Claude Sonnet 4.5 ist da: Neue Pacman-Herausforderung
Ich habe Anthropics neuestes Claude Sonnet 4.5 Modell mit derselben Pacman-Herausforderung getestet. Anders als Opus 4.1 und GPT-5 hat es beim ersten Versuch nicht perfekt funktioniert—aber der Wettbewerb macht es spannend.
Kemal Esensoy·aktualisiert am October 1, 2025
Anthropics neuestes Modell gegen seinen Vorgänger und die Konkurrenz
Das KI-Rennen heizt sich weiter auf. Direkt nach meinem GPT-5 vs Claude Opus 4.1 Vergleich hat Anthropic Claude Sonnet 4.5 veröffentlicht, und natürlich musste ich es derselben Pacman-Herausforderung unterziehen.
Der übliche Hinweis: Dies ist kein wissenschaftlicher Vergleich. Es ist einfach eine unterhaltsame Art, zu erkunden, was diese Modelle können, und ehrlich gesagt liebe ich es, diesen Wettbewerb zu beobachten.
Die Herausforderung erneut
Dieselben Regeln wie zuvor: Erstelle ein funktionales Pacman-Spiel aus einem einzigen Prompt, keine Nachfragen, keine Korrekturen. Nur reine Ausführung beim ersten Versuch.
Die Ergebnisse
Hier wurde es interessant. Anders als seine Geschwister Opus 4.1 und GPT-5, die beide beim ersten Versuch perfekt ablieferten, hatte Sonnet 4.5 einige Probleme:
Was schief ging:
- Pacman erschien innerhalb einer Wand
- Die Spielgeschwindigkeit war extrem schnell, was es nahezu unspielbar machte
- Alles andere funktionierte korrekt
Was gut lief:
- Kern-Spielmechaniken waren implementiert
- Visuelle Elemente wurden korrekt gerendert
- Die Gesamtstruktur war solide
Vergleich auf einen Blick
| Modell | Erfolg beim ersten Versuch | Bemerkenswerte Probleme |
|---|---|---|
| GPT-5 | ✅ Ja | Keine |
| Claude Opus 4.1 | ✅ Ja | Keine |
| Claude Sonnet 4.5 | ⚠️ Teilweise | Spawn-Position, Geschwindigkeitsbalance |
Was uns das sagt
Sonnet 4.5 ist als Anthropics effizientestes Alltagsmodell positioniert, optimiert für Geschwindigkeit und Routineaufgaben. Diese Pacman-Herausforderung, obwohl alles andere als wissenschaftlich, deutet darauf hin, dass es möglicherweise Kompromisse zwischen Effizienz und der akribischen Detailgenauigkeit gibt, die Opus 4.1 demonstrierte.
Allerdings sind dies kleinere Probleme, die mit einem einzigen Follow-up-Prompt trivial zu beheben wären. Das Modell hat die Aufgabe eindeutig verstanden und ein größtenteils funktionales Spiel geliefert.
Das große Ganze
Was mich am meisten begeistert, ist nicht die Ausrufung eines Gewinners, sondern zu beobachten, wie schnell sich diese Technologie entwickelt. Wir haben jetzt mehrere KI-Modelle, die eine einfache Anfrage in spielbare Spiele verwandeln können. Die Unterschiede zwischen ihnen werden nuancierter, mehr über Stil und Ansatz als über Fähigkeiten.
Der Wettbewerb zwischen OpenAI und Anthropic treibt beide Unternehmen zu schnellerer Innovation, und wir alle profitieren davon.
Haben Sie Sonnet 4.5 schon ausprobiert? Was sind Ihre Erfahrungen?
Über den Autor
Kemal Esensoy
Kemal Esensoy, Gründer von Wunderlandmedia, begann seine Karriere als freiberuflicher Webentwickler und Designer. Er führte Web-Design-Kurse mit über 3.000 Studenten durch. Heute leitet er eine preisgekrönte Full-Stack-Agentur, die sich auf Webentwicklung, SEO und digitales Marketing spezialisiert hat.