Eine Woche nach Opus 5.5 schiebt Anthropic das mittlere Modell nach. Claude Sonnet 5.5 soll mehr als 30 Prozent schneller arbeiten und pro Aufgabe bis zu 30 Prozent weniger kosten. In einzelnen Tests liegt es sogar vor dem großen Bruder.
Anthropic hat Claude Sonnet 5.5 am 28. September vorgestellt. Es ist nach Claude Opus 5.5 vom 22. September das zweite Modell der 5.5-Reihe und löst das im Juni vorgestellte Claude Sonnet 5 ab. Die Eckdaten stehen in Anthropics Ankündigung zu Sonnet 5.5.
Sonnet ist die mittlere der drei Hauptlinien, zwischen dem kleinen Haiku und dem großen Opus. Darüber liegen noch die Modelle Fable und Mythos. Haiku 5.5 soll in den kommenden Wochen folgen.
Das Wichtigste in Kürze
- Sonnet 5.5 erzeugt Antworten laut Anthropic mehr als 30 Prozent schneller als Sonnet 5 und ist das bislang schnellste Sonnet-Modell.
- Die Preise pro Token bleiben gleich, weil das Modell weniger Token braucht, sinken die Kosten pro Aufgabe um bis zu 30 Prozent.
- In mehreren Tests liegt Sonnet 5.5 nahe an Opus 5.5, bei einem Programmiertest sogar davor.
- Als erstes Sonnet-Modell startet es mit denselben Schutzmechanismen für Cybersicherheit wie die größten Modelle.
Stärker bei Alltagsaufgaben und Programmierung
Anthropic positioniert Sonnet 5.5 als schnellere und günstigere Ergänzung zu Opus 5.5. Seine Stärke sieht das Unternehmen bei klar umrissenen Alltagsaufgaben: Fehler im Code beheben, Dokumente, Präsentationen und Tabellen erstellen. Dazu kommt ein Auge für Gestaltung, etwa beim Überarbeiten von Oberflächen oder beim Befüllen von Folienvorlagen.
Bei komplexer, offener Arbeit, die längeres Abwägen verlangt, bleibt Opus 5.5 nach Anthropics eigener Aussage klar vorne. Die Testergebnisse zeigen trotzdem, wie nah das mittlere Modell herangerückt ist.
| Test | Sonnet 5.5 | Sonnet 5 | Opus 5.5 |
|---|---|---|---|
| Terminal-Bench 4.0 (Programmieren im Terminal) | 70,6 % | 10,3 % | 66,4 % |
| CursorBench 4.0 (Programmieren) | 55,5 % | 34,1 % | 57,8 % |
| GDPval-AA v2.1 (Berufsaufgaben, Punkte) | 1844 | 1449 | 1846 |
| OSWorld 2.1 (Computersteuerung) | 80,1 % | 57,0 % | 81,8 % |
| Humanity’s Last Exam (mit Werkzeugen) | 64,5 % | 54,9 % | 67,7 % |
Alle Werte stammen aus Anthropics Ankündigung. Beim Terminal-Bench gibt Anthropic für Opus 5.5 den Wert bei der höchsten Aufwandsstufe an.
Gleiche Preise, weniger Verbrauch
An den Preisen pro Million Token ändert sich gegenüber Sonnet 5 nichts. Opus 5.5 kostet pro Token genau das Doppelte.
| Preis pro Million Token | Sonnet 5.5 | Opus 5.5 |
|---|---|---|
| Eingabe | 2 Dollar | 4 Dollar |
| Ausgabe | 10 Dollar | 20 Dollar |
| Cache-Schreibvorgänge | 2,50 Dollar | 5 Dollar |
| Cache-Lesevorgänge | 0,20 Dollar | 0,20 Dollar |
Die Ersparnis entsteht über den Verbrauch. Sonnet 5.5 braucht für dieselbe Arbeit deutlich weniger Token. In Anthropics Tests kostete eine Aufgabe dadurch bis zu 30 Prozent weniger als mit dem Vorgänger. Auf niedriger oder mittlerer Aufwandsstufe übertrifft das Modell in mehreren Tests das beste Ergebnis von Sonnet 5 für etwa ein Zehntel der Kosten pro Aufgabe.
Neue Schutzmechanismen
Weil die Fähigkeiten im Bereich Cybersicherheit laut Anthropic etwa auf dem Niveau von Opus 5 liegen, startet Sonnet 5.5 als erstes Sonnet-Modell mit Schutzmechanismen wie bei den leistungsstärksten Modellen. Routinearbeit wie das Finden und Beheben von Fehlern im eigenen Code bleibt möglich. Riskantere Anfragen aus dem Sicherheitsbereich fallen sichtbar auf Sonnet 5 zurück.
Neu ist außerdem ein Schutz gegen sogenannte Destillationsangriffe. Dabei versuchen Angreifer, über Tausende gefälschte Konten die Fähigkeiten eines Modells im großen Stil abzuschöpfen. Die Schutzmechanismen im Bereich Biologie bleiben gegenüber Sonnet 5 unverändert.
Wann das mittlere Modell reicht
Mit Sonnet 5.5 verschiebt sich die Grenze, ab der Opus nötig ist, deutlich nach oben. In den Berufs- und Computertests liegen beide Modelle fast gleichauf, beim Programmieren im Terminal ist Sonnet sogar vorne – bei halbem Preis pro Token. Wir erwarten, dass viele Entwickler Routinearbeit auf Sonnet verlagern und Opus für die Planung und schwierigere Entscheidungen reservieren.
Nutzt du die Claude-App auf iPhone, iPad oder Mac, läuft das Modell dort standardmäßig mit mittlerem Aufwand. Schon auf dieser Stufe übertrifft es im Terminal-Test das beste Ergebnis von Sonnet 5. Dieselbe Voreinstellung gilt in Claude Code, das iOS-Apps inzwischen direkt im Simulator testen kann.
Reicht dir für den Alltag künftig Sonnet, oder bleibt Opus dein Standardmodell? Schreib uns in die Kommentare, wofür du welches Modell einsetzt.





