Anthropic hat Claude Sonnet 5.5 veröffentlicht und hält die Tokenpreise gegenüber Sonnet 5 unverändert. Nach Angaben des Unternehmens erzeugt die neue Version Ausgaben um mehr als 30 % schneller als Sonnet 5; in eigenen Tests sanken zudem die Kosten pro Aufgabe.
Tokenpreise und Kosten pro Aufgabe
Für eine Million Eingabe-Tokens werden weiterhin 2 US-Dollar berechnet, für eine Million Ausgabe-Tokens 10 US-Dollar. Das Lesen einer Million Tokens aus dem Cache kostet 0,20 US-Dollar.
Die von Anthropic gemeldete Kostenverbesserung setzt bei der benötigten Tokenmenge an, nicht bei diesen Tarifen. In den Tests des Unternehmens lagen die Kosten pro Aufgabe um bis zu 30 % unter denen des Vorgängers. Als Ursache nennt Anthropic, dass Sonnet 5.5 für dieselbe Arbeit üblicherweise weniger Tokens verbraucht.
Benchmark-Vergleiche mit Sonnet 5 und Opus 5.5
In Anthropics Ergebnissen zum Terminal-Bench 4.0 erreicht Sonnet 5.5 einen Wert von 70,6 %, gegenüber 10,3 % für Sonnet 5 und 66,4 % für Opus 5.5. Der Test bewertet laut Unternehmen die Bearbeitung komplexer beruflicher Aufgaben mit mehreren Schritten in einer Kommandozeilenumgebung. Für Opus stammt der angegebene Wert aus der Einstellung Xhigh, mit der dieses Modell sein bestes Ergebnis erzielte.
Bei GDPval-AA v2.1 veröffentlicht Anthropic für Sonnet 5.5 einen Wert von 1844. Sonnet 5 kommt auf 1449, während Opus 5.5 mit 1846 knapp über der neuen Sonnet-Version liegt. Artificial Analysis führte GDPval-AA und AA-Briefcase auf einer Vorab-Bereitstellung von Sonnet 5.5 aus. Diese enthielt laut Anthropic einen inzwischen behobenen Fehler, der Antworten auf Anfragen mit strukturierten Ausgaben beeinträchtigen konnte.
Eine weitere Beobachtung betrifft den Aufwand, den das Modell für eine Aufgabe betreibt: Laut Anthropic schneidet Sonnet 5.5 in FrontierCode mit Max schlechter ab als mit Xhigh. Dieser Test prüft, ob sich eine Codeänderung ohne menschliche Nachbearbeitung übernehmen lässt. Änderungen außerhalb des Auftrags werden dabei negativ bewertet.
Als Erklärung nennt Anthropic den häufigeren Einsatz der Code-Review-Funktion von Claude Code bei Max. Sie verteilt die Prüfung auf mehrere Subagenten. In zwei von Cognition untersuchten Fällen führte dieser Ablauf zu einer Zeitüberschreitung oder zu zusätzlichen Änderungen außerhalb des Aufgabenrahmens und damit zu einem schlechteren Testergebnis.
Präsentationsentwurf und steuerbarer Denkaufwand
Für die Arbeit mit Unternehmensunterlagen beschreibt Anthropic einen internen Test mit einem konkreten Ablauf. Sonnet 5.5 erhielt Materialien zu den Quartalsergebnissen eines börsennotierten Unternehmens, Transkripte der zugehörigen Telefonkonferenzen und eine Präsentationsvorlage. Daraus sollte es einen zehn Folien umfassenden Überblick über die operative Entwicklung erstellen. Zwei Experten bewerteten den ersten Entwurf nach Angaben des Herstellers als ohne Änderungen versandfertig.
Wie viel Aufwand das Modell in seine Antworten investiert, lässt sich über die Effort-Einstellung steuern. In Claude Code und den Claude-Apps ist Medium voreingestellt, auf der Claude Platform dagegen High. Laut Anthropic führen niedrigere Einstellungen zu schnelleren Antworten und geringerem Tokenverbrauch; höhere Einstellungen lassen das Modell länger nachdenken und seine Arbeit gründlicher überprüfen.
Verfügbarkeit und Änderungen beim Umstieg
Sonnet 5.5 ist auf allen Plattformen von Anthropic sowie über Amazon Web Services, Google Cloud und Microsoft Azure verfügbar. Entwickler können es auf der Claude Platform über die Modellkennung claude-sonnet-5-5 ansprechen.
Für Anwendungen, die Sonnet bislang mit abgeschaltetem Thinking verwenden, ist vor dem Wechsel eine Konfigurationsänderung erforderlich. Sie müssen auf die neue Einstellung between_tools umstellen. Diese lässt das anfängliche Nachdenken des Modells weiterhin ausgeschaltet.
Außerdem erweitert Anthropic den Mechanismus preserved thinking: Der Denkverlauf bleibt an das Konto gebunden, auf dem er entstanden ist. Relevant ist die Änderung insbesondere beim Verschieben von Konversationen zwischen Konten. Dazu gehört auch ein Kontowechsel während einer laufenden Claude-Code-Sitzung.
Für risikoreichere Cybersicherheitsaufgaben kündigt Anthropic einen sichtbaren Wechsel von Sonnet 5.5 auf Sonnet 5 an; gewöhnliche Fehlersuche und Fehlerbehebung im Code sollen verfügbar bleiben. Das Unternehmen plant außerdem, sein erweitertes Cyber Verification Program für einen abgestuften Zugang zu fortgeschritteneren Fähigkeiten zu öffnen.



