Anthropic hat mit Claude Sonnet 5.5 ein neues Modell veröffentlicht, das im unabhängigen Artificial Analysis Intelligence Index sogar vor OpenAIs Flaggschiff GPT-6 Astra landet – mit einem Haken beim Rechenaufwand.
Das Thema kurz und kompakt
- Claude Sonnet 5.5 läuft laut Anthropic über 30 % schneller und kostet bis zu 30 % weniger pro Aufgabe als der Vorgänger Sonnet 5.
- Im unabhängigen Artificial Analysis Intelligence Index erreicht Sonnet 5.5 56 Punkte – Platz zwei hinter dem eigenen Flaggschiff Opus 5.5 (58) und vor GPT-6 Astra (53).
- Der Haken: Bei maximaler Rechenintensität verbraucht Sonnet 5.5 mit rund 193.000 Output-Token pro Aufgabe so viele Token wie kein von Artificial Analysis bislang gemessenes Modell – siebenmal so viele wie GPT-6 Astra.
- Die Preise pro Token bleiben gegenüber Sonnet 5 unverändert, die Kosten pro vollständiger Aufgabe im Intelligence Index steigen dadurch trotzdem um rund 50 % auf 7,60 US-Dollar.
- Wer verstehen möchte, wie sich Leistung, Geschwindigkeit und Kosten bei der Wahl eines KI-Modells sinnvoll gegeneinander abwägen lassen, findet in der KI Prompt Engineering-Weiterbildung von Distart die passende Grundlage.
Ein deutlicher Sprung gegenüber dem Vorgänger
Sonnet 5.5 ist das zweite Modell der Claude-5.5-Familie und positioniert sich als schnellere, günstigere Ergänzung zum Spitzenmodell Opus 5.5 – gedacht für klar umrissene Alltagsaufgaben, Bugfixes und das Erstellen von Dokumenten, Präsentationen und Tabellen. Im Coding-Test Terminal-Bench 4.0 erreicht Sonnet 5.5 70,6 Prozent, gegenüber nur 10,3 Prozent beim Vorgänger. Bei Wissensarbeit (GDPval-AA) liegt es mit 1.844 Punkten fast gleichauf mit Opus 5.5 (1.846) und rund 400 Punkte über Sonnet 5. Auch bei der Bildverarbeitung markiert das Modell einen Meilenstein: Es ist das erste Sonnet-Modell, das Pokémon Rot allein anhand von Screenshots durchspielen kann.
Mehrere Unternehmen, die das Modell vorab getestet haben, berichten von spürbaren Verbesserungen: Der Finanzdienstleister Balyasny Asset Management maß bei 2.441 eigenen Finanzaufgaben einen Rückgang des Token-Verbrauchs von 497.000 auf rund 121.000 Token pro Antwort, bei gleichzeitig besseren Ergebnissen. Der Support-Anbieter Zendesk berichtet von 20 Prozent schnellerer Ticket-Bearbeitung, Slack von rund 14 Prozent weniger benötigten Output-Token in eigenen Tests.
Der Haken: Rekordverbrauch an Token bei Höchstleistung
Der unabhängige Benchmark-Anbieter Artificial Analysis ordnet die Leistung differenzierter ein. Im Intelligence Index erreicht Sonnet 5.5 bei maximaler Rechenintensität 56 Punkte – zwei hinter Opus 5.5, aber vor GPT-6 Astra (53) und dem direkt vergleichbaren GPT-6 Sol (48). Um dieses Ergebnis zu erzielen, generiert Sonnet 5.5 im höchsten Denkmodus laut Artificial Analysis rund 193.000 Output-Token pro Aufgabe – der höchste Wert, den die Analysefirma je gemessen hat, etwa 60 Prozent mehr als Opus 5.5 und siebenmal so viel wie GPT-6 Astra.
Die Token-Preise selbst bleiben gegenüber Sonnet 5 unverändert bei 2 US-Dollar pro Million Eingabe- und 10 US-Dollar pro Million Ausgabe-Token. Durch den hohen Verbrauch steigen die tatsächlichen Kosten pro vollständiger Aufgabe im Intelligence Index aber auf rund 7,60 US-Dollar – etwa 50 Prozent mehr als bei Sonnet 5, und mehr als bei Opus 5.5 (5,98 US-Dollar) oder GPT-6 Astra (3,26 US-Dollar). Bei niedrigeren, alltagstauglicheren Denkstufen fällt dieser Effekt deutlich geringer aus: Anthropic setzt deshalb in den Claude-Apps und in Claude Code standardmäßig eine mittlere Rechenintensität an, auf der Claude Platform eine hohe.
Fazit
- Claude Sonnet 5.5 läuft über 30 % schneller und kostet pro Token bis zu 30 % weniger als der Vorgänger
- Im unabhängigen Intelligence Index landet es vor GPT-6 Astra, allerdings mit dem bislang höchsten gemessenen Token-Verbrauch bei maximaler Rechenintensität
- Bei niedrigeren, alltagstauglichen Denkstufen bleibt das Kosten-Leistungs-Verhältnis deutlich günstiger






