Anthropic bringt mit Claude Sonnet 5.5 ein neues KI-Modell für den allgemeinen Arbeitseinsatz auf den Markt. Es soll schneller arbeiten, weniger Rechenaufwand benötigen und sich besonders bei Programmierung sowie typischen Büroaufgaben deutlich vom Vorgänger Claude Sonnet 5 absetzen. Anthropic kündigt dies in einem offiziellen Blogbeitrag an. Das Modell steht auf der eigenen Plattform sowie über Amazon Web Services, Google Cloud und Microsoft Azure bereit.
Das Unternehmen ordnet Sonnet 5.5 zwischen dem günstigeren, schnellen Haiku-Modell und dem leistungsstärkeren Opus 5.5 ein. Opus bleibt laut Anthropic für schwierige, offene Aufgaben gedacht, bei denen ein Modell über längere Zeit abwägen muss. Sonnet 5.5 richtet sich dagegen an klar umrissene Arbeiten, etwa Fehlerkorrekturen im Code, Analysen, Präsentationen, Dokumente und Tabellen.
Die Preise pro Token bleiben gegenüber Sonnet 5 unverändert. Eine Million Eingabe-Token kosten 2 US-Dollar, eine Million Ausgabe-Token 10 US-Dollar. Dennoch soll Sonnet 5.5 in der Praxis bis zu 30% günstiger pro Aufgabe sein. Anthropic begründet dies mit kürzeren Antworten, weniger Werkzeugaufrufen und einer effizienteren Bearbeitung. Die Ausgabe soll zudem mehr als 30% schneller erfolgen.
Deutlicher Sprung bei Programmieraufgaben
Besonders groß fällt der von Anthropic gemeldete Fortschritt beim Coding aus. Im Test Terminal-Bench 4.0, der mehrstufige Aufgaben in einer Kommandozeilenumgebung misst, erreicht Sonnet 5.5 laut Unternehmen 70,6%. Sonnet 5 kommt dort auf 10,3%. Für Opus 5.5 nennt Anthropic 66,4% bei der höchsten Rechenstufe.
Diese Werte bedeuten nicht automatisch, dass Sonnet 5.5 Opus generell übertrifft. Anthropic betont selbst, dass Opus 5.5 bei komplexen und wenig klar abgegrenzten Aufgaben weiterhin besser abschneide. Auf CursorBench 4.0, einem Test mit mehrdeutigen Aufgaben aus realen Programmierprojekten, erzielt Sonnet 5.5 55,5%. Opus 5.5 erreicht 57,8%, Sonnet 5 34,1%.
Nutzer können über Rechenstufen zwischen Geschwindigkeit, Kosten und Qualität wählen. Bei niedrigen Stufen antwortet das Modell schneller und verbraucht weniger Token. Höhere Stufen geben ihm mehr Zeit für Prüfung und Planung. In den Claude-Apps und in Claude Code ist Medium die Voreinstellung. Auf der Claude Platform ist es High.
Mehr Leistung bei Dokumenten und Analysen
Auch bei Wissensarbeit meldet Anthropic deutliche Fortschritte. Im Benchmark GDPval-AA, der Aufgaben aus 44 Berufen abbildet, erreicht Sonnet 5.5 einen Wert von 1844. Opus 5.5 liegt mit 1846 knapp darüber, Sonnet 5 mit 1449 deutlich darunter. Der Anbieter verweist zudem auf Verbesserungen bei Bildverständnis, Diagrammen, Computersteuerung und länger laufenden Arbeitsabläufen.
Für sensible Bereiche führt Anthropic zusätzliche Schutzmechanismen ein. Wegen verbesserter Cybersecurity-Fähigkeiten gelten für Sonnet 5.5 ähnliche Einschränkungen wie für Opus 5.5. Riskante Anfragen können auf Sonnet 5 zurückfallen. Normale Softwareentwicklung soll davon nicht betroffen sein.
Bleib auf dem Laufenden
KI für Contentprofis: die neuesten Tools, Tipps und Trends. Alle 14 Tage in deine Inbox: