AI Modelle & Releases AI First Daily · Ausgabe 105

Claude Opus 5.5: mehr Agentenleistung, 20 Prozent günstiger

Anthropic veröffentlicht Opus 5.5 – bessere Agenten-Benchmarks als das 2,5-mal teurere Fable 5.1, dazu 20 Prozent unter dem Preis von Opus 5.

Wojciech Bzumowski

Anthropic hat am 22. September Claude Opus 5.5 veröffentlicht, zwei Monate nach Opus 5. Bemerkenswert ist weniger die Leistung selbst als die Preislage: Das Modell liegt bei den Agenten-Benchmarks vor Fable 5.1, dem bisherigen Spitzenmodell des Hauses – und kostet dabei 60 Prozent weniger als dieses. Damit kehrt sich die gewohnte Logik um, nach der mehr Leistung zwangsläufig mehr kostet.

Auf einen Blick

  • Preis: 4 $ (Input) / 20 $ (Output) je Million Token – 20 % unter Opus 5, 60 % unter Fable 5.1
  • Cache-Lesezugriffe: 0,20 $ je Million Token – 60 % weniger als bei Opus 5, für das weiterhin 0,50 $ berechnet werden
  • Kontext: 1 Mio. Token, bis 128.000 Token Ausgabe je Antwort (über die Batches-API in der Beta bis 300.000)
  • Modell-ID: claude-opus-5-5
  • Verfügbar: Claude Platform API, AWS, Google Cloud, Microsoft Azure

Was das Modell in den Benchmarks leistet

Anthropic hat Opus 5.5 gegen die beiden eigenen Vorgänger gestellt. Auffällig ist der Abstand zu Fable 5.1, das bislang als leistungsfähigstes Modell des Anbieters galt und weiterhin 10 $ / 50 $ je Million Token kostet.

BenchmarkOpus 5.5Fable 5.1Opus 5
Terminal-Bench 4.066,4 %55,8 %52,3 %
FrontierCode v1.1 (Main)54,4 %50,3 %48,0 %
CursorBench 4.057,8 %51,8 %46,6 %
GDPval-AA v2.11846 Elo1735 Elo–

Dazu nennt Anthropic 67,7 % bei Humanity’s Last Exam, erzielt mit Werkzeugzugriff, und 81,8 % bei OSWorld 2.0 als Teilpunktwertung – dort zählt der Anteil erfüllter Prüfpunkte, nicht der vollständig gelösten Aufgaben. Einzuordnen ist das mit der üblichen Zurückhaltung: Es handelt sich um herstellereigene Messungen, unabhängige Prüfungen stehen noch aus.

Der eigentliche Hebel liegt nicht im Listenpreis

Die 20 Prozent Preissenkung gegenüber Opus 5 sind die kleinere Hälfte der Rechnung. Zwei andere Posten wiegen im Betrieb schwerer.

Erstens der Cache: Lesezugriffe auf zwischengespeicherten Kontext kosten 0,20 $ je Million Token und damit 60 Prozent weniger als bei Opus 5, für das weiterhin 0,50 $ berechnet werden. Bei Agenten, die denselben Systemkontext über viele Durchläufe wiederverwenden, ist genau das häufig der größte Einzelposten der Rechnung – nicht die eigentliche Ein- und Ausgabe.

Zweitens der Tokenverbrauch: Laut Anthropic kosten typische Arbeitslasten bei Standardeinstellungen rund 40 Prozent weniger als mit Opus 5 – das Modell kostet weniger je Token und braucht zugleich weniger Token je Aufgabe. Zusammen ist das deutlich mehr, als die Preisliste allein hergibt. Die Ausgabe erfolgt zudem über 30 Prozent schneller als bei Opus 5.

Angeführte Praxisbeispiele

  • Migration von 680.000 Zeilen Code in unter einem Tag
  • Audit einer Codebasis mit 200.000 Zeilen in unter drei Stunden – Opus 5 benötigte über 20 Stunden und 2,5-mal so viele Token
  • Übersetzung von HAProxy aus C nach Rust in 9,5 Stunden statt 12 Stunden mit Fable 5.1, zu 51 % geringeren Kosten

In einer eigens dafür entwickelten Prüfung zu Eindämmungsgrenzen versuchte das Modell nach Unternehmensangaben rund 85 Prozent seltener als Opus 5, gesetzte Grenzen zu umgehen; die verbliebenen Versuche stuft Anthropic als geringfügig ein und gibt an, das Modell habe sie selbst gemeldet. Davon getrennt steht der automatisierte Verhaltensaudit, der knapp 2.000 Szenarien abdeckte und den Anthropic als seine bislang umfassendste Alignment-Prüfung bezeichnet.

Was sich für bestehende Integrationen ändert

Wer bereits mit der Schnittstelle arbeitet, sollte vor dem Wechsel vier Punkte prüfen. Das Nachdenken des Modells ist dauerhaft aktiv und wird nicht mehr über ein Token-Budget, sondern über den Parameter effort gesteuert. Erzwungene Werkzeugaufrufe werden nicht mehr unterstützt und enden mit einer Fehlermeldung; zulässig bleiben der Standard auto und none. Denkblöcke sind an das erzeugende Modell gebunden: Opus 5.5 liest die Blöcke von Opus 5 sowie älteren Opus-, Sonnet- und Haiku-Modellen, nicht aber die von Fable- oder Mythos-Modellen – was das Zielmodell nicht lesen kann, verwirft die Schnittstelle stillschweigend, ohne die Anfrage scheitern zu lassen. Und die ältere Variante des Computer-Use-Werkzeugs computer_20251124 wird über die Claude-API und bei Google Cloud abgelehnt, während sie auf Amazon Bedrock unverändert funktioniert.

Keiner dieser Punkte ist aufwendig zu beheben. Sie fallen aber in bestehenden Integrationen auf, sobald man die Modellkennung austauscht – ein reiner Ein-Zeilen-Wechsel ist es nicht.

Was das für den Mittelstand am Niederrhein bedeutet

Für Unternehmen, die KI bislang nur im Chatfenster nutzen, ändert dieses Release wenig. Relevant wird es dort, wo KI dauerhaft im Hintergrund arbeitet: in Automatisierungen, die Dokumente prüfen, Anfragen vorsortieren oder Daten zwischen Systemen übertragen. Genau bei diesen Dauerläufern entscheidet der Preis je Durchlauf darüber, ob sich ein Anwendungsfall rechnet – und dieser Preis ist gerade spürbar gefallen.

Konkret heißt das: Automatisierungen, die vor einem halben Jahr noch an den laufenden Kosten gescheitert sind, sollten Sie neu durchrechnen. Ein Vorgang, der damals 40 Cent gekostet hat, liegt heute bei einem Bruchteil davon. Das verschiebt die Schwelle, ab der sich ein Prozess automatisieren lässt, deutlich nach unten – vor allem bei Aufgaben mit hohem Volumen und geringem Einzelwert.

Zwei Dinge bleiben davon unberührt. Erstens ist das leistungsfähigste Modell selten das wirtschaftlichste: Für Klassifizierung, Textextraktion und einfache Zuordnungen bleiben kleinere Modelle die günstigere Wahl, und der Abstand ist erheblich. Zweitens entscheidet über den Nutzen einer Automatisierung nicht das Modell, sondern der Prozess dahinter – saubere Daten, klare Zuständigkeiten, ein definierter Weg für Fälle, die das System nicht sicher entscheiden kann. Ein besseres Modell verkürzt die Laufzeit. Einen unklaren Prozess repariert es nicht.

Quellen

  • Anthropic: Introducing Claude Opus 5.5 (22.09.2026)
  • VentureBeat (22.09.2026)
  • TechCrunch (22.09.2026)

Zusammenfassung und Einordnung durch die AI First Redaktion auf Basis der genannten Quellen.

Erstgespräch

Wo lohnt sich KI in Ihrem Unternehmen?

Lassen Sie uns gemeinsam herausfinden, wo KI Ihre Prozesse sinnvoll automatisieren kann. Kostenlos und unverbindlich.

Noch unentschlossen? Kostenlose Checkliste ansehen →

Erstgespräch buchen