Anthropic hat am 22. September 2026 Claude Opus 5.5 veröffentlicht, das erste Modell der 5.5-Familie. Die Ankündigung stellt weniger einen Rekordwert in den Vordergrund als die Kosten pro Aufgabe: Bei einer Qualität, die bei den meisten Aufgaben mit Fable 5.1 vergleichbar ist, senkt Opus 5.5 die Kosten bei typischen agentischen Arbeitslasten um 40 Prozent, bei einer mehr als 30 Prozent schnelleren Ausgabe.
API-Preise deutlich gesenkt
Der API-Preis sinkt von 5 $ / 25 $ (Eingabe / Ausgabe, pro Million Token) bei Opus 5 auf 4 $ / 20 $ bei Opus 5.5, ein Rückgang von 20 Prozent an beiden Enden. Das Lesen aus dem Cache fällt von 0,50 $ auf 0,20 $ pro Million Token, eine Senkung um 60 Prozent, die sich direkt auf Agenten-Architekturen mit langem Kontext und vielen wiederholten Aufrufen auswirkt. Zusätzlich gibt es einen schnellen Modus für 8 $ / 40 $ pro Million Token mit einer 2,5-fachen Geschwindigkeitssteigerung für latenzempfindliche Anwendungen.
| Posten | Opus 5 | Opus 5.5 | Veränderung |
|---|---|---|---|
| Eingabe (pro Mio. Token) | 5 $ | 4 $ | -20 % |
| Ausgabe (pro Mio. Token) | 25 $ | 20 $ | -20 % |
| Cache-Lesezugriff (pro Mio. Token) | 0,50 $ | 0,20 $ | -60 % |
| Typische Kosten agentischer Arbeitslast | Referenzwert | -40 % | -40 % |
Fortschritte konzentrieren sich auf Code und lange Aufgaben
Die von Anthropic veröffentlichten Benchmarks zeigen einen deutlichen Sprung bei entwicklungsorientierten Aufgaben: Terminal-Bench 4.0 steigt von 52,3 % auf 66,4 %, FrontierCode v1.1 von 48,0 % auf 54,4 % und CursorBench 4.0 von 46,6 % auf 57,8 %. Bei OSWorld 2.0, das die vollständige Computerbedienung bewertet, klettert der Wert von 74,0 % auf 81,8 %.
In von Anthropic genannten Praxisfällen schloss ein Tester eine Migration von 680.000 Codezeilen in weniger als einem Tag ab, und die Portierung eines veralteten HAProxy-Proxys von C nach Rust dauerte 9,5 Stunden statt 12 Stunden mit Fable 5.1, eine Verbesserung um 51 Prozent. Ein Code-Audit über 200.000 Zeilen, das zuvor mehr als 20 Stunden beanspruchte, ist jetzt in unter drei Stunden erledigt.
Bei einer Qualität, die bei den meisten Aufgaben mit Fable 5.1 vergleichbar ist, senkt Opus 5.5 die typischen Kosten agentischer Arbeitslasten um 40 Prozent und erzeugt Ausgaben mehr als 30 Prozent schneller.
Integration bei Agenten und Tools
Anthropic hebt eine Reduzierung der Anzahl von Tool-Aufrufen und Schritten hervor, die zur Erledigung einer Aufgabe nötig sind, was die Kosten für Agenten-Architekturen mit vielen aneinandergereihten Aufrufen direkt senkt, ein Thema, das Mail Studio bereits im Zusammenhang mit redaktionellen Agenten in Produktion behandelt hat. GitHub, in der Ankündigung zitiert, berichtet von Aufgaben, die in halb so vielen Schritten erledigt wurden. Das Modell delegiert zudem besser an Subagenten in mehrstufigen Abläufen, was agentische Anwendungsfälle näher an die Interoperabilitätslogik der MCP-Spezifikation heranrückt.
import anthropic
client = anthropic.Anthropic()
response = client.messages.create(
model="claude-opus-5-5",
max_tokens=4096,
messages=[{"role": "user", "content": "Pruefe dieses Modul und liste wahrscheinliche Regressionen auf."}],
)
print(response.content[0].text)Der Denkmodus («thinking») lässt sich bei Opus 5.5 nicht mehr deaktivieren, anders als bei früheren Versionen. Integrationen, die zur Latenzreduzierung auf einen Modus ohne Denkschritt gesetzt haben, müssen ihre Timeouts und die Verarbeitung des Ausgabestroms vor dem Produktivumzug neu kalibrieren.
Verfügbarkeit
Das Modell ist über die Claude-API sowie über Amazon Web Services, Google Cloud und Microsoft Azure unter der Kennung claude-opus-5-5 verfügbar. Anthropic gibt an, das Modell vor der Veröffentlichung von externen Organisationen wie METR und Frontier Design haben evaluieren zu lassen. Mail Studio verfolgt die professionellen Einsatzmöglichkeiten von KI in der Entwicklung im Leitfaden KI für Webentwickler.
Was man sich merken sollte
Opus 5.5 jagt nicht um jeden Preis Rohwert-Rekorde gegenüber früheren Generationen, sondern zielt darauf ab, Kosten und Zeit für ein gleichwertiges Ergebnis zu senken, insbesondere bei Programmieraufgaben und langen agentischen Abläufen. Die Preissenkung bei der API unterstreicht diese Positionierung und macht den Produktivbetrieb für Teams mit vielen aneinandergereihten Aufrufen tragfähiger.
Was mir an dieser Ankündigung am meisten auffällt, ist die Verschiebung der Kommunikation: Zwei Jahre lang haben Labore mit Benchmark-Werten geworben, hier wirbt Anthropic mit Kosten pro tatsächlich erledigter Aufgabe. Das ist die richtige Kennzahl für alle, die Agenten produktiv einsetzen, und sie lässt sich schwerer schönreden als eine Leaderboard-Zahl. Bleibt zu prüfen, ob sich das Verhältnis von Qualität zu Kosten bei meinen eigenen Arbeitslasten über die Zeit hält und nicht nur bei Demo-Fällen — Simon Janvier.
Zum Weiterlesen: Die vollständige Ankündigung ist verfügbar unter anthropic.com/news.
