Anthropic hat Opus 5.5 mit niedrigeren Token-Preisen, schnellerer Ausgabe und behaupteten Ergebnissen auf Fable-Niveau vorgestellt und damit die Messlatte für effiziente Enterprise-KI höher gelegt.

Anthropic hat Claude Opus 5.5 veröffentlicht, ein neues Flaggschiffmodell, das nach Angaben des Unternehmens bei vielen Aufgaben mit dem leistungsfähigeren System Fable 5.1 mithalten oder es übertreffen soll, während es im Betrieb weniger kostet. Mit dem Start erhalten Entwickler Zugang zu einem schnelleren und günstigeren Modell der Spitzenklasse – zu einem Zeitpunkt, an dem Käufer von KI die Fähigkeiten gegen die Inferenzkosten abwägen.
Opus 5.5 ist ab sofort über Anthropics Dienste und große Cloud-Plattformen verfügbar. Das Unternehmen sagt außerdem, es habe den Schreibstil des Modells verbessert, Fachjargon reduziert und wichtige Informationen in Antworten weiter nach vorne gerückt. Diese Änderungen zielen auf eine wiederkehrende Beschwerde über formelhafte oder übermäßig ausgearbeitete Ausgaben früherer Claude-Modelle.
Anthropic beziffert Opus 5.5 mit 4 Dollar pro Million Eingabetokens und 20 Dollar pro Million Ausgabetokens, nach 5 beziehungsweise 25 Dollar für Opus 5. Das Unternehmen sagt außerdem, die Kosten für Cache-Reads seien um 60 Prozent gesunken. TechCrunch berichtete den Ausgabepreis als Senkung von 25 auf 20 Dollar pro Million Tokens und merkte an, dass das neue Modell weniger Rechenleistung für den Betrieb benötigt.
Anthropic schätzt, dass die gesamten Betriebskosten unter Einbeziehung der Token-Nutzung etwa 40 Prozent niedriger ausfallen sollten als bei Opus 5. Diese weiter gefasste Schätzung spiegelt die behauptete Fähigkeit des Modells wider, weniger Tokens zu verwenden, sowie eine mehr als 30 Prozent schnellere Ausgabe. Der Unterschied ist für Produktionsteams wichtig: Niedrigere Listenpreise garantieren nicht automatisch niedrigere Rechnungen, wenn ein Modell bei schwierigen Aufgaben deutlich mehr Tokens verbraucht.
Die Nutzungsgrenzen für fünfstündige Sitzungen für Abonnenten sollen laut der Darstellung von Anthropics Ankündigung durch The Decoder um 20 Prozent steigen. Anthropic sagt, dass die Kombination aus höheren Grenzen und niedrigeren Nutzungskosten die praktische Kapazität um etwa 25 Prozent erweitern sollte.
Das Modell ist auf der Claude Platform mit der Modell-ID claude-opus-5-5 verfügbar, ebenso über Amazon Web Services, Google Cloud und Microsoft Azure. Diese Verteilung gibt Enterprise-Teams mehr Möglichkeiten, das Modell in bestehende Cloud-, Compliance- und Beschaffungssysteme zu integrieren.
Anthropic beschreibt Opus 5.5 als das bislang leistungsstärkste Modell des Unternehmens und sagt, es erreiche bei den meisten Aufgaben Claude Fable 5.1. In den Vergleichen wird das neue Modell zudem bei mehreren Tests vor OpenAI’s GPT-6 Astra eingeordnet, trotz eines niedrigeren Listenpreises. Dabei handelt es sich um vom Anbieter gemeldete Behauptungen, die nicht als unabhängige Bestätigung einer allgemeinen Überlegenheit zu verstehen sind.
The Decoder berichtete detaillierter über Anthropics Coding-Vergleiche. Bei FrontierCode, so das Unternehmen, schlägt Opus 5.5 GPT-6 Astra bei etwa 20 Prozent der Kosten pro Aufgabe. Bei Terminal-Bench 4.0 behauptet Anthropic eine vergleichbare Leistung bei 40 Prozent der Kosten von Astra, während es bei CursorBench einen Vorsprung von 11 Punkten gegenüber GPT-5.6 Sol bei einem Drittel der Kosten meldet.
Es gibt eine gewisse externe Unterstützung für die Benchmark-Position des Modells. Artificial Analysis, eine von The Decoder zitierte unabhängige Plattform, vergab Opus 5.5 im Intelligence Index bei maximalem Aufwand eine Punktzahl von 58 – der höchste zu diesem Zeitpunkt auf dem Index verzeichnete Wert. Zudem wurden führende Ergebnisse in sechs von zehn Bewertungen gemeldet, darunter Humanity’s Last Exam und SciCode.
Dieselbe Analyse identifizierte jedoch einen Effizienzkompromiss. Bei maximalem Aufwand erzeugte Opus 5.5 Berichten zufolge etwa 119.000 Ausgabe-Tokens pro Aufgabe, verglichen mit 73.000 bei Opus 5, 78.000 bei Fable 5.1 und 27.000 bei GPT-6 Astra. Niedrigere Token-Preise können diese Nutzung in einigen Workloads ausgleichen, aber das Modell ist nicht notwendigerweise bei jeder einzelnen Aufgabe günstiger.
Anthropic sagt, Opus 5.5 verwende seltener Fachjargon, beginne eher mit den wichtigsten Informationen und befolge Schreibanweisungen besser. Frühe Tester, die von The Decoder beschrieben wurden, fanden die Ausgabe klarer, doch diese Eindrücke bleiben begrenzt und sind kein Ersatz für kontrollierte Evaluierungen über reale Workflows hinweg.
Die Veröffentlichung erweitert außerdem die Sicherheitskontrollen, die auf Anthropics leistungsfähigste Modelle angewendet werden. Opus 5.5 erhält Schutzmaßnahmen, die mit Fable 5.1 für Cybersicherheit, Biologie und Frontier-AI-Entwicklung vergleichbar sind. Anthropic sagt, Anfragen, die diese Kontrollen auslösen, könnten an ein anderes Modell weitergeleitet werden. Der Großteil der markierten Cybersicherheitsarbeit werde Berichten zufolge an Opus 4.8 geleitet, während bestimmte Bio- und Frontier-Entwicklungsanfragen an Opus 5 gehen.
Verifizierte Organisationen können über Anthropics Life Sciences Verification Program Zugang für biologische Forschung beantragen. Das Unternehmen plant, sein Cyber Verification Program auf Opus 5.5 auszuweiten. Das Modell enthält außerdem „Preserved Thinking“, das API-Nutzern verbietet, früheren Kontext zu bearbeiten, um Schlussfolgerungen zu extrahieren, sowie Wasserzeichenmaßnahmen, die laut Beschreibung die Einhaltung des EU AI Act unterstützen.
Anthropic sagt, Opus 5.5 sei vor der Veröffentlichung von METR und Frontier Design evaluiert worden. Das Unternehmen bereitet außerdem strengere Prüfungen für Reinforcement-Learning-Umgebungen, stärkere Überwachung und automatisierte Sicherheitstrainingsszenarien vor. Diese Pläne sind wichtig, sie beschreiben jedoch laufende Arbeit und keinen Beweis dafür, dass alle Risiken der Ausrichtung oder des Missbrauchs gelöst sind.
Für Software-Teams liegt die wichtigste Chance nicht nur im Zugang zu einer höheren Benchmark-Punktzahl. Ein Modell, das starke Coding- und Wissensarbeitsleistung mit niedrigeren veröffentlichten Preisen verbindet, könnte längere KI-Agenten praktischer machen, insbesondere für Code-Reviews, Debugging, Dokumentation, Recherche und interne Analysen.
Das Kostenbild hängt stark von den Efforteinstellungen, dem Prompt-Design, der Wiederverwendung von Kontext und der Ausgabelänge ab. Die Zahlen von Artificial Analysis deuten darauf hin, dass Opus 5.5 bei maximalem Aufwand weit mehr Tokens verbrauchen kann als konkurrierende Systeme. Teams sollten daher die Kosten pro abgeschlossenem Workflow testen und nicht nur die Token-Preise vergleichen.
Für Unternehmenskunden kann die Verfügbarkeit über die Claude Platform, Amazon Web Services, Google Cloud und Microsoft Azure die Bereitstellung erleichtern. Käufer müssen jedoch weiterhin Latenz, Optionen zur Datenaufbewahrung, Routing-Verhalten beim Greifen von Schutzmaßnahmen und die Zuverlässigkeit des Modells bei ihren eigenen Dokumenten und Tools validieren. Anthropics Behauptungen über klareres Schreiben könnten in langen Sitzungen wichtig sein, sollten aber mit bestehenden Modellen gemessen und nicht einfach angenommen werden.
Anthropics Veröffentlichung verschärft zudem den Wettbewerb unter Premium-Modellen. Das Unternehmen positioniert Opus 5.5 gegen Fable 5.1 und GPT-6 Astra und reagiert zugleich auf günstigere Alternativen, darunter chinesische Modelle, die The Decoder als leistungsschwächer bei deutlich niedrigeren Preisen beschrieb. Die nächste Wettbewerbsphase könnte ebenso stark durch Kosten pro erfolgreicher Aufgabe und Bereitstellungskontrollen wie durch die Schlagzeilen-Führung in Benchmarks entschieden werden.
Das unmittelbare Signal wird sein, ob unabhängige Bewertungen Anthropics gemeldete Gewinne bei Coding, agentischer Arbeit und Geschäftsanwendungen reproduzieren. Die tatsächlichen Kundenkosten werden ein weiterer wichtiger Test sein, insbesondere bei maximalen Workloads, die große Ausgaben erzeugen.
Anthropic sagt, dass Sonnet 5.5 und Haiku 5.5 in den kommenden Wochen mit ähnlichen Verbesserungen bei Leistung, Effizienz und Sicherheit erscheinen werden. Deren Preisgestaltung und Fähigkeiten werden zeigen, ob die Opus-Änderungen eine breitere Neugestaltung der Modellfamilie oder vor allem ein Flaggschiff-Upgrade darstellen.
Entwickler sollten auch den Rollout des Cyber Verification Program, Änderungen beim Routing des Modells unter Sicherheitskontrollen und weitere Details zu Anthropics Überwachungs- und Anti-Distillation-Maßnahmen beobachten. Diese Richtlinien könnten beeinflussen, welche Forschungs- und Sicherheits-Workflows direkt auf Opus 5.5 laufen können.
Opus 5.5 ist bedeutsam, weil Anthropic Effizienz als Teil der Leistungsfähigkeit verkauft und nicht als Kompromiss dagegen. Die gemeldeten Ergebnisse des Unternehmens deuten darauf hin, dass Premium-KI-Produkte sich einem praktikableren Maßstab nähern: den Kosten und der Zuverlässigkeit für den Abschluss eines gesamten Workflows.
Die Evidenz ist vielversprechend, wird aber noch stark von Anthropics eigenen Benchmarks und Testentscheidungen geprägt. Für Entwickler und Käufer ist die vernünftige Reaktion eine gezielte Evaluierung: erfolgreiche Aufgabenerledigung, Token-Verbrauch, Latenz, Sicherheits-Routing und Anforderungen an menschliche Bearbeitung auf repräsentativen Arbeitsabläufen messen, bevor die behauptete Senkung der Betriebskosten um 40 Prozent als Produktionsfakt betrachtet wird.