Anthropic hat sein neuestes KI-Modell Claude Opus 5.5 vorgestellt. Diese neue Version wurde etwa zwei Monate nach dem letzten Upgrade des Opus-Modells veröffentlicht und entspricht dem bisherigen Upgrade-Rhythmus von Anthropic. Derzeit bietet Anthropic mehrere verschiedene KI-Modelle an, darunter Haiku (das kleinste und günstigste), Sonnet (mittelgroß und preislich im Mittelfeld) sowie Opus (das größte und teuerste der drei Modelle). Darüber hinaus gibt es Fable/Mythos, eine leistungsstarke und kostspieligere Option.
Mit dieser Veröffentlichung wird das Opus-Modell von Version 5 auf Version 5.5 aktualisiert. Anthropic gibt an, dass Opus 5.5 das erste Modell ist, das nach dem Aufruf zu bahnbrechenden Entwicklungen entstanden ist. Wie bei früheren Modellen wurde es vor der Veröffentlichung von externen Gutachtern getestet, darunter METR und Frontier Design. In unseren umfassendsten Ausrichtungstests erzielte es die bisher stärksten Ergebnisse.
Opus 5.5 zeigt signifikante Leistungssteigerungen
Anthropic beschreibt die Leistung von Opus 5.5 als einen signifikanten Fortschritt, der im Vergleich zu Opus 5 viele Verbesserungen aufweist. Es handelt sich um ein brandneues Spitzenmodell, das von frühen Testern in ihren komplexesten Aufgaben als leistungsstark wahrgenommen wurde. Ein Tester schloss in weniger als einem Tag eine Migration von 680.000 Zeilen Code ab, während diese Aufgabe normalerweise mehrere Wochen für ein Ingenieurteam in Anspruch nimmt. Es zeigte hervorragende Leistungen bei der Identifizierung und Behebung von Ineffizienzen in Software: Als wir es baten, die Ladezeiten jeder Seite einer Webanwendung zu reduzieren, war Opus 5.5 in 39 von 40 Fällen erfolgreich, während die Verbesserungen von Opus 5 geringer ausfielen und das Verhalten der Anwendung veränderten.
Ein anderer Tester ließ mehrere Claude-Modelle aus einem einzigen Prompt ein Spiel erstellen; Opus 5.5 erzielte in Bezug auf Grafik und Aussehen die höchsten Punktzahlen im Vergleich zu allen anderen Modellen.
Speziell im Bereich Codierung gibt Anthropic an, dass Opus 5.5 besonders gut für langfristige und komplexe Aufgaben geeignet ist, wie z.B. die Migration und Prüfung eines gesamten Codebestands. Ein früher Tester nutzte es, um in weniger als drei Stunden einen Codebestand von 200.000 Zeilen zu überprüfen und zu reparieren, während Opus 5 dafür über 20 Stunden benötigte und 2,5-mal so viele Tokens verwendete. In einem internen Test forderten wir Opus 5.5 und Fable 5.1 auf, die weit verbreitete Software HAProxy von C nach Rust zu übersetzen.
Beide Umschreibungen bestanden nahezu alle Regressionstests von HAProxy selbst, jedoch benötigte Opus 5.5 dafür 9,5 Stunden, während Fable 5.1 12 Stunden in Anspruch nahm, was zu einer Kostenersparnis von 51% führte. Opus 5.5 bietet bei autonomem Codieren kostengünstigere Ergebnisse auf Spitzeniveau.
Opus 5.5 bietet ein besseres Kosten-Nutzen-Verhältnis als die Vorgängerversion
Auf dem standardmäßigen Anstrengungsniveau kostet Opus 5.5 etwa 20% der Kosten von GPT-6 Astra pro Aufgabe. In den Terminal Bench 4.0 Tests zeigte es eine vergleichbare Leistung wie Astra, jedoch zu etwa 40% der Kosten, und im CursorBench-Test übertraf es GPT-5.6 Sol um 11 Punkte, bei Kosten von etwa einem Drittel. Darüber hinaus ist die Preisgestaltung von Opus 5.5 im Vergleich zu Opus 5 vorteilhafter: Opus 5.5 benötigt weniger Rechenressourcen als Opus 5, was sich auch in der Preisgestaltung widerspiegelt.
Unsere Tests zeigen, dass Opus 5.5 unter Standardbedingungen bei typischen Arbeitslasten 40% günstiger ist als Opus 5. Die Kosten für Eingabe- und Ausgabemarkierungen betragen jeweils $4 und $20 pro Million, was 20% günstiger ist als bei Opus 5. Die Kosten für Cache-Lesungen (die den Großteil der Kosten für autonome und codierende Arbeiten ausmachen) betragen $0.20 pro Million, was 60% günstiger ist als bei Opus 5. Die Ausgabegenerierungsgeschwindigkeit von Opus 5.5 ist ebenfalls über 30% schneller als die von Opus 5.
Zusätzlich zu den gesunkenen Preisen werden wir die Nutzungslimits in den Pro-, Max- und Team-Plänen um fünf Stunden erhöhen. Wir bieten auch Abonnenten eine Rücksetzung der Ratenbegrenzung an, die jetzt jederzeit gespeichert und verwendet werden kann. Das neue Claude Opus 5.5 Modell ist jetzt verfügbar. Ausblickend hat Anthropic angekündigt, dass die Modelle Claude Sonnet 5.5 und Claude Haiku 5.5 in den kommenden Wochen veröffentlicht werden, die viele der gleichen Leistungs-, Effizienz- und Sicherheitsverbesserungen aufweisen werden.
Artikel Spezifikationen Code-Migrationsfähigkeit 680.000 Zeilen Code in weniger als einem Tag abgeschlossen Code-Repository-Auditzeit 200.000 Zeilen Code in weniger als drei Stunden abgeschlossen HAProxy Übersetzungszeit 9,5 Stunden (weniger als die 12 Stunden von Fable 5.1)
Originalartikel auf techritual.com lesen (traditionelles Chinesisch) →
The TechRitual editorial desk in Hong Kong. Articles on TechRitual World are translated from the Traditional Chinese originals on techritual.com.

