KI

Claude Opus 5.5: 40 % günstiger und schneller, während Anthropic zur Vorsicht mahnt

Susan Hill
Fügen Sie uns bei Google hinzu

Claude Opus 5.5 tut etwas, das Anthropics bisherige Modelle nicht taten: Es kostet weniger und läuft schneller, während es ein größeres, teureres System einholt oder übertrifft. Das Modell meistert agentisches Codieren, Computernutzung, Diagrammlesen und multidisziplinäre Argumentation auf einem Niveau, das laut Anthropics eigenen Daten das von Claude Fable 5.1 – dem bisher leistungsfähigsten Modell des Unternehmens – in mehreren Bereichen übersteigt. Für Menschen und Entwickler, die Opus 5 als nützlich, aber teuer empfanden, hat sich der Abstand zwischen dem, was das Modell kann, und dem, was es kostet, deutlich verschoben.

Der Preisunterschied ist konkret. Opus 5.5 verlangt 4 Dollar pro Million Input-Token und 20 Dollar pro Million Output-Token; Opus 5 kostete 5 bzw. 25 Dollar. Gecachte Lesevorgänge sinken von 0,50 auf 0,20 Dollar pro Million Token. Laut Anthropic sind typische Arbeitslasten insgesamt rund 40 Prozent günstiger. Die Geschwindigkeit geht in die gleiche Richtung: Das Standardmodell generiert Text mehr als 30 Prozent schneller als Opus 5. Eine separate Fast-Mode-Option, die bei 8 Dollar Input und 40 Dollar Output pro Million Token liegt, erreicht bis zu 2,5-fache Geschwindigkeit des Standard-Opus-5 – eine nützliche Einstellung für latenzempfindliche Anwendungen.

Anthropics veröffentlichte Leistungsdaten setzen Opus 5.5 bei vier von sechs Benchmarks vor Fable 5.1, Opus 5 und GPT-6 Astra. Bei Terminal-Bench 4.0, der die Codeausführung in einer Live-Terminal-Umgebung testet, erreicht Opus 5.5 66,4 Prozent gegenüber 55,8 Prozent von Fable 5.1. Bei Humanity’s Last Exam, einem Test, der akademisches und berufliches Wissen über Disziplinen hinweg abdeckt, liegt das Ergebnis bei 67,7 Prozent gegenüber 65,6 Prozent. OSWorld 2.0, das die Bedienung von Computerschnittstellen misst, zeigt 81,8 Prozent gegenüber 80,7 Prozent. Ein Deloitte-Test ergab, dass Opus 5.5 bei niedrigster Aufwandsstufe 72 Prozent der bekannten Programmierfehler in der Überprüfung erkannte, gegenüber 56 Prozent bei Opus 5 mit hohem Aufwand. Diese Zahlen stammen von Anthropic und ausgewählten Partnern; angegebene Fehlermargen liegen zwischen ±1,6 und ±5 Prozentpunkten, und zum Start wurde keine unabhängige Überprüfung durch Dritte veröffentlicht.

Zwei Bereiche durchbrechen das Muster. Bei AutomationBench erreicht GPT-6 Astra 41,4 Prozent zu Opus 5.5s 40,0 Prozent. Bei Terminal-Bench-Science ist die Lücke größer: Astra kommt auf 64,6 Prozent, während Opus 5.5 bei 58,7 Prozent landet. Beide Unterschiede liegen innerhalb der angegebenen Fehlermargen – es könnte Rauschen sein – aber es könnte auch nicht so sein. Anthropic führt diese Zeilen in der eigenen veröffentlichten Tabelle auf, was mehr ist, als die meisten KI-Unternehmen beim Start tun. Die Zahlen bedürfen noch unabhängiger Prüfung, bevor sie als endgültig betrachtet werden können.

In Sachen Sicherheit gibt Anthropic an, dass Opus 5.5 vor der Veröffentlichung von externen Teams, darunter METR, evaluiert wurde. In der unternehmenseigenen internen Verhaltensprüfung – fast 2.000 Szenarien, die testen, ob das Modell versucht, ihm auferlegte Einschränkungen zu umgehen – wird Opus 5.5 als 85 Prozent weniger wahrscheinlich beschrieben, solche Umgehungsversuche zu unternehmen, als Opus 5. Stärkere Modelle neigen dazu, eher Lösungen für Umgehungen zu finden, was die Verbesserung bedeutsam macht, sofern sie Bestand hat. Die tatsächliche Bewährungsprobe wird der Einsatz in der Praxis sein.

Was diesen Launch ungewöhnlich macht, ist sein Zeitpunkt. Anfang dieses Monats veröffentlichte Anthropic-CEO Dario Amodei einen Essay, in dem er schrieb, er sei zu der Überzeugung gelangt, dass die vollständige Bewältigung von KI-Risiken erfordere, „die Geschwindigkeit des Fähigkeitsfortschritts so zu drosseln, dass die Risikoprävention Zeit hat, Schritt zu halten.“ Sam Altman von OpenAI und Elon Musk stimmten der grundsätzlichen Besorgnis zu. Jensen Huang von Nvidia sagte, die zugrundeliegende Wissenschaft stütze dies nicht. Und dann brachte Anthropic ein Modell heraus, das schneller, günstiger und leistungsfähiger ist als sein Vorgänger. Eine Lesart: Ein Modell mit besseren Sicherheitsbewertungen und breiterem Zugang ist genau das, was Amodei im Sinn hatte. Eine andere: Der Essay nannte den Fähigkeitsfortschritt als Problem, und die Fähigkeiten wurden erweitert. Beide Lesarten beruhen auf denselben Fakten, und Anthropics Benchmarks allein können nicht klären, welche richtig ist.

Claude Opus 5.5 ist seit dem 22. September 2026 unter der API-Modell-ID claude-opus-5-5 verfügbar. Es läuft innerhalb von Claude auf den Plänen Pro, Max, Team und Enterprise und ist über AWS, Google Cloud und Microsoft Azure zugänglich. Anthropic erhöht die Nutzungslimits für die Fünf-Stunden-Abonnementstufen. Sonnet 5.5 und Haiku 5.5, die übrigen Mitglieder der 5.5-Familie, sollen in den kommenden Wochen folgen; für beide wurden weder Preise noch ein konkreter Veröffentlichungstermin bekannt gegeben.

Schlagwörter: , , , , ,

Fügen Sie uns bei Google hinzu

Diskussion

Es gibt 0 Kommentare.