Claude Opus 5.5 soll Programmieraufgaben schneller und günstiger bewältigen

Claude Opus 5.5 soll Programmieraufgaben schneller und günstiger bewältigen
Illustrationen erstellt mit KI-Bildgenerierung

Anthropic hat Claude Opus 5.5 als erstes Modell der neuen Claude-5.5-Familie vorgestellt. Es soll bei typischen Arbeitsabläufen 40 Prozent weniger kosten als Opus 5, Ausgaben schneller erzeugen und insbesondere umfangreiche Programmieraufgaben effizienter erledigen.

Anthropic stellte Claude Opus 5.5 am 22. September 2026 vor. Eine Million Eingabe-Token kostet 4 US-Dollar, eine Million Ausgabe-Token 20 US-Dollar. Token sind kleine Einheiten, in die Inhalte zur Verarbeitung und Abrechnung zerlegt werden. Zwischenspeicher-Lesevorgänge, also das Wiederverwenden bereits verarbeiteter Daten, kosten 0,20 US-Dollar je Million Token. Das sind 60 Prozent weniger als bei Opus 5. Die Ausgabe erfolgt laut Anbieter zudem mehr als 30 Prozent schneller.

Umfangreiche Softwarearbeiten im Mittelpunkt

Bei frühen Erprobungen bewältigte das Modell große Vorhaben innerhalb kurzer Zeit. Ein Tester schloss die Übertragung einer Softwarebasis mit 680.000 Programmzeilen in weniger als einem Tag ab. Ein anderer ließ 200.000 Zeilen in weniger als drei Stunden prüfen und korrigieren. Opus 5 benötigte für dieselbe Aufgabe mehr als 20 Stunden und verbrauchte zweieinhalbmal so viele Token.

Bei einem internen Versuch übertrugen Opus 5.5 und Claude Fable 5.1 die Software HAProxy, die den Datenverkehr auf Webserver verteilt, von der Programmiersprache C in die Programmiersprache Rust. Beide Fassungen bestanden nahezu alle vorhandenen Rückfallprüfungen. Opus 5.5 benötigte 9,5 Stunden, Claude Fable 5.1 zwölf Stunden. Die Kosten des neuen Modells lagen dabei 51 Prozent niedriger als bei Claude Fable 5.1.

Auch bei der Optimierung einer Webanwendung erzielte Opus 5.5 nach Angaben von Anthropic bessere Ergebnisse. In 39 von 40 Versuchen verkürzte es die Ladezeiten auf sämtlichen Seiten. Opus 5 erreichte geringere Verbesserungen und veränderte zugleich das Verhalten der Anwendung.

Leistung in Vergleichsprüfungen

In den von Anthropic aufgeführten Vergleichsprüfungen lag Opus 5.5 unter anderem bei selbstständiger Programmierung, Computernutzung und Wissensarbeit vorn. Beim Terminal-Bench 4.0, der komplexe mehrstufige Aufgaben auf der Kommandozeile misst, erreichte es 66,4 Prozent. Beim FrontierCode v1.1, der bewertet, ob die Programmänderungen eines selbstständig arbeitenden Systems übernommen würden, waren es 54,4 Prozent. Beim OSWorld 2.0 zur Computernutzung erzielte es insgesamt 81,8 Prozent mit teilweiser Bewertung. Anthropic weist allerdings darauf hin, dass geringe Unterschiede in solchen Prüfungen die tatsächlichen Unterschiede im praktischen Einsatz nicht immer zuverlässig abbilden.

Externe Prüfung und Schutzmaßnahmen

Vor der Veröffentlichung prüften die externen Prüforganisationen Frontier Design und METR das Modell. Anthropic testete es außerdem in Tausenden simulierten Szenarien. Nach den Ergebnissen der unternehmenseigenen Verhaltensprüfung führt Opus 5.5 seltener schwer umkehrbare Handlungen aus, überschreitet seltener vorgegebene Grenzen und ist widerstandsfähiger gegen eingeschleuste schädliche Anweisungen als Opus 5. Weitere Angaben zu den Prüfungen und Grenzen des Modells enthält die von Anthropic auf der Produktseite erläuterte Systemkarte.

Da Anthropic die Fähigkeiten von Opus 5.5 in Biologie und Cybersicherheit als vergleichbar mit einem weiteren Anthropic-Modell namens Claude Mythos 5.1 einstuft, gelten ähnliche Schutzmaßnahmen wie bei Claude Fable 5.1. Geprüfte Organisationen können sich ab sofort für das Prüfprogramm für Biowissenschaften bewerben, um das Modell in der biologischen Forschung einzusetzen. Der Zugang zum Prüfprogramm für Cybersicherheit soll in den kommenden Wochen ausgeweitet werden.

Höhere Nutzungsgrenzen und schneller Modus

Anthropic erhöht die fünfstündigen Nutzungsgrenzen für Pro, Max, Team und sitzplatzbasierte Enterprise-Tarife. Abonnenten erhalten außerdem ein zurücklegbares Zurücksetzen ihrer Nutzungsgrenze, das sie speichern und bei Bedarf zu einem selbst gewählten Zeitpunkt einsetzen können.

In Claude Code und auf der Claude Platform steht zudem ein schneller Modus mit bis zu zweieinhalbfacher Geschwindigkeit bereit. Dieser kostet 8 US-Dollar je Million Eingabe-Token und 40 US-Dollar je Million Ausgabe-Token. Claude Sonnet 5.5 und Claude Haiku 5.5 sollen in den kommenden Wochen folgen.

Dieser Artikel wurde KI-generiert erstellt. Die Themenauswahl trifft die Redaktion, die redaktionelle Verantwortung liegt bei KI-Prüfstand.