Anthropic enthüllt Claude Opus 5: Elite-Performance zum halben Preis
Anthropic hat offiziell Claude Opus 5 auf den Markt gebracht, ein neues Flaggschiff-Modell, das darauf ausgelegt ist, den High-End-LLM-Markt zu revolutionieren, indem es nahezu die Leistungsfähigkeit des Premium-Modells Claude Fable 5 zu einem deutlich niedrigeren Preis bietet. Dieser strategische Schritt zielt darauf ab, den Preisdruck durch Wettbewerber wie GPT-5.6 Sol zu neutralisieren und Entwicklern gleichzeitig ein effizienteres Werkzeug für die Programmierung und komplexe Wissensarbeit zur Verfügung zu stellen.
Revolutionierung der Preis-Leistungs-Grenze
Das auffälligste Merkmal von Claude Opus 5 ist seine aggressive Preisstruktur. Während das Top-Modell Claude Fable 5 10 $ pro Million Input-Token und 50 $ pro Million Output-Token kostet, halbiert Opus 5 diese Sätze auf 5 $ pro Million Input- und 25 $ pro Million Output-Token.
Um Latenzanforderungen gerecht zu werden, hat Anthropic zudem einen „Fast Mode“ eingeführt, der die Verarbeitungsgeschwindigkeit um das 2,5-fache erhöht, allerdings um den Preis einer Verdoppelung des Token-Preises. Diese gestaffelte Preisgestaltung, kombiniert mit einem massiven Kontextfenster von 1 Million Token, positioniert Opus 5 als das neue Standardmodell für Claude Max und als die leistungsfähigste Option für Claude Pro-Nutzer.
Benchmark-Überlegenheit in den Bereichen Coding und Reasoning
Opus 5 ist nicht bloß eine Budget-Alternative; es ist ein Kraftpaket in spezifischen Bereichen. Beim agentischen Terminal-Coding via Frontier-Bench v0.1 erreichte Opus 5 einen Wert von 43,3 % und übertraf damit sowohl Fable 5 (33,7 %) als auch GPT-5.6 Sol (34,4 %) deutlich. Es demonstrierte zudem seine Dominanz in der Wissensarbeit und führte den GDPval-AA v2 Benchmark mit einem Elo-Score von 1.861 an.
Die vielleicht verblüffendste Statistik stammt aus dem ARC-AGI-3 Benchmark, der die Problemlösung bei neuartigen Aufgaben misst. Opus 5 erzielte 30,2 % und vervierfachte damit nahezu den Wert von 7,8 %, den GPT-5.6 Sol erreichte. Dies deutet auf einen massiven Sprung in der Fähigkeit des Modells hin, Aufgaben zu bewältigen, die außerhalb der Muster seiner Trainingsdaten liegen.
Intelligente Skalierung des Aufwands und Effizienz
Anthropic hat ein ausgeklügeltes „Effort“-System eingeführt, mit dem Nutzer zwischen fünf Einstellungen wählen können: low, medium, high, xhigh und max. Dies ermöglicht eine granulare Abwägung zwischen Token-Verbrauch und Reasoning-Tiefe.
Während Anthropic für allgemeine Aufgaben die Einstellungen „low“ und „medium“ empfiehlt, um die Kosten zu optimieren, rät das Unternehmen zur Nutzung von „xhigh“ für komplexes agentisches Coding. Interessanterweise stellte das Unternehmen bei der Einstellung „max“ einen abnehmenden Grenznutzen fest; sowohl im Frontier-Bench v0.1 als auch im Artificial Analysis Coding Agent Index verzeichnete Opus 5 trotz der höheren Kosten einen leichten Leistungsabfall bei maximalem Aufwand. Dies deutet darauf hin, dass die „xhigh“-Einstellung derzeit der „Sweet Spot“ für die Effizienz sein könnte.
Verbesserte Sicherheit und Autonomie
Als direkte Reaktion auf Nutzerfeedback hat Anthropic die Sicherheitsklassifikatoren für Opus 5 feinjustiert. Die Cyber-Filter des Modells lösen etwa 85 % seltener aus als die von Fable 5, womit Kritik an der übermäßig strengen Blockierung legitimer Forschung adressiert wird. Während das Modell weiterhin die Generierung von Exploits und binärbasierte Scans verhindert, ist es bei der Forschung zu Schwachstellen in Quellcode weitaus permissiver.
Darüber hinaus zeigt Opus 5 verbesserte Selbstkorrektur-Fähigkeiten. In realen Tests erstellte das Modell erfolgreich ein 3D-Modell in FreeCAD, indem es seine eigene Computer-Vision-Pipeline schrieb, um die Geometrie zu interpretieren – eine Aufgabe, an der alle anderen konkurrierenden Modelle scheiterten.
Die wichtigsten Erkenntnisse
- Drastische Kostensenkung: Opus 5 bietet Flaggschiff-Performance zu 50 % der Token-Kosten von Claude Fable 5.
- Durchbruch im Reasoning: Das Modell zeigte im ARC-AGI-3 Benchmark für die Problemlösung bei neuartigen Aufgaben einen massiven 4-fachen Vorsprung gegenüber der Konkurrenz.
- Optimierter Workflow für Entwickler: Mit verbesserten Sicherheitsklassifikatoren und spezialisierten „Effort“-Einstellungen bietet Opus 5 ein flüssigeres Erlebnis für agentisches Coding und Forschung.
