Anthropic hat 80 % seiner System-Prompt-Anweisungen entfernt und Opus 5 veröffentlicht, ein neues Claude Code Modell, das tagelang oder wochenlang autonom arbeiten kann und 30 % beim Arc AGI Benchmark erreicht. Das „Press-Delete“-Redesign, das das Unternehmen als „Unhobbling“-Strategie bezeichnet, lässt die rohen Fähigkeiten der KI hervortreten, ohne die Software-Fesseln, die große Sprachmodelle normalerweise in einen reinen Chat-Modus einschränken.

Warum die Änderung wichtig ist

Anthropics Ingenieure nutzten früher eine dichte Reihe von Leitplanken (Guardrails) für Claude – explizite Prompts, die dem Modell sagen, was es sagen soll, was nicht und wie es bei der Sache bleiben soll. Diese Prompts wirken wie eine Leine, die verhindert, dass das Modell in ungetestetes Verhalten abdriftet, aber auch dessen Leistung begrenzt. Als Opus 5 erschien, löschte das Team den gesamten Prompt-Stack und fügte die Anweisungen dann einzeln wieder hinzu, um die Auswirkungen jeder einzelnen zu messen. Da das neue Modell leistungsfähiger ist, konnten sie den Großteil der ursprünglichen Formulierungen weglassen und erhielten dennoch zuverlässige Ergebnisse. Das System versteht nun ein übergeordnetes Ziel und generiert vollständige Dateien und Funktionen.

Der technische Ertrag

  • Benchmark-Sprung – Opus 5 erreichte einen Wert von 30 % beim Arc AGI Benchmark, einer Metrik, die die Fähigkeit eines Modells misst, neuartige Probleme zu lösen. Frühere Claude-Versionen lagen weit unter diesem Wert, was auf einen erheblichen Sprung in der rohen Denkfähigkeit hindeutet.
  • Erweiterte Autonomie – Die „Auto Mode“-Funktion ermöglicht es dem Modell, über längere Zeiträume zu operieren, wobei es seinen eigenen Kontext beibehält und Fortschritte macht, ohne ständige menschliche Impulse zu benötigen. In der Praxis kann ein Entwickler dem Modell eine Spezifikation übergeben und es über Tage hinweg iterieren lassen, wobei er nur dann eingreift, wenn ein Meilenstein erreicht ist.
  • Härtung gegen Prompt Injection – Prompt Injection versucht, ein Modell dazu zu bringen, seine Sicherheitsregeln zu ignorieren, indem bösartige Anweisungen in die Benutzereingabe eingebettet werden. Anthropic gibt an, dass Opus 5 diesen Angriff dank interner Forschung und spezialisierter Klassifikatoren, die verdächtige Muster markieren, besser widersteht als seine Vorgänger. Sie empfehlen zudem, vor dem Einsatz Abbruchkriterien und Leitplanken zu definieren.

Bedeutung für Entwickler und Unternehmen

Für Startups, die KI-gestützte Tools entwickeln, vergrößert die Änderung den „Product Overhang“ – die Lücke zwischen dem, was ein Modell leisten kann, und dem, was die umgebende Software zulässt. Durch das Aufheben dieses Overhangs kann Claude Code eine einfache Chat-Schnittstelle in einen Full-Stack-Entwicklungsassistenten verwandeln, der Code autonom schreibt, testet und refaktoriert. Unternehmen, die das Modell einsetzen, könnten die Zeit für repetitive Codierungsaufgaben reduzieren und so Ingenieure für anspruchsvollere Designarbeiten freisetzen.

Was „Unhobbling“ wirklich bedeutet

Cherny prägte den Begriff „Unhobbling“, um die Befreiung eines leistungsfähigen Modells von künstlichen Einschränkungen zu beschreiben. In vielen KI-Produkten schränken Entwickler absichtlich ein, was das Modell versuchen kann, weil die Benutzeroberfläche oder der Richtlinienrahmen noch nicht für den vollen Umfang des Modells bereit ist. Das Ergebnis ist ein „Product Overhang“, bei dem die KI auf einem Podest aus ungenutztem Potenzial sitzt. Claude Code holt dieses Potenzial auf die Erde und lässt das Modell als Co-Autor von Software agieren, statt nur als reiner Frage-Antwort-Bot.

Ratschläge für Gründer und Studenten

  • Den Overhang erkennen – Suchen Sie nach Aufgaben, bei denen bestehende KI-Tools kurz hinter ihren aktuellen Grenzen scheitern. Das sind „Low-Hanging Fruits“, bei denen ein „Unhobbling“-Ansatz überproportionale Erträge liefern könnte.
  • Das Modell fordern – Geben Sie der KI Aufgaben, die sich geringfügig jenseits ihrer beworbenen Fähigkeiten anfühlen. Das interne Denken des Modells mag Sie überraschen, insbesondere wenn Sie die Reibung durch Prompts reduzieren.
  • Klare Leitplanken definieren – Bevor Sie das Modell unüberwacht laufen lassen, legen Sie Abbruchbedingungen (z. B. maximale Laufzeit, Ressourcenlimits) und Sicherheitsprüfungen fest. Dies ermöglicht es der KI zu explorieren, während die Risiken begrenzt bleiben.

Studenten sollten Theorie mit Praxis verbinden. Das Beherrschen von Algorithmen ist wertvoll, aber die Kombination dieses Wissens mit Produktverständnis und datengestützter Experimentierfreudigkeit wird die nächste Welle von KI-fokussierten Entwicklern hervorbringen.

Worauf man als Nächstes achten sollte

Fazit: Durch das Löschen der meisten System-Prompts hat Anthropic ein intelligenteres Modell mit deutlich weniger Anleitung agieren lassen und Claude Code in einen autonomen Coder verwandelt, der Projekte über Wochen hinweg bewältigen kann.