Ein Modell, das seine Arbeit von selbst prüft, und was das mit alten Prompts macht
Anthropic stellt Claude Opus 5 vor. Zwei Verhaltensänderungen betreffen jeden, der bestehende Anweisungen weiterverwendet: Das Modell prüft sich selbst, und Denken ist jetzt voreingestellt an, mit einer neuen Kante beim Abschalten.
Der Sprung von 4.8 auf 5 ist bei Anthropic der erste Hauptwechsel in der Opus-Reihe seit anderthalb Jahren, und die Ankündigung vom 24. Juli liest sich zunächst wie üblich: näher an der eigenen Spitze, halber Preis, sofort verfügbar. Der Preis bleibt sogar unverändert bei 5 Dollar je Million Eingabe- und 25 Dollar je Million Ausgabe-Token.
Interessant sind aber zwei Änderungen abseits der Ranglisten, die in der Herstellerdokumentation unter „Verhaltensänderungen“ stehen. Sie betreffen jeden, der bestehende Anweisungen weiterverwendet.
Eine bewährte Anweisung wird zum Fehler
Bisher gehörte es zum Handwerk, einem Modell einen Prüfschritt vorzuschreiben: „Prüfe dein Ergebnis am Ende noch einmal.“ Der Grund dafür war gut, das Modell tat es sonst nicht.
Opus 5 tut es von selbst, und die Dokumentation sagt ausdrücklich, was mit den alten Anweisungen passiert: Sie sollen entfernt werden, weil sie sonst zu viel Prüfung auslösen. Wer seine Prompt-Bibliothek unverändert weiterbenutzt, bekommt also weder dasselbe Ergebnis wie vorher noch das bessere. Er bekommt ein umständlicheres.
Das ist der praktische Kern und der Grund, warum diese Meldung hier länger ist als die anderen. Eine Technik, die man gelernt hat, wird nicht schrittweise schlechter. Sie kippt mit einem Modellwechsel von hilfreich zu schädlich, und zwar leise: Es gibt keine Fehlermeldung, das Ergebnis wird nur schlechter. Mehr dazu in Grundkurs, Kapitel 06.
Der Regler ist älter, die Kante ist neu
Die zweite Änderung: Denken ist bei Opus 5 voreingestellt an, bei 4.8 blieb es
aus, wenn man es nicht ausdrücklich einschaltete. Wie tief das Modell dabei
denkt, steuert eine Angabe mit fünf Stufen von low bis max, Voreinstellung
high.
Diese Angabe selbst ist kein neuer Regler. Sie stand schon bei Opus 4.5 zur
Verfügung, zunächst zusammen mit einem eigenen Token-Budget fürs Denken, seit
Opus 4.7 in der vollen Stufenleiter bis max. Sie ersetzt auch keine
Modellwahl: Wer Opus statt Sonnet nimmt, wählt weiter das Modell, die Stufe ist
eine zweite Angabe je Anfrage, unabhängig davon. Wer aus Kostengründen zu einem
kleineren Modell griff, kann das weiterhin tun und beim gewählten Modell
zusätzlich die Stufe herunterdrehen. Der Hersteller empfiehlt, bei der
Voreinstellung anzufangen und in beide Richtungen anzupassen, gemessen an
eigenen Prüfläufen.
Eine Kante gibt es dabei, und die ist bei Opus 5 tatsächlich neu. Denken lässt
sich weiter abschalten, aber nur bis zur Stufe high. Bei den beiden höchsten
Stufen antwortet die Schnittstelle mit einem Fehler. Das ist ein Bruch
gegenüber 4.8, wo beides unabhängig voneinander war.
Was sonst auffällt
Das Kontextfenster liegt bei einer Million Token, und zwar als Voreinstellung und als Höchstwert; eine kleinere Ausführung gibt es nicht mehr. In Agenten-Sitzungen berichtet das Modell häufiger über seinen Fortschritt und übergibt bereitwilliger an Subagenten. Beides sind Verhaltensänderungen ohne Codeänderung, und beides fällt eher auf, wenn man länger damit arbeitet, als in einem Vergleichstest.
Wie sich das alles in der eigenen Arbeit anfühlt, sagen Herstellerangaben nicht. Das bleibt eine Frage der Erfahrung, und die braucht ein paar Wochen.
Im GlossarLLM
Quellen
3 Einträgealle erreichbar
Erreichbarkeit automatisch geprüft
Ankündigung des Herstellerserreichbar
Introducing Claude Opus 5 (externe Seite, anthropic.com)
anthropic.comgeprüft 24.09.2026
Anthropic stellt am 24.07.2026 Claude Opus 5 vor. Die Ankündigung nennt Preis, Verfügbarkeit und die Einordnung gegenüber der eigenen Spitze, und ist damit die Stelle, an der sich die Angaben nachlesen lassen.
Dokumentationerreichbar
What's new in Claude Opus 5 (externe Seite, platform.claude.com)
platform.claude.comgeprüft 23.09.2026
Die Herstellerdokumentation zu Claude Opus 5 vom 24.07.2026. Sie nennt die Verhaltensänderungen, die eine bestehende Anbindung betreffen: Denken ist voreingestellt an, der Regler für den Reasoning Effort reicht von low bis max, und das Modell prüft seine Arbeit von selbst. Dazu der Bruch, dass sich Denken bei den beiden höchsten Stufen nicht mehr abschalten lässt.
Dokumentationerreichbar
Effort (externe Seite, platform.claude.com)
platform.claude.comgeprüft 24.09.2026
Die Herstellerdokumentation zum effort-Parameter, der in fünf Stufen regelt, wie viele Token ein Modell auf eine Anfrage verwendet. Die Liste unterstützter Modelle und der Vergleich mit Opus 4.5 zeigen, dass der Regler nicht erst mit Opus 5 entstand.