Svennis AI
9 Min. Lesezeit

Von Claude Opus 5 auf Opus 5.5 wechseln: Kosten, Änderungen und sicherer Umstieg

Opus 5.5 ist günstiger und schneller als Opus 5, bricht aber bestehenden Code an vier Stellen. So rechnen, testen und stellen Sie Schritt für Schritt um.

Zwei versetzte Bahnen, die in eine gemeinsame, schmalere Linie übergehen, als Sinnbild für einen geordneten Wechsel

Von Claude Opus 5 auf Opus 5.5 wechseln: Kurzantwort und Zeitrahmen

Von Claude Opus 5 auf Opus 5.5 zu wechseln, lohnt sich für die meisten Unternehmen. Opus 5.5 kostet je Token 20 Prozent weniger und erzeugt Text laut Anthropic mehr als 30 Prozent schneller. Nach Anthropics Angaben erreicht es bei den meisten Aufgaben das Niveau von Claude Fable 5.1. Der Wechsel ist aber kein bloßer Austausch der Modellbezeichnung: Vier Änderungen brechen bestehenden Code, und die voreingestellte Denktiefe sinkt.

Ein Modellwechsel ist in diesem Leitfaden die Umstellung eines produktiven Systems von einer Modellversion auf eine andere. Dazu gehören die Prüfung der Prompts, Tests an echten Vorgängen und eine schrittweise Umstellung. Wer das überspringt, merkt Fehler oft erst im Tagesgeschäft, etwa an falsch zugeordneten Anfragen oder stummen Oberflächen.

Zeitdruck besteht nicht. Anthropic führt Opus 5 weiter und nennt als Stilllegung frühestens den 24. Juli 2027. Sie haben also Monate, um sauber zu testen.

Ob sich das Spitzenmodell für Ihre Aufgaben grundsätzlich eignet, behandelt unser Beitrag Claude Opus 5.5 im Unternehmen: wann es sich lohnt. Dieser Leitfaden geht einen Schritt weiter: Er richtet sich an Unternehmen, die Opus 5 bereits produktiv einsetzen. Er zeigt, was sich an Preisen und Technik ändert, wie Sie die Kosten beider Modelle vergleichen und in welcher Reihenfolge Sie umstellen.

Preise je Million Token: Opus 5.5 kostet 20 bis 60 Prozent weniger als Opus 5

Opus 5.5 ist in jeder Preiskategorie günstiger als Opus 5, am deutlichsten beim Lesen aus dem Zwischenspeicher. Ein Token ist ein Textstück, das das Modell verarbeitet, im Englischen rund vier Zeichen. Anthropic rechnet in US-Dollar je Million Token ab.

Zwei Begriffe braucht die Tabelle. Prompt Caching ist die Wiederverwendung bereits verarbeiteter Prompt-Teile über mehrere Anfragen hinweg; gelesene Cache-Inhalte kosten nur einen Bruchteil des normalen Eingabepreises. Die Batch API ist eine Schnittstelle für die zeitversetzte Verarbeitung großer Mengen von Anfragen mit 50 Prozent Rabatt auf Eingabe und Ausgabe.

Preisposition (USD je Million Token)Opus 5Opus 5.5Unterschied
Eingabe5,004,0020 % weniger
Ausgabe25,0020,0020 % weniger
Cache lesen0,500,2060 % weniger
Cache schreiben, 5 Minuten6,255,0020 % weniger
Cache schreiben, 1 Stunde10,008,0020 % weniger
Batch, Eingabe / Ausgabe2,50 / 12,502,00 / 10,0020 % weniger

Der Cache-Preis zählt mehr, als er auf den ersten Blick wirkt. Anthropic schreibt, dass Cache-Lesevorgänge den Großteil der Kosten bei agentischer Arbeit und Programmierung ausmachen. Wer lange Systemanweisungen, Produktkataloge oder Wissensdokumente bei jeder Anfrage mitschickt, profitiert daher besonders. Für beide Modelle liegt die Mindestlänge eines cachebaren Prompts bei 512 Token.

Für den schnellen Modus von Opus 5.5 gelten eigene Preise: 8 USD je Million Eingabe-Token und 40 USD je Million Ausgabe-Token. Er ist eine Forschungsvorschau und nur über die Claude API verfügbar.

Opus 5.5 senkt den Ausgabepreis von 25 auf 20 USD je Million Token, die Eingabe von 5 auf 4 USD: Opus 5 Ausgabe 25, Opus 5.5 Ausgabe 20, Opus 5 Eingabe 5, Opus 5.5 Eingabe 4 (USD je Mio. Token)
Quelle: platform.claude.com

Leistung und Tempo von Opus 5.5 laut Anthropic, mit Einschränkungen

Anthropic beschreibt Opus 5.5 als besser und zugleich günstiger als Opus 5. Das Modell erzeugt Ausgaben nach Herstellerangaben mehr als 30 Prozent schneller. In der Ankündigung heißt es zudem, dass es bei Standardeinstellungen auf typischen Arbeitslasten 40 Prozent weniger kostet als Opus 5. Diese 40 Prozent gehen über den reinen Preisnachlass von 20 Prozent je Token hinaus.

Für die Qualität nennt Anthropic eigene Messwerte. Im Benchmark GDPval-AA v2.1 erreicht Opus 5.5 bei maximalem Effort 1846 Elo. Opus 5 kommt auf 1708 Elo, Claude Fable 5.1 auf 1735 Elo. Die Vergleichstabelle stammt von Anthropic selbst und stellt nur Claude-Modelle gegenüber.

Anthropic ordnet solche Zahlen selbst vorsichtig ein. Auf dem heutigen Leistungsniveau seien Abstände in Benchmarks ein weniger verlässlicher Hinweis auf Unterschiede im echten Einsatz. Für Ihr Unternehmen heißt das: Die Herstellerzahlen zeigen die Richtung, die Entscheidung treffen Sie mit Tests an Ihren eigenen Vorgängen.

An den technischen Eckdaten ändert sich wenig. Beide Modelle verarbeiten bis zu 1 Million Token Kontext und liefern bis zu 128.000 Token Ausgabe. Beide nehmen Text und Bilder entgegen und geben Text aus. Der verlässliche Wissensstand reicht bei Opus 5.5 bis Juni 2026, bei Opus 5 bis Mai 2026. Anthropic empfiehlt in seiner Modellübersicht, im Zweifel mit Opus 5.5 zu beginnen.

Standard-Effort medium statt high: Quelle der Einsparung und Risiko für die Qualität

Opus 5.5 denkt ohne ausdrückliche Einstellung weniger tief als Opus 5. Effort ist der Parameter, mit dem Sie Denktiefe, Antwortzeit und Kosten einer Anfrage steuern. Eine Anfrage ohne Effort-Angabe läuft auf Opus 5.5 mit medium, auf Opus 5 lief sie mit high.

Diese Voreinstellung trägt vermutlich einen Teil zu den günstigeren Kosten bei Standardeinstellungen bei. Weniger Denkaufwand bedeutet in der Regel weniger erzeugte Token. Gleichzeitig kann eine geringere Denktiefe bei schwierigen Fällen die Antwortqualität verändern. Ein Prozess, der auf Opus 5 zuverlässig lief, kann auf Opus 5.5 mit medium bei Grenzfällen anders entscheiden.

Testen Sie deshalb beide Stufen. Lassen Sie Ihre Prüffälle einmal mit der Voreinstellung medium und einmal mit high laufen. Liefert medium dieselbe Qualität, sparen Sie am meisten. Braucht ein Prozess high, setzen Sie den Wert ausdrücklich in der Anfrage und rechnen mit höheren Token-Mengen.

Reicht auch high nicht aus, nennt Anthropic einen klaren Weg: Claude Fable 5.1 ist für anspruchsvolles Schlussfolgern und lange agentische Aufgaben gedacht. Es kostet 10 USD je Million Eingabe-Token und 50 USD je Million Ausgabe-Token. Was dieses Modell kann und wo es an Grenzen stößt, lesen Sie in unserem Beitrag Claude Fable 5.1: das stärkste Modell und seine Grenzen.

Vier inkompatible Änderungen, die bestehenden Opus-5-Code brechen

Anthropic nennt vier Änderungen, die Code betreffen, der bereits auf Opus 5 läuft. Die Details stehen in der Dokumentation What's new in Claude Opus 5.5. Diese vier Punkte prüfen Sie vor dem Wechsel:

  1. Denken lässt sich nicht mehr abschalten. Eine Anfrage mit thinking: {"type": "disabled"} oder mit einem festen Budget über budget_tokens endet mit dem Fehler 400 invalid_request_error. Die Denktiefe steuern Sie nur noch über Effort.
  2. Erzwungene Werkzeugnutzung wird abgelehnt. tool_choice mit dem Typ any oder tool führt zum Fehler 400. Das Modell entscheidet selbst, ob es ein Werkzeug aufruft.
  3. Denkblöcke sind an Modell und Gespräch gebunden. Opus 5.5 liest Denkblöcke von Opus 5, aber nicht von Fable- oder Mythos-Modellen. Nicht lesbare Blöcke verwirft die API ohne Fehler und ohne Berechnung. Für Konten ab dem 31. August 2026 lehnt die API außerdem wiedergegebene Denkblöcke ab, wenn früherer Kontext verändert wurde.
  4. Die ältere Version des Computer-Use-Werkzeugs entfällt. computer_20251124 wird auf der Claude API und bei Google Cloud abgelehnt. Auf Amazon Bedrock funktioniert es weiter.

Eine fünfte Änderung erzeugt keinen Fehler, fällt Nutzern aber sofort auf. Text, den das Modell zwischen zwei Werkzeugaufrufen schreibt, kommt als Denkblock statt als Textblock zurück. Bei der Standardeinstellung für die Anzeige ist dieser Text leer. Eine Anwendung, die solche Zwischenstände live anzeigt, bleibt dann stumm, bis Sie einen Anzeigewert setzen, der den Text zurückgibt.

Die neue Modellkennung lautet claude-opus-5-5, auf Amazon Bedrock anthropic.claude-opus-5-5.

Opus 5 bleibt verfügbar: Status und Stilllegung frühestens am 24. Juli 2027

Opus 5 läuft weiter, Sie müssen nicht sofort umstellen. Anthropic führt das Modell mit dem Status „Active (legacy)“. Veröffentlicht wurde es am 24. Juli 2026, die Stilllegung erfolgt laut Dokumentation nicht vor dem 24. Juli 2027.

Der Zusatz „legacy“ hat eine feste Bedeutung. Ein Legacy-Modell erhält keine Aktualisierungen mehr und kann künftig abgekündigt werden. Vor der Stilllegung öffentlich verfügbarer Modelle informiert Anthropic Kunden mit aktiven Einsätzen mindestens 60 Tage im Voraus. Nach der Stilllegung schlagen Anfragen an das Modell fehl.

Achten Sie auf die Plattform, über die Sie Claude beziehen. Die Termine gelten für die Claude API, Claude Platform on AWS und Microsoft Foundry. Amazon Bedrock und Google Cloud legen eigene Stilllegungspläne fest, dort können Status und Termine abweichen.

Bevor Sie planen, sollten Sie wissen, wo Opus 5 überhaupt läuft. In der Claude Console können Sie auf der Seite „Usage“ eine CSV-Datei exportieren. Sie zeigt die Nutzung aufgeschlüsselt nach API-Schlüssel und Modell. So erkennen Sie, welche Anwendungen und Automatisierungen noch claude-opus-5 aufrufen.

Opus 5.5 selbst erschien am 22. September 2026. Anthropic nennt für dieses Modell eine Stilllegung nicht vor dem 22. September 2027.

Rechenbeispiel: ein Monatsvolumen auf Opus 5 und Opus 5.5 im Vergleich

Bei gleicher Token-Menge senkt Opus 5.5 die Rechnung in diesem Beispiel um rund ein Viertel. Angenommen ist ein Kundenservice-Assistent mit einer langen, gecachten Systemanweisung. Im Monat verarbeitet er 50 Millionen neue Eingabe-Token, 150 Millionen Token aus dem Cache und 10 Millionen Ausgabe-Token. Die Mengen sind ein Beispiel, die Preise stammen von Anthropic.

PositionMenge (Mio. Token)Opus 5 (USD)Opus 5.5 (USD)
Eingabe50250,00200,00
Cache lesen15075,0030,00
Ausgabe10250,00200,00
Summe210575,00430,00

Die Differenz beträgt 145 USD im Monat, also gut 25 Prozent. Der Anteil über 20 Prozent kommt aus dem deutlich günstigeren Cache-Lesen. Je größer Ihr gecachter Anteil ist, desto stärker sinkt die Rechnung.

Die Rechnung setzt gleiche Token-Mengen auf beiden Modellen voraus. In der Praxis ändert sich die Menge durch die niedrigere Effort-Voreinstellung. Anthropic nennt für typische Arbeitslasten 40 Prozent Ersparnis bei Standardeinstellungen. Ob Ihr Prozess näher an 25 oder an 40 Prozent liegt, zeigt erst ein Test mit echten Vorgängen.

Umgekehrt steigt die Rechnung wieder, wenn Sie Effort auf high setzen müssen. Deshalb gehört der Kostenvergleich in denselben Testlauf wie der Qualitätsvergleich.

Regressionstests an echten Vorgängen und schrittweiser Umstieg

Ein Regressionstest prüft, ob ein System nach einer Änderung noch dieselben richtigen Ergebnisse liefert wie vorher. Für einen Modellwechsel heißt das: echte, abgeschlossene Vorgänge aus Ihrem Betrieb auf beiden Modellen durchspielen und die Ergebnisse vergleichen. Erfundene Beispielsätze reichen dafür nicht, weil sie die schwierigen Fälle selten abbilden.

Ein Beispiel ist die Zuordnung eingehender Anfragen in Zoho Desk. Sie wählen zwanzig Tickets der letzten Wochen, deren richtige Abteilung feststeht. Darunter sollten auch unklare Anfragen, Beschwerden und Mischfälle sein. Beide Modelle erhalten denselben Prompt, Opus 5.5 einmal mit medium und einmal mit high. Sie vergleichen Zuordnung, Begründung, Token-Verbrauch und Antwortzeit.

Bei Svennis stellen wir einen Modellwechsel nie direkt in der Produktion um. Wir lassen alte und neue Modellversion zuerst auf denselben echten Vorgängen laufen und vergleichen die Ergebnisse Fall für Fall, bevor wir einen Prozess umstellen.

Danach stellen Sie Prozess für Prozess um, nicht alle gleichzeitig. Halten Sie die Modellkennung als Einstellung außerhalb des Codes, damit Sie bei Problemen ohne neue Auslieferung auf Opus 5 zurückschalten können. Das gilt für einen Assistenten in Microsoft 365 und Teams ebenso wie für die Angebotserstellung mit Claude und Preisen aus Zoho CRM.

Echte Tickets auf Opus 5 und auf Opus 5.5 mit medium und high zeigen, ob der Wechsel trägt. Was Sie tun / Woran Sie es prüfen. 1. Prüffälle wählen: Abgeschlossene Tickets mit feststehender Abteilung / Unklare Anfragen, Beschwerden und Mischfälle dabe

Was der Wechsel für Unternehmen in Deutschland, Österreich und der Schweiz bedeutet

Für Unternehmen im deutschsprachigen Raum sind drei Punkte wichtig: das Wasserzeichen nach dem EU AI Act, die Abrechnung in US-Dollar und die Plattform, über die Sie Claude beziehen.

Wasserzeichen nach dem EU AI Act

Opus 5.5 enthält nach Angaben von Anthropic Wasserzeichen-Maßnahmen, mit denen das Unternehmen die Kennzeichnungspflicht des EU AI Act erfüllen will. Seit dem 2. August 2026 verlangt die EU von KI-Anbietern, die ihren Markt bedienen, KI-erzeugte Inhalte zu kennzeichnen. Das Wasserzeichen steckt in der Wortwahl und fügt keine Zeichen und keine zusätzlichen Token hinzu, kostet also nichts extra. Laut Anthropic enthält es keine Angaben, die auf eine Person, eine Organisation oder ein Gespräch zurückführen.

Opus 5 erschien vor dem 2. August 2026; für solche Modelle sieht das EU-Recht eine Übergangsfrist vor. Anthropic will das Wasserzeichen für solche Modelle in den kommenden Monaten nachrüsten. Auf Dauer ist das Wasserzeichen damit kein Unterscheidungsmerkmal zwischen beiden Modellen. Bei kurzen Texten funktioniert die Erkennung laut Anthropic ohnehin schlecht.

Abrechnung und Plattform

Alle Preise stehen in US-Dollar, Ihr Budget in Euro oder Franken schwankt also mit dem Wechselkurs. Wer über Microsoft Foundry oder Claude Platform on AWS bezieht, zahlt in Claude Consumption Units zu je 0,01 USD. Opus 5.5 ist laut Anthropic zudem mit Zero Data Retention verfügbar. Was diese Vereinbarung im Einzelnen umfasst und welche Ausnahmen gelten, regeln die Bedingungen von Anthropic beziehungsweise Ihres Cloud-Anbieters. Prüfen Sie diese Vereinbarung vor dem Wechsel, sofern vorhanden, mit Ihrer Datenschutzbeauftragten oder Ihrem Datenschutzbeauftragten.

Checkliste für den Wechsel von Opus 5 auf Opus 5.5

Die folgende Tabelle fasst die Umstellung in der Reihenfolge zusammen, in der Sie sie abarbeiten. Die dritte Spalte nennt jeweils, woran Sie erkennen, dass der Schritt erledigt ist.

SchrittWas Sie tunWoran Sie den Erfolg prüfen
Bestand erfassenUsage-CSV aus der Claude Console exportierenAlle Schlüssel mit claude-opus-5 sind bekannt
Modellkennung ändernclaude-opus-5-5 bzw. anthropic.claude-opus-5-5 eintragenKennung liegt als Einstellung vor, nicht fest im Code
Denken bereinigendisabled und budget_tokens entfernenKein Fehler 400 im Testlauf
Werkzeugwahl bereinigentool_choice mit any oder tool entfernenWerkzeuge werden weiterhin korrekt aufgerufen
Computer Use prüfencomputer_20251124 auf Claude API und Google Cloud ersetzenKein abgelehnter Werkzeugaufruf
Anzeige prüfenAnzeigewert für Zwischentexte setzenOberfläche zeigt Zwischenstände wieder an
Effort festlegenmedium und high gegeneinander testenGewählte Stufe steht ausdrücklich in der Anfrage
RegressionstestZwanzig echte Vorgänge auf beiden Modellen laufen lassenQualität mindestens gleich, Abweichungen begründet
Rechnung vergleichenToken-Verbrauch und Kosten je Vorgang gegenüberstellenErsparnis in USD je Monat beziffert

Arbeiten Sie die Schritte je Prozess einzeln ab. Stellen Sie erst dann den nächsten Prozess um.

Nächste Schritte: Bestand messen, an echten Fällen testen, einzeln umstellen

Beginnen Sie diese Woche mit dem Export der Nutzungsdaten aus der Claude Console. Die Liste zeigt Ihnen, welche Anwendungen Opus 5 aufrufen und welche davon die größten Kosten verursachen. Mit dem teuersten Prozess starten Sie, denn dort bringt der Wechsel am meisten.

Für diesen ersten Prozess gehen Sie in drei Schritten vor:

  1. Sie suchen im Code nach abgeschaltetem Denken, festen Denkbudgets, erzwungener Werkzeugwahl und der älteren Computer-Use-Version.
  2. Sie stellen zwanzig abgeschlossene Vorgänge mit bekanntem richtigem Ergebnis zusammen.
  3. Sie lassen beide Modelle laufen, Opus 5.5 mit medium und mit high, und vergleichen Qualität und Kosten.

Liegt Opus 5.5 gleichauf oder besser, stellen Sie den Prozess um und behalten Opus 5 einige Wochen als Rückfalloption. Bis zum 24. Juli 2027 bleibt genug Zeit, auch die übrigen Prozesse in Ruhe nachzuziehen.

Manche Aufgaben brauchen gar kein Spitzenmodell. Einfache Zuordnungen oder kurze Zusammenfassungen laufen oft mit einem kleineren Modell günstiger. Welches Modell zu welcher Aufgabe passt, zeigt unser Überblick Opus, Sonnet oder Haiku: welches Claude-Modell wofür.

Quellen

  1. 1. Anthropic: Introducing Claude Opus 5.5
  2. 2. Anthropic Newsroom
  3. 3. Claude Platform Docs: What's new in Claude Opus 5.5
  4. 4. Claude Platform Docs: Claude Opus 5.5
  5. 5. Claude Platform Docs: Claude Opus 5
  6. 6. Claude Platform Docs: Pricing
  7. 7. Claude Platform Docs: Model deprecations
  8. 8. Claude Platform Docs: Models overview
  9. 9. Anthropic: How Claude's text watermarking works

Verwandte Beiträge