Svennis AI
10 Min. Lesezeit

Claude Opus 5.5 im Unternehmen: wann sich das Spitzenmodell lohnt und wann nicht

Claude Opus 5.5 kostet 4 und 20 US-Dollar je Million Tokens. Dieser Leitfaden zeigt, bei welchen Aufgaben sich das Modell trägt und wo Sonnet 5 oder Haiku 4.5 genügen.

Abstrakte Stufen unterschiedlicher Höhe, über die sich eine Linie in mehreren Schritten nach oben bewegt

Claude Opus 5.5 lohnt sich bei langen, mehrstufigen Aufgaben

Claude Opus 5.5 im Unternehmen lohnt sich dort, wo eine Aufgabe viele Schritte hat, große Datenmengen verarbeitet oder eine Analyse verlangt, die ein kleineres Modell nicht zuverlässig trifft. Für Zuordnen, kurze Antworten und einfache Zusammenfassungen genügt meist Claude Sonnet 5 zum halben Tokenpreis oder Claude Haiku 4.5 zu einem Viertel davon.

Claude Opus 5.5 ist ein KI-Modell von Anthropic, das laut Hersteller für lang laufende agentische Programmier- und Wissensarbeit gebaut ist. Agentisch heißt: Das Modell ruft selbstständig Werkzeuge auf und arbeitet eine Aufgabe über mehrere Schritte ab.

Dieser Leitfaden behandelt Claude Opus 5.5. Er gehört zu einer Reihe von drei Beiträgen über die aktuellen Claude-Modelle. Die beiden anderen Beiträge behandeln Claude Fable 5.1 und Claude Sonnet 5. Fable 5.1 empfiehlt Anthropic für anspruchsvolles Schlussfolgern und besonders lange Agentenarbeit. Sonnet 5 beschreibt Anthropic als beste Verbindung aus Tempo und Intelligenz.

Opus 5.5 liegt zwischen diesen beiden Modellen. Anthropic gibt an, dass es bei den meisten Aufgaben das Niveau von Claude Fable 5.1 erreicht. Im Betrieb kostet es laut Anthropic 40 % weniger als der Vorgänger Claude Opus 5. Die Modellübersicht empfiehlt, im Zweifel mit Opus 5.5 zu beginnen.

Claude Opus 5.5 in Eckdaten: Start, Kontext, Denken, Plattformen

Anthropic hat Claude Opus 5.5 am 22. September 2026 veröffentlicht, als erstes Modell einer neuen Modellfamilie. Die Modellkennung in der Claude API lautet claude-opus-5-5. Das Modell nimmt Text und Bilder entgegen und gibt Text aus. Sein verlässlicher Wissensstand reicht bis Juni 2026.

Kontextfenster und Ausgabelänge

Das Kontextfenster von Opus 5.5 umfasst 1 Million Tokens, die maximale Ausgabe 128.000 Tokens. Ein Token ist ein Textstück, das das Modell verarbeitet. Im Englischen entspricht ein Token laut Anthropic etwa vier Zeichen oder 0,75 Wörtern. Das Kontextfenster ist die Textmenge, die das Modell in einer Anfrage auf einmal berücksichtigt.

Adaptives Denken und Effort

Adaptives Denken ist bei Opus 5.5 immer eingeschaltet und lässt sich nicht abschalten. Die Denktiefe steuern Sie über den Parameter Effort, der laut Anthropic Denktiefe, Wartezeit und Kosten regelt. Ohne Angabe läuft Opus 5.5 mit dem Effort medium. Bei Opus 5 war der Standard noch high.

Plattformen und Laufzeit

Opus 5.5 ist über die Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry und Claude Platform on AWS verfügbar. Für die Claude-Apps hat Anthropic mit dem Start die Nutzungslimits im Fünf-Stunden-Fenster erhöht. Das gilt für die Tarife Pro, Max, Team und das sitzbasierte Enterprise. Anthropic schaltet Opus 5.5 nicht vor dem 22. September 2027 ab.

Preise von Opus 5.5 im Vergleich zu Fable 5.1, Sonnet 5 und Haiku 4.5

Claude Opus 5.5 kostet 4 US-Dollar je Million Input-Tokens und 20 US-Dollar je Million Output-Tokens. Input-Tokens sind der Text, den Sie an das Modell schicken. Output-Tokens sind der Text, den es zurückgibt. Alle Preise auf Anthropics Preisseite gelten in US-Dollar.

ModellInput (USD je Mio. Tokens)Output (USD je Mio. Tokens)KontextfensterEinsatz laut Anthropic
Claude Fable 5.110501 Mio. TokensAnspruchsvolles Schlussfolgern, lange Agentenarbeit
Claude Opus 5.54201 Mio. TokensLang laufende agentische Programmier- und Wissensarbeit
Claude Sonnet 52101 Mio. TokensBeste Verbindung aus Tempo und Intelligenz
Claude Haiku 4.515200.000 TokensSchnellstes Modell mit nahezu Spitzenintelligenz

Gegenüber Claude Opus 5, das 5 und 25 US-Dollar kostet, sinken die Tokenpreise um 20 %. Cache-Reads machen laut Anthropic den größten Teil der Kosten bei agentischer Arbeit und Programmierung aus. Sie fallen um 60 % auf 0,20 US-Dollar je Million Tokens. Nach Anthropics Tests kostet Opus 5.5 bei Standardeinstellungen auf typischen Arbeitslasten insgesamt 40 % weniger als Opus 5.

Fable 5.1 kostet je Token das Zweieinhalbfache von Opus 5.5, Sonnet 5 die Hälfte. Das große Kontextfenster allein ist kein Grund für Opus 5.5. Sonnet 5 bietet ebenfalls 1 Million Tokens.

Rechenbeispiel: ein Monatsbericht aus Zoho CRM mit vier Modellen

Ein Monatsbericht für die Geschäftsführung kostet mit Claude Opus 5.5 rund 0,80 US-Dollar je Lauf, mit Sonnet 5 rund 0,40 US-Dollar. Das Beispiel geht von einem Export aus Zoho CRM mit Verkaufschancen, Aktivitäten und Umsätzen aus. Export und Arbeitsanweisung ergeben angenommen 150.000 Input-Tokens. Der fertige Bericht umfasst angenommen 10.000 Output-Tokens.

ModellInput-Kosten (USD)Output-Kosten (USD)Summe je Bericht (USD)
Claude Fable 5.11,500,502,00
Claude Opus 5.50,600,200,80
Claude Opus 5.5 über die Batch API0,300,100,40
Claude Sonnet 50,300,100,40
Claude Haiku 4.50,150,050,20

Die Rechnung zeigt das Verhältnis der Listenpreise, keine exakte Abrechnung. Die Tokenmengen sind Annahmen zur Veranschaulichung. Die Denktiefe beeinflusst laut Anthropic Wartezeit und Kosten. Die tatsächlichen Kosten hängen daher auch vom gewählten Effort ab.

Bei einem Bericht im Monat liegt der Unterschied zwischen Opus 5.5 und Sonnet 5 unter einem US-Dollar. Bei dieser Menge entscheidet die Qualität, nicht der Preis. Fasst Sonnet 5 Kennzahlen falsch zusammen, kostet die Nacharbeit schnell mehr als der Modellaufpreis. Wie ein solcher Bericht aufgebaut wird, zeigt der Beitrag über Wochen- und Monatsberichte für die Geschäftsführung mit Claude.

Wo sich Claude Opus 5.5 wirtschaftlich trägt

Claude Opus 5.5 trägt sich bei Aufgaben, in denen ein Fehler in einem frühen Schritt alle späteren Schritte verdirbt. Das betrifft vor allem lange Agentenabläufe. Dort ruft das Modell nacheinander Werkzeuge auf, prüft Zwischenergebnisse und arbeitet weiter. Anthropic baut Opus 5.5 ausdrücklich für diese lang laufende Programmier- und Wissensarbeit.

Typische Einsatzfelder in einem kleinen oder mittleren Unternehmen sind:

  • mehrstufige Agentenarbeit über mehrere Systeme, etwa Daten aus dem CRM lesen, mit Tickets abgleichen und einen Befund schreiben
  • Berichte und Analysen, die Sonnet 5 in Ihren Tests nicht zuverlässig richtig liefert
  • umfangreiche Dokumente, bei denen das Modell viele Stellen gegeneinander abwägen muss
  • Programmierarbeit an eigenen Schnittstellen und Skripten

Der Maßstab für die Modellwahl ist ein Test mit Ihren eigenen Fällen, keine Rangliste. Ein Benchmark ist ein standardisierter Leistungstest für KI-Modelle. Anthropic schreibt selbst, dass Vorsprünge in Benchmarks auf diesem Leistungsniveau reale Unterschiede nur noch begrenzt verlässlich abbilden.

Reicht Opus 5.5 auch mit höherem Effort nicht aus, empfiehlt Anthropic den Wechsel zu Claude Fable 5.1. Fable 5.1 kostet je Token das Zweieinhalbfache. Der Wechsel sollte deshalb nur für die Teilaufgabe gelten, die ihn wirklich braucht.

Wo Claude Sonnet 5 oder Claude Haiku 4.5 genügen

Ein kleineres Claude-Modell genügt überall dort, wo die Aufgabe kurz, klar umrissen und häufig ist. Beispiele sind das Zuordnen eingehender E-Mails vor Zoho Desk, das Auslesen von Feldern aus Formularen oder kurze Antwortentwürfe. Bei hohen Stückzahlen verdoppelt Opus 5.5 gegenüber Sonnet 5 die Tokenkosten. Genau bei solchen Mengen summiert sich der Unterschied.

Claude Sonnet 5

Claude Sonnet 5 kostet 2 US-Dollar je Million Input-Tokens und 10 US-Dollar je Million Output-Tokens. Das Modell bietet ebenfalls 1 Million Tokens Kontext und 128.000 Tokens Ausgabe. Sein Standard-Effort ist high, sein Wissensstand reicht bis Januar 2026. Anthropic schaltet Sonnet 5 nicht vor dem 30. Juni 2027 ab.

Claude Haiku 4.5

Claude Haiku 4.5 ist laut Anthropic das schnellste Modell und kostet 1 und 5 US-Dollar je Million Tokens. Es hat ein Kontextfenster von 200.000 Tokens und eine maximale Ausgabe von 64.000 Tokens. Sein Wissensstand reicht bis Februar 2025. Haiku 4.5 nutzt erweitertes statt adaptives Denken und unterstützt keine Effort-Einstellung.

Anthropic nennt für Haiku 4.5 als frühestes Abschaltdatum den 15. Oktober 2026. Wer heute einen dauerhaften Ablauf auf Haiku 4.5 aufbaut, sollte diesen Termin einplanen.

Kosten von Opus 5.5 senken: Batch API, Prompt-Caching und Effort

Die Kosten von Claude Opus 5.5 lassen sich mit drei Hebeln senken, ohne das Modell zu wechseln. Jeder Hebel passt zu einem anderen Ablauf.

Batch API für Auswertungen ohne Zeitdruck

Die Batch API verarbeitet große Mengen von Anfragen asynchron mit 50 % Rabatt auf Input und Output. Für Opus 5.5 kostet das 2 und 10 US-Dollar je Million Tokens. Sie passt zu nächtlichen Auswertungen, bei denen niemand auf die Antwort wartet.

Prompt-Caching für wiederkehrende Anweisungen

Prompt-Caching verwendet bereits verarbeitete Teile einer Anfrage in Folgeanfragen wieder. Ein Cache-Read kostet bei Opus 5.5 0,20 US-Dollar je Million Tokens, also ein Zwanzigstel des Input-Preises. Das Schreiben in den Cache kostet 5 US-Dollar für fünf Minuten und 8 US-Dollar für eine Stunde. Der kleinste cachebare Prompt umfasst 512 Tokens.

Effort passend zur Aufgabe wählen

Der Standard-Effort medium ist bei Opus 5.5 bereits niedriger als bei Opus 5. Höheren Effort setzen Sie nur dort, wo Tests zeigen, dass die Ergebnisse davon profitieren.

Der Fast Mode geht den umgekehrten Weg. Er ist eine schnellere Variante von Opus 5.5, die als Forschungsvorschau nur über die Claude API läuft. Er kostet 8 und 40 US-Dollar je Million Tokens.

Im Enterprise-Tarif deckt die Sitzgebühr nur den Zugang ab, die Nutzung wird zu API-Preisen abgerechnet. Administratoren setzen Ausgabenlimits für Organisation, Gruppen und einzelne Nutzer. Claude Code und Cowork verbrauchen laut Anthropic deutlich mehr Tokens als der normale Chat. Worauf Sie dabei achten sollten, beschreibt der Beitrag Claude Cowork im Unternehmen einsetzen.

Ein Cache Read kostet 0,20 statt 4 USD je Million Tokens, die Batch API halbiert den Input auf 2 USD: Input zum Standardpreis 4 USD je Mio. Tokens, Input über die Batch API 2 USD je Mio. Tokens, Cache Read 0,20 USD je Mio. Tokens, Cache Write mit 1 S
Quelle: platform.claude.com

Entscheidungstabelle: welches Claude-Modell für welche Aufgabe

Die Wahl des Claude-Modells richtet sich nach Länge, Fehlerfolgen und Menge einer Aufgabe. Die folgende Tabelle ordnet typische Aufgaben in einem Geschäftssystem einem Startmodell zu. Ihre eigenen Tests entscheiden am Ende.

AufgabeStartmodellBegründung
E-Mails vor dem Ticketsystem zuordnenHaiku 4.5 oder Sonnet 5Kurz, häufig, klar umrissen
Kurze Antwortentwürfe für den KundenserviceSonnet 5Tempo zählt, ein Mensch prüft
Angebotstexte mit Preisen aus dem CRMSonnet 5, bei Fehlern Opus 5.5Preise kommen aus dem System, das Modell schreibt den Text
Monatsbericht mit Kennzahlen und EinordnungOpus 5.5Mehrere Quellen, Fehler fallen spät auf
Agent über mehrere Systeme mit vielen WerkzeugaufrufenOpus 5.5Dafür baut Anthropic das Modell
Analysen, an denen Opus 5.5 auch mit höherem Effort scheitertFable 5.1Empfehlung von Anthropic
Nächtliche Massenauswertung ohne ZeitdruckOpus 5.5 oder Sonnet 5 über die Batch APIHalber Preis

Bei Angeboten liefert das Modell den Text, die Preise stammen aus dem System. Wie diese Arbeitsteilung aussieht, beschreibt der Beitrag Angebote mit Claude erstellen.

Bei Svennis lassen wir einen neuen Ablauf zuerst mit Sonnet 5 gegen echte Fälle des Kunden laufen und stellen nur die Schritte auf Opus 5.5 um, deren Ergebnisse dort nicht halten. So bleibt das teurere Modell auf die Stellen beschränkt, an denen es den Unterschied macht.

Technische Änderungen in Opus 5.5, die bestehende Integrationen betreffen

Wer Claude Opus 5 bereits in eigenen Abläufen einsetzt, muss beim Wechsel auf Opus 5.5 vier inkompatible Änderungen beachten. An diesen Änderungen kann bestehender Code scheitern. Die ersten drei gelten laut Anthropic auch für Claude Fable 5.1.

Die vier inkompatiblen Änderungen sind:

  • Das Denken lässt sich nicht abschalten. Eine Anfrage, die es deaktiviert oder ein festes Denkbudget setzt, endet mit Fehler 400.
  • Erzwungene Werkzeugnutzung wird nicht unterstützt. Die tool_choice-Werte any und tool führen ebenfalls zu Fehler 400.
  • Denkblöcke sind an das Modell und an den Gesprächsverlauf gebunden.
  • Das ältere Computer-Use-Werkzeug nimmt Opus 5.5 über die Claude API und Google Cloud nicht mehr an. Auf Amazon Bedrock funktioniert es weiter.

Eine weitere Änderung fällt ohne Fehlermeldung auf. Text, den das Modell zwischen zwei Werkzeugaufrufen schreibt, kommt als Denkblock zurück. Bei der Standardanzeige ist dieser Denkblock leer. Eine Anwendung, die diesen Text als Fortschrittsmeldung zeigt, verstummt dann, bis sie eine Anzeigeeinstellung setzt, die den Text zurückgibt.

Für Konten, die ab dem 31. August 2026 angelegt wurden, lehnt die API zudem wiederverwendete Denkblöcke nach Änderungen am früheren Kontext ab. Für Umsteiger von Opus 5 stellt Anthropic einen Migrationsleitfaden bereit.

Datenstandort und Rechtslage für Unternehmen in Deutschland und der EU

Über Anthropics eigene API bleiben Ihre Daten nicht in der EU. Der Speicherort ruhender Daten, der Workspace-Geo, steht derzeit nur als us zur Verfügung. Der Ort der Verarbeitung, der Inference-Geo, steht standardmäßig auf global und kann in jeder verfügbaren Geografie laufen. Eine reine US-Verarbeitung kostet das 1,1-Fache des Standardpreises, eine EU-Option nennt die Dokumentation von Anthropic zum Datenstandort nicht.

Eine Verarbeitung in der EU erreichen Sie daher nur über Amazon Bedrock oder Google Cloud mit regionalen Endpunkten. Microsoft Foundry bietet für Claude derzeit nur eine globale und eine US-Bereitstellung an. Bedrock und Google Cloud legen für ihre Regionen eigene Preise fest.

Drei Routing-Optionen bei Amazon Bedrock

Die Regionenübersicht von Amazon Bedrock beschreibt drei Optionen. Bei In-Region verlassen Anfragen die gewählte AWS-Region nie. Bei der geografischen Option bleiben Prompts und Ausgaben innerhalb einer Geografie wie der EU. Bei der globalen Option kann die Anfrage in jede unterstützte kommerzielle Region weltweit gehen.

Für einen Datenstandort in der EU scheidet die globale Option aus. Welche der übrigen Optionen Bedrock für Opus 5.5 anbietet, zeigt die Regionentabelle. Für das Routing zwischen Regionen erhebt Bedrock keinen Aufschlag.

Aufbewahrung, Kennzeichnung und Recht

Opus 5.5 ist laut Anthropic mit Zero Data Retention verfügbar, also ohne Aufbewahrung der Anfragedaten beim Anbieter. Verfügbar heißt nicht automatisch eingeschaltet. Klären Sie deshalb vertraglich, welche Aufbewahrungsregeln für Ihr Konto gelten. Nutzen Sie Claude über Amazon Bedrock oder Google Cloud, prüfen Sie zusätzlich die Bedingungen des jeweiligen Cloud-Anbieters.

Die Ausgaben tragen Wasserzeichen, mit denen Anthropic den EU AI Act erfüllen will. Welche Pflichten Ihr Unternehmen selbst trägt, fasst die Seite KI-Recht für Unternehmen in Deutschland zusammen. Beachten Sie außerdem, dass Anthropic alle Preise in US-Dollar angibt.

Nächste Schritte: das passende Claude-Modell für Ihren Ablauf festlegen

Die Modellwahl gelingt am sichersten mit einem kurzen, strukturierten Test an Ihren eigenen Aufgaben. Diese Schritte haben sich als Reihenfolge bewährt:

  1. Listen Sie die Aufgaben auf, die ein Claude-Modell übernehmen soll.
  2. Ordnen Sie jede Aufgabe nach Länge, Menge und Fehlerfolgen ein.
  3. Sammeln Sie eine Handvoll echter Fälle je Aufgabe als Testmaterial.
  4. Testen Sie zuerst mit Sonnet 5 und wechseln Sie nur bei schwachen Ergebnissen auf Opus 5.5.
  5. Prüfen Sie, ob Batch API oder Prompt-Caching für den Ablauf passen.
  6. Setzen Sie Ausgabenlimits, bevor der Ablauf produktiv läuft.
  7. Klären Sie den Datenstandort, prüfen Sie den Auftragsverarbeitungsvertrag und die Grundlage für Übermittlungen außerhalb der EU, und wählen Sie danach die Plattform.

Wenn Sie zunächst einordnen möchten, wo KI in Ihrem Unternehmen überhaupt ansetzt, beginnen Sie mit dem Leitfaden Wie jedes Unternehmen KI nutzen kann. Er hilft, die Aufgaben für den ersten Test auszuwählen.

Quellen

  1. 1. Anthropic: Models overview (Claude Platform Docs)
  2. 2. Anthropic: Models overview
  3. 3. Anthropic: Pricing
  4. 4. Anthropic: What's new in Claude Opus 5.5
  5. 5. Anthropic: Claude Opus 5.5 overview
  6. 6. Anthropic: Introducing Claude Opus 5.5
  7. 7. Anthropic: Newsroom
  8. 8. Anthropic: Data residency
  9. 9. Amazon Bedrock: Regional availability by models
  10. 10. Claude Help Center: What is the Enterprise plan?
  11. 11. Claude Help Center: Claude Enterprise consumption guide

Verwandte Beiträge