Svennis AI
10 Min. Lesezeit

Opus, Sonnet oder Haiku: welches Claude-Modell wofür im Geschäftsalltag

Wählen Sie das Claude-Modell pro Arbeitsschritt statt pro Projekt. Dieser Leitfaden zeigt Preise, Effort, eine Entscheidungstabelle für sechs typische Aufgaben und einen einfachen Test.

Abstrakte Stufenform aus drei unterschiedlich großen Blöcken, zwischen denen Linien Aufgaben verteilen

Opus, Sonnet oder Haiku: das Claude-Modell pro Aufgabe wählen, nicht pro Projekt

Opus, Sonnet oder Haiku: welches Claude-Modell wofür? Wählen Sie das Modell für jeden Arbeitsschritt einzeln. Haiku 4.5 übernimmt schnelle, häufige Schritte wie Klassifizieren und Weiterleiten. Sonnet 5 trägt den Großteil der Alltagsarbeit. Opus 5.5 setzen Sie dort ein, wo gründliches Abwägen den höheren Preis rechtfertigt.

Eine Modellstufe ist eine Leistungsklasse innerhalb der Claude-Familie. Haiku ist die schnellste und günstigste Stufe, Sonnet die mittlere und Opus die starke. Darüber steht Claude Fable 5.1, das Anthropic als sein leistungsfähigstes Modell für alle Kunden beschreibt.

Die Wahl pro Aufgabe lohnt sich, weil ein Geschäftsprozess aus sehr unterschiedlichen Schritten besteht. Ein Supportablauf vor Zoho Desk sortiert viele kurze E-Mails und muss nur wenige schwierige Fälle gründlich beurteilen. Ein Monatsbericht aus Zoho CRM braucht dagegen einmal im Monat eine sorgfältige Auswertung.

Wer für alles das stärkste Modell nimmt, zahlt für die Masse zu viel. Wer für alles das günstigste nimmt, verliert bei den schwierigen Fällen an Qualität. Die Grundlage der folgenden Empfehlungen sind Anthropics Seite zur Modellwahl, die Modellübersicht und die Preisseite.

Die vier aktuellen Claude-Modelle: Preise, Kontext und Einsatzzweck

Anthropic bietet derzeit vier Modelle für alle Kunden an, und sie unterscheiden sich vor allem in Preis und Tiefe. Die Preise gelten pro Million Tokens und sind in US-Dollar angegeben. Ein Token ist ein Textstück, das das Modell verarbeitet, im Englischen etwa vier Zeichen oder 0,75 Wörter.

ModellEingabe / AusgabeKontextfensterMax. AusgabeStandard-EffortEinsatz laut Anthropic
Claude Fable 5.110 $ / 50 $1 Mio. Tokens128.000 Tokenshochanspruchsvolles Schlussfolgern, lange Agentenarbeit
Claude Opus 5.54 $ / 20 $1 Mio. Tokens128.000 Tokensmittellang laufende agentische Programmierung und Wissensarbeit
Claude Sonnet 52 $ / 10 $1 Mio. Tokens128.000 Tokenshochbeste Verbindung aus Tempo und Intelligenz
Claude Haiku 4.51 $ / 5 $200.000 Tokens64.000 Tokensnicht unterstütztschnellstes Modell mit nahezu Spitzenintelligenz

Die Details zu jedem Modell stehen in eigenen Beiträgen: Claude Haiku 4.5 im Unternehmen, Claude Sonnet 5 als Standardmodell und wann sich Claude Opus 5.5 lohnt.

Claude Fable 5.1 ist die Spitze der Reihe. Anthropic empfiehlt Fable 5.1 für anspruchsvolles Schlussfolgern und lange Agentenarbeit. Das Modell ist auch dann angezeigt, wenn Ihre Tests mit Opus 5.5 bei höherem Effort noch nicht genügen. Laut Anthropic arbeitet Opus 5.5 allerdings bei den meisten Aufgaben auf dem Niveau von Fable 5.1, und das bei weniger als der Hälfte des Tokenpreises.

Claude Mythos 5.1 bietet dieselben Fähigkeiten wie Fable 5.1, steht aber nur Teilnehmern von Project Glasswing offen. Mehr dazu im Beitrag über Claude Fable 5.1 und seine Grenzen.

Drei Kriterien für die Modellwahl: Fähigkeit, Tempo und Kosten

Anthropic nennt drei Kriterien für die Modellwahl: Fähigkeit, Tempo und Kosten. Jede Aufgabe gewichtet diese drei anders. Eine Weiterleitung im Postfach braucht Tempo, eine Vertragsprüfung braucht Fähigkeit.

Fähigkeit

Die Grundfähigkeiten teilen alle aktuellen Modelle. Jedes verarbeitet Text und Bilder als Eingabe, schreibt Text, arbeitet mehrsprachig und kann Werkzeuge aufrufen. Die Unterschiede liegen in der Tiefe des Schlussfolgerns und im Kontextfenster. Das Kontextfenster ist die Textmenge, die ein Modell in einer Anfrage auf einmal berücksichtigt.

Haiku 4.5 fasst 200.000 Tokens, die drei größeren Modelle je eine Million. Auch der Wissensstand unterscheidet sich: Haiku 4.5 ist verlässlich bis Februar 2025, Sonnet 5 bis Januar 2026, Opus 5.5 und Fable 5.1 bis Juni 2026.

Tempo

Haiku 4.5 führt Anthropic mit der schnellsten Latenz, also der kürzesten Wartezeit bis zur Antwort. Für Opus 5.5 gibt es zusätzlich den Fast Mode, eine Forschungsvorschau mit bis zu 2,5-facher Ausgabegeschwindigkeit. Er kostet 8 $ pro Million Eingabe- und 40 $ pro Million Ausgabetokens.

Kosten

Die Tokenpreise verdoppeln sich ungefähr von Stufe zu Stufe bis Opus 5.5. Opus 5.5 kostet pro Token viermal so viel wie Haiku 4.5. Zwei Rabatte gelten zusätzlich: Die Batch API halbiert Eingabe- und Ausgabepreise für Anfragen, die nicht sofort beantwortet werden müssen. Ein Treffer im Prompt-Cache kostet 10 Prozent des normalen Eingabepreises.

Der Effort-Parameter ist oft der bessere Hebel als ein Modellwechsel

Der Effort-Parameter ist eine Einstellung, die innerhalb eines Modells Intelligenz gegen Wartezeit und Kosten abwägt. Anthropic schreibt dazu ausdrücklich, dass das Anpassen des Effort oft der bessere Hebel ist als ein Modellwechsel. Bevor Sie also das Modell tauschen, prüfen Sie die Effort-Stufe.

Die Standardwerte unterscheiden sich je Modell. Fable 5.1 und Sonnet 5 starten auf hoch, Opus 5.5 auf mittel. Haiku 4.5 unterstützt die Effort-Einstellung nicht. Haiku 4.5 nutzt stattdessen manuell eingeschaltetes erweitertes Denken, das Sie pro Anfrage aktivieren.

Bei Opus 5.5 und Fable 5.1 ist das adaptive Denken immer eingeschaltet. Adaptives Denken heißt, dass das Modell selbst entscheidet, wie viel es vor der Antwort überlegt. Opus 5.5 lässt sich laut Anthropic nicht mehr mit ausgeschaltetem Denken betreiben.

Für die Praxis ergeben sich zwei Regeln:

  • Genügt Opus 5.5 nicht, erhöhen Sie zuerst den Effort und wechseln erst danach zu Fable 5.1.
  • Arbeitet Opus 5.5 zuverlässig, senken Sie zuerst den Effort und prüfen erst danach einen Wechsel zu Sonnet 5.

Der Vorteil liegt im geringen Umbauaufwand. Eine Effort-Stufe ändern Sie in einer einzelnen Einstellung. Ein Modellwechsel verlangt dagegen, dass Sie Ihre Anweisungen und Ergebnisse erneut prüfen.

Zwei Startwege: mit Haiku 4.5 sparen oder mit Opus 5.5 beginnen

Anthropic beschreibt zwei Wege, eine neue Anwendung zu beginnen. Beide führen zum passenden Modell, sie unterscheiden sich nur in der Richtung.

Effizienz zuerst: mit Haiku 4.5 starten

Beim ersten Weg beginnen Sie mit einem schnellen, günstigen Modell wie Haiku 4.5. Anthropic nennt diesen Einstieg für manche Anwendungen den optimalen Ansatz. Sie wechseln nur dann eine Stufe höher, wenn Sie eine Lücke gemessen haben. Dieser Weg passt zu Aufgaben mit hohem Volumen und klarer Vorgabe, etwa Kategorien vergeben oder Felder auslesen.

Fähigkeit zuerst: mit Opus 5.5 starten

Beim zweiten Weg beginnen Sie mit dem starken Modell. Anthropic schreibt dazu: Die meisten Anwendungen starten mit Claude Opus 5.5. Sind Sie unsicher, empfiehlt die Modellübersicht ebenfalls Opus 5.5 als Ausgangspunkt. Sobald der Ablauf eingespielt ist, senken Sie den Effort oder gehen auf Sonnet 5 herunter.

Welcher Weg zu welcher Aufgabe passt

Die Entscheidung hängt davon ab, wie gut Sie die Aufgabe schon kennen. Ist das gewünschte Ergebnis eindeutig und prüfbar, starten Sie effizient. Ist unklar, wie gut ein Modell die Aufgabe überhaupt lösen kann, starten Sie mit Opus 5.5. So sehen Sie zuerst, was möglich ist, und sparen danach gezielt.

Haiku 4.5 sortiert die Masse, Sonnet 5 trägt den Alltag, Opus 5.5 übernimmt Grenzfälle und Planung. Haiku 4.5 / Sonnet 5 / Opus 5.5. Typische Aufgaben: Klassifizieren, Weiterleiten, hohes Volumen / Alltagsarbeit wie Datenanalyse und Texte / Komplexe

Entscheidungstabelle: sechs typische Aufgaben und das passende Startmodell

Die folgende Tabelle ordnet sechs Aufgaben aus kleinen und mittleren Unternehmen einem Startmodell zu. Für jede Aufgabe steht dort auch das Zeichen, eine Stufe höher oder tiefer zu gehen. Die Zuordnung folgt Anthropics Einsatzbeschreibungen: Haiku 4.5 für Echtzeit, hohes Volumen und Teilaufgaben, Sonnet 5 für Alltagsarbeit wie Datenanalyse und Texterstellung, Opus 5.5 für komplexe Agenten- und Wissensarbeit.

AufgabeStartmodellZeichen für eine Stufe höherZeichen für eine Stufe tiefer
Kundenangebot entwerfenSonnet 5Bedingungen aus langen Unterlagen fehlen im EntwurfTexte folgen fast immer derselben Vorlage
Monatsbericht aus CRM-DatenSonnet 5Deutungen passen nicht zu den ZahlenBericht ist reine Zahlenaufbereitung ohne Deutung
Supportpostfach sortierenHaiku 4.5Mehrdeutige Anfragen landen häufig falschkeine, niedrigste Stufe
Rechnungsfelder auslesenHaiku 4.5Felder bei ungewöhnlichen Layouts falsch erkanntkeine, niedrigste Stufe
Lange RechercheaufgabeOpus 5.5Ergebnis bleibt auch bei höherem Effort lückenhaftRecherche folgt einem festen Schema
Agent arbeitet einen Rückstand abOpus 5.5, Teilaufgaben an Haiku 4.5Agent verliert über lange Sitzungen den FadenTeilschritte gelingen stabil auf Haiku 4.5

Für das Auslesen von Rechnungen hilft, dass Haiku 4.5 Bilder als Eingabe annimmt. Die ausgelesenen Felder landen dann etwa in Zoho Books. Wie ein Angebot mit KI-Text und geprüften Preisen entsteht, zeigt der Beitrag Angebote mit Claude erstellen.

Beispiel: das Supportpostfach vor Zoho Desk mit zwei Modellen sortieren

Ein Supportpostfach lässt sich mit zwei Modellstufen sortieren: Haiku 4.5 für jede E-Mail, ein stärkeres Modell für die unklaren Fälle. Das folgende Beispiel zeigt den Ablauf Schritt für Schritt.

  1. Jede eingehende E-Mail geht an Haiku 4.5 mit der Modell-ID claude-haiku-4-5. Die Anweisung enthält Ihre feste Liste von Kategorien.
  2. Haiku 4.5 liefert eine Kategorie und markiert Fälle, bei denen keine Kategorie eindeutig passt.
  3. Markierte Fälle gehen an Sonnet 5 oder an Opus 5.5 mit der Modell-ID claude-opus-5-5.
  4. Das Ergebnis schreibt der Ablauf in das Ticket in Zoho Desk, und ein Mensch sieht die Grenzfälle.

Die Kostenlogik ist einfach. Die meisten Tokens fallen bei Haiku 4.5 an, das pro Token ein Viertel von Opus 5.5 kostet. Das teure Modell sieht nur den kleinen Rest. Können einzelne E-Mails einige Zeit warten, halbiert die Batch API den Preis zusätzlich.

Das Kontextfenster von Haiku 4.5 reicht für diese Aufgabe aus. Eine einzelne E-Mail mit Kategorienliste liegt weit unter 200.000 Tokens. Der Alias claude-haiku-4-5 verweist auf einen festen Stand des Modells, damit sich das Verhalten nicht unbemerkt ändert.

Bei Svennis legen wir das Modell für jeden Schritt in der Konfiguration des Ablaufs fest, nicht verstreut im Code. So bleibt der spätere Wechsel auf eine neue Haiku-Version eine Änderung an einer einzigen Stelle, die wir vorher mit denselben Test-E-Mails prüfen.

Modelle kombinieren: günstiges Modell für die Masse, Spitzenmodell für die Grenzfälle

Mehrmodell-Strategien verbinden ein günstiges Modell mit einem Spitzenmodell, sodass die meisten Tokens zum niedrigen Preis abgerechnet werden. Anthropic beschreibt dafür zwei gängige Muster.

  • Ausführer mit Berater: Das günstige Modell erledigt die Arbeit und gibt schwierige Fälle an das Spitzenmodell weiter.
  • Koordinator mit Helfern: Das Spitzenmodell plant und verteilt Teilaufgaben an günstige Modelle.

Das Supportpostfach aus dem vorigen Beispiel folgt dem ersten Muster. Ein Agent, der einen Rückstand an Aufgaben abarbeitet, folgt eher dem zweiten. Ein Agent ist hier ein Programm, das mit einem Modell eigenständig mehrere Schritte plant und ausführt. Opus 5.5 zerlegt dann die Arbeit, und Haiku 4.5 erledigt die einzelnen Teilschritte. Anthropic nennt solche Teilaufgaben ausdrücklich als Einsatzfeld von Haiku 4.5.

Technisch ist die Kombination einfach, weil jede Anfrage über die API ihre eigene Modell-ID trägt. Ein Ablauf kann also im ersten Schritt Haiku 4.5 und im zweiten Opus 5.5 aufrufen. Welche Fähigkeiten und Tokengrenzen ein Modell hat, lässt sich über die Models API abfragen. Deren Antwort enthält für jedes verfügbare Modell die maximale Eingabe, die maximale Ausgabe und die unterstützten Fähigkeiten.

Die Grenze zwischen den Stufen legen Sie fest, nicht das Modell. Definieren Sie vorab, woran ein Fall als schwierig gilt, etwa eine fehlende eindeutige Kategorie. Nur so bleibt der Anteil der teuren Anfragen planbar.

Datenstandort für Unternehmen in Deutschland, Österreich und der Schweiz

Über Anthropics eigene API werden Ihre Daten in den USA gespeichert. Anthropic bietet dort keine eigene EU- oder UK-Datenhaltung an. Zwei unabhängige Einstellungen regeln den Datenstandort.

  • Workspace-Geo: legt fest, wo Daten ruhend gespeichert werden und wo etwa Codeausführung stattfindet. Derzeit ist us der einzige verfügbare Wert, und er lässt sich nach dem Anlegen des Workspace nicht mehr ändern.
  • Inference-Geo: legt pro Anfrage fest, wo das Modell rechnet. Der Standard global erlaubt jede verfügbare Region.

Wer die Berechnung auf die USA festlegen will, setzt die Inference-Geo auf us. Das kostet das 1,1-Fache des normalen Preises für alle Tokenarten. Bei Haiku 4.5 wird dieser Parameter nicht unterstützt. Eine Anfrage mit dieser Einstellung endet dort mit dem Fehler 400.

Eine Verarbeitung in einer bestimmten Region außerhalb der USA gestalten Sie über die Cloud-Plattformen, auf denen Claude ebenfalls angeboten wird. Das sind Amazon Bedrock, Google Cloud und Microsoft Foundry, jeweils mit eigenen Modell-IDs. Bedrock und Google Cloud haben eigene regionale Preise. Welche Region ein Modell dort anbietet, prüfen Sie für jedes Modell einzeln beim jeweiligen Anbieter, bevor Sie es auswählen.

Für die Modellwahl hat das eine praktische Folge. Das günstigste Modell ist nicht in jeder Konstellation das passende, wenn Ihre Datenregeln eine Region vorschreiben. Opus 5.5 ist laut Anthropic zudem mit Zero Data Retention erhältlich, also ohne Speicherung der Anfragen, und bringt Wasserzeichen zur Einhaltung des EU AI Act mit. Die Preise auf Anthropics Seiten sind in US-Dollar angegeben, rechnen Sie Budgets also mit Wechselkurs.

Neue Modellversionen ändern die Zahlen, nicht die Stufenlogik

Die Empfehlungen in diesem Leitfaden gelten pro Stufe und bleiben gültig, wenn neue Versionen erscheinen. Haiku 4.5 ist derzeit das aktuelle Haiku-Modell. Anthropic kündigt neue Versionen von Sonnet und Haiku für die kommenden Wochen an, ohne ein Datum zu nennen.

Neue Versionen verschieben vor allem Preise und Leistung. Ein Beispiel liefert Anthropic selbst: Opus 5.5 kostet bei Standardeinstellungen für typische Aufgaben 40 Prozent weniger als Opus 5. Die Tokenpreise liegen 20 Prozent unter denen von Opus 5, und die Ausgabe entsteht laut Anthropic mehr als 30 Prozent schneller.

Die Logik der Stufen ändert sich dadurch nicht. Die günstige Stufe bleibt für häufige, klar definierte Schritte zuständig. Die mittlere Stufe trägt den Alltag, die starke Stufe die schwierigen Fälle. Was sich ändert, ist die Grenze zwischen den Stufen: Ein neues günstiges Modell kann Aufgaben übernehmen, für die bisher die mittlere Stufe nötig war.

Planen Sie deshalb drei Dinge ein:

  • Die Modell-ID steht an einer zentralen Stelle Ihrer Konfiguration.
  • Die aktuellen Preise lesen Sie auf Anthropics Preisseite nach, nicht in älteren Beiträgen.
  • Vor jedem Wechsel laufen Ihre Testbeispiele auf alter und neuer Version.

So wird eine neue Version zur Gelegenheit, eine Stufe tiefer zu gehen, und nicht zum Risiko für einen laufenden Prozess.

Nächste Schritte: zwanzig echte Beispiele auf zwei Modellen testen

Der verlässlichste Weg zur richtigen Modellwahl ist ein kleiner Test mit Ihren eigenen Daten. Anthropic nennt einen eigenen Testsatz für den Anwendungsfall den wichtigsten Schritt bei der Modellwahl. Veröffentlichte Benchmark-Abstände sind laut Anthropic bei heutiger Leistungsfähigkeit ein weniger verlässlicher Hinweis auf Unterschiede im Alltag.

So gehen Sie vor:

  1. Sammeln Sie zwanzig echte Beispiele einer Aufgabe, etwa zwanzig Supportanfragen oder zwanzig Rechnungen.
  2. Notieren Sie für jedes Beispiel das richtige Ergebnis, bevor ein Modell es sieht.
  3. Wählen Sie zwei benachbarte Stufen aus der Entscheidungstabelle, etwa Haiku 4.5 und Sonnet 5.
  4. Lassen Sie alle zwanzig Beispiele auf beiden Modellen laufen, mit identischer Anweisung.
  5. Vergleichen Sie die Treffer und die Rechnung beider Durchläufe.

Liefert das günstigere Modell gleich gute Ergebnisse, nehmen Sie es. Liegt es deutlich zurück, prüfen Sie zuerst eine höhere Effort-Stufe oder das Weiterleiten der Grenzfälle, bevor Sie komplett wechseln. Wiederholen Sie den Test, sobald eine neue Modellversion erscheint.

Wer den Schritt vom einzelnen Chat zu festen Abläufen mit mehreren Modellen gehen will, findet den Weg im Leitfaden Claude wie ein Power User nutzen.

Quellen

  1. 1. Anthropic: Choosing the right model
  2. 2. Anthropic: Models overview
  3. 3. Anthropic: Pricing
  4. 4. Anthropic: Claude Haiku 4.5
  5. 5. Anthropic: Data residency
  6. 6. Anthropic: Introducing Claude Opus 5.5
  7. 7. Anthropic: Newsroom

Verwandte Beiträge