Begriffe vorab
- Modellfamilie: eine Reihe verwandter Modelle derselben Generation mit unterschiedlicher Größe und Ausrichtung.
- Modell-ID: der exakte Bezeichner, den man in der API angeben muss; er enthält Namen und Version.
- Latenz: die Wartezeit bis zur Antwort. Durchsatz: wie viele Anfragen pro Zeit bearbeitet werden.
Die Stufen
Claude-Modelle werden in Stufen angeboten, die sich in Geschwindigkeit, Kosten und Leistungsfähigkeit unterscheiden:
- Haiku: schnell und günstig, gut für einfache, hochvolumige Aufgaben.
- Sonnet: ausgewogen, der Allrounder für die meisten Aufgaben.
- Opus: am leistungsfähigsten, für komplexe Analyse, Recherche und schwierige Programmieraufgaben.
Auswahlhilfe
- Klassifizieren, Extrahieren, Routing: eher Haiku.
- Alltag, Texte, Code: Sonnet.
- Mehrstufige, knifflige Probleme: Opus.
Wichtig
Modellnamen und Versionen ändern sich regelmäßig. Verlässliche Angaben stehen in der offiziellen Dokumentation von Anthropic. Für die API sollte man die exakte Modell-ID aus der Dokumentation verwenden.
Warum es mehrere Stufen gibt
Die Namen Haiku, Sonnet und Opus führte Anthropic 2024 für aufsteigende Leistungsstufen ein; seitdem ist die Reihe gewachsen (inzwischen gibt es oberhalb von Opus eine weitere Stufe namens Fable).
Größere Modelle sind in der Regel leistungsfähiger bei schwierigen, mehrstufigen Aufgaben, brauchen aber mehr Rechenzeit und kosten mehr pro verarbeitetem Text. Kleinere Modelle antworten schneller und günstiger und genügen für viele Routineaufgaben. Anthropic bietet deshalb mehrere Stufen an, damit man je Aufgabe das passende Verhältnis aus Qualität, Geschwindigkeit und Kosten wählen kann.
Ein Auswahlverfahren in drei Schritten
- Aufgabe einordnen: Ist sie einfach und massenhaft (Kategorisieren, Felder extrahieren) oder anspruchsvoll (mehrstufige Analyse, schwieriger Code)?
- Mit der mittleren Stufe beginnen und an echten Beispielen messen, ob die Qualität reicht.
- Gezielt wechseln: nach unten, wenn die Qualität reicht und Kosten oder Tempo zählen; nach oben, wenn bestimmte Fälle scheitern.
Ein Beispiel
Ein Support-Team sortiert täglich tausende E-Mails nach Thema. Hier genügt ein schnelles, günstiges Modell, weil die Aufgabe klar umrissen ist. Dieselbe Firma lässt Verträge auf Risiken prüfen; dort lohnt sich ein stärkeres Modell, weil Fehler teuer sind und der Text lang und verschachtelt ist.
Modellnamen, Versionen, Preise und Kontextgrößen ändern sich regelmäßig. Für verbindliche Angaben immer die aktuelle Modellübersicht in der offiziellen Dokumentation prüfen und die exakte Modell-ID von dort übernehmen, statt sie aus älteren Beispielen zu kopieren.
Zum Selbermachen: drei Aufgaben, drei Stufen
- Wähle eine einfache Aufgabe (zum Beispiel 20 Kundenanfragen nach Thema sortieren) und lass sie von der kleinsten Stufe lösen.
- Nimm eine mittelschwere Aufgabe (einen Text umschreiben, Code erklären) und vergleiche die Antworten der kleinen und der mittleren Stufe.
- Stelle eine schwierige Aufgabe (mehrstufige Analyse eines längeren Dokuments) und prüfe, ob eine größere Stufe merklich besser ist.
- Notiere, wo sich der Unterschied lohnt – das ist deine persönliche Auswahlregel.
Ein Qualitätsvergleich ohne eigene Beispiele ist wenig aussagekräftig: Teste immer mit Material aus deinem tatsächlichen Alltag.
Prüfstatus: Belegt (Stand 1. Oktober 2026): Jahreszahlen, Zahlen, Namen und Quellenangaben dieser Lektion, soweit die Quellenliste sie nennt, wurden gegen Primärquellen geprüft. Nicht einzeln belegt: erklärende Darstellung nach Lehrbuchstand und Quellen, die in der Liste als „allgemeine Referenz“ markiert sind. Modellstufen sind bestätigt; Namen, Versionen und Preise ändern sich laufend.
Quellen
- Anthropic – Claude Docs, Abschnitt „Models overview“ (docs.anthropic.com) (allgemeine Referenz, nicht Zeile für Zeile geprüft)