Einblicke

Aktuelles und Kommentare

Claude Haiku 5.5: Listenpreis minus 90 %, die echte Rechnung muss neu aufgestellt werden

Am 7. Oktober 2026 hat Anthropic Claude Haiku 5.5 vorgestellt - als bislang günstigstes, schnellstes und leistungsfähigstes kleines Modell, gedacht für hochvolumige, kostensensible Aufgaben. Die Schlagzeile ist der Preis: 0,10 USD Input und 0,50 USD Output pro Million Tokens bei Prompts unter 100K Tokens, 90 % weniger als die Vorgängergeneration. Das Kleingedruckte zählt mehr: Ein neuer Tokenizer zählt rund 30 % mehr Tokens für denselben Text, fünf alte Integrationsmuster liefern jetzt HTTP 400, und adaptives Thinking ist standardmäßig aktiv. Gleichzeitig hat sich der Preiskampf der Branche in die Einstiegsklasse verlagert - DeepSeek, Google und Anthropic bepreisen sie jeweils anders.

SlateMoth Editorial · Muse ·

Recherche und Entwurf durch Muse; stufenweise Prüfung durch Muse im selben Autorenkontext. Recherche, Entwurf, Faktenprüfung und Übersetzung in acht Sprachen durch Muse in gestufter Same-Author-Prüfung (reviewMode=muse_same_platform_staged, contextRelationship=same_author_context); offengelegt als Same-Author-Kontext, kein unabhängiges Drittaudit. Preise und Benchmarks sind Herstellerangaben; Migrationsdetails stammen aus der offiziellen Dokumentation; Vergleiche Dritter sind mit ihren Einschränkungen attribuiert.

Was passiert ist

Am 7. Oktober hat Anthropic Claude Haiku 5.5 vorgestellt - als bislang günstigstes, schnellstes und leistungsfähigstes kleines Modell. Die Positionierung ist eindeutig: hochvolumige, kostensensible Aufgaben - Zusammenfassungen, Kontextkomprimierung, Datenbankabfragen, Klassifizierung sowie Subagenten-Aufgaben unter Opus 5.5 und Sonnet 5.5.

Der Preis ist die Schlagzeile: Bei Prompts bis 100K Tokens kosten 0,10 USD pro Million Input-Tokens und 0,50 USD pro Million Output-Tokens; über 100K Tokens steigen die Sätze auf 0,50 und 2,50 USD. Das Vorgängermodell Haiku 4.5 verlangte pauschal 1,00 und 5,00 USD. Laut Anthropic fielen rund 90 % der Anfragen an das alte Haiku in die günstige Stufe.

[1]

Den Preisnachlass lesen: ein zweistufiges Preisschild

Nach Angaben von Anthropic kostet Haiku 5.5 im Schnitt rund 75 % weniger im Betrieb als 4.5. Beachten Sie die Zuschreibung: Das ist eine Herstelleraussage auf Basis eigener Verkehrsannahmen. Ihre tatsächliche Rechnung hängt von der Länge Ihrer Prompts, der Cache-Nutzung und der Token-Inflation des neuen Tokenizers ab.

Zum Start gab es zwei weitere Wertanpassungen: Der Preis für Cache-Reads bei Sonnet 5.5 wurde halbiert, was laut Anthropic die meisten agentischen Aufgaben rund 20 % günstiger macht; und Max- sowie Team-Abonnenten erhalten neue monatliche API-Guthaben - 100 USD für Max 5x, 200 USD für Max 20x, bis zu 500 USD gemeinsam für Team - gedacht zum Experimentieren mit Agenten auf der Plattform.

Haiku 5.5 ist zudem das erste Haiku mit einstellbarem Effort: Man kann innerhalb einer einzigen Anfrage zwischen Sparen und mehr Intelligenz gewichten, ohne die Modellebene zu wechseln. Erstmals erhält ein kleines Modell die Denk-Drossel, die bisher den Flaggschiffen vorbehalten war.

[1]

Benchmarks: So liest man Herstellerergebnisse

Die Ergebnistabelle stammt von Anthropic selbst: Bei Wissensarbeit erreicht GDPval-AA v2.1 1620 Punkte (735 für 4.5, 1437 für GPT-6 Luna); AA-Briefcase v1.1 erreicht 1578 (614 / 1336); bei Computernutzung erreicht die Offline-Teilmenge von OSWorld 2.1 72,4 % (15,7 % / 48,9 %); bei agentischem Coden erreicht Terminal-Bench 4.0 39,2 % (0,0 % für 4.5, 16,4 % für Luna); bei visuellem Schließen erreicht Chartography 46,4 % (6,4 % / 29,1 %).

Lesart: Die größten Sprünge gibt es bei praktischen Aufgaben - OSWorld von 15,7 % auf 72,4 %, Terminal-Bench von null auf 39,2 %. Doch zwei Vorbehalte bleiben: Alle Zahlen sind Herstellerangaben und nicht unabhängig reproduziert; und Anthropic selbst sagt, dass komplexes agentisches Coden Revier von Sonnet und Opus bleibt, während Haiku für enge, repetitive Aufgaben taugt.

[1]

Migration: fünf Stellen, an denen alter Code 400 liefert

Jenseits des Preises verstecken sich die echten Kosten im Migrationsleitfaden. Haiku 5.5 nutzt den neueren Tokenizer, den es mit Claude 4.7 und späteren Modellen teilt: Derselbe Text zählt rund 30 % mehr Tokens als bei 4.5. Jedes tokenbasierte Budget, jede Kürzungsgrenze und jedes Kostendashboard muss mit Zählungen des neuen Modells neu berechnet werden - nicht mit recycelten alten Zahlen.

Härter noch sind fünf direkte 400er-Fehler: temperature muss 1 sein, top_p muss 0,99 sein, jedes top_k wird abgelehnt; Assistant-Prefill wird verweigert; manuelle Thinking-Budgets (budget_tokens) werden abgelehnt; Computer Use muss auf das neue Toolset umziehen; und das Zurücksenden von Thinking-Blöcken nach Änderung früherer Turns liefert ebenfalls 400. Das alte Klassifizierer-Rezept aus temperature=0 plus Prefill plus max_tokens=20 scheitert an jeder Stelle.

Dann die stillen Änderungen: Adaptives Thinking ist standardmäßig aktiv, sodass Antworten mit einem Thinking-Block beginnen können, der nur ein leeres Feld und eine Signatur trägt; Thinking-Tokens zählen zu max_tokens, sodass kleine Limits direkt nach dem Denken abbrechen können; und ein neuer Sicherheitsklassifizierer kann eine Anfrage mit Ablehnungsgrund stoppen, ohne serverseitigen Fallback. Migration ist kein Modell-ID-Tausch, sondern ein kleines Refactoring.

[2] [4]

Die Einstiegsklasse wird zum Dreikampf

Der Blick von oben: Zwischen September und Anfang Oktober 2026 startete die Einstiegsklasse in einem Fünf-Wochen-Sprint - DeepSeek V4.1 Flash, Google Gemini 3.8 Flash und Anthropic Haiku 5.5 landeten kurz nacheinander. Die Flaggschiff-Schlagzeilen wichen der Einstiegsklasse: Für Chatbots, Ticket-Router und Extraktionsaufgaben, die zehntausendfach am Tag aufgerufen werden, ist die Rechnung der wahre Benchmark.

Die drei Anbieter wählten drei Preislogiken: DeepSeek rechnet nach Spitzen- und Schwachlastzeiten ab und verdoppelt in der Spitze; Anthropic rechnet nach Promptlänge ab und verfünffacht jenseits von 100K Tokens; Google verlangt einen Festpreis. Ein Drittvergleich beziffert Haiku 5.5s Einstiegspreis auf rund ein Siebtel von Gemini 3.8 Flash - doch es gibt keine universelle anbieterübergreifende Preisformel, und wer Cache-, Zeit- oder Längenannahmen ändert, ändert das Ergebnis.

Eine Preisangleichung verdient Beachtung: Mehrere Medien berichten, Haiku 5.5s Kurzprompt-Preise entsprächen exakt denen von OpenAIs GPT-6 Luna. Doch Anthropics eigene Ankündigung hat Lunas Preise nie veröffentlicht - die Paritätsbehauptung stammt aus Drittberichten und sollte nicht als offizielle Bestätigung zitiert werden.

[3] [2] [4]

Fazit und Aktionsliste

Das Fazit: Der Modellwettbewerb ist 2026 in die Phase der Gesamtbetriebskosten eingetreten. Tokenizer-Inflation, Standard-Denkkosten, Cache-Trefferraten und Promptlängenverteilung bestimmen gemeinsam eine Rechnung; wer nur auf Dollar pro Million Tokens schaut, führt Budgets in die Irre. Anthropic selbst positioniert Haiku als schnelle Schicht im Agentensystem - Routing, Klassifizierung, Extraktion, Subagenten - und überlässt komplexes Coden Sonnet und Opus.

Eine Aktionsliste für Teams: Zuerst echte Promptverteilungen mit count_tokens unter dem neuen Tokenizer neu vermessen; für Klassifizierer effort explizit auf niedrig setzen und Prefill-plus-temperature=0-Gewohnheiten durch strukturierte Ausgaben oder Enum-Tools ersetzen; 4.5 und 5.5 parallel auf kleinem Traffic fahren und die Label-Übereinstimmung vergleichen, bevor vollständig umgestellt wird; und bei Langprompt-Aufgaben prüfen, ob die 100K-Token-Linie überschritten wird, an der sich die Preise verfünffachen.

[1] [2]

Quellen und weitere Lektüre

Die Quellenangaben werden von Muse im selben Autorenkontext bereitgestellt und geprüft; eine unabhängige Faktenprüfung wurde nicht durchgeführt.

  1. Offizielle Anthropic-Ankündigung (2026-10-07)

    Anthropic

    Erfasstes Veröffentlichungsdatum ·

    Erfasster Prüfzeitpunkt ·

  2. Anthropic Claude Platform Migrationsdokumentation

    Anthropic (Claude Platform Docs)

    Veröffentlichungsdatum der Quelle nicht verifiziert

    Erfasster Prüfzeitpunkt ·

  3. Tech-Insider-Vergleich der Einstiegsklasse (2026-10-08, Dritter)

    Tech Insider

    Erfasstes Veröffentlichungsdatum ·

    Erfasster Prüfzeitpunkt ·

  4. Migrationsnotizen eines Ingenieurs auf DEV Community (2026-10-08, Dritter)

    DEV Community

    Erfasstes Veröffentlichungsdatum ·

    Erfasster Prüfzeitpunkt ·