Start / News / Claude Haiku 5.5 fällt auf 0,10 $ pro Million Tokens, aber Prompts über 100K kosten fünfmal mehr
Anthropic

Claude Haiku 5.5 fällt auf 0,10 $ pro Million Tokens, aber Prompts über 100K kosten fünfmal mehr

8. Okt. 20265 Min. Lesezeit
Claude Haiku 5.5 fällt auf 0,10 $ pro Million Tokens, aber Prompts über 100K kosten fünfmal mehr

Zusammenfassung der Neuigkeiten

Anthropic hat am 7. Oktober 2026 gegen 11:08 Uhr US-Pazifikzeit Claude Haiku 5.5 veröffentlicht und positioniert es als das kleinste und schnellste Modell seiner Claude-5.5-Familie. Der Einstiegspreis für den API-Zugang kleiner Modelle wurde dabei auf 0,10 $ pro Million Eingabe-Tokens und 0,50 $ pro Million Ausgabe-Tokens für Prompts mit bis zu 100.000 Tokens gesenkt. Das sind etwa 90 Prozent weniger als die Preise von 1 $ und 5 $ bei Claude Haiku 4.5. Das Modell ist unter der Kennung claude-haiku-5-5 auf Anthropics eigener Plattform sowie über Amazon Web Services, Google Cloud und Microsoft Azure verfügbar.

Was Anthropic angekündigt hat

Haiku 5.5 erscheint etwa neun Tage nachdem Anthropic Ende September 2026 erstmals einen Ausblick auf das Modell zusammen mit Sonnet 5.5 gegeben hatte. Laut Berichten von VentureBeat, MarkTechPost, DataCamp und Unite.AI konzentriert sich die Veröffentlichung auf drei Kernpunkte: einen deutlich niedrigeren Basispreis, einen großen Sprung bei der gemessenen Leistungsfähigkeit gegenüber Haiku 4.5 sowie eine Reihe agentenorientierter Funktionen wie anpassbare Aufwandstufen und Beta-Werkzeuge zur Computernutzung. Sekundärberichte nennen zudem ein Kontextfenster von bis zu 1 Million Tokens und eine Ausgabe von bis zu 128.000 Tokens. Da der Artikel von VentureBeat jedoch keine Kontextgröße angibt, sollten Entwickler die genauen Grenzen in der Dokumentation von Anthropic überprüfen.

Anthropic erklärt außerdem, dass reale Arbeitslasten – wenn man Veränderungen beim Token-Verbrauch und typische Anfragegrößen berücksichtigt – etwa 75 Prozent weniger kosten sollten als bei Haiku 4.5. Das ist ein geringerer Wert als die plakativ beworbenen 90 Prozent Preisnachlass.

Die Preisstufen erklärt

Haiku 5.5 nutzt zwei Preisstufen, die sich nach der Prompt-Länge richten und pro Million Tokens angegeben werden:

  • Prompts mit bis zu 100.000 Tokens: 0,10 $ für die Eingabe, 0,50 $ für die Ausgabe, 0,01 $ für Cache-Lesezugriffe und 0,125 $ für fünfminütige Cache-Schreibvorgänge.
  • Prompts mit mehr als 100.000 Tokens: 0,50 $ für die Eingabe, 2,50 $ für die Ausgabe, 0,05 $ für Cache-Lesezugriffe und 0,625 $ für Cache-Schreibvorgänge.
  • Zum Vergleich Claude Haiku 4.5: 1,00 $ für die Eingabe, 5,00 $ für die Ausgabe, 0,10 $ für Cache-Lesezugriffe und 1,25 $ für Cache-Schreibvorgänge.

Für die Batch-API gibt es Berichten zufolge weitere 50 Prozent Rabatt. Mehrere Analysten haben auf die „100K-Token-Falle“ hingewiesen: Eine Anfrage, die diese Schwelle überschreitet, wird zum Fünffachen des niedrigeren Tarifs abgerechnet. Teams, die regelmäßig lange Dokumente oder große Codebasen senden, könnten daher deutlich weniger sparen, als die Schlagzeile vermuten lässt. VentureBeat merkt an, dass in dem Artikel nicht steht, wie Anfragen mit exakt 100.000 Tokens berechnet werden. Anthropic hat zudem die Preise für Cache-Lesezugriffe bei Sonnet 5.5 von 0,20 $ auf 0,10 $ pro Million Tokens gesenkt.

Benchmark-Ergebnisse

Die folgenden Zahlen stammen vom Hersteller und wurden nicht unabhängig reproduziert.

  • GDPval-AA v2.1, eine Bewertung für Wissensarbeit: Haiku 5.5 erreicht 1.620 Punkte, gegenüber 735 bei Haiku 4.5, 1.437 bei OpenAIs GPT-6 Luna und 1.840 bei Sonnet 5.5.
  • AA-Briefcase v1.1: 1.578 für Haiku 5.5, 614 für Haiku 4.5, 1.336 für GPT-6 Luna und 1.824 für Sonnet 5.5.
  • OSWorld 2.1 (Offline-Teilmenge), ein Test zur Computerbedienung: 72,4 Prozent für Haiku 5.5, 15,7 Prozent für Haiku 4.5, 48,9 Prozent für GPT-6 Luna und 83,9 Prozent für Sonnet 5.5.
  • Terminal-Bench 4.0: 39,2 Prozent für Haiku 5.5 bei maximalem Aufwand, 0,0 Prozent für Haiku 4.5, 16,4 Prozent für GPT-6 Luna und 70,6 Prozent für Sonnet 5.5. Bei mittlerem Aufwand erreicht Haiku 5.5 etwa 20 Prozent.
  • FrontierCode 1.1: 46,4 Prozent für Haiku 5.5, 42,4 Prozent für GPT-6 Luna und 52,1 Prozent für Sonnet 5.5 bei hohem Aufwand.

Der unabhängige Aggregator BenchLM vergibt an Haiku 5.5 eine Gesamtpunktzahl von 66,3 von 100 und ordnet es damit auf Platz 28 unter 216 erfassten Modellen ein. Dieser Wert basiert auf einer anderen Methodik und ist nicht direkt mit den Tabellen von Anthropic vergleichbar.

Funktionen und Sicherheitsvorkehrungen

Haiku 5.5 unterstützt anpassbare Aufwandstufen, wobei „mittel“ die Standardeinstellung ist. So können Entwickler Geschwindigkeit und Kosten gegen die Tiefe der Schlussfolgerungen abwägen. Anthropic beschreibt es als sein schnellstes Modell bei Standardgeschwindigkeiten, allerdings wurde kein Wert für Tokens pro Sekunde veröffentlicht. Browser- und Computerbedienungsfunktionen im Beta-Stadium sind über die Python- und TypeScript-SDKs nutzbar.

Das Modell wird mit strengeren Cybersicherheitsbeschränkungen ausgeliefert als Haiku 4.5. Anfragen für Penetrationstests werden durch die Standardschutzmaßnahmen blockiert, während geprüften Nutzern über Verifizierungsprogramme ein breiterer Zugang gewährt wird. Anthropic wies zudem auf monatliche API-Guthaben hin, die in Abonnements enthalten sind: 100 $ für Max 5x, 200 $ für Max 20x und bis zu 500 $ geteilt innerhalb eines Team-Tarifs.

Alex Wang aus dem Bereich angewandte KI beim Finanztechnologieunternehmen Rogo beschrieb die Rolle des Modells in Unternehmensabläufen so: „Es ist genau genug, dass wir ihm dort vertrauen würden, und schnell und günstig genug, dass wir es häufig einsetzen können.“

Der Preisvergleich

Die Vergleichstabelle von VentureBeat listet die folgenden Eingabe- und Ausgabetarife pro Million Tokens auf. Sie vergleicht ausschließlich die Preise, nicht die Fähigkeiten.

  • Claude Haiku 5.5: 0,10 $ und 0,50 $ für Prompts unter 100K Tokens.
  • GPT-6 Luna: 0,10 $ und 0,50 $, mit einem Aufschlag oberhalb von 272K Eingabe-Tokens.
  • Gemini 3.5 Flash-Lite: 0,30 $ und 2,50 $.
  • Gemini 3.8 Flash: 0,75 $ und 3,75 $, Aktionspreise bis zum 31. Dezember 2026.
  • Grok 4.3: 1,25 $ und 2,50 $ bei unter 200K Prompt-Tokens.
  • Grok 4.7: 2,00 $ und 6,00 $ bei unter 200K Prompt-Tokens.
  • GPT-6.1 Sol und Claude Sonnet 5.5: 2,00 $ und 10,00 $.

Warum das für Entwickler und Lernende wichtig ist

Kleine Modelle übernehmen die volumenstarken, repetitiven Teile von KI-Anwendungen: Support-Tickets klassifizieren, Felder aus Dokumenten extrahieren, Anfragen weiterleiten und Teilaufgaben innerhalb größerer Agentensysteme ausführen. Bei 0,10 $ pro Million Eingabe-Tokens kostet eine Million kurzer Anfragen mit jeweils wenigen Hundert Tokens nur wenige Dollar. Das senkt die Einstiegshürde für Studierende, Start-ups und Forschende weltweit, die mit KI experimentieren.

Die Preisstruktur vermittelt zudem eine praktische Lektion für die Softwareentwicklung. Die Kosten hängen nicht nur vom Token-Preis ab, sondern auch von der Prompt-Länge, dem Caching und der Stapelverarbeitung. Entwickler können Prompts unter der 100K-Schwelle halten, zwischengespeicherten Kontext zu einem Zehntel des Eingabepreises wiederverwenden und für nicht dringende Aufgaben die Batch-Verarbeitung nutzen, um das Maximum aus dem neuen Modell herauszuholen.

Einschränkungen

Die meisten Angaben in diesem Bericht stammen aus Artikeln, die am 7. und 8. Oktober 2026 veröffentlicht wurden, und nicht von der Preisseite von Anthropic; zudem wurden die Benchmark-Zahlen vom Hersteller geliefert. Preise, Limits und das Kontextfenster sollten vor jeder Budgetplanung oder Migrationsentscheidung anhand der offiziellen Dokumentation von Anthropic überprüft werden.

Dieser Artikel wurde von der AIBARS-Redaktion mit KI-Unterstützung zusammengestellt. KI kann Fehler machen, prüfe wichtige Angaben daher an der Originalquelle. Fehler entdeckt? Schreibe an [email protected].

AnthropicClaude