Claude Haiku 5.5: Anthropic senkt Preise um bis zu 90%

Claude Haiku 5.5: Anthropic senkt Preise um bis zu 90%

Anthropic hat Claude Haiku 5.5 vorgestellt und nennt es sein bislang schnellstes und günstigstes kleines Modell. Zugleich sinken die Preise für Sonnet 5.5, und zahlende Abonnenten erhalten künftig monatliche API-Guthaben. Zusammen zeigen die Ankündigungen, dass sich der Preiskampf zwischen den KI-Laboren weiter verschärft.

Günstiger pro Token, mit einem Haken

Haiku 5.5 ist für große Mengen an Anfragen gedacht, bei denen vor allem die Kosten zählen. Als typische Einsatzgebiete nennt Anthropic Zusammenfassungen, Datenbankabfragen, Klassifizierung und Kundensupport in Echtzeit.

Im Mittelpunkt steht der Preis. Im Schnitt kostet Haiku 5.5 rund 75 Prozent weniger als Haiku 4.5. Bei Prompts mit bis zu 100.000 Tokens fallen die Preise um bis zu 90 Prozent. Laut Anthropic lagen etwa 90 Prozent aller bisherigen Haiku-Anfragen in diesem Bereich. Prompts mit mehr als 100.000 Tokens kosten das Fünffache.

Einen Vorbehalt gibt es allerdings. Haiku 5.5 nutzt einen überarbeiteten Tokenizer, der für dieselbe Aufgabe etwas mehr Tokens braucht. Einen ähnlichen Effekt hatte Anthropic schon bei seinen Opus-4.x-Modellen beobachtet: Dort ließ allein der neue Tokenizer den Verbrauch um etwa 30 Prozent steigen. Die tatsächliche Ersparnis dürfte daher geringer ausfallen, als die Preise pro Token vermuten lassen.

Große Sprünge in den Benchmarks

Im Vergleich zu Haiku 4.5 fallen die Zuwächse deutlich aus:

  1. GDPval-AA v2.1 (Wissensarbeit): 1.620, nach zuvor 735.
  2. Humanity's Last Exam: 45,9 Prozent ohne Werkzeuge und 57,4 Prozent mit Werkzeugen, nach zuvor 10,2 und 18,7 Prozent.
  3. OSWorld-2.1 (Computersteuerung): 72,4 Prozent, nach zuvor 15,7 Prozent.
  4. Terminal-Bench 4.0 (agentisches Programmieren): 39,2 Prozent, wo Haiku 4.5 auf null kam.

Am auffälligsten ist das Ergebnis bei der Computersteuerung. In diesem Modus bedient das Modell selbstständig einen Computer, was viele Tokens verbraucht. Ein schnelles, günstiges Modell passt gut zu solchen Aufgaben.

Anthropic vergleicht Haiku 5.5 auch mit OpenAIs Sparmodell GPT-6 Luna, und Haiku liegt in allen getesteten Kategorien vorn. Die Vergleichswerte von Sonnet 5.5 zeigen jedoch einen klaren Abstand. Das kleine Modell bleibt deutlich hinter Anthropics größerem zurück.

Einstellbares Reasoning und strengere Cyber-Regeln

Haiku 5.5 ist das erste Modell der Haiku-Klasse mit einstellbaren Reasoning-Stufen, sodass Nutzer zwischen Kosten und Qualität abwägen können. Anthropic empfiehlt es für klar umrissene Aufgaben wie Kompaktierung, Zusammenfassungen oder den Einsatz als Sub-Agent. Für komplexes agentisches Programmieren verweist das Unternehmen weiterhin auf Sonnet 5.5 und Opus 5.5.

Die Schutzmechanismen für Cybersicherheit sind strenger als bei Haiku 4.5. Gleichzeitig erlauben sie ein breiteres Spektrum an defensiven Aufgaben als bei Sonnet 5.5, auch weil Haiku insgesamt weniger leistungsfähig ist. Penetrationstests bleiben gesperrt. Organisationen mit weitergehendem Bedarf können sich für Anthropics Verifizierungsprogramme für Biowissenschaften und Cybersicherheit bewerben.

Das Modell ist ab sofort auf allen Plattformen verfügbar, darunter Amazon Web Services, Google Cloud und Microsoft Azure.

Preissenkung bei Sonnet und API-Guthaben

Außerdem halbiert Anthropic den Preis für Cache-Lesezugriffe bei Sonnet 5.5, von 0,20 auf 0,10 Dollar pro Million Tokens. Das Unternehmen rechnet damit, dass die Kosten für die meisten agentischen Aufgaben dadurch um rund 20 Prozent sinken. Der Zeitpunkt deutet auf eine Reaktion auf OpenAIs neue GPT-6.1-Reihe hin, zu der auch GPT-6.1 Sol gehört, beworben zu einem Bruchteil der Kosten des Flaggschiffs.

Abonnenten erhalten künftig monatliche API-Guthaben. Nutzer von Max-5x bekommen 100 Dollar, Nutzer von Max-20x 200 Dollar, und Team-Abonnenten erhalten bis zu 500 Dollar pro Monat. Mit dem Guthaben lassen sich Werkzeuge, Apps und Agenten über die API ausprobieren. Damit knüpft Anthropic an seinen früheren Vorstoß mit kostenlosen Guthaben für Start-ups an.

Zudem aktualisiert Anthropic seine SDKs für Python und TypeScript und ergänzt sie um Beta-Unterstützung für Computer- und Browsersteuerung.

Unsere Einschätzung

Für Teams, die Agenten in großem Umfang betreiben, ist diese Veröffentlichung wichtiger, als es ein weiteres Spitzenmodell wäre. Ein Großteil der Agentenarbeit wiederholt sich: Kontext zusammenfassen, Eingaben klassifizieren, sich durch Oberflächen klicken. Ein günstiges Modell, das diese Schritte gut erledigt, kann die Wirtschaftlichkeit einer ganzen Pipeline verändern, vor allem wenn es als Sub-Agent unter einem größeren Modell arbeitet.

Der Vorbehalt beim Tokenizer erinnert daran, nachzumessen statt anzunehmen. Die Preise pro Token sind nur die halbe Rechnung. Teams sollten die Gesamtkosten einer Aufgabe vergleichen, bevor sie umsteigen.

Das größere Muster ist eindeutig. Die Labore konkurrieren hart über den Preis, und Anthropics Preissenkung bei Sonnet wirkt wie eine direkte Antwort auf OpenAI. Das passt zu Anzeichen, dass die Ausgaben von Unternehmen für KI sinken, obwohl die Nutzung wächst. Es lohnt sich zu beobachten, ob OpenAI mit eigenen Preissenkungen reagiert und ob unabhängige Tests die Werte von Haiku 5.5 bei der Computersteuerung auch außerhalb von Anthropics eigenen Benchmarks bestätigen.