
Anthropic hat am 7. Oktober Claude Haiku 5.5 veröffentlicht. Das kleine KI-Modell soll häufig wiederkehrende Aufgaben günstiger erledigen, etwa Nachrichten sortieren, Informationen aus Dokumenten holen oder einem größeren Agenten zuarbeiten. Für Entwickler ist dabei nicht nur der Leistungszuwachs interessant: Die neue Preisstaffel und eine veränderte Textzerlegung entscheiden darüber, wie viel eine Anwendung tatsächlich spart.
Das Wichtigste in Kürze
- Haiku 5.5 startet auf der Claude Platform sowie bei den großen Cloud-Partnern. Die direkte API-Modellkennung lautet claude-haiku-5-5.
- Bis einschließlich 100.000 Eingabe-Tokens kosten eine Million Eingabe-Tokens 0,10 US-Dollar und eine Million Ausgabe-Tokens 0,50 Dollar. Bei längeren Prompts gelten höhere Sätze.
- Der neue Tokenizer zählt denselben Text anders. Niedrigere Tokenpreise lassen sich deshalb nicht unverändert in eine Ersparnis pro Auftrag übersetzen.
- Ein einstellbarer Denkaufwand macht Haiku flexibler. Für anspruchsvolle Programmieragenten bleiben die größeren Modelle laut Anthropic besser geeignet.
Wo ein kleines Modell viel Arbeit abnehmen kann
Haikus interessantester Einsatz liegt in überschaubaren Aufträgen mit klarer Antwortform. Ein Supportsystem muss beispielsweise erkennen, ob eine Nachricht eine Rechnung, eine Kündigung oder eine technische Störung betrifft. Ein Dokumentenassistent kann einzelne Angaben aus einem Bericht herausziehen. Solche Schritte brauchen nicht automatisch das Modell, das auch einen langen Forschungsauftrag oder eine schwierige Softwareänderung bewältigen soll.
Das eröffnet eine sinnvolle Arbeitsteilung: Ein größeres Modell plant, ein kleineres erledigt abgegrenzte Teilaufgaben. Ein solcher Teilagent, oft Subagent genannt, erhält dafür nur das Material und die Anweisung, die er braucht. Unsere Einordnung: Wenn diese Aufträge häufig anfallen, kann ein billigeres Modell mehr bewirken als ein weiterer Spitzenwert bei einer seltenen Spezialaufgabe. Voraussetzung ist, dass die Ergebnisse für den jeweiligen Zweck zuverlässig genug sind.
Anthropics veröffentlichte Benchmarks zeigen einen deutlichen Abstand zum Vorgänger Haiku 4.5. Beim Computertest OSWorld 2.1 nennt der Hersteller 72,4 statt 15,7 Prozent, ausdrücklich auf der Offline-Teilmenge. Beim Programmieragententest Terminal-Bench 4.0 stehen 39,2 Prozent für Haiku 5.5 den 70,6 Prozent von Sonnet 5.5 gegenüber. Das sind Herstellerangaben aus definierten Testumgebungen, keine Erfolgsquoten für den eigenen Arbeitsplatz.
Die Differenz erklärt trotzdem, warum ein Austausch nach Aufgabenart sinnvoller ist als ein pauschaler Wechsel. Wer mehrstufige Softwarearbeit auslagert, hat andere Anforderungen als jemand, der eingehende Texte nach festen Kategorien sortiert. Der größere Claude Opus 5.5 bleibt eine andere Werkzeugklasse. Haiku ergänzt diese Auswahl um einen günstigeren Kandidaten für die vielen kleinen Arbeitsschritte dazwischen.
Was die neue Preisstaffel tatsächlich bedeutet
Die offiziellen API-Preise unterscheiden zwischen Prompts bis einschließlich 100.000 Tokens und längeren Eingaben. Tokens sind die Textbausteine, mit denen das Modell rechnet; sie entsprechen nicht einfach Wörtern. In der günstigeren Stufe fallen pro Million Eingabe-Tokens 0,10 Dollar und pro Million Ausgabe-Tokens 0,50 Dollar an. Oberhalb der Grenze sind es 0,50 beziehungsweise 2,50 Dollar. Die Länge der Eingabe bestimmt damit auch den Preis der Antwort.
Als reines Rechenbeispiel: Ein Auftrag mit 10.000 abgerechneten Eingabe-Tokens und 1.000 abgerechneten Ausgabe-Tokens kostet ohne Zwischenspeicherung oder weitere Gebühren 0,0015 Dollar. Ein Auftrag mit 120.000 Eingabe-Tokens und derselben Ausgabemenge kostet 0,0625 Dollar. Das ist keine Messung einer Anwendung. Es zeigt, warum die günstigste Preiszeile für lange Dokumentensammlungen keine ausreichende Kalkulation liefert.
Hinzu kommt der Tokenizer, also das Verfahren zur Zerlegung des Textes. Laut Modell-Dokumentation zählt derselbe Text bei Haiku 5.5 ungefähr 30 Prozent mehr Tokens als bei Haiku 4.5; der genaue Unterschied hängt vom Inhalt ab. Daraus folgt weder eine feste Kostensteigerung noch eine feste Ersparnis. Wer migriert, muss seine echten Eingaben mit dem neuen Modell erneut zählen und die tatsächlich erzeugten Antworten berücksichtigen.
Auch Zwischenspeicherung verdient einen eigenen Blick. Prompt-Caching kann wiederkehrende Eingabeteile günstiger wiederverwenden, etwa feste Anweisungen oder Dokumentenabschnitte. Die Dokumentation verlangt dafür identische Teile des Prompts. Ein wechselnder Anfang oder ständig veränderte Werkzeugbeschreibungen können den erwarteten Vorteil zunichtemachen. Für eine belastbare Rechnung zählen deshalb Eingabe, Ausgabe, Cache-Treffer und Wiederholungen nach fehlerhaften Antworten zusammen.
So lässt sich der Umstieg sinnvoll prüfen
Auf der direkten Claude-API beginnt der Versuch mit der Modellkennung claude-haiku-5-5. Ein bestehendes Projekt sollte jedoch nicht blind nur diese Zeichenfolge austauschen: Der Migrationsleitfaden nennt Änderungen an Anfrageparametern, der Verarbeitung von Denkblöcken und vorhandenen Gesprächsverläufen. Das ist für Entwickler relevant, weil eine billigere Anfrage wenig hilft, wenn die Anwendung ihre Antwort anschließend falsch ausliest.
Neu für die Haiku-Reihe ist der einstellbare Denkaufwand. Die Dokumentation empfiehlt medium als Ausgangspunkt. Für kurze, einfache Aufgaben kann low schneller und sparsamer sein; bei längeren Agentenaufträgen kann das Modell dann aber eher eine Suche oder Prüfung auslassen. Mehr Denkaufwand ist somit eine Stellschraube, keine kostenlose Verbesserung. Er sollte mit genau den Aufgaben verglichen werden, für die die Anwendung später bezahlt.
Ein brauchbarer Vergleich beginnt mit einer kleinen Sammlung echter Fälle: gewöhnliche Nachrichten, unvollständige Angaben und schwierige Grenzfälle. Danach lässt sich für beide Modelle prüfen, ob Kategorie, extrahierte Werte und Ausgabeformat stimmen. Zusätzlich gehören Bearbeitungszeit und Kosten pro brauchbarem Ergebnis in die Auswertung. Ein Modell, das öfter nacharbeiten muss, kann trotz niedrigerem Listenpreis die schlechtere Wahl sein.
Der Gewinn liegt in mehr bezahlbaren Arbeitsschritten
Haiku 5.5 macht vor allem eine Architektur attraktiver, in der nicht jede Anfrage beim größten Modell landet. Der praktische Fortschritt wäre ein Assistent, der häufiger nachschlagen, sortieren und vorbereiten kann, ohne dass jeder kleine Schritt teuer wird. Wie groß dieser Gewinn ausfällt, entscheidet sich an den eigenen Aufträgen. Die überzeugende Einsatzstelle ist dort, wo ein klar begrenzter Schritt zuverlässig gelingt und die gesamte Kette danach schneller oder günstiger arbeitet.

