Claude, Haiku

Claude Haiku 5.5: Anthropic senkt API-Kosten bei kurzen Prompts um 90 Prozent

Veröffentlicht am: 07.10.2026 um 22:34 Uhr | Redaktion boerse-global.de

Das neue Haiku-Modell senkt die Betriebskosten im Schnitt um rund 75 Prozent und erzielt höhere Benchmarkwerte als sein Vorgänger.

Anthropic präsentiert Claude Haiku 5.5 mit deutlich niedrigeren Kosten
Ein minimalistisch gestalteter, moderner Serverraum mit blauer Beleuchtung und reflektierenden Böden. Illustration mit AI erstellt.

Das KI-Unternehmen Anthropic hat Claude Haiku 5.5 vorgestellt. Wie aus Unternehmensberichten vom 7. Oktober 2026 hervorgeht, ist das Modell für schnelle, hochvolumige sowie kostensensible Aufgaben konzipiert. Es handelt sich um das erste Update der kleinsten Modellreihe seit fast einem Jahr und gleichzeitig um das dritte Modell der Claude-5.5-Familie innerhalb eines Monats nach Opus 5.5 und Sonnet 5.5.

Anthropic beziffert die durchschnittlichen Betriebskosten des neuen Modells auf rund 75 Prozent unter denen des Vorgängers Haiku 4.5. Dieser schlug noch mit 1 US-Dollar für die Eingabe und 5 US-Dollar für die Ausgabe je 1 Million Tokens zu Buche.

Bei Claude Haiku 5.5 sind die Preise nach Prompt-Länge gestaffelt: Bei Prompts bis 100.000 Tokens liegen die Kosten bei 0,10 US-Dollar für den Input und 0,50 US-Dollar für den Output je 1 Million Tokens, was einem Nachlass von 90 Prozent entspricht.

Für Anfragen über 100.000 Tokens fallen 0,50 US-Dollar für den Input und 2,50 US-Dollar für den Output an, womit diese um 50 Prozent günstiger sind. Nach Angaben des Unternehmens fielen rund 90 Prozent der bisherigen Anfragen bei Haiku 4.5 in die günstigere Kategorie. Für kurze Prompts entspreche der Preis dem von OpenAIs GPT-6 Luna.

Auch beim Caching führt Anthropic neue Tarife ein. Bei Prompts bis 100.000 Tokens betragen die Gebühren für Cache-Lesezugriffe 0,01 US-Dollar und für Cache-Schreibzugriffe 0,125 US-Dollar je 1 Million Tokens. Bei längeren Eingaben liegen die Werte bei 0,05 US-Dollar beziehungsweise 0,625 US-Dollar.

Technische Neuerungen und Leistungsdaten

Claude Haiku 5.5 ist laut Anthropic das erste Modell der Reihe, das über einen einstellbaren Aufwand verfügt, mit dem Nutzer Kosten und Leistungsfähigkeit je nach Aufgabe abwägen können.

Das Modell ist für Einsatzbereiche wie Klassifizierung, Zusammenfassungen, Datenextraktion, Live-Support und Sprachagenten vorgesehen. Anthropic bezeichnet es als das bislang leistungsfähigste Haiku-Modell, das den Vorgänger in den Bereichen Programmierung, Computerbedienung und Wissensarbeit übertreffe.

Anzeige

Wer sich mit dem Einsatz solch leistungsfähiger KI-Systeme in Unternehmen befasst, muss auch die rechtlichen Rahmenbedingungen der neuen EU-Verordnung im Blick behalten. Dieser kostenlose Umsetzungsleitfaden bietet einen kompakten Überblick über alle Anforderungen, Pflichten und Fristen des AI Acts. EU AI Act in 5 Schritten verstehen: Fristen, Pflichten und Risikoklassen kompakt erklärt

In Benchmark-Tests erzielte das Modell bei der Offline-Teilmenge der OSWorld 2.1-Computerbedienung einen Wert von 72,4 Prozent, während Haiku 4.5 bei 15,7 Prozent und GPT-6 Luna bei 48,9 Prozent lagen. Beim agentischen Coding im Terminal-Bench 4.0 erreichte Claude Haiku 5.5 ein Ergebnis von 39,2 Prozent, verglichen mit 0,0 Prozent bei Haiku 4.5 und 16,4 Prozent bei GPT-6 Luna.

Anthropic ergänzte zudem eine Beta-Unterstützung für Computer- und Browserbedienung in den Software Development Kits für Python und TypeScript. Erstmals in der Modellreihe sind Schutzmaßnahmen für bestimmte sicherheitskritische Cybersecurity-Anfragen integriert; alltägliche Aufgaben seien davon überwiegend nicht betroffen.

Plattform-Verfügbarkeit und Anpassungen bei Sonnet 5.5

Das Modell steht auf der Claude Platform sowie über AWS, Google Cloud und Azure bereit. Amazon Web Services meldete die Verfügbarkeit auf Amazon Bedrock und Claude Platform on AWS.

Anzeige

Während neue Modelle die technologischen Möglichkeiten erweitern, stellen sie Unternehmen auch vor neue Fragen zur rechtssicheren Einstufung ihrer Systeme. Erfahren Sie in diesem kostenlosen Report, welche KI-Anwendungen als Hochrisiko gelten und wie Sie die Dokumentationspflichten korrekt umsetzen. Welche KI-Systeme gelten als Hochrisiko – und was müssen Unternehmen jetzt konkret tun?

Auf Amazon Bedrock wird der Zugriff über regionale Geo-CRIS-Inferenzprofile in den Regionen USA, EU, Australien, Japan sowie global bereitgestellt, verbunden mit regionaler Datenresidenz und zentraler AWS-Abrechnung. Zudem stellt AWS GovCloud (US) das Modell über bedrock-runtime und bedrock-mantle bereit.

Parallel zur Modelleinführung halbierte Anthropic den Preis für Cache-Lesezugriffe bei Sonnet 5.5 von 0,20 US-Dollar auf 0,10 US-Dollar je 1 Million Tokens. Dadurch verringern sich die Kosten für Sonnet 5.5 laut Unternehmen bei den meisten agentischen Aufgaben um rund 20 Prozent.

Zudem kündigte Anthropic monatliche API-Guthaben an: für Max-Stufen fünfmal 100 US-Dollar sowie 20-mal 200 US-Dollar, während für Team-Tarife gepoolte Guthaben von bis zu 500 US-Dollar vorgesehen sind.

Disclaimer...

de | wissenschaft | 70259615 |