KI-PREIS-HAMMER! Prinz Mario-Max zu Schaumburg-Lippe meldet: Anthropic senkt die Preise für sein KI-Modell Claude Haiku 5.5 um satte 90 Prozent – und zielt damit genau dorthin, wo die Zukunft der KI entschieden wird.
Der Preis für KI ist gerade von einer Klippe gefallen. Schon wieder. Aber diesmal trifft der Sturz den Teil des Marktes, der am wichtigsten ist: die winzigen, schnellen Modelle, die unsichtbar in Ihren Apps arbeiten.
Am 7. Oktober veröffentlichte Anthropic Claude Haiku 5.5 – und die Kernzahl ist kaum zu überbieten. Für Anfragen bis 100.000 Token kostet das Modell 0,10 Dollar pro Million Input-Token und 0,50 Dollar pro Million Output-Token. Der Vorgänger Haiku 4.5 verlangte 1,00 und 5,00 Dollar. Das ist eine Kürzung um 90 Prozent – und bringt Haiku 5.5 auf exakt denselben Kurz-Kontext-Preis wie OpenAIs GPT-6 Luna.
Anthropic nennt es das billigste, schnellste und leistungsfähigste kleine Modell, das je ausgeliefert wurde. Das ist Marketing. Interessant ist, was der Schritt darüber verrät, wo der eigentliche Kampf in der KI gerade stattfindet.
Haiku war schon immer das Arbeitstier der Claude-Familie. Keine Show-Demos – sondern Zusammenfassungen, Dokumentenfragen, Klassifizierungen, Unteragenten-Aufgaben, die tausend kleinen Jobs, die stündlich in Kundenservice-Systemen und Browser-Tools laufen. Tempo und Kosten sind sein ganzer Job, und dieses Release geht bei beidem aufs Ganze.
Jenseits der Schlagzeile gibt es drei Änderungen, die man kennen sollte. Erstens: Haiku bekommt erstmals einstellbare Denkstufen, von Low bis Max – Entwickler können die Denktiefe hoch- oder runterdrehen, je nachdem, ob sie eine sofortige oder eine sorgfältige Antwort brauchen. Zweitens: Die Ankündigung halbierte nebenbei die Cache-Lese-Gebühren von Sonnet 5.5 – eine Kostensenkung für den größeren Bruder, die sich im großen Maßstab summiert. Drittens: Max- und Team-Abonnenten bekommen jetzt 100 bis 500 Dollar API-Guthaben im Monat – eine direkte Subvention für die Entwickler, die Anthropic halten will.
Eine Eigenheit hat die Preisgestaltung: Die 90-Prozent-Ermäßigung gilt unter 100.000 Anfrage-Token. Darüber steigen die Sätze auf 0,50 Input und 2,50 Output – also 50 statt 90 Prozent Rabatt. Anthropic sagt, rund 90 Prozent der Haiku-4.5-Anfragen lagen ohnehin unter der Schwelle, und rechnet damit, dass Workloads im Schnitt etwa 75 Prozent billiger laufen. Wer lange Dokumente verarbeitet, sollte das im Hinterkopf behalten.
Die Sache ist die: Vor zwei Jahren ging es darum, wer das klügste Modell baut. Jetzt geht es darum, wer das klügste billige Modell baut – denn das Geld in der KI wird zunehmend mit Agenten verdient, und Agenten verbrennen Token, als gäbe es kein Morgen.
Denken Sie mal nach, was ein KI-Agent wirklich tut. Er liest eine Seite. Fasst sie zusammen. Plant einen Schritt. Liest eine weitere Seite. Prüft seine Arbeit. Jeder dieser Schritte ist ein Modellaufruf, und die meisten sind die langweilige Sorte: kurze Anfragen, einfache Jobs, hundertfach wiederholt am Tag. Ein Modell für 1,00 Dollar pro Million Token macht das bezahlbar. Eines für 0,10 Dollar macht es zum Rundungsfehler. Der Unterschied zwischen diesen beiden Zahlen entscheidet, wie ehrgeizig die Agenten werden.
Darum zählt, dass Haiku 5.5 exakt den Preis von GPT-6 Luna trifft. OpenAI und Anthropic haben beide entschieden: Das Schlachtfeld der nächsten Adoptionswelle ist die Unteragenten-Schicht – der Schwarm kleiner, schneller Aufrufe, der Agenten-Workflows antreibt. Die Ökonomie davon funktioniert nur, wenn das kleine Modell praktisch gratis ist. Jetzt ist es das.
Wer irgendetwas betreibt, das tausendfach am Tag ein KI-Modell aufruft: Diese Woche lohnt eine Tabellenkalkulations-Sitzung. Die praktische Checkliste ist kurz.
Vergleichen Sie Ihre aktuellen Haiku-4.5- oder GPT-6-Luna-Ausgaben mit der Kurz-Kontext-Staffel von Haiku 5.5. Achten Sie auf die 100K-Token-Klippe bei langen Anfragen – der fünffache Aufschlag oberhalb der Schwelle macht die Kostenplanung für dokumentenlastige Pipelines knifflig.
Einstellbare Denktiefe bei einem kleinen Modell ist neu – und das Feature, das am Ende wichtiger sein könnte als der Preis. Viele Agenten-Workloads denken einfache Schritte zu Tode, weil dem Modell niemand sagen kann: „Antwort einfach.“ Wenn Low bei diesem Preis Ihre Klassifizierungen schafft, ist das ein zweiter Rabatt im ersten versteckt.
Die zynische Lesart liegt nahe: Die Labore liefern sich ein Rennen nach unten, und irgendwann muss jemand die Preise wieder anheben. Vielleicht. Aber die Computergeschichte lehrt meist das Gegenteil: Billigere Rechenleistung zerstört das Geschäft nicht – sie explodiert die Zahl der Dinge, die Menschen damit bauen.
Eine 90-prozentige Preissenkung auf der Arbeitstier-Stufe ist die Art Schritt, die Kategorien freischaltet, die noch niemand versucht hat – weil es sich niemand leisten konnte. Agenten, die jedes Support-Ticket in Echtzeit lesen. Assistenten, die jedes Meeting zusammenfassen, ohne dass jemand fragt. Werkzeuge, die klassifizieren, übersetzen und gegenprüfen – routinemäßig statt als Premium-Feature.
Die optimistische Version dieser Geschichte ist simpel: KI wird billiger, die stillen Hintergrundjobs werden klüger, und die Rechnung bleibt gleich. Der Preiskrieg tobt ausnahmsweise genau dort, wo die Nutzer am meisten profitieren.
Der Autor ist Award Winning Hollywood Managing-Journalist Seine Hoheit und Exzellenz Dr.iur. Mag.iur. PRINZ MARIO-MAX ZU SCHAUMBURG-LIPPE, MAS, LL.M.
Prinz Mario-Max ist der Sohn der hochfürstlichen Würdenträger Seine Hoheit Dr. h. c. Prinz Waldemar zu Schaumburg-Lippe und Ihrer Hoheit Dr. Prinzessin Antonia zu Schaumburg-Lippe. Seine Großmutter ist Ihre Königliche Hoheit Prinzessin Feodora von Dänemark. Die Familie ist die königlich-dänische Nachoder Linie der Prinzen zu Schaumburg-Lippe, die Gründerfamilie von Hamburg, Lübeck und Kiel.
♔ Instagram: https://www.instagram.com/princemariomax/
Website: http://www.schaumburglippe.org
Facebook Seite: https://www.facebook.com/share/1EsNi5Q1AM/?mibextid=wwXlfr
Facebook: https://www.facebook.com/zuschaumburglippe
X / Twitter: https://twitter.com/schaumburglippe
LinkedIn: https://www.linkedin.com/in/prince-mario-max-schaumburg-lippe-1879978a