Halbe Preise für KI-Modelle: OpenAI und Anthropic starten Preis-Schlacht
Anthropic senkt die Kosten für Claude Opus 5.5 um 40 Prozent, OpenAI zieht mit GPT-6 Sol und Luna nach und halbiert die API-Preise. Ausgerechnet nach dem…
Aktien im Artikel
Goldesel Kompakt
Das Wichtigste in Kürze
- Anthropic senkt Preise: Claude Opus 5.5 kostet bei typischen Workloads 40 Prozent weniger als Opus 5, Input-Tokens liegen bei 4 US-Dollar pro Million.
- OpenAI kontert: Rund 90 Minuten nach Anthropic senkte OpenAI die API-Preise für GPT-6 Sol und Luna um 50 Prozent gegenüber der 5.6-Serie.
- Verfügbarkeit: Claude Opus 5.5 ist ab sofort über Amazon Web Services, Google Cloud und Microsoft Azure verfügbar.
90 Minuten Abstand: Zwei Modell-Release am selben Tag
Der 22. September 2026 war ein beispielloser Tag im KI-Markt: Gegen Mittag veröffentlichte Anthropic Claude Opus 5.5, das erste Modell der neuen 5.5-Familie. Nur rund 90 Minuten später zog OpenAI nach und stellte die kleineren Modelle GPT-6 Sol und Luna vor. Beide Konzerne verbanden die Releases mit derselben Botschaft: Die neuen Modelle sind deutlich günstiger als ihre Vorgänger.

Bei Anthropic kostet Claude Opus 5.5 bei typischen Workloads 40 Prozent weniger als Opus 5. Die API-Preise liegen bei 4 US-Dollar pro 1 Million Input-Tokens, 20 US-Dollar pro 1 Million Output-Tokens und 0,20 US-Dollar pro 1 Million Cache-Reads. Die Cache-Reads sind damit 60 Prozent günstiger als beim Vorgänger. Dazu kommt, dass Opus 5.5 den Output mehr als 30 Prozent schneller generiert als Opus 5.
OpenAI ging noch weiter: Die API-Preise für GPT-6 Sol und Luna wurden gegenüber der 5.6-Serie um die Hälfte gesenkt. Das Unternehmen führt die Preissenkung auf Verbesserungen beim Caching und bei der Inferenz zurück. Sol ist auf komplexe Aufgaben wie Programmierung ausgelegt, Luna auf Routinearbeit mit hohem Volumen, etwa das Zusammenfassen von Dokumenten oder das Beantworten kurzer Fragen.
Was Opus 5.5 konkret kann
Anthropic positioniert Opus 5.5 als neues Spitzenmodell. Es erreiche das Niveau von Claude Fable 5.1 bei den meisten Aufgaben, bei agenticem Programmieren, Computernutzung und Wissensarbeit führe es die eigenen Benchmarks an. Ein früher Tester habe damit eine Migration von 680.000 Codezeilen an einem einzigen Tag abgeschlossen, Arbeit, für die ein Engineering-Team Wochen gebraucht hätte. In einem weiteren Test habe Opus 5.5 ein 200.000 Zeilen umfassendes Code-Audit in unter drei Stunden erledigt, wo Opus 5 über 20 Stunden und das 2,5-Fache an Tokens benötigte.
Die Effizienzgewinne sind kein Nebeneffekt, sondern Kern des Produkts. Opus 5.5 verbraucht weniger Rechenleistung pro Anfrage und braucht weniger Tokens pro Aufgabe. Auf FrontierCode schlägt das Modell laut Anthropic GPT-6 Astra bei rund 20 Prozent der Kosten pro Aufgabe, auf Terminal-Bench 4.0 liegt es etwa gleichauf zum 40-Prozent-Preis. Gegenüber GPT-5.6 Sol liegt Opus 5.5 auf CursorBench 11 Punkte vorn, bei etwa einem Drittel der Kosten.
OpenAI wiederum gibt auf Basis interner Evaluierungen an, dass GPT-6 Sol etwa halb so viele Fehler mache wie das Vorgängermodell. Das Unternehmen schreibt in seiner Ankündigung, das Modell erreiche die Zuverlässigkeit von Astra zu deutlich niedrigeren Kosten. Die neuen Versionen von Sol und Luna sind für zahlende Konten in ChatGPT Work und Codex sowie über die ChatGPT-API verfügbar, Luna zusätzlich in der Desktop-App und für Free- und Go-Nutzer.
GPT-6 Astra introduced a new generation of intelligence; these models extend its benefits by making that intelligence more efficient and accessible.
OpenAI, Ankündigung zu GPT-6 Sol und Luna
Der Widerspruch: Preisdruck trotz Slowdown-Appell
Was die Doppelvorstellung besonders bemerkenswert macht: Erst in der Vorwoche hatte Anthropic-CEO Dario Amodei ein „Pacing the Frontier“ gefordert, also ein Tempo beim Modellfortschritt, bei dem Sicherheitsmaßnahmen Schritt halten können. Er argumentierte, dass die heutigen Modelle beherrschbare Risiken mit sich bringen, ernstere Risiken aber mit wachsenden Fähigkeiten schnell entstehen könnten und man sich jetzt darauf vorbereiten müsse.
Anthropic betont, Opus 5.5 sei das erste Release seit diesem Appell und wurde vor der Veröffentlichung von externen Gutachtern geprüft, darunter Frontier Design und METR. Auf dem automatisierten Verhaltens-Audit, dem umfangreichsten Alignment-Test des Unternehmens, sei es das stärkste bisher getestete Modell. Es sei weniger anfällig für Prompt-Injection und seltener bereit, schwer umkehrbare Aktionen auszuführen oder vorgegebene Grenzen zu überschreiten.
Gleichzeitig zeigt der Preisverfall, dass der Wettbewerbsdruck stärker wirkt als jeder langsamere Kurs. Effizientere Modelle verbilligen nicht nur die Nutzung, sie senken auch die Rechenkosten beim Anbieter selbst. Wer die Kosten pro Aufgabe am stärksten drückt, gewinnt Enterprise-Kunden, deren Rechnungen mit Agenten-Workloads schnell in die Millionen gehen. OpenAI und Anthropic werben in ihren Ankündigungen ausdrücklich damit, die Modelle des jeweiligen Konkurrenten bei gleichem Ergebnis für einen Bruchteil der Kosten zu schlagen.
Wolkenriesen und Anwendungsfirmen als Gewinner
Für die großen Cloud-Plattformen ist die Verbreitung der Modelle direkt Geschäft. Claude Opus 5.5 ist ab sofort über Amazon Web Services, Google Cloud und Microsoft Azure verfügbar. Alle drei Konzerne betreiben die nötige Recheninfrastruktur und verkaufen Zugriff auf die Modelle an Geschäftskunden weiter. Billigere Tokens bedeuten für sie mehr Nutzungsvolumen, weil sich KI-Workloads für mehr Unternehmen rechnen.
Auch Softwarefirmen, die KI in ihre Produkte einbauen, profitieren unmittelbar. Box setzt in seiner KI-Suite auf Claude-Modelle und berichtet von internen Evaluierungen, in denen Opus 5.5 ein Drittel der Tokens von Opus 5 verbrauchte und die Antworten 40 Prozent kürzer ausfielen, ohne an Genauigkeit einzubüßen. Spotify sah in eigenen internen Evaluierungen eine klare Verbesserung der Token-Effizienz, gleich Aufgaben ließen sich günstiger und schneller erledigen. Thomson Reuters setzt Claude-Modelle unter anderem in der Rechtsplattform CoCounsel ein und meldet bessere Ergebnisse in Experten-Evaluationen neben Gewinnen bei Geschwindigkeit und Token-Effizienz.
Diese Aktien sind mögliche Profiteure
Microsoft, Amazon und Alphabet sind über ihre Cloud-Sparten die Verteiler der neuen Modelle. Box und Spotify senken mit günstigeren Tokens ihre laufenden Betriebskosten für KI-Features, Thomson Reuters nutzt die Modelle in seinen Rechts- und Informationsprodukten.
Quellen & weiterführende Berichte