Claude Opus 5.5 ist da – und mit ihm der bisher deutlichste Preisrutsch am oberen Ende des KI-Markts. Anthropic veröffentlichte das Modell am 22. September 2026 und senkte die Token-Preise um 20 Prozent. Wenige Minuten später konterte OpenAI mit zwei neuen GPT-6-Modellen namens Sol und Luna, deren API-Preise rund die Hälfte der jeweiligen Vorgänger betragen. Für alle, die KI nicht als Spielerei, sondern als Kostenstelle betrachten, ist das die eigentliche Nachricht des Tages.
Was Claude Opus 5.5 kostet – und was es kann
Anthropic nennt für Opus 5.5 4 US-Dollar pro Million Eingabe-Token und 20 US-Dollar pro Million Ausgabe-Token. Das sind jeweils 20 Prozent weniger als bei Opus 5. Den stärksten Schnitt gab es bei den Cache-Reads: Sie fallen von 0,50 auf 0,20 US-Dollar pro Million Token, also um 60 Prozent. Da Cache-Reads bei agentischen Arbeitslasten den Löwenanteil der Kosten ausmachen, rechnet Anthropic für typische Aufgaben mit rund 40 Prozent geringeren Gesamtkosten. Diese 40 Prozent kommen nicht allein aus dem Preis: Laut Anthropic braucht Opus 5.5 auch weniger Token pro Aufgabe und erzeugt den Output über 30 Prozent schneller. Ein schnellerer Bedienmodus kostet extra: 8 US-Dollar Eingabe, 40 US-Dollar Ausgabe.
Klartext ins Postfach
KI, Security & Crypto – die wichtigsten Analysen, kein Spam. Jederzeit abbestellbar.
Bei der Leistung meldet Anthropic unter anderem 66,4 Prozent auf Terminal-Bench 4.0 gegenüber 52,3 Prozent für Opus 5 – gemessen allerdings auf der höchsten Denkstufe und mit einem Standardfehler von ±2,6 Prozentpunkten. Auf GDPval-AA v2.1 stehen bei maximalem Effort 1846 Elo gegen 1708 für Opus 5 und 1735 für Fable 5.1. Bemerkenswert ehrlich ist die Einordnung im eigenen Haus: Anthropic schreibt selbst, dass Benchmark-Abstände auf diesem Niveau ein weniger verlässlicher Hinweis auf echte Unterschiede seien und der Abstand im Alltag schmaler ausfalle, als die Zahlen suggerieren. Das ist ein Satz, den man von einem Hersteller selten liest.
OpenAIs Antwort: Sol und Luna
OpenAI zielt mit den beiden neuen Modellen nach unten auf der Kostenkurve. Sol liegt bei 2 US-Dollar pro Million Eingabe- und 10 US-Dollar pro Million Ausgabe-Token, Luna eine Größenordnung darunter bei 10 beziehungsweise 50 Cent. Zum Vergleich: GPT-5.6 Sol lag bei 4 und 20 US-Dollar, GPT-5.6 Luna bei 20 Cent und 1,20 US-Dollar. Luna ist für Routinearbeit im großen Stil gedacht – Zusammenfassen, Extrahieren –, Sol für wiederkehrende Coding- und Agentenaufgaben. Beide stammen laut OpenAI aus derselben GPT-6-Generation wie GPT-6 Astra und sollen dessen Fähigkeiten günstiger verfügbar machen.
Ein sauberer Direktvergleich zwischen den beiden Häusern existiert übrigens nicht: OpenAI misst gegen Fable 5.1 und Opus 5, Anthropic gegen GPT-6 Astra und GPT-5.6 Sol. Wer also liest, das eine Modell „schlage” das andere, sollte immer nachsehen, wer gemessen hat.
Was das für dich bedeutet
Ich habe in den letzten beiden Jahren genug Projekte gesehen, in denen der KI-Einsatz nicht an der Qualität scheiterte, sondern an der Rechnung am Monatsende. Genau dort greift diese Runde. Die interessante Zahl ist nicht der Listenpreis, sondern der Cache-Read. Wer einen Agenten über eine Codebasis oder eine Dokumentensammlung laufen lässt, schickt denselben Kontext immer wieder mit. Minus 60 Prozent an dieser Stelle verändert die Wirtschaftlichkeit eines Anwendungsfalls stärker als jeder Benchmark-Punkt.
Zwei Details relativieren den Rabatt allerdings, und die stehen selten in den Ankündigungen: Cache-Writes kosten bei Opus 5.5 5 US-Dollar pro Million Token, also mehr als Input-Token. Caching rechnet sich erst ab der Wiederverwendung. Und ein Cache lebt standardmäßig nur wenige Minuten – bei seltenen, verteilten Aufrufen greift er schlicht nie.
Der zweite Punkt betrifft die Auswahl: Der Preisabstand zwischen den Klassen ist inzwischen so groß, dass es fahrlässig ist, alles mit dem teuersten Modell zu erledigen. Luna kostet pro Ausgabe-Token ein Vierzigstel von Opus 5.5. Für Klassifikation, Extraktion oder Zusammenfassungen ist das der richtige Griff; für eine mehrstündige, unbeaufsichtigte Aufgabe über mehrere Repositories eben nicht.
Und aus CISO-Sicht noch ein Detail, das in den Preismeldungen untergeht: Anthropic liefert Opus 5.5 mit Schutzmechanismen aus, die die meisten Cybersecurity-Aufgaben auf ein älteres Modell (Opus 4.8) umleiten, und fenced Biologie-Arbeit mit hohem Risiko ab. Wer das Modell für Security-Arbeit einplant, sollte das vorher testen statt es hinterher zu bemerken – für geprüfte Praktiker soll ein Verifizierungsprogramm folgen. Praktisch heißt das: In einer Security-nahen Pipeline kann man sich nicht darauf verlassen, dass über alle Schritte hinweg dasselbe Modell antwortet. Wer Qualität misst, sollte deshalb wissen, welches Modell gerade geantwortet hat.
Drei konkrete Schritte
- Kosten pro Aufgabe messen, nicht pro Token. Lege für deine zwei bis drei häufigsten Arbeitslasten fest, was ein Durchlauf heute kostet. Ohne diesen Ausgangswert ist jede Preissenkung eine Behauptung.
- Prompt-Caching wirklich nutzen. Stabilen Kontext (Systemprompt, Referenzdokumente, Code-Kontext) an den Anfang stellen und konstant halten. Sonst greift der 60-Prozent-Rabatt schlicht nicht.
- Modell-Routing einführen. Eine simple Regel – Routinearbeit auf das billige Modell, komplexe Agentenläufe auf das starke – spart in der Praxis mehr als jede Preisrunde der Anbieter.
Wer solche Experimente lieber im eigenen Haus fährt, statt Token abzurechnen: Welche Hardware für lokal betriebene Modelle sinnvoll ist, habe ich in meinem Ratgeber zu Hardware für lokale LLMs zusammengefasst. Für einen Teil der Routineaufgaben ist das die ruhigere Rechnung.
Verfügbarkeit
Opus 5.5 läuft auf der Claude-Plattform als claude-opus-5-5 sowie über AWS, Google Cloud und Microsoft Azure. Claude Sonnet 5.5 und Haiku 5.5 sollen in den kommenden Wochen folgen. Die OpenAI-Modelle sind als gpt-6-sol und gpt-6-luna für Entwickler verfügbar sowie in ChatGPT Work und Codex; Free- und Go-Nutzer bekommen Luna in der Desktop-App.
Quellen
- Anthropic: Claude Opus 5.5 (22.09.2026)
- TechCrunch: OpenAI launches GPT-6 Sol and Luna (22.09.2026)
- VentureBeat: OpenAI releases GPT-6 Sol and Luna models
- SiliconANGLE: Anthropic releases Claude Opus 5.5 and OpenAI counters with two cheaper GPT-6 models
Diese Analysen als Newsletter
Ein Mal pro Woche Klartext zu KI, Security & Crypto – direkt in dein Postfach.
Jetzt anmelden