01 KI-Beratung 02 Softwareentwicklung 03 Über mich 04 Blog
DE EN
Gespräch vereinbaren
← Alle Beiträge

KI-Beratung

Zwei Modelle an einem Tag: was der 22. September über den KI-Markt verrät

Am 22. September 2026 haben zwei Anbieter im Abstand von ein bis zwei Stunden neue Modelle veröffentlicht: Anthropic Claude Opus 5.5, OpenAI die Stufen GPT-6 Sol und GPT-6 Luna. Welches Haus zuerst dran war, ist widersprüchlich belegt; der gemeinsame Tag ist gesichert. Eine Absicht dahinter hat kein Anbieter geäußert.

Interessanter als die Frage, wer gewonnen hat, ist eine Messung vom selben Tag. Der unabhängige Analysedienst Epoch AI hat über fünf Benchmarks hinweg ausgerechnet, wie schnell der Preis für eine gegebene Leistung fällt: um rund 47 Prozent pro Quartal, seit 2023 etwa das Dreizehnfache pro Jahr. Das ist die eigentliche Nachricht dieses Tages — und sie bedeutet, dass jede Wirtschaftlichkeitsrechnung, die zwölf Monate alt ist, mit Preisen aus einer anderen Epoche rechnet.

Auf einen Blick

  • Was gilt: Am 22.09.2026 erschienen Claude Opus 5.5 sowie GPT-6 Sol und Luna — aber nicht Flaggschiff gegen Flaggschiff: OpenAI zeigte mittlere und kleine Stufen zu etwa halbierten Preisen, sein Spitzenmodell GPT-6 Astra stammt vom 3. September.
  • Was folgt: Epoch AI misst 47 Prozent Preisverfall pro Quartal bei gleicher Leistung — schneller als die historischen Kostenkurven bei Strom, Rechenleistung und Batterien.
  • Der Haken: Die unabhängige Vorabprüfung von Opus 5.5 nennt den Fortschritt „incremental” — und legt offen, dass der geprüfte Anbieter ein redaktionelles Prüfrecht am Bericht hatte.

Was an diesem Tag geschah

DatumAnthropicOpenAI
24.07.2026Claude Opus 5—
01.09.2026Claude Fable 5.1 und Mythos 5.1—
03./04.09.2026—GPT-6 Astra (Flaggschiff)
22.09.2026Claude Opus 5.5GPT-6 Sol + GPT-6 Luna

Die Lesart „zwei Spitzenmodelle im Duell” hält der Prüfung nicht stand: OpenAI zeigte keine neue Spitze, sondern zwei günstigere Stufen unterhalb des eigenen Flaggschiffs — das blieb GPT-6 Astra vom 3. September. Anthropic stellte umgekehrt sein Flaggschiff vor, 19 Tage nach Astra und knapp zwei Monate nach Opus 5. Gemeinsam ist beiden Ankündigungen nicht die Leistungsspitze, sondern der Preis.

Die Zahl, die den Tag erklärt

Epochs Messung ist die belastbarste Zahl des Quartals, weil sie nicht von einem Anbieter stammt und in sich stimmt: 47 Prozent je Quartal ergeben über vier Quartale rund Faktor 13. Ein Teil davon ist Hardware — jeder in KI-Chips investierte Dollar liefert laut Epoch pro Jahr etwa 49 Prozent mehr Rechenleistung. Der Verfall bei der Modellnutzung ist schneller als diese Kurve; was darüber hinausgeht, kommt aus besseren Verfahren — meine Einordnung, nicht Epochs Messung.

Zu den Einzelpreisen schweige ich bewusst. Meine Quellen widersprechen sich: Aus den Listenpreisen ergibt sich für Opus 5.5 ein Rückgang von etwa einem Fünftel, der Anbieter selbst spricht von 40 Prozent geringeren Betriebskosten — je nach Bezugsgröße kann beides zutreffen. Und die Zahlen zu den GPT-6-Stufen stammen aus einer einzigen Quelle, die ein zweiter Prüfdurchgang nicht wiederfand. Der Listenpreis ist ohnehin nicht der Preis, den Sie zahlen: Cache-Lesevorgänge kosten nur 2,5 bis 10 Prozent des Eingabepreises, die Stapelverarbeitung gibt 50 Prozent Rabatt.

Drei Einwände gegen die einfache Lesart

Erstens: „Unabhängig geprüft” trägt weniger, als es klingt. METR, eine der wenigen Stellen, die Modelle vor Veröffentlichung prüfen, testete Opus 5.5 zehn Werktage lang an fünf Aufgaben. Das Urteil: besser als das teurere Vorgängermodell, aber ausdrücklich ein „incremental improvement”. Bemerkenswerter ist, was METR über die eigenen Grenzen schreibt: Alignment-Eigenschaften wurden nicht geprüft — und der geprüfte Anbieter hatte ein redaktionelles Prüfrecht am veröffentlichten Text. Eine Fremdprüfung, an deren Wortlaut der Geprüfte mitredigiert, ist kein Testat. Wer Sorgfaltspflichten mit „extern geprüft” begründet, sollte wissen, was der Satz hergibt — dasselbe Muster wie beim Sicherheits-Narrativ eines Anbieters.

Zweitens: Preise fallen nicht nur. Ein Einführungspreis ist eine Verkaufsmaßnahme, keine Kalkulationsgrundlage: Der von Gemini 3.8 Flash gilt nur bis zum 31.12.2026 und verdoppelt sich zum 1. Januar 2027, und DeepSeek hat die Preise für sein Modell V4-Pro im August sogar erhöht und erstmals nach Spitzen- und Nebenzeiten abgerechnet.

Drittens: Wechseln ist Entwicklungsarbeit, keine Konfigurationszeile. In der aktuellen Claude-Generation sind temperature, top_p und top_k abgeschafft — abweichende Werte liefern einen Fehler, und fast jedes ältere LLM-Projekt setzt sie. Dazu die Abkündigungen: Opus 4.1 ist seit dem 5. August abgeschaltet, Sonnet 4.5 folgt frühestens am 29. September 2026, Haiku 4.5 ab dem 15. Oktober.

Ein waagerechter Bone-Messbalken mit fein gekerbter Kante liegt vor tiefem Ink-Grund auf einer massiven, vollflächigen Bone-Fläche. In der Mitte fehlt dem Balken ein Stück; das herausgelöste Segment schwebt leicht versetzt darüber und ist nur als hohler Umriss mit denselben Kerben gezeichnet. An der rechten Schnittkante läuft eine einzelne kurze senkrechte vermilionfarbene Markierung in die Fläche hinunter.

Der Preisverfall ist gemessen. Wer ihn misst, ist nicht immer unabhängig: In der Vorabprüfung hatte der Geprüfte ein redaktionelles Prüfrecht am Bericht — ein Stück des Maßstabs ist herausgelöst und liegt daneben.

Wer arbeitet eigentlich in Ihrem Copilot?

Seit dem 25. September, drei Tage nach dem Doppel-Launch, routet Microsoft seinen Copilot automatisch: Eine Software wählt nach Genauigkeit, Geschwindigkeit und Kosten aus, welches Modell antwortet — aus der GPT-Familie, der Claude-Familie oder Microsofts eigener MAI-Reihe. Wer nicht weiß, welches Modell arbeitet, weiß nicht, wer die Daten verarbeitet; Auftragsverarbeitungsvertrag, Verarbeitungsverzeichnis und Drittlandbewertung wackeln an derselben Stelle. Verlangen Sie die Auskunft, welche Modelle der Router nutzen darf, und eine Mitteilung bei Änderungen. (Sekundärquelle mit Datum; Microsofts eigene Ankündigung habe ich nicht geprüft.)

Was das für Ihr Unternehmen heißt

Erstens: Holen Sie alte Absagen aus dem Archiv. Wenn ein Vorhaben 2025 an den Nutzungskosten gescheitert ist, ist die damalige Rechnung nicht knapp falsch, sondern aus einer anderen Größenordnung. Rechnen Sie die drei oder vier teuersten Fälle neu.

Zweitens: Verdrahten Sie sich nicht fest. Vom Preisverfall profitiert nur, wer wechseln kann, und die Bindung entsteht selten am Modell, sondern am Kontext darum herum — Prompts, Memory, Werkzeuganbindungen. Wie teuer dieser Kontext-Lock-in wird, unterschätzen die meisten Projekte.

Drittens: Machen Sie Modell-Transparenz zur Anforderung. Halten Sie in Verträgen und in Ihrer KI-Richtlinie fest, welche Modelle in welchem Werkzeug zugelassen sind und wer über einen Wechsel informiert.

Fazit

Der 22. September war kein Duell, sondern eine Preisrunde — und die interessanteste Zahl des Tages kam von keinem der beiden Beteiligten. Wenn der Preis für eine gegebene Leistung um rund die Hälfte pro Quartal fällt, ist „welches Modell ist das beste?” die falsche Frage. Die richtige lautet: Welche Vorhaben rechnen sich jetzt, die sich vor einem Jahr nicht gerechnet haben?

Ein Vorbehalt gehört dazu: Nicht alles fällt, Einführungspreise laufen aus, und die Prüfung, die den Fortschritt einordnet, ist selbst nicht ganz unabhängig. Wer darauf plant, plant mit Bandbreiten. Wenn Sie wissen wollen, welche Ihrer verworfenen KI-Vorhaben heute tragen, sprechen wir darüber — ich rechne das als Entwickler und lese die Vertrags- und Datenschutzfolgen als Wirtschaftsjurist.

FAQ

Was wurde am 22. September 2026 veröffentlicht?

Anthropic hat Claude Opus 5.5 vorgestellt, OpenAI die Stufen GPT-6 Sol und GPT-6 Luna — am selben Tag, ein bis zwei Stunden auseinander. Flaggschiff gegen Flaggschiff war das nicht: OpenAI zeigte mittlere und kleine Stufen zu etwa halbierten Preisen, sein Spitzenmodell GPT-6 Astra stammt vom 3. September 2026. Welches Haus zuerst dran war, ist widersprüchlich belegt.

Wie schnell fallen die Preise für KI-Leistung wirklich?

Epoch AI hat am 22. September 2026 über fünf Benchmarks gemessen, dass der Preis für eine gegebene Leistung um rund 47 Prozent pro Quartal fällt — seit 2023 etwa das Dreizehnfache pro Jahr. Beide Angaben beschreiben dieselbe Bewegung: 47 Prozent je Quartal ergeben über vier Quartale ungefähr Faktor 13.

Warum nennt dieser Beitrag keine Preise pro Million Token?

Weil meine Quellen sich widersprechen: Aus den Listenpreisen ergibt sich für Claude Opus 5.5 ein Rückgang von etwa einem Fünftel, der Anbieter selbst spricht von 40 Prozent geringeren Betriebskosten. Die Zahlen zu den GPT-6-Stufen stammen aus einer einzigen Quelle, die ein zweiter Prüfdurchgang nicht wiederfand. Belastbar sind Richtung und Rate des Verfalls, nicht die Einzelpreise.

Was heißt das für die Modellauswahl im Unternehmen?

Alte Absagen aus Kostengründen gehören auf Wiedervorlage, nicht ins Archiv. Vom Verfall profitiert aber nur, wer wechseln kann, und der Wechsel ist Entwicklungsarbeit: In der aktuellen Claude-Generation sind temperature, top_p und top_k abgeschafft. Wer ein Werkzeug mit automatischer Modellwahl einkauft, braucht zusätzlich die Auskunft, welche Modelle der Router nutzen darf.


Quellen — Stand 26.09.2026

Hinweis: openai.com war nicht erreichbar (HTTP 403); die OpenAI-Fakten stützen sich auf das Entwickler-Changelog und Drittquellen. Die absoluten Preise der GPT-6-Stufen waren einzelquellig und in einem zweiten Durchgang nicht bestätigt — deshalb nennt dieser Beitrag keine Token-Preise.

Dieser Beitrag ist allgemeine Information und keine Rechtsberatung im Einzelfall. Der Markt bewegt sich schnell; Stand 26. September 2026 — prüfen Sie Preise und Abkündigungsfristen vor Entscheidungen an der Primärquelle.

Leon Lotz

Leon Lotz

Leon Lotz ist Wirtschaftsjurist und Gründer von MusketierSoftware. Er verbindet juristische Tiefe mit echtem Software-Handwerk.

KI-gestützt erstellt, redaktionell geprüft und verantwortet. KI-Transparenz