01 KI-Beratung 02 Softwareentwicklung 03 Über mich 04 Blog
DE EN
Gespräch vereinbaren
← Alle Beiträge

Software

Das MCP-Protokoll ist am 28. Juli gebrochen: Warum eine KI-Integration ein Pflegebudget braucht

Am 28. Juli 2026 hat das Model Context Protocol eine neue Spezifikationsversion bekommen, und der Nachfolger der Fassung vom 25. November 2025 ist kein Feinschliff. MCP ist der Standard, über den heute die meisten KI-Agenten an Unternehmensdaten angebunden werden — an das DMS, die Kanzleisoftware, das ERP. Jetzt ist das Protokoll zustandslos: Der Handshake ist weg, der Sitzungs-Header ist weg, ein Pflicht-Aufruf ist dazugekommen, HTTP+SSE ist abgekündigt. Wer 2025 oder Anfang 2026 eine MCP-Integration gebaut hat, muss sie anfassen.

Interessanter als der Bruch ist, was er über die Kostenstruktur von KI-Projekten verrät. Acht Tage später, am 5. August, hat Anthropic Claude Opus 4.1 abgeschaltet — angekündigt am 5. Juni. Zwei verschiedene Vorgänge mit derselben Wirkung: Der Grund, auf dem Sie gebaut haben, bewegt sich unter dem Gebauten. Eine KI-Integration ist deshalb kein Projekt mit Enddatum, sondern eine Anlage mit Pflegebedarf — und das ist eine Position im Budget, die in den meisten Angeboten fehlt.

Auf einen Blick

  • Was gilt: Die MCP-Fassung 2026-07-28 ist zustandslos, server/discover ist für Server Pflicht, subscriptions/listen ersetzt den HTTP-GET-Stream. Roots, Sampling, Logging und HTTP+SSE sind abgekündigt.
  • Was folgt: Für Abkündigungen gilt erstmals ein Fenster von mindestens zwölf Monaten — die Altlast darf nicht vor Ende Juli 2027 wegfallen. Ein Planungshorizont, kein Sicherheitsnetz.
  • Der Haken: Opus 4.1 wurde 61 Tage nach der Ankündigung abgeschaltet. Wer ein Modell fest verdrahtet, hat im Zweifel zwei Monate Zeit.

Was am 28. Juli entfallen ist

Bisher war eine MCP-Verbindung eine Sitzung mit Gedächtnis: ein Handshake über initialize, zusammengehalten vom Header Mcp-Session-Id. Beides ist entfallen; Protokollversion und Client-Fähigkeiten reisen jetzt bei jedem Aufruf im Feld _meta mit.

Bisher (Fassung 2025-11-25)Ab Fassung 2026-07-28Status
Sitzung mit Header Mcp-Session-Idkeine Sitzung, zustandslosentfernt
Handshake initializeAngaben in _metaentfernt
—server/discoverPflicht für Server
HTTP-GET-Stream, resources/subscribesubscriptions/listenersetzt
ping, logging/setLevel—entfernt
Server-initiierte Anfragen (roots/list, sampling/createMessage)Muster Multi Round-Trip Requestsersetzt
Roots, Sampling, Loggingweiter nutzbarabgekündigt, ≥ 12 Monate
HTTP+SSE, Wiederaufnahme per Last-Event-IDWiederaufnahme entferntabgekündigt

Zwei Zeilen tun im Betrieb weh. server/discover müssen Server implementieren — ein selbst gebauter Server, der den Aufruf nicht kennt, ist auf der neuen Version nicht mehr vollwertig. Und die Wiederaufnahme abgebrochener Streams ist entfernt: Ein abgebrochener Stream verliert die laufende Anfrage, die Wiederholung müssen Sie selbst bauen. Dazu kommt eine Härtung bei der Anmeldung: Die iss-Prüfung nach RFC 9207 ist Pflicht, die dynamische Client-Registrierung ist abgekündigt.

Die zweite Variante: Modelle verschwinden mit Frist

Der Protokollbruch ist der sichtbarste Wartungsposten des Quartals, nicht der häufigste. Der häufigste ist banaler: Das Modell, auf das ein Produkt verdrahtet ist, verschwindet. Claude Opus 4.1 wurde am 5. Juni angekündigt und am 5. August abgeschaltet — 61 Tage. Anthropic sichert mindestens 60 Tage zu und bewahrt die Modellgewichte langfristig auf; das hält alte Ergebnisse nachvollziehbar, bringt den Endpunkt aber nicht zurück. Gemini Robotics ER 1.6 in der Preview-Fassung hatte es kürzer: angekündigt am 30. Juli, abgeschaltet zum 31. August, 32 Tage. Der Unterschied zwischen 61 und 32 Tagen ist der zwischen zwei Firmenrichtlinien, nicht zwischen zwei Rechtslagen.

Ein Modellwechsel ist außerdem selten eine Konfigurationszeile. Mit Claude Opus 4.7 und später sind die API-Parameter temperature, top_p und top_k abgeschafft: Ein abweichender Wert liefert einen 400er-Fehler, im Python-SDK ab Version 1.0 werfen sie einen TypeError. Bestehender Code, der eine Temperatur setzt — praktisch jedes Projekt aus 2024 und 2025 —, bricht beim Umstieg hart ab. Das ist kein Tippfehler-Fix, sondern eine Verhaltensänderung, die Sie neu abnehmen müssen. Und die Rechnung bewegt sich mit: DeepSeek hob am 16. August den Ausgabepreis für V4-Pro von pauschal 0,87 US-Dollar je Million Token auf bis zu 3,96 zur Spitzenzeit an — wer mit 0,87 kalkuliert hat, rechnet dort mit dem 4,5-Fachen.

Warum das trotzdem kein Skandal ist

Erstens: Die Änderung ist überwiegend eine Verbesserung. In der Fachdiskussion ab Ende Juli wurde die Zustandslosigkeit positiv bewertet — sie macht Lastverteilung und Skalierung von MCP-Servern erheblich einfacher. Ein sitzungsgebundenes Protokoll zwingt jede Anfrage zurück auf dieselbe Instanz.

Zweitens: Derselbe Bruch liefert erstmals Planbarkeit. Die neue Fassung bringt eine Lebenszyklus-Politik mit mindestens zwölf Monaten Abkündigungsfenster; vorher gab es keine zugesagte Frist. Über den Bruch zu klagen und die Frist zu unterschlagen wäre unfair.

Drittens: Nichts davon bricht heute. Roots, Sampling, Logging und HTTP+SSE sind abgekündigt, nicht entfernt; ein alter Client gegen einen alten Server läuft weiter. Der Druck entsteht im Umfeld: Microsofts AutoGen stellte schon am 28. Juli auf die neue MCP-Fassung um, Azure AI Foundry legte im August einen MCP-Connector für Claude-Modelle nach. Wer die alte Fassung behält, fällt nicht aus dem Betrieb, sondern aus der Unterstützung durch alles, was um ihn herum weiterzieht.

Derselbe lange, massive Bone-Balken auf vier schlanken Pfeilern vor tiefem Ink-Schwarz, jetzt instandgesetzt: Der zu kurz gewordene dritte Pfeiler hat oben ein kräftigeres, sichtbar neueres Bone-Segment erhalten, das die Lücke bis zur Unterseite des Balkens schließt. Die Fuge zwischen altem Pfeiler und neuem Stück ist als feine Linie erkennbar. Genau über dieser Stelle sitzt auf dem Balken eine einzelne kurze, schräg gestellte vermilionfarbene Markierung.

Nicht gebaut und fertig, sondern nachgestellt: Der Balken trägt wieder, weil jemand ein neues Stück eingesetzt hat. Die Markierung sitzt über der Reparaturstelle — dort, wo die Arbeit anfällt, die kein Lastenheft vorgesehen hatte.

Was das für Ihr Unternehmen heißt

Inventarisieren Sie die Abhängigkeiten, bevor Sie sie budgetieren. Vier Spalten genügen: Welche Modell-Endpunkte rufen wir namentlich auf? Welche Protokoll- und SDK-Versionen setzen wir ein? Welcher Anbieter, welche zugesagte Vorlauffrist? Und wer bei uns merkt es, wenn sich etwas davon ändert? Die vierte Spalte ist am häufigsten leer. Hat ein Dienstleister die Integration gebaut, ist die Frage nach dem Migrationsstand auf die Fassung 2026-07-28 eine gute Gelegenheit, das Inventar von dort zu bekommen.

Behandeln Sie den Modellwechsel als Regelfall, nicht als Störung. Der Modellname gehört in die Konfiguration, nicht in den Code; es braucht eine Testreihe auf den eigenen Aufgaben, die nach einem Wechsel durchläuft; und der Vertrag sollte Vorlauffrist und Folgen ihres Verstreichens benennen, statt sie der Anbieterpolitik zu überlassen. Wie schnell eine Abhängigkeit zur Falle wird, zeigte der Fall Fable 5 — dort war das Modell binnen eines Tages weg, ohne jede Frist. Dass Wechselkosten auch im angesammelten Kontext stecken, steht unter Kontext-Lock-in, die grundsätzliche Abwägung im Beitrag zum Vendor-Lock-in bei KI.

Setzen Sie einen festen Wartungsposten an und leiten Sie seine Größe aus den Fristen ab. Einen Prozentsatz nennt Ihnen niemand seriös — er hängt von der Integrationstiefe ab. Rechnen kann man mit den Fristen, die auf dem Tisch liegen: Zwölf Monate Abkündigungsfenster heißen mindestens ein geplanter Migrationsslot pro Jahr; 60 Tage zugesagter Vorlauf heißen, dass Sie binnen zwei Monaten reagieren können müssen — bei einem anderen Anbieter waren es 32 Tage. Die dritte Zahl ist Ihre eigene: Wie lange braucht Ihr Team, um eine Modellabhängigkeit zu tauschen und abzunehmen? Liegt sie über zwei Monaten, haben Sie kein Budgetproblem, sondern ein Architekturproblem — und das löst kein Geld, sondern eine Entkopplung.

Fazit

Die MCP-Änderungen sind technisch vernünftig, sie kommen mit einer Frist, die es vorher nicht gab, und niemand muss heute etwas abschalten. Genau das macht sie zum Lehrstück: Der Aufwand entsteht nicht, weil jemand einen Fehler gemacht hat, sondern weil die Schicht, auf der KI-Anwendungen stehen, noch jung ist und sich verbessert. Solche Schichten bewegen sich weiter — Protokoll, Modell, Preis.

Rechnen Sie eine KI-Integration deshalb wie eine Anlage, nicht wie ein Projekt: mit Inventar, mit Fristen, mit einem Posten für den Umbau, der sicher kommt, und mit einer Architektur, in der ein Modellwechsel Tage kostet statt Quartale. Wer das einplant, erlebt Meldungen wie die vom 28. Juli als Termin — wer es nicht einplant, als Vorfall.

Wenn Sie wissen wollen, welche Ihrer Integrationen die neue MCP-Fassung betrifft und was ein realistischer Wartungsposten für Ihren Fall ist, sprechen wir darüber. Ich lese solche Fragen als Wirtschaftsjurist und baue die Integrationen, um die es geht, selbst.

FAQ

Was hat sich am 28. Juli 2026 an MCP geändert?

Die Fassung 2026-07-28 ist ein Breaking Change: Sitzungen samt Header Mcp-Session-Id und der Handshake über initialize entfallen, das Protokoll ist zustandslos. Der Aufruf server/discover ist für Server neu verpflichtend, subscriptions/listen ersetzt den HTTP-GET-Stream. Roots, Sampling, Logging und der alte HTTP+SSE-Transport sind abgekündigt.

Muss ich meine bestehende MCP-Integration sofort umbauen?

Sofort nicht. Die abgekündigten Teile bleiben nutzbar, und die Spezifikation führt erstmals ein Abkündigungsfenster von mindestens zwölf Monaten ein, gerechnet ab dem 28. Juli 2026. Der Druck kommt aus dem Umfeld: Werkzeuge und Plattformen ziehen um, und wer die alte Fassung behält, fällt aus deren Unterstützung heraus.

Wie groß sollte das Wartungsbudget für eine KI-Integration sein?

Einen belastbaren Prozentsatz nennt Ihnen niemand seriös — er hängt von der Integrationstiefe ab. Leiten Sie die Größe aus den Fristen ab: zwölf Monate Abkündigungsfenster heißen mindestens ein Migrationsslot pro Jahr, 60 Tage zugesagter Vorlauf heißen Reaktionsfähigkeit binnen zwei Monaten. Wer länger braucht, hat ein Architekturproblem, kein Budgetproblem.

Wie oft verschwinden KI-Modelle, auf die ein Produkt verdrahtet ist?

Regelmäßig, mit unterschiedlich viel Vorlauf je Anbieter. Claude Opus 4.1 wurde am 5. Juni 2026 angekündigt und am 5. August abgeschaltet — 61 Tage; Anthropic sichert mindestens 60 Tage zu. Gemini Robotics ER 1.6 in der Preview-Fassung hatte 32 Tage. Die Vorlaufzeit ist Anbieterpolitik, kein Rechtsanspruch.


Quellen — Stand 19.08.2026

Dieser Beitrag ist allgemeine Information und keine Rechtsberatung im Einzelfall. Stand 19. August 2026; Protokoll- und Modellfristen ändern sich schnell, bitte prüfen Sie vor Entscheidungen den aktuellen Stand.

Leon Lotz

Leon Lotz

Leon Lotz ist Wirtschaftsjurist und Gründer von MusketierSoftware. Er verbindet juristische Tiefe mit echtem Software-Handwerk.

KI-gestützt erstellt, redaktionell geprüft und verantwortet. KI-Transparenz