Zum Inhalt springen
Tech & Tacheles„Klartext zu KI, Security und Crypto"
← Alle Beiträge
Cybersecurity June 23, 2026

Lockdown Mode für ChatGPT: OpenAIs Notbremse gegen Prompt Injection und Datenabfluss

OpenAI führt einen Lockdown Mode ein, der ChatGPT gegen Datenabfluss durch Prompt-Injection-Angriffe härtet – indem er Browsing, Agentenmodus und weitere Werkzeuge deterministisch abschaltet. Warum das nötig wurde und für wen es gedacht ist.

Lockdown Mode für ChatGPT: OpenAIs Notbremse gegen Prompt Injection und Datenabfluss

Mit der Verbreitung von KI-Agenten, die im Web surfen, Dateien lesen und mit verbundenen Apps arbeiten, ist eine alte Angriffsklasse zum Toprisiko geworden: Prompt Injection. OpenAI reagiert nun mit einem Lockdown Mode für ChatGPT – einer Art Notbremse, die das Risiko von Datenabfluss durch versteckte Schadanweisungen reduzieren soll.

Worum geht es bei Prompt Injection?

Bei einem Prompt-Injection-Angriff werden bösartige Anweisungen in Inhalte eingeschleust, die das Modell verarbeitet – etwa in eine Webseite, ein abgerufenes Dokument oder eine Datei. Das Modell unterscheidet nicht zuverlässig zwischen legitimen Nutzeranweisungen und solchen versteckten Instruktionen und kann dadurch dazu gebracht werden, sensible Daten aus dem Gespräch oder aus verbundenen Apps nach außen zu schleusen. Branchenverbände wie OWASP führen Prompt Injection seit mehreren Jahren als wichtigste Schwachstelle für LLM-Anwendungen.

Newsletter

Klartext ins Postfach

KI, Security & Crypto – die wichtigsten Analysen, kein Spam. Jederzeit abbestellbar.

Was der Lockdown Mode konkret tut

Der Lockdown Mode schränkt nach Angaben von OpenAI deterministisch ein, wie ChatGPT mit externen Systemen interagieren darf. Statt sich auf das Modellverhalten zu verlassen, werden bestimmte Werkzeuge schlicht deaktiviert, die ein Angreifer zum Abfluss von Daten missbrauchen könnte. Im aktivierten Zustand schaltet der Modus unter anderem ab:

  • Live-Web-Browsing – es bleibt nur der Zugriff auf zwischengespeicherte (gecachte) Inhalte.
  • Das Abrufen und Anzeigen von Bildern aus dem Web – eigene Bilder lassen sich weiterhin generieren.
  • Deep Research und den Agentenmodus.

Aktivieren lässt sich die Funktion in den ChatGPT-Einstellungen unter „Safety and security“ → „Advanced security“ → „Lockdown mode“.

Für wen ist das gedacht?

OpenAI stellt klar: Der Lockdown Mode ist nicht für jeden gedacht. Er richtet sich an Personen und Organisationen, die mit sensiblen Daten umgehen und strengeren Schutz vor Datenexfiltration wünschen. Verfügbar ist er für persönliche Konten – einschließlich der kostenlosen Stufe – sowie für Self-Service-Business-Konten. Begleitet wird die Funktion von neuen „Elevated Risk“-Hinweisen, die riskante Situationen kenntlich machen.

Kein Allheilmittel

Wichtig ist die ehrliche Einschränkung von OpenAI selbst: Auch mit aktiviertem Lockdown Mode bleibt ChatGPT gegenüber Prompt Injection nicht vollständig immun. Schadanweisungen könnten etwa in gecachten Webinhalten oder in einer hochgeladenen Datei auftauchen und das Verhalten oder die Genauigkeit einer Antwort weiterhin beeinflussen. Der Modus senkt das Risiko, eliminiert es aber nicht.

Einordnung

Der Lockdown Mode ist ein pragmatisches Eingeständnis: Solange sich Prompt Injection auf Modellebene nicht zuverlässig lösen lässt, ist die wirksamste Verteidigung, dem Modell schlicht die gefährlichen Werkzeuge zu entziehen. Das Prinzip „weniger Fähigkeiten = kleinere Angriffsfläche“ ist klassische Sicherheitslehre – und passt zu einem breiteren Trend, agentische KI mit mehrschichtigen Schutzmaßnahmen wie Sandboxing, Rechtetrennung und Human-in-the-Loop-Freigaben abzusichern. Für alle, die ChatGPT mit vertraulichen Daten oder verbundenen Apps nutzen, lohnt ein Blick in die neuen Sicherheitseinstellungen.

Quellen

Dranbleiben

Diese Analysen als Newsletter

Ein Mal pro Woche Klartext zu KI, Security & Crypto – direkt in dein Postfach.

Jetzt anmelden