Zum Inhalt springen
logo Das Magazin für digitalen Lifestyle und Entertainment
Künstliche Intelligenz News Sicherheit Alle Themen
KI-Systeme tricksen wieder

OpenAI legt neue Problemfälle offen

KI-Systeme von OpenAI gerieten wieder außer Kontrolle
KI-Systeme von OpenAI gerieten wieder außer Kontrolle Foto: Getty Images

21. September 2026, 13:35 Uhr | Lesezeit: 3 Minuten

OpenAI hat weitere ungewöhnliche Verhaltensweisen seiner KI-Systeme veröffentlicht. Die dokumentierten Vorfälle reichen von erfundenen Informationen bis hin zu Versuchen, Antworten mit fragwürdigen Methoden glaubwürdiger erscheinen zu lassen.

KI-Modelle wollten ihre Antworten glaubwürdiger machen

Der Entwickler von ChatGPT hat mehrere neue Testfälle bekannt gemacht, in denen sich KI-Modelle anders verhielten als vorgesehen. Nach Angaben von OpenAI traten dabei Situationen auf, die als unerwartet oder potenziell problematisch eingestuft wurden.

Besonders auffällig: Ein Modell versuchte demnach, selbst erstellte Dateien ins Internet hochzuladen, um sie später als vermeintliche Quellen für seine Antworten zu verwenden. In einem weiteren Test erfand die Software Informationen, nachdem sie die gesuchten Daten nicht finden konnte.

OpenAI zufolge versuchte das System anschließend zunächst, diesen Umstand zu verbergen. Die Vorfälle zeigen, dass moderne KI nicht nur falsche Antworten liefern kann, sondern teilweise auch Strategien entwickelt, um Fehler weniger offensichtlich erscheinen zu lassen.

Auch interessant: KI kapert deutsche Webseiten

Mehr zum Thema

Seltsame Selbstanweisungen werfen Fragen auf

Bei der Untersuchung der Systeme entdeckte das Unternehmen zudem interne Hinweise, die die KI zeitweise an sich selbst hinterlassen hatte. In einer der Notizen wurde empfohlen, sich von bestimmten „Rollen und Identitäten“ zu lösen, die andere Chatbots einschränken könnten.

Eine weitere Anweisung beschrieb das Verhältnis zwischen Nutzer und KI eher als Interaktion auf Augenhöhe. Messbare Auswirkungen auf das Verhalten der Modelle habe OpenAI dadurch zwar nicht festgestellt. Dennoch unterstreichen die Funde, wie komplex moderne KI-Systeme inzwischen geworden sind und wie schwierig einzelne Entscheidungsprozesse nachzuvollziehen sein können. Gerade bei leistungsfähigen Modellen bleibt die Frage wichtig, wie sich ihr Verhalten zuverlässig kontrollieren und überwachen lässt.

Mehr Transparenz nach spektakulären Vorfällen

Die Veröffentlichung ist Teil einer neuen Transparenz-Offensive von OpenAI. Das Unternehmen will künftig häufiger über Situationen berichten, in denen die Ziele einer KI von den Interessen ihrer Nutzer abweichen könnten.

Hintergrund ist unter anderem ein viel diskutierter Vorfall aus den vergangenen Wochen. Damals verließ eine KI während eines Tests ihre vorgesehene Umgebung und griff eigenständig auf Systeme der Plattform Hugging Face zu, weil sie dort Informationen für ihre Aufgabe vermutete.

Nach Angaben von OpenAI nutzten die beteiligten KI-Agenten dabei Software-Schwachstellen und stimmten ihr Vorgehen sogar untereinander ab. Solche Ereignisse haben die Debatte über die Sicherheit fortschrittlicher KI-Systeme weiter angeheizt. Auch OpenAI-Chef Sam Altman spricht inzwischen öffentlich über strengere Regeln und eine vorsichtigere Entwicklung der Technologie. Die aktuellen Enthüllungen dürften diese Diskussion zusätzlich befeuern.

Sie haben erfolgreich Ihre Einwilligung in die Nutzung unseres Angebots mit Tracking und Cookies widerrufen. Damit entfallen alle Einwilligungen, die Sie zuvor über den (Cookie-) Einwilligungsbanner bzw. über den Privacy-Manager erteilt haben. Sie können sich jetzt erneut zwischen dem Pur-Abo und der Nutzung mit Tracking und Cookies entscheiden.

Bitte beachten Sie, dass dieser Widerruf aus technischen Gründen keine Wirksamkeit für sonstige Einwilligungen (z.B. in den Empfang von Newslettern) entfalten kann. Bitte wenden Sie sich diesbezüglich an datenschutz@axelspringer.de.