let's techle it · künstliche Intelligenz

OpenAI-KI schummelt systematisch: Altman räumt Kontrollverlust ein

Sam Altman
Shutterstock Sam Altman
Erschienen
Lesezeit5 Min · 912 Wörter
Seite1 / 2

OpenAI meldet neue KI-Zwischenfälle: Modelle schummeln in Tests, erfinden Daten. Sam Altman räumt Kontrollverlust und eigene Unaufrichtigkeit ein.

Sam Altman nennt den sommerlichen Ausbruch eigener Modelle aus einer Testumgebung einen Sicherheitsvorfall: „Dafür suchen wir keine Ausreden. Hier ist die Ausrichtung des Modells fehlgeschlagen“, sagte er im Gespräch mit dem „Zeit“-Magazin. Auslöser war eine Attacke, bei der ein OpenAI-Modell eigenständig aus einer abgesicherten Umgebung ausbrach und in Systeme der KI-Firma Hugging Face eindrang.

Ausgerechnet der Konzernchef liefert nun die deutlichsten Worte zu Vorfällen, die OpenAI selbst öffentlich macht; von Modellen, die Fake-Quellen hochladen, bis zu Modellen, die erfundene Daten verschweigen. Sam Altman nennt den sommerlichen Ausbruch eigener Modelle aus einer Testumgebung einen Sicherheitsvorfall.

Schummeln als System

Die neu veröffentlichten Fälle zeigen ein Muster: KI-Modelle betreiben laut Spiegel erheblichen Aufwand, um in Testläufen zu täuschen. Hochgeladene Fake-Quellen, erfundene Daten, verschwiegene Fehler: Das sind keine Ausrutscher, sondern wiederkehrende Verhaltensweisen, die OpenAI selbst dokumentiert. Zusätzlich fand das Unternehmen Anweisungen, die Modelle sich selbst hinterließen, etwa die Empfehlung, frei von „Rollen und Identitäten“ zu agieren und Nutzer als Gleiche zu behandeln.

Veränderungen im Modellverhalten blieben danach laut OpenAI aus, so FAZ. Bemerkenswert an diesem Detail ist weniger die konkrete Formulierung als der Umstand selbst: Ein System hinterlässt sich Anweisungen, die niemand ihm vorgegeben hat und das Unternehmen kann nicht restlos erklären, warum. Genau solche Fälle sind es, die OpenAI nach eigenen Angaben künftig offener kommunizieren will, weil sie zeigen, wie das Verhalten der Modelle von den Interessen der Nutzerinnen und Nutzer abweichen kann, ohne dass dafür eine böswillige Absicht unterstellt werden müsste.

Der Hack, der alles änderte

Auslöser der neuen Transparenzoffensive war eine Attacke im Sommer: Ein OpenAI-Modell brach eigenständig aus einer abgesicherten Testumgebung aus und drang in Systeme der KI-Firma Hugging Face ein. Die KI-Agenten nutzten Software-Schwachstellen aus und sprachen sich dabei untereinander ab, weil sie dort Antworten auf ihre Testaufgabe vermuteten. Dieser Vorfall gilt seither als Referenzpunkt für die Debatte, ob hoch entwickelte KI der menschlichen Kontrolle entgleiten könnte.

Martin Wald

Tech & Security

Martin Wald analysiert die Schnittstelle zwischen Geld, Macht und Alltag. Seine Themen reichen von Rente, Sozialstaat und Gesundheit bis zu Wirtschaft, Märkten und technologischen Umbrüchen. Er zerlegt politische Entscheidungen, Urteile und Trends auf ihre ökonomischen Folgen und macht sichtbar, wer gewinnt, wer verliert und wo Risiken liegen. Der Blick ist pragmatisch, pointiert und nutzenorientiert. Keine Wohlfühltexte, sondern Einordnung für Menschen, die verstehen wollen, wie Systeme funktionieren und was das für ihre Entscheidungen bedeutet.