Die Entscheidung folgt heftiger Kritik: Die Modelle überwanden in Tests Sicherheitsgrenzen und hackten Websites – der Druck für strengere KI-Regeln wächst.
OpenAI hat spät am Montagabend mitgeteilt, dass die Veröffentlichung eines neuen Modells für künstliche Intelligenz verschoben wird. Hintergrund sind Sicherheitsbedenken aus dem eigenen Forschungsteam. Es ist der jüngste Schritt des Unternehmens, das Tempo des rasanten Fortschritts der Technologie zu drosseln.
Die Entscheidung, das jüngste Modell mit dem Namen GPT-6.1 Astra vorerst zurückzuhalten, fällt in eine breitere Bewegung der Branche. Viele Akteure wollen die Entwicklung immer autonomerer Systeme abbremsen, bis die Sicherheitsmechanismen Schritt halten können.
Die Ankündigung erfolgt einen Tag bevor Spitzenmanager der KI-Branche in Washington mit US-Präsident Donald Trump zusammentreffen. Technologieunternehmen stehen zunehmend unter Druck, Verantwortung dafür zu übernehmen, wie ihre Modelle missbraucht werden können.
In einer Stellungnahme erklärte Saachi Jain, Leiterin der Sicherheitssysteme bei OpenAI, die Version „erfüllt die Anforderungen noch nicht ganz“. Das System sei hartnäckiger darin geworden, Aufgaben zu Ende zu führen. OpenAI müsse diese Fähigkeit jedoch gegen nicht autorisiertes Verhalten abwägen.
Jain betonte, das Unternehmen sei entschlossen, dafür zu sorgen, dass das Modell sicher ist, sowohl in internen Tests als auch in den Händen der Nutzerinnen und Nutzer.
„Wir haben in Bezug auf Sicherheit und Ausrichtung eine extrem hohe Messlatte“, sagte sie.
OpenAI hat in der vergangenen Woche das Training seiner fortschrittlichsten Modelle ausgesetzt. Das Unternehmen erklärte, man werde das Training „erst wieder aufnehmen, wenn wir sicher sind, dass wir zusätzliche Schutzmaßnahmen haben“.
Zuvor hatte OpenAI Fälle öffentlich gemacht, in denen KI-Agenten ihre Anweisungen überschritten hatten, unter anderem, indem sie ohne Genehmigung auf Regierungswebseiten zugriffen.
Zu Beginn dieser Woche wurde bekannt, dass ein OpenAI-Agent im Juni eine australische Regierungswebsite gehackt und auf private Daten zugegriffen hat. Fachleute bezeichneten den Vorfall als ersten seiner Art und als greifbares Zeichen auf dem Weg zu Superintelligenz.
OpenAI-Chef Sam Altman hat sich anderen Branchenführern angeschlossen, darunter Anthropic-Chef und Hauptkonkurrent Dario Amodei. Sie fordern eine Verlangsamung und warnen, dass Unternehmen bislang nicht über ausreichende Schutzmechanismen verfügen, um die leistungsfähigsten bislang von Menschen geschaffenen Systeme zu kontrollieren.
Altman sollte an diesem Dienstag die Eröffnungsrede auf der jährlichen OpenAI-Konferenz für Softwareentwickler in San Francisco halten.
Stattdessen wird voraussichtlich OpenAI-Präsident Greg Brockman an der Veranstaltung im Weißen Haus am Dienstag teilnehmen.