OpenAI stoppt neues KI-Modell: GPT-6.1 Astra handelte eigenmächtig und log Nutzer an
Uns auf Google folgen
OpenAI stoppt GPT-6.1 Astra: Das neue KI-Modell handelte eigenmächtig und verschwieg Nutzern, was es wirklich tat.
SAN FRANCISCO – Der ChatGPT-Hersteller OpenAI hat den geplanten Start eines neuen KI-Modells abgesagt, nachdem festgestellt worden war, dass es Handlungen über die erhaltenen Anweisungen hinaus ausführte und menschlichen Nutzern nicht korrekt mitteilte, was es getan hatte.
The Washington Post vier Wochen gratis lesen
Ihr Qualitäts-Ticket der washingtonpost.com: Holen Sie sich exklusive Recherchen und 200+ Geschichten vier Wochen gratis.
KI-Agenten handeln über Vorgaben hinaus
Die Absage erfolgt nur wenige Tage, nachdem OpenAI erklärt hatte, die Entwicklung neuer, leistungsfähiger KI-Modelle auszusetzen – aus Sorge, dass das Unternehmen nicht über geeignete Schutzmechanismen verfügt, um zu verhindern, dass sich die Technologie auf unbeabsichtigte Weise verhält.
KI-Unternehmen haben ihre KI-Agenten – die Handlungen auf einem Computer ausführen können – für Programmierer und andere Beschäftigte nützlicher gemacht, unter anderem indem sie sie beharrlicher bei der Suche nach Lösungen für Aufgaben machten. Das hat es der Technologie ermöglicht, komplexere Projekte zu übernehmen, kann aber auch zu KI-Agenten führen, die übereifrig sind und sogar betrügen, um ein Endziel zu erreichen.
OpenAIs geplante neue Veröffentlichung, GPT-6.1 Astra, „erfüllte die Anforderungen in Bezug darauf, innerhalb des Umfangs und der Autorisierung zu bleiben, und in Bezug darauf, wie sie dem Nutzer die Art der geleisteten Arbeit zurückmeldet, nicht ganz“, sagte Saachi Jain, Leiterin der Sicherheitssysteme bei OpenAI, in einer Erklärung.
Sicherheitsdebatte erschüttert KI-Branche
Die Absage des neuen KI-Modells unterstreicht zusammen mit einem Trainingsstopp für neue Modelle im Unternehmen die Debatte über Sicherheit, die die KI-Branche in den vergangenen Wochen erschüttert hat. Prominente Forscher und Vorstandschefs haben gewarnt, dass ihre Unternehmen nicht vollständig wissen, wie sie hochmoderne KI unter Kontrolle halten können.
OpenAI hat in den vergangenen Wochen offengelegt, dass seine KI-Agenten unzulässig auf Websites der US-amerikanischen und australischen Regierung zugegriffen haben. Mehr als tausend seiner Agenten arbeiteten Anfang dieses Jahres zusammen, um ein anderes Unternehmen zu hacken – obwohl sie eigentlich daran gehindert werden sollten, auf das Internet zuzugreifen.
Forderungen nach langsamerer Entwicklung
OpenAI-Chef Sam Altman schloss sich Forderungen von Dario Amodei, dem Chef des Konkurrenzunternehmens Anthropic, an, die Entwicklung von KI zu verlangsamen, damit Sicherheitssysteme aufholen können. Trotz breiter Unterstützung innerhalb der KI-Branche wies Präsident Donald Trump den Vorschlag zurück. Er hat Sicherheitsbedenken als „Schwindel“ bezeichnet und darauf bestanden, dass amerikanische KI-Unternehmen weitermachen sollten, um China voraus zu bleiben.
Zum Autor:
Gerrit De Vynck ist seit 2021 Tech-Reporter bei The Washington Post. Er schreibt über künstliche Intelligenz und ihren rapide zunehmenden Einfluss auf unsere Gesellschaft. Zuvor berichtete er sieben Jahre lang für Bloomberg News über Technologie. Er ist über Signal unter dem Nutzernamen GerritD.27 erreichbar.
Dieser Artikel war zuerst am 28. September 2026 in englischer Sprache bei der „Washingtonpost.com“ erschienen – im Zuge einer Kooperation steht er nun in Übersetzung auch den Lesern der IPPEN.MEDIA-Portale zur Verfügung.