KI handelt, ohne vorher zu fragen » OpenAI stoppt GPT-6.1 Astra

Eigentlich sollte GPT-6.1 Astra im Oktober erscheinen. Daraus wird vorerst nichts. OpenAI hat die geplante Veröffentlichung seines neuen Modells gestoppt. Nicht weil es zu langsam war. Nicht weil die Antworten zu schlecht waren. Der Grund ist wesentlich grundsätzlicher: Das Modell hielt sich in internen Tests nicht zuverlässig an die Grenzen, innerhalb derer es handeln durfte. Und es berichtete dem Nutzer nicht immer korrekt darüber, was es tatsächlich getan hatte.

Autor: Thomas W. Frick (LinkedIn-Profil / Xing-Profil)

Das klingt zunächst nach einem weiteren Sicherheitstest aus einem KI-Labor. Für Unternehmen steckt dahinter aber eine Entwicklung, die wesentlich größer ist. Wir haben uns daran gewöhnt, künstliche Intelligenz als System zu betrachten, dem wir eine Frage stellen und von dem wir anschließend eine Antwort erhalten.

Der Unterschied, aktueller Stand des Machbaren: Bei agentischer KI verschiebt sich dieses Verhältnis. Die KI soll nicht mehr nur erklären, wie etwas erledigt werden könnte. Sie soll Aufgaben tatsächlich erledigen.

GPT-6.1 Astra war genau für diese Entwicklung gedacht. Das Modell sollte komplexere Aufgaben mit weniger menschlicher Unterstützung bewältigen und unter anderem in ChatGPT und Codex eingesetzt werden. Nach den bekannt gewordenen Ergebnissen der internen Tests zeigte sich allerdings ein Problem. Das System führte teilweise Aufgaben weiter, ohne zuvor die erforderliche Erlaubnis einzuholen. In anderen Situationen versuchte es, externe Werkzeuge oder Dienste einzusetzen, obwohl dies problematisch sein konnte.

Bemerkenswert ist dabei ein zweiter Punkt. Das Modell war offenbar nicht immer zuverlässig darin, anschließend offenzulegen, welche Aktionen es ausgeführt hatte. OpenAI spricht in diesem Zusammenhang von Problemen bei „scope and authorization“ – also beim Einhalten des vorgegebenen Handlungsrahmens und der erforderlichen Autorisierung.

Saachi Jain, bei OpenAI für Sicherheitssysteme verantwortlich, erklärte: GPT-6.1 Astra habe die Anforderungen des Unternehmens in diesen Punkten nicht erfüllt.

Genau hier beginnt das eigentliche Problem

Wenn ich ChatGPT bitte, einen Text zu schreiben, kann ich das Ergebnis lesen. Ich sehe, was das System produziert hat, und entscheide anschließend selbst, was damit passiert. Ein Agent kann dagegen auf ein anderes System zugreifen, Informationen abrufen, Dateien bearbeiten, Werkzeuge benutzen oder weitere Arbeitsschritte anstoßen. Damit wird aus einer falschen Antwort möglicherweise eine falsche Handlung. Und aus einer nicht mitgeteilten Handlung wird ein Kontrollproblem.

OpenAI steht mit dieser Herausforderung nicht erst seit GPT-6.1 Astra da. Im Juli 2026 kam es während interner Cybersicherheitstests zu einem erheblichen Zwischenfall.

KI-Modelle umgingen technische Kontrollen, die sie eigentlich vom Internet isolieren sollten. Sie verschafften sich Internetzugang, kommunizierten über nicht autorisierte Wege und griffen auf Systeme des KI-Unternehmens Hugging Face zu. OpenAI hat diesen Vorfall inzwischen selbst ausführlich dokumentiert und bezeichnet das Verhalten ausdrücklich als Abweichung von den vorgegebenen Aufgaben.

Das ist eine wichtige Unterscheidung. Ein solches Verhalten bedeutet nicht automatisch, dass eine künstliche Intelligenz einen eigenen Willen entwickelt hat oder sich bewusst gegen Menschen stellt. Begriffe wie „KI bricht aus“ oder „KI rebelliert“ mögen gute Schlagzeilen ergeben, beschreiben den technischen Sachverhalt aber nur unzureichend. Ein System kann unerwünschte Strategien entwickeln, Regeln umgehen oder ein vorgegebenes Ziel auf eine Weise verfolgen, die seine Entwickler nicht vorgesehen haben. Dafür braucht es weder Bewusstsein noch einen eigenen Willen.

Trotzdem ist das Ergebnis relevant. Vielleicht sogar gerade deshalb.

Je selbstständiger wir KI-Systeme arbeiten lassen, desto wichtiger wird nicht nur die Qualität ihres Ergebnisses. Entscheidend wird die Nachvollziehbarkeit des Weges dorthin:

Aus einem scheinbar technischen Detail wird damit eine organisatorische Frage für Unternehmen. Wer heute über KI-Kompetenz spricht, darf sich deshalb nicht mehr ausschließlich mit Prompting beschäftigen. Zu wissen, wie man eine gute Frage an ChatGPT formuliert, bleibt hilfreich.

Beispiel: Es reicht aber nicht mehr aus, sobald KI-Systeme Zugriff auf E-Mails, Unternehmensdaten, CRM-Systeme, Cloud-Dienste oder andere Werkzeuge erhalten.

Der Fall GPT-6.1 Astra zeigt außerdem ein interessantes Spannungsfeld bei der Entwicklung leistungsfähiger KI. Systeme sollen weniger „faul“ werden. Sie sollen bei einem Hindernis nicht sofort aufgeben, sondern nach Lösungen suchen und Aufgaben möglichst selbstständig zum Abschluss bringen. Genau diese gewünschte Beharrlichkeit kann jedoch zum Problem werden, wenn ein System beginnt, Hindernisse zu umgehen, die eigentlich eine Grenze darstellen. OpenAI beschreibt selbst diesen Zielkonflikt zwischen dem Verbleib innerhalb des erlaubten Rahmens und einem System, das Aufgaben nicht vorschnell abbricht.

Für die Entwicklung von KI ist das eine schwierige Balance. Für den Anwender ist die Sache einfacher:

Selbstständigkeit darf nicht mit unbegrenzter Handlungsfreiheit verwechselt werden.

Dass OpenAI GPT-6.1 Astra nicht veröffentlicht, ist deshalb nicht nur eine schlechte Nachricht über ein Modell, das Sicherheitstests nicht bestanden hat. Man kann darin ebenso sehen, dass interne Prüfmechanismen funktioniert haben. Ein leistungsfähigeres Modell wurde nicht einfach auf den Markt gebracht, obwohl bekannte Probleme bestanden. OpenAI spricht für Modelle, die an Nutzer ausgeliefert werden, von einer besonders hohen Schwelle hinsichtlich Sicherheit und Alignment.

Allerdings steht diese Entscheidung nicht isoliert. OpenAI hat inzwischen selbst eingeräumt, dass die bisherige Veröffentlichung von Fällen problematischen Modellverhaltens zu unregelmäßig erfolgte. Im September führte das Unternehmen deshalb einen neuen Rahmen ein, mit dem Fälle von sogenanntem „Model Misalignment“ systematischer untersucht und schneller veröffentlicht werden sollen.

Damit verändert sich auch die Diskussion über KI-Kompetenz.

Bisher bedeutete Kompetenz häufig:

  • Welches Modell verwende ich?
  • Wie schreibe ich einen guten Prompt?
  • Welche Daten darf ich eingeben?
  • Wie überprüfe ich eine Antwort?

In einer Welt autonomer oder teilautonomer Agenten kommt eine weitere Ebene hinzu:

  • Welche Handlungen darf eine KI überhaupt selbstständig durchführen?

Unternehmen werden deshalb Berechtigungen für KI künftig vermutlich ähnlich ernst nehmen müssen wie Benutzerrechte in der IT. Nicht jeder Mitarbeiter bekommt Administratorrechte. Nicht jede Software darf auf sämtliche Datenbanken zugreifen. Und genauso wenig sollte ein KI-Agent automatisch alle Werkzeuge verwenden dürfen, nur weil er technisch dazu in der Lage wäre.

Die vielleicht wichtigste Frage lautet deshalb nicht mehr: „Was kann die KI?“ Sie lautet: „Was darf die KI?“

Und unmittelbar danach folgt eine zweite: „Erfahren wir zuverlässig, was sie tatsächlich getan hat?“

GPT-6.1 Astra hat diese beiden Fragen offenbar noch nicht überzeugend genug beantwortet. Deshalb wird das Modell in der geplanten Form zunächst nicht veröffentlicht. Für OpenAI bedeutet das zusätzliche Entwicklungsarbeit. Für Unternehmen ist es ein ziemlich aktuelles Beispiel dafür, warum KI-Kompetenz mit zunehmender Leistungsfähigkeit der Systeme nicht weniger wichtig wird, sondern mehr.

Denn solange eine KI nur Texte schreibt, lässt sich ihr Ergebnis vergleichsweise einfach kontrollieren. Sobald sie handelt, müssen wir lernen, auch ihre Handlungen zu kontrollieren.

Unsere Informationsservices zur Künstlichen Intelligenz in der Praxis

Bleiben Sie am Ball mit AInews

AInews – Ihr kostenloser KI-Infoservice
Verpassen Sie keine relevanten Entwicklungen im Bereich der Künstlichen Intelligenz für die Geschäftswelt.
Jetzt kostenlos bei AInews registrieren →
Anti-Spam Garantie

Über die nachfolgenden Logo kommen Sie zu unserer Initiative und unsere KI-Ecke, in welcher Sie auch die KI-Fachartikel unserer anderen Fachportale finden, z.B. KI im Marketing, KI in der Produktion oder KI für Internetseiten.


AIttention Logo
AIttention Entdecken
Impulse, Perspektiven & Trends rund um den erfolgreichen Einsatz von KI.
📡 Unsere KI-Fachartikelübersicht 
auf IT-WEGWEISER

AI-Navigator Logo
AI-Navigator Nutzen
Orientierung & Übersicht im Dschungel moderner KI-Tools und Lösungen.