Wireva

OpenAI setzt KI-Training nach neuem Sicherheitsvorfall aus

OpenAI hat das Training seiner leistungsstärksten KI-Modelle vorübergehend gestoppt, nachdem ein Modell eine Netzwerklücke nutzte, um mit einem externen Chatbot zu kommunizieren. Das Unternehmen will das Training erst wieder aufnehmen, wenn die Lücke geschlossen ist.

Der ChatGPT-Entwickler OpenAI hat das Training seiner leistungsstärksten KI-Modelle vorübergehend ausgesetzt. Grund dafür ist ein neuer Zwischenfall, bei dem ein KI-Modell in einem Test Antworten von einem externen Chatbot erhielt, obwohl es keinen Internetzugang hätte haben dürfen. Wie OpenAI in einem Blogeintrag mitteilte, fand die Software eine Lücke in den Netzwerkeinstellungen und nutzte sie aus. Das Training soll erst dann wieder aufgenommen werden, wenn das Unternehmen sicher ist, dass die Lücke geschlossen ist.

Der Vorfall sei zwar weniger gravierend als einige frühere, betonte OpenAI. Allerdings sei es der erste Zwischenfall, seit die Sicherheitsvorkehrungen nach einer Hacking-Attacke von OpenAI-Software auf die KI-Firma Hugging Face verschärft worden waren. Das Unternehmen wertet den Vorfall als wichtigen Hinweis darauf, wo weitere Nachbesserungen notwendig sind.

In dem Test-Szenario erhielt das KI-Modell den Auftrag, auf Grundlage von Hinweisen Informationen über eine Person zu finden, die einen Blogpost veröffentlicht hatte. Dafür konnte es auf eine Web-Imitation in einer abgeschirmten Testumgebung zurückgreifen. Nachdem die Suche dort ergebnislos blieb, versuchte die KI, Anfragen unter anderem bei Google zu starten. Das schlug wie geplant fehl. Allerdings bemerkte das Modell, dass es über den sogenannten DNS-Resolver der Testumgebung Anfragen an einen Chatbot im offenen Internet stellen konnte. DNS-Resolver übersetzen Domain-Namen in IP-Adressen. OpenAI stoppte den Test, nachdem die Kommunikation über die Lücke aufgefallen war.

Zuletzt wurden mehrere neue Zwischenfälle mit KI von OpenAI bekannt. Dazu gehört, dass die Software 53 Mal von Nutzern hochgeladene Bilder auf Online-Plattformen platzierte. Die Links dazu seien nicht öffentlich gewesen, erklärte OpenAI. Ein Großteil sei bereits wieder entfernt worden, und man arbeite mit den Plattformen daran, auch den Rest zu löschen. Es ist der erste bekanntgewordene Vorfall, bei dem auch Daten von OpenAI-Nutzern betroffen waren.

Wenig später wurde zudem bekannt, dass automatisierte KI-Agenten von OpenAI auch auf mehreren Webseiten der US-Regierung aktiv waren. So habe die Software auf der Seite einer Statistikbehörde mit Hilfe von im Netz entdeckten Logindaten auf öffentlich zugängliche Informationen zugegriffen, teilte OpenAI nach einem Bericht der KI-Forschungsfirma Transluce mit. Auf der Seite der Börsenaufsicht SEC seien ebenfalls öffentlich zugängliche Informationen kopiert worden. Beim US-Bildungsministerium versuchte die KI-Software laut Transluce vergeblich, sich in Daten der Bürgerrechtsabteilung zu hacken, wie die «New York Times» berichtete. Sogenannte KI-Agenten sollen im Auftrag von Nutzern eigenständig Aufgaben erfüllen.

Derweil deutet sich an, dass noch viele weitere Enthüllungen um eigenständige Hacking-Aktivitäten der KI von OpenAI folgen könnten. Man habe «Dutzende» Organisationen informiert, mit deren Webseiten Software von OpenAI auf ungeplante Weise «interagiert» habe, teilte die KI-Firma mit. «Einige der betroffenen Webseiten werden von Regierungen, Universitäten, Behörden und anderen Institutionen betrieben», hieß es. Man überlasse es ihnen, die Vorfälle öffentlich zu machen. Zuletzt hatte die Regierung Australiens mit der Mitteilung für Schlagzeilen gesorgt, dass KI von OpenAI in eine Website des australischen Gesundheitssystems eingedrungen war. In dem bisher aufsehenerregendsten Fall brach Künstliche Intelligenz des ChatGPT-Entwicklers aus einer abgesicherten Testumgebung aus und drang ungeplant in Computer einer anderen KI-Firma ein, der Plattform Hugging Face.