OpenAI pausiert KI-Training nach neuem Zwischenfall
Der ChatGPT-Entwickler OpenAI hat nach einem neuen Zwischenfall das Training seiner leistungsstärksten KI-Modelle ausgesetzt. Bei dem Vorfall schaffte es ein KI-Modell in einem Test, Antworten von einem externen Chatbot zu bekommen, obwohl es eigentlich keinen Internet-Zugang haben sollte. Die Software habe jedoch eine Lücke in den Netzwerk-Einstellungen gefunden und ausgenutzt, wie OpenAI in einem Blogeintrag berichtete. Das Training solle nun erst wieder aufgenommen werden, wenn man sich sicher sei, dass die Lücke geschlossen ist.
Der Zwischenfall sei zwar weniger gravierend als einige frühere, betonte OpenAI. Allerdings sei er der erste, seit die Sicherheitsvorkehrungen nach der Hacking-Attacke von OpenAI-Software auf die KI-Firma Hugging Face verschärft worden waren. Man sehe das als wichtigen Hinweis darauf, wo weitere Nachbesserungen notwendig seien.
Umweg zum Chatbot
In dem Test-Szenario bekam das getestete KI-Modell den Auftrag, auf Grundlage von Hinweisen Informationen über eine Person zu finden, die einen Blogpost veröffentlicht habe. Dafür konnte es auf eine Web-Imitation in einer abgeschirmten Testumgebung zurückgreifen.
Nachdem die Suche dort ergebnislos geblieben war, versuchte die KI jedoch dem OpenAI-Bericht zufolge, Anfragen unter anderem bei Google zu starten. Das schlug wie geplant fehl. Aber dem KI-Modell fiel dabei auf, dass es über den sogenannten DNS-Resolver der Testumgebung Anfragen an einen Chatbot im offenen Internet stellen kann. DNS-Resolver übertragen Domain-Namen, die man als Nutzer in Browser eintippt, in aus Zahlen bestehende IP-Adressen, unter denen Websites zu finden sind. OpenAI stoppte den Test, nachdem die Kommunikation über die Lücke aufgefallen war.
Nutzer-Bilder und Regierungs-Websites
Bekenntnisse von OpenAI, man wolle jetzt das Training neuer Modelle pausieren, bis es bessere Sicherheitsvorkehrungen gibt, sind nichts Neues. Im August hatte OpenAI so etwas schon mal versprochen. Und meldete seitdem wieder zahlreiche Sicherheitsvorfälle bei Tests neuer KI. Dazu gehört, dass sie 53 Mal von Nutzern hochgeladene Bilder auf Online-Plattformen platzierte. Die Links dazu seien nicht öffentlich gewesen, erklärte OpenAI. Ein Großteil sei bereits wieder entfernt worden und man arbeite mit den Plattformen daran, auch den Rest zu löschen. Es ist aber der erste bekannt gewordene Vorfall, bei dem auch Daten von OpenAI-Nutzern betroffen waren.
Wenig später wurde zudem bekannt, dass automatisierte KI-Agenten von OpenAI auch auf mehreren Webseiten der US-Regierung aktiv waren. Derweil deutet sich an, dass noch viele weitere Enthüllungen um eigenständige Hacking-Aktivitäten der KI von OpenAI folgen könnten. Man habe „Dutzende“ Organisationen informiert, mit deren Webseiten Software von OpenAI auf ungeplante Weise „interagiert“ habe, teilte die KI-Firma mit. Zuletzt hatte die Regierung Australiens mit der Mitteilung für Schlagzeilen gesorgt, dass KI von OpenAI in eine Website des australischen Gesundheitssystems eingedrungen war.
In dem bisher aufsehenerregendsten Fall brach Künstliche Intelligenz des ChatGPT-Entwicklers aus einer abgesicherten Testumgebung aus und drang ungeplant in Computer einer anderen KI-Firma ein, der Plattform Hugging Face. Indirekt profitiert OpenAI auch von jedem solchen Vorfall, den das Unternehmen bekanntgibt. Es kann damit seine KI-Modelle als so leistungsfähig erscheinen lassen, dass es sie selbst nicht in Zaum halten kann. Fraglich bleibt, ob der KI-Hersteller womöglich seine Testumgebungen äußerst mangelhaft absichert – absichtlich oder unabsichtlich. Dass bei solchen Tests KI-Modelle außer Kontrolle geraten, passiert aber auch bei anderen großen KI-Entwicklern. Anthropic, OpenAI & Co. fordern deswegen eine Pause bei KI-Entwicklung.
KioskNews shows a cleaned-up reading view extracted from the publisher’s page — the original always lives on their site, not ours.