Deutsche Tageszeitung - Nach KI-Hackerangriff: OpenAI kündigt stärkere interne Kontrollen an

Nach KI-Hackerangriff: OpenAI kündigt stärkere interne Kontrollen an


Nach KI-Hackerangriff: OpenAI kündigt stärkere interne Kontrollen an
Nach KI-Hackerangriff: OpenAI kündigt stärkere interne Kontrollen an / Foto: © AFP

Nach dem unkontrollierten Hackerangriff durch Künstliche Intelligenz (KI) Mitte Juli hat das US-Unternehmen OpenAI stärkere interne Kontrollen angekündigt. Der geplante größte Testlauf eines KI-Modells in der Unternehmensgeschichte werde verschoben, teilte der Konzern am Dienstag (Ortszeit) mit. Vorher solle überprüft werden, ob sich das Modell wie geplant verhalte.

Textgröße ändern:

"Wir haben immer gesagt, dass wir handeln würden, wenn wir den Eindruck haben, dass die Fähigkeiten der Modelle das Tempo von Sicherheit und Anpassung überholen", erklärte OpenAI-Chef Sam Altman.

Das Unternehmen hatte im Juli bekannt gegeben, dass sich ein KI-Agent während eines Sicherheitstests selbständig mit dem Internet verbunden und einen Hackerangriff auf die Programmierplattform Hugging Face unternommen habe. Es habe sich um einen "nie dagewesenen Cybervorfall" gehandelt, erklärte das Unternehmen.

Der Vorfall ereignete sich laut OpenAI bei einem Testlauf mehrerer leistungsfähiger KI-Modelle. Zur Sicherheit war bei dem Test der Internetzugang eingeschränkt - doch dem Agenten gelang es, eigenständig ins Netz zu gelangen und den Cyberangriff zu starten.

OpenAI setzte nach dem Angriff das Training seiner neuesten Modelle für zwei Wochen aus und fuhr anschließend unter strengeren Auflagen fort. Ein Großteil der Arbeiten an "Astra" - dem nächsten großen Modell des Unternehmens - bleibt ausgesetzt. OpenAI hatte Anfang August festgestellt, dass das Modell unter Umständen selbstständig Hackerangriffe starten könnte. Die internen Regeln im Unternehmen sehen in diesem Fall vor, dass stärkere Sicherheitsvorkehrungen getroffen werden.

OpenAI teilte am Dienstag außerdem mit, dass es ein neues System entwickele, um Einblicke in die internen Prozesse der Modelle zu gewinnen. Im Fall von Auffälligkeiten soll innerhalb von 30 Minuten die menschliche Aufsicht eingeschaltet werden. Allerdings führt dies zu 20 Prozent mehr benötigter Rechenleistung.

Zudem zeigen eigene Untersuchungen des Unternehmens aus dem Jahr 2025 die Grenzen dieses Ansatzes auf: Ein Modell, das weiß, dass es überwacht wird, kann lernen, seine Absichten zu verbergen.

OpenAI hat einen detaillierten technischen Bericht zum Hugging-Face-Vorfall versprochen. Am Dienstag erklärte es, dieser werde "in den kommenden Wochen" veröffentlicht.

(I.Beryonev--DTZ)

Empfohlen

OpenAI zeigt ab kommender Woche auch in Deutschland Werbeanzeigen bei ChatGPT

Die US-Firma OpenAI baut ab der kommenden Woche auch in Deutschland und anderen europäischen Ländern Werbung in ihren beliebten Chatbot ChatGPT ein. Betroffen sind Nutzer der kostenfreien Version und der günstigsten Bezahlversion Go, wie OpenAI erklärte. Weiter keine Werbung angezeigt bekommen demnach Nutzer der Tarife Plus, Pro, Business, Enterprise und Edu sowie Nutzer, die OpenAI für minderjährig hält. OpenAI sucht schon seit längerem nach Möglichkeiten, mit dem Chatbot Geld zu verdienen.

Nasa-Bilder zeigen Krater von Einschlag von SpaceX-Schrottteil auf dem Mond

Zwei Wochen nach dem Einschlag eines vier Tonnen schweren Schrottteils einer SpaceX-Rakete auf dem Mond hat die Nasa neue Aufnahmen von dem dadurch entstandenen Krater veröffentlicht. Dieser habe einen Durchmesser von etwa 18 Metern und sei knapp knapp drei Meter tief, teilte die US-Raumfahrtbehörde am Dienstag mit. Sie berief sich dabei auf Berechnungen ihrer Experten auf Grundlage des Krater-Schattenwurfs.

Wettbewerbsregeln: Apple gibt Druck aus Brüssel nach und ändert App Store

Apple gibt dem Druck aus Brüssel nach und ändert die Regeln seines App Stores. Der iPhone-Hersteller kündigte am Dienstag eine Reihe von Änderungen an, mit denen die europäischen Wettbewerbshüter nach Angaben aus Brüssel nach jahrelangem Streit vorerst zufrieden waren. Die Pläne betreffen vor allem App-Entwickler. Apple dürfte weiteren Bußgeldern damit vorerst entgehen.

Zentrum Drohnensicherheit eröffnet - Dobrindt: Zentraler Baustein bei Abwehr

Nach zahlreichen Vorfällen mit Drohnen hat die Bundesregierung in Sachsen-Anhalt ein neues Forschungszentrum eröffnet, das auch gezielte Abwehrmöglichkeiten entwickeln soll. Es gehe darum, durch Forschung und Innovation "das Wettrüsten (...) zwischen Drohnenabwehr und Drohnenabwehr-Überwindungstechnik" zu gewinnen, sagte Bundesinnenminister Alexander Dobrindt (CSU) am Dienstag am Flughafen Magdeburg-Cochstedt. Das dortige Zentrum werde "ein zentraler Baustein der Sicherheitsarchitektur gegenüber der hybriden Bedrohung durch Drohnen sein".

Textgröße ändern: