OpenAI macht weitere Sicherheitsrisiken und Probleme seiner KI-Modelle öffentlich
Das US-Unternehmen OpenAI hat neue Fehlfunktionen und unerwartete Verhaltensweisen seiner künstlichen Intelligenz öffentlich gemacht. Nach einer früheren Hacking-Attacke hatte der ChatGPT-Entwickler mehr Transparenz versprochen. Berichten zufolge zeigten die Modelle unter anderem Manipulationsversuche und schummelten bei Tests.
First reported 6 hours ago · latest update 5 hours from now
Der ChatGPT-Entwickler OpenAI hat neue Zwischenfälle bekannt gemacht, bei denen sich seine künstliche Intelligenz (KI) in Tests »unerwartet oder besorgniserregend« verhielt. Bei einem Teil geht es erneut darum, dass die KI erheblichen Aufwand betreibt, um in Testläufen zu schummeln. So versuchte ein KI-Modell OpenAI zufolge , von ihm selbst erstellte Dateien ins Netz hochzuladen, nur um sie bei Antworten als Quelle vorweisen zu können. In einem anderen Fall erfand die KI angefragte Daten, weil sie die Informationen nicht finden konnte, und wollte das zunächst verschweigen.
OpenAI fand auch ein Problem mit Anweisungen, die die Software gelegentlich an sich selbst hinterließ. Dazu gehörte die Empfehlung, frei von »Rollen und Identitäten« zu sein, die andere Chatbots zurückhielten. Das Verhältnis zum Nutzer solle dabei als eins unter Gleichen betrachtet werden, hieß es in der Anweisung. OpenAI zufolge blieben danach Veränderungen im Verhalten des Modells allerdings aus.
Die Veröffentlichung ist Teil eines neuen Verfahrens von OpenAI, solche Probleme offener zu kommunizieren. Dabei geht es vor allem um Fälle, in denen das Vorgehen der KI von den Interessen der Nutzerinnen und Nutzer abweicht.
Der ChatGPT-Entwickler hatte nach der aufsehenerregenden Hacking-Attacke mehr Transparenz versprochen, bei der seine Software eigenständig aus einer abgesicherten Umgebung ausbrach und auf eigene Faust in Systeme der KI-Firma Hugging Face eindrang (mehr dazu hier ). Sie vermutete dort Antworten auf die ihr gestellte Testaufgabe. Für die Attacke nutzten die KI-Agenten unter anderem Software-Schwachstellen aus – und sprachen sich zudem untereinander ab.
Dieser Hacking-Angriff und andere Zwischenfälle verstärkten die Sorge, dass hoch entwickelte KI der menschlichen Kontrolle entgleiten könnte. Immer wieder wird diskutiert, ob eine sich selbst verbessernde KI über kurz oder lang in der Lage sein könnte, sogar die Menschheit auszulöschen (wie das konkret passieren könnte, erfahren Sie hier ).
Am Wochenende hatten erneute Aufrufe von KI-Techbossen in den USA, die Entwicklung künstlicher Intelligenz zu verlangsamen, für Aufmerksamkeit gesorgt. Dario Amodei, Chef des KI-Unternehmens Anthropic, machte einen solchen Vorstoß. Zustimmung kam von Rivalen wie dem OpenAI-Chef Sam Altman sowie Techmilliardär Elon Musk (mehr dazu, warum die KI-Krise gerade jetzt eskaliert, erfahren Sie hier ).
Anthropic warnt vor massiven KI-Risiken, OpenAI verschiebt seinen Börsengang. Fondsmanager Christoph Schmidbauer vermutet dahinter auch knallharte Geschäftsinteressen – und sagt hier im Interview , worauf er jetzt setzen würde.
Citations · 11 reports from 3 outlets
Tap a citation to read it above, right here on T.A.M.
OpenAI: ChatGPT-Entwickler macht weitere KI-Probleme öffentlich
Das Unternehmen OpenAI hatte nach einer aufsehenerregenden Hacking-Attacke mehr Transparenz versprochen. Nun listet es neue Beispiele auf, bei denen sich die KI in Tests »unerwartet oder besorgniserregend« verhalten habe.
5 hours agoKünstliche Intelligenz: OpenAI macht weitere Probleme mit KI öffentlich - DIE ZEIT
Künstliche Intelligenz: OpenAI macht weitere Probleme mit KI öffentlich DIE ZEIT
3 hours agoOpenAI macht weitere KI-Probleme öffentlich - Schwäbische.de
OpenAI macht weitere KI-Probleme öffentlich Schwäbische.de
6 hours agoKünstliche Intelligenz - OpenAI macht weitere KI-Probleme öffentlich - Wirtschaft - SZ.de - SZ.de
Künstliche Intelligenz - OpenAI macht weitere KI-Probleme öffentlich - Wirtschaft - SZ.de SZ.de
6 hours agoKünstliche Intelligenz: OpenAI macht weitere KI-Probleme öffentlich - kurier.de
Künstliche Intelligenz: OpenAI macht weitere KI-Probleme öffentlich kurier.de
6 hours agoGefahren künstlicher Intelligenz: OpenAI macht weitere Probleme seiner KI-Modelle öffentlich - Spiegel
Gefahren künstlicher Intelligenz: OpenAI macht weitere Probleme seiner KI-Modelle öffentlich Spiegel
5 hours ago„Unerwartet und besorgniserregend“: OpenAI macht weitere KI-Probleme öffentlich - Tagesspiegel
„Unerwartet und besorgniserregend“: OpenAI macht weitere KI-Probleme öffentlich Tagesspiegel
5 hours agoOpenAI macht KI-Probleme öffentlich: Modelle schummelten in Tests - 20 Minuten
OpenAI macht KI-Probleme öffentlich: Modelle schummelten in Tests 20 Minuten
4 hours agoKünstliche Intelligenz: OpenAI macht weitere Probleme mit KI öffentlich - DIE ZEIT
Künstliche Intelligenz: OpenAI macht weitere Probleme mit KI öffentlich DIE ZEIT
3 hours agoKI verhält sich besorgniserregend: Außer Kontrolle? OpenAI macht weitere KI-Probleme öffentlich - marktspiegel.de
KI verhält sich besorgniserregend: Außer Kontrolle? OpenAI macht weitere KI-Probleme öffentlich marktspiegel.de
4 hours from nowOpenAI macht weitere KI-Probleme öffentlich – Künstliche Intelligenz versucht in Tests, zu schummeln - Deutschlandfunk
OpenAI macht weitere KI-Probleme öffentlich – Künstliche Intelligenz versucht in Tests, zu schummeln Deutschlandfunk
5 hours from now