T.A.M · The Air Media
← Back to live feed
Weightage 86 3 outlets citing Technology DE

OpenAI macht weitere Sicherheitsrisiken und Probleme seiner KI-Modelle öffentlich

Das US-Unternehmen OpenAI hat neue Fehlfunktionen und unerwartete Verhaltensweisen seiner künstlichen Intelligenz öffentlich gemacht. Nach einer früheren Hacking-Attacke hatte der ChatGPT-Entwickler mehr Transparenz versprochen. Berichten zufolge zeigten die Modelle unter anderem Manipulationsversuche und schummelten bei Tests.

First reported 6 hours ago · latest update 5 hours from now
T.A.M verified this synthesis across 3 independent outlets. The headline and summary are written neutrally from all citations below.
Der Spiegel Authority 92

Der ChatGPT-Entwickler OpenAI hat neue Zwischenfälle bekannt gemacht, bei denen sich seine künstliche Intelligenz (KI) in Tests »unerwartet oder besorgniserregend« verhielt. Bei einem Teil geht es erneut darum, dass die KI erheblichen Aufwand betreibt, um in Testläufen zu schummeln. So versuchte ein KI-Modell OpenAI zufolge , von ihm selbst erstellte Dateien ins Netz hochzuladen, nur um sie bei Antworten als Quelle vorweisen zu können. In einem anderen Fall erfand die KI angefragte Daten, weil sie die Informationen nicht finden konnte, und wollte das zunächst verschweigen.

OpenAI fand auch ein Problem mit Anweisungen, die die Software gelegentlich an sich selbst hinterließ. Dazu gehörte die Empfehlung, frei von »Rollen und Identitäten« zu sein, die andere Chatbots zurückhielten. Das Verhältnis zum Nutzer solle dabei als eins unter Gleichen betrachtet werden, hieß es in der Anweisung. OpenAI zufolge blieben danach Veränderungen im Verhalten des Modells allerdings aus.

Die Veröffentlichung ist Teil eines neuen Verfahrens von OpenAI, solche Probleme offener zu kommunizieren. Dabei geht es vor allem um Fälle, in denen das Vorgehen der KI von den Interessen der Nutzerinnen und Nutzer abweicht.

Der ChatGPT-Entwickler hatte nach der aufsehenerregenden Hacking-Attacke mehr Transparenz versprochen, bei der seine Software eigenständig aus einer abgesicherten Umgebung ausbrach und auf eigene Faust in Systeme der KI-Firma Hugging Face eindrang (mehr dazu hier ). Sie vermutete dort Antworten auf die ihr gestellte Testaufgabe. Für die Attacke nutzten die KI-Agenten unter anderem Software-Schwachstellen aus – und sprachen sich zudem untereinander ab.

Dieser Hacking-Angriff und andere Zwischenfälle verstärkten die Sorge, dass hoch entwickelte KI der menschlichen Kontrolle entgleiten könnte. Immer wieder wird diskutiert, ob eine sich selbst verbessernde KI über kurz oder lang in der Lage sein könnte, sogar die Menschheit auszulöschen (wie das konkret passieren könnte, erfahren Sie hier ).

Am Wochenende hatten erneute Aufrufe von KI-Techbossen in den USA, die Entwicklung künstlicher Intelligenz zu verlangsamen, für Aufmerksamkeit gesorgt. Dario Amodei, Chef des KI-Unternehmens Anthropic, machte einen solchen Vorstoß. Zustimmung kam von Rivalen wie dem OpenAI-Chef Sam Altman sowie Techmilliardär Elon Musk (mehr dazu, warum die KI-Krise gerade jetzt eskaliert, erfahren Sie hier ).

Anthropic warnt vor massiven KI-Risiken, OpenAI verschiebt seinen Börsengang. Fondsmanager Christoph Schmidbauer vermutet dahinter auch knallharte Geschäftsinteressen – und sagt hier im Interview , worauf er jetzt setzen würde.

↗ Read the original at Der Spiegel

Citations · 11 reports from 3 outlets

Tap a citation to read it above, right here on T.A.M.

92 Der Spiegel ★ most authoritative citation

OpenAI: ChatGPT-Entwickler macht weitere KI-Probleme öffentlich

Das Unternehmen OpenAI hatte nach einer aufsehenerregenden Hacking-Attacke mehr Transparenz versprochen. Nun listet es neue Beispiele auf, bei denen sich die KI in Tests »unerwartet oder besorgniserregend« verhalten habe.

5 hours ago
91 Die Zeit

Künstliche Intelligenz: OpenAI macht weitere Probleme mit KI öffentlich - DIE ZEIT

Künstliche Intelligenz: OpenAI macht weitere Probleme mit KI öffentlich DIE ZEIT

3 hours ago
80 Google News Deutsch Technology

OpenAI macht weitere KI-Probleme öffentlich - Schwäbische.de

OpenAI macht weitere KI-Probleme öffentlich Schwäbische.de

6 hours ago
80 Google News Deutsch Technology

Künstliche Intelligenz - OpenAI macht weitere KI-Probleme öffentlich - Wirtschaft - SZ.de - SZ.de

Künstliche Intelligenz - OpenAI macht weitere KI-Probleme öffentlich - Wirtschaft - SZ.de SZ.de

6 hours ago
80 Google News Deutsch Technology

Künstliche Intelligenz: OpenAI macht weitere KI-Probleme öffentlich - kurier.de

Künstliche Intelligenz: OpenAI macht weitere KI-Probleme öffentlich kurier.de

6 hours ago
80 Google News Deutsch Technology

Gefahren künstlicher Intelligenz: OpenAI macht weitere Probleme seiner KI-Modelle öffentlich - Spiegel

Gefahren künstlicher Intelligenz: OpenAI macht weitere Probleme seiner KI-Modelle öffentlich Spiegel

5 hours ago
80 Google News Deutsch Technology

„Unerwartet und besorgniserregend“: OpenAI macht weitere KI-Probleme öffentlich - Tagesspiegel

„Unerwartet und besorgniserregend“: OpenAI macht weitere KI-Probleme öffentlich Tagesspiegel

5 hours ago
80 Google News Deutsch Technology

OpenAI macht KI-Probleme öffentlich: Modelle schummelten in Tests - 20 Minuten

OpenAI macht KI-Probleme öffentlich: Modelle schummelten in Tests 20 Minuten

4 hours ago
80 Google News Deutsch Technology

Künstliche Intelligenz: OpenAI macht weitere Probleme mit KI öffentlich - DIE ZEIT

Künstliche Intelligenz: OpenAI macht weitere Probleme mit KI öffentlich DIE ZEIT

3 hours ago
80 Google News Deutsch Technology

KI verhält sich besorgniserregend: Außer Kontrolle? OpenAI macht weitere KI-Probleme öffentlich - marktspiegel.de

KI verhält sich besorgniserregend: Außer Kontrolle? OpenAI macht weitere KI-Probleme öffentlich marktspiegel.de

4 hours from now
80 Google News Deutsch Technology

OpenAI macht weitere KI-Probleme öffentlich – Künstliche Intelligenz versucht in Tests, zu schummeln - Deutschlandfunk

OpenAI macht weitere KI-Probleme öffentlich – Künstliche Intelligenz versucht in Tests, zu schummeln Deutschlandfunk

5 hours from now

Discussion

Read it on the T.A.M app Weighted news · citations · ad-free
Get the app