OpenAI: ChatGPT-Entwickler macht weitere KI-Probleme öffentlich
Der ChatGPT-Entwickler OpenAI hat neue Zwischenfälle bekannt gemacht, bei denen sich seine künstliche Intelligenz ( KI ) in Tests »unerwartet oder besorgniserregend« verhielt. Bei einem Teil geht es erneut darum, dass die KI erheblichen Aufwand betreibt, um in Testläufen zu schummeln. So versuchte ein KI-Modell OpenAI zufolge , von ihm selbst erstellte Dateien ins Netz hochzuladen, nur um sie bei Antworten als Quelle vorweisen zu können. In einem anderen Fall erfand die KI angefragte Daten, weil sie die Informationen nicht finden konnte, und wollte das zunächst verschweigen.
OpenAI fand auch ein Problem mit Anweisungen, die die Software gelegentlich an sich selbst hinterließ. Dazu gehörte die Empfehlung, frei von »Rollen und Identitäten« zu sein, die andere Chatbots zurückhielten. Das Verhältnis zum Nutzer solle dabei als eins unter Gleichen betrachtet werden, hieß es in der Anweisung. OpenAI zufolge blieben danach Veränderungen im Verhalten des Modells allerdings aus.
Die Veröffentlichung ist Teil eines neuen Verfahrens von OpenAI, solche Probleme offener zu kommunizieren. Dabei geht es vor allem um Fälle, in denen das Vorgehen der KI von den Interessen der Nutzerinnen und Nutzer abweicht.
Der ChatGPT-Entwickler hatte nach der aufsehenerregenden Hacking-Attacke mehr Transparenz versprochen, bei der seine Software eigenständig aus einer abgesicherten Umgebung ausbrach und auf eigene Faust in Systeme der KI-Firma Hugging Face eindrang (mehr dazu hier ). Sie vermutete dort Antworten auf die ihr gestellte Testaufgabe. Für die Attacke nutzten die KI-Agenten unter anderem Software-Schwachstellen aus – und sprachen sich zudem untereinander ab.
2 Min Zur Merkliste hinzufügen 2 Min Zur Merkliste hinzufügen Biowaffen, Cyberattacken, Roboter: Die KI löscht die Menschheit aus? Wie das konkret passieren könnte Von Markus Böhm 9 Min Zur Merkliste hinzufügen 9 Min Zur Merkliste hinzufügen KI-Sicherheitsvorfall: Ein Wiener stoppte eine wild gewordene Anthropic-KI – in seiner Freizeit Von Marcel Rosenbach und Hakan Tanriverdi 6 Min Zur Merkliste hinzufügen 6 Min Zur Merkliste hinzufügen Dieser Hacking-Angriff und andere Zwischenfälle verstärkten die Sorge, dass hoch entwickelte KI der menschlichen Kontrolle entgleiten könnte. Immer wieder wird diskutiert, ob eine sich selbst verbessernde KI über kurz oder lang in der Lage sein könnte, sogar die Menschheit auszulöschen (wie das konkret passieren könnte, erfahren Sie hier ).
Am Wochenende hatten erneute Aufrufe von KI-Techbossen in den USA , die Entwicklung künstlicher Intelligenz zu verlangsamen, für Aufmerksamkeit gesorgt. Dario Amodei , Chef des KI-Unternehmens Anthropic , machte einen solchen Vorstoß. Zustimmung kam von Rivalen wie dem OpenAI-Chef Sam Altman sowie Techmilliardär Elon Musk (mehr dazu, warum die KI-Krise gerade jetzt eskaliert, erfahren Sie hier ).
Anthropic warnt vor massiven KI-Risiken, OpenAI verschiebt seinen Börsengang. Fondsmanager Christoph Schmidbauer vermutet dahinter auch knallharte Geschäftsinteressen – und sagt hier im Interview , worauf er jetzt setzen würde.
5News hat diese Zusammenfassung aus dem öffentlichen Feed der Quelle übernommen. Der vollständige Artikel mit allen Details steht auf www.spiegel.de — der Inhalt gehört Der Spiegel Netzwelt.