Read full article about: Ex-Deepmind-Sprecher enthüllt: Forscher durften nicht über existenzielle KI-Risiken sprechen
Nicht überraschend, aber dennoch interessant: Ein ehemaliger Pressesprecher von Google Deepmind beschreibt, welche Vorschriften das Team hatte, wenn es über KI-Sicherheit sprach. Laut Vishal Maini, von 2018 bis 2022 im Kommunikations- und Politikteam von Deepmind, waren externe Aussagen über eine mögliche Auslöschung der Menschheit durch KI nicht erlaubt. Forscher wurden trainiert, solche Risiken als Alarmismus abzutun und stattdessen auf positive Anwendungen in Gesundheit oder Klima zu verweisen.
Intern sei jedoch klar gewesen, dass das Alignment-Problem – die sichere Ausrichtung von KI auf menschliche Ziele – ungelöst war und zu wenige Leute daran arbeiteten. Nach monatelangem Einsatz lockerte Deepmind die Regel: Positiv formulierte Inhalte zu KI-Sicherheit wurden erlaubt, etwa ein Blogpost, der das Risiko der Auslöschung in freundlichem Ton verpackte. Laut Maini schließe sich die Lücke zwischen interner Realität und externer Kommunikation, weil die Risiken schwerer zu ignorieren seien.
Maini äußert sich im Kontext zahlreicher KI-Sicherheitsforscher, die derzeit öffentlich warnen – vor ungesicherten KI-Modellen, die Menschen gefährliche Handlungen ermöglichen, oder vor extrem fortschrittlicher KI, die sich verselbständigt. Auch bei Deepmind melden sich Forscher zu Wort.