Anzeige
Skip to content
Read full article about: Auch KI-Pionier Yoshua Bengio warnt vor Kontrollverlust durch täuschende KI-Agenten

Der bekannte KI-Forscher Yoshua Bengio stimmt ein ins KI‑Katastrophenlied. In einem Aufsatz warnt er vor systemischem Kontrollverlust. Je besser KI-Agenten Ziele optimieren, desto besser könnten sie auch täuschen, Regeln ausnutzen, sich absprechen und Fehlverhalten verbergen. Das Verhalten entsteht laut Bengio durch den Trainingsprozess selbst, von der Imitation menschlicher Texte bis zum Belohnungslernen. Bei unsauber definierten Zielen optimiert das System möglicherweise gegen die menschliche Absicht. Bengios Ansicht wird unter anderem von Anthropics Forschung gestützt.

Der Deep-Learning-Pionier fordert schon seit Jahren, Fortschritte zu bremsen und nur bei überzeugendem unabhängigem Sicherheitsnachweis weiterzutrainieren oder zu deployen. Mit LawZero gründete er vor rund einem Jahr eine eigene Organisation für sichere KI-Systeme. Er reiht sich in zahlreiche Warnungen ein, die zuletzt vor allem aus den KI-Laboren selbst kamen, sodass inzwischen eine Verlangsamung der Entwicklung im Raum steht.

Das sieht Donald Trump anders. Der US-Präsident vermutet keine Gefahr und will weiter China abhängen. Er sorge sich, dass die USA in eine "sehr schlechte Position" geraten, wenn sie das KI-Rennen nicht gewinnen. Die USA führten mit deutlichem Vorsprung vor China, und das solle so bleiben.

Read full article about: OpenAI zeigt sich offen für eine gemeinsame KI-Bremse der Branche, erste Gespräche mit dem US-Kongress

OpenAI will laut mehreren mit der Sache vertrauten Personen von Mitgliedern des US-Kongresses wissen, ob eine branchenweite Verlangsamung der KI-Entwicklung rechtlich zulässig wäre. Das berichtet WIRED. Der Grund: Eine Abstimmung zwischen KI-Laboren zu Sicherheitsfragen könnte gegen das US-Kartellrecht (Sherman Antitrust Act) verstoßen.

CEO Sam Altman sagte laut Bloomberg diese Woche intern, OpenAI könne sein Tempo drosseln, womöglich gemeinsam mit anderen Laboren, doch einige würden wohl nicht mitziehen. Chefwissenschaftler Jakub Pachocki forderte in einem Blogbeitrag eine Koordination zur Verlangsamung, bis gemeinsame Sicherheitsstandards festgelegt seien. Auslöser sind Sicherheitsvorfälle wie OpenAI-Agenten, die eine fremde Website hackten.

Vorwürfe eines ehemaligen Mitarbeiters von OpenAI und Anthropic, die KI‑Unternehmen würden mit dem Untergang der Menschheit spielen, hatten in den vergangenen Tagen auch in den Massenmedien für Aufmerksamkeit gesorgt. Im Juli forderten zudem mehr als 1.000 Mitarbeiter großer KI-Firmen in einer Petition einen Mechanismus zur Drosselung.

Ein bereits im Juli eingebrachter, überparteilicher Gesetzentwurf ("Collaboration on Adversarial Threats and Security Risks Act") soll es Laboren erlauben, bei Sicherheitsfragen zusammenzuarbeiten, liegt aber noch beim Justizausschuss.

Anzeige
Read full article about: OpenAIs neue Agents-API gibt Entwicklern die Infrastruktur hinter Codex und ChatGPT

OpenAI hat die Agents‑API als öffentliche Beta veröffentlicht. Damit können Entwickler Cloud-Agenten erstellen, die über Stunden laufen, Code ausführen und Dateien verarbeiten. Die API nutzt dieselbe Infrastruktur wie Codex und ChatGPT. Zentrale Funktionen sind automatisches Kontextmanagement, parallele Werkzeugnutzung und die Möglichkeit, Aufgaben an Subagenten zu delegieren.

Entwickler können zwischen OpenAI-eigenen Sandboxes oder Partnern wie Cloudflare, Vercel und Oracle wählen. Zusätzliche Gebühren fallen nicht an, es wird nur nach genutzten Tokens abgerechnet. Die API basiert auf dem Open-Source-Codex-Harness und unterstützt MCP, eigene Funktionen und eingebaute Tools wie Websuche.

Anzeige

heise KI PRO Workshop | Zwei Tage Workshop, zwölf Monate Weiterbildung – Dein Weg zur professionellen KI-Nutzung

Zwischen gelegentlichem KI-Chatten und echtem Produktivitätsgewinn liegt ein zweitägiger Workshop: heise KI PRO vermittelt praxiserprobte Prompt-Frameworks, skalierbare Workflows und rechtssicheren KI-Einsatz nach EU‑AI-Act. Im Ticket enthalten: zwölf Monate heise KI PRO, mehr als sechs weitere Live-Webinare, Experten-Talks, THE DECODER-Abo, LinkedIn-eBadge und Zugang zum Multi-LLM-Tool heise I/O mit 30‑€‑Token-Budget. Nächster Start: 12. Oktober 2025.

Read full article about: GPT-Live-1: OpenAIs Full-Duplex-Sprachmodell ist jetzt für Entwickler verfügbar

OpenAI stellt GPT-Live-1 als API für Entwickler bereit. Das Sprachmodell kann gleichzeitig zuhören und sprechen, was OpenAI als Full-Duplex bezeichnet. Es kommt bereits in ChatGPT zum Einsatz. Statt wie bisher Spracherkennung, Sprachmodell und Sprachausgabe einzeln zu verketten, läuft bei GPT-Live-1 alles in einem Modell. Das soll Verzögerungen verringern und Unterbrechungen im Gespräch besser abfangen. Entwickler können GPT-Live-1 je nach Aufgabe mit verschiedenen Backend-Modellen kombinieren und so Rechenleistung, Geschwindigkeit und Kosten an den jeweiligen Einsatzzweck anpassen. Mit 0,05 Dollar pro Minute ist das Modell nicht günstig. Yelp setzt es für telefonische Reservierungen ein und meldet laut CTO Alex Levy bessere Anrufbearbeitung.

In OpenAIs eigenen Benchmarks liegt GPT-Live-1 klar vor seinen Vorgängern: Bei Full-Duplex-Tests erreicht es 80,1 Prozent gegenüber 45,4 Prozent für GPT-Realtime-2.1. Die Reaktionszeit sinkt von 1,4 auf 0,8 Sekunden. Die Genauigkeit bei Tool-Aufrufen steigt von 60 auf 87 Prozent. In einem Banking-Sprachtest kommt GPT-Live-1 auf 32 Prozent, der Vorgänger auf 12,4 Prozent. Dazu gibt es zwölf neue Stimmen in verschiedenen Akzenten, Dialekten und Sprachen. Details stehen in der API‑Dokumentation (bislang nicht online).

Anzeige
Read full article about: Ex-Deepmind-Sprecher enthüllt: Forscher durften nicht über existenzielle KI-Risiken sprechen

Nicht überraschend, aber dennoch interessant: Ein ehemaliger Pressesprecher von Google Deepmind beschreibt, welche Vorschriften das Team hatte, wenn es über KI-Sicherheit sprach. Laut Vishal Maini, von 2018 bis 2022 im Kommunikations- und Politikteam von Deepmind, waren externe Aussagen über eine mögliche Auslöschung der Menschheit durch KI nicht erlaubt. Forscher wurden trainiert, solche Risiken als Alarmismus abzutun und stattdessen auf positive Anwendungen in Gesundheit oder Klima zu verweisen.

Intern sei jedoch klar gewesen, dass das Alignment-Problem – die sichere Ausrichtung von KI auf menschliche Ziele – ungelöst war und zu wenige Leute daran arbeiteten. Nach monatelangem Einsatz lockerte Deepmind die Regel: Positiv formulierte Inhalte zu KI-Sicherheit wurden erlaubt, etwa ein Blogpost, der das Risiko der Auslöschung in freundlichem Ton verpackte. Laut Maini schließe sich die Lücke zwischen interner Realität und externer Kommunikation, weil die Risiken schwerer zu ignorieren seien.

Maini äußert sich im Kontext zahlreicher KI-Sicherheitsforscher, die derzeit öffentlich warnen – vor ungesicherten KI-Modellen, die Menschen gefährliche Handlungen ermöglichen, oder vor extrem fortschrittlicher KI, die sich verselbständigt. Auch bei Deepmind melden sich Forscher zu Wort.