Künstliche Intelligenz: Nvidia-Roboter lernt Handlung durch Beobachten
Einem Roboter Handlungsmuster einzuprogrammieren, ist ein zeitaufwendiger Prozess. Leichter wäre es, wenn die Maschine wie ein Mensch durch Beobachtung lernen könnte, bestimmte Handlungen auszuführen. Nvidia-Forscher zeigten heute an einem einfachen Beispiel, wie maschinelles Lernen genau dies möglich machen könnte.
Farbige Klötze in der richtigen Reihenfolge stapeln: Was selbst sehr kleine Kinder leicht verstehen, muss einer Künstlichen Intelligenz erst mühsam beigebracht werden. Schließlich sind bei solchen, scheinbar trivialen Handlungen eine Vielzahl kognitiver Prozesse am Werk. Was ist ein Klotz? Was gehört zu ihm und was nicht? Wo liegt er im Raum? Welche Farbe hat er? Und in welchem Verhältnis stehen diese Farben zueinander? Was heißt das überhaupt: Stapeln?
Um einer KI all dies beizubringen, trainierten und schalteten die Nvidia-Forscher gleich mehrere neuronale Netze aneinander. Das erste ist für die Objekterkennung zuständig. Es identifiziert die Blöcke im Raum unabhängig von der Position der Kamera, partiellen Verdeckungen und dem Hintergrund.
Das zweite Netz zieht Rückschlüsse über die Beziehung der Blöcke zueinander. Ein drittes Netzwerk schließlich generiert auf Basis beobachteten Verhaltens ein Handlungsmuster. Danach kann der Roboter die Handlung ausführen.

Nächstes Ziel: Den Handlungsspielraum erweitern
Trainiert wurden die künstlichen neuronalen Netze mittels rein synthetischer Daten, die aus einer Simulation stammen. Das geht laut den Forschern schneller, da vorab kein reales Trainingsmaterial generiert werden muss.
Außerdem ist dieser Ansatz weniger gefährlich: Nvidia nutzt seit längerem Simulationen, um Roboter in der Virtual Reality unter sicheren Bedingungen zu trainieren. Verlaufen die Tests erfolgreich, kann das Lernmuster der KI exportiert und in einen realen Roboter übertragen werden.
Laut den Forschern kann die trainierte KI das Klötzestapeln anhand einer einzigen Demonstration lernen und korrekt nachahmen (siehe Youtube-Video). Als nächstes will das Team das Spektrum lernbarer Handlungen schrittweise erweitern.
Nvidia stellt die Forschungsergebnisse heute auf der International Conference on Robotics and Automation (ICRA) in Brisbane, Australien vor.
KI-News ohne Hype – von Menschen kuratiert
Mit dem THE‑DECODER‑Abo liest du werbefrei und wirst Teil unserer Community: Diskutiere im Kommentarsystem, erhalte unseren wöchentlichen KI‑Newsletter, 6× im Jahr den „KI Radar“‑Frontier‑Newsletter mit den neuesten Entwicklungen aus der Spitze der KI‑Forschung, bis zu 25 % Rabatt auf KI Pro‑Events und Zugriff auf das komplette Archiv der letzten zehn Jahre.
Jetzt abonnierenKI-News ohne Hype
Von Menschen kuratiert.
- Mehr als 20 Prozent Launch-Rabatt.
- Lesen ohne Ablenkung – keine Google-Werbebanner.
- Zugang zum Kommentarsystem und Austausch mit der Community.
- Wöchentlicher KI-Newsletter.
- 6× jährlich: „KI Radar“ – Deep-Dives zu den wichtigsten KI-Themen.
- Bis zu 25 % Rabatt auf KI Pro Online-Events.
- Zugang zum kompletten Archiv der letzten zehn Jahre.
- Die neuesten KI‑Infos von The Decoder – klar und auf den Punkt.