Im März 2025 überraschte OpenAI mit der neuen GPT-4o-Bildgenerierung, während Figure AI mit einer beeindruckenden Roboter-Simulation auf Basis von Reinforcement Learning für Aufsehen sorgte. Zwei Entwicklungslinien, die seither enorm an Fahrt aufgenommen haben.
Inhaltverzeichnis
ToggleUpdate: Von GPT-4o zu GPT Image 2
OpenAIs Bildgenerierung hat sich seit 2025 mehrfach weiterentwickelt: Auf GPT-4o Image Generation folgte im Dezember 2025 GPT Image 1.5, und seit dem 21. April 2026 ist mit GPT Image 2 (ChatGPT Images 2.0) eine komplett neue, deutlich realistischere Generation da – mit klarerer Textdarstellung in Bildern und einer neuen Single-Pass-Architektur. DALL-E, der frühere Standard, wurde am 12. Mai 2026 endgültig abgeschaltet. Mehr Details dazu in unserem Update zu KI-Bildern in ChatGPT.
Figure AI: Von der Simulation zur Serienproduktion
Aus der 2025 gezeigten Simulation ist inzwischen echte Massenproduktion geworden. Figure AI hat die Fertigung seines Figure-03-Roboters in der eigenen „BotQ“-Fabrik von einer Einheit pro Tag auf eine pro Stunde gesteigert – über 350 Roboter wurden bereits gebaut, mit einem Zielvolumen von bis zu 12.000 Einheiten pro Jahr. Technisch basiert das auf der neuen Helix-02-Architektur: ein einheitliches neuronales System, das Gehen und Greifen nicht mehr getrennt behandelt, sondern als eine durchgängige Fähigkeit – gesteuert von einem „System 0″-Controller mit 1.000 Hertz Taktrate. Langfristig will Figure AI humanoide Roboter für unter 20.000 Euro anbieten.
Zwei Bereiche, ein gemeinsamer Trend
Sowohl bei Bild-KI als auch bei humanoider Robotik zeigt sich derselbe Muster: schnelle Iteration, sinkende Kosten und der Sprung von der Demo zur Massenanwendung. Auch bei Open-Source-Robotik tut sich einiges – siehe unser Update zu Hugging Face & Pollen Robotics.
Fazit
GPT-4o-Bildgenerierung und Figure AIs Roboter-Simulation waren 2025 vielversprechende Ansätze – 2026 sind daraus ein ausgereiftes Bildmodell (GPT Image 2) und eine hochskalierte Roboterproduktion geworden.
