Helix 2.5: Figure AI erreicht 56% Erfolgsquote in Cold-Start-Tests
Veröffentlicht am: 20.09.2026 um 01:09 Uhr | Redaktion boerse-global.de
Das Robotikunternehmen Figure AI hat am 17. September 2026 Ergebnisse zu Praxistests seines Modells Helix 2.5 vorgelegt. Bei sogenannten Cold-Start-Tests in 30 zuvor unbekannten Haushalten in der San Francisco Bay Area erreichte das System eine Zero-Shot-Erfolgsrate von 56 Prozent.
Ohne das sogenannte Index-Pretraining lag die Quote zuvor bei lediglich 9 Prozent, was einem sechsfachen Leistungssprung entspricht. Figure-AI-Chef Brett Adcock bezeichnete das Vorhaben als wichtigstes Projekt des Unternehmens.
Ergebnisse und Testaufbau in realen Wohnräumen
Für die Versuche nutzte Figure AI 30 angemietete Wohnungen und Häuser in der kalifornischen Bay Area. Die humanoiden Roboter starteten dabei ohne zusätzliches Training vor Ort, ohne lokale Datenerhebung, ohne Fine-Tuning und gänzlich ohne vorherige Anpassung an die jeweilige Umgebung. An der Hardware der Plattform Figure 03 wurden dabei keine Veränderungen vorgenommen.
Insgesamt absolvierten die Einheiten 420 Versuche bei drei komplexen Langzeit-Ganzkörperaufgaben, von denen 237 erfolgreich abgeschlossen wurden:
- Bett machen: 94 von 140 Versuchen erfolgreich (67 Prozent)
- Handtücher falten: 87 von 140 Versuchen erfolgreich (62 Prozent)
- Wohnzimmer aufräumen und Spielzeug wegräumen: 56 von 140 Versuchen erfolgreich (40 Prozent)
Der rasante Fortschritt in der Robotik zeigt, wie massiv KI-Technologien bereits heute ganze Industriezweige transformieren. Dieser kostenlose Report bietet konkrete Einblicke in Unternehmen, die von den weltweiten Milliarden-Investitionen in diese neue Industrieära profitieren. Robotik und KI: Profiteure der neuen Industrieära erkennen
Im Rahmen der Testkriterien wurden keine Teilpunkte vergeben; 44 Prozent der Versuche galten somit als gescheitert. Zudem fand bislang kein unabhängiges Audit der Resultate statt, und es bleibt offen, ob die Erfolgsquote von 56 Prozent über längere Zeiträume in realen Haushalten stabil gehalten werden kann.
Datengrundlage und Rechenleistung hinter dem Index
Im Vergleich zum Vorgängermodell Helix 02 benötigt Helix 2.5 nach Unternehmensangaben nur noch halb so viele aufgabenspezifische Anpassungsdaten. Die Grundlage für das Pretraining liefert ein breit aufgestellter Datenindex, der rund 35 Minuten an menschlichen Verhaltensdaten pro Sekunde bereitstellt. Für das Helix-Training wurden Rechenkapazitäten im Wert von 3,5 Milliarden US-Dollar zugesagt.
Dieser Index stützt sich laut Berichten auf 264.000 Downloads und 44.000 wöchentlich aktive Nutzer aus 108 Ländern. Mehr als 16 Millionen Videos aus über 100 Ländern wurden zusammengetragen, wofür bisher 15 Millionen US-Dollar an beitragende Ersteller ausgezahlt wurden.
Während technologische Durchbrüche bei humanoiden Systemen die Schlagzeilen beherrschen, stellt sich für viele die Frage nach den wirtschaftlichen Gewinnern dieses Umbruchs. Ein aktueller Report analysiert die größte Industrierevolution seit Jahrzehnten und fasst zusammen, welche Akteure den Wandel bereits erfolgreich vollzogen haben. Kostenlosen Report zur industriellen Revolution herunterladen
Einordnung im Marktumfeld
Zwar melden Konkurrenten wie Sunday Robotics auf dem Papier höhere Leistungswerte, diese gelten jedoch als schwer vergleichbar. Figure AI stellt Helix 2.5 derzeit weder zum Verkauf bereit noch werden Modellgewichte oder eine API öffentlich angeboten.
Auf Plattformen wie AIxploria wird eine verifizierte Tool-Karte für Helix 2.5 geführt – versehen mit einer Bewertung von 4,5, 7.398 Aufrufen, 63 Upvotes sowie einer Platzierung auf Rang vier im Bereich Roboter und Geräte –, die allerdings fälschlicherweise als kostenpflichtig markiert ist.
