SchlüsselarbeitOriginalarbeiterreichbar
π0: A Vision-Language-Action Flow Model for General Robot Control
Black und 23 Mitautoren stellen am 31.10.2024 ein Grundmodell für Roboter vor, das über mehrere Bauformen hinweg dieselbe Steuerung fährt, von Einzelarm bis mobiler Greifer. Erschienen bei der Konferenz Robotics: Science and Systems 2025 und damit begutachtet, was in diesem Gebiet die Ausnahme ist. Beschreibt das Verfahren, ein vortrainiertes Bild-Sprach-Modell um einen fortlaufenden Bewegungsausgang zu erweitern.
geprüft 24.09.2026
Worauf sich diese Seite beruft, wörtlich, abgerufen am 07.09.2026:
bringing robot learning to the level of generality required for effective real-world systems faces major obstacles in terms of data, generalization, and robustness
bestätigt 24.09.2026We propose a novel flow matching architecture built on top of a pre-trained vision-language model (VLM) to inherit Internet-scale semantic knowledge.
bestätigt 24.09.2026