Modèles VLA

AgiBot GO-1 (Genie Operator-1)

Chine

Modèle de fondation incarné ouvert phare de la Chine, qui introduit le cadre ViLLA où des tokens d'action latents relient les entrées vision-langage au contrôle du robot. Annoncé en mars 2025 et intégralement open source (poids sur Hugging Face) en septembre 2025, aux côtés du plus grand jeu de données robotique réel ouvert.

Mis à jour le 2026-07-09 · Dernière vérification 2026-07-09

OrganisationAgiBot (Zhiyuan Robotics) / OpenDriveLab
PaysCN
Sortie2025-03
Params (Mds)3
Poids ouvertsoui
ArchitectureViLLA (Vision-Language-Latent-Action): InternVL2.5-2B VLM backbone + MoE with a 24-layer latent planner predicting latent action tokens and a high-frequency action expert
LicenceCC BY-NC-SA 4.0
Modalitésvision, language, action
Incarnationshumanoid, manipulator, cross-embodiment
Données d'entraînementAgiBot World dataset: over 1 million real-robot trajectories across 217 tasks in 5 application domains, plus cross-embodiment and human video data for the latent planner

Sources : Hugging Face (model card) (2026-07-09)GlobeNewswire (AgiBot press release) (2025-03-11)arXiv (2025-03-09)OpenDriveLab (X) (2025-09-20)

← Retour au comparateur · Modèles VLA
Christian Verbrugge

Christian Verbrugge · D·Fairy

Vous introduisez une solution physical AI dans l'industrie européenne ?

15 ans chez KUKA sur les programmes OEM automobile (100 M€), aujourd'hui IA embarquée et agents autonomes. J'accompagne les entreprises de robotique et d'IA incarnée sur leur entrée marché EMEA : accès OEM et Tier 1, pilotes cofinancés, AI Act.

Réserver un premier appel