Modèles VLA

OpenVLA

États-Unis

Le VLA open source de référence : il a surpassé le modèle fermé RT-2-X (55 Md) avec seulement 7 Md de paramètres et publié tous les poids et le code d'entraînement sous licence MIT, catalysant l'écosystème VLA académique et startup.

Mis à jour le 2026-07-09 · Dernière vérification 2026-07-09

OrganisationStanford / UC Berkeley / TRI / Google DeepMind (academic consortium)
PaysUS
Sortie2024-06
Params (Mds)7
Poids ouvertsoui
Architectureautoregressive VLA: Prismatic VLM (Llama-2-7B language backbone + fused SigLIP and DINOv2 vision encoders), actions as discrete tokens
LicenceMIT
Modalitésvision, language, action
Incarnationsmanipulator, cross-embodiment
Données d'entraînement970k robot manipulation episodes from the Open X-Embodiment dataset; trained on 64 A100 GPUs for 15 days

Sources : arXiv (2024-06-13)Hugging Face (model card) (2026-07-09)OpenVLA project (2026-07-09)

← Retour au comparateur · Modèles VLA
Christian Verbrugge

Christian Verbrugge · D·Fairy

Vous introduisez une solution physical AI dans l'industrie européenne ?

15 ans chez KUKA sur les programmes OEM automobile (100 M€), aujourd'hui IA embarquée et agents autonomes. J'accompagne les entreprises de robotique et d'IA incarnée sur leur entrée marché EMEA : accès OEM et Tier 1, pilotes cofinancés, AI Act.

Réserver un premier appel