Modèles VLA

SmolVLA

États-Unis

Un VLA ouvert de 450 M de paramètres entraîné uniquement sur des données communautaires, assez petit pour être entraîné sur un seul GPU grand public et tourner sur CPU ou MacBook ; l'inférence asynchrone apporte ~30 % de latence en moins et ~2x de débit de tâches. Développé par l'équipe LeRobot de Hugging Face, basée à Paris.

Mis à jour le 2026-07-09 · Dernière vérification 2026-07-09

OrganisationHugging Face (LeRobot team)
PaysUS
Sortie2025-06
Params (Mds)0,5
Poids ouvertsoui
Architecturecompact VLA: SmolVLM-2 backbone + flow-matching action expert conditioned on multi-camera views, robot state and language; asynchronous inference
LicenceApache-2.0
Modalitésvision, language, action
Incarnationsmanipulator
Données d'entraînementExclusively publicly available, crowd-sourced LeRobot community datasets from the Hugging Face hub (low-cost robot data)

Sources : arXiv (2025-06-02)Hugging Face (2025-06-03)Hugging Face (model card) (2026-07-09)

← Retour au comparateur · Modèles VLA
Christian Verbrugge

Christian Verbrugge · D·Fairy

Vous introduisez une solution physical AI dans l'industrie européenne ?

15 ans chez KUKA sur les programmes OEM automobile (100 M€), aujourd'hui IA embarquée et agents autonomes. J'accompagne les entreprises de robotique et d'IA incarnée sur leur entrée marché EMEA : accès OEM et Tier 1, pilotes cofinancés, AI Act.

Réserver un premier appel