SmolVLA نموذج ذكاء اصطناعي فعال في مجالات الرؤية الحاسوبية، اللغة الطبيعية، والتحكم في الحركة، تم تطويره باستخدام بيانات تدريب مقدمة من مجتمع Lerobot. هذا النموذج قادر على إدارة العمليات البصرية، فهم اللغة، والوظائف الحركية بشكل متكامل في نفس الوقت.
يركز SmolVLA بشكل رئيسي على زيادة الكفاءة والدقة في التطبيقات متعددة الوسائط والروبوتات، وقد حقق تحسينات ملحوظة في أدائه باستخدام مصادر بيانات فريدة من مجتمع Lerobot.

