当前位置:首页>>Hugging Face 公布 4.5 亿参数开源机器人模型

Hugging Face 公布 4.5 亿参数开源机器人模型

发布时间:2025-06-09作者:光光

 6月9日消息,Hugging Face现已公布 4.5 亿参数开源机器人模型 SmolVLA,该模型主打高普适性,可在 MacBook Pro等的消费级硬件设备上运行,旨在帮助开发者降低入门成本。


当下,业界机器人模型通常采用“视觉 - 语言 - 行动 ”(Vision-Language-Action,VLA)设计,此类模型尝试在单一架构中整合感知能力、语言理解与行动决策,从而让机器人实现自主执行复杂任务。不过相应模型训练成本极高,目前大多数模型仍为闭源项目,训练过程中依赖昂贵硬件、大量工程资源和大规模私有数据集。


为此,Hugging Face 推出 SmolVLA 这一轻量级开源模型,使用公开数据集进行训练,并可在消费级硬件设备上运行,旨在降低爱好者入门成本,推动通用机器人智能体的研究进展。


据介绍,SmolVLA在模型架构上结合Transformer结构与flow-matching解码器,并采用了四项关键优化技术:一是跳过视觉模型中一半层数,以提升推理速度并减小模型体积;二是交替融合自注意力与交叉注意力模块,提高多模态信息整合效率;三是减少视觉Token数量以提升处理效率;四是采用更轻量的SmolVLM2作为视觉编码器,从而进一步降低硬件要求。


图源:Hugging Face(下同)


而在训练策略方面,SmolVLA首先通过通用操作数据进行预训练,再针对特定任务进行微调,以提升适应能力。因此虽然SmolVLA的训练数据远少于现有其他VLA模型(仅包括不到3万个任务记录),但Hugging Face表示,该模型在模拟环境和真实场景中的表现与大型模型相当,甚至在部分任务上实现“超越”。


此外,Hugging Face透露SmolVLA还引入“异步推理架构(Asynchronous Inference Stack),将感知处理(如视觉和语音理解)与动作执行进行解耦,使机器人在面对快速变化的环境时能做出更及时的响应,大幅提升其实用性。



Hugging Face强调,用户使用MacBook Pro笔记本电脑等消费级硬件即可运行SmolVLA-450M 模型,无需花费大成本采购专用AI训练服务器。同时用户也可以考虑采购 Hugging Face推出的低成本机器人平台(SO-100、SO-101 和 LeKiwi)等降低成本。


Hugging Face援引自家进行的多项基准测试验证SmolVLA的性能,在LIBERO与Meta-World 等模拟测试平台上,SmolVLA的表现据称优于Octo、OpenVLA等业界竞品,而在使用真实机器人 SO-100 和 SO-101 进行抓取、放置、堆叠与分类任务中,SmolVLA 也展现出更好的性能。



目前,SmolVLA的基础模型已在Hugging Face平台上线,完整训练方法也同步在GitHub上公开。

公司简介

宜科(天津)电子有限公司是中国工业自动化的领军企业,于2003年在天津投资成立,销售和服务网络覆盖全国。作为中国本土工业自动化产品的提供商和智能制造解决方案的供应商,宜科在汽车、汽车零部件、工程机械、机器人、食品制药、印刷包装、纺织机械、物流设备、电子制造等诸多领域占据领先地位。宜科为智慧工厂的整体规划实施提供自系统层、控制层、网络层到执行层自上而下的全系列服务,产品及解决方案涵盖但不局限于云平台、MES制造执行系统、工业现场总线、工业以太网、工业无线通讯、机器人及智能设备组成的自动化生产线、自动化电气控制系统集成、智能物流仓储系统等,以实现真正智能化的生产制造,从而带来生产力和生产效率的大幅提升,以及对生产灵活性和生产复杂性的管理能力的大幅提升。多年来,宜科以创新的技术、卓越的解决方案和产品坚持不懈地为中国制造业的发展提供全面支持,并以出众的品质和令人信赖的可靠性、领先的技术成就、不懈的创新追求,在业界独树一帜。帮助中国制造业转型升级,加速智能制造进程,成为中国工业4.0智慧工厂解决方案当之无愧的践行者。

更多详情>>

联系我们

  • 联系人:章清涛
  • 热线:18611695135
  • 电话:
  • 传真:
  • 邮箱:18210150532@139.com

Copyright © 2015 ilinki.net Inc. All rights reserved. 智汇工业版权所有

电话:010-62314658 邮箱:service@ilinki.net

主办单位:智汇万联(北京)信息技术有限公司

京ICP备15030148号-1