当前位置:首页 > 元宇宙 > AI

Hugging Face 公布 4.5 亿参数开源机器人模型 SmolVLA,消费级硬件设备即可运行

来源: 责编: 时间:2025-06-12 09:53:05 116观看
导读 6 月 9 日消息,Hugging Face现已公布 4.5 亿参数开源机器人模型 SmolVLA,该模型主打高普适性,可在 MacBook Pro等的消费级硬件设备上运行,旨在帮助开发者降低入门成本。当下,业界机器人模型通常采用“视觉-语言-行

6 月 9 日消息,Hugging Face现已公布 4.5 亿参数开源机器人模型 SmolVLA,该模型主打高普适性,可在 MacBook Pro等的消费级硬件设备上运行,旨在帮助开发者降低入门成本。LcU28资讯网——每日最新资讯28at.com

当下,业界机器人模型通常采用“视觉-语言-行动”(Vision-Language-Action,VLA)设计,此类模型尝试在单一架构中整合感知能力、语言理解与行动决策,从而让机器人实现自主执行复杂任务。不过相应模型训练成本极高,目前大多数模型仍为闭源项目,训练过程中依赖昂贵硬件、大量工程资源和大规模私有数据集。LcU28资讯网——每日最新资讯28at.com

为此,Hugging Face 推出 SmolVLA 这一轻量级开源模型,使用公开数据集进行训练,并可在消费级硬件设备上运行,旨在降低爱好者入门成本,推动通用机器人智能体的研究进展。LcU28资讯网——每日最新资讯28at.com

据介绍,SmolVLA 在模型架构上结合 Transformer 结构与 flow-matching 解码器,并采用了四项关键优化技术:一是跳过视觉模型中一半层数,以提升推理速度并减小模型体积;二是交替融合自注意力与交叉注意力模块,提高多模态信息整合效率;三是减少视觉 Token 数量以提升处理效率;四是采用更轻量的 SmolVLM2 作为视觉编码器,从而进一步降低硬件要求。LcU28资讯网——每日最新资讯28at.com

LcU28资讯网——每日最新资讯28at.com

▲ 图源Hugging Face(下同)

而在训练策略方面,SmolVLA 首先通过通用操作数据进行预训练,再针对特定任务进行微调,以提升适应能力。因此虽然 SmolVLA 的训练数据远少于现有其他 VLA 模型(仅包括不到 3 万个任务记录),但 Hugging Face 表示,该模型在模拟环境和真实场景中的表现与大型模型相当,甚至在部分任务上实现“超越”。LcU28资讯网——每日最新资讯28at.com

此外,Hugging Face 透露 SmolVLA 还引入“异步推理架构”(Asynchronous Inference Stack),将感知处理(如视觉和语音理解)与动作执行进行解耦,使机器人在面对快速变化的环境时能做出更及时的响应,大幅提升其实用性。LcU28资讯网——每日最新资讯28at.com

LcU28资讯网——每日最新资讯28at.com

Hugging Face 强调,用户使用MacBook Pro 笔记本电脑等消费级硬件即可运行 SmolVLA-450M 模型,无需花费大成本采购专用AI训练服务器。同时用户也可以考虑采购 Hugging Face 推出的低成本机器人平台(SO-100、SO-101 和 LeKiwi)等降低成本。LcU28资讯网——每日最新资讯28at.com

Hugging Face 援引自家进行的多项基准测试验证SmolVLA 的性能,在 LIBERO 与 Meta-World 等模拟测试平台上,SmolVLA 的表现据称优于Octo、OpenVLA 等业界竞品,而在使用真实机器人 SO-100 和 SO-101 进行抓取、放置、堆叠与分类任务中,SmolVLA 也展现出更好的性能。LcU28资讯网——每日最新资讯28at.com

LcU28资讯网——每日最新资讯28at.com

目前,SmolVLA 的基础模型已在 Hugging Face 平台上线,完整训练方法也同步在 GitHub 上公开,附项目页面如下(https://huggingface.co/lerobot/smolvla_base)。LcU28资讯网——每日最新资讯28at.com

本文链接:http://www.28at.com/showinfo-45-13643-0.htmlHugging Face 公布 4.5 亿参数开源机器人模型 SmolVLA,消费级硬件设备即可运行

声明:本网页内容旨在传播知识,若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。邮件:2376512515@qq.com

上一篇: 国产 AI 初创企业硅基流动完成新一轮数亿元融资,阿里云领投

下一篇: 英国电影协会警告:AI 会掠夺剧本,将对本土影视业构成直接威胁

标签:
  • 热门焦点
  • 数字虚拟人23年最新变化!

    作者:小资来源:米塔之家自2021年元宇宙“爆炸”后,作为现实世界连接元宇宙的媒介之一,大批虚拟人跑步入场。到了2022年底,据天眼查数据显示,我国目前企业名称或经营范围
  • 茅台的元宇宙App火了,也被骂惨了

    元宇宙从概念走向大众生活,并不是一件简单的事情。技术、世界观、填充内容、载体形式,每一个环节都需要层层叠叠的逻辑。但正如赛博朋克奠基人威廉·吉布
  • 传腾讯已推出全新XR业务;摩托罗拉正打造5GXR颈戴式计算组件

    今日热点:传腾讯已推出全新XR业务;摩托罗拉与Verizon合作打造5G XR颈戴式计算组件;小米AR购物导航专利获授权;VR一体机Simula One放弃众筹并开放直接预订;VR游戏《
  • 比特币的价格越高,使用价值越大

    隔夜比特币还是在精准地横盘在42k上方。空头昨日试图发起一波小的攻势,但是晚上就被多头掰了回来。以太坊的链上gas price降到了60 gwei以下,彰显着市场活跃度的
  • 冰墩墩还能火多久?

    作者:田巧云题图源自北京2022年冬奥会官方微博如果要问2022年的开年明星是谁,冰墩墩当仁不让。几乎所有人都被那个抖雪的动作实力圈粉。在社交媒体的助推,以及日
  • NFT盗窃案:为什么NFT市场被盗窃和黑客所困扰?

    Block-806NFT的增长值得关注。许多人愿意为数字艺术支付数百万美元,世界正在走向数字化。报告显示,NFT市场和NFT收藏从2020年的1.06亿美元增加到了2021年的442亿
  • 对讽刺无动于衷,Nori将碳市场放在区块链上

    当我们聊气候问题的解决方案时,以太坊区块链应该不是最首想到的,但这正是Nori所选择的方案,它建立了一个引擎,鼓励农民使用负碳耕作方法,将空气中的碳抽出并放回地
  • 技术赋能,国内首家宠物元宇宙平台“Pet Meta”开启虚拟养宠新方式

    作者:易明未来,Pet Meta数字宠物藏品将是链接全球数亿爱宠人群与元宇宙世界独一无二的身份象征。首家面向国内的宠物元宇宙平台Pet Meta生长于“宠物经济”快速
  • 我们为什么需要Web3,距离Web3的实现还有多远?

    当今技术正在经历着重要的变革,许多公司正在改变他们的经营模式以求变得更加的灵活,其中有很大一部分公司采用了不同的方式来发展自己的业务。其中之一就是Web3,
Top