当前位置:首页 > 元宇宙 > AI

Hugging Face 公布 4.5 亿参数开源机器人模型 SmolVLA,消费级硬件设备即可运行

来源: 责编: 时间:2025-06-12 09:53:05 151观看
导读 6 月 9 日消息,Hugging Face现已公布 4.5 亿参数开源机器人模型 SmolVLA,该模型主打高普适性,可在 MacBook Pro等的消费级硬件设备上运行,旨在帮助开发者降低入门成本。当下,业界机器人模型通常采用“视觉-语言-行

6 月 9 日消息,Hugging Face现已公布 4.5 亿参数开源机器人模型 SmolVLA,该模型主打高普适性,可在 MacBook Pro等的消费级硬件设备上运行,旨在帮助开发者降低入门成本。Ltm28资讯网——每日最新资讯28at.com

当下,业界机器人模型通常采用“视觉-语言-行动”(Vision-Language-Action,VLA)设计,此类模型尝试在单一架构中整合感知能力、语言理解与行动决策,从而让机器人实现自主执行复杂任务。不过相应模型训练成本极高,目前大多数模型仍为闭源项目,训练过程中依赖昂贵硬件、大量工程资源和大规模私有数据集。Ltm28资讯网——每日最新资讯28at.com

为此,Hugging Face 推出 SmolVLA 这一轻量级开源模型,使用公开数据集进行训练,并可在消费级硬件设备上运行,旨在降低爱好者入门成本,推动通用机器人智能体的研究进展。Ltm28资讯网——每日最新资讯28at.com

据介绍,SmolVLA 在模型架构上结合 Transformer 结构与 flow-matching 解码器,并采用了四项关键优化技术:一是跳过视觉模型中一半层数,以提升推理速度并减小模型体积;二是交替融合自注意力与交叉注意力模块,提高多模态信息整合效率;三是减少视觉 Token 数量以提升处理效率;四是采用更轻量的 SmolVLM2 作为视觉编码器,从而进一步降低硬件要求。Ltm28资讯网——每日最新资讯28at.com

Ltm28资讯网——每日最新资讯28at.com

▲ 图源Hugging Face(下同)

而在训练策略方面,SmolVLA 首先通过通用操作数据进行预训练,再针对特定任务进行微调,以提升适应能力。因此虽然 SmolVLA 的训练数据远少于现有其他 VLA 模型(仅包括不到 3 万个任务记录),但 Hugging Face 表示,该模型在模拟环境和真实场景中的表现与大型模型相当,甚至在部分任务上实现“超越”。Ltm28资讯网——每日最新资讯28at.com

此外,Hugging Face 透露 SmolVLA 还引入“异步推理架构”(Asynchronous Inference Stack),将感知处理(如视觉和语音理解)与动作执行进行解耦,使机器人在面对快速变化的环境时能做出更及时的响应,大幅提升其实用性。Ltm28资讯网——每日最新资讯28at.com

Ltm28资讯网——每日最新资讯28at.com

Hugging Face 强调,用户使用MacBook Pro 笔记本电脑等消费级硬件即可运行 SmolVLA-450M 模型,无需花费大成本采购专用AI训练服务器。同时用户也可以考虑采购 Hugging Face 推出的低成本机器人平台(SO-100、SO-101 和 LeKiwi)等降低成本。Ltm28资讯网——每日最新资讯28at.com

Hugging Face 援引自家进行的多项基准测试验证SmolVLA 的性能,在 LIBERO 与 Meta-World 等模拟测试平台上,SmolVLA 的表现据称优于Octo、OpenVLA 等业界竞品,而在使用真实机器人 SO-100 和 SO-101 进行抓取、放置、堆叠与分类任务中,SmolVLA 也展现出更好的性能。Ltm28资讯网——每日最新资讯28at.com

Ltm28资讯网——每日最新资讯28at.com

目前,SmolVLA 的基础模型已在 Hugging Face 平台上线,完整训练方法也同步在 GitHub 上公开,附项目页面如下(https://huggingface.co/lerobot/smolvla_base)。Ltm28资讯网——每日最新资讯28at.com

本文链接:http://www.28at.com/showinfo-45-13643-0.htmlHugging Face 公布 4.5 亿参数开源机器人模型 SmolVLA,消费级硬件设备即可运行

声明:本网页内容旨在传播知识,若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。邮件:2376512515@qq.com

上一篇: 国产 AI 初创企业硅基流动完成新一轮数亿元融资,阿里云领投

下一篇: 英国电影协会警告:AI 会掠夺剧本,将对本土影视业构成直接威胁

标签:
  • 热门焦点
  • 错过了BRC20还有eths,eth铭文协议

    来源:三头鸟NFT大家好,我是鸟哥,了解鸟哥的人都知道鸟哥擅撸空投,说实话撸毛虽然回报大但周期还是有点长的,所以除了撸毛我们自己也在研究早期项目,打新,比如BRC20协议ordi当时就有
  • 关于ChatGPT的10点思考

    作者:晏涛三寿近日ChatGPT又有大动作。5月19日,OpenAI在官网宣布正式发布App应用,并登录苹果应用商店。与网页版的聊天机器人相比,iOS应用程序的发布有望让更多人接触到ChatGPT
  • 元宇宙将会如何塑造未来的工作方式?

    科幻小说家尼尔·斯蒂芬森 (Neal Stephenson) 在1992年就创造了“元宇宙”一词,但事实上,在Facebook将其更名为Meta以反映其将这一科幻愿景变为现实的战略重点之
  • 从冰墩墩到无聊猿,解秘未来IP爆款的模因

    打造IP,是建设元宇宙的刚需。NFT能直接让IP的价值变现;虚拟人IP是元宇宙的第一入口,而元宇宙要搭建的,就是一个个品牌IP星球,考验的是IP世界观的建设能力。如果说在
  • 从英式拍到荷兰拍,看传统金融拍卖玩法如何玩转NFT市场交易

    作者:鲁拍卖是一种从古至今的商业活动。从古代的典当到现代的拍卖市场、我们熟知的拍卖行,以及知名街头艺术家Bansky名画拍卖成功后,竟自毁粉碎,现价值又翻倍的拍
  • Web 3如何改变传统HR

    互联网自诞生以来,经历了三次迭代。Web1是第一阶段,包括ISP服务器上的个人网页或免费的虚拟主机服务。然后Web2出现了,它引入了动态的用户生成内容、互操作性、增
  • NFT世界的艺术家名单

    我们汇编了以下艺术家的名单,它包括每个艺术家的简短概述。当然,这份名单肯定不全面,还有很多很多艺术家、哲学家和商业领袖为世界贡献了不可估量的价值。而他们
  • 盘点9个主流元宇宙平台,你都知道哪些?

    随着NFT的持续升温,它也加入了现在的元宇宙浪潮。本文介绍元宇宙的基本概念以及 九个最流行的元宇宙NFT平台,如Decentraland、sandbox等。用熟悉的语言学习 以太
  • 元宇宙的应用行业研究:娱乐可能是元宇宙落地最快的场景之一

    近日,毕马威正式发布其《初探元宇宙》报告,这也是毕马威在元宇宙领域发布的首份报告。报告指出,元宇宙在以下十个领域的应用场景尤其值得期待,包括娱乐、社交、零
Top