当前位置:首页 > 元宇宙 > AI

阿里巴巴开源自主搜索 AI 智能体 WebAgent

来源: 责编: 时间:2025-06-02 11:05:28 109观看
导读 5 月 30 日消息,阿里巴巴昨日在 Github 上开源了其创新的自主搜索 AI Agent——WebAgent,具备端到端的自主信息检索与多步推理能力,能够像人类一样在网络环境中主动感知、决策和行动。例如,当用户想了解某个特定

5 月 30 日消息,阿里巴巴昨日在 Github 上开源了其创新的自主搜索 AI Agent——WebAgent,具备端到端的自主信息检索与多步推理能力,能够像人类一样在网络环境中主动感知、决策和行动。JVa28资讯网——每日最新资讯28at.com

例如,当用户想了解某个特定领域的最新研究成果时,WebAgent 能够主动搜索多个学术数据库,筛选出最相关的文献,并根据用户的需求进行深入分析和总结。JVa28资讯网——每日最新资讯28at.com

据介绍,WebAgent 不仅能识别文献中的关键信息,还能通过多步推理将不同文献中的观点进行整合,最终为用户提供一份全面且精准的研究报告。JVa28资讯网——每日最新资讯28at.com

JVa28资讯网——每日最新资讯28at.com

阿里巴巴 WebAgent 分为 WebDancer 和 WebWalker,前者是一种端到端智能体训练框架,旨在增强基于网络的 AI 智能体的多步骤信息搜索能力;后者则属于“Web 遍历中的 LLM 基准测试”。JVa28资讯网——每日最新资讯28at.com

JVa28资讯网——每日最新资讯28at.com

Web Agents 上的性能:JVa28资讯网——每日最新资讯28at.com

JVa28资讯网——每日最新资讯28at.com

WebDancer 的框架一共由 4 大块组成,从数据构建到训练优化,逐步打造出能够自主完成复杂信息检索任务的智能体。JVa28资讯网——每日最新资讯28at.com

浏览数据构建是整个框架的起点。在现实世界中,高质量的训练数据是智能体能够有效学习和泛化的关键。WebDancer 通过两种创新的数据合成方法来解决传统数据集的局限性。JVa28资讯网——每日最新资讯28at.com

为了确保生成的轨迹既有效又连贯,WebDancer 采用了短推理和长推理两种方法。短推理利用大模型直接生成简洁的推理路径,而长推理则通过推理模型逐步构建复杂的推理过程。JVa28资讯网——每日最新资讯28at.com

在数据准备完成后,WebDancer 进入监督微调(SFT)阶段。这一阶段的目标是通过高质量的轨迹数据对智能体进行初始化训练,使其能够适应信息检索任务的格式和环境要求。JVa28资讯网——每日最新资讯28at.com

在 SFT 过程中,WebDancer 将轨迹中的思考、行动和观察内容分别标记,并计算损失函数,以优化模型的参数。为了提高模型的鲁棒性,WebDancer 在计算损失时排除了外部反馈的影响,确保模型能够专注于自主决策过程。这一阶段的训练为智能体提供了强大的初始能力,使其能够在后续的强化学习阶段更好地适应复杂的任务环境。JVa28资讯网——每日最新资讯28at.com

强化学习(RL)阶段是 WebDancer 框架的关键环节。在这一阶段,智能体通过与环境的交互,学习如何在复杂的任务中做出最优决策。WebDancer 采用了 DAPO 算法,这是一种专门针对智能体训练设计的强化学习算法。JVa28资讯网——每日最新资讯28at.com

DAPO 算法通过动态采样机制,有效利用未充分利用的 QA 对,提高数据效率和策略的鲁棒性。在 RL 过程中,智能体通过多次尝试和反馈,逐步优化其决策策略,最终实现高效的多步推理和信息检索能力。JVa28资讯网——每日最新资讯28at.com

附 WebAgent 官方地址:JVa28资讯网——每日最新资讯28at.com

Github:https://github.com/Alibaba-NLP/WebAgentJVa28资讯网——每日最新资讯28at.com

WebDancer论文:https://arxiv.org/ pdf/2505.22648JVa28资讯网——每日最新资讯28at.com

WebWalker论文:https://arxiv.org/ pdf/2501.07572JVa28资讯网——每日最新资讯28at.com

本文链接:http://www.28at.com/showinfo-45-13298-0.html阿里巴巴开源自主搜索 AI 智能体 WebAgent

声明:本网页内容旨在传播知识,若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。邮件:2376512515@qq.com

上一篇: AI“电老虎”:2025 年底预估占全球数据中心近 50% 用电量,首超加密货币挖矿

下一篇: OpenAI o3 AI 推理模型成关键“侦探”,发现 Linux 内核高危漏洞

标签:
  • 热门焦点
  • 关于ChatGPT的10点思考

    作者:晏涛三寿近日ChatGPT又有大动作。5月19日,OpenAI在官网宣布正式发布App应用,并登录苹果应用商店。与网页版的聊天机器人相比,iOS应用程序的发布有望让更多人接触到ChatGPT
  • 从科幻走进现实,元宇宙概念逐渐清晰

    2021年,元宇宙概念如同一颗炸弹投进互联网行业,掀起了一场数字海啸,众多企业纷纷入局,在此新领域展开新探索。那么,加速狂奔的元宇宙究竟是什么?概念翻红,元宇宙走进资本圈2021年3
  • 借VR产业东风,江西抢滩布局“元宇宙”

    自2016年起就在VR上倾注了大量精力的江西省,迅速搭上了“元宇宙”。VR、AR等技术是通往元宇宙的关键接口,使人们可以在数字空间和物理空间自由穿梭。自2016年起
  • 小众有趣NFT艺术作品欣赏(1)

    随着NFT发展火热,越来越多领域与NFT融合,NFT艺术在加密领域中占据了很大一部分。NFT艺术与传统艺术有相似之处,也有完全不同的地方。NFT艺术与传统艺术一样,表现了
  • 数字经济、数据要素与数字治理

    深入理解数字经济与数据要素,有利于更准确理解和把握数字治理的基本规律,构建面向未来的健康的数字治理体系,也才能更好地理解元宇宙的治理框架。 一、数字经济
  • NFT:新骗局的狩猎场

    骗局的自动化需要更好的防御,从数字身份开始。前几天我在OpenSea上购买了一个NFT,是才华横溢的艺术家海伦·福尔摩斯 (Helen Holmes) 的漫画,来自她的 "原作 "收
  • 大厂打造元宇宙平台的业务重心是什么?

    知名市场研究机构IDC发布《2022年中国元宇宙市场十大预测》报告,其中提出互联网大厂各自独立布局元宇宙平台。事实上,在2021年的最后一个季度,包括Meta、英伟达、
  • Steam 禁止NFT和加密货币原因曝光

    近日,Valve(V社)总裁Gabe Newell接受PC Gamer采访时解释了该平台禁止NFT和加密货币的原因。早在2021年10月18日,PC Gamer就报道Steam推出的新规:使用区块链或允许交
  • Staking 收益翻倍?

    以太坊质押可能很快就会有两倍的利润。Coinbase 估计,在 1 月份以太坊网络合并后,持有 ETH 的回报将翻倍。增长预期假设来自加密货币交易所 Coinbase 的估计是准
Top