当前位置:首页 > 科技  > 资讯

快手Kwai Agents系统、模型、数据全部开源

来源: 责编: 时间:2024-01-08 09:14:20 367观看
导读7B的模型也能玩转AI Agents了?近期,快手开源了Kwai Agents,亲测发现,问它周末滑雪问题,它不但能帮你找到场地,连当天的天气都帮你考虑周到了。大语言模型(LLM)通过对语言的建模而掌握了大量知识,并具备一定认知和推理能力。但

7B的模型也能玩转AI Agents了?近期,快手开源了Kwai Agents,亲测发现,问它周末滑雪问题,它不但能帮你找到场地,连当天的天气都帮你考虑周到了。xpJ28资讯网——每日最新资讯28at.com

大语言模型(LLM)通过对语言的建模而掌握了大量知识,并具备一定认知和推理能力。但由于无法跟世界保持实时的交互,在单独使用的情况下,常会出现一本正经地胡说八道的现象。而AI Agents就是解决这个问题的道路之一,它通过激发大模型任务规划、反思、调用工具等能力,使大模型能够借助现实世界工具提升生成内容的准确性,甚至有能力解决复杂问题。xpJ28资讯网——每日最新资讯28at.com

据了解,KwaiAgents是一个先进的AI智能体系统,由快手联合哈尔滨工业大学研发,通过使用大型语言模型来模仿人类认知技能,可应用于自然语言处理、语音识别等领域。Kwai Agents可以使7B/13B的“小”大模型也能达到超越GPT-3.5的效果,目前该项目已将系统、模型、数据、评测全部开源,使得更多的研究人员可以参与其中。 xpJ28资讯网——每日最新资讯28at.com

技术报告:https://arxiv.org/abs/2312.04889xpJ28资讯网——每日最新资讯28at.com

项目主页:https://github.com/KwaiKEG/KwaiAgentsxpJ28资讯网——每日最新资讯28at.com

从「KwaiAgents」的Github主页中可以看到,本次开源内容包含:xpJ28资讯网——每日最新资讯28at.com

1.系统(KAgentSys-Lite):轻量级AI Agents系统,并配备事实、时效性工具集;xpJ28资讯网——每日最新资讯28at.com

2.模型(KAgentLMs):Meta-Agent Tuning后,具有Agents通用能力的系列大模型及其训练数据;xpJ28资讯网——每日最新资讯28at.com

3.评测(KAgentBench):开箱即用的Agent能力自动化评测Benchmark与人工评测结果。xpJ28资讯网——每日最新资讯28at.com

xpJ28资讯网——每日最新资讯28at.com

KAgentBench通过人工精细化标注的上千条数据,做到了开箱即用,让大家能够用一行命令评测一个大模型在不同模板下,各方面的Agents能力。下表显示了经过快手团队调优后,7B-13B模型各项能力的提升,且超越了GPT-3.5的效果:xpJ28资讯网——每日最新资讯28at.com

xpJ28资讯网——每日最新资讯28at.com

同时,作者们还请人类标注者在200个事实性和时效性的问题(如“刘德华今年几岁了”),对不同的大模型和Agent系统进行了交叉评估,可以看到KAgentSys系统和MAT之后模型提升显著(百分号前为正确率,括号内为5分制均分)。xpJ28资讯网——每日最新资讯28at.com

xpJ28资讯网——每日最新资讯28at.com

xpJ28资讯网——每日最新资讯28at.com

通常仅依赖网页搜索对一些长尾问题和热门问题返回结果不佳。比如问到“安东内拉比梅西大多少天?”这类长尾问题,往往搜索结果返回的都是一些两者的八卦新闻,而返回不了一些关键信息。而KAgentSys 通过调用百科搜索工具获取精准的出生日期,再调用time_delta时间差工具算出年龄差,就能精准回答这个问题了。xpJ28资讯网——每日最新资讯28at.com

快手技术人员表示,AI Agents是一条非常有潜力的道路,未来一方面会在这个方向持之以恒地沉淀核心技术,并为整个社区不断地注入新的活力;另一方面,也会积极探索Agents技术与快手业务的结合,尝试更多有趣、有价值的创新应用落地。xpJ28资讯网——每日最新资讯28at.com

本文链接:http://www.28at.com/showinfo-16-57712-0.html快手Kwai Agents系统、模型、数据全部开源

声明:本网页内容旨在传播知识,若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。邮件:2376512515@qq.com

上一篇: 全年短视频点赞破万亿 快手用“最孤独的广告牌”致敬用户

下一篇: 初冬邂逅“蓝朋友” 快手快相亲、中国青年网牵手火焰蓝开启寻找缘分之旅

标签:
  • 热门焦点
  • K60至尊版狂暴引擎2.0加持:超177万跑分斩获性能第一

    Redmi的后性能时代战略发布会今天下午如期举办,在本次发布会上,Redmi公布了多项关于和联发科的深度合作,以及新机K60 Ultra在软件和硬件方面的特性,例如:“K60 至尊版,双芯旗舰
  • 6月iOS设备性能榜:M2稳居榜首 A系列只能等一手3nm来救

    没有新品发布,自然iOS设备性能榜的上榜设备就没有什么更替,仅仅只有跑分变化而产生的排名变动,毕竟苹果新品的发布节奏就是这样的,一年下来也就几个移动端新品,不会像安卓厂商,一
  • 一篇聊聊Go错误封装机制

    %w 是用于错误包装(Error Wrapping)的格式化动词。它是用于 fmt.Errorf 和 fmt.Sprintf 函数中的一个特殊格式化动词,用于将一个错误(或其他可打印的值)包装在一个新的错误中。使
  • 使用AIGC工具提升安全工作效率

    在日常工作中,安全人员可能会涉及各种各样的安全任务,包括但不限于:开发某些安全工具的插件,满足自己特定的安全需求;自定义github搜索工具,快速查找所需的安全资料、漏洞poc、exp
  • 10天营收超1亿美元,《星铁》比《原神》差在哪?

    来源:伯虎财经作者:陈平安即便你没玩过《原神》,你一定听说过的它的大名。恨它的人把《原神》开服那天称作是中国游戏史上最黑暗的一天,有粉丝因为索尼在PS平台上线《原神》,怒而
  • 腾讯盖楼,字节拆墙

    来源 | 光子星球撰文 | 吴坤谚编辑 | 吴先之“想重温暴刷深渊、30+技能搭配暴搓到爽的游戏体验吗?一起上晶核,即刻暴打!”曾凭借直播腾讯旗下代理格斗游戏《DNF》一
  • 英特尔Xe-HP项目终止,将专注Xe-HPC/HPG系列显卡

    据10 月 31 日消息报道,英特尔高级副总裁兼加速计算系统和图形事业部总经理 表示,Xe-HP“ Arctic Sound” 系列服务器 GPU 已经应用于 oneAPI devcloud 云服
  • 联想小新Pad Pro 12.6将要推出,搭载高通骁龙 870 处理器

    联想小新Pad Pro 12.6将于秋季新品会上推出,官方按照惯例直接在发布会前给出了机型的所有参数。联想小新 Pad Pro 12.6 将搭载高通骁龙 870 处理器,重量为 5
  • 中关村论坛11月25日开幕,15位诺奖级大咖将发表演讲

    11月18日,记者从2022中关村论坛新闻发布会上获悉,中关村论坛将于11月25至30日在京举行。本届中关村论坛由科学技术部、国家发展改革委、工业和信息化部、国务
Top