当前位置:首页 > 元宇宙 > AI

谷歌推出 DataGemma:基于可信数据源提高 AI 准确度,减少幻觉

来源: 责编: 时间:2024-09-14 16:06:21 164观看
导读 9 月 13 日消息,科技媒体 maginative 昨日(9 月 12 日)发布博文,报道谷歌公司基于谷歌数据共享(Data Commons)中的真实世界统计数据,推出了开放权重 Gemma 模型的新版本 DataGemma。语言模型当前面临的一大难题就是

9 月 13 日消息,科技媒体 maginative 昨日(9 月 12 日)发布博文,报道谷歌公司基于谷歌数据共享(Data Commons)中的真实世界统计数据,推出了开放权重 Gemma 模型的新版本 DataGemma。Pbn28资讯网——每日最新资讯28at.com

Pbn28资讯网——每日最新资讯28at.com

语言模型当前面临的一大难题就是幻觉(Hallucinations),尤其是大语言模型(LLMs)在处理数值或统计数据时,这一问题变得尤为棘手,因此精确性至关重要。Pbn28资讯网——每日最新资讯28at.com

谷歌的 Data Commons 是一个存储库,汇集了来自联合国和疾病控制与预防中心等可信组织收集的超过 2400 亿个数据点。Pbn28资讯网——每日最新资讯28at.com

通过利用这一庞大的统计数据集,基于 Gemini 的 DataGemma 能够显著提升模型准确性,确保其输出基于真实可信的现实世界信息。Pbn28资讯网——每日最新资讯28at.com

Pbn28资讯网——每日最新资讯28at.com

DataGemma 方法的核心在于两种关键技术:检索交错生成(RIG)和检索增强生成(RAG)。这两种方法通过在生成过程中将模型基于现实世界数据,从而减少幻觉现象。Pbn28资讯网——每日最新资讯28at.com

简要介绍两项技术如下:Pbn28资讯网——每日最新资讯28at.com

RIG:Pbn28资讯网——每日最新资讯28at.com

通过主动查询可信来源,再生成回答的方式运作。在接收到提示词之后,DataGemma 会识别查询中的统计数据点,并从数据共享平台获取准确信息。Pbn28资讯网——每日最新资讯28at.com

Pbn28资讯网——每日最新资讯28at.com

例如,若被问及“全球可再生能源的使用量是否有所增加?”,该模型会在回答中穿插实时统计数据,确保事实准确性。Pbn28资讯网——每日最新资讯28at.com

RAG:Pbn28资讯网——每日最新资讯28at.com

在生成回答之前,会从数据共享平台检索相关信息,进一步提升了回答的质量。借助其长上下文窗口(由 Gemini 1.5 Pro 实现),DataGemma 确保了回答的全面性,引入了表格和脚注以提供更深层次的上下文,从而减少了虚构内容的出现。Pbn28资讯网——每日最新资讯28at.com

Pbn28资讯网——每日最新资讯28at.com

谷歌对 RIG 和 RAG 的研究尚处于初期阶段,但初步成果令人鼓舞。通过将现实世界数据嵌入回复中,DataGemma 模型在处理数值事实和统计查询方面展现出显著提升。研究团队已发表论文详述其方法,强调这些技术如何帮助 LLMs 判断何时依赖外部数据与内部参数。Pbn28资讯网——每日最新资讯28at.com

本文链接:http://www.28at.com/showinfo-45-7165-0.html谷歌推出 DataGemma:基于可信数据源提高 AI 准确度,减少幻觉

声明:本网页内容旨在传播知识,若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。邮件:2376512515@qq.com

上一篇: 安卓和 iOS 版谷歌 Gemini AI 应用新增 Gems 及管理器

下一篇: OpenAI o1 模型登场:开启 AI 通用复杂推理新篇章,模拟人类思考、处理问题

标签:
  • 热门焦点
  • AI网红能年赚百万,普通人的新机会来了?

    来源|运营研究社作者 | 张知白编辑 | 杨佩汶设计 | 晏谈梦洁2023 年 ,数字人成为了当红的“流量话题”和“商业机会"。不管是 AI 孙燕姿走红网络,还是 AI 数字
  • 蓝标亏钱、Meta裁员:天下秀还值得砸钱元宇宙吗?

    日前,天下秀数字科技集团正式公布了2022年报及2023年一季报。报告显示,2022年天下秀实现营收41.29亿元,同比下滑8.48%;归母净利润1.8亿元,同比下滑49.2%,几乎出现了盈利腰斩的态势
  • 关于年度热词NFT,除了钱,我们还可以聊点啥?

    每到年底,社交媒体总少不了年度盘点、年度总结、年度热词。如果让你来总结2021年度热词,你会想到什么?柯林斯词典将年度热词颁给了“NFT”,而其理由是:一个缩写词的
  • 搭上“谷爱凌”,“柳夜熙们”站上风口?

    作者:张琳 曹杨从“永不塌房”的艺人到频频亮相北京冬奥会,作为元宇宙细分赛道之一的虚拟数字人又火了一把。2月7日,即谷爱凌摘得冬奥会自由式滑雪大跳台金牌的
  • 2030年的元宇宙产业将会如何发展?

    对互联网巨头传统业务的反垄断政策倒逼互联网企业颠覆创新,寻找新的增长点,移动互联网流量空间见顶之际,元宇宙时代红利已然开启。序章:元宇宙应用场景大猜想元宇
  • Shiba Inu布局元宇宙 走出Meme局限

    以「狗狗币杀手」成名的Shiba Inu(SHIB)在人们的印象中始终有着浓厚的Meme(模因恶搞)烙印,但它似乎一直在尝试突破这种局限。建立起一个庞大的粉丝社区后,Shiba Inu
  • 以太坊伦敦升级后,随之生效的以太坊EIP-1559是什么?

    作者:三黎过去的一年里,除了 BTC 一如既往稳坐王位,DEFI 则是贯穿一整年的狂欢热点。 DeFi 在让 ETH 实现价值增长的同时,也使得其网络日渐拥堵、交易费用增高,成为
  • NFT:新骗局的狩猎场

    骗局的自动化需要更好的防御,从数字身份开始。前几天我在OpenSea上购买了一个NFT,是才华横溢的艺术家海伦·福尔摩斯 (Helen Holmes) 的漫画,来自她的 "原作 "收
  • 艺术创作者能否永久收取版税?

    NFTs正在改变我们理解互联网所有权的方式,社区管理的所有权有很多好处,但如果创作者想为他/她的创作获得永久的收益(版税),会发生什么?这不是一个容易解决的问题,版税
Top