当前位置:首页 > 元宇宙 > AI

中美 AI 挑战东京大学入学考试:双双合格,英语优异,数学欠佳

来源: 责编: 时间:2025-04-09 07:25:24 164观看
导读 4 月 7 日消息,据日经新闻 4 月 5 日报道,日本经济新闻与民间企业、大型补习班的联合研究发现,中美两国新型生成式 AI 已具备通过日本最难关东京大学理科 3 类入学考试的“学力”。两个模型在考察语言能力的英语

4 月 7 日消息,据日经新闻 4 月 5 日报道,日本经济新闻与民间企业、大型补习班的联合研究发现,中美两国新型生成式 AI 已具备通过日本最难关东京大学理科 3 类入学考试的“学力”。两个模型在考察语言能力的英语中取得高分,但在数学中多次出现论证错误等问题。k2p28资讯网——每日最新资讯28at.com

此次测试让美国 OpenAI 的“o1”和中国 AI 初创公司 DeepSeek 的“R1”两个基础模型解答 2025 年度的东大入学考试题。AI 初创公司 Life Prompt(东京・新宿)输出了答案,并由大型预备学校河合塾的讲师进行评分。k2p28资讯网——每日最新资讯28at.com

k2p28资讯网——每日最新资讯28at.com

大学入学共通考试和二次考试合计的理科得分(注:满分 550 分)中,o1 获得了 374 分,R1 获得了 369 分,两者均超过了东大在 3 月 10 日公布的理科 3 类合格最低分数线(368.7 分)。k2p28资讯网——每日最新资讯28at.com

R1 在理科 1 类和理科 2 类的共通考试中未达到合格最低分数线,但在其他科类中,与 o1 一起包括文科在内都“合格”了。k2p28资讯网——每日最新资讯28at.com

在二次考试中,得分率较高的是英语,o1 和 R1 的得分率均超过了 75%。河合塾负责英语的久恒秀雄讲师表示:“几乎没有单词和语法的错误,远远超过了东大考生的平均水平。”k2p28资讯网——每日最新资讯28at.com

数学方面,虽然最终答案正确的问题较多,但在图形和论证问题上多次出现论述错误和说明不足的情况。理科数学中,o1 在 120 分满分中得了 38 分,R1 得了 49 分。负责数学的香坂季京讲师指出:“这比合格者的平均分要低很多。”k2p28资讯网——每日最新资讯28at.com

自 2011 年开始的“机器人能否进入东京大学(东 Robo)”项目的负责人、国立信息学研究所的新井纪子教授对此次考试结果评价道:“这是 AI 成长的一个重要里程碑。不过,AI 有时会给出相当糟糕的答案,需要能够正确判断并熟练使用 AI 输出的人才。”k2p28资讯网——每日最新资讯28at.com

本文链接:http://www.28at.com/showinfo-45-12048-0.html中美 AI 挑战东京大学入学考试:双双合格,英语优异,数学欠佳

声明:本网页内容旨在传播知识,若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。邮件:2376512515@qq.com

上一篇: 天冕科技新专利:智能图像识别技术赋能金融业务高效升级

下一篇: IDC:2028 年中国 AI 总投资规模将突破 1000 亿美元,五年复合增长率达 35.2%

标签:
  • 热门焦点
  • 元娲2.7上线:虚拟人视频制作速度疯狂翻倍!

    来源:清元宇宙 炎炎夏日努力工作的Q仔的电脑都冒烟儿啦~今天要给大家介绍两个新小伙伴——小元和小娲,他们将给大家解读元娲2.7版本重磅更新内容~大家掌声欢迎~~~本次更
  • FMIFAwards奖项即将揭晓!

    来源:X增强现实FMIF Awards未来元宇宙创新奖是由未来元宇宙创新论坛、ARinChina以及多家投资机构、媒体、研究院联合发起的一项评选活动。旨在推动新技术的融合与集成低成本
  • “平均时代”:ChatGPT模仿秀的隐喻

    来源:锦缎如果你问ChatGPT,Instagram上最美的女人是谁?它很可能会给你一个名字,叫卡戴珊。如果你观察过Instagram这个美版小红书:平台上的所有网红,展现的几乎是统一面孔:统一的医
  • 茅台的元宇宙App火了,也被骂惨了

    元宇宙从概念走向大众生活,并不是一件简单的事情。技术、世界观、填充内容、载体形式,每一个环节都需要层层叠叠的逻辑。但正如赛博朋克奠基人威廉·吉布
  • AI特效、虚拟人、数字盲盒,来看看元宇宙如何融合冬奥会!

    今天是冬奥会比赛的第12天,截至目前所累计的成绩,中国代表团已经取得了冬奥历史最佳战绩。全世界的人都在关注着这场盛事,为奥运健儿呐喊助威。谷爱凌、徐梦桃、
  • 2030年的元宇宙产业将会如何发展?

    对互联网巨头传统业务的反垄断政策倒逼互联网企业颠覆创新,寻找新的增长点,移动互联网流量空间见顶之际,元宇宙时代红利已然开启。序章:元宇宙应用场景大猜想元宇
  • 韩国国民银行将推出韩国首个加密货币 ETF

    韩国国民银行(Kookmin Bank)计划发行该国首个以散户投资者为主要关注点的加密货币投资基金。根据公告,该银行正在等待政府批准,并已建立一个准备就绪的数字资产
  • NFT行业周报:NBA巨星勒布朗·詹姆斯申请NFT相关商标

    1. “无聊猿”BAYC交易总额突破14亿美元3月10日,据DappRader最新数据显示,“无聊猿”Bored Ape Yacht Club(BAYC)交易总额已突破14亿美元,创下历史新高,本文撰写时为
  • 超级账本Julian Gordon:联盟链与公链的竞争不是非此即彼

    在2021年《福布斯》区块链50强榜单中,29家企业使用Hyperledger超级账本技术,占比近60%。同年,研究机构Blockdata发布了的调查报告显示,访问Top100上市公司中,有 81
Top