当前位置:首页 > 元宇宙 > AI

中美 AI 挑战东京大学入学考试:双双合格,英语优异,数学欠佳

来源: 责编: 时间:2025-04-09 07:25:24 147观看
导读 4 月 7 日消息,据日经新闻 4 月 5 日报道,日本经济新闻与民间企业、大型补习班的联合研究发现,中美两国新型生成式 AI 已具备通过日本最难关东京大学理科 3 类入学考试的“学力”。两个模型在考察语言能力的英语

4 月 7 日消息,据日经新闻 4 月 5 日报道,日本经济新闻与民间企业、大型补习班的联合研究发现,中美两国新型生成式 AI 已具备通过日本最难关东京大学理科 3 类入学考试的“学力”。两个模型在考察语言能力的英语中取得高分,但在数学中多次出现论证错误等问题。3zF28资讯网——每日最新资讯28at.com

此次测试让美国 OpenAI 的“o1”和中国 AI 初创公司 DeepSeek 的“R1”两个基础模型解答 2025 年度的东大入学考试题。AI 初创公司 Life Prompt(东京・新宿)输出了答案,并由大型预备学校河合塾的讲师进行评分。3zF28资讯网——每日最新资讯28at.com

3zF28资讯网——每日最新资讯28at.com

大学入学共通考试和二次考试合计的理科得分(注:满分 550 分)中,o1 获得了 374 分,R1 获得了 369 分,两者均超过了东大在 3 月 10 日公布的理科 3 类合格最低分数线(368.7 分)。3zF28资讯网——每日最新资讯28at.com

R1 在理科 1 类和理科 2 类的共通考试中未达到合格最低分数线,但在其他科类中,与 o1 一起包括文科在内都“合格”了。3zF28资讯网——每日最新资讯28at.com

在二次考试中,得分率较高的是英语,o1 和 R1 的得分率均超过了 75%。河合塾负责英语的久恒秀雄讲师表示:“几乎没有单词和语法的错误,远远超过了东大考生的平均水平。”3zF28资讯网——每日最新资讯28at.com

数学方面,虽然最终答案正确的问题较多,但在图形和论证问题上多次出现论述错误和说明不足的情况。理科数学中,o1 在 120 分满分中得了 38 分,R1 得了 49 分。负责数学的香坂季京讲师指出:“这比合格者的平均分要低很多。”3zF28资讯网——每日最新资讯28at.com

自 2011 年开始的“机器人能否进入东京大学(东 Robo)”项目的负责人、国立信息学研究所的新井纪子教授对此次考试结果评价道:“这是 AI 成长的一个重要里程碑。不过,AI 有时会给出相当糟糕的答案,需要能够正确判断并熟练使用 AI 输出的人才。”3zF28资讯网——每日最新资讯28at.com

本文链接:http://www.28at.com/showinfo-45-12048-0.html中美 AI 挑战东京大学入学考试:双双合格,英语优异,数学欠佳

声明:本网页内容旨在传播知识,若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。邮件:2376512515@qq.com

上一篇: 天冕科技新专利:智能图像识别技术赋能金融业务高效升级

下一篇: IDC:2028 年中国 AI 总投资规模将突破 1000 亿美元,五年复合增长率达 35.2%

标签:
  • 热门焦点
  • 超跑与NFT的首次结合,兰博基尼能否破局?

    兰博基尼公司近日称即将推出它的首款NFT,并且将加速进军区块链领域。这家闻名遐迩的意大利汽车厂商野心勃勃地将目光投向混合动力和电动跑车,并宣布将拍卖与瑞士
  • 比特币的价格越高,使用价值越大

    隔夜比特币还是在精准地横盘在42k上方。空头昨日试图发起一波小的攻势,但是晚上就被多头掰了回来。以太坊的链上gas price降到了60 gwei以下,彰显着市场活跃度的
  • 冰墩墩NFT遇冷,价格跌80%,日成交仅3笔。

    “两日上涨千倍”并不存在,且冰墩墩NFT的市场热度远不及社交媒体所称的那样高。2月11日,获得国际奥委会授权的2022冬奥会吉祥物冰墩墩相关NFT产品在nWayPlay上线
  • 中国区块链产业生态地图报告(2021)

    区块链是技术整合创新、金融创新、组织方式创新、产业应用创新的多维度创新,以服务实体经济、政务民生以及公共服务等领域为落脚点,以期实现整个地区和产业的资
  • NFT也有黄牛?这家公司专门对付外挂作弊机器人

    澳大利亚前总理马尔科姆·特恩布尔 (Malcolm Turnbull) 是支持萨姆·Crowther (Sam Crowther) 的人之一,Sam是一名出生于纽卡斯尔的黑客,他的职业生涯始于为国防
  • 过去女性在互联网领域是半边天,在Web3,将会是整片天!

    Web 2.0 是由几家“直男”大公司塑造的。接下来的Web3世界中,如果女性在创造性方面发挥更大的作用,可能会让这个新时代更受欢迎、更安全和公平。当我们谈论 Web3
  • 在元宇宙开会是什么样一种体验

    空间就是一切还记得面对面的会议吗?就在不久前,与会者需要飞到遥远的目的地,并进行鼓舞人心的对话、网络、免费食物,甚至可能会有一两个很好的小组讨论。随之而来
  • 元宇宙存在的意义和价值

    科技公司目前都在犹豫,看谁能在元宇宙上押下更大的赌注。然而,除了巨额的资金投入,到底要怎样才能获胜在很大程度上还没有得到证实。它是否仅仅是对当前数字景观
  • 76亿美金估值、2022年最具创新力公司,Dapper Labs如何做到?

    “元宇宙的开拓者”是我们针对元宇宙的发展而设立的专栏,主要面向那些深挖元宇宙产业或者在元宇宙进行“淘金”的从业者,分享这些企业或者创业者们的故事,以独特
Top