当前位置:首页 > 科技  > 手机

揭秘苹果iPhone里的Transformer:基于GPT-2架构打造

来源: 责编: 时间:2023-09-18 21:20:45 451观看
导读 苹果Transformer的“秘密”,让发烧友给扒出来了。大模型浪潮下,即使保守如苹果,也每逢发布会必提“Transformer”。比如,在今年的WWDC上,苹果就已宣布,船新版本的iOS和macOS将内置Transforme

苹果Transformer的“秘密”,让发烧友给扒出来了。j2f28资讯网——每日最新资讯28at.com

大模型浪潮下,即使保守如苹果,也每逢发布会必提“Transformer”。j2f28资讯网——每日最新资讯28at.com

比如,在今年的WWDC上,苹果就已宣布,船新版本的iOS和macOS将内置Transformer语言模型,以提供带文本预测功能的输入法。j2f28资讯网——每日最新资讯28at.com

揭秘苹果iPhone里的Transformer:基于GPT-2架构打造j2f28资讯网——每日最新资讯28at.com

苹果官方没有透露更多信息,但技术爱好者们可坐不住了。j2f28资讯网——每日最新资讯28at.com

一位名叫Jack Cook的小哥,就把macOS Sonoma beta翻了个底朝天,结果,还真挖出不少新鲜信息:j2f28资讯网——每日最新资讯28at.com

-模型架构上,Cook小哥认为苹果的语言模型更像是基于GPT-2打造的。j2f28资讯网——每日最新资讯28at.com

-在分词器(tokenizer)方面,表情符号在其中十分突出。j2f28资讯网——每日最新资讯28at.com

更多细节,一起来看。j2f28资讯网——每日最新资讯28at.com

基于GPT-2架构j2f28资讯网——每日最新资讯28at.com

先来回顾一下苹果基于Transformer的语言模型能在iPhone、MacBook等设备上实现怎样的功能。j2f28资讯网——每日最新资讯28at.com

主要体现在输入法方面。语言模型加持下的苹果自带输入法,可以实现单词预测和纠错的功能。j2f28资讯网——每日最新资讯28at.com

揭秘苹果iPhone里的Transformer:基于GPT-2架构打造j2f28资讯网——每日最新资讯28at.com

Jack Cook小哥具体测试了一下,发现这个功能主要实现的是针对单个单词的预测。j2f28资讯网——每日最新资讯28at.com

揭秘苹果iPhone里的Transformer:基于GPT-2架构打造j2f28资讯网——每日最新资讯28at.com

△图源:Jack Cook博客文章j2f28资讯网——每日最新资讯28at.com

模型有时也会预测即将出现的多个单词,但这仅限于句子语义十分明显的情况,比较类似于Gmail里的自动完成功能。j2f28资讯网——每日最新资讯28at.com

揭秘苹果iPhone里的Transformer:基于GPT-2架构打造△图源:Jack Cook博客文章j2f28资讯网——每日最新资讯28at.com

那么这个模型具体被装在了哪里?一通深入挖掘之后,Cook小哥确定:j2f28资讯网——每日最新资讯28at.com

我在 /System/Library/LinguisticData/RequiredAssets_en.bundle/AssetData/en.lm/unilm.bundle 中找到了预测文本模型。j2f28资讯网——每日最新资讯28at.com

原因是:j2f28资讯网——每日最新资讯28at.com

1、unilm.bundle中的许多文件在macOS Ventura(13.5)里并不存在,仅出现在了新版本macOS Sonoma beta(14.0)里。j2f28资讯网——每日最新资讯28at.com

2、unilm.bundle中存在一个sp.dat文件,这在Ventura和Sonoma beta里都能找到,但Sonoma beta的版本中更新了明显像是分词器的一组token。j2f28资讯网——每日最新资讯28at.com

3、sp.dat中token的数量跟unilm.bundle中的两个文件——unilm_joint_cpu.espresso.shape和unilm_joint_ane.espresso.shape能匹配得上。这两个文件描述了Espresso/CoreML模型中各层的形状。j2f28资讯网——每日最新资讯28at.com

进而,小哥根据unilm_joint_cpu中描述的网络结构,推测苹果模型是基于GPT-2架构打造的:j2f28资讯网——每日最新资讯28at.com

主要包含token embeddings、位置编码、解码器块和输出层,每个解码器块中都有类似gpt2_transformer_layer_3d这样的字眼。j2f28资讯网——每日最新资讯28at.com

揭秘苹果iPhone里的Transformer:基于GPT-2架构打造△图源:Jack Cook博客文章j2f28资讯网——每日最新资讯28at.com

根据每层大小,小哥还推测,苹果模型约有3400万参数,隐藏层大小是512。也就是说,它比GPT-2小的版本还要小。j2f28资讯网——每日最新资讯28at.com

小哥认为,这主要是因为苹果想要一种不太耗电,但同时能够快速、频繁运行的模型。j2f28资讯网——每日最新资讯28at.com

而苹果官方在WWDC上的说法是,“每点击一个键,iPhone就会运行模型一次”。j2f28资讯网——每日最新资讯28at.com

不过,这也就意味着,这个文本预测模型并不能很好地完整续写句子或段落。j2f28资讯网——每日最新资讯28at.com

揭秘苹果iPhone里的Transformer:基于GPT-2架构打造△图源:Jack Cook博客文章j2f28资讯网——每日最新资讯28at.com

模型架构之外,Cook小哥还挖出了分词器(tokenizer)的相关信息。j2f28资讯网——每日最新资讯28at.com

他在unilm.bundle/sp.dat里发现了一组数量为15000的token,值得关注的是,其中包含100个emoji。j2f28资讯网——每日最新资讯28at.com

Cook揭秘库克j2f28资讯网——每日最新资讯28at.com

尽管此Cook非彼库克,小哥的博客文章一发出,还是吸引了不少关注。j2f28资讯网——每日最新资讯28at.com

揭秘苹果iPhone里的Transformer:基于GPT-2架构打造j2f28资讯网——每日最新资讯28at.com

基于他的发现,网友们热烈地讨论起苹果在用户体验和前沿技术应用之间的平衡大法。j2f28资讯网——每日最新资讯28at.com

揭秘苹果iPhone里的Transformer:基于GPT-2架构打造j2f28资讯网——每日最新资讯28at.com

回到Jack Cook本人,他本科和硕士毕业于MIT的计算机专业,目前还在攻读牛津大学的互联网社会科学硕士学位。j2f28资讯网——每日最新资讯28at.com

此前,他曾在英伟达实习,专注于BERT等语言模型的研究。他还是《纽约时报》的自然语言处理高级研发工程师。j2f28资讯网——每日最新资讯28at.com

那么,他的这一番揭秘是否也引发了你的一些思考?欢迎在评论区分享观点~j2f28资讯网——每日最新资讯28at.com

原文链接:https://jackcook.com/2023/09/08/predictive-text.htmlj2f28资讯网——每日最新资讯28at.com


文章出处:量子位

本文链接:http://www.28at.com/showinfo-22-10279-0.html揭秘苹果iPhone里的Transformer:基于GPT-2架构打造

声明:本网页内容旨在传播知识,若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。邮件:2376512515@qq.com

上一篇: 李斌:蔚来手机是首款为车设计的手机 不需要靠广告挣钱

下一篇: 渠道商:iPhone 15 Pro Max到货比例为近几年低

标签:
  • 热门焦点
  • 5月安卓手机好评榜:魅族20 Pro夺冠

    性能榜和性价比榜之后,我们来看最后的安卓手机好评榜,数据来源安兔兔评测,收集时间2023年5月1日至5月31日,仅限国内市场。第一名:魅族20 Pro好评率:97.50%不得不感慨魅族老品牌还
  • 从 Pulsar Client 的原理到它的监控面板

    背景前段时间业务团队偶尔会碰到一些 Pulsar 使用的问题,比如消息阻塞不消费了、生产者消息发送缓慢等各种问题。虽然我们有个监控页面可以根据 topic 维度查看他的发送状态,
  • 学习JavaScript的10个理由...

    作者 | Simplilearn编译 | 王瑞平当你决心学习一门语言的时候,很难选择到底应该学习哪一门,常用的语言有Python、Java、JavaScript、C/CPP、PHP、Swift、C#、Ruby、Objective-
  • 零售大模型“干中学”,攀爬数字化珠峰

    文/侯煜编辑/cc来源/华尔街科技眼对于绝大多数登山爱好者而言,攀爬珠穆朗玛峰可谓终极目标。攀登珠峰的商业路线有两条,一是尼泊尔境内的南坡路线,一是中国境内的北坡路线。相
  • 大厂卷向扁平化

    来源:新熵作者丨南枝 编辑丨月见大厂职级不香了。俗话说,兵无常势,水无常形,互联网企业调整职级体系并不稀奇。7月13日,淘宝天猫集团启动了近年来最大的人力制度改革,目前已形成一
  • 华为Mate 60保护壳曝光:硕大后置相机模组 凸起程度有惊喜

    这段时间以来,关于华为新旗舰的爆料日渐密集。据此前多方爆料,今年华为将开始恢复一年双旗舰战略,除上半年推出的P60系列外,往年下半年的Mate系列也将
  • 华为开发者大会2023日程公开:开设鸿蒙HarmonyOS 4体验区

    IT之家 7 月 31 日消息,华为今日公布了 HDC.Together 开发者大会 2023 的详细日程。整场大会将于 8 月 4 日-6 日之间举行,届时将发布最新一代鸿蒙 H
  • 自研Exynos回归!三星Galaxy S24系列将提供Exynos和骁龙双版本

    年初,全新的三星Galaxy S23系列发布,包含Galaxy S23、Galaxy S23+和Galaxy S23 Ultra三个版本,全系搭载超频版骁龙8 Gen 2,虽同样采用台积电4nm工艺制
  • 与兆芯合作 联想推出全新旗舰版笔记本电脑开天N7系列

    联想与兆芯合作推出全新联想旗舰版笔记本电脑开天 N7系列。这个系列采用兆芯KX-6640MA处理器平台,KX-6640MA 处理器是采用了陆家嘴架构,16nm 工艺,4 核 4 线
Top