• 我的订阅
  • 科技

苹果大模型,不藏了

类别:科技 发布时间:2024-01-06 09:10:00 来源:钛媒体APP

岁末年初,苹果加快了在大模型领域的步伐。

上个月,苹果先是推出了名为Ferret的多模态大语言模型,图像处理技术堪称惊艳;而后又发布了一篇题为《闪存中的大型语言模型:在有限内存下高效的大型语言模型推理》的论文,直指大模型落地iPhone等“内存有限”设备的方法。

进入新年,Siri助手将搭载生成式模型Ajax的消息,再次不胫而走。

去年六月和九月的两次重要发布会,苹果分别掏出了早有传闻的XR项目和iPhone系列的惯例年更,前者市场反响平平,后者挤牙膏被批像是被“卡脖子”了,硅谷All in大模型之时,苹果官方对人工智能这一年度热词始终闭口不谈。

公司CEO库克曾解释道,苹果有计划在更多产品中加入AI,但要“深思熟虑”。

现如今,也许是想好了,也许是技术突破了,留了一手的苹果,终于不藏了。

iPhone的AI时刻,来了?

Siri助手AI化其实早有预兆:去年七月份,彭博社发文称苹果内部正在暗中测试一款对标OpenAI和谷歌的生成式AI工具,暂定名“Apple GPT”。

因使用Google JAX框架进行构建,Apple GPT的开发框架被命名为Ajax。

当时的消息称,苹果LLM技术的最大用武之地,便是整合在Siri内部,让语音助手以更为智能的方式协助用户。

现在,更多细节被透露——苹果发布的论文称,这项将大语言模型放在闪存中优化运行的技术,较传统运行方法提高了4-5倍(CPU)和20-25倍(GPU)的推理速度。

把大象(大模型)装进冰箱(手机)里的方法,来了:先减少闪存传输的数据量,再提高每次传输的吞吐量。

先看框架:以手机为例,平时购机时的【12+256G】、【16+512G】,12/16为运行内存,256/512为储存空间。

苹果大模型,不藏了

以此类推绝大部分移动设备存储结构,运存空间小,但读取速率高(DRAM 10GB/s);储存空间大,但读取速率相对较低(Flash Memory 1GB/s)。

一般来说,大模型的推理阶段,模型加载、分析数据需要直接占用运存,而目前主流手机市场最大的16GB运存,也并不能完全满足大模型所需的空间:模型大小>手机内存。

苹果给出的解决方案是“先减少闪存传输的数据量”——把大模型完全体放在空间更大的储存中,运行时只调用必要数据进入运存。

这并非一个简单的搬箱子过程,如何正确筛选出所有必要数据,以及如何把数据快速由闪存传输到运存,是两个需要解决的问题。

方法之一被命名为sliding window(滑窗):

苹果大模型,不藏了

假设大模型正在处理Once upon a time there was a kid who had a dream这句话,在处理“Once upon a time there”这段字符的时候,图中上半部分的青色格子(神经元)处于激活状态;而当处理字段变到“upon a time there was”(往后推进了一个字符),图中下半部新启用了蓝色格子,并删除了了此前青色部分的几个格子(以粉色标注),其余青色保持不变。

这就是sliding Window的核心思想:查缺补漏,多退少补。在大模型运行过程中,只保留一开始就激活的神经元,后续的每次运算,都基于前一次参数进行删除和添加,省去了一部分重复工作。

当然,这种预设也并非没有问题,知乎博主@Civ发文称,sliding window可用的核心假设是大模型在处理相邻数据时前后具有相似性,但这个相似性苹果没有展开论证。

再者是传输:将多次传输的数据拼接后一次性读取,保持连续完整的“数据”,避免多次复制拖慢时间;另外,提前预留出一个较大的空间(较大,但仍远远小于模型整体占用),避免在数据传输过程中,因多次增加空间而加大设备的计算量。

苹果大模型,不藏了
苹果大模型,不藏了

此前,蓝媒汇在《AI PC发布,联想真的想通AI了吗?》中提及,限制大模型进入移动端的瓶颈就是模型占地太大,影响设备本身正常运转,或者塞不进去导致无法运行。

苹果这项新研究的诸多技术细节,都在指向空间的压缩,包括数据体量,也包括运算所占用的算力。

发力多模态

之前有个段子(也可能是真事儿),说是大模型搞不定人机验证,是因为AI被设定不能说谎,所以无法选择“我不是机器人”。

去年十月份,苹果还是以论文的形式公布了一项研究成果:Ferret大模型,自己搞定谷歌人机验证了。

苹果大模型,不藏了

遥遥领先于GPT4。

不久之前,苹果公布了更多Ferret模型的细节、功能。

苹果大模型,不藏了

图/苹果Github Ferret模型介绍

和GPT4相比,Ferret的领先之处在于,它不仅能准确识别并处理图像内容,还能用算法区分图片中各种元素(人、物体等等),并根据用户指令找出对应元素。

苹果大模型,不藏了

这种多模态理解能力,使得Ferret能够同时处理用户输入的图像和自然语言,并且由于其算法能够将图像中的元素准确拆分、定位,Ferret可以准确理解如“图片右上角”、“靠近沙发”这类指令。

苹果大模型,不藏了

相比于卷疯了的自然语言处理,这种基于图像的交互使得信息更加直观。

苹果大模型,不藏了
苹果大模型,不藏了

最近一次更新,苹果提供了Ferret的7B和13B两个版本,并创建了包含了1.1M个样本的GRIT的数据集以丰富空间知识,进一步增强功能。

考虑到苹果相当成熟的产品生态以及巨量用户规模,AI落地带来的换机潮等收益,或将极为可观。

2023年被称为是AI的iPhone时刻,现在,苹果的AI时刻大约也快到了。

以上内容为资讯信息快照,由td.fyun.cc爬虫进行采集并收录,本站未对信息做任何修改,信息内容不代表本站立场。

快照生成时间:2024-01-06 12:45:22

本站信息快照查询为非营利公共服务,如有侵权请联系我们进行删除。

信息原文地址:

苹果300亿参数大模型首亮相,还买了家AI公司|焦点分析
...武静静编辑|邓咏仪放弃造车后的苹果,正在加速入局大模型战争。当地时间3月15日,苹果就披露了两个关键大模型动作。其中一个值得关注的是苹果的收购事件。彭博社报道称,苹果已经收购
2024-03-16 18:14:00
苹果发布mm1.5-ui模型
...13日消息,近日,苹果公司推出了300亿参数的多模态AI大模型MM1.5,该版本是在前代MM1的架构基础上发展而来的。该模型继续遵循数据驱动的训练原则,着重探究在不同训练周期
2024-10-13 10:57:00
苹果取得技术突破:可在 iPhone 上运行大型语言模型
...功地在内存有限的iPhone和其他苹果设备上部署了大型语言模型(LLM)。这一成果有望让更强大的Siri、实时语言翻译以及融入摄影和增强现实的尖端AI功能登陆未来iPhone
2023-12-21 22:47:00
苹果被大模型打得措手不及
...士多德提问,并且可以得到回答”。乔布斯几乎预见了大模型技术的崛起,并坚信人工智能将为苹果公司带来远大前景。Siri是由乔布斯主导,苹果公司对人工智能最早的探索,但在库克时代,
2024-03-26 10:25:00
苹果AI将引入云端黑盒机制 只为隐私数据安全
...,但苹果的AI功能却存在隐患,毕竟苹果并未自己训练大模型,而是选择引入第三方大模型,这会导致AI在云端数据处理上,存在安全问题。不过苹果方面已经进行相应处理,能够让用户放心使
2024-06-03 20:19:00
系统级玩家微软、苹果先后出牌,端侧大模型路径清晰了?
落地端侧被认为是大模型走向普及的关键。个人PC和智能手机是当前受众最为广泛的两大终端品类。2023年下半年以来,全球范围内各大PC、手机厂商纷纷通过硬件扩容,尝试将大模型在物理意
2024-06-21 09:16:00
苹果的封闭生态为大模型打开!发布开源多模态大模型、每天为 AI 烧百万美元,零碎的 Android 生态打得过吗?
...构成威胁,Arm 和台积电将获胜。”有网友说到苹果在大模型发展上的状况。也有网友认为,苹果在大模型上的发力将为其在未来的手机市场竞争中带来优势。他们认为,开源模型加上移动设备
2023-12-26 14:06:00
苹果或通过新的闪存利用技术,让iPhone等设备运行LLM
...能支持的应用受到了不少用户的欢迎,背后需要大型语言模型(LLM)提供支持。虽然苹果在人工智能方面暂时还没有带来重量级的功能,不过近期公布的论文显示,苹果在人工智能研究上已经下
2023-12-22 17:26:00
苹果正悄悄开发大模型,会是乔布斯心中的ChatGPT吗?
...跟“乔布斯”对话。只要输入相应的数据以及训练,AI大模型就能复刻出“亚里士多德”。只是这样的科技创新,并不来自苹果,而是OpenAI。苹果,当然也不甘心。就在日前,市场消息称
2023-07-21 15:11:00
更多关于科技的资讯:
甘度环境:秋冬季污水处理站的低温挑战与技术破局
在北方环保行业,每到秋冬季节,污水处理站的运维人员总会面临一场特殊的“大考”。随着气温从15℃骤降至0℃以下,污水处理系统的各项指标仿佛被按下了“紊乱键”
2025-09-10 12:03:00
据华商报报道,近日,有不少用户反映,近十余个话费充值平台,多不能充小额或自定义话费。基本为50元起充,甚至有平台最低充100元
2025-09-10 12:08:00
西秀区:互联网营销师培训赋能,助力金刺梨开拓线上市场
多彩贵州网讯 2025年7月29日,由西秀区人力资源和社会保障局主办的首期互联网营销师培训班顺利结业。00后高校毕业生肖洁作为学员之一
2025-09-10 12:29:00
特步入驻京东秒送 超2500家门店爆款最快9分钟送达
9月9日,特步正式入驻京东秒送,全国超2500家特步线下门店将上线全品类商品,为消费者提供“线上下单、附近门店发货、商品最快9分钟送达”的即时购物体验
2025-09-10 13:03:00
引领AI打印新浪潮 京东携手爱普生首发AI学习打印机
9月9日,京东×爱普生“AI学习助手”暨全球首发*1AI学习打印机*2发布会在京东全球总部举办。秉持“科技+本地化”战略
2025-09-10 13:03:00
中新经纬9月10日电 据日本共同社报道,7-Eleven便利店尝试引入机器人等设备节省人力。报道称,7-Eleven日本公司9日在东京都荒川区的一家便利店引入旨在节省人力的机器人进行测试
2025-09-10 13:07:00
纳入真实到店指标 高德扫街榜成为刷不了的榜
9月10日,国民应用高德正式推出了全球首个基于真实导航、出行行为,融合AI技术打造而成的生活服务榜单——高德扫街榜,构建全新的线下服务信用体系
2025-09-10 13:24:00
当同窗的实习offer成为宿舍夜谈的资本,当招聘软件上“大三优先”的实习岗位被一抢而空,当社交媒体上“00后手握5份大厂实习”的帖子在朋友圈刷屏
2025-09-10 12:09:00
本报讯 日前,我国电器电子产品有害物质管控领域(中国RoHS)首个强制性国家标准《电器电子产品有害物质限制使用要求》经国家标准化管理委员会批准发布
2025-09-10 10:54:00
人工智能赛事火热,百余选手角逐“最强大脑”“算法高手”指尖翻飞 键盘之上跃动智慧南报网讯(记者余梦迪)“嗒嗒!嗒嗒!”9月7日的南京开放大学(南京工匠学院)赛场内
2025-09-10 07:43:00
□通讯员陶炎鲁荟宇林爽姜静南京日报/紫金山新闻记者徐宁“以前我每个月都要从承包商系统中手动导出考核明细表,再结合管理规定进行数据分析并编写通报材料
2025-09-10 07:44:00
5G小微基站 米粒芯片“守门”这种滤波器芯片出自宁企,用于商场、地下车库等场景,使国产高端滤波器实现弯道超车□南京日报/紫金山新闻记者孙秉印 实习生赵璇 通讯员麒轩9月9日
2025-09-10 07:44:00
“贵州白酒云展会”数字化平台于“一码贵州”正式上线
多彩贵州网讯 9月9日,在第十四届中国(贵州)国际酒类博览会盛大开幕之际,“贵州白酒云展会”数字化平台于“一码贵州”正式上线
2025-09-10 00:50:00
投洽会期间厦门火炬高新区共有41个项目完成签约 计划总投资约433亿元
投洽会上,火炬高新区企业展示的芯片产品吸引客商关注。(本组图/厦门日报全媒体记者 卢剑豪 摄)多家位于火炬高新区的专精特新“小巨人”企业亮相投洽会
2025-09-09 08:44:00
刚刚过去的暑假,“工厂游”火爆出圈。多地工厂纷纷敞开大门,推出丰富多彩的研学项目。而在社交平台上,“工厂游”的攻略被大量转发
2025-09-09 08:46:00