• 我的订阅
  • 科技

「LLM」这个名字不好,Karpathy认为不准确、马斯克怒批太愚蠢

类别:科技 发布时间:2024-09-18 15:01:00 来源:机器之心Pro

LLM 应该改名吗?你怎么看。

在 AI 领域,几乎每个人都在谈论大型语言模型,其英文全称为 Large Language Models,简写为 LLM。

因为 LLM 中有「Language」一词,因此,大家默认这种技术和语言密切相关。

然而,知名 AI 大牛 Andrej Karpathy 却对此有着独特的见解:

「LLM」这个名字不好,Karpathy认为不准确、马斯克怒批太愚蠢

「大型语言模型(LLM)名字虽然带有语言二字,但它们其实与语言关系不大,这只是历史问题,更确切的名字应该是自回归 Transformer 或者其他。

LLM 更多是一种统计建模的通用技术,它们主要通过自回归 Transformer 来模拟 token 流,而这些 token 可以代表文本、图片、音频、动作选择、甚至是分子等任何东西。因此,只要能将问题转化为模拟一系列离散 token 的流程,理论上都可以应用 LLM 来解决。

实际上,随着大型语言模型技术栈的日益成熟,我们可能会看到越来越多的问题被纳入这种建模范式。也就是说,问题固定在使用 LLM 进行『下一个 token 的预测』,只是每个领域中 token 的用途和含义有所不同。

如果核心问题真的变成了预测下一个 token,那么深度学习框架(例如 PyTorch 及其同类框架, 因为 PyTorch 提供了过于广泛的操作和层的可配置性而显得过于普通)也可能过于普通,无法满足大多数问题随时间推移的需要。如果 80% 的问题只需要使用 LLM 来解决,那么成千上万个可以随意重新配置的操作和层又有什么用呢?我认为这不是真的,但我认为它只对了一半。」

Karpathy 的这番言论引来很多人围观,浏览量高达 20 多万。

「LLM」这个名字不好,Karpathy认为不准确、马斯克怒批太愚蠢

Karpathy 曾是 OpenAI 的早期成员之一,之后加入特斯拉领导其自动驾驶的计算机视觉团队。之后他又回到过 OpenAI,领导着一个专注提升 ChatGPT 的 GPT-4 的小团队。今年 7 月,他宣布创立了一家名为 Eureka Labs 的 AI + 教育公司。

「LLM」这个名字不好,Karpathy认为不准确、马斯克怒批太愚蠢

作为前排吃瓜群众的马斯克非常赞同的表示:这绝对需要一个新名字,「多模态 LLM(Multimodal Large Language Models)」是一个特别愚蠢的名字,因为第一个词与第三个词相矛盾!

「LLM」这个名字不好,Karpathy认为不准确、马斯克怒批太愚蠢

机器学习和 AI 研究员、畅销书《Python 机器学习》作者 Sebastian Raschka 也非常赞同,他表示:如果将 LLM 改为自回归 Transformers 或者其他名字的话,那 Mamba、Jamba、Samba 可以申请加入吗。不管怎样,还是非常赞同 Karpathy 观点。

「LLM」这个名字不好,Karpathy认为不准确、马斯克怒批太愚蠢

不过,来自 OpenAI 的研究者 Clive Chan 却表示:另一方面,也许所有可以用自回归方式表达的东西都可以被视为一种语言。任何事物都可以被转化为一串 token 流,因此从这个角度看,一切都是语言!

对于这种说法,Karpathy 回复到:当然,你可以想象说话纹理、说话分子等等。但我所观察到的是,语言这个词误导了人们认为大型语言模型(LLM)只限于文本应用。

「LLM」这个名字不好,Karpathy认为不准确、马斯克怒批太愚蠢

在 Meta 从事 PyTorch 研究的 Horace He 表示:确实,深度学习框架可能在某些方面过于普遍。尽管如此,即便只是针对大型语言模型(LLM),实际运行的操作也有很大的变化。这包括新的注意力操作、混合专家模型(MoE)、不同变体的激活检查点、不同的位置嵌入等。

在 Horace He 看来,这些技术的多样性说明,即使是在专注于 LLM 的应用中,深度学习框架的通用性也是有其必要性的,以适应不断发展和变化的模型需求。

「LLM」这个名字不好,Karpathy认为不准确、马斯克怒批太愚蠢

「像 LLMs、GPT 和 RLHF 这样的术语现在变成主流,这实在有些奇怪。通常,一个领域向更广泛的世界介绍自己时并不会这样做(在我看来,这也是有些机构品牌推广失败的原因)。」有人发表了这样的观点。

这种情况反映了复杂技术术语的普及可能并不总能有效地代表其真实的应用和影响,有时甚至可能导致公众理解上的困难。

「LLM」这个名字不好,Karpathy认为不准确、马斯克怒批太愚蠢

还有网友认为,「Large」这个词用的也不好,因为今天的「大」在未来会显得「小」。

「LLM」这个名字不好,Karpathy认为不准确、马斯克怒批太愚蠢

「 同样的情况也适用于电话和计算机领域,看起来最初的术语往往会保持使用。」

「LLM」这个名字不好,Karpathy认为不准确、马斯克怒批太愚蠢

这不由得让我们想起 AI 领域各种命名方式,早期的名称往往因为先入为主的效应而被广泛沿用,即使随着技术的演进,这些名称可能已不再准确描述其功能了。

大型语言模型到底应不应该改名,你怎么看,欢迎评论区留言。

参考链接:https://x.com/karpathy/status/1835024197506187617

以上内容为资讯信息快照,由td.fyun.cc爬虫进行采集并收录,本站未对信息做任何修改,信息内容不代表本站立场。

快照生成时间:2024-09-18 18:45:02

本站信息快照查询为非营利公共服务,如有侵权请联系我们进行删除。

信息原文地址:

马斯克:一旦找到一个足够“愚蠢”的人来继任 我就辞任推特CEO
...路透社12月21日报道,在推特“兴风作浪”一个月以后,马斯克20日发推宣布,他将在找到一名“足够愚蠢”继任者后辞去推特首席执行官(CEO)一职。马斯克在推特上这样说:“一旦我
2022-12-21 13:13:00
马斯克“任命”一只狗担任推特首席执行官
...通讯社莫斯科2月15日电美国企业家、推特的新主人埃隆∙马斯克“任命”了该公司的新首席执行官,并在自己的推特页面给“任命”附上了狗的照片。马斯克在推特上狗的照片下评论道:“新的
2023-02-16 13:43:00
马斯克公开回击迪士尼CEO,“滚蛋吧”,承认赞同反犹帖子愚蠢
当地时间11月29日,埃隆·马斯克出现在《纽约时报》的DealBook峰会上。现年52岁的亿万富翁保持了随性的风格,毛领皮夹克内搭纯黑T恤,并配了一双短靴,显然他并没有因为出席的
2023-12-01 09:26:00
马斯克关注的账号“Teslaconomics”周日发帖,分享了一段特斯拉Semi卡车在高速路上连续超越多辆卡车的视频,并配文称:“别挡道,特斯拉Semi卡车开过来了!比尔·盖茨,
2023-08-06 15:47:00
马斯克:汽车后视镜是愚蠢的设计!干掉后视镜可以增加5%的续航
...的特斯拉MODEL 3已经干掉了实体后视镜,特斯拉的创始人马斯克,更是多次炮轰,传统后视镜是鸡肋,是愚蠢的设计。“后视镜在汽车行驶过程中,会产生风阻,从而让电动车最多减少5%
2024-05-27 09:10:00
马斯克来了,摩根大通、辉瑞CEO也要来!重磅人物云集中国,什么信号?
5月30日,马斯克时隔三年再次访问中国。然而有消息称,摩根大通、星巴克、辉瑞CEO近日也都要来中国了!啥情况?马斯克会见宁德时代曾毓群 ?据央视新闻,5月30日,特斯拉首席执行官
2023-05-31 10:22:00
马斯克服软了,不宣传以色列暴行而是改口:以色列只能摧毁哈马斯
来源:Six说 马斯克恐怕是这个世界上最敢说的资本家。巴以冲突刚刚爆发的时候,他就持非常激烈的批判以色列的态度,甚至利用他的社交媒体宣传以色列的种种暴行。可现在马斯克终于知道,凭
2023-12-01 10:38:00
...纵火。针对极端活动人士的做法,特斯拉公司首席执行官马斯克予以强烈抨击,称其“极其愚蠢”。马斯克在社交媒体X上说:“这些人要么是地球上最愚蠢的生态恐怖分子,要么是那些没有良好环
2024-03-06 13:50:00
...国Grünheide工厂的高缺勤率引起了特斯拉首席执行官埃隆·马斯克(Elon Musk)的注意。《商报》报道称,特斯拉Grünheide工厂的员工请病假率在8月份攀升至17%
2024-09-30 21:00:00
更多关于科技的资讯:
“内容重构论”引短剧行业共鸣
当“反转”“爽点”不再能轻易留住观众,微短剧行业正迎来一场深层重构。到2024年中,中国微短剧用户规模已接近7亿,市场体量超过500亿元
2025-10-29 14:01:00
鲸鸿动能亮相中国国际广告节&亚洲广告大会,全场景AI驱动增长
10月24日,第32届中国国际广告节&第34届亚洲广告大会在北京举办,鲸鸿动能受邀出席,并发表主题演讲《从孤岛到共生
2025-10-29 11:21:00
如何选择适合你的视频画质修复工具
在数字时代,视频已成为我们记录生活、创作内容和保存记忆的重要载体。然而由于拍摄设备限制、保存条件或传输压缩,我们常常面临视频模糊
2025-10-29 11:22:00
精工匠心极致服务!2025年小蓝翼杯全品类服务技术比武大赛圆满落幕
10月23日,2025年“小蓝翼”杯全品类服务技术比武大赛在TCL空调武汉智能工厂举行。其中,空调品类经过30个战区初赛
2025-10-29 11:30:00
‌2025年10月27日‌——上海联舌工坊科技有限公司今日正式于杨浦区完成注册,此举被视为其深化资本市场布局的关键一步
2025-10-29 12:37:00
三星电视荣登天猫艺术电视榜单 双十一钜惠助力消费者轻松解锁艺术家居生活
在消费焕新浪潮席卷家居领域、美学需求成为当代家庭核心诉求的当下,三星凭借对前沿科技与生活美学的深度解构与融合,始终站在全球艺术电视品类发展的潮头
2025-10-29 12:40:00
河北新闻网讯(吴建春)近日,由河北天翼科贸发展有限公司(简称“河北天翼”)为一家农业融资担保公司量身打造的在线收付款业财一体化项目
2025-10-29 13:31:00
宝宝巴士回应APP出现不良广告:严处审核负责人 研发广告强制拦截功能
华商网讯 10月29日,针对“宝宝巴士App出现不良广告”一事,宝宝巴士官方微信公众号发布致歉及整改声明。根据声明,对于近期用户关注的宝宝巴士App产品跳转不良广告一事
2025-10-29 13:40:00
米兰冬奥倒计时100天 国际奥委会携手阿里巴巴首次推出五环系列首饰
2026年米兰·科尔蒂纳冬奥会开幕倒计时100天之际,奥林匹克天猫官方旗舰店独家首发米兰冬奥会系列商品。同时,国际奥委会首次推出奥林匹克五环系列首饰
2025-10-29 13:47:00
王玉宝:于商业迷途中寻一盏不灭的心灯
鲁网10月29日讯踏入儒商研究会的大门,已是一载有余。今日静坐回望,恍然惊觉,这段旅程并非寻常的“加入一个组织”,倒更像是一场在商业迷途中的精神返乡
2025-10-29 13:51:00
2025上海国际压缩机展开幕 ,美的楼宇科技赋能工业制造绿色升级
10月28日-31日,2025上海国际压缩机及设备展览会(以下简称“上海国际压缩机展”)在上海新国际博览中心举办。作为核心参展商
2025-10-29 12:41:00
深圳首宗!医疗健康数据产品场内交易,十年临床数据为手术机器人研发注入“燃料”
经过严格匿名化处理和多轮合规审查,在严格遵守隐私保护的红线下,医疗数据也可以“活”起来,成为驱动AI技术发展的“燃料”
2025-10-29 12:38:00
为进一步推动国产雪茄高质量发展,持续提升阜阳市场“懂雪茄、会养护、善营销”的零售客户雪茄经营能力,提升服务质量,重振经营信心
2025-10-29 12:39:00
富士胶片X-SPACE迎来七周年朋友月 胶片模拟色彩配方书籍特别发布
2025年10月,富士胶片(中国)投资有限公司旗下X-SPACE富士胶片影像空间(以下简称"X-SPACE")迎来成立七周年
2025-10-29 10:59:00
河北纳科生物科技有限公司专利获雄安高价值专利大赛银奖
河北新闻网讯(钟蕾)近日,推进京津冀知识产权高质量发展暨2025・雄安高价值专利大赛颁奖活动在雄安新区举行。石家庄高新区优秀创新企业河北纳科生物科技有限公司凭借其核心专利“重组人胶原蛋白的制备和产业化应用”
2025-10-29 11:11:00