• 我的订阅
  • 科技

「LLM」这个名字不好,Karpathy认为不准确、马斯克怒批太愚蠢

类别:科技 发布时间:2024-09-18 15:01:00 来源:机器之心Pro

LLM 应该改名吗?你怎么看。

在 AI 领域,几乎每个人都在谈论大型语言模型,其英文全称为 Large Language Models,简写为 LLM。

因为 LLM 中有「Language」一词,因此,大家默认这种技术和语言密切相关。

然而,知名 AI 大牛 Andrej Karpathy 却对此有着独特的见解:

「LLM」这个名字不好,Karpathy认为不准确、马斯克怒批太愚蠢

「大型语言模型(LLM)名字虽然带有语言二字,但它们其实与语言关系不大,这只是历史问题,更确切的名字应该是自回归 Transformer 或者其他。

LLM 更多是一种统计建模的通用技术,它们主要通过自回归 Transformer 来模拟 token 流,而这些 token 可以代表文本、图片、音频、动作选择、甚至是分子等任何东西。因此,只要能将问题转化为模拟一系列离散 token 的流程,理论上都可以应用 LLM 来解决。

实际上,随着大型语言模型技术栈的日益成熟,我们可能会看到越来越多的问题被纳入这种建模范式。也就是说,问题固定在使用 LLM 进行『下一个 token 的预测』,只是每个领域中 token 的用途和含义有所不同。

如果核心问题真的变成了预测下一个 token,那么深度学习框架(例如 PyTorch 及其同类框架, 因为 PyTorch 提供了过于广泛的操作和层的可配置性而显得过于普通)也可能过于普通,无法满足大多数问题随时间推移的需要。如果 80% 的问题只需要使用 LLM 来解决,那么成千上万个可以随意重新配置的操作和层又有什么用呢?我认为这不是真的,但我认为它只对了一半。」

Karpathy 的这番言论引来很多人围观,浏览量高达 20 多万。

「LLM」这个名字不好,Karpathy认为不准确、马斯克怒批太愚蠢

Karpathy 曾是 OpenAI 的早期成员之一,之后加入特斯拉领导其自动驾驶的计算机视觉团队。之后他又回到过 OpenAI,领导着一个专注提升 ChatGPT 的 GPT-4 的小团队。今年 7 月,他宣布创立了一家名为 Eureka Labs 的 AI + 教育公司。

「LLM」这个名字不好,Karpathy认为不准确、马斯克怒批太愚蠢

作为前排吃瓜群众的马斯克非常赞同的表示:这绝对需要一个新名字,「多模态 LLM(Multimodal Large Language Models)」是一个特别愚蠢的名字,因为第一个词与第三个词相矛盾!

「LLM」这个名字不好,Karpathy认为不准确、马斯克怒批太愚蠢

机器学习和 AI 研究员、畅销书《Python 机器学习》作者 Sebastian Raschka 也非常赞同,他表示:如果将 LLM 改为自回归 Transformers 或者其他名字的话,那 Mamba、Jamba、Samba 可以申请加入吗。不管怎样,还是非常赞同 Karpathy 观点。

「LLM」这个名字不好,Karpathy认为不准确、马斯克怒批太愚蠢

不过,来自 OpenAI 的研究者 Clive Chan 却表示:另一方面,也许所有可以用自回归方式表达的东西都可以被视为一种语言。任何事物都可以被转化为一串 token 流,因此从这个角度看,一切都是语言!

对于这种说法,Karpathy 回复到:当然,你可以想象说话纹理、说话分子等等。但我所观察到的是,语言这个词误导了人们认为大型语言模型(LLM)只限于文本应用。

「LLM」这个名字不好,Karpathy认为不准确、马斯克怒批太愚蠢

在 Meta 从事 PyTorch 研究的 Horace He 表示:确实,深度学习框架可能在某些方面过于普遍。尽管如此,即便只是针对大型语言模型(LLM),实际运行的操作也有很大的变化。这包括新的注意力操作、混合专家模型(MoE)、不同变体的激活检查点、不同的位置嵌入等。

在 Horace He 看来,这些技术的多样性说明,即使是在专注于 LLM 的应用中,深度学习框架的通用性也是有其必要性的,以适应不断发展和变化的模型需求。

「LLM」这个名字不好,Karpathy认为不准确、马斯克怒批太愚蠢

「像 LLMs、GPT 和 RLHF 这样的术语现在变成主流,这实在有些奇怪。通常,一个领域向更广泛的世界介绍自己时并不会这样做(在我看来,这也是有些机构品牌推广失败的原因)。」有人发表了这样的观点。

这种情况反映了复杂技术术语的普及可能并不总能有效地代表其真实的应用和影响,有时甚至可能导致公众理解上的困难。

「LLM」这个名字不好,Karpathy认为不准确、马斯克怒批太愚蠢

还有网友认为,「Large」这个词用的也不好,因为今天的「大」在未来会显得「小」。

「LLM」这个名字不好,Karpathy认为不准确、马斯克怒批太愚蠢

「 同样的情况也适用于电话和计算机领域,看起来最初的术语往往会保持使用。」

「LLM」这个名字不好,Karpathy认为不准确、马斯克怒批太愚蠢

这不由得让我们想起 AI 领域各种命名方式,早期的名称往往因为先入为主的效应而被广泛沿用,即使随着技术的演进,这些名称可能已不再准确描述其功能了。

大型语言模型到底应不应该改名,你怎么看,欢迎评论区留言。

参考链接:https://x.com/karpathy/status/1835024197506187617

以上内容为资讯信息快照,由td.fyun.cc爬虫进行采集并收录,本站未对信息做任何修改,信息内容不代表本站立场。

快照生成时间:2024-09-18 18:45:02

本站信息快照查询为非营利公共服务,如有侵权请联系我们进行删除。

信息原文地址:

马斯克:一旦找到一个足够“愚蠢”的人来继任 我就辞任推特CEO
...路透社12月21日报道,在推特“兴风作浪”一个月以后,马斯克20日发推宣布,他将在找到一名“足够愚蠢”继任者后辞去推特首席执行官(CEO)一职。马斯克在推特上这样说:“一旦我
2022-12-21 13:13:00
马斯克“任命”一只狗担任推特首席执行官
...通讯社莫斯科2月15日电美国企业家、推特的新主人埃隆∙马斯克“任命”了该公司的新首席执行官,并在自己的推特页面给“任命”附上了狗的照片。马斯克在推特上狗的照片下评论道:“新的
2023-02-16 13:43:00
马斯克公开回击迪士尼CEO,“滚蛋吧”,承认赞同反犹帖子愚蠢
当地时间11月29日,埃隆·马斯克出现在《纽约时报》的DealBook峰会上。现年52岁的亿万富翁保持了随性的风格,毛领皮夹克内搭纯黑T恤,并配了一双短靴,显然他并没有因为出席的
2023-12-01 09:26:00
马斯克关注的账号“Teslaconomics”周日发帖,分享了一段特斯拉Semi卡车在高速路上连续超越多辆卡车的视频,并配文称:“别挡道,特斯拉Semi卡车开过来了!比尔·盖茨,
2023-08-06 15:47:00
马斯克:汽车后视镜是愚蠢的设计!干掉后视镜可以增加5%的续航
...的特斯拉MODEL 3已经干掉了实体后视镜,特斯拉的创始人马斯克,更是多次炮轰,传统后视镜是鸡肋,是愚蠢的设计。“后视镜在汽车行驶过程中,会产生风阻,从而让电动车最多减少5%
2024-05-27 09:10:00
马斯克来了,摩根大通、辉瑞CEO也要来!重磅人物云集中国,什么信号?
5月30日,马斯克时隔三年再次访问中国。然而有消息称,摩根大通、星巴克、辉瑞CEO近日也都要来中国了!啥情况?马斯克会见宁德时代曾毓群 ?据央视新闻,5月30日,特斯拉首席执行官
2023-05-31 10:22:00
马斯克服软了,不宣传以色列暴行而是改口:以色列只能摧毁哈马斯
来源:Six说 马斯克恐怕是这个世界上最敢说的资本家。巴以冲突刚刚爆发的时候,他就持非常激烈的批判以色列的态度,甚至利用他的社交媒体宣传以色列的种种暴行。可现在马斯克终于知道,凭
2023-12-01 10:38:00
...纵火。针对极端活动人士的做法,特斯拉公司首席执行官马斯克予以强烈抨击,称其“极其愚蠢”。马斯克在社交媒体X上说:“这些人要么是地球上最愚蠢的生态恐怖分子,要么是那些没有良好环
2024-03-06 13:50:00
...国Grünheide工厂的高缺勤率引起了特斯拉首席执行官埃隆·马斯克(Elon Musk)的注意。《商报》报道称,特斯拉Grünheide工厂的员工请病假率在8月份攀升至17%
2024-09-30 21:00:00
更多关于科技的资讯:
iPhone17系列正式发售,多地门店排起长队,有黄牛加价500元收购Max 256G版本
北京时间9月19日,iPhone 17系列正式发售,线上抢购到首批货源的用户将陆续收到新机,官方零售店也于8:00提前开门营业供预约取货用户取货
2025-09-19 12:06:00
在杭州看见创新未来 第四届数贸会全景前瞻
第四届全球数字贸易博览会(以下简称“数贸会”)将于2025年9月25日至29日在杭州大会展中心举行。作为我国唯一以数字贸易为主题的国家级
2025-09-19 14:13:00
走向国际,INGS英树三度荣获IFSCC青睐
2025年9月15日至18日,第35届IFSCC国际化妆品科学大会以“THE FUTURE IS SCIENCE”为主题于法国戛纳盛大启幕
2025-09-19 14:16:00
国网高密市供电公司:物资仓库里的“绣花功夫”
大众网记者 宋学敏 通讯员 赵雯雯 贾聚光 潍坊报道9月19日,走进国网高密市供电公司物资供应分中心的物资仓库,整齐的货架
2025-09-19 14:23:00
研发投入年增超40%!Coosea酷赛智能凭什么敢在创新上“下血本”?
在智能制造与AI设备行业加速迭代的浪潮中,研发实力已成企业核心竞争力的关键。近日,Coosea酷赛智能披露的研发投入数据引发行业关注——其研发投入年增超40%
2025-09-19 14:51:00
喜茶「超级植物茶」上新一周年,差异化引领新茶饮产品趋势
9月19日,喜茶「超级植物茶」迎来上新一周年。据官方数据显示,「超级植物茶」全系列产品已售出超1亿杯,喜茶坚持采用新鲜的羽衣甘蓝每日现榨
2025-09-19 15:01:00
京东运动户外品类日开启 运动、健身、户外出游全场景好物立减12%
秋高气爽迎国庆,正是走出家门、拥抱自然的好时机。9月19日晚8点至20日,京东运动户外品类日正式开启,携手阿迪达斯、北面
2025-09-19 15:08:00
华为云杨友桂:数智化转型从来不是 \
9月19日,在华为全联接大会2025上,华为高级副总裁、华为云全球Marketing与销售服务总裁杨友桂介绍了华为云如何通过四大关键竞争力
2025-09-19 15:24:00
焕新家庭储鲜,澳柯玛多款行业领先冷柜亮相电博会
鲁网9月19日讯2025年9月19日至21日,中国国际消费电子博览会在青岛国际会展中心盛大举行。作为温度科技专家的澳柯玛
2025-09-19 15:25:00
当下,金融科技行业正站在新一轮周期的关键拐点。当金融科技领域历经市场的深度重塑,行业周期拐点下,平台该如何突围?辽宁自贸试验区(营口片区)桔子数字科技有限公司(简称“桔子数科”)以科技赋能为锚点
2025-09-19 15:28:00
“媒体+科技”构建融媒服务新生态 长城新媒体集团与腾讯签订战略合作协议
金秋时节,硕果盈枝。2025年9月16日,长城新媒体集团有限公司与深圳市腾讯计算机系统有限公司在2025全球数字生态大会期间签订战略合作协议
2025-09-19 15:34:00
做教育行业的“清流”,高途以人文和体育探索营销新范式
进入2025年,教育行业在调整期后逐步迎来品牌动作的复苏潮。在行业变革的深水区,品牌营销往往是透视品牌预期和行业趋势的风向标
2025-09-19 15:34:00
近年来,以网剧、网文、网游为代表的中国文化出海“新三样”,在国际市场取得亮眼表现。9月12日,在《文化纵横》杂志社举办的“迈向全球的当代中国文化产业”研讨会上
2025-09-19 15:34:00
鑫方盛与腾讯云签订全面合作协议共创工业品供应链数智化未来
9月15日,国内工业品供应链领军企业鑫方盛集团(以下简称“鑫方盛”),与腾讯云正式签订全面合作协议。双方将依托腾讯云领先的云计算
2025-09-19 16:04:00
跨维智能与腾讯云达成战略合作,以生成式世界模型驱动具身智能高效落地
9 月 16 日,在 2025 腾讯全球数字生态大会期间,跨维(深圳)智能数字科技有限公司(以下简称 “跨维智能”)与腾讯云正式达成战略合作
2025-09-19 16:04:00