• 我的订阅
  • 科技

新版Llama 3 70B反超405B!Meta开卷后训练,谷歌马斯克都来抢镜

类别:科技 发布时间:2024-12-09 09:53:00 来源:量子位

OpenAI“双12”刚进行到第二天,就把大模型圈搅得好不热闹!

一边是Meta没预告就发布了Llama 3.3,70B版本就能实现以前405B的性能。

新版Llama 3 70B反超405B!Meta开卷后训练,谷歌马斯克都来抢镜

另一边谷歌的Gemini也上线了新的实验版模型,再一次登上大模型竞技场榜首。

新版Llama 3 70B反超405B!Meta开卷后训练,谷歌马斯克都来抢镜

有网友感叹,o1、Llama 3.3和新版Gemini接连发布,马斯克的Grok3也要来,还有GPT-4.5初露端倪……这简直是最棒的一个圣诞季。

新版Llama 3 70B反超405B!Meta开卷后训练,谷歌马斯克都来抢镜

Llama 3.3:70B实现405B效果

Llama 3.3目前只有70B一个型号。

但在指令遵循(IFEval)、数学(MATH)、推理(GPQA Diamond)等领域,水平都超过了七月份发布的Llama 3.1 405B。

在语言(MMLU)、代码(HumanEval)、长文本和多语种能力上,成绩也和Llama 3.1 405B比较接近。

而在工具使用(BFCL)上,和405B的差距则显得稍大一些。

新版Llama 3 70B反超405B!Meta开卷后训练,谷歌马斯克都来抢镜

不过,Llama 3.3的使用成本要比Llama 3.1 405B低得多。

虽然Llama本身是免费的,但是各个大模型平台的服务价格也可以作为衡量成本的一个参考。

在Meta合作的平台当中,Llama 3.3最便宜的价格是0.1/0.4美元每百万输入/输出Token。

而Llama 3.1 405B,则是1美元每百万输入token,是Llama 3.3的10倍,输出token为1.8美元,是Llama 3.3的4.5倍。

新版Llama 3 70B反超405B!Meta开卷后训练,谷歌马斯克都来抢镜

Meta生成式AI团队领导者Ahmad Al-Dahle表示,Llama 3.3能用70B实现405B的效果,主要是“运用了后训练技术的最新进展”,并点名其中包括在线偏好优化(online preference optimization)。

新版Llama 3 70B反超405B!Meta开卷后训练,谷歌马斯克都来抢镜

Meta AI官方账号也提到,Llama 3.3的进步归功于新的对齐过程和在线强化学习技术的进步。

新版Llama 3 70B反超405B!Meta开卷后训练,谷歌马斯克都来抢镜

目前,Llama 3.3的模型权重已在官网和Hugging Face上开放下载。

新版Llama 3 70B反超405B!Meta开卷后训练,谷歌马斯克都来抢镜

Gemini迎来周岁生日

Gemini 1206上线的这天,刚好是Gemini的一周岁生日。

不过,从节奏和以日期命名的方式来看,Gemini更像是一次例行更新(上一个版本是1121)。

当然成绩还是很不错的,直接登上了lmsys大模型竞技场的榜首。

新版Llama 3 70B反超405B!Meta开卷后训练,谷歌马斯克都来抢镜

而且不只是总成绩夺冠,困难提示词、代码、数学、创意写作等各个单项排名也都是第一。

新版Llama 3 70B反超405B!Meta开卷后训练,谷歌马斯克都来抢镜

实际上,Gemini此前有个1114版本,也当了一周的“榜一大哥”,后来被更新的GPT-4o给比了下去。

现在的最新版本,又让Gemini重新回到了榜单上的王座。

新版Llama 3 70B反超405B!Meta开卷后训练,谷歌马斯克都来抢镜

此外,谷歌AI Studio产品负责人(原OpenAI开发者社区主管)Logan介绍,Gemini 1206拥有2百万token的上下文窗口,目前可通过谷歌AI Studio和Gemini API免费使用。

新版Llama 3 70B反超405B!Meta开卷后训练,谷歌马斯克都来抢镜

谷歌首席科学家Jeff Dean表示,取得这样的成绩是对Gemini生日最好的庆祝方式。

新版Llama 3 70B反超405B!Meta开卷后训练,谷歌马斯克都来抢镜

不过也有网友给谷歌泼了盆冷水,表示o1还没出现在这个榜单上,而且GPT-4.5就要来了,谷歌第一的位置恐怕很快又会被OpenAI夺走。

新版Llama 3 70B反超405B!Meta开卷后训练,谷歌马斯克都来抢镜

One More Thing

除了谷歌和Meta,马斯克xAI也被盛传即将发布Grok 3。

有网友发现,正在测试的Grok 2 mini消失了,认为这是要发Grok 3的征兆。

新版Llama 3 70B反超405B!Meta开卷后训练,谷歌马斯克都来抢镜

除了对Grok 3的猜测,还有一条更确定的消息——此前要充会员才能用的Grok,现在可以免费用了。

不过免费用户用量比较有限,每两小时只能处理10条消息,而图片分析一天只能处理三张。

新版Llama 3 70B反超405B!Meta开卷后训练,谷歌马斯克都来抢镜

有意思的是,我们试了试询问Grok自己,它也表示Grok 3计划在这个月上线。

但抓马的是,点进后面引用的消息源,发现这名博主也是问Grok之后发的帖子……

新版Llama 3 70B反超405B!Meta开卷后训练,谷歌马斯克都来抢镜

那么,在这个发布密集的十二月,你最钟意或者最期待哪一款产品呢?

参考链接:[1]https://x.com/AIatMeta/status/1865079067390956006[2]https://x.com/Ahmad_Al_Dahle/status/1865071436630778109[3]https://x.com/lmarena_ai/status/1865080944455225547

以上内容为资讯信息快照,由td.fyun.cc爬虫进行采集并收录,本站未对信息做任何修改,信息内容不代表本站立场。

快照生成时间:2024-12-09 12:45:02

本站信息快照查询为非营利公共服务,如有侵权请联系我们进行删除。

信息原文地址:

马斯克:特斯拉正在训练新的FSD模型 可能会在下个月发布
...6日讯(编辑 牛占林)当地时间周三,特斯拉首席执行官马斯克在社交平台上发文称,该公司目前正在训练一款全新的完全自动驾驶(FSD)模型,可能在下个月底准备好向公众发布。 马斯克
2025-08-06 21:35:00
XAI大模型Grok-1已正式开源 但并不是在马斯克说的上周
【TechWeb】3月18日消息,据外媒报道,马斯克领导的人工智能公司xAI当地时间周日在官网宣布,他们的大语言模型Grok-1已正式开源
2024-03-18 20:19:00
马斯克打脸OpenAI!全球最大模型Grok-1开源
本文经授权转载自钛媒体(ID:taimeiti)作者:林志佳马斯克(Elon Musk)真的实现了他的承诺——把大模型Grok-1开源了
2024-03-20 13:44:00
“言出必行”马斯克,全球最大开源模型Grok真的来了
...的 Grok,一举拿下迄今为止“全球最大开源模型”称号。马斯克又搞了个全球第一。Grok开源美东时间3月17日,xAI 正式宣布开源大模型Grok-1的权重和网络架构
2024-03-18 11:50:00
马斯克偏心 xAI,被曝挖走十多名特斯拉人才训练 Grok AI 模型
...日消息,科技媒体 electrek 昨日(8 月 8 日)报道,埃隆・马斯克(Elon Musk)进一步向其 xAI 公司倾斜资源
2024-08-10 09:42:00
马斯克推出首个AI大模型:善于讽刺,只训练了两个月,部分超越GPT3.5
...:一个善于讽刺的聊天机器人。当地时间11月4日,埃隆·马斯克(Elon Musk)旗下xAI团队发布了首个AI大模型产品Grok
2023-11-06 14:23:00
马斯克要求OpenAI恢复开源,背后是开源闭源路线之争
马斯克起诉OpenAI事件已经发酵了一周。3月7日,马斯克在推特上称,如果OpenAI把名字改为ClosedAI他就撤销诉讼
2024-03-09 22:51:00
市场担忧Sora模型带来两大隐患,马斯克“坐不住”了,秀肌肉
...技惊四座”后,在AI领域一向野心勃勃的特斯拉CEO埃隆·马斯克(ElonMusk)“坐不住”了。日前,马斯克发布了特斯拉一年前模拟真实场景的自动驾驶视频,并称“特斯拉视频的生
2024-02-21 14:59:00
马斯克硬刚OpenAI 用户惨遭池鱼之殃
...的,没听说过主动给人加个上限的。如今开眼了,埃隆·马斯克正在给所有推特用户加“未成年人保护”,而这一切,居然是被AI逼的?如今推特用户每天最多能浏览多少推特,不取决于手速或者
2023-07-04 13:39:00
可生成政治人物图像,马斯克旗下xAI发布Grok-2“手撕”OpenAI
...鲸新闻8月15日讯(记者 朱俊熹)当地时间8月14日,埃隆·马斯克预告已久的新一代AI大模型Grok-2终于面世。马斯克对该模型寄予厚望
2024-08-15 14:26:00
更多关于科技的资讯:
蛋糕里吃出“牙”,和解填不满食品安全的信任缺口
齐鲁晚报·齐鲁壹点评论员 刘雅菲10月14日,有上海网友发布视频称,自己在上海的山姆会员商店外高桥店购买的枣泥核桃蛋糕中
2025-10-15 16:00:00
三联家电&海信集团强强联手!10.25重磅惠民活动即将启幕
鲁网10月15日讯为抢占四季度消费市场高地,深化品牌战略合作布局,10月11日,山东三联家用电器有限公司与海信集团联合召开“三联家电10
2025-10-15 14:59:00
京东官宣发布新车,称像买手机一样方便,已注册多枚京东汽车商标
10月14日,京东微博账号发文称:2025京东11.11期间,京东联合广汽、宁德时代将正式推出一款神秘国民好车,官方将在10月底将陆续开启内测版
2025-10-15 10:46:00
固安:开足马力赶订单 满足京津冀市场需求
河北新闻网讯(万倩、陈放)10月13日,走进位于固安县固安镇的秋兹科技(固安)有限公司生产车间,自动化裁切设备高速运转
2025-10-15 09:56:00
参展企业334家,展位数再创新高达840个斩获银奖!“南京智造”闪耀广交会南报网讯(记者黄琳燕通讯员宁商轩)第138届广交会将于10月15日在广州开幕
2025-10-15 08:09:00
“云”上调度 雨中守护|雷沃数智化服务为抢收装上智慧大脑
秋收关键期遭遇连绵阴雨,让秋收秋种受阻。除了满足抢收抢烘抢播的智能农机,潍柴雷沃还创新数智化服务,通过智能调度与精准服务
2025-10-15 01:05:00
茶酒融合催生“微醺”新赛道,新茶饮品牌争饮“昼夜”经济
当白天的提神茶饮与夜晚的放松酒品打破边界,正催生出国内消费市场一股新的“微醺”风潮。近期,茶百道经典白酒奶茶回归即创下销量佳绩
2025-10-14 11:33:00
嘎子谢孟伟被执行超1400万,已被限高,此前因穿警服带货被行拘7日
近日,因穿警服直播带货被行政拘留、账号遭封禁的嘎子谢孟伟发视频称 “我回来了”,并向所有观众诚恳道歉。视频中,其透露公司员工已被安排回老家
2025-10-14 11:33:00
平谷将打造全国农业科创中心
原标题:世界农业科创大会开幕 农业中关村核心区2.0发布平谷将打造全国农业科创中心本报讯(记者 赵婷婷)昨天,2025世界农业科技创新大会(WAFI)在北京平谷开幕
2025-10-14 11:59:00
据大象新闻报道,近期蜜雪冰城的小票成了年轻人追捧的“追更凭证”,其上连载着名为《雪王在古代卖咖啡》的小说,20个章节随机印在消费小票上
2025-10-14 12:10:00
电通创意发布《2025首席营销官报告》:算法与人性的重构力量
AI时代,品牌的长期价值回归于人性与文化共鸣,人类的创造力、同理心与文化相关性愈加重要。•AI已成日常:几乎所有CMO都在使用AI
2025-10-14 13:29:00
近日,一则“美团外卖骑手能屏蔽顾客”的消息在网络上引发热议。据媒体报道,美团已在福建晋江、浙江绍兴等七个城市试点上线骑手评价用户和屏蔽用户功能
2025-10-14 13:40:00
这座产业园一年制造千万颗球胆、百万颗整球——沂南县“造球记”
齐鲁晚报·齐鲁壹点 记者 公绪成 李其峰 通讯员 陈婉塑炼、分切、热压......沂南县泽辉体育产业园内,工人们正紧忙制作新一批篮球内胆10月9日
2025-10-14 15:00:00
在数字经济奔涌向前的浪潮中,VR正加速与新一代信息技术融合,不断催生新的应用场景。紧抓发展机遇,江西移动聚焦VR产业发展的核心问题
2025-10-14 16:02:00
行业首个!海尔智家牵头制定《智能门锁安装和售后服务要求》
据洛图科技数据显示,2025年上半年,中国智能门锁市场全渠道销量达到897万套,同比增长6.8%。面对日益增长的智能安防需求
2025-10-14 16:14:00