• 我的订阅
  • 财经

开源社区分水岭:Meta大模型Llama 3发布,参数最高或达4000亿

类别:财经 发布时间:2024-04-19 15:58:00 来源:澎湃新闻

开源社区分水岭:Meta大模型Llama 3发布,参数最高或达4000亿

为了保持公司在AI(人工智能)开源大模型领域的地位,社交巨头Meta推出了旗下最新开源模型。

当地时间4月18日,Meta在官网上宣布公布了旗下最新大模型Llama 3。目前,Llama 3已经开放了80亿(8B)和700亿(70B)两个小参数版本,上下文窗口为8k。Meta表示,通过使用更高质量的训练数据和指令微调,Llama 3比前代Llama 2有了“显著提升”。

未来,Meta将推出Llama 3的更大参数版本,其将拥有超过4000亿参数。Meta也将在后续为Llama 3推出多模态等新功能,包括更长的上下文窗口,以及Llama 3研究论文。

Meta在公告中写道:“通过Llama 3,我们致力于构建能够与当今最优秀的专有模型相媲美的开源模型。我们想处理开发者的反馈,提高Llama 3 的整体实用性,同时,继续在负责地使用和部署LLM(大型语言模型)方面发挥领先作用。”

18日当天,Meta股价(Nasdaq:META)收于每股501.80美元,涨1.54%,总市值1.28万亿美元。

“目前市场上最好的开源大模型”

据Meta介绍,Llama 3已经在多种行业基准测试上展现了最先进的性能,提供了包括改进的推理能力在内的新功能,是目前市场上最好的开源大模型。

在架构层面,Llama3选择了标准的仅解码(decoder-only)式Transformer架构,采用包含128K token词汇表的分词器。Llama 3在Meta自制的两个24K GPU集群上进行预训练,使用了超过15T的公开数据,其中5%为非英文数据,涵盖30多种语言,训练数据量是前代Llama 2的七倍,包含的代码数量是Llama 2的四倍。

根据Meta的测试结果,Llama 3 8B模型在MMLU、GPQA、HumanEval等多项性能基准上均超过了Gemma 7B和Mistral 7B Instruct,70B模型则超越了名声在外的闭源模型Claude 3的中间版本Sonnet,和谷歌的Gemini Pro 1.5相比三胜两负。

开源社区分水岭:Meta大模型Llama 3发布,参数最高或达4000亿

Llama 3在多项性能基准上表现出众。来源:Meta官网

在常规数据集之外,Meta还致力于优化Llama 3在实际场景中的性能,为此专门研发了一套高质量的人工测试集。该测试集包含1800条数据,涵盖了寻求建议、封闭式问题回答、头脑风暴、编码、写作等12个关键用例,并对开发团队保密。

在这套测试集中,从结果来看,Llama 3的成绩大幅超越了Llama 2,也胜过了Claude 3 Sonnet、Mistral Medium和GPT-3.5这些知名模型。

开源社区分水岭:Meta大模型Llama 3发布,参数最高或达4000亿

Llama 3在人工测试集上取得优异成绩。来源:Meta官网

而Llama 3的400B+模型虽然仍在训练中,Meta也展现了其部分测试成果,似乎旨在对标Claude 3的最强版本Opus。不过,Meta没有公布Llama 3更大参数模型和GPT-4等同规格选手的对比成果。

开源社区分水岭:Meta大模型Llama 3发布,参数最高或达4000亿

仍在训练中的Llama 3的400B+模型。来源:Meta官网

Llama 3模型即将在亚马逊AWS、Databricks、谷歌云、Hugging Face、Kaggle、IBM WatsonX、亚马逊Azure、英伟达NIM和Snowflake上被提供给开发者,并获得 AMD、AWS、戴尔、英特尔、英伟达和高通提供的硬件平台支持。为了让Llama 3被负责地开发,Meta还将提供新的信任和安全工具,包括Llama Guard 2、Code Shield和CyberSec Eval 2。

同时,Meta发布了基于Llama3的官方Web版本Meta AI。目前,该平台仍处于初级阶段,只有对话和绘画两大功能。用户使用对话功能无需通过注册,使用绘画功能则需要用户注册登录账号。

为开源社区注入活力

Meta的AI道路向来与开源紧密相连,Llama 3一经推出,受到了开源社区的热烈欢迎。

虽然也有一些对于Llama 3的8k上下文窗口过小的吐槽,但Meta方面表示,很快就会扩充Llama 3的上下文窗口。电子邮件初创企业Otherside AI的CEO兼联合创始人马特·舒默(Matt Shumer)对此也保持乐观,并表示:“我们正在走入一个新世界,在这里,GPT-4级别的模型是开源并可以免费访问的。”

英伟达高级研究科学家范麟熙(Jim Fan)表示,即将推出的更大参数Llama 3模型标志着开源社区的一个“分水岭”,可以改变许多学术研究和初创企业的决策方式,“预计整个生态系统中的活力将会激增”。

不过,值得注意的是,Meta没有公布Llama 3的训练数据,只称其全部来自公开数据。而从严格意义上来说,所谓的“开源”软件应当在开发与分发的过程中,将包括软件产品的源代码、训练数据等内容对公众完全开放。此前,数据公司Databricks发布的“最强开源大模型”DBRX除了拥有远超出普通计算机的标准配置外,也存在这一问题。

Llama 3的推出紧跟在Meta自研芯片取得进步之后。就在上周,Meta公布了自主研发芯片MTIA的最新版本。MTIA是Meta专门为AI训练和推理工作设计的定制芯片系列。和去年五月官宣的Meta第一代AI推理加速器MTIA v1相比,最新版本芯片在性能上有显著提升,专为Meta旗下社交软件的排名和推荐系统而设计。分析指出,Meta的目标是降低对英伟达等芯片厂商的依赖。

以上内容为资讯信息快照,由td.fyun.cc爬虫进行采集并收录,本站未对信息做任何修改,信息内容不代表本站立场。

快照生成时间:2024-04-19 17:45:05

本站信息快照查询为非营利公共服务,如有侵权请联系我们进行删除。

信息原文地址:

大模型如何开始生成一个全新时代
...概是87%,而GPT-4已经达到100%。AI大模型是人工智能历史的分水岭,甚至是工业革命以来人类文明史的分水岭。此前,人们更多关注和讨论的是人如何适应机器,探讨人与机器人的
2023-07-07 04:46:00
李彦宏称开源赶不上闭源?Meta发布最强开源模型,马斯克评价“还不错”
...科学家Jim Fan认为,Llama 3-400B以上的版本其将成为某种“分水岭”,开源社区将能用上GPT-4级别的模型
2024-04-20 11:00:00
ChatGPT浪潮之下 BAT迎来重塑时刻
...,颇有种“星夜兼程”的味道。ChatGPT或成为全新的技术分水岭尽管追逐者颇多,但若想要迅速追上早已经先行一步的OpenAI,恐怕还有不小的困难。毕竟,这种技术代差已经随着O
2023-04-17 10:59:00
2024成都车展丨夏一平:端到端技术现阶段极不安全,明年智驾行业会出现分水岭
...是上千亿。我一直判断明年可能整个智驾行业会出现一个分水岭式的竞争,跟不上就掉队了。这个事情还是算力驱动,大家知道特斯拉,特斯拉刚刚建成一个算力中心花了280亿人民币,这些还不
2024-09-02 19:03:00
国产大模型迎来“百模大战”,大模型如何从概念走向落地?
...谷歌在2017年发布了Transformer大模型,成为了AI大模型的新分水岭。但令谷歌没有想到的是,Transformer随后却成为了OpenAI滋养ChatGPT的土壤
2023-07-08 19:38:00
腾讯大模型混元Turbo:御气升昺云,梓桐金鼎开
...之间的差距不仅仅是工作效率的差距,更是未来竞争力的分水岭。让我们一起,踏上这场AI之旅,探索无限可能,让生活因AI而更加精彩!最后,不妨让我以这样一个故事,为混元Turbo的
2024-09-14 14:04:00
卷模型技术,更要卷工程实现
...架构、算力成本成为大模型应用落地和企业盈亏ROI的关键分水岭,重要性不低于模型精度。本主题将分享GPT等大模型的开源Foundation Model与Finetune
2023-08-10 10:00:00
MWC 2024观察:AI+硬件元年来了?
...百模大战,各种大模型、AI手机秀肌肉,会成为MWC的一次分水岭。AI+手机:竞争激烈,难分伯仲手机厂商对AI的追逐已经不能称之为“热衷”了,而是趋之若鹜,AI争夺战一直从产品
2024-03-04 16:55:00
全球独角兽 | Hugging Face:在人工智能的大航海时代悄悄地造一艘方舟
...发生的巨大变动或许可以被认为是影响未来AI格局的一条分水岭。 2021年8月,谷歌伦理AI(Ethical AI)人工智能伦理研究小组前负责人Margaret Mitchell加入了Hugging Face
2023-06-14 14:31:00
更多关于财经的资讯:
践行企业社会责任 共谋乡村振兴发展 中国太保寿险贵州分公司赴赫章县铁匠乡联盟村考察座谈
多彩贵州网讯(记者 王静怡)近日,中国太平洋人寿保险股份有限公司贵州分公司(以下简称中国太保寿险贵州分公司)党委书记、总经理王秋生带领公司领导班子赴赫章县铁匠乡联盟村考察座谈
2025-11-18 16:13:00
截至今年10月 秦皇岛市发放科技贷款超500亿元
河北日报讯(牛冉)近日,笔者从国家金融监督管理总局秦皇岛监管分局获悉,今年,秦皇岛监管分局以体系搭建为根基、以产品创新为抓手
2025-11-18 15:59:00
42家公司今年来实施增发后股价涨幅逾60%
根据Wind数据统计,以发行日计算,今年来已有129家公司实施了定向增发。从二级市场来看,42家公司在实施增发后股价涨幅超过60%。其中,中航成飞、*ST松发、东山精密、罗博特科
2025-11-18 09:38:00
国科天成等成立无人机科技公司,含AI业务
近日,陕西国科星达无人机科技有限公司成立,注册资本1亿元,经营范围包含:智能无人飞行器销售;工业机器人销售;人工智能行业应用系统集成服务;人工智能通用应用系统等。企查查股权穿透显
2025-11-18 09:48:00
浙江富玉具身智能创投合伙企业成立,出资额10亿
近日,浙江富玉具身智能创业投资合伙企业(有限合伙)成立,出资额10亿元,经营范围包含:创业投资(限投资未上市企业);股权投资。企查查股权穿透显示,该企业由浙江省创业投资集团有限公
2025-11-18 09:48:00
润建股份在海南成立能源公司,含多项AI业务
近日,海南佳捷能源有限公司成立,法定代表人为卢伟强,经营范围包含:储能技术服务;发电技术服务;人工智能基础软件开发;人工智能应用软件开发;人工智能行业应用系统集成服务等。企查查股
2025-11-18 09:48:00
富满微等成立子午线芯片服务公司
近日,深圳子午线芯片服务有限公司成立,经营范围包含:集成电路设计;电子产品销售;半导体分立器件销售;电子元器件制造等。企查查股权穿透显示,该公司由富满微(300671)等共同持股
2025-11-18 09:48:00
新华人寿乌鲁木齐中心支公司因培训管理不到位被罚款4千元
11月17日,新疆金融监管局行政处罚信息公示列表显示,新华人寿保险股份有限公司乌鲁木齐中心支公司及相关责任人因培训管理不到位被警告并罚款4千元。肖某东被警告并罚款4千元。
2025-11-18 10:13:00
浙商银行:决定提名陈海强任浙商银行董事长
11月17日,浙商银行股份有限公司发布关于提名董事长的提示性公告,根据中共浙江省委决定,陈海强同志任浙商银行股份有限公司党委书记,提名陈海强同志任浙商银行股份有限公司董事长。
2025-11-18 10:14:00
宁波银行调整“宁行优01” 优先股股息率第三计息周期票面利率3.25%
11月18日,宁波银行(证券代码:002142)发布公告,对其非公开发行的优先股“宁行优01”(代码:140001)第三计息周期票面股息率进行调整
2025-11-18 10:15:00
河南辉县:为建筑“上户口”,给城市“治未病”
安全可靠的韧性城市如何实现?建筑质量如何让老百姓看得见摸得着?在河南省辉县市,一条以“城市生命线全生命周期管理”为核心的新路径正在实践
2025-11-18 10:33:00
中建八局华中公司湖南分公司开展 “党建领航智慧机场 BIM赋能数字未来“活动
为推动智慧建造与工程档案管理深度融合,11月14日,中建八局华中公司湖南分公司与长沙市城建档案馆在长沙机场T3航站楼项目开展“党建领航智慧机场 BIM赋能数字未来”党建联建暨BIM档案”数智化“观摩活动
2025-11-18 10:33:00
大虹桥的“硬通货”!华发虹桥四季全维配套一应俱全!
重磅消息!徐泾动迁房票安置计划正式拉开序幕,该片区域购房活力全面引爆。握有房票的购房者不仅期待着购房带来的安居乐业,更怀揣着提升生活品质的美好愿景
2025-11-18 10:33:00
国瓷材料投资成立房地产公司
近日,山东国瓷盛源房地产有限公司成立,法定代表人为许少梅,注册资本为1000万元,经营范围包含:房地产开发经营;物业管理;住房租赁。企查查股权穿透显示,该公司由国瓷材料(3002
2025-11-18 12:00:00
中国农业银行邯郸分行因保理融资业务“三查”不尽职被罚款50万元 四人被终身禁业
11月18日,国家金融监督管理总局邯郸监管分局行政处罚信息公开表显示,中国农业银行股份有限公司邯郸分行因保理融资业务“三查”不尽职被罚款50万元;张某祥、贾某、刘某山、李某玺被禁
2025-11-18 10:45:00