• 我的订阅
  • 科技

高文院士:鹏城实验室已训练3个大模型,今年底将拥有两万多块卡

类别:科技 发布时间:2024-06-05 13:00:00 来源:搜狐科技

高文院士:鹏城实验室已训练3个大模型,今年底将拥有两万多块卡

出品 | 搜狐科技

编辑 | 梁昌均

6月5日消息,在今日举办的2024全球数字经济大会数字安全高层论坛暨北京网络安全大会战略峰会上,中国工程院院士、鹏城实验室主任高文发表演讲,分享了鹏城实验室在打造大模型平台上的进展。

他表示,大模型训练首先需要一个平台。“现在要想训练一个大模型,需要有几千块卡,甚至上万块卡。”

他介绍到,鹏城实验室在2020年就搭建了这样一个平台——鹏城云脑2,拥有4000块卡,具备有1000P的算力,专门面向大规模人工智能模型训练的底座。目前还在推进云脑3的建设,预计今年年底前应完成,其将拥有两万多块卡。

“这些平台为鹏城实验室做大规模的人工智能模型的训练提供了基础。”高文表示,“我们有了机器,整理收集购买了非常多的数据,可以通过不停的迭代训练,使得模型的效率越来越高,性能越来越好。”

不过,高文表示,目前国内已经有两三百各种各样不同的模型,鹏城实验室并不是要参与这些大模型的竞争,模型训练完后也不是说放在仓库里,而是希望把它交给社会来使用。

目前,鹏城实验室已经训练了三个大模型,包括70亿参数、330亿参数和2000亿参数等不同规模的模型,其中2000亿参数模型花费资源最多,训练阶段用四千多块卡跑了七个月,非常费卡费时。

高文还表示,从这些模型训练也得到很多经验,通过摸索印证了规模定律(Scaling Law)。“要想做一个好的模型,一定规模要大,机器的规模要大,数据的规模要大,只有规模到了才能做出好模型。”

他还提到,现在要想训练出一个好的模型,非常费钱,要训练一个千亿参数的模型,基本就是千万美元的花费。要想训练一个万亿级的模型,大概需要1亿美元。

“我们2000亿的模型大概花了5亿人民币,也就是几千万美元的成本,要是万亿模型,那肯定接近10亿人民币或者更多,才能训练好。”高文表示,任何说花很少一点钱就能训练出来,那肯定是做了很多简化,简化以后才能训练出来,但是性能可能要打折扣。

除了模型,高文表示,鹏城实验室还研发了一个33B的长窗口模型。

为什么要做长窗口模型?他解释到,因为现在一般模型,输入的向量窗口大概是4K到8K,但一本书是几十万字,要想训练,就得每次按照8K把一本书要分成很多段,然后送去训练。

由于大模型训练主要是注意力机制,即注意力参数的训练,只要两个东西相关,就可以发生一个关联。“这是在没有截断的前提下,如果把数据截成8K,第二个8k进来了以后,和第一个8K就没有直接关系,这种关联度或注意力参数就不对。”

高文提到,现在也有很多办法去解决这个问题,但比较理想的还是一次性把一本书全都送进去,这就要求窗口特别长。

“这也会带来另外一个问题,要求内存特别大等,所以训练长窗口是大家都很关注的问题,现在做长窗口的创业公司估值很高。”高文称。

他透露,鹏城实验室33B的长窗口模型是和百川智能联合研发,总体来说性能比一般的窗口效果也会更好。

高文最后表示,鹏城实验室目前正在通过开源的方式,通过开源联合体推进合作,实验室资源现在已经可以在网站去自由获取,包括和不同的智能计算中心联合,推动算力的开放协调,并通过设立基金的形式去鼓励自由探索。返回搜狐,查看更多

责任编辑:

以上内容为资讯信息快照,由td.fyun.cc爬虫进行采集并收录,本站未对信息做任何修改,信息内容不代表本站立场。

快照生成时间:2024-06-05 15:45:01

本站信息快照查询为非营利公共服务,如有侵权请联系我们进行删除。

信息原文地址:

...样方便地使用算力。”新年伊始,中国工程院院士、鹏城实验室高文忙着推进各项工作,继续加大“中国算力网”特别是粤港澳大湾区算力调度中心建设力度。鹏城实验室,坐落在深圳西丽,5座办
2024-01-29 03:46:00
...循环,取得了一系列新进展、新突破。在科技端,与鹏城实验室开展合作,协同推进工业智能关键技术攻关,不断提炼和沉淀行业级大模型通用能力。在产业端,积极运用自然语言处理、知识图谱等
2023-07-06 19:32:00
...出席活动并发表了对开源的见解。中国工程院院士、鹏城实验室主任高文表示,当下AI 正引领我们进入全新的算力时代,为构建充满活力的算力生态,我们需拥抱开源开放。中国计算机学会开源
2024-12-26 17:10:00
中国首位!高文院士获得 IEEE 社会基础设施创新奖
...,高文是中国工程院院士、北京大学博雅讲席教授、鹏城实验室主任、数字音视频编解码技术标准(AVS)工作组组长。他带领鹏城实验室团队,专注于研究大规模人工智能应用,设计、研制了低
2024-12-27 09:36:00
粤港澳大湾区建设行稳致远
...来源:广东省大湾区办图①:鹏城云脑大科学装置。鹏城实验室供图 图②:晨曦中的港珠澳大桥。新华社记者 刘大伟摄2019年2月18日,《粤港澳大湾区发展规划纲要》正式公开发布。在
2024-02-21 06:10:00
中国智能科学技术最高奖在苏州揭晓,70个项目获表彰
...园区隆重举行,70个获奖项目及个人受到表彰奖励。鹏城实验室主任、北京大学讲席教授、中国工程院院士高文荣获“吴文俊人工智能最高成就奖”,并颁授荣誉奖牌和奖金。湖南大学党委常委、
2024-04-15 13:15:00
...atGPT与人脑并不类似近期,ChatGPT相关话题热度不减。鹏城实验室副主任石光明说:“在ChatGPT出现之前
2023-04-21 06:21:00
院士班主任+1!哈工大新设人工智能院士特色班
...向2023级本科生新设人工智能班由中国工程院院士、鹏城实验室主任高文领衔并担任班主任近日在位于深圳的鹏城实验室选拔进入首届人工智能班的20名新生与班主任高文院士见面并互动交流
2023-10-12 22:17:00
首届中国大模型大会在北京举行
...人民网党委书记、董事长、总裁、传播内容认知全国重点实验室主任叶蓁蓁,清华大学教授唐杰,复旦大学教授邱锡鹏分别以“应用者视角的AI发展与合作”“ChatGLM:从大模型看AGI
2024-06-20 17:17:00
更多关于科技的资讯:
82岁老人换了新手机,但不熟悉操作,结果误开通多项收费业务。3月11日,老人收到扣费短信后向网格员求助,顺利取消了扣费服务
2026-03-11 17:36:00
中新经纬3月11日电 (董湘依)近年来,中国文化“新三样”(网文、网剧、网游)在海外迅速走红。全国两会期间,全国政协委员
2026-03-11 19:27:00
中新经纬3月11日电 题:“养龙虾”火出圈 ,算力变成稀缺资源作者 薛洪言 星图金融研究院常务副院长、苏商银行特约研究员2026年的早春
2026-03-11 19:28:00
河北新闻网讯(闫丽颖、唐福刚)近日,开滦股份范各庄矿聚焦“物理隔离+智能管控”核心需求,创新应用一套具备智能闭锁、声光报警
2026-03-11 19:51:00
中国联通eSIM尝鲜季再添新力
3月11日上午,中国联通eSIM尝鲜季——三星国内首款eSIM手机Galaxy S26系列首销仪式在西单北营业厅隆重举行
2026-03-11 14:14:00
大皖新闻讯 家里空调、冰箱等家电出故障,找维修却怕遇上“小病大修”“坐地起价”。别愁,专为安徽消费者打造的家电维修“放心平台”来了
2026-03-11 14:55:00
近日,备受瞩目的2025年度“吴文俊人工智能科学技术奖”获奖名单正式揭晓。罗普特(股票代码:688619.SH)作为主要完成单位参与的《面向海上安防的通感算一体化大数据智能处理关键技术及产业化》项目
2026-03-11 15:01:00
新华保险“空中柜面”让保单服务零距离
鲁网3月11日讯“您好,欢迎使用新华保险空中柜面服务!”当客户通过手机视频联系接通后台柜员时,这一句温暖的问候便会准时响起
2026-03-11 16:35:00
新华社记者 曾晋“你‘养龙虾’了吗?”这句略显无厘头的有趣问话,说的可是最近科技圈的一件大事。此“龙虾”并非餐桌上的美味
2026-03-11 16:02:00
长白时评评论员 丁铁巴基斯坦独立新闻社日前报道,曾是大型农场专属的现代农业机械化,正因中国农机驶入全球田间地头被改写,手工耕作的辛劳正被高效的机械作业替代
2026-03-11 11:32:00
降噪新科技,轻松听清晰,潜能发展更可期----科利耳Nucleus™ 8以创新聆听赋能成长
在移动互联高度发达的当下,听损人士的生活场景愈发多元:孩子们在游乐场嬉戏,笑声与广播声交织;学生们在校园里讨论,声音此起彼伏
2026-03-11 13:01:00
海湾深化转型,打造第二增长曲线
2025年,海湾安全技术有限公司(以下简称"海湾")迈入发展新阶段,在消防行业深度变革的浪潮中交出了一份亮眼的答卷。新年伊始
2026-03-11 13:02:00
八马以科技为翼,武夷山超级工厂破解茶行业非标发展桎梏
中国茶行业千年发展,却长期受困于“非标”痛点,品质参差、产能有限成为行业升级的最大阻碍。而作为“高端中国茶第一股”的八马茶业
2026-03-11 13:04:00
实现社保一站式便民服务厦门“汇智办”让缴费人“会自办”东南网3月11日讯(海峡导报记者 孙春燕 通讯员 杨楠欢 叶璐璐 廖皓宇) 受春节过后的“返工潮”影响
2026-03-11 13:46:00
探路制造出海“关键一跃”:华南师范大学调研团队走进华翱集团
面对复杂多变的国际环境,佛山制造业正迎来新一轮深度转型的关键期。从深耕国内市场到逐鹿全球蓝海,如何实现从单一“产品出海”向涵盖“技术-制造-品牌”的全链条出海跨越
2026-03-11 13:04:00