• 我的订阅
  • 科技

高文院士:鹏城实验室已训练3个大模型,今年底将拥有两万多块卡

类别:科技 发布时间:2024-06-05 13:00:00 来源:搜狐科技

高文院士:鹏城实验室已训练3个大模型,今年底将拥有两万多块卡

出品 | 搜狐科技

编辑 | 梁昌均

6月5日消息,在今日举办的2024全球数字经济大会数字安全高层论坛暨北京网络安全大会战略峰会上,中国工程院院士、鹏城实验室主任高文发表演讲,分享了鹏城实验室在打造大模型平台上的进展。

他表示,大模型训练首先需要一个平台。“现在要想训练一个大模型,需要有几千块卡,甚至上万块卡。”

他介绍到,鹏城实验室在2020年就搭建了这样一个平台——鹏城云脑2,拥有4000块卡,具备有1000P的算力,专门面向大规模人工智能模型训练的底座。目前还在推进云脑3的建设,预计今年年底前应完成,其将拥有两万多块卡。

“这些平台为鹏城实验室做大规模的人工智能模型的训练提供了基础。”高文表示,“我们有了机器,整理收集购买了非常多的数据,可以通过不停的迭代训练,使得模型的效率越来越高,性能越来越好。”

不过,高文表示,目前国内已经有两三百各种各样不同的模型,鹏城实验室并不是要参与这些大模型的竞争,模型训练完后也不是说放在仓库里,而是希望把它交给社会来使用。

目前,鹏城实验室已经训练了三个大模型,包括70亿参数、330亿参数和2000亿参数等不同规模的模型,其中2000亿参数模型花费资源最多,训练阶段用四千多块卡跑了七个月,非常费卡费时。

高文还表示,从这些模型训练也得到很多经验,通过摸索印证了规模定律(Scaling Law)。“要想做一个好的模型,一定规模要大,机器的规模要大,数据的规模要大,只有规模到了才能做出好模型。”

他还提到,现在要想训练出一个好的模型,非常费钱,要训练一个千亿参数的模型,基本就是千万美元的花费。要想训练一个万亿级的模型,大概需要1亿美元。

“我们2000亿的模型大概花了5亿人民币,也就是几千万美元的成本,要是万亿模型,那肯定接近10亿人民币或者更多,才能训练好。”高文表示,任何说花很少一点钱就能训练出来,那肯定是做了很多简化,简化以后才能训练出来,但是性能可能要打折扣。

除了模型,高文表示,鹏城实验室还研发了一个33B的长窗口模型。

为什么要做长窗口模型?他解释到,因为现在一般模型,输入的向量窗口大概是4K到8K,但一本书是几十万字,要想训练,就得每次按照8K把一本书要分成很多段,然后送去训练。

由于大模型训练主要是注意力机制,即注意力参数的训练,只要两个东西相关,就可以发生一个关联。“这是在没有截断的前提下,如果把数据截成8K,第二个8k进来了以后,和第一个8K就没有直接关系,这种关联度或注意力参数就不对。”

高文提到,现在也有很多办法去解决这个问题,但比较理想的还是一次性把一本书全都送进去,这就要求窗口特别长。

“这也会带来另外一个问题,要求内存特别大等,所以训练长窗口是大家都很关注的问题,现在做长窗口的创业公司估值很高。”高文称。

他透露,鹏城实验室33B的长窗口模型是和百川智能联合研发,总体来说性能比一般的窗口效果也会更好。

高文最后表示,鹏城实验室目前正在通过开源的方式,通过开源联合体推进合作,实验室资源现在已经可以在网站去自由获取,包括和不同的智能计算中心联合,推动算力的开放协调,并通过设立基金的形式去鼓励自由探索。返回搜狐,查看更多

责任编辑:

以上内容为资讯信息快照,由td.fyun.cc爬虫进行采集并收录,本站未对信息做任何修改,信息内容不代表本站立场。

快照生成时间:2024-06-05 15:45:01

本站信息快照查询为非营利公共服务,如有侵权请联系我们进行删除。

信息原文地址:

...样方便地使用算力。”新年伊始,中国工程院院士、鹏城实验室高文忙着推进各项工作,继续加大“中国算力网”特别是粤港澳大湾区算力调度中心建设力度。鹏城实验室,坐落在深圳西丽,5座办
2024-01-29 03:46:00
...循环,取得了一系列新进展、新突破。在科技端,与鹏城实验室开展合作,协同推进工业智能关键技术攻关,不断提炼和沉淀行业级大模型通用能力。在产业端,积极运用自然语言处理、知识图谱等
2023-07-06 19:32:00
...出席活动并发表了对开源的见解。中国工程院院士、鹏城实验室主任高文表示,当下AI 正引领我们进入全新的算力时代,为构建充满活力的算力生态,我们需拥抱开源开放。中国计算机学会开源
2024-12-26 17:10:00
中国首位!高文院士获得 IEEE 社会基础设施创新奖
...,高文是中国工程院院士、北京大学博雅讲席教授、鹏城实验室主任、数字音视频编解码技术标准(AVS)工作组组长。他带领鹏城实验室团队,专注于研究大规模人工智能应用,设计、研制了低
2024-12-27 09:36:00
粤港澳大湾区建设行稳致远
...来源:广东省大湾区办图①:鹏城云脑大科学装置。鹏城实验室供图 图②:晨曦中的港珠澳大桥。新华社记者 刘大伟摄2019年2月18日,《粤港澳大湾区发展规划纲要》正式公开发布。在
2024-02-21 06:10:00
中国智能科学技术最高奖在苏州揭晓,70个项目获表彰
...园区隆重举行,70个获奖项目及个人受到表彰奖励。鹏城实验室主任、北京大学讲席教授、中国工程院院士高文荣获“吴文俊人工智能最高成就奖”,并颁授荣誉奖牌和奖金。湖南大学党委常委、
2024-04-15 13:15:00
...atGPT与人脑并不类似近期,ChatGPT相关话题热度不减。鹏城实验室副主任石光明说:“在ChatGPT出现之前
2023-04-21 06:21:00
院士班主任+1!哈工大新设人工智能院士特色班
...向2023级本科生新设人工智能班由中国工程院院士、鹏城实验室主任高文领衔并担任班主任近日在位于深圳的鹏城实验室选拔进入首届人工智能班的20名新生与班主任高文院士见面并互动交流
2023-10-12 22:17:00
首届中国大模型大会在北京举行
...人民网党委书记、董事长、总裁、传播内容认知全国重点实验室主任叶蓁蓁,清华大学教授唐杰,复旦大学教授邱锡鹏分别以“应用者视角的AI发展与合作”“ChatGLM:从大模型看AGI
2024-06-20 17:17:00
更多关于科技的资讯:
厦门动漫嘉年华启幕 众多热门国漫IP集中参展
厦门动漫嘉年华各项活动精彩纷呈。(记者 林铭鸿 摄)厦门网讯(厦门日报记者 林露虹)展览面积超5万平方米,汇聚众多热门国漫IP
2026-01-01 08:41:00
助力低空应急产业发展——三明市应急管理局引进低空防御项目
东南网1月1日讯 2025年12月30日,由三明市应急管理局引进,南京云麒防务科技有限公司投资的福建鹏鑫智能科技有限公司
2026-01-01 09:33:00
近日,太长高速太原收费站智慧化升级改造全面完成并投入运营。项目以数字化转型为核心,围绕高峰期通行效率低、车辆拥堵等运营痛点
2026-01-01 07:17:00
沈洁任蓟州区代理区长 扫码阅读手机版
据“掌上蓟州”微信公众号消息,天津市蓟州区第二届人民代表大会常务委员会第三十五次会议决定:沈洁为天津市蓟州区人民政府代理区长。
2025-12-31 23:10:00
东南网12月31日讯(本网记者 卢金福)元旦佳节将至,消费市场迎来新一轮热潮。面对促销活动纷至沓来、消费场景多元拓展的新形势
2025-12-31 23:29:00
皖企长鑫科技向上交所递交IPO招股书
大皖新闻讯 2025年12月30日,总部位于合肥的长鑫科技集团股份有限公司(以下简称“长鑫科技”)正式向上海证券交易所递交招股书
2025-12-31 21:33:00
大河网讯 这一年,我们没有走遍世界,但世界,走进了《Global Talk》。2025年,《Global Talk》结识了来自全球近30个国家和地区的朋友——他们带着各自的故事
2025-12-31 22:33:00
近日,上药控股山东总部携手浪潮智慧建筑,构建涵盖16大智能化系统的智慧园区体系,以智慧云平台为中枢推进全要素数字化升级
2025-12-31 22:59:00
石家庄二中新添“AI学伴”,有道AI答疑笔以“引导式答疑”助力启发式教学
河北新闻网讯 为推动教育资源均衡发展,让智能科技惠及更多青少年,12月18日,石家庄市“希望工程”事业发展中心、石家庄市青少年发展基金会联合网易有道
2025-12-31 17:18:00
中国消费者报福州讯(记者张文章)12月31日,福建省消费者权益保护委员会聚焦“科技+消费”核心场景发布消费提示,提醒广大消费者警惕伪智能陷阱
2025-12-31 17:33:00
中国消费者报海口讯(记者黄劼)2025年12月30日,三亚海旅免税城迎来开业五周年。海旅免税以“High Five 5•五周年狂欢庆典”为主题
2025-12-31 17:33:00
麦当劳中国第4400家LEED认证绿色餐厅落户福州
福州新华都大厦餐厅盛大开业,“开心书屋”全国首发麦当劳中国第4400家LEED认证绿色餐厅落户福州辞旧迎新之际,麦当劳中国第4400家LEED认证绿色餐厅“福州新华都大厦(五四路)餐厅”盛大开业
2025-12-31 17:49:00
“艾白”来了!12月31日,福州日报社首位机器人员工正式上岗!
2025-12-31 17:49:00
嘀嗒出行发布《2025职场顺风车用户画像及体验洞察报告》
河北新闻网讯(记者 李春炜)12月31日,嘀嗒出行发布《2025职场顺风车用户画像及体验洞察报告》,基于嘀嗒顺风车大数据和近万名嘀嗒顺风车用户调研
2025-12-31 18:04:00