• 我的订阅
  • 头条热搜
清华郑纬民院士:AI for Science的出现,让高性能计算与AI的融合成为刚需|MEET2023
...准设计四大目标以及如何通过并行方法加速大规模预训练模型。为了完整体现郑纬民院士的分享及思考,在不改变原意的基础上,量子位对他的演讲内容进行了编辑整理。关于MEET 智能未来大会:MEET大会是由量子位主办的智能科...……更多
从0到1:国产化千卡集群的一小步,AI算力主动权的一大步
...。供求关系紧张是产生算力焦虑的根源所在。一方面,大模型训练与推理需求呈几何级数爆发——自2022年以来,人工智能算力需求每3~4个月就翻一番,每年训练AI模型所需算力增幅高达10倍,而生成式AI使上升曲线进一步陡峭,...……更多
摩尔线程kuae千卡集群正式落地
12月19日消息,摩尔线程今日宣布,首个全国产千卡千亿模型训练平台——摩尔线程KUAE智算中心揭幕仪式在北京成功举办,宣告国内首个以国产全功能GPU为底座的大规模算力集群正式落地,大模型智算加速卡MTTS4000也同步发布。...……更多
...闻网中新网北京6月3日电 (记者 夏宾)近年来,为了追求大模型的智慧能力,各国公司不停加码投入,4月,Meta宣布追加10亿美元投资,用于其AI芯片研发和AI数据中心建设;亚马逊为了建设新数据中心投入110亿美元。但在大模型扩...……更多
国产GPU为底座,摩尔线程首个千卡智算中心落地
...2月19日,观察者网了解到,摩尔线程首个全国产千卡千亿模型训练平台——摩尔线程KUAE智算中心揭幕仪式在北京举办,这宣告国内首个以国产全功能GPU为底座的大规模算力集群正式落地。与此同时,摩尔线程联合国内众多合作...……更多
亚马逊开发史上最大文本转语音模型
...能研究团队宣布开发了一个据称是史上最大的文本转语音模型,该模型拥有最多的参数,并使用了最大的训练数据集。研究人员已经在arXiv预印本服务器上发表了一篇论文,详细描述了模型的开发和训练过程。近年来,像ChatGPT这...……更多
芯片战场丨瞄准大模型 摩尔线程首个千卡智算中心落地
为满足大模型的“暴力”计算需求,国内GPU企业正加码算力基础设施建设。12月19日,摩尔线程首个全国产千卡千亿模型训练平台——摩尔线程KUAE智算中心落地。据其介绍,这是国内首个以国产全功能GPU为底座的大规模算力集群...……更多
类Sora模型能否理解物理规律?字节豆包大模型团队系统性研究揭秘
视频生成模型虽然可以生成一些看似符合常识的视频,但被证实目前还无法理解物理规律!自从 Sora 横空出世,业界便掀起了一场「视频生成模型到底懂不懂物理规律」的争论。图灵奖得主 Yann LeCun 明确表示,基于文本提示生...……更多
程序员福音 英伟达推出AI编程新模型:代码生成、补全、调试样样精通!
程序员福音 英伟达推出AI编程新模型:代码生成、补全、调试样样精通!快科技2月29日消息,近日英伟达和Hugging Face、ServiceNow一起发布了StarCoder2模型,代码生成、补全、调试样样精通。据介绍,系列模型包括一个ServiceNow训练...……更多
林达华谈大模型发展之路:未来会有更高效的模型结构出现
大模型的上下文长度快速增长,超长上下文解锁新应用,但推理计算代价高昂,上下文本身对于信息不会进行压缩,不能直接捕捉其中的深层知识和规律。上海人工智能实验室领军科学家林达华。过去一年,人工智能领域风起...……更多
扩散模型版CS: GO!世界模型+强化学习:2小时训练登顶Atari 100K
...读】DIAMOND是一种新型的强化学习智能体,在一个由扩散模型构建的虚拟世界中进行训练,能够以更高效率学习和掌握各种任务。在Atari 100k基准测试中,DIAMOND的平均得分超越了人类玩家,证明了其在模拟复杂环境中处理细节和进...……更多
4轮暴训,Llama 7B击败GPT-4!Meta等让LLM「分饰三角」自评自进化
【新智元导读】Meta、UC伯克利、NYU共同提出元奖励语言模型,给「超级对齐」指条明路:让AI自己当裁判,自我改进对齐,效果秒杀自我奖励模型。LLM对数据的大量消耗,不仅体现在预训练语料上,还体现在RLHF、DPO等对齐阶段...……更多
RNN回归!Bengio新作大道至简与Transformer一较高下
...坛。然而,人们并没有忘记RNN。RWKV、Mamba、xLSTM等RNN衍生模型接连出现,欲挑战Transformer之霸主地位。就在近日,又有重量级人物下场——深度学习三巨头之一的Yoshua Bengio,带领团队推出了全新的RNN架构,以大道至简的思想与Tran...……更多
Nature封面:AI训AI 越训越傻
...响随后研究人员评估了模型崩溃对语言模型的影响。由于从头开始训练大模型成本非常高,他们选择评估语言模型最常见的设置:微调设置。每个训练周期都从具有最新数据的预训练模型开始。训练数据来自另一个经过微调的预...……更多
挑战Scaling Law,Meta发布移动端350M小模型MobileLLM,性能比肩7B LLaMA-v2
【新智元导读】Scaling Law还没走到尽头,「小模型」逐渐成为科技巨头们的追赶趋势。Meta最近发布的MobileLLM系列,规模甚至降低到了1B以下,两个版本分别只有125M和350M参数,但却实现了比更大规模模型更优的性能。从5月和6月...……更多
昆仑万维发布开源13B高质量商用大模型 领先Llama2和Baichuan2
10月30日,昆仑万维宣布开源百亿级大语言模型「天工」Skywork-13B系列,并配套开源了600GB、150B Tokens的超大高质量开源中文数据集。昆仑万维「天工」Skywork-13B系列目前包括130亿参数的两大模型:Skywork-13B-Base模型、Skywork-13B-Mat……更多
国内首个以国产全功能GPU为底座的大规模算力集群正式落地
...摩尔线程官方发布通告称,摩尔线程首个全国产千卡千亿模型训练平台,摩尔线程KUAE智算中心揭幕仪式成功举办。此举也代表着,国内首个以国产全功能GPU为底座的大规模算力集群正式落地。摩尔线程CEO张建中表示,摩尔线程...……更多
清华提出时间序列大模型:面向通用时序分析的生成式Transformer
【新智元导读】大模型在语言、图像领域取得了巨大成功,时间序列作为多个行业的重要数据类型,时序领域的大模型构建尚处于起步阶段。近期,清华大学的研究团队基于Transformer在大规模时间序列上进行生成式预训练,获得...……更多
4000亿参数,国产大模型硬刚Llama 3?|钛媒体AGI
...之后我们进行了转型,在海外大力做平台型业务,经我们从头孵化的大概千万级别DAU的互联网平台有4—5家左右,全部都与内容和社交赛道相关。所以我们一直对于内容生产领域的革新非常关注。在2020年GPT-3发布之后,我们非常...……更多
贾扬清:大模型尺寸正重走CNN的老路;马斯克:在特斯拉也是这样
Transformer大模型尺寸变化,正在重走CNN的老路!看到大家都被LLaMA 3.1吸引了注意力,贾扬清发出如此感慨。拿大模型尺寸的发展,和CNN的发展作对比,就能发现一个明显的趋势和现象:在ImageNet时代,研究人员和技术从业者见证...……更多
文生图参数量升至240亿!Playground v3发布:深度融合LLM,图形设计能力超越人类
【新智元导读】Playground Research推出了新一代文本到图像模型PGv3,具备240亿参数量,采用深度融合的大型语言模型,实现了在图形设计和遵循文本提示指令上甚至超越了人类设计师,同时支持精确的RGB颜色控制和多语言识别。自...……更多
微软华人领衔AI²BMD登Nature,AI生物分子模拟双突破!继AlphaFold后又一里程碑
...发的AI²BMD(AI-basedabinitiobiomoleculardynamics system,基于AI的从头算生物分子动力学系统)在Nature上发表,这一进展代表着在分子动力学模拟领域的显著突破。 论文地址:https://www.nature.com/articles/s41……更多
这才是真开源模型!公开后训练一切,性能超越Llama 3.1 Instruct
开源模型阵营又迎来一员猛将:Tülu 3。它来自艾伦人工智能研究所(Ai2),目前包含 8B 和 70B 两个版本(未来还会有 405B 版本),并且其性能超过了 Llama 3.1 Instruct 的相应版本!长达 73 的技术报告详细介绍了后训练的细节。在...……更多
苹果AI震撼上线iPhone,进化版Siri却没有ChatGPT!47页技术报告揭秘自研模型
...,一大波测评刷屏全网。更惊喜的是,苹果AI背后的基础模型47页技术报告,也一并上线了。一大早,人们期待已久的「苹果AI」首个预览版,正式向开发者们推送了!iOS 18.1、iPadOS 18.1、macOS Sequoia 15.1三大系统中,全都植入了苹...……更多
腾讯Angel机器学习平台获世界互联网大会领先科技奖
...年度领先科技奖。腾讯Angel 机器学习平台,突破了万亿级模型分布式训练和推理以及大规模应用部署等难题,率先实现大模型技术从底层硬件到关键软件技术的自主研发,在业务场景广泛应用,显著推动实体产业和数字经济发展...……更多
影响英伟达根本逻辑的大争论:OpenAI改变策略意味着什么?谁在撒谎?
大模型预训练“缩放定律”定律失效?模型推理成“解药”,英伟达一家独大格局要变天?“缩放定律”指导下,AI大模型预训练目前遭遇瓶颈。据路透12日报道,硅谷主要AI实验室的新模型训练计划目前普遍进展不顺,新模型...……更多
AI大模型有望再扩1000倍!剑桥耶鲁康奈尔:PNN是变革关键
...一新兴的前沿领域还鲜少有人涉足,但绝对值得深耕!AI模型再扩展1000倍的秘密可能就藏在这里。随着Scaling Law越来越成功,LLM的电力和算力消耗也逐渐达到了惊人程度。我们越来越难以想象,当前的模型规模如何能再扩大10倍...……更多
ai绘画侵权实锤,扩散模型可能记住你的照片
AI绘画侵权,实锤了!最新研究表明,扩散模型会牢牢记住训练集中的样本,并在生成时“依葫芦画瓢”。也就是说,像StableDiffusion生成的AI画作里,每一笔背后都可能隐藏着一次侵权事件。不仅如此,经过研究对比,扩散模型...……更多
OpenCity大模型预测交通路况,零样本下表现出色,来自港大百度
长时间交通状况预测,可以用大模型实现了。香港大学联合华南理工大学和百度,推出了长时间城市交通预测模型——OpenCity。而且泛化能力极强,可有效应用于广泛的交通预测场景。为了解决传统交通预测模型泛化性及长期预...……更多
商汤联合发布白皮书,首次提出新一代AI基础设施评估体系
...AI基础设施成为AI2.0时代“新基建”数据显示,过去四年,大模型参数量以年均400%复合增长,AI算力需求增长超过15万倍,远超摩尔定律。以CPU为中心的传统计算基础设施已无法满足大模型、生成式AI的新要求。大模型训练对数据质量和...……更多
更多关于科技的资讯:
合资轿车价格崩了!广汽本田雅阁裸车已降到11万多
快科技1月3日消息,据懂车帝报道,广汽本田4S店销售向其介绍,最低配的本田雅阁指导价17.98万元,现在优惠6万多元,优惠完裸车价只要11万多
2025-01-03 11:14:00
美国一小型飞机撞上建筑物:现场升起蘑菇云 已致2死多伤
快科技1月3日消息,据报道,当地时间1月2日,美国加利福尼亚州,一架小型飞机坠毁致两人死亡数十人受伤。事发时监控显示,一架小型飞机快速坠落至建筑物房顶
2025-01-03 11:14:00
让更多人“当狗”:日本扮狗男子建立扮狗动物园
快科技1月3日消息,据《纽约邮报》近日报道,日本男子托科此前花了200万日元(约合人民币10万元)定制真人大小的牧羊犬布偶装
2025-01-03 11:14:00
□ 双 木近年来,全球经济形势复杂多变,国内处于结构调整转型的关键期,同时受到房地产低迷的影响,厨电产业发展面临着一定的压力
2025-01-03 11:14:00
清华大学:92%毕业生在国内工作 出国深造的大多数已回国
1月3日消息,近日,2024届清华毕业生就业数据新鲜出炉,揭示了这一届学子的职业选择趋势与动向。根据官方数据,2024届清华毕业生中
2025-01-03 11:14:00
全国5000公里对讲!小米运动对讲机发布:399元
快科技1月3日消息,小米今天公布了一款户外神器——小米运动对讲机,目前已经开启预售,定价399元。外观方面,这款对讲机更像运动相机
2025-01-03 11:14:00
最近家居厨电行业营销玩出了创意“新花样”:知名家电品牌美的与火锅黑马赵美丽跨界联手,开了一家名为“美美与共”的火锅店,将传统美食与厨电产品创新融合
2025-01-03 11:14:00
山东联通和中国联通研究院携手中兴通讯成功部署地停场景qNCR方案
鲁网1月3日讯山东联通秉持建设网络强国与推动数字中国的初心,紧抓数字化浪潮与智慧城市发展的战略机遇,持续在技术领域锐意进取
2025-01-03 11:24:00
本文转自:人民网-广西频道人民网南宁1月2日电 (雷琦竣)1月2日,2025中国(南宁)航空航天国防科技展发布会在南宁国际会展中心举行
2025-01-03 11:34:00
2025年01月03日环洋市场咨询机构出版了一份详细的、综合性的调研分析报告【全球独立智能手表行业总体规模、主要厂商及IPO上市调研报告
2025-01-03 11:41:00
微信语音消息可倍速播放 客服:微信版本升级至8.0.55可用
快科技1月3日消息, 据报道,近日微信的一项新功能引起了广大网友的注意:微信的语音消息现已支持倍速播放。针对这一变化,腾讯客服回应称
2025-01-03 11:44:00
再造轿车旗舰 比亚迪汉L官宣:侧颜绝美
快科技1月3日消息,比亚迪汽车官宣全新旗舰轿车汉L,该车将定位20万级,预计提供插混和纯电两种动力。此次官方发布了该车的侧面预告图
2025-01-03 11:44:00
前所未有!科睿将推全球首款750Hz消费级显示器:24.5英寸
快科技1月3日消息,据报道,科睿(KOORUI)将在即将到来的CES 2025上推出全球首款750Hz刷新率的消费级显示器——KOORUI G7
2025-01-03 11:44:00
Solidigm退出消费市场:曾经闪亮的Intel SSD 完全消失
SSD刚刚兴起的时候,Intel还是一股很重要的力量,X-18M、X-25M都备受好评,后来又发展出了大名鼎鼎的Optane傲腾技术和产品
2025-01-03 11:44:00
vivo计划发布自己的第二子品牌“Jovi”
现在国产手机厂商基本都有自己的子品牌,如REDMI之于小米、一加之于OPPO、iQOO之于vivo。子品牌并不唯一,如小米在REDMI之外
2025-01-03 11:46:00