• 我的订阅
  • 头条热搜
连续无故障训练15天!摩尔线程发布夸娥智算集群KUAE 1.2
...上多维升级,更高效、稳定,对生态系统更友好,可为大模型训练提供更坚实可靠的算力支撑。夸娥1.2主要升级点:▼MFU提升10% 最高可达55%在新版本中,使用千卡集群训练千亿模型,MFU(模型算力利用率)提升10%。稠密模型集群训...……更多
智谱AI新大模型来袭:部署价格大降50%,免费商用,做应用能力逼近GPT3.5 | 最前线
...开幕的中国计算机大会(CNCC)上,最受瞩目的仍然是大模型。这场计算机领域的“春晚”汇集了百度CTO王海峰、科大讯飞副总裁刘聪、蚂蚁集团副总裁徐鹏、滴滴CTO张博等几位横跨学界和业界的企业家们。除了探讨AI的技术成果...……更多
本文转自:新华网12月1日,阿里云通义千问720亿参数模型Qwen-72B宣布开源。该模型基于3T tokens高质量数据训练,在10个权威基准测评中夺得开源模型优异成绩。基于Qwen-72B,大中型企业可开发商业应用,高校、科研院所可开展AI fo...……更多
Meta版Sora深夜横空出世,小扎放出16秒高清大片!92页论文曝光技术细节,Llama 3架构立功
...、上传图像生成个性化视频。甚至Meta还放出了92页论文,模型架构、训练细节一并公开,干货满满!毫无预兆地,Meta版Sora——Movie Gen,就在刚刚抢先上线了!Meta将其称为「迄今最先进的媒体基础模型」。全新上线的大杀器Movie ...……更多
Sora这就落伍了?Meta“最强视频模型”不用DiT,用Llama大力出奇迹了
...量问题而导致难产的节骨眼,Meta毫不客气发了它的视频模型“Movie Gen”,并直接用一个完整的评测体系宣告自己打败了Sora们。而且更狠的是,Meta还“杀人诛心”,虽然这模型目前和Sora一样还没对外开放,但它把新模型的95页技...……更多
英伟达发布GB200计算卡:2080亿个晶体管,AI性能提升5倍
...算卡的算力还远远不够,尤其是像Sora这样的文生视频的模型出来,更是对计算卡的算力提出了更高的要求,于是英伟达也适时地推出了下一代GPU,在AI性能上有着突飞猛进的进步,可以说拉了竞争对手整整一代。英伟达在今天凌...……更多
大模型推理乘上RISC-V快车?国内AI芯片创企推大模型系列一体机
...算力需求大爆发的转折之年,如今随着国内两批超20个大模型获得审批、种类多样的大模型相关应用显现,企业对私有化部署的需求也水涨船高。面向这一行业趋势,2023年世界互联网大会乌镇峰会上,国内云端RISC-V大芯片创企希...……更多
MSRA:视觉生成六大技术问题
...进行了梳理,他认为视觉信号拆分是最本质的问题。生成模型的目标是拟合目标数据分布,然而,目标数据分布过于复杂,难以直接拟合。因此,往往需要将复杂的信号做拆分,拆分成多个简单的分布拟合问题,再分别求解。信...……更多
摩尔线程与360达成战略合作,将共同打造“360智脑大模型一体机”
...双方此次合作旨在聚焦数字安全、信息与数字化服务及大模型等领域的创新应用,共同构建一个更加强大、可靠的人工智能生态系统,为各行各业提供先进的技术支持和服务。双方还将携手打造“360 智脑大模型一体机”,加速...……更多
LeCun 的世界模型初步实现!基于预训练视觉特征,零样本规划
...Yann LeCun 批评 LLM 的推文之一相反,他更注重所谓的世界模型(World Model),也就是根据世界数据拟合的一个动态模型。比如驴,正是有了这样的世界模型,它们才能找到更省力的负重登山方法。近日,LeCun 团队发布了他们在世界...……更多
前谷歌工程师创业造AI芯片!产品明年问世,已拿到1.8亿融资
...芯片的集群。这样的能力使得大部分创企都有能力和成本从头开始训练一个大模型GPT-4,并获得ChatGPT级别的流量服务。MatX在官网介绍,它能为世界上最大的模型提供10倍以上的计算能力,使大模型更智能、更加有用。彭博社称,...……更多
开源大模型的ChatGPT时刻?备受期待的Llama 3 405B即将发布
...顶配,405B版本拥有4050亿个参数,是迄今为止最大的开源模型之一。昨夜凌晨,META突发Llama 3.1-405B评测数据的泄漏事件,有网友预计可能还会同时发布一个Llama 3.1-70B版本,因为“(模型提前泄露)是META的老传统了,去年的Llama模...……更多
通义千问系列AI开源模型升至Qwen2:5个尺寸,最高 128K tokens
...息,通义千问(Qwen)今天宣布经过数月的努力,Qwen 系列模型从 Qwen1.5 到 Qwen2 的重大升级,并已在 Hugging Face 和 ModelScope 上同步开源。IT之家附上 Qwen 2.0 主要内容如下:5 个尺寸的预训练和指令微调模型,包括 Qwen2-0.5B、……更多
算力市场格局生变,谁能“拔得头筹”?
...源人工智能研究院发布了全球首个单体稠密万亿参数语义模型Tele-FLM-1T,成为国内首批发布稠密万亿参数大模型的机构。针对大模型训练算力消耗高的问题,TeleAI与智源基于模型生长和损失预测等关键技术联合研发出的Tele-FLM系...……更多
首个国产单池万卡液冷算力集群投入运营,满足万亿级大模型训练需求
...展正在进入“深水区”。随着生成式AI的迭代和发展,大模型规模以惊人的速度扩展,万亿参数级别几乎成为通用大模型的标配,由此带来的是算力需求的急剧增长。作为践行《新型数据中心“算力浦江”行动计划(2022-2024年)...……更多
...、文本和视频编码为一个离散空间,在多模态混合序列上从头开始联合训练一个Transformer。智源研究院院长王仲远表示,Emu3为构建多模态通用人工智能提供了广阔的技术前景,有机会将基础设施建设收敛到一条技术路线上,为大...……更多
CMU&清华:让LLM自己合成数据来学习,特定任务性能同样大幅提升
...赵晨阳,卡内基梅隆大学硕士生贾雪莹。虽然大规模语言模型(LLM)在许多自然语言处理任务中表现优异,但在具体任务中的效果却不尽如人意。为了提升模型在特定自然语言任务上的表现,现有的方法主要依赖于高质量的人工...……更多
李开复AI公司首发大模型,阿里云领投 | 36氪独家
...复成立的AI公司“零一万物”发布了首款开源中英双语大模型“Yi”。与此同时,36氪获悉,零一万物已完成新一轮融资,由阿里云领投。目前,零一万物估值已超10亿美元,跻身独角兽行列。此前,“Yi”于11月2日已经在Hugging Fac...……更多
一块GPU都没用,苹果自研大模型干翻GPT-4?
...,上线Apple Intelligence的首个版本,同时47页的苹果自研大模型技术报告重磅发布。Apple Intelligence首个版本上线了以下AI功能:1、Siri升级。Siri唤醒后具备屏幕边缘发光特效,能理解用户表述不通顺的指令,且能回答关于苹果产品...……更多
电力大模型:“聊、查、图、写”样样精通
...办法》正式施行已近两个月,“百模大战”不断升级。大模型具有海量的参数、复杂的算法和强大的训练能力,在电力、生物医药、网络安全等领域不断落地应用。为此,本版推出特别策划,展现大模型赋能千行百业的前景。◎...……更多
谢赛宁新作:表征学习有多重要?一个操作刷新SOTA,DiT训练速度暴涨18倍
...分认识并认可了表征学习的重要性,那么视觉领域的生成模型呢?最近,谢赛宁团队发表的一篇研究就拿出了非常有力的证据:Representation matters!扩散模型如何突破瓶颈? 成本高又难训练的DiT/SiT模型如何提升效率?对于这个问...……更多
70倍极致压缩!大模型的检查点再多也不怕
...ICCV、ECCV等顶会上有多项代表性工作发表,在高效大语言模型、视觉模型等领域都有丰富的成果产出,和知名高校和科研机构合作广泛。大模型作为当下 AI 工业界和学术界当之无愧的「流量之王」,吸引了大批学者和企业投入资...……更多
本文转自:经济参考报“随着AI从1.0进入2.0大模型技术阶段,我们迎来了有史以来最重要的科技革命和平台革命。”零一万物CEO、创新工场董事长李开复日前在接受记者采访时表示,算力作为AI 2.0发展的关键环节,需要采用更务...……更多
替代NVIDIA,摩尔线程&无问芯穹联手首次实现国产GPU端到端AI大模型实训
...出大招,联合宣布正式完成MT-infini-3B 3B(30亿参数)规模大模型的实训,而使用的平台就是摩尔线程国产全功能GPU MTT S4000组成的千卡集群,以及无问芯穹的AIStudio PaaS平台。这次实训充分验证了夸娥千卡智算集群在大模型训练场景下...……更多
GPU训Llama 3.1疯狂崩溃,竟有大厂用CPU服务器跑千亿参数大模型?
【新智元导读】是时候用CPU通用服务器跑千亿参数大模型了!马斯克19天建成由10万块H100串联的世界最大超算,已全力投入Grok 3的训练中。与此同时,外媒爆料称,OpenAI和微软联手打造的下一个超算集群,将由10万块GB200组成。...……更多
山东财经大学公共管理大模型训练雁阵计划启动
...大学公共管理学院数字化教育教学能力提升暨公共管理大模型训练雁阵计划启动仪式举行。山东财经大学公共管理学院院长贾海彦在致辞中表示,学院一直高度重视现代信息技术在公共管理学科领域的应用,在人工智能技术快速...……更多
中国也有Sora同款训练架构公司,清华班底,智谱也投了 | 36氪首发
...雨编辑 | 邓咏仪全球首家发布Sora同款底层架构的清华系模型公司,近期完成了新一轮融资。投资名单中,也出现了大模型独角兽智谱AI的身影。36氪获悉,近日多模态AI模型公司生数科技完成新一轮数亿元融资。该轮融资由启明...……更多
谷歌员工曝AI改进速度放缓,Gemini已成立新团队解决问题
...为提升其聊天机器人产品Gemini的性能而努力,该公司希望模型性能提升的速度可以与去年相当,这促使研究人员专注于其他方法来勉强取得效果。这种情况和OpenAI的遭遇类似。此前有报道称,OpenAI模型性能提升速度有所放缓,该...……更多
Llama3训练每3小时崩一次?豆包大模型、港大为脆皮万卡训练提效
伴随大模型迭代速度越来越快,训练集群规模越来越大,高频率的软硬件故障已经成为阻碍训练效率进一步提高的痛点,检查点(Checkpoint)系统在训练过程中负责状态的存储和恢复,已经成为克服训练故障、保障训练进度和提...……更多
突破遥感基础模型关键技术!我国科研人员研发出遥感智能训推一体机
随着我国空天信息和人工智能技术的持续发展,基础模型已成为遥感智能解译领域的有效解决方案。然而,遥感单幅影像幅宽大、基础模型参数规模大,导致推理速度与应用场景较为受限。近日,中国科学院空天信息创新研究...……更多
更多关于科技的资讯:
苹果iphone17系列样机曝光:背部三摄排列不变
1月2日,数码博主@数码闲聊站透露了苹果iPhone17系列样机的一些细节。他说,新机背部设计引入了一个横向的大矩阵玻璃装饰
2025-01-03 10:44:00
大模型行业资本暗流涌动,10亿元融资成入局门槛?
2024年,大模型发展势头依旧强劲,能力边界不断突破,不仅强化了自然语言处理能力,还在文生视频、辅助编程、数学推理等复杂领域攻城略地
2025-01-03 10:45:00
又添5城!万师傅“当日装”服务深度赋能行业提速
近日,万师傅“当日装”服务新增上线成都、杭州、南京、苏州、天津5座城市,覆盖家具、卫浴领域等多个品类,即时解决用户紧急安装需求
2025-01-03 10:45:00
鑫住工乡墅全面升级供应链,打造全渠道高效建材方案
随着供应链全渠道时代的到来,市场需求变动迅速,企业要想在激烈的竞争中脱颖而出,必须具备强大的供应链整合能力。 (鑫住工乡墅&
2025-01-03 10:45:00
解锁海创汇2024关键词——自生长、赋能、未来
本文转自:人民网-山东频道时光流转,2024年已然落下帷幕。这一年,是科技迅速更迭与创新力量涌现的年份。置身于这一变革大潮中
2025-01-03 11:03:00
华为云HCDG城市行2024全国收官之作桂林站圆满结束
本文转自:人民网-广西频道参会人员合影。华为云供图2024年12月29日,华为云HCDG城市行·桂林站——“鸿蒙开启国产操作系统新纪元与开发者的新机遇”技术沙龙在桂林华为信息产业生态合作区青网科技园圆满举办
2025-01-03 11:05:00
巅峰一号避孕套:品质之巅,愉悦之源
巅峰一号避孕套:品质之巅,愉悦之源在两性健康领域,避孕套一直是备受关注的重要产品。而巅峰一号避孕套以其卓越的品质、独特的设计和出色的性能
2025-01-03 11:06:00
美媒:无需连接手机即可干预吸烟行为,智能手表应用程序成“戒烟助手”
本文转自:环球时报【环球时报综合报道】据雅虎新闻网1日报道,一款新开发的智能手表应用程序将成为“戒烟助手”,无需连接手机就能进行自动提醒
2025-01-03 11:07:00
本文转自:人民网人民网北京1月3日电 (记者许维娜)记者从国家数据局了解到,为凝聚广泛共识,推动数据领域相关知识的规范普及
2025-01-03 11:13:00
用生态产业链助力家装行业 共同走进AI时代
□ 本报记者 陆 俊2024第十届土巴兔生态大会近日在四川成都隆重开幕。2024年的土巴兔生态大会以“数智驱动 生态共赢”为主题
2025-01-03 11:13:00
合资轿车价格崩了!广汽本田雅阁裸车已降到11万多
快科技1月3日消息,据懂车帝报道,广汽本田4S店销售向其介绍,最低配的本田雅阁指导价17.98万元,现在优惠6万多元,优惠完裸车价只要11万多
2025-01-03 11:14:00
美国一小型飞机撞上建筑物:现场升起蘑菇云 已致2死多伤
快科技1月3日消息,据报道,当地时间1月2日,美国加利福尼亚州,一架小型飞机坠毁致两人死亡数十人受伤。事发时监控显示,一架小型飞机快速坠落至建筑物房顶
2025-01-03 11:14:00
让更多人“当狗”:日本扮狗男子建立扮狗动物园
快科技1月3日消息,据《纽约邮报》近日报道,日本男子托科此前花了200万日元(约合人民币10万元)定制真人大小的牧羊犬布偶装
2025-01-03 11:14:00
□ 双 木近年来,全球经济形势复杂多变,国内处于结构调整转型的关键期,同时受到房地产低迷的影响,厨电产业发展面临着一定的压力
2025-01-03 11:14:00
清华大学:92%毕业生在国内工作 出国深造的大多数已回国
1月3日消息,近日,2024届清华毕业生就业数据新鲜出炉,揭示了这一届学子的职业选择趋势与动向。根据官方数据,2024届清华毕业生中
2025-01-03 11:14:00