• 我的订阅
  • 头条热搜
国产大模型 DeepSeek-V3 开源:6710 亿参数自研 MoE
...(12 月 26 日)发布博文,宣布上线并同步开源 DeepSeek-V3 模型,用户可以登录官网 chat.deepseek.com,与最新版 V3 模型对话。IT之家援引博文介绍,DeepSeek-V3 是一个 6710 亿参数的专家混合(MoE,使用多个专家网络将问题空间划分为同...……更多
AI大模型行业报告:大模型发展迈入爆发期,开启AI新纪元(附下载)
技术:大模型发展呈现“规模定律”,Transformer为技术基座1.1 大模型“大力出奇迹”的背后:Scaling Law大规模语言模型(Large Language Models,LLM)泛指具有超大规模参数或者经过超大规模数据训练所得到的语言模型。与传统语言模...……更多
...人 、新加坡国立大学校长青年教授尤洋发表了题为《大模型训练的关键技术》的主题演讲。尤洋指出,庞大的AI模型规模对模型训练提出了挑战,现有的硬件设备已无法满足训练所需的大量计算资源和储存空间需求。为解决上述...……更多
...绩报告,财报指出:“腾讯混元已经发展成为领先的基础模型,在数学推导、逻辑推理以及多轮对话中性能卓越。”并首度披露腾讯混元采用混合专家模型结构,已扩展为万亿参数规模。自亮相以来,腾讯混元大模型持续迭代升...……更多
我国发布首个亿级参数量地震波大模型:名为“谛听”
...,据成都科技局官方公众号介绍,日前“谛听”地震波大模型在四川成都发布。“谛听”由国家超级计算成都中心、中国地震局地球物理研究所以及清华大学联合开发,是首个亿级参数量的地震波大模型。同时,“谛听”也是目...……更多
华为推出昇腾AI计算集群 可支持超万亿参数大模型训练 【华为推出昇腾AI计算集群 可支持超万亿参数大模型训练】《科创板日报》20日讯,华为今日推出全新架构的昇腾AI计算集群——Atlas 900 SuperCluster,可支持超万亿参数的大...……更多
chatgpt低成本复现流程来了
首个开源的ChatGPT低成本复现流程来了!预训练、奖励模型训练、强化学习训练,一次性打通。最小demo训练流程仅需 1.62GB 显存,随便一张消费级显卡都能满足了。单卡模型容量最多提升 10.3倍。相比原生PyTorch,单机训练速度最...……更多
全球首个!中国电信完成千卡、千亿参数模型500公里联合训练试商用
...、北京电信成功了 完成业内首个1024卡、千亿参数商用大模型的分布式联合训练真实用户试商用。通过天津市武清区到北京市大兴区瀛海镇之间的真实光路环回,实现了500公里长距互联分布式训练,而且训练性能达到单数据中心...……更多
天垓100率先完成百亿级参数大模型训练,天数智芯迎来新的里程碑
...院(以下简称“智源研究院”)70亿参数的Aquila语言基础模型,使用代码数据进行继续训练,稳定运行19天,模型收敛效果符合预期,证明天数智芯有支持百亿级参数大模型训练的能力。图 天数智芯产品线总监宋煜在北京市海淀...……更多
腾讯发布最大开源MoE模型,3890亿参数免费可商用
...家本领,来挤开源赛道,突然发布了市面上最大的开源MoE模型。Hunyuan-Large,3890亿总参数,520亿激活参数。跑分超过Llama 3.1 405B等开源旗舰,上下文长度支持也高出一档来到256k。虽然Hunyuan-Large还不算腾讯内部的旗舰模型,但腾讯...……更多
360智脑7b参数模型采用3.4万亿tokens训练
...12日消息,360公司日前在GitHub上开源了360智脑7B(70亿参数模型)。360智脑大模型采用3.4万亿Tokens的语料库训练,以中文、英文、代码为主,开放4K、32K、360K三种不同文本长度。360表示,360K(约50万字)是当前国产开源模型文本长...……更多
小米AI大模型MiLM-6B首次曝光:64亿参数量,此前称不单独做ChatGPT|钛快讯
...在小米公司CEO雷军演讲前夕,其研发的人工智能(AI)大模型产品悄然现身。钛媒体App获悉,8月11日,小米公司开发的大规模预训练语言模型 MiLM-6B/1.3B登陆代码托管平台GitHub,参数规模最高达64亿,而且现身在C-Eval、CMMLU基准评...……更多
GPT-4被破解 训练成本 模型架构的秘密都被挖出来了?
...字节跳动、百度等在短期内都将拥有与 GPT-4 一样强大的模型。不要误解我们的意思,OpenAI 拥有令人惊叹的工程技术,他们构建的东西令人难以置信,但他们得出的解决方案并不神奇。这是一个优雅的解决方案,具有许多复杂的...……更多
微软推出14b参数“最先进”小型语言模型
...13日消息,微软今天宣布推出14B参数“最先进”小型语言模型(SLM)Phi-4,除了传统的语言处理外,它还擅长数学等领域的复杂推理。Phi-4是Phi系列小型语言模型的最新成员,官方表示其展示了微软继续探索SLM边界的可能性。官方...……更多
马斯克承诺开源版大模型 来了!Grok-1:3140亿参数迄今最大,权重架构全开放
...之心开源社区有福了。说到做到,马斯克承诺的开源版大模型 Grok 终于来了!今天凌晨,马斯克旗下大模型公司 xAI 宣布正式开源 3140 亿参数的混合专家(MoE)模型‘Grok-1’,以及该模型的权重和网络架构。这也使得Grok-1成为当...……更多
马斯克官宣Grok-2测试版!xAI将继续拥抱开源路线吗?
继旗下xAI公司宣布正式开源大模型Grok-1后,特斯拉CEO马斯克再次在大模型市场扔下一颗重磅炸弹。当地时间8月11日晚,马斯克在X平台上透露人工智能模型Grok-2测试版将在不久后发布。事实上,马斯克在7月份就在X平台上确认,Gr...……更多
微软专利提出生物+硬件联合评估优化AR/VR眼动追踪系统
...置109来估计摄像头101的一个或多个硬件参数。这可以使用模型和其他预定值来估计。如前所述,可以联合进行摄像头101的一个或多个硬件参数的估计和生物参数的估计,从而优化眼动追踪。这种联合估计使得设备能够生成定义眼...……更多
国产首台GPU千亿参数大模型训推一体机发布,优刻得提供灵活算力部署方案
...称“沐曦”)、智谱华章共同发布国产首台GPU千亿参数大模型训推一体机。国产首台GPU千亿参数大模型训推一体机发布仪式优刻得与沐曦、智谱华章共同在宁夏的开放平台上面向第一批用户:航天医院、数字宁夏建设运营有限公...……更多
阿里推出全新推理模型:仅1/21参数媲美DeepSeek R1
...里Qwen团队正式发布他们最新的研究成果——QwQ-32B大语言模型。这是一款拥有320亿参数的模型,其性能可与具备6710亿参数(其中370亿被激活)的DeepSeek-R1媲美。QwQ-32B在仅有DeepSeek-R1约1/21参数量的情况下,用强化学习实现了性能上...……更多
...:德宏团结报性能提升30%!中国电信进一步开源12B星辰大模型本报讯 近日,中国电信开源12B参数规模星辰语义大模型TeleChat-12B,相较1月开源7B版本,内容、性能和应用等方面整体效果提升30%,其中,多轮推理、安全问题等领域...……更多
20亿参数!谷歌发布轻量级开源人工智能模型Gemma
...CNMO新闻】近日,谷歌发布了其首个重要的开源大型语言模型Gemma,这标志着自从OpenAI的ChatGPT引领了人工智能聊天机器人热潮以来,在2022年取得了重要突破。Gemma是由谷歌DeepMind和其它团队共同开发的,旨在为开发人员和研究者提...……更多
中国石油获得发明专利授权:“地震储层参数预测方法及装置”
...:将目标地层的地震数据,输入预先建立的储层参数预测模型中,得到目标地层的多个地震储层参数;储层参数预测模型按照如下过程建立:获取目标地层的地震工区资料,形成训练数据集;基于人工神经网络模型搭建多任务学...……更多
AI大模型“国标”首批测试结果公布,人工智能成市场新焦点
12月22日,国内首个官方“大模型标准符合性评测”结果公布,百度文心一言、腾讯混元大模型、360智脑、阿里云通义千问四款国产大模型首批通过测试。测试结果称,上述四款模型符合《人工智能大规模预训练模型第2部分:评...……更多
腾讯正式发布混元大模型,号称拥有超千亿的参数规模
...办的2023腾讯全球数字生态大会上,腾讯正式发布混元大模型,号称拥有超千亿的参数规模、超2万亿tokens的预训练语料。在发布会上,腾讯宣布混元大模型今日起对外开放,用户可通过腾讯云进行体验,支持直接调用API接口,或...……更多
腾讯字节“硬碰硬”
近期相继在AI大模型上发力的腾讯和字节,仍然对上一个风口元宇宙抱有期待。据媒体爆料,Meta正在与中国科技厂商洽谈,计划将其VR头显Quest推向中国市场,腾讯则有望成为Quest的国内独家经销商。截至发稿,腾讯对此消息尚...……更多
...自:文汇报 本报讯 国内首个千亿参数多模态金融大模型——“财跃F1金融大模型”于昨天在2024全球开发者先锋大会上正式发布。这款由上海财跃星辰智能科技有限公司研发的金融大模型,基于万亿级金融语料预训练,具备...……更多
大模型这把大火,烧到了手机领域
配图来自Canva可画AI大模型从年初一直火到了年尾,但似乎离普通人还有些距离。不过,现在情况似乎有了一些变化,各大手机厂商们,正在争先恐后地把大模型装进手机里,让AI变得“触手可及”。在很多人看来,手机厂商入...……更多
5620亿参数!谷歌发布史上最大“通才”ai模型
...大学的一组人工智能研究人员推出了史上最大的视觉语言模型——PaLM-E,参数量高达5620亿(GPT-3的参数量为1750亿)。PaLM-E是迄今为止已知的最大VLM(视觉语言模型)。作为一种多模态具身VLM,它不仅可以理解图像,还能理解、...……更多
没有这些,别妄谈做 ChatGPT 了
...在用行动来表明战斗力,比如前些天复旦大学推出的 MOSS 模型,一经开放试用,便冲上热搜。一时间眼花缭乱,让人生疑。有钱就能训出模型?以美团大佬带资入组为代表,很多创业者和投资人盯上了 ChatGPT,作为一个 NLPer,我...……更多
比Stable Diffusion便宜118倍!1890美元训出11.6亿参数高质量文生图模型
...研究人员,利用延迟掩蔽、MoE、分层扩展等策略,将扩散模型的训练成本降到了1890美元。训练一个扩散模型要多少钱?之前最便宜的方法(Wuerstchen)用了28400美元,而像Stable Diffusion这样的模型还要再贵一个数量级。大模型时代...……更多
更多关于科技的资讯:
DeepSeek App重磅更新:支持对话内容生成分享图功能
8月14日,根据手机应用商店显示,DeepSeek App发布了1.3.0版本更新,支持对话内容生成分享图功能。更新之后
2025-08-14 12:00:00
飞猫 5G 旗舰新品随身 WiFi 登场 解锁极速网络新姿势
近年来,5G网络如潮水般席卷而来,从实验室走向千家万户,深刻改变着人们的生活与工作方式。它让远程办公的视频会议清晰如面对面交谈
2025-08-14 07:31:00
何以中国·和合共生 撰稿:谷悦拍摄:刘岩制作:刘岩谷悦监制:李华楠协助单位:意风区资产经营管理有限公司天津海河意式风情区管理委员会
2025-08-14 07:38:00
洞门新秀FOSA的逆袭之路:OnSys系统如何撼动Crocs霸主地位
当洞洞鞋市场被贴上“丑萌”“功能单一”标签时,一个德国基因与中国智造融合的品牌正以三重缓震科技撕开行业裂缝。技术革命:OnSys系统颠覆传统脚感2025年全球洞洞鞋市场规模达142亿美元
2025-08-14 07:38:00
无人车上卖零食,路边招手就可买
8月13日,小巧的零售型无人车正沿着中新南京生态科技岛江岛智立方园区的步道平稳前行,车内放着琳琅满目的零食与饮品。零售型无人车具备L4级自动驾驶能力
2025-08-14 07:44:00
赋予“触觉神经” 推动人形机器人“进化”宁企在六维力传感器行业脱颖而出,获超2亿元战略注资南报网讯(记者张希)8月11日
2025-08-14 07:45:00
南报网讯(记者祝东秀)8月13日,“服务护航促发展·携手同行筑未来”2025年军创企业AI智能专项服务日活动在建邺区政务服务中心举行
2025-08-14 07:45:00
助企业“零代码”写应用、帮警方“大数据”破案、替用户“点对点”营销,雨花台区——大模型“七剑出鞘”,国家级备案数领跑□南京日报/紫金山新闻记者于洁尘今夏
2025-08-14 07:46:00
厦门网讯(厦门日报记者 李晓平)近日,2025年度福建省数字经济核心产业创新企业名单出炉,全省共有350家企业入选省级“独角兽”“未来独角兽”“瞪羚”企业
2025-08-14 07:53:00
中新经纬8月13日电 国新办13日就个人消费贷款贴息政策和服务业经营主体贷款贴息政策有关情况举行新闻发布会。财政部金融司司长于红在会上表示
2025-08-13 12:12:00
阅文上半年归母净利同比大增68.5%,短剧爆款率超60%
8月12日,阅文集团(股票代码:0772.HK,以下简称“阅文”)公布2025年中期业绩。业绩公告显示,2025年上半年阅文实现收入31
2025-08-13 12:27:00
TT Club与BSI Consulting呼吁加强墨西哥地区货物运输的安全措施
全球领先的运输与物流保险机构TT Club与供应链战略风险咨询机构BSI Consulting,在其关于墨西哥货运犯罪的报告发布后
2025-08-13 12:31:00
杰安易购平台海外代购上线 全球好物筑跨境新体验
2025年3月,创新型综合电商平台杰安易购商城宣布其备受期待的“海外代购”功能正式上线运营。此次海外代购功能以“正品直连
2025-08-13 12:31:00
“经纬千年·丝路新章”:“丝绸苏州2025”十周年特展新闻发布会在苏举行
(2025年8月初,中国苏州) ——今日,“丝绸苏州2025”十周年特展新闻发布会在苏州中国丝绸档案馆隆重举行。“丝绸苏州2025”十周年特展以“经纬千年·丝路新章”为主题
2025-08-13 12:31:00
18家企业共同打造我省首个工业设计产业集聚区|设计创新赋能“贵州造”
8月4日,在贵州工业设计城的展厅里,工作人员马国荣拿起一个浅灰色酒类包装盒向记者介绍,“你试试手感是不是比较轻,因为内托是竹纤维的
2025-08-13 12:52:00