• 我的订阅
  • 头条热搜
腾讯开源最大MoE大语言模型!3D大模型同时支持文/图生成,晒混元模型及应用全家桶
...型,MoE模型在相同成本下效果更优,在相同规模下训练/推理成本更低,而且容量大,可训练更多数据。当前MoE的挑战有训练稳定性差、专家负载不均衡等。 一些应对方案包括:1)Scaling Law探索,设计基于中小模型簇的MoE Scaling ...……更多
Meta提出“可持续思维链”,让大模型在连续潜空间中推理
...ta 提出“可持续思维链”:让大语言模型在连续潜空间中推理GameArena:通过实时电脑游戏评估 LLM 推理想要第一时间获取每日最新大模型热门论文? 点击阅读原文,查看「2024必读大模型论文」合集,以及申请加入「大模型技术...……更多
质量超越o1,UCSD张怡颖教授团队开源生成式AI工作流自动优化器
...ble)(外循环):构建并结合多个模块来完成任务。 多步推理 (Multi-step Reasoning)(内循环):要求 LLM 逐步推理。 少样本学习 (Few-shot Learning)(内循环):从输入样本中添加一些高质量的示例演示。 模型选择 (Model SelectioN……更多
半年冒出近百家新公司,「具身智能」也有春天 | 36氪新风向
...背景、投资方的偏好有关。北方的项目大多孵化于高校(清华、北大、中科大、北航、北理工等等),从高校实验室出发,再延伸到产业界。通用人形机器人这种“大而全”的理想,一般更容易孵化于高校实验室。“北京投资人...……更多
现在,小米算全球科技巨头了吗
...车及AI等创新业务”。这和上个月底小米开源的首个端侧推理大模型MiMo-7B关系不小。据称,它在数学和代码能力上有所突破,性能超越OpenAI闭源推理模型o1-mini,以及阿里巴巴开源推理模型QwQ-32B-Preview。此前,小米从DeepSeek挖人的...……更多
阿里CEO吴泳铭:AI计算正在加速演进,成为计算体系的主导
...会变成智能机器人。5、未来几乎所有的软硬件都会具备推理能力,它们的计算内核将变成GPU AI算力为主、CPU传统计算为辅的计算模式。6、过去一年,阿里云投资新建了大量的AI算力,但还是远远不能满足客户的旺盛需求。7、人...……更多
大模型下沉,汽车需要存算一体芯片|超级观点
...模型,且训练需求越来越大。应用生态逐渐成熟,大模型推理的算力需求上涨,算力增长速度与算力供给速度会出现极大不平衡。IDC 数据预测,到2026 年,中国在人工智能硬件市场的IT 投资将超过150 亿美元。而AMD CEO苏姿丰在发...……更多
LLM仍然不能规划,刷屏的OpenAI o1远未达到饱和
...模型,一举创造了很多历史记录。o1 模型拥有真正的通用推理能力。在一系列高难基准测试中展现出了超强实力,相比 GPT-4o 有巨大提升,让大模型的上限从「没法看」直接上升到优秀水平,不专门训练直接数学奥赛金牌,甚至...……更多
不仅开源还便宜好用,硅谷员工直呼“火烧屁股”的DeepS...
...20日,量化巨头幻方量化旗下大模型公司DeepSeek正式发布推理大模型DeepSeek-R1。作为一款开源模型,R1在数学、代码、自然语言推理等任务上的性能能够比肩OpenAI o1模型正式版,并采用MIT许可协议,支持免费商用、任意修改和衍生...……更多
腾讯Angel机器学习平台获世界互联网大会领先科技奖
...腾讯Angel 机器学习平台,突破了万亿级模型分布式训练和推理以及大规模应用部署等难题,率先实现大模型技术从底层硬件到关键软件技术的自主研发,在业务场景广泛应用,显著推动实体产业和数字经济发展,提升社会效率。...……更多
圆桌对话:软件还是硬件——人工智能的下一个热点 | 36氪2025AI Partner百业大会
...的时候也会发现他们各有所长,可以 “按需选模型”:推理用 DeepSeek,长文本用 KIMI,语音用火山引擎豆包,不绑定单一模型。另外,今年资本市场更理性,投资人更愿意投 “强行业背景 + 强工程能力” 的项目,比如字节中高...……更多
清华量子计算成果登顶刊,来自丘成桐数学中心团队
...领域首次发现!噪声会造成量子优势突然消亡。这是来自清华大学丘成桐数学科学中心助理教授魏朝晖团队的最新研究成果,刚刚登上Science子刊。(相关成果以“关联生成中量子优势的突然消亡”为题发表于综合性子刊Science Adv...……更多
科学家提出情景学习新范式,让学霸大模型向学弱大模型输送能力
...十亿左右。“做大”,能让大模型具备更强的涌现能力和推理能力,从而适用于难度更高的任务。“做小”,能让大模型获得更优秀的推理能力,从而能被部署到手机、手表、耳机、录音笔等各类小微终端之中。情景学习(ICL,...……更多
自动驾驶技术普及,仍需迈过成本关口|CES 2024
...识别能力。在谈及芯片技术时,杨宇欣区分了训练芯片与推理芯片的不同用途,训练芯片用于生成大模型,而推理芯片用于端侧的实时计算。而在未来发展中,会有面向特定场景的垂直大模型出现,这需要推理芯片在端侧进行高...……更多
高通自研CPU架构要上手机!软硬全家桶亮相China Joy,对话高管:解密生成式AI杀手锏
...以直接通过语音跟AI队友进行交流。据了解,很多端侧的推理都放在了三代高通骁龙8的NPU上,这降低了推理的延迟,让玩家可以有更流畅的游戏体验,据称最长响应时长也在1秒以内。当然,这样的端侧AI推理也可以降低成本,让...……更多
「学术版ChatGPT」登场!Ai2打造科研效率神器OpenScholar,让LLM帮你搞定文献综述
...78%~90%。 检索增强(retrieval-augmented)的语言模型可以在推理时检索并集成外部知识源,从而缓解上述问题。然而,许多此类系统依赖于黑盒API或通用的LLM ,既没有针对文献综合的任务进行优化,也没有搭配适合科研的开放式...……更多
智汇金陵 共探AI未来:开发者圈层沙龙·南京站圆满举行
...专家骆秀韬深度解析了DeepSeek R1,其通过强化学习具备强推理和“自我反思”能力。他建议企业根据需求选择推理类模型,并利用小模型蒸馏降本增效,同时介绍了星河社区提供的DeepSeek R1 API服务及免费模型部署资源。 百度飞桨...……更多
掰开安卓手机 满屏都是三个字:大模型
...的内存单元,是大模型进手机面临的第二道难关:大模型推理需要大量计算资源做支撑,与此同时,内存大小决定了数据处理速度的上限以及推理的稳定性。另外,在手机上跑大模型,也给电池带来了更大的压力。因此芯片能耗...……更多
Anthropic再反击!发布Claude 3.5吊打GPT-4o,视觉、逻辑推理等方面表现更强
...本Claude 3.5 Sonnet。从官方披露的测试数据来看,其在逻辑推理、编程、数学等方面中的表现性能均超越GPT-4o。网友直言,“太卷了,现在AI竞争是要以周为单位了吗?” 从官方介绍来看,Claude 3.5全家桶仍会有3款系列模型,分别...……更多
算子开发到推理加速,一位00后开发者的“升级打怪”之旅
...框架降低了大模型训练的门槛,目前正在做大模型分布式推理加速,希望可以帮助其他开发者在生产环境中高效部署在线推理服务。在昇腾AI的生态里,像郑辉这样为大模型浪潮默默贡献自己力量的开发者不胜枚举。他们还不是...……更多
商汤科技sensetime推出“云端边”全栈大模型体系
...的指导下,会持续探索大模型能力的KRE三层架构(知识-推理-执行),不断突破大模型能力边界。”“日日新SenseNova5.0”性能超越GPT-4 Turbo:文理双修能力大幅提升,新增多模态交互自去年4月首次发布,商汤“日日新SenseNova”大...……更多
英伟达SC24六大技术亮点,不止加速超算500强
...快数据处理的cuPyNumeric、生物医药开源框架BioNeMo、新材料推理器NVIDIA ALCHEMI NIM微服务、气候预测平台Earth-2 NIM、CUDA-Q平台以及实现数字孪生的Omniverse Blueprint,为学术界和产业界提供更多支持,推动量子计算、药物发现以及新材……更多
一年投入数十亿,手机厂商抢滩大模型 | 焦点分析
...高的要求。一般而言,大模型肯定是越大越好,这代表着推理结果会越精确,但是,手机的内存、核心处理器的计算能力却是有限的。36氪了解到,1B的数据在手机上会占用1个G的内存,7B则会占用4G内存,而当数据量达到13B,内...……更多
优刻得首个「国产千卡智算集群」落地,支持智源千亿大模型训练
...环境,可支持超千卡规模、千亿参数级别的大模型训练和推理任务,旨在突破算力瓶颈,加速AI算力的国产化进程。国产千卡智算集群采用软硬件一体化的架构设计,提供低延迟、高吞吐、高可用的IB组网环境,支持GDR技术,使...……更多
...水电大模型研发及其应用项目技术方案专家论证评审会在清华大学召开。由清华大学水利系牵头,联合清华大学计算机系、清华大学地学系、国能数智科技大数据服务有限公司、北京智谱华章科技有限公司组建了跨学科研究团队...……更多
...引发哪些变革?为什么DeepSeek在政务服务中这么受欢迎?清华大学公共管理学院教授 孟庆国:生成式人工智能这几年发展非常迅速,尤其在个人的生活、工作、学习中取得了非常好的成效,但是在政务领域,实际上各个地方尽管...……更多
字节猛踩油门
...型3.0、视觉理解模型,并推出OS Agent解决方案及AI云原生推理套件,用于企业客户构建与部署Agent应用。其中,豆包1.5深度思考模型作为字节首款推理模型,具备“边想边搜”能力,同时借助视觉推理能力,可以综合理解图片中的...……更多
清华系前腾讯Robotics X核心成员创业,业内首款能“单手玩手机”的灵巧手来了|涌现新项目
...兼CEO杨思成本科毕业于北京航空航天大学,研究生毕业于清华大学。杨思成于2018年进入腾讯Robotics X,为实验室最早一批的核心成员。源升智能联合创始人兼CTO李望维拥有新加坡国立大学博士学位。创始团队在灵巧手与触觉感知...……更多
Google 创始人谢尔盖·布林回归,直面 Gemini、Google、AGI 若干问题
...们不会提高价格,有两个主要的原因。首先,我们在模型推理方面一直在进行优化,每个月都有新的想法和优化方法累积起来,比如有 10% 的改进,有 20% 的改进,这样积累起来就可以产生显著的效果。其次,我认为我们的TPU在...……更多
Sam Altman或筹数十亿美元自造AI芯片,DeepMind首席科学家或将辞职创业
...能眼镜,以实现更加智能化的互动。5.国产「GPTs」登场!清华系重磅发布GLM-4全家桶,性能可达90% GPT-4智谱AI最近发布了新一代基座大模型GLM-4,这一模型在在多项性能指标上已接近或超过GPT-4,并在中文能力和长文本处理上展现...……更多
更多关于科技的资讯:
丰台怡海中学无人驾驶实训教学项目落地
11月28日,AI驭见未来——怡海教育&加州伯克利大学机器人自动驾驶大赛ROAR实训基地揭牌仪式在北京市丰台区怡海中学(北校区)举行
2025-12-02 12:04:00
●杨炯上周末,在珠海的亚洲通航展上,奥捷龙航空科技有限公司格外引人注目。虽然已多次到珠海参展,但这次它“来自厦门”。这一全球市场份额第一的德国旋翼机品牌
2025-12-02 08:18:00
博物馆进入“沉浸时代”,感官残障观众如何“入场”
视障文化博物馆“触摸文明”展厅。中青报·中青网记者 李怡蒙/摄如今,许多博物馆将视觉、听觉、触觉等多种感知方式融合,创造出多层次
2025-12-02 05:43:00
烟台联通举办客服人员心理健康专题讲座
胶东在线12月1日讯为加强对一线客服员工的人文关怀,帮助员工有效应对工作压力,提升情绪管理与自我调适能力,11月26日
2025-12-02 06:42:00
摘要:本文分析现代物流网络布局与供应链弹性提升的内在关联,探讨节点布局合理性、线路连接多样性、资源整合协同性对供应链冗余能力
2025-12-02 07:09:00
摘要:本文聚焦管理会计在企业战略决策中的应用,首先解析其与战略决策的内在关联,即通过整合财务与非财务信息,为战略制定提供系统性支持
2025-12-02 07:10:00
中国网12月2日讯 据国家安全部官微消息,国家安全部提示,SDK(软件开发工具包)是一套为特定软件框架、硬件平台或操作系统提供的开发工具集合
2025-12-02 07:26:00
全球首创全动压空气轴承产业化成果发布,开启高端制造新纪元
北京讯—— 2025年11月28日,“全球首创全动压空气轴承产业化成果发布会”在北京首钢园香格里拉酒店圆满落幕。此次盛会标志着我国在超精密制造领域取得了重大突破
2025-12-02 07:32:00
联通超清电视狂欢双十一,临沂IPTV用户喜获iPhone17豪礼
鲁网12月1日讯一年一度的双十一购物狂欢盛宴圆满收官,在这场全民消费热潮中,山东联通精心策划的“双十一福利再升级”活动脱颖而出
2025-12-01 11:12:00
千里运荔藏巧思 现代加盟终端拓新局
“就算失败,我也想知道,自己倒在距离终点多远的地方。”电视剧《长安的荔枝》中这句掷地有声的台词,精准道出了当下创业者选择加盟之路时的执着与忐忑
2025-12-01 12:23:00
赛事总奖金160万元!WCI国际冠军赛苏州完美收官
2025年坦克世界国际冠军赛(WCI)11月30日在苏州阳澄国际电竞馆落下帷幕。来自中国、欧洲、北美和亚太地区的八支顶尖战队经过激烈角逐
2025-12-01 13:58:00
2025年北京市中小学生电子与信息创意实践活动圆满举行
当AI小球听懂指令,当智能车驰骋赛场,当电路在指尖点亮创意……孩子们像科学家一样思考,像工程师一样实践。11月30日,2025年北京市中小学生电子与信息创意实践活动在北京市第十四中学(畿辅校区)火热开幕
2025-12-01 14:26:00
烟台联通创新应用高压直流供电技术 破解高铁5G基站供电瓶颈
胶东在线12月1日讯在青烟威荣高铁5G覆盖扩容工程建设中,烟台联通成功应用高压直流供电技术创新方案,有效解决了牟平北山隧道西口
2025-12-02 05:00:00
海尔智慧家庭成立创新实验室布局好房子住居生态
海尔智慧家庭战略持续强化、开放和加速布局,又交出新成果。11 月 28日,以“AI 新纪元 共筑智慧家”为主题的海尔智慧家庭生态创新研讨会在北京召开
2025-12-01 14:51:00
海尔智慧家庭新成果:2025物联网大会斩获两项大奖
海尔智慧家庭持续强化、开放并加速智慧居住领域战略布局,如今再添重磅新成果。11 月 29 日,在首届全球万物智联数字经济可持续发展大会暨2025(第十届)世界物联网大会上
2025-12-01 14:51:00