我的订阅
科技

我们正处于一个信息大暴发的时代，每天都能产生数以百万计的新闻资讯！

虽然有大数据推荐，但面对海量数据，通过我们的调研发现，在一个小时的时间里，您通常无法真正有效地获取您感兴趣的资讯！

头条新闻资讯订阅，旨在帮助您收集感兴趣的资讯内容，并且在第一时间通知到您。可以有效节约您获取资讯的时间，避免错过一些关键信息。

全球科研团队竞逐低成本AI模型研发新范式

类别：科技发布时间：2025-02-27 05:08:00 来源：人民资讯

本文转自：人民日报海外版

美国斯坦福大学等机构研究团队近日宣布，在基座大模型基础上，仅耗费数十美元就开发出相对成熟的推理模型。尽管其整体性能尚无法比肩美国开放人工智能研究中心（OpenAI）开发的o1、中国深度求索公司的DeepSeek-R1等，但此类尝试意味着企业可以较低成本研发出适合自身的AI应用，AI普惠性有望增强。同时，其所应用的“测试时扩展”技术或代表一条更可持续的AI研发路径。

低成本玩转高级推理

美国斯坦福大学和华盛顿大学研究团队近日宣布研发出名为s1的模型，在衡量数学和编码能力的测试中，可媲美o1和DeepSeek-R1等。研究团队称，训练租用所需的计算资源等成本只需几十美元。

s1的核心创新在于采用了“知识蒸馏”技术和“预算强制”方法。“知识蒸馏”好比把别人酿好的酒进一步提纯。该模型训练数据是基于谷歌Gemini Thinking Experimental模型“蒸馏”出的仅有1000个样本的小型数据集。

“预算强制”则使用了AI模型训练新方法——“测试时扩展”的实现方式。“测试时扩展”又称“深度思考”，核心是在模型测试阶段，通过调整计算资源分配，使模型更深入思考问题，提高推理能力和准确性。

“预算强制”通过强制提前结束或延长模型的思考过程，来影响模型的推理深度和最终答案。s1对阿里云的通义千问开源模型进行微调，通过“预算强制”控制训练后的模型计算量，使用16个英伟达H100 GPU仅进行26分钟训练便达成目标。

美国加利福尼亚大学伯克利分校研究团队最近也开发出一款名为TinyZero的精简AI模型，称复刻了DeepSeek-R1 Zero在倒计时和乘法任务中的表现。该模型通过强化学习，实现了部分相当于30亿模型参数的大语言模型的自我思维验证和搜索能力。团队称项目训练成本不到30美元。

“二次创造”增强AI普惠性

清华大学计算机系长聘副教授刘知远接受记者采访时说，部分海外研究团队使用DeepSeek-R1、o1等高性能推理大模型来构建、筛选高质量长思维链数据集，再用这些数据集微调模型，可低成本快速获得高阶推理能力。

相关专家认为，这是AI研发的有益尝试，以“二次创造”方式构建模型增强了AI普惠性。但有三点值得注意：

首先，所谓“几十美元的低成本”，并未纳入开发基座大模型的高昂成本。这就好比盖房子，只算了最后装修的钱，却没算买地、打地基的钱。AI智库“快思慢想研究院”院长田丰告诉记者，几十美元成本只是最后一个环节的算力成本，并未计算基座模型的预训练成本、数据采集加工成本。

其次，“二次创造”构建的模型，整体性能尚无法比肩成熟大模型。TinyZero仅在简单数学任务、编程及数学益智游戏等特定任务中有良好表现，但无法适用于更复杂、多样化的任务场景。而s1模型也只能通过精心挑选的训练数据，在特定测试集上超过早期版本o1 preview，而远未超过o1正式版或DeepSeek-R1。

最后，开发性能更优越的大模型，仍需强化学习技术。刘知远说，就推动大模型能力边界而言，“知识蒸馏”技术意义不大，未来仍需探索大规模强化学习技术，以持续激发大模型在思考、反思、探索等方面的能力。

AI模型未来如何进化

在2025年美国消费电子展上，美国英伟达公司高管为AI的进化勾画了一条路线图：以智能水平为纵轴、以计算量为横轴，衡量AI模型的“规模定律”呈现从“预训练扩展”到“训练后扩展”，再到“测试时扩展”的演进。

“预训练扩展”堪称“大力出奇迹”——训练数据越多、模型规模越大、投入算力越多，最终得到AI模型的能力就越强。目标是构建一个通用语言模型，以GPT早期模型为代表。而“训练后扩展”涉及强化学习和人类反馈等技术，是预训练模型的“进化”，优化其在特定领域的任务表现。

随着“预训练扩展”和“训练后扩展”边际收益逐渐递减，“测试时扩展”技术兴起。田丰说，“测试时扩展”的核心在于将焦点从训练阶段转移到推理阶段，通过动态控制推理过程中的计算量（如思考步长、迭代次数）来优化结果。这一方法不仅降低了对预训练数据的依赖，还显著提升了模型潜力。

三者在资源分配和应用场景上各有千秋。预训练像是让AI模型去学校学习基础知识，而后训练则是让模型掌握特定工作技能，如医疗、法律等专业领域。“测试时扩展”则赋予了模型更强推理能力。

AI模型的迭代还存在类似摩尔定律的现象，即能力密度随时间呈指数级增强。刘知远说，2023年以来，大模型能力密度大约每100天翻一番，即每过100天，只需要一半算力和参数就能实现相同能力。未来应继续推进计算系统智能化，不断追求更高能力密度，以更低成本，实现大模型高效发展。

（据新华社电记者彭茜）

以上内容为资讯信息快照，由td.fyun.cc爬虫进行采集并收录，本站未对信息做任何修改，信息内容不代表本站立场。

快照生成时间：2025-02-27 08:45:05

本站信息快照查询为非营利公共服务，如有侵权请联系我们进行删除。

信息原文地址：

更多关于范式,模型,科研,团队,成本,全球的资讯：

陆奇：未来大模型无处不在，是技术世界中的全新物种

...5月7日，陆奇在北京举行了一场超千人规模、主题为《新范式新时代新机会》的演讲，全程超三个小时。他就当前最新前沿技术趋势，尤其是OpenAI爆发的成因进行深入分析，系统性解

2023-05-15 13:00:00

“上天”“入地”“下海” AI驱动中国科学创新加速前行

...的月球表面……中国科学院的科研团队，正以AI重构科研范式并取得现实突破。未来已来，在国家“人工智能+”行动的号角下，这场始于技术、终于认知的科技革命，正在重塑人类探索世界的范

2025-03-21 16:54:00

【2025数博会】中国工程院院士、清华大学教授郑纬民：AI驱

“斯坦福大学《2025年AI指数报告》称，去年全球AI市场规模已突破3900亿美元，预计到2030年将达到1.8万亿美元

2025-08-28 14:24:00

AI助飞，这些科学家创业“多快好省”|科研范式变革催生新质生

...心、DNA存储研究中心，还有公共仪器平台。在这里，科研范式变革催生新质生产力，到底有多快？看看洪亮这些青年科学家的高倍速转化。新落成的DNA存储中心自动化AI实验室。【大

2024-10-11 09:52:00

【2025数博会】无相智研科研大模型AI平台助力科研范式变革

...布暨供需对接活动上首次对外发布。无相智研：驱动科研范式革新人工智能（AI）技术正以前所未有的速度重塑全球产业格局，成为企业战略布局的核心。无相智研（贵州）科技有限公司推出跨学

2025-09-01 02:46:00

国内高校最大规模异构智算平台正式上线

...驱动经济社会数字化转型的新引擎。CFFF平台正式上线新范式带来科研新要求“当下，很多研究都依赖于计算，但很多国际知名高校还停留在用大型机或者个人PC做研究的阶段。”中国工程院

2023-07-04 08:38:00

深度势能核心开发者团队发布“大原子模型计划”

...。“OpenLAM 大原子模型计划”将打开一个全新的科学研究范式，不仅让更多科研人员可以用更低成本、更低门槛来模拟任意多种原子组合在一起后发生的效应，创造出新材料，发现新规律

2023-12-05 16:20:00

全栈智链·重构农耕潍坊汇金海以智慧创新定义中国农业新范式

...实践，重构了“高产优质-资源集约-生态友好”的种植新范式。从纳米级土壤传感器到边缘计算网关，从嵌入式控制芯片到作物模型APP，全链路核心技术完成国产化突破。67项知识产权构筑

2025-07-22 20:16:00

卷模型技术，更要卷工程实现

...-运营的全链路开发工作。《开谈》圆桌AI 时代的研发新范式与开发者能力演进毕业于北京航空航天大学，从一线软件及算法工程师至创业企业CTO

2023-08-10 10:00:00

更多关于科技的资讯：

数字化转型背景下企业财务管理模式重构研究

■王鑫摘要：在数字化转型的背景下，企业财务管理正面临由传统核算型向智能决策型的系统性变革。本文从数字化发展的实际需求出发

2025-12-31 04:48:00

1元租机器人，线下开首店：人形机器人打响大众化“发令枪”

大皖新闻讯 2025年的最后两天，中国的人形机器人产业以两件标志性事件，为即将到来的2026年按下了商业化加速键。一边是擎天租以“1元闪租”的体验价格将可以“打太极”的人形机器人推向大众市场

2025-12-30 21:48:00

$从\$

从"碳基"到"硅基"：中国首次构建"数字永生"全链条技术闭环

鲁网12月30日讯12月30日，在济南召开的"永生之手叩响仿生机器人元年之门"主题峰会上，山东未来机器人技术有限公司首次提出将人类生命划分为"碳基阶段"与"硅基阶段"的颠覆性理论框架

2025-12-30 22:13:00

贵州艺森源集团：从手工敲打到智能轰鸣书写酒包装产业升级答卷

多彩贵州网讯近日，贵州艺森源集团有限公司生产车间内，智能设备高效运转，自动化生产线有序作业，一派繁忙景象。历经十年深耕

2025-12-30 22:38:00

浪潮智慧文旅“智享商旅聚力同行”2025浪潮商旅服务日成功

鲁网12月30日讯12月25日，由山东浪潮智慧文旅产业发展有限公司主办、山东浪潮智慧空间技术服务有限公司承办的“智享商旅·聚力同行——2025浪潮商旅服务日”在浪潮科技园圆满落幕

2025-12-30 17:23:00

涌金楼丨浙江老板为何爱在“CNS”发论文？

潮新闻讯浙商，是商业期刊的常客。2025年，他们的名字却接连登上《细胞》（Cell）《自然》（Nature）《科学》（Science）等学术期刊的作者栏

2025-12-30 17:52:00

悟思想伟力·看实践创新｜出口全球的电池，来自乌蒙山区

扎根毕节十年，年产能超7500万只，出口覆盖欧非亚——贵州贵航新能源科技有限公司，已成为推动区域新能源产业链发展的“关键一环”

2025-12-30 18:35:00

肯悦咖啡苹果冰雕点亮冰城代言人白敬亭助阵亮灯迎新春

2025年12月29日，肯悦咖啡在哈尔滨中央大街举办了一场别开生面的“红苹果心愿季”冰雕点灯仪式。肯悦咖啡的巨型红色咖啡杯造型冰雕搭配“水晶”苹果

2025-12-30 18:50:00

博士创新站典型案例｜保定市鑫诺电科软件开发有限公司博士创新站

当前供水行业智能化转型加速推进，保定市鑫诺电科软件开发有限公司作为本地企业，在技术层面面临自主开发的智能客服系统缺乏适配技术

2025-12-30 19:36:00

京东京喜自营2025年成交额增长10倍 5大产业带订单量破亿

2025年即将结束，回看这一年，外贸逆袭、市场反内卷、AI全面爆发，用户消费需求回归理性，带动品质消费。今日，京东旗下特价购物品牌京喜自营披露了这一年的成绩单——2025年实现成交额10倍增长

2025-12-30 19:48:00

事关以旧换新！河南公开征集

大河网讯为深入推进2026年消费品以旧换新政策实施，河南省商务厅日前正式发布《河南省2026年消费品以旧换新家电及数码智能产品参与品牌厂家征集公告》

2025-12-30 19:55:00

博士创新站典型案例｜英利能源发展有限公司博士创新站：携手高校

在全球“双碳”目标推动下，光伏产业成为新能源领域核心赛道。晶体硅太阳电池占据光伏市场主要份额，但高效光伏电池需切割分片制成组件

2025-12-30 18:04:00

博士创新站典型案例｜石家庄数英仪器有限公司博士创新站：攻克高

随着新能源发电并网比例不断提高，光伏逆变引入的谐波频率日益升高，对电网谐波测量提出了新的技术要求。当前，国内市场主流谐波标准源的谐波次数普遍低于100次

2025-12-30 18:16:00

还在用App来回倒腾文件？鸿蒙6一碰即传，感受分享的魔法

傻瓜相机的发明，将人们从复杂的调焦、测光操作中解放出来，把摄影门槛拉低到有手就行。而在这个随身电子设备越来越多的时代，人们需要在跨设备文件

2025-12-30 13:04:00

把数字安全感还给用户：HarmonyOS 6的三道主动防御防

在万物互联的数字时代，个人隐私的边界正变得日益模糊。我们或许都曾经历过这样的时刻：经常接到诈骗骚扰电话，或是家人手机里充斥着乱七八糟

2025-12-30 13:05:00

头条订阅服务

全球科研团队竞逐低成本AI模型研发新范式