• 我的订阅
  • 财经

李飞飞团队“50美元”复现DeepSeek R1?真相是…

类别:财经 发布时间:2025-02-07 06:25:00 来源:瘦子财经

s1模型的训练并非从零开始,而是基于阿里云通义千问(Qwen)模型进行监督微调。s1模型的神奇“低成本”,是建立在已具备强大能力的开源基础模型之上,可谓依然是开源的胜利。

作者 | 黄心怡

今日一则关于人工智能领域的新闻引发广泛关注。

据报道,李飞飞等斯坦福大学和华盛顿大学的研究人员以不到50美元的云计算费用,成功训练出了一个名为s1的人工智能推理模型。该模型在数学和编码能力测试中的表现,据称与OpenAI的O1和DeepSeek的R1等尖端推理模型不相上下。

这一消息无疑在AI界投下了一颗重磅炸弹,真相究竟如何?

《科创板日报》记者调查和采访业内人士后发现,s1模型的训练并非从零开始,而是基于阿里云通义千问(Qwen)模型进行监督微调。这意味着,s1模型的神奇“低成本”,是建立在已具备强大能力的开源基础模型之上。

▌通义模型的“基座”作用

根据李飞飞等人的研究论文,s1模型的训练仅使用了1000个样本数据。按照业内共识,这一数据量在AI训练中可谓微乎其微,通常不足以训练出一个具备推理能力的模型。

青年AI科学家、上海交通大学人工智能学院谢伟迪副教授告诉《科创板日报》记者,如果仔细研究斯坦福s1的论文会发现,s1模型的神奇是以通义千问模型为基座进行微调,这1000个样本训练的作用更像是“锦上添花”,而非“从零开始”。

国内某知名大模型公司CEO也向《科创板日报》记者表示:“从论文原文来看,所谓用50美元训练出新的具有推理能力的模型,实际上只是用从谷歌模型中提炼出来的1000个样本,然后对通义千问模型进行监督微调。这种微调的成本确实很低,但明显是站在既有领先模型的‘肩上’才能做到。”

斯坦福s1论文原文也注明模型是以阿里通义千问模型为基础微调

谢伟迪指出,国内外还有其他团队也声称用极低的成本,训练出了具有推理能力的新模型。但一阅读其论文原文,就会发现它们无一例外都是基于通义模型作为基座进行的。

国外多位人工智能研究者也指出,不少的“新”模型都是建立通义模型基础上

“以通义千问模型作为基座,确实可以用很少的样本数据就达到产生新的推理模型的效果,但如果换成其他基座模型,新模型能力却没有任何的提升。所以,能力真正神奇的是Qwen模型,而不是s1。” 谢伟迪说。

▌低成本训练大模型有局限,但也是方向

尽管s1模型的低成本训练在某种程度上展示了AI训练的潜力,但其局限性也不容忽视。

首先,这种低成本训练依赖于已有的强大基座模型,如阿里通义千问模型。如果没有这样的基座模型,低成本训练的效果将大打折扣。

其次,1000个样本数据的训练量在大多数情况下是不够的,尤其是在需要处理复杂任务的场景中。

此外,低成本训练的成功也引发了对AI模型知识产权和伦理问题的讨论。如果越来越多的研究依赖于已有的基座模型进行微调,那么这些基座模型的开发者是否应该获得相应的回报?如何确保AI技术的公平使用和共享?这些问题都需要业界进一步探讨和解决。

尽管s1模型的低成本训练引发了争议,但其背后的研究思路无疑为AI领域提供了新的思考方向。

武汉人工智能学院一位资深研究人员向《科创板日报》记者表示,如何在保证模型性能的前提下,降低训练成本,是AI研究的一个重要课题。未来,随着技术的进步和算法的优化,或许我们真的能够看到更多低成本、高性能的AI模型问世。

以上内容为资讯信息快照,由td.fyun.cc爬虫进行采集并收录,本站未对信息做任何修改,信息内容不代表本站立场。

快照生成时间:2025-02-07 08:45:01

本站信息快照查询为非营利公共服务,如有侵权请联系我们进行删除。

信息原文地址:

阿里云通义千问开源!70亿参数模型上线魔搭社区
【CNMO新闻】8月3日,AI模型社区魔搭ModelScope上架两款开源模型Qwen-7B和Qwen-7B-Chat
2023-08-03 17:00:00
本文转自:人民日报海外版美国斯坦福大学等机构研究团队近日宣布,在基座大模型基础上,仅耗费数十美元就开发出相对成熟的推理模型。尽管其整体性能尚无法比肩美国开放人工智能研究中心(Op
2025-02-27 05:08:00
始于安全,不止安全丨迪普科技AI基座解决方案发布
...李瑞对本次重磅发布新品作详细介绍 中国DeepSeek等AI大模型横空出世,在全球范围内掀起了巨大波澜,国产AI技术正以一种前所未有的迅猛态势重构各行各业的生态格局
2025-03-13 10:45:00
通义千问再放大招:720亿大模型开源,全尺寸赶上LLaMA-2,还有移动端可用的18亿模型
...。”华东理工大学·X-DLab(心动实验室)成员颜鑫表示,团队只用20万tokens的数据微调了Qwen基座模型,就获得了比另一家用百万级数据微调的模型更好的效果
2023-12-01 21:07:00
“上天”“入地”“下海” AI驱动中国科学创新加速前行
...再到距离地球38万公里的月球表面……中国科学院的科研团队,正以AI重构科研范式并取得现实突破。未来已来,在国家“人工智能+”行动的号角下,这场始于技术、终于认知的科技革命,正
2025-03-21 16:54:00
大模型慢半拍,字节甘做“嫁衣”?
...型上已有布局,会在语言和图像两方面发力,语言大模型团队由字节搜索部门牵头,目前团队规模在十数人左右;图片大模型团队则由产品研发与工程架构部下属的智能创作团队牵头。 另据《晚
2023-05-05 10:34:00
从云栖大会,看阿里的科技本色
...价的设备采购费用。而只有阿里巴巴看到了这一点,组建团队,在 2009 年,写下了第一行自研云计算系统的代码。 2012 年 BAT 论道云计算,李彦宏还在提云计算是新瓶装旧
2023-11-01 23:02:00
云栖通道上演AI“实战秀”:守护珊瑚、助盲出行、千元机器人勾勒落地新图景
...潜水教练,杨红强深知传统研究的局限。过去十年,他和团队走遍南海300多座岛礁,积累了20多T水下影像资料和100万张照片——如此庞大的数据量,靠专家目视分析根本无法高效处理。
2025-09-25 20:58:00
阿里云开源通义千问多模态大模型Qwen-VL 【阿里云开源通义千问多模态大模型Qwen-VL】《科创板日报》25日讯,阿里云今日推出大规模视觉语言模型Qwen-VL
2023-08-25 12:17:00
更多关于财经的资讯:
白银有色、中国五矿集团等在甘肃成立科技新公司
近日,五矿金川红鹭国创科技(甘肃)有限公司成立,注册资本1亿元,经营范围包含:金属与非金属矿产资源地质勘探;矿产资源勘查
2025-12-29 14:00:00
探路者入股芯片设计研发商通途半导体
近日,上海通途半导体科技有限公司发生工商变更,新增探路者(300005)为大股东,持股51%。企查查信息显示,该公司成立于2012年
2025-12-29 14:00:00
织金农商银行桂果支行开展“暖冬行动” 金融活水助力乡村抗寒保生产
寒冬时节,气温骤降,农业生产、农户生活面临低温挑战。为切实履行地方金融机构使命担当,筑牢乡村冬季生产生活金融保障防线,织金农商银行桂果支行主动下沉服务重心
2025-12-29 11:31:00
上门服务暖民心!织金农商银行茶店支行开展“上门办业务 服务零距离”专项活动
为切实解决农村行动不便的老年人、残疾人等特殊群体的金融服务难题,近日,织金农商银行茶店支行组织服务小队,深入乡村开展“上门办业务服务零距离”专项活动
2025-12-29 11:31:00
精准宣传护民生!织金农商银行茶店支行走进社区村组
为切实提升农村群众金融安全意识,践行便民服务宗旨,近日,织金农商银行茶店支行组织工作人员走进社区、村组开展反诈宣传及假币识别科普活动
2025-12-29 11:31:00
织金农商银行授信“活水”滋养乡村特色产业
织金农商银行积极发挥地方金融主力军作用,充分运用“黔农云”,精准滴灌乡村特色产业,为乡村振兴注入持续金融动力。推行“提前授信+线上用款”模式
2025-12-29 11:32:00
织金农商银行金南支行:上门服务为老年群体纾解金融难题
针对老年群体特别是行动不便老年客户的金融服务需求,织金农商银行金南支行自2025年12月以来,持续组织开展系列上门服务
2025-12-29 11:32:00
供应链赋能添动力 江西一铜基材料生产企业2年营收翻20倍
大江新闻讯 12月中下旬的江西寒气渐浓,但抚州市崇仁县一家铜基材料生产企业内却暖意融融、热火朝天机器轰鸣不停,生产线满负荷运转
2025-12-29 11:35:00
官宣!泰康人寿:薛继豪担任临时负责人,代行总经理职责;程康平不再担任总经理职务
12月26日,泰康人寿保险有限责任公司公告称,经公司研究决定,自2025年12月23日起,薛继豪担任公司临时负责人,代行总经理职责
2025-12-29 11:51:00
中国人民银行办公厅等联合印发《关于推广农业设施和畜禽活体抵押融资的通知》
为深入贯彻落实党的二十大和二十届历次全会精神,落实中央一号文件部署要求,深入学习运用“千万工程”经验,创新乡村振兴投融资机制
2025-12-29 12:05:00
双汇发展与华强方特开启战略合作
大河网讯 12月24日,双汇发展与华强方特战略合作签约仪式在深圳举行。双汇发展董事长万宏伟、华强方特集团董事长刘道强出席签约仪式
2025-12-29 12:10:00
农行许昌分行:助力千年花木变身“致富花”
大河网讯 提起花木,就绕不开许昌鄢陵县。这座小城的花木种植历史悠久,从唐朝的零星栽培,到宋朝荣登皇家御花园的“大雅之堂”
2025-12-29 12:10:00
农行信阳分行:金融活水浇灌油茶“黄金果”
大河网讯 大别山北麓的信阳罗山县,漫山遍野的油茶林勾勒出一幅生机勃勃的生态画卷。20万亩油茶树迎风而立,沉甸甸的油茶果挂满枝头
2025-12-29 12:10:00
历史车轮滚滚向前,唯奋进者与时代同步。当“十四五”收官的华章即将落笔,“十五五”开局号角吹响之时,消费作为经济增长“主引擎”的作用愈发凸显
2025-12-29 12:16:00
警惕征信修复骗局 守护个人信用安全——渤海银行济南分行开展专项宣传活动
为切实维护金融消费者合法权益,防范化解征信领域非法中介风险,2025年12月,渤海银行济南分行以“金融为民”为核心理念
2025-12-29 12:18:00