• 我的订阅
  • 财经

李飞飞团队“50美元”复现DeepSeek R1?真相是…

类别:财经 发布时间:2025-02-07 06:25:00 来源:瘦子财经

s1模型的训练并非从零开始,而是基于阿里云通义千问(Qwen)模型进行监督微调。s1模型的神奇“低成本”,是建立在已具备强大能力的开源基础模型之上,可谓依然是开源的胜利。

作者 | 黄心怡

今日一则关于人工智能领域的新闻引发广泛关注。

据报道,李飞飞等斯坦福大学和华盛顿大学的研究人员以不到50美元的云计算费用,成功训练出了一个名为s1的人工智能推理模型。该模型在数学和编码能力测试中的表现,据称与OpenAI的O1和DeepSeek的R1等尖端推理模型不相上下。

这一消息无疑在AI界投下了一颗重磅炸弹,真相究竟如何?

《科创板日报》记者调查和采访业内人士后发现,s1模型的训练并非从零开始,而是基于阿里云通义千问(Qwen)模型进行监督微调。这意味着,s1模型的神奇“低成本”,是建立在已具备强大能力的开源基础模型之上。

▌通义模型的“基座”作用

根据李飞飞等人的研究论文,s1模型的训练仅使用了1000个样本数据。按照业内共识,这一数据量在AI训练中可谓微乎其微,通常不足以训练出一个具备推理能力的模型。

青年AI科学家、上海交通大学人工智能学院谢伟迪副教授告诉《科创板日报》记者,如果仔细研究斯坦福s1的论文会发现,s1模型的神奇是以通义千问模型为基座进行微调,这1000个样本训练的作用更像是“锦上添花”,而非“从零开始”。

国内某知名大模型公司CEO也向《科创板日报》记者表示:“从论文原文来看,所谓用50美元训练出新的具有推理能力的模型,实际上只是用从谷歌模型中提炼出来的1000个样本,然后对通义千问模型进行监督微调。这种微调的成本确实很低,但明显是站在既有领先模型的‘肩上’才能做到。”

斯坦福s1论文原文也注明模型是以阿里通义千问模型为基础微调

谢伟迪指出,国内外还有其他团队也声称用极低的成本,训练出了具有推理能力的新模型。但一阅读其论文原文,就会发现它们无一例外都是基于通义模型作为基座进行的。

国外多位人工智能研究者也指出,不少的“新”模型都是建立通义模型基础上

“以通义千问模型作为基座,确实可以用很少的样本数据就达到产生新的推理模型的效果,但如果换成其他基座模型,新模型能力却没有任何的提升。所以,能力真正神奇的是Qwen模型,而不是s1。” 谢伟迪说。

▌低成本训练大模型有局限,但也是方向

尽管s1模型的低成本训练在某种程度上展示了AI训练的潜力,但其局限性也不容忽视。

首先,这种低成本训练依赖于已有的强大基座模型,如阿里通义千问模型。如果没有这样的基座模型,低成本训练的效果将大打折扣。

其次,1000个样本数据的训练量在大多数情况下是不够的,尤其是在需要处理复杂任务的场景中。

此外,低成本训练的成功也引发了对AI模型知识产权和伦理问题的讨论。如果越来越多的研究依赖于已有的基座模型进行微调,那么这些基座模型的开发者是否应该获得相应的回报?如何确保AI技术的公平使用和共享?这些问题都需要业界进一步探讨和解决。

尽管s1模型的低成本训练引发了争议,但其背后的研究思路无疑为AI领域提供了新的思考方向。

武汉人工智能学院一位资深研究人员向《科创板日报》记者表示,如何在保证模型性能的前提下,降低训练成本,是AI研究的一个重要课题。未来,随着技术的进步和算法的优化,或许我们真的能够看到更多低成本、高性能的AI模型问世。

以上内容为资讯信息快照,由td.fyun.cc爬虫进行采集并收录,本站未对信息做任何修改,信息内容不代表本站立场。

快照生成时间:2025-02-07 08:45:01

本站信息快照查询为非营利公共服务,如有侵权请联系我们进行删除。

信息原文地址:

阿里云通义千问开源!70亿参数模型上线魔搭社区
【CNMO新闻】8月3日,AI模型社区魔搭ModelScope上架两款开源模型Qwen-7B和Qwen-7B-Chat
2023-08-03 17:00:00
本文转自:人民日报海外版美国斯坦福大学等机构研究团队近日宣布,在基座大模型基础上,仅耗费数十美元就开发出相对成熟的推理模型。尽管其整体性能尚无法比肩美国开放人工智能研究中心(Op
2025-02-27 05:08:00
始于安全,不止安全丨迪普科技AI基座解决方案发布
...李瑞对本次重磅发布新品作详细介绍 中国DeepSeek等AI大模型横空出世,在全球范围内掀起了巨大波澜,国产AI技术正以一种前所未有的迅猛态势重构各行各业的生态格局
2025-03-13 10:45:00
通义千问再放大招:720亿大模型开源,全尺寸赶上LLaMA-2,还有移动端可用的18亿模型
...。”华东理工大学·X-DLab(心动实验室)成员颜鑫表示,团队只用20万tokens的数据微调了Qwen基座模型,就获得了比另一家用百万级数据微调的模型更好的效果
2023-12-01 21:07:00
“上天”“入地”“下海” AI驱动中国科学创新加速前行
...再到距离地球38万公里的月球表面……中国科学院的科研团队,正以AI重构科研范式并取得现实突破。未来已来,在国家“人工智能+”行动的号角下,这场始于技术、终于认知的科技革命,正
2025-03-21 16:54:00
大模型慢半拍,字节甘做“嫁衣”?
...型上已有布局,会在语言和图像两方面发力,语言大模型团队由字节搜索部门牵头,目前团队规模在十数人左右;图片大模型团队则由产品研发与工程架构部下属的智能创作团队牵头。 另据《晚
2023-05-05 10:34:00
从云栖大会,看阿里的科技本色
...价的设备采购费用。而只有阿里巴巴看到了这一点,组建团队,在 2009 年,写下了第一行自研云计算系统的代码。 2012 年 BAT 论道云计算,李彦宏还在提云计算是新瓶装旧
2023-11-01 23:02:00
云栖通道上演AI“实战秀”:守护珊瑚、助盲出行、千元机器人勾勒落地新图景
...潜水教练,杨红强深知传统研究的局限。过去十年,他和团队走遍南海300多座岛礁,积累了20多T水下影像资料和100万张照片——如此庞大的数据量,靠专家目视分析根本无法高效处理。
2025-09-25 20:58:00
阿里云开源通义千问多模态大模型Qwen-VL 【阿里云开源通义千问多模态大模型Qwen-VL】《科创板日报》25日讯,阿里云今日推出大规模视觉语言模型Qwen-VL
2023-08-25 12:17:00
更多关于财经的资讯:
随着居民风险意识持续提升,客户不仅希望保险能提供风险保障,还希望在保险期满未发生保险事故时,可获得相当于所交保费的满期生存金
2026-03-15 17:57:00
近日,兴业银行石家庄分行进口押汇自动放款业务落地。企业通过该行网上单证处理系统发起申请,仅两小时便完成全流程审批与放款
2026-03-15 18:54:00
3·15消费新主张|中国太保寿险河北分公司:守护每一份奔跑的信任
2026-03-15 19:38:00
聚焦“两司两员” 筑牢金融防线——中信银行济南分行3·15金融护航“两司两员”行动篇
为切实提升金融消费者风险防范意识和自我保护能力,在2026年“3·15国际消费者权益日”来临之际,中信银行济南分行紧扣“清朗金融网络 守护安心消费”主题
2026-03-15 14:38:00
今年“3·15国际消费者权益日”来临之际,在济南一场聚焦青年金融安全的主题宣传活动走进大学校园,以创新形式为学子们上了一堂生动的“金融安全必修课”
2026-03-15 14:40:00
才艺大赛绽放银龄风采 暖心服务绘就幸福晚年——中信银行济南分行携手山东老年大学举办“幸福家 爸妈才艺大赛”颁奖典礼
春回大地,万物复苏之际,“越晒越年轻”第六届“幸福家·爸妈才艺大赛”颁奖典礼在中信银行济南分行圆满举行。本次大赛由中信银行济南分行与山东老年大学携手组织
2026-03-15 14:40:00
良辰作灯 敬颂芳华——平安产险聊城中心支公司女神节手工灯制作专项活动
为庆祝女神节的到来,体现平安产险聊城中心支公司对员工的深切关怀,中心支公司于3月6日特别策划并开展了主题为“良辰作灯 敬颂芳华”手工灯制作专项活动
2026-03-15 14:41:00
智慧助老 才艺生辉——中信银行济南分行组织“幸福家 爸妈才艺大赛”济南赛区颁奖仪式暨3·15金融知识普及活动
春风送暖,才华绽放。2026年3月13日,由中信银行济南分行与山东省老年大学联合主办的“幸福家 爸妈才艺大赛”济南赛区颁奖仪式暨3·15金融知识普及活动
2026-03-15 14:41:00
平安产险莱州支公司:情暖三八节 巾帼绽芳华
三月春风拂面,巾帼风采绽放。在第114个“三八”国际妇女节来临之际,平安产险莱州支公司以“关爱员工、传递温暖”为宗旨,为公司三名女性员工精心准备了洗护套装与发膜
2026-03-15 15:13:00
平安产险威海中支文登支公司荣获2025年度威海市文登区“服务地方发展贡献奖”
近日,平安产险文登支公司凭借在服务地方经济、践行社会责任、助力乡村振兴等领域的突出表现,荣获中共威海市文登区委员会、威海市文登区人民政府颁发的2025年度威海市文登区“服务地方发展贡献奖”
2026-03-15 15:13:00
平安财险泰安中支携手城东交警大队、泰安市八十八医院 共启“警保医”一体化合作新篇章
近日,平安产险泰安中心支公司联合城东交警大队与泰安市八十八医院,正式举行“警保医”一体化合作签约仪式暨揭牌仪式。此次三方战略合作的达成
2026-03-15 15:13:00
山东平安产险菏泽中心支公司:315宣传筑防线,金融守护显担当
2026年3月12日,平安产险菏泽中心支公司积极投身市金融消费者协会于银座家居举办的“清朗金融网络 守护安心消费”315宣传活动
2026-03-15 15:13:00
平安产险莱阳支公司温情庆“三八” 人文关怀暖人心
2026年3月5日,在第116个国际妇女节来临之际,平安产险莱阳支公司于近日开展“致敬‘她’力量”主题庆祝活动,为全体女员工送上节日祝福与精心准备的慰问礼品
2026-03-15 15:13:00
情暖女神节 芳华绽平安——平安财险山东分公司滨州中支开展三八女神节关爱活动
阳春三月,暖意融融。在“三八”国际妇女节来临之际,平安产险滨州中心支公司举办温馨女神节主题活动,向全体女员工致以节日祝福与诚挚敬意
2026-03-15 15:14:00