• 我的订阅
  • 财经

李飞飞团队“50美元”复现DeepSeek R1?真相是…

类别:财经 发布时间:2025-02-07 06:25:00 来源:瘦子财经

s1模型的训练并非从零开始,而是基于阿里云通义千问(Qwen)模型进行监督微调。s1模型的神奇“低成本”,是建立在已具备强大能力的开源基础模型之上,可谓依然是开源的胜利。

作者 | 黄心怡

今日一则关于人工智能领域的新闻引发广泛关注。

据报道,李飞飞等斯坦福大学和华盛顿大学的研究人员以不到50美元的云计算费用,成功训练出了一个名为s1的人工智能推理模型。该模型在数学和编码能力测试中的表现,据称与OpenAI的O1和DeepSeek的R1等尖端推理模型不相上下。

这一消息无疑在AI界投下了一颗重磅炸弹,真相究竟如何?

《科创板日报》记者调查和采访业内人士后发现,s1模型的训练并非从零开始,而是基于阿里云通义千问(Qwen)模型进行监督微调。这意味着,s1模型的神奇“低成本”,是建立在已具备强大能力的开源基础模型之上。

▌通义模型的“基座”作用

根据李飞飞等人的研究论文,s1模型的训练仅使用了1000个样本数据。按照业内共识,这一数据量在AI训练中可谓微乎其微,通常不足以训练出一个具备推理能力的模型。

青年AI科学家、上海交通大学人工智能学院谢伟迪副教授告诉《科创板日报》记者,如果仔细研究斯坦福s1的论文会发现,s1模型的神奇是以通义千问模型为基座进行微调,这1000个样本训练的作用更像是“锦上添花”,而非“从零开始”。

国内某知名大模型公司CEO也向《科创板日报》记者表示:“从论文原文来看,所谓用50美元训练出新的具有推理能力的模型,实际上只是用从谷歌模型中提炼出来的1000个样本,然后对通义千问模型进行监督微调。这种微调的成本确实很低,但明显是站在既有领先模型的‘肩上’才能做到。”

斯坦福s1论文原文也注明模型是以阿里通义千问模型为基础微调

谢伟迪指出,国内外还有其他团队也声称用极低的成本,训练出了具有推理能力的新模型。但一阅读其论文原文,就会发现它们无一例外都是基于通义模型作为基座进行的。

国外多位人工智能研究者也指出,不少的“新”模型都是建立通义模型基础上

“以通义千问模型作为基座,确实可以用很少的样本数据就达到产生新的推理模型的效果,但如果换成其他基座模型,新模型能力却没有任何的提升。所以,能力真正神奇的是Qwen模型,而不是s1。” 谢伟迪说。

▌低成本训练大模型有局限,但也是方向

尽管s1模型的低成本训练在某种程度上展示了AI训练的潜力,但其局限性也不容忽视。

首先,这种低成本训练依赖于已有的强大基座模型,如阿里通义千问模型。如果没有这样的基座模型,低成本训练的效果将大打折扣。

其次,1000个样本数据的训练量在大多数情况下是不够的,尤其是在需要处理复杂任务的场景中。

此外,低成本训练的成功也引发了对AI模型知识产权和伦理问题的讨论。如果越来越多的研究依赖于已有的基座模型进行微调,那么这些基座模型的开发者是否应该获得相应的回报?如何确保AI技术的公平使用和共享?这些问题都需要业界进一步探讨和解决。

尽管s1模型的低成本训练引发了争议,但其背后的研究思路无疑为AI领域提供了新的思考方向。

武汉人工智能学院一位资深研究人员向《科创板日报》记者表示,如何在保证模型性能的前提下,降低训练成本,是AI研究的一个重要课题。未来,随着技术的进步和算法的优化,或许我们真的能够看到更多低成本、高性能的AI模型问世。

以上内容为资讯信息快照,由td.fyun.cc爬虫进行采集并收录,本站未对信息做任何修改,信息内容不代表本站立场。

快照生成时间:2025-02-07 08:45:01

本站信息快照查询为非营利公共服务,如有侵权请联系我们进行删除。

信息原文地址:

阿里云通义千问开源!70亿参数模型上线魔搭社区
【CNMO新闻】8月3日,AI模型社区魔搭ModelScope上架两款开源模型Qwen-7B和Qwen-7B-Chat
2023-08-03 17:00:00
本文转自:人民日报海外版美国斯坦福大学等机构研究团队近日宣布,在基座大模型基础上,仅耗费数十美元就开发出相对成熟的推理模型。尽管其整体性能尚无法比肩美国开放人工智能研究中心(Op
2025-02-27 05:08:00
始于安全,不止安全丨迪普科技AI基座解决方案发布
...李瑞对本次重磅发布新品作详细介绍 中国DeepSeek等AI大模型横空出世,在全球范围内掀起了巨大波澜,国产AI技术正以一种前所未有的迅猛态势重构各行各业的生态格局
2025-03-13 10:45:00
通义千问再放大招:720亿大模型开源,全尺寸赶上LLaMA-2,还有移动端可用的18亿模型
...。”华东理工大学·X-DLab(心动实验室)成员颜鑫表示,团队只用20万tokens的数据微调了Qwen基座模型,就获得了比另一家用百万级数据微调的模型更好的效果
2023-12-01 21:07:00
“上天”“入地”“下海” AI驱动中国科学创新加速前行
...再到距离地球38万公里的月球表面……中国科学院的科研团队,正以AI重构科研范式并取得现实突破。未来已来,在国家“人工智能+”行动的号角下,这场始于技术、终于认知的科技革命,正
2025-03-21 16:54:00
大模型慢半拍,字节甘做“嫁衣”?
...型上已有布局,会在语言和图像两方面发力,语言大模型团队由字节搜索部门牵头,目前团队规模在十数人左右;图片大模型团队则由产品研发与工程架构部下属的智能创作团队牵头。 另据《晚
2023-05-05 10:34:00
从云栖大会,看阿里的科技本色
...价的设备采购费用。而只有阿里巴巴看到了这一点,组建团队,在 2009 年,写下了第一行自研云计算系统的代码。 2012 年 BAT 论道云计算,李彦宏还在提云计算是新瓶装旧
2023-11-01 23:02:00
云栖通道上演AI“实战秀”:守护珊瑚、助盲出行、千元机器人勾勒落地新图景
...潜水教练,杨红强深知传统研究的局限。过去十年,他和团队走遍南海300多座岛礁,积累了20多T水下影像资料和100万张照片——如此庞大的数据量,靠专家目视分析根本无法高效处理。
2025-09-25 20:58:00
阿里云开源通义千问多模态大模型Qwen-VL 【阿里云开源通义千问多模态大模型Qwen-VL】《科创板日报》25日讯,阿里云今日推出大规模视觉语言模型Qwen-VL
2023-08-25 12:17:00
更多关于财经的资讯:
温情暖乡集 金融送福来 烟台农商银行牟平区观水支行党支部开展大集送福活动
胶东在线2月14日讯(通讯员 姜宏民 赵灿灿)2月14日农历腊月二十七,观水镇埠西头村迎来了年前的最后一个大集,琳琅满目的年货
2026-02-18 17:34:00
2026年春节档总票房(含预售)超15亿
根据猫眼专业版数据,截至2月17日晚20点37分,2026年春节档总票房(含预售)超15亿,《飞驰人生3》以超7.17亿的成绩暂时领跑今年春节档大盘
2026-02-18 07:34:00
烟台农商银行开发区支行助力住建领域民生保障获赠锦旗
胶东在线2月13日讯(通讯员 兰琳)近日,烟台黄渤海新区住建局专程为烟台农商银行开发区支行送来一面写有“住建领域民生保障 农商助力薪暖民工”的锦旗
2026-02-18 05:00:00
冬奥会“带热”滑雪游!山东青岛滑雪场人气爆棚
第25届冬季奥林匹克运动会正在举行,冬奥会的观赛热情带动了滑雪游。在山东青岛,滑雪场内举办特色的气排球比赛,吸引越来越多的人参与到滑雪运动中
2026-02-17 07:48:00
用心护佑健康 以行奔赴美好——鲁南制药集团2026年新春贺词辞乙巳旧岁,迎丙午新春。当腊月的烟火漫过街巷,万家团圆的期盼日渐浓烈
2026-02-16 11:16:00
2月13日,德州银行向陵城区某企业成功发放8000万元的控制型并购贷款。该笔贷款是《商业银行并购贷款管理办法》自去年12月31日印发实施以来
2026-02-16 11:17:00
2026年米兰-科尔蒂纳冬奥会带动全球冰雪运动持续升温。我国冰雪装备外贸企业抓住机遇,也迎来海外订单高峰期。一件件国产冰雪装备
2026-02-16 08:31:00
记者从中国石油获悉,全球规模最大的200万吨/年柴油吸附分离装置目前在中国石油广西石化稳定运行。该技术已在多家炼化企业实现规模化应用
2026-02-16 09:01:00
除夕将至、新春在即,为向坚守基层一线、守护群众健康的卫生健康工作者致以崇高敬意与新春关怀,贵州银行丹寨支行组织金融服务小分队前往兴仁镇卫生院开展春节走访慰问暨金融便民服务活动
2026-02-15 21:02:00
新春走基层丨贵州铂汇选煤设备公司:春节赶出千万订单
年关已近,六盘水高新区先进装备制造产业园内,贵州铂汇选煤设备有限公司的激光切割机喷吐着蓝色光焰,一批洗选设备的部件初具雏形
2026-02-15 23:29:00
盘南低热值煤发电项目1号机组冲刺试运行 上半年双机组将商业运营
2月11日,中电建盘南2×660MW低热值煤发电项目集控室里,中电建盘州低热值煤发电有限公司副总经理、总工程师段云龙手拿1号机组最新试验清单
2026-02-15 23:29:00
2月14日,记者从尖草坪区获悉,为助推科技服务业高质量发展,该区科技局联合区统计局、汇丰街道及乾泽园社区,深入容海川城乡规划设计有限公司
2026-02-15 18:05:00
笔墨传情迎新春 金融暖心送万福—贵州银行从江支行开展“万福迎春·送春联进万家”公益活动
“这春联写得真有年味,字好、寓意也好,谢谢贵州银行惦记着我们老百姓!”活动现场,领到春联的市民脸上洋溢着笑容,连声称赞
2026-02-15 19:27:00
反诈宣传进社区 守袋护航迎新春—贵州银行岑巩支行联合开展岁末年初反诈防非集中宣传活动
为切实筑牢岁末年初金融安全防线,有效防范电信网络诈骗与非法金融活动,守护人民群众财产安全,2026年2月11日,贵州银行岑巩支行联合岑巩县防范和打击非法金融活动联席会议办公室及全县各金融机构
2026-02-15 19:27:00
黔南州瓮安县一处老旧居民楼里,空荡的楼道内传来阵阵笑声,这是102岁唐奶奶的家。这天,唐奶奶的家里迎来两位特别的客人——贵州银行瓮安支行的吴俊丹和何林璋
2026-02-15 19:27:00