• 我的订阅
  • 头条热搜
又慢又贵?OpenAI推理模型“草莓”来了,GPT-5还有多远
OpenAI的“草莓”终于来了。当地时间9月12日,人工智能(AI)巨头OpenAI发布代号“草莓”的AI推理模型OpenAI o1系列,包括OpenAI o1-preview以及小版本的o1-mini。据OpenAI介绍, o1会花更多时间思考问题,然后再做出反应,就像人一样。...……更多
GPT刚刚公开「草莓」项目:推理能力翻倍,定价200美元?
... OpenAI 在大语言模型领域的新尝试,也可能是对人工智能推理能力一次新的革命性提升。根据目前流出的信息来看,相比以往的 GPT 模型,「草莓」在处理复杂问题、执行多步骤任务方面展现出前所未有的潜力,使其成为通用人...……更多
专注于推理的OpenAI“草莓”模型两周内发布?是人工智能下一重大突破
...“秋季发布”(9月至11月)要更早。上述报道称,专注于推理能力的人工智能“草莓”发布前后还有一些亟待解决的问题,但看似“仓促上马”似乎说明OpenAI感受到了大语言模型驱动产品领域的激烈竞争压力,希望通过近几个月...……更多
超强AI来袭!OpenAI最新AI模型 “草莓”即将上线,推理能力惊艳
...但其实这个模型的能力可不容小觑,它能够通过多步骤的推理解决复杂的问题。根据《信息》网站的报道,“草莓” 模型将视为一种推理模型,这意味着它能够处理一些需要多步骤来完成的请求,比如解答难度较大的代数题,...……更多
消息称OpenAI计划两周内发布新AI模型“草莓” 专注于推理
...于之前的预期。根据之前的报道,“草莓”是一款专注于推理的AI产品,预计于今秋发布。但这两位测试过该模型的人士称,OpenAI计划在未来两周内发布“草莓”。当然,最终的日期也可能生变。需要指出的是,虽然“草莓”是C...……更多
OpenAI o1模型到博士水平了?复旦教授:没有真正推理能力,学到的还是概率相关性
...小尺寸版o1-mini。OpenAI官方发文称,新模型旨在解决复杂推理问题,训练模型在响应之前花更多时间思考,类似于人类的思考方式。“新模型在推理能力上代表了AI能力的新水平。”OpenAI称,该模型可以解决科学、编程和数学等更...……更多
刚刚,OpenAI震撼发布o1大模型!强化学习突破LLM推理极限
...专门解决难题。这是一个重大突破,新模型可以实现复杂推理,一个通用模型解决比此前的科学、代码和数学模型能做到的更难的问题。OpenAI 称,今天在 ChatGPT 和大模型 API 中新发布的是该系列中的第一款模型,而且还只是预览...……更多
AI新时代揭幕!会“思考解题逻辑”的OpenAI推理大模型登场
...凌晨1时许,AI时代迎来崭新的起点——能够进行通用复杂推理的大模型终于走到台前。OpenAI在官网发布公告称,开始向全体订阅用户开始推送OpenAI o1预览模型——也就是此前被广泛期待的“草莓”大模型。OpenAI表示,对于复杂推...……更多
奥特曼晒“草莓”引热议 神秘新模型现身竞技场 网友第一波实测来了
...级智能的关键一步。它被指具有这些特性,比如在数学和推理能力方面有很大的提升,突破了人类数据的限制,可以自己生产巨量训练数据,有自主学习和自我改进的能力等等。在草莓项目正式被曝光的前几天,OpenAI科学家Noam B...……更多
重磅!OpenAI o1模型还没有实现真正的逻辑推理能力
...-preview和o1-mini模型已经可以使用。OpenAI宣布,“新模型在推理能力上代表了人工智能能力的新水平,因此,计数器将重置为1”。根据OpenAI的自测,o1在竞赛编程问题(Codeforces)中排名第89个百分点,在美国数学奥林匹克竞赛(AIM...……更多
小模型越级挑战14倍参数大模型,谷歌Test-Time端新的Scaling Law
...发布的新模型草莓所用的方法。研究团队探究了在大模型推理时进行计算优化的方法,根据给定的prompt难度,动态地分配测试时(Test-Time)的计算资源。结果发现这种方法在一些情况下比单纯扩展模型参数更经济有效。换句话说...……更多
ChatGPT 革新,消息称 OpenAI“草莓”大模型两周内发布
...tion 今日报道称,OpenAI 计划在接下来的两周内推出专注于推理的 AI 大模型“草莓(原 Q* 项目)”并将其应用到 ChatGPT 服务中,比传闻中的“秋季发布”(IT之家注:指 9 至 11 月)更早。作为以推理为卖点的大模型,“草莓”在...……更多
国内创业者和投资人如何看待 Figure 01 机器人:距离具身智能还有多远?
...力和机器人硬件会如何平衡,从广告噱头到量产应用还有多远?人形机器人百家争鸣的春秋时代已拉开序幕。李志飞,出门问问创始人兼CEO,美国约翰霍普金斯大学计算机系博士,自然语言处理及人工智能专家,前Google总部科学...……更多
OpenAI发布最新技术研究,AI“黑盒”不再是难题!
...出了正确回答。大部分大模型都在给出答案的同时呈现了推理过程。智谱清言给出的推理过程显示,在比较13.11%和13.8%时,13.11%是更大的数值。这是因为当比较两个百分数时,我们首先比较整数部分,如果它们相同,则比较小数...……更多
o1 基石论文火爆传阅:Ilya 仍是关键先生,核心项目清北校友闪光
...后的贡献者。Ilya 在 o1 的作用 OpenAI o1 主打进行通用复杂推理,在输出回答之前,会在产生一个很长的思维链,以此增强模型能力。而 Ilya 此前合著的这篇论文主要就是探讨了提高大语言模型多步推理能力的方法。他们主要比较...……更多
思维链让大模型推理更准确?谷歌早于OpenAI押中o1模型核心原理
...本质的不同。其不仅进入到复杂的领域,还表现出超强的推理能力。OpenAI 将 GPT-4o 和 o1 在国际数学奥林匹克竞赛资格考试方面进行对比测试。根据结果,二者差异显著,其中,前者正确解决问题的准确率是 13.4%,而 o1 的准确率...……更多
谷歌大模型推理范式,主要分为两个阶段
...新研究“自我发现”(Self-Discover),重新定义了大模型推理范式。与已成行业标准的思维链(CoT)相比,新方法不仅让模型在面对复杂任务时表现更佳,还把同等效果下的推理成本压缩至1/40。核心策略其实很简单:千人千面。...……更多
ICML2024演讲爆火!Meta朱泽园揭秘大模型内心世界:不同于人类推理
...M) 是如何解数学题的?是通过模板记忆,还是真的学会了推理思维?模型的心算过程是怎样的?能学会怎样的推理技能?与人类相同,还是超越了人类?只学一种类型的数学题,是会对通用智能的发展产生帮助?LLM 为什么会犯...……更多
让OpenAI o1逆天的慢思考,360两月前就做出来了?周鸿祎CoE媲美CoT,应用太前瞻
...读】o1大火背后,最关键的技术是CoT。模型通过一步一步推理,恰恰是「慢思考」的核心要义。而这一观点,其实这家国内大厂早就率先实现了。OpenAI的理念,居然被国内公司抢先践行了?比起OpenAI,这家公司的idea提出得更早,...……更多
语言≠思维,大模型学不了推理:一篇Nature让AI社区炸锅了
...到,人类大脑生成和解析语言的神经网络并不负责形式化推理,而且提出推理并不需要语言作为媒介。这篇论文声称「语言主要是用于交流的工具,而不是思考的工具,对于任何经过测试的思维形式都不是必需的」,引发了科技...……更多
奥林匹克竞赛里选最聪明的AI:Claude-3.5-Sonnet vs. GPT-4o?
...异,近来Anthropic公司最新发布的Claude-3.5-Sonnet因在知识型推理、数学推理、编程任务及视觉推理等任务上设立新行业基准而引发广泛讨论:Claude-3.5-Sonnet 已经取代OpenAI的GPT4o成为世界上”最聪明的AI“(Most Intelligent AI)了……更多
CMU清华教LLM练成数学高手,LeanSTaR训练模型边思考边证明,登顶新SOTA
...办?CMU清华团队提出了Lean-STaR训练框架,在语言模型进行推理的每一步中都植入CoT,提升了模型的定理证明能力,成为miniF2F上的新SOTA。如果想训练LLM证明定理的能力,你会怎么做?既然模型可以通过海量语料学会生成文本,那...……更多
o1金牌团队揭秘AI超越人类惊人时刻!22分完整版视频全公开
...共有8点:1 强化学习加持的o1,比人类更善于发现新的CoT推理步骤2 自我批评的涌现,是o1最强有力的时刻3 让o1「超时」前完成回答,然后突然有了「啊哈」时刻 4 scaling参数规模的挑战,以及继续沿着强化学习算法进步之路5 许...……更多
9月13日,OpenAI发布具有推理能力的人工智能模型“o1”,备受行业瞩目。o1通过模仿人类的思维过程,强化学习和“思维链”技术,引导模型自主解决问题。这一特点在解决复杂问题,尤其是在科学、编码和数学等领域,展现出...……更多
OpenAI「草莓」两周内发布?网传不是多模态,反应慢了10多秒
...PT 高得多的价格,还有待观察。对于复杂问题或需要多步推理的查询,「草莓」或许比 GPT-4o 更易于使用。「草莓」不仅在数学问题和编码方面表现更佳,在更主观(subjective)的商业任务方面也表现更佳,比如制定产品营销策略...……更多
号称博士生水准!OpenAI最新模型仍分不出9.11和9.8哪个大
...科技9月14日消息,OpenAI推出了OpenAI o1预览模型,官方宣称推理能力更强,可达理科博士生水准。按照官方技术博客说法,o1在推理能力上代表了人工智能最强的水平。同时官方放出了更多OpenAI o1的更多演示视频。比如使用OpenAI o1...……更多
...智能的旗舰产品GPT-4为代表的大语言模型在逻辑测试中的推理表现很糟糕:它们犯下前后不一致的错误,而且推理过程往往是荒谬的。近日发表在《皇家学会开放科学》杂志上的一项研究表明,大语言模型所依赖的语料库往往反...……更多
三个大模型组队挑战o1,实测360多模型协作干掉提示词工程
...横空出世,开启了大模型演化的新范式——Inference law(推理定律)。正如英伟达AI科学家Jim Fan所说,o1的出现标志着大模型研发者开始把集中在训练阶段的投入,开始转移到了推理过程。Jim还引用了机器学习先驱Rich Sutton的经典...……更多
姚期智院士大模型新研究:思维图DoT,用数学理论确保AI逻辑一致
姚期智院士领衔,推出大模型新推理框架,CoT“王冠”戴不住了。提出思维图(DiagramofThought),让大模型思考更像人类。团队更是为这种推理过程提供了数学基础,通过拓扑斯理论(Topos Theory)正式化(formalize)DoT,确保其逻...……更多
科学家推出大模型数据集,涵盖奥赛数学题,有望让AI辅导数学课程
...解决复杂数学问题的能力。通过此,他们不仅提高了算法推理速度,还提高了算法搜索中间结果的质量。所新推出的数据集 TriMaster100,也更加符合算法在复杂数学问题下的评价场景。目前,赵子龙的合作者正在基于本次成果开...……更多
更多关于财经的资讯:
深交所:终止对利来智造首次公开发行股票并在主板上市审核
深交所公告,终止对苏州利来工业智造股份有限公司首次公开发行股票并在主板上市审核。本文源自:金融界AI电报/阅读下一篇/返回网易首页下载网易新闻客户端
2025-02-08 20:22:00
大连银行(集中式数据库)大单:神码、腾讯云、科创未来(中)
2024 年 12 月 3 日,大连银行股份有限公司发布《新一代信息化建设-2024 年度新一代集中式数据库选型项目》招标公告
2025-02-08 20:23:00
澳洲葡萄酒2024年全球出口:中国大陆占比超35%
近日,澳大利亚葡萄酒管理局(Wine Australia)公布的澳洲葡萄酒2024年全球出口数据显示:澳洲葡萄酒在2024年的全球出口总额同比增长34
2025-02-08 20:23:00
新富科技向境外子公司增资 360 万美元
2025年2月8日消息,新富科技于 2024 年 12 月 6 日召开第一届董事会第二十三次会议,审议通过向控股的境外子公司新富-谢德尔墨西哥有限公司现金增资 360 万美元
2025-02-08 20:23:00
龙源电力:用1400亿新能源投入造福10万人
近日,龙源电力《风起乡村 向荣向兴——龙源电力2024年乡村振兴报告》。《报告》显示,龙源电力2024年新能源项目建设资金投入近1400亿元
2025-02-08 20:24:00
台前县:稳岗稳工促复产 助力经济开门红
大象新闻记者 张松涛 通讯员 王传帅 冯善胜 张太强一年之计在于春,新春伊始,正是冲刺奋进的关键时刻。春节假期刚过,台前县先进制造业开发区奏响了复工复产的激昂交响曲
2025-02-08 20:24:00
零跑汽车预计2024年整车销量达29.3万辆 同比增104%
财中社2月8日电 零跑汽车(09863)发布公告,公告中提到公司针对2025年服务采购框架协议、2025年零部件采购框架协议及新产品购销框架协议进行了补充说明
2025-02-08 20:24:00
云眼视界拟签订16235000元服务合同
2025年2月8日消息,2025 年 2 月 7 日,云眼视界召开第一届董事会第十四次会议。会上审议通过了《关于<
2025-02-08 20:25:00
证监会核准瑞银成为工银瑞信基金股东
观点网讯:2月8日,证监会发布关于核准工银瑞信基金管理有限公司变更持股5%以上股东的批复,显示核准瑞士银行有限公司(UBS AG
2025-02-08 20:56:00
邯郸某农村信用社,800万股权拍卖成交
2月7日,在拍卖平台成交了一笔邱县农村信用合作联社的800万股权,起拍价640万元经过18次加价竞拍,最终成交价为822万元
2025-02-08 20:57:00
盐湖产业“航母”正式揭牌 此前已“入主”880亿市值上市公司
《科创板日报》2月8日讯(记者 李明明)中国五矿与青海国资携手打造盐湖产业“航母”。今日,中国盐湖工业集团有限公司(以下简称“中国盐湖”)揭牌仪式在青海省举行
2025-02-08 20:59:00
鸿翔环境 2025 年第一次临时股东大会决议
2025年2月8日消息,鸿翔环境科技股份有限公司于 2025 年 2 月 5 日在公司 2 楼会议室以现场投票方式召开 2025 年第一次临时股东大会
2025-02-08 20:59:00
永强岩土 2025 年拟申请综合授信额度不超 6000 万元
2025年2月8日消息,福建永强岩土股份有限公司及全资子公司 2025 年拟向中国境内银行等金融机构申请综合授信额度,授信总额不超过人民币 6000 万元
2025-02-08 21:01:00
鑫闻界|近半鲁股“预告”去年业绩,6成公司盈利,中际旭创最高或赚58亿
齐鲁晚报·齐鲁壹点 黄寿赓截至2月8日,143只鲁股披露2024年业绩预告,2只已披露业绩快报,其中87家公司录得盈利
2025-02-08 21:01:00
学海文化 2025 年第一次临时股东大会决议:为子公司担保 500 万贷款
2025年2月8日消息,学海文化传播股份有限公司 2025 年第一次临时股东大会已召开。会议于 2025 年 2 月 6 日在公司会议室以现场投票方式举行
2025-02-08 21:01:00