• 我的订阅
  • 头条热搜
o3 压台登场:OpenAI 卷动推理 AI 模型风云,迈向 AGI 新巅峰
IT之家 12 月 21 日消息,“12 Days of OpenAI”活动已拉上帷幕,OpenAI 的 o3 系列大模型压台登场,官方称在某些场景下,其推理能力非常接近通用人工智能(AGI)。名称最新的 AI 模型为何跳过 o2,叫做 o3 呢?OpenAI 公司首席执行官山...……更多
奥林匹克竞赛里选最聪明的AI:Claude-3.5-Sonnet vs. GPT-4o?
...人工智能也能参与其中,那将是一场怎样的智慧与技术的巅峰对决?不再仅仅是肢体的较量,AI的加入无疑将开启对智力极限的新探索, 也期待更多AI选手加入这场智力的奥运会。 ……更多
OpenAI o1模型到博士水平了?复旦教授:没有真正推理能力,学到的还是概率相关性
...小尺寸版o1-mini。OpenAI官方发文称,新模型旨在解决复杂推理问题,训练模型在响应之前花更多时间思考,类似于人类的思考方式。“新模型在推理能力上代表了AI能力的新水平。”OpenAI称,该模型可以解决科学、编程和数学等更...……更多
OpenAI直播最后一天放出“王炸”:下一代推理模型o3亮相
...术分享直播活动的最后一天!周五,OpenAI发布了下一代的推理模型o3,这是今年早些时候发布的o1推理模型的升级版本。更准确地说,o3是一个模型系列——就像o1一样,同时有o3和o3-mini两个版本,后者是一款更小的精简版模型,...……更多
...智能的旗舰产品GPT-4为代表的大语言模型在逻辑测试中的推理表现很糟糕:它们犯下前后不一致的错误,而且推理过程往往是荒谬的。近日发表在《皇家学会开放科学》杂志上的一项研究表明,大语言模型所依赖的语料库往往反...……更多
刚刚,OpenAI震撼发布o1大模型!强化学习突破LLM推理极限
...专门解决难题。这是一个重大突破,新模型可以实现复杂推理,一个通用模型解决比此前的科学、代码和数学模型能做到的更难的问题。OpenAI 称,今天在 ChatGPT 和大模型 API 中新发布的是该系列中的第一款模型,而且还只是预览...……更多
超级推理模型正面对垒:谷歌版o1发布次日,OpenAI o1下一代o3登场
来源:硬AI圣诞节前,人工智能巨头上演了一场精彩的推理模型攻防战。谷歌和OpenAI正面对垒,谷歌刚发布自家的先进推理模型挑战OpenAI的o1,第二天,OpenAI就推出了升级版的最强推理模型o3。美东时间12月20日周五,在为期12个...……更多
很强也很贵!OpenAI12天12场直播收官,官宣最新推理模型o3
...,和网友猜测的一样,人工智能(AI)巨头OpenAI发布最新推理模型o3和o3-mini。前一天,OpenAI公司CEO山姆·奥特曼(Sam Altman)就曾发文提到三个“o”暗示了o3的到来。为何新模型跳过了o2直接命名o3?奥特曼表示是为了避免和英国电...……更多
思维链让大模型推理更准确?谷歌早于OpenAI押中o1模型核心原理
...本质的不同。其不仅进入到复杂的领域,还表现出超强的推理能力。OpenAI 将 GPT-4o 和 o1 在国际数学奥林匹克竞赛资格考试方面进行对比测试。根据结果,二者差异显著,其中,前者正确解决问题的准确率是 13.4%,而 o1 的准确率...……更多
影响英伟达根本逻辑的大争论:OpenAI改变策略意味着什么?谁在撒谎?
大模型预训练“缩放定律”定律失效?模型推理成“解药”,英伟达一家独大格局要变天?“缩放定律”指导下,AI大模型预训练目前遭遇瓶颈。据路透12日报道,硅谷主要AI实验室的新模型训练计划目前普遍进展不顺,新模型...……更多
小模型越级挑战14倍参数大模型,谷歌Test-Time端新的Scaling Law
...发布的新模型草莓所用的方法。研究团队探究了在大模型推理时进行计算优化的方法,根据给定的prompt难度,动态地分配测试时(Test-Time)的计算资源。结果发现这种方法在一些情况下比单纯扩展模型参数更经济有效。换句话说...……更多
AI“明星”选手巅峰对决!记者实测最新谷歌Gemini与GPT-4o
近日,OpenAI用一场26分钟的线上直播展示了GPT-4o带来的惊艳交互能力,将新一轮AI争霸带入了“Her 时代”。GPT-4o的“o”代表“omni”,一词意为“全能”,该模型能够实现无缝的文本、视频和音频输入,并生成相应模态的输出,...……更多
Gemini 开启大模型路线之争,新战场将“数流成河”
...k母公司Meta或特斯拉,跻身所谓“七巨头”。3、作为登上巅峰后迄今为止在互联网搜索领域的完全统治地位的 Google,这一年天天度日如年,这一年内讨论 Google 被颠覆话题占有史以来的99%以上,如果谷歌输掉这场AI之战会怎么样...……更多
ChatGPT o1满血版上线!实测中它竟然败给了国产AI?
...特曼用一个简单的柱状图给出了对比:可以看到o1在数学推理和编程领域的表现要明显优于o1-preview,提升幅度在50%左右,而在科研领域的测试里,o1相对于o1-preview的表现就提升有限了。图源:OpenAI考虑到o1模型不需要额外加钱就...……更多
上海AI实验室版o1已上线!数学题、Leetcode全拿下,还会玩24点
...编程、数字游戏等任务。这就是上海AI实验室版o1——强推理模型书生InternThinker,刚刚正式开放试用!新模型不仅在长思维能力方面有了很大提升,而且还能在推理过程中进行自我反思和纠正。先来一起看两个例子感受一下:比...……更多
LLM仍然不能规划,刷屏的OpenAI o1远未达到饱和
...模型,一举创造了很多历史记录。o1 模型拥有真正的通用推理能力。在一系列高难基准测试中展现出了超强实力,相比 GPT-4o 有巨大提升,让大模型的上限从「没法看」直接上升到优秀水平,不专门训练直接数学奥赛金牌,甚至...……更多
多模态LLM视觉推理能力堪忧,浙大领衔用GPT-4合成数据构建多模态基准
新智元报道编辑:乔杨【新智元导读】LLM的数学推理能力缺陷得到了很多研究的关注,但最近浙大、中科院等机构的学者们提出,先进模型在视觉推理方面同样不足。为此他们提出了一种多模态的视觉推理基准,并设计了一种...……更多
面壁智能发布开源大模型eurux-8x22b
...大模型Eurux-8x22B,包括 Eurux-8x22B-NCA 与 Eurux-8x22B-KTO,主打推理能力。官方测试中,Eurux-8x22B 在 LeetCode(180道LeetCode编程真题)与 TheoremQA(IT之家注:美国大学水准的STEM题目)测试上超越了 Llama3-70B……更多
重磅!OpenAI o1模型还没有实现真正的逻辑推理能力
...-preview和o1-mini模型已经可以使用。OpenAI宣布,“新模型在推理能力上代表了人工智能能力的新水平,因此,计数器将重置为1”。根据OpenAI的自测,o1在竞赛编程问题(Codeforces)中排名第89个百分点,在美国数学奥林匹克竞赛(AIM...……更多
对标OpenAI o1!Kimi发布新一代推理模型:中考高考考研全第一
...的Kimi国产大模型正式发布k0-math。k0-math是Kimi推出的首款推理能力强化模型,采用全新强化学习和思维链推理技术,通过模拟人脑的思考和反思过程,大幅提升解决数学难题的能力。据了解,在多项数学基准能力测试中,k0-math的...……更多
菲尔兹奖得主亲测GPT-4o,经典过河难题破解失败!最强Claude 3.5回答离谱,LeCun嘲讽LLM
... 3.5依旧答错了。LeCun在此嘲讽大模型一番,大模型竟可以推理...?问题在于,LLM没有常识,不理解现实世界,也不会规划和推理。LLM行不行,就看提示了一位网友分析总结了,以上LLM失败的原因。他表示,LLM本身就是个「哑巴」...……更多
摩尔线程GPU千卡集群完成师者AI 70亿参数教育大模型训练测试
...教育大模型的快速迭代,摩尔线程、师者AI还将在大模型推理上开展适配工作。摩尔线程夸娥方案是业内首个跑通、跑完国产大模型的千卡集群,基于全功能MTT S4000 GPU,提供软硬一体化的全栈解决方案,具备模型覆盖、推理加速...……更多
北大等发布多模态版o1!首个慢思考VLM将开源,视觉推理超闭源
...ion模型打造,超越传统思维链提示,实现自主“慢思考”推理。在多模态推理基准测试中,LLaVA-o1超越其基础模型8.9%,并在性能上超越了一众开闭源模型。新模型具体如何推理,直接上实例,比如问题是:减去所有的小亮球和紫...……更多
AI新时代揭幕!会“思考解题逻辑”的OpenAI推理大模型登场
...凌晨1时许,AI时代迎来崭新的起点——能够进行通用复杂推理的大模型终于走到台前。OpenAI在官网发布公告称,开始向全体订阅用户开始推送OpenAI o1预览模型——也就是此前被广泛期待的“草莓”大模型。OpenAI表示,对于复杂推...……更多
人类和AI在推理任务中的表现相似,Google DeepMind研究揭示AI局限性
...人工智能(AI),特别是大型Transformer语言模型(LMs)在推理任务中的表现及其局限性。研究结果显示,尽管这些模型在处理自然语言方面表现卓越,但在复杂逻辑推理任务中,人类和语言模型都会受到语义内容合理性和可信度...……更多
对着3个中国AI大模型,两个美国科技界大佬深聊了半小时
...前AI行业快速发展,竞争也越来越激烈,特别是各种高级推理模型之间的竞争。过去一段时间,中国科技公司陆续发布了3款自研的AI模型,分别是DeepSeek(深度求索)的Deepseek R1、阿里巴巴的Marco-1以及香港中文大学与商汤科技的...……更多
北大推出全新机器人多模态大模型!面向通用和机器人场景的高效推理和操作
...码仓库 Trending Research 第一位。为了赋予机器人端到端的推理和操纵能力,本文创新性地将视觉编码器与高效的状态空间语言模型集成,构建了全新的 RoboMamba 多模态大模型,使其具备视觉常识任务和机器人相关任务的推理能力,...……更多
科学家推出大模型数据集,涵盖奥赛数学题,有望让AI辅导数学课程
...解决复杂数学问题的能力。通过此,他们不仅提高了算法推理速度,还提高了算法搜索中间结果的质量。所新推出的数据集 TriMaster100,也更加符合算法在复杂数学问题下的评价场景。目前,赵子龙的合作者正在基于本次成果开...……更多
...资者关系活动记录表中表示,公司9月1日发布了风云卫大模型,现在还处于测试试用阶段,目前还没有单独针对大模型风云卫单产品的签单,后续以什么形式和模式进行签单现阶段暂不明确。绿盟科技专注于信息安全领域,在全...……更多
突破时间序列组合推理难题!南加大发布一站式多步推理框架TS-Reasoner
【新智元导读】TS-Reasoner是一个创新的多步推理框架,结合了大型语言模型的上下文学习和推理能力,通过程序化多步推理、模块化设计、自定义模块生成和多领域数据集评估,有效提高了复杂时间序列任务的推理能力和准确性...……更多
更多关于科技的资讯:
手机上好看的照片在PC上被打回原形!背后原因揭开
在如今这个移动影像盛行的时代,手机毫无悬念地成为了大家记录生活点滴的得力“神器”。咱们用手机随手一拍,那照片在手机屏幕上呈现出来的效果
2025-04-12 23:50:00
联发科天玑9400e五月见:性能超越骁龙8 Gen3
快科技4月12日消息,博主数码闲聊站暗示,联发科天玑9400e的跑分成绩超过了高通骁龙8 Gen3和骁龙8s Gen4
2025-04-12 23:50:00
网上的1TB机械硬盘只要50元:背后有猫腻
虽然固态硬盘的价格已经降了不少,但是超大容量存储还得看机械硬盘。如果在购物平台搜过硬盘,你可能会被那些硬盘的价格感到震惊
2025-04-13 00:20:00
用数据告诉你 为什么不要再买GTX 750Ti了
如果说显卡经典永流传有段位的话,那么GTX1060占一席位,GTX750Ti也要占一席位。GTX750Ti的神奇之处在于
2025-04-13 00:20:00
河北一摄像头拍到“风的轨迹”:雨水被大风刮得横着走
4月13日消息,据媒体报道,近日河北张家口康保县的一个摄像头拍下雨水被大风刮得“横着走”的场景。根据监控数据,当地风速达19米/秒
2025-04-13 00:50:00
大风天气减少外出!北京大风吹倒超1200株树木
4月13日消息,据媒体报道,截至4月12日19时00分,北京全市园林绿化系统累计出动巡查抢险人员29629人次,车辆4394台次
2025-04-13 00:50:00
透过3个经济指数看信心(经济新方位)
本文转自:人民日报新近公布的制造业、零售业、物流业相关指数均处于扩张区间——透过3个经济指数看信心(经济新方位)本报记者 刘温馨 王 珂 韩 鑫图①
2025-04-13 05:56:00
本文转自:人民日报孟祥夫“现在,人工智能这么强大,啥都会,孩子还那么努力学习干吗?绘画、书法都不用学了。”一位朋友在聊天中说道
2025-04-13 05:58:00
4月12日,携程口碑榜2025年度目的地榜单发布,太原市入选“2025亚洲100经典目的地”“2025中国50艺术瑰宝目的地”“2025中国100经典目的地”3个榜单
2025-04-13 06:31:00
越来越多国家加入!法国网友自发组抵制美货消费者群:开始抵制可口可乐和麦当劳等
4月13日消息,据国外媒体报道称,随着美国关税大棒挥向全球,一些国家和地区的用户开始自发的抵制美国商品了。法国“抵制美货”的风潮也愈演愈烈
2025-04-13 07:20:00
消博会时装秀启幕 T台入展会“即秀即购”让时尚“破界跨圈”
南海网4月12日消息(记者 周静泊)4月12日晚,第五届中国国际消费品博览会时装秀在cdf海口国际免税城拉开帷幕。今年
2025-04-12 23:20:00
vivo智能戒指专利公布:能自动定位最佳动脉监测点
快科技4月12日消息,近日,vivo公司获得了一项智能戒指专利,通过传感器能够自动寻找到最佳的动脉监测点。专利文件显示
2025-04-12 18:20:00
网友体验REDMI K80一碰秒传功能:手机PC互联秒速搞定
快科技4月12日消息,有博主发视频分享了REDMI K80的一秒碰传功能,仅需将K80碰一碰REDMI Book触控板
2025-04-12 18:50:00
水中大熊猫 超22万尾子二代中华鲟放归长江
快科技4月12日消息,“2025年中华鲟增殖放流活动”今天在宜昌、荆州两地同步举行,超22万尾子二代中华鲟放归长江。该活动由三峡集团联合湖北省农业农村厅举办
2025-04-12 18:50:00
关税提高别怕 东方甄选启动“外贸优品入驻”专项行动
快科技4月12日消息,东方甄选今日发布公告称,即日起正式启动“外贸优品入驻”专项行动,让更多优质外贸产品走进直播间,服务国内消费者
2025-04-12 18:50:00