• 我的订阅
  • 头条热搜
谷歌Gemini数学反超o1预览版!成本仅1/10、无需额外思考时间
数学击败o1-preview,成本仅为十分之一,并且几乎没有思考延迟!OpenAI《Her》全量开放同一天,谷歌Gemini 1.5迎来重大升级。除此之外,价格也是原来的一半,速度限制提升2-3倍;输出速度提升2倍、延迟降为原来三分之一。开发...……更多
OpenAI o1模型到博士水平了?复旦教授:没有真正推理能力,学到的还是概率相关性
...enAI表示,o1模型会提供由模型生成的思维链摘要。预览版成本比GPT-4o贵三四倍,9.11和9.8谁大仍翻车“发布o1-preview的一个动机是为了观察哪些使用场景会变得流行,以及这些模型在哪些方面还需要改进。”OpenAI员工称。该公司表...……更多
科学家推出大模型数据集,涵盖奥赛数学题,有望让AI辅导数学课程
...间,他曾和同事在一项研究中成功提高了大模型解决复杂数学问题的能力。通过此,他们不仅提高了算法推理速度,还提高了算法搜索中间结果的质量。所新推出的数据集 TriMaster100,也更加符合算法在复杂数学问题下的评价场...……更多
谷歌deepmind公布ai模型训练法
...包含“上限级问题”、“装箱问题”在内的一系列“涉及数学、计算机科学领域的复杂问题”。▲图源谷歌DeepMind(下同)据悉,FunSearch模型训练法主要为AI模型引入了一个“评估器(Evaluator)”系统,AI模型输出一系列“创意解...……更多
Nature重磅:击败人类数学家,AI首次攻破经典数学难题
人工智能(AI)大模型,击败了人类数学家。今天,在 Nature 上发表的一篇论文中,Google DeepMind 的研究团队介绍了一种搜索数学和计算机科学新解决方案的方法——FunSearch,它的工作原理是将预先训练的大型语言模型(LLMs)与...……更多
补齐Transformer规划短板又不放弃快速思考,Dualformer双重优势
...只是模仿系统 2 式的思考过程,那就需要远远更高的计算成本才能完成,同时响应速度也会大幅减慢。在研究这一难题时,田渊栋团队得到了一项惊人发现:在解决推理任务时,一种简单的数据方案就足以实现即时动态的系统 1 ...……更多
OpenAI o1太贵?那就自己做一个!纯提示方法让普通LLM进化出复杂推理能力
...便宜,现在想体验更强大的推理能力则需要再付出几倍的成本。 嫌OpenAI o1太贵?那就自己做一个!近日,一篇利用纯提示方法让普通LLM变身成为OpenAI o1的文章在推特上爆火。开源代码:https://github.com/harishsg993010/LLM-Research-Scr……更多
重磅!OpenAI o1模型还没有实现真正的逻辑推理能力
...数学能力看,o1最强,其次是o1-mini,最后是o1-preview,从成本看,o1最高,其次是o1-preview,最便宜是o1-mini。o1擅长准确生成和调试复杂代码,o1-preview具有较强的推理能力和广阔的世界知识,o1-mini速度更快、比o1-preview便宜80%的推.……更多
姚期智院士大模型新研究:思维图DoT,用数学理论确保AI逻辑一致
...让大模型思考更像人类。团队更是为这种推理过程提供了数学基础,通过拓扑斯理论(Topos Theory)正式化(formalize)DoT,确保其逻辑一致性和合理性。相比CoT将推理过程表示为线性序列,DoT更能捕捉人类推理的复杂性。相比引入...……更多
腾讯推出新一代大模型「混元Turbo」,性能大幅提升,定价低50%
...模型采用MoE架构,比上一代产品推理效率提升100%,推理成本降低50%,解码速度提升20%。腾讯公司副总裁、云与智慧产业事业群COO兼腾讯云总裁邱跃鹏宣布,腾讯混元Turbo在腾讯云上线,输入和输出价格只有前代模型的一半,输出...……更多
openaio1系列模型开放访问权限
...限价格较高,其中o1的输入词元(tokens)费用为每百万个成本15美元(IT之家备注:当前约107元人民币),输出词元费用为每百万个60美元(当前约427元人民币),通过API调用时,o1模型每分钟最多可调用500次,o1-mini模型每分钟可...……更多
刚刚,OpenAI震撼发布o1大模型!强化学习突破LLM推理极限
...编程的更快、更便宜的推理模型。」整体来看,o1-mini 的成本比 o1-preview 低 80%。由于 o1 等大型语言模型是在大量文本数据集上预训练,虽然具有广泛世界知识,但对于实际应用来说,可能成本高昂且速度慢。相比之下,o1-mini 是...……更多
对标o1,Kimi放出了最能打的国产模型
...6 日交上又一份答卷:Kimi 的最新一代推理模型 k0-math,在数学能力已实现对标 OpenAI o1-mini 和 o1-preview。这是 Kimi 推出的首款推理能力强化模型,k0-math 同样采用了全新的强化学习和思维链推理技术,通过模拟人脑的思考和反思过...……更多
终于,Claude上线LaTeX公式渲染功能,评论区网友沸腾了
当 ChatGPT 老早就支持使用 LaTeX 语言输入和显示数学公式时,Claude 现在终于补上了这一功能。在论文、书籍、报告或幻灯片中,我们有时需要插入数学公式或符号。其中使用 LaTeX 语言来生成数学公式或符号是主要方式之一,这...……更多
又慢又贵?OpenAI推理模型“草莓”来了,GPT-5还有多远
...15美元,每100万输出tokens收费60美元。与GPT-4o 相比,输入成本是其3倍,输出成本是其4倍。 o1-mini则定位速度更快、成本效益更高,据称在数学和编程方面的表现也较为出色,在AIME和Codeforces等评估基准上几乎与o1性能相当,可作...……更多
谷歌 Gemini 1.5 AI 模型再进化:成本更低、性能更强、响应更快
...出了 Gemini-1.5-Pro-002和 Gemini-1.5-Flash-002,相比较此前版本成本更低、性能更强、响应更快。成本更低谷歌下调了 token 输入和输出费用,Gemini-1.5-Pro-002 和 Gemini-1.5-Flash-002 最高降幅 50%,提高了两种模……更多
用AI自动设计智能体,数学提分25.9%,远超手工设计
...用,可能需要考虑不同的优化目标,例如智能体的性能、成本、延迟或安全性。评估函数定义如何评估候选智能体的这些指标。例如,为了评估智能体在未见过的数据上的表现,一种简单的方法是计算任务验证数据的准确率。该...……更多
学而思推出数学答疑原生AI工具九章随时问,“AI将重新定义教育行业”
...,好未来官方公众号宣布,学而思九章大模型推出最新AI数学搜索答疑工具“九章随时问”,即日起免费开放使用。这款产品打破了以生成式AI技术为基础,通过启发引导的方式帮助学生解决数学难题,旨在培养学生的解题思维...……更多
Anthropic再反击!发布Claude 3.5吊打GPT-4o,视觉、逻辑推理等方面表现更强
...创作情况。介绍完功能特性,再来说说很多人关心的使用成本。 值得一提的是,与上代“大杯”模型Claude 3 Opus相比,这次的“中杯”Claude 3.5 Sonnet不仅研发成本低,其性能已是最强前辈的两倍。官方介绍,该模型每百万输入Toke...……更多
00后华裔小哥哈佛辍学组团挑战英伟达,史上最快AI芯片Sohu推理性能超H100二十倍!
...展1000倍必定是昂贵的,形象地解释,下一代数据中心的成本将超过一个小国的GDP。按照目前的发展速度,我们的硬件、成本、财力根本无法跟得上。GPU撞墙了圣克拉拉,英伟达总部所在地,不愿意让人知道的小秘密是—— GPU性...……更多
OpenAI超级对齐团队遗作:两个大模型博弈一番,输出更好懂了
...成的是易于理解的文本,这件事非常重要,尤其是在处理数学、编码这样的复杂任务时。如下图所示,你让 AI 写一个快速排序算法,AI 很快就写出来了,而且答案很简洁。但不会写代码的你要怎么判断 AI 写得对不对呢?OpenAI 在...……更多
...地了解大模型产品的性能和特点提供了参考样本。AI高考数学全不及格?换个打开方式试试近期,一则“AI高考测试出分,数学全不及格”的消息登上“热搜”。消息出自上海人工智能实验室旗下司南评测体系OpenCompass对7个开源...……更多
Transformer打破三十年数学猜想!Meta研究者用AI给出反例,算法杀手攻克数学难题
【新智元导读】30多年的数学猜想首次获得了进展!Meta等学者提出的PatternBoost,使用Transformer构造了一个反例,反驳了一个已悬而未决30年的猜想。是否所有数学问题都适合机器学习技术?这样的未来太令人期待了。30多年的数...……更多
o1金牌团队揭秘AI超越人类惊人时刻!22分完整版视频全公开
...是「推理专家」,比以往OpenAI最佳模型还要聪明。而且,成本和延迟都非常低。 或许,它可能不一定知道一位名人,以其出生日期,但确具备了如何进行有效推理,和大量智慧的能力。OpenAI研究人员表示,将进一步改进算法,...……更多
OpenAI发布最新技术研究,AI“黑盒”不再是难题!
...名为Arrakis或Q*,原本计划在2025年作为GPT-5发布,但因推理成本高而取消。OpenAI此后计划,2027年发布的Q 2025(GPT-8)将实现完全的AGI。人工智能(AI)研究者早就在争论用什么标准判断人类实现了通用人工智能(AGI)。OpenAI最近开...……更多
OpenAI-o1思考替代法火了!焦剑涛高徒一作提出思考偏好优化
...任务复杂度进行不同时间的思考。不限于推理性的逻辑或数学任务,一般问答也能思考的那种。最近畅销书《Python机器学习》作者Sebastian Raschka推荐了一项新研究,被网友们齐刷刷码住了。论文一作为华人学者Tianhao Wu,导师之一...……更多
史上最快AI芯片「Sohu」,速度10倍于B200,哈佛辍学生打造
...驾驶所需的模型。Etched 给我们算了一笔账:芯片项目的成本为 5000 万至 1 亿美元,需要数年时间才能投入生产。另一方面,当模型训练成本超过 10 亿美元、推理成本超过 100 亿美元时,使用专用芯片是不可避免的。在这种产业...……更多
给小学数学题加句废话,OpenAI o1就翻车了,苹果论文质疑AI推理
...么得出上述结论的呢?我们先来看一个例子。假设有一个数学问题:奥利弗在星期五摘了 44 个猕猴桃。然后在星期六摘了 58 个猕猴桃。星期天,他摘的猕猴桃数量是星期五的两倍。奥利弗有多少个猕猴桃?显然,答案是 44 + 58 +...……更多
Llama版o1来了,来自上海AI Lab,强化学习代码已开源,
...o1发布之前,团队就开始探索蒙特卡洛树搜索提高大模型数学能力,积累了一些关注。这次最新开源代码,也在开发者社区引起热议。OpenAI o1系列发布后,团队开始升级算法,专注于数学奥赛问题,作为OpenAI草莓项目的开源版本...……更多
kimi智能助手更新:模型能力提升
...答更快,等待时间更短。逻辑推理能力提升:其中Kimi的数学和编程能力更强了。翻译能力提升:进一步提升了中英翻译场景下的语言准确性。其他体验优化:解决了Kimi在单行数学公式输出格式不稳定、部分场景回答不够精练等...……更多
更多关于科技的资讯:
400名OpenAI员工迎股票套现机会 每人最多1000万美元
快科技12月18日消息,近期,约400名OpenAI的现任及前任员工即将迎来一笔意外之财——数百万美元的套现机会。这一举动源自于旧金山的这家创新巨头与日本软银集团达成的一项特殊股票回购协议
2024-12-18 21:21:00
全网唯一!AMD X870E主板完美达成192GB DDR5:6400MHz高频、C28低时序
快科技12月18日消息,佰维宣布,已经达成192GB容量、6400MHz频率、C28时序的单系统内存配置,各项参数都堪称完美
2024-12-18 21:21:00
别担心了!iPhone 17 Pro后摄还是三角排列
快科技12月18日消息,近日,关于iPhone 17 Pro的外观爆料引发全网激烈讨论,消息称苹果将带来六年最大设计换代
2024-12-18 21:51:00
折叠屏手机鼻祖柔宇宣告破产:名下资产首拍无果 二拍降价近2.5亿元
快科技12月18日消息,不久前宣告破产的国内柔性显示屏独角兽——深圳柔宇显示技术有限公司名下资产一拍以流拍告终。据最新报道称
2024-12-18 21:51:00
广汽飞行汽车AirJet亮相:8轴8桨与双涵道构型 续航超200km
快科技12月18日消息,广汽今日举办了广汽飞行汽车发布会,发布全新飞行汽车品牌GOVY(高域),第二款飞行汽车产品GOVY AirJet也首发亮相
2024-12-18 22:21:00
华为AR-HUD规模化上车:超过20款在研车型将搭载
快科技12月18日消息,华为今天与十余家供应商完成智能车载光业务合作签约,范围涵盖智能HUD、车灯模组领域。据了解,华为智能车载光领域创建于2021年
2024-12-18 22:21:00
DC新《超人》电影先导预告来了:超人一飞冲天
快科技12月18日消息,DC电影宇宙即将带来全新力作——《超人》的30秒先导预告片即将到来,预示着一场视觉盛宴的序幕正式拉开
2024-12-18 22:51:00
母女二人睡觉正酣 插线板竟“放火”烧家
据北京大兴消防消息,近日,北京市大兴区一居民楼8层某住户家中清晨6时许突发火灾。接警后,消防部门迅速响应并赶往现场。幸运的是
2024-12-18 23:51:00
非洲矿业大国控告苹果公司使用“罪恶金属”
根据媒体周二报道,以丰富矿产资源著称的刚果民主共和国,已经在法国和比利时对苹果公司提出刑事控告,指控科技巨头在供应链中使用来自该国犯罪组织的金属矿产
2024-12-18 23:51:00
车主办完贷款被告知车卖给了别人 宝马4S店给银行的登记证书是假的
快科技12月18日消息,日前,一位车主发网上发帖投诉称,自己的宝马新车在4S店被盗了。车主提供的情况说明中显示,他今年7月份
2024-12-18 23:51:00
海外媒体宣发:打开国际传播的新大门
一、何为海外媒体宣发?(一)定义阐述海外媒体宣发,简单来说,就是把产品、活动或品牌等相关信息,借助海外的新闻媒体、社交媒体
2024-12-18 21:31:00
三星在印度推送One UI 7 Beta 面向S24用户
【CNMO科技消息】据外媒报道,近日,三星正式面向印度的GalaxyS24系列用户开放了OneUI7Beta测试计划。用户现在可以通过SamsungMembers应用程序报名参与测试
2024-12-18 22:43:00
华为在马来西亚举行旗舰新品发布会 Mate X6将亮相
【CNMO科技消息】据CNMO了解,华为将于12月18日,即今日在马来西亚举行旗舰新品发布会,推出MateX6折叠屏手机
2024-12-18 22:44:00
苹果地图网页版迎来升级!新增支持“环顾四周”功能
【CNMO科技消息】苹果于7月份首次推出的网页版苹果地图已经升级,支持“环顾四周”功能。该功能本质上相当于谷歌街景。在支持的区域中
2024-12-18 22:44:00
海信电视用户满意度连续10年蝉联第一 含金量满满!
【CNMO科技消息】12月13日,在南宁举办的“2024年满意中国大会”上,中国质量协会发布了2024年用户满意等级评价结果
2024-12-18 22:45:00