• 我的订阅
  • 头条热搜
ICML2024演讲爆火!Meta朱泽园揭秘大模型内心世界:不同于人类推理
...M) 是如何解数学题的?是通过模板记忆,还是真的学会了推理思维?模型的心算过程是怎样的?能学会怎样的推理技能?与人类相同,还是超越了人类?只学一种类型的数学题,是会对通用智能的发展产生帮助?LLM 为什么会犯...……更多
...智能的旗舰产品GPT-4为代表的大语言模型在逻辑测试中的推理表现很糟糕:它们犯下前后不一致的错误,而且推理过程往往是荒谬的。近日发表在《皇家学会开放科学》杂志上的一项研究表明,大语言模型所依赖的语料库往往反...……更多
o1金牌团队揭秘AI超越人类惊人时刻!22分完整版视频全公开
...共有8点:1 强化学习加持的o1,比人类更善于发现新的CoT推理步骤2 自我批评的涌现,是o1最强有力的时刻3 让o1「超时」前完成回答,然后突然有了「啊哈」时刻 4 scaling参数规模的挑战,以及继续沿着强化学习算法进步之路5 许...……更多
刚刚,OpenAI震撼发布o1大模型!强化学习突破LLM推理极限
...专门解决难题。这是一个重大突破,新模型可以实现复杂推理,一个通用模型解决比此前的科学、代码和数学模型能做到的更难的问题。OpenAI 称,今天在 ChatGPT 和大模型 API 中新发布的是该系列中的第一款模型,而且还只是预览...……更多
重磅!OpenAI o1模型还没有实现真正的逻辑推理能力
...-preview和o1-mini模型已经可以使用。OpenAI宣布,“新模型在推理能力上代表了人工智能能力的新水平,因此,计数器将重置为1”。根据OpenAI的自测,o1在竞赛编程问题(Codeforces)中排名第89个百分点,在美国数学奥林匹克竞赛(AIM...……更多
语言≠思维,大模型学不了推理:一篇Nature让AI社区炸锅了
...到,人类大脑生成和解析语言的神经网络并不负责形式化推理,而且提出推理并不需要语言作为媒介。这篇论文声称「语言主要是用于交流的工具,而不是思考的工具,对于任何经过测试的思维形式都不是必需的」,引发了科技...……更多
谷歌大模型推理范式,主要分为两个阶段
...新研究“自我发现”(Self-Discover),重新定义了大模型推理范式。与已成行业标准的思维链(CoT)相比,新方法不仅让模型在面对复杂任务时表现更佳,还把同等效果下的推理成本压缩至1/40。核心策略其实很简单:千人千面。...……更多
...AI)系统在编码、战略规划和机器人科学三个领域执行复杂推理任务。聊天生成预训练转换器(ChatGPT)和“克劳德3-奥普斯”(Claude 3 Opus)等大语言模型(LLM),根据人类输入“提示词”处理和生成文本。研究人员说,过去18个月,这些技...……更多
人类和AI在推理任务中的表现相似,Google DeepMind研究揭示AI局限性
...人工智能(AI),特别是大型Transformer语言模型(LMs)在推理任务中的表现及其局限性。研究结果显示,尽管这些模型在处理自然语言方面表现卓越,但在复杂逻辑推理任务中,人类和语言模型都会受到语义内容合理性和可信度...……更多
整合长期记忆,AI实现自我进化,探索大模型这一可能性
...也能让模型在处理长期、分散和个性化的数据时逐步提升推理和学习能力。用 LTM 数据提升模型能力,使其能够自我进化在传统 LLM 中,更新模型通常需要调整所有参数,而如果目的是处理个体数据,那这种操作明显不切实际。...……更多
专注于推理的OpenAI“草莓”模型两周内发布?是人工智能下一重大突破
...“秋季发布”(9月至11月)要更早。上述报道称,专注于推理能力的人工智能“草莓”发布前后还有一些亟待解决的问题,但看似“仓促上马”似乎说明OpenAI感受到了大语言模型驱动产品领域的激烈竞争压力,希望通过近几个月...……更多
研究人员给了人工智能一个“内心独白”,结果大大提高了其性能
...工智能系统,让它在说话前先思考。内心独白提高了常识推理能力,并使其数学成绩翻了一番。一项新的研究表明,给人工智能系统一个“内心独白”会大大提高它们的推理能力。这种方法训练的人工智能系统,会在对提示做出...……更多
大模型是否有推理能力?DeepMind数月前的论文让AI社区吵起来了
...,随着 OpenAI o1 模型的推出,关于大型语言模型是否拥有推理能力的讨论又多了起来。比如苹果在前段时间的一篇论文中指出,只要给模型一些干扰,最聪明的模型也会犯最简单的错误(参见《给小学数学题加句「废话」,OpenAI ...……更多
阿里CEO吴泳铭:AI计算正在加速演进,成为计算体系的主导
...会变成智能机器人。5、未来几乎所有的软硬件都会具备推理能力,它们的计算内核将变成GPU AI算力为主、CPU传统计算为辅的计算模式。6、过去一年,阿里云投资新建了大量的AI算力,但还是远远不能满足客户的旺盛需求。7、人...……更多
LeCun最新万字演讲:纯语言模型到不了人类水平,我们基本已放弃
...:完全是胡说八道。最新的公开演讲中,他表示,系统要推理、规划和理解物理世界,至少还需要几年甚至十年的时间,这时候人工智能才能达到人类水平。他还透露,现在Meta基本已经放弃纯语言模型,因为,仅通过文本训练...……更多
OpenAI o1模型到博士水平了?复旦教授:没有真正推理能力,学到的还是概率相关性
...小尺寸版o1-mini。OpenAI官方发文称,新模型旨在解决复杂推理问题,训练模型在响应之前花更多时间思考,类似于人类的思考方式。“新模型在推理能力上代表了AI能力的新水平。”OpenAI称,该模型可以解决科学、编程和数学等更...……更多
OpenAI发布最新技术研究,AI“黑盒”不再是难题!
...出了正确回答。大部分大模型都在给出答案的同时呈现了推理过程。智谱清言给出的推理过程显示,在比较13.11%和13.8%时,13.11%是更大的数值。这是因为当比较两个百分数时,我们首先比较整数部分,如果它们相同,则比较小数...……更多
从通用人工智能到科学智能,“AI爱因斯坦”还远吗?
...需要像AlphaGo Zero那样,从围棋本身出发,具备自我学习、推理和创新能力,这样才可以达到通用人工智能。要实现这一目标,一是需要结合快思考的“黑盒”预测和慢思考的“白盒”逻辑推理,打造“灰盒”可信大模型;二是融...……更多
对话云天励飞董事长陈宁:2030年人类将实现AGI,推理芯片将是蓝海市场|钛媒体AGI
...拥有一个AI Agent。“如果说2024年是大模型落地应用之年,推理就会越来越重要。此前在训练芯片市场上,英伟达一骑绝尘,占有绝对的市场占有率,那么今天,推理芯片市场没有垄断性的巨头。这不仅是万亿级、万亿颗芯片的蓝...……更多
Transformer推理天花板被谷歌打破?DeepMind首席科学家亮出84页PPT,却遭LeCun反对
...科学家Denny Zhou拿出一篇ICLR 2024论文称:CoT可以让Transformer推理无极限。但随即他就遭到了田渊栋和LeCun等的质疑。最终,CoT会是通往AGI的正确路径吗?随着OpenAI o1的爆火,最近CoT也成了圈内热议的高频词。靠着CoT的强力加持,o1...……更多
推理性能直逼o1,DeepSeek再次出手,重点:即将开源
...出手了,这次又是重磅炸弹。昨晚,DeepSeek 上线了全新的推理模型 DeepSeek-R1-Lite-Preview,直接冲击 OpenAI o1 保持了两个多月的大模型霸主地位。在美国数学竞赛(AMC)中难度等级最高的 AIME 以及全球顶级编程竞赛(codeforces)等权...……更多
AI新时代揭幕!会“思考解题逻辑”的OpenAI推理大模型登场
...凌晨1时许,AI时代迎来崭新的起点——能够进行通用复杂推理的大模型终于走到台前。OpenAI在官网发布公告称,开始向全体订阅用户开始推送OpenAI o1预览模型——也就是此前被广泛期待的“草莓”大模型。OpenAI表示,对于复杂推...……更多
菲尔兹奖得主亲测GPT-4o,经典过河难题破解失败!最强Claude 3.5回答离谱,LeCun嘲讽LLM
... 3.5依旧答错了。LeCun在此嘲讽大模型一番,大模型竟可以推理...?问题在于,LLM没有常识,不理解现实世界,也不会规划和推理。LLM行不行,就看提示了一位网友分析总结了,以上LLM失败的原因。他表示,LLM本身就是个「哑巴」...……更多
科学家竞相破解大型语言模型背后的谜团
...复杂行为。面对复杂问题,人类在潜意识里会进行分步骤推理。受此启发,谷歌团队2022年引入了“思维链提示”,以描述一种让LLM展示其“思维”的方法。简单来说,思维链提示是一种特殊的上下文学习。不同于标准提示只给...……更多
语音克隆达到人类水平,微软全新VALL-E 2模型让DeepFake堪比配音员
...零样本TTS依旧是一个有挑战性的问题。「零样本」意味着推理过程中,模型只能参照一段简短的陌生语音样本,用相同的声音说出文本内容,就像一个能即时模仿的口技大师。听到这里,不知道你会不会突然警觉——有这种能力...……更多
OpenAI没有放弃的机器人梦想
...人团队,理由是缺乏训练机器人使用人工智能进行移动和推理所需的数据,研发受到了阻碍。当时,在美国创业孵化器Y Combinator的论坛上,BuzzFeed数据科学家马克思·伍尔夫(Max Woolf)直言 :“一种可能准确但带有讽刺意味的观...……更多
AI表现直逼国际奥数优秀选手, 它要 “征服”数学了吗?
...同步揭晓。这项赛事的目的是推动发展大语言模型的数学推理能力,训练出更高数学水平的新AI模型。纯数学领域中的重大发现是推理和创造力的灵感结晶,往往意味着人类智慧极限的突破。迄今为止,解决或协助解决高等级数...……更多
罗格斯大学团队提出思想链概念,提高大模型的算数推理能力
...概念,提高了大语言模型(LLM,large language models)在复杂推理任务上的性能,例如算术推理、常识推理和符号推理等。图 | 金明宇(来源:金明宇)CoT 的原理是通过提供推理过程的示例,来教会模型处理推理,详细说明导致最...……更多
让大模型能听会说,国内机构开源首个端到端语音对话模型Mini-Omni
...交互能力的核心是模型能够直接在语音模态上进行理解和推理,这与传统的语音对话功能有本质的不同。现有的语音对话系统中主要包含 3 个过程:首先将输入语音内容转换为文本,其次利用大语言模型进行文本推理,最后利用...……更多
全模态对齐框架align-anything来啦:实现跨模态指令跟随
...-Vision-11B 既准确地识别出了餐厅,还提供了细致的思考与推理过程。 在 Meta 并未披露 Llama-3.2-11B-Vision-Instruct 对齐技术细节情况下,北大对齐小组愿开源数据、训练、模型、评估的全流程,为全模态对齐研究贡献力量。对齐框架...……更多
更多关于科技的资讯:
不可思议!美国一公司宣布复活猛犸象等史前生物:科学家担忧
快科技1月22日消息,有美国生物公司表示,他们已经开始尝试复活灭绝生物。美国一家生物初创公司正在利用DNA和基因组学,试图复活灭绝的动物
2025-01-22 08:01:00
通过太空验证!中国首款高压抗辐射碳化硅功率器件研制成功
快科技1月22日消息,据报道,中国科学院微电子研究所刘新宇、汤益丹团队和中国科学院空间应用工程与技术中心刘彦民团队等开展合作
2025-01-22 08:01:00
最强iPad!iPad Pro 2025已在路上
快科技1月22日消息,据供应链消息,苹果今年将会更新iPad Pro系列产品,预计将同时推出11英寸和13英寸两种型号
2025-01-22 08:01:00
首超4亿吨!2024年我国国内油气产量当量创历史新高:还发现多个亿吨级油田
快科技1月22日消息,据国内媒体报道称,过去的2024年,我国国内油气产量当量创历史新高。2024年,我国国内油气产量当量首次超过4亿吨
2025-01-22 08:01:00
辽宁省内政府电子产品补贴第一单落地辽宁移动 开启惠民消费新篇章
本文转自:人民网-辽宁频道1月20日下午,随着国家《手机、平板、智能手表(手环)购新补贴实施方案》的实施,政府为电子产品进行补贴的全省线下门店第一单在沈阳移动成功落地
2025-01-22 08:19:00
2024年12月,中国电科网络通信研究院(以下简称“网通院”)“产研协同模式促进手机直连卫星芯片专利技术产业化”入选全国专利产业化优秀案例
2025-01-22 08:27:00
油车高速上追尾小米SU7 结果油车起火引燃小米SU7
快科技1月22日消息,日前,一则小米SU7起火的视频引起网友关注。旁边车道车主提供的行车记录仪显示,前方车辆突然紧急刹停
2025-01-22 08:31:00
春节大礼包米粉专属!小米赠送高铁零食礼袋:限量10万份
快科技1月22日消息,2025年春运已于1月14日开启,许多人正在或即将奔向阔别已久的故乡。日前,小米公司为米粉准备了专属春节大礼包
2025-01-22 08:31:00
黄子韬给中奖员工直接转账18888元:女生激动不已
1月22日消息,据媒体报道,近日黄子韬“空降”公司年会,给员工抽特等奖18888元大红包,现场直接给中奖员工转账。抽中大奖的女员工收到转账后激动不已
2025-01-22 08:31:00
14岁了!微信体积从457KB增至近700MB 你的手机还受得了吗
快科技1月22日消息,不知不觉微信已经诞生14年了,这款国民应用也是间接推动了手机存储升级。昨天微信官方在微信派视频号
2025-01-22 09:01:00
米哈游重拳出击!捣毁多个涉嫌制售《原神》外挂犯罪团伙
快科技1月22日消息,今日,米哈游发文,称近期米哈游联合警方“亮剑”开展打击外挂专项行动,已取得突破性进展,捣毁了多个涉嫌制售《原神》《崩坏
2025-01-22 09:01:00
南北方小年为何相差一天:这种差异源于历史传统和民俗文化演变
快科技1月22日消息,今天是腊月二十三,这一天是北方传统的小年,而南方传统小年则在腊月二十四。据了解,小年是民间祭灶的日子
2025-01-22 09:01:00
本文转自:人民网-安徽频道春节临近,安庆持续营造节日氛围,进一步拉动消费,迎接节日消费高峰的到来。1月20日,“灵蛇迎春 焕新生活”2025年安庆市消费品以旧换新启动仪式
2025-01-22 09:17:00
本文转自:人民网-北京频道人民网北京1月22日电 (记者李博)为塑造产业发展新动能新优势,北京市经济和信息化局日前发布了2025年北京市高精尖产业发展项目资金和支持中小企业发展资金实施指南(第一批)
2025-01-22 09:18:00
GFIC荣誉揭晓,虹魔方包揽三大奖项!
在近日举办的2024GFIC(全球互联网大会)期间,GFIC组委会基于不同产业链生态合作伙伴,重磅推出面向全行业的“灵境杯”与“万象之星”奖项评选活动
2025-01-22 09:23:00