• 我的订阅
  • 头条热搜
补齐Transformer规划短板又不放弃快速思考,Dualformer双重优势
...健性。 尤其需要注意,随着任务难度提升,Dualformer 的优势也会增大。对于最大的 30×30 迷宫,Dualformer 的 1-Optimal-64 成功率是仅解答模型的 2.8 倍,在 3-Optimal-64 上是 2.97 倍。Dualformer 的 SWC 分数也比基线高……更多
Meta版慢思考来了!田渊栋团队整合快慢思考,能走迷宫推箱子
...务的模型,在A*搜索算法生成的路径上训练而来,在路径规划任务(如迷宫、推箱子游戏)上表现良好,可以以更高效率找到最优解。研究发现,人类会在思考过程中倾向于找捷径。为了更进一步模拟人类,Dualformer在随机推理轨...……更多
百倍提升7B模型推理能力!颜水成团队携手新加坡南洋理工大学发布Q*算法
...对状态进行最佳优先搜索,实现了对复杂推理任务的全盘规划,从而提升开源模型在推理任务上的性能。其中g(s_t)表示当前轨迹中的多个历史状态,既{s1,...,s_t},的聚合收益。具体g(s_t)的函数形式可以通过人为定义,例如判断当...……更多
LeCun 的世界模型初步实现!基于预训练视觉特征,零样本规划
...续性记忆,不能推理(只要推理的定义是合理的)、不能规划。」Yann LeCun 批评 LLM 的推文之一相反,他更注重所谓的世界模型(World Model),也就是根据世界数据拟合的一个动态模型。比如驴,正是有了这样的世界模型,它们才...……更多
上海AI实验室版o1已上线!数学题、Leetcode全拿下,还会玩24点
...引导模型解决问题的过程,如对问题的理解、知识回忆、规划、执行、反思、总结等。模型在面对复杂任务时,会显式且动态地选择元动作,再进一步展开相关动作的具体思维过程。通过这种设计,利用部分训练任务,可强化模...……更多
北大提出首个通用指令导航大模型系统 | CoRL 24
...,代码也即将在近期开源。大模型如何统一具身指令导航规划?不同的导航任务要求截然不同的能力,经典的物体导目标航任务需要理解房间结构和物体之间的联系,视觉语言导航任务侧重于严谨地遵循指令,而新兴的需求驱动...……更多
NeurIPS 2024 | 数学推理场景下,首个分布外检测研究成果来了
本文将介绍数学推理场景下的首个分布外检测研究成果。该篇论文已被 NeurIPS 2024 接收,第一作者王一鸣是上海交通大学计算机系的二年级博士生,研究方向为语言模型生成、推理,以及可解释、可信大模型。该工作由上海交通...……更多
LLM仍然不能规划,刷屏的OpenAI o1远未达到饱和
实验证明,大模型的 System 2 能力还有待开发。规划行动方案以实现所需状态的能力一直被认为是智能体的核心能力。随着大型语言模型(LLM)的出现,人们对 LLM 是否具有这种规划能力产生了极大的兴趣。最近,OpenAI 发布了 o1 ...……更多
理想的智能驾驶,到底「City 不 City」?
...能够在各种道路条件下行驶; 绕行丝滑:具备时空联合规划能力,对道路障碍物的避让和绕行更加流畅;路口轻松:通过超视距导航选路能力,在复杂路口也能顺畅通行;默契安心:考虑用户心理安全边界,实现分米级微操,...……更多
大模型不会推理,为什么也能有思路?有人把原理搞明白了
大模型不会照搬训练数据中的数学推理,回答事实问题和推理问题的「思路」也不一样。大语言模型的「推理」能力应该不是推理,在今年 6 月,一篇 Nature 论文《Language is primarily a tool for communication rather than thought》曾引发……更多
o1带火的CoT到底行不行?新论文引发了论战
...问题上为 MMLU 和 MMLU Pro 带来助益。CoT 在形式推理方面的优势和劣势下面来解释 CoT 有助于符号推理任务的原因。很多符号和半符号推理任务都可以分成两个阶段:规划与执行。该团队也基于此思路进行了分析。设置 1 和 2:少样...……更多
CMU清华教LLM练成数学高手,LeanSTaR训练模型边思考边证明,登顶新SOTA
...办?CMU清华团队提出了Lean-STaR训练框架,在语言模型进行推理的每一步中都植入CoT,提升了模型的定理证明能力,成为miniF2F上的新SOTA。如果想训练LLM证明定理的能力,你会怎么做?既然模型可以通过海量语料学会生成文本,那...……更多
单图解锁全景视角!北大/港中文/腾讯等推出ViewCrafter | 已开源
...,并生成高保真度、一致性强的新视角视频。△相机轨迹规划算法此外,现有的视频扩散模型难以生成长视频,因为长视频推理会造成巨大的计算开销。为了解决这一问题,研究采用了一种迭代式的新视角生成策略,并提出了一...……更多
世界模型突破!极佳科技首次利用世界模型增强4D驾驶场景重建效果
...模型,赋予 AI 大模型对于 4D 空间的理解、生成、常识和推理的能力,实现 4D 空间中的交互和行动,走向通用空间智能。通用空间智能对于影视游戏、元宇宙等虚拟空间的内容创作,以及自动驾驶、具身智能等物理空间的数据生...……更多
北大推出全新机器人多模态大模型!面向通用和机器人场景的高效推理和操作
...boMamba图 1. RoboMamba 具备的机器人相关能力,其中包括任务规划、提示性任务规划、长程任务规划、可操纵性判断、可操纵性生成、未来与过去预测、末端执行器位姿预测等。摘要机器人操纵的一个基本目标是使模型能够理解视觉...……更多
o1规划能力首测!已超越语言模型范畴,preview终于赢mini一回
...ew在规划任务上,表现显著优于o1-mini。相比于传统模型的优势更是碾压级别,在超难任务上的准确率比Llama3.1-405B高了11倍。要知道之前,OpenAI自己人也发了一张图,显示preview论性能比不过满血版,论经济性又不如mini,处于一个...……更多
...,并在Gameof24、8-Puzzle和PocketCube等严苛测试中展现出明显优势。XOT框架的关键步骤包括:在预训练阶段,MCTS模块在特定任务上进行预训练,以学习有关有效思维搜索的领域知识。策略和价值网络指导搜索过程。在推理过程中,预...……更多
机器学习和人工智能在各行各业掀起了新的变革浪潮
...程。虽然大语言模型陆续开发了上下文敏感记忆、多步骤规划和战略性工具等高级功能,但这些“智能体”在执行任务时通常无法吸取历史经验,从而导致其解决问题的能力效率低下。来自清华大学、大连理工大学和北京邮电大...……更多
行业丨抢滩下一个高地,分布式云计算迎来黄金发展期!
...现低延迟的实时AI推理,提升用户体验。分布式云计算的优势高可靠性分布式系统通过将数据分散存储在多个节点上,实现了数据的冗余备份和容错处理,提高了系统的可靠性。可扩展性分布式云计算可以根据需求按需增加或减...……更多
全球首篇!调研近400篇文献,鹏城实验室&中大深度解析具身智能
...抓取需要全面的语义理解、场景感知、决策和稳健的控制规划。具身抓取方法将传统的机器人运动学抓取与大型模型(如大语言模型和视觉语言基础模型)相结合,使智能体能够在多感官感知下执行抓取任务,包括视觉主动感知...……更多
首个o1复现开源RL框架OpenR来了,UCL、上交等高校联合团队发布
...高效的变体,即群体相对策略优化 (GRPO)。这两者主要在优势值的计算方法上不同:PPO 使用一个网络来估算状态值,并通过广义优势估算 (GAE) 技术来计算优势值;而 GRPO 则简化了这个过程,直接使用标准化的奖励信号来估算动作...……更多
车企争抢L3路试牌照,谁会是宝马奔驰后的下一批?
...车道划线,对车道的定位观感更加准确。由于感知模型的优势,采用该类感知模型的车型都会更容易获得L3路试牌照。华为虽然现在并没有公布公布L3级自动驾驶进度,但网传华为将参与L3级自动驾驶相关标准的制定。本月稍早前...……更多
行业第一梯队智驾稳了!理想端到端+VLM智驾体验
...接管通过闸机、高速ETC收费站方面,理想还有明显的领先优势。One More Thing这次的智驾体验路线目的地是广州中汽研检验中心,理想汽车此次包场测试,还带来了即将为车主推送的全速域无上限激活的AEB紧急制动和全自动紧急转...……更多
...发了一种新的方式,帮助人工智能(AI)系统在编码、战略规划和机器人科学三个领域执行复杂推理任务。聊天生成预训练转换器(ChatGPT)和“克劳德3-奥普斯”(Claude 3 Opus)等大语言模型(LLM),根据人类输入“提示词”处理和生成文本...……更多
让OpenAI o1逆天的慢思考,360两月前就做出来了?周鸿祎CoE媲美CoT,应用太前瞻
...、「诗词赏析」这类比较具有中文特色的问题,CoE的领先优势更加明显。目前,360的「多模型协作」已经能打败并远远甩开GPT-4o,媲美o1-preview。这就是复仇者联盟的力量,即使灭霸的能力再强,团结起来的团队,依旧是强大、...……更多
小模型越级挑战14倍参数大模型,谷歌Test-Time端新的Scaling Law
...无法完全替代预训练的扩展,但已显示出在某些情况下的优势。引发网友热议这项研究被网友po出来后,引发热议。有网友甚至表示这解释了OpenAI“草莓”模型的推理方法。为什么这么说?原来就在昨晚半夜,外媒The Information放...……更多
Scaling Law瓶颈,Cursor编程为什么这么强?新研究掏出秘密武器
...基础模型表现得好很多,但当需要生成多个答案时,这种优势就不明显了 —— 在某些情况下,甚至完全相反。模型在生成答案时缺乏多样性,这对于搜索的效果非常不利。特别是在极端情况,比如采用「贪心解码」,模型给出...……更多
全球十亿级轨迹点驱动,首个轨迹基础大模型来了
...标进行训练,旨在最小化预测点和原始点之间的差异。在推理和下游任务应用中,预训练的 UniTraj 编码器可以作为通用特征提取器,通过简单的适配器训练,即可支持多种轨迹相关的分析任务,如分类、预测和异常检测等。实验...……更多
大模型推理乘上RISC-V快车?国内AI芯片创企推大模型系列一体机
...场算力需求提供了在用户高并发、技术自主可控方面具有优势的新选择。AI大模型在推理侧的新机遇与RISC-V创新架构具有的可扩展性、可编程性、超大规模等优势特点不谋而合。技术和场景应用的双重优势下,希姆计算的大模型...……更多
商汤生成式AI业务飙涨256%,成为中国大模型、智算服务市场占有率领头羊
...发展时期,我们正处于下一波增长的有利位置。商汤核心优势在于‘大装置+大模型’深度协同,具备打造对标一流的大模型能力,在原生多模态、视频流自然交互,以及低成本模型推理架构上构建独特的优势,从而在激烈的市...……更多
更多关于科技的资讯:
9999元已全部约满!小米汽车精英驾驶培训正式开课
快科技12月16日消息,小米汽车精英驾驶培训课程于12月16日在浙江国际赛车场正式开启,为期7天,至22日结束。据悉,该培训课程定价为9999元/天
2024-12-16 18:19:00
铠侠推出EXCERIA PLUS G4固态硬盘:PCIe 5.0规范、读速达10000MB/s
快科技12月16日消息,铠侠推出全新消费级固态硬盘“EXCERIA PLUS G4系列”。据悉,该系列固态硬盘内置先进的BiCS FLASH 3D闪存技术
2024-12-16 18:19:00
iPhone 17外观大改:这奇怪的摄像头设计为哪般 背后原因分析
近日,一组iPhone 17系列的外观设计图曝光,图片显示,苹果沿用了几年的设计终于发生了变化,摄像头Deco从现在位于左上角的方形改成了一行
2024-12-16 18:19:00
韩国半导体优势地位岌岌可危!中国、马来西亚成最大竞争者
快科技12月16日消息,据媒体报道,韩国在全球半导体产业中的竞争优势正面临严峻挑战。根据韩国贸易投资振兴公社(KOTRA)最新发布的“出口相似度指数”(ESI)报告
2024-12-16 18:19:00
餐桌黑钻石!女子山上挖到1.71kg巨无霸黑松露
快科技12月16日消息,据报道,昆明安宁市县街街道居民吴女士在上山捡菌子的过程中,挖到了一颗重量超过1.7公斤的超大松露
2024-12-16 18:49:00
奔驰C级新车23万元 男子以租代购买二手:结果要花40多万
快科技12月16日消息,据报道,肖先生在福州的一家二手车行,看上了一辆奔驰C 260L二手车,但因为个人征信不合贷款要求
2024-12-16 18:49:00
中国职场人求职目标2024最新排名:国企/事业单位第一 外企第二
快科技12月16日消息,近日,脉脉高聘发布《2024年度人才迁徙报告》。《报告》显示,从求职目标来看,2024年,国企/事业单位依旧是职场人的第一选择
2024-12-16 18:49:00
2024打工人高薪榜:数字前端工程师第一 平均月薪达67728元
快科技12月16日消息,近日,脉脉高聘发布的《2024年度人才迁徙报告》显示,近三年新经济行业求职难度依然存在,人才供需比从1
2024-12-16 19:19:00
台积电2nm深度揭秘:又涨价了!一块晶圆近22万元
根据计划,台积电最新的N2(2nm)制程将于明年下半年开始量产,目前台积电正在尽最大努力完善该技术,以降低可变性和缺陷密度
2024-12-16 19:19:00
2024年度车型激烈争夺中:哪吒L力压小米SU7 极越杀入前10
快科技12月16日消息,随着年底的临近,懂车帝携手抖音共同推出了2024年度车评选活动。目前,哪吒L以超过120万的得票数高居榜首
2024-12-16 19:19:00
爆款预订 智界R7增程版将上市:建议奇瑞好好跟着华为混
快科技12月16日消息,带油箱的智界R7将于本月19日上市,预计价格会比纯电版低1-2万元,起售价有望降低到24万以下
2024-12-16 19:19:00
比亚迪鲨鱼皮卡获澳大利亚年度车大奖!准车主:领先柴油皮卡几年
快科技12月16日消息,据报道,比亚迪Shark 6(鲨鱼)插混皮卡在澳大利亚上市后一炮打响。根据比亚迪澳洲经销商提供的数据
2024-12-16 19:49:00
100多万的S800将从这里诞生:尊界超级工厂正式落成!
快科技12月16日消息,据江汽集团官方发布,今日,尊界超级工厂落成仪式在安徽合肥顺利举行。安徽省国资委党委书记、主任王宏出席落成仪式
2024-12-16 19:49:00
春节申遗成功:饺子/汤圆、春联/桃符又吵起来了
还没到春节,春节就上了热搜——这个中国人最重要的传统佳节申遗成功啦!12月4日,联合国教科文组织保护非物质文化遗产政府间委员会第19届常会通过评审
2024-12-16 19:49:00
7岁女孩天生异瞳:妈妈担心受歧视 网友却集体羡慕
快科技12月16日讯,近日,据国内媒体报道,一名来自江西的7岁女孩天生异瞳,因其中一个瞳孔是灰蓝色在学校受到同学喜爱的消息冲上了热搜
2024-12-16 19:49:00