• 我的订阅
  • 头条热搜
补齐Transformer规划短板又不放弃快速思考,Dualformer双重优势
...健性。 尤其需要注意,随着任务难度提升,Dualformer 的优势也会增大。对于最大的 30×30 迷宫,Dualformer 的 1-Optimal-64 成功率是仅解答模型的 2.8 倍,在 3-Optimal-64 上是 2.97 倍。Dualformer 的 SWC 分数也比基线高……更多
Meta版慢思考来了!田渊栋团队整合快慢思考,能走迷宫推箱子
...务的模型,在A*搜索算法生成的路径上训练而来,在路径规划任务(如迷宫、推箱子游戏)上表现良好,可以以更高效率找到最优解。研究发现,人类会在思考过程中倾向于找捷径。为了更进一步模拟人类,Dualformer在随机推理轨...……更多
清华团队提出大模型“密度定律”;足球领域首个视觉语言基础模型
...为了解决以往工作的局限性,他们在模型中集成了明确的规划和推理功能,增强了其自主导航和与复杂数字环境交互的能力。他们构建了一个大规模的 GUI agent 轨迹数据集,整合了多模态推理和接地(grounding),并采用了两阶段...……更多
百倍提升7B模型推理能力!颜水成团队携手新加坡南洋理工大学发布Q*算法
...对状态进行最佳优先搜索,实现了对复杂推理任务的全盘规划,从而提升开源模型在推理任务上的性能。其中g(s_t)表示当前轨迹中的多个历史状态,既{s1,...,s_t},的聚合收益。具体g(s_t)的函数形式可以通过人为定义,例如判断当...……更多
LeCun 的世界模型初步实现!基于预训练视觉特征,零样本规划
...续性记忆,不能推理(只要推理的定义是合理的)、不能规划。」Yann LeCun 批评 LLM 的推文之一相反,他更注重所谓的世界模型(World Model),也就是根据世界数据拟合的一个动态模型。比如驴,正是有了这样的世界模型,它们才...……更多
上海AI实验室版o1已上线!数学题、Leetcode全拿下,还会玩24点
...引导模型解决问题的过程,如对问题的理解、知识回忆、规划、执行、反思、总结等。模型在面对复杂任务时,会显式且动态地选择元动作,再进一步展开相关动作的具体思维过程。通过这种设计,利用部分训练任务,可强化模...……更多
北大提出首个通用指令导航大模型系统 | CoRL 24
...,代码也即将在近期开源。大模型如何统一具身指令导航规划?不同的导航任务要求截然不同的能力,经典的物体导目标航任务需要理解房间结构和物体之间的联系,视觉语言导航任务侧重于严谨地遵循指令,而新兴的需求驱动...……更多
Meta提出“可持续思维链”,让大模型在连续潜空间中推理
...贯性,对推理并不重要,而一些关键 token 则需要复杂的规划,给 LLM 带来了巨大的挑战。为了探索 LLM 在不受限制的潜空间中进行推理的潜力,而不是使用自然语言,他们提出了一种新的范式——可持续思维链(Coconut)。他们利...……更多
NeurIPS 2024 | 数学推理场景下,首个分布外检测研究成果来了
本文将介绍数学推理场景下的首个分布外检测研究成果。该篇论文已被 NeurIPS 2024 接收,第一作者王一鸣是上海交通大学计算机系的二年级博士生,研究方向为语言模型生成、推理,以及可解释、可信大模型。该工作由上海交通...……更多
LLM仍然不能规划,刷屏的OpenAI o1远未达到饱和
实验证明,大模型的 System 2 能力还有待开发。规划行动方案以实现所需状态的能力一直被认为是智能体的核心能力。随着大型语言模型(LLM)的出现,人们对 LLM 是否具有这种规划能力产生了极大的兴趣。最近,OpenAI 发布了 o1 ...……更多
理想:升级版端到端+VLM、AI推理可视化交互系统 将于月底全量推送
...系统1模型实时推理出的10种模态轨迹,每种模态代表一种规划决策,系统会选出当下的最优的决策轨迹。而系统2 VLM(视觉语言模型),它能理解交通规则,读懂路牌的标识,分析复杂的路况,可以说双系统就是文武双全。通过这...……更多
理想的智能驾驶,到底「City 不 City」?
...能够在各种道路条件下行驶; 绕行丝滑:具备时空联合规划能力,对道路障碍物的避让和绕行更加流畅;路口轻松:通过超视距导航选路能力,在复杂路口也能顺畅通行;默契安心:考虑用户心理安全边界,实现分米级微操,...……更多
大模型不会推理,为什么也能有思路?有人把原理搞明白了
大模型不会照搬训练数据中的数学推理,回答事实问题和推理问题的「思路」也不一样。大语言模型的「推理」能力应该不是推理,在今年 6 月,一篇 Nature 论文《Language is primarily a tool for communication rather than thought》曾引发……更多
阿里妈妈首提AIGB并实现大规模商业化落地,将正式开源Benchmark
...跌。而 DiffBid 可以明显减少这种问题除了实际线上效果的优势外,相比于其他方法,DiffBid 还具有其他两方面的优势。首先,相比于通过端到端方法直接输出 Bidding 信息,DiffBid 生成的轨迹信息具有更好的可解释性(图 4)。有助...……更多
阿里多模态检索智能体,自带o1式思考过程!复杂问题逐步拆解
...系列基准数据集上的实验中,OmniSearch展现了显著的性能优势。特别是在处理需要多步推理、多模态知识和快速变化答案的问题时,OmniSearch相较于现有的mRAG方法表现更为优异。目前OmniSearch在魔搭社区还有demo可玩。动态检索规划...……更多
o1带火的CoT到底行不行?新论文引发了论战
...问题上为 MMLU 和 MMLU Pro 带来助益。CoT 在形式推理方面的优势和劣势下面来解释 CoT 有助于符号推理任务的原因。很多符号和半符号推理任务都可以分成两个阶段:规划与执行。该团队也基于此思路进行了分析。设置 1 和 2:少样...……更多
CMU清华教LLM练成数学高手,LeanSTaR训练模型边思考边证明,登顶新SOTA
...办?CMU清华团队提出了Lean-STaR训练框架,在语言模型进行推理的每一步中都植入CoT,提升了模型的定理证明能力,成为miniF2F上的新SOTA。如果想训练LLM证明定理的能力,你会怎么做?既然模型可以通过海量语料学会生成文本,那...……更多
成本不到150元!26分钟训出个推理模型 媲美o1和R1
成本不到150元,训练出一个媲美DeepSeek-R1和OpenAI o1的推理模型?!这不是洋葱新闻,而是AI教母李飞飞、斯坦福大学、华盛顿大学、艾伦人工智能实验室等携手推出的最新杰作:s1。在数学和编程能力的评测集上,s1的表现比肩Dee...……更多
单图解锁全景视角!北大/港中文/腾讯等推出ViewCrafter | 已开源
...,并生成高保真度、一致性强的新视角视频。△相机轨迹规划算法此外,现有的视频扩散模型难以生成长视频,因为长视频推理会造成巨大的计算开销。为了解决这一问题,研究采用了一种迭代式的新视角生成策略,并提出了一...……更多
世界模型突破!极佳科技首次利用世界模型增强4D驾驶场景重建效果
...模型,赋予 AI 大模型对于 4D 空间的理解、生成、常识和推理的能力,实现 4D 空间中的交互和行动,走向通用空间智能。通用空间智能对于影视游戏、元宇宙等虚拟空间的内容创作,以及自动驾驶、具身智能等物理空间的数据生...……更多
o1规划能力首测!已超越语言模型范畴,preview终于赢mini一回
...ew在规划任务上,表现显著优于o1-mini。相比于传统模型的优势更是碾压级别,在超难任务上的准确率比Llama3.1-405B高了11倍。要知道之前,OpenAI自己人也发了一张图,显示preview论性能比不过满血版,论经济性又不如mini,处于一个...……更多
北大推出全新机器人多模态大模型!面向通用和机器人场景的高效推理和操作
...boMamba图 1. RoboMamba 具备的机器人相关能力,其中包括任务规划、提示性任务规划、长程任务规划、可操纵性判断、可操纵性生成、未来与过去预测、末端执行器位姿预测等。摘要机器人操纵的一个基本目标是使模型能够理解视觉...……更多
...,并在Gameof24、8-Puzzle和PocketCube等严苛测试中展现出明显优势。XOT框架的关键步骤包括:在预训练阶段,MCTS模块在特定任务上进行预训练,以学习有关有效思维搜索的领域知识。策略和价值网络指导搜索过程。在推理过程中,预...……更多
机器学习和人工智能在各行各业掀起了新的变革浪潮
...程。虽然大语言模型陆续开发了上下文敏感记忆、多步骤规划和战略性工具等高级功能,但这些“智能体”在执行任务时通常无法吸取历史经验,从而导致其解决问题的能力效率低下。来自清华大学、大连理工大学和北京邮电大...……更多
行业丨抢滩下一个高地,分布式云计算迎来黄金发展期!
...现低延迟的实时AI推理,提升用户体验。分布式云计算的优势高可靠性分布式系统通过将数据分散存储在多个节点上,实现了数据的冗余备份和容错处理,提高了系统的可靠性。可扩展性分布式云计算可以根据需求按需增加或减...……更多
全球首篇!调研近400篇文献,鹏城实验室&中大深度解析具身智能
...抓取需要全面的语义理解、场景感知、决策和稳健的控制规划。具身抓取方法将传统的机器人运动学抓取与大型模型(如大语言模型和视觉语言基础模型)相结合,使智能体能够在多感官感知下执行抓取任务,包括视觉主动感知...……更多
李飞飞团队ReKep荣获CoRL-LEAP研讨会最佳论文奖,具身智能又下一城!
...复杂的操纵行为团队还证明了ReKep的特定形式具有独特的优势,因为它们可以通过预先训练的大型视觉模型(LVM)和视觉语言模型(VLM)实现自动化,从而能够根据RGB-D观察结果和自由形式的语言指令对ReKep在大约10Hz的时间内进...……更多
首个o1复现开源RL框架OpenR来了,UCL、上交等高校联合团队发布
...高效的变体,即群体相对策略优化 (GRPO)。这两者主要在优势值的计算方法上不同:PPO 使用一个网络来估算状态值,并通过广义优势估算 (GAE) 技术来计算优势值;而 GRPO 则简化了这个过程,直接使用标准化的奖励信号来估算动作...……更多
车企争抢L3路试牌照,谁会是宝马奔驰后的下一批?
...车道划线,对车道的定位观感更加准确。由于感知模型的优势,采用该类感知模型的车型都会更容易获得L3路试牌照。华为虽然现在并没有公布公布L3级自动驾驶进度,但网传华为将参与L3级自动驾驶相关标准的制定。本月稍早前...……更多
行业第一梯队智驾稳了!理想端到端+VLM智驾体验
...接管通过闸机、高速ETC收费站方面,理想还有明显的领先优势。One More Thing这次的智驾体验路线目的地是广州中汽研检验中心,理想汽车此次包场测试,还带来了即将为车主推送的全速域无上限激活的AEB紧急制动和全自动紧急转...……更多
更多关于科技的资讯:
当东明石化“EPOE”,遇上DeepSeek
大众网记者 王晓姝 济南报道在国际舞台上,中国“智”造正以前所未有的速度崛起,近日火爆全球的DeepSeek是其中代表
2025-03-01 21:17:00
震撼!一千四百年前古人竟已用上储粮黑科技
快科技3月1日消息,近日,据央视报道,一项关于古代储粮技术的发现再次引发了热议。原来,在一千四百年前,古人就已经掌握了一种堪称“黑科技”的储粮秘诀
2025-03-01 13:38:00
春晚出圈的宇树科技招人了:年薪可达百万!
快科技3月1日消息,蛇年春晚舞台上,来自杭州的宇树科技凭借出色表现刷屏热搜。而就在今日,杭州今年新春最大规模的线下人才招聘会于上午9时在杭州大会展中心盛大启幕
2025-03-01 14:08:00
凌晨退税喜提5万多!网友直呼:3月第一份快乐
快科技3月1日消息,三月第一天,许多网友卡点干的第一件事,就是退税!2024年度个人所得税综合所得汇算清缴今天开始了,汇算的时间为3月1日至6月30日
2025-03-01 14:38:00
抗病5年 知名歌手方大同去世:年仅41岁
快科技3月1日消息,今日中午,歌手方大同独立音乐厂牌@赋音乐FUMUSIC 发布消息称:以积极的态度面对顽疾5年, 方大同于2025年2月21日早晨
2025-03-01 14:38:00
董明珠回应500亿做芯片质疑:国家和企业发展都需要
快科技3月1日消息,近日,董明珠在央视频的视频中回应了外界对于格力投资500亿做芯片的质疑。此前,格力大价钱投资造芯片引发热议
2025-03-01 15:08:00
DeepSeek大胆披露:理论利润率高达545%!
快科技3月1日消息,今日,DeepSeek正式在知乎平台开设了其官方账号,并发布了一篇名为《DeepSeek-V3/R1推理系统概览》的技术文章
2025-03-01 15:08:00
同比增长62.2%:蔚来公司2月交付新车13192辆
快科技3月1日消息,在刚刚过去的2月份,蔚来公司交付新车13192台,同比增长62.2%。其中,蔚来品牌交付新车9143台
2025-03-01 16:08:00
气胸是什么病、为什么高瘦男性容易得:医生科普
快科技3月1日消息,歌手方大同因病去世,享年41岁,据报道,2010年他因操劳过度,出现(气胸)爆肺而数度住院。那么什么是气胸
2025-03-01 16:38:00
每年导致40万人截肢:这种动物被联合国列入“危险疾病名单”
在非洲肯尼亚的一个小镇,11 岁的比阿特丽斯坐在路边,用手划拉着地上的泥土打发时间。忽然,石缝中弹出一条“红线”,她还没来得及反应
2025-03-01 17:08:00
9.98万 赛力斯蓝电E5 PLUS长续航先享版上市:纯电能跑165公里
快科技3月1日消息,就在今日,蓝电E5 PLUS 165km长续航先享版车型上市,限时一口价9.98万元,限量1000台
2025-03-01 17:08:00
英特尔再度推迟“千亿美元”芯片工厂的建设!投产起码再等5年
陷入困境的芯片制造商英特尔周五(2月28日)宣布,该公司将推迟在俄亥俄州开设芯片制造工厂的进程。2022年时,英特尔曾承诺将投资高达1000亿美元
2025-03-01 17:38:00
骁龙8 Elite近乎“白菜价”!有厂商要干到2500元以内:网友担心会不会赔钱
快科技3月1日消息,博主数码闲聊站爆料,某款骁龙8 Elite机型好像要干到2500元以内。这条微博引发热议,有网友担心“厂商会不会赔钱”
2025-03-01 17:38:00
因“方向感不清晰”:车主控诉小鹏P7+智驾时撞上护栏
快科技3月1日消息,当前一切高阶智能驾驶均为辅助驾驶,使用时还需小心谨慎,时刻准备接管,以防事故发生。据“1818黄金眼”最新报道
2025-03-01 18:08:00
老了也有依靠!京东外卖骑手感谢刘强东
快科技3月1日消息,据媒体报道,近日京东首批全职外卖骑手代表正式签约,引发热议。多位外卖骑手表示,公司为其缴纳五险一金对房贷
2025-03-01 18:08:00