• 我的订阅
  • 头条热搜
谷歌大模型推理范式,主要分为两个阶段
...究“自我发现”(Self-Discover),重新定义了大模型推理范式。与已成行业标准的思维链(CoT)相比,新方法不仅让模型在面对复杂任务时表现更佳,还把同等效果下的推理成本压缩至1/40。核心策略其实很简单:千人千面。让大...……更多
港中文团队提出大模型元推理范式,革新大模型的评价体系
...段时间。在 ChatGPT 面世以后,他意识到针对大模型的研究范式存在一定的不足,于是决定来到香港中文大学读博。图 | 曾忠燊(来源:曾忠燊)前不久,曾忠燊和所在团队提出一个全新评测范式。基于这一评测范式,他们又针对...……更多
本文转自:人民日报海外版美国斯坦福大学等机构研究团队近日宣布,在基座大模型基础上,仅耗费数十美元就开发出相对成熟的推理模型。尽管其整体性能尚无法比肩美国开放人工智能研究中心(OpenAI)开发的o1、中国深度求...……更多
科学家提出情景学习新范式,让学霸大模型向学弱大模型输送能力
...院大模型团队的研究员李志宇和同事提出一种情景学习新范式:SLEICL(基于强模型增强的情景学习,Strong LLM Enhanced ICL),能更好地加速小模型的学术研究和产业落地。借助这一方法可以大幅提升小模型的性能表现,从而让小模...……更多
对标o1,Kimi放出了最能打的国产模型
AI 领域正在经历新一轮技术范式的变化,预训练 Scaling Law 放缓之后,推理时间计算成为了新的性能提升关键。两个月前,OpenAI o1 的诞生再次引领了大模型技术的突破。从后训练阶段入手,通过更多的强化学习、原生的思维链和...……更多
大模型步入推理Scaling时代,SambaNova如何挑战英伟达的霸主地位
...家。在性能跃升之外,更重要的是,它揭示了大模型进化范式的转变:通过更多的强化学习(训练时计算)和更多的推理(Test-Time 计算),模型可以获得更强大的性能。这又一次让我们想起 Richard Sutton 在《The Bitter Lesson》中所...……更多
让大模型能听会说,国内机构开源首个端到端语音对话模型Mini-Omni
...文本和语音。为复用语言模型「预测下一个 token」的学习范式,输出侧语音采用离散编码,本文采用了 SNAC 编解码方案。针对语音交互场景,输入语音经过预训练 whisper 的语音编码模块进行连续特征提取,然后通过 2 层 MLP 对齐...……更多
蚂蚁自研知识增强大模型服务框架KAG,可显著提升知识推理准确率
...知识关联,对大语言模型也更友好,同时,参考 DIKW 层次范式在同一实体空间中支持 Schema 约束、无模式建模及文本结构的分层表示。同时,我们探讨了 GraphRAG 范式的两种主要实现:微软的 GraphRAG 和 HippoRAG。尽管微软的 GraphRAG ...……更多
这才是真开源模型!公开后训练一切,性能超越Llama 3.1 Instruct
...幅提升了其后训练方法的复杂度,具体包括采用多轮训练范式、使用人类数据 + 合成数据、使用多个训练算法和训练目标。也正因为此,这些模型的通用性能和专业能力都非常强。但遗憾的是,他们都没有透明地公开他们的训练...……更多
WOT全球技术创新大会2024北京站:探索AI 的无限可能
...于云原生的开源异构算力整合与虚拟化解决方案——第四范式Project-HAMi,降低国产异构算力的使用门槛? 潞晨科技全球首个开源复现ChatGPT的RLHF训练过程和完整解决方案是什么?在大模型部署与应用专题,来自百度、网易云音...……更多
清华团队提出新型光计算架构,光训练速度提升1个数量级
...建立光子传播对称性模型,未采用传统的电训练反向传播范式,化“反”为“前”。这种新范式挣脱了前向-反向光场传播严格对齐的束缚,基于通用的光计算原位训练系统,突破了电训练架构对物理光计算的掣肘。该研究为光...……更多
...字,就需要写在纸上分步完成。模型也是如此,新的推理范式相当于教会了模型如何利用更长的“思考时间”或更多的“计算步骤”。一旦模型学会了这种利用时间来分解和解决复杂问题的方法,它就能解锁更多以前无法完成的...……更多
百度云升级模型服务,百度版GPTs即日开放 | 最前线
...态的3个关键组件:大模型、智能计算、AI原生应用开发新范式。百度云智算大会他提到,在AI时代,应用技术、AI技术、IT基础设施三条平行的发展线终于交汇融合:在应用层,大模型理解、生成、逻辑、记忆的独特能力会催生AI...……更多
汇付天下AI应用丨LLM在投诉风险管控中的应用实践
...用中使用多种机器学习算法和复杂的规则引擎。 “传统范式”是借助“多种算法”和“代码语言”来开发模型。如借助TF-IDF、TextRank等多种算法,并配上大量的代码去综合分析和挖掘关键词,再借助StructBert模型对风险提示词做...……更多
全模态对齐框架align-anything来啦:实现跨模态指令跟随
...地理解和表达复杂的概念。这种全模态的信息流对大模型范式转向通用人工智能也同等重要,研究人员开始尝试将大语言模型进行模态扩展,得到不仅能够处理语言,还可以理解并生成图像、音频、视频等多种信息的全模态模型...……更多
北大推出全新机器人多模态大模型!面向通用和机器人场景的高效推理和操作
...法在操作微调阶段需要更新投影层和整个 LLM。虽然这种范式可以赋予模型动作位姿预测能力,但它也破坏了 MLLM 的固有能力,并且需要大量的训练资源。为了解决这些挑战,我们提出了一种高效的微调策略,如图 3 所示。我们...……更多
阶跃星辰李璟:多模态是AGI的必经之路,视觉模型可按语言模型路线实现大一统
...生成一体化。在阶跃提出的路线图里面,模拟世界的主要范式是模仿学习,就是把互联网上的所有的数据都喂给大模型,通过预测下一个token这样的任务来学习海量数据中的结构和特征。当学会表征世界之后,下一步就要培养机...……更多
邬贺铨院士:金融大模型改变了金融科技范式
...院士邬贺铨在大会上表示“金融大模型改变了金融科技的范式,重塑金融行业的工作方式,改变了金融服务生态。”中国工程院院士邬贺铨发表主题演讲目前金融大模型已经应用在金融资讯、产品介绍内容的文本自动生成,构建...……更多
昇思MindSpore 2.3全新发布
...开发MindSpore开源框架推动了软件性能提升。 AIforScience新范式,生成式AI赋能气动外形设计中国科学院院士、中国空气动力学会理事长唐志共表示:基于昇思MindSpore,生成式气动设计大模型平台打破传统设计范式,设计时长由月...……更多
ECCV 2024 | 南洋理工三维数字人生成新范式:结构扩散模型
...散模型(Structured Latent Diffusion Model)的三维数字人生成新范式 StructLDM。该范式包括三个关键设计:结构化的高维人体表征、结构化的自动解码器以及结构化的隐空间扩散模型。 StructLDM 是一个从图像、视频中学习的前馈三维生...……更多
又慢又贵?OpenAI推理模型“草莓”来了,GPT-5还有多远
...,但GPT-5很可能还会包括本次推出的推理技术。“有两种范式。”穆拉蒂表示,“缩放范式和这种新范式。我们希望将它们结合在一起。”GPT-5的开发之路并不好走。就在当地时间9月11日,GPT-4o/GPT-5的研究领导人、OpenAI版“Her”...……更多
成本不到150元!26分钟训出个推理模型 媲美o1和R1
...并为它配备了简单的budget forcing后,它采用了不同的scaling范式。具体来说,通过多数投票在基础模型上对test-time compute进行Scale的方法,训出的模型无法赶上s1-32B的性能。这就验证了团队之前的“直觉”,即顺序Scaling比并行Scaling...……更多
o1核心作者分享:激励AI自我学习,比试图教会AI每一项任务更重要
“o1发布后,一个新的范式产生了”。其中关键,OpenAI研究科学家、o1核心贡献者Hyung Won Chung,刚刚就此分享了他在MIT的一次演讲。演讲主题为“Don’t teach. Incentivize(不要教,要激励),核心观点是:激励AI自我学习比试图教会...……更多
阶跃星辰CEO姜大昕:强化学习不是AI的尽头,下一步是自主学习,Agent将成超级应用
...和归纳世界三个阶段。在模拟世界阶段,训练模型的主要范式是模仿学习,学习的主要目标是各种模态的表征,下一步是培养模型能够解决复杂问题的能力。人脑对复杂问题的解决是启动系统2的模式,通过问题拆解不断探索。...……更多
科学家提出大模型分子交互学习框架,已在400多万分子对中验证
...lti-hierarchical Chain-of-thought)的概念,来优化大模型的思考范式和训练范式。同时,该团队还采用一个分子交互任务间的动态参数来共享策略,以实现预测效率和预测精度的双赢。目前来看,这款框架最直观的应用在于:能被用来...……更多
对话商汤王晓刚:自动驾驶借助强化学习将超越人类,今年商业化迎爆发
...是模仿学习,很难突破人类驾驶水平的天花板。但AI技术范式的突破,为自动驾驶技术范式提供了新思路。最近火爆的DeepSeek基于纯强化学习的长思维链涌现,打破了数据瓶颈,为自动驾驶带来了突破可能。王晓刚认为,有了强...……更多
o1金牌团队揭秘AI超越人类惊人时刻!22分完整版视频全公开
...6 通过规划、纠错,o1能够解决世界上的新问题7 新的训练范式是一种全新的方法,可以将更多的算力投入到模型中8 o1编写代码时,当其输出要使用的代码时,需要通过单元测试接下来,具体来看下o1模型背后的故事。强化学习+...……更多
被认可的大模型价格战
...在Scaling Law之外,一定要在数据、算法、算力等方面寻找范式上新的转化,“不论是战略上还是信仰上,我认为Scaling Law之外都还有范式变化的可能,不只是去简单地变成压缩模式,而是会走出一个体系,这样才有机会走向AGI,...……更多
利唐i人事:AI智能体员工驱动,实现HR管理效率新范式
...业间的技术交流和合作创新。 三层架构定义HR智能体新范式作为AI智能体驱动的组织变革先锋,利唐i人事率先将AI智能体技术应用于人力资源管理领域,通过创新的三层架构体系,为企业提供更智能、更高效、更人性化的HR解决...……更多
AI发展变慢了?几位AI头部创业者并不赞同
...式从文字走向了语音,思考方式从快思考走向了慢思考,范式在突破。面壁智能是国内较早发布端侧模型的AI创业公司,该公司创始人李大海称,今年AI技术变化非常多,相比去年并不算少。不过他也理解外界认为AI发展速度变慢...……更多
更多关于科技的资讯:
鲁网10月27日讯10月24日,记者在青岛市崂山区委宣传部召开的媒体见面会上获悉,近年来,青岛市崂山区以前瞻布局推动虚拟现实产业高质量发展
2025-10-27 16:24:00
京东11.11直播技术全面升级,立影3D技术、JoyAI大模型重构沉浸式购物体验
随着京东 11.11 大促的火热进行,京东直播再度升级技术布局,以 “立影 3D 技术”“JoyAI大模型”等创新技术
2025-10-27 15:39:00
电机能效提升领域再添标杆!25 项产品 / 技术入选全国节能降碳示范名单
为深入贯彻国家 “双碳” 战略,加快电机领域节能降碳技术创新与成果转化,中国电子节能技术协会此前启动 “全国节能降碳示范产品 / 技术推荐” 征集工作
2025-10-27 15:42:00
吉刻现场|硬核登场!吉林选手角逐第三届全国博士后创新创业大赛
10月26日,第三届全国博士后创新创业大赛在福建泉州(晋江)开幕。本届大赛,吉林省派出23个项目团队组成的参赛队伍角逐三个大赛道
2025-10-27 14:09:00
厦心医院实现手术\
厦门网讯(厦门日报记者 楚燕 通讯员 许良友 付磊 刘云芳)10月23日,一项载入医学史册的创新手术在厦门大学附属心血管病医院(以下简称“厦心医院”)圆满完成
2025-10-27 08:11:00
新闻纵深·解码钢铁大模型|邯钢构建六大领域全链条智能大模型:“聪明大脑”带来极致能效
邯钢构建六大领域全链条智能大模型“聪明大脑”带来极致能效编者按当钢铁遇上人工智能,一场“智变”正悄然发生。为生动展现人工智能为钢铁产业生产
2025-10-27 08:12:00
第十一届NJSD软件开发者会议在软件谷举行江苏规模最大,1400名软件工程师在宁“聚会”南报网讯(记者于洁尘通讯员林园园)70多位业界“大咖”登台演讲
2025-10-27 08:20:00
南报网讯(通讯员郑瑞于品华杨刚记者徐宁)近日,南化公司自主研发的橡胶防老剂中间产品RT培司(4-氨基二苯胺)除盐技术取得突破
2025-10-27 08:21:00
南报网讯(通讯员杨淏涵记者张希)日前,南京林业大学与乐惠国际南京基地签署《校企全面合作协议》《产业研究院共建协议》,全面开启校企战略合作
2025-10-27 08:22:00
高效,是都市青年的通行证:InstaShake以“一杯营养”重塑健康生活方式 —— 新锐品牌以“零添加、无预制、纯手工”的坚守,为上海都市人群注入鲜活能量
在生活节奏不断加速的上海,追求健康与追求效率似乎成为一道单选题。然而,新锐健康饮品品牌InstaShake正以其独特的“零添加
2025-10-27 08:39:00
济宁银行锚定金融“五篇大文章” 多维发力赋能区域经济高质量发展
鲁网10月27日讯近年来,济宁银行围绕做好金融“五篇大文章”,深入洞察科技企业、中小微企业以及重点产业链金融需求,以产品创新破解融资难题
2025-10-27 11:07:00
汪昌莲据《经济日报》报道,“两三元就能买品牌饼干薯片”“上百种散装零食任意挑选”……从县城到乡镇,在街角与量贩零食店不期而遇已成逛街“标配”
2025-10-27 11:10:00
受冷空气影响,气温先降后升,27日早晨气温较低。26日夜间到27日白天晴间多云,北风转南风2~3级,最低气温市区4℃左右
2025-10-27 11:28:00
2025青岛虚拟现实创新大会将启,雷神科技聚焦信创生态构建
鲁网10月27日讯虚实无界,智享未来。2025青岛虚拟现实创新大会即将在崂山区拉开帷幕。2017年以来,由崂山区成功承办的虚拟现实创新大会
2025-10-27 11:48:00
长白时评评论员 唐小兰近日,北京一市民反映有陌生男子在她家中无人时,通过指纹解锁智能门锁多次进入她家。当事人焦女士告诉新京报记者
2025-10-27 13:38:00