• 我的订阅
  • 头条热搜
谷歌大模型推理范式,主要分为两个阶段
...究“自我发现”(Self-Discover),重新定义了大模型推理范式。与已成行业标准的思维链(CoT)相比,新方法不仅让模型在面对复杂任务时表现更佳,还把同等效果下的推理成本压缩至1/40。核心策略其实很简单:千人千面。让大...……更多
港中文团队提出大模型元推理范式,革新大模型的评价体系
...段时间。在 ChatGPT 面世以后,他意识到针对大模型的研究范式存在一定的不足,于是决定来到香港中文大学读博。图 | 曾忠燊(来源:曾忠燊)前不久,曾忠燊和所在团队提出一个全新评测范式。基于这一评测范式,他们又针对...……更多
科学家提出情景学习新范式,让学霸大模型向学弱大模型输送能力
...院大模型团队的研究员李志宇和同事提出一种情景学习新范式:SLEICL(基于强模型增强的情景学习,Strong LLM Enhanced ICL),能更好地加速小模型的学术研究和产业落地。借助这一方法可以大幅提升小模型的性能表现,从而让小模...……更多
让大模型能听会说,国内机构开源首个端到端语音对话模型Mini-Omni
...文本和语音。为复用语言模型「预测下一个 token」的学习范式,输出侧语音采用离散编码,本文采用了 SNAC 编解码方案。针对语音交互场景,输入语音经过预训练 whisper 的语音编码模块进行连续特征提取,然后通过 2 层 MLP 对齐...……更多
蚂蚁自研知识增强大模型服务框架KAG,可显著提升知识推理准确率
...知识关联,对大语言模型也更友好,同时,参考 DIKW 层次范式在同一实体空间中支持 Schema 约束、无模式建模及文本结构的分层表示。同时,我们探讨了 GraphRAG 范式的两种主要实现:微软的 GraphRAG 和 HippoRAG。尽管微软的 GraphRAG ...……更多
WOT全球技术创新大会2024北京站:探索AI 的无限可能
...于云原生的开源异构算力整合与虚拟化解决方案——第四范式Project-HAMi,降低国产异构算力的使用门槛? 潞晨科技全球首个开源复现ChatGPT的RLHF训练过程和完整解决方案是什么?在大模型部署与应用专题,来自百度、网易云音...……更多
清华团队提出新型光计算架构,光训练速度提升1个数量级
...建立光子传播对称性模型,未采用传统的电训练反向传播范式,化“反”为“前”。这种新范式挣脱了前向-反向光场传播严格对齐的束缚,基于通用的光计算原位训练系统,突破了电训练架构对物理光计算的掣肘。该研究为光...……更多
百度云升级模型服务,百度版GPTs即日开放 | 最前线
...态的3个关键组件:大模型、智能计算、AI原生应用开发新范式。百度云智算大会他提到,在AI时代,应用技术、AI技术、IT基础设施三条平行的发展线终于交汇融合:在应用层,大模型理解、生成、逻辑、记忆的独特能力会催生AI...……更多
北大推出全新机器人多模态大模型!面向通用和机器人场景的高效推理和操作
...法在操作微调阶段需要更新投影层和整个 LLM。虽然这种范式可以赋予模型动作位姿预测能力,但它也破坏了 MLLM 的固有能力,并且需要大量的训练资源。为了解决这些挑战,我们提出了一种高效的微调策略,如图 3 所示。我们...……更多
邬贺铨院士:金融大模型改变了金融科技范式
...院士邬贺铨在大会上表示“金融大模型改变了金融科技的范式,重塑金融行业的工作方式,改变了金融服务生态。”中国工程院院士邬贺铨发表主题演讲目前金融大模型已经应用在金融资讯、产品介绍内容的文本自动生成,构建...……更多
昇思MindSpore 2.3全新发布
...开发MindSpore开源框架推动了软件性能提升。 AIforScience新范式,生成式AI赋能气动外形设计中国科学院院士、中国空气动力学会理事长唐志共表示:基于昇思MindSpore,生成式气动设计大模型平台打破传统设计范式,设计时长由月...……更多
ECCV 2024 | 南洋理工三维数字人生成新范式:结构扩散模型
...散模型(Structured Latent Diffusion Model)的三维数字人生成新范式 StructLDM。该范式包括三个关键设计:结构化的高维人体表征、结构化的自动解码器以及结构化的隐空间扩散模型。 StructLDM 是一个从图像、视频中学习的前馈三维生...……更多
又慢又贵?OpenAI推理模型“草莓”来了,GPT-5还有多远
...,但GPT-5很可能还会包括本次推出的推理技术。“有两种范式。”穆拉蒂表示,“缩放范式和这种新范式。我们希望将它们结合在一起。”GPT-5的开发之路并不好走。就在当地时间9月11日,GPT-4o/GPT-5的研究领导人、OpenAI版“Her”...……更多
o1核心作者分享:激励AI自我学习,比试图教会AI每一项任务更重要
“o1发布后,一个新的范式产生了”。其中关键,OpenAI研究科学家、o1核心贡献者Hyung Won Chung,刚刚就此分享了他在MIT的一次演讲。演讲主题为“Don’t teach. Incentivize(不要教,要激励),核心观点是:激励AI自我学习比试图教会...……更多
科学家提出大模型分子交互学习框架,已在400多万分子对中验证
...lti-hierarchical Chain-of-thought)的概念,来优化大模型的思考范式和训练范式。同时,该团队还采用一个分子交互任务间的动态参数来共享策略,以实现预测效率和预测精度的双赢。目前来看,这款框架最直观的应用在于:能被用来...……更多
o1金牌团队揭秘AI超越人类惊人时刻!22分完整版视频全公开
...6 通过规划、纠错,o1能够解决世界上的新问题7 新的训练范式是一种全新的方法,可以将更多的算力投入到模型中8 o1编写代码时,当其输出要使用的代码时,需要通过单元测试接下来,具体来看下o1模型背后的故事。强化学习+...……更多
被认可的大模型价格战
...在Scaling Law之外,一定要在数据、算法、算力等方面寻找范式上新的转化,“不论是战略上还是信仰上,我认为Scaling Law之外都还有范式变化的可能,不只是去简单地变成压缩模式,而是会走出一个体系,这样才有机会走向AGI,...……更多
AI发展变慢了?几位AI头部创业者并不赞同
...式从文字走向了语音,思考方式从快思考走向了慢思考,范式在突破。面壁智能是国内较早发布端侧模型的AI创业公司,该公司创始人李大海称,今年AI技术变化非常多,相比去年并不算少。不过他也理解外界认为AI发展速度变慢...……更多
算力浪费超50%!百度AI计算部负责人拆解大模型时代的算力成本
...,GPU集群规模甚至达到10万卡。在王雁鹏看来,上述计算范式的变迁决定了计算体系机构的技术发展,而这种结构上的变化,又催生了云计算的技术和产品格局。“云计算可以看作一种售卖AI基础设施的形式”,他说道。打个比...……更多
超星未来梁爽:软硬件协同优化,赋能AI 2.0新时代
...模块功能的实现,尽量减少人工规则,并通过数据驱动的范式提升性能,大幅降低人工处理各种长尾问题的难度。在AI2.0时代,系统将由一个统一的通用基础大模型来应对多源数据输入,完成多种复杂任务,这一基础模型应该具...……更多
...人杨巍看来,大模型的诞生实际上带来了一个计算机使用范式的变化,迭代了人类与机器之间的交流模式,而随着各大厂家陆续推出中国本土的大模型,且各家产品形态已经初具雏形,当下的大模型行业开始进入应用落地的第二...……更多
从空间智能到具身智能,跨维践行Sim2Real AI最高效路径
...火热的空间智能和具身智能的本质是什么?以 Scaling Law 范式实现空间与具身智能的具体涵义是什么?哪条路是实现通用具身智能的最高效路径?具身智能如何从技术到产品再到商业落地?未来,有哪些能够突破行业生产范式的...……更多
郑小林:建立思维链的AI 具有里程碑意义
...应用场景来倒逼模型的创新,也成为推动AI发展的一种新范式。 ……更多
清华领衔发布多模态评估MultiTrust:GPT-4可信度有几何?
...,以及检索增强生成(RAG)和宪法AI(Constitutional AI)等范式可以一定程度上帮助改进。但多模态大模型的可信提升绝不止于此,模态间对齐、视觉编码器的鲁棒性等也是关键影响因素。此外,通过在动态环境中持续评估和优化...……更多
3天把Llama训成Mamba,性能不降,推理更快!
...Mamba模型,并且设计了新的推测解码算法,加速了模型的推理。先来看一张其乐融融的图片(一眼AI):右边的小羊驼代表Llama,而左边的蛇(Mamba)也是我们的老熟人了。至于到底能不能其乐融融,咱就不管了,之所以有此场景...……更多
手机跑大模型提速4-5倍!微软亚研院开源新技术,有CPU就行
...提升。 对此,新技术T-MAC采用基于查找表(LUT)的计算范式,无需反量化,直接支持混合精度矩阵乘。这样,T-MAC不仅提高了推理性能,还使得模型更加统一和可扩展,尤其适合在资源受限的端侧设备部署。此外,T-MAC不依赖于...……更多
大模型赋能机器狗 西工大离线具身智能研究取得新突破
...盲犬代替传统导盲犬的可能性,同时验证了离线具身智能范式的可行性,使大模型具身智能机器人可以脱离互联网环境,应用在无网或网络信号不佳的工况环境,进一步拓展了临地安防的应用场景。近年来,随着机器人技术和SLA...……更多
鄂维南院士领衔新作:大模型不止有RAG、参数存储,还有第3种记忆
...凡的性能而获得了前所未有的关注。然而, LLM 的训练和推理成本高昂,人们一直在尝试通过各种优化方法来降低成本。本文来自上海算法创新研究院、北京大学等机构的研究者受人类大脑记忆层次结构的启发,他们通过为 LLM ...……更多
百川智能发布baichuan3稳定语言模型
...方面实现较好的约束理解和遵循。此外,传统的单次RLHF范式在唐诗宋词面前也遇到极大挑战,PPO在训练过程中生成的Response有可能超出RewardModel的评价范围导致“探索”的过程失控。Baichuan3结合“RLHF&RLAIF”以及迭代式强化学...……更多
专注于推理的OpenAI“草莓”模型两周内发布?是人工智能下一重大突破
...“秋季发布”(9月至11月)要更早。上述报道称,专注于推理能力的人工智能“草莓”发布前后还有一些亟待解决的问题,但看似“仓促上马”似乎说明OpenAI感受到了大语言模型驱动产品领域的激烈竞争压力,希望通过近几个月...……更多
更多关于科技的资讯:
人工智能不仅能分析人脸情绪,还能读取脑电波信号,为人定制香氛;恐龙变为AI数字虚拟形象,成为人们的“萌宠”——这不是科幻电影
2025-09-30 08:09:00
从线上学习到山水修行:简知文旅×简橙教育共同打造银发文旅的深度与温度
近日,长江三峡见证了一场别开生面的银发游学盛事。"三峡简橙号·年度盛典"游学项目在历时七天的精彩行程后圆满落下帷幕。该项目由简知科技旗下两大知名品牌"简知文旅"与"简橙教育"联合策划执行
2025-09-30 08:17:00
聊城智汇 链接全球丨锚定国际市场,力得汽车科技加速布局海外
齐鲁晚报·齐鲁壹点 国晓宁 崔宇晴走进山东力得汽车科技股份有限公司的生产车间,机器轰鸣声不绝于耳,一条条先进的生产线正有序运转
2025-09-30 09:20:00
国庆黄金周变身“家电焕新周”,三联家电门店人气爆棚
随着国庆与中秋双节同庆的长假来临,消费市场迎来了一年之中最炙手可热的“黄金销售季”。与以往不同的是,这个假期在旅游、探亲等传统主题之外
2025-09-30 09:22:00
壹点观察 | 蔚来城商业广场十一开业,德州商业格局再迎新变化
在商业竞争日益激烈的今天,一座全新的商业综合体——蔚来城商业广场,即将于十一正式开门迎客。它的到来,为德州商业市场增添了新的变化
2025-09-30 09:24:00
鲁网9月29日讯(记者 杨勇)秋分时节,聊城市莘县升鑫金属制品有限公司的生产车间内,员工工作紧张有序,各种机器设备高效运转
2025-09-30 10:04:00
Aritco与Dezeen联合举办设计论坛 共探\
苏州2024年9月16日 -- 近日,瑞典家用电梯品牌Aritco瑞特科与全球知名设计媒体Dezeen设志在苏州联合举办了一场主题为"摒弃风格
2025-09-30 10:18:00
小微企业在传统银行承兑汇票(简称“银承”)业务办理中常常面临诸多难题。企业需要多次往返银行网点,提交大量纸质材料,流程烦琐
2025-09-30 10:45:00
中国数据研究中心:中之杰荣膺月饼行业智造先锋奖榜首
9月28日,中国数据研究中心正式发布《2025中国月饼行业白皮书》及“2025中国月饼行业智造先锋奖”十强品牌榜单,吉林中之杰食品科技发展有限公司凭借其位于长春的智能新厂
2025-09-30 11:15:00
鲁网9月30日讯近日,省科技厅公布了2025年度科技型中小企业创新能力提升工程(先投后股类)项目名单,全市共4家企业入选
2025-09-30 11:16:00
浪潮海晏荣获2025年“数据要素×”大赛山东分赛决赛三等奖
近日,由国家数据局、山东省人民政府联合指导,山东省大数据局等21家单位联合主办的2025年“数据要素×”大赛山东分赛决赛获奖名单正式公布
2025-09-30 11:21:00
据人民日报报道,近期国家网信办指导多地网信部门,对微博、快手、小红书、今日头条等多家平台进行约谈,责令限期整改热搜热榜存在的问题
2025-09-30 12:33:00
朱琳:品牌要让Z世代体验“设计师”般的快感
齐鲁晚报·齐鲁壹点 记者 牟静萍 实习生 葛同同 当下,Z世代正在以其独特的消费观念、多元的兴趣取向和对精神体验的重视
2025-09-30 12:46:00
大皖新闻讯 算力作为数字经济时代的核心生产力,已成为城市竞争的关键赛道。“十四五”期间,芜湖紧抓“东数西算”国家战略机遇
2025-09-30 13:57:00
把握国庆中秋消费节点,三联家电双节大促开启家庭焕新计划
鲁网9月30日讯国庆中秋长假,历来是家庭消费,特别是家电消费的黄金周期。许多家庭会选择在此期间,集中完成筹划已久的家电焕新计划
2025-09-30 14:55:00