• 我的订阅
  • 头条热搜
刚刚,OpenAI震撼发布o1大模型!强化学习突破LLM推理极限
...专门解决难题。这是一个重大突破,新模型可以实现复杂推理,一个通用模型解决比此前的科学、代码和数学模型能做到的更难的问题。OpenAI 称,今天在 ChatGPT 和大模型 API 中新发布的是该系列中的第一款模型,而且还只是预览...……更多
对标o1,Kimi放出了最能打的国产模型
...历新一轮技术范式的变化,预训练 Scaling Law 放缓之后,推理时间计算成为了新的性能提升关键。两个月前,OpenAI o1 的诞生再次引领了大模型技术的突破。从后训练阶段入手,通过更多的强化学习、原生的思维链和更长的推理时...……更多
手机上能跑的「GPT-4V」来啦!多图、视频理解首次上端!面壁小钢炮开源史上最强端侧多模态
...类模型低 75%。端侧友好:量化后端侧内存仅占 6 GB;端侧推理速度高达 18 tokens/s,相比上代模型快 33%。并且发布即支持 llama.cpp、ollama、vllm 推理;且支持多种语言。统一高清框架,高效能力一拖三:小钢炮的传统优势 OCR 能力延...……更多
思维链让大模型推理更准确?谷歌早于OpenAI押中o1模型核心原理
...本质的不同。其不仅进入到复杂的领域,还表现出超强的推理能力。OpenAI 将 GPT-4o 和 o1 在国际数学奥林匹克竞赛资格考试方面进行对比测试。根据结果,二者差异显著,其中,前者正确解决问题的准确率是 13.4%,而 o1 的准确率...……更多
OpenAI o1模型到博士水平了?复旦教授:没有真正推理能力,学到的还是概率相关性
...小尺寸版o1-mini。OpenAI官方发文称,新模型旨在解决复杂推理问题,训练模型在响应之前花更多时间思考,类似于人类的思考方式。“新模型在推理能力上代表了AI能力的新水平。”OpenAI称,该模型可以解决科学、编程和数学等更...……更多
AI 的“心智理论”难题:Meta ExploreToM 探索突破之路
...单的预定义场景,无法复制人类用来推断心理状态的复杂推理。ExploreToM 框架ExploreToM 通过生成多样化、可扩展的对抗性数据集,为提升 AI 的 ToM 能力奠定了坚实基础。该研究强调了当前模型的局限性,以及高质量训练数据对于...……更多
AI表现直逼国际奥数优秀选手, 它要 “征服”数学了吗?
...同步揭晓。这项赛事的目的是推动发展大语言模型的数学推理能力,训练出更高数学水平的新AI模型。纯数学领域中的重大发现是推理和创造力的灵感结晶,往往意味着人类智慧极限的突破。迄今为止,解决或协助解决高等级数...……更多
本文转自:人民网-安徽频道4月20日,科大讯飞深度推理大模型——讯飞星火X1迎来全新升级。作为当前业界唯一基于全国产算力训练的深度推理大模型,升级后的星火X1在数学、代码、逻辑推理、文本生成、语言理解、知识问答...……更多
致敬浪潮“她”力量丨成功秘诀?不过是把“我能行”,用代码写了千万遍
...”薛娇说。QASC挑战赛是美国艾伦研究所推出的一项常识推理阅读理解任务,它的挑战性在于不仅要求机器能够理解和检索知识,还要求机器将检索到的知识进行组合推理,最终给出合理的答案。“最开始的测试中,我们的模型...……更多
对话北大赵东岩:为啥DeepSeek幻觉率这么高?用户如何避免被AI“欺骗”?
...达14.3%,显著高于DeepSeek-V3的3.9%,也远远超过行业的其他推理模型,比如OpenAI-o1的测试结果是2.4%。这种AI大模型生成内容与真实数据不符,或偏离用户指令的现象,会极大影响用户的使用体验。在医疗、法律、金融等对准确性要...……更多
阿里国际发布最新开源多模态模型Ovis,多模态能力再升级
...Ovis在OpenCompass上的测评数据情况据介绍,Ovis能够在数学推理问答、物体识别、文本提取和复杂任务决策等方面展现出色表现。例如,Ovis可以准确回答数学问题,识别花的品种,支持多种语言的文本提取,甚至可以识别手写字体...……更多
腾讯Angel机器学习平台获世界互联网大会领先科技奖
...腾讯Angel 机器学习平台,突破了万亿级模型分布式训练和推理以及大规模应用部署等难题,率先实现大模型技术从底层硬件到关键软件技术的自主研发,在业务场景广泛应用,显著推动实体产业和数字经济发展,提升社会效率。...……更多
DeepSeek开源惠四方(科技名家笔谈)
...与OpenAI发布ChatGPT3.5相提并论。DeepSeek以高效率、低成本的推理模型和开源的商业模式走出一条发展人工智能的新路。 坚持历史视角准确看待价值准确认识DeepSeek的价值和贡献,必须坚持历史视角,将其放在人工智能创新发展的...……更多
突破时间序列组合推理难题!南加大发布一站式多步推理框架TS-Reasoner
【新智元导读】TS-Reasoner是一个创新的多步推理框架,结合了大型语言模型的上下文学习和推理能力,通过程序化多步推理、模块化设计、自定义模块生成和多领域数据集评估,有效提高了复杂时间序列任务的推理能力和准确性...……更多
...测中,它的综合能力逼近当时的顶尖大模型,尤其在逻辑推理和数学题上展现出强劲性能,而且它的成本要远低于作比较的其他大模型。更令圈内研究者惊喜的,是它在训练方式上的简化。以往的模型在提升推理能力时,通常依...……更多
...天凌晨,阿里巴巴又默默干了件大事:发布并开源全新的推理模型通义千问QwQ-32B。千问QwQ-32B是阿里探索推理模型的最新成果。通过大规模强化学习,它在数学、代码及通用能力上实现质的飞跃,整体性能比肩DeepSeek-R1。在保持...……更多
京东云发布八大领先智算产品,助力企业火速用上大模型
...云DeepSeek大模型一体机,通过自研的算力池化能力、智能推理加速引擎,充分融合软硬件,实现了性能的全面提升,推理速度提升50%,企业可以根据自己的需求灵活选择不同版本,开箱即用。目前,在河南鹤壁、江苏宿迁、山东...……更多
阶跃星辰李璟:多模态是AGI的必经之路,视觉模型可按语言模型路线实现大一统
...发力。一是在预训练的基础上加上强化学习,提高模型的推理能力。“强化学习还在早期,还会延续一长段时间。”第二个趋势是多模的理解生成一体化。李璟认为,文本领域已经实现生成理解任务的统一,语言模型的技术路线...……更多
Transformer推理天花板被谷歌打破?DeepMind首席科学家亮出84页PPT,却遭LeCun反对
...科学家Denny Zhou拿出一篇ICLR 2024论文称:CoT可以让Transformer推理无极限。但随即他就遭到了田渊栋和LeCun等的质疑。最终,CoT会是通往AGI的正确路径吗?随着OpenAI o1的爆火,最近CoT也成了圈内热议的高频词。靠着CoT的强力加持,o1...……更多
成都人形机器人创新中心全国首发 R-DDIRM 高速推理模型
...现突破,于近日全国首发基于扩散架构的人形机器人高速推理模型 R-DDIRM(Denoising Diffusion Implicit Robot Model)。这是继今年 5 月推出中国首个基于扩散架构人形机器人任务生成式模型 R-DDPRM(Denoising Diffusion Proba……更多
百倍提升7B模型推理能力!颜水成团队携手新加坡南洋理工大学发布Q*算法
...-7b等小模型达到参数量比其大数十倍、甚至上百倍模型的推理能力,使模型性能迎来惊人提升。自OpenAI的Q*项目曝光后,业内相关讨论始终层出不穷。据现有信息汇总,Q*项目被视作OpenAI在探索人工通用智能(Artificial General Intelli...……更多
百川智能发布baichuan3稳定语言模型
...处理和代码生成领域的强大实力。不仅如此,其在对逻辑推理能力及专业性要求极高的MCMLE、MedExam、CMExam等权威医疗评测上的中文效果同样超过了GPT-4,是中文医疗任务表现最佳的大模型。Baichuan3还突破“迭代式强化学习”技术...……更多
不遥控的机器人来了! 中国首个基于 3DSGs 的人形机器人规划推理执行系统Raydiculous—1在成都发布
...工干预、无需遥控的自主完成跨空间人形机器人任务规划推理执行系统Raydiculous—1正式亮相。该系统在执行大空间和跨空间任务中拥有长视野(Long Horizon)推理规划能力,同时具备自主学习、处理跨场景任务的特性。是人形机器...……更多
人形机器人会跳舞和空翻还不够?通用具身智能仿真平台“格物”发布
...要打造多元异构人形机器人的预训练模型管理和具身智能推理系统软件等。许彬此前在接受媒体采访时指出,当前上海在技术创新层面已取得了诸多突破性进展,已初步搭建起完整产业生态,产业集聚效应逐步显现。不过具身智...……更多
推动大模型自我进化,北理工推出「流星雨计划」
...我进化的方式,解决代码模型在处理复杂问题时缺少中间推理过程。核心观点:自我进化的力量跟随上述自我进化的思想,在 SRA-MCTS(Self-guided MCTS-based data generation for Reasoning Augmentation)方法中,作者无需借助额外的任何监……更多
CPU,正在被AI时代抛弃?
...以通过语音识别技术被录入到病例系统中,随后大模型AI推理技术辅助进行智能总结和诊断,医生们撰写病例的效率显著提高。AI推理的应用不仅节省了时间,也保护了患者隐私;在法院、律所等业务场景中,律师通过大模型对...……更多
奥林匹克竞赛里选最聪明的AI:Claude-3.5-Sonnet vs. GPT-4o?
...异,近来Anthropic公司最新发布的Claude-3.5-Sonnet因在知识型推理、数学推理、编程任务及视觉推理等任务上设立新行业基准而引发广泛讨论:Claude-3.5-Sonnet 已经取代OpenAI的GPT4o成为世界上”最聪明的AI“(Most Intelligent AI)了……更多
9月13日,OpenAI发布具有推理能力的人工智能模型“o1”,备受行业瞩目。o1通过模仿人类的思维过程,强化学习和“思维链”技术,引导模型自主解决问题。这一特点在解决复杂问题,尤其是在科学、编码和数学等领域,展现出...……更多
从通用人工智能到科学智能,“AI爱因斯坦”还远吗?
...需要像AlphaGo Zero那样,从围棋本身出发,具备自我学习、推理和创新能力,这样才可以达到通用人工智能。要实现这一目标,一是需要结合快思考的“黑盒”预测和慢思考的“白盒”逻辑推理,打造“灰盒”可信大模型;二是融...……更多
对标OpenAI o1!Kimi发布新一代推理模型:中考高考考研全第一
...的Kimi国产大模型正式发布k0-math。k0-math是Kimi推出的首款推理能力强化模型,采用全新强化学习和思维链推理技术,通过模拟人脑的思考和反思过程,大幅提升解决数学难题的能力。据了解,在多项数学基准能力测试中,k0-math的...……更多
更多关于科技的资讯:
蔡司打造全链智联解决方案 解码多元行业质控路径
在"质量强国"战略的引领下,中国工业正加速从制造向智造与质造跨越式发展。工业质量管控体系随之迎来关键转型,从局部优化迈向全域赋能
2025-06-24 14:39:00
亚洲知名跨国企业正大集团与柠季达成战略合作伙伴关系
近日,柠季宣布与亚洲知名跨国企业泰国正大集团(以下简称CP集团)达成战略合作。柠季,2021年创立以来迅速崛起的柠檬茶品牌
2025-06-24 14:39:00
随着媒介形态不断变化,年轻人的阅读场景也愈发多元。纸质书、电子书、有声书、书友会、图书市集……不同形态的购书、读书渠道
2025-06-24 14:40:00
智能卫浴先锋品牌!鹰卫浴闪耀“探索下一个十年”高峰论坛
以“安心”为锚,驶向智能卫浴新十年当智能卫浴浪潮席卷十年,2025年6月20日,2015-2025“智能马桶这十年” 调研报告发布会暨“探索下一个十年”高峰论坛盛大启幕
2025-06-24 14:48:00
从“机械应答”到“类人决策”:华为云助力超参数科技重构游戏 AI
游戏智能体因预设逻辑框架的复杂要求及开放场景的运行环境,向来是开发者眼中“难以突破的天花板”,然而大语言模型与强化学习技术的爆发
2025-06-24 14:48:00
近日,专注于中国传统文化与现代美学融合的创新品牌「NineX九玄」宣布完成近千万元天使轮融资,由知名天使投资人黄学广领投
2025-06-24 14:49:00
中化能源科技壹化加油平台携手银行推出SaaS支付3.0 ——助力民营加油站降本增效、智慧升级
在数字化浪潮下,民营加油站正迎来全新的发展机遇。中化能源科技壹化加油平台与银行机构强强联合,推出壹化加油SaaS平台支付3
2025-06-24 14:49:00
奥运冠军江钰源签约OLZZ欧乐滋,共筑高端膳食营养新标杆
2025年3月27 日,奥运冠军江钰源与美国高端膳食营养品牌 OLZZ 欧乐滋(美国制药集团旗下)完成线上签约;5月10日
2025-06-24 14:50:00
销量领先,天正荣膺行业年度大奖
6月19日,天正电气(605066.SH)应邀参加《2025年电器行业系列白皮书》发布会,与全球多家电气行业知名企业、业界大咖及200余位重量级客户
2025-06-24 14:50:00
当刀郎遇见华熙LIVE・鱼洞:音乐与华熙多元生态的碰撞,如何点燃城市活力
6月21日-22日的夏夜,重庆华熙LIVE·鱼洞·场馆内音浪如潮,数万乐迷手持荧光棒合唱《西海情歌》。当刀郎充满故事感的嗓音与16000座智能声场共振
2025-06-24 14:51:00
HDC早餐会热腾开席:深挖生态商业潜力,800万开发者共乘“鸿蒙快车”
6月22日早晨,华为开发者大会(HDC2025)期间,以“让‘鸿蒙快车’跑起来”为主题的HDC早餐会热腾开席。鸿蒙生态众多开发者及伙伴齐聚
2025-06-24 14:51:00
多维破圈引爆市场,空刻618销售额破 1.7 亿,霸榜类目TOP1
在刚刚落幕的618购物狂欢节中,AIRMETER空刻(以下简称“空刻”)凭借精准的营销策略和多渠道联动,成功引爆品牌声量与销售转化
2025-06-24 14:51:00
京东运动赞助世界滑板日2025成都站 DBH、沸点等爆款装备优惠低至7折
近日,北京ban滑板公园、成都Cosmo、深圳星河worldcocopark掀起潮酷滑板风暴,滑手们汇集在这几个潮流地标
2025-06-24 14:51:00
苏州吴中机器人产业以“硬核实力”勾勒“全国第一区”蓝图
消费日报网讯(记者 汪宏胜) 服务机器人产量占据全国六成以上,工业机器人产量占全国内资品牌七分之一,近6年年平均增速超过了20%
2025-06-24 14:52:00
近日,江阴银行在数据中心节能降耗方面取得了新成果,创新引入的“智能水雾”降温系统成功降低了运营成本,并显著提升了数据中心运行的稳定性和可持续性
2025-06-24 14:52:00