• 我的订阅
  • 头条热搜
谷歌Gemini数学反超o1预览版!成本仅1/10、无需额外思考时间
...iddenMath(内部保留的竞赛数学问题集)基准测试中,两种模型有约 20% 的显著改进,其中Pro版本以86.5%的成绩超过了o1-preview(85.5%)。除此之外,在视觉理解和代码代码生成的评估中也有2%-7%的提升。根据开发人员的反馈,这两个...……更多
初中数学压轴题突破 几何综合大题 中点模型(一)
中点模型问题是什么?中点问题是初中平面几何当中非常重要的一类问题。当我们面对两个中点时,会很自然地联想到中位线。而当我们面对一个中点时,可以联想到直角三角形的斜边中线(当然,前提条件是存在直角三角形...……更多
AI“明星”选手巅峰对决!记者实测最新谷歌Gemini与GPT-4o
近日,OpenAI用一场26分钟的线上直播展示了GPT-4o带来的惊艳交互能力,将新一轮AI争霸带入了“Her 时代”。GPT-4o的“o”代表“omni”,一词意为“全能”,该模型能够实现无缝的文本、视频和音频输入,并生成相应模态的输出,...……更多
...一。要想用好数学这个工具,就要对问题加以分类,建立模型。其实我们的课本设计的思路大致如此,只是有些教师在实际教学过程中往往把这些割裂开来,把知识点搞得杂乱无序,学生无法形成有效的知识体系。“授之以鱼,...……更多
苹果新论文证明LLM大模型存在缺陷!没有进行真正的逻辑推理
...nguage Models in Mathematical Reasoning”的论文,揭示了大型语言模型(LLM)在数学推理方面的显著局限性。尽管这些模型在生成人类水平的文本方面表现出色,但当处理简单的数学问题时,即使问题仅进行了微小的改动,如添加无关信...……更多
大模型不会推理,为什么也能有思路?有人把原理搞明白了
大模型不会照搬训练数据中的数学推理,回答事实问题和推理问题的「思路」也不一样。大语言模型的「推理」能力应该不是推理,在今年 6 月,一篇 Nature 论文《Language is primarily a tool for communication rather than thought》曾引发……更多
第一波大模型已经走进厨房了!实测方太Healthy CookingGPT
...环,不得不说非常令人期待了~ 量子位率先开展了第一波实测,来看看方太是如何实现的?第一波AI健康烹饪系统走进中国厨房此次Healthy CookingGPT发布,大体可以总结出三个特点。首先,聚焦于健康的需求。它能根据每个人的身...……更多
用进球数判断比赛走势?一个公式就能轻松解决
...偶然性,统计数据采用了泊松分布作为大小盘投注的预测模型。著名学者约翰·黑格在他所著的《Taking Chances》(中译名“机会的数学原理”)一书中创建了一个表格,根据某一球队每场平均进球数计算其打进0、1、2、3、4及更多...……更多
奥林匹克竞赛里选最聪明的AI:Claude-3.5-Sonnet vs. GPT-4o?
...工智能实验室 (GAIR Lab) 的研究团队,主要研究方向是:大模型训练、对齐与评估。团队主页:https://plms.ai/AI技术日新月异,近来Anthropic公司最新发布的Claude-3.5-Sonnet因在知识型推理、数学推理、编程任务及视觉推理等任务上设立...……更多
NeurIPS 2024 | 数学推理场景下,首个分布外检测研究成果来了
...上海交通大学计算机系的二年级博士生,研究方向为语言模型生成、推理,以及可解释、可信大模型。该工作由上海交通大学和阿里巴巴通义实验室共同完成。论文题目:Embedding Trajectory for Out-of-Distribution Detection in Mathematical R……更多
曝Bengio新动向:世界模型+数学证明,确保AI系统正常运作
...学总监。据介绍,Safeguarded AI旨在:通过结合科学的世界模型和数学证明,构建一个负责理解和降低其它AI Agent风险的AI系统。主打的就是一个量化安全保障。该项目由英国高级研究与发明局(ARIA)提供支持,据说未来ARIA将投入...……更多
扩散模型=进化算法!生物学大佬用数学揭示本质
【新智元导读】扩散模型的本质竟是进化算法!生物学大佬从数学的角度证实了这个结论,并结合扩散模型创建了全新的进化算法。扩散模型居然就是生物的进化算法!这个结论来自「新常春藤」塔夫茨大学(Tufts University)于...……更多
通义千问发布半年,大模型已不是阿里云唯一主角 | 焦点分析
...力”的内涵已经进化到了“AI算力”。阿里云并没有让大模型成为2023年云栖大会的主角,不过,大模型却又无处不在。做AI时代的“电动机” 今年4月正式亮相的通义千问,是阿里云自研的底层通用大模型。半年过去,如今阿里...……更多
对标OpenAI o1!Kimi发布新一代推理模型:中考高考考研全第一
...息,日前,国内人工智能公司月之暗面推出的Kimi国产大模型正式发布k0-math。k0-math是Kimi推出的首款推理能力强化模型,采用全新强化学习和思维链推理技术,通过模拟人脑的思考和反思过程,大幅提升解决数学难题的能力。据...……更多
清华团队提出大模型“密度定律”;足球领域首个视觉语言基础模型
今日值得关注的大模型前沿论文SwiftEdit:50 倍速文本引导图像编辑清华团队提出大模型“密度定律”足球领域首个视觉语言基础模型Aguvis:首个完全自主的纯视觉 GUI agentGoogle DeepMind:利用运动轨迹控制视频生成大模型数学新基...……更多
字节开源全栈AI编程基准,不小心曝光豆包代码大模型
豆包代码大模型,不小心给曝光了!在字节开源的代码大模型评估基准FullStack Bench里面,出现了此前字节未披露过的Doubao-Coder。不过目前还只是Preview版,还并没有上线。它在多种编程语言上的性能表现如下,可以看到在闭源模...……更多
...实落地,发挥名师的引领和辐射作用。近日,淄博市小学数学名师课堂活动在淄博经开区傅家镇中心小学举行,由数学学科基地负责人赵淑玮老师执教《小数乘整数》一课,既展示了经开区小学数学对大单元教学的研究成果,又...……更多
专家模型不要专家并行!微软开源MoE新路径
...日,来自微软的研究人员开源了使用全新方法训练的MoE大模型,不走寻常路,且编码和数学表现出色。继Phi家族之后,微软又开源了新的混合专家大模型——GRIN MoE。与Phi-3.5同样的个头(16 * 3.8B),却采用了截然不同的训练方法...……更多
姚期智院士大模型新研究:思维图DoT,用数学理论确保AI逻辑一致
姚期智院士领衔,推出大模型新推理框架,CoT“王冠”戴不住了。提出思维图(DiagramofThought),让大模型思考更像人类。团队更是为这种推理过程提供了数学基础,通过拓扑斯理论(Topos Theory)正式化(formalize)DoT,确保其逻...……更多
晓院顶山实小数学作业重实践
...自:南京晨报知行合一,“量”由“感”生晓院顶山实小数学作业重实践晨报讯(通讯员 吴红宇 南京晨报/爱南京记者 刘彩云)《数学课程标准(2022版)》新增了“量感”这一核心素养,量感主要是指对事物的可测量属性及大...……更多
vivo蓝心小v是如何实测的?
...贴等操作,效率提升明显。 文字识别可能不算难事,在实测中,我发现蓝心小V还能读懂图片里的内容,比如直接让它查找海边的照片、吃火锅的照片,当然,就算增加一些更复杂的条件,比如“找出国庆节的大餐”、“去年三...……更多
AI表现直逼国际奥数优秀选手, 它要 “征服”数学了吗?
...65届IMO大会同步揭晓。这项赛事的目的是推动发展大语言模型的数学推理能力,训练出更高数学水平的新AI模型。纯数学领域中的重大发现是推理和创造力的灵感结晶,往往意味着人类智慧极限的突破。迄今为止,解决或协助解...……更多
首个AI高考全卷评测结果发布:数学全都不及格
...布首个AI高考全卷评测结果,月初开源的阿里通义千问大模型Qwen2-72B排名第一,在语数外三科420分的满分中获得303分,OpenAI的GPT-4o和上海人工智能实验室的书生·浦语2.0文曲星(InternLM2-20B-WQX)排名二三位。本次评测采用全国新课...……更多
AI大模型也高考?成绩单出来了,星火综合第一
...湘晨报、量子位等多家权威媒体对近10款国产人工智能大模型进行了高考作文、数学、物理三个科目的评测,并公布了成绩。我们来一起回顾一下: 首先进行的是高考作文的评测。在搜狐科技的评测中,三位资深语文教师作为...……更多
学而思携九章大模型、学而思学习机亮相世界人工智能大会
...赋能和带来的行业机遇已经成为共识,教育也已经成为大模型技术产品级落地的代表性行业。“教育与人才”位列本届大会行业论坛的十大重点议题,学而思、网易有道、猿力科技等教育企业纷纷携旗下人工智能产品亮相,成为...……更多
国产大模型加速落地,争夺“中国版ChatGPT”心智定位
...主要角色介绍、情节分析、影响等角度列出概述大纲。在实测过程中,一篇169页的全英文财报,万知小程序可在3秒内对内容重点进行提炼,对财报中的财务数据进行解读,并按照财报叙述逻辑总结重点。除此之外,万知还可以...……更多
大幅减缓幻觉 百融云创大模型精度测评结果出炉
近日,百融云创大模型参加一场“考试”,并取得了行业领先的成绩,多项指标优于ChatGPT3.5。随着各类大模型的相继问世,如何去评估大模型的性能变得越来越重要。百融云创参加的这场“考试”名叫检索增强生成基准测评,...……更多
清华大学教授李宗鹏:大模型消除不了幻觉,大语言模型注定没有希望
...宗鹏接受凤凰网财经的采访)作者|王迪百度李彦宏称大模型基本消除了幻觉,AI从一本正经胡说八道变得可被信赖。清华大学李宗鹏在接受凤凰网财经采访时则指出,大模型永远不会彻底摆脱幻觉和出错的问题,这是数学上已经...……更多
LLM群体智能崛起,数学性能暴增11.6%!谷歌DeepMind四大机构联手新作
...是指,人类对自己思维、推理过程的直观认识。那么,大模型也具备「元认知」的能力吗?研究人员对此,提出了一种假设,并设想是否可以通过知识引导,进一步提高LLM的能力。 其实,此前的研究已经表明,大模型表现出一...……更多
阿里国际发布最新开源多模态模型Ovis,多模态能力再升级
...力再次升级!今天,阿里国际AI团队发布了一款多模态大模型Ovis,在图像理解任务上不断突破极限,多种具体的子类任务中均达到了SOTA(最新技术)水平。多模态大模型能够处理和理解多种不同类型的数据输入,例如文本、图...……更多
更多关于科技的资讯:
“数字之城”杭州如何驶入文旅发展新赛道?
中新网杭州12月18日电(曹丹)近日,《AI涌现——2025杭州数字文旅产业发展年度报告》在浙江杭州发布。报告显示,该市数字文旅骨干企业2025年前三季度营收同比增长10
2025-12-19 08:24:00
天立教育与腾讯教育达成战略合作,携手推动K12教育智能化升级
2025年12月16日,天立教育与腾讯教育达成战略合作。双方将深度融合腾讯的前沿AI技术能力,与天立启鸣在K12教育领域积累的教学经验与实践场景
2025-12-19 08:26:00
特步签约全运会冠军刘景扬,从耐力赛道到速度赛场的战略延伸
12月18日,中国领先体育用品品牌特步正式宣布第十五届全运会女子100米栏冠军刘景扬成为特步体育代言人。此次合作不仅是特步运动资源矩阵的拓展
2025-12-19 08:26:00
西交利物浦大学启用沉浸式球幕影院,MEGA创意媒体盛典与国际沉浸媒体联盟同步亮相
12月18日,西交利物浦大学影视与创意科技学院揭幕沉浸式球幕影院,并举办第五届MEGA国际创意媒体盛典,同时宣布国际沉浸媒体联盟正式成立
2025-12-19 08:26:00
协同作战、共创大美食材节,良之隆集团328百天倒计时动员会举行
12月18日,是良之隆・2026第十四届中国食材电商节的倒计时100天。在此之际,良之隆集团举办了3·28百天倒计时动员会
2025-12-19 08:26:00
马克思曾指出:“生产力是社会发展的最终决定力量。”AI作为第四次工业革命的重要推动力量,正用数据、算法和算力重构生产力的模样
2025-12-19 10:56:00
我国虚拟数字人领域首个国家标准《信息技术客服型虚拟数字人通用技术要求》近日正式发布。该标准的出台填补了行业技术规范的空白
2025-12-19 12:14:00
“有烟草证就能办纯信用贷款,50万元额度随借随还,这下旺季订烟的资金缺口彻底补上了!”上饶市余干县一家超市负责人李先生
2025-12-19 12:14:00
在数字经济与日常生活深度融合的今天,优质的服务体验已成为衡量企业核心竞争力的重要标尺。中国移动通信集团江苏有限公司无锡分公司(下称“无锡移动”)再次荣获国家级“用户满意服务”认证
2025-12-19 13:15:00
米连科技布局多元社交矩阵,满足不同情感连接场景
当提及线上社交平台时,许多人脑海中首先浮现的仍是“婚恋”或“约会”的单一标签。然而,米连科技通过其创新实践,正在系统性地打破这一固有印象
2025-12-19 13:58:00
浙江日报杭州12月18日讯 (记者 何冬健 通讯员 肖乐) 记者18日从之江实验室举办的021科学基础模型创新合作大会上获悉
2025-12-19 08:54:00
在共享经济与人工智能技术加速融合、新就业形态不断涌现的当下,如何规范发展、保障权益、激发创新活力成为关键。近日,由杭州高新区(滨江)市场监督管理局牵头起草的两项团体标准——《共享
2025-12-19 06:51:00
本报记者 程宬3000元本金、一张百货柜台、十来个工人,这是彭广杰2020年春天的全部家底;三年半后,他的PAOFU宠物用品旗舰店在拼多多日出5000单
2025-12-19 07:18:00
在工厂轻松搬运物料、在医院为患者做预诊、在赛场上竞速奔跑……2025年即将收官,“具身智能”以高票入选年度十大流行语榜单第二名
2025-12-19 07:18:00
出门问问打造的AIGC产品服务用户数已超1500万、江苏奥赛康研制的新型抗感染药物加速攻关……时至今日,在南京,一个个令人瞩目的成果背后
2025-12-19 07:18:00