• 我的订阅
  • 头条热搜
云从科技发布从容大模型 可支持图文理解、文案写作、逻辑推理等功能 【云从科技发布从容大模型 可支持图文理解、文案写作、逻辑推理等功能】《科创板日报》18日讯,云从科技发布从容大模型。在现场演示中,从容大模型...……更多
蚂蚁自研知识增强大模型服务框架KAG,可显著提升知识推理准确率
...个错误的引导,但这种错误的引导,尤其是大模型生成的文案可能是几百字,甚至上千字的,这时候就很难从里面观察到这类细节问题。通过测评发现,大语言模型即便是加入 RAG 以后,依然有大概 30% 到 40% 的幻觉率。在真实业...……更多
真香!智谱大模型,有了首个免费的API
...性的同时增加多样性)。体验地址:https://open.bigmodel.cn/逻辑推理能力,从简单到复杂,包含一般逻辑推理和数学推理。测试 1:先来一道前段时间让很多大模型翻车的「9.11 和 9.9 哪个更大」问题,很容易就答对了。类似的数字...……更多
...个只有8%。研究人员根据答案是否正确以及答案所包含的逻辑推理是否有效,对大语言模型的答案进行了分类。实验的第一个结果是,在每个测试重复十次的情况下,答案是不一致的。例如,在同一个测试中,有的模型十次中答...……更多
重磅!OpenAI o1模型还没有实现真正的逻辑推理能力
...二、社会评测与同行水平社会评测普遍认可o1 系列模型的逻辑推理能力优于 GPT-4o,但也有很多人提出了不同看法。差评XPIN邀请了理综三科的博士测评,物理评价较高,而生物、化学评价较低,综合认为o1在认知上达到硕士水平...……更多
国产大模型首发中文逻辑推理,「天工大模型4.0」o1版来了
...始在一些权威评测中取得领先。今天,国内首款具备中文逻辑推理能力的 o1 模型来了,它便是由昆仑万维推出的「天工大模型 4.0」 o1 版(英文名:Skywork o1)。这也是近一个月来,该公司在大模型及相关应用上的第三次大动作...……更多
姚期智院士大模型新研究:思维图DoT,用数学理论确保AI逻辑一致
...看看DoT长啥样。大模型复杂推理新框架 如前所述,DoT将逻辑推理过程建模为在单个LLM内构建有向无环图(DAG)。其框架内部管理三个关键角色:提议者:生成命题或推理步骤,添加新节点。 批评者:评估命题,识别错误、不...……更多
苹果新论文证明LLM大模型存在缺陷!没有进行真正的逻辑推理
...地依赖于训练数据中的模式进行预测。当需要进行真正的逻辑推理时,这些模型往往无法产生合理的结果,这一发现对人工智能的发展提供了重要的参考。虽然LLM在许多领域表现优异,但其推理能力仍有待改进。【本文结束】如...……更多
超级干货:企业如何用AI工具做好营销实战?
...备的能力已经超过我们过去的想象了,现在它不但可以做逻辑推理,还能识别人类语言中的感情,进行风格模仿并做出人性化、情感化的内容创作。未来大量的内容都可以交给AI来做。第三个理由:营销方法有套路。营销一半是...……更多
罗格斯大学团队提出思想链概念,提高大模型的算数推理能力
...概念,提高了大语言模型(LLM,large language models)在复杂推理任务上的性能,例如算术推理、常识推理和符号推理等。图 | 金明宇(来源:金明宇)CoT 的原理是通过提供推理过程的示例,来教会模型处理推理,详细说明导致最...……更多
人类和AI在推理任务中的表现相似,Google DeepMind研究揭示AI局限性
...,尽管这些模型在处理自然语言方面表现卓越,但在复杂逻辑推理任务中,人类和语言模型都会受到语义内容合理性和可信度的影响,表现出类似的错误倾向。研究背景人类在推理过程中存在两种系统:“直觉系统”和“理性系...……更多
商汤又“夺金”!SuperCLUE-V多模态大模型基准发布10月榜单
...度30个二级维度。报告称SenseChat-Vision 5.5在基础能力-数理逻辑推理任务如图表推理、场景推理方面具备领先优势。榜单显示,在数理逻辑分析能力中,SenseChat-Vision 5.5超越国内外所有参评模型包括GPT-4o的最新版本,位列第一。Super...……更多
奥林匹克竞赛里选最聪明的AI:Claude-3.5-Sonnet vs. GPT-4o?
...竞赛不仅是对人类(碳基智能)思维敏捷性、知识掌握和逻辑推理的极限挑战,更是AI(“硅基智能”)锻炼的绝佳练兵场,是衡量AI与“超级智能”距离的重要标尺。OlympicArena——一个真正意义上的AI奥运竞技场。在这里,AI不...……更多
Anthropic再反击!发布Claude 3.5吊打GPT-4o,视觉、逻辑推理等方面表现更强
...个版本Claude 3.5 Sonnet。从官方披露的测试数据来看,其在逻辑推理、编程、数学等方面中的表现性能均超越GPT-4o。网友直言,“太卷了,现在AI竞争是要以周为单位了吗?” 从官方介绍来看,Claude 3.5全家桶仍会有3款系列模型,...……更多
谷歌最新自然语言推理算法
...读理解和问答等任务中取得了极高的性能,但这些模型在逻辑推理方面的性能仍然十分滞后。去年5月「思维链」(ChainofThought,CoT)横空出世,有研究人员发现,只需要在prompt中加入「Let'sthinkstepbystep」就能让GPT-3的推理性能大幅...……更多
影响英伟达根本逻辑的大争论:OpenAI改变策略意味着什么?谁在撒谎?
大模型预训练“缩放定律”定律失效?模型推理成“解药”,英伟达一家独大格局要变天?“缩放定律”指导下,AI大模型预训练目前遭遇瓶颈。据路透12日报道,硅谷主要AI实验室的新模型训练计划目前普遍进展不顺,新模型...……更多
AI新时代揭幕!会“思考解题逻辑”的OpenAI推理大模型登场
...凌晨1时许,AI时代迎来崭新的起点——能够进行通用复杂推理的大模型终于走到台前。OpenAI在官网发布公告称,开始向全体订阅用户开始推送OpenAI o1预览模型——也就是此前被广泛期待的“草莓”大模型。OpenAI表示,对于复杂推...……更多
科大讯飞入局大模型混战,刘庆峰:10月底将赶超ChatGPT
...在七个维度,具体包括文本生成、语言理解、知识问答、逻辑推理、数学能力、代码能力以及多模态能力。“这将对整个人类的生产和生活方式带来巨大的颠覆,产生全新的机会。”“认知大模型成为通用人工智能的曙光,科大...……更多
百度文心一言发布会详细纪要
...和6只兔子。在这两轮提问当中展现出来的是文心一言的逻辑推理能力”。这方面它不仅知道题出的对不对,也不仅能够给出答案,也给出了解题的步骤。这很像是小学生在解应用题,它是有逻辑的,一步一步的推理出来的。我...……更多
科学家推出大模型数据集,涵盖奥赛数学题,有望让AI辅导数学课程
...23 年 2 月。当时,已经有一些研究团队开始使用大模型做逻辑推理和数学推理。赵子龙和合作者也认为这个方向很有前景。他表示让自己印象最深的例子就是 OpenAI 网站上的一道数学推理的题: Simplify tan100 + 4sin100。根据 OpenAI 自...……更多
理想汽车-W涨逾6%,理想同学App全面接入DeepSeekR1&V3 671B满血版,提供更好的复杂逻辑推理和深度思考能力
...后,理想同学App能够为用户在对话问答中提供更好的复杂逻辑推理和深度思考能力。理想同学App具备语音输入与播报能力;同时能够提供稳定的服务,支持流畅的连续对话;联网搜索使用理想同学智能体RAG3.0的能力,检索内容丰...……更多
腾讯最强!混元自研深度思考模型T1正式发布:吐字快、能秒回
...还擅长超长文处理。通过大规模强化学习,并结合数学、逻辑推理、科学和代码等理科难题的专项优化,混元T1正式版进一步提升了推理能力。在体现推理模型基础能力的常见benchmark上,如大语言模型评估增强数据集MMLU-PRO中,...……更多
...训练的深度推理大模型,升级后的星火X1在数学、代码、逻辑推理、文本生成、语言理解、知识问答等通用任务上效果显著提升,在模型参数比业界同类模型小一个数量级的情况下,整体效果对标OpenAI o1和DeepSeek R1,再次证明了...……更多
能看风水 夸我有情趣 Kimi现在都这么野了吗
...一个道理。在模型 “ 学好数学 ” 的基础上,再将这种逻辑推理的能力应用到物理、化学,乃至于咱们日常生活的方方面面,直到最后真正理解这个世界。而很显然, Kimi 推理模型的泛化能力已经开始显现出来了。在数据见顶...……更多
国内首个!百度文心大模型X1 Turbo斩获信通院最高评级证书
...成为国内首款通过该测评的大模型。其中,文心X1 Turbo在逻辑推理、代码推理、推理效果优化等技术能力及工具支持度、安全可靠度等应用能力均获得满分。AI Day现场,百度吴甜系统性讲解了文心大模型最新版的技术创新。她介...……更多
上海AI实验室版o1已上线!数学题、Leetcode全拿下,还会玩24点
...编程、数字游戏等任务。这就是上海AI实验室版o1——强推理模型书生InternThinker,刚刚正式开放试用!新模型不仅在长思维能力方面有了很大提升,而且还能在推理过程中进行自我反思和纠正。先来一起看两个例子感受一下:比...……更多
给小学数学题加句废话,OpenAI o1就翻车了,苹果论文质疑AI推理
...降。我们假设这种下降是因为当前的 LLM 无法进行真正的逻辑推理;相反,它们试图复制在训练数据中观察到的推理步骤。」这一结论得到了 Keras 之父 François Chollet 和美国心理学家、认知科学家 Gary Marcus 的转发,他们一直对 AI ...……更多
科大讯飞刘庆峰:讯飞星火大模型10月底整体赶超ChatGPT
...实时互动,无论是文本生成、语言理解,还是知识问答、逻辑推理,亦或是数学能力等,星火大模型都表现出色。现场真机实测的互动提问,大模型的精彩回答,引发掌声不断。刘庆峰表示,认知大模型成为通用人工智能的曙光...……更多
大模型降价背后,国产大模型的竞争逻辑变了
...市场拱手让人。另一方面,随着大模型产业的快速发展,推理成本飞速下降,也成为终端降价的基础。据百度官方透露,相比一年前,文心大模型的算法训练效率提升到了原来的5.1倍,周均训练有效率达到98.8%,推理性能提升了1...……更多
算力逻辑修复!各大厂商接入DS催化港股AI基建概念 李彦宏称仍应持续投入
...极发展成本较低的自有ASIC方案,并把重心从AI训练转往AI推理,预估将逐步推升AI推理服务器占比至接近50%。未来GPU仍将支持各种AI算法发展。中信证券的研报也指出,DeepSeek通过工程化能力创新,实现了大模型训练和推理算力成...……更多
更多关于财经的资讯:
中联重科新设子公司,含多项AI业务
近日,中联重科履带起重机(湖南)有限公司成立,注册资本6亿元,经营范围包含:人工智能基础软件开发;卫星遥感应用系统集成;人工智能硬件销售;人工智能基础资源与技术平台等。企查查股权
2025-09-30 16:00:00
广东省环湾农产品流通保供环网私募基金成立,出资额18亿
近日,广东省环湾农产品流通保供环网私募股权投资合伙企业(有限合伙)成立,出资额18亿元,经营范围包含:以私募基金从事股权投资
2025-09-30 16:00:00
四方精创等成立新公司,含多项AI业务
近日,深圳四方智数科技有限公司成立,注册资本1000万元,经营范围包含:人工智能基础软件开发;人工智能行业应用系统集成服务
2025-09-30 16:00:00
国华人寿绍兴中支因编制虚假材料、欺骗投保人被罚70万元
9月30日,国家金融监督管理总局绍兴监管分局行政处罚信息公开表显示,国华人寿保险股份有限公司绍兴中心支公司及相关责任人因编制虚假财务资料;欺骗投保人等违法违规行为被罚款56万元;
2025-09-30 16:01:00
建信人寿浙江分公司因代理人管理不善等问题被罚5000元,两责任人同步领罚
9月30日,国家金融监督管理总局浙江监管局行政处罚信息公开表显示,建信人寿保险股份有限公司浙江分公司及相关责任人因对保险代理人的管理不到位
2025-09-30 16:02:00
中国南方电网在广东成立资源循环公司
近日,南网资源循环(广东)有限公司成立,注册资本2亿元,经营范围包含:供应链管理服务;资源再生利用技术研发;电力行业高效节能技术研发;新兴能源技术研发等。企查查股权穿透显示,该公
2025-09-30 16:12:00
百年人寿山东分公司:一针一线缝制爱国情怀 “金融为民”温暖“星童”康复路
2025年国庆、中秋双节同庆前夕,处处洋溢着喜庆祥和的氛围。9月29日下午,百年人寿山东分公司的公益志愿者们,带着满满的爱心与节日祝福
2025-09-30 16:38:00
金秋送福·双节传情——中华财险潍坊中支走进侯王村敬老送温暖
9月29日,在这金秋送爽的美好时节,恰逢中秋、国庆双节来临之际,中华财险潍坊中支走进全国倡导孝文化模范村、“以孝治村”典范——青州市王坟镇侯王村
2025-09-30 16:39:00
青岛银行:反假币宣传多维发力 筑牢货币安全网 守好群众钱袋子
近日,青岛银行以“筑牢货币安全网 守好群众钱袋子”为主题,启动反假货币宣传月活动,通过传统与线上融合、重点群体精准覆盖
2025-09-30 16:39:00
齐商银行沂源历山支行联合城东社区开展反诈知识宣传讲座
近日,齐商银行沂源历山支行联合城东社区开展筑牢“安全网”、守护居民“钱袋子”反诈知识宣传讲座,现场共有20余名社区工作者和居民参与
2025-09-30 16:39:00
齐商银行助力淄博女企“扬帆出海”
9月28日,由淄博市女企业家协会、张店区妇女联合会主办,齐商银行营业部、张店区女企业家协会承办的“金融赋能·巾帼扬帆”女企出海专题对接会在齐银大厦举行
2025-09-30 16:39:00
百年人寿济宁中支开展“状元红”杯绘画比赛,用童真点亮金秋
金秋送爽,丹桂飘香。当稚嫩的画笔遇上中秋的圆月,会碰撞出怎样的奇思妙想?2025年9月27日,一场别开生面的艺术盛宴——百年人寿济宁中支“状元红”杯绘画比赛
2025-09-30 16:39:00
理念创新见实效 解决商办困局 MFG创始人朱元坤揭示商办资产运营不二法门
香港鼎辰中国有限公司及中国商办运营标杆、知名品牌MFG创始人朱元坤MFG上海滨港商业中心MFG与嘉里建设举行签约仪式 MFG九龙仓成都IFS路演厅日前
2025-09-30 16:40:00
塔湾街地铁口项目迎接外部检查调研
近日,外部领导到中建一局二公司塔湾街地铁口项目进行现场调研,实地察看施工进展与项目安全管理成效。项目位于辽宁省沈阳市皇姑区
2025-09-30 16:40:00
假期坚守岗位 重点工程建设“加速跑”
轰鸣的机械声、往来有序的施工人员……这个中秋国庆假期,中建二局三公司众多重点在建项目建设不停歇、不断档,建设者们放弃与家人团聚的机会
2025-09-30 16:40:00