逻辑推理,重磅,推理,逻辑,模型,能力头条新闻资讯订阅

我的订阅
头条热搜

我们正处于一个信息大暴发的时代，每天都能产生数以百万计的新闻资讯！

虽然有大数据推荐，但面对海量数据，通过我们的调研发现，在一个小时的时间里，您通常无法真正有效地获取您感兴趣的资讯！

头条新闻资讯订阅，旨在帮助您收集感兴趣的资讯内容，并且在第一时间通知到您。可以有效节约您获取资讯的时间，避免错过一些关键信息。

...二、社会评测与同行水平社会评测普遍认可o1 系列模型的逻辑推理能力优于 GPT-4o，但也有很多人提出了不同看法。差评XPIN邀请了理综三科的博士测评，物理评价较高，而生物、化学评价较低，综合认为o1在认知上达到硕士水平...……更多

2024-09-18 15:01:00逻辑推理,重磅,推理,逻辑,模型,能力

重磅！TeleAI 完成首个全国产化万卡万参大模型训练

...一在今年5月的 OpenCampass 测试榜单中，TeleChat 系列模型的逻辑推理能力名列开源大模型榜单第一。作为新一代版本，TeleChat2-115B 在9月最新公布的 C-Eval 评测 Open Access 模型综合榜单中，以 86.9 分的成绩排名第一。其通用能力较 Tele……更多

2024-09-30 09:50:00万卡,重磅,模型,国产,训练,模型

昆仑万维：“天工大模型3.0”将于4月17日正式发布同步开

...一代“天工2.0”MoE大模型，“天工3.0”在模型语义理解、逻辑推理、以及通用性、泛化性、不确定性知识、学习能力等领域拥有惊人的性能提升，其模型技术知识能力提升超过20%，数学/推理/代码/文创能力提升超过30%。同时，“...……更多

2024-04-01 19:56:00万维,昆仑,模型,将于,同步,参数

不止反击，谷歌在AI群隔空@所有人

...的一个代表大模型，其功能的强大已无需赘言，尤其是在逻辑推理和数学表现层面。但据谷歌的官方测试，PaLM2的部分结果（例如数学）比GPT-4还要好。谷歌称，对PaLM2做了算法优化，使得它在体积上比PaLM要小，但整体性能更好...……更多

2023-05-11 23:00:00所有人,模型,语言,训练,能力,搜索

国产大模型首发中文逻辑推理，「天工大模型4.0」o1版来了

...始在一些权威评测中取得领先。今天，国内首款具备中文逻辑推理能力的 o1 模型来了，它便是由昆仑万维推出的「天工大模型 4.0」 o1 版（英文名：Skywork o1）。这也是近一个月来，该公司在大模型及相关应用上的第三次大动作...……更多

2024-11-28 10:00:00模型,逻辑推理,中文,推理,逻辑,国产

罗格斯大学团队提出思想链概念，提高大模型的算数推理能力

...概念，提高了大语言模型（LLM，large language models）在复杂推理任务上的性能，例如算术推理、常识推理和符号推理等。图 | 金明宇（来源：金明宇）CoT 的原理是通过提供推理过程的示例，来教会模型处理推理，详细说明导致最...……更多

2024-03-15 10:41:00罗格,罗格斯,推理,模型,团队,概念

商汤又“夺金”！SuperCLUE-V多模态大模型基准发布1

...度30个二级维度。报告称SenseChat-Vision 5.5在基础能力-数理逻辑推理任务如图表推理、场景推理方面具备领先优势。榜单显示，在数理逻辑分析能力中，SenseChat-Vision 5.5超越国内外所有参评模型包括GPT-4o的最新版本，位列第一。Super...……更多

2024-10-14 13:34:00商汤,模态,基准,模型,模型,能力

图灵奖得主杨立昆：AI的逻辑推理和规划能力有限，会犯事实错误

...”杨立昆表示，人工智能距离人类和动物的能力差距在于逻辑推理和规划，这是智能的重要特征，现在的大模型只能“本能反应”。“如果你用一万亿或两万亿个token来训练它们，机器的性能是惊人的，但最终机器会犯事实错误...……更多

2023-06-10 05:00:00图灵奖,逻辑,错误,图灵,逻辑推理,得主

奥林匹克竞赛里选最聪明的AI：Claude-3.5-Sonn

...竞赛不仅是对人类（碳基智能）思维敏捷性、知识掌握和逻辑推理的极限挑战，更是AI（“硅基智能”）锻炼的绝佳练兵场，是衡量AI与“超级智能”距离的重要标尺。OlympicArena——一个真正意义上的AI奥运竞技场。在这里，AI不...……更多

2024-06-25 09:45:00奥林,奥林匹克,竞赛,模型,推理,能力

人类和AI在推理任务中的表现相似，Google DeepMi

...，尽管这些模型在处理自然语言方面表现卓越，但在复杂逻辑推理任务中，人类和语言模型都会受到语义内容合理性和可信度的影响，表现出类似的错误倾向。研究背景人类在推理过程中存在两种系统：“直觉系统”和“理性系...……更多

2024-08-19 13:49:00局限性,推理,人类,任务,研究,模型

姚期智院士大模型新研究：思维图DoT，用数学理论确保AI逻辑

...看看DoT长啥样。大模型复杂推理新框架如前所述，DoT将逻辑推理过程建模为在单个LLM内构建有向无环图（DAG）。其框架内部管理三个关键角色：提议者：生成命题或推理步骤，添加新节点。批评者：评估命题，识别错误、不...……更多

2024-09-24 13:36:00维图,院士,逻辑,模型,一致,理论

苹果新论文证明LLM大模型存在缺陷！没有进行真正的逻辑推理

...地依赖于训练数据中的模式进行预测。当需要进行真正的逻辑推理时，这些模型往往无法产生合理的结果，这一发现对人工智能的发展提供了重要的参考。虽然LLM在许多领域表现优异，但其推理能力仍有待改进。【本文结束】如...……更多

2024-10-13 14:15:00逻辑推理,新论,推理,缺陷,逻辑,模型

东方财富金融AI大突破，「妙想」助理重磅发布

...对上述问题给出了全新的解决方案。下一代投研解决方案重磅首发与传统“点对点”的赋能方式不同，妙想投研助理能够覆盖从研究目标确立、市场信息检索、数据整合与分析，到撰写研究报告的完整投研工作流，帮助投研群体...……更多

2024-12-04 11:46:00妙想,重磅,助理,突破,财富,金融

AI新时代揭幕！会“思考解题逻辑”的OpenAI推理大模型登

...凌晨1时许，AI时代迎来崭新的起点——能够进行通用复杂推理的大模型终于走到台前。OpenAI在官网发布公告称，开始向全体订阅用户开始推送OpenAI o1预览模型——也就是此前被广泛期待的“草莓”大模型。OpenAI表示，对于复杂推...……更多

2024-09-13 13:34:00新时代,推理,逻辑,模型,模型,问题

大语言模型为通用人工智能带来曙光

...、记忆四项能力，为通用人工智能带来曙光。会上，百度重磅发布文心大模型、飞桨平台、AI原生应用如流等一系列技术、产品及生态成果。得益于飞桨产业级深度学习开源开放平台和文心大模型的互相促进，飞桨生态愈加繁荣...……更多

2023-08-21 07:34:00曙光,人工智能,人工,模型,语言,智能

权威榜单 | 网易易盾入选中国信通院生成式 AI 技术和应用

...内容风控的场景理解与知识迁移能力，进行更深层次认知逻辑推理与综合防控；· 基于其提示上下文学习范式以及思维推理过程，内容风控将在不更新模型的基础上更加便捷的适应不同的标准，差异化分级分层精准防控。四、网...……更多

2023-06-07 18:00:00信通,易易,中国,生成,案例,权威

理想汽车-W涨逾6%，理想同学App全面接入DeepSeek

...后，理想同学App能够为用户在对话问答中提供更好的复杂逻辑推理和深度思考能力。理想同学App具备语音输入与播报能力；同时能够提供稳定的服务，支持流畅的连续对话；联网搜索使用理想同学智能体RAG3.0的能力，检索内容丰...……更多

2025-02-21 11:31:00理想,逻辑推理,接入,推理,深度,逻辑

2023IDEA大会：让大模型更好应对复杂问题

...外籍院士沈向洋在会上发表主旨演讲，发布IDEA研究院的重磅研产结晶与市场化成果；在大咖云集的论坛环节，多位领军科学家、企业家、创业者同台论道，碰撞“学研产投”灵感。2023年，AI技术给人类生活带来撼动，一个个看...……更多

2023-11-24 10:53:00模型,大会,问题,模型,研究,能力

云从科技发布从容大模型可支持图文理解、文案写作、逻辑推理等

云从科技发布从容大模型可支持图文理解、文案写作、逻辑推理等功能【云从科技发布从容大模型可支持图文理解、文案写作、逻辑推理等功能】《科创板日报》18日讯，云从科技发布从容大模型。在现场演示中，从容大模型...……更多

2023-05-18 10:50:00逻辑推理,文案,推理,从容,逻辑,模型

大语言模型逻辑推理“很糟糕”

...个只有8%。研究人员根据答案是否正确以及答案所包含的逻辑推理是否有效，对大语言模型的答案进行了分类。实验的第一个结果是，在每个测试重复十次的情况下，答案是不一致的。例如，在同一个测试中，有的模型十次中答...……更多

2024-06-12 18:15:00逻辑推理,推理,逻辑,模型,语言,模型

Anthropic再反击！发布Claude 3.5吊打GPT

...个版本Claude 3.5 Sonnet。从官方披露的测试数据来看，其在逻辑推理、编程、数学等方面中的表现性能均超越GPT-4o。网友直言，“太卷了，现在AI竞争是要以周为单位了吗？” 从官方介绍来看，Claude 3.5全家桶仍会有3款系列模型，...……更多

2024-06-21 11:50:00逻辑推理,推理,逻辑,视觉,方面,模型

中国首个音乐SOTA模型「天工音乐大模型」今日公测

...，是全球最大的开源MoE大模型。「天工3.0」在语义理解、逻辑推理、通用性、泛化性、不确定性知识、学习能力等领域拥有突破性的性能提升，数学/推理/代码/文创能力提升超过30%。（天工3.0模型参数超越Grok-1，成全球最大开...……更多

2024-04-17 15:31:00天工,公测,模型,音乐,中国,天工

昆仑万维重磅发布天工AI高级搜索功能，做最懂金融投资、科研学

...提供深度洞察。系统能够理解复杂的上下文关系，并通过逻辑推理为用户提供高质量的解决方案，做更懂你、更省心、更精准的AI搜索。推理能力的跨越式提升，离不开数据和信源检索技术的升级。在数据上，天工AI投入了巨大...……更多

2024-11-05 14:56:00天工,万维,昆仑,科研学术,搜索,重磅

讯飞星火X1全面升级领跑教育、医疗、司法行业应用

...训练的深度推理大模型，升级后的星火X1在数学、代码、逻辑推理、文本生成、语言理解、知识问答等通用任务上效果显著提升，在模型参数比业界同类模型小一个数量级的情况下，整体效果对标OpenAI o1和DeepSeek R1，再次证明了...……更多

2025-04-22 16:50:00讯飞,星火,行业应用,司法,升级,医疗

腾讯最强！混元自研深度思考模型T1正式发布：吐字快、能秒回

...还擅长超长文处理。通过大规模强化学习，并结合数学、逻辑推理、科学和代码等理科难题的专项优化，混元T1正式版进一步提升了推理能力。在体现推理模型基础能力的常见benchmark上，如大语言模型评估增强数据集MMLU-PRO中，...……更多

2025-03-22 00:29:00腾讯,深度,模型,推理,腾讯,模型

影响英伟达根本逻辑的大争论：OpenAI改变策略意味着什么？

大模型预训练“缩放定律”定律失效？模型推理成“解药”，英伟达一家独大格局要变天？“缩放定律”指导下，AI大模型预训练目前遭遇瓶颈。据路透12日报道，硅谷主要AI实验室的新模型训练计划目前普遍进展不顺，新模型...……更多

2024-11-13 14:09:00英伟,争论,逻辑,意味,根本,策略

科学家推出大模型数据集，涵盖奥赛数学题，有望让AI辅导数学课

...23 年 2 月。当时，已经有一些研究团队开始使用大模型做逻辑推理和数学推理。赵子龙和合作者也认为这个方向很有前景。他表示让自己印象最深的例子就是 OpenAI 网站上的一道数学推理的题: Simplify tan100 + 4sin100。根据 OpenAI 自...……更多

2024-03-13 10:26:00数学,数学题,科学家,模型,辅导,课程

推理性能直逼o1，DeepSeek再次出手，重点：即将开源

DeepSeek 又出手了，这次又是重磅炸弹。昨晚，DeepSeek 上线了全新的推理模型 DeepSeek-R1-Lite-Preview，直接冲击 OpenAI o1 保持了两个多月的大模型霸主地位。在美国数学竞赛（AMC）中难度等级最高的 AIME 以及全球顶级编程竞赛（codeforc..……更多

2024-11-22 09:50:00推理,性能,再次,重点,模型,推理