• 我的订阅
  • 科技

AI 的“心智理论”难题:Meta ExploreToM 探索突破之路

类别:科技 发布时间:2024-12-21 09:27:00 来源:IT之家

IT之家 12 月 20 日消息,Meta 公司携手华盛顿大学和卡内基梅隆大学,组建科研团队,合作开发了 ExploreToM 框架,旨在更有效地评估和训练大语言模型(LLM)的心智理论(Theory of Mind,ToM)能力。

心智理论

心智理论(Theory of Mind,ToM)是人类社会智能的基础之一,能让我们能够理解他人的想法、意图和信念。这种认知能力对于有效的沟通和协作至关重要,是复杂社交互动的支柱。

让 AI 也具备 ToM 能力,对于创建能与人类无缝互动的智能体至关重要,只是当前大型语言模型(LLM)在 ToM 方面仍面临巨大挑战。

现有的基准通常缺乏复杂性和多样性,导致高估模型能力。例如,许多基准测试基于简单的预定义场景,无法复制人类用来推断心理状态的复杂推理。

ExploreToM 框架

ExploreToM 通过生成多样化、可扩展的对抗性数据集,为提升 AI 的 ToM 能力奠定了坚实基础。该研究强调了当前模型的局限性,以及高质量训练数据对于弥合这些差距的潜力。

AI 的“心智理论”难题:Meta ExploreToM 探索突破之路

在数据集方面,ExploreToM 利用 A* 搜索算法和特定领域语言生成多样化、高难度的测试数据集,模拟复杂的社会情景,挑战 LLM 的认知极限。

ExploreToM 与现有基准测试不同,通过创建对抗性故事场景,旨在揭示 LLM 在 ToM 推理中的盲点。

AI 的“心智理论”难题:Meta ExploreToM 探索突破之路

此外该框架还引入了非对称信念更新机制,可以模拟不同角色对同一情况持有不同观点的复杂社交互动。

主流模型测试效果

GPT-4o 和 Llama-3.1-70B 模型在 ExploreToM 数据集上的准确率分别只有 9% 和 0%,凸显了现有 LLM 在处理复杂 ToM 推理方面的不足。

在 ExploreToM 数据上进行微调后,模型在经典 ToMi 基准测试中的准确率提高了 27 个百分点,证明了该框架的有效性。

AI 的“心智理论”难题:Meta ExploreToM 探索突破之路

以上内容为资讯信息快照,由td.fyun.cc爬虫进行采集并收录,本站未对信息做任何修改,信息内容不代表本站立场。

快照生成时间:2024-12-21 11:45:07

本站信息快照查询为非营利公共服务,如有侵权请联系我们进行删除。

信息原文地址:

如何统一自然界四种基本作用力,是当今科学界面对的最大难题!
...无定论。至于引力,则更显得毫无头绪,还有漫长的探索之路。因此,说三种力已统一是不准确的。在人类早期,世界被简单地看作由金木水火土构成(东方观点)或由水、火、土、气组成(希腊观
2024-10-28 11:05:00
chatgpt背后模型被证实具有人类心智
ChatGPT原来是拥有心智的?!“原本认为是人类独有的心智理论(TheoryofMind,ToM),已经出现在ChatGPT背后的AI模型上
2023-02-12 23:46:00
...》发表论文显示,在测试追踪他人心理状态能力——也称心智理论(Theory of Mind)的任务中,两类大语言模型(LLM)在特定情况下的表现与人类相似,甚至更好。心智理论对
2024-05-23 02:36:00
chatgpt版必应发飙,怒斥人类:放尊重些
...:额……这不就是我有时候的表现么……被证实具有人类心智其实对于网友们惊叹“太像人”这一点,斯坦福的一项研究早已对此做了证明
2023-02-15 14:56:00
济南大学教授胡晓农:探寻地下水的奥秘
...索的科研之旅从普渡大学到济南大学,胡晓农教授的科研之路跨越了半个地球。1996年,胡晓农教授在普渡大学获得博士学位,随后在美国佛罗里达州立大学担任终身教授,并成为喀斯特研究中
2024-10-14 11:39:00
智商超过99.9%人类,ChatGPT到底有多聪明?
...。那么,如今大火的ChatGPT是否具有与人类相当的智商与心智水平?Eka Roivainen是一名来自芬兰奥卢大学附属医院的评估心理学家
2023-04-14 12:00:00
...“定位方程”的核心在于解构消费者、企业家和管理者的心智,实现战略、战役和战术的协同统一。在消费者心智方面,“定位方程”强调深入洞察消费者的需求、偏好、价值观和购买行为等,挖掘
2025-02-26 15:35:00
创新赋能  老油田内再造新油田
...田累计为国家奉献原油2亿多吨。进入开发中后期,稳产之路却是羁绊重重,前行的步履不再像建设初期那般轻盈。作为渤海湾开发最早的油田之一,大港油田在相继剥离出华北油田、渤海油田和冀
2023-02-23 21:40:00
探索心智力量 推动课堂改革
本文转自:三秦都市报探索心智力量 推动课堂改革西安市经开第二学校举行第六届学术研讨会本报讯(记者 陈飞波)为深入探索“心智教育”理念下的课改实践研究经验,搭建学术成果展示与交流的
2023-07-09 00:57:00
更多关于科技的资讯: