• 我的订阅
  • 头条热搜
语言≠思维,大模型学不了推理:一篇Nature让AI社区炸锅了
...到,人类大脑生成和解析语言的神经网络并不负责形式化推理,而且提出推理并不需要语言作为媒介。这篇论文声称「语言主要是用于交流的工具,而不是思考的工具,对于任何经过测试的思维形式都不是必需的」,引发了科技...……更多
...智能的旗舰产品GPT-4为代表的大语言模型在逻辑测试中的推理表现很糟糕:它们犯下前后不一致的错误,而且推理过程往往是荒谬的。近日发表在《皇家学会开放科学》杂志上的一项研究表明,大语言模型所依赖的语料库往往反...……更多
奥林匹克竞赛里选最聪明的AI:Claude-3.5-Sonnet vs. GPT-4o?
...异,近来Anthropic公司最新发布的Claude-3.5-Sonnet因在知识型推理、数学推理、编程任务及视觉推理等任务上设立新行业基准而引发广泛讨论:Claude-3.5-Sonnet 已经取代OpenAI的GPT4o成为世界上”最聪明的AI“(Most Intelligent AI)了……更多
科学家竞相破解大型语言模型背后的谜团
...复杂行为。面对复杂问题,人类在潜意识里会进行分步骤推理。受此启发,谷歌团队2022年引入了“思维链提示”,以描述一种让LLM展示其“思维”的方法。简单来说,思维链提示是一种特殊的上下文学习。不同于标准提示只给...……更多
谷歌最新自然语言推理算法
谷歌发布全新反向推理算法LAMBADA,无惧搜索空间爆炸!自动推理绝对算是自然语言处理领域的一大难题,模型需要根据给定的前提和知识推导出有效且正确的结论。尽管近年来NLP领域借着大规模预训练语言模型在各种「自然语...……更多
谷歌大模型推理范式,主要分为两个阶段
...新研究“自我发现”(Self-Discover),重新定义了大模型推理范式。与已成行业标准的思维链(CoT)相比,新方法不仅让模型在面对复杂任务时表现更佳,还把同等效果下的推理成本压缩至1/40。核心策略其实很简单:千人千面。...……更多
微软华人团队发布全新基准AGIEval,专为人类考试而生
...2.5%,表明了目前基础模型的非凡表现。但GPT-4在需要复杂推理或特定领域知识的任务中不太熟练,文中对模型能力(理解、知识、推理和计算)的全面分析揭示了这些模型的优势和局限性。AGIEval数据集近年来,大型基础模型如GPT-4...……更多
ChatGPT大流行的思考-解析篇
...器人的本质区别。2. ChatGPT如何实现知识的获取、存储、推理及实时更新那究竟GPT如何有如此优秀的表现呢?我们不妨从人类学习思路入手,我们学习一般可分为获取知识-存储知识-推理知识-更新知识,而这也是GPT发展及学习的...……更多
人工智能已经可以解决复杂的数学问题了,还有哪些工作无法被取代
...决数学问题的系统,它是一个组合了自然语言处理和数学推理的系统。这个系统的作用是帮助计算机理解自然语言中的数学问题,从而能够通过推理和计算得出问题的答案。具体来说,这个系统包括多个子系统,包括自然语言处...……更多
超越ChatGPT:人类特有的思维要强化
...据驱动学习机制不可避免存在不可解释、数据依赖和逻辑推理弱等不足。忽略这些不足,可能会给全面认识ChatGPT带来一定的困扰。虚假关联带来隐患尽管ChatGPT可以“写”出人机莫辨的论文、诗歌,但当你尝试问它类似这样的问...……更多
...大模型加入数学领域的解题算法。“OpenAI说GPT-4有强大的推理能力,我感觉主要指的是它的数学水平高。”赵海告诉记者,“其实,推理能力包含逻辑推理能力和数学抽象思维能力,这两种能力是有区别的,前者侧重寻找因果关系。相...……更多
Bengio团队提出多模态新基准,直指Claude 3.5和GPT-4o弱点
...型开发的关键指导之一便是如何让机器像人类一样思考和推理。诸如注意力机制和思维链(Chain-of-Thought)等技术正是由此产生的灵感。然而,可能很多人并没有意识到,很多对人类来说很简单的认知任务也往往伴随着非常复杂...……更多
不止反击,谷歌在AI群隔空@所有人
...得罗夫(Slav Petrov)说。皮查伊具体称,“PaLM 2在逻辑和推理方面进行了广泛的训练,具有极强的逻辑和推理能力。”我们知道,ChatGPT-4作为其中知名的一个代表大模型,其功能的强大已无需赘言,尤其是在逻辑推理和数学表现...……更多
商汤科技与金山办公达成商业合作,“日日新”大模型补强办公软件理科大脑
...直是大模型的痛点,理科领域需要高度的抽象思维和逻辑推理能力,并且要求非常精准的答案,作为计算机科学和信息技术领域的重要工具,代码能力被视作衡量大模型智慧的关键维度。事实上,在过去一年国产大模型如火如荼...……更多
知乎 AI 革命:智能搜索与实时问答的融合
...生成,将这些答案里的有价值信息提炼出来,进行有效的推理,就能为一个 \" 新鲜出炉 \" 的专业问题提供一个立等可取的答案,提问的用户就可以能为快,然后再等其它的专业答主陆续赶到,下场答题。 在灰度测试这个功能...……更多
ChatGPT 火爆,程序员会不会被取代?答案都在这里!
...评测方法、大模型如何能持续学习、怎么显著提升训练和推理的效率这等。从左起:吴海涛、肖仰华、王文广、蒋涛、林咏华、于建岗、王千祥、王昊奋复旦大学教授肖仰华:大模型绝不仅仅是模型系统和算力,数据是非常重要...……更多
昆仑万维:“天工大模型3.0”将于4月17日正式发布 同步开源4000亿参数MoE超级模型
...“天工2.0”MoE大模型,“天工3.0”在模型语义理解、逻辑推理、以及通用性、泛化性、不确定性知识、学习能力等领域拥有惊人的性能提升,其模型技术知识能力提升超过20%,数学/推理/代码/文创能力提升超过30%。同时,“天工...……更多
...的32项学术基准中,从自然图像、音频和视频理解到数学推理,“双子座”Ultra的性能有30项超过了当前先进水平。谷歌公司称,在图像识别领域的测试结果显示,“双子座”Ultra性能优于迄今最先进的人工智能模型,具有天然多...……更多
...AI)系统在编码、战略规划和机器人科学三个领域执行复杂推理任务。聊天生成预训练转换器(ChatGPT)和“克劳德3-奥普斯”(Claude 3 Opus)等大语言模型(LLM),根据人类输入“提示词”处理和生成文本。研究人员说,过去18个月,这些技...……更多
国内创业者和投资人如何看待 Figure 01 机器人:距离具身智能还有多远?
...完成上面说的第二个步骤,模型中没有思维链,也不具备推理能力。PaLM-E 让机器人有了聪明的大脑,可以将复杂自然语言指令分解为简单指令,完成上面说的第一个步骤,然后再去调用 RT-1 执行动作。所以,PaLM-E 所做的只是自...……更多
苹果发布 OpenELM,基于开源训练和推理框架的高效语言模型
...,苹果在 Hugging Face 平台上发布了一个“具有开源训练和推理框架的高效语言模型”,名为 OpenELM。当然,这是一项开源语言模型,其源码及预训练的模型权重和训练配方可在苹果 Github 库中获取。IT之家将官方简介翻译如下:参...……更多
GPT-4不仅性能更强也更贵了:单次输出7.5万单词需6美元,是此前的30倍
...的局限性,仍然不完全可靠,存在事实性“幻觉”并出现推理错误,可能自信地在其预测中犯错。同时,它的使用价格也更贵,其API价格是Chat-GPT API 使用价格的15-30倍。GPT-4实现多项突破,晋升“考霸”相较GPT-3.5,GPT-4在多个方...……更多
什么是AGI?人工智能的未来
...Artificial Intelligence)指的是能够像人类一样思考、学习和推理的机器或计算机程序 – 其能够具备人类的普遍智慧,即能够学习各领域知识,并能将知识输出在各个领域。当时,约翰·麦卡锡预计人工智能将在几个月内实现。约翰...……更多
...思维搜索的领域知识。策略和价值网络指导搜索过程。在推理过程中,预训练的MCTS模块使用策略网络来探索LLM的思想轨迹。随后,LLM审查MCTS的思想并识别任何错误,然后进行额外的MCTS模拟以生成修改后的想法。最后,将修改后...……更多
2023IDEA大会:让大模型更好应对复杂问题
...本正经的胡说八道”怎么解?众所周之,大模型存在深度推理能力差、知识不可追溯、实时更新代价高等局限性,这也成为其在许多严肃领域落地的主要瓶颈。如何弥补大模型的这部分缺陷,是当下AI应用的重要课题。为此,IDEA...……更多
紫东.太初再进化,揭秘全模态大模型的想象力
...会出现一些意想不到的复杂能力,譬如类似人类的思维和推理能力。正如前面所提到的,紫东.太初2.0首次提出了全模态多任务统一生成式学习框架,即全模态分组对齐、分组解码和联合解码的学习方式,形成了全模态逻辑推理...……更多
探索终端操作系统领域AI大模型创新趋势 OpenHarmony技术大会OS原生智能分论坛召开
...发展带来了崭新的机遇,有望通过强大的语义理解和常识推理能力大大提升智能个人代理支持功能的广度和深度。”清华大学助理研究员李元春主题分享中软国际有限公司智能物联网军团产品研发管理部总经理、OpenHarmony项目群技...……更多
百度文心一言发布会详细纪要
...话体现出文心一言各方面的能力,比如总结分析的能力、推理的能力。事实性的东西对于一个搜索引擎来说不是那么难,但是对于一个生成式预训练大模型来说,出错的概率还是挺高的,这些问题都答对相当不容易,因为百度的...……更多
北大推出全新机器人多模态大模型!面向通用和机器人场景的高效推理和操作
...码仓库 Trending Research 第一位。为了赋予机器人端到端的推理和操纵能力,本文创新性地将视觉编码器与高效的状态空间语言模型集成,构建了全新的 RoboMamba 多模态大模型,使其具备视觉常识任务和机器人相关任务的推理能力,...……更多
chatgpt低成本复现流程开源
...。相比原生PyTorch,单机训练速度最高可提升7.73倍,单卡推理速度提升1.42倍,仅需一行代码即可调用。对于微调任务,可最多提升单卡的微调模型容量3.7倍,同时保持高速运行,同样仅需一行代码。要知道,ChatGPT火是真的火,...……更多
更多关于科技的资讯:
中国小女孩向马斯克报BUG成功:后者一个单词回应
快科技7月1日消息,近日,一位名叫茉莉的中国小女孩录制了一段视频隔空喊话马斯克,向其报了一个特斯拉的Bug,获得了马斯克的回复
2024-07-01 22:12:00
细菌鞭毛马达:最不寻常的生物结构 质子动力每分钟10万转
如果您问什么生物结构最不像自然进化的,那应该就是细菌的鞭毛马达。大部分细菌都可以在需要的时候长出鞭毛,然后通过旋转鞭毛来移动自己
2024-07-01 22:12:00
“学界牵手业界” 以赛为媒共育医疗人才供应链
南海网7月1日消息(记者 符彩云) 第九届全国大学生生物医学工程创新设计竞赛将于7月22日至26日在海南三亚崖州湾科技城举办
2024-07-01 23:30:00
汽车界的小米 零跑汽车6月交付20116台 创历史新高
快科技7月1日消息,今天零跑汽车公布了2024年6月销售数据,6月交付达20116台,创历史新高!同比增长52.3%, 环比增长10
2024-07-01 22:42:00
2024过半!新造车KPI达成率出炉:全指望下半年了
卷营销、卷价格,甚至卷老板,今年上半年车企在内卷的赛道风驰电掣,市场的惨烈程度,我们历历在目:比亚迪开年“电比油低”,五菱吉利等纷纷跟进降价
2024-07-01 22:42:00
一次加氢可行驶200多公里!国内首列氢能源智轨电车装配下线
快科技7月1日消息,据央视新闻报道,今天国内首列氢能源智轨电车在宜宾智轨产业园装配下线。氢能源智轨电车由中车株洲所自主研制
2024-07-01 22:12:00
韩妹《妮姬:胜利女神》COS图赏:身材优势尽显
《NIKKE:胜利女神》这款游戏中,桃乐丝、苏打和毒蛇是备受玩家喜爱的角色。近日,一位韩国Coser“siru_0207”分享了她的最新作品
2024-07-01 22:42:00
迪士尼《白雪公主》真人电影终于拍完:黑雪公主自豪
迪士尼《白雪公主》真人电影现已结束拍摄工作,近日瑞秋·泽格勒分享了这一消息。她表示:“《白雪公主》已杀青,我感到非常自豪和激动
2024-07-01 22:42:00
路特斯CEO称绝不会加入价格战:会增加用户持有焦虑和购买顾虑
快科技7月1日消息,日前路特斯集团CEO冯擎峰近日在微博明确表示,作为定位百万级豪华纯电汽车品牌,路特斯不会参与价格战
2024-07-01 23:12:00
对话领袖 | 廖顺喜先生:企业家精神与慈善公益的践行者
为赋能全球杰出企业品牌,深入探索服务需求,助力企业解决发展中的挑战与难题,特推出【对话领袖】专访系列,邀请优秀创业领袖
2024-07-01 22:55:00
火锅店必点菜品:小酥肉一年卖出100亿元
快科技7月1日消息,去火锅店你必点的菜品是什么?很多网友给的答案不一,比如牛羊卷、虾滑、毛肚、土豆片、豆腐等,但可能你想到不到的是
2024-07-01 23:12:00
创菱科技电暖桌:引领智能健康取暖新时代
位于贵州省毕节市七星关区小坝镇新鑫科技产业园的创菱科技实业有限公司,自成立以来,专注于电暖桌的研发、制造和销售,是一家致力于科技创新与品质卓越的领先企业
2024-07-01 22:46:00
伊刻活泉现泡茶亮相FBIF2024,以科技创新重塑茶饮新体验
6月25日至27日,备受瞩目的FBIF 2024食品饮料创新论坛及FBIF食品创新展在国家会展中心(上海)举行。本次展会汇聚了全球食品饮料行业的嘉宾展商
2024-07-01 23:03:00
半年销售额达6亿余元,昌乐县借电商平台打造珠宝销售的黄金时代
王佳潼潍坊报道“我们抖音运营中心落户昌乐主要是因为当地有庞大的货源。”抖音运营中心总经理薛婷说,昌乐县的珠宝电商产业基础非常好
2024-07-01 23:05:00
虽然如今的智能手机都有原生的骚扰屏蔽功能,第三方应用也不少,但运营商所采用的云端拦截技术依然有其独特的作用。7月1日,北京商报记者注意到
2024-07-02 00:14:00