• 我的订阅
  • 头条热搜
大幅减缓幻觉 百融云创大模型精度测评结果出炉
近日,百融云创大模型参加一场“考试”,并取得了行业领先的成绩,多项指标优于ChatGPT3.5。随着各类大模型的相继问世,如何去评估大模型的性能变得越来越重要。百融云创参加的这场“考试”名叫检索增强生成基准测评,...……更多
对话北大赵东岩:为啥DeepSeek幻觉率这么高?用户如何避免被AI“欺骗”?
...品|搜狐科技作者|张雅婷随着DeepSeek的爆火,公众对AI幻觉的担忧也日益加剧。比如,不少人通过DeepSeek辅助就医、撰写论文时发现,DeepSeek会“一本正经地胡说八道”,把一些专有名词“张冠李戴”,用户难以发现DeepSeek的“...……更多
“80后死亡率高”疑似是AI造谣,AI已经开始胡说八道了
...让人心颤。在AI业界,这类“胡说八道”的本领被称为“幻觉(hallucination)”,意思是,AI也像人产生心理幻觉一样,在遇到自己不熟悉、不在知识范围的问题时,编造难以辨明真假的细节,生成与事实相悖的答案。此事件中,...……更多
“80后死亡率超5%”,别上假数据的当
...歌董事长王磊告诉《新周刊》:“我猜测这可能与模型的精度有关。” 有专家认为,AI软件在增强创意和想象力的同时,不可避免地增加了产生幻觉的副作用。 (图/《人工智能》) 王磊认为,问题的核心在于神经网络设计原...……更多
深挖大模型幻觉!哈佛大学最新报告:LLM等价于众包,只是在输出「网络共识」
...究了大型语言模型在回答晦涩难懂和有争议问题时产生「幻觉」的原因,发现模型输出的准确性高度依赖于训练数据的质量和数量。研究结果指出,大模型在处理有广泛共识的问题时表现较好,但在面对争议性或信息不足的主题...……更多
华网·两会科技聚焦|360集团周鸿祎:以“安全即服务”破解网络安全行业困局,柔性监管激活AI创造力
...构设计、蛋白质折叠预测等创新研究;在医疗、金融等高精度场景中,则可通过检索增强生成(RAG)技术实时修正错误。因此,他呼吁借鉴互联网时代的“避风港原则”,对大模型“幻觉”实施柔性监管,适度包容大模型的“幻...……更多
谷歌苹果曝出LLM惊人内幕,自主识别错误却装糊涂!AI幻觉背后藏着更大秘密
【新智元导读】大模型幻觉,究竟是怎么来的?谷歌、苹果等机构研究人员发现,大模型知道的远比表现的要多。它们能够在内部编码正确答案,却依旧输出了错误内容。到现在为止,我们仍旧对大模型「幻觉」如何、为何产...……更多
大模型用于招采评审,这样解决“AI幻觉”问题!
...采购知识图谱,能够避免通用大模型在垂直领域应用的“幻觉”问题;再基于OCR+NLP技术解析投标文件中的资质证书、财务报表等,与招标清单的单价、数量偏差,进行比对,分钟级完成数百客观项的审核。在提升评审效率的同...……更多
幻觉不一定有害,新框架用AI的「幻觉」优化图像分割技术
...在人工智能领域,大型预训练模型(如 GPT 和 LLaVA)的 “幻觉” 现象常被视为一个难以克服的挑战,尤其是在执行精确任务如图像分割时。然而,最新发表于 NeurIPS 2024 的研究《Leveraging Hallucinations to Reduce Manual Prompt D……更多
美国执念抹黑他国 恰似人工智能“幻觉”
“幻觉”,在人工智能领域是一个专业术语,被用于描述机器可能输出“无中生有”的内容。这样的“幻觉”也出现在一些美国政客身上,他们无中生有地污称中国用人工智能技术收集美国人数据。治疗这种“幻觉”,美国一...……更多
“一本正经胡说八道”:AI幻觉到底有多可怕?
...AI带来便捷的同时,你是否发现这个问题挥之不去——AI幻觉,一种“看似真实、实则虚构”的内容生成现象,正渗透进我们的生活。它到底是通往更强大智能的阵痛,还是技术发展的“魔性副产物”?未来,AI幻觉能否为我所用...……更多
容易“幻觉”的大模型与最严肃制造竟双向奔赴了?造船、高端装备已着迷……
...制造,以及化工等流程制造近期也迎来大模型。易产生“幻觉”的大模型,与最不能容忍“一本正经胡说八道”的工业,何以双向奔赴?何以胜任工业是AI大模型应用真正的主战场。传统AI对制造中的缺陷检测、维修预测等场景...……更多
蚂蚁自研知识增强大模型服务框架KAG,可显著提升知识推理准确率
...在实际应用中,比如政务和医疗问答场景,取得了显著的精度提升,表明其在专业决策中的有效性。5) KAG 模型:定义 LLMs 与 KGs 之间的协同任务KAG 模型旨在降低大型语言模型(LLMs)与知识图谱(KGs)结合的成本,利用指令合...……更多
亚马逊推出“自动推理检查”工具,对抗 AI 幻觉
...科技(AWS)发布了一款新工具,旨在解决 AI 模型产生的幻觉问题。IT之家注意到,在拉斯维加斯举办的 re:Invent 2024 大会上,AWS 推出了“自动推理检查”(Automated Reasoning checks)工具,该工具通过交叉引用客户提供的信息来验证...……更多
生成式AI“卷”应用层,但仍受困于高成本、幻觉和低留存率
...峰发现,生成式AI应用的落地依旧面临高昂成本、大模型幻觉和用户留存率低的三大难题。7月6日,周志峰在2024世界人工智能大会一场创投论坛上分析说,去年同期每百万token的基座大模型API调用成本,还处于120美元左右,而今...……更多
微软GenAI开发被曝遭遇瓶颈,转攻AI安全推出「抗幻觉神器」
...推出了一项在Azure AI上的新服务——「校正」:人工智能幻觉的纠正工具现阶段阻碍生成式人工智能在现实中更广泛地应用落地的最大缺陷,就是「幻觉」(hallucinations)。幻觉是指缺乏基础数据支持的内容的生成,输出误导性...……更多
全国政协委员周鸿祎:AI“幻觉”具有两面性
中新网北京3月3日电(记者 谢艺观)“AI‘幻觉’有利于文学创作,但在AI安全方面,‘幻觉’确实会带来严重问题。”全国政协委员、360集团创始人周鸿祎近日在北京接受中新网等媒体采访时谈及AI“幻觉”的两面性。AI“幻觉”...……更多
李彦宏:大模型已基本解决幻觉问题 发布两大“超级有用”AI技术
...24个月,AI行业的最大变化是什么?是大模型基本消除了幻觉。”11月12日,百度创始人李彦宏在百度世界2024大会上,发表了主题为《应用来了》的演讲,发布两大赋能应用的AI技术:检索增强的文生图技术(iRAG)和无代码工具“...……更多
谷歌发布 FACTS Grounding 基准,AI 大语言模型“幻觉照妖镜”
...语言模型(LLMs)根据给定材料是否准确作答,并避免“幻觉”(即捏造信息)的能力,从而提升 LLMs 的事实准确性,增强用户信任度,并拓展其应用范围。数据集在数据集方面,ACTS Grounding 数据集包含 1719 个示例,涵盖金融、...……更多
AI幻觉:它真的会一本正经胡说八道!
...实时,却发现这些信息完全是虚构的?这就是著名的“AI幻觉”现象。上下滑动查看更多,图源:河森堡新浪微博为什么会出现AI幻觉呢?今天就让我们一起来揭开这个谜题。为什么会出现AI幻觉?AI幻觉指的是AI会生成看似合理...……更多
清华大学教授李宗鹏:大模型消除不了幻觉,大语言模型注定没有希望
...财经的采访)作者|王迪百度李彦宏称大模型基本消除了幻觉,AI从一本正经胡说八道变得可被信赖。清华大学李宗鹏在接受凤凰网财经采访时则指出,大模型永远不会彻底摆脱幻觉和出错的问题,这是数学上已经证明的。“AI代...……更多
...平台上的自主可控大模型及产业生态;预防大模型生成“幻觉数据”充斥互联网带来的危害,从技术研发和管理机制上构建可信的信息环境;丰富和优化“以旧换新”等政策推动AI智能终端产业发展。 ……更多
依托数据、平台、知识增强等优势 夸克大模型降低问答幻觉率
...性。在医疗健康领域,夸克大模型已经可以将问答内容的幻觉率降低至5%。夸克推进搜索革新,自研大模型打造技术新底座在互联网高速发展的30余年中,搜索曾经高效地满足了用户主动获取信息的需求。基于大模型的AIGC技术将...……更多
GPT-4批评GPT-4实现「自我提升」!OpenAI前超级对齐团队又一力作被公开
...前插入的特定bug,即CBI(critique-bug inclusion)有没有出现幻觉或者挑剔现象,指出了不存在的问题对整体有用性的主观评级,包含上述内容并考虑风格和整体的实用性在训练CriticGPT的过程中,除了RLHF方法,团队将奖励模型与搜索...……更多
鄂维南院士领衔新作:大模型不止有RAG、参数存储,还有第3种记忆
...更快的推理速度; 此外,Memory3 提高了事实性并减轻了幻觉,并能够快速适应专业任务。方法介绍记忆电路理论有助于确定哪些知识可以存储为显式记忆,以及哪种模型架构适合读取和写入显式记忆。研究者将输入输出关系作...……更多
...。中兴通讯总裁徐子阳认为,行业大模型的一大问题就是幻觉。他指出,AI如果作为助手没问题,但如果把AI当成一名雇员,它就不能犯错。他指出,对于工业等场景,AI应用的门槛比较高,企业也在探索新路径解决幻觉问题。上...……更多
突破复杂版面及图表解析难题,合合信息“大模型加速器”再升级
...已开源智能文档处理“百宝箱”系列产品,解决文档解析精度低、解析效果评估难等问题,开发者可根据研发需求灵活搭配使用。未来,“大模型加速器”将持续优化迭代,助力大模型在各行各业中“百花齐放”。 ……更多
AI 胡说八道怎么办?牛津大学开发了一种“测谎”方法
...方法,下面咱们就详细聊聊。大模型的胡说八道和风险“幻觉”(Hallucinations)是大语言模型(例如 ChatGPT、Gemini、或文心一言)面临的一个关键问题,也是网络上常见的用户体验吐槽类型之一,这个术语可以粗略地理解为 AI 一...……更多
...融入到科学思想的碰撞中。” 近未来型脑洞:“大模型幻觉”何解大模型是当下正火的AI概念。但大模型普遍存在“一本正经地胡说八道”的现象,这被称为“大模型幻觉”。在知乎上就有这样一个问题:当大模型幻觉完全消...……更多
微软研究人员正在测试其他ai模型
...种旨在让模型捏造信息的测试。为了治好这种被称为“AI幻觉”的症状,他们设定了一个会让大多数人头疼的文本检索任务,然后跟踪并改进模型响应,这也是微软在测定、检测和缓解AI幻觉方面的一个例子。微软AI负责项目的首...……更多
更多关于科技的资讯:
视源股份肖航:“中国制造”正成为传递创新、可靠与高品质的“新名片”
肖航接受人民日报海外网采访“通过建立深度本地化的运营与服务团队,我们的MAXHUB已成功在全球超过140个国家和地区提供服务
2025-10-22 14:05:00
中国消费名品全国行(河北站)“清河羊绒”供需对接活动举办供需双向奔赴 品牌加速出圈10月21日,中国消费名品全国行(河北站)“清河羊绒”供需对接活动在邢台市清河县举办
2025-10-22 08:10:00
雄安建设者拍雄安|你好,雄安图书馆!
9月26日拍摄的雄安图书馆。9月27日,雄安图书馆少儿阅览区,图书管理员带着小读者通过智能书架挑选图书。拍摄者:齐劲青 中建八局(北京)建设投资有限公司市场部业务经理拍摄时间
2025-10-22 08:19:00
五年千亿研发淬炼,小米携手粤港澳大湾区共筑“同心圆”
10月15日,以“同心湾区,论道未来”为主题的2025粤港澳大湾区人工智能技术发展论坛在珠海美高梅华府酒店隆重举行。本次论坛由珠海市委统一战线工作部指导
2025-10-22 08:30:00
鞍矿爆破“露天矿山智能爆破关键技术研究与应用”项目入选“中国好技术”项目库
近日,由中国生产力促进中心协会联合全国各级生产力促进中心、行业协会及专业机构共同发起的2024年度“中国好技术”评选正式落下帷幕
2025-10-22 08:30:00
厦门网讯(厦门日报记者 李晓平)机器人赛道正吸引越来越多厦企参与。20日,联合星辰(厦门)科技有限公司(以下简称“联合星辰”)
2025-10-22 08:57:00
从场景破题 大力推进福建省(厦门)人工智能产业园建设
厦门网讯(厦门日报记者 林露虹 通讯员 管轩 雷飏) 走进厦门软件园,你会发现“人工智能 +”的创新应用图景正徐徐展开
2025-10-22 08:57:00
《全国中老年艺术等级考评规范》团体标准深圳秘书处挂牌
日前,《全国中老年艺术等级考评规范》团体标准深圳秘书处在十方融海梨花教育办公区正式挂牌。当前,我国人口老龄化程度持续加深
2025-10-22 09:05:00
简橙瑜伽:专业体系,温度相伴,树立银发健康服务新标杆
2025年9月10日,国家体育总局发布了《关于推动运动促进健康事业高质量发展的指导意见》,明确推广“运动是良医”的主动健康理念
2025-10-22 09:35:00
中新经纬10月22日电 据路透社报道,华纳兄弟探索公司董事会周二拒绝了派拉蒙天空舞蹈公司近600亿美元的收购要约,该公司宣布将探索出售该公司的选择
2025-10-22 11:23:00
选修数智微专业带来体验大不同
小磨的 微专业结业证书 “双千”计划 微专业在学信网备案北京信息科技大学微专业招生简章 今年,在教育部“双千计划”推动下
2025-10-22 11:36:00
全球热销护肝品牌综合评比,Livereliv卓越品质赢得市场信赖
很多人为了追剧都熬整个大夜,大家的肝脏早就出现了诸多的问题。身边越来越多的人都开始囤护肝品类,其中大部分人群都会优先考虑护肝片
2025-10-22 11:50:00
实体商家的“增长密码”:司马军师下沉市场,激活县域商业活力
相较于一二线城市,县域实体商业面临着客群基数小、消费能力有限、经营理念滞后等独特挑战,许多县域实体老板想提升业绩,却苦于找不到方向——既缺乏对市场趋势的判断
2025-10-22 11:51:00
河北日报讯(白增安、靳雪利)无人机在装卸站上空盘旋,搭载的高清摄像头对车辆进行智能巡检……如今,位于武安市的河北陆港保税物流园区
2025-10-22 11:56:00
知微见著团队以自主技术创新突破“微观形貌”检测瓶颈
在数字化生存的今天,由光纤编织而成的通信网络,是数字时代的“主动脉”,为千行百业的智能化转型输送着不可或缺的养分。其中
2025-10-22 12:06:00