• 我的订阅
  • 头条热搜
大幅减缓幻觉 百融云创大模型精度测评结果出炉
近日,百融云创大模型参加一场“考试”,并取得了行业领先的成绩,多项指标优于ChatGPT3.5。随着各类大模型的相继问世,如何去评估大模型的性能变得越来越重要。百融云创参加的这场“考试”名叫检索增强生成基准测评,...……更多
对话北大赵东岩:为啥DeepSeek幻觉率这么高?用户如何避免被AI“欺骗”?
...品|搜狐科技作者|张雅婷随着DeepSeek的爆火,公众对AI幻觉的担忧也日益加剧。比如,不少人通过DeepSeek辅助就医、撰写论文时发现,DeepSeek会“一本正经地胡说八道”,把一些专有名词“张冠李戴”,用户难以发现DeepSeek的“...……更多
“80后死亡率高”疑似是AI造谣,AI已经开始胡说八道了
...让人心颤。在AI业界,这类“胡说八道”的本领被称为“幻觉(hallucination)”,意思是,AI也像人产生心理幻觉一样,在遇到自己不熟悉、不在知识范围的问题时,编造难以辨明真假的细节,生成与事实相悖的答案。此事件中,...……更多
“80后死亡率超5%”,别上假数据的当
...歌董事长王磊告诉《新周刊》:“我猜测这可能与模型的精度有关。” 有专家认为,AI软件在增强创意和想象力的同时,不可避免地增加了产生幻觉的副作用。 (图/《人工智能》) 王磊认为,问题的核心在于神经网络设计原...……更多
深挖大模型幻觉!哈佛大学最新报告:LLM等价于众包,只是在输出「网络共识」
...究了大型语言模型在回答晦涩难懂和有争议问题时产生「幻觉」的原因,发现模型输出的准确性高度依赖于训练数据的质量和数量。研究结果指出,大模型在处理有广泛共识的问题时表现较好,但在面对争议性或信息不足的主题...……更多
华网·两会科技聚焦|360集团周鸿祎:以“安全即服务”破解网络安全行业困局,柔性监管激活AI创造力
...构设计、蛋白质折叠预测等创新研究;在医疗、金融等高精度场景中,则可通过检索增强生成(RAG)技术实时修正错误。因此,他呼吁借鉴互联网时代的“避风港原则”,对大模型“幻觉”实施柔性监管,适度包容大模型的“幻...……更多
谷歌苹果曝出LLM惊人内幕,自主识别错误却装糊涂!AI幻觉背后藏着更大秘密
【新智元导读】大模型幻觉,究竟是怎么来的?谷歌、苹果等机构研究人员发现,大模型知道的远比表现的要多。它们能够在内部编码正确答案,却依旧输出了错误内容。到现在为止,我们仍旧对大模型「幻觉」如何、为何产...……更多
大模型用于招采评审,这样解决“AI幻觉”问题!
...采购知识图谱,能够避免通用大模型在垂直领域应用的“幻觉”问题;再基于OCR+NLP技术解析投标文件中的资质证书、财务报表等,与招标清单的单价、数量偏差,进行比对,分钟级完成数百客观项的审核。在提升评审效率的同...……更多
幻觉不一定有害,新框架用AI的「幻觉」优化图像分割技术
...在人工智能领域,大型预训练模型(如 GPT 和 LLaVA)的 “幻觉” 现象常被视为一个难以克服的挑战,尤其是在执行精确任务如图像分割时。然而,最新发表于 NeurIPS 2024 的研究《Leveraging Hallucinations to Reduce Manual Prompt D……更多
美国执念抹黑他国 恰似人工智能“幻觉”
“幻觉”,在人工智能领域是一个专业术语,被用于描述机器可能输出“无中生有”的内容。这样的“幻觉”也出现在一些美国政客身上,他们无中生有地污称中国用人工智能技术收集美国人数据。治疗这种“幻觉”,美国一...……更多
“一本正经胡说八道”:AI幻觉到底有多可怕?
...AI带来便捷的同时,你是否发现这个问题挥之不去——AI幻觉,一种“看似真实、实则虚构”的内容生成现象,正渗透进我们的生活。它到底是通往更强大智能的阵痛,还是技术发展的“魔性副产物”?未来,AI幻觉能否为我所用...……更多
容易“幻觉”的大模型与最严肃制造竟双向奔赴了?造船、高端装备已着迷……
...制造,以及化工等流程制造近期也迎来大模型。易产生“幻觉”的大模型,与最不能容忍“一本正经胡说八道”的工业,何以双向奔赴?何以胜任工业是AI大模型应用真正的主战场。传统AI对制造中的缺陷检测、维修预测等场景...……更多
亚马逊推出“自动推理检查”工具,对抗 AI 幻觉
...科技(AWS)发布了一款新工具,旨在解决 AI 模型产生的幻觉问题。IT之家注意到,在拉斯维加斯举办的 re:Invent 2024 大会上,AWS 推出了“自动推理检查”(Automated Reasoning checks)工具,该工具通过交叉引用客户提供的信息来验证...……更多
蚂蚁自研知识增强大模型服务框架KAG,可显著提升知识推理准确率
...在实际应用中,比如政务和医疗问答场景,取得了显著的精度提升,表明其在专业决策中的有效性。5) KAG 模型:定义 LLMs 与 KGs 之间的协同任务KAG 模型旨在降低大型语言模型(LLMs)与知识图谱(KGs)结合的成本,利用指令合...……更多
生成式AI“卷”应用层,但仍受困于高成本、幻觉和低留存率
...峰发现,生成式AI应用的落地依旧面临高昂成本、大模型幻觉和用户留存率低的三大难题。7月6日,周志峰在2024世界人工智能大会一场创投论坛上分析说,去年同期每百万token的基座大模型API调用成本,还处于120美元左右,而今...……更多
微软GenAI开发被曝遭遇瓶颈,转攻AI安全推出「抗幻觉神器」
...推出了一项在Azure AI上的新服务——「校正」:人工智能幻觉的纠正工具现阶段阻碍生成式人工智能在现实中更广泛地应用落地的最大缺陷,就是「幻觉」(hallucinations)。幻觉是指缺乏基础数据支持的内容的生成,输出误导性...……更多
全国政协委员周鸿祎:AI“幻觉”具有两面性
中新网北京3月3日电(记者 谢艺观)“AI‘幻觉’有利于文学创作,但在AI安全方面,‘幻觉’确实会带来严重问题。”全国政协委员、360集团创始人周鸿祎近日在北京接受中新网等媒体采访时谈及AI“幻觉”的两面性。AI“幻觉”...……更多
李彦宏:大模型已基本解决幻觉问题 发布两大“超级有用”AI技术
...24个月,AI行业的最大变化是什么?是大模型基本消除了幻觉。”11月12日,百度创始人李彦宏在百度世界2024大会上,发表了主题为《应用来了》的演讲,发布两大赋能应用的AI技术:检索增强的文生图技术(iRAG)和无代码工具“...……更多
谷歌发布 FACTS Grounding 基准,AI 大语言模型“幻觉照妖镜”
...语言模型(LLMs)根据给定材料是否准确作答,并避免“幻觉”(即捏造信息)的能力,从而提升 LLMs 的事实准确性,增强用户信任度,并拓展其应用范围。数据集在数据集方面,ACTS Grounding 数据集包含 1719 个示例,涵盖金融、...……更多
AI幻觉:它真的会一本正经胡说八道!
...实时,却发现这些信息完全是虚构的?这就是著名的“AI幻觉”现象。上下滑动查看更多,图源:河森堡新浪微博为什么会出现AI幻觉呢?今天就让我们一起来揭开这个谜题。为什么会出现AI幻觉?AI幻觉指的是AI会生成看似合理...……更多
清华大学教授李宗鹏:大模型消除不了幻觉,大语言模型注定没有希望
...财经的采访)作者|王迪百度李彦宏称大模型基本消除了幻觉,AI从一本正经胡说八道变得可被信赖。清华大学李宗鹏在接受凤凰网财经采访时则指出,大模型永远不会彻底摆脱幻觉和出错的问题,这是数学上已经证明的。“AI代...……更多
...平台上的自主可控大模型及产业生态;预防大模型生成“幻觉数据”充斥互联网带来的危害,从技术研发和管理机制上构建可信的信息环境;丰富和优化“以旧换新”等政策推动AI智能终端产业发展。 ……更多
依托数据、平台、知识增强等优势 夸克大模型降低问答幻觉率
...性。在医疗健康领域,夸克大模型已经可以将问答内容的幻觉率降低至5%。夸克推进搜索革新,自研大模型打造技术新底座在互联网高速发展的30余年中,搜索曾经高效地满足了用户主动获取信息的需求。基于大模型的AIGC技术将...……更多
GPT-4批评GPT-4实现「自我提升」!OpenAI前超级对齐团队又一力作被公开
...前插入的特定bug,即CBI(critique-bug inclusion)有没有出现幻觉或者挑剔现象,指出了不存在的问题对整体有用性的主观评级,包含上述内容并考虑风格和整体的实用性在训练CriticGPT的过程中,除了RLHF方法,团队将奖励模型与搜索...……更多
鄂维南院士领衔新作:大模型不止有RAG、参数存储,还有第3种记忆
...更快的推理速度; 此外,Memory3 提高了事实性并减轻了幻觉,并能够快速适应专业任务。方法介绍记忆电路理论有助于确定哪些知识可以存储为显式记忆,以及哪种模型架构适合读取和写入显式记忆。研究者将输入输出关系作...……更多
...。中兴通讯总裁徐子阳认为,行业大模型的一大问题就是幻觉。他指出,AI如果作为助手没问题,但如果把AI当成一名雇员,它就不能犯错。他指出,对于工业等场景,AI应用的门槛比较高,企业也在探索新路径解决幻觉问题。上...……更多
突破复杂版面及图表解析难题,合合信息“大模型加速器”再升级
...已开源智能文档处理“百宝箱”系列产品,解决文档解析精度低、解析效果评估难等问题,开发者可根据研发需求灵活搭配使用。未来,“大模型加速器”将持续优化迭代,助力大模型在各行各业中“百花齐放”。 ……更多
AI 胡说八道怎么办?牛津大学开发了一种“测谎”方法
...方法,下面咱们就详细聊聊。大模型的胡说八道和风险“幻觉”(Hallucinations)是大语言模型(例如 ChatGPT、Gemini、或文心一言)面临的一个关键问题,也是网络上常见的用户体验吐槽类型之一,这个术语可以粗略地理解为 AI 一...……更多
...融入到科学思想的碰撞中。” 近未来型脑洞:“大模型幻觉”何解大模型是当下正火的AI概念。但大模型普遍存在“一本正经地胡说八道”的现象,这被称为“大模型幻觉”。在知乎上就有这样一个问题:当大模型幻觉完全消...……更多
微软研究人员正在测试其他ai模型
...种旨在让模型捏造信息的测试。为了治好这种被称为“AI幻觉”的症状,他们设定了一个会让大多数人头疼的文本检索任务,然后跟踪并改进模型响应,这也是微软在测定、检测和缓解AI幻觉方面的一个例子。微软AI负责项目的首...……更多
更多关于科技的资讯:
江南时报讯 在金融科技迅猛发展和客户需求持续升级的背景下,南通农商银行积极推动转型升级,以网点转型为核心,通过创新管理模式
2025-12-02 21:24:00
江南时报讯 近日,南通农商银行远程视频银行密码重置功能正式上线,当日即为两名客户顺利完成业务办理。这标志着该行在“远程银行”金融服务领域迈出关键一步
2025-12-02 21:24:00
迈萨科:亚太区首个生产基地落户常州,这里有着巨大的增长潜力
11月5日,迈萨科机械科技(常州)有限公司正式开业,这标志着全球工业混合技术领域的隐形冠军——德国迈萨科公司在中国市场布局迈出关键一步
2025-12-02 21:50:00
国家级赛事!薛家5家企业获奖
近日,历时3天的第十四届中国创新创业大赛合成生物与生物制造专业赛在常州正式收官。来自全国各地的44家企业与团队成功晋级
2025-12-02 22:20:00
中创新航跻身全国“百链千企”二十强
近日,在第八届中国国际进口博览会期间,“2025知识产权保护与企业国际化发展会议暨‘百链千企’专利产业化工程推进会”在上海举行
2025-12-02 22:20:00
千问APP接入万相Wan2.5,视频能力全新升级
12月2日,千问APP接入万相系列最新模型Wan2.5,视频创作能力再度升级。动作精度和肢体协调性全面提升,并成为首个支持音视频同时输出的移动端AI助手
2025-12-02 22:37:00
胶东在线12月1日讯 11月17日,在烟台金融监管分局指导下,《烟台市保险业整治“内卷式”竞争自律公约》(以下简称《公约》)正式发布
2025-12-02 19:54:00
12月2日,太重集团发布消息,由太重集团自主设计制造的6000UST(美吨)正向双动铜挤压机热试车圆满成功。这台堪称国内最大
2025-12-02 19:29:00
丰台怡海中学无人驾驶实训教学项目落地
11月28日,AI驭见未来——怡海教育&加州伯克利大学机器人自动驾驶大赛ROAR实训基地揭牌仪式在北京市丰台区怡海中学(北校区)举行
2025-12-02 12:04:00
●杨炯上周末,在珠海的亚洲通航展上,奥捷龙航空科技有限公司格外引人注目。虽然已多次到珠海参展,但这次它“来自厦门”。这一全球市场份额第一的德国旋翼机品牌
2025-12-02 08:18:00
博物馆进入“沉浸时代”,感官残障观众如何“入场”
视障文化博物馆“触摸文明”展厅。中青报·中青网记者 李怡蒙/摄如今,许多博物馆将视觉、听觉、触觉等多种感知方式融合,创造出多层次
2025-12-02 05:43:00
烟台联通举办客服人员心理健康专题讲座
胶东在线12月1日讯为加强对一线客服员工的人文关怀,帮助员工有效应对工作压力,提升情绪管理与自我调适能力,11月26日
2025-12-02 06:42:00
摘要:本文分析现代物流网络布局与供应链弹性提升的内在关联,探讨节点布局合理性、线路连接多样性、资源整合协同性对供应链冗余能力
2025-12-02 07:09:00
摘要:本文聚焦管理会计在企业战略决策中的应用,首先解析其与战略决策的内在关联,即通过整合财务与非财务信息,为战略制定提供系统性支持
2025-12-02 07:10:00