• 我的订阅
  • 头条热搜
大幅减缓幻觉 百融云创大模型精度测评结果出炉
近日,百融云创大模型参加一场“考试”,并取得了行业领先的成绩,多项指标优于ChatGPT3.5。随着各类大模型的相继问世,如何去评估大模型的性能变得越来越重要。百融云创参加的这场“考试”名叫检索增强生成基准测评,...……更多
深挖大模型幻觉!哈佛大学最新报告:LLM等价于众包,只是在输出「网络共识」
...究了大型语言模型在回答晦涩难懂和有争议问题时产生「幻觉」的原因,发现模型输出的准确性高度依赖于训练数据的质量和数量。研究结果指出,大模型在处理有广泛共识的问题时表现较好,但在面对争议性或信息不足的主题...……更多
美国执念抹黑他国 恰似人工智能“幻觉”
“幻觉”,在人工智能领域是一个专业术语,被用于描述机器可能输出“无中生有”的内容。这样的“幻觉”也出现在一些美国政客身上,他们无中生有地污称中国用人工智能技术收集美国人数据。治疗这种“幻觉”,美国一...……更多
容易“幻觉”的大模型与最严肃制造竟双向奔赴了?造船、高端装备已着迷……
...制造,以及化工等流程制造近期也迎来大模型。易产生“幻觉”的大模型,与最不能容忍“一本正经胡说八道”的工业,何以双向奔赴?何以胜任工业是AI大模型应用真正的主战场。传统AI对制造中的缺陷检测、维修预测等场景...……更多
蚂蚁自研知识增强大模型服务框架KAG,可显著提升知识推理准确率
...在实际应用中,比如政务和医疗问答场景,取得了显著的精度提升,表明其在专业决策中的有效性。5) KAG 模型:定义 LLMs 与 KGs 之间的协同任务KAG 模型旨在降低大型语言模型(LLMs)与知识图谱(KGs)结合的成本,利用指令合...……更多
微软GenAI开发被曝遭遇瓶颈,转攻AI安全推出「抗幻觉神器」
...推出了一项在Azure AI上的新服务——「校正」:人工智能幻觉的纠正工具现阶段阻碍生成式人工智能在现实中更广泛地应用落地的最大缺陷,就是「幻觉」(hallucinations)。幻觉是指缺乏基础数据支持的内容的生成,输出误导性...……更多
生成式AI“卷”应用层,但仍受困于高成本、幻觉和低留存率
...峰发现,生成式AI应用的落地依旧面临高昂成本、大模型幻觉和用户留存率低的三大难题。7月6日,周志峰在2024世界人工智能大会一场创投论坛上分析说,去年同期每百万token的基座大模型API调用成本,还处于120美元左右,而今...……更多
依托数据、平台、知识增强等优势 夸克大模型降低问答幻觉率
...性。在医疗健康领域,夸克大模型已经可以将问答内容的幻觉率降低至5%。夸克推进搜索革新,自研大模型打造技术新底座在互联网高速发展的30余年中,搜索曾经高效地满足了用户主动获取信息的需求。基于大模型的AIGC技术将...……更多
GPT-4批评GPT-4实现「自我提升」!OpenAI前超级对齐团队又一力作被公开
...前插入的特定bug,即CBI(critique-bug inclusion)有没有出现幻觉或者挑剔现象,指出了不存在的问题对整体有用性的主观评级,包含上述内容并考虑风格和整体的实用性在训练CriticGPT的过程中,除了RLHF方法,团队将奖励模型与搜索...……更多
鄂维南院士领衔新作:大模型不止有RAG、参数存储,还有第3种记忆
...更快的推理速度; 此外,Memory3 提高了事实性并减轻了幻觉,并能够快速适应专业任务。方法介绍记忆电路理论有助于确定哪些知识可以存储为显式记忆,以及哪种模型架构适合读取和写入显式记忆。研究者将输入输出关系作...……更多
...。中兴通讯总裁徐子阳认为,行业大模型的一大问题就是幻觉。他指出,AI如果作为助手没问题,但如果把AI当成一名雇员,它就不能犯错。他指出,对于工业等场景,AI应用的门槛比较高,企业也在探索新路径解决幻觉问题。上...……更多
AI 胡说八道怎么办?牛津大学开发了一种“测谎”方法
...方法,下面咱们就详细聊聊。大模型的胡说八道和风险“幻觉”(Hallucinations)是大语言模型(例如 ChatGPT、Gemini、或文心一言)面临的一个关键问题,也是网络上常见的用户体验吐槽类型之一,这个术语可以粗略地理解为 AI 一...……更多
...融入到科学思想的碰撞中。” 近未来型脑洞:“大模型幻觉”何解大模型是当下正火的AI概念。但大模型普遍存在“一本正经地胡说八道”的现象,这被称为“大模型幻觉”。在知乎上就有这样一个问题:当大模型幻觉完全消...……更多
微软研究人员正在测试其他ai模型
...种旨在让模型捏造信息的测试。为了治好这种被称为“AI幻觉”的症状,他们设定了一个会让大多数人头疼的文本检索任务,然后跟踪并改进模型响应,这也是微软在测定、检测和缓解AI幻觉方面的一个例子。微软AI负责项目的首...……更多
人工智能为了游戏获胜会“说谎”
...理论作修订AI“一本正经地胡说八道”这种现象被称为AI幻觉。AI幻觉指的是AI会生成貌似合理连贯,但同输入问题意图不一致、同世界知识不一致、与现实或已知数据不符合或无法验证的内容。人工智能是否会“说谎”,以及最...……更多
...。尽管大模型是划时代的技术突破,但现阶段并不完美,幻觉、时效性差、缺乏专业领域知识等问题,是其落地千行百业必须要面对的挑战。百川智能CEO王小川说,搜索增强是大模型落地应用的关键,能够有效解决幻觉、时效性...……更多
Apple Intelligence提示词原来是这样,还告诉大模型:别幻觉
...人将选择这些问题的答案,这将有助于减少撰写回复时的幻觉。请输出最佳问题及每个问题的可能答案 / 选项。不要问回复片段中已经回答的问题。问题应简短,不超过 8 个字。答案也应简短,约 2 个字。请以 JSON 格式输出,包...……更多
AI搜索的知乎方案,以专业答主和优质语料减少AI幻觉
...可以观察到用户行为发生了显著变化,其中困扰行业的AI幻觉成为了用户痛点。对此知乎直答发挥了知乎高质量中文语料的优势,依靠大量专业答主的可信内容给出了社区解决方案。(知乎直答产品负责人 马奎)2024年以来,AI搜...……更多
9.11比9.9大?多个大模型翻车!业内人士:就是偏科,文科强理科弱
...示。这类大模型说胡话的现象,在业界被称为大模型出现幻觉。此前,哈尔滨工业大学和华为的研究团队发表的综述论文认为,模型产生幻觉的三大来源:数据源、训练过程和推理。大模型可能会过度依赖训练数据中的一些模式...……更多
不能简单地将AI幻觉“一棒子打死”
...电子报北京大学计算机学院教授黄铁军:不能简单地将AI幻觉“一棒子打死”4月28日,北京大学计算机学院教授、北京智源人工智能研究院理事长黄铁军在第十七届中国电子信息年会上发表演讲时表示,“幻觉”是人工智能创造...……更多
朱啸虎:AI的赚钱风向,彻底变了!
...不容易。为什么AIGC很难落地?最主要就两个问题:一是幻觉问题;二是结果不可控。一旦AI有幻觉就会出错,而且你不知道什么时候会出错,每次结果还都不一样,所以结果不可控。随着大家对幻觉的研究越来越多,发现造成幻...……更多
国内首个!中关村科金发布企业知识大模型
...判断三个层面,在他看来,目前大模型最为人诟病的是有幻觉问题,对低频常理的事实回答得不好,经常被人们认为一本正经的胡说八道,但可以通过一些其他的手段解决。比如,外挂一些知识库或者符号推进引擎,解决事实判...……更多
2023金融大模型报告|智能交易:求解知易行难
...。这包括但不限于建立合适的模型评估机制、提高模型的精度和可解释性、加强数据的安全性和合规性等。北京商报记者 宋亦桐 ……更多
大模型像“文科生”?业内人士在沪“论战”
...技术负责人张涛则认为,大模型在做辅助工作,并且有“幻觉”(看似合理但实际错误的现象)等缺点。但他认为,人无完人,知识非常渊博的人也会有盲区,要求大模型做一个完美助手,是不太现实的。RWKV元始智能COO罗璇认为,...……更多
OpenAI「补票」AI 搜索,SearchGPT 没有野心
...人质疑。尽管生成式搜索被认为是未来的搜索模式,但其幻觉问题仍然限制其发展。当地时间 7 月 25 日,OpenAI 宣布推出由 AI 驱动的搜索引擎 SearchGPT,并开启邀请测试,标志着 OpenAI 正式进军搜索引擎市场,直接对打谷歌、Bing...……更多
埃隆・马斯克推出grok聊天机器人
...异之一。然而,就像所有AI聊天机器人一样,Grok也存在“幻觉”问题,即生成包含虚假或误导信息的回应。这种现象在所有大型语言模型(LLM)中都普遍存在,包括ChatGPT。近日,一个Grok尴尬的“幻觉”在社交媒体上引起热议。...……更多
专家:openai语音转写工具存在重大缺陷
...家指出,这些生成的文本(IT之家注:业内通常称为“AI幻觉”)可能涉及种族言论、暴力措辞,甚至杜撰的医疗建议。专家们认为,这一问题尤其令人担忧,因为Whisper已被广泛应用于全球多个行业,包括用于翻译和转录访谈内...……更多
让大模型“外挂硬盘”,百川智能发布新API系列,企业定制成本大大降低
...前,对于192k token以内的请求,百川智能可以实现100%回答精度。“我们的长窗口能够做到全绿,相当于能完全不遗漏地把192k里的信息全部召回。”王小川表示。并且,结合搜索系统,Baichuan-2能够获取的原本文本规模提升了两个...……更多
OpenAI入局AI搜索 SearchGPT演示中“翻车”
...Bard出糗的一幕,犯下了事实性错误。从技术角度看,“AI幻觉”(即AI编造语句通顺但事实逻辑错误的答案)仍是业界的一大难题。SearchGPT的发布彰显出OpenAI向搜索引擎扩张的野心,不过伟大的愿景往往伴随着巨大的资金需求。...……更多
AWS搭载“最强大模型”!40亿美元投向OpenAI竞对
...与Claude 2相比,Claude 3最明显的迭代体现在多模态能力、幻觉的降低、长文本能力等方面。例如借助视觉能力,Claude 3可以理解图表、图形、报告等文件,并从中提取数据。▲Claude 3的多模态能力在准确率方面,Claude 3大幅改善了...……更多
更多关于科技的资讯:
一加李杰:以用户需求为核心,将持续打造优势产品力
【CNMO科技】从一加11开始,以“产品力优先”作为品牌理念一加手机,在数字系列旗舰中取消了Pro版本的机型,或者用一加自己的话来说
2024-11-02 14:44:00
抖音原生鸿蒙版大升级 直播、私信功能均已上线
【CNMO科技消息】自10月22日华为宣布HarmonyOSNEXT正式发布以来,鸿蒙生态的各类迭代、上新,一直是大家关注
2024-11-02 14:48:00
办公好搭子!华为千元档位护眼办公显示器开启预售
【CNMO科技消息】10月30日,全新一代华为MateViewSE护眼办公显示器正式开启预售,预售价849元。华为MateViewSE定位千元档位护眼办公显示器新选择
2024-11-02 14:48:00
华为智选Hi畅享新机曝光:支持40W快充 或11月发布
【CNMO科技消息】CNMO最新获悉,一款神秘的华为智选Hi畅享新机曝光,该机有望在11月正式发布。Hi畅享70近日,有数码博主爆料称
2024-11-02 14:49:00
4199元!华为Mate60Pro降价
华为Mate60Pro和荣耀Magic6Pro这两款手机经常被拿来比较,它们确实有不少相似之处,比如在系统操作上,用起来的感觉挺像的
2024-11-02 14:53:00
7寸大屏+骁龙8!这款新机太强悍了
各位玩友们,准备好大开眼界了吗?红魔这个名字,可是无数gamers心中的白月光啊,这次又要给我们带来新惊喜了!最近关于红魔10Pro的消息一波接一波
2024-11-02 14:54:00
总投资8亿元!淳安经开区常芯科创园项目开工
浙江在线11月2日讯 (通讯员 汪霞飞)11月2日,淳安经济开发区再度迎来先进制造赛道“高光时刻”,继2023年浙江常淳科技公司投产之后
2024-11-02 16:27:00
专家喊话公共洗手间男女例应是1比2:对女性最起码尊重
11月2日消息,原韩国驻英国大使、原韩国公共外交大使朴银夏接受媒体采访时表示,公共洗手间男女例应是1比2,这也样对女性的尊重
2024-11-02 16:35:00
新疆沙漠里竟然养出大海里的鱼虾:口感Q弹、肉质鲜美
快科技11月2日消息, 浙江大学近日宣布,该校援疆科技特派员在新疆沙漠成功养殖鱼虾。去年9月,特派员对阿拉尔市地下盐碱水进行了深入调研
2024-11-02 16:35:00
ZDS 数字股票 布局全球视野,开启智能金融新篇章
在全球金融市场蓬勃发展的背景下,ZealDigitalShares(ZDS)正迈向一个全新的发展阶段。通过采用先进技术与深度融合人工智能(AI)
2024-11-02 16:37:00
ZFX山海证券 AI驱动引领行业革新
在全球金融市场蓬勃发展的今天,众多新兴金融机构如雨后春笋般涌现。而在这其中,ZFX山海证券凭借其全球化扩展战略、严格的监管
2024-11-02 16:57:00
埃安巧用“三折叠手机”打广告:5平大床AION Y不要9.98万
快科技11月2日消息,埃安今日宣布AION Y车型推出重大促销活动,享受国家补贴、地方补贴以及厂家补贴,三重优惠叠加。有趣的是
2024-11-02 17:05:00
时代变了!英伟达纳入道琼斯指数 英特尔被取代
见证历史!最新消息,英伟达将在2024年11月8日替代英特尔成为道琼斯工业平均指数的组成成员。这是历史最悠久的美国市场指数之一
2024-11-02 17:05:00
不适合中国人用 厨余垃圾处理器连续4年大跌:降价也回天无力
快科技11月2日消息,奥维云网(AVC)数据显示,2024年1-9月厨余垃圾处理器行业零售额为4.1亿元,同比下降28
2024-11-02 17:05:00
首发原生鸿蒙!华为Mate 70系列即将官宣
快科技11月2日消息,博主厂长是关同学、定焦数码爆料,华为Mate 70系列即将官宣。从下周开始,Mate 70系列的细节信息就会露出
2024-11-02 17:35:00