• 我的订阅
  • 头条热搜
大幅减缓幻觉 百融云创大模型精度测评结果出炉
近日,百融云创大模型参加一场“考试”,并取得了行业领先的成绩,多项指标优于ChatGPT3.5。随着各类大模型的相继问世,如何去评估大模型的性能变得越来越重要。百融云创参加的这场“考试”名叫检索增强生成基准测评,...……更多
美国执念抹黑他国 恰似人工智能“幻觉”
“幻觉”,在人工智能领域是一个专业术语,被用于描述机器可能输出“无中生有”的内容。这样的“幻觉”也出现在一些美国政客身上,他们无中生有地污称中国用人工智能技术收集美国人数据。治疗这种“幻觉”,美国一...……更多
生成式AI“卷”应用层,但仍受困于高成本、幻觉和低留存率
...峰发现,生成式AI应用的落地依旧面临高昂成本、大模型幻觉和用户留存率低的三大难题。7月6日,周志峰在2024世界人工智能大会一场创投论坛上分析说,去年同期每百万token的基座大模型API调用成本,还处于120美元左右,而今...……更多
依托数据、平台、知识增强等优势 夸克大模型降低问答幻觉率
...性。在医疗健康领域,夸克大模型已经可以将问答内容的幻觉率降低至5%。夸克推进搜索革新,自研大模型打造技术新底座在互联网高速发展的30余年中,搜索曾经高效地满足了用户主动获取信息的需求。基于大模型的AIGC技术将...……更多
GPT-4批评GPT-4实现「自我提升」!OpenAI前超级对齐团队又一力作被公开
...前插入的特定bug,即CBI(critique-bug inclusion)有没有出现幻觉或者挑剔现象,指出了不存在的问题对整体有用性的主观评级,包含上述内容并考虑风格和整体的实用性在训练CriticGPT的过程中,除了RLHF方法,团队将奖励模型与搜索...……更多
鄂维南院士领衔新作:大模型不止有RAG、参数存储,还有第3种记忆
...更快的推理速度; 此外,Memory3 提高了事实性并减轻了幻觉,并能够快速适应专业任务。方法介绍记忆电路理论有助于确定哪些知识可以存储为显式记忆,以及哪种模型架构适合读取和写入显式记忆。研究者将输入输出关系作...……更多
...。中兴通讯总裁徐子阳认为,行业大模型的一大问题就是幻觉。他指出,AI如果作为助手没问题,但如果把AI当成一名雇员,它就不能犯错。他指出,对于工业等场景,AI应用的门槛比较高,企业也在探索新路径解决幻觉问题。上...……更多
AI 胡说八道怎么办?牛津大学开发了一种“测谎”方法
...方法,下面咱们就详细聊聊。大模型的胡说八道和风险“幻觉”(Hallucinations)是大语言模型(例如 ChatGPT、Gemini、或文心一言)面临的一个关键问题,也是网络上常见的用户体验吐槽类型之一,这个术语可以粗略地理解为 AI 一...……更多
...融入到科学思想的碰撞中。” 近未来型脑洞:“大模型幻觉”何解大模型是当下正火的AI概念。但大模型普遍存在“一本正经地胡说八道”的现象,这被称为“大模型幻觉”。在知乎上就有这样一个问题:当大模型幻觉完全消...……更多
微软研究人员正在测试其他ai模型
...种旨在让模型捏造信息的测试。为了治好这种被称为“AI幻觉”的症状,他们设定了一个会让大多数人头疼的文本检索任务,然后跟踪并改进模型响应,这也是微软在测定、检测和缓解AI幻觉方面的一个例子。微软AI负责项目的首...……更多
人工智能为了游戏获胜会“说谎”
...理论作修订AI“一本正经地胡说八道”这种现象被称为AI幻觉。AI幻觉指的是AI会生成貌似合理连贯,但同输入问题意图不一致、同世界知识不一致、与现实或已知数据不符合或无法验证的内容。人工智能是否会“说谎”,以及最...……更多
...。尽管大模型是划时代的技术突破,但现阶段并不完美,幻觉、时效性差、缺乏专业领域知识等问题,是其落地千行百业必须要面对的挑战。百川智能CEO王小川说,搜索增强是大模型落地应用的关键,能够有效解决幻觉、时效性...……更多
9.11比9.9大?多个大模型翻车!业内人士:就是偏科,文科强理科弱
...示。这类大模型说胡话的现象,在业界被称为大模型出现幻觉。此前,哈尔滨工业大学和华为的研究团队发表的综述论文认为,模型产生幻觉的三大来源:数据源、训练过程和推理。大模型可能会过度依赖训练数据中的一些模式...……更多
不能简单地将AI幻觉“一棒子打死”
...电子报北京大学计算机学院教授黄铁军:不能简单地将AI幻觉“一棒子打死”4月28日,北京大学计算机学院教授、北京智源人工智能研究院理事长黄铁军在第十七届中国电子信息年会上发表演讲时表示,“幻觉”是人工智能创造...……更多
朱啸虎:AI的赚钱风向,彻底变了!
...不容易。为什么AIGC很难落地?最主要就两个问题:一是幻觉问题;二是结果不可控。一旦AI有幻觉就会出错,而且你不知道什么时候会出错,每次结果还都不一样,所以结果不可控。随着大家对幻觉的研究越来越多,发现造成幻...……更多
国内首个!中关村科金发布企业知识大模型
...判断三个层面,在他看来,目前大模型最为人诟病的是有幻觉问题,对低频常理的事实回答得不好,经常被人们认为一本正经的胡说八道,但可以通过一些其他的手段解决。比如,外挂一些知识库或者符号推进引擎,解决事实判...……更多
2023金融大模型报告|智能交易:求解知易行难
...。这包括但不限于建立合适的模型评估机制、提高模型的精度和可解释性、加强数据的安全性和合规性等。北京商报记者 宋亦桐 ……更多
大模型像“文科生”?业内人士在沪“论战”
...技术负责人张涛则认为,大模型在做辅助工作,并且有“幻觉”(看似合理但实际错误的现象)等缺点。但他认为,人无完人,知识非常渊博的人也会有盲区,要求大模型做一个完美助手,是不太现实的。RWKV元始智能COO罗璇认为,...……更多
OpenAI「补票」AI 搜索,SearchGPT 没有野心
...人质疑。尽管生成式搜索被认为是未来的搜索模式,但其幻觉问题仍然限制其发展。当地时间 7 月 25 日,OpenAI 宣布推出由 AI 驱动的搜索引擎 SearchGPT,并开启邀请测试,标志着 OpenAI 正式进军搜索引擎市场,直接对打谷歌、Bing...……更多
埃隆・马斯克推出grok聊天机器人
...异之一。然而,就像所有AI聊天机器人一样,Grok也存在“幻觉”问题,即生成包含虚假或误导信息的回应。这种现象在所有大型语言模型(LLM)中都普遍存在,包括ChatGPT。近日,一个Grok尴尬的“幻觉”在社交媒体上引起热议。...……更多
让大模型“外挂硬盘”,百川智能发布新API系列,企业定制成本大大降低
...前,对于192k token以内的请求,百川智能可以实现100%回答精度。“我们的长窗口能够做到全绿,相当于能完全不遗漏地把192k里的信息全部召回。”王小川表示。并且,结合搜索系统,Baichuan-2能够获取的原本文本规模提升了两个...……更多
AWS搭载“最强大模型”!40亿美元投向OpenAI竞对
...与Claude 2相比,Claude 3最明显的迭代体现在多模态能力、幻觉的降低、长文本能力等方面。例如借助视觉能力,Claude 3可以理解图表、图形、报告等文件,并从中提取数据。▲Claude 3的多模态能力在准确率方面,Claude 3大幅改善了...……更多
OpenAI入局AI搜索 SearchGPT演示中“翻车”
...Bard出糗的一幕,犯下了事实性错误。从技术角度看,“AI幻觉”(即AI编造语句通顺但事实逻辑错误的答案)仍是业界的一大难题。SearchGPT的发布彰显出OpenAI向搜索引擎扩张的野心,不过伟大的愿景往往伴随着巨大的资金需求。...……更多
零成本突破多模态大模型瓶颈!多所美国顶尖高校华人团队,联合推出自增强技术CSR
...【新智元导读】现有多模态大模型在对齐不同模态时面临幻觉和细粒度感知不足等问题,传统偏好学习方法依赖可能不适配的外源数据,存在成本和质量问题。Calibrated Self-Rewarding(CSR)框架通过自我增强学习,利用模型自身输...……更多
破解AI“胡说八道”,这家公司要给大模型投喂好原料|产品观察
...”搭载了文本向量化模型,以解决大模型“已读乱回”的幻觉问题。合合信息的思路是,从“炼丹”源头的燃料出发,通过标准化平台进行语料结构化,提高数据预训练效率,帮助大模型厂商达成有效的模型性能提升和迭代。处...……更多
...语料进行训练。星辰语义大模型在业界首次提出缓解多轮幻觉的解决方案,通过关键信息注意力增强、知识图谱强化、多轮知识强化、知识溯源能力四大技术,将AI大模型的幻觉率降低了40%,有助于大模型变得更有“人味”,理...……更多
...生成能力、强大的迁移(推广)能力、强大的交互能力和幻觉。强大的语言生成能力可基于上下文和过去的对话,在开领域生成多样性类似人类的连贯文本。强大的迁移能力可以在代理任务上训练一个模型,通过细调适配到感兴...……更多
大模型应用疯狂加速,洗牌却在静悄悄进行了
...大模型基于训练推理一体化设计,实现大模型稀疏化、低精度量化的技术突破,能高效适配昇腾AI,加速大模型的行业落地应用和迭代;与此同时,以昇腾AI为核心,软硬件协同优化,构建算力集中、协同优化、供给稳定、数据...……更多
库克:苹果智能取得重大突破 但无法回避AI幻觉
...展,但一些人工智能存在问题,苹果也无法回避,比如AI幻觉问题。AI幻觉是指AI在某些时候的盲目自信情况,其会相当自信的给出用户某个问题的答案,但其所提供的回答完全子虚乌有。库克承认这种情况也可能发生在苹果智能...……更多
Runway开发通用世界模型,想让AI更好地模拟世界
...当我们惊叹于大语言模型竟然能够流畅地与我们对话时,幻觉问题让大模型们时不时“胡言乱语”或“答非所问”的情况也让实际的使用体验大打折扣。而这种问题并不仅仅存在于大语言模型领域,在AI扩图和AI视频生成中也屡...……更多
更多关于科技的资讯:
充电宝有必要买贵的吗?充电宝可以带上高铁吗?充电宝选购方法
市面上的充电宝可以说是非常的多,但是能选到一款适合自己的充电宝基本是不容易的,然而,当我们准备选购充电宝时,常常会面临诸多疑问
2024-08-02 17:47:00
苏州工行统筹发展与安全 数字金融技术再获新突破
江南时报讯 为全面加强客户数据安全保障,提升数字金融服务的安全性和可靠性,工商银行苏州分行持续进行探索创新和科技攻关,创新性地建立一种基于环境信息加密的通信机制
2024-08-02 17:53:00
格力电器已研发美容仪!董明珠:用一个星期发现自己漂亮了
快科技8月2日消息,今天下午,格力冰洗生活电器战略发布会在河北石家庄举行,格力电器董事长兼总裁董明珠出席大会。据媒体报道
2024-08-02 18:05:00
泳池变浅也拦不住中国人创世界纪录!潘展乐的金牌含金量到底有多高
北京时间8月1日凌晨,在巴黎奥运会男子100米自由泳决赛中,中国选手潘展乐以创世界纪录的46秒40夺得冠军,成为第一位在该奥运项目中摘金的中国人
2024-08-02 18:05:00
纯电A00级小车最强选手!比亚迪海鸥上市16个月销量超50万
快科技8月2日消息,比亚迪汽车官宣,旗下A00级纯电动车海鸥7月热销36256辆,上市16个月累销507510辆,成为了最快累销超50万辆的纯电+A00级车型
2024-08-02 18:05:00
Tik Tok运营攻略
字节跳动旗下的TikTok平台上线后,在全球的反响十分热烈,目前已成为全球实时用户量最多的一款短视频社交平台,下载量已超30亿
2024-08-02 18:25:00
微信治理假冒账号:四种名字千万别用
快科技8月2日消息,微信公众平台运营中心宣布,对仿冒官方机构、新闻媒体、行政区域及职业资质的情况,展开持续治理。自7月26日治理行动开展以来
2024-08-02 18:35:00
稳居第二!特斯拉中国7月批发销量74117辆
快科技8月2日消息,根据乘用车市场信息联席会(乘联会)最新数据,2024年7月全国新能源乘用车厂商批发销量预计达到95万辆
2024-08-02 18:35:00
华为享界S9智能电子外后视镜实测:不怕黑、不怕炫光 比物理镜好用
快科技8月2日消息,作为鸿蒙智行的第三界首车,享界S9将于8月6正式发布。据介绍,享界S9将搭载电子后视镜,而日前,鸿蒙智行公布了享界S9电子后视镜的实测视频
2024-08-02 18:35:00
美女开小米SU7出事故冲上花坛:人没事、先拍照留念
快科技8月2日消息,日常生活中,如果说开车不小心出了事故,哪怕是小剐小蹭,怕是也会影响心情,不过有些则会一反常态。近日有一女司机驾驶一台小米SU7不慎冲上了路中的花坛
2024-08-02 18:35:00
优刻得与蔚星科技达成战略合作,打造航天产业“天基大脑”
8月2日,优刻得与上海蔚星数据科技有限公司(下称:蔚星科技)达成战略合作,双方将共同探索云计算与商业航天领域的创新合作
2024-08-02 19:00:00
名校法学硕士替换功德箱二维码 盗3万多被抓
快科技8月2日消息,替换收款二维码盗窃钱财的事件不少,只能说有点儿小聪明但不多。最近就发生了一起让人大跌眼镜的替换二维码收钱的事件
2024-08-02 19:05:00
蓝戟发布第一款白色的双风扇显卡:A380 Photon只需899元
快科技8月2日消息,去年4月份,蓝戟发布了旗下首款白色显卡,A750/A770 Photon白色版,而元老级的A380 Photon今天也迎来了白色款
2024-08-02 19:05:00
苹果威胁拒绝更新微信、抖音!漏洞逃避30%佣金
苹果公司正在加大对腾讯、字节跳动的施压力度,要求他们对微信、抖音作出根本性改变。苹果这一不寻常的举动可能会加剧它与中国公司的紧张关系
2024-08-02 19:05:00
影驰主板BIOS焕然一新!更好看 更好用
快科技8月2日消息,一款主板是否强大、好用,除了硬件堆料、技术功能,更要看BIOS设计,这是非常考验厂商实力的。今天,影驰主板BIOS迎来重大更新
2024-08-02 19:05:00