• 我的订阅
  • 头条热搜
大幅减缓幻觉 百融云创大模型精度测评结果出炉
近日,百融云创大模型参加一场“考试”,并取得了行业领先的成绩,多项指标优于ChatGPT3.5。随着各类大模型的相继问世,如何去评估大模型的性能变得越来越重要。百融云创参加的这场“考试”名叫检索增强生成基准测评,...……更多
美国执念抹黑他国 恰似人工智能“幻觉”
“幻觉”,在人工智能领域是一个专业术语,被用于描述机器可能输出“无中生有”的内容。这样的“幻觉”也出现在一些美国政客身上,他们无中生有地污称中国用人工智能技术收集美国人数据。治疗这种“幻觉”,美国一...……更多
依托数据、平台、知识增强等优势 夸克大模型降低问答幻觉率
...性。在医疗健康领域,夸克大模型已经可以将问答内容的幻觉率降低至5%。夸克推进搜索革新,自研大模型打造技术新底座在互联网高速发展的30余年中,搜索曾经高效地满足了用户主动获取信息的需求。基于大模型的AIGC技术将...……更多
...融入到科学思想的碰撞中。” 近未来型脑洞:“大模型幻觉”何解大模型是当下正火的AI概念。但大模型普遍存在“一本正经地胡说八道”的现象,这被称为“大模型幻觉”。在知乎上就有这样一个问题:当大模型幻觉完全消...……更多
微软研究人员正在测试其他ai模型
...种旨在让模型捏造信息的测试。为了治好这种被称为“AI幻觉”的症状,他们设定了一个会让大多数人头疼的文本检索任务,然后跟踪并改进模型响应,这也是微软在测定、检测和缓解AI幻觉方面的一个例子。微软AI负责项目的首...……更多
人工智能为了游戏获胜会“说谎”
...理论作修订AI“一本正经地胡说八道”这种现象被称为AI幻觉。AI幻觉指的是AI会生成貌似合理连贯,但同输入问题意图不一致、同世界知识不一致、与现实或已知数据不符合或无法验证的内容。人工智能是否会“说谎”,以及最...……更多
...。尽管大模型是划时代的技术突破,但现阶段并不完美,幻觉、时效性差、缺乏专业领域知识等问题,是其落地千行百业必须要面对的挑战。百川智能CEO王小川说,搜索增强是大模型落地应用的关键,能够有效解决幻觉、时效性...……更多
不能简单地将AI幻觉“一棒子打死”
...电子报北京大学计算机学院教授黄铁军:不能简单地将AI幻觉“一棒子打死”4月28日,北京大学计算机学院教授、北京智源人工智能研究院理事长黄铁军在第十七届中国电子信息年会上发表演讲时表示,“幻觉”是人工智能创造...……更多
朱啸虎:AI的赚钱风向,彻底变了!
...不容易。为什么AIGC很难落地?最主要就两个问题:一是幻觉问题;二是结果不可控。一旦AI有幻觉就会出错,而且你不知道什么时候会出错,每次结果还都不一样,所以结果不可控。随着大家对幻觉的研究越来越多,发现造成幻...……更多
国内首个!中关村科金发布企业知识大模型
...判断三个层面,在他看来,目前大模型最为人诟病的是有幻觉问题,对低频常理的事实回答得不好,经常被人们认为一本正经的胡说八道,但可以通过一些其他的手段解决。比如,外挂一些知识库或者符号推进引擎,解决事实判...……更多
2023金融大模型报告|智能交易:求解知易行难
...。这包括但不限于建立合适的模型评估机制、提高模型的精度和可解释性、加强数据的安全性和合规性等。北京商报记者 宋亦桐 ……更多
大模型像“文科生”?业内人士在沪“论战”
...技术负责人张涛则认为,大模型在做辅助工作,并且有“幻觉”(看似合理但实际错误的现象)等缺点。但他认为,人无完人,知识非常渊博的人也会有盲区,要求大模型做一个完美助手,是不太现实的。RWKV元始智能COO罗璇认为,...……更多
埃隆・马斯克推出grok聊天机器人
...异之一。然而,就像所有AI聊天机器人一样,Grok也存在“幻觉”问题,即生成包含虚假或误导信息的回应。这种现象在所有大型语言模型(LLM)中都普遍存在,包括ChatGPT。近日,一个Grok尴尬的“幻觉”在社交媒体上引起热议。...……更多
让大模型“外挂硬盘”,百川智能发布新API系列,企业定制成本大大降低
...前,对于192k token以内的请求,百川智能可以实现100%回答精度。“我们的长窗口能够做到全绿,相当于能完全不遗漏地把192k里的信息全部召回。”王小川表示。并且,结合搜索系统,Baichuan-2能够获取的原本文本规模提升了两个...……更多
AWS搭载“最强大模型”!40亿美元投向OpenAI竞对
...与Claude 2相比,Claude 3最明显的迭代体现在多模态能力、幻觉的降低、长文本能力等方面。例如借助视觉能力,Claude 3可以理解图表、图形、报告等文件,并从中提取数据。▲Claude 3的多模态能力在准确率方面,Claude 3大幅改善了...……更多
零成本突破多模态大模型瓶颈!多所美国顶尖高校华人团队,联合推出自增强技术CSR
...【新智元导读】现有多模态大模型在对齐不同模态时面临幻觉和细粒度感知不足等问题,传统偏好学习方法依赖可能不适配的外源数据,存在成本和质量问题。Calibrated Self-Rewarding(CSR)框架通过自我增强学习,利用模型自身输...……更多
...语料进行训练。星辰语义大模型在业界首次提出缓解多轮幻觉的解决方案,通过关键信息注意力增强、知识图谱强化、多轮知识强化、知识溯源能力四大技术,将AI大模型的幻觉率降低了40%,有助于大模型变得更有“人味”,理...……更多
...生成能力、强大的迁移(推广)能力、强大的交互能力和幻觉。强大的语言生成能力可基于上下文和过去的对话,在开领域生成多样性类似人类的连贯文本。强大的迁移能力可以在代理任务上训练一个模型,通过细调适配到感兴...……更多
大模型应用疯狂加速,洗牌却在静悄悄进行了
...大模型基于训练推理一体化设计,实现大模型稀疏化、低精度量化的技术突破,能高效适配昇腾AI,加速大模型的行业落地应用和迭代;与此同时,以昇腾AI为核心,软硬件协同优化,构建算力集中、协同优化、供给稳定、数据...……更多
库克:苹果智能取得重大突破 但无法回避AI幻觉
...展,但一些人工智能存在问题,苹果也无法回避,比如AI幻觉问题。AI幻觉是指AI在某些时候的盲目自信情况,其会相当自信的给出用户某个问题的答案,但其所提供的回答完全子虚乌有。库克承认这种情况也可能发生在苹果智能...……更多
Runway开发通用世界模型,想让AI更好地模拟世界
...当我们惊叹于大语言模型竟然能够流畅地与我们对话时,幻觉问题让大模型们时不时“胡言乱语”或“答非所问”的情况也让实际的使用体验大打折扣。而这种问题并不仅仅存在于大语言模型领域,在AI扩图和AI视频生成中也屡...……更多
GPT-4不仅性能更强也更贵了:单次输出7.5万单词需6美元,是此前的30倍
...此前模型相似的局限性,仍然不完全可靠,存在事实性“幻觉”并出现推理错误,可能自信地在其预测中犯错。同时,它的使用价格也更贵,其API价格是Chat-GPT API 使用价格的15-30倍。GPT-4实现多项突破,晋升“考霸”相较GPT-3.5,...……更多
...工作。“要想实现大模型在产业的进一步落地,准确性和幻觉问题是不可回避的挑战。”百融云创AI创新负责人表示。大模型想要精准,前置的数据处理环节非常重要。在这一环节,百融云创打造了智能版面识别系统。很多企业...……更多
...回答人们提出的问题,这就导致它们经常胡编乱造,即AI幻觉。里德对此表示,AI概览通常不会 “产生幻觉”,也不会像其他大语言模型产品那样胡编胡造,因为它们与谷歌的传统搜索引擎更紧密地结合在一起,只显示最权威或...……更多
...创新机会。”杨瑞荣说。两大挑战包括,第一大模型存在幻觉问题。看似流畅自然的表述,实则不符合事实或者是错误的。“日常生活的交流中,人们对大模型幻觉的容忍度相对较高。但在崇尚严谨的医疗领域,这是致命的弱点...……更多
讯飞星火V3.5春季上新,科大讯飞首发星火图文识别大模型
...解决这一问题。星火图文识别大模型具备对复杂板面的高精度解析,融合篇章语义的文字识别功能,以及覆盖多领域的专业符号识别等特点。借助该技术,讯飞星火可以实现对多媒体信息的深入理解,显著提高用户获取知识和学...……更多
谷歌人工智能聊天机器人正在使用bard
...型的一些存在已久的问题,比如他们有编造东西或“产生幻觉”的倾向。但我最担心的是,正如我今年早些时候所写的那样,它们可能带来安全和隐私灾难。科技公司正在将这项存在严重缺陷的技术交到数百万人的手里,并允许...……更多
智慧芽AI助手“芽仔”:你的智能研发专家,开启创新新范式
...强大模型理解能力,减少幻觉,对齐人类意图,将大模型精度提升至80%。持续的数据监控和质量控制是保证训练结果可靠性的关键。在专利大模型领域,目前市场上还没有比较全面、专业、完整的评估体系。智慧芽率先建立了Pat...……更多
...19日发表的一项研究报道了一种能检测大语言模型(LLM)幻觉(hallucination)的方法,该方法能够测量生成回答的含义的不确定性,或者用于提升LLM输出的可靠性。像ChatGPT和Gemini这样的LLM是能够阅读和生成自然人类语言的人工智...……更多
大模型观察|从训练到落地金融业,大模型“升级之路”面临哪些挑战?
...常提到的技术挑战固然重要,但更为核心的问题在于机器幻觉和合规风险。 机器幻觉是指大模型在学习海量数据后,可能会根据对前文内容的理解“编造”出一些“无中生有”的内容。在容错率较低的金融领域,这种幻觉会直...……更多
更多关于科技的资讯:
枣庄高新投资集团完成枣庄市首单数据产品全国挂牌及数据资产入表
当前,数据已成为与土地、劳动力、资本、技术并称的五大生产要素之一,具有巨大的开发潜力。为进一步释放数据要素价值,近日,枣庄高新投资集团在全国性数据交易平台——北京国际大数据交易所完成了枣庄市首单数据产品挂牌
2024-07-01 08:46:00
夏普发布lcd屏新机,华为平板来了
不知道还有多少在坚守LCD屏幕手机的小伙伴?经常每隔一段时间就能看到有小伙伴感慨机圈很少看到LCD屏,诚然,目前LCD主要集中在中低端手机市场上
2024-07-01 08:42:00
redmik70至尊版、iqooneo9spro+亮相
根据行业的信息RedmiK70至尊版、iQOONeo9sPro+都将在7月份正式商用。这两款机型虽然现在的信息不多,但是亮点却提前曝光出来
2024-07-01 08:42:00
妈妈是清华的儿子也是清华的 网友点赞:优秀
7月1日消息,微博话题“妈妈是清华的儿子也是清华的”上了热搜榜。据国内多家媒体报道,在清华大学2024年本科生毕业典礼上
2024-07-01 09:11:00
红米turbo3再次优惠,性价比之最
今年的618也刚刚结束不久,从手机的整体销量情况来看,性价比依然占据主流,也就是说性价比高的手机依旧是很多人的第一选择
2024-07-01 08:49:00
真我13pro+海外版核心参数彻底曝光
6月30日,真我13Pro+海外版入网,其核心参数彻底曝光:和真我12Pro+相比,性能和续航组合都有提升,并且机身变得更轻更薄
2024-07-01 08:48:00
夏普推出5.7英寸lcd小屏手机
最近几年,小屏LCD手机逐渐淡出大众视野,智能手机似乎被大屏、高性能旗舰机型主导。然而,夏普却反其道而行之,最新推出5
2024-07-01 08:55:00
华为matex5夏日特惠,带来三重惊喜
当夏日的激情与科技创新相遇,华为MateX5折叠屏旗舰手机以一场别开生面的夏日特惠,引领智能设备的新风尚。这款集超前设计
2024-07-01 08:51:00
中国经济网北京7月1日讯美股上周五收跌,截至收盘,道指跌45.20点,跌幅为0.12%,报39118.86点;纳指跌126
2024-07-01 09:22:00
AI苦工卷向高学历,美国博士正在抢走印度人工作
美国人马特拥有通信博士学位,他最近喜提一份自由职业:成为Scale AI公司的一员,在家训练AI模型。“通信博士”“训练AI模型”
2024-07-01 08:55:00
骁龙8gen3到底贵不贵?三个维度告诉你答案
最近,有的厂商发布了新机,是一款骁龙8Gen3手机,配置齐满,售价3199元起。其实到了618之后,再等3个月,苹果、骁龙的新机就都该陆续出现了
2024-07-01 08:50:00
AI正在抢走谁的工作?一个人使用ChatGPT取代了60名员工
新智元报道编辑:庸庸 乔杨【新智元导读】ChatGPT发布一年多来,总是有人担心自己的工作会被取代,但最后总是演变成「狼来了」的故事
2024-07-01 08:56:00
年销售15694.6万台!董明珠回应小米空调销量第一底气:格力空调国内常年第一
快科技7月1日消息,近日,董明珠公开回应小米空调销量超格力:称小米“空调第一”不实。近期网上有一些文章和短视频说小米空调销量超过了格力空调
2024-07-01 09:11:00
Meta低头,库克认错,XR回归第一性原理
图片|Photo by Maxim Hopman on Unsplash©自象限原创作者丨罗辑2024年,XR的故事应该怎么讲
2024-07-01 08:56:00
中兴天机a41,降价幅度高到让人难以想象
说到性价比手机,各位可能对今年618期间红米手机降价印象深刻,可互联网如此之大,有些事情各位如果不去挖掘,是根本不会发现惊喜的
2024-07-01 09:05:00