• 我的订阅
  • 头条热搜
大幅减缓幻觉 百融云创大模型精度测评结果出炉
近日,百融云创大模型参加一场“考试”,并取得了行业领先的成绩,多项指标优于ChatGPT3.5。随着各类大模型的相继问世,如何去评估大模型的性能变得越来越重要。百融云创参加的这场“考试”名叫检索增强生成基准测评,...……更多
美国执念抹黑他国 恰似人工智能“幻觉”
“幻觉”,在人工智能领域是一个专业术语,被用于描述机器可能输出“无中生有”的内容。这样的“幻觉”也出现在一些美国政客身上,他们无中生有地污称中国用人工智能技术收集美国人数据。治疗这种“幻觉”,美国一...……更多
依托数据、平台、知识增强等优势 夸克大模型降低问答幻觉率
...性。在医疗健康领域,夸克大模型已经可以将问答内容的幻觉率降低至5%。夸克推进搜索革新,自研大模型打造技术新底座在互联网高速发展的30余年中,搜索曾经高效地满足了用户主动获取信息的需求。基于大模型的AIGC技术将...……更多
...融入到科学思想的碰撞中。” 近未来型脑洞:“大模型幻觉”何解大模型是当下正火的AI概念。但大模型普遍存在“一本正经地胡说八道”的现象,这被称为“大模型幻觉”。在知乎上就有这样一个问题:当大模型幻觉完全消...……更多
...。尽管大模型是划时代的技术突破,但现阶段并不完美,幻觉、时效性差、缺乏专业领域知识等问题,是其落地千行百业必须要面对的挑战。百川智能CEO王小川说,搜索增强是大模型落地应用的关键,能够有效解决幻觉、时效性...……更多
国内首个!中关村科金发布企业知识大模型
...判断三个层面,在他看来,目前大模型最为人诟病的是有幻觉问题,对低频常理的事实回答得不好,经常被人们认为一本正经的胡说八道,但可以通过一些其他的手段解决。比如,外挂一些知识库或者符号推进引擎,解决事实判...……更多
2023金融大模型报告|智能交易:求解知易行难
...。这包括但不限于建立合适的模型评估机制、提高模型的精度和可解释性、加强数据的安全性和合规性等。北京商报记者 宋亦桐 ……更多
大模型像“文科生”?业内人士在沪“论战”
...技术负责人张涛则认为,大模型在做辅助工作,并且有“幻觉”(看似合理但实际错误的现象)等缺点。但他认为,人无完人,知识非常渊博的人也会有盲区,要求大模型做一个完美助手,是不太现实的。RWKV元始智能COO罗璇认为,...……更多
埃隆・马斯克推出grok聊天机器人
...异之一。然而,就像所有AI聊天机器人一样,Grok也存在“幻觉”问题,即生成包含虚假或误导信息的回应。这种现象在所有大型语言模型(LLM)中都普遍存在,包括ChatGPT。近日,一个Grok尴尬的“幻觉”在社交媒体上引起热议。...……更多
让大模型“外挂硬盘”,百川智能发布新API系列,企业定制成本大大降低
...前,对于192k token以内的请求,百川智能可以实现100%回答精度。“我们的长窗口能够做到全绿,相当于能完全不遗漏地把192k里的信息全部召回。”王小川表示。并且,结合搜索系统,Baichuan-2能够获取的原本文本规模提升了两个...……更多
AWS搭载“最强大模型”!40亿美元投向OpenAI竞对
...与Claude 2相比,Claude 3最明显的迭代体现在多模态能力、幻觉的降低、长文本能力等方面。例如借助视觉能力,Claude 3可以理解图表、图形、报告等文件,并从中提取数据。▲Claude 3的多模态能力在准确率方面,Claude 3大幅改善了...……更多
...语料进行训练。星辰语义大模型在业界首次提出缓解多轮幻觉的解决方案,通过关键信息注意力增强、知识图谱强化、多轮知识强化、知识溯源能力四大技术,将AI大模型的幻觉率降低了40%,有助于大模型变得更有“人味”,理...……更多
...生成能力、强大的迁移(推广)能力、强大的交互能力和幻觉。强大的语言生成能力可基于上下文和过去的对话,在开领域生成多样性类似人类的连贯文本。强大的迁移能力可以在代理任务上训练一个模型,通过细调适配到感兴...……更多
大模型应用疯狂加速,洗牌却在静悄悄进行了
...大模型基于训练推理一体化设计,实现大模型稀疏化、低精度量化的技术突破,能高效适配昇腾AI,加速大模型的行业落地应用和迭代;与此同时,以昇腾AI为核心,软硬件协同优化,构建算力集中、协同优化、供给稳定、数据...……更多
Runway开发通用世界模型,想让AI更好地模拟世界
...当我们惊叹于大语言模型竟然能够流畅地与我们对话时,幻觉问题让大模型们时不时“胡言乱语”或“答非所问”的情况也让实际的使用体验大打折扣。而这种问题并不仅仅存在于大语言模型领域,在AI扩图和AI视频生成中也屡...……更多
...创新机会。”杨瑞荣说。两大挑战包括,第一大模型存在幻觉问题。看似流畅自然的表述,实则不符合事实或者是错误的。“日常生活的交流中,人们对大模型幻觉的容忍度相对较高。但在崇尚严谨的医疗领域,这是致命的弱点...……更多
谷歌人工智能聊天机器人正在使用bard
...型的一些存在已久的问题,比如他们有编造东西或“产生幻觉”的倾向。但我最担心的是,正如我今年早些时候所写的那样,它们可能带来安全和隐私灾难。科技公司正在将这项存在严重缺陷的技术交到数百万人的手里,并允许...……更多
智慧芽AI助手“芽仔”:你的智能研发专家,开启创新新范式
...强大模型理解能力,减少幻觉,对齐人类意图,将大模型精度提升至80%。持续的数据监控和质量控制是保证训练结果可靠性的关键。在专利大模型领域,目前市场上还没有比较全面、专业、完整的评估体系。智慧芽率先建立了Pat...……更多
大模型观察|从训练到落地金融业,大模型“升级之路”面临哪些挑战?
...常提到的技术挑战固然重要,但更为核心的问题在于机器幻觉和合规风险。 机器幻觉是指大模型在学习海量数据后,可能会根据对前文内容的理解“编造”出一些“无中生有”的内容。在容错率较低的金融领域,这种幻觉会直...……更多
2024年最重要的趋势,可能影响你的工作
...个重大的技术挑战。(图/unsplash)第二个重大的困境是AI幻觉。因为AI是一种概率模型,所以它不可避免地会出现幻觉。这种幻觉既是好事,也是坏事。好事就是它代表了AI具有想象力和融合性,有组合式创新和增量式创新的能力...……更多
...》杂志上。基于人工智能的工具(例如LLM)有时受制于“幻觉”,导致作出看似合理但实际是错误的陈述。加入一个评估步骤,系统地衡量潜在解决方案的准确性,使得利用LLM应对复杂问题成为可能。这些问题一般需要可验证且...……更多
不同量级参数模型性能同样优秀 夸克大模型再登行业评测榜首
...性。在医疗健康领域,夸克大模型已经可以将问答内容的幻觉率降低至5%,处在行业领先水平。夸克推进搜索革新,自研大模型打造技术新底座在互联网高速发展的30余年中,搜索曾经高效地满足了用户主动获取信息的需求。但...……更多
回顾GPT大模型2023这一年,5大顶级公司预测2024年AI产品
...提供更多选择。 一家主要保险公司将提供专门的AI风险幻觉保险:genAI对幻觉或错误的倾向改变了风险管理和复杂风险转移策略的计算方式。尽管保险公司一直在努力弥补涉及AI幻觉的保险漏洞,但鉴于genAI的预期增长,先锋保...……更多
2023内容科技应用典型案例:传播大脑科技(浙江)股份有限公司打造传播大模型
...信息。知识增强技术:为缓解大模型在结果生成过程中的幻觉问题,引入知识增强技术与外部知识库进行交互,以补充和约束模型的输出,从而提高信息的准确性和完整性。长文本建模技术:通过长文本建模和切片方式突破大模...……更多
汉王科技发布天地大模型:适用于古文、法律、教育等多个领域
...汉语大模型杜绝了通用大模型最容易产生的代词错乱甚至幻觉的场景,完成了开放式问答的任务。法律大模型的演示环节,通过劳动问答、婚姻问答、法考问答三个领域的开放性问答演示,结果表明,法律大模型不仅具备专业知...……更多
摆脱Transformer依赖?这家AI初创公司推出国内首个非Attention机制大模型
...性,让决策过程难以解释;长序列处理困难和无法控制的幻觉问题也限制了大模型在某些关键领域和特殊场景的广泛应用。随着云计算和边缘计算的普及,行业对于高效能、低能耗AI大模型的需求正不断增长。图片来自岩芯数智...……更多
2023金融大模型报告|重塑金融科技
...用对业务进行实际支持。 在消费金融领域,通用大模型精度不够、金融专业知识缺失,以及难以满足消费场景中大量定制化需求等问题,成为当前亟待解决的难题。对此,招联消费金融与中山大学联合研发推出开源金融大模“...……更多
研究:网络充斥低质机翻内容,大语言模型训练需警惕数据陷阱
...标准来看可能质量很低。这可能会导致LLM模型产生更多‘幻觉’ ,而选择偏差表明即使不考虑机器翻译错误,数据质量也可能较低。数据质量对于LLM训练至关重要,其中高质量语料库如书籍和维基百科文章通常会进行多次向上...……更多
2023金融大模型报告|智能风控:荆棘中有玫瑰
...场风险管理的准确性和全面性”。由于保险业对信息的高精度的要求和严苛的数据合规要求,元保保险经纪(北京)有限公司负责人也同样指出,大模型可以协同进行更总结性的监控,判断异常的交易频率规模,判断是否存在内...……更多
中金公司信息技术部执行负责人王缅:金融行业做好客户服务的标准化和定制化可通过大模型更好实现
...,大模型的输出标准相对比较模糊,当前阶段存在模型'幻觉',但是金融服务对于输出结果要求相对准确、严肃,两者之间存在一定矛盾。针对此难点有两点建议:第一,建议大模型与小模型搭配,运用行业专业领域数据结合基...……更多
更多关于科技的资讯:
PITAKA浮织工艺再升级,以浮织·光影波纹带来「浮光跃金」新品
、2025年9月,PITAKA发布了iPhone 17系列新品,也正式推出全新Moment系列新纹路——「浮光跃金」,分别有清梦蓝
2025-10-23 16:50:00
76年,于历史长河或为一瞬;于中国保险业,则是一从小到大、由弱及强、自稚嫩向成熟蜕变的壮阔史诗。76年,于一家险企而言
2025-10-23 17:01:00
能环宝NiOS™智慧能源管理系统:驱动光伏电站效益跃升与运维变革
在光伏产业迈向全面平价时代的关键节点,电站运营的精细化管理与经济效益最大化已成为行业共识。面对分布式光伏电站运维成本高
2025-10-23 15:29:00
三位核心人物的真诚分享,道尽燕教授 13 年健康深耕的温度与底气
10月20日19:30,燕教授《一“张”邀请函》第六季天津蓟州站在官方视频号如期开播,一场以“一“张”邀请函”为主题的深度访谈
2025-10-23 08:15:00
Soul App Q3生态安全报告:AI筑防线,共建安全可靠连接空间
随着移动互联网的普及与社交应用深度融入日常生活,社交平台已成为公众表达观点、建立连接的重要渠道。然而,随之而来的虚假信息传播
2025-10-23 08:15:00
厦门网讯(厦门日报记者 李晓平)近日,省工信厅公布第九批省级制造业单项冠军企业名单,15家厦企上榜,占全省31.2%。包括此次公布的名单
2025-10-23 08:43:00
深耕SUV越野赛道,山东新大陆跻身全球轮胎影响力品牌
齐鲁晚报·齐鲁壹点 高松山东新大陆橡胶科技有限公司成立于2012年,位于临沂市沂水县庐山工业园,是一家以研发、生产、销售高性能半钢子午胎为主的高新技术企业
2025-10-23 11:37:00
小米汽车SOS 1秒接通?高管辟谣:该内容完全失实
10月22日,小米汽车副总裁李肖爽发文:针对近期网传 “小米汽车SOS 1秒接通 不含排队时间”等相关内容,为了避免误传
2025-10-23 11:38:00
天猫双11闪购服务再升级:上线“爆火好店”超时20分钟享免单
2025天猫双11已于10月20日晚正式开售,首次参与双11大促的淘宝闪购今日官宣再加码:全面上线“爆火好店”频道,并推出“超时20分钟免单”服务
2025-10-23 11:38:00
京东001号“国民好车”最高出价超7800万元 京东回应此次异常高价成交事件
10月22日14时,京东001号“国民好车”在京东拍卖平台正式开拍,至18时结束时,最终价格为7819.3399万元,京东用户@j*p竞拍成功
2025-10-23 11:38:00
参小妹海参官宣倪萍为品牌代言人,新工厂同步剪彩开启秋冬滋补新篇
金秋十月,正值秋冬滋补季启动节点,生鲜电商领域知名海参品牌 “参小妹海参”于大连保税区工厂,正式官宣国民级主持人倪萍出任品牌代言人
2025-10-23 11:47:00
苹果入局F1直播:生态渗透与体育转播的范式革命
当苹果与F1的红色标识在屏幕上并置,一场关于体育转播、数字生态与用户体验的深层变革已然开启。2026年起,苹果将以7.5亿美元的价格拿下F1美国地区独家转播权
2025-10-23 12:17:00
科技有温度!及象教育以数字方案弥合银发群体艺术学习的“数字鸿沟”
在人口老龄化与数字科技浪潮交织的今天,如何满足日益庞大的银发群体对精神文化生活的更高追求,已成为社会各界广泛关注的重要议题
2025-10-23 11:47:00
画里有话|充电宝容量岂能“充水”
今年8月,消费者王先生在淘宝某品牌官方旗舰店购买了一款电芯容量为10000毫安的充电宝,背面小字标示的额定容量仅有6000毫安
2025-10-23 08:37:00
厦门网讯(厦门日报记者 杨霞瑜)“AI凑单比价”“AI万能搜”“AI帮我挑”……今年“双11”大促已经开始,AI在电商平台中被广泛使用
2025-10-23 08:42:00