• 我的订阅
  • 头条热搜
大幅减缓幻觉 百融云创大模型精度测评结果出炉
近日,百融云创大模型参加一场“考试”,并取得了行业领先的成绩,多项指标优于ChatGPT3.5。随着各类大模型的相继问世,如何去评估大模型的性能变得越来越重要。百融云创参加的这场“考试”名叫检索增强生成基准测评,...……更多
美国执念抹黑他国 恰似人工智能“幻觉”
“幻觉”,在人工智能领域是一个专业术语,被用于描述机器可能输出“无中生有”的内容。这样的“幻觉”也出现在一些美国政客身上,他们无中生有地污称中国用人工智能技术收集美国人数据。治疗这种“幻觉”,美国一...……更多
依托数据、平台、知识增强等优势 夸克大模型降低问答幻觉率
...性。在医疗健康领域,夸克大模型已经可以将问答内容的幻觉率降低至5%。夸克推进搜索革新,自研大模型打造技术新底座在互联网高速发展的30余年中,搜索曾经高效地满足了用户主动获取信息的需求。基于大模型的AIGC技术将...……更多
...融入到科学思想的碰撞中。” 近未来型脑洞:“大模型幻觉”何解大模型是当下正火的AI概念。但大模型普遍存在“一本正经地胡说八道”的现象,这被称为“大模型幻觉”。在知乎上就有这样一个问题:当大模型幻觉完全消...……更多
...。尽管大模型是划时代的技术突破,但现阶段并不完美,幻觉、时效性差、缺乏专业领域知识等问题,是其落地千行百业必须要面对的挑战。百川智能CEO王小川说,搜索增强是大模型落地应用的关键,能够有效解决幻觉、时效性...……更多
国内首个!中关村科金发布企业知识大模型
...判断三个层面,在他看来,目前大模型最为人诟病的是有幻觉问题,对低频常理的事实回答得不好,经常被人们认为一本正经的胡说八道,但可以通过一些其他的手段解决。比如,外挂一些知识库或者符号推进引擎,解决事实判...……更多
2023金融大模型报告|智能交易:求解知易行难
...。这包括但不限于建立合适的模型评估机制、提高模型的精度和可解释性、加强数据的安全性和合规性等。北京商报记者 宋亦桐 ……更多
埃隆・马斯克推出grok聊天机器人
...异之一。然而,就像所有AI聊天机器人一样,Grok也存在“幻觉”问题,即生成包含虚假或误导信息的回应。这种现象在所有大型语言模型(LLM)中都普遍存在,包括ChatGPT。近日,一个Grok尴尬的“幻觉”在社交媒体上引起热议。...……更多
让大模型“外挂硬盘”,百川智能发布新API系列,企业定制成本大大降低
...前,对于192k token以内的请求,百川智能可以实现100%回答精度。“我们的长窗口能够做到全绿,相当于能完全不遗漏地把192k里的信息全部召回。”王小川表示。并且,结合搜索系统,Baichuan-2能够获取的原本文本规模提升了两个...……更多
...语料进行训练。星辰语义大模型在业界首次提出缓解多轮幻觉的解决方案,通过关键信息注意力增强、知识图谱强化、多轮知识强化、知识溯源能力四大技术,将AI大模型的幻觉率降低了40%,有助于大模型变得更有“人味”,理...……更多
...生成能力、强大的迁移(推广)能力、强大的交互能力和幻觉。强大的语言生成能力可基于上下文和过去的对话,在开领域生成多样性类似人类的连贯文本。强大的迁移能力可以在代理任务上训练一个模型,通过细调适配到感兴...……更多
大模型应用疯狂加速,洗牌却在静悄悄进行了
...大模型基于训练推理一体化设计,实现大模型稀疏化、低精度量化的技术突破,能高效适配昇腾AI,加速大模型的行业落地应用和迭代;与此同时,以昇腾AI为核心,软硬件协同优化,构建算力集中、协同优化、供给稳定、数据...……更多
Runway开发通用世界模型,想让AI更好地模拟世界
...当我们惊叹于大语言模型竟然能够流畅地与我们对话时,幻觉问题让大模型们时不时“胡言乱语”或“答非所问”的情况也让实际的使用体验大打折扣。而这种问题并不仅仅存在于大语言模型领域,在AI扩图和AI视频生成中也屡...……更多
...创新机会。”杨瑞荣说。两大挑战包括,第一大模型存在幻觉问题。看似流畅自然的表述,实则不符合事实或者是错误的。“日常生活的交流中,人们对大模型幻觉的容忍度相对较高。但在崇尚严谨的医疗领域,这是致命的弱点...……更多
谷歌人工智能聊天机器人正在使用bard
...型的一些存在已久的问题,比如他们有编造东西或“产生幻觉”的倾向。但我最担心的是,正如我今年早些时候所写的那样,它们可能带来安全和隐私灾难。科技公司正在将这项存在严重缺陷的技术交到数百万人的手里,并允许...……更多
智慧芽AI助手“芽仔”:你的智能研发专家,开启创新新范式
...强大模型理解能力,减少幻觉,对齐人类意图,将大模型精度提升至80%。持续的数据监控和质量控制是保证训练结果可靠性的关键。在专利大模型领域,目前市场上还没有比较全面、专业、完整的评估体系。智慧芽率先建立了Pat...……更多
大模型观察|从训练到落地金融业,大模型“升级之路”面临哪些挑战?
...常提到的技术挑战固然重要,但更为核心的问题在于机器幻觉和合规风险。 机器幻觉是指大模型在学习海量数据后,可能会根据对前文内容的理解“编造”出一些“无中生有”的内容。在容错率较低的金融领域,这种幻觉会直...……更多
2024年最重要的趋势,可能影响你的工作
...个重大的技术挑战。(图/unsplash)第二个重大的困境是AI幻觉。因为AI是一种概率模型,所以它不可避免地会出现幻觉。这种幻觉既是好事,也是坏事。好事就是它代表了AI具有想象力和融合性,有组合式创新和增量式创新的能力...……更多
...》杂志上。基于人工智能的工具(例如LLM)有时受制于“幻觉”,导致作出看似合理但实际是错误的陈述。加入一个评估步骤,系统地衡量潜在解决方案的准确性,使得利用LLM应对复杂问题成为可能。这些问题一般需要可验证且...……更多
不同量级参数模型性能同样优秀 夸克大模型再登行业评测榜首
...性。在医疗健康领域,夸克大模型已经可以将问答内容的幻觉率降低至5%,处在行业领先水平。夸克推进搜索革新,自研大模型打造技术新底座在互联网高速发展的30余年中,搜索曾经高效地满足了用户主动获取信息的需求。但...……更多
回顾GPT大模型2023这一年,5大顶级公司预测2024年AI产品
...提供更多选择。 一家主要保险公司将提供专门的AI风险幻觉保险:genAI对幻觉或错误的倾向改变了风险管理和复杂风险转移策略的计算方式。尽管保险公司一直在努力弥补涉及AI幻觉的保险漏洞,但鉴于genAI的预期增长,先锋保...……更多
汉王科技发布天地大模型:适用于古文、法律、教育等多个领域
...汉语大模型杜绝了通用大模型最容易产生的代词错乱甚至幻觉的场景,完成了开放式问答的任务。法律大模型的演示环节,通过劳动问答、婚姻问答、法考问答三个领域的开放性问答演示,结果表明,法律大模型不仅具备专业知...……更多
摆脱Transformer依赖?这家AI初创公司推出国内首个非Attention机制大模型
...性,让决策过程难以解释;长序列处理困难和无法控制的幻觉问题也限制了大模型在某些关键领域和特殊场景的广泛应用。随着云计算和边缘计算的普及,行业对于高效能、低能耗AI大模型的需求正不断增长。图片来自岩芯数智...……更多
2023金融大模型报告|重塑金融科技
...用对业务进行实际支持。 在消费金融领域,通用大模型精度不够、金融专业知识缺失,以及难以满足消费场景中大量定制化需求等问题,成为当前亟待解决的难题。对此,招联消费金融与中山大学联合研发推出开源金融大模“...……更多
研究:网络充斥低质机翻内容,大语言模型训练需警惕数据陷阱
...标准来看可能质量很低。这可能会导致LLM模型产生更多‘幻觉’ ,而选择偏差表明即使不考虑机器翻译错误,数据质量也可能较低。数据质量对于LLM训练至关重要,其中高质量语料库如书籍和维基百科文章通常会进行多次向上...……更多
2023金融大模型报告|智能风控:荆棘中有玫瑰
...场风险管理的准确性和全面性”。由于保险业对信息的高精度的要求和严苛的数据合规要求,元保保险经纪(北京)有限公司负责人也同样指出,大模型可以协同进行更总结性的监控,判断异常的交易频率规模,判断是否存在内...……更多
中金公司信息技术部执行负责人王缅:金融行业做好客户服务的标准化和定制化可通过大模型更好实现
...,大模型的输出标准相对比较模糊,当前阶段存在模型\'幻觉\',但是金融服务对于输出结果要求相对准确、严肃,两者之间存在一定矛盾。针对此难点有两点建议:第一,建议大模型与小模型搭配,运用行业专业领域数据结合...……更多
...切入口。AI时代,是触手可及的未来,还是望山跑死马的幻觉?未来的问题,要回到现实寻找答案。比预想中更快的,是大模型的整体竞争,已经走向应用与落地的新赛段。我们需要找到一个链接现实与数字世界的载体,作为未...……更多
苹果的封闭生态为大模型打开!发布开源多模态大模型、每天为 AI 烧百万美元,零碎的 Android 生态打得过吗?
...了空间感知的负样本挖掘,进一步提高了模型的健壮性。幻觉问题团队也观察到了多模态大模型在回答是 / 否类问题时,往往表现出产生“幻觉”。对此,团队通过图像条件类别定位以及语义条件类别定位两种方式进行负样本挖...……更多
采用MoE大模型,清华创业团队医者AI构建健康管理Agent
...果仅用传统大模型如微调大模型、行业大模型等又会面临幻觉问题、长期记忆缺失问题、小样本训练不足等问题。为了解决这个现状,医者团队采用自研MoE架构大模型。通过混合架构,将大模型与全科医生AI、专科专家AI、运动...……更多
更多关于科技的资讯:
比饮料贵的冰杯走上冷柜C位
“农夫山泉居然出冰杯了”,社交媒体上的一篇爆款文章,揭开了冰杯行业的神秘面纱。近日,北京商报记者走访发现,以罗森便利店为主要铺货点
2024-06-26 00:47:00
麻六记开超市 主打酸辣粉
麻六记开了家专属“超市”。近日,麻六记在三里屯开出了一家具有体验功能的“超市”,店内大部分是麻六记自有产品,酸辣粉仍是招牌
2024-06-26 00:47:00
6月24日-26日,雄安网络安全技术应用大赛决赛在雄安新区中电建·雄安印象举行,河北省委网信办网络安全协调处处长冯丽平介绍大赛情况及亮点。文字:张培培拍摄:刘明哲制作:冯钰娇
2024-06-26 01:31:00
本文转自:北京日报本报讯(记者 孙奇茹)昨天,据OpenAI官方公布的信息,自7月9日起,OpenAI将开始阻止来自非支持国家和地区的API(应用程序编程接口)流量
2024-06-26 03:36:00
本文转自:北京日报本报讯(记者 朱松梅)位于朝阳区将台乡的星地中心是本市唯一的互联网3.0产业园,昨天,一场“互联网3
2024-06-26 03:35:00
本文转自:学习时报申珅 健康产业是一种有巨大市场潜力的新兴产业,涉及医药产品、保健用品、营养食品、医疗器械等多个领域,被称为“财富第五波”
2024-06-26 03:31:00
再一次用成功向祖国报告
本文转自:光明日报再一次用成功向祖国报告——航天科技集团五院嫦娥团队攻关纪实作者:本报记者 张 蕾 本报通讯员 张国航《光明日报》( 2024年06月26日 08版)6月25日14时7分
2024-06-26 04:36:00
微星新款rtx4070tisuperog显卡上线
6月25日消息,博主@wxnod 发现了微星新款RTX4070TiSUPER16GVENTUS3XBLACKOC黑色版万图师显卡的配置信息表
2024-06-26 01:08:00
索尼zv-e10相机有望7月10日发布,支持全新的AI技术
6月24日消息,据外媒SonyAlphaRumors消息,已经得到“两个消息源”确认,索尼ZV-E10II相机有望于7月10日发布
2024-06-26 01:26:00
amd锐龙ai9hx370跑分再次刷新
6月25日消息,随着上市临近,AMD锐龙AI9HX370“StrixPoint”移动处理器的 Geekbench跑分成绩再一次被刷新
2024-06-26 01:11:00
丰田宣布开放雷克萨斯充电站,效仿特斯拉
6月25日消息,尽管丰田向纯电动汽车转型的步伐缓慢,但似乎正在向行业巨头特斯拉取经。丰田宣布将旗下豪华品牌雷克萨斯充电站向日本所有电动汽车开放
2024-06-26 01:17:00
vivot3lite6月27日发布,搭载天玑6300处理器
据外媒报道,vivo即将在印度推出其新款智能手机vivoT3Lite,该机型定于印度当地时间6月27日中午12点正式发布
2024-06-26 00:47:00
真我gt6手机后盖线稿图曝光:将于7月发布
6月25日消息,博主@数码闲聊站 今日爆料真我GT6手机的后盖线稿图,该手机昨日官宣将于7月发布。据介绍,真我GT6手机采用左上角小矩阵相机Deco装饰设计
2024-06-26 01:50:00
谷歌为安卓版chrome浏览器测试“数字证书api”
6月25日消息,谷歌正为安卓版Chrome浏览器测试“数字证书API”(DigitalCredentialAPI),让网站安全地请求存储在手机钱包中的身份信息(如驾照和护照)
2024-06-26 01:59:00
《幻兽帕鲁》将移植到任天堂switch主机平台
6月25日消息,《幻兽帕鲁》的开发商Pocketpair公司CEOTakuroMizobe表示,将该作移植到任天堂Switch主机平台可能存在技术层面的困难
2024-06-26 02:10:00