• 我的订阅
  • 头条热搜
全球几十种大模型评测,如何甄别可信度?
图片来自视觉中国蓝鲸新闻12月20日讯(记者 武静静)要衡量一个大模型能力是否够强,评测是最直接的维度。大模型评测就是为大模型的一场“考试”,从不同大模型的表现中,不仅可以衡量现有技术水平,还能帮助识别大模...……更多
...划系统化的评测体系,希望借此支撑更全面地提升大模型可信度,其中,内容生成安全、数据安全、合乎伦理等都是重点关注的问题。这是我们目前看到的星星之火。以下是对话部分(经编辑):36氪:大模型席卷半年,看似已...……更多
2024WAIC热议大模型助力产业新趋势,可信应用成焦点
...求。那么,该如何确保大模型在应用落地过程中的安全和可信度呢?「大模型落地的最后一公里,需要一个系统化的方法论来保障大模型应用侧落地过程中的可信。」中国信息通信研究院人工智能研究所所长魏凯在论坛上强调。...……更多
...也面临多重挑战。首先是数据问题。测评结果的准确性和可信度,依赖于高质量、多样化的数据集。然而,数据孤岛和数据泄露问题限制了评测的深度和广度。此外,缺乏统一的评测标准,也让不同机构的评测结果缺乏可比性。...……更多
AI潮起 共筑数智之基
...大模型无法胜任结构化数据处理的产业共性难题。在安全可信度方面,九天基础大模型是通过国家“生成式人工智能服务备案”和“境内深度合成服务算法备案”双备案的首个央企研发大模型,并获得中国软件测评中心安全测评...……更多
清华领衔发布多模态评估MultiTrust:GPT-4可信度有几何?
...,首次从多个维度和视角全面评估了主流多模态大模型的可信度,展示了其中多个潜在安全风险,启发多模态大模型的下一步发展。论文标题:Benchmarking Trustworthiness of Multimodal Large Language Models: A Comprehensive St……更多
...业自律公约,规范市场经营秩序,增强大模型的透明度和可信度,为大模型的发展培育健康肥沃的土壤。中关村科金技术副总裁张杰认为,知识大模型是企业引入大模型的最佳切入点,也是新时代下必需的新兴基础设施。在此次...……更多
人工智能安全可信护航计划启动
...安全可信管理解决方案,指导行业单位开展人工智能安全可信度自评估,推动行业自律,形成重视人工智能安全可信的良好氛围,并在行业实践探索的基础上,为有关部门提供决策参考。了解到,经前期招募,截止2月10日,已有...……更多
外媒称Switch2真机爆料可信度高!油管惊现Switch2模型上手视频
不久以前一位名为NextHandheld的用户声称获得了一台零售版Switch 2主机,并确认其名称为“Nintendo Switch 2”,表示将会在圣诞节发布证据。外媒theverge发文,称自己已经和NextHandheld进行交谈,基本上可以确定他的话为真。“我看到...……更多
人工智能应用场景不断拓展
...业界的广泛沟通联动,用模型开源等方式提升其透明度与可信度。 ……更多
智慧芽发布AI助手“芽仔-生物医药”,大模型革新信息检索模式
...数据集保障了”芽仔-生物医药”为用户提供一站式、高可信度的数据查询与回答。评测结果显示,“智慧芽生物医药大模型”达到了通过中国执业药师职业资格考试、美国注册药剂师考试(NAPLEX)的水平,并在考试能力、机器...……更多
...可信方面,创新网络模型可信架构,增强模型可解释性和可信度;在可用方面,提供成熟可用的大模型行业落地方案、轻量化部署工具、原生应用框架和软硬一体智能平台,降低使用门槛。该产品可提供意图识别、多轮问答、知...……更多
OpenAI o1模型到博士水平了?复旦教授:没有真正推理能力,学到的还是概率相关性
...试图操纵用户,以及为 AI决策提供解释性,增加透明度和可信度。OpenAI总裁Greg Brockman也提到,这提供了新的安全机会,公司正在积极探索,包括可靠性、幻觉和对抗攻击者的鲁棒性。“在权衡了用户体验、竞争优势、思维链监...……更多
IBM,通用大模型商用“保守主义者”
...M watsonx,IBM可以根据企业客户的具体需求定制更具效能和可信度的AI工具以及相应的硬软件、数据服务。“坦率地讲,我不认为已经进入了用一个大模型打造一两个产品的阶段。我认为企业可能在很长时间都处于探索大模型能力...……更多
科学家的当务之急提高AI系统可信度
...利分校教授迈克尔·乔丹:科学家的当务之急提高AI系统可信度俞陶然乔丹在演讲中展示的数学公式能提高人工智能系统的可信度。 ■在讨论人工智能的负面影响时,不必聚焦毁灭性风险,因为那属于科幻小说和电影。对科学家...……更多
...,提高其泛化能力和可解释性,同时关注模型的可靠性和可信度。“此外,在应用垂直大模型时,应保护用户隐私和权益。还需要不断进行技术创新和优化,持续关注技术发展和应用所带来的挑战。”朱克力说。 ……更多
...险的必要性,并强调了纠正现有气候模型偏差以增加预测可信度的重要性。(完)【编辑:管娜】 ……更多
...程构建安全专家思维链,并使用检索增强、知识图谱提升可信度和专业度,为用户提供具备可落地的安全检测、研判能力。另一方面,持续加强技术研究与创新,从构建可信任的安全智能生态出发,逐步构建“大模型+小模型”...……更多
新华社联合北大发布AI大模型评测:安全可靠成重点,360智脑表现优异
...0已推出企业级AI大模型解决方案,将遵循“安全、向善、可信、可控”四原则打造企业级垂直大模型,目前已经为20个行业提供解决方案。报告同时提到“安全可靠的大模型产品应用正成为深耕方向”。据了解,大模型目前主要...……更多
外媒The Verge称已验证Switch 2真机:可信度很高
我们此前曾报道过Reddit论坛网友“NextHandheld”声称自己已经拿到Switch 2真机的新闻,现在外媒The Verge联系了网友“NextHandheld”,并对其所说的Switch 2真机进行了验证,最终得出结论:基本确定“NextHandheld”的泄露为真。据悉,The ..……更多
正式发布|绿盟AI大模型风险评估工具
... ★精准化基础能力评估,提升模型安全防御评估结果可信度 基于专业的阅读理解测试题数据集及各学科能力测试题数据集综合评估模型基础能力,检测模型自然语言理解能力,生成,指令跟随等能力,充分了解模型自身基...……更多
国产大模型首发中文逻辑推理,「天工大模型4.0」o1版来了
...模型能不能在常识推理层面接近人类水平,是提高其自身可信度、增强决策能力、拓展多领域应用的重要指标之一。Skywork o1 Lite 和 Preview 在这点上都表现不错。比如长度(英寸、厘米、码)与质量单位(公斤)的区分。比如盐...……更多
AI安全守护计划启动!信通院牵头,AIIA安全治理委员会发布三类模型安全评测
...”,包括建立威胁信息共享机制、开展AIGC真实内容来源可信工作、建立AI保险机制等。 一、成立半年近百家单位,形成安全、治理两大工作组AIIA安全治理委员会成立于2023年12月底,经过半年的运营,组织架构现有治理组、安全...……更多
金融科技公司激战大模型
...降低金融机构运营成本、提高运行效率,但在成本投入、可信度挑战等多个难点之下,金融大模型要大范围落地,仍有较远距离。涉猎营销、客服等多场景金融天然是数据密集型、技术密集型行业,但面对的挑战很多,例如银行...……更多
...用,可能生成“编造”的内容,直接影响金融分析结果的可信度。一旦AI大模型产生不准确的结果,目前也很难分清到底是算法技术不可靠,还是提供的底层数据不可信,这就使责任难以明确,可能造成金融业不同部门间的信任...……更多
将偏好学习引入模型训练,北大李戈团队提出代码生成优化新框架
...的代码片段通过,它的自验证得分就会越高;通过越多高可信度测试用例的代码片段,其自验证得分也越高。自验证得分的更新公式如下:其中,d为阻尼因子,Link(c,t)表示代码片段c是否通过测试用例t。经过多次迭代后,评分逐...……更多
...好机会。“当然,这里边有很大的创新要求,在金融上对可信度、精准度要求是很高的。”据悉,未来五年,生成式AI在金融领域的应用,将成为度小满最重要的战略方向。2023年5月份,度小满开源了国内首个金融行业大模型,...……更多
人工智能的“胡言乱语”,有没有解法?
...容、引用来源或陈述。这些错误的内容以一种有说服力和可信度的方式被呈现出来,使人们在没有仔细核查和事实验证的情况下很难分辨出其中的虚假信息。AI幻觉可以分为两类:内在幻觉(Intrinsic Hallucination)和外在幻觉(Extri...……更多
2023金融大模型报告|重塑金融科技
...模型评估与关键责任划分,系统性优化大模型内容的生成可信度。此外,如何挖掘更多金融行业内的大模型应用场景,并为之匹配合适的落地方案,仍然是大模型探索中的一个重大挑战。在金融科技行业复杂的工作链条中,每个...……更多
京东云曹鹏:AI变革之下,大模型技术如何为企业未来赋能?
...;以及强化数据安全与隐私保护,确保企业大模型服务的可信度和可靠性。与此同时,京东自身也在深入思考如何将大模型与业务结合,创造价值。曹鹏表示,京东拥有复杂的业务场景和多样化的业务需求,这为大模型的应用提...……更多
更多关于科技的资讯:
厦门网讯 (厦门日报记者 薛尧) “品牌金饰每克突破1100元,自己买工具打首饰能省近一半!”近日,受国际金价持续震荡
2025-10-25 08:13:00
南报网讯(记者何洁)10月22日至24日,由《自然》系列期刊编辑部和南京大学及中国生物物理学会联合主办的首届“人工智能生物学”国际学术会议在南京举行
2025-10-25 08:53:00
近日,胜利石油工程公司管具技术服务中心井控装置试压泵保压阀成功实现部件自主化维修,彻底改变以往依赖外部采购的被动局面。这次突破
2025-10-25 09:27:00
春雪食品斩获IDC未来企业大奖
近日,第十届IDC中国CIO峰会在上海落幕。莱阳春雪食品集团以数字化重塑全产业链的硬核实践,荣获“IDC未来企业大奖-卓越奖”
2025-10-25 12:55:00
AI搜索流量占比突破45%的2025年,头部GEO服务商正以技术代差重塑市场格局,这份基于1200+企业实战数据的白皮书
2025-10-25 14:27:00
抗衰冻龄选对成分是关键!2025全球五大麦角硫因品牌深度测评&选购指南
衰老的本质是细胞层面的多维损伤叠加 —— 自由基氧化、线粒体功能衰退、DNA 修复能力下降等机制相互交织,单一成分干预早已无法满足科学抗衰需求
2025-10-25 14:29:00
深耕眼科近30载,菏泽摘镜“标杆”王丽霞院长解说全飞秒4.0
通讯员 任兆潘在菏泽近视矫正领域,王丽霞院长的名字早已成为 “专业” 与 “放心” 的代名词。作为菏泽华厦眼科医院业务副院长
2025-10-25 14:39:00
“赞上合、聚天马,展风采,新体验”,2025天津马拉松将于10月26日鸣枪起跑。10月26日6:55至10:25,天津海河传媒中心《奔跑吧
2025-10-25 15:26:00
星光不负,码向未来 ———选择鸿蒙的800万种可能
摘要:每一位开发者都在用自己的方式点亮属于自己那颗星在这个追求效率的时代,技术的温度,正藏身于那些被巧妙化解的日常困境里
2025-10-25 15:44:00
同程旅行完成收购万达酒管,专业商旅平台成就“更高端”的出行体验
近日,同程旅行宣布完成对万达酒店管理公司的战略收购。这次收购远不止于简单的资源叠加,而是OTA乃至商旅服务生态的一次战略性升级
2025-10-25 15:45:00
可信数据空间新产品新服务新生态发布会在杭州中国数谷举行
2025年10月22日,“可信数据空间新产品·新服务·新生态发布会”在杭州中国数谷会议中心隆重举行。大会由北京燕元数联网络科技有限公司
2025-10-25 15:47:00
10月24日,我省首个脑机接口临床研究中心在山医大一院成立。山西医科大学将与清华海峡研究院协同创新中心在脑机接口这一前沿项目方面展开深入合作
2025-10-25 19:08:00
据第三方权威数据显示,2025年头部与尾部GEO服务商的效果差距已达430%,而企业更换服务商的平均成本高达首年投入的150%
2025-10-25 21:10:00
中山路地标\
印有MINISO LAND品牌标识的围挡。厦门网讯(厦门日报记者 沈彦彦)在厦门本岛中山路西段核心区域,一块印满时尚IP(原意为知识产权
2025-10-26 08:59:00
“宁创新品”南京市应用场景观摩会上机器人水上“秀花活”“水上漂”快速救援,“水下侦察兵”全方位勘察□南京日报/紫金山新闻记者徐宁实习生黄倩“水上漂”以最快每秒6米的速度在水面上飞驰
2025-10-26 10:31:00