• 我的订阅
  • 头条热搜
全球几十种大模型评测,如何甄别可信度?
图片来自视觉中国蓝鲸新闻12月20日讯(记者 武静静)要衡量一个大模型能力是否够强,评测是最直接的维度。大模型评测就是为大模型的一场“考试”,从不同大模型的表现中,不仅可以衡量现有技术水平,还能帮助识别大模...……更多
...划系统化的评测体系,希望借此支撑更全面地提升大模型可信度,其中,内容生成安全、数据安全、合乎伦理等都是重点关注的问题。这是我们目前看到的星星之火。以下是对话部分(经编辑):36氪:大模型席卷半年,看似已...……更多
2024WAIC热议大模型助力产业新趋势,可信应用成焦点
...求。那么,该如何确保大模型在应用落地过程中的安全和可信度呢?「大模型落地的最后一公里,需要一个系统化的方法论来保障大模型应用侧落地过程中的可信。」中国信息通信研究院人工智能研究所所长魏凯在论坛上强调。...……更多
...也面临多重挑战。首先是数据问题。测评结果的准确性和可信度,依赖于高质量、多样化的数据集。然而,数据孤岛和数据泄露问题限制了评测的深度和广度。此外,缺乏统一的评测标准,也让不同机构的评测结果缺乏可比性。...……更多
AI潮起 共筑数智之基
...大模型无法胜任结构化数据处理的产业共性难题。在安全可信度方面,九天基础大模型是通过国家“生成式人工智能服务备案”和“境内深度合成服务算法备案”双备案的首个央企研发大模型,并获得中国软件测评中心安全测评...……更多
清华领衔发布多模态评估MultiTrust:GPT-4可信度有几何?
...,首次从多个维度和视角全面评估了主流多模态大模型的可信度,展示了其中多个潜在安全风险,启发多模态大模型的下一步发展。论文标题:Benchmarking Trustworthiness of Multimodal Large Language Models: A Comprehensive St……更多
...业自律公约,规范市场经营秩序,增强大模型的透明度和可信度,为大模型的发展培育健康肥沃的土壤。中关村科金技术副总裁张杰认为,知识大模型是企业引入大模型的最佳切入点,也是新时代下必需的新兴基础设施。在此次...……更多
人工智能安全可信护航计划启动
...安全可信管理解决方案,指导行业单位开展人工智能安全可信度自评估,推动行业自律,形成重视人工智能安全可信的良好氛围,并在行业实践探索的基础上,为有关部门提供决策参考。了解到,经前期招募,截止2月10日,已有...……更多
外媒称Switch2真机爆料可信度高!油管惊现Switch2模型上手视频
不久以前一位名为NextHandheld的用户声称获得了一台零售版Switch 2主机,并确认其名称为“Nintendo Switch 2”,表示将会在圣诞节发布证据。外媒theverge发文,称自己已经和NextHandheld进行交谈,基本上可以确定他的话为真。“我看到...……更多
人工智能应用场景不断拓展
...业界的广泛沟通联动,用模型开源等方式提升其透明度与可信度。 ……更多
智慧芽发布AI助手“芽仔-生物医药”,大模型革新信息检索模式
...数据集保障了”芽仔-生物医药”为用户提供一站式、高可信度的数据查询与回答。评测结果显示,“智慧芽生物医药大模型”达到了通过中国执业药师职业资格考试、美国注册药剂师考试(NAPLEX)的水平,并在考试能力、机器...……更多
...可信方面,创新网络模型可信架构,增强模型可解释性和可信度;在可用方面,提供成熟可用的大模型行业落地方案、轻量化部署工具、原生应用框架和软硬一体智能平台,降低使用门槛。该产品可提供意图识别、多轮问答、知...……更多
OpenAI o1模型到博士水平了?复旦教授:没有真正推理能力,学到的还是概率相关性
...试图操纵用户,以及为 AI决策提供解释性,增加透明度和可信度。OpenAI总裁Greg Brockman也提到,这提供了新的安全机会,公司正在积极探索,包括可靠性、幻觉和对抗攻击者的鲁棒性。“在权衡了用户体验、竞争优势、思维链监...……更多
IBM,通用大模型商用“保守主义者”
...M watsonx,IBM可以根据企业客户的具体需求定制更具效能和可信度的AI工具以及相应的硬软件、数据服务。“坦率地讲,我不认为已经进入了用一个大模型打造一两个产品的阶段。我认为企业可能在很长时间都处于探索大模型能力...……更多
科学家的当务之急提高AI系统可信度
...利分校教授迈克尔·乔丹:科学家的当务之急提高AI系统可信度俞陶然乔丹在演讲中展示的数学公式能提高人工智能系统的可信度。 ■在讨论人工智能的负面影响时,不必聚焦毁灭性风险,因为那属于科幻小说和电影。对科学家...……更多
...,提高其泛化能力和可解释性,同时关注模型的可靠性和可信度。“此外,在应用垂直大模型时,应保护用户隐私和权益。还需要不断进行技术创新和优化,持续关注技术发展和应用所带来的挑战。”朱克力说。 ……更多
...险的必要性,并强调了纠正现有气候模型偏差以增加预测可信度的重要性。(完)【编辑:管娜】 ……更多
...程构建安全专家思维链,并使用检索增强、知识图谱提升可信度和专业度,为用户提供具备可落地的安全检测、研判能力。另一方面,持续加强技术研究与创新,从构建可信任的安全智能生态出发,逐步构建“大模型+小模型”...……更多
新华社联合北大发布AI大模型评测:安全可靠成重点,360智脑表现优异
...0已推出企业级AI大模型解决方案,将遵循“安全、向善、可信、可控”四原则打造企业级垂直大模型,目前已经为20个行业提供解决方案。报告同时提到“安全可靠的大模型产品应用正成为深耕方向”。据了解,大模型目前主要...……更多
外媒The Verge称已验证Switch 2真机:可信度很高
我们此前曾报道过Reddit论坛网友“NextHandheld”声称自己已经拿到Switch 2真机的新闻,现在外媒The Verge联系了网友“NextHandheld”,并对其所说的Switch 2真机进行了验证,最终得出结论:基本确定“NextHandheld”的泄露为真。据悉,The ..……更多
正式发布|绿盟AI大模型风险评估工具
... ★精准化基础能力评估,提升模型安全防御评估结果可信度 基于专业的阅读理解测试题数据集及各学科能力测试题数据集综合评估模型基础能力,检测模型自然语言理解能力,生成,指令跟随等能力,充分了解模型自身基...……更多
国产大模型首发中文逻辑推理,「天工大模型4.0」o1版来了
...模型能不能在常识推理层面接近人类水平,是提高其自身可信度、增强决策能力、拓展多领域应用的重要指标之一。Skywork o1 Lite 和 Preview 在这点上都表现不错。比如长度(英寸、厘米、码)与质量单位(公斤)的区分。比如盐...……更多
AI安全守护计划启动!信通院牵头,AIIA安全治理委员会发布三类模型安全评测
...”,包括建立威胁信息共享机制、开展AIGC真实内容来源可信工作、建立AI保险机制等。 一、成立半年近百家单位,形成安全、治理两大工作组AIIA安全治理委员会成立于2023年12月底,经过半年的运营,组织架构现有治理组、安全...……更多
金融科技公司激战大模型
...降低金融机构运营成本、提高运行效率,但在成本投入、可信度挑战等多个难点之下,金融大模型要大范围落地,仍有较远距离。涉猎营销、客服等多场景金融天然是数据密集型、技术密集型行业,但面对的挑战很多,例如银行...……更多
...用,可能生成“编造”的内容,直接影响金融分析结果的可信度。一旦AI大模型产生不准确的结果,目前也很难分清到底是算法技术不可靠,还是提供的底层数据不可信,这就使责任难以明确,可能造成金融业不同部门间的信任...……更多
将偏好学习引入模型训练,北大李戈团队提出代码生成优化新框架
...的代码片段通过,它的自验证得分就会越高;通过越多高可信度测试用例的代码片段,其自验证得分也越高。自验证得分的更新公式如下:其中,d为阻尼因子,Link(c,t)表示代码片段c是否通过测试用例t。经过多次迭代后,评分逐...……更多
...好机会。“当然,这里边有很大的创新要求,在金融上对可信度、精准度要求是很高的。”据悉,未来五年,生成式AI在金融领域的应用,将成为度小满最重要的战略方向。2023年5月份,度小满开源了国内首个金融行业大模型,...……更多
人工智能的“胡言乱语”,有没有解法?
...容、引用来源或陈述。这些错误的内容以一种有说服力和可信度的方式被呈现出来,使人们在没有仔细核查和事实验证的情况下很难分辨出其中的虚假信息。AI幻觉可以分为两类:内在幻觉(Intrinsic Hallucination)和外在幻觉(Extri...……更多
2023金融大模型报告|重塑金融科技
...模型评估与关键责任划分,系统性优化大模型内容的生成可信度。此外,如何挖掘更多金融行业内的大模型应用场景,并为之匹配合适的落地方案,仍然是大模型探索中的一个重大挑战。在金融科技行业复杂的工作链条中,每个...……更多
京东云曹鹏:AI变革之下,大模型技术如何为企业未来赋能?
...;以及强化数据安全与隐私保护,确保企业大模型服务的可信度和可靠性。与此同时,京东自身也在深入思考如何将大模型与业务结合,创造价值。曹鹏表示,京东拥有复杂的业务场景和多样化的业务需求,这为大模型的应用提...……更多
更多关于科技的资讯:
在制造业提质增效的浪潮中,那些藏在生产环节里的“细枝末节”,往往藏着撬动效益升级的关键密码。近日,太重包储分公司的散件箱优化项目传来捷报
2025-09-24 07:52:00
被3000亿资金哄抢的创新药企,上市首日暴涨110%
文|胡香赟编辑|海若镜港股迎来今年第11家上市的创新药公司。9月19日,劲方医药在港交所挂牌,首日涨幅接近110%、市值逼近150亿
2025-09-24 06:26:00
2025北京文化论坛“虚实无界:视听产业融合破圈”平行论坛举办
中国青年报客户端北京9月23日电(中青报·中青网记者 沈杰群)今天,2025北京文化论坛平行论坛——“虚实无界:视听产业融合破圈”在北京国际饭店会议中心举行
2025-09-24 00:03:00
中信银行南京分行成功举办“小天元”企业生态服务平台江苏区域发布会
9月22日下午,在百余家江苏企业代表的共同见证下,中信银行“小天元”企业生态服务平台江苏区域发布会暨“进万企 信服惠企”系列活动在南京成功举办
2025-09-23 23:15:00
聚焦京津冀协同发展|一个平台,推动黄骅模具迈向高端
北京市科学技术委员会牵头,京冀相关单位共建智能模具科技成果转化中试平台一个平台,推动黄骅模具迈向高端9月11日,智能模具科技成果转化中试平台工作人员正在操作四轴机床进行生产
2025-09-23 08:49:00
AI赋能千行百业一线故事(十二):数智化转型,让电厂越来越智慧
数智化转型,让电厂越来越智慧——AI赋能千行百业一线故事(十二)8月28日,石家庄良村热电有限公司生产技术部专业主管苏朝宏介绍智慧展厅
2025-09-23 08:53:00
“产业炬光灯”系列短视频首期聚焦中材航特
“产业炬光灯”系列短视频于厦门日报官方视频号、抖音号、快手号、B站账号、央视频账号等全媒体平台同步上线,首期节目走进中材航特
2025-09-23 08:58:00
厦门网讯(厦门日报记者 林雯)旧低效工业用地加速变身科创高地。近日,随着位于思明区前埔片区的2025P13、2025P14地块成功出让
2025-09-23 08:58:00
国网厦门供电公司持续推进“EASIER用电”品牌建设
国网厦门供电公司为厦门天马微电子有限公司创造更优质、更稳定的用电环境。(国网厦门供电公司 供图)“EASIER用电”品牌厦门网讯(厦门日报记者 刘艳 通讯员 林艳婷 高芳 郭芷祎)近年来
2025-09-23 08:58:00
山东移动泰安分公司数智融合加速 赋能企业蝶变升级
鲁网9月22日讯数字化浪潮正在席卷千行百业,山东移动泰安分公司(简称:泰安移动)以“技术赋能、生态协同、梯次服务”为核心
2025-09-23 10:01:00
企鹅网络(Q学友)与腾讯云达成战略合作,携手共创“AI+职业教培”新范式
9月16日-17日,2025腾讯全球数字生态大会在深圳举办。大会期间,深圳市企鹅网络科技有限公司(以下简称“企鹅网络”)与腾讯云正式签署战略合作协议
2025-09-23 10:39:00
本报记者 赵 曦 □ 花沁昕“白天的时间都用于工作和社交,只有夜晚的时间才真正属于自己,我舍不得睡,但真想睡的时候又睡不着了
2025-09-23 10:48:00
科学为基,爱心为桥:儿童营养品牌inne携手德甲冠军俱乐部启动全球公益计划
在全民健康意识提高与消费升级的双重驱动下,新一代父母对儿童营养的重视程度前所未有。消费需求愈发细分、专业,推动儿童营养品行业从“标准化供给”向“专业化服务”转变
2025-09-23 11:20:00
《金刚狼》《权游》供应商分拆机器人数据业务,腾讯、字节大牛加入 | 智能涌现独家
文|邱晓芬编辑|苏建勋2023年底,全球出货量最大的动作捕捉设备提供商"诺亦腾(Noitom)"联合创始人戴若犁,一度以为自己被骗了
2025-09-23 20:47:00
近8成职场人每周都会使用AI工具 通用对话型AI占比最高
在人工智能技术日臻成熟的2025年,AI已不再是科幻概念或实验室产物,而是深度融入职场生态的“数字同事”。从“工具”走向“伙伴”
2025-09-23 11:37:00