• 我的订阅
  • 头条热搜
国内首个官方“大模型标准符合性评测”公布
...工智能分委会全体会议期间,国内首个官方“大模型标准符合性评测”结果公布,腾讯混元大模型、阿里通义千问等大模型成为首批通过评测的四款国产大模型的其中之二。据介绍,“大模型标准符合性评测”由中国电子技术标...……更多
AI大模型“国标”首批测试结果公布,人工智能成市场新焦点
12月22日,国内首个官方“大模型标准符合性评测”结果公布,百度文心一言、腾讯混元大模型、360智脑、阿里云通义千问四款国产大模型首批通过测试。测试结果称,上述四款模型符合《人工智能大规模预训练模型第2部分:评...……更多
国家大模型标准测试结果公布 首批仅四家企业产品通过
12月23日,国内首个官方“大模型标准符合性评测”结果公布,首批360集团、百度、腾讯、阿里四家企业大模型产品通过。该测试由工信部中国电子技术标准化研究院(简称“工信部电子标准院”)发起,评测围绕多领域多维度...……更多
百度文心大模型调用量居国内首位
...工智能分委会全体会议期间,国内首个官方“大模型标准符合性评测”结果公布。百度智能云官方今日宣布,百度文心大模型首批通过大模型标准符合性测试。除此之外,首批通过测试的产品还包括腾讯混元大模型、阿里通义千...……更多
360智脑成全国首个原生安全的大模型产品之一
...有限公司今天宣布,12月22日国内首个官方“大模型标准符合性测试”结果公布,360智脑成为首批通过的大模型产品之一。据介绍,360智脑是全国首个原生安全的大模型,官方声称其拥有自研千亿参数规模,核心能力位居国内第...……更多
腾讯混元文生图大模型升级并对外开源
...GPU。▲配置要求据此前报道,国内首个官方“大模型标准符合性评测”结果公布,腾讯混元大模型、成为首批通过评测的国产大模型,首批通过的大模型还有阿里通义千问、360智脑和百度文心一言。 ……更多
腾讯自研混元大模型亮相,将通过腾讯云对外开放
...通院《大规模预训练模型技术和应用的评估方法》的标准符合性测试中,混元大模型共测评66个能力项,在“模型开发”和“模型能力”两个重要领域的综合评价均获得了当前的最高分。在主流的评测集MMLU、CEval和AGI-eval上,混...……更多
中关村科金1+N新品系列亮相,为企业打造大模型强人工智能应用
...了解,作为首批通过中国信通院组织的可信AI大模型标准符合性验证的对话式AI企业,中关村科金企业知识大模型在模块验证获得4+级评分。该模型具备全面的语义、语音、视觉等基础能力,在5个能力域、46个能力项评测中准确度...……更多
全模态对齐框架align-anything来啦:实现跨模态指令跟随
...精细化偏好标注:基于标注指令跟随、美学性、客观原则符合性、清晰度等多个细粒度原则进行标注,提供复杂精细化偏好标注。 自然语言语言反馈:提供细粒度批评和润色反馈,可利用此自然语言反馈开发算法及提升模型性...……更多
多模态模型评测框架lmms-eval发布!全面覆盖,低成本,零污染
...稿邮箱:liyazhou@jiqizhixin.com;zhaoyunfeng@jiqizhixin.com随着大模型研究的深入,如何将其推广到更多的模态上已经成为了学术界和产业界的热点。最近发布的闭源大模型如 GPT-4o、Claude 3.5 等都已经具备了超强的图像理解能力,LLaVA-……更多
智源评测体系发布 国内外“百模”评估结果出炉
5月17日,智源研究院举办大模型评测发布会,正式推出智源评测体系,发布并解读国内外140余个开源和商业闭源的语言及多模态大模型全方位能力评测结果。本次智源评测,分别从主观、客观两个维度考察了语言模型的简单理...……更多
...托系列标准,为多家技术厂商提供医疗健康大模型的能力符合性验证,持续完善评价细则,提升标准实用性和适用性,助力行业大模型规范化、集约化发展。2024年6月起,中国信通院选取GPT4、GPT-4O等国外通用大模型,文心一言、...……更多
海尔智家首届下沉丰收节收官业绩突出
...;而成果方面,海尔智家HomeGPT获得 “可信AI”大模型标准符合性验证最高等级的“4+级”评价,成为首个获得行业权威评估的智慧家庭领域专业模型。据了解,对于HomeGPT的标准符合性验证非常严格,包含7个维度、20余个能力域及4...……更多
...科学院自动化研究所等研究机构发布了国内首部中医药大模型评测团体标准。中医药大模型评测标准覆盖场景丰富度、能力支持度、应用成熟度3大能力域。针对中医药大模型技术适配性、功能实现能力和实际应用价值3个维度进...……更多
全球几十种大模型评测,如何甄别可信度?
...觉中国蓝鲸新闻12月20日讯(记者 武静静)要衡量一个大模型能力是否够强,评测是最直接的维度。大模型评测就是为大模型的一场“考试”,从不同大模型的表现中,不仅可以衡量现有技术水平,还能帮助识别大模型存在的问...……更多
《金融大模型应用评测指南》发布,系全国首个以金融业务能力...
...发布全国首个以金融业务能力为核心的团体标准《金融大模型应用评测指南》,上海库帕思科技有限公司发布多维度金融大模型评测数据集(2024版)。 《金融大模型应用评测指南》,以金融业务为核心,以金融机构模型应用为...……更多
大模型下场,360智慧生活智助三百六十行
...?答案是肯定的。12月22日,全国首个官方“大模型标准符合性测试”结果公布,包括360、百度、阿里和腾讯4家大厂的自研大模型首批通过国家大模型标准测试,拿到了“国家认证”。360智慧生活集团是国内诸多安防企业中率先...……更多
媲美OpenAI事实性基准,这个中文评测集让o1-preview刚刚及格
...和顶尖的技术人才,成立未来生活实验室。实验室聚焦大模型、多模态等 AI 技术方向,致力于打造大模型相关基础算法、模型能力和各类 AI Native 应用,引领 AI 在生活消费领域的技术创新。如何解决模型生成幻觉一直是人工智...……更多
2024年下半年可信开源最新评估结果公布
...件产品通过开源合规能力评估;2个系统平台通过SOSS标准符合性测试;2个平台工具通过可信开源治理工具(SCA)评估;1个工具通过了开源代码库能力评估;2个社区通过了可信开源社区评估;1个社区完成了可信开源社区-OpenChain...……更多
2024快手磁力大会在重庆召开
...转化、更佳的体验和更长效的经营价值,快手还运用AI大模型等智能化技术重塑生意经营全链路,在素材的生产、理解、分发和承接上,提供全链路解决方案,助力企业提升经营效率。快手高级副总裁、电商事业部兼商业化事业...……更多
发展新质生产力:新动作看杭州“聚焦点”
...州技术转移转化中心共同发布了国内首个成果转化领域大模型——“智者大模型1.0”。“‘智者大模型1.0’主要功能包括企业的智能画像、成果的智能化评价、供需的智能化匹配等。”杭州技术转移转化中心相关负责人介绍,其...……更多
中文大模型最新评测出炉:腾讯混元国内第一!
快科技8月5日消息,在最新发布的中文多模态大模型SuperCLUE-V基准评测中,腾讯混元大模型获国内排名第一,稳居卓越领导者象限。此次评测聚焦于大模型理解复杂现实世界的关键能力,即多模态理解,俗称“图生文”。多模态...……更多
新华社联合北大发布AI大模型评测:安全可靠成重点,360智脑表现优异
...新华社研究院中国企业发展研究中心发布的《人工智能大模型体验报告2.0》(以下简称“报告”)显示,当前中国大模型产品进步显著,360智脑、智谱ChatGLM等表现抢眼。其中360智脑大模型在基础能力等方面稳居大模型第一梯队...……更多
快手可灵 1.6 模型发布
...家 12 月 19 日消息,快手今日宣布视频生成推出可灵 1.6 模型,文本响应度、画面美感及运动合理性,均有明显提升,画面更稳定更生动,同时支持标准和高品质模式。特别是 1.6 图生视频的高品质模式,官方宣称“内部评测比 1....……更多
...果、微软,苹果推出Apple Intelligence AI系统等等。而在AI大模型方面,最主要事件则是OpenAI推出多模态大模型ChatGPT-4o,这一版本具有实时处理和生成文本、音频以及图像等多种模态的能力,被誉为技术上一个巨大突破。事实上,中...……更多
...试场。围绕人工智能伦理风险、数据安全风险、教学场景符合性、教育科学性和严谨性等方面,模拟真实场景开展测评,形成符合教育教学规律的智能教育通用评价标准,加快推动全市教育领域人工智能大模型的合规准入。在人...……更多
《openharmony设备统一互联技术标准》发布
...模型,新标准还包括接入与控制接口、投屏、文件分享、符合性测试规范等系列标准,为跨行业、跨厂商设备的互联提供统一的技术规范。这将有助于构建OpenHarmony物联网生态,实现设备间的无缝连接,并提供更流畅、更安全的...……更多
大模型用于采购评标,专业“证据链”驱动专家精准决策
...的客观信息(企业规模、资质、信誉、财务状况等)进行符合性比对,筛出“硬件”不符的投标方;资料缺失、内容前后不一致、不满足评标要求等,系统也都会“高亮”提示;此外,系统还能自动生成评标分析报告,标书合格...……更多
AI安全守护计划启动!信通院牵头,AIIA安全治理委员会发布三类模型安全评测
...治理框架、合规治理、赋能治理展开,安全组主要开展大模型安全、合规等研究及基准测试。今年6月,中国信通院依托该委员会发起“人工智能安全守护计划”,包括建立威胁信息共享机制、开展AIGC真实内容来源可信工作、建...……更多
港中文团队提出大模型元推理范式,革新大模型的评价体系
...院工作过一段时间。在 ChatGPT 面世以后,他意识到针对大模型的研究范式存在一定的不足,于是决定来到香港中文大学读博。图 | 曾忠燊(来源:曾忠燊)前不久,曾忠燊和所在团队提出一个全新评测范式。基于这一评测范式,...……更多
更多关于科技的资讯:
北京古稀老人赵大妈的遭遇令人揪心:她在网络交友中被骗子诱导,通过“云手机”参与所谓“股票投资”,近20万元养老钱最终血本无归
2025-08-13 21:05:00
聚焦心理服务新生态:灵动生活集团旗下幸福研习社亮相第十九届中国心理学家大会
2025年8月8-10日,第十九届中国心理学家大会于深圳盛大启幕。本届大会紧扣“此心安处是吾乡—中国社会心理服务的文化归根与范式突围”主题
2025-08-13 15:45:00
校企联动,智绘未来:哈尔滨工程大学深圳校友企业联盟探访博大数据前海智算中心
近日,哈尔滨工程大学深圳校友企业联盟代表团探访博大数据深圳前海智算中心,近20家来自同行业以及相关领域的校友企业代表齐聚于此
2025-08-13 13:51:00
(摘要:守护权益,“链”动责任)供应链不仅是一种资源配置关系,更是企业责任延伸的重要载体,员工的权益保障与企业可持续发展紧密相连
2025-08-13 13:52:00
平度:国内外市场齐发力 泡菜产业蓬勃发展
大众网记者 尚超 尹璐瑶 青岛报道近日,在平度经开区青岛农一食品有限公司的生产车间,工人们熟练地操作着各类设备,从蔬菜清洗
2025-08-13 09:27:00
近期,我国在海南商业航天发射场使用长征十二号运载火箭,成功将卫星互联网低轨07组卫星发射升空。7月30日,我国在海南商业航天发射场使用长征八号甲运载火箭
2025-08-13 10:12:00
9月10日至14日,2025年服贸会将在首钢园举办,电信、计算机和信息服务专题展(服贸会ICT展)作为科技领域“排头兵”
2025-08-13 10:42:00
中国网8月13日讯据国家安全部,“旧手机、旧电脑换菜刀、换不锈钢盆喽!”这与时俱进又略带夸张的吆喝,您是否也曾听过?一些闲置的“电子家当”留着无用
2025-08-13 10:02:00
下一款全民级AI应用,可能是个老熟人
这是技术革命时刻,也是超车巨头的机遇。2025年年中,两个看似无关的消息,形成了有趣的对照。首先是8月8日,OpenAI夏季发布会举行
2025-08-13 07:01:00
何以中国·和合共生 撰稿:杨春文拍摄:刘岩、阎金勇制作:李辉监制:李华楠协助单位:天津杨柳青画社
2025-08-13 08:06:00
我市两项目入选省级首批实践案例点数成“金”,公共数据“跑”起来南报网讯(通讯员玄数轩建数萱记者邓露洁卫凌云)近日,省数据局在全国率先组织开展江苏省公共数据“跑起来”场景县(市
2025-08-13 07:45:00
东北雨姐账号将于10月解封,解封后可继续直播带货,名下关联5家公司3家已注销
近日,曾因虚假宣传被处罚的网红“东北雨姐”在社交平台更新动态,引发公众对其复出的猜测。8月11日,本溪满族自治县互联网信息办公室工作人员回应称
2025-08-12 12:08:00
当全球经济寒风凛冽,消费者的钱包愈发收紧,一个来自中国的新名字,却在海外电商版图上掀起了一场低价风暴——TEMU。它像一把利刃
2025-08-12 13:00:00
倍益康理疗机器人亮相2025世界机器人大会,探索理疗机器人新发展
8月8日,2025世界机器人大会在北京经济技术开发区北人亦创国际会展中心隆重举行。大会以“让机器人更智慧,让具身体更智能”为主题
2025-08-12 13:06:00
红松APP正式上线行业首个适老化艺术能力认证服务
近日,红松APP官宣正式启动银发艺术培训认证服务,上线行业首个面向银发人群的“艺术能力水平认证系统”。该服务由中国艺术职业教育学会培训中心(下称“培训中心”)联合红松集团共同打造
2025-08-12 13:08:00