• 我的订阅
  • 头条热搜
国内首个官方“大模型标准符合性评测”公布
...工智能分委会全体会议期间,国内首个官方“大模型标准符合性评测”结果公布,腾讯混元大模型、阿里通义千问等大模型成为首批通过评测的四款国产大模型的其中之二。据介绍,“大模型标准符合性评测”由中国电子技术标...……更多
AI大模型“国标”首批测试结果公布,人工智能成市场新焦点
12月22日,国内首个官方“大模型标准符合性评测”结果公布,百度文心一言、腾讯混元大模型、360智脑、阿里云通义千问四款国产大模型首批通过测试。测试结果称,上述四款模型符合《人工智能大规模预训练模型第2部分:评...……更多
国家大模型标准测试结果公布 首批仅四家企业产品通过
12月23日,国内首个官方“大模型标准符合性评测”结果公布,首批360集团、百度、腾讯、阿里四家企业大模型产品通过。该测试由工信部中国电子技术标准化研究院(简称“工信部电子标准院”)发起,评测围绕多领域多维度...……更多
百度文心大模型调用量居国内首位
...工智能分委会全体会议期间,国内首个官方“大模型标准符合性评测”结果公布。百度智能云官方今日宣布,百度文心大模型首批通过大模型标准符合性测试。除此之外,首批通过测试的产品还包括腾讯混元大模型、阿里通义千...……更多
360智脑成全国首个原生安全的大模型产品之一
...有限公司今天宣布,12月22日国内首个官方“大模型标准符合性测试”结果公布,360智脑成为首批通过的大模型产品之一。据介绍,360智脑是全国首个原生安全的大模型,官方声称其拥有自研千亿参数规模,核心能力位居国内第...……更多
腾讯混元文生图大模型升级并对外开源
...GPU。▲配置要求据此前报道,国内首个官方“大模型标准符合性评测”结果公布,腾讯混元大模型、成为首批通过评测的国产大模型,首批通过的大模型还有阿里通义千问、360智脑和百度文心一言。 ……更多
中关村科金1+N新品系列亮相,为企业打造大模型强人工智能应用
...了解,作为首批通过中国信通院组织的可信AI大模型标准符合性验证的对话式AI企业,中关村科金企业知识大模型在模块验证获得4+级评分。该模型具备全面的语义、语音、视觉等基础能力,在5个能力域、46个能力项评测中准确度...……更多
全模态对齐框架align-anything来啦:实现跨模态指令跟随
...精细化偏好标注:基于标注指令跟随、美学性、客观原则符合性、清晰度等多个细粒度原则进行标注,提供复杂精细化偏好标注。 自然语言语言反馈:提供细粒度批评和润色反馈,可利用此自然语言反馈开发算法及提升模型性...……更多
多模态模型评测框架lmms-eval发布!全面覆盖,低成本,零污染
...稿邮箱:liyazhou@jiqizhixin.com;zhaoyunfeng@jiqizhixin.com随着大模型研究的深入,如何将其推广到更多的模态上已经成为了学术界和产业界的热点。最近发布的闭源大模型如 GPT-4o、Claude 3.5 等都已经具备了超强的图像理解能力,LLaVA-……更多
智源评测体系发布 国内外“百模”评估结果出炉
5月17日,智源研究院举办大模型评测发布会,正式推出智源评测体系,发布并解读国内外140余个开源和商业闭源的语言及多模态大模型全方位能力评测结果。本次智源评测,分别从主观、客观两个维度考察了语言模型的简单理...……更多
...托系列标准,为多家技术厂商提供医疗健康大模型的能力符合性验证,持续完善评价细则,提升标准实用性和适用性,助力行业大模型规范化、集约化发展。2024年6月起,中国信通院选取GPT4、GPT-4O等国外通用大模型,文心一言、...……更多
全球几十种大模型评测,如何甄别可信度?
...觉中国蓝鲸新闻12月20日讯(记者 武静静)要衡量一个大模型能力是否够强,评测是最直接的维度。大模型评测就是为大模型的一场“考试”,从不同大模型的表现中,不仅可以衡量现有技术水平,还能帮助识别大模型存在的问...……更多
《金融大模型应用评测指南》发布,系全国首个以金融业务能力...
...发布全国首个以金融业务能力为核心的团体标准《金融大模型应用评测指南》,上海库帕思科技有限公司发布多维度金融大模型评测数据集(2024版)。 《金融大模型应用评测指南》,以金融业务为核心,以金融机构模型应用为...……更多
大模型下场,360智慧生活智助三百六十行
...?答案是肯定的。12月22日,全国首个官方“大模型标准符合性测试”结果公布,包括360、百度、阿里和腾讯4家大厂的自研大模型首批通过国家大模型标准测试,拿到了“国家认证”。360智慧生活集团是国内诸多安防企业中率先...……更多
媲美OpenAI事实性基准,这个中文评测集让o1-preview刚刚及格
...和顶尖的技术人才,成立未来生活实验室。实验室聚焦大模型、多模态等 AI 技术方向,致力于打造大模型相关基础算法、模型能力和各类 AI Native 应用,引领 AI 在生活消费领域的技术创新。如何解决模型生成幻觉一直是人工智...……更多
2024年下半年可信开源最新评估结果公布
...件产品通过开源合规能力评估;2个系统平台通过SOSS标准符合性测试;2个平台工具通过可信开源治理工具(SCA)评估;1个工具通过了开源代码库能力评估;2个社区通过了可信开源社区评估;1个社区完成了可信开源社区-OpenChain...……更多
2024快手磁力大会在重庆召开
...转化、更佳的体验和更长效的经营价值,快手还运用AI大模型等智能化技术重塑生意经营全链路,在素材的生产、理解、分发和承接上,提供全链路解决方案,助力企业提升经营效率。快手高级副总裁、电商事业部兼商业化事业...……更多
发展新质生产力:新动作看杭州“聚焦点”
...州技术转移转化中心共同发布了国内首个成果转化领域大模型——“智者大模型1.0”。“‘智者大模型1.0’主要功能包括企业的智能画像、成果的智能化评价、供需的智能化匹配等。”杭州技术转移转化中心相关负责人介绍,其...……更多
中文大模型最新评测出炉:腾讯混元国内第一!
快科技8月5日消息,在最新发布的中文多模态大模型SuperCLUE-V基准评测中,腾讯混元大模型获国内排名第一,稳居卓越领导者象限。此次评测聚焦于大模型理解复杂现实世界的关键能力,即多模态理解,俗称“图生文”。多模态...……更多
...果、微软,苹果推出Apple Intelligence AI系统等等。而在AI大模型方面,最主要事件则是OpenAI推出多模态大模型ChatGPT-4o,这一版本具有实时处理和生成文本、音频以及图像等多种模态的能力,被誉为技术上一个巨大突破。事实上,中...……更多
快手可灵 1.6 模型发布
...家 12 月 19 日消息,快手今日宣布视频生成推出可灵 1.6 模型,文本响应度、画面美感及运动合理性,均有明显提升,画面更稳定更生动,同时支持标准和高品质模式。特别是 1.6 图生视频的高品质模式,官方宣称“内部评测比 1....……更多
...试场。围绕人工智能伦理风险、数据安全风险、教学场景符合性、教育科学性和严谨性等方面,模拟真实场景开展测评,形成符合教育教学规律的智能教育通用评价标准,加快推动全市教育领域人工智能大模型的合规准入。在人...……更多
《openharmony设备统一互联技术标准》发布
...模型,新标准还包括接入与控制接口、投屏、文件分享、符合性测试规范等系列标准,为跨行业、跨厂商设备的互联提供统一的技术规范。这将有助于构建OpenHarmony物联网生态,实现设备间的无缝连接,并提供更流畅、更安全的...……更多
大模型用于采购评标,专业“证据链”驱动专家精准决策
...的客观信息(企业规模、资质、信誉、财务状况等)进行符合性比对,筛出“硬件”不符的投标方;资料缺失、内容前后不一致、不满足评标要求等,系统也都会“高亮”提示;此外,系统还能自动生成评标分析报告,标书合格...……更多
港中文团队提出大模型元推理范式,革新大模型的评价体系
...院工作过一段时间。在 ChatGPT 面世以后,他意识到针对大模型的研究范式存在一定的不足,于是决定来到香港中文大学读博。图 | 曾忠燊(来源:曾忠燊)前不久,曾忠燊和所在团队提出一个全新评测范式。基于这一评测范式,...……更多
AI安全守护计划启动!信通院牵头,AIIA安全治理委员会发布三类模型安全评测
...治理框架、合规治理、赋能治理展开,安全组主要开展大模型安全、合规等研究及基准测试。今年6月,中国信通院依托该委员会发起“人工智能安全守护计划”,包括建立威胁信息共享机制、开展AIGC真实内容来源可信工作、建...……更多
首个AI高考全卷评测结果发布:最高分303,数学全不及格
...设计的高难度综合性测试,目前普遍被研究者用于考察大模型的智能水平。在前不久高考结束后,上海人工智能实验室旗下司南评测体系OpenCompass选取了7个大模型进行高考“语数外”全卷能力测试。6月19日, OpenCompass发布了首个...……更多
东方财富董事长其实:建议进一步推动股权投资支持科技创新
...推动股权投资支持科技创新的建议》和《关于支持垂直大模型开发与应用的建议》。推动股权投资支持科技创新方面,其实提出了三方面建议:一是进一步健全政府引导基金容错机制,二是支持链主企业开展早期风险投资,三是...……更多
上海人工智能实验室公布首个ai高考全卷评测结果
...一结束,该实验室旗下司南评测体系OpenCompass选取6个开源模型及GPT-4o进行高考“语数外”全卷能力测试。评测采用全国新课标I卷,参与评测的所有开源模型开源时间均早于高考,确保评测“闭卷”性。同时,成绩由具有高考评...……更多
首个AI高考全卷评测结果发布:数学全都不及格
...布首个AI高考全卷评测结果,月初开源的阿里通义千问大模型Qwen2-72B排名第一,在语数外三科420分的满分中获得303分,OpenAI的GPT-4o和上海人工智能实验室的书生·浦语2.0文曲星(InternLM2-20B-WQX)排名二三位。本次评测采用全国新课...……更多
更多关于科技的资讯:
大道至简!雪铁龙、欧标售卖无中控屏新车:换成手机支架
快科技3月4日消息,在智能化配置泛滥的当下,加大加多屏幕似乎成为了主流,然而大道至简,近日,多家欧洲车企正以"反向操作"重拾基础款车型战略
2025-03-04 19:11:00
日本10亿研发费换来60%错误率AI工具!学习样本仅5000
快科技3月4日消息,随着AI的快速发展,日本政府也投入了约10亿日元(约合4879万人民币)的研发经费,试图开发一款用于判断儿童是否遭受虐待的AI工具
2025-03-04 19:11:00
赶紧试试 !微信支持进一步瘦身啦!有网友已经实测了
快科技3月4日消息,近日,微信iOS版和安卓版均出现了热更新。此次更新使得清理变得更细致,释放出更多的存储空间。打开手机微信APP界面
2025-03-04 19:11:00
58同城CEO姚劲波提议:房租年涨幅应控制在5%以内
快科技3月4日消息,据报道,全国人大代表、58同城董事长兼CEO姚劲波聚焦住房租赁市场,拟提交一份《关于进一步保护承租人合法权益》的建议
2025-03-04 19:41:00
摩尔线程新方法优化AI交互:显存节省最多82%
摩尔线程科研团队近日发布了一项新的研究成果《Round Attention:以轮次块稀疏性开辟多轮对话优化新范式》,使得端到端延迟低于现在主流的Flash Attention推理引擎
2025-03-04 19:41:00
麦当劳回应变成了没有情绪的中年人:我情绪挺好的呀
快科技3月4日消息,话题“麦当劳变成了没有情绪的中年人”登上热搜。据媒体报道,有博主发图比较2009年和2025年的麦当劳门店装饰变化
2025-03-04 19:41:00
星邦互娱IPO:爆款断档、收入下滑、由盈转亏;“小游戏流水第一”要讲出海故事
图片来源:网络出品 | 搜狐科技作者 | 张莹编辑 | 杨锦小游戏流水第一的移动游戏公司,并非外界耳熟能详的三七互娱、点点互动
2025-03-04 20:02:00
小米SU7 Ultra欧洲首秀引发关注 卢伟冰:震撼非常大
快科技3月4日消息,小米SU7 Ultra首次在海外亮相,这次小米选择了全球豪车发源地欧洲。小米集团王化表示,即便是看惯了豪车的欧洲人
2025-03-04 20:11:00
一喷瞬间补水!爆款颐莲玻尿酸喷雾:27元新低(大差价)
天猫颐莲旗舰店,颐莲玻尿酸喷雾300ml*2标价200元,今日下单领取96元优惠券+20元品类券,到手价为54元,折合每瓶约27元
2025-03-04 20:11:00
205g新疆棉:网易严选纯色纯棉短袖T恤80元3件狂促
天猫网易严选旗舰店,网易严选纯色纯棉短袖T恤日常售价39 元,今日下单3件可用19元券,点击【送给朋友】选项,根据提示下单
2025-03-04 20:11:00
电磁炉哪个牌子的质量好?热门好用的十大品牌
电磁炉凭借它的便捷性给小伙伴们带来许多方便,特别是聚会吃个火锅美哉美哉!但市面所售的电磁炉品牌型号众多,有很多小伙伴不知道该如何选择
2025-03-04 20:36:00
羊驼教育:沉浸式学习体验与高效备考策略
在日语学习日益受到重视的今天,羊驼教育凭借其独特的沉浸式学习体验和高效备考策略,成为了众多日语学习者的首选品牌。作为羊驼教育旗下的一条成熟业务线
2025-03-04 20:37:00
重庆大学产业技术研究院与企业合作成立“天枢云擎联合研究与创新中心”
3月4日下午,在位于重庆两江新区的重庆艺臻供应链(集团)有限公司(以下简称“艺臻集团”)总部,重庆大学产业技术研究院与重庆艺臻云智能科技有限公司(以下简称“艺臻科技”)举行了“天枢云擎联合研究与创新中心”成立签约暨揭牌仪式
2025-03-04 20:47:00
3月3日,由国家能源局、山西省能源局、太原市能源局多名专家组成的评审团,现场评审科达自控总承包建设的晋能控股同忻矿选煤厂智能化项目
2025-03-04 20:55:00
贵州高速集团全面接入DeepSeek大模型 “数智贵高”升级再提速
多彩贵州网讯(本网记者 张鸿杰 通讯员 杨焙)近日,贵州高速集团接入DeepSeek人工智能大模型,通过“自主可控+开源协同”双引擎驱动
2025-03-04 21:37:00