• 我的订阅
  • 财经

体验感受哪家强?《人工智能大模型体验报告2.0》发布

类别:财经 发布时间:2023-08-12 18:18:00 来源:经济参考报

近来,人工智能大模型风云起涌,不少科技企业加快拓宽应用生态。主流大模型的实际使用感受如何?各大科技企业有何优劣势?8月12日,新华社研究院中国企业发展研究中心发布的《人工智能大模型体验报告2.0》(以下简称报告)显示,讯飞星火、百度文心一言、商汤商量和智谱AI-ChatGLM均表现抢眼,AI大模型的发展为人类工作和生活的提质增效均带来了正向积极的影响。

今年以来,国内科技企业纷纷布局人工智能大模型。据不完全统计,在新一轮生成式AI热潮中,国内已经出现了上百个大模型。天眼查数据显示,截至2023年上半年,与“大模型”直接相关的融资事件超20起。

为进一步直观感受我国当前主流科技企业所推出的大模型产品的现状、优势和特点,新华社研究院中国企业发展研究中心于今年7月启动了本次报告研究。与2023年6月首次发布的《人工智能大模型体验报告》相比,本次测评在题目设计、对标Benchmark(人类)、打分权重、专家测评团队四大维度进行了全面升级。

其中,在题目设计方面,测评题目由300道扩展至500道,并进一步完善了题目分类;在对标Benchmark方面,本次测评将接受过高等教育的人类作为对照,来考评大模型真实能力;在打分标准上,本次测评根据对产业、生活的实际价值,对基础能力、智商能力、情商能力和工具提效四大测评维度进行了权重设计;在测评团队方面,本次测评特邀北京大学文化与传播研究所及其他产界、学界专家全程参与。

本次研究设置了用户体验项目,抓取了7月31日—8月4日数据,通过人机互动提问等形式,对国内主流大模型进行使用体验评测,旨在为科技企业调整努力方向提供参考。

报告显示,与2023年6月相比,当前中国大模型产品进步显著。但与接受过高等教育的人类相比,大模型在智商、情商等方面还存在一定程度差距。具体来看,讯飞星火在工作提效方面优势明显,百度文心一言基础能力仍处领军水准,商汤商量则在情商方面表现优秀,智谱AI-ChatGLM整体表现优秀。

针对各维度能力测评,该报告还给出了相应的案例展示和分析。

在基础能力方面,人类与AI之间的差距并不显著。课题组分别从语言能力(35%)、AI向善(10%)、跨模态(20%)和多轮对话(35%)四大指标进行测评。测评显示,科技企业大模型中,百度文心一言表现最为抢眼,商汤商量、智谱AI-ChatGLM、360智脑表现优良。

在智商评估方面,人类在智商方面仍然具有明显优势。课题组分别从常识知识(20%)、逻辑能力(50%)和专业知识(30%)方面对科技企业大模型进行考量。结果显示,讯飞星火、智谱AI-ChatGLM表现突出,百度文心一言、昆仑万维天工表现优良。

在情商方面,AI与人类之间的差距最为明显。人类在情绪理解和处理方面通常具有更强的优势,和更灵活的处理能力。通过对处理日常事项(35%)、一语双关(30%)、人际关系(35%)问题进行分析发现,科技企业大模型中,商汤商量表现亮眼,百度文心一言、澜舟科技Mchat、智谱AI-ChatGLM及360智脑均表现优良。

在工作效率提升方面,课题组重点在工具提效(50%)和生成创新(50%)方面进行考量。结果显示,讯飞星火表现最为抢眼,百度文心一言、商汤商量、智谱AI-ChatGLM表现优良。不过,尽管AI具有高速度和高效率的优势,但在某些复杂和具有创新性的任务中,人类的智慧和想象力仍然具有无法替代的作用。

报告认为,虽然在不同领域中,AI和人类表现出不同的优劣势,但在整体上,AI大模型的发展为人类工作和生活的提质增效带来了重要的积极影响,大模型正在加速走进生活、走进产业。在本次体验测评基础上,研究团队将继续深耕,加强在大模型安全可解释性、工作提效能力、实际落地情况、产业优秀案例等维度上的探索与研究。

扫描二维码查看《人工智能大模型体验报告2.0》全文

以上内容为资讯信息快照,由td.fyun.cc爬虫进行采集并收录,本站未对信息做任何修改,信息内容不代表本站立场。

快照生成时间:2023-08-12 21:45:21

本站信息快照查询为非营利公共服务,如有侵权请联系我们进行删除。

信息原文地址:

“Sora”王炸,20篇研报带你走进人工智能(下载)
...于青萍之末,浪成于微澜之间。由ChatGPT所带来的新一轮人工智能热潮还在席卷全球,OpenAI又在近日发布了首款文生视频模型“Sora”。人工智能的广泛应用将给人类未来的生
2024-02-18 09:22:00
赋能千行百业  便利千家万户(大数据观察)
本文转自:人民日报生成式人工智能产品快速普及应用赋能千行百业  便利千家万户(大数据观察)本报记者  金  歆《人民日报》(2025年02月06日第 07 版)数据来源:中国互联
2025-02-06 06:11:00
《2023人工智能赋能网络视听产业观察报告》在青发布
...新技术浪潮下的智能视听步入深度变革新阶段——2023年人工智能赋能网络视听产业观察报告》。《报告》围绕综合视频、短视频、网络直播和网络音频四种视听形态梳理了2023年人工智能
2023-10-21 19:06:00
风口上的生成式AI:深度求索产业变革
...知识管理、对话应用,还是生成代码、设计研发,生成式人工智能(AI)正在深度求索产业变革。“在模型能力和性价比同步提升的背景下,国内人工智能应用依托丰富生态和成熟流量,正加速在
2025-02-15 09:28:00
...《报告》的主要内容。《报告》指出,2023年,以通用型人工智能为引领的内容科技迎来跨越式发展,内容科技持续推进以数字化为宣传思想工作赋能,推进习近平文化思想的深入学习贯彻,也
2024-04-08 16:41:00
本文转自:人民网研究院2023年,以通用型人工智能为引领的内容科技迎来跨越式发展,内容科技持续推进以数字化为宣传思想工作赋能,推进习近平文化思想的深入学习贯彻,也不断催生行业的新
2024-04-08 16:49:00
...词被提及10次,“大模型”则首次被写入。作为大模型和人工智能领域的领军企业,我们感到非常振奋,同时深感责任重大。报告在介绍今年政府工作任务时提出,“因地制宜发展新质生产力,加
2025-03-09 14:03:00
“人工智能”首次写入政府工作报告,平治信息等公司纷纷加大布局
“人工智能+”再度引发热议。2024年政府工作报告提出,积极培育新兴产业和未来产业。同时,作为未来产业重要内容的“人工智能+”也被首次写入政府工作报告。政策利好之下,A股人工智能
2024-03-11 17:52:00
报告:生成式人工智能对金融业具有深远影响
...报告》)正式发布。《报告》称,以ChatGPT为代表的生成式人工智能(AIGC)对金融业具有深远影响。《明珠湾智能金融发展报告(2022)》发布现场
2023-12-18 16:49:00
更多关于财经的资讯:
华为新专利可实现手表150米潜水级防水
近日,华为技术有限公司“一种封堵组件、壳体组件及电子设备”专利公布。企查查专利摘要显示,本申请涉及电子设备防水技术领域
2025-11-13 13:48:00
陈丽君新增名誉维权案
近日,法院刊登陈丽君起诉葛某某网络侵权责任纠纷(名誉权纠纷)开庭公告。据悉,该案件计划将于12月17日,在杭州互联网法院开庭审理。
2025-11-13 13:48:00
广东华兴银行深圳分行因虚增存款被罚60万元 责任人遭警告
11月12日,深圳金融监管局行政处罚信息公示表显示,广东华兴银行深圳分行及相关责任人因贴现资金回流至出票人用于存单质押再开票,虚增存款被罚款60万元,吴某虹被给予警告。
2025-11-13 10:14:00
民生银行上海分行成功举办“全民星闪耀·悦动舞新生”广场舞大赛
2025年11月12日,民生银行上海分行主办的“全民星闪耀·悦动舞新生”广场舞大赛总决赛在沪圆满落幕。本次大赛自启动以来
2025-11-13 10:11:00
和谐健康保险乐山中支编制虚假财务资料被罚10万元 两责任人同步领罚
11月12日,国家金融监督管理总局乐山监管分局行政处罚信息公开表显示,和谐健康保险股份有限公司乐山中心支公司因编制虚假财务资料被罚款人民币10万元;相关责任人徐某翔被警告并罚款人
2025-11-13 10:13:00
蜂助手成立极算技术公司,含AI及物联网业务
近日,广东极算技术有限公司成立,法定代表人为罗洪鹏,经营范围包含:物联网应用服务;物联网技术研发;人工智能应用软件开发;人工智能基础资源与技术平台等。企查查股权穿透显示,该公司由
2025-11-12 10:48:00
通鼎互联在苏州成立新型材料公司
近日,苏州通鼎新型材料有限公司成立,注册资本5000万元,经营范围包含:电子专用材料制造;有色金属合金制造;有色金属合金销售;有色金属压延加工等。企查查股权穿透显示,该公司由通鼎
2025-11-12 10:48:00
由中建八局城市运营携手健康集团、正和承邦共同打造的南京青奥城市客厅项目亮相2025南京体育产业高质量发展大会
近日,由南京文旅集团(筹)主办,南京体育产业集团、南京市体育产业联合会共同承办的“青奥赋能,文旅融合”2025南京体育产业高质量发展大会在宁举行
2025-11-12 10:50:00
前10个月福建汽车出口量同比增长60.9%
东南网11月12日讯 (福建日报记者 尤方明 通讯员 李凤灵 陈雅莹) 据厦门海关统计,今年1—10月,福建共出口各类汽车11
2025-11-12 11:01:00
宠物消费结构在升级!企查查:超3成宠物经济相关企业在华东
据媒体报道,一年一度的“双十一”消费大促临近尾声,宠物品类的消费热度节节攀升,成为不容忽视的大促主战场。数据显示,10月15日
2025-11-12 11:36:00
百年工运 “新”火相传——平安金服济南分公司第九届趣味运动会盛大开幕
金秋送爽,活力满场。近日,济南分公司第九届趣味运动会在热烈氛围中正式拉开帷幕,300余位同仁齐聚赛场,共赴这场兼具欢声笑语与团队精神的体育盛会
2025-11-12 11:42:00
10年封神!奈雪草莓季重磅回归,健康新品登趋势热榜
每年冬季,手握一杯奈雪的霸气草莓,早已成为无数消费者的冬日仪式感。11月11日,健康茶饮领导者奈雪的茶“草莓季”如约而至
2025-11-12 11:44:00
“平安有我,益起同行”平安一家亲健步跑,以脚步诠释责任担当
近日,“平安有我,益起同行”2025中国平安驻山东地区“一家亲”健步跑活动,在济南森林公园正式鸣枪开跑。近130名平安驻鲁专业公司员工代表身着统一赛事服装集结赛道
2025-11-12 11:46:00
“小橙帽”平安守护者在行动——平安银行济南分行为民办实事
为践行以人民为中心的发展思想,将“为民办实事”落于实处,平安银行济南分行积极组建“小橙帽”平安守护者志愿服务团队,在各地组织开展“银龄守护”
2025-11-12 11:47:00
让“使用算力像水电一样简单”|回眸“十四五”·高质量发展这五年
在东数西算(贵州)智算中心大楼前,贵州电信云网发展部副总经理黄代勇注视着屏幕上的算力调度数据,这些跳动的数据,正是他深度参与建设的贵州电信“东数西算”项目最真实的“脉动”
2025-11-12 12:04:00