• 我的订阅
  • 财经

体验感受哪家强?《人工智能大模型体验报告2.0》发布

类别:财经 发布时间:2023-08-12 18:18:00 来源:经济参考报

近来,人工智能大模型风云起涌,不少科技企业加快拓宽应用生态。主流大模型的实际使用感受如何?各大科技企业有何优劣势?8月12日,新华社研究院中国企业发展研究中心发布的《人工智能大模型体验报告2.0》(以下简称报告)显示,讯飞星火、百度文心一言、商汤商量和智谱AI-ChatGLM均表现抢眼,AI大模型的发展为人类工作和生活的提质增效均带来了正向积极的影响。

今年以来,国内科技企业纷纷布局人工智能大模型。据不完全统计,在新一轮生成式AI热潮中,国内已经出现了上百个大模型。天眼查数据显示,截至2023年上半年,与“大模型”直接相关的融资事件超20起。

为进一步直观感受我国当前主流科技企业所推出的大模型产品的现状、优势和特点,新华社研究院中国企业发展研究中心于今年7月启动了本次报告研究。与2023年6月首次发布的《人工智能大模型体验报告》相比,本次测评在题目设计、对标Benchmark(人类)、打分权重、专家测评团队四大维度进行了全面升级。

其中,在题目设计方面,测评题目由300道扩展至500道,并进一步完善了题目分类;在对标Benchmark方面,本次测评将接受过高等教育的人类作为对照,来考评大模型真实能力;在打分标准上,本次测评根据对产业、生活的实际价值,对基础能力、智商能力、情商能力和工具提效四大测评维度进行了权重设计;在测评团队方面,本次测评特邀北京大学文化与传播研究所及其他产界、学界专家全程参与。

本次研究设置了用户体验项目,抓取了7月31日—8月4日数据,通过人机互动提问等形式,对国内主流大模型进行使用体验评测,旨在为科技企业调整努力方向提供参考。

报告显示,与2023年6月相比,当前中国大模型产品进步显著。但与接受过高等教育的人类相比,大模型在智商、情商等方面还存在一定程度差距。具体来看,讯飞星火在工作提效方面优势明显,百度文心一言基础能力仍处领军水准,商汤商量则在情商方面表现优秀,智谱AI-ChatGLM整体表现优秀。

针对各维度能力测评,该报告还给出了相应的案例展示和分析。

在基础能力方面,人类与AI之间的差距并不显著。课题组分别从语言能力(35%)、AI向善(10%)、跨模态(20%)和多轮对话(35%)四大指标进行测评。测评显示,科技企业大模型中,百度文心一言表现最为抢眼,商汤商量、智谱AI-ChatGLM、360智脑表现优良。

在智商评估方面,人类在智商方面仍然具有明显优势。课题组分别从常识知识(20%)、逻辑能力(50%)和专业知识(30%)方面对科技企业大模型进行考量。结果显示,讯飞星火、智谱AI-ChatGLM表现突出,百度文心一言、昆仑万维天工表现优良。

在情商方面,AI与人类之间的差距最为明显。人类在情绪理解和处理方面通常具有更强的优势,和更灵活的处理能力。通过对处理日常事项(35%)、一语双关(30%)、人际关系(35%)问题进行分析发现,科技企业大模型中,商汤商量表现亮眼,百度文心一言、澜舟科技Mchat、智谱AI-ChatGLM及360智脑均表现优良。

在工作效率提升方面,课题组重点在工具提效(50%)和生成创新(50%)方面进行考量。结果显示,讯飞星火表现最为抢眼,百度文心一言、商汤商量、智谱AI-ChatGLM表现优良。不过,尽管AI具有高速度和高效率的优势,但在某些复杂和具有创新性的任务中,人类的智慧和想象力仍然具有无法替代的作用。

报告认为,虽然在不同领域中,AI和人类表现出不同的优劣势,但在整体上,AI大模型的发展为人类工作和生活的提质增效带来了重要的积极影响,大模型正在加速走进生活、走进产业。在本次体验测评基础上,研究团队将继续深耕,加强在大模型安全可解释性、工作提效能力、实际落地情况、产业优秀案例等维度上的探索与研究。

扫描二维码查看《人工智能大模型体验报告2.0》全文

以上内容为资讯信息快照,由td.fyun.cc爬虫进行采集并收录,本站未对信息做任何修改,信息内容不代表本站立场。

快照生成时间:2023-08-12 21:45:21

本站信息快照查询为非营利公共服务,如有侵权请联系我们进行删除。

信息原文地址:

“Sora”王炸,20篇研报带你走进人工智能(下载)
...于青萍之末,浪成于微澜之间。由ChatGPT所带来的新一轮人工智能热潮还在席卷全球,OpenAI又在近日发布了首款文生视频模型“Sora”。人工智能的广泛应用将给人类未来的生
2024-02-18 09:22:00
《2023人工智能赋能网络视听产业观察报告》在青发布
...新技术浪潮下的智能视听步入深度变革新阶段——2023年人工智能赋能网络视听产业观察报告》。《报告》围绕综合视频、短视频、网络直播和网络音频四种视听形态梳理了2023年人工智能
2023-10-21 19:06:00
本文转自:人民网研究院2023年,以通用型人工智能为引领的内容科技迎来跨越式发展,内容科技持续推进以数字化为宣传思想工作赋能,推进习近平文化思想的深入学习贯彻,也不断催生行业的新
2024-04-08 16:49:00
...《报告》的主要内容。《报告》指出,2023年,以通用型人工智能为引领的内容科技迎来跨越式发展,内容科技持续推进以数字化为宣传思想工作赋能,推进习近平文化思想的深入学习贯彻,也
2024-04-08 16:41:00
“人工智能”首次写入政府工作报告,平治信息等公司纷纷加大布局
“人工智能+”再度引发热议。2024年政府工作报告提出,积极培育新兴产业和未来产业。同时,作为未来产业重要内容的“人工智能+”也被首次写入政府工作报告。政策利好之下,A股人工智能
2024-03-11 17:52:00
报告:生成式人工智能对金融业具有深远影响
...报告》)正式发布。《报告》称,以ChatGPT为代表的生成式人工智能(AIGC)对金融业具有深远影响。《明珠湾智能金融发展报告(2022)》发布现场
2023-12-18 16:49:00
HID 2024年安防趋势报告:人工智能的应用日益增多
人工智能带来了一个新的效率时代,但它也带来了一系列独特的挑战。安防行业应该如何适应? HID高级副总裁兼首席技术官RameshSongukrishnasamy 安防行业陷入了一场永无止境的猫捉老鼠的游戏中
2024-04-25 13:00:00
CCBN2024|讯飞星火大模型助力产品创新,引领广电视听新体验
...挥其独特的优势,创造出更加丰富和高质量的内容。作为人工智能产业“国家队”,今年1月,科大讯飞星火大模型V3.5正式发布,这是首个基于全国产化算力平台“飞星一号”训练的全民开放
2024-04-26 03:00:00
度小满CEO朱光:大模型技术大幅加速金融行业的智能化进程
...程中展现出的智能水平令人惊叹。ChatGPT的问世,意味着人工智能的发展到了从 “弱人工智能”向“强人工智能”跃迁的分水岭
2023-03-09 19:39:00
更多关于财经的资讯: