• 我的订阅
  • 财经

商汤商量获SuperCLUE 9月评测总榜和子榜两项第一,AI智能体方向受瞩目

类别:财经 发布时间:2023-10-13 14:26:00 来源:财联社

商汤商量获SuperCLUE 9月评测总榜和子榜两项第一,AI智能体方向受瞩目

近日,中文通用大模型综合性评测基准SuperCLUE发布9月总排行榜和各个分类任务榜单,商汤商量SenseChat 3.0 位列中文大模型总榜排名第一。在新增的AI Agent(AI智能体)子榜中,SenseChat 3.0 同样排名第一,领先所有国内中文大模型以及GPT-3.5 和 Claude 2,表现仅次于GPT-4,展示了商汤在大模型领域创新发展及释放生产力的优势,以及在探索AGI道路上的积累与潜力。

商汤商量获SuperCLUE 9月评测总榜和子榜两项第一,AI智能体方向受瞩目

注:国外代表性模型(GPT4.0/Claude2/gpt-3.5)不参与排名。

SuperCLUE是中文通用大模型的综合性评测基准,旨在对大模型在各个能力维度上的表现进行全方位的评估,是国内最具专业性和代表性的中文大模型评测基准之一。此次评测选取了目前国内外最具代表性的20个通用大语言模型。

商量总榜第一,客观题成绩超GPT-3.5

9月最新发布的SuperCLUE总排行榜和各个分类任务榜单,主要聚焦于大模型的四个能力象限,语言理解与生成,包括语言理解与抽取、上下文对、生成与创作、角色扮演;专业技能与知识,包括知识与百科、计算、代码、逻辑与推理;Agent智能体,包括工具使用、任务规划;安全性,包括系统安全、指令攻击,总共12项基础能力。

在总排行榜中,商汤科技商量SenseChat 3.0以总分62.75分位列第一,其中在OPT客观题部分,商汤SenseChat 3.0得分还超过了GPT-3.5,展示了在中文大模型方面极强的综合竞争力。

商汤商量SenseChat于2023年4月正式推出,是国内最早的基于千亿参数大语言模型之一,并不断迭代更新。其背后依托的是商汤AI大装置SenseCore,目前上线GPU数量约30,000块,算力规模提升至6 ExaFLOPS,有效支持语言大模型的训练、升级迭代和服务。

推动AI智能体发展,加速迈向AGI

随着大模型发展,“聊天”已远远不能满足人们的要求,能够准确使用工具成为解放大模型生产力的关键。SuperCLUE新增的AI Agent(AI智能体)子榜,是业界首个AI Agent榜单,它重点评估了AI Agent在“工具使用”和“任务规划”两个关键能力上的表现。评测显示商汤商量SenseChat 3.0具备作为人类超级助手的潜力,可以根据人类需求自主完成任务,进而充分释放大模型的生产力,使其在 AI Agent 榜单上表现仅次于GPT-4,全面领先其余参评大模型。

商汤商量获SuperCLUE 9月评测总榜和子榜两项第一,AI智能体方向受瞩目

目前全球领先的AI 智能体,几乎都以领先大模型GPT-4为核心驱动,它们借助强大的工具使用能力等,可将复杂问题拆解成可实现的子任务、类人的自然语言交互等能力。商量SenseChat 3.0作为领先的中文大模型,通过使用代码解释器、API调用和搜索三类常用工具来解决复杂任务,灵活搭建AI智能体应用,支撑企业的生产力革新。

目前,商量SenseChat已经在金融、手机、医疗、汽车、地产、能源、传媒、工业制造等众多垂直行业与超过500家客户建立了深度合作。作为具备强大工具使用能力的大模型,商量SenseChat的持续快速提升,为商汤发展更强大的、能够像人类一样进行交互的AI智能体,以及面向AGI道路的探索,都将提供重要的基础和支撑。

以上内容为资讯信息快照,由td.fyun.cc爬虫进行采集并收录,本站未对信息做任何修改,信息内容不代表本站立场。

快照生成时间:2023-10-13 18:45:01

本站信息快照查询为非营利公共服务,如有侵权请联系我们进行删除。

信息原文地址:

...青年报记者跟随“高质量发展调研行”主题采访活动来到商汤科技新洲大厦。智能自诊预测疾病风险、临床大数据治理、智能化专病随访服务……如今,越来越多未来感十足的就医新场景在上海渐次
2024-05-27 07:15:00
商汤发布开源社区最大最强多模态多任务通用大模型“书生2.5”
商汤发布开源社区最大最强多模态多任务通用大模型“书生2.5” 3月14日,商汤科技发布多模态多任务通用大模型“书生(INTERN)2.5”,在多模态多任务处理能力方面实现多项全新
2023-03-15 13:30:00
商汤科技sensetime推出“云端边”全栈大模型体系
2024年4月23日,上海——商汤科技SenseTime举办技术交流日活动,发布行业首个“云、端、边”全栈大模型产品矩阵
2024-04-25 01:02:00
商汤科技发布“书生·浦语”大模型 中文考试超越ChatGPT
...各业,据CNMO了解,近日,行业领先的人工智能软件公司商汤科技与上海AI实验室等发布了“书生·浦语”大模型。商汤科技据媒体报道,商汤科技、上海AI实验室联合香港中文大学、复旦
2023-06-08 00:13:00
...2.0》(以下简称报告)显示,讯飞星火、百度文心一言、商汤商量和智谱AI-ChatGLM均表现抢眼,AI大模型的发展为人类工作和生活的提质增效均带来了正向积极的影响。今年以来
2023-08-12 18:18:00
“大装置+大模型”战略:助力商汤迅速获取生成式AI商业化果实
...机会。从AI1.0向AI2.0演进,全球领先的人工智能软件公司商汤集团股份有限公司(下文简称“商汤”)成为立于潮头的那个
2024-04-01 15:16:00
...2023年中国大模型行研能力评测报告》。评测结果显示,商汤语言大模型“日日新·商量”以总分7.73(满分10分)斩获总榜第一,并在报告撰写能力、模型基础能力两个子榜位居第一。
2024-01-13 00:05:00
本文转自:劳动报商汤科技发布日日新5.0大模型五大产品全新亮相 局部能力赶超GPT-4本报讯(劳动报记者 陈宁)日前,在上海商汤临港AIDC举行的“2024年商汤技术交流日”活动
2024-04-29 04:36:00
商汤久违爆发
沉寂已久的AI巨头商汤4月24日迎来大爆发,当日股价飙涨31.15%。商汤的放量大涨行情也成为了市场焦点,4月24日上午11时15分起
2024-04-25 01:00:00
更多关于财经的资讯:
深耕“两化”管理 筑牢发展根基——农发行吴中区支行推进规范化精细化建设
为强化基础管理、推动银行业务高质量发展。中国农业发展银行苏州市吴中区支行将规范化、精细化管理要求提升高度,致力于通过管理能力的根本性提升
2025-11-25 12:08:00
吴江农发行精准贯彻总行精神 筑牢涉农贷款认定管理根基
近日,中国农业发展银行吴江支行组织全体员工,专题学习总行下发的《关于加强涉农贷款认定管理的通知》文件精神,旨在进一步统一思想
2025-11-25 12:43:00
苏州市农发行:深化安全思想建设 筑牢思想安全屏障
安全思想是安全管理的“第一道防线”。苏州农发行结合农业政策性银行职能与运营实际,推动全员安全思想从“被动遵守”向“主动敬畏”转变
2025-11-25 12:46:00
张家港市农发行坚持实地库存检查 守牢信贷资产安全底线
为切实强化信贷资产管理,确保质押物真实有效,防范信贷风险,张家港农发行始终将实地库存检查作为信贷风险防控的关键环节,通过常态化
2025-11-25 13:25:00
吴江农发行喜迎省行信贷专项检查 以检促建夯实高质量发展根基
近日,中国农业发展银行江苏省分行信贷领域专项检查组一行,在相关负责人的带领下,莅临吴江支行开展信贷业务专项检查与现场指导工作
2025-11-25 13:25:00
张家港市农发行积极开展“爱满港城”慈善网络募捐活动 传递金融温度
为积极履行社会责任,凝聚向善力量,近日,张家港农发行响应地方慈善号召,组织全体员工积极参与“爱满港城”慈善网络募捐活动
2025-11-25 13:28:00
张家港市农发行深化“两化”管理 赋能业务发展提质增效
为持续优化内部管理体系,提升金融服务质效,张家港农发行以“标准化、精细化”管理为抓手,通过健全制度规范、优化业务流程、强化过程管控
2025-11-25 13:28:00
张家港市农发行:夯实数据质量管理根基 赋能业务高质量发展
为提升金融服务精准度,筑牢风险防控数据支撑,张家港农发行聚焦数据全生命周期管理,通过建机制、强管控、优能力,持续夯实数据质量管理根基
2025-11-25 13:30:00
吴江农发行深入开发区开展反诈宣传 筑牢企业金融“防火墙”
为切实提升企业客户的金融风险防范意识,护航区域经济健康发展,近日,中国农业发展银行吴江支行组织业务骨干,主动走进吴江经济技术开发区
2025-11-25 13:30:00
张家港市农发行组织收看心理健康讲座 为员工心灵“充电赋能”
为切实关心关爱员工心理健康,帮助员工缓解工作压力、调适心理状态,近日,张家港农发行组织全体员工集中收看心理健康专题讲座
2025-11-25 13:37:00
张家港市农发行积极参加省行安全大讲堂 筑牢智慧消防安防“防火墙”
为全面提升银行安全管理智能化水平,切实强化消防安全与安防体系建设,近日,张家港农发行组织全体员工线上参加省行举办的“银行智慧消防安防一体化”安全大讲堂活动
2025-11-25 13:38:00
吴江农发行四季度蓄力攻坚 擘画“开门红”新篇章
时值四季度,中国农业发展银行吴江支行已全面进入备战2026年“开门红”的冲刺状态。支行紧紧围绕服务乡村振兴战略,秉持“早谋划
2025-11-25 13:38:00
成都产投等成立蓉酒酒业公司,注册资本5亿元
近日,成都蓉酒酒业有限公司成立,法定代表人为周卫东,注册资本为5亿元,经营范围包含:酒制品生产;酒类经营;饮料生产;食品销售
2025-11-25 13:48:00
东华软件在福州新设科技公司,含多项AI业务
近日,东华闽都(福州)科技有限公司成立,法定代表人为杨滨鲜,注册资本为5000万元,经营范围包含:人工智能应用软件开发
2025-11-25 13:48:00
华工科技、武汉产发基金等新设创投基金
近日,华工未来(武汉)创业投资基金合伙企业(有限合伙)成立,出资额2亿元,经营范围包含:创业投资(限投资未上市企业);以私募基金从事股权投资
2025-11-25 13:48:00