• 我的订阅
  • 财经

商汤商量获SuperCLUE 9月评测总榜和子榜两项第一,AI智能体方向受瞩目

类别:财经 发布时间:2023-10-13 14:26:00 来源:财联社

商汤商量获SuperCLUE 9月评测总榜和子榜两项第一,AI智能体方向受瞩目

近日,中文通用大模型综合性评测基准SuperCLUE发布9月总排行榜和各个分类任务榜单,商汤商量SenseChat 3.0 位列中文大模型总榜排名第一。在新增的AI Agent(AI智能体)子榜中,SenseChat 3.0 同样排名第一,领先所有国内中文大模型以及GPT-3.5 和 Claude 2,表现仅次于GPT-4,展示了商汤在大模型领域创新发展及释放生产力的优势,以及在探索AGI道路上的积累与潜力。

商汤商量获SuperCLUE 9月评测总榜和子榜两项第一,AI智能体方向受瞩目

注:国外代表性模型(GPT4.0/Claude2/gpt-3.5)不参与排名。

SuperCLUE是中文通用大模型的综合性评测基准,旨在对大模型在各个能力维度上的表现进行全方位的评估,是国内最具专业性和代表性的中文大模型评测基准之一。此次评测选取了目前国内外最具代表性的20个通用大语言模型。

商量总榜第一,客观题成绩超GPT-3.5

9月最新发布的SuperCLUE总排行榜和各个分类任务榜单,主要聚焦于大模型的四个能力象限,语言理解与生成,包括语言理解与抽取、上下文对、生成与创作、角色扮演;专业技能与知识,包括知识与百科、计算、代码、逻辑与推理;Agent智能体,包括工具使用、任务规划;安全性,包括系统安全、指令攻击,总共12项基础能力。

在总排行榜中,商汤科技商量SenseChat 3.0以总分62.75分位列第一,其中在OPT客观题部分,商汤SenseChat 3.0得分还超过了GPT-3.5,展示了在中文大模型方面极强的综合竞争力。

商汤商量SenseChat于2023年4月正式推出,是国内最早的基于千亿参数大语言模型之一,并不断迭代更新。其背后依托的是商汤AI大装置SenseCore,目前上线GPU数量约30,000块,算力规模提升至6 ExaFLOPS,有效支持语言大模型的训练、升级迭代和服务。

推动AI智能体发展,加速迈向AGI

随着大模型发展,“聊天”已远远不能满足人们的要求,能够准确使用工具成为解放大模型生产力的关键。SuperCLUE新增的AI Agent(AI智能体)子榜,是业界首个AI Agent榜单,它重点评估了AI Agent在“工具使用”和“任务规划”两个关键能力上的表现。评测显示商汤商量SenseChat 3.0具备作为人类超级助手的潜力,可以根据人类需求自主完成任务,进而充分释放大模型的生产力,使其在 AI Agent 榜单上表现仅次于GPT-4,全面领先其余参评大模型。

商汤商量获SuperCLUE 9月评测总榜和子榜两项第一,AI智能体方向受瞩目

目前全球领先的AI 智能体,几乎都以领先大模型GPT-4为核心驱动,它们借助强大的工具使用能力等,可将复杂问题拆解成可实现的子任务、类人的自然语言交互等能力。商量SenseChat 3.0作为领先的中文大模型,通过使用代码解释器、API调用和搜索三类常用工具来解决复杂任务,灵活搭建AI智能体应用,支撑企业的生产力革新。

目前,商量SenseChat已经在金融、手机、医疗、汽车、地产、能源、传媒、工业制造等众多垂直行业与超过500家客户建立了深度合作。作为具备强大工具使用能力的大模型,商量SenseChat的持续快速提升,为商汤发展更强大的、能够像人类一样进行交互的AI智能体,以及面向AGI道路的探索,都将提供重要的基础和支撑。

以上内容为资讯信息快照,由td.fyun.cc爬虫进行采集并收录,本站未对信息做任何修改,信息内容不代表本站立场。

快照生成时间:2023-10-13 18:45:01

本站信息快照查询为非营利公共服务,如有侵权请联系我们进行删除。

信息原文地址:

...青年报记者跟随“高质量发展调研行”主题采访活动来到商汤科技新洲大厦。智能自诊预测疾病风险、临床大数据治理、智能化专病随访服务……如今,越来越多未来感十足的就医新场景在上海渐次
2024-05-27 07:15:00
商汤发布开源社区最大最强多模态多任务通用大模型“书生2.5”
商汤发布开源社区最大最强多模态多任务通用大模型“书生2.5” 3月14日,商汤科技发布多模态多任务通用大模型“书生(INTERN)2.5”,在多模态多任务处理能力方面实现多项全新
2023-03-15 13:30:00
商汤科技sensetime推出“云端边”全栈大模型体系
2024年4月23日,上海——商汤科技SenseTime举办技术交流日活动,发布行业首个“云、端、边”全栈大模型产品矩阵
2024-04-25 01:02:00
商汤科技发布“书生·浦语”大模型 中文考试超越ChatGPT
...各业,据CNMO了解,近日,行业领先的人工智能软件公司商汤科技与上海AI实验室等发布了“书生·浦语”大模型。商汤科技据媒体报道,商汤科技、上海AI实验室联合香港中文大学、复旦
2023-06-08 00:13:00
...2.0》(以下简称报告)显示,讯飞星火、百度文心一言、商汤商量和智谱AI-ChatGLM均表现抢眼,AI大模型的发展为人类工作和生活的提质增效均带来了正向积极的影响。今年以来
2023-08-12 18:18:00
“大装置+大模型”战略:助力商汤迅速获取生成式AI商业化果实
...机会。从AI1.0向AI2.0演进,全球领先的人工智能软件公司商汤集团股份有限公司(下文简称“商汤”)成为立于潮头的那个
2024-04-01 15:16:00
本文转自:劳动报商汤科技发布日日新5.0大模型五大产品全新亮相 局部能力赶超GPT-4本报讯(劳动报记者 陈宁)日前,在上海商汤临港AIDC举行的“2024年商汤技术交流日”活动
2024-04-29 04:36:00
...2023年中国大模型行研能力评测报告》。评测结果显示,商汤语言大模型“日日新·商量”以总分7.73(满分10分)斩获总榜第一,并在报告撰写能力、模型基础能力两个子榜位居第一。
2024-01-13 00:05:00
商汤科技马堃:通用型人工智能将大幅提升生产力 元萝卜AI下棋机器人为家庭应用而生|WISE2023商业之王大会
...提问,给未来答案。在11月29日上午的WISE主会场演讲中,商汤科技联合创始人、西安电子科技大学客座教授、元罗卜智能科技有限公司总裁马堃为我们带来了《AI应用在家庭中的演进与
2023-12-01 19:06:00
更多关于财经的资讯:
重庆三峡医学中心一期项目门诊试运行暨诺贝尔奖工作站一期正式启用!
10月31日,由中建三局数字工程公司建设的重庆三峡医学中心一期项目门诊试运行暨诺贝尔奖工作站一期正式启用,为项目后续竣工移交打下坚实基础
2025-11-04 11:44:00
中建一局二公司辽宁分公司举行体重管理年“活力健步走,趣味运动会”活动
近日,为积极响应中建一局二公司“活力健康节”暨“体重管理年”活动号召,辽宁分公司工会联合团委组织开展“活力健步走,趣味运动会”活动
2025-11-04 11:44:00
南京银行江北新区分行辖内高新开发区支行:锚定“金融+生物医药”服务定位, 打造全生命周期服务模式
早在2016年,南京银行江北新区分行辖内高新开发区支行便扎根于南京生物医药谷园区。九年来,高新开发区支行始终锚定“金融+生物医药”服务定位
2025-11-04 10:58:00
九州通等在辽宁新设供应链管理公司
近日,辽宁九州通供应链管理有限公司成立,法定代表人为刘兰芳,注册资本2000万人民币,经营范围包括供应链管理服务、货物进出口
2025-11-04 10:24:00
T3出行在大理成立领行智享科技公司
近日,大理领行智享科技有限公司成立,法定代表人为刘思远,经营范围包括网络预约出租汽车经营服务、互联网信息服务、第二类增值电信业务等。企查查股权穿透显示,该公司由T3出行关联公司南
2025-11-04 10:24:00
腾讯在海南成立阅漫网络科技新公司
近日,海南阅漫网络科技有限公司成立,法定代表人为杨沾,经营范围含网络文化经营、广播电视节目制作经营、人工智能硬件销售、动漫游戏开发等。企查查股权穿透显示,该公司由腾讯关联公司海南
2025-11-04 10:24:00
国祥控股成立智能机器人公司
近日,浙江国祥智能机器人有限公司成立,法定代表人为朱光全,注册资本3000万人民币,经营范围包括智能机器人的研发、工业机器人制造、智能机器人销售、机电耦合系统研发等。企查查股权穿
2025-11-04 10:24:00
三花智控新设商用制冷部件贸易公司
近日,浙江三花商用制冷部件贸易有限公司成立,法定代表人为陈雨忠,注册资本2000万人民币,经营范围包括制冷、空调设备销售
2025-11-04 10:24:00
平高电气在河南成立智慧高压电器公司
近日,平高电气智慧高压电器(河南)有限公司成立,经营范围包含:输配电及控制设备制造;配电开关控制设备研发;配电开关控制设备制造;配电开关控制设备销售等。企查查股权穿透显示,该公司
2025-11-04 10:24:00
“镜头里的河南”看见不一样的河南!
大河网讯 当千年洛邑古城的飞檐斗拱遇上vivo X300系列的蔡司影像黑科技,一场“用镜头解码中原文明”的文化盛宴正以磅礴之势席卷洛阳
2025-11-03 15:12:00
建行驻村帮扶工作队绘就乡村振兴新画卷
大河网讯 自建行河南省分行定点帮扶三陈村以来,建行驻村帮扶工作队深入一线、精准施策,积极对接国家乡村振兴政策和地方发展规划
2025-11-03 15:12:00
屈长云获批出任阳光财险青岛分公司总经理助理
10月31日,国家金融监督管理总局青岛监管局发布关于屈长云阳光财产保险股份有限公司青岛分公司总经理助理任职资格的批复,核准屈长云阳光财产保险股份有限公司青岛分公司总经理助理的任职
2025-11-03 15:20:00
刘栋获批担任中国民生银行张家口分行行长
11月3日,张家口金融监管分局发布关于刘栋中国民生银行张家口分行行长任职资格的批复,核准刘栋中国民生银行张家口分行行长的任职资格。
2025-11-03 15:21:00
工商银行、建设银行:暂停受理这项业务
11月3日,工商银行发布公告,表示受宏观政策影响,根据工行风险管理要求,自2025年11月3日起,工行暂停受理如意金积存业务的开户
2025-11-03 15:28:00
未经批准擅自取水,唐山松汀钢铁被罚7.5万元
据信用河北官网公开信息,近日,因未经批准擅自取水,唐山松汀钢铁有限公司(以下简称“唐山松汀钢铁”)被迁安市水利局罚款7
2025-11-03 15:29:00