• 我的订阅
  • 科技

通义千问系列AI开源模型升至Qwen2:5个尺寸,最高 128K tokens

类别:科技 发布时间:2024-06-07 09:32:00 来源:IT之家

IT之家 6 月 7 日消息,通义千问(Qwen)今天宣布经过数月的努力,Qwen 系列模型从 Qwen1.5 到 Qwen2 的重大升级,并已在 Hugging Face 和 ModelScope 上同步开源。

通义千问系列AI开源模型升至Qwen2:5个尺寸,最高 128K tokens

IT之家附上 Qwen 2.0 主要内容如下:

5 个尺寸的预训练和指令微调模型,包括 Qwen2-0.5B、Qwen2-1.5B、Qwen2-7B、Qwen2-57B-A14B 以及 Qwen2-72B

在中文英语的基础上,训练数据中增加了 27 种语言相关的高质量数据;

多个评测基准上的领先表现;

代码和数学能力显著提升;

增大了上下文长度支持,最高达到 128K tokens(Qwen2-72B-Instruct)。

模型基础信息

Qwen2 系列包含 5 个尺寸的预训练和指令微调模型,其中包括 Qwen2-0.5B、Qwen2-1.5B、Qwen2-7B、Qwen2-57B-A14B 和 Qwen2-72B。

模型 Qwen2-0.5BQwen2-1.5BQwen2-7BQwen2-57B-A14BQwen2-72B 参数量 0.49B1.54B7.07B57.41B72.71B 非 Embedding 参数量 0.35B1.31B5.98B56.32B70.21BGQATrueTrueTrueTrueTrueTie EmbeddingTrueTrueFalseFalseFalse 上下文长度 32K32K128K64K128K

在 Qwen1.5 系列中,只有 32B 和 110B 的模型使用了 GQA。这一次,所有尺寸的模型都使用了 GQA,以便让大家体验到 GQA 带来的推理加速和显存占用降低的优势。

模型评测

相比 Qwen1.5,Qwen2 在大规模模型实现了非常大幅度的效果提升。我们对 Qwen2-72B 进行了全方位的评测。

在针对预训练语言模型的评估中,对比当前最优的开源模型,Qwen2-72B 在包括自然语言理解、知识、代码、数学及多语言等多项能力上均显著超越当前领先的模型,如 Llama-3-70B 以及 Qwen1.5 最大的模型 Qwen1.5-110B。

通义千问系列AI开源模型升至Qwen2:5个尺寸,最高 128K tokens

通义千问系列AI开源模型升至Qwen2:5个尺寸,最高 128K tokens

通义千问系列AI开源模型升至Qwen2:5个尺寸,最高 128K tokens

通义千问系列AI开源模型升至Qwen2:5个尺寸,最高 128K tokens

以上内容为资讯信息快照,由td.fyun.cc爬虫进行采集并收录,本站未对信息做任何修改,信息内容不代表本站立场。

快照生成时间:2024-06-07 12:45:27

本站信息快照查询为非营利公共服务,如有侵权请联系我们进行删除。

信息原文地址:

阿里云通义千问开源!70亿参数模型上线魔搭社区
...等多种语言的基座模型,在超过2万亿token数据集上训练,上下文窗口长度达到8k。Qwen-7B-Chat是基于基座模型的中英文对话模型
2023-08-03 17:00:00
Kimi爆火背后:访问量仅次于文心一言和阿里通义,国内外大模型都在卷上下文
...款面向C端的大模型产品。早前,该公司宣布在大模型长上下文窗口技术上取得新的突破,Kimi已支持200万字超长无损上下文,并开启产品内测,该能力在不到半年内提升9倍。市场的火爆
2024-03-23 14:00:00
阿里Qwen3登顶全球最强开源模型,用8款模型夺回中国AI话语权
...代码开发复杂度。此外,模型还支持最近火热的MCP(模型上下文协议),用户可以调用内置工具或自行集成其他工具。 此前,阿里云已推出MCP服务,并提出要做Agent Store
2025-04-29 16:17:00
阿里通义开源模型Qwen2.5力压Claude3.5、GPT-4o等顶级闭源模型
...Qwen2.5能够提供更为自然流畅的交互体验,这得益于其对上下文理解的深度把握以及对人类情感和意图的准确捕捉。可以说,在实现人机交互更加人性化方面,Qwen2.5迈出了坚实的
2024-10-31 09:47:00
Agent调用能力取得重大突破!阿里开源最强编程模型Qwen3-Coder
...码模型,总参数达480B,激活35B参数,原生支持256K token的上下文并可扩展至1M长度。Qwen3-Coder在代码占比70%的7
2025-07-23 14:05:00
AI“大姨”现场刁难智能客服!直击一群AI打PK赛,真能落地的那种
...个满足现在用户需求的智能客服。能理解用户问题、结合上下文给出解决办法,并且有情商、说人话、能面对各种复杂情景。而且上手门槛很低。 比如参赛选手云蝠智能,他们的主打业务是电话
2024-09-23 09:53:00
本文转自:新华网12月1日,阿里云通义千问720亿参数模型Qwen-72B宣布开源。该模型基于3T tokens高质量数据训练
2023-12-01 13:33:00
通义千问再放大招:720亿大模型开源,全尺寸赶上LLaMA-2,还有移动端可用的18亿模型
时隔一个月,通义千问又放大招了!在一个月前的阿里云栖大会上,阿里正式发布通义千问2.0版本,在复杂指令理解、文学创作、通用数学、知识记忆、幻觉抵御等能力上,都有较大提升。并且,阿
2023-12-01 21:07:00
始于安全,不止安全丨迪普科技AI基座解决方案发布
...编排引擎实现零代码工作流配置,集成动态知识图谱实现上下文智能增强,并采用模块化插件架构支持外部工具的无缝接入,形成从业务逻辑抽象到系统落地的自动化闭环的智能体基座。同时创新性
2025-03-13 10:45:00
更多关于科技的资讯:
拾亿圆赋能商业新想象,Eleven Homebar重塑年轻人轻社交
当城市的夜幕垂下,白天的喧嚣却并未沉寂,而是悄然转化为了另一种生机勃勃的形态。对于越来越多的年轻人而言,夜间已经成为生活的重要时段
2025-09-12 13:56:00
唐山港京唐港区首台智慧生态机器人上岗
河北新闻网讯(任小霞、王育民)9月8日,唐山港京唐港区矿石码头首台智慧生态机器人正式上岗。这台机器人具有灵敏感知、快速决策
2025-09-12 13:57:00
360联盟合作伙伴大会圆满落幕,共探AI时代广告联盟破界增长之道
随着AI技术在数字营销领域的深入应用,营销行业正朝着技术驱动、效率提升和生态协同的方向不断进化,也为行业参与者带来了更加多元的发展机遇
2025-09-12 13:57:00
河北新闻网讯(刘蕾、师源)9月10日,唐山高新区商务局举办“数智浪潮・无界跨境”唐山内转外专享外贸峰会,全市130余家意向“出海”企业参会
2025-09-12 13:57:00
北京大学医学博士陶勇教授携手Blueglass,推出联名护眼酸奶“叶黄素太空益生菌黑加仑益生菌含酸奶饮”
当眼科专家遇上健康食品创新,一场关于眼部健康的饮食革命正在悄然发生。北京大学医学博士陶勇教授与高端现制酸奶品牌Blueglass正式联手
2025-09-12 13:59:00
创作人的福音来了!微信公众号智能回复功能上线,还可以24小时在线陪聊
9月11日,微信派公众号发文称:微信公众号智能回复功能上线。在公众号 PC 端后台“互动管理”内点击“自动回复”,即可开启“智能回复”
2025-09-12 11:55:00
唐山百川机器人共享智能制造工厂通过“共享制造”模式,为京津冀中小企业提供非标零件加工、样机试制等一站式服务。该工厂拥有800台智能设备和千余名技术人员
2025-09-12 09:21:00
聚焦酒博会|共赴“佳酿之约”,酒博会“新朋友”为行业注入新活力
9月9日至13日,以“汇全球佳酿促开放合作”为主题的第十四届中国(贵州)国际酒类博览会在贵阳举行。本届盛会不仅汇聚了众多行业“老朋友”
2025-09-12 06:01:00
潍柴船舶动力新能源产品,大会现场批量签单!
9月9日-10日,作为我国航运领域最具影响力的行业盛会之一,内河航运高质量发展论坛(2025)在重庆举行。来自全国水运行业的200余家单位代表齐聚一堂
2025-09-12 07:05:00
南报网讯(记者张安琪)在2025江苏产学研合作对接大会主题大会上,长城企业战略研究所首次发布2025中国科创未来之星企业研究报告
2025-09-12 07:44:00
□南京日报/紫金山新闻记者黄琳燕清晨,老山脚下的养蜂基地里,蜂农按规范检查蜂群,采集的蜂王浆样本贴着专属溯源码;生产车间内
2025-09-12 07:44:00
2025江苏产学研合作对接大会成果、需求集中发布
9月11日,2025江苏产学研合作对接大会在南京国展中心开幕。在合作洽谈区域,各大企业、高校、科研院所的创新科技产品纷纷亮相
2025-09-12 07:45:00
从科幻到现实,脑机接口领域的“山海经”
工作人员正在对脑机接口产品进行研发、测试。南京日报/紫金山新闻记者 孙中元 摄将小鼠与设备连接,研究人员即可通过查看小鼠的脑电波数据
2025-09-12 07:45:00
□南京日报/紫金山新闻记者田诗雨李香君故居陈列馆创建独立女性品牌仅一个月,相关文创产品销售额同比增长788%;南京中国科举博物馆暑期推出“能喝的墨水”
2025-09-12 07:46:00
河北日报讯(见习记者康晓博)能够自动监控、及时预警的“两个半径”防机械伤害系统,可广泛应用在机场、火车站等人流密集区的智能环保电警摄像单元
2025-09-12 07:54:00