写点什么

通义千问重磅开源 Qwen2.5,下载量突破 4000 万

  • 2024-09-19
    北京
  • 本文字数:1240 字

    阅读完需:约 4 分钟

大小:684.54K时长:03:53
通义千问重磅开源Qwen2.5,下载量突破4000万

9 月 19 日云栖大会,阿里云 CTO 周靖人发布通义千问新一代开源模型 Qwen2.5。Qwen2.5 全系列涵盖多个尺寸的大语言模型、多模态模型、数学模型和代码模型,每个尺寸都有基础版本、指令跟随版本、量化版本,总计上架 100 多个模型。



Qwen2.5 全系列模型都在 18T tokens 数据上进行预训练,相比 Qwen2,整体性能提升 18%以上,拥有更多的知识、更强的编程和数学能力。Qwen2.5-72B 模型在 MMLU-rudex 基准(考察通用知识)、MBPP 基准(考察代码能力)和 MATH 基准(考察数学能力)的得分高达 86.8、88.2、83.1。


Qwen2.5 支持高达 128K 的上下文长度,可生成最多 8K 内容。模型拥有强大的多语言能力,支持中文、英文、法文、西班牙文、俄文、日文、越南文、阿拉伯文等 29 种以上语言。模型能够丝滑响应多样化的系统提示,实现角色扮演和聊天机器人等任务。在指令跟随、理解结构化数据(如表格)、生成结构化输出(尤其是 JSON)等方面 Qwen2.5 都进步明显。


语言模型方面,Qwen2.5 开源了 7 个尺寸,0.5B、1.5B、3B、7B、14B、32B、72B,它们在同等参数赛道都创造了佳绩,型号设定充分考虑下游场景的不同需求,3B 是适配手机等端侧设备的黄金尺寸;32B 是受开发者期待的“性价比之王”,可在性能和功耗之间获得最佳平衡,Qwen2.5-32B 的整体表现超越了 Qwen2-72B。


在 MMLU-redux 等十多个基准测评中,Qwen2.5-72B 表现超越 Llama3.1-405B


72B 是 Qwen2.5 系列的旗舰模型,其指令跟随版本 Qwen2.5-72B-Instruct 在 MMLU-redux、MATH、MBPP、LiveCodeBench、Arena-Hard、AlignBench、MT-Bench、MultiPL-E 等权威测评中表现出色,在多个核心任务上,以不到 1/5 的参数超越了拥有 4050 亿巨量参数的 Llama3.1-405B。


专项模型方面,用于编程的 Qwen2.5-Coder 和用于数学的 Qwen2.5-Math 都比前代有了实质性进步。Qwen2.5-Coder 在多达 5.5T tokens 的编程相关数据上作了训练,当天开源 1.5B 和 7B 版本,未来还将开源 32B 版本;Qwen2.5-Math 支持使用思维链和工具集成推理(TIR) 解决中英双语的数学题,本次开源了 1.5B、7B、72B 三个尺寸和一款数学奖励模型 Qwen2.5-Math-RM。


多模态模型方面,广受期待的视觉语言模型 Qwen2-VL-72B 正式开源,Qwen2-VL 能识别不同分辨率和长宽比的图片,理解 20 分钟以上长视频,具备自主操作手机和机器人的视觉智能体能力。日前权威测评 LMSYS Chatbot Arena Leaderboard 发布最新一期的视觉模型性能测评结果,Qwen2-VL-72B 成为全球得分最高的开源模型。


Qwen2-VL-72B 在__权威测评__LMSYS Chatbot Arena Leaderboard 成为成为全球得分最高的开源视觉理解模型


自从 2023 年 8 月开源以来,通义在全球开源大模型领域成为不少开发者尤其是中国开发者的首选模型。性能上,通义大模型多次登顶 Hugging Face 全球大模型榜单;生态上,通义从零起步、开疆拓土,与海内外的开源社区、生态伙伴、开发者共建生态网络,截至 2024 年 9 月中旬,通义千问开源模型下载量突破 4000 万,Qwen 系列衍生模型总数超过 5 万个,成为仅次于 Llama 的世界级模型群。


HuggingFace 数据显示,截至 9 月中旬 Qwen 系列原生模型和衍生模型总数超过 5 万个

2024-09-19 21:299060

评论

发布
暂无评论
发现更多内容

这个开源神器可快速帮你安装 MacOS 虚拟机!

JackTian

macos GitHub Linux 操作系统 虚拟机

算法:时间复杂度和空间复杂度

shirley

算法 时间复杂度

一文道尽 Excel 的 Criterion

张利东

Excel

spring-data-redis -- 一次执行链路的分析

常清静

Java spring springdataredis

Git 多用户多仓库配置 windows10

halapano

git

Kafka系列8:一网打尽常用脚本及配置,宜收藏落灰!

z小赵

大数据 kafka 实时计算

zabbix实战指南(1)

橙子冰

zabbix

ARTS - Week 1

Khirye

ARTS 打卡计划

游戏夜读 | 游戏代码之道

game1night

分支管理模式

wiflish

git

这么多年了,QQ没发现这个问题吗?

BabyKing

zabbix 实战指南(2)

橙子冰

zabbix

写给产品经理的信(3):抗压能力需要多强?

punkboy

生涯规划 产品经理 进阶 压力 工作方式

IDEA 插件开发实战

李孟聊AI

Java 工具 IDEA 插件 idea插件

奈学教育:分布式架构,刚性事务-2PC必须注意的问题及3PC详细解说

奈学教育

分布式架构 2PC 3PC

眼前搁座金山也看不见

池建强

搜索引擎 学习

在 Go 中使用并发编程 - 第一部分

TuringTuring

并发编程 线程模型 Go 语言

ES 操作之批量写-BulkProcessor 原理浅析

常清静

Java elasticsearch 后端

AutoConfigurationImportSelector到底怎么初始化

编号94530

Java spring Spring Boot import

ARTS week 1

锈蠢刀

重学 Java 设计模式:实战建造者模式

小傅哥

设计模式 小傅哥 重构 代码质量 优化代码

原创 | 使用JUnit、AssertJ和Mockito编写单元测试和实践TDD (九)测试驱动开发(TDD)

编程道与术

Java 编程 软件测试 TDD 单元测试

Linux 终端下记不住命令的使用方法?这个开源项目帮你解决。

JackTian

Linux 开源 运维 操作系统 命令

JavaScript 基础拾遗 —— this 的前世今生

hq

Java 学习 大前端

七年老程序员面试经历

代码诗人

团队快速扩张时期的组织架构演进

小鲸数据

团队管理 团队协作 团队 团队组织

回“疫”录(25):被颜色攻占的地方

小天同学

疫情 回忆录 现实纪录 纪实

变则通,通则久 —— 读《谁动了我的奶酪?》

YoungZY

读书 读书感悟

Oracle误删数据闪回

阡陌r

MySQL慢查询优化(线上案例调优)

NotFound9

MySQL 开源 架构 运维 编程语言

python实现·十大排序算法之堆排序(Heap Sort)

南风以南

Python 排序算法 堆排序

通义千问重磅开源Qwen2.5,下载量突破4000万_生成式 AI_华卫_InfoQ精选文章