Qwen3(通义千问)
Qwen3 是阿里云通义千问团队的开源大模型系列,2025 年 5 月正式发布全系列,2026 年 8 月再次更新 Qwen3.8 系列(含 27B / Max 等规格)。Qwen3 是当前最强、覆盖规格最全的开源模型家族之一,从 0.6B 端侧到 235B / Max 云端一次性开放,Apache 2.0 协议全栈开源,并提供 /think 思考模式开关。
一、公司速览
阿里云通义千问
- 团队归属:阿里巴巴集团 · 阿里云
- 品牌:通义千问 / Qwen / Tongyi Qianwen
- 官网:qwen.alibaba.com / tongyi.aliyun.com
- 定位:阿里自研通用大模型系列,主打开源 + 全规格
- 国际品牌:Qwen(海外开发者熟悉度最高的中国模型之一)
核心方向
- 全规格开源:从 0.6B 端侧模型到 235B / Max 云端模型,覆盖所有部署场景
- Apache 2.0 协议:最宽松的开源协议之一
- 多模态全栈:文本、视觉、音频、代码、数学模型都有
- 国际开发者友好:Hugging Face + ModelScope 双发布,文档英文优先
二、产品矩阵
模型层(Qwen3 系列)
Qwen3 系列在 2025 年 5 月一次性发布完整矩阵,2026 年 8 月升级到 Qwen3.8 系列。
Qwen3 通用语言模型
| 模型 | 参数 | 定位 |
|---|---|---|
| Qwen3-0.6B | 0.6B | 端侧 / 嵌入式 |
| Qwen3-1.7B | 1.7B | 端侧 / 轻量 |
| Qwen3-4B | 4B | 边缘 / 低资源 |
| Qwen3-8B | 8B | 单卡可跑 |
| Qwen3-14B | 14B | 中等规模 |
| Qwen3-32B | 32B | 高质量 |
| Qwen3-235B | 235B(激活 22B) | 旗舰 MoE |
| Qwen3-Max | 未公开(推测 > 1T) | 顶级旗舰 来源 |
Qwen3.8 系列(2026-08 最新)
衍生模型
- Qwen3-VL:视觉语言模型
- Qwen3-Coder:代码专精模型
- QwQ:推理专精模型(思考模式)
- QVQ:视觉推理模型
产品层
| 产品 | 定位 |
|---|---|
| 通义千问 App | C 端对话产品 |
| 阿里云百炼平台 | B 端 API(兼容 OpenAI 协议)来源 |
| ModelScope | 国内开源社区 |
| Hugging Face | 海外开源发布 |
三、Qwen3 核心特性
3.1 全规格覆盖(业内最全)
Qwen3 是当前覆盖规格最全的开源模型家族——从 0.6B 端侧到 235B MoE 旗舰一次性发布 来源。
| 场景 | 推荐规格 |
|---|---|
| 手机 / 嵌入式 | 0.6B - 4B |
| 笔记本 / 单卡 | 8B - 14B |
| 工作站 | 32B - 72B |
| 数据中心 | 235B / Max |
3.2 双 MoE 模型「越级挑战」
Qwen3 系列有 两个 MoE 模型(30B-A3B / 235B-A22B),激活参数远小于总参数,实际推理成本接近小模型,能力却对标大模型来源。
这是 Qwen3 最重要的差异化之一——让中小企业也能跑得起大模型。
3.3 /think 思考模式开关
Qwen3 系列提供 /think 思考模式开关——一个模型既是普通对话模型,又能切换成深度思考模式 来源。
- /think 模式:进入深度推理,类似 OpenAI o1
- 非 /think 模式:常规快速对话,类似 GPT-4o
这是 Qwen3 独有的差异化——其他模型家族没有这种开关。
3.4 Apache 2.0 协议
Qwen3 全系列采用 Apache 2.0 协议——最宽松的开源协议之一 来源。
| 协议 | 商用 | 修改 | 分发 | 私有使用 |
|---|---|---|---|---|
| Apache 2.0 | ✅ | ✅ | ✅ | ✅ |
| 限制 | 需要保留版权声明和许可证副本 |
比 MIT 略严格,但仍然非常宽松。
3.5 多语言能力
Qwen3 在多语言支持上是国产模型最强的——支持 119 种语言,远超其他国产模型 来源。
四、能力评测
4.1 主要榜单
Qwen3 在多个国际权威榜单上取得 全球开源冠军、国产模型冠军来源:
| 榜单 | Qwen3 表现 |
|---|---|
| LiveBench | 全球开源冠军 |
| LiveCodeBench | 全球开源冠军 |
| SuperClue | 国产模型冠军 |
| Artificial Analysis | 全球开源冠军 |
4.2 Qwen3.8-Max 价格优势
国际价格:$2.0/百万输入 / $6.0/百万输出——约为 Claude Opus 5 的 40% 与 24% 来源。
国内价格:缓存命中输入只要 1.5 元/百万 tokens。
意义:Qwen3.8-Max 是当前顶级旗舰里价格最低的之一。
4.3 与国内主流模型对比
| 模型 | 公司 | 上下文 | 开源 | 价格 | 思考模式 |
|---|---|---|---|---|---|
| Qwen3-Max | 阿里 | 长 | ✅ Apache 2.0 | 最低 | ✅ |
| M3 | MiniMax | 1M | ✅ | 中等 | ❌ |
| GLM-5.3 | 智谱 | 中长 | ✅ MIT | 中等 | ❌ |
| Kimi K3 | 月之暗面 | 4M | ✅ | 较高 | ❌ |
| DeepSeek V4 | DeepSeek | 1M | ✅ MIT | 低 | ❌ |
Qwen3 的独特优势:唯一开源 + Apache 2.0 + 全规格 + /think 开关 + 最低价的旗舰组合。
五、技术亮点
5.1 MoE 架构创新
Qwen3 的两个 MoE 模型(30B-A3B / 235B-A22B):
- 激活参数仅 3B / 22B——单次推理算力可控
- 总参数 30B / 235B——能力对标大模型
- 推理成本接近 3B / 22B 密集模型
5.2 /think 切换机制
Qwen3 的 /think 模式不是简单的 prompt 拼接,而是模型内部做了专门的训练优化:
- 训练数据中包含思考过程
- 推理时通过特殊 token 触发
- 比 OpenAI o1 的 API 调用方式更灵活(用户可自由切换)
5.3 Qwen3.8 新特性(2026-08)
六、商业策略
6.1 价格策略
- 国际:$2.0 输入 / $6.0 输出(百万 token)
- 国内:1.5 元/百万输入(缓存命中)
- 对标 Claude Opus 5:40% 与 24% 来源
- 对标国内:低于 DeepSeek V4(DeepSeek 走极致低价路线)
6.2 双渠道分发
| 渠道 | 用户 |
|---|---|
| Hugging Face | 海外开发者 |
| ModelScope | 国内开发者 |
| 阿里云百炼 | 企业 API 用户 |
6.3 开源 + 商业双轨
- 开源:Apache 2.0 全规格权重
- 商业:阿里云 API 调用、企业级 SLA、专属支持
七、国内大模型横向对标
| 模型 | 公司 | 上下文 | 开源协议 | 价格 | 旗舰规格 | 思考模式 |
|---|---|---|---|---|---|---|
| Qwen3-Max | 阿里 | 长 | Apache 2.0 | 最低 | 顶级 | ✅ |
| M3 | MiniMax | 1M | 开源 | 中等 | 顶级 | ❌ |
| GLM-5.3 | 智谱 | 中长 | MIT | 中等 | 顶级 | ❌ |
| Kimi K3 | 月之暗面 | 4M | 自定义 | 较高 | 顶级 | ❌ |
| DeepSeek V4 | DeepSeek | 1M | MIT | 低 | 顶级 | ❌ |
Qwen3 的独特卖点:
- Apache 2.0 协议最宽松
- 全规格覆盖(0.6B 到 Max)
- /think 开关独家
- 价格最低
- 多语言 119 种
八、适合什么样的使用者
推荐用 Qwen3 的场景
- ✅ 本地私有部署:Apache 2.0 最自由
- ✅ 需要 100+ 语言支持:Qwen3 多语言最强
- ✅ 端侧 AI 应用:0.6B / 1.7B 嵌入式友好
- ✅ 成本敏感应用:价格最低
- ✅ 需要 /think 切换:思考模式灵活
- ✅ 企业多场景部署:全规格覆盖
不太推荐用 Qwen3 的场景
- ❌ 需要 1M+ 超长上下文:Kimi K3 的 4M 更大
- ❌ 极致安全研究:GLM-5.3 在 ExploitGym 领先
- ❌ 顶级代码生成 + 长上下文:M3 / K3 在 Frontend Arena 略胜
九、常见问题
Q1:Qwen3 和 Qwen2.5 怎么选?
- Qwen3:当前最新版,全新架构
- Qwen2.5:上一代,性能略低但稳定
- 全新项目推荐 Qwen3
Q2:Qwen3-Max 和 Qwen3-235B 怎么选?
- Max:顶级旗舰,能力最强,价格也是 Qwen3 家族最高
- 235B:次旗舰 MoE,激活 22B,性价比突出
- 预算充足选 Max,预算敏感选 235B
Q3:Qwen3 的 /think 模式怎么用?
通过 prompt 中的特殊标记开启。例如在 system prompt 中加入 /think 触发深度推理,或在用户消息中明确要求”先思考再回答”。
Q4:Qwen3 商用需要付费吗?
不需要。Apache 2.0 协议允许商用,但需要保留版权声明和许可证副本。
但如果你用阿里云 API(百炼平台),那是按调用付费的——和开源不冲突。
Q5:Qwen3 在国内合规吗?
是的。Qwen3 通过国内备案,可在阿里云百炼平台合规调用 来源。
十、延伸阅读
官方资源
第三方分析
相关笔记
- 阿里云百炼 - 阿里云大模型服务平台
- DeepSeek V4 - 国内开源大模型另一极
十一、一句话总结
Qwen3 是 2026 年中国开源大模型里”全规格 + 全协议 + 全语言”维度的标杆——0.6B 到 Max 全栈、Apache 2.0 最宽松协议、119 种语言、/think 思考开关、顶级旗舰里最低价格。如果你需要本地私有部署、多语言支持、全场景覆盖、最宽松商用协议,Qwen3 是当前最值得认真考虑的国产开源模型家族。
Coding Plan(AI 编码套餐)
阿里云百炼的 Coding Plan 是固定月费的 AI 编码套餐,整合千问、GLM、Kimi、MiniMax 等模型,兼容 Qwen Code、Claude Code、Cline、OpenClaw 等主流 AI 编程工具(2026-09 官方文档)。
- 固定月费、月度请求额度,成本可控,无按量扣费风险
- 必须使用 Coding Plan 专属 Base URL 和 API Key(编程端点为 coding.dashscope.aliyuncs.com 下的 Anthropic 协议地址);专属 Key 配标准端点会报「invalid access token or token expired」