Apache-2.0MoEQwen开源端侧 开源模型
Qwen3-30B-A3B 30B-A3B
Qwen3-30B系列 · 阿里巴巴通义千问 · 2025-04发布
模型介绍
Qwen3-30B-A3B 是阿里开源轻量 MoE 模型,总参数 30B、激活仅 3B,性能超越 QwQ-32B,Apache-2.0 可商用,消费级显卡即可本地部署。
模型基础信息
模型系列Qwen3-30B系列
开发机构阿里巴巴通义千问
发布时间2025-04
参数规模30B MoE(3B 激活)
上下文窗口128K
模型类型文本
中文能力优秀
使用方式网页体验 / API调用 / 本地部署
免费额度与收费政策
免费开源 免费额度 按量
免费规则详情
模型权重 Apache-2.0 开源;百炼平台有免费额度。
收费标准简介
百炼平台 API 按 token 计费(以官方价格页为准)。
模型能力介绍
✅ 核心优势
- 激活仅 3B 部署极省
- 性能超越 QwQ-32B
- pache-2.0 可商用
- 支持混合推理
⚠️ 短板与局限
- 绝对能力弱于 235B
- 无原生多模态
- 长文生成本地偏慢
🎯 适用场景
- 边缘与端侧部署
- 低成本推理
- 私有化场景
- gent 轻量任务
模型使用教程
本章节整理 Qwen3-30B-A3B 的在线体验、API调用、本地部署全套入门教程,快速上手使用该模型。
Qwen3-30B-A3B 是阿里开源的小型 MoE 模型,总参数 30B、激活仅 3B,部署成本极低。
- 网页体验:通义 App / chat.qwen.ai。
- API 调用:阿里云百炼。
- 本地部署:Apache-2.0 开源,消费级显卡即可运行。
- 注册阿里云并开通百炼。
- 创建 API Key。
- 国内直连。
from openai import OpenAI
client = OpenAI(base_url="https://dashscope.aliyuncs.com/compatible-mode/v1", api_key="YOUR_KEY")
res = client.chat.completions.create(
model="qwen3-30b-a3b",
messages=[{"role": "user", "content": "帮我写一段商品文案"}])
print(res.choices[0].message.content)
pip install vllm
vllm serve Qwen/Qwen3-30B-A3B-Instruct
# 单张 24G 显卡即可运行
💡 使用小技巧
端侧与低成本场景首选,单张 24G 显卡即可部署。
❓ 常见问题 FAQ
Q1:Qwen3-30B-A3B 部署简单吗?
A1:非常简单,单张消费级显卡即可运行。
Q2:性能如何?
A2:激活仅 3B 却超越 QwQ-32B。
访问备注与注意事项
- pache-2.0 可商用
- 适合端侧
Aitishiku.com