Apache-2.0MoEQwen开源推理 开源模型

Qwen3-235B-A22B 235B-A22B

Qwen3-235B系列 · 阿里巴巴通义千问 · 2025-04发布

开源支持本地部署国内可直连有免费额度长上下文代码专用

模型介绍

Qwen3-235B-A22B 是阿里开源旗舰 MoE 模型,总参数 235B、激活仅 22B,混合推理能力出色,Apache-2.0 开源可商用,仅需 4 张 H20 即可部署。

模型基础信息

模型系列Qwen3-235B系列
开发机构阿里巴巴通义千问
发布时间2025-04
参数规模235B MoE(22B 激活)
上下文窗口128K
模型类型文本
中文能力优秀
使用方式网页体验 / API调用 / 本地部署

免费额度与收费政策

免费开源 免费额度 按量

免费规则详情

模型权重 Apache-2.0 开源;百炼平台新用户有免费额度。

收费标准简介

百炼平台 API 按 token 计费(以官方价格页为准)。

模型能力介绍

✅ 核心优势

  • 混合推理(思考/非思考)
  • 仅 4 张 H20 即可部署
  • pache-2.0 可商用
  • 119+ 语�

⚠️ 短板与局限

  • MoE 部署仍需较高显存
  • 无原生多模态
  • 本地推理延迟较高

🎯 适用场景

  • 私有化部署
  • 推理与 Agent 任务
  • 多语言场景
  • 成本敏感业务

模型使用教程

本章节整理 Qwen3-235B-A22B 的在线体验、API调用、本地部署全套入门教程,快速上手使用该模型。

Qwen3-235B-A22B 是阿里开源的旗舰 MoE 模型,总参数 235B、激活仅 22B,支持思考/非思考双模式。

  • 网页体验:通义 App / chat.qwen.ai。
  • API 调用:阿里云百炼平台。
  • 本地部署:Apache-2.0 开源,仅需 4 张 H20 可部署。
  1. 注册阿里云并开通百炼 Model Studio。
  2. 创建 API Key。
  3. 国内直连。
from openai import OpenAI
client = OpenAI(base_url="https://dashscope.aliyuncs.com/compatible-mode/v1", api_key="YOUR_KEY")
res = client.chat.completions.create(
    model="qwen3-235b-a22b",
    messages=[{"role": "user", "content": "解释量子计算"}])
print(res.choices[0].message.content)
pip install vllm
vllm serve Qwen/Qwen3-235B-A22B-Instruct --tensor-parallel-size 4
# 4 张 H20 即可满血部署

💡 使用小技巧

本地部署成本控制极佳,4 张 H20 即可满血运行。

❓ 常见问题 FAQ

Q1:Qwen3-235B 部署门槛如何?

A1:4 张 H20 显卡即可满血部署,显存约为同类三分之一。

Q2:支持什么模式?

A2:支持思考与非思考双模式切换。

访问备注与注意事项