开源模型
通义 Qwen3-Coder-Next Coder-Next
Qwen3-Coder系列 · 阿里巴巴通义千问 · 2026-02发布
模型介绍
专为代码 Agent 与本地开发设计的开放权重模型,80B 总参 / 3B 激活 MoE,256K 原生上下文可扩展 1M,Agent 化编程能力强大,仅支持非思考模式。
模型基础信息
模型系列Qwen3-Coder系列
开发机构阿里巴巴通义千问
发布时间2026-02
参数规模80B(MoE,激活 3B)
上下文窗口256K(可扩展 1M)
模型类型文本(编程,非思考模式)
中文能力优秀
使用方式网页体验 / API调用 / 本地部署
免费额度与收费政策
开源权重免费
免费规则详情
权重在 Hugging Face / ModelScope 免费开源,自行部署。
收费标准简介
开源权重免费;算力自备。
模型能力介绍
✅ 核心优势
- 3B 激活,成本极低
- 256K→1M 长上下文
- gent 化编程能力强
- 提供 Instruct/Base/FP8/GGUF 多版本
⚠️ 短板与局限
- 仅非思考模式
- 极限推理弱于大模型
- 生态较新
🎯 适用场景
- 仓库级编程
- gent 工具调用
- 本地开发助手
- Vibe Coding
模型使用教程
本章节整理 通义 Qwen3-Coder-Next 的在线体验、API调用、本地部署全套入门教程,快速上手使用该模型。
- 体验网址:通过 [Qwen Code](https://github.com/QwenLM/qwen-code) 终端工具体验,或下载权重部署。
- 能力简介:专为代码 Agent 与本地开发设计的开放权重模型,基于 Qwen3-Next-80B-A3B-Base,256K 原生上下文可扩展至 1M,Agent 化编程能力强大。
- 适用场景:仓库级编程、Agent 工具调用、本地开发助手、Vibe Coding。
- 使用建议:仅支持非思考模式,输出不包含思考块;推荐配合 Qwen Code CLI。
- 开发接入:Hugging Face / ModelScope 下载,vLLM / SGLang / llama.cpp 部署。
- 访问 [Hugging Face](https://huggingface.co/Qwen/Qwen3-Coder-Next) 或 [ModelScope](https://modelscope.cn/models/Qwen/Qwen3-Coder-Next)。
- 官方提供 Instruct / Base / FP8 / GGUF 多版本,按需选择:
git lfs install
git clone https://huggingface.co/Qwen/Qwen3-Coder-Next-GGUF
- 可选安装 Qwen Code CLI:
pip install qwen-code。
启动服务
vllm serve Qwen/Qwen3-Coder-Next --served-model-name qwen3-coder-next
curl 调用
curl http://localhost:8000/v1/chat/completions \
-H "Content-Type: application/json" \
-d '{"model":"qwen3-coder-next","messages":[{"role":"user","content":"给这个函数补全单元测试"}],"tools":[{"type":"function","function":{"name":"run_tests","description":"运行测试"}}]}'
> 提示:模型支持工具调用与 Agent 循环,适合接入选代式编码流程。
- 部署方式:开源权重,支持 vLLM / SGLang / llama.cpp。
- 硬件要求:80B 总参 / 3B 激活 MoE,量化(FP8/GGUF)后消费级显卡可运行。
- 参考:官方 GitHub(QwenLM/Qwen3-Coder)提供完整部署与 Qwen Code 集成文档。
💡 使用小技巧
推荐配合 Qwen Code CLI;FP8/GGUF 量化后消费级显卡可运行。
❓ 常见问题 FAQ
Q1:支持思考模式吗?
A1:仅支持非思考模式,输出不含思考块。
Q2:单卡能跑吗?
A2:3B 激活,量化后可消费级显卡运行。
访问备注与注意事项
- 2026-02-03 发布,基于 Qwen3-Next-80B-A3B-Base
Aitishiku.com