开源模型

通义 Qwen3-Coder-Next Coder-Next

Qwen3-Coder系列 · 阿里巴巴通义千问 · 2026-02发布

开源支持本地部署国内可直连长上下文代码专用

模型介绍

专为代码 Agent 与本地开发设计的开放权重模型,80B 总参 / 3B 激活 MoE,256K 原生上下文可扩展 1M,Agent 化编程能力强大,仅支持非思考模式。

模型基础信息

模型系列Qwen3-Coder系列
开发机构阿里巴巴通义千问
发布时间2026-02
参数规模80B(MoE,激活 3B)
上下文窗口256K(可扩展 1M)
模型类型文本(编程,非思考模式)
中文能力优秀
使用方式网页体验 / API调用 / 本地部署

免费额度与收费政策

开源权重免费

免费规则详情

权重在 Hugging Face / ModelScope 免费开源,自行部署。

收费标准简介

开源权重免费;算力自备。

模型能力介绍

✅ 核心优势

  • 3B 激活,成本极低
  • 256K→1M 长上下文
  • gent 化编程能力强
  • 提供 Instruct/Base/FP8/GGUF 多版本

⚠️ 短板与局限

  • 仅非思考模式
  • 极限推理弱于大模型
  • 生态较新

🎯 适用场景

  • 仓库级编程
  • gent 工具调用
  • 本地开发助手
  • Vibe Coding

模型使用教程

本章节整理 通义 Qwen3-Coder-Next 的在线体验、API调用、本地部署全套入门教程,快速上手使用该模型。

  • 体验网址:通过 [Qwen Code](https://github.com/QwenLM/qwen-code) 终端工具体验,或下载权重部署。
  • 能力简介:专为代码 Agent 与本地开发设计的开放权重模型,基于 Qwen3-Next-80B-A3B-Base,256K 原生上下文可扩展至 1M,Agent 化编程能力强大。
  • 适用场景:仓库级编程、Agent 工具调用、本地开发助手、Vibe Coding。
  • 使用建议:仅支持非思考模式,输出不包含思考块;推荐配合 Qwen Code CLI。
  • 开发接入:Hugging Face / ModelScope 下载,vLLM / SGLang / llama.cpp 部署。
  1. 访问 [Hugging Face](https://huggingface.co/Qwen/Qwen3-Coder-Next) 或 [ModelScope](https://modelscope.cn/models/Qwen/Qwen3-Coder-Next)。
  2. 官方提供 Instruct / Base / FP8 / GGUF 多版本,按需选择:
git lfs install
git clone https://huggingface.co/Qwen/Qwen3-Coder-Next-GGUF
  1. 可选安装 Qwen Code CLI:pip install qwen-code

启动服务

vllm serve Qwen/Qwen3-Coder-Next --served-model-name qwen3-coder-next

curl 调用

curl http://localhost:8000/v1/chat/completions \
  -H "Content-Type: application/json" \
  -d '{"model":"qwen3-coder-next","messages":[{"role":"user","content":"给这个函数补全单元测试"}],"tools":[{"type":"function","function":{"name":"run_tests","description":"运行测试"}}]}'

> 提示:模型支持工具调用与 Agent 循环,适合接入选代式编码流程。

  • 部署方式:开源权重,支持 vLLM / SGLang / llama.cpp。
  • 硬件要求:80B 总参 / 3B 激活 MoE,量化(FP8/GGUF)后消费级显卡可运行。
  • 参考:官方 GitHub(QwenLM/Qwen3-Coder)提供完整部署与 Qwen Code 集成文档。

💡 使用小技巧

推荐配合 Qwen Code CLI;FP8/GGUF 量化后消费级显卡可运行。

❓ 常见问题 FAQ

Q1:支持思考模式吗?

A1:仅支持非思考模式,输出不含思考块。

Q2:单卡能跑吗?

A2:3B 激活,量化后可消费级显卡运行。

访问备注与注意事项