两层结构:模型家族加终端 Agent
Qwen Coder 实际包含两层东西,选型时要分开看。第一层是开放权重的代码模型家族,从 0.5B 的小模型一路到 480B 的大模型,权重公开发布,可以自己部署也可以调用托管接口。第二层是 Qwen Code,官方仓库自述为「为你终端、编辑器、桌面、浏览器和聊天准备的编程 Agent」,开源框架与开源模型一起演进。两层的关系是:模型提供代码能力,Agent 提供干活的手脚——读文件、跑命令、改代码、提交改动。
产品情报 / 编程大模型与编码 Agent
Qwen CoderQwen Coder 是阿里千问团队的编程模型家族,覆盖 0.5B 到 480B 参数的多个尺寸;最新一代 Qwen3-Coder-Next 以 80B 总参数、3B 激活参数支持 256K 原生上下文,并配套开源的 Qwen Code 终端编程 Agent。

深度介绍
Qwen Coder 实际包含两层东西,选型时要分开看。第一层是开放权重的代码模型家族,从 0.5B 的小模型一路到 480B 的大模型,权重公开发布,可以自己部署也可以调用托管接口。第二层是 Qwen Code,官方仓库自述为「为你终端、编辑器、桌面、浏览器和聊天准备的编程 Agent」,开源框架与开源模型一起演进。两层的关系是:模型提供代码能力,Agent 提供干活的手脚——读文件、跑命令、改代码、提交改动。
按官方权重页的发布时间,这条线大致分三代。早期是 Qwen2.5-Coder 系列,尺寸有 0.5B、1.5B、3B、7B、14B、32B,多数带 Instruct 版本与量化版本,是本地跑代码补全最常用的一批。随后是 Qwen3-Coder,包含 480B 总参数、35B 激活参数的大尺寸版本,以及 30B 总参数、3B 激活参数的轻量版本。最新一代是 Qwen3-Coder-Next,2026 年 1 月底上线权重,并配套发布了技术报告。
官方模型卡给出的规格是:总参数 80B、激活参数 3B,隐藏维度 2048,48 层,采用混合布局——每三层「门控 DeltaNet 加专家层」之后接一层「门控注意力加专家层」;专家层共 512 个专家、每次激活 10 个,另有 1 个共享专家。原生上下文 262,144 个 token,官方说明可以用 YaRN 扩展到 100 万 token,面向仓库级理解。这个模型只走非思考模式,不再输出思考块。官方把它训练中的重点放在长程推理、复杂工具调用和执行失败后的恢复上。
官方仓库把它概括为「开箱即用」——自动记忆、自动技能、子 Agent、Agent 团队与 MCP 都在里面,不需要先搭一套工作流。模型接入上它不绑定单一来源:既支持多家厂商的接口,也能接第三方服务商或本地模型(配合本地推理框架),并且可以在运行中切换。官方还强调这款 Agent 正在「自己迭代自己」:用它自己的 Agent 与模型去提议题、提合并请求、评审代码和跑测试。安装方式包括一行安装脚本、npm 包与 Homebrew,Windows 也提供 PowerShell 安装脚本。
官方文档把使用界面分成五类:终端里直接跑命令行;桌面端提供 macOS、Windows 与 Linux 安装包;网页界面用一条 serve 命令在浏览器里打开(官方标注为实验特性);编辑器侧提供 VS Code、Zed 与 JetBrains 的集成;聊天侧可以接进 Telegram、微信、钉钉、企业微信、飞书与 QQ 机器人,再启动通道即可远程派活。此外还有无头模式,用一条命令行参数就能在脚本与持续集成里调用,以及 TypeScript、Python 与 Java 三套 SDK 和以 HTTP 加服务端事件推送的守护进程模式。
文档中与生产相关的条目相当多:审批模式决定哪些操作需要先确认,沙箱限制文件系统与命令的影响范围,信任文件夹划定 Agent 可以自由活动的目录;MCP 用来接外部工具,LSP 让 Agent 获得语言服务信息;规则与记忆提供长期约定,钩子与插件提供扩展点,定时任务与目标模式让它可以按计划推进多步工作;工作树支持在隔离的代码副本上并行作业。上下文成本上还有两项专门优化——token 缓存与常驻上下文的开销控制。
权重开放意味着可以完全跑在自己的机器上。官方模型卡给出的推理路径是:用 SGLang(0.5.8 及以上)或 vLLM(0.15.0 及以上)起一个兼容主流协议的服务端点,并指定配套的工具调用解析器;默认上下文 256K,启动失败时官方建议降到 32768 这类较小值。本地应用侧,多家推理工具已经支持 Qwen3 系列。官方推荐的采样参数是温度 1.0、top_p 0.95、top_k 40。需要提醒的是,这类模型对显存要求不低,官方也明确给出了遇到内存不足时缩短上下文的建议。
权重与框架都在宽松开源许可之下:Qwen3-Coder-Next 的模型卡标注为 Apache-2.0,Qwen Code 仓库同样是 Apache-2.0,核验时约 2.8 万星标、3,000 多个分支。不想自己部署的可以用官方订阅方案:个人版分四档,每月 6 到 68 美元(限时价),按 7 天为一个窗口发放 2,500 到 40,000 积分,积分不够可以单独买加油包;团队版按席位计,每席位每月 20 到 200 美元,对应每月 25,000 到 250,000 积分,没有按周的频率限制,官方承诺团队版数据不用于模型训练。
产品特点
两层都开源是这条线最实际的区别:模型权重按 Apache-2.0 发布,可以自建服务、微调或离线内网运行;配套的 Qwen Code 仓库也是同一许可。对担心供应商锁定或数据外流的团队,这意味着整条链路都能自己掌控。
官方把 Qwen3-Coder-Next 的重点放在效率上:80B 总参数里每次只激活 3B,官方称在代理式编程等任务上达到了激活参数多十倍到二十倍模型的水平。参数少意味着单机或小规模集群就能部署,长期跑 Agent 的推理成本会低不少。
终端、桌面应用、网页、编辑器插件与聊天工具共用同一套 Agent 与配置,在终端里定下的规则、记忆和技能可以带到编辑器与手机聊天窗口里,不需要为每个界面重新培养一个助手。
官方订阅方案用统一积分覆盖文本、图像、视频与语音模型,也覆盖网页搜索与代码解释器这类工具,并且兼容两套主流的模型调用协议——任何支持自定义服务地址与密钥的第三方工具都能接进来共用这份额度。
最近动态
官方文档的更新日志按周发布,九月的三条分别是:九月十七日加入把任务交给外部编码客户端的能力、支持按名字运行工作流并设置 token 上限、为目标模式加上轮次与时间限制;九月十日加入工作流运行回看、把计划模式与免确认模式配对使用,以及群聊里的多任务并行;九月三日则延续同一节奏。这种每周一更的频率说明项目仍在快速迭代,选型时值得定期回看更新记录。
这一代模型在一月底上线权重,官方给出的定位是「推动小型混合模型在智能体编程上的边界」:基于 80B 总参数、3B 激活参数的混合注意力与专家混合架构,用大规模可执行任务合成、环境交互与强化学习做代理式训练,官方称在智能体编程与浏览器使用等任务上取得了与体量大得多的闭源模型相当的结果,并适配多种终端与编辑器客户端的调用模板。技术报告与博客同期发布。
权重发布后很快补齐了部署所需的变体:低精度版本与基础版本在二月初上线,随后又放出了适配本地推理工具的量化格式。对想在自己机器上跑的人来说,这一步比模型本身更关键——它决定了多少显存能跑起来、能开多长的上下文,也决定了能不能在没有外网的环境里部署。
Qwen Coder 是阿里千问团队的编程模型家族,同时配套一个开源的终端编程 Agent。选型时要分成两层看:第一层是开放权重的代码模型,从 0.5B 一直覆盖到 480B;第二层是 Qwen Code,官方自述为「为终端、编辑器、桌面、浏览器和聊天准备的编程 Agent」,框架与模型一起开源演进。 模型谱系大致分三代。早期是 Qwen2.5-Coder,尺寸有 0.5B、1.5B、3B、7B、14B、32B,多数提供指令微调版与量化版,是本地代码补全最常用的一批。接着是 Qwen3-Coder,包含 480B 总参数、35B 激活参数的大尺寸版本,以及 30B 总参数、3B 激活参数的轻量版本。最新一代 Qwen3-Coder-Next 于 2026 年 1 月底上线权重:总参数 80B、激活参数 3B,隐藏维度 2048,48 层,采用混合布局——每三层「门控 DeltaNet 加专家层」接一层「门控注意力加专家层」,专家层共 512 个专家、每次激活 10 个加 1 个共享专家;原生上下文 262,144 个 token,官方称可用 YaRN 扩展到 100 万 token,面向仓库级理解,并且只走非思考模式。官方把训练重点放在长程推理、复杂工具调用与执行失败后的恢复上。 Qwen Code 强调开箱即用:自动记忆、自动技能、子 Agent、Agent 团队与 MCP 都内置,模型接入不绑定单一来源,可接多家厂商接口或本地模型并运行中切换。使用界面分五类——终端命令行、桌面应用、浏览器界面(官方标注实验特性)、VS Code 与 Zed 与 JetBrains 编辑器集成、以及 Telegram 与微信与钉钉与企业微信与飞书与 QQ 的聊天通道;另有脚本与持续集成用的无头模式、TypeScript 与 Python 与 Java 三套 SDK,以及基于 HTTP 与服务端事件推送的守护进程模式。工程侧提供审批模式、沙箱、信任文件夹、语言服务协议、规则与记忆、钩子与插件、定时任务与目标模式、工作树隔离,以及 token 缓存与常驻上下文成本控制。 部署路径上,官方建议用 SGLang 或 vLLM 起兼容主流协议的服务端点并指定配套的工具调用解析器,默认上下文 256K、失败时可降到 32768;官方推荐采样参数为温度 1.0、top_p 0.95、top_k 40。授权方面,模型权重与 Qwen Code 仓库都是 Apache-2.0。官方订阅方案分个人版与团队版:个人版每月 6 到 68 美元(限时价),以 7 天为窗口发放 2,500 到 40,000 积分,可另购加油包;团队版每席位每月 20 到 200 美元,对应每月 25,000 到 250,000 积分,无按周限制,并承诺数据不用于训练。
核验信息
本页事实来自官方渠道:Qwen 官网与 Qwen Chat、Qwen Code 官方文档与每周更新日志(五类使用界面、无头模式与三套 SDK 与守护进程、审批模式与沙箱与信任文件夹与语言服务协议与扩展点、token 缓存与常驻上下文成本控制、九月三条周更内容)、Qwen Code 官方仓库(开箱即用能力清单、模型接入方式、自迭代说明、安装方式与许可与星标数)、Qwen3-Coder 官方仓库(模型谱系与关键特性、256K 原生上下文与 YaRN 扩展)、Qwen3-Coder-Next 模型卡(参数规模与混合布局与专家数、上下文长度、非思考模式、推理引擎版本与工具调用解析器、推荐采样参数、许可),以及官方订阅方案文档的档位与积分条款。页内未列出官方文档与界面里出现的第三方品牌与模型名称。价格与状态核验于 2026 年 9 月 22 日。
Qwen Coder介绍页面对您是否有帮助?