2025 年 7 月,阿里巴巴上线 Qwen3-235B-A22B,这是 Qwen3 系列中参数规模最大的 MoE 模型,最高支持 256K 上下文。
核心参数
- 总参数:235B,激活参数 22B(MoE 架构)
- 上下文长度:最高 256K token
- 定位:长文档理解、代码仓库分析、多轮 Agent 对话等长上下文场景
为什么值得关注
256K 上下文意味着模型单次可以处理约 20-30 万字的中文文本(按 token 估算,实际以官方文档为准),对代码库级理解和长文档分析有实际意义。22B 激活参数意味着推理成本显著低于同量级稠密模型,这是 MoE 架构在部署侧的固有优势。
待核验的部分
- 官方发布了与 K2、DeepSeek、Claude 等模型的基准对比,但测试方法与复现路径尚未完全公开,结论应以独立实测为准。
- “256K"是最大窗口长度,实际可用长度受显存、推理框架和注意力实现影响,部署前建议用真实负载压测。


