Core capabilities
- 30B 总参数 / 约 3B 激活 MoE
- 128K 上下文与按轮思考切换
- 多语言、代码、数学和工具能力
- 支持 llama.cpp、MLX 等本地运行时
Alibaba Qwen / open
仅激活约 3B 参数的高效 MoE 型号,兼顾本地部署、推理与智能体能力。
适合硬件预算有限但又希望保留混合推理、工具与多语言能力的团队。 Qwen3 30B-A3B 在 30B 总参数中每次激活约 3B,并采用 128 专家 MoE,提供 128K 上下文与混合思考,适合工作站级部署。
适合本地助手和轻量智能体。选择明确支持 Qwen3 MoE 与推理解析器的运行时,按全部权重加 KV Cache 规划内存,并为困难样本保留高阶模型回退。
本地运行体验取决于框架对 MoE、KV 缓存和推理解析器的支持。 3B 激活不代表任意 3B 运行环境都能承载;全部专家权重仍需存储和内存规划,MoE 与 KV Cache 支持是关键。
Specifications and positioning checked against provider documentation.
Open official source↗