
通用问答 · 代码开发
Qwen3.6-35B-NVFP4
支持单台 MegaCube 部署的 35B 多模态混合专家模型,采用 NVIDIA NVFP4 量化,适用于通用问答、文档理解、代码开发与智能体工具调用。
多模态理解文本、图像、视频 → 文本
01 / 模型介绍
模型架构与能力
Qwen3.6-35B-A3B 是通义千问的混合专家多模态模型,每次计算激活约 3B 参数。除了问答、写作和资料理解,官方也重点训练了代码与智能体能力,包括保留思考过程的多轮工具协作。NVIDIA NVFP4 版本通过低精度量化降低权重与计算资源需求。
- 发布方 / 量化方
- 阿里通义千问 / NVIDIA
- 完整模型名
- nvidia/Qwen3.6-35B-A3B-NVFP4
- 参数规模
- 35B 总参数;每 token 激活约 3B
- 架构
- 40 层混合注意力 MoE;256 个路由专家,每次选 8 个,另有 1 个共享专家
- 模型上下文
- 原生 262,144 tokens,可扩展至 1,010,000 tokens;实际服务长度取决于运行配置
- 输入 / 输出
- 文本、图像、视频输入;文本与工具调用输出
- 权重精度
- NVIDIA ModelOpt NVFP4
- 许可证
- Apache-2.0
02 / 适用场景
应用场景
日常问答与资料整理
围绕工作资料进行问答、提炼要点、撰写摘要,将长篇内容整理为清晰的结论。
代码生成、调试与修改
根据需求编写代码,解释现有逻辑,分析报错,并辅助完成代码修改。
图像理解与工具协作
理解图片和图表中的信息,结合文字进行分析,并通过工具调用完成多步骤任务。
规划模型部署与应用集成
根据模型规模、业务任务与并发需求,评估设备配置和推理服务。