← 全部模型

通用问答 · 代码开发

Qwen3.6-35B-NVFP4

支持单台 MegaCube 部署的 35B 多模态混合专家模型,采用 NVIDIA NVFP4 量化,适用于通用问答、文档理解、代码开发与智能体工具调用。

多模态理解文本、图像、视频 → 文本
1 台 MegaCube

01 / 模型介绍

模型架构与能力

Qwen3.6-35B-A3B 是通义千问的混合专家多模态模型,每次计算激活约 3B 参数。除了问答、写作和资料理解,官方也重点训练了代码与智能体能力,包括保留思考过程的多轮工具协作。NVIDIA NVFP4 版本通过低精度量化降低权重与计算资源需求。

发布方 / 量化方
阿里通义千问 / NVIDIA
完整模型名
nvidia/Qwen3.6-35B-A3B-NVFP4
参数规模
35B 总参数;每 token 激活约 3B
架构
40 层混合注意力 MoE;256 个路由专家,每次选 8 个,另有 1 个共享专家
模型上下文
原生 262,144 tokens,可扩展至 1,010,000 tokens;实际服务长度取决于运行配置
输入 / 输出
文本、图像、视频输入;文本与工具调用输出
权重精度
NVIDIA ModelOpt NVFP4
许可证
Apache-2.0

02 / 适用场景

应用场景

  • 日常问答与资料整理

    围绕工作资料进行问答、提炼要点、撰写摘要,将长篇内容整理为清晰的结论。

  • 代码生成、调试与修改

    根据需求编写代码,解释现有逻辑,分析报错,并辅助完成代码修改。

  • 图像理解与工具协作

    理解图片和图表中的信息,结合文字进行分析,并通过工具调用完成多步骤任务。

规划模型部署与应用集成

根据模型规模、业务任务与并发需求,评估设备配置和推理服务。

咨询此模型方案