← 全部模型

通用问答 · 代码开发

Ornith-1.5-35B-A3B

面向文本推理、代码开发与智能体任务的 35B 混合专家模型。模型商店提供单机 BF16 部署方案,可通过兼容接口接入品悟。

多模态理解文本、图像 → 文本
1 台 MegaCube

01 / 模型介绍

模型架构与能力

Ornith-1.5-35B-A3B 由 Ornith AI 基于 Qwen3.5 系列继续预训练,并通过强化学习提升推理、代码和工具使用能力。模型默认采用思考模式,适合需要多步推理或操作工具的任务。它的配置包含视觉编码器,而当前商店方案主要面向文本对话和代码。

发布方 / 模型
Ornith AI · Ornith-1.5-35B-A3B
参数规模
35B 总参数;每 token 激活约 3B
架构
Qwen3.5 MoE 架构;40 层,256 个路由专家,每次选 8 个,含共享专家
模型上下文
配置上限 262,144 tokens;商店部署参考使用 32K
输入 / 输出
文本输入与文本 / 工具调用输出;模型配置另包含视觉编码器及图像、视频标记
精度 / 下载体积
BF16;约 71.9 GB(67.0 GiB),不等于运行时内存占用
许可证
MIT

02 / 适用场景

应用场景

  • 知识问答与多步推理

    围绕文字资料解答问题,拆解复杂任务,辅助分析和内容整理。

  • 代码开发与问题修复

    编写和解释代码,分析错误原因,辅助完成软件问题修复。

  • 智能体工具协作

    连接支持工具调用的应用,围绕一个目标执行连续的查询、分析和操作。

规划模型部署与应用集成

根据模型规模、业务任务与并发需求,评估设备配置和推理服务。

咨询此模型方案