M 贤紫精选模型市场
返回模型市场

Ornith-1.5-35B-A3B 本地 GGUF · Q4_K_M

代码 / Agent · Ornith 1.5 · Q4_K_M

Ornith Agent MoE 多模态 MTP GGUF

Ornith-1.5-35B-A3B 社区 Q4_K_M GGUF(bartowski · imatrix):35B MoE Agent 向模型,支持工具调用与思考链;MTP 已打包进主文件,图像需 mmproj,适配自研底座、小紫 AI 工作台与贤紫 AI 代码编辑器。

本 SKU 规格

项目说明
文件名Ornith-1.5-35B-A3B-Q4_K_M.gguf
量化Q4_K_M(imatrix 校准)
体积约 21.9 GB
架构Qwen3.5 MoE · 35B total / A3B 激活
上下文以官方基座与 llama.cpp 支持为准(长上下文注意 KV)
显存建议24 GB 起
MTP主 GGUF 含 MTP,可选 --spec-type draft-mtp 加速
后端较新版本 llama.cpp / llama-server(qwen35moe、jinja)

适合做什么

  • Agent / 工具调用 / 多步推理 工作流
  • 代码与通用任务(与同档 MoE Agent 并列选型)
  • 图像输入:需 mmproj 配套

本地提示

  • 加载多模态:--mmproj 指向 f16 mmproj 文件。
  • 与 KAT-Coder、Nex-N2.5、Apodex 等同屏时,Ornith 强调 MIT 开源 + MoE + 内置 MTP + VLM。

下载与合规

见右侧两个下载按钮(跳转魔搭第三方源)。协议 MIT;权重来自 ornith-ai 基座 + bartowski 社区 GGUF,贤紫精选市场仅索引与下载入口。