Ornith-1.5-35B-A3B 本地 GGUF · Q4_K_M
代码 / Agent · Ornith 1.5 · Q4_K_M
模型文件由第三方社区提供,贤紫精选模型市场仅提供索引与下载便利;使用请遵守该模型开源协议。
Ornith-1.5-35B-A3B 社区 Q4_K_M GGUF(bartowski · imatrix):35B MoE Agent 向模型,支持工具调用与思考链;MTP 已打包进主文件,图像需 mmproj,适配自研底座、小紫 AI 工作台与贤紫 AI 代码编辑器。
本 SKU 规格
| 项目 | 说明 |
|---|---|
| 文件名 | Ornith-1.5-35B-A3B-Q4_K_M.gguf |
| 量化 | Q4_K_M(imatrix 校准) |
| 体积 | 约 21.9 GB |
| 架构 | Qwen3.5 MoE · 35B total / A3B 激活 |
| 上下文 | 以官方基座与 llama.cpp 支持为准(长上下文注意 KV) |
| 显存建议 | 24 GB 起 |
| MTP | 主 GGUF 含 MTP,可选 --spec-type draft-mtp 加速 |
| 后端 | 较新版本 llama.cpp / llama-server(qwen35moe、jinja) |
适合做什么
- Agent / 工具调用 / 多步推理 工作流
- 代码与通用任务(与同档 MoE Agent 并列选型)
- 图像输入:需 mmproj 配套
本地提示
- 加载多模态:
--mmproj指向 f16 mmproj 文件。 - 与 KAT-Coder、Nex-N2.5、Apodex 等同屏时,Ornith 强调 MIT 开源 + MoE + 内置 MTP + VLM。
下载与合规
见右侧两个下载按钮(跳转魔搭第三方源)。协议 MIT;权重来自 ornith-ai 基座 + bartowski 社区 GGUF,贤紫精选市场仅索引与下载入口。