M 贤紫精选模型市场
XIANZI CURATED MODEL MARKET

贤紫精选模型市场

专为自研底座、小紫 AI 工作台与贤紫 AI 代码编辑器精选本地 GGUF 等可部署权重——运营逐条审核上架,免登录一键下载(下载将跳转至第三方源),配好量化档与场景,拿来就能进本地推理。

12上架模型
0官方推荐

全部模型 共 12 个

Agents-A1 本地 GGUF · Q4_K_M

Agents-A1 · Q4_K_M

InternScience Agents-A1(35B MoE Agent,约 19.7GB),长程 Agent / 代码 / 工具调用,适合本地 SRX 改仓。

24 GB 起 Agents-A1 InternScience Agent MoE
下载 详情

Muse Glimmer-30B 本地 GGUF · Q4_K_M

Muse Glimmer 30B · Q4_K_M

Meta Muse Glimmer 30B(约 16.8GB 文本量化 + 感知编码器),本地 Agent:多步推理、工具调用、截图/文档多模态与失败恢复。

24 GB 起(官方 17GB 档面向 24GB 显存) Muse Glimmer Meta Agent 多模态
下载 详情

Apodex-1.1-mini 本地 GGUF · Q4_K_M-MTP

Apodex 1.1 · Q4_K_M-MTP

Apodex 1.1-mini(约 36B MoE Agent,约 20.2GB),长程研究、文件/代码/工具与 Agent Team 场景。

24 GB 起 Apodex Agent MoE 工具调用
下载 详情

Nex-N2.5-mini 本地 GGUF · Q4_K_M

Nex-N2.5 · Q4_K_M

Nex-AGI Nex-N2.5-mini(MoE Agent,约 22.3GB),长程任务、代码/工具/电脑与浏览器操作、多模态视觉 Agent。

24 GB 起 Nex-AGI Agent MoE 多模态
下载 详情

Qwen3.8-27B 本地 GGUF · UD-Q4_K_XL

Qwen3.8 · UD-Q4_K_XL

通义 Qwen3.8-27B 多模态指令版(约 16.4GB),262K 上下文,面向本地 Agent、代码与长任务。

20 GB 起 Qwen3.8 阿里 27B 多模态
下载 详情

KAT-Coder-V2.5-Dev 本地 GGUF · Q4_K_M

KAT-Coder V2.5 · Q4_K_M

快手 Kwaipilot KAT-Coder(35B MoE,约 21.4GB),Agentic Coding / SWE,同档开源代码 Agent 表现突出。

24 GB 起 KAT-Coder Kwaipilot 代码 Agent
下载 详情

Ornith-1.5-35B-A3B 本地 GGUF · Q4_K_M

Ornith 1.5 · Q4_K_M

Ornith 1.5 35B-A3B MoE(约 21.9GB),Agent/工具/推理向,含 MTP;多模态需 mmproj。

24 GB 起 Ornith Agent MoE 多模态
下载 详情

Gemma 4 31B 本地 GGUF · UD-Q4_K_XL

Gemma 4 · UD-Q4_K_XL

Google Gemma 4 31B 稠密指令版(约 17.5GB),偏质量上限的本地推理与 Agent。

20 GB 起 Gemma4 Google 31B 稠密
下载 详情

Gemma 4 26B-A4B 本地 GGUF · UD-Q4_K_XL

Gemma 4 26B-A4B · UD-Q4_K_XL

Google Gemma 4 MoE(约 4B 激活),约 15.8GB,桌面工作站本地 Agent 与长上下文推理。

18 GB 起 Gemma4 Google MoE 26B
下载 详情

Gemma 4 12B 本地 GGUF · UD-Q4_K_XL

Gemma 4 12B · UD-Q4_K_XL

Gemma 4 12B 统一多模态指令版(约 6.9GB),256K 上下文,适合笔记本本地 Agent。

8 GB 起 Gemma4 Google 12B 多模态
下载 详情

智谱 GLM-4.7-Flash · Q4_K_M

GLM-4.7-Flash · Q4_K_M

智谱 GLM-4.7-Flash 本地 GGUF,适配自研底座 / 工作台 / 代码编辑器;代码与 Agent 向表现突出。

16 GB 起 智谱 GLM-4.7 Flash GGUF
下载 详情

gpt-oss-20b 本地 GGUF · UD-Q4_K_XL

gpt-oss 20b · UD-Q4_K_XL

OpenAI gpt-oss-20b MoE(约 11.9GB),可配置推理强度,工具/Agent 向本地 GGUF。

16 GB 起 gpt-oss OpenAI Agent 推理
下载 详情

下载与导入

  1. 在本页或详情页点击「下载」——免登录,下载将跳转至第三方源获取文件。
  2. 将 GGUF 等权重文件放入自研底座 / 工作台约定的模型目录(参见产品内「模型管理」说明)。
  3. 在「模型连接」或底座界面中选择对应模型与量化档,配置 llama-server / 推理参数后启动。
  4. 若下载中断,请重新点击下载;上游链接变更时,运营会在后台更新该模型的下载配置。