Gemma 4 31B 本地 GGUF · UD-Q4_K_XL
代码 / Agent · Gemma 4 · UD-Q4_K_XL
模型文件由第三方社区提供,贤紫精选模型市场仅提供索引与下载便利;使用请遵守该模型开源协议。
Google Gemma 4 31B-it(稠密)Unsloth 本地 GGUF,面向自研底座、小紫 AI 工作台与贤紫 AI 代码编辑器的高强度本地推理。
本 SKU 规格
| 项目 | 说明 |
|---|---|
| 文件名 | gemma-4-31B-it-UD-Q4_K_XL.gguf |
| 量化 | UD-Q4_K_XL |
| 体积 | 约 17.5 GB |
| 架构 | 31B 稠密(Gemma 4 系列中偏 质量上限,推理慢于 26B-A4B MoE) |
| 上下文 | 最高约 256K(取决于内存与底座) |
| 显存建议 | 20 GB 起 |
| 后端 | llama.cpp / llama-server 或底座内置推理 |
适合做什么
- 工作站 高质量对话、推理、代码与 Agent
- 长上下文 阅读与复杂任务
- 多模态:需下载 mmproj 配套 并按底座配置;仅主文件时以文本为主
26B-A4B:更快、更省显存,质量接近。31B(本条目):稠密全量,质量潜力更高。12B:更轻。按显存与速度选型。
推荐采样
--temp 1.0 --top-p 0.95 --top-k 64