Nex-N2.5-mini 本地 GGUF · Q4_K_M
代码 / Agent · Nex-N2.5 · Q4_K_M
模型文件由第三方社区提供,贤紫精选模型市场仅提供索引与下载便利;使用请遵守该模型开源协议。
Nex-N2.5-mini 社区 Q4_K_M GGUF(bartowski · imatrix):面向长程 Agent、代码、工具调用、电脑/浏览器操作与视觉反馈,适配自研底座、小紫 AI 工作台与贤紫 AI 代码编辑器。
本 SKU 规格
| 项目 | 说明 |
|---|---|
| 文件名 | nex-agi_Nex-N2.5-mini-Q4_K_M.gguf |
| 量化 | Q4_K_M(imatrix 校准,bartowski 魔搭仓库) |
| 体积 | 约 22.3 GB |
| 基座 | nex-agi/Nex-N2.5-mini · Qwen3.5 MoE 系多模态 Agent |
| 上下文 | 原生最长约 262K(实际上限取决于内存与底座) |
| 显存建议 | 24 GB 起 |
| 后端 | 较新版本 llama.cpp / llama-server(qwen35moe、--reasoning-parser qwen3、--tool-call-parser qwen3_coder、jinja) |
适合做什么
- 长程 Agent:研究、知识工作、复杂生产力任务
- GUI / Computer Use、浏览器、程序自测 等视觉 grounded Agent
- 代码、工具调用 与多步工作流
- 图像输入:需下载 mmproj 配套 并按多模态方式加载
与 Apodex-1.1-mini 同属 Agent 向 MoE;Nex-N2.5 更强调 电脑/浏览器/视觉闭环 与 Nex 系列 Agent 训练环境。
本地提示
- 官方推荐采样约
temperature=0.7、top_p=0.95、top_k=40(以底座为准)。 - 思考模式可通过
reasoning_effort(none / medium / high)控制,需服务端与模板支持。 - 须使用模型自带 chat template(GGUF 内嵌或仓库模板)。
下载与合规
见右侧两个下载按钮(跳转魔搭第三方源)。协议 Apache-2.0;权重由 Nex-AGI 开源基座 + bartowski 社区 GGUF 提供,贤紫精选市场仅索引与下载入口。