M 贤紫精选模型市场
返回模型市场

Agents-A1 本地 GGUF · Q4_K_M

代码 / Agent · Agents-A1 · Q4_K_M

Agents-A1 InternScience Agent MoE 35B GGUF

InternScience Agents-A1 官方 Q4_K_M GGUF:35B-A3B MoE 长程 Agent 模型,面向自研底座、小紫 AI 工作台与贤紫 AI 代码编辑器的本地 Agent 与改仓。

本 SKU 规格

项目说明
文件名Agents-A1-Q4_K_M.gguf
量化Q4_K_M
体积约 19.7 GB
架构Qwen3.5 系 MoE(约 35B 总参、约 3B 激活),偏 Agent 地平线 训练
上下文支持长上下文(实际上限取决于内存与底座;Agent 常用 8K~32K 起)
多模态需另下 mmproj 配套;仅主文件时为 文本 Agent
显存建议24 GB 起
后端较新版本 llama.cpp / llama-server(须支持 qwen35moe 推理图)

适合做什么

  • 长程 Agent、工具调用、软件工程 / 改仓(与「只堆参数」的通用模型定位不同)
  • 配合本机 SRX 做多步任务与落盘
  • 图/视觉输入:加载 mmproj 后按 Qwen-VL 类方式配置(见底座文档)

显存不足可考虑同系列 Agents-A1-4B GGUF(另上架);追求精度可选 Q8_0 条目。

使用提示

  • 请保持 llama.cpp / 自研底座 为支持 Agents-A1 架构的 较新构建,否则可能无法加载。
  • 聊天模板以 Qwen3 / Agents-A1 官方为准;推理深度、thinking 等由底座参数控制。

下载与合规

主模型与 mmproj 见右侧两个下载按钮(跳转魔搭)。权重由 InternScience 提供,协议 Apache-2.0;贤紫精选市场仅提供索引与下载入口。