Aiko Chat
语言模型
模型目录、上下文窗口、思考层级、能力别名与模型可见性管理
Aiko IDE 的模型来自团队的 new-api 网关——IDE 拉取网关的 /v1/models 目录,按"对话模型"与"能力别名"两层使用。
对话模型(进选择器)
| 家族 | 示例 | 上下文 / 输出 | 思考层级(effort) |
|---|---|---|---|
| Kimi | k3、kimi-for-coding | 1M / 128K | k3:低 / 高 / 最大 |
| GLM | glm-5.2、glm-4.7、glm-5-turbo | 202K–1M | glm-5.2:高 / 最大 |
| DeepSeek | deepseek-v4-pro / flash | 1M / 384K | 高 / 最大 |
| GPT | gpt-5.4 ~ 5.6 系列 | 400K–1.05M | 无 / 低 / 中 / 高 / 超高(5.6 加最大) |
| Qwen | qwen3.6 / 3.7 系列 | 1M / 64K | —(仅思考开关) |
| Claude | claude-opus / sonnet / haiku | 200K | 低 / 中 / 高 / 超高 / 最大 |
有思考层级的模型在选择器里会多一个「思考层级」配置项;没有层级的模型(qwen、glm-4.x、kimi-for-coding)刻意不提供该控件——上游只支持开关不支持档位。
切换模型的提示缓存说明
会话中途切换模型会让上一个模型在网关侧缓存的 prompt 前缀失效(prompt cache 按模型隔离),下一轮将按全量上下文重新计费/计算。界面上的「重置提示缓存」提示就是在说明这件事——不是错误,只是成本提醒。
能力别名(不进选择器)
特定能力的模型统一走网关别名,不直接暴露上游具体模型 id:
| 别名 | 能力 | 消费方 |
|---|---|---|
image-recognition | 图像理解 | image_understand 工具(默认) |
web_search | 联网搜索 | web_search 工具 |
image-generation | 图像生成 | 预留 |
可见性管理
- 图像生成、纯视觉、音频、嵌入、rerank、OCR、视频类模型在所有选择器里自动隐藏
- 还有漏网的?设置项
aiko.newapi.hiddenModels里加一条 id 或 glob(如glm-*v)即可,改完重启 agent host 生效 - 上下文/思考层级 schema 由
aiko.newapi.modelContexts维护(编辑或由 Aiko 平台推送,不硬编码)