Files
vscode-workbench/.mimo2codex-audit/REPORT.md
T

63 lines
4.5 KiB
Markdown
Raw Blame History

This file contains ambiguous Unicode characters
This file contains Unicode characters that might be confused with other characters. If you think that this is intentional, you can safely ignore this warning. Use the Escape button to reveal them.
# mimo2codex 模型能力实测与配置报告
日期:2026-09-06 | 网关:OpenCode Zen (Console Go) `https://opencode.ai/zen/go/v1` | 代理:mimo2codex v0.5.29 @ `http://127.0.0.1:8788`
## 一、做了什么
对 mimo2codex 中**所有分组**(deepseek / mimo / generic)可达的全部 **35 个上游模型**逐一实测:
- **思考(reasoning)检测**:分别用 `thinking:{type:"enabled"}`、`reasoning_effort:"high"`、两者组合探测,检查响应中的 `reasoning_content` / `reasoning` 字段或 `<think>` 标签。
- **多模态(vision)检测**:发送 64×64 红色 PNG(data URL),验证模型能否真正说出"红色"。仅返回 200 但回答"没看到图片"或出现 `[Unsupported Image]` 占位符的,判为**不支持**(排除了第一轮的误报:deepseek-v4-pro / hy4-preview / longcat-2.0)。
## 二、实测结果(25 个可用模型)
| 模型 | 思考 | 多模态 | 备注 |
|---|---|---|---|
| mimo-v2.5 | ✅ | ✅ | 代理默认模型 |
| deepseek-v4-pro | ✅ | ❌ | 图片被上游替换为占位符 |
| deepseek-v4-flash | ✅ | ❌ | 400 text-only |
| deepseek-v4-flash-vision-exp | ✅ | ✅ | 实验版视觉模型 |
| glm-5.3 | ✅ | ❌ | 已同步修正 Codex catalog 为 text-only |
| glm-5.3-flash | ✅ | ✅ | |
| glm-5.2 / 5.1 / 5 | ✅ | ❌ | |
| kimi-k3 / k2.7-code / k2.6 | ✅ | ✅ | reasoning 字段风格 |
| qwen3.8-max / 3.8-flash / 3.7-plus / 3.6-plus / 3.5-plus | ✅ | ✅ | 1×1 图会因尺寸限制被拒,需 ≥64px |
| qwen3.7-max | ✅ | ❌ | 拒绝 image_url 内容格式 |
| minimax-m3 | ✅ | ✅ | `<think>` 标签风格;不认 thinking.type=enabled |
| minimax-m2.5 | ✅ | ❌ | |
| mimo-v2.5-pro | ✅ | ❌ | 404 no image endpoints |
| hy3 / hy4-preview | ✅ | ❌ | hy4 图片不透传 |
| longcat-2.0 | ✅ | ❌ | 声称看不到图片 |
| omen-alpha | ✅ | ✅ | 仅 thinking 参数可触发 |
**当前不可用(无法实测,保留路由,出错时上游给出明确报错)**:
gpt-5.6-luna(上游 500)、grok-4.5(503)、grok-4.6(不支持 oa-compat)、kimi-k2.5(无可用供应商)、minimax-m2.7(500)、mimo-v2-pro / mimo-v2-omni(套餐不支持)、hy3-preview(不可用)、muse-spark-1.2/1.3-contributor(地区限制 403)。
## 三、配置变更
1. **新建 `C:\Users\12914\.mimo2codex\providers.json`**:generic 分组(别名 zen)指向 Zen 网关,登记全部 35 个模型并写入实测的 `supportsReasoning` / `supportsImages` / `contextWindow` 标志。代理启动时自动种子进 `data.db` 的 models 表(已验证)。
- **修复了核心路由 bug**:此前 `glm-5.3`、`deepseek-v4-pro` 等不在任何分组目录中的模型会被静默改写成 `mimo-v2.5`(chat_logs 有 `gpt-5.6-luna -> mimo-v2.5` 记录为证)。现在全部**按原样透传**(已验证 `glm-5.3 -> glm-5.3`、`deepseek-v4-pro -> deepseek-v4-pro`,均 200)。
2. **`.env` 追加 `GENERIC_API_KEY`**(与 MIMO_API_KEY 相同的 Zen key)。
3. **启用多模态兜底**(settings 表 `codex.visionFallbackEnabled=1`,`codex.visionFallbackModel=mimo-v2.5`)。注意:该兜底按代理实现只对内置 mimo 分组生效;generic 分组下非视觉模型的图片请求走"图片落盘 + OCR 提示"的降级路径(已实测)。
4. **修正 Codex catalog** `C:\Users\12914\.codex\cc-switch-model-catalog.json`:`glm-5.3` 的 `input_modalities` 由 `[text,image]` 改为 `[text]`(与实测一致)。
5. 内置 deepseek 分组无官方 API key(只有 Zen key),其 4 个模型经 generic 分组照常可用;若日后配置 `DS_API_KEY`,需从 providers.json 移除 deepseek 条目才会切回官方直连。
## 四、端到端验证(全部通过)
| 测试 | 结果 |
|---|---|
| `/v1/chat/completions` glm-5.3 | 200,upstream_model=glm-5.3(无改写) |
| `/v1/chat/completions` deepseek-v4-pro | 200,upstream_model=deepseek-v4-pro |
| `/v1/responses` mimo-v2.5 + 图片 | 200,回答"红色" |
| `/v1/responses` mimo-v2.5 文本 | 200,回答"12" |
| `/v1/responses` kimi-k3 / glm-5.3 + 图片 | 200,图片落盘 `~/.mimo2codex/cache/images/` 并附 OCR 指引 |
| `/v1/models` | 列出全部 35 个模型 |
代理以独立进程常驻(pid 见端口 8788 监听),不依赖本会话。管理面板:http://127.0.0.1:8788/admin/
## 五、产物文件
- `providers.json` → `C:\Users\12914\.mimo2codex\providers.json`
- 实测原始数据 → `.mimo2codex-audit/probe-results.json`、`vision-retest.json`
- 测试脚本 → `.mimo2codex-audit/probe-zen.mjs`、`vision-retest.mjs`、`responses-test.mjs`、`verify-db.mjs`