Codex Router 模型矩阵 — DeepSeek、Kimi、GLM、Copilot 等
Codex Router 可以为 Codex 模型选择器接入 DeepSeek、Kimi、GLM(Z.ai)、Grok(xAI)、Claude(Anthropic)、GitHub Copilot、Xiaomi MiMo、opencode Go、Command Code、Meta、Qwen plan 以及众多兼容供应商的模型。本页同步当前内置认证矩阵,并单独列出需要从账户实时目录发现或定制模型的供应商。
内置模型矩阵
以下条目随仓库发布,供应商启用并完成认证后即出现在 Codex 选择器中:
| 选择器标签 | 模型 ID | 认证方式 |
|---|---|---|
| K2.7 Coding Highspeed (OAuth) | kimi-oauth/kimi-for-coding-highspeed | 已有的 Kimi Code CLI OAuth 会话 |
| K2.7 Coding (OAuth) | kimi-oauth/kimi-for-coding | 已有的 Kimi Code CLI OAuth 会话 |
| Kimi K3 (OAuth) | kimi-oauth/k3 | 已有的 Kimi Code CLI OAuth 会话 |
| Kimi K3 (API) | kimi-api/kimi-k3 | 独立计费的 Kimi Platform API Key |
| Kimi K3 (中国 API) | kimi-api-cn/kimi-k3 | 独立计费的 Moonshot 中国平台 Key |
| DeepSeek V4 Flash (API) | deepseek/deepseek-v4-flash | DeepSeek API Key |
| DeepSeek V4 Pro (API) | deepseek/deepseek-v4-pro | DeepSeek API Key |
| DeepSeek V4.1 Flash (API) | deepseek/deepseek-v4.1-flash | DeepSeek API Key |
| Grok 4.5 (OAuth) | grok-oauth/grok-4.5 | 官方 Grok CLI OAuth 会话 |
| Grok 4.5 (API) | grok-api/grok-4.5 | 独立计费的 xAI API Key |
| Claude Opus 4.8 (API) | anthropic-api/claude-opus-4.8 | 独立计费的 Anthropic API Key |
| GLM-5.2 (Ollama Cloud) | ollama-cloud/glm-5.2 | Ollama Cloud API Key |
| GLM-5.3 (Ollama Cloud) | ollama-cloud/glm-5.3 | Ollama Cloud API Key |
| GLM-5.3-Flash (Ollama Cloud) | ollama-cloud/glm-5.3-flash | Ollama Cloud API Key |
| Kimi K2.7 Code (Ollama Cloud) | ollama-cloud/kimi-k2.7-code | Ollama Cloud API Key |
| Kimi K3 (Ollama Cloud) | ollama-cloud/kimi-k3 | Ollama Cloud API Key |
| MiniMax M3 (Ollama Cloud) | ollama-cloud/minimax-m3 | Ollama Cloud API Key |
| DeepSeek V4 Pro (Ollama Cloud) | ollama-cloud/deepseek-v4-pro | Ollama Cloud API Key |
| DeepSeek V4 Flash (Ollama Cloud) | ollama-cloud/deepseek-v4-flash | Ollama Cloud API Key |
| MiniMax M3 | minimax-token-plan/minimax-m3 | MiniMax Token Plan API Key |
| MiMo-V2.5 (Xiaomi API) | xiaomi-mimo/mimo-v2.5 | Xiaomi MiMo API Key |
| MiMo-V2.5-Pro (Xiaomi API) | xiaomi-mimo/mimo-v2.5-pro | Xiaomi MiMo API Key |
| Qwen3.8 Max (Plan) | qwen-plan/qwen3.8-max | 阿里云百炼 plan API Key |
| Qwen3.8 Max Preview (Plan) | qwen-plan/qwen3.8-max-preview | 阿里云百炼 plan API Key |
| Qwen3.7 Max (Plan) | qwen-plan/qwen3.7-max | 阿里云百炼 plan API Key |
| Qwen3.7 Plus (Plan) | qwen-plan/qwen3.7-plus | 阿里云百炼 plan API Key |
| Qwen3.6 Flash (Plan) | qwen-plan/qwen3.6-flash | 阿里云百炼 plan API Key |
| DeepSeek V4 Pro (Qwen Plan) | qwen-plan/deepseek-v4-pro | 阿里云百炼 plan API Key |
| DeepSeek V4 Flash (Qwen Plan) | qwen-plan/deepseek-v4-flash-0731 | 阿里云百炼 plan API Key |
| GLM-5.2 (Qwen Plan) | qwen-plan/glm-5.2 | 阿里云百炼 plan API Key |
| GLM-5.3 (Coding Plan) | zai-coding/glm-5.3 | Z.ai GLM Coding Plan API Key |
| GLM-5.2 (Coding Plan) | zai-coding/glm-5.2 | Z.ai GLM Coding Plan API Key |
| GLM-5-Turbo (Coding Plan) | zai-coding/glm-5-turbo | Z.ai GLM Coding Plan API Key |
| GLM-5.3-Flash (Z.ai API) | zai-api/glm-5.3-flash | 独立计费的 Z.ai 平台 API Key |
| GLM-5.3 (Z.ai API) | zai-api/glm-5.3 | 独立计费的 Z.ai 平台 API Key |
| GLM-5.2 (Z.ai API) | zai-api/glm-5.2 | 独立计费的 Z.ai 平台 API Key |
| GLM-4.7 (Z.ai API) | zai-api/glm-4.7 | 独立计费的 Z.ai 平台 API Key |
| Muse Spark 1.2 (Meta) | meta/muse-spark-1.2 | Meta Model API Key |
| Muse Spark 1.2 Contributor (Meta) | meta/muse-spark-1.2-contributor | Meta Model API Key |
| Muse Spark 1.1 (Meta) | meta/muse-spark-1.1 | Meta Model API Key |
| GLM-5.2 (ClinePass) | clinepass/glm-5.2 | ClinePass API Key |
| Kimi K3 (ClinePass) | clinepass/kimi-k3 | ClinePass API Key |
| Kimi K2.7 Code (ClinePass) | clinepass/kimi-k2.7-code | ClinePass API Key |
| Kimi K2.6 (ClinePass) | clinepass/kimi-k2.6 | ClinePass API Key |
| DeepSeek V4 Pro (ClinePass) | clinepass/deepseek-v4-pro | ClinePass API Key |
| DeepSeek V4 Flash (ClinePass) | clinepass/deepseek-v4-flash | ClinePass API Key |
| MiMo-V2.5 (ClinePass) | clinepass/mimo-v2.5 | ClinePass API Key |
| MiMo-V2.5-Pro (ClinePass) | clinepass/mimo-v2.5-pro | ClinePass API Key |
| MiniMax M3 (ClinePass) | clinepass/minimax-m3 | ClinePass API Key |
| Qwen3.7 Max (ClinePass) | clinepass/qwen3.7-max | ClinePass API Key |
| Qwen3.7 Plus (ClinePass) | clinepass/qwen3.7-plus | ClinePass API Key |
| Qwen3.8 Max (ClinePass) | clinepass/qwen3.8-max | ClinePass API Key |
| Hy4 Preview (ClinePass) | clinepass/tencent/hy4-preview | ClinePass API Key |
| Hy4 Preview (Command Code) | commandcode/hy4-preview | Command Code API Key |
| Hy4 Preview (NanoGPT) | nano-gpt/tencent/hy4-preview | NanoGPT API Key |
| Hy4 Preview (Nous Research) | nousresearch/tencent/hy4-preview | Nous Portal API Key |
| Hy4 Preview (opencode Go) | opencode-go/hy4-preview | opencode Go/Zen API Key |
| Hy4 Preview (OpenRouter) | openrouter/tencent/hy4-preview | OpenRouter API Key |
| Union Alpha (opencode Go) | opencode-go-messages/union-alpha | opencode Go/Zen API Key |
| Union Alpha (OpenRouter) | openrouter/union-alpha | OpenRouter API Key |
| Kimi K3 (ainetcafe) | ainetcafe/kimi-k3 | ainetcafe API Key(AINETCAFE_API_KEY) |
上表同步仓库 README 中精简的主要认证矩阵。下方供应商章节与独立指南还会覆盖尚未列入该表的新内置路线,例如 Grok 4.6 OAuth 与 Meta Muse Spark 1.3。opencode Go 与 Command Code 还有额外的供应商族目录,仅目录供应商则在本机发现或定制条目。
目录如何决定你看到什么
Codex 目录是凭据感知的:只有已启用、且存有 API Key 或有效 OAuth 会话的外部供应商,其模型才会被纳入。原生 GPT 模型仅在 codex login status 确认 OpenAI 登录后才包含——因此未登录的免登录会话只显示你已认证的外部模型。
也就是说,添加模型永远是两步:启用供应商并提供凭据。已启用但没有密钥的供应商不会显示任何模型。
选择器顺序
Codex 按优先级渲染模型选择器,路由模型通常会落在最高可见原生条目之后的一段区间。如果你日常使用的就是外部模型,可以把它们发布到原生 GPT 条目之前:
./bin/model-router codex picker-order routed-first
./bin/model-router codex picker-order native-first
native-first 是保持不变的默认值。选择 routed-first 时,每条路由模型(含已认证的 v2 子代理路线)都会按既有供应商分组顺序发布在 1..N,原生条目随后排列。该选择保存在 model-picker.json 中,可见性写入会保留它;旧文件或无法识别的值会继续使用默认值。修改后请完全退出并重新打开 Codex。
OAuth 与 API Key
两种方式都在上面的矩阵中出现,即使同一厂商也是独立的账户与计费体系:
- OAuth 复用官方 CLI 的已登录会话(Kimi Code CLI 或 Grok CLI)。路由器不额外保存官方 CLI 已持有的内容。
- API Key 是独立计费的开发者密钥,通过隐藏提示输入一次。DeepSeek、Kimi Platform、xAI、Anthropic、Ollama Cloud、Z.ai(plan 与平台)、Xiaomi、Meta 与 Qwen plan 都使用 API Key。
启用供应商
./bin/model-router codex providers
./bin/model-router codex providers enable deepseek
./bin/model-router codex provider-key deepseek set
./bin/model-router codex provider-key anthropic-api set
Windows 上用 ./model-router.ps1 codex 执行相同命令。API Key 提示会关闭终端回显,受保护文件在 POSIX 上使用 mode 600、在 Windows 上使用禁用继承的当前用户 ACL;诊断只报告凭据的存在与来源,绝不报告值。
GitHub Copilot
github-copilot 只公开账户可见、并明确支持 Responses API、流式响应和工具调用的模型。由于目录取决于用户套餐和组织策略,仓库不硬编码 Copilot 模型 ID。先保存带 Copilot Requests 权限的细粒度 github_pat_,再从实时目录定制模型:
./bin/model-router codex provider-key github-copilot set
./bin/curate-models github-copilot
令牌会通过 GitHub Copilot 账户端点验证,返回的推理主机只有属于 GitHub 时才会被接受。请求会消耗用户的 Copilot 配额;经典 ghp_ 令牌与 Copilot CLI 凭据库不会被使用。
opencode Go 与 Zen
opencode 供应商族用一个存储密钥(OPENCODE_API_KEY 或 OPENCODE_GO_API_KEY)覆盖两个端点:按订阅计费的 Go(其测试模型 Grok 4.5、GLM-5.2、Kimi K3、DeepSeek V4 Pro 等随仓库发布)与按量计费的 Zen(更大目录可通过本地 curation 获取)。整体显示为单个 “opencode Go/Zen” 供应商。
Command Code Provider API
Command Code 官方 Provider API 是 OpenAI 兼容的 Chat Completions 接口加上 Anthropic Messages 接口,地址为 https://api.commandcode.ai/provider/v1。它现在仅支持 API Key——路由器不再通过 Command Code CLI 登录。先在 Command Code Studio 创建一个 Key,然后保存(COMMAND_CODE_API_KEY 或 COMMANDCODE_API_KEY 环境变量,或保存密钥):
./bin/model-router codex provider-key commandcode set
./bin/model-router codex providers enable commandcode
GOAT、Pro、Max、Team 与 Provider 套餐使用 Provider API。Go 套餐使用 coding-plan 路线:当 /provider/v1 在发送任何响应字节前返回精确的 403 upgrade_required 权益错误时,路由器会通过 Command Code 的 /alpha/generate 传输重试,并记住该凭据的结果。其它 403、超时、限流与服务端错误不会触发回退;两条路径共用同一密钥与供应商族。
Meta Model API
Meta 的 Muse Spark 模型在 https://api.meta.ai/v1 上使用 Responses 协议,需要存储的 META_API_KEY。仓库发布五个模型:Muse Spark 1.3 与 1.2、两代各自更便宜的 Contributor 档位(Meta 可能将其输入输出用于训练),以及上一代 1.1。
Z.ai 计量平台
zai-api 是 Z.ai 按量付费平台(https://api.z.ai/api/paas/v4)的独立供应商,提供 GLM-5.3、GLM-5.2(1M 上下文)和更便宜的 GLM-4.7,GLM-5.3/5.2 的推理档位阶梯与 Coding Plan 路由一致。它在凭据上完全独立:自己的密钥文件、钥匙串服务和 ZAI_PLATFORM_API_KEY 环境变量——绝不使用 plan 的 ZAI_API_KEY。Coding Plan Key 不能在计量端点计费,反之亦然。
Xiaomi MiMo API
MiMo(Xiaomi API)使用小米官方的 OpenAI 兼容端点 https://api.xiaomimimo.com/v1。与 MiMo 转售路由不同,官方 API 直接讲 /chat/completions,请求完全不经过 Responses 网关。MiMo-V2.5 与 MiMo-V2.5-Pro 使用 Xiaomi MiMo API Key 随仓库发布。
GLM-5.3 说明
GLM-5.3 于 2026-08-14 发布。主矩阵现在包含 zai-coding/glm-5.3、zai-api/glm-5.3、opencode-go/glm-5.3 与 ollama-cloud/glm-5.3;OpenRouter、Command Code 与 Venice 的供应商目录也已固定该模型。Ollama Cloud 的完整版与 Flash 条目仍属于 candidate 元数据,在精确路线实测前不应称为已认证。
实时目录供应商
以下 OpenAI 兼容供应商已注册路由与凭据隔离,但不随仓库发布预选模型,因为其目录变化太快、无法逐条固定并实测:
| 供应商 | Provider ID |
|---|---|
| Groq | groq |
| Together AI | together |
| Fireworks AI | fireworks |
| Cerebras | cerebras |
| Mistral AI | mistral |
| NVIDIA NIM | nvidia-nim |
| SiliconFlow | siliconflow |
| Hugging Face Router | huggingface |
| Google Gemini API | gemini-api |
| GitHub Copilot | github-copilot |
| Chutes | chutes |
| OrcaRouter | orca |
| Google Cloud Vertex AI | vertex |
devin-cli 是 OAuth 例外:运行 devin auth login 后,路由器只读取已安装 Devin CLI 向该账户提供的模型配置,不预选 Devin 模型。vertex 是 Google Cloud 例外,详见下文。opencode-free 与 kilo-free 是另外两个匿名网关,实时目录只保留文档声明的免费子集;无需 Key,但可用性与限制由供应商控制。
存好密钥后,从供应商实时目录中挑选模型:
./bin/model-router codex provider-key groq set
./bin/curate-models groq
定制时还会询问模型是否拒绝强制 tool_choice;回答是会存储 auto-tool-choice 请求画像,路由器仅对该模型降级强制选择。
Vertex AI(Google Cloud)
vertex 使用 gcloud auth application-default login 生成的 Application Default Credentials 认证——绝不使用存储的 API Key,也不会静默改用 gcloud auth login 的用户令牌——默认安装不会选中它:
gcloud auth application-default login
./bin/control vertex set PROJECT_ID LOCATION
./bin/curate-models vertex
它是纯目录型供应商:只列出 Model Garden 模型供你挑选,发现的 ID 必须先挑选到已审核的适配器上才可路由。它尊重 --no-discovery,因此 Vertex 凭据不会被带入发现流程。当账户无法访问 Model Garden 的发布者模型列表时,定制提供显式离线模式,仅使用 config/vertex/support-catalog.json 中已审核的条目:
./bin/curate-models vertex --static --models MODEL_ID
--static 不会在实时发现失败后静默回退,也不能与 --refresh 同时使用;请求仍然需要可用的 ADC、Vertex API 启用、IAM 与模型访问权限。它是定制的应急出口,并不代表该账户一定能使用每个已审核模型。
同时提供固定模型与实时目录的供应商
这些 API Key 供应商会发布经过审核的固定路线,也允许从账户实时目录继续挑选模型:
| 供应商 | Provider ID | Base URL | Key 获取 |
|---|---|---|---|
| OpenRouter | openrouter | https://openrouter.ai/api/v1 | openrouter.ai/settings/keys |
| NanoGPT | nano-gpt | https://nano-gpt.com/api/v1 | nano-gpt.com |
| Venice | venice | https://api.venice.ai/api/v1 | venice.ai/settings/api |
| Nous Research(Hermes) | nousresearch | https://inference-api.nousresearch.com/v1 | portal.nousresearch.com |
| ainetcafe | ainetcafe | https://microquickjs.com/v1 | ainetcafe API Key(AINETCAFE_API_KEY) |
Venice 的 API 访问是权益而非仅仅是 Key:免费 Venice 账户没有任何 API 权限。Pro 订阅、充值 USD 余额、或质押 VVV 获得 VCU 才能让 Key 可用——路由器在接入供应商时就打印该要求,而不是等 Codex 内部出现 403。Nous Research 的 Key 是 Nous Portal API Key,与 Hermes agent 使用同一个端点;内置注册表现在列出 28 个 Nous 模型(含 Hermes 4 与免费门户档位),但仍不是完整的 372 模型目录。OpenRouter 在可策展目录之上还内置了 Grok 4.6、Union Alpha 等固定路线。ainetcafe 内置一条固定路线 ainetcafe/kimi-k3,指向其 OpenAI 兼容端点,并复用其它 Kimi K3 转售路线相同的 kimi-k3 请求画像,使用默认 256K 上下文与文本+图片输入。
GLM-5.3-Flash(原 Ox Alpha)
最初以 “Ox Alpha” 名义上线的隐身 1M 上下文推理模型已经升级:OpenCode Go 现在以命名、计费的 glm-5.3-flash 发布它,实测也已认证 OpenRouter、Z.ai API 与 Z.ai Coding 上的同名模型。不再有任何内置 Ox Alpha 路线——未通过实测的 Command Code 与 Venice 预设已被撤回,OpenCode Free / OpenRouter / Nous 预设也已移除:
| 选择器标签 | 模型 ID | 需要 Key? | 状态 |
|---|---|---|---|
| GLM-5.3-Flash (opencode Go) | opencode-go/glm-5.3-flash | opencode | 命名替代 |
| GLM-5.3-Flash (Command Code) | commandcode/glm-5.3-flash | Command Code | 可用——目录固定 |
| GLM-5.3-Flash (OpenRouter) | openrouter/glm-5.3-flash | OpenRouter | 可用 |
| GLM-5.3-Flash (Z.ai API) | zai-api/glm-5.3-flash | Z.ai API | 可用 |
| GLM-5.3-Flash (Z.ai Coding) | zai-coding/glm-5.3-flash | Z.ai Coding | 可用 |
| GLM-5.3-Flash (Ollama Cloud) | ollama-cloud/glm-5.3-flash | Ollama Cloud | Candidate——需要精确路线实测 |
venice/ox-alpha | — | 撤回——实测被账单阻断 | |
opencode-free/ox-alpha 等 | — | 撤回 |
已认证 Flash 路线的推理档位是 low · high · max,默认 max。Z.ai Coding、Z.ai API、OpenRouter 与 Command Code 的 Flash 路线已声明原生文本和图片输入,粘贴图片会绕过 Vision Bridge;无后缀 GLM-5.3 仍是纯文本。Ollama Cloud candidate 已列出但尚未认证。现有 opencode-go/ox-alpha 选择与本地策展的 opencode-go/ox-alpha-free 会自动迁移到 opencode-go/glm-5.3-flash。选择器仍显示宣传的 1M 上下文,但 Codex 会在 每一条 GLM-5.3-Flash 路线上于 400K 处提前压缩。
免费预览已经结束:保留的是凭据路线上的命名模型,各供应商留存条款不同(OpenCode 声称零数据留存、Venice 匿名化、其它说得更少)。
Union Alpha(opencode Go 与 OpenRouter)
OpenCode Go 当前的隐身预览模型是 Union Alpha。它与 Ox Alpha / GLM-5.3-Flash 是两个不同的模型:OpenCode 未公布其开发方,文档给出 262,144 token 上下文与 131,072 token 宣传输出、文本与图片输入,目前标注为限时免费。
| 选择器标签 | 模型 ID | 需要 Key? | 说明 |
|---|---|---|---|
| Union Alpha (opencode Go) | opencode-go-messages/union-alpha | opencode Go/Zen | Anthropic Messages 通道,目前免费 |
| Union Alpha (OpenRouter) | openrouter/union-alpha | OpenRouter | 与 stealth/union-alpha 同一预览 |
Go 路线使用 Anthropic Messages API 而非 Chat Completions,并保留实测的 32,768 token 补全上限,使 Desktop 规模的首轮加上该预留仍能放进 262,144 窗口;压缩阈值保持在 180,000,高于缓存的工具 schema 下限。Console Go 还会拒绝单条超过 2,500,000 字符的消息,因此超大的 ImageGen data URL 会被替换为带标记的占位串,而 Codex 仍保留该文件。OpenRouter 以 stealth/union-alpha 发布同一预览,但不公布推理档位阶梯,因此该路线只存储保守的单一 high 档,并且只接受 tool_choice auto。ClinePass 与 Command Code 没有列出该 ID;Omen Alpha 仅作为已弃用条目留在 Go 实时目录中,未随仓库发布。请重建目录并完全退出、重新打开 Codex 以看到新的选择器条目。
本地后端:Ollama 与 LM Studio
本机运行的模型会在 local 供应商下出现在选择器中。Ollama 保持原生路由,LM Studio 可作为第二个本地后端与它并行——其模型使用稳定的 lmstudio/<model-id> 命名空间,相同 ID 也不会冲突:
./bin/model-router codex providers enable lmstudio
./bin/curate-models lmstudio
默认端点为 http://127.0.0.1:1234/v1;LM Studio 监听其他地址时设置 MODEL_ROUTER_LMSTUDIO_BASE_URL。只有你明确勾选的模型才会发布,并在选择器中标注 experimental。完整流程见本地模型指南。
定制通用 Ollama 供应商时,不再回退到 131,072 token 的猜测值与纯文本输入。当供应商是以 /v1 为根的 OpenAI 聊天端点时,发现流程还会向同一服务器的 /api/show 逐模型查询、验证返回确实是 Ollama 结构,并且只填补模型列表留空的字段——因此服务器以 1M 加视觉运行的模型会按实际提供的窗口与模态定制。探测是有界的:遇到路由缺失或连续三次拒绝即停止,并跳过服务器无法描述的模型。定制会存储实际宣传的窗口与图片输入,发现流程以 contextLengths 与 inputModalities 报告它们;文档默认值不会再冒充服务器实际提供的能力。
供应商设置指南
每个供应商都有单独的分步指南:DeepSeek、Kimi、GLM、Grok、Claude、opencode Go、opencode Zen、GitHub Copilot、Ollama Cloud、Command Code、Meta Muse Spark、Qwen plan、Nous Research、Venice、MiniMax、小米 MiMo、ClinePass 与本地模型。其它请用自定义模型。
验证模型
启用供应商后重启 Codex,确认选择器条目。对具体模型做一次实时(消耗配额)检查:
./bin/test-model 'groq/MODEL_ID' --live --yes