最后更新

Codex Router 模型矩阵 — DeepSeek、Kimi、GLM、Copilot 等

Codex Router 可以为 Codex 模型选择器接入 DeepSeek、Kimi、GLM(Z.ai)、Grok(xAI)、Claude(Anthropic)、GitHub Copilot、Xiaomi MiMo、opencode Go、Command Code、Meta、Qwen plan 以及众多兼容供应商的模型。本页同步当前内置认证矩阵,并单独列出需要从账户实时目录发现或定制模型的供应商。

DeepSeekDeepSeekKimiKimiGLMGLMGrokGrokClaudeClaudeGitHub CopilotGitHub CopilotOpenRouterOpenRouterOllama CloudOllama Cloud

内置模型矩阵

以下条目随仓库发布,供应商启用并完成认证后即出现在 Codex 选择器中:

选择器标签模型 ID认证方式
K2.7 Coding Highspeed (OAuth)kimi-oauth/kimi-for-coding-highspeed已有的 Kimi Code CLI OAuth 会话
K2.7 Coding (OAuth)kimi-oauth/kimi-for-coding已有的 Kimi Code CLI OAuth 会话
Kimi K3 (OAuth)kimi-oauth/k3已有的 Kimi Code CLI OAuth 会话
Kimi K3 (API)kimi-api/kimi-k3独立计费的 Kimi Platform API Key
Kimi K3 (中国 API)kimi-api-cn/kimi-k3独立计费的 Moonshot 中国平台 Key
DeepSeek V4 Flash (API)deepseek/deepseek-v4-flashDeepSeek API Key
DeepSeek V4 Pro (API)deepseek/deepseek-v4-proDeepSeek API Key
DeepSeek V4.1 Flash (API)deepseek/deepseek-v4.1-flashDeepSeek API Key
Grok 4.5 (OAuth)grok-oauth/grok-4.5官方 Grok CLI OAuth 会话
Grok 4.5 (API)grok-api/grok-4.5独立计费的 xAI API Key
Claude Opus 4.8 (API)anthropic-api/claude-opus-4.8独立计费的 Anthropic API Key
GLM-5.2 (Ollama Cloud)ollama-cloud/glm-5.2Ollama Cloud API Key
GLM-5.3 (Ollama Cloud)ollama-cloud/glm-5.3Ollama Cloud API Key
GLM-5.3-Flash (Ollama Cloud)ollama-cloud/glm-5.3-flashOllama Cloud API Key
Kimi K2.7 Code (Ollama Cloud)ollama-cloud/kimi-k2.7-codeOllama Cloud API Key
Kimi K3 (Ollama Cloud)ollama-cloud/kimi-k3Ollama Cloud API Key
MiniMax M3 (Ollama Cloud)ollama-cloud/minimax-m3Ollama Cloud API Key
DeepSeek V4 Pro (Ollama Cloud)ollama-cloud/deepseek-v4-proOllama Cloud API Key
DeepSeek V4 Flash (Ollama Cloud)ollama-cloud/deepseek-v4-flashOllama Cloud API Key
MiniMax M3minimax-token-plan/minimax-m3MiniMax Token Plan API Key
MiMo-V2.5 (Xiaomi API)xiaomi-mimo/mimo-v2.5Xiaomi MiMo API Key
MiMo-V2.5-Pro (Xiaomi API)xiaomi-mimo/mimo-v2.5-proXiaomi MiMo API Key
Qwen3.8 Max (Plan)qwen-plan/qwen3.8-max阿里云百炼 plan API Key
Qwen3.8 Max Preview (Plan)qwen-plan/qwen3.8-max-preview阿里云百炼 plan API Key
Qwen3.7 Max (Plan)qwen-plan/qwen3.7-max阿里云百炼 plan API Key
Qwen3.7 Plus (Plan)qwen-plan/qwen3.7-plus阿里云百炼 plan API Key
Qwen3.6 Flash (Plan)qwen-plan/qwen3.6-flash阿里云百炼 plan API Key
DeepSeek V4 Pro (Qwen Plan)qwen-plan/deepseek-v4-pro阿里云百炼 plan API Key
DeepSeek V4 Flash (Qwen Plan)qwen-plan/deepseek-v4-flash-0731阿里云百炼 plan API Key
GLM-5.2 (Qwen Plan)qwen-plan/glm-5.2阿里云百炼 plan API Key
GLM-5.3 (Coding Plan)zai-coding/glm-5.3Z.ai GLM Coding Plan API Key
GLM-5.2 (Coding Plan)zai-coding/glm-5.2Z.ai GLM Coding Plan API Key
GLM-5-Turbo (Coding Plan)zai-coding/glm-5-turboZ.ai GLM Coding Plan API Key
GLM-5.3-Flash (Z.ai API)zai-api/glm-5.3-flash独立计费的 Z.ai 平台 API Key
GLM-5.3 (Z.ai API)zai-api/glm-5.3独立计费的 Z.ai 平台 API Key
GLM-5.2 (Z.ai API)zai-api/glm-5.2独立计费的 Z.ai 平台 API Key
GLM-4.7 (Z.ai API)zai-api/glm-4.7独立计费的 Z.ai 平台 API Key
Muse Spark 1.2 (Meta)meta/muse-spark-1.2Meta Model API Key
Muse Spark 1.2 Contributor (Meta)meta/muse-spark-1.2-contributorMeta Model API Key
Muse Spark 1.1 (Meta)meta/muse-spark-1.1Meta Model API Key
GLM-5.2 (ClinePass)clinepass/glm-5.2ClinePass API Key
Kimi K3 (ClinePass)clinepass/kimi-k3ClinePass API Key
Kimi K2.7 Code (ClinePass)clinepass/kimi-k2.7-codeClinePass API Key
Kimi K2.6 (ClinePass)clinepass/kimi-k2.6ClinePass API Key
DeepSeek V4 Pro (ClinePass)clinepass/deepseek-v4-proClinePass API Key
DeepSeek V4 Flash (ClinePass)clinepass/deepseek-v4-flashClinePass API Key
MiMo-V2.5 (ClinePass)clinepass/mimo-v2.5ClinePass API Key
MiMo-V2.5-Pro (ClinePass)clinepass/mimo-v2.5-proClinePass API Key
MiniMax M3 (ClinePass)clinepass/minimax-m3ClinePass API Key
Qwen3.7 Max (ClinePass)clinepass/qwen3.7-maxClinePass API Key
Qwen3.7 Plus (ClinePass)clinepass/qwen3.7-plusClinePass API Key
Qwen3.8 Max (ClinePass)clinepass/qwen3.8-maxClinePass API Key
Hy4 Preview (ClinePass)clinepass/tencent/hy4-previewClinePass API Key
Hy4 Preview (Command Code)commandcode/hy4-previewCommand Code API Key
Hy4 Preview (NanoGPT)nano-gpt/tencent/hy4-previewNanoGPT API Key
Hy4 Preview (Nous Research)nousresearch/tencent/hy4-previewNous Portal API Key
Hy4 Preview (opencode Go)opencode-go/hy4-previewopencode Go/Zen API Key
Hy4 Preview (OpenRouter)openrouter/tencent/hy4-previewOpenRouter API Key
Union Alpha (opencode Go)opencode-go-messages/union-alphaopencode Go/Zen API Key
Union Alpha (OpenRouter)openrouter/union-alphaOpenRouter API Key
Kimi K3 (ainetcafe)ainetcafe/kimi-k3ainetcafe API Key(AINETCAFE_API_KEY

上表同步仓库 README 中精简的主要认证矩阵。下方供应商章节与独立指南还会覆盖尚未列入该表的新内置路线,例如 Grok 4.6 OAuth 与 Meta Muse Spark 1.3。opencode Go 与 Command Code 还有额外的供应商族目录,仅目录供应商则在本机发现或定制条目。

目录如何决定你看到什么

Codex 目录是凭据感知的:只有已启用、且存有 API Key 或有效 OAuth 会话的外部供应商,其模型才会被纳入。原生 GPT 模型仅在 codex login status 确认 OpenAI 登录后才包含——因此未登录的免登录会话只显示你已认证的外部模型。

也就是说,添加模型永远是两步:启用供应商提供凭据。已启用但没有密钥的供应商不会显示任何模型。

选择器顺序

Codex 按优先级渲染模型选择器,路由模型通常会落在最高可见原生条目之后的一段区间。如果你日常使用的就是外部模型,可以把它们发布到原生 GPT 条目之前:

./bin/model-router codex picker-order routed-first
./bin/model-router codex picker-order native-first

native-first 是保持不变的默认值。选择 routed-first 时,每条路由模型(含已认证的 v2 子代理路线)都会按既有供应商分组顺序发布在 1..N,原生条目随后排列。该选择保存在 model-picker.json 中,可见性写入会保留它;旧文件或无法识别的值会继续使用默认值。修改后请完全退出并重新打开 Codex。

OAuth 与 API Key

两种方式都在上面的矩阵中出现,即使同一厂商也是独立的账户与计费体系:

  • OAuth 复用官方 CLI 的已登录会话(Kimi Code CLI 或 Grok CLI)。路由器不额外保存官方 CLI 已持有的内容。
  • API Key 是独立计费的开发者密钥,通过隐藏提示输入一次。DeepSeek、Kimi Platform、xAI、Anthropic、Ollama Cloud、Z.ai(plan 与平台)、Xiaomi、Meta 与 Qwen plan 都使用 API Key。

对比详见常见问题与各模型教程

启用供应商

./bin/model-router codex providers
./bin/model-router codex providers enable deepseek
./bin/model-router codex provider-key deepseek set
./bin/model-router codex provider-key anthropic-api set

Windows 上用 ./model-router.ps1 codex 执行相同命令。API Key 提示会关闭终端回显,受保护文件在 POSIX 上使用 mode 600、在 Windows 上使用禁用继承的当前用户 ACL;诊断只报告凭据的存在与来源,绝不报告值。

GitHub Copilot

github-copilot 只公开账户可见、并明确支持 Responses API、流式响应和工具调用的模型。由于目录取决于用户套餐和组织策略,仓库不硬编码 Copilot 模型 ID。先保存带 Copilot Requests 权限的细粒度 github_pat_,再从实时目录定制模型:

./bin/model-router codex provider-key github-copilot set
./bin/curate-models github-copilot

令牌会通过 GitHub Copilot 账户端点验证,返回的推理主机只有属于 GitHub 时才会被接受。请求会消耗用户的 Copilot 配额;经典 ghp_ 令牌与 Copilot CLI 凭据库不会被使用。

opencode Go 与 Zen

opencode 供应商族用一个存储密钥(OPENCODE_API_KEYOPENCODE_GO_API_KEY)覆盖两个端点:按订阅计费的 Go(其测试模型 Grok 4.5、GLM-5.2、Kimi K3、DeepSeek V4 Pro 等随仓库发布)与按量计费的 Zen(更大目录可通过本地 curation 获取)。整体显示为单个 “opencode Go/Zen” 供应商。

Command Code Provider API

Command Code 官方 Provider API 是 OpenAI 兼容的 Chat Completions 接口加上 Anthropic Messages 接口,地址为 https://api.commandcode.ai/provider/v1。它现在仅支持 API Key——路由器不再通过 Command Code CLI 登录。先在 Command Code Studio 创建一个 Key,然后保存(COMMAND_CODE_API_KEYCOMMANDCODE_API_KEY 环境变量,或保存密钥):

./bin/model-router codex provider-key commandcode set
./bin/model-router codex providers enable commandcode

GOAT、Pro、Max、Team 与 Provider 套餐使用 Provider API。Go 套餐使用 coding-plan 路线:当 /provider/v1 在发送任何响应字节前返回精确的 403 upgrade_required 权益错误时,路由器会通过 Command Code 的 /alpha/generate 传输重试,并记住该凭据的结果。其它 403、超时、限流与服务端错误不会触发回退;两条路径共用同一密钥与供应商族。

Meta Model API

Meta 的 Muse Spark 模型在 https://api.meta.ai/v1 上使用 Responses 协议,需要存储的 META_API_KEY。仓库发布五个模型:Muse Spark 1.3 与 1.2、两代各自更便宜的 Contributor 档位(Meta 可能将其输入输出用于训练),以及上一代 1.1。

Z.ai 计量平台

zai-api 是 Z.ai 按量付费平台(https://api.z.ai/api/paas/v4)的独立供应商,提供 GLM-5.3、GLM-5.2(1M 上下文)和更便宜的 GLM-4.7,GLM-5.3/5.2 的推理档位阶梯与 Coding Plan 路由一致。它在凭据上完全独立:自己的密钥文件、钥匙串服务和 ZAI_PLATFORM_API_KEY 环境变量——绝不使用 plan 的 ZAI_API_KEY。Coding Plan Key 不能在计量端点计费,反之亦然。

Xiaomi MiMo API

MiMo(Xiaomi API)使用小米官方的 OpenAI 兼容端点 https://api.xiaomimimo.com/v1。与 MiMo 转售路由不同,官方 API 直接讲 /chat/completions,请求完全不经过 Responses 网关。MiMo-V2.5 与 MiMo-V2.5-Pro 使用 Xiaomi MiMo API Key 随仓库发布。

GLM-5.3 说明

GLM-5.3 于 2026-08-14 发布。主矩阵现在包含 zai-coding/glm-5.3zai-api/glm-5.3opencode-go/glm-5.3ollama-cloud/glm-5.3;OpenRouter、Command Code 与 Venice 的供应商目录也已固定该模型。Ollama Cloud 的完整版与 Flash 条目仍属于 candidate 元数据,在精确路线实测前不应称为已认证。

实时目录供应商

以下 OpenAI 兼容供应商已注册路由与凭据隔离,但不随仓库发布预选模型,因为其目录变化太快、无法逐条固定并实测:

供应商Provider ID
Groqgroq
Together AItogether
Fireworks AIfireworks
Cerebrascerebras
Mistral AImistral
NVIDIA NIMnvidia-nim
SiliconFlowsiliconflow
Hugging Face Routerhuggingface
Google Gemini APIgemini-api
GitHub Copilotgithub-copilot
Chuteschutes
OrcaRouterorca
Google Cloud Vertex AIvertex

devin-cli 是 OAuth 例外:运行 devin auth login 后,路由器只读取已安装 Devin CLI 向该账户提供的模型配置,不预选 Devin 模型。vertex 是 Google Cloud 例外,详见下文。opencode-freekilo-free 是另外两个匿名网关,实时目录只保留文档声明的免费子集;无需 Key,但可用性与限制由供应商控制。

存好密钥后,从供应商实时目录中挑选模型:

./bin/model-router codex provider-key groq set
./bin/curate-models groq

定制时还会询问模型是否拒绝强制 tool_choice;回答是会存储 auto-tool-choice 请求画像,路由器仅对该模型降级强制选择。

Vertex AI(Google Cloud)

vertex 使用 gcloud auth application-default login 生成的 Application Default Credentials 认证——绝不使用存储的 API Key,也不会静默改用 gcloud auth login 的用户令牌——默认安装不会选中它:

gcloud auth application-default login
./bin/control vertex set PROJECT_ID LOCATION
./bin/curate-models vertex

它是纯目录型供应商:只列出 Model Garden 模型供你挑选,发现的 ID 必须先挑选到已审核的适配器上才可路由。它尊重 --no-discovery,因此 Vertex 凭据不会被带入发现流程。当账户无法访问 Model Garden 的发布者模型列表时,定制提供显式离线模式,仅使用 config/vertex/support-catalog.json 中已审核的条目:

./bin/curate-models vertex --static --models MODEL_ID

--static 不会在实时发现失败后静默回退,也不能与 --refresh 同时使用;请求仍然需要可用的 ADC、Vertex API 启用、IAM 与模型访问权限。它是定制的应急出口,并不代表该账户一定能使用每个已审核模型。

同时提供固定模型与实时目录的供应商

这些 API Key 供应商会发布经过审核的固定路线,也允许从账户实时目录继续挑选模型:

供应商Provider IDBase URLKey 获取
OpenRouteropenrouterhttps://openrouter.ai/api/v1openrouter.ai/settings/keys
NanoGPTnano-gpthttps://nano-gpt.com/api/v1nano-gpt.com
Venicevenicehttps://api.venice.ai/api/v1venice.ai/settings/api
Nous Research(Hermes)nousresearchhttps://inference-api.nousresearch.com/v1portal.nousresearch.com
ainetcafeainetcafehttps://microquickjs.com/v1ainetcafe API Key(AINETCAFE_API_KEY

Venice 的 API 访问是权益而非仅仅是 Key:免费 Venice 账户没有任何 API 权限。Pro 订阅、充值 USD 余额、或质押 VVV 获得 VCU 才能让 Key 可用——路由器在接入供应商时就打印该要求,而不是等 Codex 内部出现 403。Nous Research 的 Key 是 Nous Portal API Key,与 Hermes agent 使用同一个端点;内置注册表现在列出 28 个 Nous 模型(含 Hermes 4 与免费门户档位),但仍不是完整的 372 模型目录。OpenRouter 在可策展目录之上还内置了 Grok 4.6、Union Alpha 等固定路线。ainetcafe 内置一条固定路线 ainetcafe/kimi-k3,指向其 OpenAI 兼容端点,并复用其它 Kimi K3 转售路线相同的 kimi-k3 请求画像,使用默认 256K 上下文与文本+图片输入。

GLM-5.3-Flash(原 Ox Alpha)

最初以 “Ox Alpha” 名义上线的隐身 1M 上下文推理模型已经升级:OpenCode Go 现在以命名、计费的 glm-5.3-flash 发布它,实测也已认证 OpenRouter、Z.ai API 与 Z.ai Coding 上的同名模型。不再有任何内置 Ox Alpha 路线——未通过实测的 Command Code 与 Venice 预设已被撤回,OpenCode Free / OpenRouter / Nous 预设也已移除:

选择器标签模型 ID需要 Key?状态
GLM-5.3-Flash (opencode Go)opencode-go/glm-5.3-flashopencode命名替代
GLM-5.3-Flash (Command Code)commandcode/glm-5.3-flashCommand Code可用——目录固定
GLM-5.3-Flash (OpenRouter)openrouter/glm-5.3-flashOpenRouter可用
GLM-5.3-Flash (Z.ai API)zai-api/glm-5.3-flashZ.ai API可用
GLM-5.3-Flash (Z.ai Coding)zai-coding/glm-5.3-flashZ.ai Coding可用
GLM-5.3-Flash (Ollama Cloud)ollama-cloud/glm-5.3-flashOllama CloudCandidate——需要精确路线实测
Ox Alpha (Venice)venice/ox-alpha撤回——实测被账单阻断
Ox Alpha (OpenCode Free / OpenRouter / Nous)opencode-free/ox-alpha撤回

已认证 Flash 路线的推理档位是 low · high · max,默认 max。Z.ai Coding、Z.ai API、OpenRouter 与 Command Code 的 Flash 路线已声明原生文本和图片输入,粘贴图片会绕过 Vision Bridge;无后缀 GLM-5.3 仍是纯文本。Ollama Cloud candidate 已列出但尚未认证。现有 opencode-go/ox-alpha 选择与本地策展的 opencode-go/ox-alpha-free 会自动迁移到 opencode-go/glm-5.3-flash。选择器仍显示宣传的 1M 上下文,但 Codex 会在 每一条 GLM-5.3-Flash 路线上于 400K 处提前压缩。

免费预览已经结束:保留的是凭据路线上的命名模型,各供应商留存条款不同(OpenCode 声称零数据留存、Venice 匿名化、其它说得更少)。

Union Alpha(opencode Go 与 OpenRouter)

OpenCode Go 当前的隐身预览模型是 Union Alpha。它与 Ox Alpha / GLM-5.3-Flash 是两个不同的模型:OpenCode 未公布其开发方,文档给出 262,144 token 上下文与 131,072 token 宣传输出、文本与图片输入,目前标注为限时免费。

选择器标签模型 ID需要 Key?说明
Union Alpha (opencode Go)opencode-go-messages/union-alphaopencode Go/ZenAnthropic Messages 通道,目前免费
Union Alpha (OpenRouter)openrouter/union-alphaOpenRouterstealth/union-alpha 同一预览

Go 路线使用 Anthropic Messages API 而非 Chat Completions,并保留实测的 32,768 token 补全上限,使 Desktop 规模的首轮加上该预留仍能放进 262,144 窗口;压缩阈值保持在 180,000,高于缓存的工具 schema 下限。Console Go 还会拒绝单条超过 2,500,000 字符的消息,因此超大的 ImageGen data URL 会被替换为带标记的占位串,而 Codex 仍保留该文件。OpenRouter 以 stealth/union-alpha 发布同一预览,但不公布推理档位阶梯,因此该路线只存储保守的单一 high 档,并且只接受 tool_choice auto。ClinePass 与 Command Code 没有列出该 ID;Omen Alpha 仅作为已弃用条目留在 Go 实时目录中,未随仓库发布。请重建目录并完全退出、重新打开 Codex 以看到新的选择器条目。

本地后端:Ollama 与 LM Studio

本机运行的模型会在 local 供应商下出现在选择器中。Ollama 保持原生路由,LM Studio 可作为第二个本地后端与它并行——其模型使用稳定的 lmstudio/<model-id> 命名空间,相同 ID 也不会冲突:

./bin/model-router codex providers enable lmstudio
./bin/curate-models lmstudio

默认端点为 http://127.0.0.1:1234/v1;LM Studio 监听其他地址时设置 MODEL_ROUTER_LMSTUDIO_BASE_URL。只有你明确勾选的模型才会发布,并在选择器中标注 experimental。完整流程见本地模型指南

定制通用 Ollama 供应商时,不再回退到 131,072 token 的猜测值与纯文本输入。当供应商是以 /v1 为根的 OpenAI 聊天端点时,发现流程还会向同一服务器的 /api/show 逐模型查询、验证返回确实是 Ollama 结构,并且只填补模型列表留空的字段——因此服务器以 1M 加视觉运行的模型会按实际提供的窗口与模态定制。探测是有界的:遇到路由缺失或连续三次拒绝即停止,并跳过服务器无法描述的模型。定制会存储实际宣传的窗口与图片输入,发现流程以 contextLengthsinputModalities 报告它们;文档默认值不会再冒充服务器实际提供的能力。

供应商设置指南

每个供应商都有单独的分步指南:DeepSeekKimiGLMGrokClaudeopencode Goopencode ZenGitHub CopilotOllama CloudCommand CodeMeta Muse SparkQwen planNous ResearchVeniceMiniMax小米 MiMoClinePass本地模型。其它请用自定义模型

验证模型

启用供应商后重启 Codex,确认选择器条目。对具体模型做一次实时(消耗配额)检查:

./bin/test-model 'groq/MODEL_ID' --live --yes

分模型教程见 DeepSeekKimiGLMGrokClaude;模型不出现时看故障排查