最后更新

Codex Router 更新日志 — 版本历史

本页追踪 Codex Router 的每个版本,并依据仓库的 CHANGELOG.md 更新。当前发布线为 0.6.0;“Unreleased”内容来自主分支,尚不等同于稳定版承诺。

更新方式

Codex Router 通过托管检出更新:运行 ./bin/model-router codex update(Windows 为 ./codex-router.ps1 codex update)。更新要求干净的 main 检出与可识别的 GitHub 源,把上一版本保留为本地回滚引用,并从新版本重新安装。任何更新后运行 ./bin/model-router codex doctor --fix,让生成的配置与服务与源码版本一致,然后完全退出并重新打开 Codex 以重载合并模型目录。

完整、逐条的中文翻译量过大,下面给出各版本的中文要点;逐条细节请阅读英文完整更新日志

Unreleased(未发布)

  • 原生 GPT 重放保留路由模型的可见推理:当任务从路由模型切回原生模型时,无法由原生后端解密的路由 reasoning 会转换成带标记的助手文本,让后续模型真正读到对话依赖的上下文;原生 reasoning item 保持原样。
  • 子代理使用已配置的推理档位:生成的路由 agent 定义现在写入每个模型配置的 model_reasoning_effort,避免低推理父代理把所有子代理也意外限制在低档位。
  • 新增 Union Alpha 隐身预览:OpenCode Go 的 Messages 通道新增 opencode-go-messages/union-alpha,OpenRouter 以 stealth/union-alpha 发布同款;262,144 上下文、32,768 补全上限、180,000 压缩阈值,目前限时免费。多条修复让被提前关闭的推理前缀不再被存成 final_answer,超大 ImageGen 图片会以占位串替代。
  • 新增 Google Cloud Vertex AI 供应商:使用 gcloud auth application-default login 的 Application Default Credentials(非 API Key),纯目录型、默认不启用,支持 --static 离线定制与 --no-discovery
  • 新增 ainetcafe 供应商ainetcafe/kimi-k3 指向其 OpenAI 兼容端点,复用 kimi-k3 请求画像,默认 256K 上下文与文本+图片输入。
  • 新增选择器顺序控制./bin/model-router codex picker-order 可在 native-first(默认)与 routed-first 之间切换,把路由模型发布到原生 GPT 条目之前。
  • OpenCode Zen 拆分协议变体:定制的 Claude 落在 opencode-zen-messages,GPT、Grok、Muse 落在 opencode-zen-responses,Gemini 被拒绝。
  • GLM-5.3-Flash 与图片/档位修复:Command Code 的 Flash 路线补齐 ox-alpha 收敛并在 400K 压缩,DeepSeek V4.1 Flash 补充图片输入;原生 GPT 重放不再被当作提示词收费,图片 token 估算有 4096 上限兜底。
  • 配置与安装健壮性修复:YAML 中撇号不再吞掉后面的配置、config.toml 多行字符串不再被误改、Gemini .env 的 CRLF/LF 混用可原样保留、失败安装后 POSIX 重试会回到 main、Windows 缺少计划任务时 start/restart 会明确报错。
  • ChatGPT 额度耗尽时自动审批可回退到路由模型Approve for me 使用 Codex 自身隐藏的原生模型,与会话额度是两套。现在可用 ./bin/control auto-review-fallback set <provider/model> 指定接管这些审查的模型;仅在原生审查者因额度拒绝后生效,且限定在该次拒绝声明的窗口内,拒绝、策略驳回与其它错误仍留在原生审查者,deny 绝不转交重试。
  • 新增 subagents explain <model>:直接说明某条路线为何无法作为子代理委派,给出第一个阻塞点与修复命令,并区分拼写错误、未定制模型与原生 slug;同时说明 v2 声明来自注册表、本机五项检查还是你自己的选择。只读且不消耗额度。
  • 修复子代理 effort 导致的假漂移syncRoutedCodexAgents 写入 model_reasoning_effort,而状态检查计算期望内容时未包含它,导致设置了子代理 effort 的模型永远被报告为 stale--fix 也只是原样重发。现已对齐。
  • 新增 OpenRouter Decisions 原生路线/v1/decisions 支持 OpenRouter 的 Decisions 协议,openrouter-decisions/jev-latest 复用同一份存储密钥并指向 https://openrouter.ai/api/alpha。该路线刻意不在选择器中列出,供 jev-pruner 这类本地集成使用,不能替代 Codex 原生压缩。
  • doctor 警告被下架的路由:当某条已列出路线从其供应商目录中消失时,doctor 只警告而不自动删除,由你决定是否移除;一次失败或过期的抓取绝不会隐藏仍可用的路线,模型回归后下次刷新即清除警告。

0.6.0

  • 转售路线不再把历史推理重复显示为正文:不符合原生推理重放契约的 Chat Completions 路线现在会丢弃历史推理 carry,而不是转换成 output_text;修复 Command Code 等模型把自己的进度笔记重复 2、4、5、8、16 次的问题。符合厂商推理契约的路线与原生 Responses 路线不受影响。
  • 首次冷启动超时不再卸载服务:全新安装时,即使 LiteLLM 因模型较多而超过 300 秒健康检查,安装器也会保留已经注册并运行的服务、启动器和客户端配置,并提示后续检查。只有确认崩溃循环或启动器损坏时才回滚。
  • GLM-5.3-Flash 原生读取图片zai-coding/glm-5.3-flashzai-api/glm-5.3-flashopenrouter/glm-5.3-flash 已声明文本和图片输入,粘贴截图时不再调用第二个 Vision Bridge 模型并消耗额外额度。无后缀的完整 GLM-5.3 仍是纯文本路线;更新后需重建目录并完全退出、重新打开 Codex。
  • Harness 页面新增 Route 开关:每个客户端都能单独打开或关闭路由。打开会在需要时完成设置并发布模型;关闭只撤下该客户端中由 Codex Router 管理的配置,不影响共享服务或其它客户端。
  • 五个新客户端可从 Harness 页面发布:opencode、pi、omp(oh-my-pi)、Command Code 与 Hermes Agent 现在各写入一个 codex-router 供应商配置。Control Center 的 Harness 页面「Route」开关会在需要时安装 CLI 并把整份路由模型一次性发布;./bin/control client-setup <id>client-disconnect <id> 是终端等价命令。Responses 客户端指向本地回环 /v1,Command Code 与 Hermes 使用与 Claude Code 相同的 Anthropic Messages 接口(codex_router/anthropic/<slug>)。YAML 按行区间拼接以保留注释与其它供应商,无法往返的 JSON 会被拒绝,且路由器只拥有自己发布的那个 provider key。
  • 客户端可单独更新./bin/control client-update <id>client-update --all 运行各客户端自带更新器(opencode upgradepi update --selfcommand-code updatehermes update --yes),而非 npm install -g,因此 Homebrew 或 curl | sh 安装的 CLI 会原地升级;发布模型列表不会顺带升级客户端。pi 的安装包已迁移到 @earendil-works/pi-coding-agent
  • 新增 “Use Router with ChatGPT” 开关:在保持 ChatGPT 登录可用的同时让外部模型仍可选。显式切换会把内置 OpenAI provider 指向托管的 codex-router-signed 传输,使 Codex 在发送前先向路由器校验带前缀的模型 ID;关闭时恢复原 provider。常规更新与目录刷新不会自动替已有安装打开此开关。
  • 推理可见性与泄漏工具调用恢复:LiteLLM 桥接的 Chat Completions 推理现在能在 Codex 中显示并写入线程;模型把工具调用当作文本写出(如 Hy4 的 <tool_calls:NONCE>)时会被解析回真正的 function_call,避免回合空转结束。Hy4 Preview 不再因自己的进度笔记自循环,厂商要求的推理重放也按上游模型族而非请求配置决定。大工具列表下(response.created 帧曾超过 256 KiB)空工具消息与直连 DeepSeek 推理修复不再失效,帧上限提升到 10 MiB。
  • Kimi/Moonshot 工具 schema 修复{"anyOf":[{"type":"string"},{"type":"null"}]} 这类叶子未声明 type 的联合不再被 Moonshot 以 missing type in anyOf properties 拒绝;仅在节点已暗示类型时补声明,内置 Kimi 与其它供应商负载不变。
  • 流式与配额修复:流式答案开头的空白(如以换行开始的代码块)不再丢失,且流与 output_text.done/存储快照保持一致;opencode Zen 的配额响应头不再覆盖 Go 套餐的 rate-limits.json 条目(#575)。原生重放同时包含完整 reasoning item 与同 rs_ id 的 item_reference 时会去掉冗余引用,只保留完整 item。
  • DeepSeek V4.1 Flash 上线:2026-09-10 发布的新模型已加入 DeepSeek API、OpenCode Go、Nous Research、Command Code、OpenRouter 与 Ollama Cloud 路线;厂商直连提供 1M 上下文、图片输入及 low/high/max 推理。旧 V4 路线继续保留,DeepSeek 的旧 V4 Flash 别名现由 V4.1 Flash 提供。
  • Grok 4.6 OAuth 与 Fast 档位:Grok 4.6 现在可通过官方 Grok CLI OAuth 使用,支持 500K 上下文、图片、网页/X 搜索和可选 priority Fast;长推理停顿有心跳保活,失败修复不会释放不完整答案或触发静默重复计费。
  • 移除高风险 ChatGPT Web 供应商:非官方 chatgpt.com 浏览器自动化可能导致 OpenAI 账户被暂停或永久封禁,因此上游已彻底删除;旧 chatgpt-web/* 定制条目会被安全跳过,用户应手动移除。
  • 路由模型显示与工具调用更接近原生 Codex:进度消息与最终答案现在带正确 phase;apply_patch 参数不符合 LiteLLM 包装形式时不再让流中断;从外部模型切回 OpenAI 时会清理不兼容的上游 item ID。
  • 目录漂移与未知路线保护:Codex 升级或同版本运行时被替换后会重新捕获原生模型目录;未知 provider/model 现在以本地 unrouted_model 失败,不会误把提示发送给 ChatGPT。doctor 会指出无有效路线的用户模型。
  • Muse Spark 1.3 扩展:Meta Model API 新增 Muse Spark 1.3 与 Contributor,Command Code 新增 Muse Spark 1.3;Contributor 档位可能允许 Meta 使用输入输出改进产品,应按数据政策选择。
  • 9 月 8 日稳定性更新:OpenCode Go 的 Muse Spark 1.2/1.3 Contributor 现在可重放已完成的网页搜索历史;已标记为可重试的路由传输故障会安全重试一次,避免瞬时上游故障直接终止任务。
  • 路由子代理会自动修复并保持供应商亲和性:启动时会核对托管 agent 定义与当前模型、可见性及子代理设置;缺失、过期或漂移的定义会重新发布,子代理也会留在父模型所属供应商上。
  • Control Center 与托盘修复:24H 图表改为精确滚动 24 小时且包含两个边缘小时;macOS 托盘直接读取健康端点,不再每秒启动 Node 进程占满一个 CPU 核;生成期间隐藏不准确的 tok/s,并从速度计算中排除推理 token。
  • Command Code 工具兼容增强:超过 64 字符的工具名会使用可逆别名,递归 JSON Schema 会被修复,避免 Codex MCP 工具在生成前收到 400;Grok OAuth 的工具后续流式修复也更可靠。
  • 原生 GPT 目录可自动刷新:同版本 Codex 运行时被替换或目录出现未来模型(如 GPT-6 Astra、GPT-7、o5)时可直接重新捕获,不再要求卸载路由器。
  • 桌面端要求与本地化:macOS 托盘/小组件构建明确要求完整 Xcode App,并尊重 DEVELOPER_DIR;Control Center 新增西班牙语界面。这是上游应用本地化,不代表本站已新增西班牙语内容页。
  • 同一套模型可发布到更多客户端:主分支新增 DeepSeek Harness、Gemini CLI、Cursor Agent / Cursor App、Claude Code 与 OpenClaw 目标;它们复用同一份供应商凭据、模型可见性、故障转移与用量统计。Claude Code、Cursor Agent 和 Gemini CLI 的既有订阅会话还可通过实验性的 Agent Bridge 单独调用,路由器不会复制其 OAuth token。
  • 原生 ChatGPT 多账号切换:Control Center 可保存彼此隔离的 ChatGPT 登录资料并安全切换;账户切换不再要求先禁用路由器。
  • 2026-09-03 新模型固定:Gemini 3.8 Flash、Muse Spark 1.3 / Contributor、Claude Fable 5.1、Command Code Qwen3.8 Max 0902 与 GLM-5.3-Flash、OpenCode Go Qwen3.8 Flash 已加入对应供应商;OpenCode Free 还可发现免 Key 的 Muse Spark 1.3 Contributor Free。
  • Ollama Cloud 新增 GLM-5.3 与 GLM-5.3-Flash:两个条目已经进入内置模型矩阵,但上游仍将其标记为需要精确路线实测的 candidate,不应与已认证的 OpenCode Go / OpenRouter / Z.ai 路线混为一谈。
  • 选择器与流式输出修复:路由模型按供应商品牌分组;Grok OAuth 可显示推理摘要并正确结束网关故障;严格上游不再收到空工具数组;Qwen 等模型的 <think> 标签不会泄漏进可见答案,文本与工具调用混合的回合不再重复渲染。
  • Control Center 与安装体验:推荐安装现在默认包含 Electron Control Center、托盘/菜单栏应用和 macOS 桌面小组件;Windows 后台助手不再闪出 PowerShell 窗口,关闭 macOS Control Center 后应用仍留在 Dock / 菜单栏。

0.5.1

  • 完整桌面安装成为默认推荐路径:macOS/Linux 使用 --guided --with-tray,Windows 使用 -Guided -WithTray,一次安装路由服务、Control Center 与托盘/菜单栏前端;Homebrew 仍是纯 CLI 路径。
  • 模型与路由更新:固定 Qwen3.8 Flash、GLM-5.3 与 OpenRouter Grok 4.6,完成 Ox Alpha 到 GLM-5.3-Flash 的迁移,并加强 OpenCode Go Kimi K2.7 Code 的工具架构兼容。
  • 凭据与传输强化:增加安全的供应商 API Key 池、通用 OpenAI 兼容供应商、能力门控 embeddings、带调用方认证的 Responses WebSocket,以及更严格的密钥隔离与轮换。
  • 安装恢复更可靠:修复不同检出目录接管状态时的安装死锁、Windows ACL 与服务存活判断、更新和回滚中的状态所有权边界。

0.5.0

  • Grok 4.6 上 opencode Goopencode-go-responses/grok-4.6(500K 上下文、文本+图像、low/medium/high/xhigh 推理阶梯),opencode Go 端点按官方表格发布;Grok 4.5 保留在同一个 Responses 变体。
  • Nous Research 新增约 27 个模型:含 Hermes 4(405B/70B)、6 个免费门户路线、以及 DeepSeek V4、Kimi K3、Qwen 3.8/3.7 Max、GLM-5.3、GPT-5.6 Terra、Gemini 3.7 Flash、Grok 4.6 等编码旗舰,共 28 个内置条目(非完整 372 模型目录)。
  • Ox Alpha 从六路线毕业:最初在六条路线免费上线的隐身 1M 推理模型,在 0.5.0 中完成验证与调整——Command Code/Venice 未通过实测被撤回,OpenCode Free/OpenRouter/Nous 预设移除,保留路线迁移至 GLM-5.3-Flash。
  • 新增 Venice 与 Nous Research(Hermes)API Key 供应商:Venice 免费账户无 API 权益(需 Pro 订阅/充值/质押 VVV),Nous 使用 Nous Portal Key;均带单条内置模型,覆盖 doctor 与托盘。
  • ChatGPT 订阅访问改为显式一次性授权:非 Codex 客户端(DeepSeek Harness、Gemini CLI 等)不再自动使用发现的 Codex auth.json,登录后运行 model-router codex chatgpt-session enable 一次即可;禁用即全局撤回原生 GPT 发布。
  • 子代理选择重新生效proven/selected/all 三种模式此前被静默丢弃,现已修复;测试套件不再清空操作者的子代理定义。
  • Control Center 模型页统一:提供方账号并入连接条、一个”添加模型”对话框搜索所有已连接目录;Windows 启动在计划任务失效时快速失败而非空等。
  • Grok/DeepSeek 推理摘要 + Grok 图像多模态:思考过程可在 Codex 中显示并折叠;工具结果图片保持像素、view_image 正常完成。

0.4.0-beta.4

  • 面板/桌面伴侣可用性大幅提升bin/panel(Windows codex-router.ps1 panel)在默认浏览器打开面板;伴侣不再需要 Rust 工具链(回退到只需 Node 的 Electron shell),Windows/Linux 二进制直接随发布附带下载,Windows 托盘获得与 macOS 一致的 tray [install|status|start|stop|restart|uninstall] 管理命令。
  • 凭据无关的安装模式install.sh --no-provider --no-discovery(PowerShell -NoProvider -NoDiscovery)安装空闲路由器——不提示任何凭据,Codex 流量返回本地 503 router_idle_no_provider,doctor 以 warn 报告空闲状态并退出 0,配合新的 stop 子命令形成完整生命周期。
  • 子代理自动研究:把一个模型开为子代理时会先进行分离的能力探测(两次真实请求验证流式与强制工具调用),通过后以 experimental 身份发布为 v2;首次真实子代理回合由路由器观察并记录机器本地证明,结构性拒绝会降回 v1 并保留原因。control subagents verify 可显式重跑。
  • 推理模型不再沉默 30 秒:空补全守卫不再把推理 delta 视为空白——首个字节从约 30 秒降到约 0.5 秒;已到达客户端的空回合以 error 事件写入开放流,Codex 自己重试。
  • 已完成的子代理自动关闭:托管 multi_agent_v2 块新增根使用提示,父回合结束前会注入缺失的 interrupt_agent 调用,孩子不再停留在 Working。
  • GLM-5.3 上线 + Z.ai 计量平台:GLM-5.3(2026-08-14 发布)进入 Coding Plan(zai-coding/glm-5.3)、计量平台(zai-api/glm-5.3)与 opencode Go 三路;zai-api 是独立凭据的按量供应商(GLM-5.3/5.2/4.7,独立密钥文件与 ZAI_PLATFORM_API_KEY);GLM 推理档位按模型自身注册表阶梯收敛。
  • DeepSeek Harness 支持:托盘可一键安装 @deepseek-ai/dsh 并发布模型;原生 GPT 模型在已登录 Codex 会话可用时发布到 Harness,会话失效即撤回(CODEX_ROUTER_NATIVE_SESSION_FALLBACK=0 关闭)。
  • 卸载最后一个客户端时移除后台服务:安装状态见证改为托管块,bin/disable 现在会同时退役服务。
  • 修复 Windows 下所有单参数子命令不可达(PowerShell 数组塌缩)、bin/ 脚本 CRLF 换行、调用方密钥脱敏遗漏面板 URL 等。

0.4.0-beta.3

  • 新增 GitHub Copilot catalog-only 供应商:使用具有 Copilot Requests 权限的 fine-grained PAT,校验账户权益与 GitHub 自有推理端点,只发现当前账户可用、支持流式输出与工具调用的模型。
  • Vision Bridge(视觉桥)默认开启并更可靠:粘贴图片即可自动读取;最新图片跟随最新问题、支持识别信息、候选视觉引擎回退、限定重试、并发去重与工具结果图片,不完整读取明确标注。
  • 新增自定义模型技能包:为任务、自动化、应用内浏览器和电脑操作提供四个受管理技能;不覆盖用户同名技能,doctor 校验版本与工具集一致性。
  • 用量面板显示更多配额:xAI OAuth、MiniMax、Command Code、opencode Go 显示剩余计划额度(周/月窗口),凭据只发给供应商自己的主机。
  • 上游中继更稳健:对尚未返回响应字节的部分网关错误短暂重试并保留 429 的 Retry-After;单 union 根工具模式不再导致 xAI OAuth 整轮失败;所有连接级失败记录完整原因链。
  • 本地模型(Local LLMs)增强:“该下载哪个”的推荐分组、agent-check 实测工具调用、内存适配检查(fits/tight/too-large,install 拒绝 too-large)。
  • 安全修复:litellm 升级到 1.96.0(cryptography 50.0.0,修复 GHSA-g6cj-pr64-35w5);update check 真正只读;更新允许未跟踪文件。

0.4.0-beta.2

  • 更新不再重装未变化的依赖:Node 与 Python 依赖步骤按指纹跳过,损坏时才由 doctor --fix 强制重建。
  • update check 不再执行更新:只读的可用性检查现在真正只读。
  • 推理档位与已装 Codex 版本匹配:不支持的 effort 值会映射到最近的受支持档位。
  • 旧 opencode Go 模型提供原生升级提示:GLM-5.1、Kimi K2.6、MiniMax M2.7 带 upgradeTo 指向同订阅的继任者。
  • 新模型会在 Codex 中自我公告:“Introducing” 卡片持续七天。
  • 适配已装 Codex 构建的 [agents] 并发默认值,并随构建变化重新捕获原生目录。
  • 每个供应商的推理档位阶梯按官方文档核对(Kimi K3、DeepSeek V4、Claude Opus 4.8、GLM-5.2 等)。
  • 新增 Meta Model API 供应商(Muse Spark 1.1/1.2/1.2 Contributor)。
  • opencode Go 成为统一的供应商族,并移除 Cursor 与 opencode 应用目标。
  • 修复 Windows 下原生 OpenAI 模型消失、Grok OAuth 凭据、API Key 提示确认、引导式安装新增桌面伴侣、Ollama Cloud 与 Qwen plan 供应商、交互式模型定制(curate-models)等。

0.3.0

  • 为 Kimi OAuth、Kimi API 与 DeepSeek API 增加引导式、供应商感知的安装。
  • 对两个已识别的旧 Kimi 路由器布局做安全检测、快照、自动迁移与精确回滚。
  • 增加 macOS launchd、Linux systemd-user 与 Windows 任务计划程序服务,以及原生 PowerShell 安装器与命令包装器。
  • 增加供应商可见性与运行时强制,隐藏的外部模型不会被误认为原生模型。
  • 增加 doctor --fix、隐私安全的 support bundle、更新回滚、受保护的供应商模型发现与计费兼容性测试。
  • 增加跨平台 CI、依赖审计、带 SHA-256 校验和的标签源码归档与 GitHub 构建来源证明。

0.2.0

  • 把最初仅支持 Kimi 的原型推广为经过验证的供应商/模型注册表。
  • 增加独立的 Kimi OAuth、Kimi API 与 DeepSeek API 路由,同时保留原生 Codex 模型与 ChatGPT 认证。