最后更新
Codex Router 更新日志 — 版本历史
本页追踪 Codex Router 的每个版本,并依据仓库的 CHANGELOG.md 更新。当前发布线为 0.6.0;“Unreleased”内容来自主分支,尚不等同于稳定版承诺。
更新方式
Codex Router 通过托管检出更新:运行 ./bin/model-router codex update(Windows 为 ./codex-router.ps1 codex update)。更新要求干净的 main 检出与可识别的 GitHub 源,把上一版本保留为本地回滚引用,并从新版本重新安装。任何更新后运行 ./bin/model-router codex doctor --fix,让生成的配置与服务与源码版本一致,然后完全退出并重新打开 Codex 以重载合并模型目录。
完整、逐条的中文翻译量过大,下面给出各版本的中文要点;逐条细节请阅读英文完整更新日志。
Unreleased(未发布)
- 原生 GPT 重放保留路由模型的可见推理:当任务从路由模型切回原生模型时,无法由原生后端解密的路由 reasoning 会转换成带标记的助手文本,让后续模型真正读到对话依赖的上下文;原生 reasoning item 保持原样。
- 子代理使用已配置的推理档位:生成的路由 agent 定义现在写入每个模型配置的
model_reasoning_effort,避免低推理父代理把所有子代理也意外限制在低档位。 - 新增 Union Alpha 隐身预览:OpenCode Go 的 Messages 通道新增
opencode-go-messages/union-alpha,OpenRouter 以stealth/union-alpha发布同款;262,144 上下文、32,768 补全上限、180,000 压缩阈值,目前限时免费。多条修复让被提前关闭的推理前缀不再被存成final_answer,超大 ImageGen 图片会以占位串替代。 - 新增 Google Cloud Vertex AI 供应商:使用
gcloud auth application-default login的 Application Default Credentials(非 API Key),纯目录型、默认不启用,支持--static离线定制与--no-discovery。 - 新增 ainetcafe 供应商:
ainetcafe/kimi-k3指向其 OpenAI 兼容端点,复用kimi-k3请求画像,默认 256K 上下文与文本+图片输入。 - 新增选择器顺序控制:
./bin/model-router codex picker-order可在native-first(默认)与routed-first之间切换,把路由模型发布到原生 GPT 条目之前。 - OpenCode Zen 拆分协议变体:定制的 Claude 落在
opencode-zen-messages,GPT、Grok、Muse 落在opencode-zen-responses,Gemini 被拒绝。 - GLM-5.3-Flash 与图片/档位修复:Command Code 的 Flash 路线补齐
ox-alpha收敛并在 400K 压缩,DeepSeek V4.1 Flash 补充图片输入;原生 GPT 重放不再被当作提示词收费,图片 token 估算有 4096 上限兜底。 - 配置与安装健壮性修复:YAML 中撇号不再吞掉后面的配置、
config.toml多行字符串不再被误改、Gemini.env的 CRLF/LF 混用可原样保留、失败安装后 POSIX 重试会回到main、Windows 缺少计划任务时start/restart会明确报错。 - ChatGPT 额度耗尽时自动审批可回退到路由模型:
Approve for me使用 Codex 自身隐藏的原生模型,与会话额度是两套。现在可用./bin/control auto-review-fallback set <provider/model>指定接管这些审查的模型;仅在原生审查者因额度拒绝后生效,且限定在该次拒绝声明的窗口内,拒绝、策略驳回与其它错误仍留在原生审查者,deny绝不转交重试。 - 新增
subagents explain <model>:直接说明某条路线为何无法作为子代理委派,给出第一个阻塞点与修复命令,并区分拼写错误、未定制模型与原生 slug;同时说明 v2 声明来自注册表、本机五项检查还是你自己的选择。只读且不消耗额度。 - 修复子代理 effort 导致的假漂移:
syncRoutedCodexAgents写入model_reasoning_effort,而状态检查计算期望内容时未包含它,导致设置了子代理 effort 的模型永远被报告为stale,--fix也只是原样重发。现已对齐。 - 新增 OpenRouter Decisions 原生路线:
/v1/decisions支持 OpenRouter 的 Decisions 协议,openrouter-decisions/jev-latest复用同一份存储密钥并指向https://openrouter.ai/api/alpha。该路线刻意不在选择器中列出,供 jev-pruner 这类本地集成使用,不能替代 Codex 原生压缩。 - doctor 警告被下架的路由:当某条已列出路线从其供应商目录中消失时,doctor 只警告而不自动删除,由你决定是否移除;一次失败或过期的抓取绝不会隐藏仍可用的路线,模型回归后下次刷新即清除警告。
0.6.0
- 转售路线不再把历史推理重复显示为正文:不符合原生推理重放契约的 Chat Completions 路线现在会丢弃历史推理 carry,而不是转换成
output_text;修复 Command Code 等模型把自己的进度笔记重复 2、4、5、8、16 次的问题。符合厂商推理契约的路线与原生 Responses 路线不受影响。 - 首次冷启动超时不再卸载服务:全新安装时,即使 LiteLLM 因模型较多而超过 300 秒健康检查,安装器也会保留已经注册并运行的服务、启动器和客户端配置,并提示后续检查。只有确认崩溃循环或启动器损坏时才回滚。
- GLM-5.3-Flash 原生读取图片:
zai-coding/glm-5.3-flash、zai-api/glm-5.3-flash与openrouter/glm-5.3-flash已声明文本和图片输入,粘贴截图时不再调用第二个 Vision Bridge 模型并消耗额外额度。无后缀的完整 GLM-5.3 仍是纯文本路线;更新后需重建目录并完全退出、重新打开 Codex。 - Harness 页面新增 Route 开关:每个客户端都能单独打开或关闭路由。打开会在需要时完成设置并发布模型;关闭只撤下该客户端中由 Codex Router 管理的配置,不影响共享服务或其它客户端。
- 五个新客户端可从 Harness 页面发布:opencode、pi、omp(oh-my-pi)、Command Code 与 Hermes Agent 现在各写入一个
codex-router供应商配置。Control Center 的 Harness 页面「Route」开关会在需要时安装 CLI 并把整份路由模型一次性发布;./bin/control client-setup <id>与client-disconnect <id>是终端等价命令。Responses 客户端指向本地回环/v1,Command Code 与 Hermes 使用与 Claude Code 相同的 Anthropic Messages 接口(codex_router/anthropic/<slug>)。YAML 按行区间拼接以保留注释与其它供应商,无法往返的 JSON 会被拒绝,且路由器只拥有自己发布的那个 provider key。 - 客户端可单独更新:
./bin/control client-update <id>与client-update --all运行各客户端自带更新器(opencode upgrade、pi update --self、command-code update、hermes update --yes),而非npm install -g,因此 Homebrew 或curl | sh安装的 CLI 会原地升级;发布模型列表不会顺带升级客户端。pi 的安装包已迁移到@earendil-works/pi-coding-agent。 - 新增 “Use Router with ChatGPT” 开关:在保持 ChatGPT 登录可用的同时让外部模型仍可选。显式切换会把内置 OpenAI provider 指向托管的
codex-router-signed传输,使 Codex 在发送前先向路由器校验带前缀的模型 ID;关闭时恢复原 provider。常规更新与目录刷新不会自动替已有安装打开此开关。 - 推理可见性与泄漏工具调用恢复:LiteLLM 桥接的 Chat Completions 推理现在能在 Codex 中显示并写入线程;模型把工具调用当作文本写出(如 Hy4 的
<tool_calls:NONCE>)时会被解析回真正的function_call,避免回合空转结束。Hy4 Preview 不再因自己的进度笔记自循环,厂商要求的推理重放也按上游模型族而非请求配置决定。大工具列表下(response.created帧曾超过 256 KiB)空工具消息与直连 DeepSeek 推理修复不再失效,帧上限提升到 10 MiB。 - Kimi/Moonshot 工具 schema 修复:
{"anyOf":[{"type":"string"},{"type":"null"}]}这类叶子未声明type的联合不再被 Moonshot 以missing type in anyOf properties拒绝;仅在节点已暗示类型时补声明,内置 Kimi 与其它供应商负载不变。 - 流式与配额修复:流式答案开头的空白(如以换行开始的代码块)不再丢失,且流与
output_text.done/存储快照保持一致;opencode Zen 的配额响应头不再覆盖 Go 套餐的rate-limits.json条目(#575)。原生重放同时包含完整reasoningitem 与同rs_id 的item_reference时会去掉冗余引用,只保留完整 item。 - DeepSeek V4.1 Flash 上线:2026-09-10 发布的新模型已加入 DeepSeek API、OpenCode Go、Nous Research、Command Code、OpenRouter 与 Ollama Cloud 路线;厂商直连提供 1M 上下文、图片输入及 low/high/max 推理。旧 V4 路线继续保留,DeepSeek 的旧 V4 Flash 别名现由 V4.1 Flash 提供。
- Grok 4.6 OAuth 与 Fast 档位:Grok 4.6 现在可通过官方 Grok CLI OAuth 使用,支持 500K 上下文、图片、网页/X 搜索和可选
priorityFast;长推理停顿有心跳保活,失败修复不会释放不完整答案或触发静默重复计费。 - 移除高风险 ChatGPT Web 供应商:非官方 chatgpt.com 浏览器自动化可能导致 OpenAI 账户被暂停或永久封禁,因此上游已彻底删除;旧
chatgpt-web/*定制条目会被安全跳过,用户应手动移除。 - 路由模型显示与工具调用更接近原生 Codex:进度消息与最终答案现在带正确 phase;
apply_patch参数不符合 LiteLLM 包装形式时不再让流中断;从外部模型切回 OpenAI 时会清理不兼容的上游 item ID。 - 目录漂移与未知路线保护:Codex 升级或同版本运行时被替换后会重新捕获原生模型目录;未知
provider/model现在以本地unrouted_model失败,不会误把提示发送给 ChatGPT。doctor会指出无有效路线的用户模型。 - Muse Spark 1.3 扩展:Meta Model API 新增 Muse Spark 1.3 与 Contributor,Command Code 新增 Muse Spark 1.3;Contributor 档位可能允许 Meta 使用输入输出改进产品,应按数据政策选择。
- 9 月 8 日稳定性更新:OpenCode Go 的 Muse Spark 1.2/1.3 Contributor 现在可重放已完成的网页搜索历史;已标记为可重试的路由传输故障会安全重试一次,避免瞬时上游故障直接终止任务。
- 路由子代理会自动修复并保持供应商亲和性:启动时会核对托管 agent 定义与当前模型、可见性及子代理设置;缺失、过期或漂移的定义会重新发布,子代理也会留在父模型所属供应商上。
- Control Center 与托盘修复:24H 图表改为精确滚动 24 小时且包含两个边缘小时;macOS 托盘直接读取健康端点,不再每秒启动 Node 进程占满一个 CPU 核;生成期间隐藏不准确的 tok/s,并从速度计算中排除推理 token。
- Command Code 工具兼容增强:超过 64 字符的工具名会使用可逆别名,递归 JSON Schema 会被修复,避免 Codex MCP 工具在生成前收到 400;Grok OAuth 的工具后续流式修复也更可靠。
- 原生 GPT 目录可自动刷新:同版本 Codex 运行时被替换或目录出现未来模型(如 GPT-6 Astra、GPT-7、o5)时可直接重新捕获,不再要求卸载路由器。
- 桌面端要求与本地化:macOS 托盘/小组件构建明确要求完整 Xcode App,并尊重
DEVELOPER_DIR;Control Center 新增西班牙语界面。这是上游应用本地化,不代表本站已新增西班牙语内容页。 - 同一套模型可发布到更多客户端:主分支新增 DeepSeek Harness、Gemini CLI、Cursor Agent / Cursor App、Claude Code 与 OpenClaw 目标;它们复用同一份供应商凭据、模型可见性、故障转移与用量统计。Claude Code、Cursor Agent 和 Gemini CLI 的既有订阅会话还可通过实验性的 Agent Bridge 单独调用,路由器不会复制其 OAuth token。
- 原生 ChatGPT 多账号切换:Control Center 可保存彼此隔离的 ChatGPT 登录资料并安全切换;账户切换不再要求先禁用路由器。
- 2026-09-03 新模型固定:Gemini 3.8 Flash、Muse Spark 1.3 / Contributor、Claude Fable 5.1、Command Code Qwen3.8 Max 0902 与 GLM-5.3-Flash、OpenCode Go Qwen3.8 Flash 已加入对应供应商;OpenCode Free 还可发现免 Key 的 Muse Spark 1.3 Contributor Free。
- Ollama Cloud 新增 GLM-5.3 与 GLM-5.3-Flash:两个条目已经进入内置模型矩阵,但上游仍将其标记为需要精确路线实测的 candidate,不应与已认证的 OpenCode Go / OpenRouter / Z.ai 路线混为一谈。
- 选择器与流式输出修复:路由模型按供应商品牌分组;Grok OAuth 可显示推理摘要并正确结束网关故障;严格上游不再收到空工具数组;Qwen 等模型的
<think>标签不会泄漏进可见答案,文本与工具调用混合的回合不再重复渲染。 - Control Center 与安装体验:推荐安装现在默认包含 Electron Control Center、托盘/菜单栏应用和 macOS 桌面小组件;Windows 后台助手不再闪出 PowerShell 窗口,关闭 macOS Control Center 后应用仍留在 Dock / 菜单栏。
0.5.1
- 完整桌面安装成为默认推荐路径:macOS/Linux 使用
--guided --with-tray,Windows 使用-Guided -WithTray,一次安装路由服务、Control Center 与托盘/菜单栏前端;Homebrew 仍是纯 CLI 路径。 - 模型与路由更新:固定 Qwen3.8 Flash、GLM-5.3 与 OpenRouter Grok 4.6,完成 Ox Alpha 到 GLM-5.3-Flash 的迁移,并加强 OpenCode Go Kimi K2.7 Code 的工具架构兼容。
- 凭据与传输强化:增加安全的供应商 API Key 池、通用 OpenAI 兼容供应商、能力门控 embeddings、带调用方认证的 Responses WebSocket,以及更严格的密钥隔离与轮换。
- 安装恢复更可靠:修复不同检出目录接管状态时的安装死锁、Windows ACL 与服务存活判断、更新和回滚中的状态所有权边界。
0.5.0
- Grok 4.6 上 opencode Go:
opencode-go-responses/grok-4.6(500K 上下文、文本+图像、low/medium/high/xhigh 推理阶梯),opencode Go 端点按官方表格发布;Grok 4.5 保留在同一个 Responses 变体。 - Nous Research 新增约 27 个模型:含 Hermes 4(405B/70B)、6 个免费门户路线、以及 DeepSeek V4、Kimi K3、Qwen 3.8/3.7 Max、GLM-5.3、GPT-5.6 Terra、Gemini 3.7 Flash、Grok 4.6 等编码旗舰,共 28 个内置条目(非完整 372 模型目录)。
- Ox Alpha 从六路线毕业:最初在六条路线免费上线的隐身 1M 推理模型,在 0.5.0 中完成验证与调整——Command Code/Venice 未通过实测被撤回,OpenCode Free/OpenRouter/Nous 预设移除,保留路线迁移至 GLM-5.3-Flash。
- 新增 Venice 与 Nous Research(Hermes)API Key 供应商:Venice 免费账户无 API 权益(需 Pro 订阅/充值/质押 VVV),Nous 使用 Nous Portal Key;均带单条内置模型,覆盖
doctor与托盘。 - ChatGPT 订阅访问改为显式一次性授权:非 Codex 客户端(DeepSeek Harness、Gemini CLI 等)不再自动使用发现的 Codex
auth.json,登录后运行model-router codex chatgpt-session enable一次即可;禁用即全局撤回原生 GPT 发布。 - 子代理选择重新生效:
proven/selected/all三种模式此前被静默丢弃,现已修复;测试套件不再清空操作者的子代理定义。 - Control Center 模型页统一:提供方账号并入连接条、一个”添加模型”对话框搜索所有已连接目录;Windows 启动在计划任务失效时快速失败而非空等。
- Grok/DeepSeek 推理摘要 + Grok 图像多模态:思考过程可在 Codex 中显示并折叠;工具结果图片保持像素、
view_image正常完成。
0.4.0-beta.4
- 面板/桌面伴侣可用性大幅提升:
bin/panel(Windowscodex-router.ps1 panel)在默认浏览器打开面板;伴侣不再需要 Rust 工具链(回退到只需 Node 的 Electron shell),Windows/Linux 二进制直接随发布附带下载,Windows 托盘获得与 macOS 一致的tray [install|status|start|stop|restart|uninstall]管理命令。 - 凭据无关的安装模式:
install.sh --no-provider --no-discovery(PowerShell-NoProvider -NoDiscovery)安装空闲路由器——不提示任何凭据,Codex 流量返回本地503 router_idle_no_provider,doctor 以 warn 报告空闲状态并退出 0,配合新的stop子命令形成完整生命周期。 - 子代理自动研究:把一个模型开为子代理时会先进行分离的能力探测(两次真实请求验证流式与强制工具调用),通过后以 experimental 身份发布为 v2;首次真实子代理回合由路由器观察并记录机器本地证明,结构性拒绝会降回 v1 并保留原因。
control subagents verify可显式重跑。 - 推理模型不再沉默 30 秒:空补全守卫不再把推理 delta 视为空白——首个字节从约 30 秒降到约 0.5 秒;已到达客户端的空回合以
error事件写入开放流,Codex 自己重试。 - 已完成的子代理自动关闭:托管
multi_agent_v2块新增根使用提示,父回合结束前会注入缺失的interrupt_agent调用,孩子不再停留在 Working。 - GLM-5.3 上线 + Z.ai 计量平台:GLM-5.3(2026-08-14 发布)进入 Coding Plan(
zai-coding/glm-5.3)、计量平台(zai-api/glm-5.3)与 opencode Go 三路;zai-api是独立凭据的按量供应商(GLM-5.3/5.2/4.7,独立密钥文件与ZAI_PLATFORM_API_KEY);GLM 推理档位按模型自身注册表阶梯收敛。 - DeepSeek Harness 支持:托盘可一键安装
@deepseek-ai/dsh并发布模型;原生 GPT 模型在已登录 Codex 会话可用时发布到 Harness,会话失效即撤回(CODEX_ROUTER_NATIVE_SESSION_FALLBACK=0关闭)。 - 卸载最后一个客户端时移除后台服务:安装状态见证改为托管块,
bin/disable现在会同时退役服务。 - 修复 Windows 下所有单参数子命令不可达(PowerShell 数组塌缩)、
bin/脚本 CRLF 换行、调用方密钥脱敏遗漏面板 URL 等。
0.4.0-beta.3
- 新增 GitHub Copilot catalog-only 供应商:使用具有 Copilot Requests 权限的 fine-grained PAT,校验账户权益与 GitHub 自有推理端点,只发现当前账户可用、支持流式输出与工具调用的模型。
- Vision Bridge(视觉桥)默认开启并更可靠:粘贴图片即可自动读取;最新图片跟随最新问题、支持识别信息、候选视觉引擎回退、限定重试、并发去重与工具结果图片,不完整读取明确标注。
- 新增自定义模型技能包:为任务、自动化、应用内浏览器和电脑操作提供四个受管理技能;不覆盖用户同名技能,
doctor校验版本与工具集一致性。 - 用量面板显示更多配额:xAI OAuth、MiniMax、Command Code、opencode Go 显示剩余计划额度(周/月窗口),凭据只发给供应商自己的主机。
- 上游中继更稳健:对尚未返回响应字节的部分网关错误短暂重试并保留 429 的
Retry-After;单 union 根工具模式不再导致 xAI OAuth 整轮失败;所有连接级失败记录完整原因链。 - 本地模型(Local LLMs)增强:“该下载哪个”的推荐分组、
agent-check实测工具调用、内存适配检查(fits/tight/too-large,install拒绝 too-large)。 - 安全修复:litellm 升级到 1.96.0(cryptography 50.0.0,修复 GHSA-g6cj-pr64-35w5);
update check真正只读;更新允许未跟踪文件。
0.4.0-beta.2
- 更新不再重装未变化的依赖:Node 与 Python 依赖步骤按指纹跳过,损坏时才由
doctor --fix强制重建。 update check不再执行更新:只读的可用性检查现在真正只读。- 推理档位与已装 Codex 版本匹配:不支持的 effort 值会映射到最近的受支持档位。
- 旧 opencode Go 模型提供原生升级提示:GLM-5.1、Kimi K2.6、MiniMax M2.7 带
upgradeTo指向同订阅的继任者。 - 新模型会在 Codex 中自我公告:“Introducing” 卡片持续七天。
- 适配已装 Codex 构建的
[agents]并发默认值,并随构建变化重新捕获原生目录。 - 每个供应商的推理档位阶梯按官方文档核对(Kimi K3、DeepSeek V4、Claude Opus 4.8、GLM-5.2 等)。
- 新增 Meta Model API 供应商(Muse Spark 1.1/1.2/1.2 Contributor)。
- opencode Go 成为统一的供应商族,并移除 Cursor 与 opencode 应用目标。
- 修复 Windows 下原生 OpenAI 模型消失、Grok OAuth 凭据、API Key 提示确认、引导式安装新增桌面伴侣、Ollama Cloud 与 Qwen plan 供应商、交互式模型定制(
curate-models)等。
0.3.0
- 为 Kimi OAuth、Kimi API 与 DeepSeek API 增加引导式、供应商感知的安装。
- 对两个已识别的旧 Kimi 路由器布局做安全检测、快照、自动迁移与精确回滚。
- 增加 macOS launchd、Linux systemd-user 与 Windows 任务计划程序服务,以及原生 PowerShell 安装器与命令包装器。
- 增加供应商可见性与运行时强制,隐藏的外部模型不会被误认为原生模型。
- 增加
doctor --fix、隐私安全的 support bundle、更新回滚、受保护的供应商模型发现与计费兼容性测试。 - 增加跨平台 CI、依赖审计、带 SHA-256 校验和的标签源码归档与 GitHub 构建来源证明。
0.2.0
- 把最初仅支持 Kimi 的原型推广为经过验证的供应商/模型注册表。
- 增加独立的 Kimi OAuth、Kimi API 与 DeepSeek API 路由,同时保留原生 Codex 模型与 ChatGPT 认证。