Codex 接入
OpenAI 官方 CLI / 桌面端。通过自定义 provider 指向 ByteSeek。
下载安装
想给桌面端做供应商管理与增强,见 Codex++ 接入。
前置条件
- 已安装 Codex CLI(
codex --version可输出版本) - 已在API 密钥页面创建支持 OpenAI 格式的 Key
配置
编辑 ~/.codex/config.toml:
设置密钥环境变量:
- 启动
codex后,欢迎信息中model显示你配置的模型(如gpt-5.6-sol)、provider显示byteseek; - 输入
/status可确认 Base URL 指向tokens.byteseek.ai且鉴权通过; - 对话正常返回,无 401 / stream error。
验证
正常返回即接入成功。到使用记录页面能看到这笔请求的模型与扣费。
远程压缩
上方配置把 [model_providers.byteseek] 的 name 写成 OpenAI 而不是 ByteSeek,是刻意为之——这是开启 Codex 远程压缩的开关。
Codex 在长对话接近上下文上限时会压缩历史。只有当 provider 的 name 严格等于 OpenAI 时,Codex 才会优先调用远程压缩接口(/v1/responses/compact);远程压缩质量更高,超长对话也能稳定保持,不容易降智。如果把 name 改成其他值(例如 ByteSeek),Codex 会强制使用本地压缩,效果明显更差。
name只是用于触发远程压缩的显示名,保持OpenAI即可;- provider 标识不受影响:
model_provider = "byteseek"和[model_providers.byteseek]段名照旧,不用改; - 修改这个设置不会丢失已有聊天记录。
如果同时按下文开启了 1M 上下文,压缩会在约 90 万 token 时触发,此时远程压缩的质量差距会更明显,建议务必保持 name = "OpenAI"。
启用 1M 上下文
GPT-5.6 Sol 模型本身支持约 105 万 token 的上下文,但 Codex 默认只给会话较小的预算。下面的配置可以把会话预算放大到 100 万 token(方法源自 Codex 工程师 Tibo 公开的官方配置)。
在 ~/.codex/config.toml 的最顶部加两行——必须放在所有 [section] 段落之前,TOML 会把段落之后的键归入该段落,位置放错会静默失效:
也可以不改文件,单次启动临时验证:
验证与注意事项
- 保存后重启 Codex 并新开会话,用
/status查看窗口大小确认生效。 - 成本会上升:上游对输入超过 272k 的请求按溢价计费(输入约 2 倍、输出约 1.5 倍),长上下文是用钱换的,日常任务未必需要开满。
搭配 Fast 模式
Codex 桌面端没有优先级开关。想让桌面端请求走高优先级通道,直接在 Key 上把 Fast 策略设为强制开启即可,无需改客户端,见 Fast 模式。注意费用约为常规 2 倍。