• 简体中文
  • Codex 接入

    OpenAI 官方 CLI / 桌面端。通过自定义 provider 指向 ByteSeek。

    下载安装

    npm
    Homebrew
    npx 免安装
    桌面端
    npm install -g @openai/codex

    想给桌面端做供应商管理与增强,见 Codex++ 接入

    前置条件

    • 已安装 Codex CLI(codex --version 可输出版本)
    • 已在API 密钥页面创建支持 OpenAI 格式的 Key

    配置

    编辑 ~/.codex/config.toml

    model = "gpt-5-codex"
    model_provider = "byteseek"
    
    [model_providers.byteseek]
    name = "OpenAI"  # 必须写 OpenAI,用于触发远程压缩,见下文「远程压缩」
    base_url = "https://tokens.byteseek.ai/v1"
    wire_api = "responses"

    设置密钥环境变量:

    export OPENAI_API_KEY="sk-你的密钥"
    验证时你应看到
    • 启动 codex 后,欢迎信息中 model 显示你配置的模型(如 gpt-5.6-sol)、provider 显示 byteseek
    • 输入 /status 可确认 Base URL 指向 tokens.byteseek.ai 且鉴权通过;
    • 对话正常返回,无 401 / stream error。

    验证

    codex "用一句话介绍你自己"

    正常返回即接入成功。到使用记录页面能看到这笔请求的模型与扣费。

    远程压缩

    上方配置把 [model_providers.byteseek]name 写成 OpenAI 而不是 ByteSeek,是刻意为之——这是开启 Codex 远程压缩的开关。

    Codex 在长对话接近上下文上限时会压缩历史。只有当 provider 的 name 严格等于 OpenAI 时,Codex 才会优先调用远程压缩接口(/v1/responses/compact);远程压缩质量更高,超长对话也能稳定保持,不容易降智。如果把 name 改成其他值(例如 ByteSeek),Codex 会强制使用本地压缩,效果明显更差。

    说明
    • name 只是用于触发远程压缩的显示名,保持 OpenAI 即可;
    • provider 标识不受影响:model_provider = "byteseek"[model_providers.byteseek] 段名照旧,不用改;
    • 修改这个设置不会丢失已有聊天记录

    如果同时按下文开启了 1M 上下文,压缩会在约 90 万 token 时触发,此时远程压缩的质量差距会更明显,建议务必保持 name = "OpenAI"

    启用 1M 上下文

    GPT-5.6 Sol 模型本身支持约 105 万 token 的上下文,但 Codex 默认只给会话较小的预算。下面的配置可以把会话预算放大到 100 万 token(方法源自 Codex 工程师 Tibo 公开的官方配置)。

    ~/.codex/config.toml最顶部加两行——必须放在所有 [section] 段落之前,TOML 会把段落之后的键归入该段落,位置放错会静默失效:

    model_context_window = 1000000
    model_auto_compact_token_limit = 900000
    配置项作用
    model_context_window会话的上下文预算,设为 100 万 token
    model_auto_compact_token_limit约 90 万 token 时自动压缩历史,给压缩过程和后续输出留出余量

    也可以不改文件,单次启动临时验证:

    codex -m gpt-5.6-sol \
      -c model_context_window=1000000 \
      -c model_auto_compact_token_limit=900000

    验证与注意事项

    • 保存后重启 Codex 并新开会话,用 /status 查看窗口大小确认生效。
    • 成本会上升:上游对输入超过 272k 的请求按溢价计费(输入约 2 倍、输出约 1.5 倍),长上下文是用钱换的,日常任务未必需要开满。

    搭配 Fast 模式

    Codex 桌面端没有优先级开关。想让桌面端请求走高优先级通道,直接在 Key 上把 Fast 策略设为强制开启即可,无需改客户端,见 Fast 模式。注意费用约为常规 2 倍。

    常见问题

    症状原因与处理
    401密钥无效;确认 OPENAI_API_KEY 已生效
    403分组限定客户端或不含该模型;到模型广场核对
    模型列表为空base_url 少了 /v1,或 wire_api 没设为 responses
    超时深度推理响应慢属正常;频繁超时见故障排查
    © 2026 ByteSeek Limited. 保留所有权利。服务条款隐私政策免责声明