Codex 通过 Responses API 让模型直接读取项目、调用工具、修改代码并处理命令执行结果。DeepSeek 在 V4-Flash-0731 更新中原生适配了这一协议,开发者可直接将官方模型接入 Codex CLI、桌面端和 VS Code 插件,无需额外兼容层。
截至 2026 年 8 月中旬,官方 Responses API 仅支持 deepseek-v4-flash,暂不支持 deepseek-v4-pro(官方此前表示计划于 8 月初开放,实际进度以最新文档为准)。目前有两条实用路径:
- V4 Flash → 官方一键配置(推荐)
- V4 Pro → 通过 NoneLinear 等第三方 Responses 适配接入
V4 Flash 带来了什么?
当前官方 API 中的 Flash 版本为 DeepSeek-V4-Flash-0731。它具备:
- 1M 上下文
- 最大 384K 输出
- 思考模式(可调推理强度)
- 工具调用与并行工具调用
- 原生 Responses API 支持
针对 Codex 的关键能力包括:
- Function Calling
- Codex 专用的
apply_patch工具 - Web Search(服务端执行)
- 思考强度设置
- 流式 SSE 事件
- 并行工具调用
核心规格与价格(每百万 Token,人民币):
| 项目 | 价格 |
|---|---|
| 缓存命中输入 | 0.02 元 |
| 缓存未命中输入 | 1 元 |
| 输出 | 2 元 |
官方定位清晰:Flash 更侧重速度与成本,适合日常编码与 Agent 场景;Pro 更适合复杂推理与高难度代码任务。注意官方已提示近期可能整体上调 API 价格,建议关注官方公告并合理规划用量。
官方接入方式:在 Codex 中配置 V4 Flash
DeepSeek 提供官方一键配置脚本。使用前请先安装 Codex CLI 或 Codex App(ChatGPT 桌面端),并至少启动一次,确保本机已生成 ~/.codex 目录(Windows 为 %USERPROFILE%\.codex)。
macOS / Linux
bash <(curl -fsSL https://cdn.deepseek.com/api-docs/codex-deepseek-setup.sh)
Windows(PowerShell)
irm https://cdn.deepseek.com/api-docs/codex-deepseek-setup-en.ps1 | iex
脚本会引导你输入 DeepSeek API Key(以 sk- 开头,在 DeepSeek Platform 获取),并选择 deepseek-v4-flash。它会自动备份原有配置、写入模型目录 models.json、更新 config.toml,同时保留已有的 MCP 服务器与项目权限设置。
配置完成后,进入项目目录启动:
cd /path/to/your-project
codex
启动信息中出现 model: deepseek-v4-flash 即表示生效。Codex CLI、桌面端与 VS Code 插件共用同一份配置。切换模型后请重启客户端,并新建对话测试。
如需手动配置,可参考官方文档创建 ~/.codex/models.json 与 config.toml,核心字段包括:
model = "deepseek-v4-flash"
model_provider = "deepseek"
preferred_auth_method = "apikey"
model_reasoning_effort = "high"
model_catalog_json = "~/.codex/models.json"
[model_providers.deepseek]
name = "deepseek" base_url = "https://api.deepseek.com/" wire_api = "responses" experimental_bearer_token = "<你的 DeepSeek API Key>"
建议 Codex 版本 ≥ 0.144.0。
通过 NoneLinear 接入 V4 Pro
官方尚未向 deepseek-v4-pro 开放 Responses API 时,可通过 NoneLinear 的协议适配层临时接入。使用最新版 cc-switch(或类似配置工具)按以下步骤操作:
- 打开 cc-switch,进入 Codex 配置页并新增供应商。
- 供应商名称填写
NoneLinear,API 请求地址填写https://api.nonelinear.com/v1。 - 填入 NoneLinear API Key,在模型映射中选择或添加
deepseek-v4-pro。 - 保存并启用配置,重启 Codex 后新建对话。
NoneLinear 提供兼容 OpenAI 的接口,聚合了包括 DeepSeek 在内的多款模型,适合在官方 Pro 支持到位前作为过渡方案。
使用建议与注意事项
- Token 消耗:Codex 每次请求会携带系统提示词、工具定义、会话状态和项目上下文,实际消耗远高于单纯用户输入。初次测试建议在空目录或小型项目中进行,便于观察成本。
- 缓存命中:Agent 场景下缓存命中率通常较高,可显著降低输入成本。
- 推理强度:可通过
model_reasoning_effort调整(low / high / max),更高强度带来更好效果,但耗时与成本也会增加。 - 客户端一致性:配置一次即可在 CLI、桌面端和 VS Code 插件中生效,切换后记得重启并新建会话。
- 安全性:API Key 属于敏感信息,请妥善保管,避免提交到公开仓库。
- 后续更新:持续关注 DeepSeek 官方文档,尤其是 Responses API 与定价页面。Pro 正式支持后,可直接切换回官方通道。
DeepSeek V4 Flash 以极低的成本和原生 Responses 支持,让 Codex 这类 Agent 编程工具变得更加普惠。无论是日常开发还是复杂任务探索,现在都有了更经济、更直接的选择。配置完成后直接上手测试,你会发现它在速度、成本和可用性之间取得了很好的平衡。
文章评论