Codex CLI 完全指南:第三章·模型提供商配置

Codex CLI 不绑定任何单一模型服务。通过灵活的 Provider 架构,你可以接入 OpenAI、Anthropic、Google Gemini、Azure、Ollama 本地模型等 75+ LLM 提供商。本章详解每一种接入方式的配置策略、适用场景和性能对比。

提供商架构

Codex 的模型层使用统一抽象,所有 Provider 实现相同的接口:

用户请求 → Codex Engine → Provider Adapter → LLM API
                               ├── OpenAI Adapter
                               ├── Anthropic Adapter
                               ├── Google Adapter
                               ├── OpenRouter Adapter
                               └── Ollama Adapter

这种设计让切换模型只需修改配置中的一个字段,代码零改动。

OpenAI

OpenAI 是 Codex 的默认提供商,提供最强的综合编程能力。

配置

model:
  provider: openai
  model: gpt-4o
  temperature: 0.2
  max_tokens: 16000

可用模型

| 模型 | 上下文窗口 | 特点 | 适用场景 |
|------|-----------|------|----------|
| gpt-4o | 128K | 最新旗舰,速度最快 | 日常开发首选 |
| gpt-4-turbo | 128K | 上一代旗舰 | 复杂重构 |
| gpt-4o-mini | 128K | 性价比高 | 简单任务 |
| o3-mini | 200K | 推理特化 | 复杂算法、逻辑推理 |
| o4-mini | 200K | 最新推理模型 | 高难度推理 |
| gpt-4.1 | 1M | 超长上下文 | 大型项目分析 |

高级配置

model:
  provider: openai
  model: gpt-4o
  temperature: 0.2
  max_tokens: 16000
  openai:
    api_key: ${OPENAI_API_KEY}
    base_url: https://api.openai.com/v1   # 或 Azure / 代理地址
    organization: org-xxx                  # 可选:组织 ID
    reasoning_effort: medium               # o3/o4 系列专属:low | medium | high

使用 Azure OpenAI

model:
  provider: openai
  model: gpt-4o
  openai:
    base_url: https://your-resource.openai.azure.com/openai/deployments/gpt-4o
    api_key: ${AZURE_OPENAI_API_KEY}
    api_version: "2024-08-01-preview"

Anthropic Claude

Anthropic 的 Claude 系列在长代码理解和安全编程方面表现突出。

配置

model:
  provider: anthropic
  model: claude-sonnet-4-20250514
  temperature: 0.2
  max_tokens: 16000

可用模型

| 模型 | 上下文窗口 | 特点 |
|------|-----------|------|
| claude-sonnet-4-20250514 | 200K | 最新 Sonnet,代码能力极强 |
| claude-3-5-sonnet-20241022 | 200K | 上一代 Sonnet,稳定可靠 |
| claude-3-5-haiku-20241022 | 200K | 速度最快,成本低 |
| claude-opus-4-20250514 | 200K | 最强推理,成本高 |

环境变量

export ANTHROPIC_API_KEY="sk-ant-api03-..."

Claude 特别适合需要深度理解项目结构的大型重构任务,其 200K 上下文窗口可以容纳整个中小型项目。

Google Gemini

Google AI 的 Gemini 模型提供慷慨的免费额度和出色的长文本处理能力。

配置

model:
  provider: google
  model: gemini-2.5-pro-preview
  temperature: 0.2
  max_tokens: 16000

可用模型

| 模型 | 上下文窗口 | 特点 |
|------|-----------|------|
| gemini-2.5-pro-preview | 1M | 最新旗舰,代码能力强 |
| gemini-2.5-flash | 1M | 速度极快 |
| gemini-2.0-flash | 1M | 稳定版本 |

环境变量

export GOOGLE_API_KEY="AIza..."

获取 API Key:aistudio.google.com

Gemini 2.5 Flash 每日有 1500 次免费调用额度,适合个人开发。

OpenRouter

OpenRouter 是一个 LLM API 聚合平台,通过统一的 API 接入 200+ 模型,不需要分别注册各平台账号。

配置

model:
  provider: openrouter
  model: openai/gpt-4o
  temperature: 0.2
  max_tokens: 16000

环境变量

export OPENROUTER_API_KEY="sk-or-v1-..."

推荐模型

# 编程首选
model: anthropic/claude-sonnet-4-20250514

# 性价比之选
model: google/gemini-2.5-flash

# 深度推理
model: openai/o3-mini

# 开源模型
model: deepseek/deepseek-chat

OpenRouter 按用量付费,同一 API Key 可调用所有模型,省去管理多个 Key 的麻烦。它还提供模型路由功能——自动选择当前可用的最优模型。

Ollama(本地模型)

Ollama 让你在本地运行开源 LLM,完全离线,零 API 费用,数据不外传。

安装 Ollama

# macOS / Linux
curl -fsSL https://ollama.com/install.sh | sh

# 验证
ollama --version

拉取模型

# 代码模型推荐
ollama pull codellama:34b              # Meta Code Llama 34B
ollama pull deepseek-coder:33b         # DeepSeek Coder 33B
ollama pull qwen2.5-coder:32b          # 通义千问代码模型
ollama pull llama3.1:70b               # Meta Llama 3.1(通用)

# 轻量模型(适合 16GB 内存设备)
ollama pull codellama:13b
ollama pull deepseek-coder:6.7b
ollama pull qwen2.5-coder:7b

配置

model:
  provider: ollama
  model: deepseek-coder:33b
  temperature: 0.1
  ollama:
    host: http://localhost:11434   # Ollama 默认端口
    num_ctx: 32768                 # 上下文窗口大小

硬件建议

| 模型大小 | 最低显存 | 推荐显存 | 最低内存 |
|----------|---------|---------|---------|
| 7B | 6GB | 8GB | 16GB |
| 13B | 10GB | 16GB | 32GB |
| 33B | 24GB | 32GB | 64GB |
| 70B | 48GB | 64GB | 128GB |

局限性

  • 代码理解能力不如 GPT-4/Claude Sonnet
  • 大型重构准确率下降明显
  • 不支持工具调用和函数调用

适合对隐私有严格要求、有足够硬件的场景,或作为离线备用方案。

DeepSeek

DeepSeek 提供极具性价比的 API,代码能力接近 Claude Sonnet。

配置

model:
  provider: openai
  model: deepseek-chat
  openai:
    base_url: https://api.deepseek.com/v1
    api_key: ${DEEPSEEK_API_KEY}

DeepSeek 兼容 OpenAI API 格式,直接用 openai provider 设置 base_url 即可。

模型切换策略

按任务复杂度切换

# codex.yaml 中可以按场景指定模型
tasks:
  simple_edit:
    model: gpt-4o-mini         # 简单修改:改名、添加方法
  code_generation:
    model: gpt-4o              # 新功能生成
  complex_refactor:
    model: claude-sonnet-4     # 大型重构
  debugging:
    model: o3-mini             # 逻辑调试
  large_context:
    model: gemini-2.5-pro      # 大项目全局分析

运行时动态切换

# 本次会话使用 Claude
codex --model claude-sonnet-4-20250514 --provider anthropic "重构这个模块"

# 使用本地模型
codex --model deepseek-coder:33b --provider ollama "review 这个文件"

模型对比总结

| 维度 | GPT-4o | Claude Sonnet 4 | Gemini 2.5 Pro | DeepSeek | 本地 33B |
|------|--------|----------------|----------------|----------|----------|
| 代码生成 | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐ | ⭐⭐⭐⭐ | ⭐⭐⭐ |
| 长文本理解 | ⭐⭐⭐⭐ | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐ | ⭐⭐⭐ |
| 推理能力 | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐ | ⭐⭐⭐⭐ | ⭐⭐ |
| 速度 | ⭐⭐⭐⭐ | ⭐⭐⭐⭐ | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐ | ⭐⭐⭐⭐⭐ |
| 成本 | ⭐⭐⭐ | ⭐⭐⭐ | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐⭐ | 免费 |
| 隐私 | ⭐⭐ | ⭐⭐ | ⭐⭐ | ⭐⭐⭐ | ⭐⭐⭐⭐⭐ |

小结

Codex 的模型灵活性是它的核心竞争力之一。推荐策略:

  • 日常开发:GPT-4o 或 Claude Sonnet
  • 省钱方案:DeepSeek 或 Gemini Flash
  • 隐私至上:Ollama 本地模型
  • 多模型对比:OpenRouter

选择模型不是越强越好,而是在能力、速度、成本之间找到平衡点。