Codex CLI 不绑定任何单一模型服务。通过灵活的 Provider 架构,你可以接入 OpenAI、Anthropic、Google Gemini、Azure、Ollama 本地模型等 75+ LLM 提供商。本章详解每一种接入方式的配置策略、适用场景和性能对比。
Codex 的模型层使用统一抽象,所有 Provider 实现相同的接口:
用户请求 → Codex Engine → Provider Adapter → LLM API
├── OpenAI Adapter
├── Anthropic Adapter
├── Google Adapter
├── OpenRouter Adapter
└── Ollama Adapter
这种设计让切换模型只需修改配置中的一个字段,代码零改动。
OpenAI 是 Codex 的默认提供商,提供最强的综合编程能力。
model: provider: openai model: gpt-4o temperature: 0.2 max_tokens: 16000
| 模型 | 上下文窗口 | 特点 | 适用场景 |
|------|-----------|------|----------|
| gpt-4o | 128K | 最新旗舰,速度最快 | 日常开发首选 |
| gpt-4-turbo | 128K | 上一代旗舰 | 复杂重构 |
| gpt-4o-mini | 128K | 性价比高 | 简单任务 |
| o3-mini | 200K | 推理特化 | 复杂算法、逻辑推理 |
| o4-mini | 200K | 最新推理模型 | 高难度推理 |
| gpt-4.1 | 1M | 超长上下文 | 大型项目分析 |
model:
provider: openai
model: gpt-4o
temperature: 0.2
max_tokens: 16000
openai:
api_key: ${OPENAI_API_KEY}
base_url: https://api.openai.com/v1 # 或 Azure / 代理地址
organization: org-xxx # 可选:组织 ID
reasoning_effort: medium # o3/o4 系列专属:low | medium | high
model:
provider: openai
model: gpt-4o
openai:
base_url: https://your-resource.openai.azure.com/openai/deployments/gpt-4o
api_key: ${AZURE_OPENAI_API_KEY}
api_version: "2024-08-01-preview"
Anthropic 的 Claude 系列在长代码理解和安全编程方面表现突出。
model: provider: anthropic model: claude-sonnet-4-20250514 temperature: 0.2 max_tokens: 16000
| 模型 | 上下文窗口 | 特点 |
|------|-----------|------|
| claude-sonnet-4-20250514 | 200K | 最新 Sonnet,代码能力极强 |
| claude-3-5-sonnet-20241022 | 200K | 上一代 Sonnet,稳定可靠 |
| claude-3-5-haiku-20241022 | 200K | 速度最快,成本低 |
| claude-opus-4-20250514 | 200K | 最强推理,成本高 |
export ANTHROPIC_API_KEY="sk-ant-api03-..."
Claude 特别适合需要深度理解项目结构的大型重构任务,其 200K 上下文窗口可以容纳整个中小型项目。
Google AI 的 Gemini 模型提供慷慨的免费额度和出色的长文本处理能力。
model: provider: google model: gemini-2.5-pro-preview temperature: 0.2 max_tokens: 16000
| 模型 | 上下文窗口 | 特点 |
|------|-----------|------|
| gemini-2.5-pro-preview | 1M | 最新旗舰,代码能力强 |
| gemini-2.5-flash | 1M | 速度极快 |
| gemini-2.0-flash | 1M | 稳定版本 |
export GOOGLE_API_KEY="AIza..."
获取 API Key:aistudio.google.com
Gemini 2.5 Flash 每日有 1500 次免费调用额度,适合个人开发。
OpenRouter 是一个 LLM API 聚合平台,通过统一的 API 接入 200+ 模型,不需要分别注册各平台账号。
model: provider: openrouter model: openai/gpt-4o temperature: 0.2 max_tokens: 16000
export OPENROUTER_API_KEY="sk-or-v1-..."
# 编程首选 model: anthropic/claude-sonnet-4-20250514 # 性价比之选 model: google/gemini-2.5-flash # 深度推理 model: openai/o3-mini # 开源模型 model: deepseek/deepseek-chat
OpenRouter 按用量付费,同一 API Key 可调用所有模型,省去管理多个 Key 的麻烦。它还提供模型路由功能——自动选择当前可用的最优模型。
Ollama 让你在本地运行开源 LLM,完全离线,零 API 费用,数据不外传。
# macOS / Linux curl -fsSL https://ollama.com/install.sh | sh # 验证 ollama --version
# 代码模型推荐 ollama pull codellama:34b # Meta Code Llama 34B ollama pull deepseek-coder:33b # DeepSeek Coder 33B ollama pull qwen2.5-coder:32b # 通义千问代码模型 ollama pull llama3.1:70b # Meta Llama 3.1(通用) # 轻量模型(适合 16GB 内存设备) ollama pull codellama:13b ollama pull deepseek-coder:6.7b ollama pull qwen2.5-coder:7b
model:
provider: ollama
model: deepseek-coder:33b
temperature: 0.1
ollama:
host: http://localhost:11434 # Ollama 默认端口
num_ctx: 32768 # 上下文窗口大小
| 模型大小 | 最低显存 | 推荐显存 | 最低内存 |
|----------|---------|---------|---------|
| 7B | 6GB | 8GB | 16GB |
| 13B | 10GB | 16GB | 32GB |
| 33B | 24GB | 32GB | 64GB |
| 70B | 48GB | 64GB | 128GB |
适合对隐私有严格要求、有足够硬件的场景,或作为离线备用方案。
DeepSeek 提供极具性价比的 API,代码能力接近 Claude Sonnet。
model:
provider: openai
model: deepseek-chat
openai:
base_url: https://api.deepseek.com/v1
api_key: ${DEEPSEEK_API_KEY}
DeepSeek 兼容 OpenAI API 格式,直接用 openai provider 设置 base_url 即可。
# codex.yaml 中可以按场景指定模型
tasks:
simple_edit:
model: gpt-4o-mini # 简单修改:改名、添加方法
code_generation:
model: gpt-4o # 新功能生成
complex_refactor:
model: claude-sonnet-4 # 大型重构
debugging:
model: o3-mini # 逻辑调试
large_context:
model: gemini-2.5-pro # 大项目全局分析
# 本次会话使用 Claude codex --model claude-sonnet-4-20250514 --provider anthropic "重构这个模块" # 使用本地模型 codex --model deepseek-coder:33b --provider ollama "review 这个文件"
| 维度 | GPT-4o | Claude Sonnet 4 | Gemini 2.5 Pro | DeepSeek | 本地 33B |
|------|--------|----------------|----------------|----------|----------|
| 代码生成 | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐ | ⭐⭐⭐⭐ | ⭐⭐⭐ |
| 长文本理解 | ⭐⭐⭐⭐ | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐ | ⭐⭐⭐ |
| 推理能力 | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐ | ⭐⭐⭐⭐ | ⭐⭐ |
| 速度 | ⭐⭐⭐⭐ | ⭐⭐⭐⭐ | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐ | ⭐⭐⭐⭐⭐ |
| 成本 | ⭐⭐⭐ | ⭐⭐⭐ | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐⭐ | 免费 |
| 隐私 | ⭐⭐ | ⭐⭐ | ⭐⭐ | ⭐⭐⭐ | ⭐⭐⭐⭐⭐ |
Codex 的模型灵活性是它的核心竞争力之一。推荐策略:
选择模型不是越强越好,而是在能力、速度、成本之间找到平衡点。