智能体 > 推理与提供商
Agent 模型选择
# Agent 模型选择 Warp 让您可以从精心策划的一组大型语言模型中进行选择,以驱动您的 Agent,或者让 Warp 为每个任务自动选择最佳模型。Warp 提供来自 OpenAI、Anthropic、Google 和开源提供商的模型,支持可配置的推理级别和每个配置文件的默认设置。 ## 可用模型 Warp 让您可以从一组精心策划的大型语言模型 (LLM) 中进行选择,以驱动您的 Agent 开发环境。 **Warp 支持以下模型。** 下面显示的 `model_id` 值可用于通过 [Oz 平台](/agent-platform/cloud-agents/platform/) 或 [CLI](/reference/cli/) 配置模型。 ### 自动模型 | 模型 | `model_id` | 描述 | | --- | --- | --- | | Auto (响应式) | `auto` | 选择质量最高、速度最快的可用模型。可能会更快消耗积分。 | | Auto (高性价比) | `auto-efficient` | 在保持强大输出质量的同时,优化积分消耗,降低成本。 | | Auto (智能型) | `auto-genius` | 适应任务复杂性,并在值得时选择 Warp 最强大的模型。最适合深度调试、架构决策和 `/plan` 会话。 | | Auto (开源模型) | `auto-open` | 在 Warp 可用的最佳开源模型之间进行路由。使用开放权重模型优化低成本和快速响应。 | 所有 Auto 模型在所有 Agent 工作流程中表现出色,如果您希望 Warp 动态管理模型选择,它们是理想的选择。 #### OpenAI | 模型 | `model_id` | 推理级别 | | --- | --- | --- | | GPT-5.5 | `gpt-5-5-low` | 低 | | GPT-5.5 | `gpt-5-5-medium` | 中 | | GPT-5.5 | `gpt-5-5-high` | 高 | | GPT-5.5 | `gpt-5-5-xhigh` | 极高 | | GPT-5.4 | `gpt-5-4-low` | 低 | | GPT-5.4 | `gpt-5-4-medium` | 中 | | GPT-5.4 | `gpt-5-4-high` | 高 | | GPT-5.4 | `gpt-5-4-xhigh` | 极高 | | GPT-5.3 Codex | `gpt-5-3-codex-low` | 低 | | GPT-5.3 Codex | `gpt-5-3-codex-medium` | 中 | | GPT-5.3 Codex | `gpt-5-3-codex-high` | 高 | | GPT-5.3 Codex | `gpt-5-3-codex-xhigh` | 极高 | | GPT-5.2 Codex | `gpt-5-2-codex-low` | 低 | | GPT-5.2 Codex | `gpt-5-2-codex-medium` | 中 | | GPT-5.2 Codex | `gpt-5-2-codex-high` | 高 | | GPT-5.2 Codex | `gpt-5-2-codex-xhigh` | 极高 | | GPT-5.2 | `gpt-5-2-low` | 低 | | GPT-5.2 | `gpt-5-2-medium` | 中 | | GPT-5.2 | `gpt-5-2-high` | 高 | | GPT-5.2 | `gpt-5-2-xhigh` | 极高 | #### Anthropic | 模型 | `model_id` | 变体 | | --- | --- | --- | | Claude Opus 4.7 | `claude-4-7-opus-xhigh` | 默认工作量 | | Claude Opus 4.7 | `claude-4-7-opus-high` | 高工作量 | | Claude Opus 4.7 | `claude-4-7-opus-max` | 最大工作量 | | Claude Opus 4.6 | `claude-4-6-opus-high` | 默认工作量 | | Claude Opus 4.6 | `claude-4-6-opus-max` | 最大工作量 | | Claude Sonnet 4.6 | `claude-4-6-sonnet-high` | 默认工作量 | | Claude Sonnet 4.6 | `claude-4-6-sonnet-max` | 最大工作量 | | Claude Opus 4.5 | `claude-4-5-opus` | 关闭思考 | | Claude Opus 4.5 | `claude-4-5-opus-thinking` | 开启思考 | | Claude Sonnet 4.5 | `claude-4-5-sonnet` | 关闭思考 | | Claude Sonnet 4.5 | `claude-4-5-sonnet-thinking` | 开启思考 | | Claude Haiku 4.5 | `claude-4-5-haiku` | — | #### Google | 模型 | `model_id` | | --- | --- | | Gemini 3.1 Pro | `gemini-3.1-pro` | #### 托管模型(通过 [Fireworks AI](https://fireworks.ai)) Warp 还支持通过 Fireworks AI 托管的领先开源模型,因此您无需设置自己的推理基础设施即可在 Warp 内部运行它们。 | 模型 | `model_id` | | --- | --- | | GLM 5.1 | `glm-5.1-fireworks` | | Kimi K2.5 | `kimi-k25-fireworks` | | Kimi K2.6 | `kimi-k26-fireworks` | | Minimax 2.7 | `minimax-2.7-fireworks` | | Qwen 3.6 Plus | `qwen-3.6-plus-fireworks` | ### 如何更换模型 您可以在提示输入中使用模型选择器快速切换模型。当前激活的模型会直接显示在输入编辑器中。 <figure>  <figcaption>Warp 输入中的模型选择器。</figcaption> </figure> 要更换模型,请点击显示的模型名称(例如,_Claude Sonnet 4.5_)以打开包含所有受支持选项的下拉菜单。您的选择将自动保留以用于未来的提示。 ### 模型回退 如果您选择的模型因提供商中断或容量问题而暂时不可用,Warp 会使用模型回退系统来确保服务不中断。 **工作原理:** * 如果您选择的模型不可用,Warp 会自动使用预定义链中的回退模型,以在不报错的情况下继续您的对话。 * 一旦您最初选择的模型再次可用,Warp 会自动切回该模型。 * 选择回退模型是为了提供与您最初选择的模型相当的质量和能力。 ### 配置每个 Agent 配置文件的模型 您可以配置每个 [Agent 配置文件](/agent-platform/capabilities/agent-profiles-permissions/) 的基础模型,以及 Agent 的自主性、工具访问权限和其他权限。基础模型也用于 [规划 (Planning)](/agent-platform/capabilities/planning/)。 在 **设置** > **Agents** > **配置文件** 中直接编辑您的默认配置文件或任何其他配置文件。 ### 零数据保留策略 Warp 与多个大型语言模型 (LLM) 提供商集成,以驱动其 AI 驱动的功能。 **这些提供商包括但不限于:** * OpenAI * Anthropic * Google * xAI * Fireworks AI Warp 已与这些提供商执行了 **零数据保留 (ZDR)** 协议。这意味着,默认情况下,在所有计划中: * LLM 提供商承诺不对通过 Warp 服务处理的任何客户生成数据进行模型训练。 * LLM 提供商承诺在生成相关输出后,在固定的时间期限内删除输入和输出。 Warp 通过技术手段和与 LLM 提供商的合同保障来强制执行这些承诺。从一组精心策划的顶级 LLM 中为 Warp 的 Agent 进行选择(或让 Warp 自动选择最佳模型)。
Warp 让您可以从一组精心策划的大型语言模型中进行选择,以驱动您的 Agent,或者让 Warp 为每个任务自动选择最佳模型。Warp 提供来自 OpenAI、Anthropic、Google 和开源提供商的模型,支持可配置的推理级别和每个配置文件的默认设置。
可用模型
标题为“可用模型”的章节Warp 让您可以从一组精心策划的大型语言模型 (LLM) 中进行选择,以驱动您的 Agent 开发环境。
Warp 支持以下模型。
下面显示的 model_id 值可用于通过 Oz 平台 或 CLI 配置模型。
自动模型
标题为“自动模型”的章节| 模型 | model_id | 说明 |
|---|---|---|
| Auto (响应式) | auto | 选择质量最高、速度最快的可用模型。可能会更快消耗积分。 |
| Auto (高性价比) | auto-efficient | 在保持强大输出质量的同时,优化积分消耗,降低成本。 |
| Auto (智能型) | auto-genius | 适应任务复杂性,并在值得时选择 Warp 最强大的模型。最适合深度调试、架构决策和 /plan 会话。 |
| Auto (开源模型) | auto-open | 在 Warp 可用的最佳开源模型之间进行路由。使用开放权重模型优化低成本和快速响应。 |
所有 Auto 模型在所有 Agent 工作流程中表现出色,如果您希望 Warp 动态管理模型选择,它们是理想的选择。
OpenAI
标题为“OpenAI”的章节| 模型 | model_id | 推理级别 |
|---|---|---|
| GPT-5.5 | gpt-5-5-low | 低 |
| GPT-5.5 | gpt-5-5-medium | 中 |
| GPT-5.5 | gpt-5-5-high | 高 |
| GPT-5.5 | gpt-5-5-xhigh | 极高 |
| GPT-5.4 | gpt-5-4-low | 低 |
| GPT-5.4 | gpt-5-4-medium | 中 |
| GPT-5.4 | gpt-5-4-high | 高 |
| GPT-5.4 | gpt-5-4-xhigh | 极高 |
| GPT-5.3 Codex | gpt-5-3-codex-low | 低 |
| GPT-5.3 Codex | gpt-5-3-codex-medium | 中 |
| GPT-5.3 Codex | gpt-5-3-codex-high | 高 |
| GPT-5.3 Codex | gpt-5-3-codex-xhigh | 极高 |
| GPT-5.2 Codex | gpt-5-2-codex-low | 低 |
| GPT-5.2 Codex | gpt-5-2-codex-medium | 中 |
| GPT-5.2 Codex | gpt-5-2-codex-high | 高 |
| GPT-5.2 Codex | gpt-5-2-codex-xhigh | 极高 |
| GPT-5.2 | gpt-5-2-low | 低 |
| GPT-5.2 | gpt-5-2-medium | 中 |
| GPT-5.2 | gpt-5-2-high | 高 |
| GPT-5.2 | gpt-5-2-xhigh | 极高 |
Anthropic
标题为“Anthropic”的章节| 模型 | model_id | 变体 |
|---|---|---|
| Claude Opus 4.7 | claude-4-7-opus-xhigh | 默认工作量 |
| Claude Opus 4.7 | claude-4-7-opus-high | 高工作量 |
| Claude Opus 4.7 | claude-4-7-opus-max | 最大工作量 |
| Claude Opus 4.6 | claude-4-6-opus-high | 默认工作量 |
| Claude Opus 4.6 | claude-4-6-opus-max | 最大工作量 |
| Claude Sonnet 4.6 | claude-4-6-sonnet-high | 默认工作量 |
| Claude Sonnet 4.6 | claude-4-6-sonnet-max | 最大工作量 |
| Claude Opus 4.5 | claude-4-5-opus | 关闭思考 |
| Claude Opus 4.5 | claude-4-5-opus-thinking | 开启思考 |
| Claude Sonnet 4.5 | claude-4-5-sonnet | 关闭思考 |
| Claude Sonnet 4.5 | claude-4-5-sonnet-thinking | 开启思考 |
| Claude Haiku 4.5 | claude-4-5-haiku | — |
| 模型 | model_id |
|---|---|
| Gemini 3.1 Pro | gemini-3.1-pro |
Warp 还支持通过 Fireworks AI 托管的领先开源模型,因此您无需设置自己的推理基础设施即可在 Warp 内部运行它们。
| 模型 | model_id |
|---|---|
| GLM 5.1 | glm-5.1-fireworks |
| Kimi K2.5 | kimi-k25-fireworks |
| Kimi K2.6 | kimi-k26-fireworks |
| Minimax 2.7 | minimax-2.7-fireworks |
| Qwen 3.6 Plus | qwen-3.6-plus-fireworks |
如何更换模型
标题为“如何更换模型”的章节您可以在提示输入中使用模型选择器快速切换模型。当前激活的模型会直接显示在输入编辑器中。
要更换模型,请点击显示的模型名称(例如,Claude Sonnet 4.5)以打开包含所有受支持选项的下拉菜单。您的选择将自动保留以用于未来的提示。
模型回退
标题为“模型回退”的章节如果选择的模型因提供商中断或容量问题而暂时不可用,Warp 会使用模型回退系统来确保服务不中断。
工作原理
- 如果选择的模型不可用,Warp 会自动使用预定义链中的回退模型,以在不报错的情况下继续您的对话。
- 一旦最初选择的模型再次可用,Warp 会自动切回该模型。
- 选择回退模型是为了提供与最初选择的模型相当的质量和能力。
配置每个 Agent 配置文件的模型
标题为“配置每个 Agent 配置文件的模型”的章节您可以配置每个 Agent 配置文件 的基础模型,以及 Agent 的自主性、工具访问权限和其他权限。基础模型也用于 规划 (Planning)。
在 设置 > Agents > 配置文件 中直接编辑您的默认配置文件或任何其他配置文件。
零数据保留策略
标题为“零数据保留策略”的章节Warp 与多个大型语言模型 (LLM) 提供商集成,以驱动其 AI 驱动的功能。
这些提供商包括但不限于:
- OpenAI
- Anthropic
- xAI
- Fireworks AI
Warp 已与这些提供商执行了 零数据保留 (ZDR) 协议。这意味着,默认情况下,在所有计划中:
- LLM 提供商承诺不对通过 Warp 服务处理的任何客户生成数据进行模型训练。
- LLM 提供商承诺在生成相关输出后,在固定的时间期限内删除输入和输出。
Warp 通过技术手段和与 LLM 提供商的合同保障来强制执行这些承诺。