> ## Documentation Index
> Fetch the complete documentation index at: https://docs.mixroute.ai/llms.txt
> Use this file to discover all available pages before exploring further.

# 当下热门模型

> 本页面提供 MixRoute 支援的模型资讯、定价和使用说明。

## 🔥 当前推荐模型

以下为当前稳定供给的热门模型，完整模型列表和实时价格请访问 [MixRoute 模型广场](https://console.mixroute.ai/models)。

<Danger>
  在呼叫模型时，请检查名称是否与 MixRoute 模型广场中的命名相符，否则将无法正常运行。
</Danger>

<Info>
  表中上下文长度采用模型厂商公开规格。MixRoute 的接口支持、路由别名、可用性与价格，以模型广场和各模型详情页为准。
</Info>

## 模型分类

### 🤖 OpenAI 系列

#### GPT 系列

| 模型名称            | 模型ID            | 上下文长度 | 特点                                                     | 推荐场景           |
| --------------- | --------------- | ----- | ------------------------------------------------------ | -------------- |
| GPT 5.6 Sol ⭐   | gpt-5.6-sol     | 1.05M | 面向复杂专业任务的前沿模型，支持深度推理，最大输出 128K                         | 复杂推理、编程、长程代理任务 |
| GPT 5.6 Terra   | gpt-5.6-terra   | 1.05M | 在专业工作负载中兼顾智能水平与成本，最大输出 128K                            | 通用编程、分析、内容创作   |
| GPT 5.6 Luna    | gpt-5.6-luna    | 1.05M | 面向成本敏感和高吞吐场景的 GPT 5.6 版本，最大输出 128K                     | 高吞吐、路由、批量任务    |
| GPT Chat Latest | gpt-chat-latest | 400K  | MixRoute 对 OpenAI Chat Latest 滚动模型的别名，底层快照会随 OpenAI 更新 | 对话助手、原型开发、兼容场景 |
| GPT 5.5         | gpt-5.5         | 1.05M | 面向编程与专业工作的前沿模型，支持文本和图像输入，最大输出 128K                     | 编程、推理、专业工作流    |
| GPT 5.4 Pro     | gpt-5.4-pro     | 1.05M | 使用更多推理计算提高回答精度；仅支持 Responses API，复杂请求可能耗时较长            | 高精度分析、高难度任务    |
| GPT 5.4         | gpt-5.4         | 1.05M | 面向编程与专业工作的通用模型，支持 Chat Completions 和 Responses         | 编程、分析、商业内容     |

#### 图像生成模型

| 模型名称          | 模型ID          | 特点                   |
| ------------- | ------------- | -------------------- |
| GPT-Image-2 ⭐ | gpt-image-2   | OpenAI 当前最高能力的图像生成模型 |
| GPT-Image-1.5 | gpt-image-1.5 | 为现有集成保留的上一代图像模型      |
| GPT-Image-1   | gpt-image-1   | 为兼容旧项目保留的早期图像生成模型    |

#### 音频、转录与视频模型

| 模型名称                      | 模型ID                      | 特点                                            | 推荐场景        |
| ------------------------- | ------------------------- | --------------------------------------------- | ----------- |
| GPT Audio 1.5 ⭐           | gpt-audio-1.5             | OpenAI 当前最佳语音模型，通过 Chat Completions 处理音频输入和输出 | 语音助手、实时语音交互 |
| GPT Audio                 | gpt-audio                 | 面向现有集成的上一代音频输入和输出模型                           | 音频对话兼容场景    |
| GPT-4o Transcribe Diarize | gpt-4o-transcribe-diarize | 将语音转为文字，并标注不同说话者及其时间段                         | 会议、访谈、通话分析  |
| GPT-4o Mini Transcribe    | gpt-4o-mini-transcribe    | 成本更低的 GPT-4o mini 语音转文字模型                     | 字幕、批量转录     |
| Sora 2 ⭐                  | sora-2                    | OpenAI 旗舰视频生成模型，支持文生视频、图生视频和同步音频              | 视频创作、创意生产   |

### 🎭 Claude 系列 (Anthropic)

#### Claude 最新模型

| 模型名称              | 模型ID             | 上下文长度 | 特点                                       | 推荐场景            |
| ----------------- | ---------------- | ----- | ---------------------------------------- | --------------- |
| Claude Opus 5 ⭐   | claude-opus-5    | 1M    | 面向复杂代理式编程和企业工作的深度推理模型，最大输出 128K，默认启用思考   | 长程代理、高难度编程、企业工作 |
| Claude Sonnet 5 ⭐ | claude-sonnet-5  | 1M    | Anthropic 速度与智能的最佳平衡，最大输出 128K，默认启用自适应思考 | 编程、代理、日常知识工作    |
| Claude Haiku 4.5  | claude-haiku-4-5 | 200K  | 当前 Claude 系列中速度最快，最大输出 64K，支持可选扩展思考      | 低延迟对话、路由、信息抽取   |

### 🌟 Google Gemini 系列

| 模型名称                     | 模型ID                   | 上下文长度 | 特点                              | 推荐场景            |
| ------------------------ | ---------------------- | ----- | ------------------------------- | --------------- |
| Gemini 3.6 Flash ⭐       | gemini-3.6-flash       | 1M    | 已正式发布，面向代理式编程、多模态和空间推理，最大输出 64K | 编程循环、多模态分析、代理任务 |
| Gemini 3.5 Flash-Lite    | gemini-3.5-flash-lite  | 1M    | 低延迟、低成本，适合高吞吐子代理、文档解析和数据抽取      | 路由、抽取、高并发任务     |
| Gemini 3.1 Pro Preview   | gemini-3.1-pro-preview | 1M    | 面向软件工程、精确工具调用和可靠多步骤执行的预览模型      | 复杂推理、编程、工具工作流   |
| Gemini 3.1 Flash Image ⭐ | gemini-3.1-flash-image | 128K  | 稳定版高吞吐图像生成与编辑模型，支持文字渲染和搜索增强     | 图像生成、编辑、视觉内容    |

### 🚀 xAI Grok 系列

| 模型名称                  | 模型ID                     | 上下文长度 | 特点                                          | 推荐场景               |
| --------------------- | ------------------------ | ----- | ------------------------------------------- | ------------------ |
| Grok 4.5 ⭐            | grok-4.5                 | 500K  | 面向编程、代理任务和知识工作的前沿模型，支持推理、工具及文本或图像输入         | 编程、代理、复杂知识工作       |
| Grok 4.20 Reasoning   | grok-4.20-0309-reasoning | 1M    | 高速推理模型，支持代理式工具调用和结构化输出；实时数据需显式启用搜索工具        | 推理、研究代理、工具工作流      |
| Grok 4.3              | grok-4.3                 | 1M    | 快速通用模型，具备较强指令遵循、工具调用、结构化输出和可调推理能力           | 对话、代理、高频工具调用       |
| Grok Build 0.1（兼容 ID） | grok-code-fast-1         | 256K  | xAI 将此兼容 ID 路由到 Grok Build 0.1，面向代理式软件工程工作流 | 编程代理、代码仓库任务、Web 开发 |

### 🔍 DeepSeek 系列

| 模型名称              | 模型ID              | 上下文长度 | 特点                                       | 推荐场景            |
| ----------------- | ----------------- | ----- | ---------------------------------------- | --------------- |
| DeepSeek V4 Pro ⭐ | deepseek-v4-pro   | 1M    | V4 高能力版本，面向推理和代理式编程；支持思考与非思考模式，最大输出 384K | 高难度推理、编程代理、长程任务 |
| DeepSeek V4 Flash | deepseek-v4-flash | 1M    | 更快、更经济的 V4 版本，同样支持双模式和最大 384K 输出         | 高吞吐推理、对话、简单代理   |
| DeepSeek V3.2     | deepseek-v3.2     | 164K  | 上一代模型，重点优化高效推理和带工具推理工作流                  | 通用推理、工具调用、兼容场景  |
| DeepSeek V3.1     | deepseek-v3.1     | 128K  | 混合推理模型，支持思考与非思考模式，工具和代理能力较早期 V3 更强       | 对话、推理、编程、代理     |

### 🐘 国产模型系列

#### 智谱 AI (GLM)

| 模型名称           | 模型ID           | 上下文长度 | 特点                                    | 推荐场景             |
| -------------- | -------------- | ----- | ------------------------------------- | ---------------- |
| GLM-5.2 ⭐      | glm-5.2        | 1M    | 面向项目级工程和长程任务的旗舰模型，最大输出 128K，支持调节推理强度  | 大型代码仓库、编程代理、长程任务 |
| GLM-5.1        | glm-5.1        | 200K  | 面向长时间自主编程和工程交付的旗舰基座模型，最大输出 128K       | 代理式编程、系统优化、办公任务  |
| GLM-5 Turbo    | glm-5-turbo    | 200K  | 针对 OpenClaw 类代理优化，强化工具调用、指令遵循和持续多步骤执行 | 工具代理、定时任务、自动化    |
| GLM-5          | glm-5          | 200K  | 面向 Agentic Engineering、复杂系统和长程执行的基座模型 | 编程、代理、结构化知识工作    |
| GLM-4.7 FlashX | glm-4.7-flashx | 200K  | GLM-4.7 的轻量高速版本，最大输出 128K，支持代理式编程     | 快速编程、写作、翻译、对话    |

#### 阿里通义千问 (Qwen)

| 模型名称               | 模型ID               | 上下文长度 | 特点                                    | 推荐场景          |
| ------------------ | ------------------ | ----- | ------------------------------------- | ------------- |
| Qwen Image 2.0 Pro | qwen-image-2.0-pro | —     | 支持最高 2K 的图像生成与编辑，在写实效果、细节和文字渲染方面进一步提升 | 文生图、图像编辑、商品视觉 |
| Qwen 3.7 Max ⭐     | qwen3.7-max        | 1M    | Qwen 3.7 系列中规模最大，支持混合思考、函数调用和内置工具     | 推理、编程、代理、长文本  |

#### Moonshot Kimi 系列

| 模型名称           | 模型ID           | 上下文长度 | 特点                                           | 推荐场景            |
| -------------- | -------------- | ----- | -------------------------------------------- | --------------- |
| Kimi K3 ⭐      | kimi-k3        | 1M    | Moonshot 当前最高能力的开放权重原生多模态代理模型，面向长程编程、知识工作和推理 | 大型代码仓库、研究、多模态代理 |
| Kimi K2.7 Code | kimi-k2.7-code | 256K  | 编程专用代理模型，支持图像和视频输入、强制思考及跨轮保留推理               | 软件工程、编程代理、工具调用  |
| Kimi K2.6      | kimi-k2.6      | 256K  | 原生多模态代理模型，强化长程编程、主动执行和多代理编排                  | 编程、视觉代理、自主工作流   |
| Kimi K2.5      | kimi-k2.5      | 256K  | 原生多模态模型，支持文本、图像和视频理解，以及思考与快速模式               | 多模态对话、推理、编程     |

#### Seedance & Seedream 视频与图像系列

| 模型名称                    | 模型ID                              | 特点                                             |
| :---------------------- | :-------------------------------- | :--------------------------------------------- |
| Dola Seedream 5.0 Pro ⭐ | dola-seedream-5-0-pro-260628      | MixRoute 图像生成路由，支持尺寸与质量控制                      |
| Seedream 5.0 ⭐          | seedream-5-0-260128               | 支持文生图、图生图、多图融合和高分辨率输出                          |
| Seedream 5.0 Lite       | seedream-5-0-lite-260128          | 成本更低的文生图和图生图版本                                 |
| Seedream 4.5            | seedream-4-5-251128               | 支持图像生成与编辑、多图融合、组图生成和提示词优化                      |
| Seedream 4.0            | seedream-4-0-250828               | 支持图像生成与编辑、多图融合、组图生成及 2K/4K 输出                  |
| Seedance 2.0 ⭐          | dreamina-seedance-2-0-260128      | 支持文本、图像、视频和音频参考的多模态视频生成，可生成同步音频，最高 4K          |
| Seedance 2.0 Fast       | dreamina-seedance-2-0-fast-260128 | 更快的 Seedance 2.0 路由，支持多模态参考、同步音频和 480p/720p 输出 |
| Seedance 2.0 Mini       | dreamina-seedance-2-0-mini-260615 | 轻量版 Seedance 2.0，支持多模态参考、同步音频和 480p/720p 输出    |
| Seedance 1.5 Pro        | seedance-1-5-pro-251215           | 支持文生视频、图生视频、首尾帧、同步音频和样片模式                      |
| Seedance 1.0 Pro        | seedance-1-0-pro-250528           | 支持文生视频、首帧图生视频和首尾帧控制                            |
| Seedance 1.0 Pro Fast   | seedance-1-0-pro-fast-251015      | 更快的文生视频和首帧图生视频版本                               |

## 🛠️ 使用建议

### 模型选择指南

<CardGroup cols={2}>
  <Card title="编程开发" icon="code">
    **最高能力**：GPT 5.6 Sol、Claude Opus 5、Kimi K3

    **均衡选择**：GPT 5.6 Terra、Claude Sonnet 5、Gemini 3.6 Flash、Grok 4.5

    **开放模型备选**：DeepSeek V4 Pro、GLM-5.2、Qwen 3.7 Max
  </Card>

  <Card title="内容创作" icon="pen">
    **推荐**：GPT 5.6 Terra、Claude Sonnet 5、Qwen 3.7 Max

    **高难度研究或长材料**：GPT 5.6 Sol、Claude Opus 5、Gemini 3.1 Pro Preview
  </Card>

  <Card title="快速响应" icon="bolt">
    **推荐**：GPT 5.6 Luna、Claude Haiku 4.5、Gemini 3.5 Flash-Lite

    **备选**：Gemini 3.6 Flash、DeepSeek V4 Flash、GLM-4.7 FlashX
  </Card>

  <Card title="多模态" icon="image">
    **图像**：GPT-Image-2、Gemini 3.1 Flash Image、Seedream 5.0

    **音频**：GPT Audio 1.5、GPT-4o Transcribe Diarize

    **视频**：Sora 2、Seedance 2.0
  </Card>
</CardGroup>

### 长文本处理

* **百万级上下文**：GPT 5.6 系列和 GPT 5.5（1.05M）；Claude Opus 5 与 Sonnet 5、Gemini 3.6 Flash 与 3.1 Pro Preview、DeepSeek V4、GLM-5.2、Qwen 3.7 Max、Kimi K3、Grok 4.20/4.3（1M）
* **编程与代理任务**：GPT 5.6 Sol、Claude Opus 5、Kimi K3、Grok 4.5、DeepSeek V4 Pro、GLM-5.2
* **容量规划**：不要占满标称上下文窗口，应为模型输出、推理 Token 和工具结果预留空间

### 成本优化建议

1. **分级使用**：简单任务用便宜模型，复杂任务用高级模型
2. **测试优化**：先用小模型测试，确定需求后再用大模型
3. **批量处理**：大量相似任务可以选择 Mini 版本
4. **缓存复用**：对重复查询结果进行缓存

## 🔗 相关资源

<CardGroup cols={2}>
  <Card title="API 文档" icon="book" href="https://mixroute.ai" cta="了解更多">
    详细接口说明
  </Card>

  <Card title="快速开始" icon="rocket" href="https://mixroute.ai" cta="了解更多">
    集成指南
  </Card>
</CardGroup>

<Note>
  模型列表持续更新中，我们会及时添加最新发布的优秀模型。如需使用特定模型或有批量需求，请联系客服。
</Note>
