> ## Documentation Index
> Fetch the complete documentation index at: https://docs.mixroute.ai/llms.txt
> Use this file to discover all available pages before exploring further.

# 当下热门模型

> 本页面提供 MixRoute 支援的模型资讯、定价和使用说明。

## 🔥 当前推荐模型

以下为当前稳定供给的热门模型，完整模型列表和实时价格请访问 [MixRoute 模型广场](https://console.mixroute.ai/models)。

<Danger>
  在呼叫模型时，请检查名称是否与 MixRoute 模型广场中的命名相符，否则将无法正常运行。
</Danger>

<Info>
  表中上下文长度采用模型厂商公开规格。MixRoute 的接口支持、路由别名、可用性与价格，以模型广场和各模型详情页为准。
</Info>

## 模型分类

### 🤖 OpenAI 系列

#### GPT 系列

| 模型名称 | 模型ID | 上下文长度 | 特点 | 推荐场景 |
| - | - | - | - | - |
| GPT 6 Astra ⭐ | gpt-6-astra | 1.05M | OpenAI 当前能力最强的模型，面向复杂端到端任务；支持文本和图像输入，最大输出 128K | 复杂推理、编程代理、研究与文档创作 |
| [GPT 6.1 Sol](/zh-hans/model-api/openai/gpt-6.1-sol) | gpt-6.1-sol | 1.05M | 面向复杂编程和专业工作的文本/图像推理模型，最大输出 128K；函数调用使用 Responses | 编程、代理、专业任务 |
| [GPT 6 Sol](/zh-hans/model-api/openai/gpt-6-sol) | gpt-6-sol | 1,050,000 | GPT 6 中兼顾智能水平与成本的模型，适合编程和代理工作流。 | 编程、工具工作流、专业任务 |
| [GPT 6 Luna](/zh-hans/model-api/openai/gpt-6-luna) | gpt-6-luna | 1,050,000 | GPT 6 高效率模型，适合目标明确的高吞吐任务。 | 路由、抽取、高吞吐助手 |
| GPT 5.6 Sol ⭐ | gpt-5.6-sol | 1.05M | 面向复杂专业任务的前沿模型，支持深度推理，最大输出 128K | 复杂推理、编程、长程代理任务 |
| GPT 5.6 Terra | gpt-5.6-terra | 1.05M | 在专业工作负载中兼顾智能水平与成本，最大输出 128K | 通用编程、分析、内容创作 |
| GPT 5.6 Luna | gpt-5.6-luna | 1.05M | 面向成本敏感和高吞吐场景的 GPT 5.6 版本，最大输出 128K | 高吞吐、路由、批量任务 |
| GPT Chat Latest | gpt-chat-latest | 400K | MixRoute 对 OpenAI Chat Latest 滚动模型的别名，底层快照会随 OpenAI 更新 | 对话助手、原型开发、兼容场景 |
| GPT 5.5 | gpt-5.5 | 1.05M | 面向编程与专业工作的前沿模型，支持文本和图像输入，最大输出 128K | 编程、推理、专业工作流 |
| GPT 5.4 Pro | gpt-5.4-pro | 1.05M | 使用更多推理计算提高回答精度；仅支持 Responses API，复杂请求可能耗时较长 | 高精度分析、高难度任务 |
| GPT 5.4 | gpt-5.4 | 1.05M | 面向编程与专业工作的通用模型，支持 Chat Completions 和 Responses | 编程、分析、商业内容 |

#### 图像生成模型

| 模型名称 | 模型ID | 特点 |
| - | - | - |
| [GPT Image 2.5 Sunburst](/zh-hans/model-api/openai/gpt-image-2.5-sunburst) | gpt-image-2.5-sunburst | GPT Image 2.5 精细创作版本，适合精确生成、高要求编辑和细节丰富的视觉素材。 |
| [GPT Image 2.5 Flare](/zh-hans/model-api/openai/gpt-image-2.5-flare) | gpt-image-2.5-flare | GPT Image 2.5 高速度版本，支持图像生成和编辑。 |
| GPT-Image-2 | gpt-image-2 | 上一代 GPT Image 生成与编辑模型，支持灵活尺寸。 |
| GPT-Image-1.5 | gpt-image-1.5 | 为现有集成保留的上一代图像模型 |
| GPT-Image-1 | gpt-image-1 | 为兼容旧项目保留的早期图像生成模型 |

#### 音频、转录与视频模型

| 模型名称 | 模型ID | 特点 | 推荐场景 |
| - | - | - | - |
| GPT-Realtime-2 ⭐ | gpt-realtime-2 | 支持工具调用的实时端到端语音推理模型，128K 上下文、最大输出 32K | 语音代理、实时助手、工具工作流 |
| GPT Audio 1.5 | gpt-audio-1.5 | 通过 Chat Completions 处理音频输入和输出 | 语音助手、语音交互 |
| GPT Audio | gpt-audio | 面向现有集成的上一代音频输入和输出模型 | 音频对话兼容场景 |
| GPT-4o Transcribe Diarize | gpt-4o-transcribe-diarize | 将语音转为文字，并标注不同说话者及其时间段 | 会议、访谈、通话分析 |
| GPT-4o Mini Transcribe | gpt-4o-mini-transcribe | 成本更低的 GPT-4o mini 语音转文字模型 | 字幕、批量转录 |
| Sora 2 ⭐ | sora-2 | OpenAI 旗舰视频生成模型，支持文生视频、图生视频和同步音频 | 视频创作、创意生产 |

### 🎭 Claude 系列 (Anthropic)

#### Claude 最新模型

| 模型名称 | 模型ID | 上下文长度 | 特点 | 推荐场景 |
| - | - | - | - | - |
| [Claude Opus 5.5](/zh-hans/model-api/anthropic/claude-opus-5-5) | claude-opus-5-5 | 1M | Claude Opus 系列模型，面向长程代理式编程和知识工作。 | 编程代理、研究、复杂知识工作 |
| Claude Opus 5 ⭐ | claude-opus-5 | 1M | 面向复杂代理式编程和企业工作的深度推理模型，最大输出 128K，默认启用思考 | 长程代理、高难度编程、企业工作 |
| Claude Fable 5.1 ⭐ | claude-fable-5-1 | 1M | 面向高难度推理和长程代理的高能力模型，最大输出 128K，始终启用自适应思考 | 高难度推理、长程代理、多步骤研究 |
| Claude Fable 5 | claude-fable-5 | 1M | Anthropic 面向创意叙事和知识工作的深度推理模型，支持扩展思考 | 创意写作、内容创作、研究分析 |
| [Claude Sonnet 5.5](/zh-hans/model-api/anthropic/claude-sonnet-5-5) | claude-sonnet-5-5 | 1M | 面向编程和知识工作的快速模型，最大输出 128K，支持自适应思考和自动工具选择 | 编程、代理、知识工作 |
| Claude Sonnet 5 | claude-sonnet-5 | 1M | 为现有集成保留的上一代 Sonnet，最大输出 128K | 现有 Sonnet 工作流 |
| Claude Haiku 5.5 | claude-haiku-5-5 | 1M | 面向高流量工作的低延迟模型，支持自适应思考，最大输出 128K | 分类、路由、信息抽取、编程子代理 |
| Claude Haiku 4.5 | claude-haiku-4-5-20251001 | 200K | 上一代 Haiku 模型，最大输出 64K，支持可选扩展思考 | 现有 Haiku 集成 |

### 🌟 Google Gemini 系列

| 模型名称 | 模型ID | 上下文长度 | 特点 | 推荐场景 |
| - | - | - | - | - |
| Gemini 3.8 Flash ⭐ | gemini-3.8-flash | 1M | Google 当前智能水平最高的 Flash 模型，支持 100 万输入、64K 输出、可调思考、工具和结构化输出 | 长程编程、自主代理、企业工作流 |
| [Lyria 3.5](/zh-hans/model-api/google/lyria-3.5) | lyria-3.5 | 131,072 input | Google 音乐生成模型，可创作器乐和带人声的歌曲。 | 歌曲、配乐、器乐创作 |
| Gemini Omni 1.1 Flash | gemini-omni-1.1-flash | 1M | 支持文本、图像或视频输入的对话式视频生成与编辑，可输出 3-10 秒、最高 4K 视频 | 视频创作、编辑、续写 |
| Gemini 3.7 Flash | gemini-3.7-flash | 1M | 稳定版原生多模态推理模型，支持思考、工具和结构化输出 | 编程循环、多模态分析、代理任务 |
| Gemini 3.6 Flash | gemini-3.6-flash | 1M | 已正式发布，面向代理式编程、多模态和空间推理，最大输出 64K | 编程循环、多模态分析、代理任务 |
| Gemini 3.5 Flash-Lite | gemini-3.5-flash-lite | 1M | 低延迟、低成本，适合高吞吐子代理、文档解析和数据抽取 | 路由、抽取、高并发任务 |
| Gemini 3.1 Pro Preview | gemini-3.1-pro-preview | 1M | 面向软件工程、精确工具调用和可靠多步骤执行的预览模型 | 复杂推理、编程、工具工作流 |
| [Nano Banana 2.1](/zh-hans/model-api/google/gemini-nano-banana-2.1) | gemini-nano-banana-2.1 | 128K | 图片生成与对话式编辑，支持 1K/2K/4K 输出，强化文字渲染和参考一致性 | 图片创作、编辑、视觉内容 |
| Gemini 3.1 Flash Image | gemini-3.1-flash-image | 128K | 为现有图片集成保留的 Nano Banana 2 路由 | 现有图片生成与编辑 |

### 🚀 xAI Grok 系列

| 模型名称 | 模型ID | 上下文长度 | 特点 | 推荐场景 |
| - | - | - | - | - |
| [Grok 4.7](/zh-hans/model-api/xai/grok-4.7) | grok-4.7 | 500,000 | xAI 面向编程、代理任务和知识工作的模型，支持可调推理。 | 编程、代理、视觉分析 |
| Grok 4.6 ⭐ | grok-4.6 | 500K | xAI 面向编程、代理任务和知识工作的旗舰模型，支持文本或图像输入、可调推理、函数调用和结构化输出 | 编程、代理、复杂知识工作 |
| Grok 4.5 | grok-4.5 | 500K | 面向编程、代理任务和知识工作的前沿模型，支持推理、工具及文本或图像输入 | 编程、代理、复杂知识工作 |
| Grok 4.20 Reasoning | grok-4.20-0309-reasoning | 1M | 高速推理模型，支持代理式工具调用和结构化输出；实时数据需显式启用搜索工具 | 推理、研究代理、工具工作流 |
| Grok 4.20 Multi-Agent | grok-4.20-multi-agent-0309 | 1M | 多个代理并行协作完成深度研究；需使用 Responses API | 深度研究、多代理分析、复杂调查 |
| Grok 4.3 | grok-4.3 | 1M | 快速通用模型，具备较强指令遵循、工具调用、结构化输出和可调推理能力 | 对话、代理、高频工具调用 |
| Grok Build 0.1（兼容 ID） | grok-code-fast-1 | 256K | xAI 将此兼容 ID 路由到 Grok Build 0.1，面向代理式软件工程工作流 | 编程代理、代码仓库任务、Web 开发 |
| Grok Imagine Image 2.0 ⭐ | grok-imagine-image-2.0 | — | xAI 图像生成与编辑模型，支持 1K/2K 输出和质量控制 | 图像生成、编辑、创意生产 |
| Grok Imagine Image | grok-imagine-image | — | 为兼容现有集成保留的上一代 xAI 图像路由 | 现有图像集成 |

### 🔍 DeepSeek 系列

| 模型名称 | 模型ID | 上下文长度 | 特点 | 推荐场景 |
| - | - | - | - | - |
| [DeepSeek V4.1 Flash](/zh-hans/model-api/deepseek/deepseek-v4.1-flash) | deepseek-v4.1-flash | 1M | 具备原生视觉理解的 DeepSeek 推理模型，适合编程、代理和多模态分析。 | 视觉推理、编程、代理 |
| DeepSeek V4 Pro ⭐ | deepseek-v4-pro | 1M | V4 高能力版本，面向推理和代理式编程；支持思考与非思考模式，最大输出 384K | 高难度推理、编程代理、长程任务 |
| DeepSeek V4 Flash | deepseek-v4-flash | 1M | 更快、更经济的 V4 版本，同样支持双模式和最大 384K 输出 | 高吞吐推理、对话、简单代理 |
| DeepSeek V4 Flash Vision Exp | deepseek-v4-flash-vision-exp | 1M | 支持视觉的实验性 V4 Flash，面向图文推理、工具与 Responses 工作流 | 图像分析、多模态代理、视觉编程 |
| [DeepSeek V3.2 Speciale](/zh-hans/model-api/deepseek/deepseek-v3.2-speciale) | deepseek-v3.2-speciale | - | DeepSeek V3.2 的高强度推理版本，面向高难度文本、数学和分析任务。 | 数学、高难度文本推理 |
| DeepSeek V3.2 | deepseek-v3.2 | 164K | 上一代模型，重点优化高效推理和带工具推理工作流 | 通用推理、工具调用、兼容场景 |
| DeepSeek V3.1 | deepseek-v3.1 | 128K | 混合推理模型，支持思考与非思考模式，工具和代理能力较早期 V3 更强 | 对话、推理、编程、代理 |

### 🐘 国产模型系列

#### 智谱 AI (GLM)

| 模型名称 | 模型ID | 上下文长度 | 特点 | 推荐场景 |
| - | - | - | - | - |
| [GLM-5.3 FlashX](/zh-hans/model-api/zhipu/glm-5.3-flashx) | glm-5.3-flashx | 1M | GLM-5.3 Flash 的高速推理服务版本，适合多模态编程和长程代理。 | 视觉编程、文档分析、快速代理 |
| GLM-5.3 Flash ⭐ | glm-5.3-flash | 1M | 面向编程、视觉理解和长程代理的高效原生多模态模型 | 多模态编程、文档分析、快速代理 |
| GLM-5.3 ⭐ | glm-5.3 | 1M | 始终启用思考的旗舰模型，面向复杂编程、长程代理和安全分析 | 高难度编程、自主代理、安全工作 |
| GLM-5.2 | glm-5.2 | 1M | 面向项目级工程和长程任务的上一代旗舰模型，最大输出 128K | 现有编程代理、长程任务 |
| GLM-5.1 | glm-5.1 | 200K | 面向长时间自主编程和工程交付的旗舰基座模型，最大输出 128K | 代理式编程、系统优化、办公任务 |
| GLM-5 Turbo | glm-5-turbo | 200K | 针对 OpenClaw 类代理优化，强化工具调用、指令遵循和持续多步骤执行 | 工具代理、定时任务、自动化 |
| GLM-5 | glm-5 | 200K | 面向 Agentic Engineering、复杂系统和长程执行的基座模型 | 编程、代理、结构化知识工作 |
| GLM-4.7 FlashX | glm-4.7-flashx | 200K | GLM-4.7 的轻量高速版本，最大输出 128K，支持代理式编程 | 快速编程、写作、翻译、对话 |

#### 阿里通义千问 (Qwen)

| 模型名称 | 模型ID | 上下文长度 | 特点 | 推荐场景 |
| - | - | - | - | - |
| Qwen Image 2.0 Pro | qwen-image-2.0-pro | — | 支持最高 2K 的图像生成与编辑，在写实效果、细节和文字渲染方面进一步提升 | 文生图、图像编辑、商品视觉 |
| Qwen 3.8 Max ⭐ | qwen3.8-max | 1M | 面向编程与专业工作的 2.4T 参数 MoE 旗舰，支持视觉理解、函数调用和结构化输出 | 推理、编程、代理、长文本 |

#### Moonshot Kimi 系列

| 模型名称 | 模型ID | 上下文长度 | 特点 | 推荐场景 |
| - | - | - | - | - |
| Kimi K3 ⭐ | kimi-k3 | 1M | Moonshot 当前最高能力的开放权重原生多模态代理模型，面向长程编程、知识工作和推理 | 大型代码仓库、研究、多模态代理 |
| Kimi K2.7 Code | kimi-k2.7-code | 256K | 编程专用代理模型，支持图像和视频输入、强制思考及跨轮保留推理 | 软件工程、编程代理、工具调用 |
| Kimi K2.6 | kimi-k2.6 | 256K | 原生多模态代理模型，强化长程编程、主动执行和多代理编排 | 编程、视觉代理、自主工作流 |
| Kimi K2.5 | kimi-k2.5 | 256K | 原生多模态模型，支持文本、图像和视频理解，以及思考与快速模式 | 多模态对话、推理、编程 |

#### MiniMax 系列

| 模型名称 | 模型ID | 上下文长度 | 特点 | 推荐场景 |
| - | - | - | - | - |
| MiniMax H3 ⭐ | MiniMax-H3 | — | 通用多模态视频模型，支持文本、图像和多模态参考工作流、原生立体声音频、768P/2K 与 4-15 秒输出 | 视频创作、多模态编辑、品牌内容 |
| MiniMax M3 ⭐ | MiniMax-M3 | 1M | MiniMax 最新旗舰模型，面向复杂推理、编程和长文本处理，支持工具调用 | 复杂推理、编程、长文本处理 |
| MiniMax M2.7 | MiniMax-M2.7 | 256K | 高性能通用模型，在推理、编程和多轮对话中表现均衡 | 通用推理、编程、对话 |
| MiniMax M2.5 | MiniMax-M2.5 | 256K | 面向通用场景的轻量模型，兼顾性能与成本 | 对话、内容生成、批量任务 |
| MiniMax M2 | MiniMax-M2 | 128K | 上一代通用模型，为现有集成保留的兼容版本 | 兼容场景、简单任务 |

#### 小米 MiMo 系列

| 模型名称 | 模型ID | 上下文长度 | 特点 | 推荐场景 |
| - | - | - | - | - |
| MiMo V2.5 Pro ⭐ | mimo-v2.5-pro | 1M | 小米能力最强的开放权重 Agent 模型，总参数 1.02T、激活参数 42B | 复杂编程、长程代理、高密度工具调用 |

#### 腾讯

| 模型名称 | 模型ID | 上下文长度 | 特点 | 推荐场景 |
| - | - | - | - | - |
| Hy4 Preview ⭐ | hy4-preview | 1M | 旗舰生产力模型，支持推理、结构化输出、函数调用和缓存；最大输入 960K、最大输出 64K | 复杂代理、编程、办公与分析 |
| Hy3 | hy3 | 256K | 面向编程代理、长文档、搜索问答和复杂任务执行的正式版；最大输入 192K、最大输出 128K | 编程、文档分析、多步骤代理 |
| Hy-MT2-Pro | hy-mt2-pro | 8K | 面向专业领域和高质量要求场景的旗舰翻译模型 | 专业及领域翻译 |
| Hy-MT2-Plus | hy-mt2-plus | 8K | 指令遵循能力较强的翻译模型 | 可控翻译、术语敏感场景 |
| Hy-MT2-Lite | hy-mt2-lite | 8K | 针对低延迟优化的轻量翻译模型 | 快速及大批量翻译 |

#### Seedance 视频系列

| 模型名称 | 模型ID | 特点 |
| :- | :- | :- |
| Seedance 2.5 ⭐ | doubao-seedance-2-5-260628 | MixRoute 最新 Seedance 视频路由，支持文生视频与图生视频，提供 480p、720p 和 1080p 输出 |
| [Dreamina Seedance 2.5](/zh-hans/model-api/bytedance/dreamina-seedance-2-5) | dreamina-seedance-2-5-260628 | 通过 Dreamina 路由调用 Seedance 2.5，支持多模态参考和同步音频的视频生成。 |
| Seedance 2.0 | dreamina-seedance-2-0-260128 | 支持文本、图像、视频和音频参考的多模态视频生成，可生成同步音频，最高 4K |
| Seedance 2.0 Fast | dreamina-seedance-2-0-fast-260128 | 更快的 Seedance 2.0 路由，支持多模态参考、同步音频和 480p/720p 输出 |
| Seedance 2.0 Mini | dreamina-seedance-2-0-mini-260615 | 轻量版 Seedance 2.0，支持多模态参考、同步音频和 480p/720p 输出 |

#### 通义万相视频系列

| 模型名称 | 模型ID | 特点 |
| - | - | - |
| [Wan 3.0 Video Prime](/zh-hans/model-api/alibaba/wan3.0-video-prime) | wan3.0-video-prime | 万相 3.0 视频优速版，保持标准版的输入模式并提升生成速度。 |
| [Wan 2.6 I2V Flash](/zh-hans/model-api/alibaba/wan2.6-i2v-flash) | wan2.6-i2v-flash | 万相 2.6 首帧图生视频高速版，可控制是否生成音轨。 |
| [Wan 2.6 R2V Flash](/zh-hans/model-api/alibaba/wan2.6-r2v-flash) | wan2.6-r2v-flash | 万相 2.6 参考生视频高速版，用于保持参考主体一致性的视频创作。 |

### Cohere

| 模型名称 | 模型ID | 上下文长度 | 特点 | 推荐场景 |
| - | - | - | - | - |
| [Command A+](/zh-hans/model-api/cohere/command-a-plus-05-2026) | command-a-plus-05-2026 | 128K | Cohere 面向多语言推理、企业代理和视觉理解的模型。 | 企业助手、推理、代理 |
| [Command A](/zh-hans/model-api/cohere/command-a-03-2025) | command-a-03-2025 | 256K | Cohere 多语言模型，适合企业对话、检索增强生成和工具工作流。 | 企业对话、RAG、工具调用 |
| [Embed v4.0](/zh-hans/model-api/cohere/embed-v4.0) | embed-v4.0 | 128K | Cohere 多语言向量模型，支持长文本检索。 | 语义搜索、检索、分类 |
| [Embed English v3.0](/zh-hans/model-api/cohere/embed-english-v3.0) | embed-english-v3.0 | 512 | Cohere 面向英语检索优化的文本向量模型。 | 语义搜索、检索、分类 |
| [Embed Multilingual v3.0](/zh-hans/model-api/cohere/embed-multilingual-v3.0) | embed-multilingual-v3.0 | 512 | Cohere 面向跨语言检索的文本向量模型。 | 语义搜索、检索、分类 |
| [Rerank v4.0 Pro](/zh-hans/model-api/cohere/rerank-v4.0-pro) | rerank-v4.0-pro | 32,768 | Cohere 注重排序质量的多语言相关性重排序模型。 | RAG 排序、搜索相关性 |
| [Rerank v4.0 Fast](/zh-hans/model-api/cohere/rerank-v4.0-fast) | rerank-v4.0-fast | 32,768 | Cohere 注重响应速度的多语言相关性重排序模型。 | RAG 排序、搜索相关性 |

### Meta Llama

| 模型名称 | 模型ID | 上下文长度 | 特点 | 推荐场景 |
| - | - | - | - | - |
| [Llama 3.3 70B Instruct](/zh-hans/model-api/meta/llama-3.3-70b-instruct) | llama-3.3-70b-instruct | 128K | Meta 指令微调文本模型，适合多语言对话和文本生成。 | 对话、摘要、文本生成 |
| [Llama 4 Maverick FP8](/zh-hans/model-api/meta/llama-4-maverick-17b-128e-instruct-fp8) | llama-4-maverick-17b-128e-instruct-fp8 | 1M | Meta 多模态混合专家模型，支持文本和图像理解。 | 多模态助手、视觉分析 |
| [Llama 4 Scout](/zh-hans/model-api/meta/llama-4-scout-17b-16e-instruct) | llama-4-scout-17b-16e-instruct | 10M | Meta 多模态混合专家模型，支持文本和图像理解。 | 多模态助手、视觉分析 |

## 🛠️ 使用建议

### 模型选择指南

<CardGroup cols={2}>
  <Card title="编程开发" icon="code">
    **最高能力**：GPT 6 Astra、GPT 6.1 Sol、Claude Fable 5.1、Claude Opus 5.5、GLM-5.3、Hy4 Preview、Kimi K3、MiMo V2.5 Pro

    **均衡选择**：GPT 5.6 Terra、Claude Sonnet 5.5、Gemini 3.8 Flash、GLM-5.3 Flash、Hy3、Grok 4.7

    **开放模型备选**：DeepSeek V4.1 Flash、GLM-5.3、Qwen 3.8 Max、MiMo V2.5 Pro
  </Card>

  <Card title="内容创作" icon="pen">
    **推荐**：GPT 5.6 Terra、Claude Sonnet 5.5、Qwen 3.8 Max

    **高难度研究或长材料**：GPT 6 Astra、GPT 6.1 Sol、Claude Fable 5.1、Claude Opus 5.5、GLM-5.3、Grok 4.20 Multi-Agent、Gemini 3.1 Pro Preview
  </Card>

  <Card title="快速响应" icon="bolt">
    **推荐**：GPT 6 Luna、GPT-5.4 Nano、Claude Haiku 5.5、Gemini 3.5 Flash-Lite

    **备选**：GLM-5.3 Flash、Gemini 3.6 Flash、DeepSeek V4.1 Flash
  </Card>

  <Card title="多模态" icon="image">
    **图像**：GPT Image 2.5 Sunburst、GPT Image 2.5 Flare、Grok Imagine Image 2.0、Nano Banana 2.1、DeepSeek V4.1 Flash

    **音频**：GPT-Realtime-2、GPT Audio 1.5、GPT-4o Transcribe Diarize, Lyria 3.5

    **视频**：Sora 2、Gemini Omni 1.1 Flash、Seedance 2.5、MiniMax H3
  </Card>
</CardGroup>

### 长文本处理

* **百万级上下文**：GPT 6 Astra、GPT 6.1 Sol、GPT 5.6 系列和 GPT 5.5（1.05M）；Claude Fable 5.1、Opus 5.5 与 Sonnet 5.5、Haiku 5.5、Gemini 3.8 Flash、DeepSeek V4、GLM-5.3、Qwen 3.8 Max、Hy4 Preview、Kimi K3、MiMo V2.5 Pro、Grok 4.20/4.3（1M）
* **编程与代理任务**：GPT 6 Astra、GPT 6.1 Sol、Claude Fable 5.1、Claude Opus 5.5、GLM-5.3、Hy4 Preview、Kimi K3、MiMo V2.5 Pro、Grok 4.7、DeepSeek V4.1 Flash
* **容量规划**：不要占满标称上下文窗口，应为模型输出、推理 Token 和工具结果预留空间

### 成本优化建议

1. **分级使用**：简单任务用便宜模型，复杂任务用高级模型
2. **测试优化**：先用小模型测试，确定需求后再用大模型
3. **批量处理**：大量相似任务可以选择 Mini 版本
4. **缓存复用**：对重复查询结果进行缓存

## 🔗 相关资源

<CardGroup cols={2}>
  <Card title="API 文档" icon="book" href="https://mixroute.ai" cta="了解更多">
    详细接口说明
  </Card>

  <Card title="快速开始" icon="rocket" href="https://mixroute.ai" cta="了解更多">
    集成指南
  </Card>
</CardGroup>

<Note>
  模型列表持续更新中，我们会及时添加最新发布的优秀模型。如需使用特定模型或有批量需求，请联系客服。
</Note>


This documentation is built and hosted on [Mintlify](https://mintlify.com), a developer documentation platform.