模型对比
本页把当前在售的模型并排列出,方便你一眼挑选。表格中可对比上下文窗口、输入模态、各模型最擅长的场景,以及原生 API 协议,下方的”如何选择”给出快速建议。这里不展示价格,因为价格会变动;实时价格与可用状态在控制台的模型市场 按模型逐一列出。
对比表
Anthropic(原生协议:Anthropic)
| 模型 | 上下文窗口 | 模态 | 最适合 | 原生协议 |
|---|---|---|---|---|
| Claude Fable 5 | 1,000,000 tokens | 文本、图像 | 前沿级自主编码与深度知识工作;自适应思考始终开启 | Anthropic |
| Claude Sonnet 5 | 1,000,000 tokens | 文本、图像 | 均衡默认款,适合生产编码、高并发服务、长上下文智能体 | Anthropic |
| Claude Opus 4.8 | 1,000,000 tokens | 文本、图像 | 上一代前沿款,适合自主智能体与长周期工作;仍在供应 | Anthropic |
| Claude Haiku 4.5 | 200,000 tokens | 文本、图像 | 快速、低成本、高并发实时任务与文本摘要 | Anthropic |
OpenAI(原生协议:OpenAI)
| 模型 | 上下文窗口 | 模态 | 最适合 | 原生协议 |
|---|---|---|---|---|
| GPT-5.6 Sol | 1,050,000 tokens | 文本、图像、PDF | 旗舰深度推理,适合复杂编码、分析与多步规划 | OpenAI |
| GPT-5.6 Terra | 1,050,000 tokens | 文本、图像、PDF | 均衡款,中档价位,适合通用编码与业务应用 | OpenAI |
| GPT-5.6 Luna | 1,050,000 tokens | 文本、图像 | 经济型,成本优先,适合高频轻任务与实时交互 | OpenAI |
| GPT-5.5 | 1,050,000 tokens | 文本、图像 | 上一代旗舰,适合多步自主任务与研究 | OpenAI |
Google(原生协议:OpenAI)
| 模型 | 上下文窗口 | 模态 | 最适合 | 原生协议 |
|---|---|---|---|---|
| Gemini 3.1 Pro | 1,050,000 tokens | 文本、图像、PDF | 旗舰 Pro 档,适合高级推理、编码与多模态分析 | OpenAI |
| Gemini 3.5 Flash | 1,100,000 tokens | 文本、图像、视频 | 主力款,以 Flash 档速度胜任高吞吐编码与智能体执行 | OpenAI |
| Gemini 3 Flash | 1,050,000 tokens | 文本、图像 | 轻量、低延迟、成本敏感型任务 | OpenAI |
开源 / 国产(原生协议:OpenAI)
| 模型 | 上下文窗口 | 模态 | 最适合 | 原生协议 |
|---|---|---|---|---|
| GLM-5.2 | 1,000,000 tokens | 文本、图像、视频 | 顶级开源权重模型,适合长周期工程与中文场景 | OpenAI |
| GLM-5.3 | 1,000,000 tokens | 文本 | 新一代旗舰,推理常开,适合复杂软件工程与长程 Agent | OpenAI |
| GLM-5.1 | 128,000 tokens | 文本 | 上一代开源旗舰,面向智能体工程;仍在供应 | OpenAI |
如何选择
- 均衡默认款: 多数生产编码与智能体工作,先用 Claude Sonnet 5;OpenAI 一侧可选均衡款 GPT-5.6 Terra。
- 最强推理: 处理最复杂的编码与深度知识工作,选 Claude Fable 5 或 GPT-5.6 Sol。
- 最省最快: 高频、延迟敏感的任务,用 Claude Haiku 4.5、GPT-5.6 Luna 或 Gemini 3 Flash。
- 最长上下文: Gemini 3.5 Flash 窗口最大,为 1,100,000 tokens;另有多款达到 1,000,000 至 1,050,000。若需要开源权重上的长上下文,用 GLM-5.2。
- 视频输入: 选 Gemini 3.5 Flash 或 GLM-5.2,二者原生支持视频输入。
完整参考
完整的模型参考列出全部模型,包括更多正在陆续上线的模型(如视频与更多开源权重模型)。实时价格与当前可用状态在该页以及控制台的模型市场中列出。
Last updated on