推理模型 - MyTokenGate
1. 概述
推理模型是基于深度学习的 AI 系统,通过逻辑推演、知识关联和上下文分析解决复杂任务,典型应用包括数学解题、代码生成、逻辑判断和多步推理场景。
2. 当前支持
目前 MyTokenGate 提供的模型均具备强大的推理能力,可用于复杂任务:
Claude 系列
claude-fable-5- 前沿最强,常开自适应思考claude-sonnet-5- 均衡默认,高吞吐claude-opus-4-8- 上代前沿,长程推理
GPT 系列
gpt-5.6-sol- 旗舰推理gpt-5.4- 日常主力推理gpt-5.5- 上代旗舰
Gemini 系列
gemini-3.1-pro-preview- 复杂多模态推理
开源推理系(OpenAI 兼容 reasoning_content)
glm-5.1/glm-5.2- GLM 推理模型deepseek-v4-pro- 深度推理旗舰(即将上线)
3. 使用示例
from openai import OpenAI
client = OpenAI(
base_url='https://gateway.mytokengate.com/v1',
api_key='your-api-key'
)
response = client.chat.completions.create(
model="claude-sonnet-5",
messages=[
{"role": "user", "content": "请逐步分析:如果所有 A 都是 B,所有 B 都是 C,那么所有 A 都是 C 吗?"}
],
max_tokens=4096,
stream=True
)
for chunk in response:
if chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)4. 推理控制(努力度与思考预算)
不同厂商用不同参数控制”思考”的深度,命名与取值各异:
- GPT-5 系列 ——
reasoning.effort,取值minimal/low/medium(默认)/high,较新的模型另有none/xhigh/max;minimal近零思考、延迟最低。思考 token 计入输出计费。 - Claude 扩展思考 ——
thinking.type="enabled"+budget_tokens(思考预算 token 数);在 Claude 4.6 上该显式模式已标记弃用但仍可用,前沿模型默认自适应思考。 - Gemini ——
thinkingConfig内thinkingBudget(0 关 / -1 动态)与较新的thinkingLevel;Gemini 3 Pro 无法完全关闭思考。 - 开源推理系(GLM / DeepSeek) —— 走 OpenAI 兼容接口,思考内容在
reasoning_content字段返回,工具调用场景需原样保留回放,详见 交错思考。
MyTokenGate 通过统一网关透传上述参数,具体取值以各模型页与上游文档为准。
5. 最佳实践
- 复杂任务拆解:将复杂问题分解为多个步骤
- 明确指令:提供清晰的上下文和要求
- 流式输出:长推理任务建议使用流式输出
6. 注意事项
- 请确保使用正确的 API 密钥进行身份验证
- 不同模型有不同的上下文窗口限制
- 可在 模型列表 查看最新支持的模型
Last updated on