Skip to Content
Wiki接口功能推理

推理模型 - MyTokenGate

1. 概述

推理模型是基于深度学习的 AI 系统,通过逻辑推演、知识关联和上下文分析解决复杂任务,典型应用包括数学解题、代码生成、逻辑判断和多步推理场景。

2. 当前支持

目前 MyTokenGate 提供的模型均具备强大的推理能力,可用于复杂任务:

Claude 系列

  • claude-fable-5 - 前沿最强,常开自适应思考
  • claude-sonnet-5 - 均衡默认,高吞吐
  • claude-opus-4-8 - 上代前沿,长程推理

GPT 系列

  • gpt-5.6-sol - 旗舰推理
  • gpt-5.4 - 日常主力推理
  • gpt-5.5 - 上代旗舰

Gemini 系列

  • gemini-3.1-pro-preview - 复杂多模态推理

开源推理系(OpenAI 兼容 reasoning_content

  • glm-5.1 / glm-5.2 - GLM 推理模型
  • deepseek-v4-pro - 深度推理旗舰(即将上线)

3. 使用示例

from openai import OpenAI client = OpenAI( base_url='https://gateway.mytokengate.com/v1', api_key='your-api-key' ) response = client.chat.completions.create( model="claude-sonnet-5", messages=[ {"role": "user", "content": "请逐步分析:如果所有 A 都是 B,所有 B 都是 C,那么所有 A 都是 C 吗?"} ], max_tokens=4096, stream=True ) for chunk in response: if chunk.choices[0].delta.content: print(chunk.choices[0].delta.content, end="", flush=True)

4. 推理控制(努力度与思考预算)

不同厂商用不同参数控制”思考”的深度,命名与取值各异:

  • GPT-5 系列 —— reasoning.effort,取值 minimal/low/medium(默认)/high,较新的模型另有 none/xhigh/maxminimal 近零思考、延迟最低。思考 token 计入输出计费。
  • Claude 扩展思考 —— thinking.type="enabled" + budget_tokens(思考预算 token 数);在 Claude 4.6 上该显式模式已标记弃用但仍可用,前沿模型默认自适应思考。
  • Gemini —— thinkingConfigthinkingBudget(0 关 / -1 动态)与较新的 thinkingLevel;Gemini 3 Pro 无法完全关闭思考。
  • 开源推理系(GLM / DeepSeek) —— 走 OpenAI 兼容接口,思考内容在 reasoning_content 字段返回,工具调用场景需原样保留回放,详见 交错思考

MyTokenGate 通过统一网关透传上述参数,具体取值以各模型页与上游文档为准。

5. 最佳实践

  • 复杂任务拆解:将复杂问题分解为多个步骤
  • 明确指令:提供清晰的上下文和要求
  • 流式输出:长推理任务建议使用流式输出

6. 注意事项

  • 请确保使用正确的 API 密钥进行身份验证
  • 不同模型有不同的上下文窗口限制
  • 可在 模型列表 查看最新支持的模型
Last updated on