Bu sayfa şimdilik yalnızca Çince. Gezinme ve menüler zaten Türkçe.

模型与服务商

在 InOneAPI 中,模型代表你要调用的 AI 能力,服务商代表实际提供该模型推理服务的平台。你只需在请求中使用模型 ID,InOneAPI 会在支持该模型的可用服务商之间完成路由。

模型是什么

模型决定一次调用能做什么,例如文本对话、代码生成、图片生成、语音合成或视频生成。不同模型还会在以下方面存在差异:

  • 输入与输出模态;
  • 上下文长度和最大输出长度;
  • 工具调用、结构化输出和流式响应等能力;
  • 速度、价格和适用场景。

模型列表和详情页会展示当前可用能力、价格及服务商信息。接入前应根据业务需要选择模型,不要只凭名称判断模型是否支持某项功能。

服务商是什么

服务商负责运行模型并实际处理请求。同一个模型可能由多家经过筛选的服务商提供。它们提供的是同一个模型,但在实时容量、响应速度、价格以及数据处理政策等方面可能存在差异。

多服务商并不意味着一次请求会同时发送给多家。智能路由会从当前可用的服务商中选择一家处理请求,并根据运行状态持续调整后续流量。这样可以降低单一服务商异常造成的中断风险,但不能承诺服务永不中断。

模型 ID 保持不变

请求使用平台展示的模型 ID,原样复制。YOUR_MODEL_ID 只是文档占位符。服务商发生切换时,模型 ID 和 API 调用方式通常不需要改变。

智能路由只在同一个模型的可用服务商之间选择。价格优先模式选择的是同一模型下价格更低的可用服务商,不会把你的请求静默替换成另一个更便宜的模型。

如何选择模型

选择模型时,建议按以下顺序确认:

  1. 输入和输出模态是否符合业务需求。
  2. 上下文长度、工具调用、流式响应等能力是否满足请求。
  3. 价格和预期用量是否符合预算。
  4. 当前可用服务商数量、响应性能和数据政策是否符合生产要求。
  5. 先在体验区或测试项目中验证真实请求,再投入生产。

模型名称相近不代表能力、上下文或价格相同。应用应显式指定需要的模型 ID,并正确处理超时、429、5xx 和流式中断。

价格与请求记录

模型详情页展示可用服务商及对应价格。请求完成后,用量记录会显示实际使用的模型、服务商、Token、费用、延迟、重试和 X-Gateway-Trace-ID 等元数据,便于核对计费和排查问题。

InOneAPI 不持久化保存提示词和回复内容。请求仍需发送给实际处理它的服务商,因此敏感业务还应结合模型详情和服务商条款评估数据处理要求。

下一步阅读智能路由和可靠性与故障转移。

Modeller ve hizmet sağlayıcılar · Belgeler · InOneAPI