Gateway de enrutamiento inteligente para los principales proveedores de China

Una sola API para los principales modelos de China
Principales proveedores. Acceso fiable. Sin recargos.

Nuestro propio gateway mantiene activas las conexiones con el upstream para reducir el tiempo hasta el primer token y luego enruta cada solicitud entre los proveedores del mismo modelo según precio, latencia, capacidad de tráfico y disponibilidad, con conmutación por fallo automática. Cada llamada va a un endpoint de un proveedor oficial y se factura a sus precios.

Alibaba Cloud
Tencent Cloud
Volcengine
Baidu AI Cloud
Zhipu AI
Moonshot AI
MiniMax
DeepSeek
Endpoints oficiales · Pago por uso · Cero registro de contenidos
MENÚResumenClaves de APIModelos y preciosPlayground en líneaRegistros de solicitudesCentro de recarga
☰⌕   Busca funciones o documentación◐ ♢ FC
Saldo de la cuenta$1,284.60↑ 18.2%
Solicitudes428,590↑ 12.8%
Estado del servicioTodos los sistemas operativos
99.72%
Tendencia de uso
☰•••
Saldo de la cuenta$1,284.60↑ 18.2%
Solicitudes428,590↑ 12.8%

Una sola clave de API, enrutada entre los principales proveedores de modelos de China

AlibabaCloudAlibaba CloudTencentCloudTencent CloudVolcengineVolcengineBaiduCloudBaidu AI Cloud
Por qué producción necesita más de un proveedor

Las cargas de trabajo en producción no deberían depender de un único punto de fallo

Las variaciones de un proveedor no deberían convertirse en interrupciones del negocio. Entre la disponibilidad, la elección de modelo y los precios que cambian, una aplicación de producción necesita una ruta alternativa que pueda tomar en cualquier momento, no un proveedor del que siempre depende.

Una caída puede afectar tu producto

Incluso los proveedores consolidados sufren caídas, límites de uso y lentitud. Sin una ruta alternativa, un problema upstream puede dejar funciones del producto fuera de servicio.

Cada modelo nuevo implica una integración nueva

Los proveedores difieren en la forma del endpoint, las claves, las cuentas y la semántica de facturación. Cambiar de modelo o de proveedor puede significar reconstruir a la vez la integración y la conciliación.

Una ruta fija puede costar más

El precio del mismo modelo varía entre proveedores y cambia con el tiempo. Quedarse con un solo proveedor puede significar perder un mejor precio en otro lado.

El enfoque de InOneAPI

Principales proveedores. Un solo punto de entrada inteligente.

InOneAPI es un gateway de modelos construido a medida, no una dirección de reenvío: un solo protocolo y una sola superficie de autenticación, selección de rutas en vivo según tus prioridades, trazado a nivel de solicitud y medición de tokens, y corte de circuito ante fallos, todo facturado a los precios oficiales de los proveedores.

La conmutación automática por fallo reduce las interrupciones

El enrutamiento reacciona a la latencia, la capacidad de tráfico y las tasas de error, y se mueve entre los proveedores disponibles del mismo modelo. Los proveedores que fallan de forma repetida se retiran y se sondean hasta que se recuperan.

Modelos insignia, comprobados uno por uno

Solo conectamos los modelos insignia de cada principal proveedor y comprobamos la compatibilidad de protocolo y la semántica de facturación antes de activarlos, en texto, imagen, vídeo y audio.

El menor precio disponible, de forma automática

El enrutamiento por precio elige el proveedor disponible con el precio más bajo para el mismo modelo. Elige el enrutamiento por velocidad o el equilibrado según tus prioridades de negocio.

Capacidades principales

Construido para el acceso a modelos en producción

Desde la cobertura de modelos y la conmutación por fallo hasta el control de costes: lleva fiabilidad, transparencia y privacidad del contenido a cada solicitud.

Modelos insignia, una sola integración

Accede a los modelos insignia de los principales proveedores de China en texto, imagen, vídeo y audio mediante una sola API. Elige según el caso de uso, no según quién tenga el catálogo más largo.

Enrutamiento según tus reglas

Da prioridad al precio, a la velocidad de respuesta o a un balance de ambos. Las rutas se adaptan a medida que cambian las condiciones de los proveedores.

Endpoints oficiales, costes desglosados

Las solicitudes van a endpoints oficiales de los proveedores y se facturan a sus precios, sin recargos. Los tokens se miden localmente con el algoritmo de cada proveedor, así que cada línea se puede conciliar.

Resiliencia entre proveedores

Usa varios proveedores para el mismo modelo. El enrutamiento dinámico y la conmutación automática por fallo reducen el impacto de la lentitud y los errores upstream.

Acceso por equipo y presupuestos

Administra espacios de trabajo, proyectos y subclaves con límites de presupuesto, restricciones de modelos y límites de tasa.

Cero registro de contenidos

El cero registro de contenidos es el modo estándar de toda la plataforma. Los prompts y las respuestas se transmiten y se miden en memoria, sin guardar su contenido ni exigir una configuración opt-in.

Gateway propio, primer token más rápido

Enrutamiento por precio, por velocidad y equilibrado

Protocolos nativos de OpenAI y Anthropic

Diagnóstico de trazas a nivel de solicitud

Corte de circuito con sondas de recuperación

Alertas de tasa de error y de presupuesto

Límites de RPM, TPM y concurrencia

Configuración del agente con un clic

Soporte humano 24/7

Cómo funciona

Qué hace el gateway con cada solicitud

Enrutamiento inteligente

Define el objetivo. Deja que el enrutamiento se adapte.

Los precios y el rendimiento cambian, así que las rutas también deberían hacerlo. Elige el enrutamiento por precio, por velocidad o equilibrado, y el gateway selecciona entre los proveedores del mismo modelo según precio, latencia del primer token, capacidad de tráfico y disponibilidad.

El precio por delante encuentra la ruta más económica

Selecciona el proveedor disponible con el precio más bajo para el mismo modelo a los precios actuales. El enrutamiento se ajusta cuando cambian los precios y te evita comparaciones y cambios manuales.

Reacciona a los cambios de rendimiento

El enrutamiento usa latencia, capacidad de tráfico y tasas de error para mover el tráfico cuando baja el rendimiento, y retira los proveedores que fallan de forma repetida hasta que una sonda los recupera.

Precios y transparencia

Enrutamiento inteligente sin recargo

Elige con flexibilidad entre los principales proveedores pagando sus precios oficiales. Los tokens se miden localmente con el algoritmo de cada proveedor y se registran el proveedor elegido, el uso y el coste de cada solicitud, de modo que una factura puede revisarse línea por línea contra el precio del proveedor.

Trazabilidad a nivel de solicitud

Usa X-Gateway-Trace-ID para revisar los tiempos, los reintentos y el uso a lo largo de la ruta de la solicitud.

Costes desglosados

Comprueba cada solicitud contra el precio del proveedor seleccionado y el uso registrado.

Soporte para producción

Soporte para producción. El contenido sigue siendo privado.

El enrutamiento con varios proveedores reduce la dependencia de uno solo, mientras que los espacios de trabajo, los proyectos y las subclaves definen los límites de acceso y los presupuestos. El cero registro de contenidos es el modo estándar: mide y depura llamadas sin guardar prompts ni respuestas.

Los incidentes se muestran y se detienen

Las anomalías de tasa de error y de presupuesto generan eventos de alerta, y los proveedores que fallan de forma persistente se retiran del enrutamiento en lugar de seguir recibiendo tráfico real.

El cero registro de contenidos es el modo estándar

No hay ninguna opción de privacidad que activar. El contenido se procesa solo en memoria. Los metadatos de la solicitud, como el uso, el coste y los tiempos, sirven para facturar y diagnosticar sin los cuerpos de los prompts o las respuestas.

Integración rápida

Cambia un baseURL y llega a los principales modelos de China

Las solicitudes de texto son nativamente compatibles con OpenAI Chat Completions, OpenAI Responses y Anthropic Messages. Imagen y audio reutilizan la forma de los endpoints de OpenAI, y el vídeo pasa por endpoints unificados. Cambia el baseURL y la clave de API y sigue funcionando.

Ver la guía de integración
quickstartEjemplos de código
# -H "X-APP-NAME: Your App Name"
# -H "X-APP-URL: https://your-app.example.com"
curl "https://api.inoneapi.com/v1/chat/completions" \
  -H "Authorization: Bearer $INONEAPI_API_KEY" \
  -H "Content-Type: application/json" \
  --data '{
  "model": "YOUR_MODEL_ID",
  "messages": [
    {
      "role": "user",
      "content": "Hello"
    }
  ]
}'

Dale a cada llamada de modelo una segunda ruta

Regístrate, crea una clave de API y cambia un solo baseURL para empezar. Paga por uso, con los precios oficiales de los proveedores que puedes conciliar línea por línea y sin guardar ningún contenido.

Crear cuenta gratis
InOneAPI · Gateway de enrutamiento inteligente para los principales modelos de China, a precio de proveedor