Sobre nosotros

1. Qué construimos

InOneAPI es una plataforma de agregación de APIs de modelos de IA y de enrutamiento inteligente pensada para producción. Publicamos los modelos de texto, imagen, video y audio de los principales proveedores de modelos de China detrás de una sola API compatible con los SDK de OpenAI y Anthropic, de modo que su aplicación elige un proveedor según la prioridad de negocio, en lugar de mantener una integración, una clave y un proceso de conciliación por cada uno.

Solo nos conectamos a proveedores de modelos de primer nivel en China. No añadimos canales económicos cuyo origen y calidad no podamos verificar.

InOneAPI no desarrolla modelos grandes ni es quien ejecuta la inferencia. Las solicitudes que usted envía las completa el canal del proveedor que elija o el que seleccione el enrutamiento. Las políticas de retención, las reglas de moderación de contenido y el cumplimiento regional de cada proveedor siguen sus propios términos.

2. En qué nos concentramos

Confiabilidad

Cuando es posible, el mismo modelo está disponible a través de más de un proveedor. La pasarela observa los cambios de latencia, de rendimiento y de tasa de error, ajusta las rutas entre los canales disponibles del mismo modelo y cambia de canal ante fallos, lo que reduce el impacto de depender de un solo proveedor. No hacemos una promesa incondicional de disponibilidad: el enrutamiento y el failover reducen el riesgo de interrupción y no sustituyen el manejo de reintentos y de degradación en su aplicación.

Costo

El enrutamiento por precio selecciona el proveedor disponible más económico para el mismo modelo. Cuando sus prioridades son otras, están disponibles los modos por velocidad y equilibrado. Cada solicitud se factura al precio del proveedor que realmente la atendió, a precio de proveedor y sin recargos. En la consola puede revisar el modelo, el consumo de tokens y el costo de cada solicitud.

Privacidad

El registro cero de contenido es el modo de operación estándar de la plataforma, no una opción configurable. Los prompts y las respuestas de los modelos solo se reenvían, se transmiten y se contabilizan en memoria, y nunca se escriben en una base de datos. Los metadatos de la solicitud que usamos para facturar y diagnosticar se mantienen separados del contenido y nunca incluyen el texto del prompt ni de la respuesta.

3. Capacidades de la plataforma

  • Enrutamiento inteligente: modos por precio, por velocidad y equilibrado que eligen la ruta según precio, tiempo hasta el primer token, rendimiento, tasa de error y disponibilidad.
  • Rendimiento de la pasarela: una pasarela en Rust mantiene pools de conexiones HTTP/2 con Keep-Alive persistentes hacia los proveedores aguas arriba para mejorar el tiempo hasta el primer token.
  • Trazas LLMOps integradas: X-Gateway-Trace-ID a nivel de solicitud, con tiempos, reintentos, consumo de tokens y diagnósticos de entrada y salida.
  • Control de tráfico anómalo: detección de agentes descontrolados, tormentas de reintentos y claves filtradas, con corte de circuito activo y alertas por WeChat o correo a los administradores.
  • Facturación transparente: cálculo local de tokens alineado con los algoritmos oficiales de cada proveedor, facturado por solicitud y verificable línea por línea.
  • Gobernanza para equipos: fronteras de acceso por workspace, proyecto, miembro y subclave, con límites de presupuesto y listas permitidas de modelos.
  • Playground: valide el comportamiento y los parámetros de un modelo en las páginas de Playground y de experiencia del modelo antes de escribir código de producción.

4. Cuentas y facturación

A cada cuenta se le asigna una moneda inmutable y una billetera asociada en el momento del registro: USD, que se recarga con Stripe, y cambiar el idioma de la interfaz nunca la modifica. Los precios y las facturas no se convierten a posteriori: cada modelo tiene un precio independiente en USD y en CNY.

5. A quién atendemos

  • Desarrolladores de aplicaciones de IA y de agentes que necesitan los modelos de China con una sola integración en lugar de varias.
  • Equipos de ingeniería y de plataforma que deben repartir claves y controlar presupuestos y alcance de modelos entre miembros y proyectos.
  • Empresas que necesitan registros de costos verificables y cero retención de contenido.

6. Dónde seguir

Sobre nosotros · InOneAPI