À propos de nous

1. Ce que nous construisons

InOneAPI est une plateforme d’agrégation d’API de modèles d’IA et de routage intelligent, pensée pour la production. Nous plaçons les modèles de texte, d’image, de vidéo et d’audio des principaux fournisseurs chinois derrière une seule API compatible avec les SDK d’OpenAI et d’Anthropic, afin que votre application choisisse un fournisseur selon la priorité métier, sans maintenir une intégration, une clé et un processus de rapprochement pour chacun.

Nous ne connectons que des fournisseurs de modèles de premier plan en Chine. Nous n’ajoutons pas de canaux à bas coût dont nous ne pouvons pas vérifier l’origine ni la qualité.

InOneAPI ne développe pas de grands modèles et n’est pas la partie qui assure l’inférence du modèle. Les requêtes que vous envoyez sont exécutées par le canal du fournisseur que vous choisissez ou celui que le routage retient. La politique de conservation, les règles de modération et la conformité régionale d’un fournisseur suivent ses propres conditions.

2. Ce sur quoi nous nous concentrons

Fiabilité

Lorsque c’est possible, un même modèle est disponible via plusieurs fournisseurs. La passerelle suit les évolutions de latence, de débit et de taux d’erreur, ajuste les chemins entre les canaux disponibles d’un même modèle et bascule en cas d’échec, ce qui réduit l’impact d’une dépendance à un seul fournisseur. Nous ne faisons aucune promesse de disponibilité inconditionnelle : le routage et la bascule diminuent le risque d’interruption et ne remplacent ni les tentatives ni la gestion de la dégradation dans votre application.

Coût

Le routage orienté prix sélectionne le fournisseur disponible le moins cher pour un même modèle. Les modes orienté vitesse et équilibré sont disponibles quand vos priorités diffèrent. Chaque requête est facturée au tarif du fournisseur qui l’a réellement servie, aux tarifs des fournisseurs, sans majoration. Le modèle, l’utilisation de jetons et le coût par requête sont consultables dans la console.

Confidentialité

L’absence de journalisation du contenu est le mode de fonctionnement standard de la plateforme, pas un réglage optionnel. Les prompts et les réponses des modèles sont transférés, diffusés et décomptés uniquement en mémoire, et jamais écrits en base. Les métadonnées de la requête utilisées pour la facturation et le diagnostic sont tenues à l’écart du contenu et n’incluent jamais le texte du prompt ni de la réponse.

3. Fonctionnalités de la plateforme

  • Routage intelligent : modes orienté prix, orienté vitesse et équilibré, qui choisissent les chemins d’après le prix, le délai jusqu’au premier jeton, le débit, le taux d’erreur et la disponibilité.
  • Performance de la passerelle : une passerelle en Rust conserve des pools de connexions HTTP/2 Keep-Alive persistants vers les fournisseurs amont pour améliorer le délai jusqu’au premier jeton.
  • Trace LLMOps intégré : un X-Gateway-Trace-ID par requête, avec temporisation, tentatives, utilisation de jetons et diagnostics d’entrée et de sortie.
  • Contrôle du trafic anormal : détection des agents débridés, des tempêtes de tentatives et des clés divulguées, avec coupure de circuit active et alertes WeChat ou e-mail aux administrateurs.
  • Facturation transparente : calcul local des jetons aligné sur les algorithmes officiels des fournisseurs, facturé par requête et vérifiable ligne à ligne.
  • Gouvernance d’équipe : périmètres d’accès par espace de travail, projet, membre et sous-clé, avec plafonds de budget et listes de modèles autorisés.
  • Playground : validez le comportement et les paramètres des modèles dans les pages playground et expérience avant d’écrire le code de production.

4. Comptes et facturation

Chaque compte se voit attribuer à l’inscription une devise immuable et le portefeuille associé — USD, rechargé via Stripe — ; changer la langue de l’interface ne le modifie jamais. Les tarifs et les factures ne sont pas convertis après coup : chaque modèle porte un tarif USD et un tarif CNY indépendants.

5. À qui nous nous adressons

  • Aux développeurs d’applications et d’agents IA qui ont besoin des modèles de Chine via une seule intégration plutôt que plusieurs.
  • Aux équipes d’ingénierie et de plateforme qui doivent distribuer les clés et piloter budgets et périmètre de modèles selon les membres et les projets.
  • Aux entreprises qui ont besoin d’enregistrements de coûts vérifiables et d’aucune conservation de contenu.

6. Où aller ensuite

À propos de nous · InOneAPI