Chi siamo

1. Cosa costruiamo

InOneAPI è una piattaforma di aggregazione di API di modelli di IA e di instradamento intelligente pensata per la produzione. Mettiamo i modelli di testo, immagine, video e audio dei principali provider cinesi dietro un'unica API compatibile con gli SDK di OpenAI e Anthropic, così la tua applicazione sceglie il provider in base alla priorità di business invece di mantenere un'integrazione, una chiave e un processo di riconciliazione per ciascuno.

Ci colleghiamo solo ai provider di modelli di prima fascia cinesi. Non aggiungiamo canali a basso costo di cui non possiamo verificare provenienza e qualità.

InOneAPI non sviluppa grandi modelli e non è la parte che eroga l'inferenza del modello. Le richieste che invii sono completate dal canale del provider che scegli tu o da quello selezionato dall'instradamento. Le politiche di conservazione, le regole di revisione dei contenuti e la conformità regionale di un provider seguono i suoi termini.

2. Su cosa ci concentriamo

Affidabilità

Quando è possibile, lo stesso modello è disponibile tramite più di un provider. Il gateway osserva le variazioni di latenza, produttività e tasso di errore, aggiusta i percorsi tra i canali disponibili dello stesso modello e passa a un altro in caso di guasto, riducendo l'impatto della dipendenza da un singolo provider. Non facciamo alcuna promessa incondizionata di disponibilità: instradamento e failover riducono il rischio di interruzione e non sostituiscono la gestione di retry e degradazione nella tua applicazione.

Costi

L'instradamento a priorità di prezzo seleziona il provider disponibile dal prezzo più basso per lo stesso modello. Le modalità a priorità di velocità ed equilibrata sono disponibili quando le tue priorità sono diverse. Ogni richiesta è fatturata al prezzo del provider che l'ha effettivamente servita, ai prezzi dei provider e senza maggiorazioni. Modello, utilizzo di token e costo per richiesta sono consultabili nella console.

Privacy

La zero registrazione dei contenuti è la modalità operativa standard della piattaforma, non un'impostazione opzionale. Prompt e risposte dei modelli vengono inoltrati, trasmessi e contati solo in memoria, e non vengono mai scritti in un database. I metadati delle richieste usati per la fatturazione e la diagnostica restano separati dal contenuto e non includono mai il testo del prompt o della risposta.

3. Funzionalità della piattaforma

  • Instradamento intelligente: modalità a priorità di prezzo, di velocità ed equilibrata, che scelgono i percorsi in base a prezzo, tempo al primo token, produttività, tasso di errore e disponibilità.
  • Prestazioni del gateway: un gateway in Rust mantiene pool di connessioni HTTP/2 Keep-Alive persistenti verso i provider upstream per migliorare il tempo al primo token.
  • Trace LLMOps integrato: X-Gateway-Trace-ID a livello di richiesta, con tempi, retry, utilizzo di token e diagnostica di input e output.
  • Controllo del traffico anomalo: rilevamento di agent fuori controllo, retry storm e chiavi divulgate, con circuit breaking attivo e avvisi WeChat o email agli amministratori.
  • Fatturazione trasparente: calcolo dei token eseguito localmente in linea con gli algoritmi ufficiali dei provider, fatturato per richiesta e verificabile riga per riga.
  • Governance del team: confini di accesso per workspace, progetto, membro e sottochiave, con limiti di budget e elenchi di modelli consentiti.
  • Playground: verifica il comportamento dei modelli e i parametri nel Playground e nelle pagine di prova del modello prima di scrivere codice di produzione.

4. Account e fatturazione

A ogni account viene assegnata una valuta immutabile e un portafoglio corrispondente al momento della registrazione — USD, ricaricabile con Stripe — e cambiare la lingua dell'interfaccia non la modifica mai. Prezzi e fatture non vengono convertiti a posteriori: ogni modello ha un prezzo USD e un prezzo CNY indipendenti.

5. A chi serviamo

  • Sviluppatori di applicazioni e di agent IA che hanno bisogno dei modelli cinesi con un'unica integrazione invece di diverse.
  • Team di ingegneria e di piattaforma che devono distribuire chiavi e controllare budget e ambito di modelli tra membri e progetti.
  • Aziende che hanno bisogno di registri dei costi verificabili e di nessuna conservazione dei contenuti.

6. Prossimi passi

Chi siamo · InOneAPI