1. Cosa costruiamo
InOneAPI è una piattaforma di aggregazione di API di modelli di IA e di instradamento intelligente pensata per la produzione. Mettiamo i modelli di testo, immagine, video e audio dei principali provider cinesi dietro un'unica API compatibile con gli SDK di OpenAI e Anthropic, così la tua applicazione sceglie il provider in base alla priorità di business invece di mantenere un'integrazione, una chiave e un processo di riconciliazione per ciascuno.
Ci colleghiamo solo ai provider di modelli di prima fascia cinesi. Non aggiungiamo canali a basso costo di cui non possiamo verificare provenienza e qualità.
InOneAPI non sviluppa grandi modelli e non è la parte che eroga l'inferenza del modello. Le richieste che invii sono completate dal canale del provider che scegli tu o da quello selezionato dall'instradamento. Le politiche di conservazione, le regole di revisione dei contenuti e la conformità regionale di un provider seguono i suoi termini.
2. Su cosa ci concentriamo
Affidabilità
Quando è possibile, lo stesso modello è disponibile tramite più di un provider. Il gateway osserva le variazioni di latenza, produttività e tasso di errore, aggiusta i percorsi tra i canali disponibili dello stesso modello e passa a un altro in caso di guasto, riducendo l'impatto della dipendenza da un singolo provider. Non facciamo alcuna promessa incondizionata di disponibilità: instradamento e failover riducono il rischio di interruzione e non sostituiscono la gestione di retry e degradazione nella tua applicazione.
Costi
L'instradamento a priorità di prezzo seleziona il provider disponibile dal prezzo più basso per lo stesso modello. Le modalità a priorità di velocità ed equilibrata sono disponibili quando le tue priorità sono diverse. Ogni richiesta è fatturata al prezzo del provider che l'ha effettivamente servita, ai prezzi dei provider e senza maggiorazioni. Modello, utilizzo di token e costo per richiesta sono consultabili nella console.
Privacy
La zero registrazione dei contenuti è la modalità operativa standard della piattaforma, non un'impostazione opzionale. Prompt e risposte dei modelli vengono inoltrati, trasmessi e contati solo in memoria, e non vengono mai scritti in un database. I metadati delle richieste usati per la fatturazione e la diagnostica restano separati dal contenuto e non includono mai il testo del prompt o della risposta.
3. Funzionalità della piattaforma
- Instradamento intelligente: modalità a priorità di prezzo, di velocità ed equilibrata, che scelgono i percorsi in base a prezzo, tempo al primo token, produttività, tasso di errore e disponibilità.
- Prestazioni del gateway: un gateway in Rust mantiene pool di connessioni HTTP/2 Keep-Alive persistenti verso i provider upstream per migliorare il tempo al primo token.
- Trace LLMOps integrato:
X-Gateway-Trace-IDa livello di richiesta, con tempi, retry, utilizzo di token e diagnostica di input e output. - Controllo del traffico anomalo: rilevamento di agent fuori controllo, retry storm e chiavi divulgate, con circuit breaking attivo e avvisi WeChat o email agli amministratori.
- Fatturazione trasparente: calcolo dei token eseguito localmente in linea con gli algoritmi ufficiali dei provider, fatturato per richiesta e verificabile riga per riga.
- Governance del team: confini di accesso per workspace, progetto, membro e sottochiave, con limiti di budget e elenchi di modelli consentiti.
- Playground: verifica il comportamento dei modelli e i parametri nel Playground e nelle pagine di prova del modello prima di scrivere codice di produzione.
4. Account e fatturazione
A ogni account viene assegnata una valuta immutabile e un portafoglio corrispondente al momento della registrazione — USD, ricaricabile con Stripe — e cambiare la lingua dell'interfaccia non la modifica mai. Prezzi e fatture non vengono convertiti a posteriori: ogni modello ha un prezzo USD e un prezzo CNY indipendenti.
5. A chi serviamo
- Sviluppatori di applicazioni e di agent IA che hanno bisogno dei modelli cinesi con un'unica integrazione invece di diverse.
- Team di ingegneria e di piattaforma che devono distribuire chiavi e controllare budget e ambito di modelli tra membri e progetti.
- Aziende che hanno bisogno di registri dei costi verificabili e di nessuna conservazione dei contenuti.
6. Prossimi passi
- I dettagli di integrazione sono nelle guide di integrazione, nel riferimento API e nelle guide della piattaforma.
- Consulta l'Informativa sulla privacy per come trattiamo le informazioni personali e i Termini di servizio per l'accordo tra le parti.
- Per domande tecniche, di fatturazione o commerciali, vedi la pagina Contattaci.