1. O que construímos
A InOneAPI é uma plataforma de agregação de APIs de modelos de IA e roteamento inteligente voltada para produção. Colocamos os modelos de texto, imagem, vídeo e áudio dos principais provedores da China atrás de uma única API compatível com os SDKs da OpenAI e da Anthropic, para que sua aplicação escolha o provedor pela prioridade do negócio, e não mantendo uma integração, uma chave e um processo de conciliação para cada um.
Conectamos apenas provedores de modelos de primeira linha da China. Não adicionamos canais de baixo custo cuja origem e qualidade não possamos verificar.
A InOneAPI não desenvolve grandes modelos e não é a parte que executa a inferência do modelo. As solicitações que você envia são concluídas pelo canal do provedor que você escolhe ou pelo que o roteamento seleciona. A política de retenção, as regras de revisão de conteúdo e a conformidade regional de um provedor seguem os termos dele.
2. Onde focamos
Confiabilidade
Sempre que possível, o mesmo modelo está disponível por mais de um provedor. O gateway acompanha variações de latência, vazão e taxa de erros, ajusta os caminhos entre os canais disponíveis do mesmo modelo e alterna em caso de falha, o que reduz o impacto de depender de um único provedor. Não fazemos promessa incondicional de disponibilidade: roteamento e failover reduzem o risco de interrupção e não substituem o tratamento de novas tentativas e de degradação na sua aplicação.
Custo
O roteamento por preço escolhe o provedor disponível mais barato para o mesmo modelo. Os modos por velocidade e equilibrado estão disponíveis quando suas prioridades são outras. Cada solicitação é cobrada ao preço do provedor que efetivamente a atendeu, aos preços dos provedores e sem acréscimo. Modelo, uso de tokens e custo por solicitação podem ser conferidos no console.
Privacidade
O registro zero de conteúdo é o modo operacional padrão da plataforma, não uma configuração opcional. Prompts e respostas dos modelos são encaminhados, transmitidos e contados apenas em memória, e nunca gravados em banco de dados. Os metadados da solicitação usados para cobrança e diagnóstico ficam separados do conteúdo e nunca incluem o texto do prompt ou da resposta.
3. Recursos da plataforma
- Roteamento inteligente: modos por preço, por velocidade e equilibrado, que escolhem caminhos usando preço, tempo até o primeiro token, vazão, taxa de erros e disponibilidade.
- Desempenho do gateway: um gateway em Rust mantém pools de conexões HTTP/2 Keep-Alive persistentes com os provedores upstream para melhorar o tempo até o primeiro token.
- Trace LLMOps integrado:
X-Gateway-Trace-IDpor solicitação, com tempos, tentativas, uso de tokens e diagnóstico de entrada e saída. - Controle de tráfego anormal: detecção de agentes fora de controle, tempestades de tentativas e chaves vazadas, com circuit breaking ativo e alertas por WeChat ou e-mail para os administradores.
- Cobrança transparente: cálculo local de tokens alinhado aos algoritmos oficiais dos provedores, cobrado por solicitação e verificável linha a linha.
- Governança em equipe: fronteiras de acesso por workspace, projeto, membro e subchave, com limites de orçamento e listas de modelos permitidos.
- Playground: valide o comportamento e os parâmetros dos modelos nas páginas de playground e de experiência antes de escrever código de produção.
4. Contas e cobrança
Cada conta recebe, no cadastro, uma moeda imutável e a carteira correspondente — USD, recarregável por Stripe — e mudar o idioma da interface nunca a altera. Preços e faturas não são convertidos depois: cada modelo tem um preço independente em USD e em CNY.
5. Para quem atendemos
- Desenvolvedores de aplicações e agentes de IA que precisam dos modelos da China com uma única integração, e não com várias.
- Equipes de engenharia e de plataforma que precisam distribuir chaves e controlar orçamentos e escopo de modelos entre membros e projetos.
- Empresas que precisam de registros de custo verificáveis e de nenhuma retenção de conteúdo.
6. Próximos passos
- Os detalhes de integração estão nos guias de integração, na referência da API e nos guias da plataforma.
- Consulte a Política de privacidade para saber como tratamos informações pessoais e os Termos de serviço para ver o acordo entre as partes.
- Para dúvidas técnicas, de cobrança ou comerciais, veja a página Fale conosco.