Sobre nós

1. O que construímos

A InOneAPI é uma plataforma de agregação de APIs de modelos de IA e encaminhamento inteligente voltada para produção. Colocamos os modelos de texto, imagem, vídeo e áudio dos principais fornecedores da China atrás de uma única API compatível com os SDKs da OpenAI e da Anthropic, para que sua aplicação escolha o fornecedor pela prioridade do negócio, e não mantendo uma integração, uma chave e um processo de conciliação para cada um.

Conectamos apenas fornecedores de modelos de primeira linha da China. Não adicionamos canais de baixo custo cuja origem e qualidade não possamos verificar.

A InOneAPI não desenvolve grandes modelos e não é a parte que executa a inferência do modelo. Os pedidos que você envia são concluídas pelo canal do fornecedor que você escolhe ou pelo que o encaminhamento seleciona. A política de retenção, as regras de revisão de conteúdo e a conformidade regional de um fornecedor seguem os termos dele.

2. Onde focamos

Confiabilidade

Sempre que possível, o mesmo modelo está disponível por mais de um fornecedor. O gateway acompanha variações de latência, caudal e taxa de erros, ajusta os caminhos entre os canais disponíveis do mesmo modelo e alterna em caso de falha, o que reduz o impacto de depender de um único fornecedor. Não fazemos promessa incondicional de disponibilidade: encaminhamento e failover reduzem o risco de interrupção e não substituem o tratamento de novas tentativas e de degradação na sua aplicação.

Custo

O encaminhamento por preço escolhe o fornecedor disponível mais barato para o mesmo modelo. Os modos por velocidade e equilibrado estão disponíveis quando suas prioridades são outras. Cada pedido é cobrado ao preço do fornecedor que efetivamente o atendeu, aos preços dos fornecedores e sem acréscimo. Modelo, uso de tokens e custo por pedido podem ser conferidos na consola.

Privacidade

O registo zero de conteúdo é o modo operacional padrão da plataforma, não uma configuração opcional. Prompts e respostas dos modelos são encaminhados, transmitidos e contados apenas em memória, e nunca gravados em base de dados. Os metadados do pedido usados para cobrança e diagnóstico ficam separados do conteúdo e nunca incluem o texto do prompt ou da resposta.

3. Recursos da plataforma

  • Encaminhamento inteligente: modos por preço, por velocidade e equilibrado, que escolhem caminhos usando preço, tempo até o primeiro token, caudal, taxa de erros e disponibilidade.
  • Desempenho do gateway: um gateway em Rust mantém pools de ligações HTTP/2 Keep-Alive persistentes com os fornecedores upstream para melhorar o tempo até o primeiro token.
  • Trace LLMOps integrado: X-Gateway-Trace-ID por pedido, com tempos, tentativas, uso de tokens e diagnóstico de entrada e saída.
  • Controle de tráfego anormal: detecção de agentes fora de controle, tempestades de tentativas e chaves vazadas, com circuit breaking ativo e alertas por WeChat ou e-mail para os administradores.
  • Cobrança transparente: cálculo local de tokens alinhado aos algoritmos oficiais dos fornecedores, cobrado por pedido e verificável linha a linha.
  • Governança em equipa: fronteiras de acesso por workspace, projeto, membro e subchave, com limites de orçamento e listas de modelos permitidos.
  • Playground: valide o comportamento e os parâmetros dos modelos nas páginas de playground e de experiência antes de escrever código de produção.

4. Contas e cobrança

Cada conta recebe, no cadastro, uma moeda imutável e a carteira correspondente — USD, recarregável por Stripe — e mudar o idioma da interface nunca a altera. Preços e faturas não são convertidos depois: cada modelo tem um preço independente em USD e em CNY.

5. Para quem atendemos

  • Desenvolvedores de aplicações e agentes de IA que precisam dos modelos da China com uma única integração, e não com várias.
  • Equipas de engenharia e de plataforma que precisam distribuir chaves e controlar orçamentos e âmbito de modelos entre membros e projetos.
  • Empresas que precisam de registos de custo verificáveis e de nenhuma retenção de conteúdo.

6. Próximos passos

Sobre nós · InOneAPI