1. O que construímos
A InOneAPI é uma plataforma de agregação de APIs de modelos de IA e encaminhamento inteligente voltada para produção. Colocamos os modelos de texto, imagem, vídeo e áudio dos principais fornecedores da China atrás de uma única API compatível com os SDKs da OpenAI e da Anthropic, para que sua aplicação escolha o fornecedor pela prioridade do negócio, e não mantendo uma integração, uma chave e um processo de conciliação para cada um.
Conectamos apenas fornecedores de modelos de primeira linha da China. Não adicionamos canais de baixo custo cuja origem e qualidade não possamos verificar.
A InOneAPI não desenvolve grandes modelos e não é a parte que executa a inferência do modelo. Os pedidos que você envia são concluídas pelo canal do fornecedor que você escolhe ou pelo que o encaminhamento seleciona. A política de retenção, as regras de revisão de conteúdo e a conformidade regional de um fornecedor seguem os termos dele.
2. Onde focamos
Confiabilidade
Sempre que possível, o mesmo modelo está disponível por mais de um fornecedor. O gateway acompanha variações de latência, caudal e taxa de erros, ajusta os caminhos entre os canais disponíveis do mesmo modelo e alterna em caso de falha, o que reduz o impacto de depender de um único fornecedor. Não fazemos promessa incondicional de disponibilidade: encaminhamento e failover reduzem o risco de interrupção e não substituem o tratamento de novas tentativas e de degradação na sua aplicação.
Custo
O encaminhamento por preço escolhe o fornecedor disponível mais barato para o mesmo modelo. Os modos por velocidade e equilibrado estão disponíveis quando suas prioridades são outras. Cada pedido é cobrado ao preço do fornecedor que efetivamente o atendeu, aos preços dos fornecedores e sem acréscimo. Modelo, uso de tokens e custo por pedido podem ser conferidos na consola.
Privacidade
O registo zero de conteúdo é o modo operacional padrão da plataforma, não uma configuração opcional. Prompts e respostas dos modelos são encaminhados, transmitidos e contados apenas em memória, e nunca gravados em base de dados. Os metadados do pedido usados para cobrança e diagnóstico ficam separados do conteúdo e nunca incluem o texto do prompt ou da resposta.
3. Recursos da plataforma
- Encaminhamento inteligente: modos por preço, por velocidade e equilibrado, que escolhem caminhos usando preço, tempo até o primeiro token, caudal, taxa de erros e disponibilidade.
- Desempenho do gateway: um gateway em Rust mantém pools de ligações HTTP/2 Keep-Alive persistentes com os fornecedores upstream para melhorar o tempo até o primeiro token.
- Trace LLMOps integrado:
X-Gateway-Trace-IDpor pedido, com tempos, tentativas, uso de tokens e diagnóstico de entrada e saída. - Controle de tráfego anormal: detecção de agentes fora de controle, tempestades de tentativas e chaves vazadas, com circuit breaking ativo e alertas por WeChat ou e-mail para os administradores.
- Cobrança transparente: cálculo local de tokens alinhado aos algoritmos oficiais dos fornecedores, cobrado por pedido e verificável linha a linha.
- Governança em equipa: fronteiras de acesso por workspace, projeto, membro e subchave, com limites de orçamento e listas de modelos permitidos.
- Playground: valide o comportamento e os parâmetros dos modelos nas páginas de playground e de experiência antes de escrever código de produção.
4. Contas e cobrança
Cada conta recebe, no cadastro, uma moeda imutável e a carteira correspondente — USD, recarregável por Stripe — e mudar o idioma da interface nunca a altera. Preços e faturas não são convertidos depois: cada modelo tem um preço independente em USD e em CNY.
5. Para quem atendemos
- Desenvolvedores de aplicações e agentes de IA que precisam dos modelos da China com uma única integração, e não com várias.
- Equipas de engenharia e de plataforma que precisam distribuir chaves e controlar orçamentos e âmbito de modelos entre membros e projetos.
- Empresas que precisam de registos de custo verificáveis e de nenhuma retenção de conteúdo.
6. Próximos passos
- Os detalhes de integração estão nos guias de integração, na referência da API e nos guias da plataforma.
- Consulte a Política de privacidade para saber como tratamos informações pessoais e os Termos de serviço para ver o acordo entre as partes.
- Para dúvidas técnicas, de cobrança ou comerciais, veja a página Fale connosco.