1. 우리가 만드는 것
InOneAPI는 운영 환경 중심의 AI 모델 API 통합·스마트 라우팅 플랫폼입니다. 중국 상위 모델 공급사의 텍스트·이미지·비디오·오디오 모델을 OpenAI 및 Anthropic SDK와 호환되는 단일 API로 제공하여, 애플리케이션이 공급사별로 연동·키·정산 절차를 유지하는 대신 업무상 우선순위로 공급사를 고를 수 있습니다.
당사는 중국 최고 수준의 모델 공급사만 연결합니다. 출처와 품질을 검증할 수 없는 저가 채널은 추가하지 않습니다.
InOneAPI는 대규모 모델을 개발하지 않으며, 모델 추론을 실제로 제공하는 주체도 아닙니다. 귀하가 보낸 요청은 귀하가 고른 공급사 채널이나 라우팅이 선택한 채널에서 처리됩니다. 공급사의 보관 정책, 콘텐츠 심사 규칙, 지역별 준수는 각자의 약관을 따릅니다.
2. 우리가 집중하는 것
신뢰성
가능한 한, 동일한 모델을 여러 공급사를 통해 사용할 수 있도록 합니다. 게이트웨이는 지연 시간, 처리량, 오류율의 변화를 추적하고, 동일 모델의 사용 가능 채널 간 경로를 조정하며, 장애 시 전환하므로 단일 공급사 의존으로 인한 영향을 줄입니다. 당사는 무조건적인 가용성을 약속하지는 않습니다. 라우팅과 페일오버는 중단 위험을 줄일 뿐, 귀하의 애플리케이션에서 처리해야 할 재시도와 장애 대응을 대체하지 않습니다.
비용
가격 우선 라우팅은 동일한 모델에 대해 가장 저렴하게 사용 가능한 공급사를 선택합니다. 다른 우선순위가 있다면 속도 우선 또는 균형 모드를 사용할 수 있습니다. 각 요청은 실제로 서비스를 제공한 공급사의 가격으로 과금되며, 공급사 가격에 마크업을 더하지 않습니다. 모델, 토큰 사용량, 요청당 비용은 콘솔에서 확인할 수 있습니다.
프라이버시
제로 콘텐츠 로깅은 선택 설정이 아니라 플랫폼의 표준 운영 방식입니다. 프롬프트와 모델 응답은 메모리에서만 전달·스트리밍·토큰 계측되며 데이터베이스에 기록되지 않습니다. 과금과 진단에 사용하는 요청 메타데이터는 콘텐츠와 분리되어 보관되며, 프롬프트나 완성 텍스트를 포함하지 않습니다.
3. 플랫폼 기능
- 스마트 라우팅: 가격, 첫 토큰까지의 시간, 처리량, 오류율, 가용성을 기준으로 경로를 선택하는 가격 우선·속도 우선·균형 모드.
- 게이트웨이 성능: Rust 게이트웨이가 업스트림 공급사와 상시 HTTP/2 Keep-Alive 커넥션 풀을 유지하여 첫 토큰까지의 시간을 개선합니다.
- 기본 제공 LLMOps 트레이스: 요청 단위
X-Gateway-Trace-ID와 타이밍, 재시도, 토큰 사용량, 입출력 진단 정보. - 비정상 트래픽 제어: 폭주 에이전트, 재시도 폭주, 유출된 키를 탐지하고 능동적으로 서킷 브레이킹하며, 관리자에게 WeChat 또는 이메일로 알림을 보냅니다.
- 투명한 과금: 공급사 공식 알고리즘에 맞춘 로컬 토큰 계산, 요청 단위 과금과 항목별 검증.
- 팀 거버넌스: 워크스페이스, 프로젝트, 구성원, 하위 키 단위의 접근 경계와 예산 한도, 모델 허용 목록.
- Playground: 프로덕션 코드를 작성하기 전에 Playground와 모델 체험 페이지에서 모델 동작과 파라미터를 검증하십시오.
4. 계정과 과금
모든 계정은 가입 시점에 변경 불가능한 통화와 그에 맞는 지갑을 하나만 받으며(USD, Stripe로 충전), 인터페이스 언어를 바꿔도 통화는 바뀌지 않습니다. 가격과 청구서는 사후 환율로 환산하지 않습니다. 각 모델은 USD와 CNY 가격을 각각 별도 유지합니다.
5. 이런 분을 위한 서비스
- 하나의 연동으로 중국 모델을 사용하려는 AI 애플리케이션·에이전트 개발자.
- 구성원과 프로젝트에 키를 배포하고 예산과 모델 범위를 통제해야 하는 엔지니어링·플랫폼 팀.
- 검증 가능한 비용 기록과 콘텐츠 무보관을 요구하는 기업.