1. 私たちが提供しているもの
InOneAPI は本番運用向けの AI モデル API 集約・スマートルーティングプラットフォームです。中国のトップモデルプロバイダー各社のテキスト・画像・動画・音声モデルを、OpenAI および Anthropic の SDK と互換性のあるひとつの API の後ろに集約しています。アプリケーションは業務の優先順位に応じて接続先を選べ、各社ごとの接続、キー管理、照合作業を維持する必要はありません。
接続先は中国のトップモデルプロバイダーのみです。出所や品質を確認できない低価格の経路は追加しません。
InOneAPI は大規模モデルを開発しておらず、推論を実際に提供する事業者でもありません。お客様からのリクエストは、お客様が選んだ、またはルーティングが選択したプロバイダーの経路で処理されます。各モデルの保存方針、コンテンツ審査のルール、地域に関するコンプライアンスは、それぞれのプロバイダーの規約に基づきます。
2. 私たちが重視している三点
安定性
可能な限り、同一モデルを複数のプロバイダーで利用できるようにしています。ゲートウェイは遅延、スループット、エラー率の変化を継続的に把握し、同一モデルの利用可能な経路間でルーティングを調整し、障害時には切り替えます。これにより一社依存の影響を軽減できますが、無条件の稼働率をお約束するものではありません。ルーティングと自動切り替えは中断のリスクを下げるための仕組みであり、アプリケーション側での再試行や縮退運用に代わるものではありません。
コスト
価格優先モードは、同一モデルで利用可能な接続先の中から現在の最安の経路を選択します。業務上の目的に応じて、速度優先またはバランスモードも利用できます。課金は、実際に処理を担当したプロバイダーの料金でリクエスト単位に確定し、各社と同価格で上乗せはありません。モデル、トークン使用量、費用はコンソールで一件ごとに確認できます。
プライバシー
コンテンツを保存しない運用(ゼロコンテンツログ)は当社の標準的な運用形態であり、任意の設定項目ではありません。プロンプトとモデルの応答は、メモリ上で転送・ストリーミング出力・トークン計測のみを行い、データベースには書き込みません。課金と障害調査に使用するリクエストメタデータはコンテンツと明確に区別しており、プロンプトおよび応答の本文を含みません。
3. プラットフォームの機能
- スマートルーティング:価格、初回トークン遅延、スループット、エラー率、可用性にもとづく価格優先・速度優先・バランスの各モード。
- ゲートウェイの性能:Rust ゲートウェイが上流との永続的な HTTP/2 Keep-Alive コネクションプールを維持し、初回トークン遅延の改善を図ります。
- LLMOps トレース:リクエスト単位の
X-Gateway-Trace-IDと、処理時間、再試行、トークン使用量、入出力に関する診断情報。 - 異常トラフィック対策:暴走した Agent、リクエストの連鎖的再試行、キー漏えいの検知、能動的なサーキットブレーク、設定に応じた WeChat またはメールでの通知。
- 透明な課金:公式プロバイダーのアルゴリズムに合わせたローカルのトークン計算、リクエスト単位の請求と明細の照合。
- チーム管理:ワークスペース、プロジェクト、メンバー、サブ Key の権限境界、予算上限とモデルの許可リスト。
- オンライン体験:Playground とモデル体験ページで、実装前に出力やパラメーターを確認可能。
4. アカウントと課金の通貨
すべてのアカウントは登録時に単一の請求通貨と対応するウォレットが確定し(USD、チャージは Stripe)、表示言語を切り替えても通貨は変わりません。価格と請求書は事後的な為替換算を行わず、各モデルごとに USD と CNY の価格を個別に管理しています。
5. 想定しているご利用先
- 中国のモデルをひとつの接続で利用したい AI アプリケーションおよび Agent 開発者。
- メンバーやプロジェクトごとに Key を配分し、予算と利用可能なモデルを管理したいエンジニアリングチーム。
- 費用の照合可能性とコンテンツを保存しない運用を重視する企業のお客様。
6. 次のステップ
- 接続方法は導入ガイド、API リファレンス、プラットフォームガイドをご覧ください。
- 個人情報の取扱いはプライバシーポリシー、当事者の権利と義務は利用規約に定めています。
- 技術、課金、ビジネスでのご連絡はお問い合わせをご覧ください。