Über uns

1. Was wir bauen

InOneAPI ist eine produktionsorientierte Plattform zur Bündelung von KI-Modell-APIs und zum intelligenten Routing. Wir stellen die Text-, Bild-, Video- und Audio-Modelle der führenden chinesischen Modellanbieter hinter eine einzige API, die mit den SDKs von OpenAI und Anthropic kompatibel ist. Ihre Anwendung wählt den Anbieter nach Geschäftspriorität, statt für jeden Anbieter eine Integration, einen Schlüssel und einen Abgleichprozess zu pflegen.

Wir verbinden ausschließlich Top-Tier-Modellanbieter in China. Keine kostengünstigen Kanäle, deren Herkunft und Qualität wir nicht verifizieren können.

InOneAPI entwickelt keine großen Modelle und ist nicht die Partei, die die Modell-Inferenz ausliefert. Von Ihnen gesendete Anfragen werden von dem Anbieterkanal erledigt, den Sie wählen oder den das Routing auswählt. Aufbewahrungsrichtlinie, Inhaltsprüfungsregeln und regionale Compliance eines Anbieters folgen dessen eigenen Bedingungen.

2. Worauf wir uns konzentrieren

Zuverlässigkeit

Wo möglich, ist dasselbe Modell über mehr als einen Anbieter verfügbar. Das Gateway verfolgt Änderungen bei Latenz, Durchsatz und Fehlerquote, passt die Wege zwischen den verfügbaren Kanälen desselben Modells an und schaltet bei Fehlern um, was die Folgen einer Abhängigkeit von einem einzigen Anbieter verringert. Wir geben kein bedingungsloses Verfügbarkeitsversprechen: Routing und Failover senken das Unterbrechungsrisiko und ersetzen weder Wiederholungen noch Degradationsbehandlung in Ihrer Anwendung.

Kosten

Das preisorientierte Routing wählt den günstigsten verfügbaren Anbieter desselben Modells. Geschwindigkeits- und ausgewichtete Modi stehen bereit, wenn Ihre Prioritäten anders liegen. Jede Anfrage wird zu dem Preis des Anbieters abgerechnet, der sie tatsächlich bedient hat – zu Anbieterpreisen ohne Aufschlag. Modell, Token-Nutzung und Kosten pro Anfrage sind in der Console einsehbar.

Privatsphäre

Keine Inhaltsspeicherung ist der Standardbetriebsmodus der Plattform, keine optionale Einstellung. Prompts und Modellantworten werden ausschließlich im Arbeitsspeicher weitergeleitet, gestreamt und gezählt und niemals in einer Datenbank gespeichert. Die für Abrechnung und Diagnose genutzten Metadaten der Anfrage werden getrennt vom Inhalt aufbewahrt und umfassen niemals Prompt- oder Antworttext.

3. Plattformfunktionen

  • Intelligentes Routing: preis-, geschwindigkeits- und ausgewichtete Modi, die Wege anhand von Preis, Zeit bis zum ersten Token, Durchsatz, Fehlerquote und Verfügbarkeit wählen.
  • Gateway-Leistung: Ein Rust-Gateway hält persistente HTTP/2-Keep-Alive-Verbindungspools zu Upstream-Anbietern bereit, um die Zeit bis zum ersten Token zu verbessern.
  • Integrierter LLMOps-Trace: X-Gateway-Trace-ID auf Anfrageebene mit Zeitverhalten, Wiederholungen, Token-Nutzung und Ein-/Ausgabe-Diagnose.
  • Kontrolle anomalen Traffics: Erkennung von durchlaufenden Agenten, Wiederholungsstürmen und geleakten Schlüsseln, mit aktivem Circuit Breaking und WeChat- oder E-Mail-Warnungen an Administratoren.
  • Transparente Abrechnung: lokale Token-Berechnung nach den offiziellen Algorithmen der Anbieter, pro Anfrage abgerechnet und Position für Position nachvollziehbar.
  • Team-Governance: Zugriffsgrenzen nach Workspace, Projekt, Mitglied und Unterschlüssel, mit Budgetgrenzen und Modell-Freigabelisten.
  • Playground: Prüfen Sie Modellverhalten und Parameter in Playground und Modell-Erlebnis, bevor Sie Produktionscode schreiben.

4. Konten und Abrechnung

Jedes Konto erhält bei der Registrierung eine unveränderliche Währung und die passende Wallet — USD, aufgeladen über Stripe — ; ein Wechsel der Oberflächensprache ändert sie nie. Preise und Rechnungen werden nicht nachträglich umgerechnet: jedes Modell führt einen unabhängigen USD- und CNY-Preis.

5. Für wen wir da sind

  • Entwickler von KI-Anwendungen und Agenten, die Chinas Modelle über eine statt über mehrere Integrationen brauchen.
  • Engineering- und Plattform-Teams, die Schlüssel verteilen und Budgets sowie Modellumfänge über Mitglieder und Projekte steuern müssen.
  • Unternehmen, die nachvollziehbare Kostenaufzeichnungen und keine Aufbewahrung von Inhalten brauchen.

6. Weiter so

Über uns · InOneAPI