Das Enterprise-KI-Gateway für über 100 Modelle
— von Grund auf transparent

Über 100 Modelle hinter einer API — GPT, Claude, Gemini sowie DeepSeek, Qwen, GLM und Kimi, von Text bis zur Bild- und Videogenerierung. Im Team steuerbar: Rollen, Budgets und Audit-Trail sind eingebaut.

Unsere Enterprise-Zusagen in vier Zahlen

* Das SLA deckt die Verfügbarkeit der Ofox-Plattform ab. Ausfälle vorgelagerter Modellanbieter sind ausgenommen.

0 %
Plattformgebühr auf jede Anfrage
99,9 %
Verfügbarkeits-SLA *
Nie
Training mit Ihren Prompts oder Ausgaben
100 %
Anfragen protokolliert mit Verursacher und exakten Kosten
Enterprise-Funktionen

KI-Infrastruktur auf Enterprise-Niveau ab der ersten Anfrage

Eine API, ein Dashboard, eine Rechnung — mit der Steuerung, Zuverlässigkeit und Datenverarbeitung, die ein Produktiv-Rollout verlangt. Die 0 % Plattformgebühr sind dabei nur der Ausgangspunkt.

Modellkarte$3.00 / M
Sie zahlen$3.00 / M · 0%
Mengenrabattbis zu −7 % · automatisch

0 % Plattformgebühr — offizielle Anbieterpreise

Abgerechnet wird zum offiziellen Tarif des Modellanbieters — der Preis auf der Modellkarte ist der Preis, den Sie zahlen. Mit wachsendem Volumen greifen automatisch Mengenrabatte von bis zu 7 %.

OpenAIOpenAI
ClaudeClaude
GeminiGemini
DeepSeekDeepSeek
QwenQwen
GrokGrok
sk-ofox-••••••••

Ein API-Key für GPT, Claude, Gemini und über 100 Modelle

Zugriff auf Claude, GPT, Gemini, DeepSeek, Qwen und über 100 Modelle mit einem einzigen API-Key. Vollständig kompatibel mit dem OpenAI SDK.

100 % Verfügbarkeit
letzte 30 TageTokyo

99,9 % Verfügbarkeits-SLA mit Failover über mehrere Regionen *

Redundanz über mehrere Regionen mit automatischem Failover. Verfügbarkeitszusagen schriftlich fixiert.

Monatslimit$0 / $1,000
Heute
$0
Diese Woche
$0
Diesen Monat
$0

Granulare Kostenkontrolle je Key und je Nutzer

Legen Sie Tages-, Wochen- oder Monatsbudgets je Key oder je Nutzer fest, mit automatischer Ratenbegrenzung. Echtzeit-Dashboards beseitigen Rechnungsüberraschungen.

AnfrageModell
Nicht gespeichertKein Training

Keine dauerhafte Speicherung von Inhalten

Prompts und Antworten werden nie für Training verwendet. Gespeichert werden nur kurzlebige Betriebsprotokolle sowie Anfrage-Metadaten und Token-Verbrauch für die Abrechnung.

Ticket< 24 Std.
Priorität< 4 Std.
DediziertIn Echtzeit

Gestaffelter technischer Support

Höheres Volumen verkürzt die Reaktionszeiten. Accounts der obersten Stufe erhalten einen festen technischen Ansprechpartner und bevorzugte Ticketbearbeitung.

Traces
LangfuseDatadogWeave

LLM-Observability (Langfuse, Datadog, Weave)

Demnächst

Optionales Logging von Prompts und Antworten, gestreamt an Langfuse, Datadog und weitere Plattformen für Debugging und Analyse — dieselbe Zuordnung wie im Dashboard, exportiert in den Observability-Stack, den Sie bereits betreiben.

* Das SLA deckt ausschließlich die Verfügbarkeit der Ofox-Plattform ab; Ausfälle vorgelagerter Modellanbieter sind ausgenommen.

Sicherheit und Compliance

Sicherheit und Compliance: weiterleiten statt speichern

Die Aufgabe eines Gateways ist es, Ihre Anfragen zu transportieren, nicht sie zu behalten. Der Datenverkehr ist TLS-verschlüsselt, Inhalte werden weder dauerhaft gespeichert noch für Training genutzt — und wo eine Zertifizierung noch läuft, sagen wir das unten genau so.

Wie Ihre Daten behandelt werden

TLS-verschlüsselt bei der Übertragung

Der gesamte API-Verkehr wird zwischen Ihren und unseren Systemen Ende-zu-Ende verschlüsselt.

Keine dauerhafte Speicherung von Prompts oder Antworten

Prompts und Antworten werden nicht dauerhaft gespeichert — es bleiben nur kurzlebige Betriebsprotokolle sowie die für die Abrechnung nötigen Anfrage-Metadaten und Token-Zahlen.

Ihre Daten werden nie für Training verwendet

Ihre Inhalte werden nicht zum Training von Modellen verwendet — weder für unsere noch für fremde. Vorgelagerte Anbieter sind an ihre eigenen Enterprise-Bedingungen gebunden.

Zertifizierungen und Datenvereinbarungen

SOC 2 Type II

Audit läuft — erwartet im 3. Quartal 2026

In Arbeit

ISO 27001

Erwartet im 3. Quartal 2026

In Arbeit

GDPR

AVV mit Standardvertragsklauseln; Unterauftragsverarbeiter-Liste auf Anfrage

Konform

DPA

Auf Anfrage, vor Vertragsunterzeichnung

Verfügbar

Wir behaupten keine Zertifizierungen, die wir noch nicht besitzen. Wenn ein Standard für Ihren Prüfzeitplan entscheidend ist, sagen Sie uns Bescheid — wir teilen den aktuellen Stand des Audits mit.

Teamverwaltung

Nutzungsanalytik für Entwicklungsteams

Kosten, Performance und Verbrauch in Echtzeit — zugeordnet zu jedem Modell, API-Key und Teammitglied. Ausgabenprüfung und Kapazitätsplanung laufen über Daten statt über den Monatsabschluss.

Ein Satz Filter — Modell, Mitglied, API-Key, App — angewendet auf Kosten, Anfragenstatus, Tokens und Cache. Gecachtes und Ungecachtes werden getrennt bepreist.

Denselben Verlauf zwischen Modellen, API-Keys und Mitgliedern umschalten — wenn der Verbrauch ausschlägt, steht die Quelle fest, bevor die Rechnung kommt.

Kosten, Tokens und Cache-Analyse in einem Dashboard
Integration

Integration: Base-URL ändern, SDK behalten

Ofox ist kompatibel mit den SDKs von OpenAI, Anthropic und Gemini. Kein Umschreiben, kein proprietärer Client.

Kompatibel mit den SDKs von OpenAI, Anthropic und Gemini

from openai import OpenAI

client = OpenAI(
    base_url="https://api.ofox.run/v1",  # ← die einzige Änderung
    api_key="YOUR_OFOX_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-5.6-sol",
    messages=[{"role": "user", "content": "Hello!"}],
)

print(response.choices[0].message.content)

Funktioniert mit Claude Code, Cursor, LangChain und mehr

Alle Integrationen
Support und Onboarding

Wie ein Enterprise-Rollout abläuft

Schritt 1 Registrieren und testen

Account anlegen, Guthaben aufladen und die eigene Evaluierung fahren — für die Frage, ob Modelle, Latenz und Preise zu Ihrer Last passen, braucht es kein Vertriebsgespräch.

Schritt 2 Pilot mit gesetzten Budgets fahren

Bringen Sie eine einzelne Last mit gesetzten Budgets und Limits produktiv. Prüfen Sie Latenz, Qualität und Abrechnung an Ihren eigenen Zahlen.

Schritt 3 Mit Rollen und Key-Limits live gehen

Rollen und Budgets je Key im gesamten Team ausrollen. Höheres Volumen verkürzt die Reaktionszeiten und bringt einen festen technischen Ansprechpartner.

Häufige Fragen

Enterprise-FAQ

Produkt und Zuverlässigkeit

Worin unterscheidet sich Ofox von den offiziellen APIs der Anbieter?

Sie behalten die offiziellen Preise — 0 % Plattformgebühr — und ersetzen viele Integrationen durch eine: ein Key, eine Rechnung und ein Dashboard für OpenAI, Anthropic, Google, DeepSeek, Qwen, GLM, Kimi und über 100 Modelle, mit eingebauten Rollen, Budgets und Audit-Trail. Direkt bedeutet je Anbieter eine eigene Geschäftsbeziehung, ein eigenes SDK und eine eigene Rechnung; Ofox bündelt das ohne Aufschlag.

Was deckt das SLA von 99,9 % ab?

Die Verfügbarkeit der Ofox-Plattform — Gateway, Routing und API-Schicht. Ausfälle, die bei einem vorgelagerten Modellanbieter entstehen, sind ausgenommen, da wir dessen Infrastruktur nicht kontrollieren. Die aktuellen Service-Credit-Bedingungen erhalten Sie auf Anfrage.

Was passiert, wenn ein vorgelagerter Modellanbieter ausfällt?

Störungen auf Plattformebene werden automatisch über unsere Regionen umgangen. Fällt der Anbieter selbst aus, geben wir den Fehler klar zurück, statt still die Qualität zu senken — und da die API modellunabhängig ist, wechseln die meisten Teams mit einer geänderten Zeichenkette auf ein gleichwertiges Modell. Solche Ausfälle sind vom SLA ausgenommen, und das sagen wir vorab.

Wie lange dauert die Integration?

Für die meisten Teams Minuten. Die API ist kompatibel mit den SDKs von OpenAI, Anthropic und Gemini: Sie ändern Base-URL und Key und behalten Ihren bestehenden Code.

Daten und Compliance

Speichern Sie unsere Prompts und Antworten?

Nein. Anfrageinhalte werden in Echtzeit verarbeitet und nicht dauerhaft gespeichert — es bleiben nur kurzlebige Betriebsprotokolle sowie die für die Abrechnung nötigen Metadaten und Token-Zahlen. Der gesamte Verkehr ist bei der Übertragung TLS-verschlüsselt.

Werden unsere Daten für Modelltraining genutzt?

Nie. Ihre Prompts und Ausgaben werden nicht zum Training von Modellen verwendet — weder für unsere noch für fremde. Vorgelagerte Anbieter sind an ihre eigenen Enterprise-Bedingungen gebunden.

Sind Sie SOC-2-zertifiziert?

Noch nicht. Das SOC-2-Type-II-Audit läuft und wird für das 3. Quartal 2026 erwartet; ISO 27001 folgt demselben Zeitplan. Wir behaupten keine Zertifizierung, bevor sie erteilt ist — hängt Ihre Prüfung daran, melden Sie sich: Wir teilen den aktuellen Auditstand schriftlich mit.

Sind Sie DSGVO-konform?

Ja. Wir bieten einen AVV mit Standardvertragsklauseln, verschlüsseln den gesamten Verkehr bei der Übertragung, speichern Anfrageinhalte nicht dauerhaft und stellen auf Anfrage unsere Liste der Unterauftragsverarbeiter bereit. Melden Sie sich — wir stellen die Unterlagen für Ihre Prüfung zusammen.

Abrechnung

Wie funktioniert die Preisgestaltung?

Nutzungsbasierte Abrechnung zum offiziellen Tarif des Modellanbieters, bei 0 % Plattformgebühr — der auf der Modellkarte ausgewiesene Preis ist der berechnete Preis. Keine Monatsgebühr, kein Plattform-Mindestumsatz, kein Aufschlag beim Aufladen. Dauerhaftes Volumen erzeugt automatisch Guthaben von bis zu 7 %.

Werden fehlgeschlagene Anfragen berechnet?

Nein. Fehlgeschlagene Anfragen liefern einen eindeutigen Fehler zurück und werden nicht berechnet — Sie zahlen ausschließlich für abgeschlossene Anfragen.

Verfällt vorausbezahltes Guthaben?

Nein. Ihr Guthaben bleibt verfügbar, bis Sie es aufbrauchen — ohne Ablaufdatum und ohne monatlichen Mindestumsatz, um es aktiv zu halten.

Team und Zugriff

Wie begrenzen wir die Ausgaben eines Teammitglieds?

Setzen Sie in der Konsole ein Tages-, Wochen- oder Monatslimit je Mitglied oder je API-Key. Ist das Limit erreicht, werden Anfragen automatisch gedrosselt und der Zugriff startet in der nächsten Periode neu — kein Rechnungsschock durch ein außer Kontrolle geratenes Skript.

Können wir einschränken, welche Modelle unser Team aufrufen darf?

Ja. Zugriffe werden je Rolle und je Key gesteuert, sodass Sie die Nutzung auf einen freigegebenen Modellsatz begrenzen und zugleich Ausgabenlimits durchsetzen können.

Unterstützen Sie SSO?

Nennen Sie uns Ihren Identity-Provider, und wir bestätigen, was heute unterstützt wird und was auf der Roadmap steht.

ofox

Jedes Modell, das Ihr Team braucht — mit der Kontrolle, die Ihr Unternehmen erwartet.

Testen Sie zuerst ein Modell im Playground oder sprechen Sie mit uns über den Rollout in Ihrem Team — inklusive Modellen, Regionen und Prüfanforderungen.

API-Key holen