AI Gateway

Leiten Sie jeden Schritt zum richtigen Modell – und halten Sie regulierte Daten auf Ihrer eigenen Infrastruktur.

Führen Sie sensible Aufgaben auf Ihren eigenen Modellen aus und schicken Sie alles Übrige an das stärkste Frontier-Modell – alles in einem Workflow, ohne dass regulierte Daten je eine Cloud erreichen. Ein Gateway registriert Ihre lokale Runtime und Ihren GPU-Cluster neben den Anbietern, denen Sie ohnehin vertrauen (Claude, GPT, Gemini, Azure), und leitet dann jeden Schritt nach Stufe, Kosten und Datenklassifizierung.

5Modellanbieter, lokal + Claude/GPT/Gemini/Azure
3Routing-Stufen — lokal / GPU / kontrollierte Cloud
pro SchrittModellwahl in jedem Workflow & Agenten
403Souveräne Daten aus der Cloud gesperrt
So funktioniert das Routing

Ein Gateway schickt jedem Schritt das richtige Modell.

Registrieren Sie alles einmal, und Stufe, Kosten und Datenklassifizierung entscheiden dann, wo jeder Schritt läuft – ob lokal, auf Ihrem GPU-Cluster oder auf einem kontrollierten Cloud-Modell. Der hybride Aufruf von Claude, GPT, Gemini und Azure ist bereits heute verfügbar und kein Punkt auf einer Roadmap.

Jedes Modell, jeder Schritt

Nie an einen Anbieter gebunden

Bringen Sie jeden Anbieter mit, den Sie möchten. Fünf sind bereits integriert: eine abgeschottete lokale Runtime sowie OpenAI, Anthropic (Claude), Gemini und Azure OpenAI. Über Tier-Aliase (local-standard, local-advanced, cloud-reasoning) tauschen Sie das Modell hinter einem Schritt per Konfiguration aus – ohne erneutes Deployment.

Routing pro Schritt

Jeden Schritt auf dem Modell ausführen, das er braucht

Der Inference-Node im Designer und jeder Agentenschritt wählen ihre eigene Stufe. Ein Zusammenfassungsschritt kann auf einem lokalen Modell laufen, während ein Reasoning-Schritt im selben Ablauf ein kontrolliertes Cloud-Modell aufruft – so zahlen Sie Frontier-Tarife nur für die Schritte, die sie wirklich brauchen.

Souverän als Standard

Souveräne Daten bleiben auf lokalen Stufen

Das Routing folgt dem Sovereignty-Gate. Als souverän klassifizierte Daten erreichen ausschließlich lokale Stufen, und jeder Versuch, sie in die Cloud zu senden, gibt 403 SOVEREIGNTY_BLOCK zurück, bevor sie Ihr Netzwerk verlassen. 'Auto' löst zuerst lokal auf – der sichere Weg ist damit der Standard.

Model-Ops

Ein Modell ohne Wartungsfenster hinzufügen

Katalog → VRAM-Prüfung → Pull → Aktivierung, mit Multi-Route-Failover bei Health-Cooldown, damit die Auslieferung während eines Laufs nie abbricht. (Routenänderungen sind eine Enterprise-Funktion.)

Kostensteuerung

Sehen Sie, wohin jeder Euro fließt

Das Gateway erfasst die Ausgaben bei jedem Aufruf, wendet Budgets pro Agent an und ordnet Kosten nach Route zu – so sehen Sie genau, was jedes Modell und jeder Workflow kostet. Administratoren können zudem nutzerbezogene Budgets und Rate-Limits über Scoped Keys aktivieren.

Editionen

Routing in jeder Edition starten

Das Model-Routing ist in jeder Edition enthalten; Routenänderungen über Model-Ops sind Enterprise.

Erleben Sie das Gateway-Routing auf Ihren eigenen Daten.

Sehen Sie, wie ein Workflow ein lokales Modell für sensible Schritte und ein kontrolliertes Cloud-Modell für das Reasoning nutzt – während das Sovereignty-Gate in dem Moment 403 zurückgibt, in dem geschützte Daten Richtung Cloud gehen.

DEMNÄCHSTAANCER startet in Kürze.Für Prelaunch-Events & Demos registrieren →