Enrute cada paso al modelo adecuado y mantenga los datos regulados en su propia infraestructura.
Ejecute las tareas sensibles en sus propios modelos y envíe todo lo demás al modelo frontera más potente, todo en un mismo flujo de trabajo y sin que los datos regulados lleguen nunca a la nube. Una sola puerta de enlace registra su runtime local y su clúster de GPU junto a los proveedores en los que ya confía (Claude, GPT, Gemini, Azure), y a continuación enruta cada paso según el nivel, el coste y la clasificación de los datos.
Una puerta de enlace envía el modelo adecuado a cada paso.
Registre todo una sola vez y, a partir de ahí, el nivel, el coste y la clasificación de los datos deciden dónde se ejecuta cada paso: en local, en su clúster de GPU o en un modelo de nube gobernado. Las llamadas híbridas a Claude, GPT, Gemini y Azure están disponibles hoy, no son una promesa de roadmap.
Nunca atado a un solo proveedor
Incorpore el proveedor que prefiera. Cinco vienen integrados: un runtime local aislado más OpenAI, Anthropic (Claude), Gemini y Azure OpenAI. Los alias de nivel (local-standard, local-advanced, cloud-reasoning) le permiten cambiar el modelo que hay detrás de un paso desde la configuración, sin necesidad de redesplegar.
Ejecute cada paso en el modelo que necesita
El nodo Inference del diseñador y cada paso de un agente eligen su propio nivel. Un paso de resumen puede ejecutarse en un modelo local mientras un paso de razonamiento del mismo flujo llama a un modelo de nube gobernado, de modo que solo paga tarifas frontera por los pasos que las requieren.
Los datos soberanos permanecen en niveles locales
El enrutamiento obedece a la barrera de soberanía. Los datos clasificados como soberanos solo pueden llegar a niveles locales, y cualquier intento de enviarlos a la nube devuelve 403 SOVEREIGNTY_BLOCK antes de que salgan de su red. «Auto» se resuelve primero en local, de modo que la vía segura es la opción por defecto.
Añada un modelo sin ventana de mantenimiento
Catálogo → verificación de ajuste de VRAM → descarga → activación, con conmutación por error entre varias rutas ante un enfriamiento de salud, de modo que el servicio nunca se cae a mitad de una ejecución. (Los cambios de ruta son una capacidad Enterprise.)
Vea a dónde va cada euro
La puerta de enlace contabiliza el gasto de cada llamada, aplica presupuestos por agente y atribuye el coste por ruta, de modo que puede ver con exactitud lo que cuesta cada modelo y cada flujo de trabajo. Los administradores también pueden habilitar presupuestos y límites de tasa por usuario mediante claves con alcance acotado.
Empiece a enrutar en cualquier edición
El enrutamiento de modelos se incluye en todas las ediciones; las mutaciones de ruta de Model-Ops son Enterprise.
Vea la puerta de enlace enrutar sobre sus propios datos.
Observe cómo un mismo flujo de trabajo ejecuta un modelo local para los pasos sensibles y un modelo de nube gobernado para el razonamiento, con la barrera de soberanía devolviendo un 403 en el instante en que datos protegidos se dirigen a la nube.