Siga una petición a través de la esclusa.
Cambie una base_url y sus SDK y streaming de OpenAI cruzan tres compuertas.
La compuerta se cierra tras usted.
Antes de que salga un byte, el prompt pasa más de 60 detectores y todo lo hallado se pseudonimiza de forma reversible.
Los nombres son los datos personales más difíciles de captar por patrón, así que la detección de nombres son cinco capas que usted activa: heurísticas de contexto, correlación de correos, un directorio de nombres por tenant, un diccionario de nombres incluido compilado a partir de datos abiertos de administraciones públicas y el propio modelo de reconocimiento multilingüe de Sluis, que corre dentro de su despliegue y nunca envía un nombre a un tercero. El modelo viene en dos niveles a elegir: uno rápido que responde en milisegundos de un dígito, y uno profundo (GLiNER2-PII) que detecta bastante más a cambio de unos cientos de milisegundos por segmento analizado. Las cifras medidas por nivel están en la documentación.
La detección opcional de inyecciones de prompt y jailbreaks corre en la misma esclusa (Llama Prompt Guard 2, Built with Llama), en paralelo con el análisis de entidades, en modo log o block; los aciertos quedan en el registro de auditoría, y el análisis falla en abierto para no tumbar nunca el tráfico.
Trabaje con datos personales y secretos. El modelo nunca los ve.
El escaneo sustituye cada valor PII y cada secreto por un token estable y solo reenvía tokens al modelo. “Anna de Vries” se convierte en «PERSON_1», de forma coherente en toda la conversación, para que el modelo pueda seguir razonando. La respuesta llega con tokens y sale de la esclusa con nombres: la restauración ocurre dentro del stream, token a token, de modo que su usuario no nota nada. La tabla de correspondencia se queda dentro. Siempre.
El nivel del agua se iguala.
Usted define por clave qué modelos, regiones y propietarios se permiten; si uno falla, el siguiente toma el relevo.
Soberano de la UE por defecto
De serie, el ajuste más estricto: solo proveedores de propiedad europea como Mistral y Scaleway, y nubes en región UE. Los proveedores directos de EE. UU. y China también están disponibles, desactivados por defecto: permítalos en la política y Sluis aplica esa línea exacta.
Propiedad, no solo región
Cada modelo lleva una etiqueta: dónde corre y quién puede alcanzarlo. Una matriz estadounidense bajo el CLOUD Act figura ahí mismo (owner_is_eu = false), así que una ruta directa a EE. UU. o China es siempre una elección que usted ve, nunca una tomada por usted.
Bloqueos firmes, no best-effort
Si ningún proveedor cumple la política, la petición se rechaza en la compuerta y vuelve a su aplicación con un código de motivo claro. Un bloqueo, no una conjetura.
Un endpoint. Siempre el mejor modelo.
La política antes que el benchmark: el mismo alias sluis/auto se resuelve de forma distinta por tenant cuando la política lo exige. Una organización EU-only nunca se enruta a un proveedor no conforme, aunque los benchmarks digan que es el más rápido.
Llame a un nombre estable
Use sluis/auto para enrutamiento por petición o nombres por caso de uso como sluis/code, sluis/cheap y sluis/vision. Los ids de modelo salen de su app.
Actualizado con benchmarks vivos
Las rutas gestionadas se actualizan a diario desde benchmarks de Artificial Analysis y luego Sluis las cura antes de activarlas.
Su política manda
Sus alias de tenant pueden reutilizar un nombre reservado y ocultar la ruta gestionada. Las claves pueden allow-listear sluis/auto o sluis/code como un id de modelo.
Rankings: Artificial Analysis · objetivos reevaluados a diario, siempre resueltos dentro de su política de residencia.
# One stable name. Tenant policy still decides the target. $ curl https://api.sluis.ai/v1/chat/completions \ -H "Authorization: Bearer $SLUIS_KEY" \ -d '{ "model": "sluis/auto", "messages": [...] }' # → x-sluis-route: sluis/auto # → x-sluis-model: mistral/mistral-large-latest # → x-sluis-region: EU · policy-aware
El paso queda en el registro.
Cada petición entra en un registro encadenado por hash que exporta como JSON Lines y reverifica sin conexión.
El derecho de supresión (art. 17 RGPD y equivalentes) purga el contenido de las peticiones, la caché y las credenciales de proveedor, y conserva la cadena de metadatos, de modo que verify-chain sigue pasando después de que los datos desaparezcan.
Sus agentes pasan las mismas tres compuertas.
Las llamadas a herramientas MCP son peticiones como cualquier otra, así que pasan las mismas tres compuertas. Un agente que lee su CRM o crea un ticket lo hace tras la esclusa: inspeccionado, enrutado, sellado.
La única pasarela MCP donde cada invocación de herramienta pasa Inspeccionar → Enrutar → Sellar, para que «se quedó dentro de su política» cubra sus herramientas, no solo sus prompts.
- inspect
Inspeccionar la llamada a la herramienta
La misma pasada DLP escanea argumentos y resultados de herramientas en busca de PII y secretos.
arguments · scannedpass - route
Enrutar la salida de la herramienta
Una salida de herramienta fuera de su política de residencia se bloquea en la compuerta.
egress · eu-sovereignin-region - seal
Sellarla en el mismo registro
La llamada y un hash de sus argumentos se encadenan en el mismo registro a prueba de manipulaciones.
ledger · #4f9c2averified
tool.callinspect.passroute.eu-sovereignseal.#4f9c2aConstruido para no estorbar a la petición.
El cumplimiento no puede costarle latencia. El hot path está diseñado para que los controles corran sin bloquearse jamás en una base de datos, un lock o un búfer.
Sin estado por diseño
Sin estado por petición: escala añadiendo réplicas y el hot path nunca toca Postgres.
Sellado fuera del hot path
Las escrituras de auditoría son asíncronas y por lotes: la respuesta nunca espera al registro.
En streaming, nunca en búfer
El SSE pasa directo por un tee; el cuerpo nunca se retiene completo en memoria.
Un gasto que no se desvía
El gasto se debita en dinero real y se reconcilia desde el registro durable; falla cerrado.
Medido, no prometido
Con todas las compuertas activas, el sobrecoste medido es +1 ms en la mediana, nada frente a un modelo en vivo.
Anonimización de documentos
Entregue a la gateway un docx, un pdf, una imagen o texto plano y reciba el mismo documento con cada nombre, número y secreto sustituido por «MERGE_TAG»s en el texto y difuminado en los píxeles. El renderizado y el OCR corren dentro del proceso de la gateway; nada llega a un proveedor de modelos, la operación se sella en la cadena de auditoría y el mapa de tokens es solo suyo.
Pague una sola vez por la misma respuesta.
Active por tenant una caché exacta y una semántica, aisladas por tenant y cifradas AEAD, sin debilitar jamás la residencia.
Construido para el stack que ya tiene.
Compatible con OpenAI hasta el byte. Conserve su SDK, sus prompts, sus herramientas. Apunte una base_url a Sluis y añada una cabecera de residencia cuando quiera fijar una clase de tráfico.
API compatible con OpenAI
/v1/chat/completions, /v1/embeddings, /v1/models: mismas formas, mismo streaming, nada que reescribir.
Funciona con sus SDKs actuales
Clientes OpenAI oficiales, LangChain o curl a secas: ninguna biblioteca nueva, ningún protocolo propietario.
Una base_url, una clave
Acuñe una clave virtual por app, cada una con su lista de modelos, límites y presupuesto.
Observabilidad integrada
Métricas Prometheus y trazas OTLP, etiquetadas jurisdiction, owner y decision, directas a Grafana.
# Same API. One endpoint. You set the residency policy. # eu-sovereign is the safe default; allow more deliberately. $ curl https://api.sluis.ai/v1/chat/completions \ -H "Authorization: Bearer $SLUIS_KEY" \ -H "X-Sluis-Residency: eu-sovereign" \ -d '{ "model": "mistral/mistral-large", "messages": [...] }' # → mistral-large @ mistral-fr · in-region # → sealed · #4f9c2a · streamed
Vea la esclusa trabajar con su propio tráfico.
El precio de lista de su proveedor más un 10% fijo. Sin asientos, sin mínimos, sin juegos de margen. Usted activa con tarjeta o SEPA y paga por uso, y ninguna petición sale jamás de su política de residencia.