Folgen Sie einer Anfrage durch die Schleuse.
Tauschen Sie eine base_url, und Ihre OpenAI-SDKs und Streaming durchlaufen drei Tore.
Das Tor schließt sich hinter Ihnen.
Bevor ein Byte hinausgeht, durchläuft der Prompt über 60 Detektoren, und alles Gefundene wird reversibel pseudonymisiert.
Namen sind die personenbezogenen Daten, die sich am schwersten per Muster fassen lassen, daher besteht die Namenserkennung aus fünf Schichten, die Sie optional zuschalten: Kontext-Heuristiken, E-Mail-Korrelation, ein Namensverzeichnis pro Tenant, ein mitgeliefertes Namenswörterbuch aus offenen Behördendaten und Sluis' eigenes mehrsprachiges Erkennungsmodell, das in Ihrem Deployment läuft und nie einen Namen an einen Dritten sendet. Das Modell gibt es in zwei wählbaren Stufen: einer schnellen, die in einstelligen Millisekunden antwortet, und einer tiefen (GLiNER2-PII), die für einige hundert Millisekunden pro gescanntem Segment deutlich mehr erkennt. Gemessene Zahlen je Stufe stehen in der Dokumentation.
Die optionale Prompt-Injection- und Jailbreak-Erkennung läuft an derselben Schleuse (Llama Prompt Guard 2, Built with Llama), parallel zum Entitäts-Scan, im log- oder block-Modus; Treffer landen im Audit-Protokoll, und der Scan fällt offen aus, legt den Traffic also nie lahm.
Arbeiten Sie mit personenbezogenen Daten und Secrets. Das Modell sieht sie nie.
Der Scan ersetzt jeden PII-Wert und jedes Secret durch ein stabiles Token und leitet nur Tokens an das Modell weiter. „Anna de Vries“ wird zu «PERSON_1», durchgängig über das ganze Gespräch, damit das Modell weiter argumentieren kann. Die Antwort kommt mit Tokens an und verlässt die Schleuse mit Namen: die Wiederherstellung geschieht im Stream, Token für Token, sodass Ihr Nutzer nichts bemerkt. Die Zuordnungstabelle bleibt drinnen. Immer.
Der Wasserstand gleicht sich an.
Sie legen pro Key fest, welche Modelle, Regionen und Eigentümer erlaubt sind; fällt einer aus, übernimmt der nächste.
EU-souverän per Default
Der Default ist die strengste Einstellung: nur EU-eigene Anbieter wie Mistral und Scaleway sowie EU-Region-Clouds. Direkte US- und chinesische Anbieter sind ebenfalls verfügbar, standardmäßig deaktiviert: Erlauben Sie sie in der Policy, und Sluis setzt genau diese Linie durch.
Eigentum, nicht nur Region
Jedes Modell trägt ein Etikett: wo es läuft und wer es erreichen kann. Eine US-Muttergesellschaft unter dem CLOUD Act steht direkt darauf (owner_is_eu = false), sodass eine direkte US- oder China-Route immer eine Wahl ist, die Sie sehen, nie eine für Sie getroffene.
Harte Blocks statt Best-Effort
Erfüllt kein Anbieter die Policy, wird die Anfrage am Tor abgewiesen und mit einem klaren Grund-Code an Ihre App zurückgegeben. Ein Block, keine Vermutung.
Ein Endpoint. Immer das beste Modell.
Policy vor Benchmark: derselbe Alias sluis/auto wird je Tenant anders aufgelöst, wenn die Policy es verlangt. Eine EU-only-Organisation wird nie zu einem nicht konformen Provider geroutet, selbst wenn Benchmarks ihn am schnellsten nennen.
Einen stabilen Namen aufrufen
Nutzen Sie sluis/auto für Routing pro Anfrage oder Use-Case-Namen wie sluis/code, sluis/cheap und sluis/vision. Modell-IDs verschwinden aus Ihrer App.
Aus Live-Benchmarks aktualisiert
Verwaltete Routen werden täglich aus Artificial Analysis Benchmarks aktualisiert und dann von Sluis kuratiert, bevor sie aktiv werden.
Ihre Policy gewinnt
Ihre Tenant-Aliasse können einen reservierten Namen wiederverwenden und die verwaltete Route überdecken. Keys können sluis/auto oder sluis/code wie eine Modell-ID allow-listen.
Rankings: Artificial Analysis · Ziele werden täglich neu bewertet und immer innerhalb Ihrer Residency-Policy aufgelöst.
# One stable name. Tenant policy still decides the target. $ curl https://api.sluis.ai/v1/chat/completions \ -H "Authorization: Bearer $SLUIS_KEY" \ -d '{ "model": "sluis/auto", "messages": [...] }' # → x-sluis-route: sluis/auto # → x-sluis-model: mistral/mistral-large-latest # → x-sluis-region: EU · policy-aware
Die Passage kommt ins Register.
Jede Anfrage landet in einem hash-verketteten Register, das Sie als JSON Lines exportieren und offline nachprüfen.
Das Recht auf Löschung (Art. 17 DSGVO und vergleichbare Regelungen) entfernt Anfrageinhalte, Cache und Provider-Credentials und erhält die Metadaten-Kette, sodass verify-chain auch nach dem Löschen der Daten weiter besteht.
Ihre Agenten durchlaufen dieselben drei Tore.
MCP-Tool-Aufrufe sind Anfragen wie jede andere und durchlaufen dieselben drei Tore. Ein Agent, der Ihr CRM liest oder ein Ticket anlegt, tut es hinter der Schleuse: geprüft, geroutet, versiegelt.
Das einzige MCP-Gateway, in dem jede Tool-Invokation Prüfen → Routen → Versiegeln durchläuft, sodass „es blieb in Ihrer Policy“ Ihre Tools abdeckt, nicht nur Ihre Prompts.
- inspect
Den Tool-Aufruf prüfen
Dieselbe DLP-Passe scannt Tool-Argumente und -Ergebnisse zuerst auf PII und Secrets.
arguments · scannedpass - route
Den Tool-Abfluss routen
Ein Tool-Abfluss außerhalb Ihrer Residency-Policy wird am Tor blockiert.
egress · eu-sovereignin-region - seal
Im selben Register versiegeln
Tool-Aufruf und ein Hash seiner Argumente verketten sich ins selbe manipulationssichere Register.
ledger · #4f9c2averified
tool.callinspect.passroute.eu-sovereignseal.#4f9c2aGebaut, um der Anfrage nicht im Weg zu stehen.
Compliance darf Sie keine Latenz kosten. Der Hot Path ist so konstruiert, dass die Kontrollen laufen, ohne je auf eine Datenbank, einen Lock oder einen Puffer zu blockieren.
Zustandslos by design
Kein Zustand pro Anfrage: Sie skalieren mit Replikas, und der Hot Path berührt nie Postgres.
Versiegelt abseits des Hot Path
Audit-Schreibvorgänge sind asynchron und gebündelt, sodass die Antwort nie auf das Register wartet.
Gestreamt, nie gepuffert
SSE läuft direkt durch ein Tee; der Body wird nie vollständig im Speicher gehalten.
Ausgaben, die nicht driften
Ausgaben werden in echtem Geld gebucht und aus dem dauerhaften Register rekonstruiert; fail-closed.
Gemessen, nicht versprochen
Alle Tore an, der gemessene Overhead ist +1 ms im Median, gegen ein Live-Modell nichts.
Dokument-Anonymisierung
Geben Sie der gateway eine docx, ein pdf, ein Bild oder reinen Text und Sie erhalten dasselbe Dokument zurück, mit jedem Namen, jeder Nummer und jedem Secret ersetzt durch «MERGE_TAG»s im Text und unkenntlich gemacht in den Pixeln. Rendering und OCR laufen im gateway-Prozess; nichts erreicht einen Modellanbieter, der Vorgang wird in der Audit-Kette versiegelt und die Token-Zuordnung gehört Ihnen allein.
Für dieselbe Antwort nur einmal zahlen.
Aktivieren Sie pro Tenant Exact-Match- und semantische Caches, tenant-isoliert und AEAD-verschlüsselt, ohne die Residency zu schwächen.
Gebaut für den Stack, den Sie schon haben.
OpenAI-kompatibel bis aufs Byte. Behalten Sie Ihr SDK, Ihre Prompts, Ihr Tooling. Richten Sie eine base_url auf Sluis und setzen Sie einen Residency-Header, wenn Sie eine Traffic-Klasse festlegen wollen.
OpenAI-kompatible API
/v1/chat/completions, /v1/embeddings, /v1/models: gleiche Request-Formen, gleiches Streaming, nichts umzuschreiben.
Funktioniert mit Ihren bestehenden SDKs
Offizielle OpenAI-Clients, LangChain oder schlichtes curl: keine neue Bibliothek, kein proprietäres Protokoll.
Eine base_url, ein Key
Prägen Sie einen virtuellen Key pro App, je mit eigener Modell-Allowlist, Limits und Budget.
Observability eingebaut
Prometheus-Metriken und OTLP-Traces, mit jurisdiction, owner und decision, direkt in Ihr Grafana.
# Same API. One endpoint. You set the residency policy. # eu-sovereign is the safe default; allow more deliberately. $ curl https://api.sluis.ai/v1/chat/completions \ -H "Authorization: Bearer $SLUIS_KEY" \ -H "X-Sluis-Residency: eu-sovereign" \ -d '{ "model": "mistral/mistral-large", "messages": [...] }' # → mistral-large @ mistral-fr · in-region # → sealed · #4f9c2a · streamed
Sehen Sie die Schleuse an Ihrem eigenen Traffic arbeiten.
Der Listenpreis Ihres Anbieters plus pauschal 10%. Keine Seats, keine Mindestumsätze, keine Margenspiele. Sie aktivieren per Karte oder SEPA und zahlen nach Verbrauch, und keine Anfrage verlässt je Ihre Residency-Policy.