Prześledź jedno żądanie przez śluzę.
Podmień jedno base_url, a Twoje SDK i streaming OpenAI przechodzą przez troje wrót.
Wrota zamykają się za Tobą.
Zanim wyjdzie choć bajt, prompt przechodzi ponad 60 detektorów, a wszystko znalezione jest odwracalnie pseudonimizowane.
Nazwiska to dane osobowe najtrudniejsze do wychwycenia wzorcem, dlatego wykrywanie nazwisk to pięć warstw, które włączasz sam: heurystyki kontekstu, korelacja e-maili, katalog nazwisk per tenant, dostarczany słownik nazwisk skompilowany z rządowych danych otwartych oraz własny wielojęzyczny model rozpoznawania Sluis, który działa wewnątrz Twojego wdrożenia i nigdy nie wysyła nazwiska do strony trzeciej. Model występuje w dwóch poziomach do wyboru: szybkim, odpowiadającym w kilka milisekund, i głębokim (GLiNER2-PII), który wykrywa wyraźnie więcej kosztem kilkuset milisekund na analizowany segment. Zmierzone liczby per poziom są w dokumentacji.
Opcjonalne wykrywanie prompt injection i jailbreaków działa przy tej samej śluzie (Llama Prompt Guard 2, Built with Llama), równolegle ze skanem encji, w trybie log lub block; trafienia lądują w dzienniku audytu, a skan zawodzi w trybie otwartym, więc nigdy nie zatrzymuje ruchu.
Pracuj z danymi osobowymi i sekretami. Model nigdy ich nie widzi.
Skan podmienia każdą wartość PII i każdy sekret na stabilny token i przekazuje modelowi wyłącznie tokeny. „Anna de Vries” staje się «PERSON_1», spójnie w całej rozmowie, aby model mógł dalej rozumować. Odpowiedź przychodzi z tokenami i opuszcza śluzę z nazwiskami: przywracanie dzieje się w strumieniu, token po tokenie, więc Twój użytkownik niczego nie zauważa. Tablica odwzorowania zostaje w środku. Zawsze.
Poziom wody się wyrównuje.
Definiujesz per klucz, które modele, regiony i właściciele są dozwoleni; gdy jeden zawiedzie, przejmuje następny.
Suwerenna UE domyślnie
Domyślne ustawienie jest najsurowsze: wyłącznie dostawcy należący do podmiotów z UE, jak Mistral i Scaleway, oraz chmury w regionach UE. Bezpośredni dostawcy z USA i Chin również są dostępni, domyślnie wyłączeni: zezwól na nich w polityce, a Sluis wyegzekwuje dokładnie tę linię.
Własność, nie tylko region
Każdy model nosi etykietę: gdzie działa i kto może go dosięgnąć. Amerykańska spółka matka podlegająca CLOUD Act jest na niej wprost (owner_is_eu = false), więc bezpośrednia trasa do USA lub Chin zawsze jest wyborem, który widzisz, nigdy podjętym za Ciebie.
Twarde blokady, nie best-effort
Jeśli żaden dostawca nie spełnia polityki, żądanie jest odrzucane u wrót i wraca do aplikacji z czytelnym kodem przyczyny. Blokada, nie domysł.
Jeden endpoint. Zawsze najlepszy model.
Polityka przed benchmarkiem: ten sam alias sluis/auto rozwiązuje się inaczej dla każdego tenanta, gdy wymaga tego polityka. Organizacja EU-only nigdy nie trafi do niezgodnego dostawcy, nawet gdy benchmarki wskazują go jako najszybszego.
Wywołaj jedną stabilną nazwę
Użyj sluis/auto do routingu per żądanie albo nazw według zastosowania, takich jak sluis/code, sluis/cheap i sluis/vision. Identyfikatory modeli znikają z aplikacji.
Odświeżane z żywych benchmarków
Trasy zarządzane są codziennie odświeżane z benchmarków Artificial Analysis, a potem kuratorowane przez Sluis przed aktywacją.
Twoja polityka wygrywa
Aliasy tenanta mogą ponownie użyć zarezerwowanej nazwy i przesłonić trasę zarządzaną. Klucze mogą allow-listować sluis/auto lub sluis/code tak jak id modelu.
Rankingi: Artificial Analysis · cele oceniane codziennie od nowa, zawsze rozwiązywane w Twojej polityce rezydencji.
# One stable name. Tenant policy still decides the target. $ curl https://api.sluis.ai/v1/chat/completions \ -H "Authorization: Bearer $SLUIS_KEY" \ -d '{ "model": "sluis/auto", "messages": [...] }' # → x-sluis-route: sluis/auto # → x-sluis-model: mistral/mistral-large-latest # → x-sluis-region: EU · policy-aware
Przejście trafia do rejestru.
Każde żądanie trafia do rejestru spiętego łańcuchem hashy, który wyeksportujesz jako JSON Lines i zweryfikujesz offline.
Prawo do usunięcia danych (art. 17 RODO i odpowiedniki) czyści treść żądań, cache i poświadczenia dostawców, a zachowuje łańcuch metadanych, więc verify-chain przechodzi nadal, gdy danych już nie ma.
Twoi agenci przechodzą przez te same troje wrót.
Wywołania narzędzi MCP to żądania jak każde inne, więc przechodzą przez te same troje wrót. Agent, który czyta Twój CRM lub tworzy zgłoszenie, robi to za śluzą: poddany inspekcji, zroutowany, zapieczętowany.
Jedyna brama MCP, w której każde wywołanie narzędzia przechodzi Inspekcja → Routing → Pieczęć, by „zostało w ramach Twojej polityki” obejmowało Twoje narzędzia, nie tylko prompty.
- inspect
Inspekcja wywołania narzędzia
Ten sam przebieg DLP skanuje argumenty i wyniki narzędzi pod kątem PII i sekretów.
arguments · scannedpass - route
Routing wyjścia narzędzia
Wyjście narzędzia poza Twoją politykę rezydencji jest blokowane u wrót.
egress · eu-sovereignin-region - seal
Pieczęć w tym samym rejestrze
Wywołanie i hash jego argumentów spinają się w ten sam odporny na manipulacje rejestr.
ledger · #4f9c2averified
tool.callinspect.passroute.eu-sovereignseal.#4f9c2aZbudowana tak, by nie stawać żądaniu na drodze.
Zgodność nie może kosztować Cię latencji. Hot path zaprojektowano tak, by kontrole działały bez blokowania się na bazie danych, locku czy buforze.
Bezstanowa z założenia
Zero stanu per żądanie: skalujesz, dodając repliki, a hot path nigdy nie dotyka Postgresa.
Pieczętowanie poza hot path
Zapisy audytu są asynchroniczne i wsadowe: odpowiedź nigdy nie czeka na rejestr.
Strumieniowane, nigdy buforowane
SSE przechodzi wprost przez tee; treść nigdy nie jest w całości trzymana w pamięci.
Wydatki, które nie dryfują
Wydatki obciążane są prawdziwymi pieniędzmi i uzgadniane z trwałego rejestru; fail-closed.
Zmierzone, nie obiecane
Przy wszystkich włączonych wrotach zmierzony narzut to +1 ms w medianie, nic wobec modelu na żywo.
Anonimizacja dokumentów
Przekaż gateway docx, pdf, obraz lub zwykły tekst i odbierz ten sam dokument, w którym każde nazwisko, numer i sekret zastąpiono «MERGE_TAG»ami w tekście i rozmyto w pikselach. Render i OCR działają w procesie gateway; nic nie trafia do dostawcy modelu, operacja jest pieczętowana w łańcuchu audytu, a mapa tokenów należy tylko do ciebie.
Zapłać raz za tę samą odpowiedź.
Włącz per tenant cache dokładny i semantyczny, izolowane per tenant i szyfrowane AEAD, bez osłabiania rezydencji.
Zbudowane pod stack, który już masz.
Zgodny z OpenAI co do bajta. Zachowaj swój SDK, swoje prompty, swoje narzędzia. Skieruj jedno base_url na Sluis i dodaj nagłówek rezydencji, gdy chcesz przypiąć klasę ruchu.
API zgodne z OpenAI
/v1/chat/completions, /v1/embeddings, /v1/models: te same kształty, ten sam streaming, nic do przepisania.
Działa z Twoimi obecnymi SDK
Oficjalne klienty OpenAI, LangChain lub zwykły curl: żadnej nowej biblioteki, żadnego własnościowego protokołu.
Jedno base_url, jeden klucz
Wybij wirtualny klucz na aplikację, każdy z własną listą modeli, limitami i budżetem.
Wbudowana obserwowalność
Metryki Prometheus i ślady OTLP, z etykietami jurisdiction, owner i decision, prosto do Grafany.
# Same API. One endpoint. You set the residency policy. # eu-sovereign is the safe default; allow more deliberately. $ curl https://api.sluis.ai/v1/chat/completions \ -H "Authorization: Bearer $SLUIS_KEY" \ -H "X-Sluis-Residency: eu-sovereign" \ -d '{ "model": "mistral/mistral-large", "messages": [...] }' # → mistral-large @ mistral-fr · in-region # → sealed · #4f9c2a · streamed
Zobacz śluzę przy pracy na własnym ruchu.
Cena katalogowa Twojego dostawcy plus stałe 10%. Bez stanowisk, bez minimów, bez gier marżowych. Aktywujesz kartą lub SEPA i płacisz za zużycie, a żadne żądanie nigdy nie opuszcza Twojej polityki rezydencji.