Cloudflare DLP: ile danych wycieka, zanim ktoś to zauważy
Firmowe dane nie wyciekają już jedną, dobrze znaną drogą. Wychodzą wszędzie tam, gdzie pracownicy dziś pracują, a większość organizacji dowiaduje się o skali problemu dopiero po fakcie, kiedy incydent jest już kosztowny. Cloudflare DLP to sposób, żeby zobaczyć ten problem, zanim urośnie do rozmiarów incydentu. Pokazujemy, jak to działa w praktyce: od profili, przez progi wykrywania, po logi.
Ile kosztują incydenty wewnętrzne
Skalę problemu widać w liczbach. Według 2026 Cost of Insider Risks Global Report Ponemon Institute i DTEX, opartego na ankiecie wśród 354 organizacji, przeciętny roczny koszt incydentów wewnętrznych sięgnął w 2025 roku 19,5 mln dolarów, a sam koszt incydentów wynikających z niedbalstwa pracowników, a nie złych intencji, wzrósł rok do roku o 17%, do 10,3 mln dolarów. Organizacje z formalnym programem zarządzania ryzykiem wewnętrznym unikają średnio siedmiu incydentów rocznie i oszczędzają 8,2 mln dolarów, a 92% ankietowanych organizacji przyznaje, że GenAI zmieniło sposób, w jaki pracownicy uzyskują dostęp do danych i się nimi dzielą.
Skąd realnie wyciekają dane: cztery kanały
Cloudflare DLP monitoruje cztery kanały, którymi dane opuszczają organizację. Pierwszym jest ruch HTTP przechodzący przez Cloudflare Gateway - wymaga on włączonego filtrowania HTTP i deszyfrowania TLS, co w praktyce oznacza zainstalowanie na urządzeniu agenta Cloudflare One Client (dawniej WARP); bez tego DLP nie zobaczy treści zaszyfrowanego ruchu. Drugim są pliki przechowywane w aplikacjach SaaS, skanowane bezpośrednio przez API dzięki integracji CASB, niezależnie od ustawień Gateway. Trzecim są prompty i odpowiedzi wysyłane do modeli AI: ruch generowany przez własne aplikacje i automatyzacje, które wywołują API dostawców wprost z kodu, obsługuje Cloudflare AI Gateway, a bezpośrednie korzystanie z publicznych narzędzi AI w przeglądarce - Gateway Application Granular Controls. Czwartym kanałem są wychodzące wiadomości e-mail w Microsoft 365, skanowane przez dodatek do Outlooka.
Każdy z tych czterech kanałów korzysta z tych samych profili DLP. Reguła skonfigurowana raz - na przykład wykrywająca numery kart płatniczych - działa wszędzie tam, gdzie ją podłączysz, bez potrzeby ponownego definiowania jej od zera.
Jak działa Cloudflare DLP: profile detekcji
Profil DLP definiuje, czego Cloudflare ma szukać w ruchu. Składa się z reguł detekcji, czyli gotowej logiki wykrywania: wzorców regex, gotowych detekcji utrzymywanych przez Cloudflare, zestawów danych do Exact Data Match, odcisków dokumentów oraz tematów promptów AI. Opcjonalnie profil może dodatkowo korzystać z klas danych i etykiet, które porządkują wyniki w ramach szerszej klasyfikacji danych.
Domyślnie skanowana treść nigdy nie trafia na dysk. Cloudflare szyfruje ją i przechowuje tymczasowo tylko w pamięci, do momentu podjęcia decyzji o dopasowaniu. Żeby zachować kopię do przeglądu, trzeba świadomie włączyć logowanie payloadu z osobnym kluczem szyfrującym albo skonfigurować eksport do Logpush.
Co faktycznie wykrywają profile detekcji
Profile predefiniowane to gotowe zestawy utrzymywane przez Cloudflare. Obejmują dane finansowe (numery kart płatniczych z walidacją algorytmem Luhna), dane zdrowotne, klucze i sekrety (AWS, Azure, GCP, SSH, tokeny API Cloudflare), pliki HAR bez oczyszczenia, kod źródłowy w kilkunastu językach programowania, krajowe numery identyfikacyjne z ponad dziesięciu krajów (między innymi Australii, Kanady, Francji, Hongkongu, Indonezji, Malezji, Filipin, Singapuru, Tajwanu, Tajlandii, Wielkiej Brytanii i USA) oraz pięć wariantów ochrony promptów AI: bezpieczeństwo, dane klienta, informacje finansowe, PII i dane techniczne.
Osobny profil, PII Record, ma nietypową logikę dopasowania: uznaje trafienie dopiero, gdy w bliskiej odległości od siebie znajdzie co najmniej trzy różne rodzaje danych osobowych. To wyraźnie ogranicza liczbę fałszywych alarmów w porównaniu z pojedynczymi dopasowaniami.
Można też stworzyć własny profil detekcji, dopasowany do danych i ryzyka firmy. Osobną opcją jest profil integracyjny, korzystający z klasyfikacji zewnętrznej platformy, na przykład etykiet Microsoft Purview, i wymagający Cloudflare CASB.
Reguły, progi detekcji i logi: jak ograniczyć fałszywe alarmy
Dwa ustawienia profilu pozwalają dopasować czułość detekcji do realiów organizacji. Match count ustawia próg liczby dopasowań, zanim reguła w ogóle zadziała. Confidence threshold określa, ile słów kontekstowych w pobliżu musi się zgadzać: niski próg łapie więcej przypadków, ale generuje więcej szumu, wysoki próg jest bardziej selektywny.
W praktyce dobrym punktem startowym jest reguła z akcją Allow, która loguje każde dopasowanie profilu bez blokowania niczego. Dopiero gdy dane z logów potwierdzą skalę problemu, dokłada się drugą regułę z akcją Block dla wysokiego poziomu pewności.
Logi domyślnie maskują dopasowane wartości: numer 123-45-6789 zamienia się w XXX-XX-XXXX. Pełny payload można zachować tylko po skonfigurowaniu osobnego klucza szyfrującego, a Cloudflare nie jest w stanie go odszyfrować bez klucza prywatnego po stronie klienta. Do poprawy trafności DLP wykorzystuje też analizę kontekstu AI: zredagowany fragment tekstu wokół dopasowania trafia jako wektor, a nie jako surowy tekst, do Workers AI i jest przechowywany do sześciu miesięcy w prywatnej przestrzeni konta, razem z historią zgłoszeń fałszywych i prawdziwych dopasowań.
Dostępność, koszt i ograniczenia
Pełny Cloudflare DLP to płatny dodatek do planu Zero Trust Enterprise. Konta na planach Free i Pay-as-you-go mają jednak darmowy dostęp do dwóch gotowych profili: danych finansowych oraz krajowych numerów identyfikacyjnych. Dodatkowo mogą korzystać z logowania payloadu i zgłaszania fałszywych dopasowań. Pozostałe sześć profili predefiniowanych, możliwość tworzenia własnych profili detekcji oraz profile integracyjne wymagają już pełnej subskrypcji.
DLP skanuje tekst, pliki CSV, dokumenty Microsoft Office 2007 i nowsze (docx, xlsx, pptx), PDF-y oraz archiwa ZIP, w tym spakowane rekurencyjnie do dziesięciu poziomów. Skanowanie treści obrazów - na przykład zrzutu ekranu z numerem karty czy zeskanowanego dokumentu - wymaga osobno włączonej funkcji OCR, która najpierw wyodrębnia tekst z obrazu, zanim trafi on do właściwego skanowania DLP.
Trzeba też wiedzieć, gdzie kończy się rola tego narzędzia. DLP wykrywa obecność konkretnych, wrażliwych danych w treści - nie chroni natomiast przed atakami na same modele językowe, takimi jak prompt injection czy próby obejścia zabezpieczeń modelu. Ten obszar pokrywa osobny produkt, Cloudflare AI Security for Apps, i oba mechanizmy można stosować równolegle na tym samym ruchu.
Jak ICWT pomaga
Wdrożenie DLP to więcej niż włączenie gotowego profilu. W ICWT pomagamy klientom dobrać profile i progi detekcji adekwatne do branży i przepisów, na przykład RODO czy NIS2, zbudować własne profile detekcji pod konkretne dane firmowe, oraz rozłożyć wdrożenie tak, żeby zacząć od widoczności (Allow i log), a dopiero potem przejść do blokowania - niezależnie od tego, czy chodzi o ruch HTTP, SaaS, e-mail czy prompty do modeli AI. Jeśli chcesz sprawdzić, jak to wygląda w Waszej infrastrukturze, skontaktuj się z nami.
Źródła
- Cloudflare One - Data loss prevention (Overview)
- Cloudflare One - DLP profiles
- Cloudflare One - Predefined profiles
- Cloudflare One - Configure detection entries
- Cloudflare One - Profile settings (match count, confidence thresholds)
- Cloudflare One - DLP logging options
- Cloudflare One - Scan SaaS applications with DLP (CASB)
- Cloudflare One - Integration profiles
- Cloudflare One - Common DLP policies
- Cloudflare One - About the Cloudflare One Client
- Ponemon Institute / DTEX - 2026 Cost of Insider Risks Global Report
Najczęściej zadawane pytania
Czy DLP wymaga osobnej subskrypcji?
Pełna funkcjonalność DLP to płatny dodatek do Zero Trust Enterprise. Dwa gotowe profile - dane finansowe i krajowe numery identyfikacyjne - są jednak dostępne za darmo na planach Free i Pay-as-you-go, razem z logowaniem payloadu i zgłaszaniem fałszywych dopasowań.
Czy Cloudflare przechowuje skanowaną treść?
Nie domyślnie. Skanowana treść jest szyfrowana i przechowywana tylko tymczasowo w pamięci. Trwałą kopię zachowuje się wyłącznie po świadomym włączeniu logowania payloadu z własnym kluczem szyfrującym albo po skonfigurowaniu eksportu do Logpush.
Czym różni się DLP od AI Security for Apps?
DLP wykrywa obecność konkretnych, wrażliwych danych - numerów kart, danych osobowych, kodu źródłowego - w treści zapytań i odpowiedzi. AI Security for Apps chroni przed atakami typowymi dla dużych modeli językowych, na przykład prompt injection czy próbami obejścia zabezpieczeń modelu. Oba mechanizmy się uzupełniają i można ich używać jednocześnie na tym samym ruchu.
Jak DLP radzi sobie z fałszywymi alarmami?
Dwoma ustawieniami: match count, czyli minimalną liczbą dopasowań, zanim reguła w ogóle zadziała, oraz confidence threshold, czyli wymaganą liczbą słów kontekstowych w pobliżu dopasowania. Dobrą praktyką jest też zacząć od reguły z akcją Allow, która tylko loguje dopasowania, i dopiero na tej podstawie kalibrować regułę blokującą.
Czy DLP skanuje całe pliki czy tylko tekst?
DLP skanuje treść tekstową plików tekstowych, CSV, dokumentów Microsoft Office 2007 i nowszych, PDF-ów oraz archiwów ZIP, rekurencyjnie do dziesięciu poziomów. Skanowanie obrazów wymaga osobno włączonej funkcji OCR, która najpierw wyodrębnia z nich tekst.
Jak DLP łączy się z AI Gateway?
AI Gateway korzysta z tych samych profili DLP co reszta Cloudflare One - konfiguruje się je raz i można ich używać zarówno do skanowania promptów i odpowiedzi modeli AI, jak i do ruchu HTTP czy plików w SaaS. Więcej o tym w artykule o Cloudflare AI Gateway.