Przejdź do treści głównej

Cloudflare DLP: ile danych wycieka, zanim ktoś to zauważy

Bartosz Cybersecurity Engineer
6 min czytania
Cloudflare DLP: ile danych wycieka, zanim ktoś to zauważy

Firmowe dane nie wyciekają już jedną, dobrze znaną drogą. Wychodzą wszędzie tam, gdzie pracownicy dziś pracują, a większość organizacji dowiaduje się o skali problemu dopiero po fakcie, kiedy incydent jest już kosztowny. Cloudflare DLP to sposób, żeby zobaczyć ten problem, zanim urośnie do rozmiarów incydentu. Pokazujemy, jak to działa w praktyce: od profili, przez progi wykrywania, po logi.

Ile kosztują incydenty wewnętrzne

Skalę problemu widać w liczbach. Według 2026 Cost of Insider Risks Global Report Ponemon Institute i DTEX, opartego na ankiecie wśród 354 organizacji, przeciętny roczny koszt incydentów wewnętrznych sięgnął w 2025 roku 19,5 mln dolarów, a sam koszt incydentów wynikających z niedbalstwa pracowników, a nie złych intencji, wzrósł rok do roku o 17%, do 10,3 mln dolarów. Organizacje z formalnym programem zarządzania ryzykiem wewnętrznym unikają średnio siedmiu incydentów rocznie i oszczędzają 8,2 mln dolarów, a 92% ankietowanych organizacji przyznaje, że GenAI zmieniło sposób, w jaki pracownicy uzyskują dostęp do danych i się nimi dzielą.

Skąd realnie wyciekają dane: cztery kanały

Cloudflare DLP monitoruje cztery kanały, którymi dane opuszczają organizację. Pierwszym jest ruch HTTP przechodzący przez Cloudflare Gateway - wymaga on włączonego filtrowania HTTP i deszyfrowania TLS, co w praktyce oznacza zainstalowanie na urządzeniu agenta Cloudflare One Client (dawniej WARP); bez tego DLP nie zobaczy treści zaszyfrowanego ruchu. Drugim są pliki przechowywane w aplikacjach SaaS, skanowane bezpośrednio przez API dzięki integracji CASB, niezależnie od ustawień Gateway. Trzecim są prompty i odpowiedzi wysyłane do modeli AI: ruch generowany przez własne aplikacje i automatyzacje, które wywołują API dostawców wprost z kodu, obsługuje Cloudflare AI Gateway, a bezpośrednie korzystanie z publicznych narzędzi AI w przeglądarce - Gateway Application Granular Controls. Czwartym kanałem są wychodzące wiadomości e-mail w Microsoft 365, skanowane przez dodatek do Outlooka.

Każdy z tych czterech kanałów korzysta z tych samych profili DLP. Reguła skonfigurowana raz - na przykład wykrywająca numery kart płatniczych - działa wszędzie tam, gdzie ją podłączysz, bez potrzeby ponownego definiowania jej od zera.

Jak działa Cloudflare DLP: profile detekcji

Profil DLP definiuje, czego Cloudflare ma szukać w ruchu. Składa się z reguł detekcji, czyli gotowej logiki wykrywania: wzorców regex, gotowych detekcji utrzymywanych przez Cloudflare, zestawów danych do Exact Data Match, odcisków dokumentów oraz tematów promptów AI. Opcjonalnie profil może dodatkowo korzystać z klas danych i etykiet, które porządkują wyniki w ramach szerszej klasyfikacji danych.

Domyślnie skanowana treść nigdy nie trafia na dysk. Cloudflare szyfruje ją i przechowuje tymczasowo tylko w pamięci, do momentu podjęcia decyzji o dopasowaniu. Żeby zachować kopię do przeglądu, trzeba świadomie włączyć logowanie payloadu z osobnym kluczem szyfrującym albo skonfigurować eksport do Logpush.

Co faktycznie wykrywają profile detekcji

Profile predefiniowane to gotowe zestawy utrzymywane przez Cloudflare. Obejmują dane finansowe (numery kart płatniczych z walidacją algorytmem Luhna), dane zdrowotne, klucze i sekrety (AWS, Azure, GCP, SSH, tokeny API Cloudflare), pliki HAR bez oczyszczenia, kod źródłowy w kilkunastu językach programowania, krajowe numery identyfikacyjne z ponad dziesięciu krajów (między innymi Australii, Kanady, Francji, Hongkongu, Indonezji, Malezji, Filipin, Singapuru, Tajwanu, Tajlandii, Wielkiej Brytanii i USA) oraz pięć wariantów ochrony promptów AI: bezpieczeństwo, dane klienta, informacje finansowe, PII i dane techniczne.

Osobny profil, PII Record, ma nietypową logikę dopasowania: uznaje trafienie dopiero, gdy w bliskiej odległości od siebie znajdzie co najmniej trzy różne rodzaje danych osobowych. To wyraźnie ogranicza liczbę fałszywych alarmów w porównaniu z pojedynczymi dopasowaniami.

Można też stworzyć własny profil detekcji, dopasowany do danych i ryzyka firmy. Osobną opcją jest profil integracyjny, korzystający z klasyfikacji zewnętrznej platformy, na przykład etykiet Microsoft Purview, i wymagający Cloudflare CASB.

Reguły, progi detekcji i logi: jak ograniczyć fałszywe alarmy

Dwa ustawienia profilu pozwalają dopasować czułość detekcji do realiów organizacji. Match count ustawia próg liczby dopasowań, zanim reguła w ogóle zadziała. Confidence threshold określa, ile słów kontekstowych w pobliżu musi się zgadzać: niski próg łapie więcej przypadków, ale generuje więcej szumu, wysoki próg jest bardziej selektywny.

W praktyce dobrym punktem startowym jest reguła z akcją Allow, która loguje każde dopasowanie profilu bez blokowania niczego. Dopiero gdy dane z logów potwierdzą skalę problemu, dokłada się drugą regułę z akcją Block dla wysokiego poziomu pewności.

Logi domyślnie maskują dopasowane wartości: numer 123-45-6789 zamienia się w XXX-XX-XXXX. Pełny payload można zachować tylko po skonfigurowaniu osobnego klucza szyfrującego, a Cloudflare nie jest w stanie go odszyfrować bez klucza prywatnego po stronie klienta. Do poprawy trafności DLP wykorzystuje też analizę kontekstu AI: zredagowany fragment tekstu wokół dopasowania trafia jako wektor, a nie jako surowy tekst, do Workers AI i jest przechowywany do sześciu miesięcy w prywatnej przestrzeni konta, razem z historią zgłoszeń fałszywych i prawdziwych dopasowań.

Dostępność, koszt i ograniczenia

Pełny Cloudflare DLP to płatny dodatek do planu Zero Trust Enterprise. Konta na planach Free i Pay-as-you-go mają jednak darmowy dostęp do dwóch gotowych profili: danych finansowych oraz krajowych numerów identyfikacyjnych. Dodatkowo mogą korzystać z logowania payloadu i zgłaszania fałszywych dopasowań. Pozostałe sześć profili predefiniowanych, możliwość tworzenia własnych profili detekcji oraz profile integracyjne wymagają już pełnej subskrypcji.

DLP skanuje tekst, pliki CSV, dokumenty Microsoft Office 2007 i nowsze (docx, xlsx, pptx), PDF-y oraz archiwa ZIP, w tym spakowane rekurencyjnie do dziesięciu poziomów. Skanowanie treści obrazów - na przykład zrzutu ekranu z numerem karty czy zeskanowanego dokumentu - wymaga osobno włączonej funkcji OCR, która najpierw wyodrębnia tekst z obrazu, zanim trafi on do właściwego skanowania DLP.

Trzeba też wiedzieć, gdzie kończy się rola tego narzędzia. DLP wykrywa obecność konkretnych, wrażliwych danych w treści - nie chroni natomiast przed atakami na same modele językowe, takimi jak prompt injection czy próby obejścia zabezpieczeń modelu. Ten obszar pokrywa osobny produkt, Cloudflare AI Security for Apps, i oba mechanizmy można stosować równolegle na tym samym ruchu.

Jak ICWT pomaga

Wdrożenie DLP to więcej niż włączenie gotowego profilu. W ICWT pomagamy klientom dobrać profile i progi detekcji adekwatne do branży i przepisów, na przykład RODO czy NIS2, zbudować własne profile detekcji pod konkretne dane firmowe, oraz rozłożyć wdrożenie tak, żeby zacząć od widoczności (Allow i log), a dopiero potem przejść do blokowania - niezależnie od tego, czy chodzi o ruch HTTP, SaaS, e-mail czy prompty do modeli AI. Jeśli chcesz sprawdzić, jak to wygląda w Waszej infrastrukturze, skontaktuj się z nami.

Źródła

Tagi:
#Cloudflare #DLP #Zero Trust #Data Loss Prevention #Bezpieczeństwo danych #CASB

Najczęściej zadawane pytania

Czy DLP wymaga osobnej subskrypcji?

Pełna funkcjonalność DLP to płatny dodatek do Zero Trust Enterprise. Dwa gotowe profile - dane finansowe i krajowe numery identyfikacyjne - są jednak dostępne za darmo na planach Free i Pay-as-you-go, razem z logowaniem payloadu i zgłaszaniem fałszywych dopasowań.

Czy Cloudflare przechowuje skanowaną treść?

Nie domyślnie. Skanowana treść jest szyfrowana i przechowywana tylko tymczasowo w pamięci. Trwałą kopię zachowuje się wyłącznie po świadomym włączeniu logowania payloadu z własnym kluczem szyfrującym albo po skonfigurowaniu eksportu do Logpush.

Czym różni się DLP od AI Security for Apps?

DLP wykrywa obecność konkretnych, wrażliwych danych - numerów kart, danych osobowych, kodu źródłowego - w treści zapytań i odpowiedzi. AI Security for Apps chroni przed atakami typowymi dla dużych modeli językowych, na przykład prompt injection czy próbami obejścia zabezpieczeń modelu. Oba mechanizmy się uzupełniają i można ich używać jednocześnie na tym samym ruchu.

Jak DLP radzi sobie z fałszywymi alarmami?

Dwoma ustawieniami: match count, czyli minimalną liczbą dopasowań, zanim reguła w ogóle zadziała, oraz confidence threshold, czyli wymaganą liczbą słów kontekstowych w pobliżu dopasowania. Dobrą praktyką jest też zacząć od reguły z akcją Allow, która tylko loguje dopasowania, i dopiero na tej podstawie kalibrować regułę blokującą.

Czy DLP skanuje całe pliki czy tylko tekst?

DLP skanuje treść tekstową plików tekstowych, CSV, dokumentów Microsoft Office 2007 i nowszych, PDF-ów oraz archiwów ZIP, rekurencyjnie do dziesięciu poziomów. Skanowanie obrazów wymaga osobno włączonej funkcji OCR, która najpierw wyodrębnia z nich tekst.

Jak DLP łączy się z AI Gateway?

AI Gateway korzysta z tych samych profili DLP co reszta Cloudflare One - konfiguruje się je raz i można ich używać zarówno do skanowania promptów i odpowiedzi modeli AI, jak i do ruchu HTTP czy plików w SaaS. Więcej o tym w artykule o Cloudflare AI Gateway.