Bezpieczeństwo, prywatność i etyka AI
- Znasz politykę prywatności i data retention Anthropic
- Wiesz, co wolno, a czego nie wrzucać do AI
- Rozumiesz podstawy EU AI Act
- Potrafisz wykrywać i zapobiegać halucynacjom
Data retention - jak długo Anthropic przechowuje dane
| Plan | Retencja | Trening AI |
|---|---|---|
| Free, Pro, Max (opt-in) | Do 5 lat (dane zdeidentyfikowane) | TAK |
| Free, Pro, Max (opt-out) | 30 dni (usunięta rozmowa znika z historii od razu, a z systemów Anthropic w ciągu 30 dni) | NIE |
| Team | Czaty zostają, dopóki ich nie usuniesz; usunięte znikają z systemów Anthropic w ciągu 30 dni | Domyślnie NIE (wyjątek: ocena kciukiem) |
| Enterprise | Domyślnie bezterminowo; Owner (właściciel konta firmy) może ustawić własny okres, minimum 30 dni | Domyślnie NIE (wyjątek: ocena kciukiem) |
| API | Wejścia i wyjścia usuwane w ciągu 30 dni; przy umowie ZDR nic nie zostaje po zwróceniu odpowiedzi | Domyślnie NIE (tylko za wyraźną zgodą) |
ZDR (zero data retention) to umowa, przy której Anthropic nie przechowuje promptów ani odpowiedzi po zwróceniu wyniku. Funkcje, które z natury wymagają przechowywania, mają własne zasady: pliki wgrane przez Files API, Batch API (29 dni) i Covered Models (minimum 30 dni, opis niżej). Anthropic może trzymać do 2 lat treści oznaczone przez systemy bezpieczeństwa, także przy umowie ZDR. Własnego okresu retencji nie ustawisz na Team - to funkcja Enterprise (stan na 1 października 2026).
Najważniejsze zasady:
- Dane z API domyślnie nie trafiają do treningu. Wyjątek: wyraźna zgoda, np. w umowie albo przez udział w programie Development Partner. W tym programie firma sama zgadza się udostępnić dane do ulepszania modeli
- Usunięta rozmowa nie trafi do treningu kolejnych modeli. Zostaje tylko w treningach, które już trwają, i w modelach już wytrenowanych
- Team i Enterprise - dane domyślnie nie trafiają do treningu. Wyjątek: rozmowa, którą ocenisz kciukiem w górę lub w dół, albo inna wyraźna zgoda. Administrator może wyłączyć ocenianie ustawieniem Rate chats
- Anthropic nie sprzedaje danych stronom trzecim
Wyjątek - najmocniejsze modele. Claude Fable 5.1, Mythos 5.1, Fable 5 i Mythos 5 to tzw. „Covered Models”. Wymagają minimum 30-dniowej retencji danych i nie działają w trybie ZDR, chyba że Anthropic wyrazi na to wyraźną zgodę. Firmy z umową ZDR muszą dla tych modeli włączyć 30-dniową retencję w wybranym workspace (obszarze roboczym konsoli API) albo używać modeli spoza tej listy. Pod ZDR działają m.in. Opus 5.5, Sonnet 5.5 i Haiku 4.5, a także starsze Opus 5 i Sonnet 5.
Komunikat Anthropic z 1 września 2026 zapowiada Enterprise Frontier Safeguards (EFS). To połączenie prywatności ZDR z zabezpieczeniami przed nadużyciami, w którym dane leżą w chmurze kontrolowanej przez klienta, a nie przez Anthropic. Do startu EFS uprawnieni klienci firmowi dostają ZDR także na Fable 5 i Fable 5.1. Stan na 1 października 2026: EFS nadal jest zapowiedzią na jesień 2026, z wdrożeniem etapami.
Do zapamiętania: Wybór „trening: tak/nie” dotyczy wszystkich planów konsumenckich (Free, Pro, Max). Dokonujesz go przy pierwszym logowaniu i w każdej chwili zmienisz w Settings → Privacy. Opt-in oznacza retencję do 5 lat (tylko dla nowych lub wznowionych rozmów), opt-out - 30 dni. Czaty incognito nigdy nie trafiają do treningu. Stan na 1 października 2026: obowiązuje polityka prywatności z 10 września 2026. Względem poprzedniej wersji z 8 lipca 2026 zmieniły się tylko zapisy dla Korei Południowej. Liczby i zasada opt-out zostały bez zmian.
Co wrzucać, a czego nie
NIGDY nie wrzucaj:
- Haseł, kluczy API, tokenów
- Numerów PESEL, dowodów osobistych, paszportów
- Danych bankowych (numery kart, kont)
- Poufnych umów z klauzulą NDA
- Danych medycznych pacjentów (wyjątek: plan Enterprise w trybie HIPAA-ready, czyli zgodnym z amerykańską ustawą o danych medycznych; Free, Pro, Max i Team tego trybu nie włączą). HIPAA nie zastępuje RODO: w Polsce dane o zdrowiu to szczególna kategoria danych osobowych (art. 9 RODO)
- Danych osobowych klientów bez podstawy prawnej
Bezpiecznie wrzucasz:
- Własne teksty do edycji
- Publicznie dostępne dane
- Zanonimizowane dane (bez imion, adresów, identyfikatorów)
- Kod open-source
- Własne notatki i pomysły
Strefa szara (zależy od planu i polityki firmy):
- Wewnętrzne raporty → moim zdaniem OK na Team/Enterprise: trening jest tam domyślnie wyłączony, a Anthropic działa jako podmiot przetwarzający na podstawie umowy z firmą. Na Free to ryzykowne, bo o treningu decydujesz sam
- Kod firmowy → moja ocena: akceptowalne na Pro z opt-out, bezpieczniej przez API. Pamiętaj, że nawet po opt-out rozmowy oznaczone przez filtry bezpieczeństwa mogą posłużyć Anthropic do prac nad bezpieczeństwem. Na koncie Pro stroną umowy jesteś Ty, nie Twoja firma
- Dane klientów → tylko po anonimizacji
Konto osobiste vs firmowe
| Aspekt | Konto osobiste | Konto firmowe (Team/Enterprise) |
|---|---|---|
| Retencja | Opt-out: do usunięcia przez użytkownika, potem do 30 dni w systemach Anthropic; opt-in: do 5 lat | Team: do usunięcia przez użytkownika, potem do 30 dni w systemach Anthropic. Enterprise: domyślnie bezterminowo, własny okres od 30 dni |
| Trening AI | Możliwy (opt-in) | Domyślnie nie |
| Admin control | Brak | Team: logowanie kontem firmowym (SSO), automatyczne zakładanie kont (JIT), limity wydatków. Enterprise: dodatkowo synchronizacja kont z katalogiem firmy (SCIM), dziennik zdarzeń (audit logs), Compliance API (dostęp do danych dla działu zgodności), role z własnymi uprawnieniami (RBAC), własna retencja |
| Compliance | RODO; w EOG administratorem danych jest Anthropic Ireland, Limited | Anthropic jako podmiot przetwarzający (umowa powierzenia danych). Certyfikaty: SOC 2 Type I i II, ISO 27001:2022, ISO/IEC 42001:2023. HIPAA-ready tylko Enterprise |
SOC 2 to raport z niezależnego audytu zabezpieczeń. ISO 27001 i ISO/IEC 42001 to normy, na zgodność z którymi firma przechodzi certyfikację. Pierwsza dotyczy bezpieczeństwa informacji, druga zarządzania systemami AI. Na koncie firmowym pamiętaj o jednym: czaty incognito też trafiają do eksportu danych organizacji, do którego dostęp mają Ownerzy.
Rekomendacja: Do pracy z danymi firmowymi - minimum Team Standard ($25/os./mies., $20 przy rozliczeniu rocznym; wariant Premium: $125/os./mies., $100 przy rozliczeniu rocznym) lub API. Potrzebujesz własnego okresu retencji, SCIM, dziennika zdarzeń albo HIPAA? To już Enterprise: $20 za miejsce miesięcznie przy rozliczeniu rocznym plus zużycie po stawkach API, minimum 20 miejsc (stan na 1 października 2026).
EU AI Act - co musisz wiedzieć
EU AI Act to pierwsza na świecie pełna regulacja AI. Wchodzi w życie etapami. Stan na 1 października 2026:
- Luty 2025: Zakaz AI do social scoring (punktowej oceny ludzi za zachowanie), manipulacji i identyfikacji biometrycznej w czasie rzeczywistym w przestrzeni publicznej przez organy ścigania, z wyjątkami (art. 5). Od tej samej daty obowiązuje AI literacy, czyli budowanie kompetencji w zakresie AI (art. 4, uproszczony przez omnibus). Krajowe organy egzekwują ten obowiązek od sierpnia 2026
- Sierpień 2025: Obowiązki dla modeli AI ogólnego przeznaczenia (GPAI, jak Claude) - transparentność, dokumentacja. Modele GPAI wydane przed 2 sierpnia 2025 mają czas do 2 sierpnia 2027
- Sierpień 2026: Większość pozostałych przepisów, w tym art. 50 (przejrzystość) oraz kary krajowe (art. 99) i kary dla dostawców GPAI (art. 101). Dla GPAI sierpień 2026 to start sankcji, nie nowe obowiązki
- Grudzień 2026: Zakaz aplikacji „nudify” (cyfrowo rozbierających ludzi na zdjęciach) i systemów generujących CSAM, czyli materiały przedstawiające wykorzystywanie seksualne dzieci (nowe art. 5 ust. 1 lit. ba i bb), od 2 grudnia 2026. Tego samego dnia kończy się okres przejściowy na oznaczanie treści (art. 50 ust. 2) dla systemów sprzed 2 sierpnia 2026
- Sierpień 2027: Do 2 sierpnia 2027 każde państwo UE ma uruchomić co najmniej jedną piaskownicę regulacyjną AI, czyli przestrzeń do testowania systemów pod okiem regulatora
- Systemy wysokiego ryzyka: dwa terminy, nie jeden. Pakiet AI Omnibus to rozporządzenie (UE) 2026/1744 z 8 lipca 2026, opublikowane w Dzienniku Urzędowym UE 24 lipca 2026 i w mocy od 27 lipca 2026. Zmienia 42 artykuły i 3 załączniki AI Act. Systemy z Załącznika III (biometria, infrastruktura krytyczna, edukacja, zatrudnienie, migracja) - 2 grudnia 2027 (pierwotnie 2 sierpnia 2026). Systemy wbudowane w produkty z Załącznika I - 2 sierpnia 2028 (pierwotnie 2 sierpnia 2027)
Art. 50 - przejrzystość - obowiązuje od 2 sierpnia 2026. Cztery obowiązki: informujesz, że rozmówca gada z AI; treści syntetyczne (tekst, obraz, audio, wideo) mają być oznaczone w sposób odczytywalny maszynowo; informujesz przy rozpoznawaniu emocji i kategoryzacji biometrycznej; ujawniasz deepfake'i i teksty AI publikowane w sprawach interesu publicznego (chyba że przeszły redakcyjną kontrolę człowieka). Systemy uruchomione przed 2 sierpnia 2026 mają na obowiązek oznaczania (art. 50 ust. 2) czas do 2 grudnia 2026 (art. 111 ust. 4). Praktyczne wskazówki dają wytyczne Komisji Europejskiej do art. 50 (opublikowane 20 lipca 2026) i dobrowolny kodeks Code of Practice on Transparency of AI-Generated Content (wersja ostateczna z 10 czerwca 2026).
Polska. Ustawa z 3 lipca 2026 o systemach sztucznej inteligencji (Dz.U. 2026 poz. 1003, ogłoszona 27 lipca 2026) weszła w życie 11 sierpnia 2026. Nie cała naraz. 28 października 2026 zaczynają obowiązywać art. 8-18 (opinie indywidualne) oraz rozdziały 3-5, 8 i 9: kontrola, postępowanie przed organem nadzoru rynku, układ w sprawie złagodzenia sankcji, kary pieniężne i przepisy karne, zmiany w innych ustawach.
Organ nadzoru to Komisja Rozwoju i Bezpieczeństwa Sztucznej Inteligencji, w skrócie KRiBSI (art. 5 ust. 1-2) - organ nadzoru rynku i pojedynczy punkt kontaktowy. Przewodniczącą została Pamela Krzypkowska: Sejm powołał ją 18 września 2026, Senat wyraził zgodę 24 września, kadencja trwa 5 lat. W składzie Komisji są też 2 zastępców i 4 członków wskazanych przez Prezesa UOKiK, KNF, KRRiT i Prezesa UKE. Pierwsze posiedzenie przewodnicząca ma zwołać w ciągu 3 miesięcy od wejścia ustawy w życie, czyli do ok. 11 listopada 2026. Ministerstwo Cyfryzacji zapowiada start działalności Komisji w listopadzie.
Ustawa przewiduje piaskownice regulacyjne - dla małych i średnich firm (MŚP) udział jest nieodpłatny. Od 28 października złożysz też wniosek o opinię indywidualną: 150 zł, odpowiedź w 30 dni, a w sprawach szczególnie skomplikowanych w 60. Brak opinii w terminie oznacza opinię zgodną ze stanowiskiem z Twojego wniosku. Masz wątpliwość, czy Twój system jest „wysokiego ryzyka”? To tańsze niż godzina kancelarii.
Klasy ryzyka:
- Niedopuszczalne - zakazane (social scoring, manipulacja)
- Wysokie ryzyko - ścisła regulacja (rekrutacja, kredyty, medycyna)
- Ograniczone ryzyko - obowiązek transparentności (chatboty - muszą informować, że to AI; treści syntetyczne - oznaczanie z art. 50, w mocy od 2 sierpnia 2026)
- Minimalne ryzyko - bez ograniczeń (większość zastosowań biznesowych)
Do zapamiętania: Jeśli używasz Claude do generowania treści marketingowych, analizy danych czy kodowania, Twoje zastosowanie zwykle mieści się w klasie „minimalne ryzyko”. Oznaczenie treści syntetycznych (art. 50 ust. 2) to obowiązek dostawcy systemu, w claude.ai - Anthropic. Sam ujawniasz deepfake'i oraz teksty AI publikowane w sprawach interesu publicznego, chyba że tekst przeszedł redakcyjną kontrolę człowieka. Jeśli jednak budujesz system, który automatycznie ocenia CV kandydatów lub podejmuje decyzje kredytowe - to już „wysokie ryzyko” z obowiązkami regulacyjnymi.
Znak wodny i Content Credentials - jak Anthropic odpowiada na art. 50. Stan na 1 października 2026: na powierzchniach Anthropic (API, claude.ai, Claude Code, Cowork, Claude Tag) tekst z ośmiu modeli Claude niesie statystyczny znak wodny. To wariant metody SynthID-Text. Od premiery znakują Fable 5.1, Mythos 5.1, Opus 5.5 i Sonnet 5.5. Opus 5 dołączył 16 września 2026, a Fable 5, Opus 4.8 i Sonnet 5 - 1 października 2026. Bez znaku w tekście zostają Haiku 4.5, Mythos 5, Opus 4.7, 4.6 i 4.5 oraz Sonnet 4.6 i 4.5. Do tekstu nic nie jest dodawane, nie ma ukrytych znaków, nie ma dopłaty. Brak udokumentowanego wyłącznika dla użytkownika.
Obrazy, wideo i audio, które tworzy Claude, dostają podpisane Content Credentials C2PA, czyli metadane o pochodzeniu pliku - niezależnie od modelu. PDF, DOCX i TXT podpisu nie mają. Sprawdzanie plików: darmowy Claude Content Checker (claude.com/check-files). Detekcja w tekście to na razie prywatny preview (dostęp testowy na wniosek) dla regulatorów, mediów, badaczy i firm z własnymi obowiązkami z AI Act - komercyjne „detektory AI” znaku nie czytają.
Pamiętaj: jako wdrożeniowiec na API nadal sam oceniasz swoje obowiązki z art. 50. Pełny opis metody, słabych punktów i narzędzi znajdziesz w lekcji o znaku wodnym i C2PA.
Halucynacje - jak wykrywać i zapobiegać
Halucynacja to sytuacja, gdy AI generuje informacje wyglądające wiarygodnie, ale nieprawdziwe. Claude nie jest na nie odporny. Spójrz na niezależny test wiarygodności wiedzy AA-Omniscience (Artificial Analysis, stan na 2 października 2026). Claude Opus 5.5 (max) ma w nim najwyższy łączny wynik: 46 pkt wobec 43 pkt GPT-6 Astra (max) od OpenAI i 42 pkt Gemini 4 Argon od Google. Prowadzi, bo najczęściej odpowiada poprawnie.
Gdy jednak nie zna odpowiedzi, częściej niż konkurenci zgaduje, zamiast przyznać się do niewiedzy. Wskaźnik halucynacji mówi, jak często model odpowiada błędnie, choć powinien przyznać, że nie wie. Opus 5.5 ma 59%, GPT-6 Astra 51%, a Gemini 4 Argon 15% (na razie w ograniczonym dostępie). Rankingi zmieniają się z każdą premierą, więc traktuj te liczby jak migawkę.
W lekcji o prompt debugging omówiłem 7 technik z oficjalnej strony Anthropic „Reduce hallucinations” i kilka dodatkowych. Najważniejsze zasady do zapamiętania:
- Daj Claude pozwolenie na „nie wiem” - przy takim wskaźniku halucynacji to pierwsza rzecz do dopisania w prompcie
- Wymagaj cytatów z dostarczonych dokumentów
- Ogranicz zakres odpowiedzi do dostarczonych źródeł
- Przy ważnej odpowiedzi zadaj to samo pytanie kilka razy i porównaj wyniki (technika Best-of-N). Rozbieżności to sygnał możliwej halucynacji
- Zawsze weryfikuj konkretne dane (daty, statystyki, URL-e) w zewnętrznych źródłach. Sam Anthropic zastrzega, że techniki ograniczają halucynacje, ale ich nie eliminują
Druga strona medalu - niepotrzebne odmowy. Model bywa nadmiernie ostrożny i odmawia odpowiedzi na całkowicie legalne pytanie. W testach Anthropic (karta systemowa) Claude Opus 5.5, premiera 22 września 2026, robi to bardzo rzadko: przy 0,03% łagodnych pytań w API i 0,38% w claude.ai. Opus 5 miał w tym samym teście 0,12% i 0,49% (w claude.ai różnica mieści się w granicach błędu). To odmowy samego modelu. Osobna sprawa to klasyfikatory, czyli automatyczne filtry. Te od cyberbezpieczeństwa Anthropic ustawił w Opusie 5.5 tymczasowo z szerszym marginesem bezpieczeństwa, dopóki nie ograniczy fałszywych alarmów. Dlatego takie pytania mogą częściej trafiać do innego modelu. Przy odmowie doprecyzuj kontekst i cel pytania.
Przełączanie modelu przez klasyfikator. Gdy filtr oznaczy wiadomość, Claude może sam przełączyć rozmowę na inny model (stan na 1 października 2026):
- Opus 5.5 i Opus 5: cyberbezpieczeństwo (exploity, skanowanie binariów, pentesty) → Opus 4.8
- Opus 5.5: biologia dual-use, czyli wiedza, którą da się użyć i do dobra, i do szkody (np. wirusologia, toksykologia), oraz pytania o budowę czołowych modeli AI → Opus 5
- Sonnet 5.5: cyberbezpieczeństwo i budowa czołowych modeli AI → Sonnet 5. Pytania z biologii są blokowane bez przełączenia
- Fable 5.1: cyberbezpieczeństwo → Opus 4.8, biologia → Opus 5
Próby wyciągnięcia toku rozumowania (destylacja, czyli kopiowanie umiejętności modelu) kończą się blokadą bez przełączenia. Przełączanie wyłączysz w Settings → Capabilities → „Switch models when a message is flagged” (w Claude Code: Config → MODEL & OUTPUT). W API ten mechanizm jest domyślnie wyłączony - trzeba go włączyć i skonfigurować (przełączanie po stronie serwera jest w becie).
Część odmów w API kosztuje. Od 24 września 2026 Anthropic znów nalicza opłatę za odmowę przed pierwszym tokenem odpowiedzi w trzech kategoriach: biologia, budowa czołowych modeli AI i wyciąganie toku rozumowania. Odmowy w kategorii cyberbezpieczeństwa i ogólnych szkód są bezpłatne.
Szczegółowy przewodnik po regulacjach AI znajdziesz w artykule EU AI Act - co musi wiedzieć marketer.
Co dalej
W następnej lekcji poznasz znak wodny w tekście Claude (osiem modeli, w tym Opus 5.5 i Sonnet 5.5), Content Credentials C2PA w plikach i sposób sprawdzenia pliku w Claude Content Checkerze.