Moduł 2 25 min Średniozaawansowany

Analiza plików i dokumentów

Czego się nauczysz
  • Znasz wszystkie obsługiwane formaty plików i ich limity
  • Potrafisz analizować PDF-y, CSV i obrazy w Claude
  • Wiesz, jak działa OCR i vision capabilities Claude
  • Stosujesz techniki efektywnej analizy dokumentów

Obsługiwane formaty

Claude przyjmuje w czacie dwie grupy plików (stan na 1 października 2026):

Dokumenty: PDF, DOCX, CSV, XLSX (wymaga włączonego Code execution and file creation), TXT, HTML, ODT, RTF, EPUB, JSON

Obrazy: JPEG, PNG, GIF, WebP (do 8000 x 8000 px). Animacji Claude nie obsługuje: z animowanego GIF-a bierze tylko pierwszą klatkę.

Wideo i audio: nie ma ich na liście. Wszystkie obecne modele Claude przyjmują na wejściu tekst i obrazy, a odpowiadają tekstem. Film przeanalizujesz w Gemini: w aplikacji 5 minut wideo za darmo, do 1 godziny na AI Pro i Ultra. ChatGPT też przyjmuje wideo, ale OpenAI zastrzega, że analiza może nie objąć całego nagrania.

Lista się zmienia. Zamiast uczyć się jej na pamięć, sprawdzaj wykaz w artykule pomocy Anthropic „Upload files to Claude” (support.claude.com, wersja z 23 lipca 2026). W tym kursie odświeżam go przy każdej aktualizacji.

Limity

ParametrWartość
Rozmiar per plik500 MB (upload w rozmowie; pliki wiedzy w Projects: 30 MB)
Pliki na czatdo 20 jednocześnie
PDFanaliza multimodalna (tekst + obraz) do 100 stron; odczyt tekstowy do 1000 stron
Obrazydo 8000 x 8000 px

Te liczby dotyczą czatu na claude.ai. Przy obrazach źródła Anthropic się różnią. Artykuł pomocy podaje 500 MB na plik, a dokumentacja dla programistów (strona Vision) tylko 10 MB na obraz w claude.ai. Duże zdjęcie zmniejsz więc przed wgraniem. Baza wiedzy w Projects rządzi się własnymi limitami - opisuję je w lekcji o Projects.

Jak wgrywać pliki

Cztery sposoby:

  1. Przycisk „+” w lewym dolnym rogu pola czatu, potem „Add files or photos”
  2. Drag & drop - przeciągnij plik na okno czatu
  3. Schowek - skopiuj obraz i wklej go do pola czatu (Ctrl+V, na Macu Cmd+V)
  4. Konektory - pliki z zewnętrznych źródeł bez ręcznego wgrywania: m.in. Google Drive, GitHub, Microsoft 365 i zdalne serwery MCP (MCP to protokół, przez który Claude łączy się z innymi aplikacjami)

Dostępność konektorów zależy od planu (stan na 1 października 2026). Microsoft 365 działa na wszystkich planach, także Free, ale tylko z kontem służbowym. Najpierw administrator Microsoft Entra (systemu kont służbowych Microsoftu) w Twojej firmie musi raz wyrazić zgodę na połączenie z Claude. Zapis (maile, kalendarz, pliki, wiadomości Teams) działa, gdy włączy go administrator. Na Free dodasz jeden własny konektor MCP. Slack jest tylko na Team i Enterprise. Claude edytuje też na żywo Dokumenty, Arkusze i Prezentacje Google w panelu obok czatu (beta, web i Desktop). Aktualną listę konektorów znajdziesz w claude.ai w Customize → Connectors.

Analiza PDF

Claude analizuje PDF-y, korzystając z vision capabilities (rozpoznawania obrazu) - widzi zarówno tekst, jak i elementy wizualne:

  • Tekst (OCR, czyli rozpoznawanie znaków - także ze skanów)
  • Tabele
  • Wykresy i grafy
  • Obrazy w dokumencie
  • Formatowanie i układ strony

Analiza multimodalna działa dla PDF-ów do 100 stron - dłuższe pliki (do 1000 stron) Claude czyta tylko w warstwie tekstowej. Wykres na stronie 340 raportu rocznego zobaczy więc jako podpis, nie jako obraz.

Claude potrafi też tworzyć i edytować pliki PDF. Stan na 1 października 2026: robi to przez wbudowany skill Anthropic do PDF, który wymaga włączonego przełącznika Code execution and file creation (Settings → Capabilities). W części artykułów pomocy Anthropic ten sam przełącznik nazywa się „Cloud code execution and file creation” - w ustawieniach szukaj obu nazw. Na planach płatnych dokument przygotujesz też w szablonie Claude Docs (beta) i wyeksportujesz do PDF, Worda, Markdown albo Google Docs.

Pro tip: PDF dłuższy niż 100 stron, w którym liczą się wykresy, podziel na części do 100 stron - wtedy Claude zobaczy też grafikę. Przy wielu dokumentach użyj Projects. Na planach płatnych, gdy wiedza projektu zbliża się do limitu okna kontekstu, Claude włącza tryb RAG: wyszukuje potrzebne fragmenty zamiast czytać całość. Według Anthropic zwiększa to pojemność projektu nawet 10 razy. Pojedynczy plik w projekcie może mieć do 30 MB.

Analiza CSV i Excel

Z włączonym Code execution and file creation (Settings → Capabilities) Claude:

  • Pisze i uruchamia kod w sandboxie, czyli odizolowanym środowisku (m.in. Python)
  • Czyści, eksploruje i przetwarza dane
  • Daje matematycznie precyzyjne wyniki (nie szacuje - oblicza)
  • Tworzy wizualizacje i dashboardy z danych
  • Generuje nowe pliki (CSV, XLSX, PDF) z przetworzonymi danymi

Nie musisz od razu prosić o artefakt. Wgraj CSV i zapytaj: „Co pokazują te dane?”. Claude może narysować interaktywny wykres prosto w odpowiedzi (custom visuals, beta, web i Desktop). Więcej w następnej lekcji.

Skills Anthropic do plików biurowych. Ten sam przełącznik odblokowuje cztery gotowe skille od Anthropic: Excel, Word, PowerPoint i PDF. Skill to folder z instrukcjami, skryptami i zasobami, który Claude ładuje na żądanie - dzięki temu arkusz z formułami albo prezentacja z 12 slajdami wychodzą w poprawnym formacie, a nie jako tekst do przeklejenia. Katalog skilli otworzysz w Customize → Skills → „+” → Browse skills, na wszystkich planach od Free wzwyż (stan na 1 października 2026). Więcej w lekcji o Skills i Plugins.

Częsty błąd: Wgranie CSV bez instrukcji, co Claude ma z nim zrobić. Zamiast „Oto moje dane” napisz: „Przeanalizuj ten CSV. Zidentyfikuj 3 główne trendy, oblicz średnią dla kolumny X i stwórz wykres pokazujący zmiany w czasie.”

Vision - co Claude widzi na obrazach

Claude rozpoznaje:

  • Obiekty, sceny i kontekst na zdjęciach
  • Tekst na obrazach (OCR) - także ze zdjęć zrobionych telefonem; przy obrazach rozmazanych, obróconych albo mniejszych niż 200 px może się mylić
  • Wykresy i dane wizualne
  • Diagramy techniczne, schematy, wireframes
  • Tabele na screenshotach
  • Interfejsy użytkownika (screenshoty aplikacji)

Ograniczenia (według dokumentacji Anthropic, stan na 1 października 2026):

  • Nie poda imion ani nazwisk osób ze zdjęcia. Odmówi, bo zabraniają tego zasady użytkowania Anthropic.
  • Nie oceni wiarygodnie, czy obraz wygenerowało AI. Do wykrywania fałszywek się nie nadaje.
  • Obiekty policzy tylko w przybliżeniu, zwłaszcza gdy jest ich dużo i są drobne.

Techniki efektywnej analizy dokumentów

1. Chain analysis (od ogółu do szczegółu)

Prompt 1: "Podsumuj ten dokument w 5 punktach."
Prompt 2: "Rozwiń punkt 3 - jakie konkretne dane go wspierają?"
Prompt 3: "Jakie wnioski wynikają z tych danych dla mojego biznesu?"

2. Porównanie dokumentów

Wgraj 2-3 pliki jednocześnie: „Porównaj te raporty. Wskaż najważniejsze różnice i sprzeczności.”

3. Ekstrakcja danych do tabeli

„Wyodrębnij z tego PDF wszystkie daty, kwoty i nazwy firm. Przedstaw jako tabelę.”

4. Podsumowanie wielopoziomowe

„Stwórz 3 wersje podsumowania: (1) TL;DR w 2 zdaniach, (2) Executive summary w 5 punktach, (3) Szczegółowa analiza z wnioskami.”

Ćwiczenie praktyczne: Wgraj 3 różne typy plików i przeanalizuj je:

1. PDF: Wgraj dowolny raport (np. raport roczny firmy) i poproś: „Podsumuj najważniejsze wnioski i zidentyfikuj 3 istotne liczby.”

2. CSV: Pobierz dowolny publiczny dataset (np. z dane.gov.pl lub Kaggle) i poproś: „Przeanalizuj te dane. Pokaż 3 główne trendy i stwórz wykres.”

3. Obraz: Zrób screenshot dowolnej strony internetowej i poproś: „Oceń UX tej strony. Co jest dobre, co wymaga poprawy?”

Co dalej

W następnej lekcji zobaczysz, co Claude potrafi w generowaniu wizualizacji - diagramy, wykresy i interaktywne aplikacje.