Analiza plików i dokumentów
- Znasz wszystkie obsługiwane formaty plików i ich limity
- Potrafisz analizować PDF-y, CSV i obrazy w Claude
- Wiesz, jak działa OCR i vision capabilities Claude
- Stosujesz techniki efektywnej analizy dokumentów
Obsługiwane formaty
Claude przyjmuje w czacie dwie grupy plików (stan na 1 października 2026):
Dokumenty: PDF, DOCX, CSV, XLSX (wymaga włączonego Code execution and file creation), TXT, HTML, ODT, RTF, EPUB, JSON
Obrazy: JPEG, PNG, GIF, WebP (do 8000 x 8000 px). Animacji Claude nie obsługuje: z animowanego GIF-a bierze tylko pierwszą klatkę.
Wideo i audio: nie ma ich na liście. Wszystkie obecne modele Claude przyjmują na wejściu tekst i obrazy, a odpowiadają tekstem. Film przeanalizujesz w Gemini: w aplikacji 5 minut wideo za darmo, do 1 godziny na AI Pro i Ultra. ChatGPT też przyjmuje wideo, ale OpenAI zastrzega, że analiza może nie objąć całego nagrania.
Lista się zmienia. Zamiast uczyć się jej na pamięć, sprawdzaj wykaz w artykule pomocy Anthropic „Upload files to Claude” (support.claude.com, wersja z 23 lipca 2026). W tym kursie odświeżam go przy każdej aktualizacji.
Limity
| Parametr | Wartość |
|---|---|
| Rozmiar per plik | 500 MB (upload w rozmowie; pliki wiedzy w Projects: 30 MB) |
| Pliki na czat | do 20 jednocześnie |
| analiza multimodalna (tekst + obraz) do 100 stron; odczyt tekstowy do 1000 stron | |
| Obrazy | do 8000 x 8000 px |
Te liczby dotyczą czatu na claude.ai. Przy obrazach źródła Anthropic się różnią. Artykuł pomocy podaje 500 MB na plik, a dokumentacja dla programistów (strona Vision) tylko 10 MB na obraz w claude.ai. Duże zdjęcie zmniejsz więc przed wgraniem. Baza wiedzy w Projects rządzi się własnymi limitami - opisuję je w lekcji o Projects.
Jak wgrywać pliki
Cztery sposoby:
- Przycisk „+” w lewym dolnym rogu pola czatu, potem „Add files or photos”
- Drag & drop - przeciągnij plik na okno czatu
- Schowek - skopiuj obraz i wklej go do pola czatu (Ctrl+V, na Macu Cmd+V)
- Konektory - pliki z zewnętrznych źródeł bez ręcznego wgrywania: m.in. Google Drive, GitHub, Microsoft 365 i zdalne serwery MCP (MCP to protokół, przez który Claude łączy się z innymi aplikacjami)
Dostępność konektorów zależy od planu (stan na 1 października 2026). Microsoft 365 działa na wszystkich planach, także Free, ale tylko z kontem służbowym. Najpierw administrator Microsoft Entra (systemu kont służbowych Microsoftu) w Twojej firmie musi raz wyrazić zgodę na połączenie z Claude. Zapis (maile, kalendarz, pliki, wiadomości Teams) działa, gdy włączy go administrator. Na Free dodasz jeden własny konektor MCP. Slack jest tylko na Team i Enterprise. Claude edytuje też na żywo Dokumenty, Arkusze i Prezentacje Google w panelu obok czatu (beta, web i Desktop). Aktualną listę konektorów znajdziesz w claude.ai w Customize → Connectors.
Analiza PDF
Claude analizuje PDF-y, korzystając z vision capabilities (rozpoznawania obrazu) - widzi zarówno tekst, jak i elementy wizualne:
- Tekst (OCR, czyli rozpoznawanie znaków - także ze skanów)
- Tabele
- Wykresy i grafy
- Obrazy w dokumencie
- Formatowanie i układ strony
Analiza multimodalna działa dla PDF-ów do 100 stron - dłuższe pliki (do 1000 stron) Claude czyta tylko w warstwie tekstowej. Wykres na stronie 340 raportu rocznego zobaczy więc jako podpis, nie jako obraz.
Claude potrafi też tworzyć i edytować pliki PDF. Stan na 1 października 2026: robi to przez wbudowany skill Anthropic do PDF, który wymaga włączonego przełącznika Code execution and file creation (Settings → Capabilities). W części artykułów pomocy Anthropic ten sam przełącznik nazywa się „Cloud code execution and file creation” - w ustawieniach szukaj obu nazw. Na planach płatnych dokument przygotujesz też w szablonie Claude Docs (beta) i wyeksportujesz do PDF, Worda, Markdown albo Google Docs.
Pro tip: PDF dłuższy niż 100 stron, w którym liczą się wykresy, podziel na części do 100 stron - wtedy Claude zobaczy też grafikę. Przy wielu dokumentach użyj Projects. Na planach płatnych, gdy wiedza projektu zbliża się do limitu okna kontekstu, Claude włącza tryb RAG: wyszukuje potrzebne fragmenty zamiast czytać całość. Według Anthropic zwiększa to pojemność projektu nawet 10 razy. Pojedynczy plik w projekcie może mieć do 30 MB.
Analiza CSV i Excel
Z włączonym Code execution and file creation (Settings → Capabilities) Claude:
- Pisze i uruchamia kod w sandboxie, czyli odizolowanym środowisku (m.in. Python)
- Czyści, eksploruje i przetwarza dane
- Daje matematycznie precyzyjne wyniki (nie szacuje - oblicza)
- Tworzy wizualizacje i dashboardy z danych
- Generuje nowe pliki (CSV, XLSX, PDF) z przetworzonymi danymi
Nie musisz od razu prosić o artefakt. Wgraj CSV i zapytaj: „Co pokazują te dane?”. Claude może narysować interaktywny wykres prosto w odpowiedzi (custom visuals, beta, web i Desktop). Więcej w następnej lekcji.
Skills Anthropic do plików biurowych. Ten sam przełącznik odblokowuje cztery gotowe skille od Anthropic: Excel, Word, PowerPoint i PDF. Skill to folder z instrukcjami, skryptami i zasobami, który Claude ładuje na żądanie - dzięki temu arkusz z formułami albo prezentacja z 12 slajdami wychodzą w poprawnym formacie, a nie jako tekst do przeklejenia. Katalog skilli otworzysz w Customize → Skills → „+” → Browse skills, na wszystkich planach od Free wzwyż (stan na 1 października 2026). Więcej w lekcji o Skills i Plugins.
Częsty błąd: Wgranie CSV bez instrukcji, co Claude ma z nim zrobić. Zamiast „Oto moje dane” napisz: „Przeanalizuj ten CSV. Zidentyfikuj 3 główne trendy, oblicz średnią dla kolumny X i stwórz wykres pokazujący zmiany w czasie.”
Vision - co Claude widzi na obrazach
Claude rozpoznaje:
- Obiekty, sceny i kontekst na zdjęciach
- Tekst na obrazach (OCR) - także ze zdjęć zrobionych telefonem; przy obrazach rozmazanych, obróconych albo mniejszych niż 200 px może się mylić
- Wykresy i dane wizualne
- Diagramy techniczne, schematy, wireframes
- Tabele na screenshotach
- Interfejsy użytkownika (screenshoty aplikacji)
Ograniczenia (według dokumentacji Anthropic, stan na 1 października 2026):
- Nie poda imion ani nazwisk osób ze zdjęcia. Odmówi, bo zabraniają tego zasady użytkowania Anthropic.
- Nie oceni wiarygodnie, czy obraz wygenerowało AI. Do wykrywania fałszywek się nie nadaje.
- Obiekty policzy tylko w przybliżeniu, zwłaszcza gdy jest ich dużo i są drobne.
Techniki efektywnej analizy dokumentów
1. Chain analysis (od ogółu do szczegółu)
Prompt 1: "Podsumuj ten dokument w 5 punktach."
Prompt 2: "Rozwiń punkt 3 - jakie konkretne dane go wspierają?"
Prompt 3: "Jakie wnioski wynikają z tych danych dla mojego biznesu?"
2. Porównanie dokumentów
Wgraj 2-3 pliki jednocześnie: „Porównaj te raporty. Wskaż najważniejsze różnice i sprzeczności.”
3. Ekstrakcja danych do tabeli
„Wyodrębnij z tego PDF wszystkie daty, kwoty i nazwy firm. Przedstaw jako tabelę.”
4. Podsumowanie wielopoziomowe
„Stwórz 3 wersje podsumowania: (1) TL;DR w 2 zdaniach, (2) Executive summary w 5 punktach, (3) Szczegółowa analiza z wnioskami.”
Ćwiczenie praktyczne: Wgraj 3 różne typy plików i przeanalizuj je:
1. PDF: Wgraj dowolny raport (np. raport roczny firmy) i poproś: „Podsumuj najważniejsze wnioski i zidentyfikuj 3 istotne liczby.”
2. CSV: Pobierz dowolny publiczny dataset (np. z dane.gov.pl lub Kaggle) i poproś: „Przeanalizuj te dane. Pokaż 3 główne trendy i stwórz wykres.”
3. Obraz: Zrób screenshot dowolnej strony internetowej i poproś: „Oceń UX tej strony. Co jest dobre, co wymaga poprawy?”
Co dalej
W następnej lekcji zobaczysz, co Claude potrafi w generowaniu wizualizacji - diagramy, wykresy i interaktywne aplikacje.