Samouczek: Redagowanie pliku PDF pobranego przez HTTP
Kompletny, gotowy do uruchomienia workflow n8n, który pobiera plik PDF przez HTTP i redaguje na nim twarz za pomocą węzła PDF Redaction.
Ten samouczek buduje kompletny, gotowy do uruchomienia workflow n8n, który:
- Pobiera prawdziwy plik PDF przez HTTP za pomocą węzła HTTP Request.
- Redaguje znajdujące się na nim twarze za pomocą węzła PDF Redaction.
- Pokazuje zredagowany plik i wyniki wykrywania w panelu wyjściowym.
Wykorzystuje publiczny plik przykładowy z repozytorium pdf-redaction-api — SampleWithFace.pdf — dzięki czemu możesz odtworzyć każdy krok bez własnych plików.
Ogólny opis instalacji/konfiguracji znajdziesz najpierw w Samouczku instalacji i konfiguracji. Ten przewodnik zakłada, że węzeł jest już zainstalowany i masz już poświadczenie PDF Redaction API.
1. Trigger + HTTP Request
Zacznij od Manual Trigger, następnie dodaj węzeł HTTP Request z:
- Method:
GET - URL:
https://raw.githubusercontent.com/StabRise/pdf-redaction-api/main/examples/pdfs/SampleWithFace.pdf - Options → Response → Response Format:
File
Uruchom węzeł. Odpowiedź wraca jako dane binarne w polu data:

2. PDF Redaction — anonimizacja tagu "Face"
Dodaj węzeł PDF Redaction po węźle HTTP Request. Automatycznie pobiera pole binarne data (zarówno Input Binary Field, jak i Output Binary Field domyślnie mają wartość data, zgodnie z tym, co wygenerował HTTP Request).
Ustaw:
- Credential: swoje poświadczenie PDF Redaction API
- Operation:
Anonymize - Additional Fields → Tags:
Face

3. Uruchom i sprawdź wynik
Kliknij Execute step. Węzeł wywołuje API PDF Redaction i zwraca:
- Zredagowany plik PDF (
redacted.pdf) w wyjściowym polu binarnym, z zaczernioną twarzą. - Payload JSON z
detected_pii(znalezione encje, tutaj dwa wpisyFACEz ramkami ograniczającymi) i podziałemprocessing_timena poszczególne etapy przetwarzania.
Wynik JSON:

Wynik binarny:

Oryginalny plik miał 823 kB; zredagowany wynik ma 377 kB, ponieważ API spłaszcza przetworzone strony do kompaktowego pliku PDF.
4. Przetworzony plik PDF
Otwarcie pobranego pliku redacted.pdf potwierdza, że obie twarze na stronie są zaczernione:

5. Kompletny workflow
Wszystkie trzy węzły połączone razem, każdy pokazujący pomyślne wykonanie (zielone znaczniki):

Dostosowanie do własnych plików
Zastąp węzeł HTTP Request tym, co dostarcza Twój plik PDF jako dane binarne — payload webhooka, węzeł Read/Write File from Disk, załącznik e-mail (przez trigger e-mail) lub plik z pamięci masowej w chmurze (S3, Google Drive itp.). Dopóki poprzedzający węzeł zapisuje dane binarne w polu, a Input Binary Field węzła PDF Redaction odpowiada nazwie tego pola, ten sam wzorzec ma zastosowanie.
Samouczek instalacji i konfiguracji
Zainstaluj węzeł społecznościowy n8n PDF Redaction, utwórz poświadczenie API i skonfiguruj operacje Anonymize, Anonymize with Custom Prompt oraz Detect PII.
Samouczek: Wykrywanie danych PII bez redagowania
Zbuduj workflow n8n, który skanuje plik PDF w poszukiwaniu imion i nazwisk, e-maili oraz dat za pomocą operacji Detect PII, bez modyfikowania dokumentu.