GrabAll

Wyodrębnianie linków do plików

Jak wyodrębnić linki do plików z HTML lub strony internetowej

Uzyskaj czystą listę adresów URL obrazów, plików PDF i innych plików z HTML strony internetowej. Wybierz między skanowaniem strony na żywo za pomocą GrabAll a wyodrębnieniem linków z wklejonego HTML lub tekstu za pomocą darmowych narzędzi online.

Dodaj do Chrome Dodaj do Edge Dodaj do Firefox Wkrótce

Wybierz między skanowaniem strony a parsowaniem wklejonego HTML

Skanowanie załadowanej strony internetowej może znaleźć pliki dostępne w przeglądarce, podczas gdy internetowy extractor odczytuje tylko HTML lub tekst, który wklejasz. Wybierz metodę, która odpowiada Twojemu punktowi początkowemu, a następnie przejrzyj powstałe adresy URL przed ich użyciem do pobierania.

Gdzie HTML przechowuje adresy

Linki używają href, multimedia zwykle src, obrazy responsywne srcset, a biblioteki lazy load atrybutów danych.

Rozwijanie względnych ścieżek

Ścieżka ../files/report.pdf staje się pełna dopiero po dodaniu adresu strony źródłowej. Później sprawdź domenę.

Filtrowanie kandydatów

Kod zawiera też nawigację, API, analitykę, fonty, skrypty i tracking. Filtruj według potrzebnych rozszerzeń.

Sprawdzenie przed pobraniem

Usuń duplikaty, sprawdź domeny i przetestuj małą próbkę. Samo rozszerzenie nie gwarantuje poprawnego ani dozwolonego pliku.

Najczęściej zadawane pytania

Czy narzędzie rozwija ścieżki ../?

Tak, jeśli podasz oryginalny adres strony jako bazę.

Czy obsługuje obrazy srcset?

Tak, sprawdza popularne atrybuty źródeł i obrazów responsywnych.

Dlaczego brakuje plików z działającej strony?

JavaScript może dodać je później lub dopiero po interakcji.

Czy wszystkie adresy są bezpieczne?

Nie, sprawdź domenę, typ pliku, uprawnienia i małą próbkę.