Wyodrębnianie linków do plików
Jak wyodrębnić linki do plików z HTML lub strony internetowej
Uzyskaj czystą listę adresów URL obrazów, plików PDF i innych plików z HTML strony internetowej. Wybierz między skanowaniem strony na żywo za pomocą GrabAll a wyodrębnieniem linków z wklejonego HTML lub tekstu za pomocą darmowych narzędzi online.
Wybierz między skanowaniem strony a parsowaniem wklejonego HTML
Skanowanie załadowanej strony internetowej może znaleźć pliki dostępne w przeglądarce, podczas gdy internetowy extractor odczytuje tylko HTML lub tekst, który wklejasz. Wybierz metodę, która odpowiada Twojemu punktowi początkowemu, a następnie przejrzyj powstałe adresy URL przed ich użyciem do pobierania.
Gdzie HTML przechowuje adresy
Linki używają href, multimedia zwykle src, obrazy responsywne srcset, a biblioteki lazy load atrybutów danych.
Rozwijanie względnych ścieżek
Ścieżka ../files/report.pdf staje się pełna dopiero po dodaniu adresu strony źródłowej. Później sprawdź domenę.
Filtrowanie kandydatów
Kod zawiera też nawigację, API, analitykę, fonty, skrypty i tracking. Filtruj według potrzebnych rozszerzeń.
Sprawdzenie przed pobraniem
Usuń duplikaty, sprawdź domeny i przetestuj małą próbkę. Samo rozszerzenie nie gwarantuje poprawnego ani dozwolonego pliku.
Najczęściej zadawane pytania
Czy narzędzie rozwija ścieżki ../?
Tak, jeśli podasz oryginalny adres strony jako bazę.
Czy obsługuje obrazy srcset?
Tak, sprawdza popularne atrybuty źródeł i obrazów responsywnych.
Dlaczego brakuje plików z działającej strony?
JavaScript może dodać je później lub dopiero po interakcji.
Czy wszystkie adresy są bezpieczne?
Nie, sprawdź domenę, typ pliku, uprawnienia i małą próbkę.