Handleiding voor het extraheren van bestandslinks
Bestandslinks uit HTML halen
Gekopieerde HTML kan URL's bevatten in href, src, srcset, data-attributen, CSS url()-waarden en gewone tekst.
Waar URL's in HTML staan
Links gebruiken href, media meestal src, responsieve afbeeldingen srcset en lazy-load bibliotheken data-attributen.
Relatieve paden oplossen
Een pad als ../files/report.pdf wordt pas volledig met de oorspronkelijke pagina-URL. Controleer daarna het domein.
Kandidaten filteren
Broncode bevat ook navigatie, API's, analyse, lettertypen, scripts en tracking. Filter op relevante extensies.
Valideren voor download
Verwijder duplicaten, controleer domeinen en test een kleine steekproef. Een extensie garandeert geen geldig of toegestaan bestand.
Veelgestelde vragen
Kan de tool ../-paden oplossen?
Ja, met de oorspronkelijke pagina-URL als basis.
Worden srcset-afbeeldingen gevonden?
Ja, gangbare bron- en responsieve attributen worden gecontroleerd.
Waarom ontbreken live bestanden?
JavaScript kan ze pas later of na interactie toevoegen.
Zijn alle URL's veilig?
Nee, controleer domein, type, toestemming en een steekproef.