Handleiding voor het extraheren van bestandslinks

Bestandslinks uit HTML halen

Gekopieerde HTML kan URL's bevatten in href, src, srcset, data-attributen, CSS url()-waarden en gewone tekst.

Toevoegen aan ChromeToevoegen aan Edge

Waar URL's in HTML staan

Links gebruiken href, media meestal src, responsieve afbeeldingen srcset en lazy-load bibliotheken data-attributen.

Relatieve paden oplossen

Een pad als ../files/report.pdf wordt pas volledig met de oorspronkelijke pagina-URL. Controleer daarna het domein.

Kandidaten filteren

Broncode bevat ook navigatie, API's, analyse, lettertypen, scripts en tracking. Filter op relevante extensies.

Valideren voor download

Verwijder duplicaten, controleer domeinen en test een kleine steekproef. Een extensie garandeert geen geldig of toegestaan bestand.

Veelgestelde vragen

Kan de tool ../-paden oplossen?

Ja, met de oorspronkelijke pagina-URL als basis.

Worden srcset-afbeeldingen gevonden?

Ja, gangbare bron- en responsieve attributen worden gecontroleerd.

Waarom ontbreken live bestanden?

JavaScript kan ze pas later of na interactie toevoegen.

Zijn alle URL's veilig?

Nee, controleer domein, type, toestemming en een steekproef.