GrabAll

Analisi del codice HTML

Come estrarre link dei file da HTML o da una pagina web

Ottieni un elenco pulito di URL di immagini, PDF e altri file dal HTML di una pagina web. Scegli tra scansionare la pagina live con GrabAll ed estrarre link dal HTML o dal testo incollato con gli strumenti online gratuiti.

Per una pagina web live, scansiona con GrabAll e copia i link dei file rilevati. Per HTML salvato o codice sorgente copiato, incollalo nel Bulk File URL Extractor. Fornisci un URL di base quando la sorgente contiene link relativi.

Scegli tra scansionare una pagina o analizzare HTML incollato

Scansionare una pagina web caricata può trovare i file disponibili nel browser, mentre l'estrattore online legge solo l'HTML o il testo che incolli. Scegli il metodo che corrisponde al tuo punto di partenza, quindi controlla gli URL risultanti prima di usarli per i download.

Quali attributi contengono i link

Gli indirizzi possono trovarsi in href, src, srcset, attributi per il lazy loading e valori CSS url(). Un estrattore utile deve riconoscere URL assoluti e percorsi relativi, oltre a rimuovere i duplicati.

Perché serve un URL di base

Un percorso come ../files/report.pdf non è completo fuori dalla pagina originale. Fornendo l’indirizzo della pagina come base, lo strumento può trasformarlo in un URL assoluto più facile da verificare e usare.

Limiti del codice statico

JavaScript può aggiungere risorse dopo il caricamento o dopo un’interazione. Se il link non compare nel codice incollato, un estrattore locale non può trovarlo. In quel caso, carica prima la pagina e usa la scansione del browser.

Pulisci e verifica l’elenco

Filtra per estensione, elimina duplicati e controlla un piccolo campione. Non tutti gli URL presenti nel codice sono necessariamente pubblici, attivi o autorizzati al download.

Procedura consigliata

  1. Copia l’HTML o il frammento di codice da analizzare.
  2. Incollalo nell’estrattore e aggiungi l’URL di base se necessario.
  3. Filtra, copia o scarica l’elenco pulito dei link.

Domande frequenti

GrabAll può aggirare login o restrizioni di accesso?

No. GrabAll organizza soltanto le risorse che il browser e l’utente sono autorizzati a consultare.

Come posso ottenere risultati più puliti?

Inizia con un piccolo campione, controlla i tipi di file trovati e applica filtri mirati prima del download in blocco.

Dove vengono elaborati i risultati?

GrabAll è progettato per flussi di lavoro locali nel browser e salva i file tramite il normale sistema di download del browser.