简要说明:使用 GrabAll 扫描当前页面,再按类别检查结果。扩展可以整理浏览器能够访问的链接和资源,但不会发现页面未公开的私有服务器文件。
什么算作可下载文件
可下载文件可以是链接的文档,图像来源,媒体元素,存档,电子表格,也可以是页面引用的另一个公共资产. 浏览器必须足够了解资源来请求或显示.
文件发现并不意味着服务器探索. GrabAll与当前页面合作并提供了URL,而不是私有目录或未列出的服务器内容.
- 文件和档案的锁定链接
- 图像弧, srcset, 和懒惰装入属性
- 视频、音频、海报和源元素
- 以页面文本或数据属性显示的公共文件 URL
结构化查找流程
先扫描最相关的页面。 按类型分组结果,然后检查文件扩展名,MIME提示,尺寸,大小和源域. 可用时使用预览。
如果页面是动态的,允许相关部分在扫描前加载. 避免通过无关区域滚动,因为这样可以将建议和导航资产添加到结果集中.
- 选择一个特定的页面
- 装入与任务相关的内容
- 按类型分列的扫描和组结果
- 过滤、预览和选择有用的文件
没有明显扩展名的 URL
一些下载使用路径如/download?id=123而不是以.pdf或.zip结尾的文件名. 这些链接在服务器响应前可能更难分类. 页面标签,响应头,浏览器下载行为可能提供更多信息.
不要假设每个长的 URL 是文件。 跟踪,导航,和API链接可以看起来相似.
为什么扫描渲染后页面更有效
查看HTML源可以帮助技术用户,但现代页面经常在初始文档负载后添加内容. 浏览器扩展可以检查渲染的上下文,并在面向审查的界面中显示结果.
对于被粘贴的 HTML 或离线源,请使用免费的 Bulk 文件 URL 提取器. 对于活页,使用GrabAll,这样可以将发现与预览和下载选择结合起来.
合理认识扫描能力
认证后的文件,在受保护的API呼叫后生成,被储存在私人系统中,或通过DRM交付的文件,不在正常的页面扫描工具的范围之外. 遵守访问规则,并在提供的地方使用官方下载控制.
最佳结果来自故意暴露资源链接,画廊,附件,文档,或普通媒体文件的页面.
常见问题
GrabAll 能找到页面未链接的文件吗?
不能。GrabAll 只能整理浏览器和页面当前公开的资源,不会搜索私有目录或未公开的服务器文件。
应该扫描主页还是具体页面?
优先扫描最具体、真正包含目标资源的页面,这样无关文件更少,结果也更容易筛选。
URL 没有文件扩展名怎么办?
某些下载地址使用动态路由,无法仅凭 URL 判断类型。应结合页面标签、响应信息和实际下载行为核对。
可以从复制的 HTML 中提取链接吗?
可以。免费文件 URL 批量提取器支持粘贴 HTML、源代码和文本。动态内容则更适合使用扩展扫描。
允许您访问和下载的文件使用 GrabAll。 扩展帮助发现和组织页面公开的网页资产;它不会绕过认证,付费墙,DRM,私人内容,版权,或网站规则.