做一个项目时,资料往往分散在几页:报告目录、附件页、图片参考页。多标签页扫描让你主动把这些页面作为一次操作处理。普通新扫描会产生独立结果,不会自动把历史页面混进来。
先整理需要的标签页
确认每页已加载目标内容,而不是停在登录界面或占位画面。图片图库可能需要滚动,附件可能需要展开。浏览器并不会因为标签页已打开,就自动完成页面上的所有交互。
扫描当前窗口的全部标签,或仅扫描右侧标签。每次扫描打开独立的结果列表。
选择合适的范围
Scan all tabs / Scan tabs to the Right. 扫描当前窗口的全部标签,或仅扫描右侧标签。每次扫描打开独立的结果列表。
如果只需要配图,可使用图片条件;多种文档混合时,在结果页按扩展名细分。不要为了方便默认扫描所有私人或工作标签页。

合并结果后仍要检查来源
不同网站可能有同名文件,同一文件也可能以多个地址出现。规范化 URL 去重减少重复地址,但不会逐个比较文件内容。
按域名、关键词、格式和图片尺寸筛选,然后查看实际选中数。来自不同来源时,使用带 {host} 的命名规则可帮助区分。
无法扫描的页面单独处理
Chrome 内部页面、应用商店页、受限框架和未授权来源可能无法读取。查看工具报告,区分“某个标签页失败”与“整个任务失败”。
需要登录时先正常登录,但不能保证任意请求都能继承所需访问条件。过期资源地址可能还需要重新获取。
先查看结果,再开始下载
扫描完成后会打开 Dashboard,汇总本次资源。筛选、选中文件,再点击 Start download;扫描本身不会自动开始下载。 原来的标签页保持打开,方便核对内容、加载更多资源或刷新已过期的链接。
多标签页并不是全站递归爬取。Find files in pages 只向下一层查找,而已知文件地址通常更适合URL 清单导入。收集讲义可继续看批量 PDF 指南。


