Skip to main content

批量抓取多个URLs

你现在可以同时批量抓取多个URL。它接受起始URL和可选参数作为参数。params参数允许你指定批量抓取作业的额外选项,例如输出格式。

工作原理

它与 /crawl 端点的工作方式非常相似。它提交一个批量抓取作业并返回一个作业ID,用于检查批量抓取的状态。 SDK提供了两种方法,同步和异步。同步方法将返回批量抓取作业的结果,而异步方法将返回一个作业ID,你可以使用该ID来检查批量抓取的状态。

使用方法

响应

如果你使用的是SDK的同步方法,它将返回批量抓取作业的结果。否则,它将返回一个作业ID,你可以使用该ID来检查批量抓取的状态。

同步

Completed

异步

然后你可以使用作业ID通过调用 /batch/scrape/{id} 端点来检查批量抓取的状态。这个端点应在作业仍在运行时或在作业刚刚完成后使用 因为批量抓取作业会在24小时后过期

带提取的批量抓取

你也可以使用批量抓取端点从页面中提取结构化数据。如果你想从一个URL列表中获得相同的结构化数据,这将非常有用。

响应

同步

Completed

异步