请教scrapy的需求矛盾问题!!!很纠结!!

发布于 2022-09-12 23:23:53 字数 335 浏览 35 评论 0

通过scrapy爬一个api,有很多页数据,其中response中有一个lastId参数,用于翻页,并且是发起request的必须参数。lastId不是简单的数字,而是该页最后一个用户的id,完全没有规律,lastId实时变化(数据不断更新),所以只能一页一页的爬取,因为爬了第一页并获取lastId,才能爬第二页。

那么问题来了,scrapy是异步的,但是如上所述,整个过程似乎是只能同步,并且是阻塞的。那么这跟scrapy异步高性能的特点截然相反,是不是用不了scrapy?

求大神指点!!!

如果你对这篇内容有疑问,欢迎到本站社区发帖提问 参与讨论,获取更多帮助,或者扫码二维码加入 Web 技术交流群。

扫码二维码加入Web技术交流群

发布评论

需要 登录 才能够评论, 你可以免费 注册 一个本站的账号。

评论(3

吹泡泡o 2022-09-19 23:23:53

requests不香吗

远山浅 2022-09-19 23:23:53

你问scrapy支不支持分页抓取的需求, 肯定是支持的.

蓦然回首 2022-09-19 23:23:53

inline_requests 了解下

~没有更多了~
我们使用 Cookies 和其他技术来定制您的体验包括您的登录状态等。通过阅读我们的 隐私政策 了解更多相关信息。 单击 接受 或继续使用网站,即表示您同意使用 Cookies 和您的相关数据。
原文