python爬虫的时候,需要爬取的数据出现在javascript的变量里,只能通过正则获取么?

发布于 2022-09-03 08:40:38 字数 793 浏览 14 评论 0

比如网址:http://gsxt.lngs.gov.cn/saicp...
里面的内容是:
<script type="text/javascript">
$(document).ready(function(){tzr_paging([{"blicno":"","invid":"1017186481","countryName":"","invtypeName":"自然人股东","sconformName":"1|","respformName":"","dom":"辽宁省铁岭市银州区广裕街7栋2单元601室","blictypeName":"中华人民共和国居民身份证","inv":"张淑坤"},{"blicno":"","invid":"1017186480","countryName":"","invtypeName":"自然人股东","sconformName":"1|","respformName":"","dom":"辽宁省铁岭市银州区广裕街农科巷阳光园六区三期15号楼2单元602室","blictypeName":"中华人民共和国居民身份证","inv":"刘莹雪"}],"2","211202000012015032445494","false");}); </script>

我要获取这个tzr_paging里的内容,除了正则还有别的方法获取这个数组么?

如果你对这篇内容有疑问,欢迎到本站社区发帖提问 参与讨论,获取更多帮助,或者扫码二维码加入 Web 技术交流群。

扫码二维码加入Web技术交流群

发布评论

需要 登录 才能够评论, 你可以免费 注册 一个本站的账号。

评论(3

忆悲凉 2022-09-10 08:40:38

你可以把字典起始部分的字符串抠出来,然后用eval得到这个字典

s = "{'a':1,'b':2}"
d = eval(s)
print d
# than you get dictionary d: {'a': 1, 'b': 2}
牵你手 2022-09-10 08:40:38

肯定是要把当做字符串来处理了。

荒岛晴空 2022-09-10 08:40:38

可以用 phantomjs 去执行这段 js,然后把结果回调出来

http://phantomjs.org/

~没有更多了~
我们使用 Cookies 和其他技术来定制您的体验包括您的登录状态等。通过阅读我们的 隐私政策 了解更多相关信息。 单击 接受 或继续使用网站,即表示您同意使用 Cookies 和您的相关数据。
原文