python爬虫获取动态网页时怎么过滤图片-成都创新互联网站建设

关于创新互联

多方位宣传企业产品与服务 突出企业形象

公司简介 公司的服务 荣誉资质 新闻动态 联系我们

python爬虫获取动态网页时怎么过滤图片

小编给大家分享一下python爬虫获取动态网页时怎么过滤图片,相信大部分人都还不怎么了解,因此分享这篇文章给大家参考一下,希望大家阅读完这篇文章后大有收获,下面让我们一起去了解一下吧!

创新互联公司专注于贞丰企业网站建设,响应式网站,电子商务商城网站建设。贞丰网站建设公司,为贞丰等地区提供建站服务。全流程按需求定制设计,专业设计,全程项目跟踪,创新互联公司专业和态度为您提供的服务

在这个爬虫里不用看任何图片信息,所以图片没有加载的必要,为了提升一点点运行效率,将所有图片拦截掉:

//开启拦截器
await page.setRequestInterception(true)
await page.on('request',interceptedRequest => {
    //判断加载的url是否以jpg或png结尾,符合条件将不再加载
    if(interceptedRequest.url().endsWith('.jpg') || interceptedRequest.url().endsWith('.png')){
        interceptedRequest.abort();
    }else{
        interceptedRequest.continue();
    }
})

拓展:调整窗口大小

在浏览器弹出时,会发现打开的窗口显示范围很小,不仅不方便浏览,可能还会导致点击或输入等操作出错,所以还是有必要进行调整:

await page.setViewport({
    width: 1920,
    height: 1080,
})

以上是“python爬虫获取动态网页时怎么过滤图片”这篇文章的所有内容,感谢各位的阅读!相信大家都有了一定的了解,希望分享的内容对大家有所帮助,如果还想学习更多知识,欢迎关注创新互联行业资讯频道!


分享题目:python爬虫获取动态网页时怎么过滤图片
网页路径:http://kswsj.cn/article/gjicgs.html

其他资讯