
本书围绕 python网络爬虫技术及相关框架,主要参照 1x数据采集职业技能等级要求,以学情境方式介绍了基于静态网页的爬虫技术及相关框架,如 requet、beautifuloup4、xpath、cv和 pymyql;基于动态网页的爬虫技术及框架,如 crapy、elenium、jon、phantomj和 pillow;基于 app应用的爬虫技术与应用软件,如 fiddler;反爬虫策略,如用 header模拟浏览器,用 cookie记录身份信息;通过结合 crapy和 redi提高网络爬虫的效率、安全及数据一致。本书理论分析相对较少,偏重动手实践,适用于应用型本科、高职高专院校大数据技术、人工智能技术应用专业和希望快速进入大数据、人工智能领域的读者。
阅读更多