在这两个项目中我负责网页数据爬取。 第一个静态数据爬取的主要步骤是根据网页网站获取网页源代码,将源代码转化到xml类型,再由for循环获取数据,最后讲数据保存。 第二个动态数据项目,先爬取所需数据的包,根据字典的变量名获取数据所在位置,再经过for循环获取数据,最后保存数据。
在此处项目中,我主要负责动态数据的爬取。动态数据的爬取,首先需要在网站中打开开发者工具,找到所需数据的包,通过这个数据包爬取数据位置,再通过for循环获得所需所有数据,最后通过csv保存数据。
扫码添加客服极速匹配,或直接发布需求让更多人才主动报名
基于 35,336 需求方信任
鼠标悬停或点击上方资质图片,可放大右下角二维码进行扫码验真。
添加客服微信,免费为您安排与该工程师直接沟通
长按二维码添加客服微信
如该工程师当前档期不合,也可免费为您推荐相似候选人
收藏后可在“我的收藏”里统一查看,也方便后续继续联系和筛选合适人才。
登录后将自动返回当前页,继续浏览不会丢失。