职位描述:
1、负责设计和开发分布式网络爬虫系统,进行多平台信息的抓取和分析工作;
2、负责网页信息和app数据抽取、清洗、消重等工作,提升平台的抓取效率;
3、参与爬虫核心算法和策略优化,熟悉采集系统的调度策略;
4、实时监控爬虫的进度和警报反馈。
任职要求:
1、有扎实的算法和数据结构能力;
2、熟悉爬虫原理,熟悉常见的反爬虫技术,有爬虫相关项目开发经验者优先;
3、掌握http协议,熟悉html、dom、xpath等常见的数据抽取技术;
4、有大规模数据处理、数据挖掘、信息提取等经验者优先。
因篇幅问题不能全部显示,请点此查看更多更全内容
Copyright © 2019- sarr.cn 版权所有 赣ICP备2024042794号-1
违法及侵权请联系:TEL:199 1889 7713 E-MAIL:2724546146@qq.com
本站由北京市万商天勤律师事务所王兴未律师提供法律服务