移动抓取与收录研发工程师(J92916)
Core
Building and maintaining a distributed web crawling and data collection system to handle massive-scale data acquisition.
Role type
Senior IC crawler engineer (distributed systems)
Builds
High-performance, high-concurrency distributed crawling infrastructure
Domain
Internet / Data Engineering
Deliverable
production ML models | product features
Required skills
C/C++/Python, HTTP/HTTPS protocols, browser rendering principles, Scrapy, BeautifulSoup, Selenium, web/app reverse engineering, anti-scraping evasion strategies
Preferred skills
Problem-solving for complex technical challenges, risk identification and mitigation
Technologies
Scrapy, BeautifulSoup, Selenium, C, C++, Python
Responsibilities
Develop and maintain distributed crawler systems; solve high-concurrency and high-availability technical challenges; write high-quality code and documentation; overcome specific scraping obstacles
Seniority
Senior, hands-on IC
