CareerPlanSign in
💼 Full-time🗓 2026-06-25 → 2026-09-24

Core

Design and maintain declarative extraction specifications and build autonomous, self-healing data extraction pipelines using AI agents and classical scraping backends.

Role type

Senior AI Data Engineer (Extraction Engineering)

Builds

Reusable specification libraries, component-based extraction platforms, and autonomous data extraction agents.

Domain

Data Engineering / Web Scraping / AI Automation

Deliverable

production ML models | product features

Required skills

Python, Specification-Driven Extraction, LangChain, LangGraph, LlamaIndex, AutoGen, Scrapy-LLM, Playwright + MCP, Autonomous Agent Design, Classical Scraping Fundamentals, Data Validation & Storage, API Integration, HTTP/DOM/XPath/CSS

Preferred skills

Open-source contributions to scraping/AI-automation, Data privacy engineering (GDPR/CCPA), DevOps (Docker, CI/CD)

Responsibilities

Design declarative extraction specifications using Pydantic/JSON schemas; Implement pipelines translating specs into executable plans; Deploy self-healing spiders using Model Context Protocol (MCP); Orchestrate multi-step browsing workflows with agentic frameworks; Build component-based extraction platforms with monitoring and alerting; Partner with data scientists to refine specs for complex domains.

Seniority

Senior, hands-on IC

Sourced via wellfound · Listed on CareerPlan, which tracks 70,000+ jobs from 20+ sources.