Job Description
📋 Description Own pipelines, schemas, and validation for curriculum data Build ingestion from XML, JSON, PDF, and API sources Create Python parsers, transformers, and validators Translate content workflows into data engineering requirements Build and maintain embedding/vector pipelines for AI features Work in Git-based workflows with versioned data artifacts 🎯 Requirements 4+ years data engineering with strong Python Schema design instincts for downstream use Data quality mindset with validation checks from start Cross-functional collaborator with non-engineers Provisioning and monitoring infra for data systems; IaC tools such as Terraform and Terragrunt The data system operates ECS, EKS clusters, provision lambdas and S3 buckets 🎁 Benefits Meaningful equity Health insurance: medical, dental, vision, disability and life 401k plan One Medical membership (in participating locations) Flexible vacation time policy (avg 4 weeks per year) 10 paid sick days per year