Data Engineering Lead
Position Overview
The Data Engineering Lead is responsible for designing and implementing modern, scalable data architectures to support migration of legacy, file-based analytical systems to AWS Cloud Native environments.
This role leads the transformation of legacy SAS-based data storage models—including flat files, batch outputs, and subsystem-specific data artifacts—into structured, governed, and scalable data models optimized for cloud-native processing.
The Data Engineering Lead will ensure data integrity, performance, and visibility across a system-of-systems modernization initiative, while providing technical leadership for data modeling, ingestion patterns, validation frameworks, and transparency reporting.
Expert-level proficiency in Python and strong experience designing AWS-based data architectures are required.
Key Responsibilities
Legacy Data Discovery & Data Model Transformation
- Participate in structured system inventory efforts to document:
- Legacy file-based storage structures
- SAS dataset dependencies
- Subsystem data flows
- Manual gating and handoff processes
- Analyze legacy storage models and design target-state data models aligned to AWS Cloud Native architecture.
- Replace file-driven batch dependencies with:
- API-based ingestion
- Event-driven workflows