Senior Data Engineer
Job Description
Vertage is hiring a Senior Data Engineer to lead critical data infrastructure and migration work for a next-generation application platform. The role focuses on moving from legacy systems to a modern, cloud-based architecture while enabling real-time data products for downstream consumers.
This position is based in the United States (onsite) and offers an hourly rate of USD 70 - 75. You will design core PostgreSQL capabilities, manage large-scale migrations from Oracle to AWS RDS for PostgreSQL, and build streaming pipelines using Kafka and Flink, including lakehouse-oriented components.
Responsibilities
- Design and implement PostgreSQL databases and schemas from scratch, focusing on performance, scalability, and maintainability
- Lead migration of large-scale Oracle databases from on-premises infrastructure to AWS RDS PostgreSQL clusters, protecting data integrity and minimizing downtime
- Build and optimize data products using Apache Kafka, Apache Flink, and Apache Hudi to deliver reliable data streams to downstream teams
- Review existing schemas, identify optimization opportunities, recommend structural improvements, and maintain database integrity during changes
- Design and implement comprehensive change auditing to track data modifications, create audit trails, and support compliance needs
- Develop and maintain a data catalog and detailed schema documentation to support integration with application development teams
Requirements
- Strong proficiency in PostgreSQL database design, administration, and optimization, with solid relational database and SQL knowledge
- Proven experience migrating large enterprise databases (with Oracle to PostgreSQL preferred), including strong change management practices
- Hands-on experience with AWS, especially RDS and EC2, including networking and security configurations
- Experience with Apache Kafka, Apache Flink, and data lakehouse technologies such as Hudi (and related platforms like Delta Lake)
- Ability to design normalized and denormalized schemas, understand trade-offs, and optimize for both OLTP and analytical workloads
- Experience implementing CDC patterns and audit logging systems for tracking data lineage and changes
- Ability to communicate complex data concepts to both technical and non-technical stakeholders, including strong architecture and schema documentation skills
- English with professional working proficiency
Technologies
- PostgreSQL, Oracle Database
- AWS RDS, EC2, Terraform, CloudFormation
- Apache Kafka, Apache Flink, Apache Hudi, Delta Lake
- AWS Data Pipeline tools including Glue, Lambda, or Step Functions
- GDPR, HIPAA, Cryptography
Preferred / Nice-to-Have
- Experience with AWS Data Pipeline tools (Glue, Lambda, or Step Functions)
- Knowledge of data quality and validation frameworks
- Familiarity with infrastructure-as-code tools such as Terraform and CloudFormation
- Prior experience in application modernization or legacy system replacements
- Understanding of data security, encryption, and compliance requirements including GDPR and HIPAA
Skills (as listed)
- Change Data Capture, Data migration, Data Quality, Data security
- Terraform, CloudFormation, Change management
- Regulatory Compliance, GDPR, Health insurance portability and accountability act (HIPAA)
- Real-Time Systems, Oracle Database
- Apache Kafka, Apache Flink, Data modelling, Cryptography, Relational database