Data/ETL Engineer
ascendion
Job Description
- Design, build, and maintain scalable data pipelines for AI/ML applications.
- Develop ETL/ELT workflows to ingest data from databases, APIs, files, and streaming systems.
- Prepare, clean, transform, and validate data for machine learning and Generative AI use cases.
- Build data platforms and pipelines using Python, SQL, Spark, and cloud technologies.
- Work with structured and unstructured data, including documents, text, logs, and embeddings.
- Build and maintain data lakes, data warehouses, and lakehouse architectures.
- Develop data pipelines for LLM/RAG applications, including document ingestion, chunking, metadata extraction, embedding generation, and vector storage.
- Integrate AI/ML models and APIs into production data workflows.
- Implement data quality, governance, security, lineage, and monitoring.
- Optimize pipeline performance, storage, and cloud costs.
- Collaborate with Data Scientists, ML Engineers, Software Engineers, and business teams.
- Deploy and monitor production data/AI pipelines using CI/CD and DevOps practices.