Description
• 7+ years of relevant experience
• Experience in database design and management of database transformation and/or migration projects for software applications
Databricks: Delta Lake, Delta Live Tables, Unity Catalog, Workflows, Structured Streaming, SQL Warehouses
• Languages: SQL, Python, PySpark/Spark
• AWS data services: S3, Glue, Lambda
• ETL/ELT, streaming ingestion, and API-based data exchange
• Data quality, metadata, and lineage tools (e.g., Unity Catalog lineage, data quality frameworks)
• Databases: PostgreSQL, Aurora, DynamoDB
• Preparing AI-ready data: feature engineering, labeled training datasets, and semantic embeddings
NLP/LLM techniques for automated metadata tagging, classification, and entity/relationship extraction