{"schemaVersion":"jobsearcher.job.v1","id":"f072c0b4ebe0a64ac7752e76","url":"https://jobsearcher.com/jobs/f072c0b4ebe0a64ac7752e76","canonicalUrl":"https://jobsearcher.com/jobs/f072c0b4ebe0a64ac7752e76","title":"Database Administrator","description":"We are seeking a senior Iceberg DBA / Lakehouse Operations Engineer to own reliability, performance and operational integrity of the Apache Iceberg data layer that powers enterprise analytics and business-critical apps. You will operate in a large-scale, multi-engine Lakehouse environment (Spark, Hive, Impala) and support data modernization initiatives (Hive/Teradata → Iceberg). This role directly impacts downstream reporting and decision-making.Key responsibilities:- Day-to-day ownership of Iceberg tables: ensure availability, consistency and integrity for TB–PB datasets.- Advanced table maintenance: compaction (minor/major), small-file mitigation, snapshot expiration, metadata compaction, orphan file cleanup (vacuum).- Data layout optimization: file-size tuning, partition evolution/pruning, clustering/ordering strategies (e.g., Z-ordering patterns).- Enforce data modeling and Lakehouse design: 3NF where appropriate, medallion (Bronze/Silver/Gold) layers, alignment with ingestion patterns and downstream requirements.- Multi-engine query consistency and tuning across Spark (CDE), Hive/Impala (CDW); resolve metadata inconsistencies and inefficient plans.- Metadata and lifecycle management: retention/archival, snapshot lifecycle, time-travel optimization.- Production support: L2/L3 troubleshooting, on-call rotation, P1/P2 incident response, RCA and preventive action.- Security/governance: support Ranger/RBAC policies, data validation and reconciliation between source and Iceberg.Required skills: Apache Iceberg/Hive experience, Spark SQL/Hive/Impala/NiFi/Trino, partitioning, Parquet/ORC, distributed query processing. Preferred: migration experience (Hive→Iceberg, Teradata→Iceberg), Cloudera CDP, cloud (AWS/Azure), Python/Shell automation.","company":"Vysystems","rawCompany":"vysystems","city":"Denver","state":"CO","isRemote":false,"isActive":false,"createdAt":"2026-09-22T07:32:01.905Z","occupations":[{"code":"15-1242.00","title":"Database Administrators","slug":"database-administrators"},{"code":"15-1243.01","title":"Data Warehousing Specialists","slug":"data-warehousing-specialists"},{"code":"15-1243.00","title":"Database Architects","slug":"database-architects"}],"industries":[{"code":"541512","title":"Computer Systems Design Services","slug":"computer-systems-design-services"},{"code":"518210","title":"Computing Infrastructure Providers, Data Processing, Web Hosting, and Related Services","slug":"computing-infrastructure-providers-data-processing-web-hosting-and-related-services"},{"code":"541511","title":"Custom Computer Programming Services","slug":"custom-computer-programming-services"}],"jobPosting":{"@context":"https://schema.org","@type":"JobPosting","title":"Database Administrator","description":"We are seeking a senior Iceberg DBA / Lakehouse Operations Engineer to own reliability, performance and operational integrity of the Apache Iceberg data layer that powers enterprise analytics and business-critical apps. You will operate in a large-scale, multi-engine Lakehouse environment (Spark, Hive, Impala) and support data modernization initiatives (Hive/Teradata → Iceberg). This role directly impacts downstream reporting and decision-making.Key responsibilities:- Day-to-day ownership of Iceberg tables: ensure availability, consistency and integrity for TB–PB datasets.- Advanced table maintenance: compaction (minor/major), small-file mitigation, snapshot expiration, metadata compaction, orphan file cleanup (vacuum).- Data layout optimization: file-size tuning, partition evolution/pruning, clustering/ordering strategies (e.g., Z-ordering patterns).- Enforce data modeling and Lakehouse design: 3NF where appropriate, medallion (Bronze/Silver/Gold) layers, alignment with ingestion patterns and downstream requirements.- Multi-engine query consistency and tuning across Spark (CDE), Hive/Impala (CDW); resolve metadata inconsistencies and inefficient plans.- Metadata and lifecycle management: retention/archival, snapshot lifecycle, time-travel optimization.- Production support: L2/L3 troubleshooting, on-call rotation, P1/P2 incident response, RCA and preventive action.- Security/governance: support Ranger/RBAC policies, data validation and reconciliation between source and Iceberg.Required skills: Apache Iceberg/Hive experience, Spark SQL/Hive/Impala/NiFi/Trino, partitioning, Parquet/ORC, distributed query processing. Preferred: migration experience (Hive→Iceberg, Teradata→Iceberg), Cloudera CDP, cloud (AWS/Azure), Python/Shell automation.","datePosted":"2026-09-22T07:32:01.905Z","dateModified":"2026-09-22T07:32:01.905Z","hiringOrganization":{"@type":"Organization","name":"Vysystems","sameAs":"https://jobsearcher.com"},"jobLocation":{"@type":"Place","address":{"@type":"PostalAddress","addressLocality":"Denver","addressRegion":"CO","addressCountry":"US"}},"identifier":{"@type":"PropertyValue","name":"JobSearcher","value":"f072c0b4ebe0a64ac7752e76"},"url":"https://jobsearcher.com/jobs/f072c0b4ebe0a64ac7752e76"}}