{"schemaVersion":"jobsearcher.job.v1","id":"9f4c07cd9897718e2f5c56eb","url":"https://jobsearcher.com/jobs/9f4c07cd9897718e2f5c56eb","canonicalUrl":"https://jobsearcher.com/jobs/9f4c07cd9897718e2f5c56eb","title":"AWS Data Science | Specialist (Remote)","description":"Responsabilidades e atribuiçõesLiderar o desenvolvimento e evolução das capacidades da Feature Store: data lineage, feature views, feature recommendation e novos motores de consulta;Projetar e implementar tabelas Apache Iceberg com foco em performance de leitura, versionamento e evolução de schema;Arquitetar e otimizar a camada de serving com Redis para features em tempo real com SLOs rigorosos de latência;Integrar e otimizar Amazon EMR como motor de consulta e processamento em escala;Definir e implementar pipelines de feature selection e transformação com rastreabilidade end-to-end;Estabelecer padrões de qualidade, versionamento e governança de features para toda a plataforma;Atuar como referência técnica para times de dados e ciência que consomem a Feature Store.Requisitos e qualificaçõesExpertise em engenharia de features em plataformas de ML corporativas (Feast, Tecton, Hopsworks ou equivalentes);Domínio avançado de Apache Spark/PySpark para processamento distribuído em escala;Profundo conhecimento de Apache Iceberg e arquiteturas lakehouse (comparativo com Delta Lake e Hudi);Expertise em Redis para feature serving em baixa latência, incluindo estratégias de cache invalidation e serialização eficiente;Experiência sólida com AWS e seus serviços de dados em produção (S3, Glue, EMR, Redshift, Athena).Desejável: Domínio de data lineage e catálogos de metadados (DataHub, OpenMetadata, Marquez) em produção, experiência com Amazon EMR: configuração, otimização de clusters e tuning de jobs Spark, expertise em práticas de MLOps com foco em versionamento e rastreabilidade de artefatos de dados, atuação anterior em contexto financeiro com dados de alta cardinalidade, alta frequência e requisitos regulatórios, conhecimento de ferramentas de qualidade de dados em escala (Great Expectations, Soda, dbt tests).","company":"Compass Uol","rawCompany":"compass uol","isRemote":true,"isActive":false,"createdAt":"2026-08-17T12:56:29.675Z","occupations":[{"code":"15-1243.01","title":"Data Warehousing Specialists","slug":"data-warehousing-specialists"},{"code":"15-2051.00","title":"Data Scientists","slug":"data-scientists"},{"code":"15-1252.00","title":"Software Developers","slug":"software-developers"}],"industries":[{"code":"541512","title":"Computer Systems Design Services","slug":"computer-systems-design-services"},{"code":"518210","title":"Computing Infrastructure Providers, Data Processing, Web Hosting, and Related Services","slug":"computing-infrastructure-providers-data-processing-web-hosting-and-related-services"},{"code":"541511","title":"Custom Computer Programming Services","slug":"custom-computer-programming-services"}],"jobPosting":{"@context":"https://schema.org","@type":"JobPosting","title":"AWS Data Science | Specialist (Remote)","description":"Responsabilidades e atribuiçõesLiderar o desenvolvimento e evolução das capacidades da Feature Store: data lineage, feature views, feature recommendation e novos motores de consulta;Projetar e implementar tabelas Apache Iceberg com foco em performance de leitura, versionamento e evolução de schema;Arquitetar e otimizar a camada de serving com Redis para features em tempo real com SLOs rigorosos de latência;Integrar e otimizar Amazon EMR como motor de consulta e processamento em escala;Definir e implementar pipelines de feature selection e transformação com rastreabilidade end-to-end;Estabelecer padrões de qualidade, versionamento e governança de features para toda a plataforma;Atuar como referência técnica para times de dados e ciência que consomem a Feature Store.Requisitos e qualificaçõesExpertise em engenharia de features em plataformas de ML corporativas (Feast, Tecton, Hopsworks ou equivalentes);Domínio avançado de Apache Spark/PySpark para processamento distribuído em escala;Profundo conhecimento de Apache Iceberg e arquiteturas lakehouse (comparativo com Delta Lake e Hudi);Expertise em Redis para feature serving em baixa latência, incluindo estratégias de cache invalidation e serialização eficiente;Experiência sólida com AWS e seus serviços de dados em produção (S3, Glue, EMR, Redshift, Athena).Desejável: Domínio de data lineage e catálogos de metadados (DataHub, OpenMetadata, Marquez) em produção, experiência com Amazon EMR: configuração, otimização de clusters e tuning de jobs Spark, expertise em práticas de MLOps com foco em versionamento e rastreabilidade de artefatos de dados, atuação anterior em contexto financeiro com dados de alta cardinalidade, alta frequência e requisitos regulatórios, conhecimento de ferramentas de qualidade de dados em escala (Great Expectations, Soda, dbt tests).","datePosted":"2026-08-17T12:56:29.675Z","dateModified":"2026-08-17T12:56:29.675Z","hiringOrganization":{"@type":"Organization","name":"Compass Uol","sameAs":"https://jobsearcher.com"},"jobLocationType":"TELECOMMUTE","applicantLocationRequirements":{"@type":"Country","name":"US"},"identifier":{"@type":"PropertyValue","name":"JobSearcher","value":"9f4c07cd9897718e2f5c56eb"},"url":"https://jobsearcher.com/jobs/9f4c07cd9897718e2f5c56eb"}}