Data Engineer (Databricks) | Specialist (Remoto)
Empresa: Compass UOL
Localização: San Francisco, Brasil
Modalidade: Presencial
Nível: Sênior
Contrato: CLT ou PJ
Skills obrigatórias: azure-databricks, databricks, delta-lake, unity-3d, google-cloud-platform, migra, pyspark, spark, airflow, apache-airflow, ml-flow, mlflow, amazon-web-services, aws-glue, postgresql, mongodb, cassandra, apache-cassandra, kafka, unity-and-unreal-software-and-training
Sobre a vaga
**Responsabilidades e atribuições**
- Construção e manutenção de pipelines de dados escaláveis e confiáveis, utilizando tecnologias modernas de processamento distribuído para garantir a ingestão, transformação e disponibilização de dados com qualidade e performance.
- Organização das tabelas em Delta Lake e Unity Catalog;
- Implementação de uma esteira automatizada de MLOps nativa em Databricks on GCP, cobrindo o ciclo de vida completo dos modelos;
- Preparação de dados, geração de features, treinamento, validação, registro, deploy, serving, monitoramento e retreino automático;
- Atuação desde o discovery técnico com inventário dos modelos existentes, até a construção de um template padrão de pipeline validado em um piloto e migração progressiva dos modelos em ondas organizadas por criticidade.
- Atuação no modelo ágil, com sprints, rituais de refinamento, review e retrospectiva;
**Requisitos e qualificações**
- Experiência com Databricks;
- Experiência com PySpark e Apache Spark;
- Experiência com Apache Airflow;
- Experiência com BigQuery;
- Experiência com integração e utilização do MLflow;
- Conhecimento em AWS Glue;
- Experiência com bancos de dados SQL e NoSQL, como PostgreSQL, MongoDB e Cassandra;
**Requisitos Desejáveis:**
- Desejável conhecimento em Apache Kafka;
- Desejável conhecimento em dbt.
Criar conta grátis no TrailWise para ver seu Match Score