Data Engineer (Databricks) | Specialist (Remoto)

Empresa: Compass UOL

Localização: San Francisco, Brasil

Modalidade: Presencial

Nível: Sênior

Contrato: CLT ou PJ

Skills obrigatórias: azure-databricks, databricks, delta-lake, unity-3d, google-cloud-platform, migra, pyspark, spark, airflow, apache-airflow, ml-flow, mlflow, amazon-web-services, aws-glue, postgresql, mongodb, cassandra, apache-cassandra, kafka, unity-and-unreal-software-and-training

Sobre a vaga

**Responsabilidades e atribuições**

- Construção e manutenção de pipelines de dados escaláveis e confiáveis, utilizando tecnologias modernas de processamento distribuído para garantir a ingestão, transformação e disponibilização de dados com qualidade e performance.

- Organização das tabelas em Delta Lake e Unity Catalog;

- Implementação de uma esteira automatizada de MLOps nativa em Databricks on GCP, cobrindo o ciclo de vida completo dos modelos;

- Preparação de dados, geração de features, treinamento, validação, registro, deploy, serving, monitoramento e retreino automático;

- Atuação desde o discovery técnico com inventário dos modelos existentes, até a construção de um template padrão de pipeline validado em um piloto e migração progressiva dos modelos em ondas organizadas por criticidade.

- Atuação no modelo ágil, com sprints, rituais de refinamento, review e retrospectiva;

**Requisitos e qualificações**

- Experiência com Databricks;

- Experiência com PySpark e Apache Spark;

- Experiência com Apache Airflow;

- Experiência com BigQuery;

- Experiência com integração e utilização do MLflow;

- Conhecimento em AWS Glue;

- Experiência com bancos de dados SQL e NoSQL, como PostgreSQL, MongoDB e Cassandra;

**Requisitos Desejáveis:**

- Desejável conhecimento em Apache Kafka;

- Desejável conhecimento em dbt.

Criar conta grátis no TrailWise para ver seu Match Score