Engenheiro de Dados Júnior - Remoto

Brivia · Remoto, BR

**Buscamos um(a) profissional para atuar como parceiro da Brivia.** Somos um ecossistema especializado na transformação de marcas, ajudando nossos clientes a superar desafios em transformação digital, tecnologia e marketing. Para isso, buscamos constantemente expandir nossas capacidades, contando com os melhores especialistas em diversas áreas. A Brivia\_Group quer contar com o seu talento para fortalecer ainda mais nosso ecossistema de transformação digital! ### **Requisitos:** * Experiência ou conhecimento em Engenharia de Dados, ETL/ELT e construção de pipelines de dados. * Conhecimento em processos de ingestão, tratamento e transformação de dados provenientes de diferentes fontes. * Conhecimento em ferramentas de orquestração de pipelines, como Apache Airflow, Azure Data Factory, AWS Glue ou Google Cloud Composer. * Conhecimento em processamento de dados com Apache Spark e/ou ferramentas como Azure Databricks, Azure Synapse Analytics, AWS Glue, AWS EMR ou Google Cloud Dataproc. * Conhecimento em bancos de dados relacionais e não relacionais. * Conhecimento em manipulação de dados estruturados e não estruturados. * Conhecimento em modelagem de dados, preferencialmente modelagem dimensional. * Noções de otimização de consultas, queries e performance de bases de dados. * Conhecimento ou interesse em arquiteturas de Data Lake e Data Warehouse. * Conhecimento em integração e ingestão de dados por meio de APIs REST. * Capacidade de trabalhar em conjunto com times de Machine Learning, desenvolvimento e Business Intelligence. * Perfil analítico, organizado e com interesse em desenvolvimento contínuo na área de dados. ### **Qualificações:** **Formação Acadêmica:** * Formação superior completa ou em andamento em Ciência da Computação, Engenharia de Dados, Engenharia da Computação, Sistemas de Informação, Estatística, Matemática, Tecnologia ou áreas correlatas. **Requisitos Técnicos:** * Conhecimento em processos **ETL/ELT**. * Conhecimento em construção e orquestração de **pipelines de dados**. * Conhecimento em **Apache Airflow, Azure Data Factory, AWS Glue ou Google Cloud Composer**. * Conhecimento em **Apache Spark** e processamento distribuído de dados. * Conhecimento em bancos de dados **SQL e/ou NoSQL**. * Conhecimento em **modelagem de dados dimensional**. * Conhecimento em **Data Lakes e Data Warehouses**. * Conhecimento em manipulação de dados estruturados e não estruturados. * Noções de **tuning de queries e performance de bancos de dados**. * Conhecimento ou familiaridade com integração de dados via **APIs REST**. * Conhecimento em pelo menos um ambiente de **cloud**, preferencialmente Azure, AWS ou Google Cloud. * Interesse ou experiência inicial com pipelines de dados em tempo real, utilizando tecnologias como **Apache Kafka, Azure Event Hub, AWS Kinesis ou Google Cloud Pub/Sub**. **Diferenciais:** * Conhecimento em **Azure Data Factory/Data Flow**. * Conhecimento em **Azure Functions e Logic Apps**. * Experiência ou conhecimento em **Azure Databricks, Azure Synapse Analytics, AWS EMR, Google Cloud Dataproc, Snowflake, BigQuery ou Redshift**. * Conhecimento em **Power BI** e entendimento de como os dados são utilizados na construção de dashboards. * Conhecimento ou experiência com ambientes de **Machine Learning** e integração entre Engenharia de Dados e ML. * Cursos ou certificações relacionados a **Cloud, Engenharia de Dados, ETL/ELT, Azure, AWS ou Google Cloud**. #### **Informações Adicionais:** * **Prazo do projeto:** 12 meses * **Modelo de trabalho:** Remoto * Contratação no modelo **PJ (CNPJ ativo necessário)**. * Equipamento próprio. Junte\-se a um ecossistema dinâmico e faça parte da revolução do mercado!