Engenheiro de Dados Junior en Unkown

Remoto - Brasil

Postularse
Más vacantes en Unkown

Engenheiro de Dados Junior

Brasil 49 candidaturas

Vaga: Engenheiro de Dados Júnior - Home Office.

Estamos em busca de um Engenheiro de Dados Júnior para atuar em um cliente do ramo farmacêutico, contribuindo com o desenvolvimento e manutenção de pipelines de dados, garantindo eficiência, escalabilidade e governança.

Responsabilidades:

  • Desenvolver e manter pipelines de dados utilizando Python e/ou KNIME;
  • Modelar tabelas no BigQuery, aplicando conceitos de normalização, fatos e dimensões;
  • Manter e otimizar scripts em Python e SQL, assegurando qualidade e performance;
  • Administrar fluxos de trabalho com Airflow, garantindo automação e confiabilidade;
  • Utilizar serviços da Google Cloud Platform (GCP) – BigQuery, Google Bucket, Dataflow e Looker – para manipulação, armazenamento e visualização de dados;
  • Apoiar a criação de documentos de requisitos técnicos, alinhando entregas às necessidades do negócio e às melhores práticas de arquitetura de dados.

Requisitos técnicos:

  • Conhecimento em SQL ANSI DDL/DML (uma ou mais plataformas);
  • Noções de ferramentas de ambiente Hadoop: HDFS, Hive, Impala, Apache Airflow;
  • Programação em Python;
  • Experiência com processos ETL e pelo menos uma ferramenta relevante;
  • Manipulação de dados, incluindo tratamentos e data quality;
  • Desenvolvimento de código limpo, modular e estruturado;
  • Experiência com GCP (BigQuery, Google Bucket, Looker e demais ferramentas).

Conceitos desejáveis:

  • Engenharia de Software (conhecimento teórico é diferencial);

  • Tunning de bancos de dados e queries;

  • Orquestração e fluxo de jobs;

  • Mapas ETL, pipelines de dados e paralelização de processos, principalmente em Hadoop;

  • Lógica de programação;

  • Excel – Pivot Tables.

  • Nível de experiência

Júnior

  • Tipo de emprego

Tempo integral

  • Função

Tecnologia da informação

  • Setores

Atividades dos serviços de tecnologia da informação

Requisitos

Experiência

  • Experiência com processos ETL
  • Experiência com GCP (BigQuery, Google Bucket, Looker e demais ferramentas)

Habilidades

  • Python
  • KNIME
  • BigQuery
  • SQL
  • Airflow
  • Google Cloud Platform
  • Hadoop
  • HDFS
  • Hive
  • Impala
  • ETL
  • data quality

Responsabilidades

  • Desenvolver e manter pipelines de dados utilizando Python e/ou KNIME
  • Modelar tabelas no BigQuery, aplicando conceitos de normalização, fatos e dimensões
  • Manter e otimizar scripts em Python e SQL, assegurando qualidade e performance
  • Administrar fluxos de trabalho com Airflow, garantindo automação e confiabilidade
  • Utilizar serviços da Google Cloud Platform (GCP) – BigQuery, Google Bucket, Dataflow e Looker – para manipulação, armazenamento e visualização de dados
  • Apoiar a criação de documentos de requisitos técnicos, alinhando entregas às necessidades do negócio e às melhores práticas de arquitetura de dados

Tecnologias

PythonKNIMEBigQuerySQLAirflowGoogle Cloud PlatformGoogle BucketDataflowLookerHadoopHDFSHiveImpalaETL

Compartir vacante

Descubre si tu currículum está listo para esta vacante

Mira cómo nuestra IA puede optimizar tu currículum y aumentar tus chances en este puesto.