Impulsione a sua carreira em um dos maiores centros de P&D do país. Há 23 anos, desenvolvemos soluções sob medida em software e hardware para diversos segmentos em parceria com grandes players globais da área de tecnologia. Atuamos também com testes de laboratório, consultoria de inovação, capacitação, treinamento e certificação de produtos para telecomunicações.
É a sua chance de adquirir novas experiências e aplicar seu conhecimento em projetos relevantes que impactam positivamente a vida das pessoas.
Somos mais de 1.800 profissionais e reconhecidos como um dos Lugares Incríveis para se Trabalhar pelo prêmio FIA/UOL.
Estamos em grandes polos tecnológicos do país, com unidades em Brasília, Campinas, Manaus e Porto Alegre.
Temos infraestrutura completa de laboratórios, especialmente o de microeletrônica, que é referência em todo o país.
Somos o único membro da América Latina da associação europeia EARTO.
Temos expertise em tecnologias como inteligência artificial, visão computacional, computação gráfica, realidade virtual e aumentada, assistentes virtuais e interface por voz, big data e analytics, openRAN, sistemas embarcados, IoT e blockchain.
/n
Formação superior completa em Ciência da Computação, Engenharia da Computação, Análise de Sistemas, ou equivalente;
Experiência sólida em engenharia de dados, domínio de Python/PySpark e SQL;
Experiência prática com Databricks (ou Spark em geral) e ferramentas de orquestração como Azure Data Factory;
Conhecimento de formatos de dados analíticos (Parquet, Delta Lake);
Experiência com dbt é desejável;
Conhecimento de práticas de controle de versão (Git) e CI/CD para pipelines de dados;
Experiência com integração de dados via API REST;
Conhecimento de boas práticas de visualização de dados e storytelling com dados;
Experiência com fontes de dados diversas (SQL, APIs, arquivos, Lakehouse/Warehouse);
Experiência implementando segurança em nível de linha (Row Level Security);
Disponibilidade para viagens para cidade de São Paulo é um diferencial;
Inglês avançado é diferencial.
/n
Desenvolver e implantar pipelines de ingestão a partir de fontes heterogêneas: APIs REST, scraping web, procedures SQL de sistemas legados e arquivos;
Apoiar a implementação de mecanismos de réplica somente leitura para sistemas que não oferecem acesso direto ao banco (ex.: ERPs legados), com atenção ao impacto de performance nos sistemas de origem.Implementar transformações de dados em Azure Databricks / Fabric Spark usando PySpark e SQL;
Participar de benchmarks de custo e performance de processamento, contribuindo para a definição de dimensionamento mais eficiente;
Modelar e manter as camadas Bronze, Silver e Gold seguindo o padrão medallion architecture;
Implementar pipelines de scraping resilientes, com mecanismos de detecção de mudança de layout e tratamento de bloqueio;
Construir as camadas Bronze, Silver e Gold da plataforma, aplicando deduplicação, normalização e testes de qualidade de dados;
Desenvolver mecanismos de contrato de dados (data contracts) e alertas de schema drift para integrações de terceiros;
Construir dashboards e relatórios em Power BI a partir da camada de dados estruturada;
Traduzir requisitos de negócio em modelos de dados e visualizações eficazes;
Implementar controle de acesso a dados nos relatórios (Row Level Security), alinhado às políticas de RBAC da empresa;
Implementar testes de qualidade de dados e transformações declarativas usando dbt;
Apoiar a configuração de recursos de self-service analytics (ex.: Fabric Copilot);
Colaborar com o time de governança para garantir lineage e classificação adequada dos dados;
Diagnosticar e resolver problemas de performance em pipelines e consultas;
Realizar testes de aceitação com usuários finais e ajustar dashboards a partir do feedback.