Staff Data Engineer
Jaya Tech
Job Description
Staff Data Engineer — Plataformas de Dados e IA
Atuação 100% remota | Forma de contratação: CLT | Remuneração: Real | Full-time
Esta é uma oportunidade para fazer parte de uma equipe de engenharia altamente experiente, responsável por construir a próxima geração de plataformas de dados impulsionadas por Inteligência Artificial. Procuramos uma pessoa Staff Data Engineer que combine profundo conhecimento em engenharia de dados com uma sólida visão arquitetural. Você trabalhará na resolução de desafios complexos, no desenvolvimento de plataformas escaláveis e na definição de padrões técnicos para diferentes equipes de engenharia.
Esta é uma posição prática como Individual Contributor (Staff IC). Você influenciará a direção técnica da plataforma de dados, projetará e implementará arquiteturas de dados de nível produtivo, orientará profissionais experientes e viabilizará casos de uso de IA e analytics em escala.
Suas responsabilidades
- Definir a arquitetura técnica e o roadmap de plataformas de dados e IA nativas da nuvem.
- Projetar e implementar pipelines de dados escaláveis para processamento batch e streaming.
- Construir e evoluir arquiteturas lakehouse que suportem workloads de analytics, machine learning e IA generativa.
- Desenvolver frameworks reutilizáveis para ingestão, transformação, orquestração e disponibilização de dados.
- Projetar modelos de dados curados e data products para casos de uso analíticos e operacionais.
- Estabelecer padrões de qualidade, observabilidade, linhagem, governança, segurança e gestão do ciclo de vida dos dados.
- Otimizar workloads distribuídos para garantir confiabilidade, desempenho, escalabilidade e eficiência de custos.
- Viabilizar soluções de IA em produção por meio da construção de bases de dados para recuperação de informações, embeddings, avaliação e fluxos de trabalho com agentes.
- Trabalhar em parceria com equipes de Data Science, IA, Analytics, Plataforma e áreas de negócio para transformar requisitos em soluções de dados confiáveis.
- Liderar decisões arquiteturais e promover boas práticas de engenharia em toda a organização de dados.
- Orientar profissionais seniores por meio de revisões de design, discussões técnicas e resolução colaborativa de problemas.
O que buscamos:
Profissionais com sólida experiência em:
- Arquitetura de plataformas e pipelines de dados.
- Processamento de dados batch e streaming.
- Frameworks de processamento distribuído.
- Arquiteturas de data lake, data warehouse e lakehouse.
- Modelagem de dados para workloads analíticos e operacionais.
- Padrões de arquitetura ETL e ELT.
- Orquestração de workflows e gerenciamento de dependências.
- Plataformas de dados em nuvem — AWS, Azure ou GCP.
- Bancos de dados relacionais, NoSQL e analíticos.
- Qualidade, linhagem, observabilidade e governança de dados.
- Segurança, privacidade e controle de acesso em plataformas de dados.
- Otimização de desempenho e gestão de custos.
- Práticas de engenharia de software aplicadas a sistemas de dados.
- Experiência com tecnologias como Apache Spark, Kafka, Databricks, Airflow, dbt, Delta Lake, Apache Iceberg ou plataformas equivalentes será altamente valorizada.
- Dados para Inteligência Artificial e Machine Learning
Também valorizamos experiência no suporte a workloads modernos de IA, especialmente em:
- Pipelines de dados para machine learning e Large Language Models (LLMs).
- Retrieval-Augmented Generation (RAG).
- Geração e gerenciamento de embeddings.
- Bancos de dados vetoriais e busca híbrida.
- Pipelines de preparação de dados e avaliação de soluções de IA.
- Fluxos de trabalho com agentes de IA e frameworks de orquestração.
- Model Context Protocol (MCP).
- Monitoramento, governança e observabilidade de sistemas de IA em produção.
Requisitos obrigatórios:
- Experiência comprovada no desenho, desenvolvimento e operação de plataformas de dados complexas em produção.
- Experiência atuando como Staff Engineer ou em uma posição equivalente de liderança técnica.
- Conhecimento profundo de sistemas distribuídos e arquiteturas modernas de dados.
- Sólidos fundamentos de programação e engenharia de software.
- Experiência na liderança de iniciativas técnicas e decisões arquiteturais entre diferentes equipes.
- Excelentes habilidades de comunicação, colaboração e mentoria.
- Inglês fluente ou avançado — nível B2 ou superior.
Diferenciais
- Experiência prática com Databricks ou plataformas modernas de dados em nuvem equivalentes.
- Experiência com ferramentas de governança, catálogos de dados e data contracts.
- Experiência com Infrastructure as Code utilizando Terraform ou tecnologias semelhantes.
- Certificações AWS, Azure, GCP e/ou Databricks.
- Experiência na construção de plataformas para analytics, machine learning ou IA generativa em escala.
- Experiência anterior em Agronegócio, Ciências da Vida ou outros setores com grandes volumes e alta complexidade de dados.
O que você encontrará:
- Trabalho 100% remoto.
- Ambiente internacional e colaborativo.
- Equipe de engenharia altamente experiente.
- Iniciativas de dados e IA desenvolvidas do zero.
- Oportunidade de definir a arquitetura e a estratégia técnica de uma plataforma moderna de dados.
- Projetos de longo prazo, tecnicamente desafiadores e com impacto significativo para o negócio.