All jobs
Save

Pessoa Engenheira de Dados Sênior

Zup Innovation
Contract type
Ongoing
Work mode
100% remote
Experience
3 years

Job description

Key details

  • Participar do processo de entendimento das necessidades do negócio, entendendo e garantindo a entrega de valor
  • Desenhar a arquitetura e avaliar as tecnologias disponíveis para resolver o problema certo
  • Desenvolver e evoluir pipelines de dados escaláveis e preparados para alimentar modelos de IA Generativa e soluções de RAG
  • Implementar pipelines de Dados para democratização de dados em uma arquitetura Data Mesh, criando camadas semânticas e dados estruturados para consumo por IA
  • Combinar a arquitetura e tecnologia para desenvolver e entregar componentes reutilizáveis como conectores, APIs, SDKs, CLIs, integrando com APIs de LLMs (OpenAI, Claude, Gemini)
  • Prototipar agentes inteligentes utilizando frameworks como LangChain, LangGraph e CrewAI, avaliando custo, latência e qualidade das integrações
  • Testar e automatizar tudo que for possível
  • Validar e adaptar os componentes de acordo com os feedbacks dos usuários
  • Colaborar com a qualidade e inovação tecnológica do produto e ambiente de trabalho
  • Company mission
  • Usar a tecnologia para transformar a vida de pessoas, potencializar talentos desperdiçados por falta de acesso e posicionar regiões desprivilegiadas como pólos de tecnologia de qualidade

Primary stack

Core technologies

Python (Programming Language)AWSTerraform

Benefits

  • Plano de desenvolvimento de carreira
  • Acompanhamento próximo por uma pessoa do time de People
  • Acesso a uma plataforma proprietária que tangibiliza o sentimento de progresso
  • Liberdade para trabalhar de onde quiserem (home office, escritórios ou modelo híbrido)

Requirements & details

  • Conhecimento em processamento de dados em larga escala, processamento paralelo e distribuído (Apache Spark, Hadoop, Hive, etc)
  • Experiência prática em ELT utilizando dbt, Data Lake/Lakehouse e orquestração com Airflow
  • Experiência com serviços de Data & Analytics da nuvem AWS (Glue, EMR, Athena, Quicksight)
  • Conhecimento de linguagem de programação Python
  • Domínio sobre os principais serviços da Cloud AWS (S3, Lambda, SQS, DynamoDB, API Gateway)
  • Proficiência no uso de LLMs, aplicação prática de embeddings, RAG (Retrieval-Augmented Generation) e Bancos Vetoriais (Pinecone, Milvus, pgvector, Qdrant, etc.)
  • Habilidade em Engenharia de Prompts e orquestração com frameworks como LangChain ou LangGraph
  • Atuação prática consistente com bases de dados relacionais (SQL) e NoSQL (documentos e chave-valor)
  • Domínio de práticas de DevOps e infraestrutura como código (Terraform, CodePipeline, etc)
  • Desejável: Experiência anterior em iniciativas de democratização de dados com Data Mesh
  • Desejável: Experiência em avaliação comparativa entre diferentes LLMs de mercado considerando custo-benefício e latência
  • Desejável: Experiência com IA generativa ou ferramentas de automação aplicadas a pipelines de dados, como geração assistida de código, documentação automatizada ou monitoramento inteligente de qualidade de dados
  • Desejável: Conhecimentos de Observability
  • Python, AWS, Apache Spark, Hadoop, Hive, dbt, Airflow, LangChain, LangGraph, CrewAI, OpenAI, Claude, Gemini, Pinecone, Milvus, pgvector, Qdrant, Terraform, CodePipeline
  • Python (Programming Language)
  • AWS
  • Terraform

Apply