Cientista de Dados Sênior - IA Generativa e Agentes
Descrição da vaga
A Leega é uma empresa focada no atendimento eficiente e inovador em seus clientes.
Isso não poderia ser diferente com o nosso principal combustível: as pessoas!
Nossa cultura é inspiradora e nossos valores estão presentes no dia a dia: ética e transparência, excelência de qualidade, trabalho em equipe, responsabilidade econômica, social e ambiental, relações humanas e credibilidade.
Buscamos profissionais inovadores que sejam movidos por desafios e focados em resultados.
Se você busca uma empresa dinâmica e parceira e que investe em seus colaboradores através de capacitação constante, a Leega é o lugar para você!
>> A LEEGA É PARA TODOS, ficaremos muito felizes em ter você em nosso time. Venha fazer parte da nossa história e da construção do nosso futuro.
Cadastre-se agora mesmo em nossas vagas!
Responsabilidades e atribuições
Buscamos um(a) Cientista de Dados Sênior com foco em IA Generativa para atuar em um projeto de construção de cinco agentes de IA para um grande cliente do setor de saúde e varejo farmacêutico. Os agentes automatizam processos de back-office: abertura de lojas, fiscalização sanitária, inteligência regulatória, compras e cadastro de planos de saúde.
Os agentes são criados por prompt na plataforma de IA do cliente e consultam bases de conhecimento via RAG (Azure OpenAI e MongoDB Vector Search). Eles se integram a sistemas corporativos por APIs, MCPs e automações RPA, e conversam com as áreas de negócio pelo Microsoft Teams.
Você será a pessoa responsável pela inteligência dos agentes, em uma squad com arquiteto de soluções, desenvolvedor e analista de negócios. O projeto trata dados sensíveis e passa por comitê de arquitetura e segurança; por isso, governança, LGPD e rastreabilidade fazem parte do trabalho desde o primeiro dia.
Responsabilidades e atribuições:
- Desenvolver e versionar os prompts de sistema dos agentes: papel e escopo, guardrails, ações permitidas, prazos e SLAs, controle de fluxo em processos de longa duração, política de chamada de tools, formato de saída e escalonamento humano.
- Preparar e estruturar as bases de conhecimento para RAG: normas regulatórias, políticas internas, RFPs e regras operacionais. O trabalho inclui limpeza, divisão em seções, metadados de vigência e organização por categorias e grupos de acesso.
- Avaliar a qualidade da recuperação (recall@k, isolamento entre grupos de acesso) e ajustar a estratégia de RAG.
- Construir fluxos de OCR e extração de informação de documentos (PDFs, fotos e manuscritos), com métricas de qualidade e tratamento de documentos ilegíveis.
- Implementar serviços de anonimização e mascaramento de dados pessoais, além de guardrails de entrada (anti prompt injection) e de saída (schema, vazamento de dados, ações proibidas).
- Montar golden sets e um harness de avaliação de prompts, com regressão a cada versão e medição de acurácia e custo por caso.
- Avaliar e homologar modelos de LLM de diferentes provedores por tipo de tarefa, aplicando práticas de FinOps de IA: roteamento entre modelos leves e robustos, batch e prompt caching.
- Criar os agentes na plataforma do cliente em conjunto com o time técnico, e apoiar testes integrados, homologação com usuários (UAT) e operação assistida.
- Documentar decisões técnicas e apoiar o material submetido ao comitê de arquitetura (custos, segurança e tratamento de dados).
Requisitos e qualificações
Obrigatórios:
- Formação superior em Ciência da Computação, Estatística, Matemática, Engenharia, Sistemas de Informação ou áreas correlatas.
- 4 anos ou mais de experiência em ciência de dados ou machine learning, sendo parte em projetos com IA Generativa.
- Experiência prática com LLMs: engenharia de prompts, function calling/tools, saída estruturada (JSON Schema) e agentes.
- Experiência com RAG: embeddings, bancos vetoriais, busca híbrida, reranking e avaliação de recuperação.
- Python para experimentação, avaliação e tratamento de dados.
- Construção de datasets e métricas de avaliação para soluções com LLM (acurácia, precisão/recall, LLM-as-judge).
- Conhecimento em OCR e extração de informação de documentos (modelos multimodais e/ou Document AI).
- Conhecimento de governança de IA e LGPD: mascaramento, anonimização e minimização de dados.
- Inglês intermediário/avançado.
Diferenciais:
- Azure OpenAI e/ou Microsoft Foundry; MongoDB Atlas Vector Search.
- Protocolo MCP e padrões de agentes (ReAct, fluxos com estado).
- Segurança de LLMs: prompt injection, red teaming e guardrails.
- FinOps de IA: estimativa e otimização de custo de tokens e comparação entre provedores.
- Node.js/TypeScript.
- Vivência com RPA ou integrações com ServiceNow, Microsoft Teams/Graph ou SAP.
- Conhecimento de negócio em saúde/regulatório (ANVISA), suprimentos ou benefícios de RH.
- Certificações em Cloud ou IA (Azure AI Engineer, por exemplo).
Informações adicionais
Trabalho Remoto
Tempo de Projeto: 5 meses, com possibilidade de extensão/internalização.
Etapas do processo
- Etapa 1: Cadastro
- Etapa 2: Avaliação de Perfil
- Etapa 3: Teste Coploy
- Etapa 4: Entrevista Gestor
- Etapa 5: Entrevista Cliente
- Etapa 6: Contratação
Onde a inteligência humana amplifica o poder dos dados
Na Leega, não entregamos apenas linhas de código ou dashboards. Transformamos desafios tecnológicos complexos em impacto real. Com mais de 15 anos de estrada, unimos a profundidade da experiência humana à velocidade da Inteligência Artificial para criar soluções que mudam negócios e, acima de tudo, melhoram a vida das pessoas.
Somos uma consultoria de tecnologia, agnóstica e estratégica. Com escritórios no Brasil e na Europa, nosso time de mais de 580 talentos multidisciplinares vive e respira o ecossistema de Data Analytics, Cloud e IA. Dominamos a base, da Governança à Engenharia, para garantir que a tecnologia não seja apenas uma ferramenta, mas uma vantagem competitiva sustentável para os maiores players do mercado.
A Leega em outras plataformas