PT

Tech Lead Gen AI

Descrição da vaga:

Estamos construindo soluções de IA Generativa chatbots corporativos, assistentes com RAG, agentes que executam ações e fluxos de automação, utilizando LLMs já disponíveis no mercado. Buscamos uma pessoa para liderar tecnicamente iniciativas que envolvem estratégia avançada de soluções de LLM nos principais provedores, como OCI, AWS e Azure.

O desafio é gerar valor a partir das capacidades das LLMs modernas para resolver problemas complexos, explorando recursos como tools, thinking, agents e LLM skills. Essas capacidades se somam a um ecossistema de gestão que abrange disponibilidade e uso de modelos, billing, gestão de tokens, FinOps, RBAC e ABAC, entre outros elementos de governança.


O que você vai fazer

  • Arquitetar o ecossistema de GenAI da solução, escolhendo o padrão certo para cada problema: chatbots com capacidade comparável à dos grandes fornecedores (OpenAI, Claude, Gemini), uso intensivo de tools específicas por modelo e fluxos determinísticos para responder a perguntas complexas que envolvem cálculos precisos.
  • Operar a camada conversacional: autenticação, controle de acesso (RBAC e ABAC), gestão de múltiplos modelos/provedores e governança de conversas.
  • Projetar os processos de busca, combinando busca determinística (NL2SQL) com busca semântica/RAG (vetorial e híbrida), garantindo que aquilo que não pode errar seja tratado por código — e não pela "criatividade" do modelo.
  • Especificar e integrar agentes e ferramentas (function calling / tools, MCP): quais ações o agente pode executar, tratamento de falhas, limites de autonomia e supervisão humana em ações sensíveis.
  • Coordenar a plataforma de dados e serving no Databricks (Vector Search, Mosaic AI, model serving, Unity Catalog): versionamento, atualização e permissões dos dados que alimentam o RAG.
  • Garantir avaliação e observabilidade do ecossistema: qualidade das respostas, fidelidade às fontes, alucinação, custo por interação (tokens), latência e escalabilidade.
  • Definir guardrails e segurança: prevenção de prompt injection, mascaramento de PII, filtros de conteúdo e conformidade (LGPD, AI Act).
  • Gerir custo e escolha de modelo: roteamento entre modelos, caching e controle de consumo de tokens.
  • Alinhar expectativas de stakeholders, comunicando progresso, limitações e trade-offs de forma clara para públicos técnicos e não técnicos.
  • Capacidade de gerar informações analiticas: para ajudar a entender o que ocorre por todo processo de serviços de GENAI.


O que buscamos

  • Experiência prática construindo aplicações de LLM em produção (não apenas provas de conceito).
  • Domínio de RAG de ponta a ponta: chunking, embeddings, bancos vetoriais, busca híbrida, busca determinística, NL2SQL, arquitetura agêntica, reranking e diagnóstico de falhas de recuperação.
  • Engenharia de prompts e padrões de design de LLM (few-shot, structured output/JSON, chain-of-thought).
  • Experiência com frameworks de orquestração de agentes (LangChain/LangGraph, CrewAI, Agno, LlamaIndex, AutoGen, Semantic Kernel ou similares) e com function calling / tools / skills.
  • Vivência com Databricks aplicado a GenAI (Vector Search, Mosaic AI, Unity Catalog) e base de Spark/SQL.
  • Clareza sobre a fronteira entre o determinístico e o probabilístico — saber onde o código previsível termina e o LLM começa.
  • Fluência em Python e noções de infraestrutura (Docker, APIs REST, deploy de serviços).
  • Capacidade de avaliar sistemas de LLM (suítes de teste, LLM-as-a-judge com cautela, testes de regressão).
  • Perfil de liderança técnica: coordenar equipe, priorizar e traduzir necessidades de negócio em solução técnica.


Diferenciais

  • Experiência com plataformas corporativas como OpenAI, Claude, Gemini e Perplexity.
  • Familiaridade com MCP (Model Context Protocol) e arquiteturas multiagente.
  • Uso de ferramentas de observabilidade de LLM (Langfuse, LangSmith ou equivalentes).
  • Experiência com segurança de GenAI (prompt injection, escopo de assistentes, dados não confiáveis).
  • Conhecimento de governança de dados e conformidade regulatória aplicada a IA.
  • Estratégia multiprovedor e otimização de custo em escala.
  • Conhecimento em ferramentas de analise de dados para geração de dashboard e cockpits


Informações Adicionais

Modelo de contratação: PJ

Localização
Modelo de contratação
Modelo de trabalho
São Paulo, SP, BR
Autônomo PJ
Híbrido