About the role
Buscamos um(a) profissional para atuar na construção de produtos baseados em LLMs em ambiente produtivo, trabalhando em conjunto com o(a) Arquiteto(a) de Soluções GenAI.
O profissional será responsável por transformar arquiteturas e definições técnicas em código robusto, testado, observável e pronto para produção, atuando diretamente no desenvolvimento de soluções de Inteligência Artificial Generativa.
Responsabilidades
Desenvolvimento de Soluções GenAI
Implementar pipelines de RAG (Retrieval-Augmented Generation);
Desenvolver agentes utilizando frameworks como LangGraph;
Construir chatbots e copilots baseados em LLMs;
Integrar soluções de orquestração multi-modelo utilizando LiteLLM;
Implementar recursos como:Function Calling;
Memória para agentes;
Orquestração de agentes;
Integração com múltiplos modelos de linguagem.
Engenharia de Software
Desenvolver soluções full-stack utilizando:Python;
.NET/C#;
React/TypeScript;
Construir APIs robustas com suporte a:Streaming;
Processamento assíncrono;
Integrações entre sistemas;
Aplicar padrões de resiliência, como:Circuit Breaker;
Retry;
Timeout;
Atuar em soluções distribuídas e escaláveis.
Qualidade e Operação
Desenvolver e executar testes automatizados;
Implementar avaliações de qualidade de LLMs (LLM Evals);
Apoiar testes de regressão de modelos e prompts;
Implementar observabilidade de soluções de IA;
Monitorar indicadores como:Consumo de tokens;
Latência;
Custos de inferência;
Atuar na identificação e resolução de problemas em produção.
Colaboração Técnica
Participar de Code Reviews;
Contribuir para ADRs (Architecture Decision Records);
Apoiar a construção de POCs e MVPs;
Elaborar documentação técnica;
Trabalhar em conjunto com o(a) Arquiteto(a) de Soluções GenAI e demais times técnicos.
Requisitos e Qualificações
Obrigatórios
Experiência mínima de 4 anos em desenvolvimento de software;
Experiência mínima de 1 ano trabalhando com LLMs em soluções além de POCs;
Experiência prática com:LangChain;
LangGraph;
Implementação de soluções RAG;
Conhecimento em Python;
Experiência com pelo menos uma das tecnologias:.NET/C#;
React/TypeScript;
Experiência em desenvolvimento full-stack;
Conhecimento em APIs REST;
Experiência com mensageria e processamento assíncrono;
Noções de sistemas distribuídos;
Experiência com pelo menos um provedor de nuvem:Azure;
AWS;
GCP;
Experiência com CI/CD;
Conhecimento em Docker;
Experiência com pelo menos um provedor de LLM:Azure OpenAI;
Amazon Bedrock;
Vertex AI/Gemini;
Claude;
Conhecimento de Prompt Engineering aplicado;
Experiência com Git;
Vivência em times ágeis.
Diferenciais
Experiência com bancos de dados vetoriais, como:pgvector;
Pinecone;
Azure AI Search;
Conhecimento em arquiteturas multiagente;
Experiência com:CrewAI;
AutoGen;
Semantic Kernel;
Conhecimento em MCP (Model Context Protocol);
Experiência com observabilidade de LLMs:LangSmith;
Arize;
Conhecimento em frameworks de avaliação de LLMs:RAGAS;
DeepEval;
Experiência com:Guardrails;
Proteção e tratamento de PII;
Conhecimento em Kubernetes;
Certificações em Cloud;
Inglês avançado ou fluente, com boa conversação.
Originally posted on Himalayas