Lucas Souza
{AI Engineer} — apaixonado por Laravel, arquitetura de software e construir produtos com impacto. Compartilho aqui tutoriais, descobertas e reflexões sobre o dia a dia de engenharia.
Embedding sozinho erra mais do que você imagina. Veja como combinar busca lexical (BM25), busca semântica e um reranker cross-encoder para subir a qualidade do RAG em produção, com código em Python e LangChain.
Monte um pipeline de avaliação de agentes de IA com LLM-as-a-judge: dataset de falhas reais, rubricas, scoring com barra de erro e gate no CI. Sem eval, deploy é no escuro.
Modelos open source fecharam o gap em 2026. Mas "open source" não é "local" e "local" não é "de graça". A conta honesta de quando rodar LLM local compensa: custo, privacidade e velocidade.
Comprar licença de IA não deixa a empresa pronta pra IA. Um framework de prontidão para IA em quatro frentes — dados, processos, pessoas e governança — com os números que mostram onde a maioria trava.
Comparativo prático entre Claude Code e Codex para coding agêntico em 2026: onde cada um ganha em repo real, terminal e custo. A melhor IA para programar em 2026 não é um nome — é uma decisão de cenário.
Tutorial de um bot de Slack que responde perguntas sobre seus dados com Claude, baseado no cookbook da Anthropic. Do app_mention ao agente em produção.
Tutorial mão na massa pra escrever um servidor MCP em Python do zero — uma tool, um resource e um prompt — rodando em stdio e HTTP, plugado no Claude.
O que um engenheiro de IA realmente faz no dia a dia em 2026: a rotina real, o stack que ele toca, o que NÃO faz e como entrar na área vindo de dev backend. Spoiler: não é treinar modelo o dia inteiro.
Desenvolvedor de IA e engenheiro de IA não são dois nomes pra mesma vaga. Comparativo direto de escopo, skills, salário e carreira, e onde o dev de produto cruza a linha.
Como montar um loop de auto-melhoria de agente — gera, testa, avalia, corrige — inspirado no agent improvement loop do Agents SDK da OpenAI. Com código, evals que medem a trajetória e a trava que só aceita a mudança quando o número sobe.
Estratégias para usar Claude Code em monorepo e large codebase sem estourar o context window: escopo de sessão, CLAUDE.md em camadas, code intelligence e subagentes.
Guia prático dos três pontos de extensão do Claude Code — hooks, slash commands e MCP. Os arquivos de config exatos pra transformar o agente de autocomplete em parte do seu fluxo de engenharia.