~/beer-and-code
▪ Clã Beer and Code a maior comunidade de Engenharia de IA do Brasil · ao vivo, toda semana entrar no Clã ›
~ / tutoriais $ ls -la

Tutoriais

Guias práticos passo a passo sobre Laravel, Filament e ecossistema PHP.

124 tutoriais
73 #ia · #ai-agents
Roadmap AI Engineer em 90 dias: do dev backend ao primeiro agente em produção

Caminho real de 13 semanas para dev backend experiente virar AI engineer aplicada. Tool use, harness próprio, RAG, memória, evals e um projeto fim-a-fim que cabe no portfólio. Sem refazer fundamentos, sem detour por framework da moda. Entregáveis por semana e foco no que recrutador olha de verdade.

10 Mai · 11 min ›
74 #openai · #ia
Model Graders: usando LLMs para avaliar LLMs (e os 3 erros que invalidam o seu eval)

LLM-as-judge é o atalho que todo time de IA usa pra escalar evals. Mas tem três armadilhas que silenciosamente invalidam o pipeline: self-preference, position e verbosity bias, e calibração ausente. Cobrimos os três padrões de prompt para grader (rubric, reference, pairwise) e como blindar contra cada erro com mitigação concreta.

08 Mai · 12 min ›
75 #ia · #rag
Engenharia de contexto na prática: 3 experimentos com tokens, custo e testes (8/8 vs 4/8)

Mesma tarefa de refatoração, três montagens de contexto: inflado (25k tokens), enxuto (2k) e vazio (150). Enxuto passou 8/8 testes com 4x menos custo; inflado aplicou regra descartada; vazio inventou faixas. Os números e o playbook Write, Select, Compress, Isolate em PHP/Laravel pra cortar ruído sem amputar sinal.

08 Mai · 11 min ›
76 #ia · #agentes
Specs como contrato com o agente: rodei a mesma spec em 4 LLMs pra ver quanto convergem

Experimento prático rodando a mesma spec em Claude Sonnet 4.6, GPT-5.1, Gemini 2.5 Pro e Llama 4 Maverick. Mede convergência via TSED e testes passados. Spec vaga deu 0,34 de similaridade entre pares; spec estruturada deu 0,78. A spec importa mais que o modelo.</excerpt> <parameter name="tags">["spec-driven-development", "sdd", "llm", "evals", "claude", "agentes", "requisitos", "testing"]

08 Mai · 9 min ›
77 #ia · #observabilidade
Do prompt frágil ao sistema confiável: pipeline de eval contínuo para prompts em produção

Trocou o modelo, mudou uma frase no system, ajustou um exemplo, e 30% dos casos regrediram em silêncio. Pipeline de eval contínuo no CI resolve isso. Dataset versionado, runner em cada PR, gate de qualidade que barra merge. Mão na massa com Promptfoo e GitHub Actions.

07 Mai · 10 min ›
78 #agentes · #produtividade
SDD vs BMAD vs Vibe Coding: qual metodologia faz sentido para seu time

Para de discutir "qual é melhor" e comece a discutir "qual cabe no seu contexto". Matriz de decisão com quatro eixos que mapeia SDD, BMAD e Vibe Coding ao quadrante onde performam.

07 Mai · 10 min ›
79 #laravel · #php
Hooks, Slash Commands e MCPs: a anatomia de um harness produtivo

Claude Code não é só um modelo, é um harness com três pontos de extensão (hooks, slash commands e MCPs). Cada um resolve um problema diferente. Esse post disseca peça por peça, com exemplos reais de configuração que rodam todo dia em projetos Laravel.

07 Mai · 11 min ›
80 #harness · #arquitetura-de-software
Versionando specs: como manter documentação viva sem virar mais um README abandonado

Tripé Git + spec + ADR (Architecture Decision Records) que mantém doc viva ao lado do código, com hooks de pré-commit que travam o drift. Estrutura mínima, scripts de validação e configuração pre-commit prontos para colar — sem precisar contratar engenheiro de documentação.

06 Mai · 5 min ›
81 #performance · #ia
RAG não é só vector search: combinando busca semântica, SQL e tools no mesmo agente

Vector-only, hybrid (BM25 + vetor + RRF) e o stack completo com SQL e reranker como tools separadas: comparação prática com benchmarks reais e código de produção.

06 Mai · 11 min ›
82 #ia · #agentes
Subagentes na prática: dividindo contexto entre Claudes para não estourar o token budget

Padrão pesquisador, executor e validador na prática. Por que três Claudes especializados batem um agente gigante em qualidade e travam menos no limite de contexto. Com números reais publicados pela Anthropic.

06 Mai · 10 min ›
83 #laravel · #php
Spec reversa: aplicando SDD em um módulo legado

SDD nasceu pensando em greenfield. A maioria dos tutoriais começa em mkdir projeto-novo e ignora quem está em projeto maduro. Reverse-spec resolve isso: o agente lê o código existente, gera a specification, humano revisa, e a partir daí o ciclo SDD clássico roda. Vou mostrar 4 passos práticos pra aplicar a técnica num módulo legado real, sem reescrever do zero e sem precisar esperar comando oficial em ferramenta nenhuma.

05 Mai · 10 min ›
84 #agentes · #ai-agents
BMAD Method vs SDD: onde acerta e onde vira ruído

BMAD promete um time agil de IA com personas para cada papel. Em termos de SDD, e Spec-Driven com mais cerimonia. Mapeio onde isso vale o overhead e onde so vira cerimonia que atrasa entrega.

05 Mai · 9 min ›
Conheça o Clã Beer and Code
tocando