~/beer-and-code
▪ próximo evento Workshop: Jev na Prática para Devs · 14 Out · 19h — duração de 2h a 3h, ao vivo via Google Meet garantir vaga ›
~ / tag / #claude $ grep

#Claude

69 posts
49 #performance · #ai-agents
Plan-and-Execute: o pattern que cortou 90% do custo do nosso agente

Agente nosso queimava US$ 2.300/mês rodando Claude Opus em loop. Trocamos por Plan-and-Execute: uma chamada cara que planeja, N chamadas baratas que executam. Conta nova: US$ 220/mês com a mesma qualidade. Planilha de tokens, código Laravel (PlanJob + ExecuteStep) e o tipo de fluxo onde esse pattern quebra.

29 Mai · 10 min ›
50 #ia · #ai-agents
MCP em produção: OAuth 2.1, schemas validados e o gateway que precisa estar entre você e o agente

MCP local não é MCP em produção. Sair do stdio no laptop pra um servidor MCP servindo agente corporativo exige três mudanças: Streamable HTTP no transporte, OAuth 2.1 com PKCE e Resource Indicators na auth, e JSON Schema 2020-12 estrito nos argumentos. E um gateway corporativo no meio, sempre.

29 Mai · 17 min ›
51 #ia · #ai-agents
Claude Opus 4.8 chegou: o que muda de verdade pra quem entrega IA em produção

A Anthropic lançou o Claude Opus 4.8 hoje. Filtramos o que importa pra quem coda e roda agentes: liderança no SWE-Bench Pro, 84% em browser-agent, tool calling com menos passos, 4x menos bug sem comentar, multimodal 61% mais barato e Dynamic Workflows com centenas de subagentes no Claude Code, tudo no mesmo preço do 4.7.

28 Mai · 8 min ›
52 #ai-agents · #observabilidade
Observabilidade de agentes de IA: LangSmith vs Langfuse vs Helicone (e o que cada um NÃO faz)

Mapa frio das três opções de LLM observability (uma delas em maintenance mode desde março de 2026), setup Langfuse self-hosted em Laravel e o esquema de tracing mínimo pra reconstruir a decisão do agente sem plataforma nenhuma.

28 Mai · 19 min ›
53 #arquitetura-de-software · #claude
Como documentar decisões técnicas com IA: ADRs que envelhecem bem (e o Claude que escreve com você)

Time pequeno raramente escreve ADR porque dói. Com Claude no fluxo a primeira versão sai em 4 minutos. Tem o template em 7 seções que envelhece bem, o prompt mestre em XML que extrai a decisão sem interrogatório e três anti-padrões clássicos que matam ADR em produção.

27 Mai · 11 min ›
54 #php · #automacao
Pipeline de revisão automatizada de PR com GitHub Actions e Claude

Pipeline em três camadas que automatiza revisão de PR sem ruído: um gate filtra trivialidades, um reviewer com Claude e tool use roda php artisan test antes de comentar, e um escalator chama humano quando o modelo não tem confiança. Workflow YAML completo, prompt em XML em três blocos e um caso real de SQL injection que o bot pegou em produção.

26 Mai · 14 min ›
55 #laravel · #eloquent
Migrei um projeto real de Prism pro Laravel AI SDK: 47 linhas a menos, diff aberto

Case de migração: portei um projeto real de Prism pra SDK oficial do Laravel e abri o diff. 47 linhas a menos no serviço de IA, switch de provider em um atributo, embeddings e vector store no Eloquent, e os casos em que ficar no Prism é a decisão certa. Se a dúvida é qual pacote escolher, comece pelo comparativo Laravel AI SDK vs Prism.

25 Mai · 3 min ›
56 #tool-use · #llm-as-a-judge
Prompt para code review: 5 padrões que sobem o sinal de 12% pra 67%

Prompt para code review com LLM que o time realmente lê: cinco padrões (diff-anchored, severity gate, tool use antes do palpite, citation obrigatória e self-grading com threshold) que sobem o signal ratio de ~20% pra acima de 60%. Vem com REVIEW.md completo e workflow de GitHub Actions pronto pra plugar em um projeto Laravel.

24 Mai · 15 min ›
57 #openai · #ia
Google I/O 2026: 7 anúncios que mudam o trabalho do AI engineer brasileiro

Os sete movimentos de plataforma do Google I/O 2026 que mudam o trabalho do AI engineer brasileiro, com comparativo Gemini 3.5 Flash x Sonnet 4.5 x GPT-5.5 em três tarefas backend reais e o que ignorar do hype enterprise.

23 Mai · 11 min ›
58 #laravel · #tool-use
Code review com IA: benchmark de 7 ferramentas (precision e recall) e como medir se o seu bot acerta

Setup completo de bot de code review com Claude no GitHub Actions num projeto Laravel: workflow YAML pra colar, allowedTools pra rodar php artisan test antes de comentar, scoring de confiança com threshold 80, armadilhas de fork e pull_request_target, e um script que mede precision e recall do bot contra os comentários humanos do time.

12 Mai · 15 min ›
59 #laravel · #php
Hands-on: meu primeiro Pull Request 100% gerado por agente em Laravel (com diff e revisão)

Liguei o agente, fui tomar café e voltei 43 minutos depois com um PR de 380 linhas em 9 arquivos. Case study real com harness Laravel + Claude Agent SDK + sandbox isolado, a task escolhida, o loop cronometrado de 43 min em 12 iterações, o diff comentado, os 3 bugs que escaparam pro code review humano, custo total em USD e o veredito sobre soltar isso em produção. Repositório público no final.

11 Mai · 13 min ›
60 #ia · #backend
Engenharia de IA não é Data Science: 7 diferenças que separam disciplina de hype

Recrutador chama as duas de "vaga de IA". CTO que confunde uma com a outra paga seis meses de retrabalho. Põe lado a lado data science e engenharia de IA em sete eixos: foco, métrica, stack, output, tempo de feedback, quem migra mais rápido e por que essa confusão atrasa carreira.

09 Mai · 9 min ›
Conheça o Clã Beer and Code
tocando