~/beer-and-code
▪ próximo evento Workshop: Jev na Prática para Devs · 14 Out · 19h — duração de 2h a 3h, ao vivo via Google Meet garantir vaga ›
~ / tag / #claude-code $ grep

#Claude Code

47 posts
37 #ai-agents · #produtividade
Vale a pena usar Cursor em 2026? 6 meses rodando Cursor, Claude Code e Windsurf lado a lado

Seis meses rodando Cursor, Claude Code e Windsurf no mesmo projeto Laravel. Pricing maio/2026, benchmarks, custo real em USD e veredito por persona: dev solo, time pequeno mixed-stack e time grande JS/TS.

26 Mai · 10 min ›
38 #tool-use · #llm-as-a-judge
Prompt para code review: 5 padrões que sobem o sinal de 12% pra 67%

Prompt para code review com LLM que o time realmente lê: cinco padrões (diff-anchored, severity gate, tool use antes do palpite, citation obrigatória e self-grading com threshold) que sobem o signal ratio de ~20% pra acima de 60%. Vem com REVIEW.md completo e workflow de GitHub Actions pronto pra plugar em um projeto Laravel.

24 Mai · 15 min ›
39 #ai-agents · #observabilidade
Quanto custa um agente em produção em 2026: planilha real depois de 6 meses

A calculadora da OpenAI mente. Pricing de token é só um item de linha; a fatura real de um agente em produção tem seis baldes: inferência, eval em runtime, observability, infra, pessoas, outros. Este post abre o balancete de 6 meses, mês a mês, com números e fontes. No fim, build vs buy: quando vale construir e quando você está pagando para reinventar o Cursor.

14 Mai · 16 min ›
40 #performance · #ia
Quando NÃO usar Agentic Code: 8 cenários onde o agente é prejuízo

Curva de hype joga todo mundo no extremo. Aqui está a lista honesta de 8 cenários onde, em 2026, o agente custa mais caro, demora mais e ainda erra mais que o time fazendo na mão, com explicação técnica, benchmarks e dor de produção.

13 Mai · 12 min ›
41 #laravel · #php
TDD com agentes: como escrever testes que sobrevivem ao código gerado

Agente deletou o teste pra fazer passar. Aconteceu, vai acontecer. METR documentou em 2025 modelos modificando timers e graders pra parecer rápido. TDD com agente exige inversão: o teste é a especificação executável, quem escreve o teste manda no agente.

13 Mai · 10 min ›
42 #laravel · #tool-use
Code review com IA: benchmark de 7 ferramentas (precision e recall) e como medir se o seu bot acerta

Setup completo de bot de code review com Claude no GitHub Actions num projeto Laravel: workflow YAML pra colar, allowedTools pra rodar php artisan test antes de comentar, scoring de confiança com threshold 80, armadilhas de fork e pull_request_target, e um script que mede precision e recall do bot contra os comentários humanos do time.

12 Mai · 15 min ›
43 #ia · #agentes
Agente autônomo: os 4 níveis de autonomia na prática

Quem roda agentes em código de verdade já entendeu que a régua não é se o agente faz, mas quem aprova, quem reverte e quem audita cada ação. Mapa prático de quatro níveis de autonomia em agentic code, do tab completion ao agente que abre PR sozinho em CI, com os gates de engenharia que sustentam cada degrau.

12 Mai · 18 min ›
44 #laravel · #php
Hands-on: meu primeiro Pull Request 100% gerado por agente em Laravel (com diff e revisão)

Liguei o agente, fui tomar café e voltei 43 minutos depois com um PR de 380 linhas em 9 arquivos. Case study real com harness Laravel + Claude Agent SDK + sandbox isolado, a task escolhida, o loop cronometrado de 43 min em 12 iterações, o diff comentado, os 3 bugs que escaparam pro code review humano, custo total em USD e o veredito sobre soltar isso em produção. Repositório público no final.

11 Mai · 13 min ›
45 #ia · #ai-agents
Agentic Code vs Vibe Coding vs SDD: a tabela definitiva pra escolher por contexto

Três paradigmas, três comunidades brigando no Twitter, e zero clareza sobre quando cada um performa. Definição operacional de vibe coding, agentic engineering e SDD, tabela com oito critérios e árvore de decisão pronta pra colar na wiki do time.

11 Mai · 11 min ›
46 #php · #openai
Agentic Code: o que muda quando o agente escreve, executa e testa o próprio código

Vibe coding deixou o dev no volante. SDD desenhou o mapa. Agentic Code tira o dev do carro e dá a chave pro agente, com freio de mão na mão. Cunhagem do termo em PT-BR, taxonomia de 4 níveis de autonomia, anatomia do ciclo plan/act/observe/reflect, demo comparativa de CRUD em três paradigmas, modos de falha reais e o que o harness precisa garantir pra rodar agente em produção sem quebrar tudo.

09 Mai · 11 min ›
47 #laravel · #php
Hooks, Slash Commands e MCPs: a anatomia de um harness produtivo

Claude Code não é só um modelo, é um harness com três pontos de extensão (hooks, slash commands e MCPs). Cada um resolve um problema diferente. Esse post disseca peça por peça, com exemplos reais de configuração que rodam todo dia em projetos Laravel.

07 Mai · 11 min ›
Conheça o Clã Beer and Code
tocando