#Claude
Agente nosso queimava US$ 2.300/mês rodando Claude Opus em loop. Trocamos por Plan-and-Execute: uma chamada cara que planeja, N chamadas baratas que executam. Conta nova: US$ 220/mês com a mesma qualidade. Planilha de tokens, código Laravel (PlanJob + ExecuteStep) e o tipo de fluxo onde esse pattern quebra.
MCP local não é MCP em produção. Sair do stdio no laptop pra um servidor MCP servindo agente corporativo exige três mudanças: Streamable HTTP no transporte, OAuth 2.1 com PKCE e Resource Indicators na auth, e JSON Schema 2020-12 estrito nos argumentos. E um gateway corporativo no meio, sempre.
A Anthropic lançou o Claude Opus 4.8 hoje. Filtramos o que importa pra quem coda e roda agentes: liderança no SWE-Bench Pro, 84% em browser-agent, tool calling com menos passos, 4x menos bug sem comentar, multimodal 61% mais barato e Dynamic Workflows com centenas de subagentes no Claude Code, tudo no mesmo preço do 4.7.
Mapa frio das três opções de LLM observability (uma delas em maintenance mode desde março de 2026), setup Langfuse self-hosted em Laravel e o esquema de tracing mínimo pra reconstruir a decisão do agente sem plataforma nenhuma.
Time pequeno raramente escreve ADR porque dói. Com Claude no fluxo a primeira versão sai em 4 minutos. Tem o template em 7 seções que envelhece bem, o prompt mestre em XML que extrai a decisão sem interrogatório e três anti-padrões clássicos que matam ADR em produção.
Pipeline em três camadas que automatiza revisão de PR sem ruído: um gate filtra trivialidades, um reviewer com Claude e tool use roda php artisan test antes de comentar, e um escalator chama humano quando o modelo não tem confiança. Workflow YAML completo, prompt em XML em três blocos e um caso real de SQL injection que o bot pegou em produção.
Case de migração: portei um projeto real de Prism pra SDK oficial do Laravel e abri o diff. 47 linhas a menos no serviço de IA, switch de provider em um atributo, embeddings e vector store no Eloquent, e os casos em que ficar no Prism é a decisão certa. Se a dúvida é qual pacote escolher, comece pelo comparativo Laravel AI SDK vs Prism.
Prompt para code review com LLM que o time realmente lê: cinco padrões (diff-anchored, severity gate, tool use antes do palpite, citation obrigatória e self-grading com threshold) que sobem o signal ratio de ~20% pra acima de 60%. Vem com REVIEW.md completo e workflow de GitHub Actions pronto pra plugar em um projeto Laravel.
Os sete movimentos de plataforma do Google I/O 2026 que mudam o trabalho do AI engineer brasileiro, com comparativo Gemini 3.5 Flash x Sonnet 4.5 x GPT-5.5 em três tarefas backend reais e o que ignorar do hype enterprise.
Setup completo de bot de code review com Claude no GitHub Actions num projeto Laravel: workflow YAML pra colar, allowedTools pra rodar php artisan test antes de comentar, scoring de confiança com threshold 80, armadilhas de fork e pull_request_target, e um script que mede precision e recall do bot contra os comentários humanos do time.
Liguei o agente, fui tomar café e voltei 43 minutos depois com um PR de 380 linhas em 9 arquivos. Case study real com harness Laravel + Claude Agent SDK + sandbox isolado, a task escolhida, o loop cronometrado de 43 min em 12 iterações, o diff comentado, os 3 bugs que escaparam pro code review humano, custo total em USD e o veredito sobre soltar isso em produção. Repositório público no final.
Recrutador chama as duas de "vaga de IA". CTO que confunde uma com a outra paga seis meses de retrabalho. Põe lado a lado data science e engenharia de IA em sete eixos: foco, métrica, stack, output, tempo de feedback, quem migra mais rápido e por que essa confusão atrasa carreira.