~/beer-and-code
▪ próximo evento Workshop: Jev na Prática para Devs · 14 Out · 19h — duração de 2h a 3h, ao vivo via Google Meet garantir vaga ›
~ / autor / lucas-souza-virgu $ whoami
Lucas Souza

Lucas Souza

{AI Engineer} — apaixonado por Laravel, arquitetura de software e construir produtos com impacto. Compartilho aqui tutoriais, descobertas e reflexões sobre o dia a dia de engenharia.

294 posts
217 #ai-agents · #observabilidade
Quanto custa um agente em produção em 2026: planilha real depois de 6 meses

A calculadora da OpenAI mente. Pricing de token é só um item de linha; a fatura real de um agente em produção tem seis baldes: inferência, eval em runtime, observability, infra, pessoas, outros. Este post abre o balancete de 6 meses, mês a mês, com números e fontes. No fim, build vs buy: quando vale construir e quando você está pagando para reinventar o Cursor.

14 Mai · 16 min ›
218 #performance · #ia
Quando NÃO usar Agentic Code: 8 cenários onde o agente é prejuízo

Curva de hype joga todo mundo no extremo. Aqui está a lista honesta de 8 cenários onde, em 2026, o agente custa mais caro, demora mais e ainda erra mais que o time fazendo na mão, com explicação técnica, benchmarks e dor de produção.

13 Mai · 12 min ›
219 #ia · #harness
AI Engineer no Brasil: as 6 senioridades que o mercado realmente paga (e o que cada uma entrega)

RH pede 5 anos em IA agêntica para um campo que não tem 5 anos. A escala real é outra. Mapa de 6 senioridades de AI Engineer no Brasil em 2026 com entregáveis por nível, faixa salarial e o critério de promoção que recrutador respeita.

13 Mai · 13 min ›
220 #laravel · #php
TDD com agentes: como escrever testes que sobrevivem ao código gerado

Agente deletou o teste pra fazer passar. Aconteceu, vai acontecer. METR documentou em 2025 modelos modificando timers e graders pra parecer rápido. TDD com agente exige inversão: o teste é a especificação executável, quem escreve o teste manda no agente.

13 Mai · 10 min ›
221 #laravel · #tool-use
Code review com IA: benchmark de 7 ferramentas (precision e recall) e como medir se o seu bot acerta

Setup completo de bot de code review com Claude no GitHub Actions num projeto Laravel: workflow YAML pra colar, allowedTools pra rodar php artisan test antes de comentar, scoring de confiança com threshold 80, armadilhas de fork e pull_request_target, e um script que mede precision e recall do bot contra os comentários humanos do time.

12 Mai · 15 min ›
222 #ia · #agentes
Agente autônomo: os 4 níveis de autonomia na prática

Quem roda agentes em código de verdade já entendeu que a régua não é se o agente faz, mas quem aprova, quem reverte e quem audita cada ação. Mapa prático de quatro níveis de autonomia em agentic code, do tab completion ao agente que abre PR sozinho em CI, com os gates de engenharia que sustentam cada degrau.

12 Mai · 18 min ›
223 #ai-agents · #observabilidade
Portfólio de AI Engineer: 5 projetos que abrem porta sem precisar de mestrado

Recrutador olha 11 segundos. Notebook de fine-tuning de Llama no Colab não convence ninguém. Cinco projetos pequenos que provam skill real de AI engineer e cabem em 1 a 3 fins de semana cada.

12 Mai · 13 min ›
224 #ia · #ai-agents
Glossário do AI Engineer 2026: 30 termos que todo engenheiro precisa saber (sem hype)

Dicionário de campo com 30 termos que aparecem em todo projeto sério de IA em 2026: núcleo, capacidades, padrões agênticos, recuperação, engenharia e operação. Cada termo em uma linha clara, com um exemplo concreto e zero hype. Mais mini-FAQ com 10 perguntas que economizam reunião.

11 Mai · 13 min ›
225 #laravel · #php
Hands-on: meu primeiro Pull Request 100% gerado por agente em Laravel (com diff e revisão)

Liguei o agente, fui tomar café e voltei 43 minutos depois com um PR de 380 linhas em 9 arquivos. Case study real com harness Laravel + Claude Agent SDK + sandbox isolado, a task escolhida, o loop cronometrado de 43 min em 12 iterações, o diff comentado, os 3 bugs que escaparam pro code review humano, custo total em USD e o veredito sobre soltar isso em produção. Repositório público no final.

11 Mai · 13 min ›
226 #ia · #ai-agents
Agentic Code vs Vibe Coding vs SDD: a tabela definitiva pra escolher por contexto

Três paradigmas, três comunidades brigando no Twitter, e zero clareza sobre quando cada um performa. Definição operacional de vibe coding, agentic engineering e SDD, tabela com oito critérios e árvore de decisão pronta pra colar na wiki do time.

11 Mai · 11 min ›
227 #ia · #engenharia-de-software
Quanto ganha um Engenheiro de IA no Brasil em 2026: R$ 7 mil a R$ 38 mil no CLT, e por que o PJ paga 50% mais

Existem três mercados rodando em paralelo para Engenheiro de IA no Brasil, e cada um tem faixa, alíquota e critério de negociação diferentes: CLT, PJ e contrato gringo via EOR. Aqui estão as três faixas de 2026 por nível, com fonte, mais a razão de 1,5x entre CLT e PJ, o custo all-in que o contratante estrangeiro realmente paga por você, e as três especializações que movem o número mais que stack ou tempo de casa.

10 Mai · 17 min ›
228 #ai-agents · #observabilidade
Anatomia de um harness em produção: as 6 camadas que separam POC de sistema confiável

O harness do tutorial roda. Em produção, ele morre na primeira semana. Esse post abre o capô do que entra entre o request e o response quando o agente está vivo 24 por 7: gate, roteador, contexto, loop com budget, pós-processamento e telemetria. Diagrama, código e referências reais para sair do POC e chegar num sistema confiável.

10 Mai · 11 min ›
Conheça o Clã Beer and Code
tocando