~/beer-and-code
▪ próximo evento Workshop: Jev na Prática para Devs · 14 Out · 19h — duração de 2h a 3h, ao vivo via Google Meet garantir vaga ›
~ / autor / lucas-souza-virgu $ whoami
Lucas Souza

Lucas Souza

{AI Engineer} — apaixonado por Laravel, arquitetura de software e construir produtos com impacto. Compartilho aqui tutoriais, descobertas e reflexões sobre o dia a dia de engenharia.

294 posts
133 #ia · #llm
GLM 5.2: o melhor modelo de código open source é chinês, MIT e 6x mais barato

A Z.ai (ex-Zhipu) lançou o GLM 5.2, modelo open-weight de 753B sob licença MIT que fica a 0,7 ponto do Claude Opus 4.8 em código e custa um sexto do preço por token. O que muda pra quem programa com IA no Brasil — incluindo rodar self-host.

22 Jun · 8 min ›
134 #openai · #ia
GPT 5.6: data de lançamento, o vazamento no Codex e o que os rumores acertaram (rastreador)

Este rastreador seguiu o GPT 5.6 da string vazada nos logs do Codex até o lançamento de 26/06/2026, cruzando o que os rumores acertaram (a data, a família de três tiers) com o que caiu (1,5M de contexto, modo UltraFast). A escolha entre Sol, Terra e Luna e a tabela de preço vigente estão no comparativo dedicado.

22 Jun · 9 min ›
135 #ia · #embeddings
RAG híbrido na prática: BM25, embeddings e reranker

Embedding sozinho erra mais do que você imagina. Veja como combinar busca lexical (BM25), busca semântica e um reranker cross-encoder para subir a qualidade do RAG em produção, com código em Python e LangChain.

21 Jun · 9 min ›
136 #ia · #ai-agents
Como criar evals para agentes de IA com LLM-as-a-judge

Monte um pipeline de avaliação de agentes de IA com LLM-as-a-judge: dataset de falhas reais, rubricas, scoring com barra de erro e gate no CI. Sem eval, deploy é no escuro.

21 Jun · 18 min ›
137 #ia · #llm
Modelos de IA open source valem a pena em 2026? A conta real de rodar local

Modelos open source fecharam o gap em 2026. Mas "open source" não é "local" e "local" não é "de graça". A conta honesta de quando rodar LLM local compensa: custo, privacidade e velocidade.

20 Jun · 8 min ›
138 #ia · #gestao
Prontidão para IA: como deixar sua empresa pronta de verdade

Comprar licença de IA não deixa a empresa pronta pra IA. Um framework de prontidão para IA em quatro frentes — dados, processos, pessoas e governança — com os números que mostram onde a maioria trava.

20 Jun · 10 min ›
139 #openai · #ia
Claude Code ou Codex: o Codex ganha o terminal por 13 pontos, o Claude ganha o repo difícil por 10

Claude Code ou Codex? A resposta tem número: o Codex abre 13 pontos no Terminal-Bench (82,7% contra 69,4%) e o Claude Code abre 10 no SWE-bench Pro (69,2% contra 58,6%), que é o benchmark do problema multi-arquivo de verdade. No SWE-bench Verified empatam. Aqui está o veredito por cenário, o custo real por dev e o critério que importa mais que qualidade: quanto controle você quer durante a tarefa.

19 Jun · 10 min ›
140 #ia · #ai-agents
Como criar um bot no Slack com Claude: um agente de dados no seu workspace

Tutorial de um bot de Slack que responde perguntas sobre seus dados com Claude, baseado no cookbook da Anthropic. Do app_mention ao agente em produção.

19 Jun · 11 min ›
141 #ia · #ai-agents
Como criar um servidor MCP do zero: tools, resources e prompts, do stdio ao HTTP

Tutorial mão na massa pra escrever um servidor MCP em Python do zero — uma tool, um resource e um prompt — rodando em stdio e HTTP, plugado no Claude.

19 Jun · 16 min ›
142 #ia · #carreira
4 mitos sobre o engenheiro de IA: o que ele NÃO faz em 2026

Quatro mitos que perseguem a profissão desde que ela ganhou nome: treinar modelo o dia inteiro, precisar de PhD, viver de fine-tuning e 'usar ChatGPT no trabalho'. O que o engenheiro de IA não faz em 2026, e por que quem vem de backend já tem 80% do caminho.

18 Jun · 9 min ›
143 #ia · #carreira
Desenvolvedor de IA vs Engenheiro de IA: 7 diferenças que importam

Desenvolvedor de IA e engenheiro de IA não são dois nomes pra mesma vaga. Comparativo direto de escopo, skills, salário e carreira, e onde o dev de produto cruza a linha.

18 Jun · 10 min ›
144 #openai · #ia
Agent improvement loop: o ciclo que faz o agente melhorar o próprio código

Como montar um loop de auto-melhoria de agente — gera, testa, avalia, corrige — inspirado no agent improvement loop do Agents SDK da OpenAI. Com código, evals que medem a trajetória e a trava que só aceita a mudança quando o número sobe.

18 Jun · 8 min ›
Conheça o Clã Beer and Code
tocando