~/beer-and-code
▪ próximo evento Workshop: Jev na Prática para Devs · 14 Out · 19h — duração de 2h a 3h, ao vivo via Google Meet garantir vaga ›
~ / autor / lucas-souza-virgu $ whoami
Lucas Souza

Lucas Souza

{AI Engineer} — apaixonado por Laravel, arquitetura de software e construir produtos com impacto. Compartilho aqui tutoriais, descobertas e reflexões sobre o dia a dia de engenharia.

294 posts
01 #openai · #noticias
ChatGPT Pro 500: a OpenAI lança plano de US$ 500 e corta o Pro 200 pela metade

A OpenAI lançou o ChatGPT Pro 500 e, no mesmo anúncio, cortou pela metade a cota do Pro 200 sem mexer no preço. O que mudou em cada plano, do Free ao Pro 500, as três contas que não estão no anúncio (fim do desconto por volume, Ultrafast que come 8x a cota, crédito a preço de API) e o que isso responde sobre o custo da IA.

07 Out · 12 min ›
02 #claude · #anthropic
Reset do Claude: o botão que zera seu limite de uso vence dia 22 de outubro

Desde setembro todo assinante do Claude tem um reset de limite guardado na conta: um clique em Settings > Usage e o contador volta ao máximo, de graça. É um só, não tem volta e expira em 22 de outubro de 2026. Onde clicar, o que ele zera, o que não zera e quando vale gastar.

07 Out · 7 min ›
03 #llm · #seguranca-ia
Anthropic acusa Moonshot de servir Claude no lugar do Kimi: o que o relatório prova (e o que não prova)

A Anthropic acusa a Moonshot de repassar requests de clientes do Kimi para o Claude Opus e exibir a resposta como se fosse do Kimi: quase 300 mil requests em dez dias, 5.380 contas fraudulentas e 23 milhões de trocas de destilação. Separamos o que o relatório de 154 páginas afirma, o que ele não prova, o que a Moonshot (não) respondeu e o que muda pra quem roda Kimi K3 em produção.

06 Out · 15 min ›
04 #claude · #anthropic
Claude Fable 5.5: o que é fato, o que é boato e por que o IPO de novembro entrou na conversa

O Claude Fable 5.5 não foi anunciado: sem model id, sem model card, sem preço. Rastreador com data e fonte do que está confirmado (Fable 5.1 segue como modelo atual, IPO da Anthropic mirado para meados de novembro) e do que é só timeline (roteamento escondido, demos virais, URL com 404). E o que fazer com o seu código enquanto isso.

02 Out · 10 min ›
05 #openai · #seguranca-ia
PewDiePie banido pela OpenAI duas vezes: o que é destilação e o que o Ajax tem a ver com isso

PewDiePie diz que a OpenAI baniu a conta dele duas vezes por destilação enquanto treinava o Ajax, um Qwen 3.5 9B local com recusas removidas pelo Heretic. O que é destilação de modelo, como a OpenAI detecta (o relatório do caso Moonshot saiu dois dias antes), o que tem dentro do Ajax e onde fica a linha entre dado sintético legítimo e ban na sua conta.

02 Out · 10 min ›
06 #laravel · #ai-agents
Higgsfield MCP: o que é e 10 sistemas onde um dev pode integrar imagem e vídeo

O Higgsfield MCP entrega mais de 30 modelos de imagem e vídeo para o seu agente, com o harness de geração pronto. Como conectar no Claude Code, quanto custa cada geração em créditos e 10 sistemas onde um dev pode integrar isso.

01 Out · 11 min ›
07 #laravel · #php
Claude Code headless: como o claude -p vira um agente de IA orquestrado pelo seu código

Um comando artisan, uma fila e o Claude Code em modo headless (claude -p) gerando 11 sites dentro da assinatura. Como orquestrar o agente por PHP, onde a conta fecha e como plugar o Higgsfield como etapa de assets com orçamento controlado por código.

30 Set · 8 min ›
08 #openai · #alucinacao
GPT-6 Sol e Luna, Opus 5.5 e Gemini 4: o que muda de verdade nessa leva de modelos

GPT-6 Sol e Luna chegaram pela metade do preço do GPT-5.6, o Claude Opus 5.5 entrega nível Fable 5.1 a $4/$20 com quatro breaking changes na API, e o Google diz que o Gemini 4 sai antes do fim do ano. O que cada um traz de diferente, as pegadinhas (Luna regride em código agentic, effort padrão do Opus caiu para medium) e qual usar agora.

24 Set · 13 min ›
09 #harness · #llm
Grok 4.7 responde em 0,85s e o Fable 5.1 em 298s: onde cada um compensa

O Grok 4.7 chegou em 21/09/2026 custando 5x menos por token que o Fable 5.1 e o GPT-6 Astra — e mesmo assim perde pro Astra no custo por tarefa concluída. Onde esse modelo realmente compensa (spoiler: latência, não código), onde fica 22 pontos atrás no Terminal-Bench, e a conta que desmonta a comparação por preço de tabela.

22 Set · 14 min ›
10 #guardrails · #llm
Substituir LLM por Jev: 10 lugares onde a migração se paga em uma semana

Um catálogo de decisão com número, não adjetivo: dez tarefas que hoje rodam em LLM de fronteira e cabem nos três primitivos do Jev. Um milhão de chamadas em cada caso custa US$ 46.200 no LLM e US$ 523 no Jev. Tem o payload de cada caso, o padrão cascata, como medir a migração em shadow mode sem rotular nada e as quatro tarefas em que o Jev é a escolha errada.

21 Set · 19 min ›
11 #modelos-de-ia · #custos
Laya vs Jev: a IA de decisão de US$ 40 milhões contra a de graça que roda no seu notebook

Jev custa US$ 0,042 por milhão de tokens e é API fechada. Laya é Apache 2.0, roda offline numa GPU de 2018 e mede 7,8x mais rápido no P50. Comparativo com os números que cada lado publicou, mais a briga de anterioridade que estourou no Hacker News dois dias depois do lançamento.

21 Set · 21 min ›
12 #ia · #alucinacao
O que é o Jev IA: o modelo que não escreve nada (e por isso custa 100x menos)

A TypeSafe lançou o Jev, o primeiro System One model: ele não completa texto, recebe o estado do seu programa e devolve decisão tipada numa passagem paralela. Sem parser, sem retry, sem JSON quebrado. Neste post: o que o Jev é de fato, por que ele não consegue alucinar (e por que isso não significa que não erra), a conta real de US$ 0,042 por milhão de tokens com output de graça, os três primitivos com código Python rodando, e as 5 armadilhas que a própria doc admite.

21 Set · 15 min ›
Conheça o Clã Beer and Code
tocando