~/beer-and-code
▪ próximo evento AI Engineering Lab 3ª Edição — Da Arquitetura à Produção · 19—20 Set · 19 e 20 de setembro, das 09h às 13h — ao vivo via Google Meet garantir vaga
~ / tag / #ia $ grep

#Ia

168 posts
49 #ia · #guardrails
Fable 5 jailbreak: o que quebrou em dias e o que isso diz sobre segurança de LLM

A Anthropic vendeu o Fable 5 como o modelo mais alinhado da casa. Dias depois, já tinha jailbreak circulando. Separamos o que de fato quebrou, o que é demonstração de pesquisa vs. risco real, e o que isso muda na arquitetura de quem coloca LLM em produção.

27 Jun · 9 min
50 #openai · #ia
Como construir um agente de bolão da Copa 2026 no WhatsApp com Evolution API e N8N

Como construir um agente de IA que gerencia o bolão da Copa 2026 no WhatsApp — com Evolution API, N8N e Google Sheets. Guardrails, engenharia de prompt e de contexto na prática, com o flow real na mesa.

27 Jun · 13 min
51 #openai · #ia
GPT-5.6 liberado só com aval do governo dos EUA: o que muda pra quem constrói com IA

Pela primeira vez o governo dos EUA decidiu quem pode usar um modelo de IA antes do lançamento. O caso GPT-5.6, com fontes, e o que muda pra quem constrói software com IA.

26 Jun · 8 min
52 #openai · #ia
GPT-5.6 Sol, Terra ou Luna: a diferença real e por que o Sol custa 25x mais que o Luna

A OpenAI dividiu o GPT-5.6 em três tiers: Sol, Terra e Luna. O que muda entre eles, o preço atualizado depois do corte de 30/07 (Luna caiu 80%, Terra caiu 20%) e qual escolher em produção. Com a conta de quando o Sol vale os 25x de diferença para o Luna, e quando ele é só desperdício de orçamento.

26 Jun · 11 min
53 #ia · #produtividade
Estudo da Microsoft: GitHub Copilot aumenta a produtividade do dev em 40% — o que o número esconde

Paper da Microsoft (maio/2026) mede +40,5% de PRs com GitHub Copilot em 16 mil engenheiros. Destrinchamos o que "produtividade" significa no estudo, o que o número esconde e como isso se compara a agentes como Claude Code e Cursor.

26 Jun · 8 min
54 #openai · #ia
OpenAI Daybreak: o GPT-5.5-Cyber que caça e corrige vulnerabilidades sozinho

A OpenAI liberou o GPT-5.5-Cyber dentro do programa Daybreak, um modelo que acha, valida e corrige vulnerabilidades num fluxo automatizado. O que ele faz na prática, onde entra no fluxo do dev e até onde dá pra confiar correção de vuln a um modelo.

25 Jun · 8 min
55 #ia · #claude
Anthropic vai exigir verificação de identidade no Claude? O que muda (e o que não) pra quem usa no Brasil

A Anthropic começou a pedir verificação de identidade por biometria no Claude e a comunidade surtou achando que era restrição de acesso. Calma: separamos o pânico do que é real, e o que isso significa pra dev no Brasil.

25 Jun · 8 min
56 #ia · #produtividade
CLAUDE.md: as 4 cláusulas do Karpathy e a 5ª que a comunidade adicionou

O post mais votado da semana no r/ClaudeAI partiu das 4 cláusulas de CLAUDE.md sugeridas pelo Karpathy e somou uma 5ª, a que mais muda o comportamento do agente. Um guia prático pra escrever um claude.md que o Claude Code realmente obedece.

25 Jun · 10 min
57 #ia · #llm
Mistral OCR 4: testei o novo modelo e ele lê PDF melhor que o ChatGPT?

A Mistral lançou o OCR 4 e ele foi pro topo do Hacker News. O que muda na extração de PDF, como compara com a leitura do ChatGPT/Gemini e quando vale plugar na sua stack.

24 Jun · 8 min
58 #ia · #llm
Mythos da Anthropic "invadiu a NSA em horas"? O que é fato e o que é boato

Viralizou a fala atribuída ao chefe da NSA de que o Mythos, modelo de fronteira da Anthropic, invadiu "quase todos" os sistemas classificados "em horas". O modelo é real. A acusação do hack, nem tanto. Separando fato de boato.

24 Jun · 7 min
59 #ia · #llm
Fable 5 casos de uso: o que os EUA construíram nas 72h antes do bloqueio

Curadoria dos projetos reais que devs dos EUA construíram com o Claude Fable 5 nas primeiras 72 horas, antes de a Anthropic desligar o modelo por diretiva de controle de exportação dos EUA.

23 Jun · 9 min
60 #ia · #agentes
Sakana Fugu: o modelo que rege Fable 5 e Mythos sem treinar nenhum frontier

A Sakana AI lançou o Sakana Fugu: um LLM treinado para orquestrar um pool de outros modelos (chamar, delegar, verificar e sintetizar) atrás de uma única API compatível com OpenAI. Por que a tese de "capacidade frontier sem o risco de export controls" importa, e o que isso ensina sobre arquitetura de orquestração de agentes.

22 Jun · 8 min
Conheça o Clã Beer and Code
tocando