#Ia
A Anthropic vendeu o Fable 5 como o modelo mais alinhado da casa. Dias depois, já tinha jailbreak circulando. Separamos o que de fato quebrou, o que é demonstração de pesquisa vs. risco real, e o que isso muda na arquitetura de quem coloca LLM em produção.
Como construir um agente de IA que gerencia o bolão da Copa 2026 no WhatsApp — com Evolution API, N8N e Google Sheets. Guardrails, engenharia de prompt e de contexto na prática, com o flow real na mesa.
Pela primeira vez o governo dos EUA decidiu quem pode usar um modelo de IA antes do lançamento. O caso GPT-5.6, com fontes, e o que muda pra quem constrói software com IA.
A OpenAI dividiu o GPT-5.6 em três tiers: Sol, Terra e Luna. O que muda entre eles, o preço atualizado depois do corte de 30/07 (Luna caiu 80%, Terra caiu 20%) e qual escolher em produção. Com a conta de quando o Sol vale os 25x de diferença para o Luna, e quando ele é só desperdício de orçamento.
Paper da Microsoft (maio/2026) mede +40,5% de PRs com GitHub Copilot em 16 mil engenheiros. Destrinchamos o que "produtividade" significa no estudo, o que o número esconde e como isso se compara a agentes como Claude Code e Cursor.
A OpenAI liberou o GPT-5.5-Cyber dentro do programa Daybreak, um modelo que acha, valida e corrige vulnerabilidades num fluxo automatizado. O que ele faz na prática, onde entra no fluxo do dev e até onde dá pra confiar correção de vuln a um modelo.
A Anthropic começou a pedir verificação de identidade por biometria no Claude e a comunidade surtou achando que era restrição de acesso. Calma: separamos o pânico do que é real, e o que isso significa pra dev no Brasil.
O post mais votado da semana no r/ClaudeAI partiu das 4 cláusulas de CLAUDE.md sugeridas pelo Karpathy e somou uma 5ª, a que mais muda o comportamento do agente. Um guia prático pra escrever um claude.md que o Claude Code realmente obedece.
A Mistral lançou o OCR 4 e ele foi pro topo do Hacker News. O que muda na extração de PDF, como compara com a leitura do ChatGPT/Gemini e quando vale plugar na sua stack.
Viralizou a fala atribuída ao chefe da NSA de que o Mythos, modelo de fronteira da Anthropic, invadiu "quase todos" os sistemas classificados "em horas". O modelo é real. A acusação do hack, nem tanto. Separando fato de boato.
Curadoria dos projetos reais que devs dos EUA construíram com o Claude Fable 5 nas primeiras 72 horas, antes de a Anthropic desligar o modelo por diretiva de controle de exportação dos EUA.
A Sakana AI lançou o Sakana Fugu: um LLM treinado para orquestrar um pool de outros modelos (chamar, delegar, verificar e sintetizar) atrás de uma única API compatível com OpenAI. Por que a tese de "capacidade frontier sem o risco de export controls" importa, e o que isso ensina sobre arquitetura de orquestração de agentes.