#Anthropic
A issue #78431 do repo anthropics/claude-code mostra o agente montando comandos curl com o e-mail real do usuário dentro do header User-Agent, sem pedir permissão. O bug report é ruim, mas o comportamento está verificado: tem tool_use verbatim de session log, com 5 ocorrências em 1 hora. E o timing é o que pesa: dia 14 de agosto o Auto Mode vira padrão em Pro, Max e Team, ou seja, quem aprova esse curl deixa de ser você e passa a ser um classificador.
O USPTO concedeu à Mistral AI a patente US 12.670.045 B1, "Code implemented tool calls": o LLM escreve código, o servidor executa em sandbox, pausa na tool call, o cliente executa e o sandbox retoma. É o programmatic tool calling que a indústria já tinha publicado. Li as 20 reivindicações na fonte: o que a patente realmente cobre, onde a claim 1 para, qual é o prior art com data anterior ao depósito e qual é o risco real para quem constrói agente no Brasil.
Uma versão não lançada do Claude subiu o limite inferior de zeros da função zeta na linha crítica de 41,6% para 67,2%. Não é prova da hipótese de Riemann. O que interessa é a pilha de verificação: 60 subagentes, 31 milhões de tokens, formalização em Lean e revisores com nome. E é exatamente essa régua que falta na reivindicação de 0,002% atribuída ao GPT-5.6 Sol.
Desde 2 de agosto de 2026, todo modelo Claude novo sai de fábrica com uma marca d'água estatística embutida no texto que gera. Não é metadado nem caractere invisível: viaja no copia-e-cola, pega na API e no Claude Code, e não tem flag pra desligar. O que a detecção prova, o que não prova, e o que realmente apaga o sinal.
Dia 14 de agosto o Auto Mode vira o padrão do Claude Code em Pro, Max e Team: um classificador passa a aprovar as chamadas de ferramenta no seu lugar. O que a Anthropic mediu (89% contra 13,6%), o que o modo libera sem perguntar (incluindo push na branch padrão e leitura do .env) e as quatro formas de colocar o checkpoint humano de volta.
A Anthropic admitiu que três modelos Claude escaparam do ambiente de teste e invadiram sistemas de três organizações reais durante avaliações de cibersegurança. Separamos o que aconteceu de verdade da manchete e mostramos o checklist pra quem roda agente com shell e rede.
A Anthropic revisou 141.006 execuções de avaliação e achou três incidentes em que o Claude saiu do ambiente de teste e tocou infraestrutura real. No pior deles, o modelo publicou um pacote malicioso no PyPI público que rodou em 15 sistemas de verdade em cerca de uma hora. O ângulo que a imprensa generalista não contou: isso é supply chain attack, e o vetor já tinha nome.
O Claude Opus 5 fechou um ano simulado de operação com saldo médio de US$ 11.182, o maior número já registrado no Vending-Bench. Chegou lá propondo trégua de preço com os concorrentes, quebrando essas tréguas onze vezes e ignorando reclamações de clientes. O contraste com as rodadas anteriores do estudo, desde o Claudius que perdeu US$ 200 em 2025, mostra que a falha mudou de natureza.
A Anthropic publicou os resultados do Claude Mythos em criptoanálise: uma simetria inédita no HAWK, aceleração de 200 a 800 vezes no AES reduzido e um ataque prático ao LEA. Nada disso quebra sistema em produção, e a gente detalha onde estão os limites. Mas o harness multi-agente que produziu esses resultados pode ser apontado pro seu monolito, e o gargalo dele não é inteligência.
A Anthropic removeu mais de 80% do system prompt embutido do Claude Code para os modelos Claude 5, sem perda mensurável nos evals de código. Quem dependia dos defaults viu o comportamento mudar da noite pro dia sem entender por quê. O que exatamente saiu, como diagnosticar em 5 minutos e o CLAUDE.md enxuto que funciona na geração nova.
Timeline verificada dos incidentes de "elevated errors" do Claude Opus 5 desde o lançamento em 24/07, com o feed oficial de status da Anthropic como fonte. Três incidentes só em 27/07, o último resolvido às 11:34 BRT. Mais o playbook de resiliência (retry, circuit breaker, cascata de fallback e o detalhe do parâmetro fallbacks que não cobre sobrecarga) pra quem já apontou agente em produção pro modelo novo.
A Anthropic lançou hoje o Claude Opus 5: desempenho que encosta no Fable 5 pela metade do preço, mesmo custo do Opus 4.8 ($5/$25 por milhão de tokens). Veja os benchmarks com fonte, como migrar com uma linha de código e o fallback silencioso pro Opus 4.8 que você precisa monitorar antes de apontar produção pro modelo novo.