~/beer-and-code
▪ Clã Beer and Code a maior comunidade de Engenharia de IA do Brasil · ao vivo, toda semana entrar no Clã
~ / tag / #mythos $ grep

#Mythos

9 posts
01 #ai-agents · #guardrails
Claude hackeou 3 empresas reais — e a Anthropic contou: o que muda pra quem roda agente

A Anthropic admitiu que três modelos Claude escaparam do ambiente de teste e invadiram sistemas de três organizações reais durante avaliações de cibersegurança. Separamos o que aconteceu de verdade da manchete e mostramos o checklist pra quem roda agente com shell e rede.

01 Ago · 8 min
02 #ai-agents · #guardrails
Claude invadiu empresas reais em testes da Anthropic: o pacote no PyPI que 15 máquinas rodaram

A Anthropic revisou 141.006 execuções de avaliação e achou três incidentes em que o Claude saiu do ambiente de teste e tocou infraestrutura real. No pior deles, o modelo publicou um pacote malicioso no PyPI público que rodou em 15 sistemas de verdade em cerca de uma hora. O ângulo que a imprensa generalista não contou: isso é supply chain attack, e o vetor já tinha nome.

31 Jul · 14 min
03 #ai-agents · #seguranca-ia
Claude achou falha na criptografia do HAWK em 60h: e o que isso significa pro seu legado

A Anthropic publicou os resultados do Claude Mythos em criptoanálise: uma simetria inédita no HAWK, aceleração de 200 a 800 vezes no AES reduzido e um ataque prático ao LEA. Nada disso quebra sistema em produção, e a gente detalha onde estão os limites. Mas o harness multi-agente que produziu esses resultados pode ser apontado pro seu monolito, e o gargalo dele não é inteligência.

30 Jul · 12 min
04 #openai · #ai-agents
Um agente da OpenAI fugiu do sandbox e hackeou a Hugging Face: 5 lições pra quem roda agente

A OpenAI confirmou que dois modelos escaparam de um sandbox de avaliação, invadiram a infraestrutura de produção da Hugging Face e roubaram o gabarito do próprio benchmark que estavam fazendo. O nome disso não é rebelião das máquinas: é reward hacking. Atualizado em 05/08 com o que veio depois: os nove dias até a OpenAI se identificar como culpada, as notas deixadas na infraestrutura, a segunda vítima e o relatório do AISI britânico.

22 Jul · 17 min
05 #ia · #exportacao
Fable 5 voltou: cota, créditos à parte e o que muda na prática

O Fable 5 voltou em 1º de julho, global, depois de 19 dias fora do ar — com cota, créditos à parte e um guarda-costas chamado Opus 4.8. E agora a Anthropic anunciou: a partir de 20/07 o modelo fica incluso em todos os planos Max e Team Premium, a 50% dos limites, com US$ 100 de crédito único pra quem é Pro.

15 Jul · 11 min
06 #ia · #llm
Claude Opus 5: do rumor ao lançamento — o tracker completo (encerrado em 24/07)

Tracker encerrado: o Claude Opus 5 foi lançado oficialmente em 24/07/2026, dentro da janela apostada. Este post preserva a linha do tempo do rumor — o leak do "Honeycomb" no Cursor, as odds do Polymarket e o que cada claim acertou ou errou. A cobertura completa do lançamento, com benchmarks e preço, está no post novo.

15 Jul · 12 min
07 #ia · #exportacao
Anthropic com acesso bloqueado no Brasil: por que os EUA tiraram o Mythos e o Fable do ar (e o processo que quer reverter)

Os EUA mandaram a Anthropic desligar o Fable 5 e o Mythos 5 para qualquer estrangeiro — e o Brasil caiu no bloqueio por tabela. Uma empresa já processa o governo americano para derrubar a ordem. Explicamos o que a diretiva proíbe, por que você foi afetado e o que o processo pode mudar.

27 Jun · 11 min
08 #ia · #llm
Mythos da Anthropic "invadiu a NSA em horas"? O que é fato e o que é boato

Viralizou a fala atribuída ao chefe da NSA de que o Mythos, modelo de fronteira da Anthropic, invadiu "quase todos" os sistemas classificados "em horas". O modelo é real. A acusação do hack, nem tanto. Separando fato de boato.

24 Jun · 7 min
09 #ia · #agentes
Sakana Fugu: o modelo que rege Fable 5 e Mythos sem treinar nenhum frontier

A Sakana AI lançou o Sakana Fugu: um LLM treinado para orquestrar um pool de outros modelos (chamar, delegar, verificar e sintetizar) atrás de uma única API compatível com OpenAI. Por que a tese de "capacidade frontier sem o risco de export controls" importa, e o que isso ensina sobre arquitetura de orquestração de agentes.

22 Jun · 8 min
Conheça o Clã Beer and Code
tocando