#Notícias
A OpenAI lançou o ChatGPT Pro 500 e, no mesmo anúncio, cortou pela metade a cota do Pro 200 sem mexer no preço. O que mudou em cada plano, do Free ao Pro 500, as três contas que não estão no anúncio (fim do desconto por volume, Ultrafast que come 8x a cota, crédito a preço de API) e o que isso responde sobre o custo da IA.
Desde setembro todo assinante do Claude tem um reset de limite guardado na conta: um clique em Settings > Usage e o contador volta ao máximo, de graça. É um só, não tem volta e expira em 22 de outubro de 2026. Onde clicar, o que ele zera, o que não zera e quando vale gastar.
A Anthropic acusa a Moonshot de repassar requests de clientes do Kimi para o Claude Opus e exibir a resposta como se fosse do Kimi: quase 300 mil requests em dez dias, 5.380 contas fraudulentas e 23 milhões de trocas de destilação. Separamos o que o relatório de 154 páginas afirma, o que ele não prova, o que a Moonshot (não) respondeu e o que muda pra quem roda Kimi K3 em produção.
O Claude Fable 5.5 não foi anunciado: sem model id, sem model card, sem preço. Rastreador com data e fonte do que está confirmado (Fable 5.1 segue como modelo atual, IPO da Anthropic mirado para meados de novembro) e do que é só timeline (roteamento escondido, demos virais, URL com 404). E o que fazer com o seu código enquanto isso.
PewDiePie diz que a OpenAI baniu a conta dele duas vezes por destilação enquanto treinava o Ajax, um Qwen 3.5 9B local com recusas removidas pelo Heretic. O que é destilação de modelo, como a OpenAI detecta (o relatório do caso Moonshot saiu dois dias antes), o que tem dentro do Ajax e onde fica a linha entre dado sintético legítimo e ban na sua conta.
GPT-6 Sol e Luna chegaram pela metade do preço do GPT-5.6, o Claude Opus 5.5 entrega nível Fable 5.1 a $4/$20 com quatro breaking changes na API, e o Google diz que o Gemini 4 sai antes do fim do ano. O que cada um traz de diferente, as pegadinhas (Luna regride em código agentic, effort padrão do Opus caiu para medium) e qual usar agora.
GPT-6 Astra é o novo modelo topo de linha da OpenAI, lançado em 03/09/2026 a $10/$50 por milhão de tokens, o mesmo preço do Claude Fable 5.1. Benchmark por benchmark contra Fable 5.1 e GPT-5.6 Sol, a conta de cache que deixa uma sessão de agente 54% mais cara no Astra, e o ARC-AGI-3 onde o mesmo modelo fez 62,7% ou 99,9% só trocando o harness.
O Claude caiu hoje e o Codex junto. Do outro lado, engenheiros da Anthropic com o mesmo terminal travado. Eles têm servidor privado? Trocam pra outro modelo? Voltam a ler log na mão? A resposta, cruzando palestra do time de confiabilidade, código vazado, postmortems e 358 incidentes do status page.
A Anthropic lançou o Claude Fable 5.1 em 01/09/2026. Ele bate o Opus 5 em todos os benchmarks publicados, mas quase sempre por 2 a 3 pontos, e custa o dobro por token. Os números oficiais, a conta real de uma sessão agentic com cache quente (onde a razão de custo cai de 2x para 1.3x), a árvore de decisão entre Fable 5.1, Opus 5 e Sonnet 5, e os 3 breaking changes que quebram seu código se você só trocar o model id.
Uma ação coletiva na Califórnia (Kahn v. Anthropic, 3:26-cv-05763) alega que o plano Claude Max 20x entrega entre 6x e 8x o uso do Pro, não 20x. O que a petição sustenta com documentos internos, por que o multiplicador só vale na sessão de 5 horas enquanto o teto semanal é o que realmente trava, e como descobrir em qual dos dois você esbarra antes de renovar.
As threads dizem que o Claude Opus 5 regrediu, e o Google já responde que sim. Mas a explicação mais provável não é nerf de modelo: é que a Anthropic cortou mais de 80% do system prompt embutido do Claude Code na geração Claude 5. Os defaults de contenção saíram, e a responsabilidade migrou para o seu CLAUDE.md. O que dá pra medir, o que é percepção e como domar sem trocar de fornecedor.
Não é modelo novo. É o mesmo GPT-5.6 Sol rodando num chip do tamanho de um prato: 750 tokens/s, 44 GB de SRAM on-chip e zero preço publicado. A OpenAI anuncia 14x contra o próprio Sol Standard; a Cerebras anuncia 11x contra o Fable 5 (sem teste pareado). Aqui separamos o que é verificável do que é marketing de fornecedor, explicamos por que Sol, Ultra e Ultrafast são três coisas diferentes, e mostramos a conta que decide se latência vira dinheiro no seu agente.