#Modelos de IA
A OpenAI confirma o desligamento do gpt-4o-2024-05-13 em 23 de outubro de 2026, junto com mais onze model IDs. Mas a manchete que circulou erra em dois pontos: o gpt-4o-mini não está na lista, e não houve falta de aviso. O que a fonte primária diz, e o checklist técnico pra migrar sem quebrar produção.
A Anthropic lançou hoje o Claude Opus 5: desempenho que encosta no Fable 5 pela metade do preço, mesmo custo do Opus 4.8 ($5/$25 por milhão de tokens). Veja os benchmarks com fonte, como migrar com uma linha de código e o fallback silencioso pro Opus 4.8 que você precisa monitorar antes de apontar produção pro modelo novo.
A Bloomberg reportou que Sam Altman fará um briefing à administração Trump e ao Congresso sobre a próxima geração de modelos da OpenAI, e a internet leu isso como lançamento iminente do GPT-6. Este é um rastreador: cada linha com data e fonte, separando o que foi confirmado do que é especulação. Mais o que fazer se você tem produto rodando na API da OpenAI.
O Google lançou o Gemini 3.6 Flash prometendo qualidade de Pro com preço de Flash. Testei o anúncio contra os números: benchmarks oficiais, preço por token, o tier Flash-Lite — e o que é fato e o que é rumor na história do Pro que não chega.
O GPT-5.6 saiu do preview: desde 9 de julho, Sol, Terra e Luna rodam no ChatGPT, na API e no Codex. Preços, o modo Ultra com subagents cooperando e os primeiros testes independentes — que contam uma história menos bonita que o marketing.
O Google lançou o Gemini Omni Flash prometendo criar vídeo a partir de qualquer coisa. Testei na prática: como usar, quanto custa, onde impressiona e onde quebra.
Saiu o Claude Sonnet 5. Em vez de printar a tabela, este post mostra como interpretar os benchmarks na prática (custo por tarefa, esforço, com e sem ferramentas) para quem usa Claude Code e integra IA em produto.
A OpenAI lançou o GPT-5.6 em três modelos: Sol, Terra e Luna. O que muda entre eles, quanto custa cada um e quando usar qual, sem hype.
A Mistral lançou o OCR 4 e ele foi pro topo do Hacker News. O que muda na extração de PDF, como compara com a leitura do ChatGPT/Gemini e quando vale plugar na sua stack.
A Z.ai (ex-Zhipu) lançou o GLM 5.2, modelo open-weight de 753B sob licença MIT que fica a 0,7 ponto do Claude Opus 4.8 em código e custa um sexto do preço por token. O que muda pra quem programa com IA no Brasil — incluindo rodar self-host.
O GPT 5.6 foi lançado em três modelos (Sol, Terra e Luna), com acesso restrito pelo governo dos EUA. O que se confirmou dos vazamentos, os preços e o que ainda é incógnita.
O Claude Fable 5 durou três dias disponível antes de ser bloqueado pelo governo dos EUA. Enquanto isso, o OpenRouter publicou dados que mudam a pergunta: e se painel de modelos baratos já superar qualquer frontier solo em deep research?