#Modelos de IA
O Google lançou o Gemini Omni Flash prometendo criar vídeo a partir de qualquer coisa. Testei na prática: como usar, quanto custa, onde impressiona e onde quebra.
Saiu o Claude Sonnet 5. Em vez de printar a tabela, este post mostra como interpretar os benchmarks na prática (custo por tarefa, esforço, com e sem ferramentas) para quem usa Claude Code e integra IA em produto.
A OpenAI dividiu o GPT-5.6 em três tiers: Sol, Terra e Luna. O que muda entre eles, o preço atualizado depois do corte de 30/07 (Luna caiu 80%, Terra caiu 20%) e qual escolher em produção. Com a conta de quando o Sol vale os 25x de diferença para o Luna, e quando ele é só desperdício de orçamento.
A Mistral lançou o OCR 4 e ele foi pro topo do Hacker News. O que muda na extração de PDF, como compara com a leitura do ChatGPT/Gemini e quando vale plugar na sua stack.
A Z.ai (ex-Zhipu) lançou o GLM 5.2, modelo open-weight de 753B sob licença MIT que fica a 0,7 ponto do Claude Opus 4.8 em código e custa um sexto do preço por token. O que muda pra quem programa com IA no Brasil — incluindo rodar self-host.
O GPT 5.6 foi lançado em três modelos (Sol, Terra e Luna), com acesso restrito pelo governo dos EUA. O que se confirmou dos vazamentos, os preços e o que ainda é incógnita.
O Claude Fable 5 durou três dias disponível antes de ser bloqueado pelo governo dos EUA. Enquanto isso, o OpenRouter publicou dados que mudam a pergunta: e se painel de modelos baratos já superar qualquer frontier solo em deep research?
GPT-5 está em todo lugar, mas a pergunta de quem programa é só uma: vale trocar o que já funciona? Olhamos código real, custo por tarefa e quando a troca se paga, no tom honesto da marca.