~/beer-and-code
▪ próximo evento Workshop: Jev na Prática para Devs · 14 Out · 19h — duração de 2h a 3h, ao vivo via Google Meet garantir vaga ›
~ / tag / #modelos-de-ia $ grep

#Modelos de IA

27 posts
13 #openai · #noticias
Antes do GPT-6: os 10 problemas de matemática que o Astra da OpenAI resolveu, as provas em Lean e o boato do GPT-5.7

Um mês antes do lançamento do GPT-6, a OpenAI anunciou que uma versão interna do Astra resolveu 10 problemas em aberto de matemática e complexidade, com provas verificáveis em Lean. Registro do que foi confirmado (Connes, Erdős, grupos não-sóficos, custo de US$ 2 mil), do ceticismo dos matemáticos e do que circulou como boato até o modelo sair.

01 Ago · 9 min ›
14 #openai · #tokens
Preço do GPT-5.6 Luna caiu 80%: a conta refeita com a tabela de hoje

A OpenAI cortou 80% do preço do GPT-5.6 Luna e 20% do Terra, três semanas depois do lançamento. Refazemos a conta por milhão de tokens com um cenário real de agente em produção, comparamos os três tiers e mostramos o que revisar na sua arquitetura antes de sair migrando de modelo por causa de manchete.

30 Jul · 8 min ›
15 #openai · #noticias
GPT-4o descontinuado: 23 de outubro é a data. O checklist pra migrar sem quebrar produção

A OpenAI confirma o desligamento do gpt-4o-2024-05-13 em 23 de outubro de 2026, junto com mais onze model IDs. Mas a manchete que circulou erra em dois pontos: o gpt-4o-mini não está na lista, e não houve falta de aviso. O que a fonte primária diz, e o checklist técnico pra migrar sem quebrar produção.

27 Jul · 14 min ›
16 #claude · #anthropic
Claude Opus 5 chegou: quase um Fable 5 pela metade do preço

A Anthropic lançou hoje o Claude Opus 5: desempenho que encosta no Fable 5 pela metade do preço, mesmo custo do Opus 4.8 ($5/$25 por milhão de tokens). Veja os benchmarks com fonte, como migrar com uma linha de código e o fallback silencioso pro Opus 4.8 que você precisa monitorar antes de apontar produção pro modelo novo.

24 Jul · 8 min ›
17 #openai · #noticias
Linha do tempo do GPT-6: de Altman em Washington ao lançamento do Astra (rastreador encerrado)

Em julho a Bloomberg reportou o briefing de Altman ao governo dos EUA e a internet leu como lançamento iminente do GPT-6. Este rastreador registrou, com data e fonte, o que foi confirmado e o que era especulação até o modelo sair em 03/09/2026 como GPT-6 Astra. Fica como linha do tempo; os números, o preço e a comparação com Fable 5.1 e GPT-5.6 Sol estão no comparativo.

22 Jul · 7 min ›
18 #ia · #google
Gemini 3.6 Flash chegou: benchmarks, preço e por que o Google lançou o Flash antes do Pro

O Google lançou o Gemini 3.6 Flash prometendo qualidade de Pro com preço de Flash. Testei o anúncio contra os números: benchmarks oficiais, preço por token, o tier Flash-Lite — e o que é fato e o que é rumor na história do Pro que não chega.

21 Jul · 9 min ›
19 #openai · #multi-agent
GPT-5.6 no Codex: o modo Ultra rende 3 pontos, e o Terra gasta 2,6x mais tokens pra entregar pior

O GPT-5.6 está no Codex desde 9 de julho, nos três tiers. O modo Ultra coordena quatro subagents que cooperam durante a tarefa e rende 3 pontos no Terminal-Bench (88,8% para 91,9%), a um custo de tokens bem maior. E o teste independente da CodeRabbit derruba o reflexo de escolher o tier barato: o Terra gastou 2,6x mais tokens que o Sol para passar 40,7% das tarefas contra 63,7%. Preço por token não é preço por tarefa.

15 Jul · 11 min ›
20 #ia · #google
Gemini Omni Flash na prática: como usar o gerador de vídeo do Google e se vale a pena

O Google lançou o Gemini Omni Flash prometendo criar vídeo a partir de qualquer coisa. Testei na prática: como usar, quanto custa, onde impressiona e onde quebra.

07 Jul · 9 min ›
21 #produto-ia · #llm
Claude Sonnet 5: como interpretar os benchmarks na prática

Saiu o Claude Sonnet 5. Em vez de printar a tabela, este post mostra como interpretar os benchmarks na prática (custo por tarefa, esforço, com e sem ferramentas) para quem usa Claude Code e integra IA em produto.

30 Jun · 9 min ›
22 #openai · #ia
Diferença entre GPT-5.6 Sol, Terra e Luna: preço por tier e qual usar

Qual a diferença entre GPT-5.6 Sol, Terra e Luna? Mesma geração, três tiers: Sol é o topo agêntico ($5/$30 por 1M de tokens), Terra o meio-termo ($2/$12) e Luna o barato e rápido ($0,20/$1,20). Com a tabela vigente desde o corte de 30/07, quando cada um vale a pena e quando o Sol é só desperdício de orçamento.

26 Jun · 11 min ›
23 #ia · #llm
Mistral OCR 4: testei o novo modelo e ele lê PDF melhor que o ChatGPT?

A Mistral lançou o OCR 4 e ele foi pro topo do Hacker News. O que muda na extração de PDF, como compara com a leitura do ChatGPT/Gemini e quando vale plugar na sua stack.

24 Jun · 8 min ›
24 #ia · #llm
GLM 5.2: o melhor modelo de código open source é chinês, MIT e 6x mais barato

A Z.ai (ex-Zhipu) lançou o GLM 5.2, modelo open-weight de 753B sob licença MIT que fica a 0,7 ponto do Claude Opus 4.8 em código e custa um sexto do preço por token. O que muda pra quem programa com IA no Brasil — incluindo rodar self-host.

22 Jun · 8 min ›
Conheça o Clã Beer and Code
tocando