Use a IA antes que ela use você.
Tutoriais práticos, notícias do ecossistema e pacotes que valem o seu tempo. Por Lucas Souza.
A Anthropic lançou o Claude Fable 5.1 em 01/09/2026. Ele bate o Opus 5 em todos os benchmarks publicados, mas quase sempre por 2 a 3 pontos, e custa o dobro por token. Os números oficiais, a conta real de uma sessão agentic com cache quente (onde a razão de custo cai de 2x para 1.3x), a árvore de decisão entre Fable 5.1, Opus 5 e Sonnet 5, e os 3 breaking changes que quebram seu código se você só trocar o model id.
ler agora ›Metade dos "projetos de IA" que revisei em 2026 se resolviam com um if e um SELECT. A outra metade virou agente porque o time queria dizer que tinha IA. Aqui está o teste dos 3 minutos: 4 perguntas que decidem se o seu problema pede um if, uma query, um prompt, um fluxo determinístico ou um agente de verdade. Com 5 casos reais, o veredito de cada um (spoiler: 1 em 5 era agente) e o custo invisível de errar pra cima.
O agente decide sozinho qual fluxo usar, mas ninguém consegue explicar por que ele escolheu errado ontem às 14h. Roteador determinístico vs. roteador por LLM, classificação de intenção com schema fechado e evidência, política de fallback explícita, atributos de trace para auditar a decisão e como medir acerto de rota sem rotular dez mil conversas na mão.
Se o seu código tem um try/catch em volta de um json_decode da resposta do modelo, você não tem contrato. Tem esperança. Como garantir saída estruturada de verdade no LLM: constrained decoding no provider, schema que o modelo consegue cumprir, validação semântica e retry com orçamento fixo, sem loop infinito e sem parser defensivo.
Seu protótipo custou R$ 12 no primeiro dia. Em produção, com 200 usuários, ele custa quase R$ 4.000 por mês. Abrimos a conta de token de um agente real camada por camada (system prompt, definições de tool, chunks de RAG, histórico, tool results) e mostramos onde some quase 80% do dinheiro. No fim, compressão de prompt, pruning de histórico e seleção de contexto derrubam a fatura em 73%, com a planilha antes e depois.