#Ia
84% dos devs usam IA, mas a confiança caiu. Devs acham que estão 20% mais rápidos quando estão 19% mais lentos. FOMO de IA já prediz ansiedade em paper acadêmico. Este post junta os dados que provam que a paralisia que você sente não é preguiça — é excesso — e mostra o método pra sair dela: menos consumo, mais execução.
Passo a passo pra rodar um LLM local com Ollama: instala, roda o qwen3:8b em 2 comandos e pluga no seu código pelo endpoint compatível com OpenAI. Roda com 8 GB de RAM e sem GPU obrigatória. De quebra, a conta de VRAM por tamanho de modelo e quando local ganha da API.
O Google lançou o Gemini 3.6 Flash prometendo qualidade de Pro com preço de Flash. Testei o anúncio contra os números: benchmarks oficiais, preço por token, o tier Flash-Lite — e o que é fato e o que é rumor na história do Pro que não chega.
Todo mundo acha que precisa de fine tuning. Quase ninguém precisa. O guia direto do que é, como funciona e o critério honesto de quando usar vs RAG vs contexto.
O Kimi K3 corrigiu 15 falhas de segurança que Codex e Fable recusaram por "cyber guardrails". Na mesma semana, a HuggingFace foi invadida e teve a perícia travada pelo próprio guardrail. Quando o freio da IA protege, e quando desarma o defensor.
O Fable 5 ajudou o matemático Levent Alpöge a produzir um contraexemplo para a Conjectura Jacobiana, aberta desde 1939. O que é a conjectura sem jargão, o que é um contraexemplo, por que dessa vez a conferência é fácil e o que isso diz sobre IA fazendo matemática de fronteira.
A Alibaba soltou o Qwen 3.8 Max, MoE de 2.4 trilhões de parâmetros que ela diz ser o segundo do mundo, atrás só do Fable 5. Sem benchmark público no lançamento, o único teste independente deu 80/100 contra 83 do Kimi K3. Aqui: o que ele é, quanto custa (Token Plan de US$ 6 a 68), como acessar via API e onde cada modelo da família Qwen 3.8 se encaixa.
A OpenAI baixou o contexto efetivo do modelo do Codex de 372k para 272k tokens numa atualização silenciosa e transformou o antigo teto numa linha onde o preço dobra. O que foi cortado, por que dói em sessão longa e monorepo, como confirmar que você foi afetado e os workarounds que existem hoje.
O X grita que vem o "grande rollback" da IA; a prática mostra OpenAI e Anthropic brigando por quem deixa você usar mais. Fui atrás dos números verificados: preço por token despencando 83%, custo por tarefa subindo 3x-18x ao ano, margem de 70% em quem paga e prejuízo projetado de US$ 74 bi. Os dois lados estão errados, e a variável que decide tudo é uma só.
A Anthropic agendou reuniões com investidores mirando IPO já em outubro de 2026, avaliada em US$ 965 bilhões. O que a pressão por receita pode mudar no preço do Claude Code, nos limites de uso e no foco enterprise, e por que Kimi K3 e GLM 5.2 espremem essa avaliação. Post vivo: atualizado quando sair o anúncio formal.
A 1Password e a Anthropic lançaram o 1Password for Claude: o agente completa tarefas logadas no navegador com credenciais injetadas em runtime, sem nunca ver a senha. Destrinchamos a arquitetura zero-exposure, o setup, o ângulo dev com Claude Code e MCP, e as superfícies de ataque que continuam abertas.
Kimi K3 custa US$ 3 de entrada e US$ 15 de saída por milhão de tokens na API (chat grátis no kimi.com), 1,7x mais barato que o Claude Opus 4.8, não os "5x" da timeline. Fizemos a conta honesta do preço, separamos o benchmark verificável do hype e mostramos onde ele bate (e onde não bate) o Claude.