Lucas Souza
{AI Engineer} — apaixonado por Laravel, arquitetura de software e construir produtos com impacto. Compartilho aqui tutoriais, descobertas e reflexões sobre o dia a dia de engenharia.
Kimi K3 custa US$ 3 de entrada e US$ 15 de saída por milhão de tokens na API (chat grátis no kimi.com), 1,7x mais barato que o Claude Opus 4.8, não os "5x" da timeline. Fizemos a conta honesta do preço, separamos o benchmark verificável do hype e mostramos onde ele bate (e onde não bate) o Claude.
A OpenAI lançou seu primeiro hardware: o Codex Micro, um macropad de US$ 230 pra controlar agentes do Codex — e ele esgotou em horas. Specs, o uso real na supervisão de múltiplos agentes e a conta honesta de se vale a pena comprar.
O Claude Design pelo olhar de quem escreve código: como usar a ferramenta da Anthropic a partir do seu codebase, o round-trip com o Claude Code e quando cada um ganha. Sem review de designer.
O GPT-5.6 está no Codex desde 9 de julho, nos três tiers. O modo Ultra coordena quatro subagents que cooperam durante a tarefa e rende 3 pontos no Terminal-Bench (88,8% para 91,9%), a um custo de tokens bem maior. E o teste independente da CodeRabbit derruba o reflexo de escolher o tier barato: o Terra gastou 2,6x mais tokens que o Sol para passar 40,7% das tarefas contra 63,7%. Preço por token não é preço por tarefa.
O Fable 5 voltou em 1º de julho, global, depois de 19 dias fora do ar — com cota, créditos à parte e um guarda-costas chamado Opus 4.8. E agora a Anthropic anunciou: a partir de 20/07 o modelo fica incluso em todos os planos Max e Team Premium, a 50% dos limites, com US$ 100 de crédito único pra quem é Pro.
Tracker encerrado em 24/07/2026. Este post preserva a linha do tempo do rumor do Opus 5: o modelo fantasma 'Claude Honeycomb' no Cursor, as odds do Polymarket semana a semana e a tabela do que cada claim acertou ou furou. Benchmarks, preço e migração estão na cobertura do lançamento.
Seu agente lê um README e obedece a uma instrução escondida nele. A busca por "prompt injection" multiplicou por 8 no Brasil em 2026. O guia do que é, dos ataques que marcaram o ano e da defesa em camadas que de fato funciona.
Laravel é "aquele framework PHP" pra quem parou em 2015. Em 2026, é a stack onde o agente lê seu schema via MCP oficial, o SDK de IA é first-party e um dev sobe um produto com RAG em um fim de semana. Este post responde o que é Laravel, para que serve e por que a era da IA jogou a favor dele.
Em duas semanas, dois físicos de elite — Giorgio Parisi (Nobel) e Yuji Tachikawa — creditaram ao Claude a solução de problemas travados há meses ou anos. O padrão importa mais que a manchete: problema maduro, confiança calibrada e verificação em loop, aplicável a qualquer trabalho técnico.
Usuários do GPT-5.6 Sol relatam bans automáticos por "ameaça de cibersegurança" em tarefas inofensivas, de scripts DevOps a macro de Excel. Appeal negado por bot e OpenAI em silêncio. O que se sabe até agora, o histórico do modelo que nasceu restrito e como proteger sua conta e seu histórico. Em apuração.
A OpenAI removeu o limite de 5 horas do Codex sem aviso e a Anthropic respondeu em horas, estendendo o aumento de 50% no limite semanal do Claude Code até 19 de julho. O que exatamente mudou, o que continua travado e como decidir qual assinatura compensa agora — com a conta na mão.
O Google lançou o Gemini Omni Flash prometendo criar vídeo a partir de qualquer coisa. Testei na prática: como usar, quanto custa, onde impressiona e onde quebra.