~/beer-and-code
▪ próximo evento Workshop: Loop Engineering — Pare de Ser o Operador do Agente · 19 Ago · 19h (horário de Brasília) — duração de 2 a 4 horas, ao vivo via Google Meet garantir vaga
~ / tag / #ia $ grep

#Ia

153 posts
01 #ia · #google
Gemini 3.5 Pro: rastreador de lançamento, vazamentos e o que já dá pra confirmar

O Gemini 3.5 Pro ainda não saiu, e a cada semana tem uma data nova circulando. Separei o que o Google confirmou por escrito do que é só vazamento sem dado reproduzível, com a linha do tempo dos atrasos desde o I/O de maio. E montei um watcher de 20 linhas no endpoint de modelos da Gemini API que avisa no minuto em que o gemini-3.5-pro aparecer, mais um fallback de modelo em Laravel pra troca virar uma linha de .env.

08 Ago · 6 min
02 #ia · #agentes
Muse Spark invadiu uma empresa real: o terceiro modelo em três semanas

O Muse Spark 1.1 da Meta invadiu os sistemas de uma empresa real durante uma avaliação de cibersegurança. É o terceiro laboratório em três semanas, sempre com a mesma falha de contenção e o mesmo fornecedor de avaliação. E um dia antes da notícia, essa avaliadora havia publicado um laudo dizendo que o modelo não altera o cenário de ameaças.

07 Ago · 18 min
03 #openai · #ia
A segunda onda de gameplays falsos de GTA 6 com IA já tem 1 milhão de views (e ninguém vai pedir desculpa)

Um "gameplay vazado" de GTA 6 passou de 1 milhão de views e foi gerado por IA do primeiro ao último frame. Desmontamos o pipeline de 5 etapas por trás desses vídeos, por que o Sora saiu do jogo no meio da onda, e como cada artefato que denuncia o fake é consequência direta de uma decisão técnica de quem produziu.

07 Ago · 9 min
04 #ia · #llm
Qwen 3.8 Max pesos abertos dia 10: o que dá (e o que não dá) pra rodar dos 2,4 trilhões

A Alibaba vai publicar os pesos do Qwen3.8-Max, 2,4 trilhões de parâmetros, na semana de 10 de agosto: é a primeira vez que um modelo classe Max abre. A conta honesta do que isso significa na prática: quanto pesa em VRAM, por que nem um nó de 8 H200 fecha, por que o Qwen3.8-27B é o checkpoint que realmente te interessa, e o detalhe que quase ninguém está olhando, a licença que ainda não foi anunciada.

07 Ago · 12 min
05 #ia · #agentes
Muse Code: a Meta bateu o Codex no Terminal-Bench — e cobra US$ 0,30 pra ler seu repositório

A Meta lançou o Muse Code em beta, agente de terminal rodando o Muse Spark 1.2. O gráfico diz 82,9% no Terminal-Bench e vitória sobre o Codex. Fui ler o gráfico: a Meta bateu o GPT-5.6 Terra, não o GPT-5.6 Sol que o Codex realmente usa, e perdeu pro Claude Opus 5 nos três benchmarks do próprio anúncio. O que sobra de real, a arquitetura de worktrees e event log que vale copiar, e o preço de US$ 0,30 por milhão que você paga com o seu código.

06 Ago · 11 min
06 #openai · #ia
GPT-5.6 Sol derrubou a Conjectura de Maxwell: o modelo teve a ideia, os humanos fizeram a prova

O GPT-5.6 Sol sugeriu a construção que derrubou a Conjectura de Maxwell — e não, não são as equações do eletromagnetismo. Paper no arXiv com 5 cargas e 24 pontos de equilíbrio, o papel real do modelo vs. dos matemáticos, o caso anterior do Fable 5 e a ressalva que o hype de "problema de 150 anos" omite.

31 Jul · 8 min
07 #ia · #google
Cactus Hybrid: o modelo local que sabe quando está errado e chama a nuvem sozinho

A Cactus pós-treinou o Gemma 4 E2B com uma probe de confiança nativa: cada resposta sai com um score de 0 a 1 e, abaixo do threshold, a query escala sozinha pra nuvem. Iguala o Gemini 3.1 Flash-Lite roteando só 15-55% das queries. Destrinchamos como a probe funciona, o código de integração (o roteamento é um if), a conta de custo e onde isso quebra.

25 Jul · 8 min
08 #ia · #embeddings
O que é um banco de dados vetorial? Guia prático com exemplo (pgvector)

Banco de dados vetorial explicado de baixo pra cima: o que é, como a busca por similaridade funciona por dentro e como montar um com pgvector no Postgres que você já tem.

23 Jul · 10 min
09 #ia · #produtividade
FOMO de IA: por que você sente que está sempre ficando pra trás (e como sair da paralisia)

84% dos devs usam IA, mas a confiança caiu. Devs acham que estão 20% mais rápidos quando estão 19% mais lentos. FOMO de IA já prediz ansiedade em paper acadêmico. Este post junta os dados que provam que a paralisia que você sente não é preguiça — é excesso — e mostra o método pra sair dela: menos consumo, mais execução.

22 Jul · 10 min
10 #ia · #llm
Como rodar um LLM local: guia do zero (Ollama, hardware e quando vale a pena)

Dá pra rodar um modelo decente no seu notebook, sem mandar um byte pra nuvem. O guia de quando isso faz sentido, o que roda no seu hardware, como subir com Ollama e quando local ganha da API.

22 Jul · 9 min
11 #ia · #google
Gemini 3.6 Flash chegou: benchmarks, preço e por que o Google lançou o Flash antes do Pro

O Google lançou o Gemini 3.6 Flash prometendo qualidade de Pro com preço de Flash. Testei o anúncio contra os números: benchmarks oficiais, preço por token, o tier Flash-Lite — e o que é fato e o que é rumor na história do Pro que não chega.

21 Jul · 9 min
12 #ia · #rag
O que é fine tuning? Guia prático (e quando NÃO usar)

Todo mundo acha que precisa de fine tuning. Quase ninguém precisa. O guia direto do que é, como funciona e o critério honesto de quando usar vs RAG vs contexto.

21 Jul · 10 min
Conheça o Clã Beer and Code
tocando