#Self-Hosting
2 posts
01
#ia · #llm
Qwen 3.8 Max pesos abertos dia 10: o que dá (e o que não dá) pra rodar dos 2,4 trilhões
A Alibaba vai publicar os pesos do Qwen3.8-Max, 2,4 trilhões de parâmetros, na semana de 10 de agosto: é a primeira vez que um modelo classe Max abre. A conta honesta do que isso significa na prática: quanto pesa em VRAM, por que nem um nó de 8 H200 fecha, por que o Qwen3.8-27B é o checkpoint que realmente te interessa, e o detalhe que quase ninguém está olhando, a licença que ainda não foi anunciada.
07 Ago · 12 min
›
02
#ia · #llm
Como rodar um LLM local: guia do zero (Ollama, hardware e quando vale a pena)
Dá pra rodar um modelo decente no seu notebook, sem mandar um byte pra nuvem. O guia de quando isso faz sentido, o que roda no seu hardware, como subir com Ollama e quando local ganha da API.
22 Jul · 9 min
›