~/beer-and-code
▪ próximo evento Workshop: Jev na Prática para Devs · 14 Out · 19h — duração de 2h a 3h, ao vivo via Google Meet garantir vaga ›
~ / tag / #china $ grep

#China

12 posts
01 #llm · #seguranca-ia
Anthropic acusa Moonshot de servir Claude no lugar do Kimi: o que o relatório prova (e o que não prova)

A Anthropic acusa a Moonshot de repassar requests de clientes do Kimi para o Claude Opus e exibir a resposta como se fosse do Kimi: quase 300 mil requests em dez dias, 5.380 contas fraudulentas e 23 milhões de trocas de destilação. Separamos o que o relatório de 154 páginas afirma, o que ele não prova, o que a Moonshot (não) respondeu e o que muda pra quem roda Kimi K3 em produção.

06 Out · 15 min ›
02 #ia · #llm
Ox Alpha era o GLM-5.3-Flash: a Z.ai confirmou, abriu os pesos em MIT — e o benchmark de 80% continua falso

O Ox Alpha era o GLM-5.3-Flash. Cinco dias antes de qualquer anúncio, o fingerprinting por tokenizador já apontava a Zhipu: 95 de 95 contra o vocabulário do GLM-5. Agora a Z.ai confirmou, publicou os pesos no Hugging Face sob licença MIT e revelou a arquitetura: 320B totais com 18B ativos, 1M de contexto, US$ 0,075 por milhão. O benchmark de 80% continua sendo o que sempre foi: uma amostra de dez tarefas. No conjunto completo, 63%.

25 Ago · 13 min ›
03 #llm · #custos
DeepSeek V4 Pro 0813: 87,9 no Terminal Bench passa o Opus 4.8 e a conta vai subir

A DeepSeek publicou o DeepSeek-V4-Pro-0813 na página oficial de preços e o release oficial do V4 Pro finalmente saiu do rótulo de preview. Os números reportados, o que é fato e o que ainda não tem documento público, a comparação com o Flash 0731 e o Opus 4.8, e o aviso na própria página de preços de que a DeepSeek vai aumentar os valores em breve.

12 Ago · 11 min ›
04 #llm · #custos
DeepSeek V4 Flash 0731: pesos novos, 82,7 no Terminal Bench e a conta que dói na OpenAI

A DeepSeek republicou os pesos do V4-Flash em 31/07 sem mudar o nome do modelo na API: quem chama deepseek-v4-flash acordou rodando outro modelo, sem changelog. Os números reais do 0731 (82,7 no Terminal Bench, mas 79% na medição independente), onde ele ganha do GPT-5.6 Luna e onde perde, os 169 GB pra rodar local e o que fazer se seu agente aponta pra um nome de modelo que virou alvo móvel.

31 Jul · 12 min ›
05 #llm · #modelos-open-source
Kimi K3 liberou os pesos abertos: o maior modelo do mundo é de graça, mas roda em quê?

A Moonshot AI publicou os pesos abertos do Kimi K3 um dia antes do prometido: 2,8 trilhões de parâmetros, licença MIT modificada e formato MXFP4 nativo. A conta que o hype não faz: 1,4 TB de VRAM só para carregar os pesos, nó de 8 GPUs que não fecha e um break-even de 6.200 tokens por segundo para empatar com a API a US$ 3 / US$ 15. Mais o que as sanções americanas alcançam de quem baixa peso no Brasil.

27 Jul · 14 min ›
06 #llm · #modelos-open-source
EUA ameaçam sancionar IA chinesa open source: o que muda pra quem usa Kimi e DeepSeek

Os EUA acusam formalmente labs chineses de roubo de tecnologia, a China rebate e OpenAI e Anthropic se uniram contra os modelos open-weight. Separamos fato de rumor nas sanções à IA chinesa open source e mostramos o playbook pra quem roda Kimi K3, DeepSeek ou Qwen em produção: o que a sanção alcança (e o que não) num stack no Brasil.

23 Jul · 10 min ›
07 #ia · #llm
Qwen 3.8 Max (2.4T): benchmark vs Kimi K3, preço e pesos abertos

A Alibaba soltou o Qwen 3.8 Max, MoE de 2.4 trilhões de parâmetros que ela diz ser o segundo do mundo, atrás só do Fable 5. Sem benchmark público no lançamento, o único teste independente deu 80/100 contra 83 do Kimi K3. Aqui: o que ele é, quanto custa (Token Plan de US$ 6 a 68), como acessar via API e onde cada modelo da família Qwen 3.8 se encaixa.

20 Jul · 9 min ›
08 #ia · #llm
Kimi K3 preço: US$ 3/15 por milhão, tem grátis? Benchmarks vs Claude

Kimi K3 custa US$ 3 de entrada e US$ 15 de saída por milhão de tokens na API (chat grátis no kimi.com), 1,7x mais barato que o Claude Opus 4.8, não os "5x" da timeline. Fizemos a conta honesta do preço, separamos o benchmark verificável do hype e mostramos onde ele bate (e onde não bate) o Claude.

17 Jul · 10 min ›
09 #seguranca-ia · #anthropic
Alibaba baniu o Claude Code: o que é real no "backdoor de detecção de China"

A Alibaba baniu o Claude Code dos funcionarios e mandou trocar pelo Qoder, alegando um mecanismo de deteccao de China. Separamos o fato tecnico (o que a Anthropic embutiu e por que) do panico geopolitico EUA x China, com o checklist pra quem roda coding agent em codigo sensivel no Brasil.

06 Jul · 10 min ›
10 #ia · #llm
DeepSeek V4 Flash com 1M de contexto no seu RTX 5090: dá pra rodar local — mas tem um porém

O r/LocalLLaMA travou num feito: DeepSeek V4 Flash rodando 1M de tokens de contexto num único RTX 5090. É real, mas tem um asterisco que ninguém coloca no título. Separamos a engenharia de verdade do entusiasmo de thread: os números reais, o porém da RAM e quando a API sai mais barata.

03 Jul · 9 min ›
11 #ia · #llm
LongCat 2.0: o modelo fantasma owl-alpha que sumiu do OpenRouter era um MoE de 1,6 trilhão

O owl-alpha rodou disfarçado no OpenRouter por semanas, liderou rankings e sumiu. Era a LongCat 2.0 da Meituan: MoE de 1,6 trilhão de parâmetros, treinada sem NVIDIA. A história do modelo fantasma e o que ela ensina pra quem constrói com IA.

03 Jul · 8 min ›
12 #ia · #llm
GLM 5.2: o melhor modelo de código open source é chinês, MIT e 6x mais barato

A Z.ai (ex-Zhipu) lançou o GLM 5.2, modelo open-weight de 753B sob licença MIT que fica a 0,7 ponto do Claude Opus 4.8 em código e custa um sexto do preço por token. O que muda pra quem programa com IA no Brasil — incluindo rodar self-host.

22 Jun · 8 min ›
Conheça o Clã Beer and Code
tocando