~/beer-and-code
▪ próximo evento AI Engineering Lab 3ª Edição — Da Arquitetura à Produção · 19—20 Set · 19 e 20 de setembro, das 09h às 13h — ao vivo via Google Meet garantir vaga
~ / tag / #ia $ grep

#Ia

168 posts
61 #ia · #llm
GLM 5.2: o melhor modelo de código open source é chinês, MIT e 6x mais barato

A Z.ai (ex-Zhipu) lançou o GLM 5.2, modelo open-weight de 753B sob licença MIT que fica a 0,7 ponto do Claude Opus 4.8 em código e custa um sexto do preço por token. O que muda pra quem programa com IA no Brasil — incluindo rodar self-host.

22 Jun · 8 min
62 #openai · #ia
GPT 5.6 foi lançado: Sol, Terra e Luna, preços e tudo o que sabemos (rastreador)

O GPT 5.6 foi lançado em três modelos (Sol, Terra e Luna), com acesso restrito pelo governo dos EUA. O que se confirmou dos vazamentos, os preços e o que ainda é incógnita.

22 Jun · 9 min
63 #ia · #embeddings
RAG híbrido na prática: BM25, embeddings e reranker

Embedding sozinho erra mais do que você imagina. Veja como combinar busca lexical (BM25), busca semântica e um reranker cross-encoder para subir a qualidade do RAG em produção, com código em Python e LangChain.

21 Jun · 9 min
64 #ia · #ai-agents
Como criar evals para agentes de IA com LLM-as-a-judge

Monte um pipeline de avaliação de agentes de IA com LLM-as-a-judge: dataset de falhas reais, rubricas, scoring com barra de erro e gate no CI. Sem eval, deploy é no escuro.

21 Jun · 18 min
65 #ia · #llm
Modelos de IA open source valem a pena em 2026? A conta real de rodar local

Modelos open source fecharam o gap em 2026. Mas "open source" não é "local" e "local" não é "de graça". A conta honesta de quando rodar LLM local compensa: custo, privacidade e velocidade.

20 Jun · 8 min
66 #ia · #gestao
Prontidão para IA: como deixar sua empresa pronta de verdade

Comprar licença de IA não deixa a empresa pronta pra IA. Um framework de prontidão para IA em quatro frentes — dados, processos, pessoas e governança — com os números que mostram onde a maioria trava.

20 Jun · 10 min
67 #openai · #ia
Claude Code ou Codex: o Codex ganha o terminal por 13 pontos, o Claude ganha o repo difícil por 10

Claude Code ou Codex? A resposta tem número: o Codex abre 13 pontos no Terminal-Bench (82,7% contra 69,4%) e o Claude Code abre 10 no SWE-bench Pro (69,2% contra 58,6%), que é o benchmark do problema multi-arquivo de verdade. No SWE-bench Verified empatam. Aqui está o veredito por cenário, o custo real por dev e o critério que importa mais que qualidade: quanto controle você quer durante a tarefa.

19 Jun · 10 min
68 #ia · #ai-agents
Como criar um bot no Slack com Claude: um agente de dados no seu workspace

Tutorial de um bot de Slack que responde perguntas sobre seus dados com Claude, baseado no cookbook da Anthropic. Do app_mention ao agente em produção.

19 Jun · 11 min
69 #ia · #ai-agents
Como criar um servidor MCP do zero: tools, resources e prompts, do stdio ao HTTP

Tutorial mão na massa pra escrever um servidor MCP em Python do zero — uma tool, um resource e um prompt — rodando em stdio e HTTP, plugado no Claude.

19 Jun · 12 min
70 #ia · #carreira
Engenheiro de IA: o que faz no dia a dia em 2026

O que um engenheiro de IA realmente faz no dia a dia em 2026: a rotina real, o stack que ele toca, o que NÃO faz e como entrar na área vindo de dev backend. Spoiler: não é treinar modelo o dia inteiro.

18 Jun · 8 min
71 #ia · #carreira
Desenvolvedor de IA vs Engenheiro de IA: 7 diferenças que importam

Desenvolvedor de IA e engenheiro de IA não são dois nomes pra mesma vaga. Comparativo direto de escopo, skills, salário e carreira, e onde o dev de produto cruza a linha.

18 Jun · 10 min
72 #openai · #ia
Agent improvement loop: o ciclo que faz o agente melhorar o próprio código

Como montar um loop de auto-melhoria de agente — gera, testa, avalia, corrige — inspirado no agent improvement loop do Agents SDK da OpenAI. Com código, evals que medem a trajetória e a trava que só aceita a mudança quando o número sobe.

18 Jun · 8 min
Conheça o Clã Beer and Code
tocando