~/beer-and-code
▪ próximo evento AI Engineering Lab 3ª Edição — Da Arquitetura à Produção · 19—20 Set · 19 e 20 de setembro, das 09h às 13h — ao vivo via Google Meet garantir vaga
~ / tag / #contexto $ grep

#Contexto

16 posts
01 #claude · #contexto
Claude Opus 5 piorou? Melhor nos benchmarks, pior de conviver

As threads dizem que o Claude Opus 5 regrediu, e o Google já responde que sim. Mas a explicação mais provável não é nerf de modelo: é que a Anthropic cortou mais de 80% do system prompt embutido do Claude Code na geração Claude 5. Os defaults de contenção saíram, e a responsabilidade migrou para o seu CLAUDE.md. O que dá pra medir, o que é percepção e como domar sem trocar de fornecedor.

01 Set · 7 min
02 #ia · #llm
O que é um LLM: a explicação para quem vai construir, não para quem vai postar

Fundamento operacional de LLM sem analogia de papagaio: o que o modelo faz a cada token, por que ele é stateless, como a janela de contexto degrada muito antes do limite e por que temperatura 0 não é determinística. Cada conceito fecha com a consequência de arquitetura que ele te obriga a construir, com a doc oficial da Anthropic e da OpenAI, o paper Lost in the Middle e o estudo de context rot da Chroma na mão.

31 Ago · 5 min
03 #ia · #arquitetura-de-software
Engenharia de prompt acabou. O que veio depois se chama engenharia de contexto

Metade das tecnicas de prompt sumiu porque o modelo aprendeu sozinho. A outra metade virou parametro de API. O que sobreviveu, o que virou folclore, e por que em sistema real o problema deixou de ser a frase e passou a ser o que entra na janela de contexto.

31 Ago · 13 min
04 #cache · #contexto
Como economizar tokens em Claude Code, Codex e Cursor: pare de quebrar o cache

Você manda uma pergunta de uma linha e o /usage acusa consumo do dia inteiro. Economizar tokens em assistente de código não tem a ver com o tamanho do prompt: tem a ver com cache de prefixo. Como ele funciona no Claude Code, Codex e Cursor, as sete ações que invalidam ele sem você perceber, como medir com cache_read vs cache_creation, e oito alavancas para estender a sessão.

06 Ago · 16 min
05 #produtividade · #contexto
Anthropic cortou 80% do system prompt do Claude Code: o que seu CLAUDE.md precisa recuperar

A Anthropic removeu mais de 80% do system prompt embutido do Claude Code para os modelos Claude 5, sem perda mensurável nos evals de código. Quem dependia dos defaults viu o comportamento mudar da noite pro dia sem entender por quê. O que exatamente saiu, como diagnosticar em 5 minutos e o CLAUDE.md enxuto que funciona na geração nova.

30 Jul · 10 min
06 #ai-agents · #harness
Harness engineering não basta: o manifesto que explica por que as "fábricas de software" com IA falham

O manifesto da HumanLayer que bateu 373 pontos no Hacker News explica por que fábricas de software 100% autônomas degradam codebases e o que fazer no lugar.

25 Jul · 8 min
07 #ia · #rag
O que é fine tuning? Guia prático (e quando NÃO usar)

Todo mundo acha que precisa de fine tuning. Quase ninguém precisa. O guia direto do que é, como funciona e o critério honesto de quando usar vs RAG vs contexto.

21 Jul · 11 min
08 #openai · #ia
Codex com contexto reduzido: OpenAI cortou de 372k pra 272k sem avisar

A OpenAI baixou o contexto efetivo do modelo do Codex de 372k para 272k tokens numa atualização silenciosa e transformou o antigo teto numa linha onde o preço dobra. O que foi cortado, por que dói em sessão longa e monorepo, como confirmar que você foi afetado e os workarounds que existem hoje.

20 Jul · 9 min
09 #ia · #claude
Claude Code em monorepo: como não estourar contexto em base grande

Estratégias para usar Claude Code em monorepo e large codebase sem estourar o context window: escopo de sessão, CLAUDE.md em camadas, code intelligence e subagentes.

17 Jun · 11 min
10 #ia · #agentes
O que é Harness de IA? O ambiente que faz seu agente parar de travar

O harness é o ambiente que roda o agente — loop, ferramentas, estado e guardrails. É ele, não o modelo, que decide se seu agente aguenta produção ou trava na primeira tarefa de verdade.

15 Jun · 9 min
11 #agentes · #pgvector
Por que o agente esquece tudo: como dar memória de verdade ao seu agente de IA

Seu agente de IA começa do zero a cada sessão porque o modelo é stateless. Entenda por que ele esquece, a diferença entre memória de curto e longo prazo, e como dar memória de verdade sem complexidade desnecessária.

13 Jun · 11 min
12 #rag · #llm
Estourou o limite de tokens do ChatGPT: por que a IA esquece e como resolver

A IA não esquece por burrice. É a janela de contexto. Entenda pela dor o limite de tokens e as quatro saídas: resumo, RAG, chunking e memória.

13 Jun · 10 min
Conheça o Clã Beer and Code
tocando