~/beer-and-code
▪ próximo evento Workshop: Jev na Prática para Devs · 14 Out · 19h — duração de 2h a 3h, ao vivo via Google Meet garantir vaga ›
~ / tag / #ia $ grep

#Ia

169 posts
97 #ia · #agentes
Quando usar RAG (e quando fine-tuning ou contexto resolvem melhor)

RAG virou resposta automática pra tudo, e quase sempre é a escolha errada. O mapa de decisão entre RAG, fine-tuning e contexto pelos critérios que importam: volatilidade do dado, custo, rastreabilidade e tamanho.

04 Jun · 11 min ›
98 #ia · #ai-agents
System prompt de produção: a espinha dorsal do comportamento do agente

O system prompt não é onde você manda o modelo ser legal. É a constituição do agente: papel, políticas, ferramentas e formato. Como estruturar um de produção e por que ele joga num campeonato diferente de um prompt de chat.

03 Jun · 10 min ›
99 #ia · #ai-agents
Progressive disclosure: como não afogar seu agente em 50 ferramentas

Colocar 50 ferramentas no contexto do agente degrada a escolha e estoura tokens. Progressive disclosure carrega tools sob demanda: o agente descobre o que precisa quando precisa. Padrão central de arquitetura de agentes que escalam.

03 Jun · 10 min ›
100 #ia · #ai-agents
Programmatic tool calling: deixe o agente escrever o código em vez de chamar tool a tool

Chamar 12 tools uma a uma é caro, lento e entope o contexto. Programmatic tool calling vira o jogo: o agente escreve um código que orquestra as chamadas e devolve só a resposta. Entenda o padrão com exemplos da Claude API e do Code Mode da Cloudflare.

03 Jun · 15 min ›
101 #ia · #llm
Engenharia de prompt: o guia honesto (sem fórmula mágica)

Engenharia de prompt não é decorar fórmula nem lista de "100 prompts mágicos". É escrever instrução como contrato: estrutura, instrução clara, exemplos few-shot e formato de saída. O guia honesto para quem constrói software com IA.

02 Jun · 11 min ›
102 #ia · #ai-agents
Tool async com API externa e resource template num MCP server (ViaCEP)

Exemplo prático complementar ao tutorial completo: um MCP server em Python com uma tool async que consulta CEP na ViaCEP e um resource template `padroes://{area}`, testado no MCP Inspector e plugado no Claude.

02 Jun · 10 min ›
103 #laravel · #php
Tool calling na prática: como o agente decide chamar uma ferramenta

Anatomia do loop ReAct e do tool calling: quando o agente decide buscar/agir vs. responder direto, os três campos do tool_use/tool_result que você não pode errar e uma tool de busca em banco no Laravel via Claude API, com idempotência onde tem efeito colateral.

02 Jun · 13 min ›
104 #ia · #ai-agents
Engenharia de contexto: o que vai no prompt (e o que NÃO vai)

O recurso mais escasso de um agente é a janela de contexto. Veja como decidir o que entra no prompt — system prompt, exemplos, histórico, dados recuperados — e por que encher de contexto degrada a resposta.

01 Jun · 10 min ›
105 #ia · #ai-agents
O que é MCP: o protocolo que virou o padrão de tools dos agentes de IA

O Model Context Protocol é o padrão aberto que conecta modelos de IA a ferramentas e dados sem reescrever integração a cada vez. Entenda o que é MCP, como a arquitetura funciona e por que a indústria adotou em massa.

01 Jun · 7 min ›
106 #ia · #agentes
O que é um agente de IA (e o que é só um wrapper de prompt)

90% dos "agents" que você vê no LinkedIn são um if com esteroides. A definição honesta de o que é um agente de IA: o loop percepção→decisão→ação→observação e os quatro blocos mínimos — modelo, ferramentas, memória e orquestração. Falte um e o sistema vira burro depois da terceira mensagem.

01 Jun · 9 min ›
107 #ia · #produto-ia
Compliance EU AI Act + NIST RMF: checklist de 18 itens para times brasileiros que vendem pra fora

EU AI Act entra em vigor em 2 de agosto de 2026, com multas de até 7% do faturamento global. Checklist técnico de 18 itens em ordem de prioridade, mapeado para NIST RMF (Govern/Map/Measure/Manage), com templates Markdown prontos para colar no repositório.

30 Mai · 14 min ›
108 #performance · #openai
Reasoning models em produção: quando o trade de latência vale a pena

Reasoning model resolve o que modelo normal não resolve. Em troca: três vezes mais latência, cinco vezes mais tokens. Em maio/2026, com o3, DeepSeek-R1 e Claude Sonnet 4.5 estáveis, dá pra falar com número na mesa: quando vale o trade e qual pattern de roteador separa o time que opera bem do time que estourou o budget no terceiro dia.

30 Mai · 9 min ›
Conheça o Clã Beer and Code
tocando