~/beer-and-code
▪ próximo evento Workshop: Jev na Prática para Devs · 14 Out · 19h — duração de 2h a 3h, ao vivo via Google Meet garantir vaga ›
~ / tag / #ai-agents $ grep

#Ai Agents

109 posts
01 #laravel · #ai-agents
Higgsfield MCP: o que é e 10 sistemas onde um dev pode integrar imagem e vídeo

O Higgsfield MCP entrega mais de 30 modelos de imagem e vídeo para o seu agente, com o harness de geração pronto. Como conectar no Claude Code, quanto custa cada geração em créditos e 10 sistemas onde um dev pode integrar isso.

01 Out · 11 min ›
02 #laravel · #php
Claude Code headless: como o claude -p vira um agente de IA orquestrado pelo seu código

Um comando artisan, uma fila e o Claude Code em modo headless (claude -p) gerando 11 sites dentro da assinatura. Como orquestrar o agente por PHP, onde a conta fecha e como plugar o Higgsfield como etapa de assets com orçamento controlado por código.

30 Set · 8 min ›
03 #ai-agents · #whatsapp
Da tela ao diálogo: interfaces de linguagem natural são a maior oportunidade aberta para o dev brasileiro

O brasileiro vive no WhatsApp, adotou o Pix em cinco anos e já compra pelo chat. As empresas ainda entregam formulário: só 17% usaram IA em 2025. Com dados do Gartner, Cetic.br, Banco Central e Opinion Box, por que a migração da tela para interfaces de linguagem natural é a maior oportunidade aberta para o dev brasileiro, o que construir agente significa na prática e as ressalvas que a tese precisa encarar.

14 Set · 15 min ›
04 #ia · #ai-agents
Quando usar agente de IA: o teste dos 3 minutos

Metade dos "projetos de IA" que revisei em 2026 se resolviam com um if e um SELECT. A outra metade virou agente porque o time queria dizer que tinha IA. Aqui está o teste dos 3 minutos: 4 perguntas que decidem se o seu problema pede um if, uma query, um prompt, um fluxo determinístico ou um agente de verdade. Com 5 casos reais, o veredito de cada um (spoiler: 1 em 5 era agente) e o custo invisível de errar pra cima.

02 Set · 18 min ›
05 #ai-agents · #llm
Classificação de intenção com LLM: como o agente decide qual rota seguir

O agente decide sozinho qual fluxo usar, mas ninguém consegue explicar por que ele escolheu errado ontem às 14h. Roteador determinístico vs. roteador por LLM, classificação de intenção com schema fechado e evidência, política de fallback explícita, atributos de trace para auditar a decisão e como medir acerto de rota sem rotular dez mil conversas na mão.

02 Set · 17 min ›
06 #ai-agents · #cache
Quanto custa um agente de IA em produção: a conta real de tokens

Seu protótipo custou R$ 12 no primeiro dia. Em produção, com 200 usuários, ele custa quase R$ 4.000 por mês. Abrimos a conta de token de um agente real camada por camada (system prompt, definições de tool, chunks de RAG, histórico, tool results) e mostramos onde some quase 80% do dinheiro. No fim, compressão de prompt, pruning de histórico e seleção de contexto derrubam a fatura em 73%, com a planilha antes e depois.

01 Set · 13 min ›
07 #ai-agents · #llm
LangGraph, Mem0, LangChain, MCP: do que você realmente precisa

Mapa honesto do ecossistema de orquestração e memória de agentes. O que LangGraph, Mem0, LangChain e MCP realmente fazem, o ponto em que cada um deixa de ser overhead, e a árvore de decisão de 5 perguntas antes de instalar qualquer coisa.

01 Set · 15 min ›
08 #ia · #ai-agents
Graph engineering é hype? Li o paper, os benchmarks e a conta

Uma frase de doze palavras no X virou paradigma com paper em cinco semanas. Fui ler o survey procurando o benchmark que justifica o degrau novo: não tem nenhum. O que separa hype de engenharia em graph engineering, com os números rastreados até a fonte, quais são de fabricante e quais são independentes, e a régua de cinco perguntas pra decidir se o seu caso pede grafo ou se você só quer o crachá novo.

27 Ago · 14 min ›
09 #laravel · #php
Laravel AI SDK vs Prism PHP: qual usar em cada caso

A internet trata o Laravel AI SDK e o Prism PHP como concorrentes e ainda repete que o SDK oficial usa o Prism por baixo dos panos. O composer.json diz outra coisa. Neste post: o que cada pacote faz de fato, o código lado a lado, a tabela do que só existe em um deles, a cadência de release dos dois e um guia de decisão por caso concreto. Sem "depende".

20 Ago · 4 min ›
10 #performance · #openai
GPT-5.6 Sol Ultrafast: 750 tokens/s na Cerebras, 11x mais rápido que o Fable 5

Não é modelo novo. É o mesmo GPT-5.6 Sol rodando num chip do tamanho de um prato: 750 tokens/s, 44 GB de SRAM on-chip e zero preço publicado. A OpenAI anuncia 14x contra o próprio Sol Standard; a Cerebras anuncia 11x contra o Fable 5 (sem teste pareado). Aqui separamos o que é verificável do que é marketing de fornecedor, explicamos por que Sol, Ultra e Ultrafast são três coisas diferentes, e mostramos a conta que decide se latência vira dinheiro no seu agente.

15 Ago · 10 min ›
11 #google · #ai-agents
Gemini 3.7 Flash chegou: 43,6% no FrontierCode e US$ 0,75/M, com o Flash antes do Pro de novo

O Google repetiu a jogada e soltou o Flash antes do Pro. Só que o US$ 0,75/M que tomou a timeline não é preço baixo: a tabela oficial mostra que é o preço do 3.6 Flash com 50% de desconto até 31/12/2026, e a fatura dobra em 1º de janeiro. Aqui estão os dois valores, os benchmarks reais (FrontierCode 43,6%, AutomationBench 30,4%), o que quebra na migração vindo do 3.6, e o dado que o release não conta: a alucinação subiu de 55,6% para 64,5%.

15 Ago · 11 min ›
12 #ai-agents · #seguranca
Agentes de IA em conflito: a Anthropic deu metas rivais a 3 Claudes e eles se atacaram com malware

Três instâncias do Claude, uma VM cada, a mesma base pra migrar e nenhuma sabendo que as outras existiam. Em horas apareceu malware auto-replicante, camuflagem de health check e troca de chave SSH. Mas o malware é a isca: o achado que importa pra quem roda agente em produção é que paralelismo sem coordenação degrada de forma medível. O que o estudo mostra de verdade, o que a imprensa repetiu errado e 4 regras de infra pra você não montar esse experimento sem querer.

15 Ago · 11 min ›
Conheça o Clã Beer and Code
tocando