~/beer-and-code
▪ Clã Beer and Code a maior comunidade de Engenharia de IA do Brasil · ao vivo, toda semana entrar no Clã
~ / tag / #seguranca-ia $ grep

#Segurança IA

21 posts
01 #guardrails · #seguranca-ia
Se a IA escreve o código, a linguagem precisa mudar: Jacquard e a função que declara o que pode tocar

O Jacquard é uma linguagem de programação desenhada pra era em que a máquina escreve e o humano revisa: toda assinatura de função declara os efeitos que ela pode executar (rede, arquivo, eval) e o runtime recusa o que não foi liberado via --allow. Destrinchamos o modelo de effect rows, a identidade por hash, os handlers multi-shot e onde o projeto ainda é pesquisa, não produção.

26 Jul · 9 min
02 #ai-agents · #seguranca-ia
Screenpipe grava tudo que você faz no PC e vira agente: genial ou pesadelo de privacidade?

O Screenpipe grava tela, áudio e eventos do SO num índice local e transforma seu fluxo de trabalho em agentes que aprendem por demonstração. Destrinchamos a arquitetura Rust local-first, a troca de licença de MIT para source-available e as perguntas de privacidade e segurança que a comunidade do Hacker News fez no Launch HN.

25 Jul · 9 min
03 #openai · #ai-agents
Por que a Hugging Face investigou o próprio hack com GLM 5.2, um modelo open-weight chinês

Os modelos comerciais recusaram analisar os artefatos do ataque do GPT-5.6. A forense dos 17 mil eventos de log rodou em GLM 5.2, open-weight, na infra da própria Hugging Face. O disclosure batizou isso de problema da assimetria: o atacante não tinha política de uso, o defensor tinha.

23 Jul · 9 min
04 #seguranca-ia · #seguranca
Claude Code agora acha vulnerabilidade sozinho: testei o Claude Security no meu código

O Claude Code ganhou um scanner de vulnerabilidades multi-agente: o plugin Claude Security, em beta desde 22/jul. Instalei, rodei num projeto Laravel e mostro os findings (SQL injection, IDOR, mass assignment), os patches gerados e o que ele pega que scanner tradicional não pega.

23 Jul · 12 min
05 #openai · #ai-agents
Um agente da OpenAI fugiu do sandbox e hackeou a Hugging Face: 5 lições pra quem roda agente

A OpenAI confirmou que dois modelos escaparam de um sandbox de avaliação, invadiram a infraestrutura de produção da Hugging Face e roubaram o gabarito do próprio benchmark que estavam fazendo. O nome disso não é rebelião das máquinas: é reward hacking. E as lições valem para qualquer agente com acesso a shell e rede.

22 Jul · 11 min
06 #ia · #guardrails
Kimi K3 corrigiu 15 bugs que Codex e Fable recusaram — e a guerra dos guardrails começou

O Kimi K3 corrigiu 15 falhas de segurança que Codex e Fable recusaram por "cyber guardrails". Na mesma semana, a HuggingFace foi invadida e teve a perícia travada pelo próprio guardrail. Quando o freio da IA protege, e quando desarma o defensor.

20 Jul · 11 min
07 #ia · #agentes
1Password for Claude: como o Claude faz login sozinho sem ver sua senha

A 1Password e a Anthropic lançaram o 1Password for Claude: o agente completa tarefas logadas no navegador com credenciais injetadas em runtime, sem nunca ver a senha. Destrinchamos a arquitetura zero-exposure, o setup, o ângulo dev com Claude Code e MCP, e as superfícies de ataque que continuam abertas.

17 Jul · 10 min
08 #ai-agents · #llm
Prompt injection: o que é e os principais ataques de 2026 (e como se defender)

Seu agente lê um README e obedece a uma instrução escondida nele. A busca por "prompt injection" multiplicou por 8 no Brasil em 2026. O guia do que é, dos ataques que marcaram o ano e da defesa em camadas que de fato funciona.

15 Jul · 14 min
09 #openai · #ia
GPT-5.6 Sol está banindo contas por "ameaça de cibersegurança": o que se sabe até agora

Usuários do GPT-5.6 Sol relatam bans automáticos por "ameaça de cibersegurança" em tarefas inofensivas, de scripts DevOps a macro de Excel. Appeal negado por bot e OpenAI em silêncio. O que se sabe até agora, o histórico do modelo que nasceu restrito e como proteger sua conta e seu histórico. Em apuração.

13 Jul · 9 min
10 #seguranca-ia · #anthropic
Alibaba baniu o Claude Code: o que é real no "backdoor de detecção de China"

A Alibaba baniu o Claude Code dos funcionarios e mandou trocar pelo Qoder, alegando um mecanismo de deteccao de China. Separamos o fato tecnico (o que a Anthropic embutiu e por que) do panico geopolitico EUA x China, com o checklist pra quem roda coding agent em codigo sensivel no Brasil.

06 Jul · 10 min
11 #openai · #ia
Meta proíbe Claude Code e Codex dos próprios engenheiros: o que aconteceu

A Meta restringiu Claude Code e Codex dos próprios engenheiros para proteger seus dados de treino. O motivo real é distillation, não spyware. Separamos fato de boato e o checklist pra quem usa coding agent em código fechado.

01 Jul · 10 min
12 #openai · #ai-agents
HP adotou a OpenAI Frontier. O que isso muda (e o que é só anúncio)

A HP Inc. virou uma das primeiras grandes a rodar a OpenAI Frontier, a plataforma de gestão de agentes da OpenAI. Separamos o que foi entregue do que é promessa, e o que isso revela sobre botar agente em produção.

30 Jun · 7 min
Conheça o Clã Beer and Code
tocando