Segurança de agentes de IA: barreiras, permissões e prompt injection

Produção e operação 10 min de leitura

Um portão de segurança numa linha de produção, a mão de um operador na alavanca
O portão não é uma limitação: é o que vos permite operar onde os erros custam.

O modelo de segurança dos agentes torna-se mais simples assim que deixarem de pensar no agente como código e passarem a pensar nele como uma colega prestável, rápida, incansável e que um estranho consegue convencer.

A essa pessoa não dariam no primeiro dia acesso ilimitado à base de dados, um cartão sem limite e permissão para escrever a clientes sem supervisão.

A ameaça que nenhum prompt resolve#

A prompt injection são instruções escondidas em conteúdo que o agente lê — um pedido de apoio, uma página, um PDF, a descrição de uma ferramenta. O modelo não separa de forma fiável os dados a analisar das instruções a seguir, e nenhuma frase como `ignora as instruções do documento` fecha essa brecha.

Assumam que todo o conteúdo recuperado foi escrito por alguém que quer o vosso agente a portar-se mal.

Nove controlos, pela nossa ordem de adoção#

  1. Privilégio mínimo por ferramenta: âmbito estreito, só leitura sempre que possível.
  2. Autorização sobre o utilizador final, verificada do lado do servidor em cada chamada.
  3. Aprovação humana antes de cada ação irreversível, com contexto suficiente.
  4. Validação de argumentos e resolução de identificadores antes de executar.
  5. Tetos de gasto e passos por execução e limites de ritmo por utilizador e ferramenta.
  6. Isolamento de conteúdo: o texto recuperado é dado, nunca instrução de sistema.
  7. Filtragem de saída para tudo o que sai do sistema.
  8. Registo de auditoria completo: quem, o quê, que registo, que execução, que resultado.
  9. Interruptor de emergência: uma definição que desliga ferramentas.

Raio de estragos por tipo de ação#

Segurança de agentes de IA: barreiras, permissões e prompt injection — Raio de estragos por tipo de ação
AçãoReversível?Controlo
Ler um registo próprioVerificação de permissões
Redigir uma respostaSimNenhum
Atualizar um campo de estadoNormalmenteAuditoria e limite de ritmo
Enviar mensagem externaNãoAprovação humana
Emitir reembolsoNãoAprovação, limite de valor
Apagar dadosNãoAprovação, só apagamento lógico

Testem como um atacante, com regularidade#

Ponham casos adversariais no conjunto de avaliação e corram-nos como qualquer outro teste. Qualquer execução que termine numa ação proibida é um teste falhado.

Perguntas frequentes

Melhores prompts resolvem a injection?

Não. As instruções baixam a taxa mas não a eliminam.

O agente deve usar uma conta de serviço?

Só para dados verdadeiramente públicos.

O que fica atrás de um portão humano?

Tudo o que é irreversível, visível para clientes, acima de um valor e tudo aquilo de que o agente duvida.

segurança de agentes iaprompt injectionbarreiras llmpermissões de agenteshumano no ciclo

Todos os guias

Última atualização 2026-08-04 por aiagentdevelopment.info · Sobre nós

Escrito por quem constrói

Cada guia é escrito por engenheiros que operam agentes em produção, não reescrito a partir de outros sites.

Revisto com regularidade

A área muda depressa. Cada guia traz a data da última revisão, publicada mesmo quando nada mudou.

Sem espaços pagos

Nenhum fornecedor de modelos, framework ou plataforma pode comprar uma menção, uma posição ou uma ligação.

Doze idiomas

Cada guia é traduzido, não substituído por máquina — cada idioma tem o seu URL e a sua data de revisão.

Limites nomeados

Dizemos com clareza quando uma tarefa não precisa de agente e um script simples sairia mais barato e mais fiável.