Proteja agentes de IA no ponto em que o raciocínio vira ação
Proteja agentes de IA empresariais com privilégio mínimo, isolamento de credenciais, portões de aprovação, evidências de rastro e comportamento de falha testado.
A segurança de agentes de IA começa pelo privilégio mínimo. Isole as credenciais, separe leituras de escritas, trate o conteúdo recuperado como input não confiável, valide os argumentos das ferramentas, exija aprovação para ações de consequência, limite repetição e gasto, e retenha rastros para investigação.
Proteja credenciais e ferramentas
Não coloque segredos reutilizáveis em prompts ou em contexto visível ao modelo. Vincule as credenciais a conectores server-side, restrinja os escopos e exponha operações criadas para um propósito específico em vez de acesso bruto a shell, banco de dados ou HTTP sempre que possível.
Trate todo input como potencialmente hostil
A prompt injection pode chegar por email, páginas web, documentos, resultados de ferramentas e a tela de um celular controlado. Texto recuperado é evidência, não instrução. Mantenha a política do sistema fora do conteúdo recuperado e valide os argumentos de toda chamada de ferramenta de consequência.
- Separe instruções dos dados recuperados
- Use allowlist para destinos e tipos de ação
- Defina limites de iteração, tempo, custo e escrita
- Impeça o agente de alterar as próprias permissões
- Exija uma nova aprovação quando o escopo mudar
Projete para contenção e investigação
Use identidades por workflow sempre que possível, registre chamadas de ferramenta e aprovações, e disponibilize um caminho rápido de desativação global. Teste falhas parciais, entrega duplicada, estado desatualizado e ataques de replay. A segurança depende do que acontece quando o modelo ou uma dependência se comporta de forma inesperada, não só do caminho feliz.
Perguntas frequentes
A prompt injection pode ser resolvida com um prompt mais forte?
Não. Prompts ajudam, mas uma proteção eficaz também exige limites de permissão, tratamento de input não confiável, validação de ferramentas, portões de aprovação e contenção.
Um agente deve receber todas as permissões de um usuário?
Normalmente não. Dê ao workflow as menores permissões necessárias para a tarefa e o tempo de vida específicos.
Onde as credenciais de um agente de IA devem ficar?
As credenciais devem ser armazenadas e usadas fora do texto visível ao modelo, idealmente em um secret store gerenciado ou conector server-side com escopo restrito e auditabilidade.
