Guardrails (barreiras de segurança)
Definição
Guardrails são os limites técnicos ao redor de um sistema de IA: ferramentas permitidas, faixas de valores, limites de gasto e volume, ações proibidas e aprovações obrigatórias. Transformam um modelo imprevisível num sistema que falha de forma segura e visível.
Guardrails eficazes são aplicados fora do modelo — no código, na camada de integração, em restrições de banco de dados — para que uma saída persuasiva, porém errada, do modelo ainda assim não cause danos.
Eles também tornam a operação auditável: toda ação bloqueada é registrada, e cada limite tem um responsável que pode alterá-lo deliberadamente.
Na prática
- Limites rígidos para valores, volumes, destinatários e ações destrutivas
- Aplicados em código, não apenas pedindo ao modelo que se comporte bem
- Todo bloqueio e substituição fica registrado para revisão
Termos relacionados
- Governança de IAGovernança de IA é o conjunto de regras que define quais sistemas de IA uma empresa opera, com quais dados, com quais permissões, sob a responsabilidade de quem e como os resultados são revisados. Torna o uso de IA auditável perante a diretoria, auditores e reguladores.
- Humano no processo (human in the loop)Humano no processo significa um ponto definido em que uma pessoa revisa, aprova ou corrige o trabalho do sistema de IA. O repasse é projetado com antecedência para gatilhos específicos — limites de valor, baixa confiança, contrapartes desconhecidas — em vez de ser deixado ao acaso.
- AlucinaçãoUma alucinação é uma saída confiante, porém falsa, de um modelo de linguagem — um número, cláusula ou referência inventados. É uma propriedade da geração estatística de texto, por isso sistemas de produção verificam as saídas contra dados-fonte em vez de confiar nelas.