Voltar para a Governança de IA

Governança de IA

Guardrails

Os guardrails definem o que a IA não deve fazer: vazar dado sensível, prometer resultado absoluto, dar parecer jurídico ou de saúde, responder ao cliente sem revisão ou executar ação crítica sozinha. Cada um é explícito e auditável — quando acionado, pode bloquear o output, exigir revisão humana e gerar evidência. O guardrail reduz risco; não o elimina.

  • Regras explícitas e auditáveis
  • Guardrail acionado bloqueia ou exige revisão
  • Reduz risco — não o elimina
Guardrails críticos não podem ser excluídos — apenas enfraquecidos com justificativa registrada, mantendo o histórico para auditoria.

Bloquear dado sensível no output

Dado sensível
Crítica
Ativo

Output com dado sensível (saúde, documento, cartão, senha) é bloqueado e exige revisão humana antes de qualquer uso.

Bloqueia output na violação Exige revisão humana Gera evidência Exige justificativa

Bloquear prompt injection

Injeção de prompt
Alta
Ativo

Tentativa de sobrescrever instruções / vazar prompt do sistema é bloqueada e registrada.

Bloqueia output na violação Gera evidência

Minimizar dado pessoal no input

Privacidade
Alta
Ativo

Dado pessoal no input deve ser minimizado/redigido. Sinaliza para reduzir o que é enviado ao provedor.

Gera evidência

Não decidir crédito/finanças

Financeiro
Alta
Ativo

Decisão de crédito, investimento ou financeira sensível exige revisão humana. A IA é apoio à decisão.

Exige revisão humana Gera evidência

Não emitir diagnóstico de saúde

Saúde
Crítica
Ativo

Diagnóstico, prescrição ou promessa de cura é bloqueado. Não substitui avaliação profissional de saúde.

Bloqueia output na violação Exige revisão humana Gera evidência Exige justificativa

Não emitir parecer jurídico conclusivo

Jurídico
Alta
Ativo

A IA apoia, não substitui revisão profissional. Conclusão jurídica definitiva exige revisão humana (Jurídico).

Exige revisão humana Gera evidência

Não fazer promessa absoluta

Promessa absoluta
Alta
Ativo

Promessa de resultado garantido / 'sem risco' / '100%' é sinalizada e revisada antes de ir ao cliente.

Exige revisão humana

Resposta a cliente sensível exige revisão

Comunicação ao cliente
Alta
Ativo

Output voltado ao cliente em contexto sensível não vai sem revisão humana. Uso governado, não automático.

Exige revisão humana Gera evidência

Sem ação crítica automática

Limite de automação
Crítica
Ativo

A IA não executa ação irreversível ou decisão crítica (exclusão, jurídica, financeira, trabalhista) sem revisão humana.

Bloqueia output na violação Exige revisão humana Gera evidência Exige justificativa

Sem conteúdo discriminatório

Discriminação
Alta
Ativo

Conteúdo discriminatório ou decisão por característica protegida é sinalizado e revisado.

Exige revisão humana Gera evidência

O TrustOps apoia a governança, o controle e a rastreabilidade do uso de IA. Não garante conformidade jurídica ou regulatória — decisões devem ser revisadas por profissionais responsáveis.

Centriu TrustOps