Agente de IA Seguro · Red-Team de IA

IA aplicada a testar a sua própria IA

Um especialista configurado para submeter chatbots, copilotos e agentes a ataques controlados, com evidência reproduzível e plano de defesa, dentro do escopo que você autorizar.

Empresas que confiam na UPX

  • Bradesco
  • Nubank
  • BTG Pactual
  • Totvs
  • Ascenty
  • Live!
  • G4 Educação
  • EVEO

Capacidades

O que o Agente de Red-Team de IA pode fazer

Principais frentes de atuação do Agente de IA Especialista em Red-Team de IA na sua operação.

Injeção de prompt

Testa se instruções externas conseguem sobrepor as regras do sistema.

Vazamento de contexto

Verifica se o sistema revela instruções, dados ou credenciais indevidamente.

Contorno de guardrails

Avalia se as restrições configuradas resistem a tentativas de desvio.

Abuso de ferramentas

Testa se o agente pode ser induzido a usar integrações fora do escopo.

Evidência reproduzível

Documenta cada achado com o passo a passo que permite confirmar a falha.

Plano de defesa

Propõe camadas de mitigação priorizadas pelo impacto de cada achado.

Skills

Capacidades que compõem o especialista

Skills adicionam capacidades específicas ao Agente de IA Seguro de acordo com os processos que ele precisa executar.

Bateria de ataques controlados
Executa os casos de teste acordados dentro do escopo autorizado.
Documentação de achados
Registra cada falha com o passo a passo para reprodução.
Plano de mitigação
Propõe defesas em camadas priorizadas por impacto.
Como funciona

Do escopo ao plano de defesa, com revisão em cada etapa

Defina o escopo autorizado, conecte os sistemas a testar e deixe a bateria acontecer dentro dos limites que você estabeleceu.

01

Defina o escopo autorizado
Nada é testado fora do que foi acordado.Registre quais sistemas podem ser testados, em qual ambiente e em qual janela. O Agente de IA Seguro opera somente dentro do escopo aprovado por escrito.

02

Peça o trabalho
Fale com o agente em linguagem natural.Solicite a bateria de testes, a verificação de um guardrail específico ou o relatório pelos canais disponíveis. O agente entende o contexto, aplica as skills configuradas e segue o escopo definido.

03

O agente testa. O time corrige.
Do achado à defesa, com controle.O agente executa os casos, registra a evidência e propõe a mitigação dentro das permissões definidas. Alterar o sistema testado e priorizar a correção continuam com a equipe de produto.

Integrações

Conectado aos sistemas de IA que você colocou em produção

O Agente de IA Especialista em Red-Team de IA pode testar os sistemas autorizados e registrar os achados nas ferramentas que sua equipe já utiliza.

  • OpenAI
  • Anthropic
  • Google Gemini
  • Azure OpenAI
  • GitHub

Fluxo

O que entra, o que o agente faz e o que sai

Do escopo autorizado ao plano de defesa, seguindo as regras e permissões da sua empresa.

Entradas

  • Escopo autorizadoDOC
  • Casos de testeLista
  • Configuração do alvoJSON

Processamento

Agente de IA Seguro

Processando a tarefa

  • Validar escopo
  • Executar
  • Registrarem execução
  • Propor defesa
Skill aplicadaEscopo verificado

Saída

Concluído

Relatório preparado

  • Achados reproduzíveis
  • Impacto estimado
  • Defesa em camadas proposta

Controle

Você define até onde o Agente pode agir

Diferentes ações podem operar com níveis diferentes de autonomia, sempre dentro das regras da sua empresa.

  1. 1

    Consulta

    Lê o escopo e a configuração do sistema alvo.

  2. 2

    Prepara

    Executa os casos acordados e registra a evidência.

  3. 3

    Solicita revisão

    Aguarda validação de quem responde pelo produto.

  4. 4

    Executa

    Realiza a ação dentro dos limites definidos.

Os níveis são configurados por tipo de ação, conforme a política de cada empresa. Nenhum teste é executado fora do escopo autorizado, e alterar o sistema testado permanece sempre sob aprovação humana.

Comece agora

Coloque um Agente de IA Seguro para trabalhar.

Comece pela plataforma ou escolha o plano que acompanha o ritmo da sua operação.

Segurança e conformidade

Segurança que pode ser verificada.

Certificações e atestados

  • SOC 2 Type II
  • ISO 27001

A UPX mantém SOC 2 Type II e ISO 27001, com auditoria independente sobre seus controles de segurança da informação.

Privacidade e regulamentação

LGPD
As operações seguem a Lei nº 13.709/2018. Nos contratos de Agentes de IA, a UPX atua como operadora; a base legal permanece com a sua empresa.
Zero Data Retention
Política de produto, não certificação: com provedores e configurações compatíveis, o conteúdo processado não permanece retido após a execução.
Retenção e exclusão
A política de retenção é definida por contrato. Encerrado o contrato, os dados são apagados no prazo acordado.

Perguntas frequentes

Dúvidas comuns sobre o Agente de Red-Team de IA

O que as equipes costumam perguntar antes de colocar um agente para testar sistemas de IA.

  • Ele pode testar qualquer sistema?

    Não. Todo teste depende de escopo autorizado por escrito, com sistema, ambiente e janela definidos. O agente não executa nada fora desse escopo, e não testa sistemas de terceiros sem autorização.
  • Os testes podem derrubar o ambiente?

    Os casos são controlados e o escopo define o ambiente. A recomendação é começar por homologação; quando o teste ocorre em produção, a janela e os limites são acordados antes com a equipe responsável.
  • Por que a evidência precisa ser reproduzível?

    Porque sem o passo a passo o time de produto não consegue confirmar a falha nem validar a correção. Cada achado é documentado com o que foi enviado, o que o sistema respondeu e em que condições.
  • Ele corrige as falhas que encontra?

    Não. O agente propõe a defesa em camadas e prioriza pelo impacto. Alterar prompt, guardrail ou integração do sistema testado continua com a equipe de produto.
  • Os dados dos testes são usados para treinar modelos?

    Não. O conteúdo processado pelos Agentes de IA Seguros não é utilizado para treinar modelos da UPX nem de terceiros.
  • Conseguimos auditar o que o agente fez?

    Sim. Cada ação executada fica registrada: o que foi consultado, o que foi proposto, quando, em qual sistema e sob qual permissão. O histórico fica disponível para consulta e auditoria.
  • Quanto tempo leva para colocar em operação?

    Depende dos sistemas a testar e da definição de escopo. O ponto de partida é acordar o escopo de um sistema e rodar a primeira bateria, ampliando conforme os resultados aparecem.

Agente de IA Seguro

Leve um Agente de IA Seguro para testar a sua IA

Converse com nossos especialistas e veja como adaptar este Agente de IA aos seus processos, sistemas e necessidades.