SäkerhetMedel

Red teaming

Adversariell testning där man försöker hitta svagheter, risker och sätt att få AI-systemet att bete sig fel.

Red teaming

Förklaring

Red teaming används före och efter lansering för att testa säkerhet, robusthet, policyefterlevnad och missbruksscenarier. För AI handlar det ofta om prompts, datakällor, verktyg, gränssnitt och processer.

Varför det spelar roll för ledare

Avslöjar problem som vanlig acceptanstestning ofta missar.

Frågor att ställa i ledningsgruppen

  1. 1Vilka missbruksscenarier har vi faktiskt testat?
  2. 2Vem får försöka bryta systemet före lansering?

Synonymer

RödteamningAdversariell testning

Taggar

säkerhettestningadversarial

Relaterade begrepp

Vidare

Förstå begreppen — i sitt sammanhang.

Aligns insikter och events sätter termerna i ett verkligt ledningssammanhang.