Hvordan kan virksomheder sikre, at deres chatbots opfører sig etisk og undgår stødende indhold, mens de stadig forbliver kreative?

For at styre en chatbot uden at dræbe dens kreativitet, skal man tænke i lag. Man kan ikke bare give den strenge regler, da det ofte gør svarene kedelige og robotagtige. En god løsning er at bruge det, man kalder for guardrails eller sikkerhedshegn.

Først bør man opstille klare etiske retningslinjer, som chatbotten skal kende til. Dette gøres ofte ved at give modellen specifikke instruktioner om, hvilke emner den aldrig må berøre, som f.eks. racisme eller hadefulde ytringer. Man kan også bruge en separat kontrol-model, der holder øje med både input fra brugeren og chatbotten svar. Hvis den opdager noget upassende, stopper den svaret med det samme.

Det er også vigtigt at teste modellen løbende gennem det, man kalder red teaming. Det betyder, at man aktivt forsøger at provokere chatbotten til at sige noget forkert, så man kan lukke hullerne, før kunderne finder dem. Ved at kombinere klare regler med tekniske filtre kan man skabe en chatbot, der er både sjov, kreativ og helt sikker at tale med for alle brugere.