Vi tror på ansvarlig, iterativ udvikling og implementering som et middel til at opnå sikker kunstig generel intelligens. Vi udfører en betydelig mængde test og afbødning af sikkerhed og tilpasning, før vi nogensinde lancerer en model til offentligheden, og vi har også automatiserede og menneskelige systemer på plads til at hjælpe med at registrere problematisk indhold, der vises på vores tjenester for enkeltpersoner, såsom ChatGPT og GPT'er. Vi beskriver nogle af disse indsatser nedenfor.
ChatGPT og ImageGen
Vi bruger automatiserede værktøjer, f.eks. en intern version af vores API til moderering, til at registrere indhold (prompter, svar og uploads), der kan være skadeligt eller overtræde vores retningslinjer for brug. Hvis vi registrerer problematisk indhold, vil vi typisk enten advare dig om, at dit indhold muligvis overtræder vores retningslinjer for brug, eller forhindre modellen i at besvare din prompt. Vi kan også forhindre, at chatten med den problematiske prompt eller det problematiske svar bliver delt. I ganske få tilfælde kan vi også udelukke din konto på grund af groft uacceptabel adfærd.
Vi modtager også anmeldelser fra personer om problematisk indhold i ChatGPT. Vi bruger en kombination af automatiserede systemer og et uddannet team af eksperter til at gennemgå disse anmeldelser.
ChatGPT: Hvis nogen deler en chat, som du mener indeholder problematisk indhold, kan du også anmelde den til os.
Du kan få flere oplysninger om, hvordan du anmelder indhold direkte i ChatGPT, i denne artikel.
GPT'er
Vi bruger også automatiserede værktøjer såsom vores /moderation API til at se, om en GPT potentielt er problematisk. Hvis vi registrerer problematisk indhold knyttet til GPT'en, vil vi handle, for eksempel ved at forhindre, at den distribueres. Udvikleren kan redigere konfigurationen af GPT'en eller API'en for at fjerne det problematiske indhold eller kan appellere afgørelsen via et flow i produktet. I meget begrænsede tilfælde kan vi også udelukke udviklerens konto på grund af særligt grov adfærd.
Vi accepterer også indberetninger fra mennesker om problematiske GPT'er. Hvis du ser en GPT, som du mener overtræder vores brugspolitikker eller på anden måde afspejler problematisk indhold, kan du også indberette den til os. Vi bruger en kombination af automatiserede systemer og et uddannet team af eksperter til at gennemgå disse indberetninger.
