Uskomme vastuulliseen, iteratiiviseen kehitykseen ja käyttöönottoon keinona saavuttaa turvallinen yleinen tekoäly. Teemme huomattavan määrän turvallisuus- ja kohdistusalan testausta ja riskien lieventämistä ennen kuin julkaisemme mallin yleisölle, ja käytössämme on myös automaattisia ja ihmisten ylläpitämiä järjestelmiä, jotka auttavat havaitsemaan ongelmallista sisältöä yksityishenkilöille suunnatuissa palveluissamme, kuten ChatGPT:ssä ja GPT:issä. Kuvaamme joitakin näistä toimista alla.
ChatGPT ja ImageGen
Käytämme automaattisia työkaluja, kuten sisäistä versiota /moderations API -rajapinnastamme, tunnistaaksemme sisällön (kehotteet, vastaukset, lataukset), joka voi olla haitallista tai rikkoa käyttökäytäntöjämme. Jos havaitsemme ongelmallista sisältöä, yleensä joko varoitamme sinua siitä, että sisältösi saattaa rikkoa käyttökäytäntöjämme, tai estämme mallia vastaamasta kehotteeseesi. Saatamme myös estää ongelmallisen kehotteen tai vastauksen sisältävän keskustelun jakamisen. Erittäin rajatuissa tilanteissa saatamme myös estää tilisi käytön törkeän toiminnan vuoksi.
Hyväksymme myös ihmisten tekemiä ilmoituksia ongelmallisesta sisällöstä ChatGPT:ssä. Käytämme näiden ilmoitusten tarkistamiseen automaattisten järjestelmien ja koulutetun asiantuntijatiimin yhdistelmää.
ChatGPT: Jos joku jakaa keskustelun, jonka uskot sisältävän ongelmallista sisältöä, voit myös ilmoittaa siitä meille.
Lisätietoja sisällön ilmoittamisesta suoraan ChatGPT:ssä on tässä artikkelissa.
GPT:t
Käytämme myös automaattisia työkaluja, kuten /moderation API -rajapintaamme, selvittääksemme, onko GPT mahdollisesti ongelmallinen. Jos havaitsemme GPT:hen liittyvää ongelmallista sisältöä, ryhdymme toimiin, kuten estämme sen jakelun. Luoja voi muokata GPT:n tai API:n määrityksiä poistaakseen ongelmallisen sisällön tai valittaa päätöksestä tuotteessa olevan prosessin kautta. Erittäin rajatuissa tilanteissa saatamme myös estää luojan tilin käytön törkeän toiminnan vuoksi.
Hyväksymme myös ihmisten tekemiä ilmoituksia ongelmallisista GPT:istä. Jos näet GPT:n, jonka uskot rikkovan käyttökäytäntöjämme tai muuten sisältävän ongelmallista sisältöä, voit myös ilmoittaa siitä meille. Käytämme näiden ilmoitusten tarkistamiseen automaattisten järjestelmien ja koulutetun asiantuntijatiimin yhdistelmää.
