സുരക്ഷിതമായ ആർട്ടിഫിഷ്യൽ ജനറൽ ഇന്റലിജൻസ് കൈവരിക്കാനുള്ള മാർഗമായി ഉത്തരവാദിത്തപരവും ക്രമാനുഗതവുമായ വികസനത്തിലും വിന്യാസത്തിലും ഞങ്ങൾ വിശ്വസിക്കുന്നു. ഒരു മോഡൽ പൊതുജനങ്ങൾക്ക് അവതരിപ്പിക്കുന്നതിന് മുമ്പ്, സുരക്ഷയുടെയും അലൈൻമെന്റിന്റെയും ഗണ്യമായ തോതിലുള്ള പരിശോധനയും ലഘൂകരണവും ഞങ്ങൾ നടത്തുന്നു; കൂടാതെ ChatGPT, GPT-കൾ പോലുള്ള വ്യക്തികൾക്കുള്ള ഞങ്ങളുടെ സേവനങ്ങളിൽ പ്രത്യക്ഷപ്പെടുന്ന പ്രശ്നകരമായ ഉള്ളടക്കം കണ്ടെത്താൻ സഹായിക്കുന്ന സ്വയമേവ പ്രവർത്തിക്കുന്നതും മനുഷ്യർ ഉൾപ്പെട്ടതുമായ സിസ്റ്റങ്ങളും ഞങ്ങൾ ഒരുക്കിയിട്ടുണ്ട്. ആ ശ്രമങ്ങളിൽ ചിലതിന്റെ രൂപരേഖ താഴെ നൽകുന്നു.
ChatGPT-യും ImageGen-ഉം
ഹാനികരമായേക്കാവുന്നതോ ഞങ്ങളുടെ ഉപയോഗ നയങ്ങൾ ലംഘിക്കുന്നതോ ആയ ഉള്ളടക്കം (പ്രോംപ്റ്റുകൾ, മറുപടികൾ, അപ്ലോഡുകൾ) കണ്ടെത്താൻ, ഞങ്ങളുടെ /moderations API-യുടെ ആഭ്യന്തര പതിപ്പ് പോലുള്ള സ്വയമേവ പ്രവർത്തിക്കുന്ന ഉപകരണങ്ങൾ ഞങ്ങൾ ഉപയോഗിക്കുന്നു. പ്രശ്നകരമായ ഉള്ളടക്കം കണ്ടെത്തിയാൽ, നിങ്ങളുടെ ഉള്ളടക്കം ഞങ്ങളുടെ ഉപയോഗ നയങ്ങൾ ലംഘിച്ചേക്കാമെന്ന് സാധാരണയായി മുന്നറിയിപ്പ് നൽകുകയോ നിങ്ങളുടെ പ്രോംപ്റ്റിന് മറുപടി നൽകുന്നതിൽ നിന്ന് മോഡലിനെ തടയുകയോ ചെയ്യും. പ്രശ്നകരമായ പ്രോംപ്റ്റോ മറുപടിയോ അടങ്ങിയ ചാറ്റ് പങ്കിടുന്നതും ഞങ്ങൾ തടഞ്ഞേക്കാം. വളരെ അപൂർവമായ സാഹചര്യങ്ങളിൽ, അത്യന്തം ഗുരുതരമായ പെരുമാറ്റത്തിന് നിങ്ങളുടെ അക്കൗണ്ട് നിരോധിച്ചേക്കാം.
ChatGPT-യിലെ പ്രശ്നകരമായ ഉള്ളടക്കത്തെക്കുറിച്ച് ആളുകൾ നൽകുന്ന റിപ്പോർട്ടുകളും ഞങ്ങൾ സ്വീകരിക്കുന്നു. ഈ റിപ്പോർട്ടുകൾ പരിശോധിക്കാൻ സ്വയമേവ പ്രവർത്തിക്കുന്ന സംവിധാനങ്ങളും പരിശീലനം ലഭിച്ച വിദഗ്ധരുടെ സംഘവും ചേർന്ന സംവിധാനം ഞങ്ങൾ ഉപയോഗിക്കുന്നു.
ChatGPT: പ്രശ്നകരമായ ഉള്ളടക്കമുണ്ടെന്ന് നിങ്ങൾ കരുതുന്ന ഒരു ചാറ്റ് ആരെങ്കിലും പങ്കിട്ടാൽ, നിങ്ങൾക്ക് അത് ഞങ്ങൾക്ക് റിപ്പോർട്ട് ചെയ്യാം.
ChatGPT-യിൽ നേരിട്ട് ഉള്ളടക്കം റിപ്പോർട്ട് ചെയ്യുന്നതിനെക്കുറിച്ചുള്ള കൂടുതൽ വിവരങ്ങൾക്ക് ഈ ലേഖനം കാണുക.
GPT-കൾ
ഒരു GPT പ്രശ്നകരമായിരിക്കാമോ എന്ന് പരിശോധിക്കാൻ, ഞങ്ങളുടെ /moderation API പോലുള്ള സ്വയമേവ പ്രവർത്തിക്കുന്ന ഉപകരണങ്ങളും ഞങ്ങൾ ഉപയോഗിക്കുന്നു. GPT-യുമായി ബന്ധപ്പെട്ട പ്രശ്നകരമായ ഉള്ളടക്കം കണ്ടെത്തിയാൽ, അതിന്റെ വിതരണം തടയുന്നതു പോലുള്ള നടപടി ഞങ്ങൾ സ്വീകരിക്കും. പ്രശ്നകരമായ ഉള്ളടക്കം നീക്കം ചെയ്യാൻ നിർമാതാവിന് GPT-യുടെയോ API-യുടെയോ കോൺഫിഗറേഷൻ എഡിറ്റ് ചെയ്യാം, അല്ലെങ്കിൽ ഉൽപ്പന്നത്തിനകത്തെ നടപടിക്രമത്തിലൂടെ തീരുമാനത്തിനെതിരെ അപ്പീൽ നൽകാം. വളരെ കുറച്ച് സാഹചര്യങ്ങളിൽ, അത്യന്തം ഗുരുതരമായ പെരുമാറ്റത്തിന് നിർമാതാവിന്റെ അക്കൗണ്ട് ഞങ്ങൾ നിരോധിച്ചേക്കാം.
പ്രശ്നകരമായ GPT-കളെക്കുറിച്ച് വ്യക്തികൾ നൽകുന്ന റിപ്പോർട്ടുകളും ഞങ്ങൾ സ്വീകരിക്കുന്നു. ഞങ്ങളുടെ ഉപയോഗ നയങ്ങൾ ലംഘിക്കുന്നതായി നിങ്ങൾ വിശ്വസിക്കുന്ന, അല്ലെങ്കിൽ മറ്റേതെങ്കിലും തരത്തിൽ പ്രശ്നകരമായ ഉള്ളടക്കം കാണിക്കുന്ന ഒരു GPT നിങ്ങൾ കാണുകയാണെങ്കിൽ, അത് ഞങ്ങൾക്കു റിപ്പോർട്ട് ചെയ്യാനും നിങ്ങൾക്ക് കഴിയും. ഈ റിപ്പോർട്ടുകൾ പരിശോധിക്കാൻ സ്വയമേവ പ്രവർത്തിക്കുന്ന സിസ്റ്റങ്ങളുടെയും പരിശീലനം ലഭിച്ച വിദഗ്ധരുടെ ടീമിന്റെയും സംയോജനം ഞങ്ങൾ ഉപയോഗിക്കുന്നു.
