സുരക്ഷിതമായ ആർട്ടിഫിഷ്യൽ ജനറൽ ഇന്റലിജൻസ് കൈവരിക്കാനുള്ള മാർഗമായി ഉത്തരവാദിത്തപരവും ക്രമാനുഗതവുമായ വികസനത്തിലും വിന്യാസത്തിലും ഞങ്ങൾ വിശ്വസിക്കുന്നു. ഒരു മോഡൽ പൊതുജനങ്ങൾക്ക് അവതരിപ്പിക്കുന്നതിന് മുമ്പ്, സുരക്ഷയുടെയും അലൈൻമെന്റിന്റെയും ഗണ്യമായ തോതിലുള്ള പരിശോധനയും ലഘൂകരണവും ഞങ്ങൾ നടത്തുന്നു; കൂടാതെ ChatGPT, GPT-കൾ പോലുള്ള വ്യക്തികൾക്കുള്ള ഞങ്ങളുടെ സേവനങ്ങളിൽ പ്രത്യക്ഷപ്പെടുന്ന പ്രശ്നകരമായ ഉള്ളടക്കം കണ്ടെത്താൻ സഹായിക്കുന്ന സ്വയമേവ പ്രവർത്തിക്കുന്നതും മനുഷ്യർ ഉൾപ്പെട്ടതുമായ സിസ്റ്റങ്ങളും ഞങ്ങൾ ഒരുക്കിയിട്ടുണ്ട്. ആ ശ്രമങ്ങളിൽ ചിലതിന്റെ രൂപരേഖ താഴെ നൽകുന്നു.
ChatGPTയും ImageGenയും
ഹാനികരമായിരിക്കാവുന്നോ ഞങ്ങളുടെ ഉപയോഗ നയങ്ങൾ ലംഘിക്കാവുന്നോ ആയ ഉള്ളടക്കം (പ്രോംപ്റ്റുകൾ, പൂർത്തീകരണങ്ങൾ, അപ്ലോഡുകൾ) കണ്ടെത്താൻ, ഞങ്ങളുടെ /moderations API-യുടെ ആഭ്യന്തര പതിപ്പ് പോലുള്ള സ്വയമേവ പ്രവർത്തിക്കുന്ന ഉപകരണങ്ങൾ ഞങ്ങൾ ഉപയോഗിക്കുന്നു. പ്രശ്നകരമായ ഉള്ളടക്കം കണ്ടെത്തിയാൽ, സാധാരണയായി നിങ്ങളുടെ ഉള്ളടക്കം ഞങ്ങളുടെ ഉപയോഗ നയങ്ങൾ ലംഘിച്ചേക്കാമെന്ന് ഞങ്ങൾ നിങ്ങൾക്ക് മുന്നറിയിപ്പ് നൽകുകയോ, നിങ്ങളുടെ പ്രോംപ്റ്റിന് മറുപടി നൽകുന്നതിൽ നിന്ന് മോഡലിനെ തടയുകയോ ചെയ്യും. പ്രശ്നകരമായ പ്രോംപ്റ്റോ പൂർത്തീകരണമോ ഉള്ള ചാറ്റ് പങ്കിടുന്നതും ഞങ്ങൾ തടഞ്ഞേക്കാം. വളരെ കുറച്ച് സാഹചര്യങ്ങളിൽ, അത്യന്തം ഗുരുതരമായ പെരുമാറ്റത്തിന് നിങ്ങളുടെ അക്കൗണ്ട് ഞങ്ങൾ നിരോധിച്ചേക്കാം.
ChatGPT-ൽ പ്രശ്നകരമായ ഉള്ളടക്കത്തെക്കുറിച്ച് വ്യക്തികൾ നൽകുന്ന റിപ്പോർട്ടുകളും ഞങ്ങൾ സ്വീകരിക്കുന്നു. ഈ റിപ്പോർട്ടുകൾ പരിശോധിക്കാൻ സ്വയമേവ പ്രവർത്തിക്കുന്ന സിസ്റ്റങ്ങളുടെയും പരിശീലനം ലഭിച്ച വിദഗ്ധരുടെ ടീമിന്റെയും സംയോജനം ഞങ്ങൾ ഉപയോഗിക്കുന്നു.
ChatGPT: പ്രശ്നകരമായ ഉള്ളടക്കം അടങ്ങിയതായി നിങ്ങൾ വിശ്വസിക്കുന്ന ഒരു ചാറ്റ് ആരെങ്കിലും പങ്കിട്ടാൽ, അത് ഞങ്ങൾക്കു റിപ്പോർട്ട് ചെയ്യാനും നിങ്ങൾക്ക് കഴിയും.
ChatGPT-ൽ നേരിട്ട് ഉള്ളടക്കം റിപ്പോർട്ട് ചെയ്യുന്നതിനെക്കുറിച്ചുള്ള കൂടുതൽ വിവരങ്ങൾക്ക്, ഈ ലേഖനം കാണുക.
GPT-കൾ
ഒരു GPT പ്രശ്നകരമായിരിക്കാമോ എന്ന് പരിശോധിക്കാൻ, ഞങ്ങളുടെ /moderation API പോലുള്ള സ്വയമേവ പ്രവർത്തിക്കുന്ന ഉപകരണങ്ങളും ഞങ്ങൾ ഉപയോഗിക്കുന്നു. GPT-യുമായി ബന്ധപ്പെട്ട പ്രശ്നകരമായ ഉള്ളടക്കം കണ്ടെത്തിയാൽ, അതിന്റെ വിതരണം തടയുന്നതു പോലുള്ള നടപടി ഞങ്ങൾ സ്വീകരിക്കും. പ്രശ്നകരമായ ഉള്ളടക്കം നീക്കം ചെയ്യാൻ നിർമാതാവിന് GPT-യുടെയോ API-യുടെയോ കോൺഫിഗറേഷൻ എഡിറ്റ് ചെയ്യാം, അല്ലെങ്കിൽ ഉൽപ്പന്നത്തിനകത്തെ നടപടിക്രമത്തിലൂടെ തീരുമാനത്തിനെതിരെ അപ്പീൽ നൽകാം. വളരെ കുറച്ച് സാഹചര്യങ്ങളിൽ, അത്യന്തം ഗുരുതരമായ പെരുമാറ്റത്തിന് നിർമാതാവിന്റെ അക്കൗണ്ട് ഞങ്ങൾ നിരോധിച്ചേക്കാം.
പ്രശ്നകരമായ GPT-കളെക്കുറിച്ച് വ്യക്തികൾ നൽകുന്ന റിപ്പോർട്ടുകളും ഞങ്ങൾ സ്വീകരിക്കുന്നു. ഞങ്ങളുടെ ഉപയോഗ നയങ്ങൾ ലംഘിക്കുന്നതായി നിങ്ങൾ വിശ്വസിക്കുന്ന, അല്ലെങ്കിൽ മറ്റേതെങ്കിലും തരത്തിൽ പ്രശ്നകരമായ ഉള്ളടക്കം കാണിക്കുന്ന ഒരു GPT നിങ്ങൾ കാണുകയാണെങ്കിൽ, അത് ഞങ്ങൾക്കു റിപ്പോർട്ട് ചെയ്യാനും നിങ്ങൾക്ക് കഴിയും. ഈ റിപ്പോർട്ടുകൾ പരിശോധിക്കാൻ സ്വയമേവ പ്രവർത്തിക്കുന്ന സിസ്റ്റങ്ങളുടെയും പരിശീലനം ലഭിച്ച വിദഗ്ധരുടെ ടീമിന്റെയും സംയോജനം ഞങ്ങൾ ഉപയോഗിക്കുന്നു.
