ደህንነቱ የተጠበቀ አጠቃላይ የሰው ሠራሽ አስተውሎት ለማሳካት፣ ኃላፊነት ያለው፣ ደረጃ በደረጃ የሚሻሻል ልማትና ማሰማራት እናምናለን። ማንኛውንም ሞዴል ለሕዝብ ከማስጀመራችን በፊት ብዙ የደህንነት እና የማስተካከል ሙከራ እና መቀነሻ እርምጃ እናደርጋለን፤ እንዲሁም እንደ ChatGPT እና GPTs ባሉ ለግለሰቦች በሚቀርቡ አገልግሎቶቻችን ላይ የሚታይ ችግር ያለበት ይዘት ለመለየት የሚረዱ ራስ-ሰር እና የሰው ሥርዓቶች አሉን። ከእነዚያ ጥረቶች አንዳንዶቹን ከታች እንገልጻለን።
ChatGPT እና ImageGen
ጎጂ ሊሆን ወይም የአጠቃቀም ፖሊሲዎቻችንን ሊጥስ የሚችል ይዘት (እርምጃዎች፣ የተጠናቀቁ ምላሾች፣ የተሰቀሉ ፋይሎች) ለመለየት፣ እንደ የውስጥ ስሪት የእኛ /moderations API ያሉ ራስ-ሰር መሣሪያዎችን እንጠቀማለን። ችግር ያለበት ይዘት ካገኘን፣ በተለምዶ ይዘትዎ የአጠቃቀም ፖሊሲዎቻችንን ሊጥስ እንደሚችል እናስጠነቅቃለን ወይም ሞዴሉ ለእርምጃዎ ምላሽ እንዳይሰጥ እንከለክላለን። ችግር ያለበት እርምጃ ወይም የተጠናቀቀ ምላሽ ያለው ውይይት እንዳይጋራ ልንከለክልም እንችላለን። በጣም ውስን በሆኑ ሁኔታዎች፣ ለከባድ ጥፋት መለያዎን ልናግድ እንችላለን።
በChatGPT ላይ ስለሚገኝ ችግር ያለበት ይዘት የሰዎች ሪፖርቶችንም እንቀበላለን። እነዚህን ሪፖርቶች ለመገምገም የራስ-ሰር ሥርዓቶችን እና የሰለጠነ የባለሙያዎች ቡድንን በጥምረት እንጠቀማለን።
ChatGPT፦ አንድ ሰው ችግር ያለበት ይዘት እንዳለው የሚያምኑትን ውይይት ካጋራ፣ እርስዎም ለእኛ ሪፖርት ማድረግ ይችላሉ።
በChatGPT ውስጥ ይዘትን በቀጥታ እንዴት ሪፖርት እንደሚያደርጉ ለተጨማሪ ዝርዝሮች፣ ይህን ጽሑፍ ይመልከቱ።
GPTs
አንድ GPT ሊችገር የሚችል መሆኑን ለማየት፣ እንደ የእኛ /moderation API ያሉ ራስ-ሰር መሣሪያዎችንም እንጠቀማለን። ከGPT ጋር የተያያዘ ችግር ያለበት ይዘት ካገኘን፣ እንዳይሰራጭ መከልከል ያሉ እርምጃዎችን እንወስዳለን። ገንቢው ችግር ያለበትን ይዘት ለማስወገድ የGPT ወይም API ውቅርን ማርትዕ ይችላል፣ ወይም በምርቱ ውስጥ ባለ ሂደት ውሳኔውን ይግባኝ ማለት ይችላል። በጣም ውስን በሆኑ ሁኔታዎች፣ ለከባድ ጥፋት የገንቢውን መለያ ልናግድ እንችላለን።
ችግር ያለባቸው GPTs ላይ የሰዎች ሪፖርቶችንም እንቀበላለን። የአጠቃቀም ፖሊሲዎቻችንን እየጣሰ እንደሆነ ወይም በሌላ መንገድ ችግር ያለበት ይዘት እንደሚያንጸባርቅ የሚያምኑትን GPT ካዩ፣ እርስዎም ለእኛ ሪፖርት ማድረግ ይችላሉ። እነዚህን ሪፖርቶች ለመገምገም የራስ-ሰር ሥርዓቶችን እና የሰለጠነ የባለሙያዎች ቡድንን በጥምረት እንጠቀማለን።
