ደህንነቱ የተጠበቀ አጠቃላይ የሰው ሠራሽ አስተውሎት ለማሳካት፣ ኃላፊነት ያለው፣ ደረጃ በደረጃ የሚሻሻል ልማትና ማሰማራት እናምናለን። ማንኛውንም ሞዴል ለሕዝብ ከማስጀመራችን በፊት ብዙ የደህንነት እና የማስተካከል ሙከራ እና መቀነሻ እርምጃ እናደርጋለን፤ እንዲሁም እንደ ChatGPT እና GPTs ባሉ ለግለሰቦች በሚቀርቡ አገልግሎቶቻችን ላይ የሚታይ ችግር ያለበት ይዘት ለመለየት የሚረዱ ራስ-ሰር እና የሰው ሥርዓቶች አሉን። ከእነዚያ ጥረቶች አንዳንዶቹን ከታች እንገልጻለን።
ChatGPT እና ImageGen
ጎጂ ሊሆን ወይም የአጠቃቀም ፖሊሲዎቻችንን ሊጥስ የሚችል ይዘትን (እርምጃዎች፣ ምላሾች፣ የተሰቀሉ ፋይሎች) ለመለየት እንደ የውስጥ /moderations API ስሪታችን ያሉ ራስ-ሰር መሣሪያዎችን እንጠቀማለን። ችግር ያለበት ይዘት ካገኘን፣ በተለምዶ ይዘትዎ የአጠቃቀም ፖሊሲዎቻችንን ሊጥስ እንደሚችል እናስጠነቅቅዎታለን ወይም ሞዴሉ ለእርምጃዎ ምላሽ እንዳይሰጥ እናግዳለን። ችግር ያለበትን እርምጃ ወይም ምላሽ የያዘው ውይይት እንዳይጋራም ልንከለክል እንችላለን። እጅግ ውስን በሆኑ ሁኔታዎች፣ ከባድ ጥፋት በመፈጸምዎ መለያዎን ልናግድ እንችላለን።
በChatGPT ላይ ስላለ ችግር ያለበት ይዘት በሰዎች የሚቀርቡ ሪፖርቶችንም እንቀበላለን። እነዚህን ሪፖርቶች ለመገምገም ራስ-ሰር ሥርዓቶችንና የሠለጠኑ ባለሙያዎችን ያካተተ ቡድን በጋራ እንጠቀማለን።
ChatGPT፦ አንድ ሰው ችግር ያለበት ይዘት እንደያዘ የሚያምኑበትን ውይይት ካጋራ፣ ለእኛ ሪፖርት ማድረግ ይችላሉ።
ይዘትን በቀጥታ በChatGPT ውስጥ እንዴት ሪፖርት ማድረግ እንደሚችሉ ለተጨማሪ ዝርዝር፣ ይህን ጽሑፍ ይመልከቱ።
GPTs
አንድ GPT ሊችገር የሚችል መሆኑን ለማየት፣ እንደ የእኛ /moderation API ያሉ ራስ-ሰር መሣሪያዎችንም እንጠቀማለን። ከGPT ጋር የተያያዘ ችግር ያለበት ይዘት ካገኘን፣ እንዳይሰራጭ መከልከል ያሉ እርምጃዎችን እንወስዳለን። ገንቢው ችግር ያለበትን ይዘት ለማስወገድ የGPT ወይም API ውቅርን ማርትዕ ይችላል፣ ወይም በምርቱ ውስጥ ባለ ሂደት ውሳኔውን ይግባኝ ማለት ይችላል። በጣም ውስን በሆኑ ሁኔታዎች፣ ለከባድ ጥፋት የገንቢውን መለያ ልናግድ እንችላለን።
ችግር ያለባቸው GPTs ላይ የሰዎች ሪፖርቶችንም እንቀበላለን። የአጠቃቀም ፖሊሲዎቻችንን እየጣሰ እንደሆነ ወይም በሌላ መንገድ ችግር ያለበት ይዘት እንደሚያንጸባርቅ የሚያምኑትን GPT ካዩ፣ እርስዎም ለእኛ ሪፖርት ማድረግ ይችላሉ። እነዚህን ሪፖርቶች ለመገምገም የራስ-ሰር ሥርዓቶችን እና የሰለጠነ የባለሙያዎች ቡድንን በጥምረት እንጠቀማለን።
