OpenAI
Оваа страница беше машински преведена. Погледнете ја оригиналната статија на англиски јазик.

Како идентификуваме проблематична содржина на нашите услуги за поединци

Дознајте како OpenAI користи автоматизирани системи и човечка проверка за да открие штетна содржина или содржина што ги прекршува правилата во одделни услуги.

Ажурирано: 2 days ago

Веруваме во одговорен, итеративен развој и воведување како средство за постигнување безбедна општа вештачка интелигенција. Вршеме значителен обем на тестирање и ублажување во однос на безбедноста и усогласувањето пред воопшто да пуштиме модел во јавност, а исто така имаме воспоставено автоматизирани и човечки системи за да помогнат во откривањето проблематична содржина што се појавува на нашите услуги за поединци, како што се ChatGPT и GPT-и. Подолу наведуваме дел од тие напори.

ChatGPT и ImageGen

Користиме автоматизирани алатки, како што е интерна верзија на нашиот /moderations API, за да откриеме содржини (промпти, генерирани одговори и прикачувања) што може да бидат штетни или да ги прекршуваат нашите Политики за користење. Ако откриеме проблематична содржина, обично ќе ве предупредиме дека таа можеби ги прекршува нашите политики за користење или ќе го спречиме моделот да одговори на вашиот промпт. Може и да спречиме споделување на разговорот што го содржи проблематичниот промпт или генериран одговор. Во многу мал број случаи, може и да ја забраниме вашата сметка поради особено сериозно прекршување.

Прифаќаме и пријави од луѓе за проблематични содржини на ChatGPT. За да ги разгледаме овие пријави, користиме комбинација од автоматизирани системи и обучен тим од стручни лица.

  • ChatGPT: Ако некој сподели разговор за кој сметате дека содржи проблематична содржина, можете да ни го пријавите.

За повеќе информации како директно да пријавите содржина во ChatGPT, погледнете ја оваа статија.

GPT-и

Користиме и автоматизирани алатки, како што е нашиот /moderation API, за да видиме дали даден GPT е потенцијално проблематичен. Ако откриеме проблематична содржина поврзана со GPT-от, ќе преземеме мерки, како што е спречување на неговата дистрибуција. Креаторот може да ја уреди конфигурацијата на GPT-от или API-то за да ја отстрани проблематичната содржина или може да поднесе жалба на одлуката преку постапка во самиот производ. Во многу ограничен број околности, може и да ја забраниме сметката на креаторот поради исклучително сериозно однесување.

Прифаќаме и пријави од луѓе за проблематични GPT-и. Ако видите GPT за кој сметате дека ги прекршува нашите политики за користење или на друг начин одразува проблематична содржина, можете и да ни го пријавите. Користиме комбинација од автоматизирани системи и обучен тим експерти за да ги прегледаме овие пријави.

Дали оваа статија ви беше корисна?