Wierzymy w odpowiedzialne, iteracyjne tworzenie i wdrażanie jako sposób na osiągnięcie bezpiecznej ogólnej sztucznej inteligencji. Zanim udostępnimy model publicznie, przeprowadzamy wiele testów oraz działań ograniczających ryzyko dotyczących bezpieczeństwa i zgodności, a także korzystamy z systemów automatycznych i pracy ludzi, aby pomagać w wykrywaniu problematycznych treści pojawiających się w naszych usługach dla osób indywidualnych, takich jak ChatGPT i GPT. Poniżej przedstawiamy część tych działań.
ChatGPT i ImageGen
Korzystamy z automatycznych narzędzi, takich jak wewnętrzna wersja naszego interfejsu API /moderations, aby wykrywać treści (polecenia, odpowiedzi i przesłane pliki), które mogą być szkodliwe lub naruszać nasze Zasady użytkowania. Jeśli wykryjemy problematyczne treści, zazwyczaj ostrzeżemy Cię, że mogą one naruszać nasze Zasady użytkowania, albo zablokujemy możliwość wygenerowania przez model odpowiedzi na Twoje polecenie. Możemy również uniemożliwić udostępnienie czatu zawierającego problematyczne polecenie lub odpowiedź. W bardzo nielicznych przypadkach możemy też zablokować Twoje konto z powodu rażącego zachowania.
Przyjmujemy również od użytkowników zgłoszenia dotyczące problematycznych treści w ChatGPT. Do analizowania tych zgłoszeń wykorzystujemy zarówno zautomatyzowane systemy, jak i przeszkolony zespół ekspertów.
ChatGPT: jeśli ktoś udostępni czat, który Twoim zdaniem zawiera problematyczne treści, możesz również zgłosić go nam.
Więcej informacji o zgłaszaniu treści bezpośrednio w ChatGPT znajdziesz w tym artykule.
GPT
Korzystamy też z narzędzi automatycznych, takich jak nasz interfejs API /moderation, aby sprawdzać, czy GPT jest potencjalnie problematyczny. Jeśli wykryjemy problematyczne treści powiązane z GPT, podejmiemy działania, na przykład uniemożliwiając jego dystrybucję. Twórca może edytować konfigurację GPT lub API, aby usunąć problematyczne treści, albo odwołać się od decyzji w ramach procesu dostępnego w produkcie. W bardzo ograniczonych okolicznościach możemy również zablokować konto twórcy za rażące zachowanie.
Przyjmujemy też zgłoszenia od użytkowników dotyczące problematycznych GPT. Jeśli zobaczysz GPT, który Twoim zdaniem narusza nasze zasady użytkowania lub w inny sposób zawiera problematyczne treści, możesz również zgłosić go nam. Do analizowania tych zgłoszeń używamy połączenia zautomatyzowanych systemów i wyszkolonego zespołu ekspertów.
