OpenAI
此頁面由機器翻譯。查看原文英文文章

我們如何識別面向個人服務中的問題內容

了解 OpenAI 如何透過自動化系統和人工審查,識別個別服務中有害或違反政策的內容。

更新日期:2 days ago

我們相信,負責任、反覆迭代的開發與部署,是實現安全通用人工智能的途徑。在向公眾推出任何模型之前,我們都會進行大量安全與一致性測試緩解工作;同時,我們亦設有自動化和人工系統,協助偵測在我們為個人提供的服務(例如 ChatGPT 和 GPTs)上出現的有問題內容。我們在下文概述其中一些工作。

ChatGPT 與 ImageGen

我們使用自動化工具(例如內部版本的 /moderations API),偵測可能有害或違反《使用政策》的內容(提示詞、生成內容及上載內容)。如果我們偵測到有問題的內容,通常會警告你該內容可能違反《使用政策》,或阻止模型回應你的提示詞。我們亦可能禁止分享包含有問題提示詞或生成內容的對話。在極少數情況下,如行為極其惡劣,我們亦可能封禁你的帳戶。

我們亦接受由使用者舉報 ChatGPT 上有問題的內容。我們結合自動化系統與經過培訓的專家團隊,審查這些舉報。

  • ChatGPT:如果有人分享的對話含有你認為有問題的內容,你亦可向我們舉報

如欲進一步了解如何直接在 ChatGPT 舉報內容,請參閱這篇文章

GPTs

我們亦使用自動化工具,例如我們的 /moderation API,以判斷某個 GPT 是否可能有問題。如果我們偵測到與該 GPT 相關的有問題內容,我們會採取行動,例如防止其被分發。建立者可以編輯 GPT 或 API 的配置,以移除有問題的內容,亦可透過產品內流程就決定提出申訴。在極少數情況下,我們亦可能因嚴重不當行為而禁止建立者的帳戶。

我們亦接受人們舉報有問題的 GPT。如果你看到某個 GPT 你認為違反我們的使用政策,或以其他方式反映有問題的內容,你亦可以向我們舉報。我們會結合自動化系統和受訓專家團隊來審查這些舉報。

這篇文章對你有幫助嗎?