ما به توسعه و استقرار مسئولانه و تکرارشونده بهعنوان راهی برای دستیابی به هوش مصنوعی عمومی ایمن باور داریم. پیش از آنکه مدلی را برای عموم عرضه کنیم، میزان قابلتوجهی آزمایش و کاهش ریسک در زمینه ایمنی و همسویی انجام میدهیم، و همچنین سامانههای خودکار و انسانی داریم تا به شناسایی محتوای مشکلداری کمک کنند که در سرویسهای ما برای افراد، مانند ChatGPT و GPTها، ظاهر میشود. در ادامه برخی از این تلاشها را شرح میدهیم.
ChatGPT و ImageGen
ما برای شناسایی محتوایی (اعلانها، پاسخهای تولیدشده و فایلهای بارگذاریشده) که ممکن است زیانبار باشد یا «سیاستهای استفاده» ما را نقض کند، از ابزارهای خودکار، مانند نسخهای داخلی از API تعدیل محتوا، استفاده میکنیم. اگر محتوای مشکلداری شناسایی کنیم، معمولاً به شما هشدار میدهیم که محتوایتان ممکن است «سیاستهای استفاده» ما را نقض کند یا اجازه نمیدهیم مدل به اعلان شما پاسخ دهد. همچنین ممکن است مانع اشتراکگذاری گفتوگویی شویم که حاوی اعلان یا پاسخ تولیدشدهٔ مشکلدار است. در موارد بسیار محدودی، ممکن است حساب شما را نیز بهدلیل رفتار بسیار نامناسب مسدود کنیم.
همچنین گزارشهای کاربران دربارهٔ محتوای مشکلدار در ChatGPT را میپذیریم. برای بررسی این گزارشها، از ترکیبی از سامانههای خودکار و تیمی آموزشدیده از کارشناسان استفاده میکنیم.
ChatGPT: اگر فردی گفتوگویی را به اشتراک گذاشته است که به باور شما محتوای مشکلدار دارد، میتوانید آن را به ما گزارش دهید.
برای جزئیات بیشتر دربارهٔ نحوهٔ گزارش مستقیم محتوا در ChatGPT، این مقاله را ببینید.
GPTها
ما همچنین از ابزارهای خودکاری مانند /moderation API خود استفاده میکنیم تا ببینیم آیا یک GPT بالقوه مشکلدار است یا نه. اگر محتوای مشکلداری مرتبط با GPT شناسایی کنیم، اقداماتی انجام میدهیم؛ مانند جلوگیری از توزیع آن. سازنده میتواند پیکربندی GPT یا API را برای حذف محتوای مشکلدار ویرایش کند، یا از طریق فرایندی درونمحصولی به تصمیم اعتراض کند. در مجموعهای بسیار محدود از شرایط، ممکن است حساب سازنده را نیز بهدلیل رفتار بسیار نامناسب مسدود کنیم.
ما گزارشهای انسانی درباره GPTهای مشکلدار را نیز میپذیریم. اگر GPTای میبینید که فکر میکنید سیاستهای استفاده ما را نقض میکند یا بهگونهای دیگر بازتابدهنده محتوای مشکلدار است، شما نیز میتوانید آن را به ما گزارش کنید. برای بررسی این گزارشها از ترکیبی از سامانههای خودکار و تیمی آموزشدیده از کارشناسان استفاده میکنیم.
