ما به توسعه و استقرار مسئولانه و تکرارشونده بهعنوان راهی برای دستیابی به هوش مصنوعی عمومی ایمن باور داریم. پیش از آنکه مدلی را برای عموم عرضه کنیم، میزان قابلتوجهی آزمایش و کاهش ریسک در زمینه ایمنی و همسویی انجام میدهیم، و همچنین سامانههای خودکار و انسانی داریم تا به شناسایی محتوای مشکلداری کمک کنند که در سرویسهای ما برای افراد، مانند ChatGPT و GPTها، ظاهر میشود. در ادامه برخی از این تلاشها را شرح میدهیم.
ChatGPT و ImageGen
ما از ابزارهای خودکار، مانند نسخهای داخلی از /moderations API خود، برای شناسایی محتوایی (اعلانها، تکمیلها، بارگذاریها) استفاده میکنیم که ممکن است زیانبار باشد یا سیاستهای استفاده ما را نقض کند. اگر محتوای مشکلدار شناسایی کنیم، معمولاً یا به شما هشدار میدهیم که محتوایتان ممکن است سیاستهای استفاده ما را نقض کند، یا جلوی پاسخدادن مدل به اعلان شما را میگیریم. همچنین ممکن است از اشتراکگذاری گفتوگویی که شامل اعلان یا تکمیل مشکلدار است جلوگیری کنیم. در مجموعهای بسیار محدود از شرایط، ممکن است حساب شما را نیز بهدلیل رفتار بسیار نامناسب مسدود کنیم.
ما گزارشهای انسانی درباره محتوای مشکلدار در ChatGPT را نیز میپذیریم. برای بررسی این گزارشها از ترکیبی از سامانههای خودکار و تیمی آموزشدیده از کارشناسان استفاده میکنیم.
ChatGPT: اگر کسی گفتوگویی را به اشتراک بگذارد که فکر میکنید حاوی محتوای مشکلدار است، شما نیز میتوانید آن را به ما گزارش کنید.
برای جزئیات بیشتر درباره نحوه گزارش مستقیم محتوا در ChatGPT، این مقاله را ببینید.
GPTها
ما همچنین از ابزارهای خودکاری مانند /moderation API خود استفاده میکنیم تا ببینیم آیا یک GPT بالقوه مشکلدار است یا نه. اگر محتوای مشکلداری مرتبط با GPT شناسایی کنیم، اقداماتی انجام میدهیم؛ مانند جلوگیری از توزیع آن. سازنده میتواند پیکربندی GPT یا API را برای حذف محتوای مشکلدار ویرایش کند، یا از طریق فرایندی درونمحصولی به تصمیم اعتراض کند. در مجموعهای بسیار محدود از شرایط، ممکن است حساب سازنده را نیز بهدلیل رفتار بسیار نامناسب مسدود کنیم.
ما گزارشهای انسانی درباره GPTهای مشکلدار را نیز میپذیریم. اگر GPTای میبینید که فکر میکنید سیاستهای استفاده ما را نقض میکند یا بهگونهای دیگر بازتابدهنده محتوای مشکلدار است، شما نیز میتوانید آن را به ما گزارش کنید. برای بررسی این گزارشها از ترکیبی از سامانههای خودکار و تیمی آموزشدیده از کارشناسان استفاده میکنیم.
