OpenAI
این صفحه به‌صورت ماشینی ترجمه شده است. مقاله اصلی انگلیسی را مشاهده کنید.

چگونه محتوای مسئله‌دار را در سرویس‌های خود برای افراد شناسایی می‌کنیم

به‌روزرسانی: 19 hours ago

ما به توسعه و استقرار مسئولانه و تکرارشونده به‌عنوان راهی برای دستیابی به هوش مصنوعی عمومی ایمن باور داریم. پیش از آنکه مدلی را برای عموم عرضه کنیم، میزان قابل‌توجهی آزمایش و کاهش ریسک در زمینه ایمنی و همسویی انجام می‌دهیم، و همچنین سامانه‌های خودکار و انسانی داریم تا به شناسایی محتوای مشکل‌داری کمک کنند که در سرویس‌های ما برای افراد، مانند ChatGPT و GPTها، ظاهر می‌شود. در ادامه برخی از این تلاش‌ها را شرح می‌دهیم.

ChatGPT و ImageGen

ما برای شناسایی محتوایی (اعلان‌ها، پاسخ‌های تولیدشده و فایل‌های بارگذاری‌شده) که ممکن است زیان‌بار باشد یا «سیاست‌های استفاده» ما را نقض کند، از ابزارهای خودکار، مانند نسخه‌ای داخلی از API تعدیل محتوا، استفاده می‌کنیم. اگر محتوای مشکل‌داری شناسایی کنیم، معمولاً به شما هشدار می‌دهیم که محتوایتان ممکن است «سیاست‌های استفاده» ما را نقض کند یا اجازه نمی‌دهیم مدل به اعلان شما پاسخ دهد. همچنین ممکن است مانع اشتراک‌گذاری گفت‌وگویی شویم که حاوی اعلان یا پاسخ تولیدشدهٔ مشکل‌دار است. در موارد بسیار محدودی، ممکن است حساب شما را نیز به‌دلیل رفتار بسیار نامناسب مسدود کنیم.

همچنین گزارش‌های کاربران دربارهٔ محتوای مشکل‌دار در ChatGPT را می‌پذیریم. برای بررسی این گزارش‌ها، از ترکیبی از سامانه‌های خودکار و تیمی آموزش‌دیده از کارشناسان استفاده می‌کنیم.

  • ChatGPT: اگر فردی گفت‌وگویی را به اشتراک گذاشته است که به باور شما محتوای مشکل‌دار دارد، می‌توانید آن را به ما گزارش دهید.

برای جزئیات بیشتر دربارهٔ نحوهٔ گزارش مستقیم محتوا در ChatGPT، این مقاله را ببینید.

GPTها

ما همچنین از ابزارهای خودکاری مانند /moderation API خود استفاده می‌کنیم تا ببینیم آیا یک GPT بالقوه مشکل‌دار است یا نه. اگر محتوای مشکل‌داری مرتبط با GPT شناسایی کنیم، اقداماتی انجام می‌دهیم؛ مانند جلوگیری از توزیع آن. سازنده می‌تواند پیکربندی GPT یا API را برای حذف محتوای مشکل‌دار ویرایش کند، یا از طریق فرایندی درون‌محصولی به تصمیم اعتراض کند. در مجموعه‌ای بسیار محدود از شرایط، ممکن است حساب سازنده را نیز به‌دلیل رفتار بسیار نامناسب مسدود کنیم.

ما گزارش‌های انسانی درباره GPTهای مشکل‌دار را نیز می‌پذیریم. اگر GPTای می‌بینید که فکر می‌کنید سیاست‌های استفاده ما را نقض می‌کند یا به‌گونه‌ای دیگر بازتاب‌دهنده محتوای مشکل‌دار است، شما نیز می‌توانید آن را به ما گزارش کنید. برای بررسی این گزارش‌ها از ترکیبی از سامانه‌های خودکار و تیمی آموزش‌دیده از کارشناسان استفاده می‌کنیم.

آیا این مقاله مفید بود؟