OpenAI
این صفحه به‌صورت ماشینی ترجمه شده است. مقاله اصلی انگلیسی را مشاهده کنید.

چگونه محتوای مسئله‌دار را در سرویس‌های خود برای افراد شناسایی می‌کنیم

به‌روزرسانی: 12 days ago

ما به توسعه و استقرار مسئولانه و تکرارشونده به‌عنوان راهی برای دستیابی به هوش مصنوعی عمومی ایمن باور داریم. پیش از آنکه مدلی را برای عموم عرضه کنیم، میزان قابل‌توجهی آزمایش و کاهش ریسک در زمینه ایمنی و همسویی انجام می‌دهیم، و همچنین سامانه‌های خودکار و انسانی داریم تا به شناسایی محتوای مشکل‌داری کمک کنند که در سرویس‌های ما برای افراد، مانند ChatGPT و GPTها، ظاهر می‌شود. در ادامه برخی از این تلاش‌ها را شرح می‌دهیم.

ChatGPT و ImageGen

ما از ابزارهای خودکار، مانند نسخه‌ای داخلی از /moderations API خود، برای شناسایی محتوایی (اعلان‌ها، تکمیل‌ها، بارگذاری‌ها) استفاده می‌کنیم که ممکن است زیان‌بار باشد یا سیاست‌های استفاده ما را نقض کند. اگر محتوای مشکل‌دار شناسایی کنیم، معمولاً یا به شما هشدار می‌دهیم که محتوایتان ممکن است سیاست‌های استفاده ما را نقض کند، یا جلوی پاسخ‌دادن مدل به اعلان شما را می‌گیریم. همچنین ممکن است از اشتراک‌گذاری گفت‌وگویی که شامل اعلان یا تکمیل مشکل‌دار است جلوگیری کنیم. در مجموعه‌ای بسیار محدود از شرایط، ممکن است حساب شما را نیز به‌دلیل رفتار بسیار نامناسب مسدود کنیم.

ما گزارش‌های انسانی درباره محتوای مشکل‌دار در ChatGPT را نیز می‌پذیریم. برای بررسی این گزارش‌ها از ترکیبی از سامانه‌های خودکار و تیمی آموزش‌دیده از کارشناسان استفاده می‌کنیم.

  • ChatGPT: اگر کسی گفت‌وگویی را به اشتراک بگذارد که فکر می‌کنید حاوی محتوای مشکل‌دار است، شما نیز می‌توانید آن را به ما گزارش کنید.

برای جزئیات بیشتر درباره نحوه گزارش مستقیم محتوا در ChatGPT، این مقاله را ببینید.

GPTها

ما همچنین از ابزارهای خودکاری مانند /moderation API خود استفاده می‌کنیم تا ببینیم آیا یک GPT بالقوه مشکل‌دار است یا نه. اگر محتوای مشکل‌داری مرتبط با GPT شناسایی کنیم، اقداماتی انجام می‌دهیم؛ مانند جلوگیری از توزیع آن. سازنده می‌تواند پیکربندی GPT یا API را برای حذف محتوای مشکل‌دار ویرایش کند، یا از طریق فرایندی درون‌محصولی به تصمیم اعتراض کند. در مجموعه‌ای بسیار محدود از شرایط، ممکن است حساب سازنده را نیز به‌دلیل رفتار بسیار نامناسب مسدود کنیم.

ما گزارش‌های انسانی درباره GPTهای مشکل‌دار را نیز می‌پذیریم. اگر GPTای می‌بینید که فکر می‌کنید سیاست‌های استفاده ما را نقض می‌کند یا به‌گونه‌ای دیگر بازتاب‌دهنده محتوای مشکل‌دار است، شما نیز می‌توانید آن را به ما گزارش کنید. برای بررسی این گزارش‌ها از ترکیبی از سامانه‌های خودکار و تیمی آموزش‌دیده از کارشناسان استفاده می‌کنیم.

آیا این مقاله مفید بود؟