OpenAI سامانههای هوش مصنوعی مولدِ در دسترس عموم را در ایالت کالیفرنیا ارائه میکند. ما این سامانهها را با استفاده از منابع دادهای گوناگون توسعه میدهیم، از جمله دادههای در دسترس عموم، دادههایی که برای دسترسی به آنها با اشخاص ثالث همکاری میکنیم، و اطلاعاتی که کاربران ما یا مربیان و پژوهشگران انسانی ارائه یا تولید میکنند. ما همچنین سامانههای خود را با استفاده از دادههای مصنوعی توسعه میدهیم.
ما از دادهها استفاده میکنیم تا به سامانههای خود کمک کنیم زبان انسان و جهان را بهتر درک کنند. این امر، به نوبه خود، به سامانههای ما امکان میدهد خلاقیت انسانی را تقویت کنند، کشفیات علمی و پژوهشهای پزشکی را پیش ببرند، و به صدها میلیون نفر کمک کنند زندگی روزمره خود را بهبود بخشند. سامانههای ما بر پایه مجموعهدادههایی توسعه یافتهاند که شامل تریلیونها توکن از محتوای متنی، تصویری، صوتی و سمعیوبصری هستند.
ما برای توسعه سامانههای خود از مجموعهای متنوع از دادهها استفاده میکنیم، از جمله دادههایی که ممکن است تحت حمایت حق نشر باشند و دادههایی که در مالکیت عمومی قرار دارند. اگرچه اقداماتی برای کاهش میزان اطلاعات شخصی در مجموعهدادههای آموزشی خود انجام میدهیم، برخی از دادههای ما ممکن است شامل اطلاعات شخصی و اطلاعات تجمیعی مصرفکننده باشد، مطابق با تعاریف مندرج در بخش 1798.140 قانون مدنی کالیفرنیا. کاربران ما میتوانند با استفاده از درگاه خصوصی ما، از استفاده از محتوای خود برای آموزش انصراف دهند و همچنین درخواست کنند برخی اطلاعات شخصی از پاسخهای ChatGPT حذف شود. ما از روشهای گوناگونی برای پردازش مجموعهدادههای خود استفاده میکنیم تا عملکرد و دقت مدلهای خود را بهبود دهیم.
ما گردآوری دادهها برای توسعه سامانههای خود را تقریباً در سال 2018 آغاز کردیم و امروز نیز به گردآوری دادهها ادامه میدهیم. ما نخستین بار در سال 2021 از مجموعهدادههای خود برای توسعه سامانهها استفاده کردیم.
اطلاعات بیشتر درباره توسعه سامانههای ما را میتوان در کارتهای سیستم ما یافت.
خلاصه دادههای آموزشی مطابق با بخش 3111 قانون مدنی کالیفرنیا
بهروزرسانی: 11 days ago
