OpenAI
ეს გვერდი მანქანური თარგმანის მეშვეობით ითარგმნა. სტატიის ინგლისური დედნის ნახვა.

ტრენინგის მონაცემების შეჯამება კალიფორნიის სამოქალაქო კოდექსის 3111-ე მუხლის შესაბამისად

განახლებულია: 7 days ago

OpenAI კალიფორნიის შტატში საჯაროდ ხელმისაწვდომ გენერაციულ AI სისტემებს სთავაზობს. ამ სისტემებს მონაცემთა სხვადასხვა წყაროს გამოყენებით ვავითარებთ, მათ შორის საჯაროდ ხელმისაწვდომი მონაცემებით, მონაცემებით, რომლებზეც წვდომისთვის მესამე მხარეებთან ვთანამშრომლობთ, და ინფორმაციით, რომელსაც ჩვენი მომხმარებლები ან ადამიანური ტრენერები და მკვლევრები გვაწვდიან ან ქმნიან. ჩვენს სისტემებს სინთეტიკური მონაცემების გამოყენებითაც ვავითარებთ.

მონაცემებს ვიყენებთ, რათა ჩვენს სისტემებს ადამიანის ენა და სამყარო უკეთ გავაგებინოთ. ეს კი, თავის მხრივ, ჩვენს სისტემებს საშუალებას აძლევს გააძლიერონ ადამიანის შემოქმედებითობა, წინ წასწიონ სამეცნიერო აღმოჩენები და სამედიცინო კვლევები და ასეულობით მილიონ ადამიანს ყოველდღიური ცხოვრების გაუმჯობესებაში დაეხმარონ. ჩვენი სისტემები შემუშავებულია მონაცემთა ნაკრებებზე, რომლებიც ტექსტური, გამოსახულების, აუდიო და აუდიოვიზუალური კონტენტის ტრილიონობით token-ს შეიცავს.

ჩვენი სისტემების განსავითარებლად მრავალფეროვან მონაცემებს ვიყენებთ, მათ შორის ისეთ მონაცემებს, რომლებიც შესაძლოა საავტორო უფლებებით იყოს დაცული, და საჯარო დომენში არსებულ მონაცემებს. მიუხედავად იმისა, რომ ნაბიჯებს ვდგამთ ჩვენს სასწავლო მონაცემთა ნაკრებებში პერსონალური ინფორმაციის რაოდენობის შესამცირებლად, ჩვენი ზოგიერთი მონაცემი შეიძლება შეიცავდეს პერსონალურ ინფორმაციას და მომხმარებელთა აგრეგირებულ ინფორმაციას, როგორც ეს განსაზღვრულია კალიფორნიის სამოქალაქო კოდექსის 1798.140-ე მუხლში. ჩვენს მომხმარებლებს შეუძლიათ უარი თქვან მათი კონტენტის სწავლებისთვის გამოყენებაზე, ასევე მოითხოვონ გარკვეული პერსონალური ინფორმაციის ამოღება ChatGPT-ის პასუხებიდან, ჩვენი კონფიდენციალურობის პორტალის გამოყენებით. ჩვენი მონაცემთა ნაკრებების დასამუშავებლად სხვადასხვა ტექნიკას ვიყენებთ, რათა გავაუმჯობესოთ ჩვენი მოდელების წარმადობა და სიზუსტე.

ჩვენი სისტემების განსავითარებლად მონაცემების შეგროვება დაახლოებით 2018 წელს დავიწყეთ და მონაცემების შეგროვებას დღესაც ვაგრძელებთ. ჩვენი მონაცემთა ნაკრებები სისტემების განვითარებისთვის პირველად 2021 წელს გამოვიყენეთ.

ჩვენი სისტემების განვითარებაზე დამატებითი ინფორმაცია შეგიძლიათ იხილოთ ჩვენს სისტემურ ბარათებში.

სასარგებლო იყო ეს სტატია?