OpenAI
ეს გვერდი მანქანური თარგმანის მეშვეობით ითარგმნა. სტატიის ინგლისური დედნის ნახვა.

სწრაფი რეჟიმი — ხშირად დასმული კითხვები

ხშირად დასმული კითხვები სწრაფი რეჟიმისა და მომსახურების Ultrafast დონის შესახებ.

განახლებულია: 4 days ago

API-ის მომხმარებლებს, რომლებსაც გარკვეულ მოდელებზე უფრო სწრაფი და სტაბილური წარმადობა სურთ, სწრაფ რეჟიმს ვთავაზობთ. ქვემოთ ნახავთ პასუხებს გავრცელებულ კითხვებზე იმის შესახებ, თუ როგორ მუშაობს ის, ასევე ფასებზე, მოდელების ხელმისაწვდომობაზე, მოთხოვნების ლიმიტებზე, საიმედოობაზე, პოლიტიკებსა და გამოყენების უფლების კრიტერიუმებზე.

შენიშვნა: პრიორიტეტულ დამუშავებას 2026 წლის 30 ივლისს სწრაფი რეჟიმი ეწოდა. API მოთხოვნებში შეგიძლიათ გამოიყენოთ როგორც service_tier: priority, ისე service_tier: fast. 

დამატებითი ინფორმაცია იხილეთ აქ.

სწრაფი რეჟიმი ყველა რეგიონშია ხელმისაწვდომი?

სწრაფი რეჟიმის ხელმისაწვდომობა თითოეულ იურისდიქციაში მოქმედ კანონებსა და რეგულაციებზეა დამოკიდებული. თქვენს რეგიონში ხელმისაწვდომობასთან დაკავშირებით კითხვების შემთხვევაში, გთხოვთ, დაუკავშირდეთ თქვენი ანგარიშის დირექტორს.

როგორ მუშაობს

მომხმარებლებს შეუძლიათ ცალკეული მოთხოვნები სწრაფ რეჟიმზე მიმართონ არსებული service_tier პარამეტრის მეშვეობით, მნიშვნელობით service_tier = "fast".

სწრაფ რეჟიმში დამუშავებული ტოკენების საფასური თითოეული ტოკენისთვის დაირიცხება, სტანდარტული დამუშავების ტარიფზე მაღალი ფასით.

ცალკეული მოთხოვნისთვის დაყენების გარდა, შეგიძლიათ პროექტისთვის სწრაფი რეჟიმი ნაგულისხმევად აირჩიოთ: პროექტის პარამეტრები > მომსახურების ნაგულისხმევი დონე: სწრაფი. ამ არჩევანის შეცვლა კვლავ შეგიძლიათ თითოეული მოთხოვნისთვის. პროექტის პარამეტრებში „სწრაფის“ არჩევა „პრიორიტეტულის“ არჩევის ტოლფასია.

როგორ მუშაობს ეს მასშტაბირების დონესთან ერთად?

მასშტაბირების დონე სწრაფი რეჟიმისგან განცალკევებული დარჩება. სწრაფ რეჟიმზე გაგზავნილი მოთხოვნების საფასური ცალკე დაირიცხება და არ გამოაკლდება მასშტაბირების დონის თქვენ მიერ შეძენილ TPM პაკეტებს.

შემიძლია მასშტაბირების დონის კვოტას გადაჭარბებული ტრაფიკი ავტომატურად გადავამისამართო სწრაფ რეჟიმზე?

არა. მასშტაბირების დონეზე გაგზავნილი ტრაფიკი კვოტის გადაჭარბებისას სწრაფ რეჟიმზე ავტომატურად არ გადავა.

როგორ ირიცხება სწრაფი რეჟიმის საფასური?

სწრაფ რეჟიმში დამუშავებული ტოკენების საფასური თითოეული ტოკენისთვის დაირიცხება, სტანდარტული დამუშავების ტარიფზე მაღალი ფასით.

უკავშირდება ჩემი წლიური ხარჯვის ვალდებულება დამუშავების კონკრეტულ რეჟიმს?

არა. დამუშავების ყველა რეჟიმის ხარჯი ითვლება Enterprise-ის ფარგლებში თქვენს წლიურ ხარჯვის ვალდებულებაში.

ქეშირებულ შემავალ ტოკენებზე ფასდაკლება ისევ მოქმედებს?

დიახ! ქეშირებულ შემავალ მონაცემებზე ვრცელდება იგივე 50–75%-იანი ფასდაკლება, რაც სტანდარტული დამუშავებისას.

როგორ ვნახო სწრაფი რეჟიმის მოხმარება და ხარჯები?

სწრაფი რეჟიმით (ყოფილი პრიორიტეტული დამუშავებით) დამუშავებული ტოკენების სანახავად გადადით მოხმარების დაფაზე, აირჩიეთ Chat Completions ან Responses და დააჯგუფეთ მომსახურების დონის მიხედვით.

სწრაფი რეჟიმის ხარჯების სანახავად გადადით მოხმარების დაფაზე და აირჩიეთ დაჯგუფება ხარჯის მუხლის მიხედვით.

მოხმარების დაფაზე მოთხოვნები, რომლებშიც service_tier-ის მნიშვნელობად მითითებულია priority ან fast, კვლავ priority-ის სახელით გამოჩნდება. მომავალი მოდელებისთვის ეს განახლდება.

მოდელები

ხელმისაწვდომია სწრაფი რეჟიმი გრძელი კონტექსტის, დამატებით გაწვრთნილი მოდელების, ვექტორული წარმოდგენებისა და სხვა შესაძლებლობებისთვის?

ამ ეტაპზე — არა. სამომავლოდ განვიხილავთ, შევთავაზოთ თუ არა სწრაფი რეჟიმი ჩვენს უახლეს მოდელებთან ერთად სხვა პროდუქტებზეც.

როგორ მუშაობს სხვა მოდალობები სწრაფ რეჟიმში?

სწრაფ რეჟიმს იგივე მულტიმოდალური შესაძლებლობები აქვს, რაც სტანდარტულს. კერძოდ, პრიორიტეტული დამუშავებისთვის შემავალ მონაცემებად შეგიძლიათ სურათებიც გამოიყენოთ — ისინიც იმავე მცირე დაყოვნებით მუშავდება.

ექნება მომავალ მოდელებს მხარდაჭერა?

ვგეგმავთ სწრაფი რეჟიმის შეთავაზებას GPT-ის ახალ მოდელებზე, თუმცა ყველა მოდელის მხარდაჭერას ვერ ვიძლევით გარანტიად.

მოთხოვნების ლიმიტები

რა მოთხოვნების ლიმიტები მოქმედებს?

მოთხოვნების ლიმიტების თვალსაზრისით, პრიორიტეტული დამუშავების მოხმარება ისევე ითვლება, როგორც სტანდარტული API ტრაფიკი.

რა ლიმიტები მოქმედებს დატვირთვის ზრდის სიჩქარეზე?

სწრაფ რეჟიმში დატვირთვის ზრდის სიჩქარე შეზღუდულია, რათა ყველა მომხმარებლისთვის სტაბილურად მაღალი წარმადობა იყოს უზრუნველყოფილი და ამასთან შენარჩუნდეს მოქნილი, მოხმარებაზე დაფუძნებული ფასები. თუ (ა) სწრაფი რეჟიმის წარმადობა გაუარესდება და ამავდროულად (ბ) მომხმარებლის ტრაფიკი მეტისმეტად სწრაფად გაიზრდება, იშვიათ შემთხვევებში ზოგიერთი მოთხოვნა შესაძლოა სტანდარტულ დამუშავებაზე გადავიდეს.

სწრაფ რეჟიმში დატვირთვის ზრდის სიჩქარის მიმდინარე ლიმიტი განსაზღვრულია ჩვენს ძირითად დოკუმენტაციაში, აქ.

რეკომენდაციები დატვირთვის ზრდის სიჩქარის ლიმიტის დასაცავად

მოდელების შეცვლისას ტრაფიკი თანდათან გაზარდეთ. მაგალითად, თუ თქვენი აპლიკაცია მოდელის წინა ვერსიიდან ახალზე გადადის, ფუნქციის ჩამრთველის მეშვეობით ტრაფიკი რამდენიმე საათის განმავლობაში გადაიტანეთ და არა ერთბაშად.

მოერიდეთ სწრაფ რეჟიმში დიდი მოცულობის მონაცემების დამუშავებასა და ასინქრონული ამოცანების გაშვებას. ასეთმა ამოცანებმა შეიძლება ტრაფიკი ძალიან სწრაფად გაზარდოს, სწრაფი რეჟიმის გაუმჯობესებული წარმადობა კი ხშირად არ სჭირდება.

თუ დატვირთვის ზრდის სიჩქარის ლიმიტს ხშირად აღწევთ, სანაცვლოდ მასშტაბირების დონის კვოტის შეძენა განიხილეთ.

ჩემს პროექტებსა თუ ორგანიზაციებზე დატვირთვის ზრდის სიჩქარის საერთო ლიმიტი ვრცელდება?

დიახ, მთელი თქვენი ტრაფიკი დატვირთვის ზრდის სიჩქარის ერთსა და იმავე ლიმიტში ითვლება.

წესები

რა ხდება, თუ სწრაფი რეჟიმის დაყოვნება სამიზნე მაჩვენებელს არ შეესაბამება?

ნებისმიერი კითხვის ან პრობლემის შემთხვევაში დაუკავშირდით თქვენს AD-ს. სწრაფი რეჟიმის SLA-ებზე იგივე მიდგომა გავრცელდება, რაც მასშტაბირების დონის SLA-ებზე: თუ მოცემულ პერიოდში Enterprise ხელშეკრულების მქონე მომხმარებლებისთვის ამ SLA-ებს ვერ შევასრულებთ, მათ მომსახურების კრედიტებს შევთავაზებთ.

თავსებადია სწრაფი რეჟიმი მონაცემთა ადგილმდებარეობის მოთხოვნებთან?

დიახ.

თავსებადია სწრაფი რეჟიმი ZDR-სა და BAA-სთან?

დიახ.

Ultrafast GPT-6 Astra-სთვის

Ultrafast მომსახურების ცალკე დონეა იმ ამოცანებისთვის, რომლებსაც GPT-6 Astra-სგან ნაკლები დაყოვნებით პასუხი სჭირდება, მაგალითად, ინტერაქტიული აპლიკაციებისა და პროგრამირების პროცესებისთვის.

სწრაფი რეჟიმის ფასები, მოთხოვნების ლიმიტები და წესები ვრცელდება მოთხოვნებზე, რომლებშიც გამოიყენება service_tier="fast". Ultrafast მოთხოვნები იყენებს ცალკე დონეს — service_tier="ultrafast".

როგორ გავაგზავნო Ultrafast მოთხოვნა?

თუ ორგანიზაციას აქვს Ultrafast-ზე წვდომა, გამოიყენეთ Responses API შემდეგი პარამეტრებით:

  • მოდელი: gpt-6-astra

  • მომსახურების დონე: ultrafast

  • მოთხოვნის ჰედერი: OpenAI-Service-Tier: ultrafast

მომსახურების დონის მითითებასთან ერთად მოთხოვნის ჰედერიც აუცილებელია.

აპლიკაციებში, რომლებიც ინსტრუმენტებს იძახებს, WebSocket რეჟიმი საშუალებას გაძლევთ მიმოცვლისას კავშირი ხელახლა გამოიყენოთ და მის დამყარებასთან დაკავშირებული ზედნადები ხარჯები შეამციროთ.

შემიძლია მოთხოვნის იგივე ჰედერი მომსახურების სხვა დონეებისთვისაც გამოვიყენო?

Ultrafast-ის ალფა-ტესტირებისას OpenAI-Service-Tier ჰედერი მხოლოდ ultrafast მნიშვნელობას იღებს. სხვა მნიშვნელობის გაგზავნა, მათ შორის default, fast ან flex, HTTP 400 შეცდომას აბრუნებს. სხვა დონის გამოყენებისას ეს ჰედერი არ მიუთითოთ.

შემიძლია Ultrafast-ის გამოყენება რეჟიმში „მუშაობა“ ან Codex-ში?

Ultrafast ასევე ხელმისაწვდომია რეჟიმში „მუშაობა“ და Codex-ში შესაბამისი გეგმებისა და სამუშაო სივრცეებისთვის. ChatGPT-ის გეგმებში ხელმისაწვდომობისა და გამოყენების პირობები API-ზე წვდომის პირობებისგან განსხვავდება.

ხელმისაწვდომობისა და გამოყენების დეტალებისთვის იხილეთ ChatGPT მუშაობა და Codex.

სასარგებლო იყო ეს სტატია?