OpenAI
આ પેજનો અનુવાદ મશીન દ્વારા કરવામાં આવ્યો હતો. મૂળ અંગ્રેજી લેખ જુઓ.

ઝડપી મોડ વિશે વારંવાર પૂછાતા પ્રશ્નો

ઝડપી મોડ અને સેવાના અતિઝડપી સ્તર વિશે વારંવાર પૂછાતા પ્રશ્નો.

અપડેટ કર્યા તારીખ: 4 days ago

ચોક્કસ મોડલો પર વધુ ઝડપી અને વધુ સ્થિર કામગીરી ઇચ્છતા API ગ્રાહકો માટે અમે ઝડપી મોડ પ્રદાન કરીએ છીએ. તે કેવી રીતે કાર્ય કરે છે, કિંમત, મોડલની ઉપલબ્ધતા, દર મર્યાદાઓ, વિશ્વસનીયતા, નીતિઓ અને પાત્રતા વિશેના સામાન્ય પ્રશ્નોના જવાબ નીચે આપેલા છે.

નોંધ: 30 જુલાઈ, 2026ના રોજ પ્રાથમિકતા પ્રક્રિયાનું નામ બદલીને ઝડપી મોડ રાખવામાં આવ્યું હતું. તમારી API વિનંતીઓમાં તમે service_tier: priority અથવા service_tier: fast પૈકી કોઈપણનો ઉપયોગ કરી શકો છો. 

વધુ માહિતી અહીં મેળવો.

શું ઝડપી મોડ બધા પ્રદેશોમાં ઉપલબ્ધ છે?

ઝડપી મોડની ઉપલબ્ધતા દરેક અધિકારક્ષેત્રમાં લાગુ પડતા કાયદા અને નિયમો પર આધારિત છે. તમારા પ્રદેશમાં ઉપલબ્ધતા વિશે કોઈ પ્રશ્ન હોય, તો કૃપા કરીને તમારા ખાતા નિયામકનો સંપર્ક કરો.

તે કેવી રીતે કામ કરે છે

ગ્રાહકો હાલના service_tier પરિમાણમાં service_tier = "fast" વિકલ્પ વાપરીને દરેક વિનંતી માટે ટ્રાફિક ઝડપી મોડમાં મોકલી શકે છે.

ઝડપી મોડ દ્વારા પૂરા પાડવામાં આવતા ટોકનનું બિલ પ્રતિ ટોકનના આધારે બનશે અને તેનો દર પ્રમાણભૂત પ્રક્રિયાના દર કરતાં વધારે હશે.

વિનંતીના સ્તરે ગોઠવવા ઉપરાંત, તમે પ્રોજેક્ટનાં સેટિંગ્સ > સેવાનું મૂળભૂત સ્તર: ઝડપી દ્વારા પ્રોજેક્ટ માટે ઝડપી મોડને મૂળભૂત મોડ તરીકે પણ સેટ કરી શકો છો. તમે હજી પણ દરેક વિનંતી માટે આ સેટિંગ બદલી શકો છો. તમારા પ્રોજેક્ટનાં સેટિંગ્સમાં ઝડપી પસંદ કરવું એ પ્રાથમિકતા પસંદ કરવા સમાન છે.

આ વ્યાપકતાનું સ્તર સાથે કેવી રીતે કામ કરે છે?

વ્યાપકતાનું સ્તર ઝડપી મોડથી અલગ રહેશે. ઝડપી મોડમાં મોકલવામાં આવેલી વિનંતીઓનું બિલ અલગ બનશે અને તે તમે ખરીદેલાં વ્યાપકતાનું સ્તર માટેનાં પ્રતિ મિનિટ ટોકનનાં બંડલમાં ગણાશે નહીં.

શું હું વ્યાપકતાનું સ્તરની ક્ષમતાથી વધારાનો ટ્રાફિક આપમેળે ઝડપી મોડમાં મોકલી શકું?

ના. વ્યાપકતાનું સ્તર પર મોકલેલો ટ્રાફિક તેની ક્ષમતાથી વધે તો તે આપમેળે ઝડપી મોડમાં જશે નહીં.

ઝડપી મોડનું બિલ કેવી રીતે બને છે?

ઝડપી મોડ દ્વારા પૂરા પાડવામાં આવતા ટોકનનું બિલ પ્રતિ ટોકનના આધારે બનશે અને તેનો દર પ્રમાણભૂત પ્રક્રિયાના દર કરતાં વધારે હશે.

શું મારી વાર્ષિક ખર્ચ પ્રતિબદ્ધતા કોઈ ચોક્કસ પ્રક્રિયા મોડ સાથે જોડાયેલી છે?

ના. બધા પ્રક્રિયા મોડનો ખર્ચ તમારી વાર્ષિક એન્ટરપ્રાઇઝ ખર્ચ પ્રતિબદ્ધતામાં ગણાય છે.

શું કૅશમાં સંગ્રહિત ઇનપુટ ટોકન પર મને હજી પણ છૂટ મળે છે?

હા. કૅશમાં સંગ્રહિત ઇનપુટ પર પ્રમાણભૂત પ્રક્રિયાની જેમ જ 50-75% છૂટ મળે છે.

હું ઝડપી મોડનો મારો વપરાશ અને ખર્ચ કેવી રીતે જોઈ શકું?

ઝડપી મોડ દ્વારા પ્રક્રિયા કરાયેલા ટોકન જોવા માટે (અગાઉ પ્રાથમિકતા પ્રક્રિયા તરીકે ઓળખાતું), વપરાશના ડૅશબોર્ડ પર જાઓ, ચૅટ પૂર્ણતાઓ અથવા પ્રતિસાદ પસંદ કરો અને સેવાના સ્તર મુજબ જૂથ બનાવો.

ઝડપી મોડનો ખર્ચ જોવા માટે, વપરાશના ડૅશબોર્ડ પર જાઓ અને ખર્ચની મદ મુજબ જૂથ બનાવવાનો વિકલ્પ પસંદ કરો.

વપરાશના ડૅશબોર્ડ પર, service_tier તરીકે priority અથવા fast વાપરતી વિનંતીઓ હજી પણ priority તરીકે જ દેખાશે. ભવિષ્યનાં મોડલ માટે આમાં ફેરફાર કરવામાં આવશે.

મોડલ

શું ઝડપી મોડ લાંબા સંદર્ભ, વિશેષ તાલીમ આપેલાં મોડલ, એમ્બેડિંગ વગેરે માટે ઉપલબ્ધ છે?

હાલમાં નહીં. અમારાં નવીનતમ મોડલ ઉપરાંત અન્ય ઉત્પાદનોમાં પણ ઝડપી મોડ આપવો કે નહીં, તેનું અમે ભવિષ્યમાં મૂલ્યાંકન કરીશું.

ઝડપી મોડમાં અન્ય પ્રકારની સામગ્રી કેવી રીતે કામ કરે છે?

ઝડપી મોડમાં પ્રમાણભૂત સ્તર જેવી જ વિવિધ પ્રકારની સામગ્રી સાથે કામ કરવાની ક્ષમતાઓ ઉપલબ્ધ છે. ખાસ કરીને, પ્રાથમિકતા પ્રક્રિયામાં છબીઓનો ઇનપુટ તરીકે ઉપયોગ કરી શકાય છે અને તેમની પ્રક્રિયા પણ એટલા જ ઓછા વિલંબ સાથે થાય છે.

શું ભવિષ્યનાં મોડલ માટે સમર્થન મળશે?

અમે નવાં GPT મોડલમાં ઝડપી મોડ આપવાનું આયોજન કરી રહ્યા છીએ, પરંતુ દરેક મોડલ માટે સમર્થન મળશે તેની ખાતરી આપતા નથી.

દર મર્યાદાઓ

દર મર્યાદાઓ શું છે?

દર મર્યાદાઓ માટે પ્રાથમિકતા પ્રક્રિયાના વપરાશને પ્રમાણભૂત API ટ્રાફિકની જેમ જ ગણવામાં આવે છે.

રેમ્પ દરની મર્યાદાઓ શું છે?

ઝડપી મોડમાં રેમ્પ દરની મર્યાદાઓ રાખવામાં આવી છે, જેથી બધા ગ્રાહકોને સતત ઉચ્ચ પ્રદર્શનની સાથે જરૂરિયાત મુજબ ઉપયોગ માટે લવચીક કિંમતો પણ મળી રહે. જો (અ) ઝડપી મોડનું પ્રદર્શન કથળે અને સાથે (બ) ગ્રાહકનો ટ્રાફિક બહુ ઝડપથી વધી રહ્યો હોય, તો જૂજ કિસ્સાઓમાં કેટલીક વિનંતીઓને તેના બદલે પ્રમાણભૂત પ્રક્રિયામાં મોકલવામાં આવી શકે છે.

ઝડપી મોડ માટે રેમ્પ દરની હાલની મર્યાદા અહીં અમારા મુખ્ય દસ્તાવેજોમાં નિર્ધારિત કરેલી છે.

રેમ્પ દરની મર્યાદામાં રહેવા માટેની શ્રેષ્ઠ રીતો

મોડલ બદલતી વખતે ટ્રાફિક ધીમે ધીમે વધારો. ઉદાહરણ તરીકે, તમારી ઍપ્લિકેશન અગાઉના સ્નૅપશૉટમાંથી નવા સ્નૅપશૉટ પર જઈ રહી હોય, તો બધો ટ્રાફિક એકસાથે ખસેડવાને બદલે સુવિધા નિયંત્રણ ફ્લૅગ વડે થોડા કલાકો દરમિયાન ધીમે ધીમે ખસેડો.

ઝડપી મોડમાં મોટા પાયે ડેટાની પ્રક્રિયા કરવાનું અથવા અસુમેળ કાર્યો ચલાવવાનું ટાળો. આ કાર્યો ટ્રાફિકને બહુ ઝડપથી વધારી શકે છે અને ઘણી વાર તેમને ઝડપી મોડના વધુ સારા પ્રદર્શનની જરૂર હોતી નથી.

જો તમે વારંવાર રેમ્પ દરની મર્યાદા સુધી પહોંચી જતા હો, તો તેના બદલે વ્યાપકતાનું સ્તર માટેનો ક્વોટા ખરીદવાનું વિચારો.

શું મારા બધા પ્રોજેક્ટ અથવા સંસ્થાઓ માટે રેમ્પ દરની મર્યાદા સહિયારી છે?

હા, તમારો બધો ટ્રાફિક રેમ્પ દરની એક જ મર્યાદામાં ગણાય છે.

નીતિઓ

જો ઝડપી મોડ વિલંબના નિર્ધારિત લક્ષ્યને ન જાળવી શકે તો શું થાય?

કોઈ પણ પ્રશ્ન કે ચિંતા હોય તો કૃપા કરીને તમારા એકાઉન્ટ ડિરેક્ટરનો સંપર્ક કરો. ઝડપી મોડના સેવા-સ્તરના કરારોને વ્યાપકતાનું સ્તર માટેના સેવા-સ્તરના કરારોની જેમ જ લાગુ કરવામાં આવશે. એન્ટરપ્રાઇઝ કરાર ધરાવતા ગ્રાહકો માટે નિર્ધારિત સમયગાળા દરમિયાન અમે આ કરારોની શરતો પૂરી ન કરી શકીએ તો સેવા ક્રેડિટ્સ આપવામાં આવશે.

શું ઝડપી મોડ ડેટા રેસિડન્સી સાથે સુસંગત છે?

હા.

શું ઝડપી મોડ ZDR અને BAA સાથે સુસંગત છે?

હા.

GPT-6 Astra માટે અતિઝડપી

અતિઝડપી એ સેવાનું એક અલગ સ્તર છે. તે એવા કાર્યભાર માટે છે જેમાં GPT-6 Astraના પ્રતિસાદ ઓછા વિલંબ સાથે જરૂરી હોય, જેમ કે સંવાદાત્મક ઍપ્લિકેશન અને કોડિંગની કાર્યપ્રવાહો.

ઝડપી મોડની કિંમતો, દર મર્યાદા અને નીતિ અંગેનું માર્ગદર્શન service_tier="fast" વાપરતી વિનંતીઓને લાગુ પડે છે. અતિઝડપી વિનંતીઓ અલગ service_tier="ultrafast" સ્તર વાપરે છે.

હું અતિઝડપી વિનંતી કેવી રીતે મોકલું?

અતિઝડપીનો ઍક્સેસ ધરાવતી સંસ્થા માટે નીચેની ગોઠવણી સાથે Responses API વાપરો:

  • મોડલ: gpt-6-astra

  • સેવાનું સ્તર: ultrafast

  • વિનંતી હેડર: OpenAI-Service-Tier: ultrafast

સેવાના સ્તરની ગોઠવણી ઉપરાંત વિનંતી હેડર પણ જરૂરી છે.

સાધનોને કૉલ કરતી ઍપ્લિકેશન માટે, WebSocket મોડ તમને અલગ અલગ વારમાં એક જ જોડાણ ફરી વાપરવા દે છે, જેથી જોડાણ સ્થાપિત કરવાનો વધારાનો ખર્ચ ઘટે છે.

શું હું સેવાનાં અન્ય સ્તરો માટે પણ એ જ વિનંતી હેડર વાપરી શકું?

અતિઝડપીના આલ્ફા તબક્કા દરમિયાન, OpenAI-Service-Tier હેડર માત્ર ultrafast સ્વીકારે છે. default, fast અથવા flex સહિત અન્ય કોઈ મૂલ્ય મોકલવાથી HTTP 400 ભૂલ મળે છે. અન્ય સ્તર વાપરતી વખતે આ હેડર ઉમેરશો નહીં.

શું હું કામ અથવા Codexમાં અતિઝડપી વાપરી શકું?

પાત્ર પ્લાન અને કાર્યસ્થળો માટે કામ તથા Codexમાં પણ અતિઝડપી ઉપલબ્ધ છે. ChatGPT પ્લાનની પાત્રતા અને વપરાશની શરતો API ઍક્સેસથી અલગ છે.

ઉપલબ્ધતા અને વપરાશની વિગતો માટે ChatGPT કામ અને Codex જુઓ.

શું આ લેખ મદદરૂપ હતો?