A Gyors módot azoknak az API-ügyfeleknek kínáljuk, akik bizonyos modellek esetében gyorsabb és egyenletesebb teljesítményt szeretnének. Az alábbiakban választ adunk a működéssel, az árakkal, a modellek elérhetőségével, a használati korlátokkal, a megbízhatósággal, a szabályzatokkal és az igénybevételi jogosultsággal kapcsolatos gyakori kérdésekre.
Megjegyzés: A Priority processing neve 2026. július 30-án Gyors módra változott. Az API-kérésekben a service_tier: priority és a service_tier: fast egyaránt használható.
További információ itt.
Minden régióban elérhető a Gyors mód?
A Gyors mód elérhetősége az egyes joghatóságokban alkalmazandó törvényektől és rendeletektől függ. Ha kérdése van a szolgáltatás elérhetőségével kapcsolatban az Ön régiójában, forduljon ügyfélkapcsolati igazgatójához.
Hogyan működik?
Az ügyfelek kérésenként irányíthatják a forgalmat a Gyors módba a meglévő service_tier paraméter service_tier = "fast" beállításával.
A Gyors módban feldolgozott tokeneket tokenenként számlázzuk, a normál feldolgozás díjainál magasabb áron.
A kérésenkénti beállítás mellett a projekt alapértelmezett módjaként is megadhatod a Gyors módot itt: Projektbeállítások > Alapértelmezett szolgáltatási szint: Gyors. Ezt továbbra is felülírhatod kérésenként. A projektbeállításokban a Gyors lehetőség kiválasztása egyenértékű az Elsőbbségi lehetőség kiválasztásával.
Hogyan kapcsolódik ez a Skálázási szinthez?
A Skálázási szint továbbra is elkülönül a Gyors módtól. A Gyors módba küldött kéréseket külön számlázzuk, és nem számítanak bele a Skálázási szinten vásárolt TPM-csomagjaidba.
Átirányíthatom automatikusan a Skálázási szint kvótáján felüli forgalmamat a Gyors módba?
Nem. A Skálázási szintre küldött forgalom a kvóta túllépésekor nem kerül át automatikusan a Gyors módba.
Hogyan történik a Gyors mód számlázása?
A Gyors módban feldolgozott tokeneket tokenenként számlázzuk, a normál feldolgozás díjainál magasabb áron.
Az éves költési vállalásom egy adott feldolgozási módhoz kötődik?
Nem. Minden feldolgozási mód használata beleszámít az Enterprise-szerződésedben vállalt éves költésbe.
Továbbra is kapok kedvezményt a gyorsítótárazott bemeneti tokenekre?
Igen! A gyorsítótárazott bemenetekre ugyanaz az 50–75%-os kedvezmény vonatkozik, mint a normál feldolgozásnál.
Hol nézhetem meg a Gyors mód használatát és költségeit?
A Gyors módban (korábbi nevén elsőbbségi feldolgozás) feldolgozott tokenek megtekintéséhez nyisd meg a Használat irányítópultot, válaszd a Chat Completions vagy a Responses lehetőséget, majd a Csoportosítás szolgáltatási szint szerint beállítást.
A Gyors mód költségeinek megtekintéséhez nyisd meg a Használat irányítópultot, és válaszd a Csoportosítás számlatétel szerint beállítást.
A Használat irányítópulton azok a kérések, amelyeknél a service_tier értéke priority vagy fast, továbbra is priority megjelöléssel jelennek meg. Ezt a jövőbeli modelleknél frissítjük.
Modellek
Elérhető a Gyors mód hosszú kontextus, finomhangolt modellek, beágyazások stb. esetén?
Jelenleg nem. A jövőben megvizsgáljuk, hogy a legújabb modelljeinken túl további termékekhez is elérhetővé tegyük-e a Gyors módot.
Hogyan működnek a többi modalitások a Gyors módban?
A Gyors mód ugyanazokat a multimodális képességeket támogatja, mint a normál feldolgozás. Az elsőbbségi feldolgozás például képeket is fogad bemenetként, és ezeket ugyanolyan alacsony késleltetéssel dolgozza fel.
A jövőbeli modellek is támogatottak lesznek?
Tervezzük, hogy az új GPT-modellekhez is elérhetővé tesszük a Gyors módot, de nem garantáljuk, hogy minden modell támogatott lesz.
Használati korlátok
Milyen használati korlátok vannak?
A használati korlátok szempontjából az elsőbbségi feldolgozás használata ugyanúgy számít, mint a normál API-forgalom.
Milyen korlátok vonatkoznak a felfutási sebességre?
A Gyors mód korlátozza a felfutási sebességet, hogy minden ügyfél számára egyenletesen magas teljesítményt biztosítson, miközben rugalmas, használatalapú díjszabást kínál. Ha (a) a Gyors mód teljesítménye romlik, ÉS (b) egy ügyfél forgalma túl gyorsan növekszik, akkor ritka esetekben egyes kérések normál feldolgozásra kerülhetnek át.
A Gyors mód aktuális felfutási sebességkorlátját itt, a fő dokumentációnkban határozzuk meg.
Bevált módszerek a felfutási sebességkorlát betartásához
Modellváltáskor fokozatosan növeld a forgalmat. Ha például az alkalmazásod egy korábbi modellverzióról újra áll át, használj funkciókapcsolót, és néhány óra alatt, fokozatosan irányítsd át a forgalmat, ne egyszerre.
Kerüld a nagy adatfeldolgozási vagy aszinkron feladatok futtatását Gyors módban. Ezek a feladatok nagyon gyorsan megnövelhetik a forgalmat, és gyakran nincs szükségük a Gyors mód nagyobb teljesítményére.
Ha rendszeresen eléred a felfutási sebességkorlátot, fontold meg inkább kvóta vásárlását a Skálázási szinten.
A projektjeimre és szervezeteimre közös felfutási sebességkorlát vonatkozik?
Igen, a teljes forgalmadra ugyanaz a közös felfutási sebességkorlát vonatkozik.
Szabályzatok
Mi történik, ha a Gyors mód nem teljesíti a késleltetési célértéket?
Kérdés vagy probléma esetén fordulj az AD-kapcsolattartódhoz. A Gyors mód SLA-it ugyanúgy kezeljük, mint a Skálázási szint SLA-it: ha egy adott időszakban nem teljesítjük ezeket az Enterprise-szerződéssel rendelkező ügyfeleknél, szolgáltatási jóváírást biztosítunk.
A Gyors mód összeegyeztethető az adatok tárolási helyére vonatkozó követelményekkel?
Igen.
A Gyors mód összeegyeztethető a ZDR-rel és a BAA-val?
Igen.
Ultrafast a GPT-6 Astra modellhez
Az Ultrafast külön szolgáltatási szint az olyan feladatokhoz, amelyeknél a GPT-6 Astra alacsonyabb késleltetésű válaszaira van szükség, például interaktív alkalmazásokhoz és programozási munkafolyamatokhoz.
A Gyors mód díjszabására, használati korlátaira és szabályzataira vonatkozó útmutatás a service_tier="fast" beállítást használó kérésekre érvényes. Az Ultrafast-kérések a különálló service_tier="ultrafast" szintet használják.
Hogyan küldhetek Ultrafast-kérést?
Ha a szervezeted rendelkezik Ultrafast-hozzáféréssel, használd a Responses API-t az alábbi beállításokkal:
Modell:
gpt-6-astraSzolgáltatási szint:
ultrafastKérésfejléc:
OpenAI-Service-Tier: ultrafast
A szolgáltatási szint beállítása mellett a kérésfejléc megadása is kötelező.
Az eszközhívásokat végrehajtó alkalmazásoknál a WebSocket mód lehetővé teszi ugyanannak a kapcsolatnak a használatát több fordulón át, csökkentve ezzel a kapcsolatkezelés többletterhelését.
Használhatom ugyanazt a kérésfejlécet más szolgáltatási szintekhez is?
Az Ultrafast alfatesztje során az OpenAI-Service-Tier fejléc csak az ultrafast értéket fogadja el. Más érték küldése – beleértve a default, fast és flex értékeket – HTTP 400-as hibát eredményez. Más szint használatakor hagyd el ezt a fejlécet.
Használhatom az Ultrafast szintet a Work módban vagy a Codexben?
Az Ultrafast a Work módban és a Codexben is elérhető az arra jogosult csomagok és munkaterületek esetén. A ChatGPT-csomagok jogosultsági és használati feltételei eltérnek az API-hozzáférés feltételeitől.
Az elérhetőségről és a használatról a ChatGPT Work és Codex című cikkben olvashatsz részletesen.
