OpenAI
หน้านี้แปลด้วยระบบอัตโนมัติ ดูต้นฉบับภาษาอังกฤษ.

คำถามที่พบบ่อยเกี่ยวกับโหมด Fast

คำถามที่พบบ่อยเกี่ยวกับโหมด Fast และประเภทของแพ็กเกจ Ultrafast

อัปเดตล่าสุด: 3 days ago

เรามีโหมด Fast สำหรับลูกค้า API ที่ต้องการประสิทธิภาพของโมเดลบางรุ่นที่รวดเร็วและสม่ำเสมอยิ่งขึ้น ด้านล่างคือคำตอบสำหรับคำถามที่พบบ่อยเกี่ยวกับวิธีการทำงาน ราคา โมเดลที่พร้อมให้ใช้งาน ลิมิตการใช้งาน ความเสถียร นโยบาย และคุณสมบัติในการใช้งาน

หมายเหตุ: Priority processing เปลี่ยนชื่อเป็นโหมด Fast เมื่อวันที่ 30 กรกฎาคม 2026 คุณสามารถใช้ service_tier: priority หรือ service_tier: fast ในคำขอ API ได้ 

ดูข้อมูลเพิ่มเติมได้ที่นี่

โหมด Fast พร้อมให้ใช้งานในทุกภูมิภาคหรือไม่

ความพร้อมใช้งานของโหมด Fast ขึ้นอยู่กับกฎหมายและข้อบังคับที่มีผลบังคับใช้ในแต่ละเขตอำนาจศาล โปรดติดต่อ Account Director ของคุณหากมีคำถามเกี่ยวกับความพร้อมใช้งานในภูมิภาคของคุณ

วิธีการทำงาน

ลูกค้าสามารถส่งทราฟฟิกไปยังโหมด Fast เป็นรายคำขอได้ โดยใช้พารามิเตอร์ service_tier ที่มีอยู่และระบุ service_tier = "fast"

Token ที่ประมวลผลด้วยโหมด Fast จะคิดค่าบริการเป็นราย Token ในอัตราที่สูงกว่าการประมวลผลแบบมาตรฐาน

นอกจากการตั้งค่าเป็นรายคำขอแล้ว คุณยังตั้งค่าให้โปรเจกต์ใช้โหมด Fast เป็นค่าเริ่มต้นได้ที่การตั้งค่าโปรเจกต์ > ประเภทของแพ็กเกจเริ่มต้น: Fast คุณยังคงระบุค่าอื่นแทนค่าเริ่มต้นเป็นรายคำขอได้ การเลือก Fast ในการตั้งค่าโปรเจกต์มีผลเหมือนกับการเลือก Priority

โหมดนี้ทำงานร่วมกับระดับการรองรับการใช้งานอย่างไร?

ระดับการรองรับการใช้งานจะยังคงแยกจากโหมด Fast คำขอที่ส่งไปยังโหมด Fast จะคิดค่าบริการแยกต่างหาก และจะไม่หักจากชุดโควตา TPM ของระดับการรองรับการใช้งานที่คุณซื้อไว้

ฉันส่งทราฟฟิกส่วนที่เกินโควตาระดับการรองรับการใช้งานไปยังโหมด Fast โดยอัตโนมัติได้หรือไม่?

ไม่ได้ ทราฟฟิกที่ส่งไปยังระดับการรองรับการใช้งานจะไม่ถูกส่งต่อไปยังโหมด Fast โดยอัตโนมัติเมื่อเกินโควตา

โหมด Fast คิดค่าบริการอย่างไร?

Token ที่ประมวลผลด้วยโหมด Fast จะคิดค่าบริการเป็นราย Token ในอัตราที่สูงกว่าการประมวลผลแบบมาตรฐาน

ยอดใช้จ่ายรายปีที่ฉันตกลงไว้ผูกกับโหมดการประมวลผลใดโดยเฉพาะหรือไม่?

ไม่ การใช้งานทุกโหมดการประมวลผลจะนับรวมในยอดใช้จ่ายรายปีที่คุณตกลงไว้ในสัญญา Enterprise

ฉันยังได้รับส่วนลดสำหรับ Token อินพุตที่แคชไว้หรือไม่?

ได้รับ! อินพุตที่แคชไว้จะได้รับส่วนลด 50-75% เช่นเดียวกับการประมวลผลแบบมาตรฐาน

ฉันจะดูการใช้งานและค่าใช้จ่ายของโหมด Fast ได้อย่างไร?

หากต้องการดู Token ที่ประมวลผลด้วยโหมด Fast (เดิมเรียกว่าการประมวลผลแบบ Priority) ให้ไปที่แดชบอร์ดการใช้งาน เลือก Chat Completions หรือ Responses แล้วจัดกลุ่มตามประเภทของแพ็กเกจ

หากต้องการดูค่าใช้จ่ายของโหมด Fast ให้ไปที่แดชบอร์ดการใช้งาน แล้วเลือกจัดกลุ่มตามรายการค่าใช้จ่าย

ในแดชบอร์ดการใช้งาน คำขอที่ระบุ service_tier เป็น priority หรือ fast จะยังคงแสดงเป็น priority การแสดงผลนี้จะได้รับการอัปเดตสำหรับโมเดลในอนาคต

โมเดล

โหมด Fast ใช้กับบริบทยาว โมเดลที่ปรับแต่งแล้ว เอ็มเบดดิง และอื่นๆ ได้หรือไม่?

ยังไม่ได้ในขณะนี้ ในอนาคต เราจะพิจารณาว่าจะเปิดให้ใช้โหมด Fast กับผลิตภัณฑ์อื่นๆ นอกเหนือจากโมเดลล่าสุดของเราหรือไม่

โหมด Fast รองรับข้อมูลรูปแบบอื่นๆ อย่างไร?

โหมด Fast รองรับการทำงานกับข้อมูลหลายรูปแบบเช่นเดียวกับการประมวลผลแบบมาตรฐาน โดยเฉพาะอย่างยิ่ง คุณสามารถใช้ภาพเป็นอินพุตในการประมวลผลแบบ Priority ได้ โดยจะประมวลผลด้วยเวลาแฝงต่ำเช่นเดียวกัน

จะรองรับโมเดลในอนาคตหรือไม่?

เรามีแผนที่จะเปิดให้ใช้โหมด Fast กับโมเดล GPT ใหม่ๆ แต่ไม่รับประกันว่าจะรองรับทุกโมเดล

ลิมิตการใช้งาน

ลิมิตการใช้งานเป็นอย่างไร?

การใช้งานการประมวลผลแบบ Priority จะนับตามลิมิตการใช้งานเช่นเดียวกับทราฟฟิก API แบบมาตรฐาน

ขีดจำกัดอัตราการเพิ่มการใช้งานคืออะไร?

โหมด Fast มีขีดจำกัดอัตราการเพิ่มการใช้งานเพื่อรักษาประสิทธิภาพระดับสูงอย่างสม่ำเสมอให้กับลูกค้าทุกราย โดยยังคงคิดค่าบริการตามการใช้งานได้อย่างยืดหยุ่น หาก (ก) ประสิทธิภาพของโหมด Fast ลดลง และ (ข) ทราฟฟิกของลูกค้าเพิ่มขึ้นเร็วเกินไป คำขอบางรายการอาจถูกปรับไปใช้การประมวลผลแบบมาตรฐานแทน ซึ่งเป็นกรณีที่เกิดขึ้นไม่บ่อยนัก

ขีดจำกัดอัตราการเพิ่มการใช้งานปัจจุบันของโหมด Fast ระบุไว้ในเอกสารหลักของเราที่นี่

แนวทางปฏิบัติที่ดีที่สุดเพื่อไม่ให้เกินขีดจำกัดอัตราการเพิ่มการใช้งาน

ค่อยๆ เพิ่มทราฟฟิกเมื่อเปลี่ยนโมเดล ตัวอย่างเช่น หากแอปพลิเคชันของคุณกำลังเปลี่ยนจากสแนปช็อตเดิมไปเป็นสแนปช็อตใหม่ ให้ใช้แฟล็กฟีเจอร์เพื่อทยอยย้ายทราฟฟิกในช่วงเวลาสองสามชั่วโมง แทนที่จะย้ายทั้งหมดในคราวเดียว

หลีกเลี่ยงการรันงานประมวลผลข้อมูลขนาดใหญ่หรืองานแบบอะซิงโครนัสในโหมด Fast งานเหล่านี้อาจทำให้ทราฟฟิกเพิ่มขึ้นอย่างรวดเร็วมาก และมักไม่จำเป็นต้องใช้ประสิทธิภาพที่สูงขึ้นของโหมด Fast

หากคุณพบปัญหาขีดจำกัดอัตราการเพิ่มการใช้งานอยู่เป็นประจำ ให้พิจารณาซื้อโควตาระดับการรองรับการใช้งานแทน

โปรเจกต์หรือองค์กรของฉันใช้ขีดจำกัดอัตราการเพิ่มการใช้งานร่วมกันหรือไม่?

ใช่ ทราฟฟิกทั้งหมดของคุณจะถูกนับรวมในขีดจำกัดอัตราการเพิ่มการใช้งานเดียวกัน

นโยบาย

จะเกิดอะไรขึ้นหากโหมด Fast ไม่สามารถทำเวลาแฝงได้ตามเป้าหมาย?

หากมีคำถามหรือข้อกังวล โปรดติดต่อ AD ของคุณ SLA ของโหมด Fast จะใช้หลักเกณฑ์เดียวกับ SLA ของระดับการรองรับการใช้งาน หากเราไม่สามารถให้บริการตาม SLA ดังกล่าวได้ภายในช่วงเวลาที่กำหนด เราจะมอบเครดิตบริการให้แก่ลูกค้าที่มีสัญญา Enterprise

โหมด Fast ใช้ร่วมกับถิ่นที่อยู่ของข้อมูลได้หรือไม่?

ได้

โหมด Fast ใช้ร่วมกับ ZDR และ BAA ได้หรือไม่?

ได้

Ultrafast สำหรับ GPT-6 Astra

Ultrafast เป็นประเภทของแพ็กเกจที่แยกต่างหากสำหรับเวิร์กโหลดที่ต้องการการตอบสนองจาก GPT-6 Astra ด้วยเวลาแฝงที่ต่ำลง เช่น แอปพลิเคชันแบบโต้ตอบและเวิร์กโฟลว์การเขียนโค้ด

แนวทางด้านราคา ลิมิตการใช้งาน และนโยบายของโหมด Fast ใช้กับคำขอที่ระบุ service_tier="fast" คำขอ Ultrafast ใช้แพ็กเกจ service_tier="ultrafast" ที่แยกต่างหาก

ฉันจะส่งคำขอ Ultrafast ได้อย่างไร?

สำหรับองค์กรที่มีสิทธิ์เข้าถึง Ultrafast ให้ใช้ Responses API โดยระบุค่าดังนี้:

  • โมเดล: gpt-6-astra

  • ประเภทของแพ็กเกจ: ultrafast

  • ส่วนหัวคำขอ: OpenAI-Service-Tier: ultrafast

ต้องระบุส่วนหัวคำขอด้วย นอกเหนือจากการตั้งค่าประเภทของแพ็กเกจ

สำหรับแอปพลิเคชันที่เรียกใช้เครื่องมือ โหมด WebSocket ช่วยให้คุณใช้การเชื่อมต่อเดิมในหลายรอบการโต้ตอบได้ และลดภาระในการสร้างการเชื่อมต่อ

ฉันใช้ส่วนหัวคำขอเดียวกันกับประเภทของแพ็กเกจอื่นๆ ได้หรือไม่?

ในช่วงอัลฟ่าของ Ultrafast ส่วนหัว OpenAI-Service-Tier จะยอมรับเฉพาะค่า ultrafast เท่านั้น การส่งค่าอื่น รวมถึง default, fast หรือ flex จะส่งคืนข้อผิดพลาด HTTP 400 ไม่ต้องใส่ส่วนหัวนี้เมื่อใช้แพ็กเกจประเภทอื่น

ฉันใช้ Ultrafast ใน Work หรือ Codex ได้หรือไม่?

Ultrafast มีให้ใช้ใน Work และ Codex ด้วย สำหรับแพ็กเกจและพื้นที่ทำงานที่มีสิทธิ์ สิทธิ์และการใช้งานตามแพ็กเกจ ChatGPT แตกต่างจากการเข้าถึงผ่าน API

ดูรายละเอียดการเปิดให้ใช้และการใช้งานได้ที่ ChatGPT Work และ Codex

บทความนี้มีประโยชน์หรือไม่