คำตอบด่วน: ราคาของ GPT-6 Astra $10 ต่อโทเคนอินพุต 1 ล้าน, $1 ต่อโทเคนข้อมูลเข้าที่เก็บไว้ในแคช 1 ล้านตัว, $12.50 ต่อโทเคนการเขียนแคช 1M, และ $50 ต่อโทเคนออก 1 ล้าน ตามอัตราค่าบริการมาตรฐาน เมื่อจำนวนโทเคนอินพุตยังไม่เกิน 272K เมื่อเกิน 272K โทเคน คำขอทั้งหมดจะเปลี่ยนไปใช้การคิดราคาตามบริบทยาว: $20 โทเคนอินพุต, $2 โทเคนอินพุตที่เก็บในแคช, $25 การเขียนข้อมูลลงในแคช, และ $75 โทเคนเอาต์พุต ต่อ 1M โทเคน OpenAI กำหนดหน้าต่างบริบท 1.05M โทเคน และผลลัพธ์สูงสุด 128K.
ตัวเลขเหล่านี้ทำให้ Astra มีประสิทธิภาพสูง แต่ก็มีค่าใช้จ่ายสูงพอที่จะต้องมีการวางแผนล่วงหน้า การส่งคำขอซ้ำสามารถลดค่าใช้จ่ายลงได้มากเมื่อระบบแคชทำงานได้อย่างมีประสิทธิภาพ ในขณะที่คำขอที่มีจำนวนโทเคนอินพุตเกิน 272K เพียงเล็กน้อย อาจทำให้ค่าใช้จ่ายเพิ่มขึ้นอย่างก้าวกระโดด คู่มือนี้จะแยกราคาอย่างเป็นทางการออกจากตัวอย่างการคำนวณ และจากหกงานปฏิบัติที่เราจะดำเนินการเมื่อ Astra เข้าสู่สภาพแวดล้อมการทดสอบของเรา.

ราคา API GPT-6 Astra
OpenAI แบ่งราคา Standard เป็นสองประเภท คือบริบทสั้นและบริบทยาว โดยค่าเกณฑ์ถูกกำหนดตาม โทเคนอินพุต, ไม่ใช่ผลรวมของข้อมูลเข้าและข้อมูลออกทั้งหมด บริบทสั้นใช้สำหรับคำสั่งที่มีข้อมูลเข้าไม่เกิน 272K โทเคน ส่วนบริบทยาวจะใช้สำหรับคำสั่งที่มีข้อมูลเข้าเกินกว่าจุดนั้น.

ค่าใช้จ่ายต่อ 1 ล้านโทเคน
ระดับราคาที่สูงขึ้นจะใช้กับคำขอทั้งหมด ราคาที่แสดงเป็นราคาต่อ 1 ล้านโทเคน.

รายละเอียดสำคัญที่สุดคือ การใช้ข้อมูลเกิน 272K จะไม่ก่อให้เกิดใบเรียกเก็บเงินที่มีอัตราค่าบริการผสม ตามที่ เอกสารเกี่ยวกับราคา API ของ OpenAI, อัตราที่สูงขึ้นจะนำไปใช้กับคำขอทั้งหมดเมื่อปริมาณข้อมูลที่ป้อนเข้าเกินขีดจำกัด ดังนั้น ทีมที่กำลังเปรียบเทียบ Astra กับรุ่นเรือธงรุ่นก่อนหน้าควรพิจารณาให้ลึกกว่าเพียงราคาป้อนเข้าที่ระบุไว้; ของเรา คู่มือราคา GPT-5.6 ให้ข้อมูลบริบทที่มีประโยชน์สำหรับการหารือเรื่องงบประมาณดังกล่าว.
การเก็บข้อมูลในแคชแบบทันทีสามารถลดค่าใช้จ่ายจากการป้อนข้อมูลซ้ำได้อย่างมีนัยสำคัญ แต่การสร้างแคชนั้นไม่ใช่เรื่องฟรี การเขียนข้อมูลลงในแคชมีค่าใช้จ่ายเท่ากับ 1.25 เท่าของอัตราค่าบริการการป้อนข้อมูลที่ไม่ใช้แคชที่บังคับใช้ การประมวลผลแบบ Batch และ Flex มีค่าใช้จ่าย 50% ของ Standard ส่วน Fast มีค่าใช้จ่ายเป็นสองเท่าของอัตราค่าบริการที่บังคับใช้ การประมวลผลในภูมิภาคที่ตรงตามเงื่อนไขจะเพิ่มค่าใช้จ่ายอีก 10% และ Fast ไม่สามารถใช้งานได้สำหรับ Astra ที่มีข้อกำหนดการเก็บข้อมูลในสหภาพยุโรป (EU data residency).
ค่าใช้จ่ายสำหรับการเรียก API GPT-6 Astra อยู่ที่เท่าไร?
สำหรับคำขอแบบมาตรฐาน ให้คำนวณแต่ละประเภทโทเคนที่ถูกเรียกเก็บเงินแยกกัน แล้วนำผลลัพธ์มารวมกัน:
ค่าใช้จ่ายรวม = ค่าใช้จ่ายของข้อมูลเข้าที่ยังไม่ถูกเก็บในแคช + ค่าใช้จ่ายของข้อมูลเข้าที่ถูกเก็บในแคช + ค่าใช้จ่ายในการเขียนข้อมูลเข้าแคช + ค่าใช้จ่ายของข้อมูลออก.
(0.0125 × $10) + (0.002 × $50)$0.225(0.1 × $10) + (0.005 × $50)$1.25(0.1 × $1) + (0.005 × $50)$0.35(0.3 × $20) + (0.01 × $75)$6.75การประมาณราคาตามอัตราปกติไม่รวมเครื่องมือ ค่าเพิ่มตามภูมิภาค และบริการอื่น ๆ ที่คิดค่าบริการแยกต่างหาก.
ตัวอย่าง 100K แสดงให้เห็นว่าทำไม prefix ที่สามารถใช้ซ้ำได้จึงสำคัญ: การประมาณค่า model-token ลดลงจาก $1.25 เป็น $0.35 เมื่อข้อมูลนำเข้าทั้งหมดถูกจัดเป็นข้อมูลที่เก็บไว้ในแคช นี่เป็นตัวอย่างเพื่อแสดงการกำหนดราคาเท่านั้น ไม่ใช่คำสัญญาว่าทุก prompt ที่ซ้ำกันจะส่งผลให้เกิด cache hit สำหรับการจัดงบประมาณแบบหลายโมเดลที่กว้างขึ้น ให้เปรียบเทียบสมมติฐานของกระบวนการทำงานใน คู่มือแบบจำลอง AI แบบครบวงจร.
โทเค็น GPT-6 Astra, หน้าต่างบริบท และขีดจำกัดผลลัพธ์
The หน้าหลักอย่างเป็นทางการของโมเดล GPT-6 Astra บันทึก หน้าต่างบริบทที่มีโทเค็น 1,050,000 โทเค็น และ a จำนวนโทเค็นสูงสุด 128,000 รายการ. ข้อมูลที่ระบบสามารถประมวลผลได้สิ้นสุด ณ วันที่ 30 เมษายน 2026 ระบบนี้รับข้อมูลเข้าทั้งแบบข้อความและภาพ ส่งคืนผลลัพธ์เป็นข้อความ และสนับสนุนการตั้งค่าความพยายามในการให้เหตุผล ต่ำ, ปานกลาง, สูง, xสูง, และ max.

หน้าต่างบริบทขนาดใหญ่เป็นขีดความสามารถ ไม่ใช่คำแนะนำให้ตอบสนองทุกคำขอ การค้นหา การเลือกเอกสาร การสรุปเนื้อหา และโครงสร้างคำสั่งสามารถช่วยให้ปริมาณข้อมูลที่ป้อนเข้าอยู่ภายในขีดจำกัดราคา 272K ได้ การเลือกโมเดลก็สำคัญเช่นกัน: ผู้พัฒนาที่เน้นด้านการเขียนโปรแกรมสามารถเปรียบเทียบข้อได้เปรียบและข้อเสียใน โมเดล AI ที่ดีที่สุดสำหรับการเขียนโค้ด การวิเคราะห์ แทนที่จะสมมติว่าโมเดลที่มีหน้าต่างกว้างที่สุดจะเหมาะสมที่สุดโดยอัตโนมัติ.
หกภารกิจทดสอบ API GPT-6 Astra ที่ใช้งานได้จริง
สถานะการทดสอบ: สภาพแวดล้อมการทดสอบของเราในปัจจุบันยังไม่ได้เปิดใช้งาน GPT-6 Astra ดังนั้นข้อมูลต่อไปนี้จึงเป็นขั้นตอนการทดสอบ ไม่ใช่ผลการวัดประสิทธิภาพที่อ้างสิทธิ์ ตารางราคาและขีดจำกัดอย่างเป็นทางการช่วยให้เราคำนวณรูปแบบการเรียกเก็บเงินที่คาดการณ์ได้ ส่วนข้อมูลการใช้งานที่วัดได้ ความล่าช้า หัวข้อมูล และภาพหน้าจอ จะถูกเพิ่มเข้ามาหลังจากเส้นทางโมเดลเปิดใช้งานแล้ว.
หกการตรวจสอบ มาตรฐานการพิสูจน์เพียงหนึ่ง
ตรวจสอบการบันทึกบัญชีโทเคน
ขอให้คำนวณค่าใช้จ่ายแบบ JSON โดยใช้โทเคนอินพุต 12,500 โทเคนที่ไม่ได้เก็บไว้ในแคช และโทเคนเอาต์พุต 2,000 โทเคน.
ส่งคืน JSON ที่มีเพียงคีย์ input_cost, output_cost และ total_cost เท่านั้น.การคำนวณที่คาดไว้: $0.125 + $0.10 = $0.225.
การวัดการเก็บข้อมูลชั่วคราวของคำสั่ง
ส่ง prefix ของใบแจ้งหนี้สังเคราะห์เดียวกันสองครั้ง และเปลี่ยนเพียงส่วนการค้นหาสุดท้ายเท่านั้น บันทึกค่าทั้งหมดของข้อมูลเข้า ข้อมูลเข้าที่เก็บไว้ในแคช โทเค็นการเขียนแคช ข้อมูลออก และเวลา.
สัญญาณเข้า Cross 272K
เปรียบเทียบชุดข้อมูลสังเคราะห์ที่มีค่าเทียบเท่ากัน ซึ่งอยู่ทั้งด้านล่างและด้านบนของ 272K บันทึกโทเคนจริง ช่วงอัตรา สถานะ ความล่าช้า และค่าใช้จ่ายรวม.
เปรียบเทียบค่าต่ำสุดกับค่าสูงสุด
ลองแก้ปัญหาค่าใช้จ่าย API รายเดือนเดียวกันที่ ต่ำ และ max. เปรียบเทียบความถูกต้อง ผลลัพธ์ที่แสดงออกมา โทเค็นการให้เหตุผล เวลาที่ผ่านไป และค่าใช้จ่ายที่คาดการณ์.
ตรวจสอบขีดจำกัด 128K
ตั้งค่า จำนวนโทเค็นสูงสุด เป็น 128,001 พร้อมข้อความแจ้งเตือนเล็กๆ ว่า “ตอบกลับเฉพาะด้วย OK” แล้วทำซ้ำด้วยขีดจำกัดทางกฎหมาย.
การตรวจสอบความถูกต้องโดยไม่ต้องซื้อการตอบสนอง 128K.
ตรวจสอบขีดจำกัดการถ่ายทอดสด
บันทึกข้อมูลหัวเรื่อง RPM/TPM และการรีเซ็ตจากการเรียกใช้ปกติ เปรียบเทียบระหว่างโหมด Standard, Batch, Flex และ Fast เฉพาะในกรณีที่บัญชีและภูมิภาคดังกล่าวรองรับเท่านั้น.
จะไม่มีการเผยแพร่ข้อมูลเกี่ยวกับผู้ชนะการทดสอบประสิทธิภาพ, การอ้างอิงค่าความหน่วง, การเข้าถึงแคช หรือปริมาณการใช้งานที่คิดค่าบริการ จนกว่าจะมีผลการตอบกลับที่สำเร็จและภาพหน้าจอ.
ข้อจำกัดอัตราการใช้งาน API GPT-6 Astra
GPT-6 Astra ไม่ได้รับการสนับสนุนในแพ็กเกจฟรี ขีดจำกัดการเผยแพร่จะเพิ่มขึ้นตามระดับการใช้งาน แต่ส่วนหัวของโครงการที่ใช้งานอยู่ยังคงเป็นแหล่งข้อมูลที่ใช้งานได้จริงสำหรับตรวจสอบความจุที่เหลืออยู่และเวลาการรีเซ็ต.
ความจุเพิ่มขึ้นอย่างรวดเร็วที่ระดับ 5
ความสูงของบาร์เป็นตัวอย่างเท่านั้น ค่า RPM, TPM และคิวงานชุดที่ระบุไว้ข้างต้นคือค่าที่ควบคุมจริง.

Batch หรือ Flex สามารถลดอัตราค่าใช้จ่ายต่อโทเคนของโมเดลลงครึ่งหนึ่งได้ เมื่อไม่จำเป็นต้องมีคำตอบทันที Fast อาจเหมาะสำหรับงานที่ให้ความสำคัญกับความหน่วง แต่จะทำให้ราคาเพิ่มขึ้นเป็นสองเท่า และไม่สามารถใช้ร่วมกับข้อกำหนดการเก็บข้อมูลในสหภาพยุโรป (EU data residency) สำหรับ Astra ได้ ก่อนที่จะนำงานไปใช้งานในสภาพแวดล้อมการผลิต ให้เปรียบเทียบค่าใช้จ่ายของโมเดลกับค่าใช้จ่ายของแพลตฟอร์มที่เกี่ยวข้อง; ของเรา คู่มือราคา Codex แสดงให้เห็นว่าทำไมการสมัครสมาชิกผลิตภัณฑ์และการเรียกเก็บเงินผ่าน API จึงไม่ควรนำมาใช้ร่วมกัน.
สิ่งที่ผู้รีวิวในช่วงต้นกำลังชี้ให้เห็น
ผู้สร้างอิสระ Matt Wolfe ได้เผยแพร่วิดีโอตัวอย่างเบื้องต้นที่นำเสนอการเขียนโค้ด การใช้คอมพิวเตอร์ รวมถึงการสาธิต Blender และ Unreal Engine ตัวอย่างเหล่านี้มีประโยชน์ในการเข้าใจรูปแบบการทำงานที่ผู้รีวิวกำลังสำรวจ แต่ไม่ใช่หลักฐานการทดสอบประสิทธิภาพที่ได้รับการควบคุมอย่างเคร่งครัด และไม่สามารถแทนที่การทดสอบ API ข้างต้นได้ การเปรียบเทียบที่กว้างขึ้น เช่น ChatGPT vs Claude vs Gemini ควรถูกตีความว่าเป็นคำแนะนำที่เหมาะกับปริมาณงานเฉพาะ ไม่ใช่ตารางอันดับทั่วไป.

ใครควรใช้ GPT-6 Astra?
Astra เป็นตัวเลือกที่เหมาะสมสำหรับงานเขียนโค้ดที่ซับซ้อน กระบวนการทำงานแบบเอเจนต์ การวิเคราะห์เอกสารขนาดใหญ่ และงานแบบมัลติโมดัล ซึ่งการให้เหตุผลที่แข็งแกร่งขึ้นหรือหน้าต่างบริบทที่กว้างมากสามารถชดเชยค่าใช้จ่ายโทเคนที่สูงได้ ทีมควรทดลองใช้กับงานที่มีขอบเขตแคบและวัดผลได้ และเปรียบเทียบคุณภาพต่อดอลลาร์ ไม่ใช่เพียงคุณภาพของผลลัพธ์เท่านั้น ของเรา ภาพรวมของโมเดล AI ที่ดีที่สุด ให้กรอบการเลือกที่หลากหลายยิ่งขึ้น.
- ใช้ Astra ในกรณีต่อไปนี้: งานนี้มีความซับซ้อน, ความผิดพลาดอาจก่อให้เกิดค่าใช้จ่ายสูง, จำเป็นต้องมีบริบทที่ยาว, หรือโมเดลนี้สามารถแทนที่ขั้นตอนการทำงานหลายขั้นตอนที่มีประสิทธิภาพต่ำกว่าได้.
- ใช้รุ่นที่มีราคาถูกกว่าเมื่อ: งานดังกล่าวเป็นงานประจำ เช่น การจัดประเภท การสกัดข้อมูล การเขียนใหม่ หรือการสร้างเนื้อหาในปริมาณมาก โดยมีข้อกำหนดด้านคุณภาพที่ชัดเจนและไม่ซับซ้อน.
- ควรปรับให้เหมาะสมก่อนเมื่อ: คำขอซ้ำๆ เกิน 272K, สามารถเก็บคำนำหน้าแบบคงที่ขนาดใหญ่ไว้ในแคชได้ หรือความล่าช้าไม่จำเป็นต้องใช้การประมวลผลแบบ Standard หรือ Fast.
สำหรับผู้อ่านที่กำลังเปรียบเทียบตัวเลือกพรีเมียมที่อยู่ติดกัน, การเปรียบเทียบระหว่าง GPT-5.6, Fable 5 และ GPT-5.5 ให้มุมมองอีกด้านเกี่ยวกับค่าใช้จ่าย ความสามารถ และความเหมาะสมของปริมาณงาน GlobalGPT ปัจจุบันมี หน้าหลักของ GPT-6 Astra. เส้นทางผลิตภัณฑ์ดังกล่าวเป็นระบบที่แยกต่างหากจากสภาพแวดล้อมการทดสอบ API ของเรา ซึ่งยังคงไม่เปิดเผย Astra สำหรับการทดสอบทั้งหกครั้งที่วัดในบทความนี้.
คำถามที่พบบ่อยเกี่ยวกับราคา GPT-6 Astra
GPT-6 Astra มีราคาเท่าไรต่อหนึ่งล้านโทเคน?
ตามอัตราค่าบริการมาตรฐานสำหรับโทเคนอินพุตสูงสุด 272K GPT-6 Astra มีค่าใช้จ่าย $10 ต่อ 1M โทเคนอินพุตที่ไม่ได้เก็บในแคช $1 ต่อ 1M โทเคนอินพุตที่เก็บในแคช, $12.50 ต่อ 1 ล้านโทเคนเขียนแคช และ $50 ต่อ 1 ล้านโทเคนผลลัพธ์.
จะเกิดอะไรขึ้นเมื่อคำสั่งสำหรับ GPT-6 Astra มีจำนวนโทเคนเกิน 272K?
เมื่อข้อมูลเข้าเกิน 272K tokens คำขอทั้งหมดจะใช้ราคาตามบริบทยาว: $20 สำหรับข้อมูลเข้า, $2 สำหรับข้อมูลเข้าที่เก็บในแคช, $25 สำหรับการเขียนข้อมูลเข้าแคช และ $75 สำหรับข้อมูลออก ต่อ 1M tokens ตามราคา Standard.
หน้าต่างบริบทของ GPT-6 Astra คืออะไร?
OpenAI บันทึกว่า GPT-6 Astra มีหน้าต่างบริบทขนาด 1,050,000 โทเคน และปริมาณผลลัพธ์สูงสุด 128,000 โทเคน ความจุของบริบทนี้ไม่ส่งผลให้ขีดจำกัดราคา 272K ถูกยกเลิก.
แพ็กเกจ Batch และ Flex มีราคาถูกกว่าแพ็กเกจ Standard หรือไม่?
ใช่ครับ ราคาของ OpenAI สำหรับ Batch และ Flex อยู่ที่ 50% ของอัตราค่าโทเคนมาตรฐานของรุ่น Standard ตัวเลือกเหล่านี้เหมาะสำหรับงานที่สามารถปรับตัวให้เข้ากับเงื่อนไขการประมวลผลได้ และไม่ควรถูกมองว่าเป็นตัวเลือกทดแทนที่เหมือนกันกับคำขอแบบซิงโครนัสของรุ่น Standard.
GPT-6 Astra มีให้บริการในระดับ API ฟรีหรือไม่?
ตารางจำกัดอัตราการใช้งานที่เผยแพร่ของ No. OpenAI ระบุว่า Free tier ไม่ได้รับการสนับสนุน ส่วนระดับการใช้งานแบบเสียค่าใช้จ่ายเริ่มต้นด้วยระดับ Tier 1 ที่มีขีดจำกัด 500 RPM, 500K TPM และคิวแบทช์ 1.5M โทเคน.
GlobalGPT ได้เสร็จสิ้นการทดสอบ GPT-6 Astra แบบปฏิบัติจริงแล้วหรือไม่?
ยังไม่ได้ครับ สภาพแวดล้อมการทดสอบปัจจุบันยังไม่เปิดเผยเส้นทาง GPT-6 Astra ที่ได้รับการตรวจสอบแล้ว ภารกิจทั้งหกในบทความนี้เป็นโปรโตคอลที่ได้รับการเผยแพร่แล้ว และผลการวัดจะได้รับการเพิ่มเข้าไปก็ต่อเมื่อสามารถบันทึกคำขอที่สำเร็จได้.
คำตัดสินสุดท้าย
GPT-6 Astra ผสมผสานหน้าต่างบริบทขนาด 1.05M โทเคน และปริมาณผลลัพธ์สูงสุด 128K พร้อมราคาพรีเมียม อัตราค่าบริการ Standard สำหรับบริบทสั้นเริ่มต้นที่ $10 ต่อ 1 ล้านโทเคนข้อมูลเข้า และ $50 ต่อ 1 ล้านโทเคนข้อมูลออก แต่ขีดจำกัด 272K โทเคน โทเคนการให้เหตุผล การเขียนแคช โหมดการประมวลผล และค่าเพิ่มตามภูมิภาค สามารถส่งผลให้ค่าใช้จ่ายเปลี่ยนแปลงได้อย่างมีนัยสำคัญ ควรประมาณจำนวนโทเคนก่อนส่งคำสั่งที่มีขนาดใหญ่ ตรวจสอบการเก็บในแคชจากข้อมูลการใช้งาน และประเมิน Astra จากมูลค่าของงานที่เสร็จสิ้น แทนที่จะพิจารณาจากราคาหลักเพียงอย่างเดียว.



