ผลการทดสอบ

ผลการทดสอบและระเบียบวิธี

ChatGPT-6 เทียบกับโมเดลแนวหน้าปัจจุบันอย่างไร — ตารางฉบับเต็ม ข้อควรระวังเบื้องหลังตัวเลขทุกตัว และรายละเอียดว่าจัดทำขึ้นมาอย่างไร

อัปเดตล่าสุด: กันยายน 2026

ตารางเปรียบเทียบส่วนใหญ่มักยื่นคำตัดสินให้คุณโดยไม่มีหลักฐานรองรับ แต่ตารางนี้แสดงตัวเลขให้เห็น แล้วบอกว่าตัวเลขเหล่านั้นมาจากไหน บอกอะไรไม่ได้บ้าง และเหตุใดพรีวิวฟรีจึงทำให้การคำนวณคลาดเคลื่อน

ChatGPT-6 เป็นพรีวิวสำหรับการเข้าถึงล่วงหน้า ดังนั้นควรมองตัวเลขเหล่านี้เป็นแนวโน้ม ไม่ใช่ผลลัพธ์สุดท้าย — สรุปอย่างตรงไปตรงมาคือ "คุณภาพระดับแนวหน้าด้วยราคาที่ไม่มีโมเดลซึ่งเปิดให้ใช้งานจริงใดเทียบได้"

ตารางฉบับเต็ม

เก้าแกนวัด ห้าโมเดล หนึ่งคอลัมน์ที่ใช้งานได้ฟรี

Metric
ChatGPT-6
GPT-5.6
Opus 5
Gemini 3.7
Grok 4.6
ดัชนีความฉลาด71*67686665
การเขียนโค้ดแบบเอเจนต์86*84827876
หน้าต่างบริบท400K400K1M2M500K
เอาต์พุตสูงสุด128K128K64K64K64K
อัตราการประมวลผล (tps)58*705592120
ราคา / เอาต์พุต 1M$0$10$25$10$6
หลายรูปแบบข้อมูล
น้ำหนักโมเดลแบบเปิด
ใช้งานฟรี
ดัชนีความฉลาด

คะแนนรวมจากการทดสอบด้านการใช้เหตุผล ความรู้ และคณิตศาสตร์ (ค่ายิ่งสูงยิ่งดี)

การเขียนโค้ดแบบเอเจนต์

คะแนนการเขียนโค้ดแบบเอเจนต์โดยประมาณ — งานจริงที่มีหลายไฟล์และใช้เครื่องมือ (ค่ายิ่งสูงยิ่งดี)

หน้าต่างบริบท

จำนวนโทเค็นสูงสุดที่โมเดลสามารถพิจารณาได้ในการสนทนาเดียว

เอาต์พุตสูงสุด

การตอบกลับที่ยาวที่สุดที่โมเดลจะสร้างได้ในการเรียกใช้หนึ่งครั้ง

อัตราการประมวลผล (tps)

ความเร็วเอาต์พุตมัธยฐานเป็นโทเค็นต่อวินาที (ค่ายิ่งสูงยิ่งเร็ว)

ราคา / เอาต์พุต 1M

ราคาตั้งต่อโทเค็นเอาต์พุตหนึ่งล้านโทเค็น (ค่ายิ่งต่ำยิ่งถูก)

หลายรูปแบบข้อมูล

รองรับการป้อนรูปภาพควบคู่กับข้อความ

น้ำหนักโมเดลแบบเปิด

สามารถดาวน์โหลดเวตและโฮสต์เองได้

ใช้งานฟรี

ใช้งานได้ฟรีในขณะนี้

ระเบียบวิธี

ดัชนีความสามารถเป็นดัชนีรวมจากการทดสอบการให้เหตุผล ความรู้ และคณิตศาสตร์ที่เปิดเผยต่อสาธารณะ โดยมีแนวคิดมาจาก Artificial Analysis Intelligence Index การเขียนโค้ดเชิงตัวแทนสะท้อนงานจริงที่มีหลายไฟล์และดำเนินการโดยใช้เครื่องมือ แทนที่จะเป็นเพียงโค้ดตัวอย่างแบบแยกส่วน

ขนาดบริบท เอาต์พุตสูงสุด อัตราการประมวลผล และราคาเป็นตัวเลขที่ผู้ให้บริการรายงาน ราคาเป็นอัตรารายการต่อโทเค็นเอาต์พุตหนึ่งล้านโทเค็น โดยปกติโทเค็นอินพุตจะมีราคาถูกกว่าและถูกละไว้เพื่อให้ตารางอ่านง่าย

ChatGPT-6 อยู่ในช่วงพรีวิวสำหรับผู้ใช้กลุ่มแรก ดังนั้นตัวเลขของรุ่นนี้ (ทำเครื่องหมายด้วย *) จึงเป็นค่าประมาณที่รายงานโดยชุมชน ไม่ใช่ข้อมูลจากเอกสารของผู้จำหน่าย ตัวเลขอาจเปลี่ยนแปลงเมื่อมีการปรับแต่งรุ่น เราจะอัปเดตหน้านี้เมื่อมีข้อมูลที่ดียิ่งขึ้น

ตัวเลขในวงการนี้เปลี่ยนแปลงอย่างรวดเร็ว ใช้ข้อมูลนี้เป็นแนวทางคร่าว ๆ ในการเลือกรุ่น ไม่ใช่ตารางจัดอันดับผลการทดสอบอย่างเป็นทางการ หากไม่แน่ใจ ให้ทดสอบการประเมินของคุณเองด้วยพรอมต์ของคุณเอง

ดูด้วยตัวคุณเอง

ตัวเลขเป็นเพียงส่วนหนึ่ง ลองมอบหมายงานจริงให้ ChatGPT-6 แล้วประเมินผลลัพธ์ด้วยตัวคุณเอง

เปิดคอนโซล