ผลการทดสอบ
ผลการทดสอบและระเบียบวิธี
ChatGPT-6 เทียบกับโมเดลแนวหน้าปัจจุบันอย่างไร — ตารางฉบับเต็ม ข้อควรระวังเบื้องหลังตัวเลขทุกตัว และรายละเอียดว่าจัดทำขึ้นมาอย่างไร
อัปเดตล่าสุด: กันยายน 2026
ตารางเปรียบเทียบส่วนใหญ่มักยื่นคำตัดสินให้คุณโดยไม่มีหลักฐานรองรับ แต่ตารางนี้แสดงตัวเลขให้เห็น แล้วบอกว่าตัวเลขเหล่านั้นมาจากไหน บอกอะไรไม่ได้บ้าง และเหตุใดพรีวิวฟรีจึงทำให้การคำนวณคลาดเคลื่อน
ChatGPT-6 เป็นพรีวิวสำหรับการเข้าถึงล่วงหน้า ดังนั้นควรมองตัวเลขเหล่านี้เป็นแนวโน้ม ไม่ใช่ผลลัพธ์สุดท้าย — สรุปอย่างตรงไปตรงมาคือ "คุณภาพระดับแนวหน้าด้วยราคาที่ไม่มีโมเดลซึ่งเปิดให้ใช้งานจริงใดเทียบได้"
ตารางฉบับเต็ม
เก้าแกนวัด ห้าโมเดล หนึ่งคอลัมน์ที่ใช้งานได้ฟรี
| Metric | ChatGPT-6 | GPT-5.6 | Opus 5 | Gemini 3.7 | Grok 4.6 |
|---|---|---|---|---|---|
| ดัชนีความฉลาด | 71* | 67 | 68 | 66 | 65 |
| การเขียนโค้ดแบบเอเจนต์ | 86* | 84 | 82 | 78 | 76 |
| หน้าต่างบริบท | 400K | 400K | 1M | 2M | 500K |
| เอาต์พุตสูงสุด | 128K | 128K | 64K | 64K | 64K |
| อัตราการประมวลผล (tps) | 58* | 70 | 55 | 92 | 120 |
| ราคา / เอาต์พุต 1M | $0 | $10 | $25 | $10 | $6 |
| หลายรูปแบบข้อมูล | |||||
| น้ำหนักโมเดลแบบเปิด | |||||
| ใช้งานฟรี |
คะแนนรวมจากการทดสอบด้านการใช้เหตุผล ความรู้ และคณิตศาสตร์ (ค่ายิ่งสูงยิ่งดี)
คะแนนการเขียนโค้ดแบบเอเจนต์โดยประมาณ — งานจริงที่มีหลายไฟล์และใช้เครื่องมือ (ค่ายิ่งสูงยิ่งดี)
จำนวนโทเค็นสูงสุดที่โมเดลสามารถพิจารณาได้ในการสนทนาเดียว
การตอบกลับที่ยาวที่สุดที่โมเดลจะสร้างได้ในการเรียกใช้หนึ่งครั้ง
ความเร็วเอาต์พุตมัธยฐานเป็นโทเค็นต่อวินาที (ค่ายิ่งสูงยิ่งเร็ว)
ราคาตั้งต่อโทเค็นเอาต์พุตหนึ่งล้านโทเค็น (ค่ายิ่งต่ำยิ่งถูก)
รองรับการป้อนรูปภาพควบคู่กับข้อความ
สามารถดาวน์โหลดเวตและโฮสต์เองได้
ใช้งานได้ฟรีในขณะนี้
เปรียบเทียบแบบตัวต่อตัว
ต้องการดูผลแบบเจาะจงระหว่างสองรุ่นใช่ไหม เลือกคู่ที่ต้องการเปรียบเทียบ
ระเบียบวิธี
ดัชนีความสามารถเป็นดัชนีรวมจากการทดสอบการให้เหตุผล ความรู้ และคณิตศาสตร์ที่เปิดเผยต่อสาธารณะ โดยมีแนวคิดมาจาก Artificial Analysis Intelligence Index การเขียนโค้ดเชิงตัวแทนสะท้อนงานจริงที่มีหลายไฟล์และดำเนินการโดยใช้เครื่องมือ แทนที่จะเป็นเพียงโค้ดตัวอย่างแบบแยกส่วน
ขนาดบริบท เอาต์พุตสูงสุด อัตราการประมวลผล และราคาเป็นตัวเลขที่ผู้ให้บริการรายงาน ราคาเป็นอัตรารายการต่อโทเค็นเอาต์พุตหนึ่งล้านโทเค็น โดยปกติโทเค็นอินพุตจะมีราคาถูกกว่าและถูกละไว้เพื่อให้ตารางอ่านง่าย
ChatGPT-6 อยู่ในช่วงพรีวิวสำหรับผู้ใช้กลุ่มแรก ดังนั้นตัวเลขของรุ่นนี้ (ทำเครื่องหมายด้วย *) จึงเป็นค่าประมาณที่รายงานโดยชุมชน ไม่ใช่ข้อมูลจากเอกสารของผู้จำหน่าย ตัวเลขอาจเปลี่ยนแปลงเมื่อมีการปรับแต่งรุ่น เราจะอัปเดตหน้านี้เมื่อมีข้อมูลที่ดียิ่งขึ้น
ตัวเลขในวงการนี้เปลี่ยนแปลงอย่างรวดเร็ว ใช้ข้อมูลนี้เป็นแนวทางคร่าว ๆ ในการเลือกรุ่น ไม่ใช่ตารางจัดอันดับผลการทดสอบอย่างเป็นทางการ หากไม่แน่ใจ ให้ทดสอบการประเมินของคุณเองด้วยพรอมต์ของคุณเอง
ดูด้วยตัวคุณเอง
ตัวเลขเป็นเพียงส่วนหนึ่ง ลองมอบหมายงานจริงให้ ChatGPT-6 แล้วประเมินผลลัพธ์ด้วยตัวคุณเอง