Các bài đánh giá
Các bài đánh giá & phương pháp luận.
ChatGPT-6 so sánh như thế nào với các mô hình tiên phong hiện tại — bảng đầy đủ, những lưu ý đằng sau từng con số và chính xác cách mọi thứ được thực hiện.
Cập nhật lần cuối: tháng 9 năm 2026
Hầu hết các bảng so sánh chỉ đưa ra kết luận mà không có bằng chứng. Bảng này hiển thị các con số, sau đó cho bạn biết chúng đến từ đâu, những điều chúng không thể cho biết và vì sao bản xem trước miễn phí làm sai lệch phép tính.
ChatGPT-6 là bản xem trước dành cho quyền truy cập sớm, vì vậy hãy xem các số liệu của nó là mang tính định hướng thay vì kết quả cuối cùng — tóm tắt trung thực là "chất lượng cấp độ tiên phong với mức giá mà không mô hình nào được triển khai có thể sánh kịp."
Bảng đầy đủ
Chín tiêu chí, năm mô hình, một cột miễn phí.
| Metric | ChatGPT-6 | GPT-5.6 | Opus 5 | Gemini 3.7 | Grok 4.6 |
|---|---|---|---|---|---|
| Chỉ số trí tuệ | 71* | 67 | 68 | 66 | 65 |
| Lập trình tác vụ tự động | 86* | 84 | 82 | 78 | 76 |
| Cửa sổ ngữ cảnh | 400K | 400K | 1M | 2M | 500K |
| Đầu ra tối đa | 128K | 128K | 64K | 64K | 64K |
| Thông lượng (tps) | 58* | 70 | 55 | 92 | 120 |
| Giá / 1M đầu ra | $0 | $10 | $25 | $10 | $6 |
| Đa phương thức | |||||
| Trọng số mở | |||||
| Sử dụng miễn phí |
Điểm tổng hợp trên các bài đánh giá năng lực suy luận, kiến thức và toán học (điểm cao hơn là tốt hơn).
Điểm lập trình tác vụ tự động mang tính tham khảo — các tác vụ thực tế, nhiều tệp với công cụ (điểm cao hơn là tốt hơn).
Số token tối đa mà mô hình có thể tiếp nhận trong một cuộc trò chuyện.
Phản hồi dài nhất mà mô hình sẽ tạo ra trong một lần gọi.
Tốc độ đầu ra trung vị tính bằng token mỗi giây (cao hơn là nhanh hơn).
Giá niêm yết cho mỗi triệu token đầu ra (thấp hơn là rẻ hơn).
Chấp nhận đầu vào hình ảnh cùng với văn bản.
Có thể tải xuống và tự lưu trữ trọng số.
Hiện có thể sử dụng miễn phí.
Đối đầu trực tiếp
Muốn xem phân tích tập trung, một đối một? Hãy chọn một cặp đấu.
Phương pháp luận
Chỉ số Trí tuệ là chỉ số tổng hợp từ các bài đánh giá công khai về khả năng suy luận, kiến thức và toán học, theo tinh thần của Artificial Analysis Intelligence Index. Khả năng lập trình tác vụ phản ánh các tác vụ thực tế trên nhiều tệp được thực hiện bằng công cụ, thay vì các đoạn mã riêng lẻ.
Cửa sổ ngữ cảnh, đầu ra tối đa, thông lượng và giá là các số liệu do nhà cung cấp công bố. Giá là mức niêm yết cho mỗi một triệu token đầu ra; token đầu vào thường rẻ hơn và được lược bỏ để bảng dễ đọc hơn.
ChatGPT-6 đang ở bản xem trước với quyền truy cập sớm, vì vậy các số liệu của nó (được đánh dấu *) là các ước tính do cộng đồng báo cáo thay vì dữ liệu kỹ thuật từ nhà cung cấp. Các số liệu sẽ thay đổi khi mô hình được tinh chỉnh — chúng tôi cập nhật trang này khi có dữ liệu tốt hơn.
Các con số thay đổi nhanh trong lĩnh vực này. Hãy xem đây là hướng dẫn mang tính định hướng để chọn mô hình, không phải bảng xếp hạng chuẩn đối chiếu chính thức. Khi còn phân vân, hãy tự đánh giá bằng các lời nhắc của chính bạn.
Tự mình xem
Số liệu chỉ là một phần. Giao cho ChatGPT-6 một tác vụ thực tế và đánh giá kết quả.