GPT-5.6 Lần Đầu Vượt Ngưỡng IQ 130 - Đường Ranh Giới Thiên Tài, Thông Minh Hơn 99% Nhân Loại
Hiện nay, 99% dân số toàn cầu có chỉ số IQ thấp hơn một AI. Trong bài kiểm tra IQ ngoại tuyến mới nhất của Tracking AI, nhiều phiên bản của GPT-5.6 đều đạt điểm số ấn tượng: 136 điểm.
Đây là lần đầu tiên một mô hình ngôn ngữ lớn (LLM) vượt qua ngưỡng 130 điểm - "vạch xuất phát của thiên tài" trong thang đo IQ của con người, mà chỉ khoảng 1% dân số đạt được. Điều này có nghĩa là GPT-5.6 được đánh giá là thông minh hơn 99% nhân loại.
Điểm số này có được từ bộ đề "ngoại tuyến" khó và chống gian lận của Tracking AI, không phải từ các bài test công khai. Trên bảng xếp hạng này, các biến thể của GPT-5.6 (bao gồm cả phiên bản thị giác) đồng loạt đạt 136 điểm, dẫn trước đối thủ gần nhất là Claude-5 Fable (130 điểm) một khoảng cách lớn. GPT-5.6 là mô hình đầu tiên phá vỡ rào cản 130 điểm sau một thời gian dài nhiều mô hình hàng đầu khác đều bị kẹt lại.
Không chỉ dừng ở điểm số, khi được đưa vào thực tế công việc, GPT-5.6 thể hiện khả năng thực hành ấn tượng. Các nhà phát triển chia sẻ rằng nó có thể tạo ra một mô phỏng vật lý hoàn chỉnh, xây dựng hệ thống hỗ trợ khách hàng dựa trên RAG, hay sửa lỗi mã hiệu quả chỉ với một gợi ý đơn giản. So với một số mô hình tập trung quá mức vào độ chính xác kỹ thuật, cách tiếp cận thực tế và thiết thực của GPT-5.6 giúp hoàn thành công việc tốt hơn.
Tuy nhiên, cần lưu ý rằng điểm IQ 136 này đến từ một bài kiểm tra cụ thể, tập trung vào nhận thức tiêu chuẩn hóa như nhận diện mẫu và lý luận logic. Nó không đo lường được độ tin cậy, khả năng sử dụng công cụ hay hiệu quả trong các tình huống nghề nghiệp thực tế của AI. Bài kiểm tra IQ chỉ là một lát cắt hẹp của "trí thông minh". Nhưng trải nghiệm thực tế từ người dùng cho thấy GPT-5.6 dường như đang kết hợp ngày càng tốt hơn giữa "biết làm bài kiểm tra" và "biết làm việc thực tế". Thách thức thực sự nằm ở việc giải quyết các vấn đề mới, chưa từng gặp, và không có đáp án để sao chép.
marsbit07/16 08:24