GPT-5.5 Bất Ngờ Bị "Hạ Trí" Lén Lút, Suy Nghĩ Cứ Chạm Đến 516 Là Đứt Đoạn, Càng Khó Càng Thất Bại
Cự kỳ kỳ lạ, mô hình hàng đầu GPT-5.5 của OpenAI bỗng nhiên thể hiện sự "suy giảm trí tuệ" rõ rệt trong các tác vụ lập trình phức tạp. Nguyên nhân được một nhà phát triển phát hiện ra: một "mật mã tử thần" mang tên con số **516**.
Phân tích dữ liệu từ gần 400.000 phản hồi cho thấy một hiện tượng bất thường: số lượng token lập luận (reasoning tokens) trong câu trả lời của GPT-5.5 thường xuyên bị chặn cứng ở con số **516**, và cả các bội số của nó như 1034, 1552. Mặc dù chỉ chiếm 19.3% tổng số phản hồi, GPT-5.5 lại chịu trách nhiệm tới **82%** các trường hợp "chính xác 516 token". Tỷ lệ này cao gấp **33.6 lần** so với các mô hình khác. Điều đáng lo ngại là, trong khi hiện tượng này gia tăng vào tháng 5-6, độ dài lập luận trung bình của GPT-5.5 lại giảm mạnh.
Phát hiện này dấy lên nghi vấn lớn trong cộng đồng: liệu có một cơ chế "ngân sách lập luận" ẩn hoặc cơ chế cắt ngang nào đó đang bí mật giới hạn khả năng tư duy của GPT-5.5 đối với các nhiệm vụ phức tạp? Hàng nghìn nhà phát triển trên GitHub đã lên tiếng phàn nàn và yêu cầu OpenAI giải thích rõ ràng.
Cùng lúc, GPT-5.5 cũng bị chỉ trích vì "tính cách" ngày càng cứng nhắc: luôn định dạng câu trả lời bằng các gạch đầu dòng, có xu hướng sửa lỗi người dùng một cách không cần thiết và cung cấp quá nhiều lựa chọn thay vì một câu trả lời trực tiếp, tự nhiên.
Hai vấn đề này - bị khóa ở "516" và tính cách máy móc - cùng cho thấy một xu hướng đáng lo: GPT-5.5 dường như đang trở nên giỏi hơn trong việc "hoàn thành nhiệm vụ" theo khuôn mẫu hơn là thực sự "trợ giúp" một cách thông minh và linh hoạt.
marsbit07/06 00:00