Là một người bình thường, nếu bạn đưa một bài toán hóc búa cho AI, và liên tục bảo nó "tiếp tục", liệu nó có thực sự giải được bài toán đó, giúp bạn giành được một khoản tiền thưởng lớn, thậm chí thay đổi quá trình phát triển của toán học?
Gần đây, giải Fields được công bố, mọi người thảo luận sôi nổi về Toán học + AI, tin rằng cũng có không ít người tưởng tượng ra cốt truyện "văn sướng" tôi vừa miêu tả.
Trên thực tế, cũng thực sự có người đang thử, nhưng quá trình không suôn sẻ như tưởng tượng.
Gần đây, chuyên gia hàng đầu về tính toán thuận nghịch và vật lý tính toán Michael P. Frank đã đăng bài nói rằng, ông đã đặt cho GPT-5.6 Sol một mục tiêu nghiên cứu độ khó cao: khám phá xem Định lý lớn Fermat có tồn tại con đường chứng minh đơn giản hơn chứng minh Wiles–Taylor hay không, tập trung vào tính mô đun của đường cong Frey chuyên biệt, phương pháp giảm vô hạn nhất quán, bất đẳng thức dạng abc số học và thương giống thấp nhất quán; duy trì ghi chép chặt chẽ, xác minh các bổ đề ứng viên thông qua tính toán, và phân biệt rõ ràng giữa kết quả đã được chứng minh và suy đoán.

Nhiệm vụ này đã chạy liên tục trong nền khoảng 33 giờ, tiêu tốn một lượng lớn tài nguyên tính toán. Nhưng cuối cùng, nó đã bị hệ thống OpenAI ngăn chặn cưỡng chế.
GPT-5.6 Sol trong phân tích sau sự kiện tự đưa ra đã viết rằng, có thể có hai lý do: một là hệ thống đánh giá phiên làm việc này chiếm quá nhiều tài nguyên; hai là OpenAI trước đó đã dùng mô hình tương tự thử vấn đề này và thất bại, lần này không muốn lãng phí sức tính toán nữa.

Michael P. Frank dường như đồng ý với phân tích này của GPT-5.6 Sol.

Ngoài ra, GPT-5.6 Sol cũng thành thật báo cáo những việc đã làm trong 33 giờ đó, cốt lõi là: đã làm nhiều công việc vững chắc, biến nhiều "con đường tắt nghe có vẻ khả thi" thành các phát biểu chính xác có thể kiểm chứng, rồi lần lượt bác bỏ hoặc loại trừ. Sản phẩm đầu ra là một tấm bản đồ "đường này không thông", chứ không phải là bản chứng minh. Đề nghị dừng lại ở đây.
Đối với cách làm này của OpenAI, còn có người đưa ra cách giải thích khác có thể: OpenAI có thể đang che giấu, không để mô hình tùy tiện giải quyết các vấn đề toán học siêu khó, sợ bị người khác cướp mất hào quang, hoặc muốn tự mình mang đi khoe. Điều này nhắc nhở mọi người: nếu sau này quá phụ thuộc vào họ, thì đồng nghĩa với việc trao toàn bộ quyền "điều gì có thể được phát hiện" cho một công ty của họ, điều này rất nguy hiểm.


Nhưng rất nhanh, nhà khoa học nghiên cứu cao cấp của OpenAI Noam Brown đã đứng ra chỉ ra sự bất hợp lý của cách nói này, ông nói: "Nếu có người chỉ cần nhập một câu 'continue' (tiếp tục), là dùng mô hình của chúng tôi giải được bài toán Thiên niên kỷ rồi lấy đi giải thưởng 1 triệu đô, thì đó mới là quảng cáo tốt nhất cho OpenAI, không có gì tốt hơn."

Nghe có lý, nhưng người phản bác cho rằng, mở khả năng đỉnh cao cho người dùng thực sự có thể mang lại lợi ích quảng cáo ngắn hạn, nhưng về lâu dài sẽ làm suy yếu lợi thế dẫn đầu của OpenAI trong cuộc đua AI. Trong môi trường cạnh tranh đa người chơi, việc bảo mật / sử dụng ưu tiên nội bộ mô hình mạnh để tăng tốc nghiên cứu của chính mình, quan trọng hơn là để người dùng "giải quyết trước" các vấn đề lớn. Và một khi khả năng trở nên "ai cũng có thể dùng", giá trị quảng cáo sẽ giảm mạnh.
Ngoài ra, những tranh cãi về quản lý gần đây cũng khiến OpenAI có lý do để bảo toàn thực lực. Nếu người dùng dùng phiên bản công khai giải được vấn đề toán học độ khó cao, thì đồng nghĩa với việc chứng minh công khai "mô hình này thực ra rất mạnh", ngược lại sẽ dẫn đến rắc rối về quản lý. Trong trường hợp này, việc cố ý cung cấp phiên bản mô hình bị làm yếu ra bên ngoài, còn nội bộ giữ lại phiên bản siêu mạnh nghe có vẻ là cách làm hợp lý.

Tuy nhiên, cũng có người từ góc độ kỹ thuật chỉ ra một khả năng khác: trong codex-cli, "goal blocked" có nghĩa là mô hình trong 3 lượt suy luận (turns) liên tiếp liên tục va phải cùng một điểm giới hạn / chặn (blocker). Vì vậy, nhiệm vụ bị tổ chức có thể là cơ chế an toàn thông thường / ngăn chặn treo máy khi mô hình chạy, chứ không phải là sự chặn đặc biệt nhắm vào bài toán khó.

Lại có người nói, đây có thể chỉ là do một lỗi (bug) gây ra. Cụ thể, Sol phiên bản 5.6 khi chạy nhiệm vụ thời gian dài có một lỗi khó chịu, cách giải quyết tạm thời là: chuyển về phiên bản 5.5, nén ngữ cảnh lại, dùng 5.5 chạy tiếp vài phút, sau đó chuyển lại sang Sol phiên bản 5.6. "Nếu bạn muốn giữ nguyên một phiên làm việc (session), sẽ bị kẹt không thoát ra được."

Bạn nghĩ sao? Chào mừng chia sẻ trải nghiệm dùng AI đột phá bài toán khó hoặc bị nó làm kẹt trong phần bình luận.
Liên kết tham khảo:
https://x.com/lu_sichu/status/2081367506468360495
Bài viết này đến từ tài khoản công chúng WeChat "Cỗ máy Chi Tâm" (ID:almosthuman2014), tác giả: Trương Thiến








