AI đang thách thức độ tin cậy của các nghiên cứu khoa học. Một nghiên cứu gần đây sử dụng AI Agent để kiểm tra và tái hiện kết quả từ 92 bài báo tại hội nghị ICML 2026 cho thấy, chỉ có 8 bài có thể tái hiện hơn 80% kết luận. Lý do bao gồm mã nguồn thiếu file, kết quả không khớp, hoặc mô hình đã ngừng hoạt động. Đáng chú ý hơn, một hệ thống kiểm tra dựa trên GPT-5 phát hiện 99,2% bài báo trên các tạp chí/tuyển tập hàng đầu có ít nhất một lỗi khách quan, chủ yếu là lỗi toán học và công thức. Số lỗi trung bình mỗi bài có xu hướng tăng. Điều này mở ra hướng nghiên cứu mới: thay vì tìm chủ đề mới, các nhà nghiên cứu có thể sử dụng AI để kiểm tra, đặt câu hỏi và tìm lỗi trong các công trình cũ, thậm chí là từ hàng thập kỷ trước. AI cũng phát hiện lỗi trong cơ sở dữ liệu hóa học 75 năm tuổi, cho thấy tiềm năng "xem xét lại" lịch sử khoa học. Tuy nhiên, công cụ AI hiện tại vẫn có độ chính xác giới hạn (83,2%) và cần sự xác minh của con người. Việc công bố bài báo trong tương lai có thể chỉ là bước khởi đầu cho một quy trình xác minh bằng AI liên tục.
marsbit5天前




