Một phần ba bài báo trên arXiv, hoá ra là do AI viết?
Ngay gần đây, một nghiên cứu của unslop đã gây xôn xao khắp cộng đồng mạng nước ngoài.
Trong một năm qua, 65% bài báo mới trong lĩnh vực khoa học máy tính, đã bị công cụ phát hiện của họ đánh dấu đỏ.
Cư dân mạng thậm chí còn đặt ra một thuật ngữ riêng cho hiện tượng này – "Thời đại nước gạo lớn".
Nhưng cùng thời kỳ đó, các bài báo toán học lại chỉ có 0.7%.

ChatGPT vừa kêu, đường cong bay vọt lên ngay tại chỗ
Trong nghiên cứu này, nhóm đã quét 12750 bài báo arXiv, với khoảng thời gian trải dài từ tháng 1/2023 thẳng đến tháng 7/2026.
Mục tiêu khóa vào mười ngành học, mỗi lĩnh vực mỗi tháng lấy mẫu khoảng 25 bài toàn văn.
Nhóm đối chứng được chọn vào giai đoạn 2021 đến 2022, đó là thời đại thuần túy của con người trước khi ChatGPT ra đời.

Kết quả cho thấy, từ 2021 đến 2022, tỷ lệ đánh dấu ổn định ở mức 0.4%; nhưng sau khi ChatGPT ra mắt, đường cong đã bùng nổ chỉ trong vài tháng.
Trong quý đầy đủ gần đây nhất, tỷ lệ đánh dấu đã đạt 32%, còn vào đầu năm 2026, đỉnh điểm thậm chí tiến sát 39%.

Phân theo ngành học, khoa học máy tính thê thảm nhất, với tỷ lệ đánh dấu cao tới 65%.
Hãy nhớ rằng trước khi ChatGPT ra đời, giá trị chuẩn của nó chỉ là 0.2%. Chỉ ba năm ngắn ngủi, con số đã tăng vọt hơn 300 lần.
Theo sau là sinh học định lượng 56.3%, kỹ thuật điện 51.3%, kinh tế và tài chính 47%; tiếp theo, vật lý ứng dụng 34%, thống kê 31.3%, vật lý vật chất ngưng tụ 24%, vật lý năng lượng cao 14%, vật lý thiên văn 10.7%.
Dòng cuối cùng của bảng xếp hạng là toán học: 0.7%.
Và đây mới chỉ là giới hạn dưới. Nếu giấu văn bản AI đủ kín, công cụ phát hiện sẽ không nhận ra được.

Cùng một máy dò, cùng một kho bài báo, chênh lệch tiến sát 100 lần.
Rốt cuộc là các nhà toán học kiên trì viết tay thuần túy? Hay là cỗ máy này trước công thức toán học, căn bản chỉ là một kẻ mù?
0.7% chạm đáy, là do máy móc bị mù
Thực ra, đáp án đã được chính unslop tự tay viết vào báo cáo.
Hãy nghĩ xem, một bài báo toán học chuẩn mực rốt cuộc trông như thế nào? Đầy màn hình là ký hiệu, công thức, định lý và chứng minh, những câu văn xuôi thực sự viết bằng tiếng Anh, ít đến đáng thương.
Đúng lúc cỗ máy dò này chỉ nhận diện chữ viết. Nó để mắt đến cấu trúc câu, thói quen dùng từ, cách tổ chức đoạn văn.
Mà mấy dòng chữ còn sót lại trong bài báo toán học, toàn là những cách diễn đạt khuôn mẫu kiểu "Giả sử X là...", "Từ Bổ đề 3 có thể suy ra...", hoàn toàn không cùng một kênh với tiếng Anh khoa học mà máy dò từng thấy khi được huấn luyện.
Vì vậy, chính nhóm nghiên cứu cũng thừa nhận, nghiên cứu hiện tại còn nhiều hạn chế:
0.7% của toán học hiện vẫn chưa nói lên điều gì. Có thể là các nhà toán học thực sự không hay dùng AI, cũng có thể là máy dò không hiểu bài báo toán, nhưng dữ liệu này không phân biệt được là loại nào.
Nhóm đối chứng cũng tương đối nhỏ. Mỗi ngành chỉ có 200 bài báo trước thời ChatGPT, với tỷ lệ báo động sai 0.4%, trong 2000 bài tổng cộng chỉ có 8 bài bị đánh dấu. Mức độ này, chỉ có thể coi là ước tính thô.
Hơn nữa là điều đã nói ở trên, máy dò không bắt hết được. Vì vậy, những con số này đều chỉ là giới hạn dưới, tỷ lệ thực tế chỉ có thể cao hơn.
Nơi càng quay cuồng, càng không rời được AI
Vậy rốt cuộc, ai là người đang dùng AI viết bài báo?
Câu trả lời, nằm trong một nghiên cứu khác kéo dài hai năm của Stanford.
Tháng 3/2024, nhóm Weixin Liang của Stanford lần đầu tiên đưa thước đo vào quá trình phản biện ngang hàng: trong ý kiến phản biện của ICLR 2024, khoảng 10.6% câu đã được LLM sửa đổi đáng kể. Bài báo chưa kiểm tra xong, chính người phản biện đã dùng trước.
Tháng 8/2025, vẫn là nhóm này, mở rộng mẫu lên 1.12 triệu bài báo, và trực tiếp đăng lên tạp chí "Nature Human Behaviour".
Nghiên cứu cho thấy, tính đến tháng 9/2024, tỷ lệ sửa đổi bằng LLM trong phần tóm tắt bài báo CS cao nhất đã đạt 22.5%. Và người dùng nhiều nhất, là những nhà nghiên cứu đăng bản in trước nhiều nhất, đâm sâu vào những lĩnh vực cạnh tranh khốc liệt nhất.

Lĩnh vực càng quay cuồng, dùng càng nhiều.
Ở đây, viết bằng AI đã trở thành cuộc chạy đua vũ trang: đồng nghiệp đều dùng AI để tăng tốc, người chỉ viết tay, nhịp độ đã chậm một bước.
Chẳng trách một bài chia sẻ liên quan được lan truyền rộng rãi trên X, dòng chữ đầu tiên trong phần chú thích là: "Prompt: Viết một bài báo có thể đăng lên arXiv."

Nó ngửi là "mùi", không phải là AI
Tuy nhiên, đừng vội lấy con số 65% này để kết tội.
Nhóm nghiên cứu trong báo cáo cũng thừa nhận, máy dò không phân biệt được "AI sửa qua một lượt ngữ pháp" và "cả bài do máy móc đại công", nó chỉ nhận ra nồng độ mùi máy móc trong chữ viết.
Vì vậy cách hiểu đúng về 65%, là "65% bài báo có mùi giống AI", chứ không phải "65% bài báo là do AI viết".
Nhưng rắc rối nằm ở chỗ, thứ mùi máy móc này, chính con người cũng có thể nhiễm phải.
Có nhà nghiên cứu không tin, ném bài báo cũ của chính mình từ nhiều năm trước vào công cụ phát hiện, kết quả 27% đến 74% nội dung bị đánh dấu đỏ.
Hãy nhớ rằng ở thời đại đó, ChatGPT còn chưa có bóng dáng.

Nguyên nhân không khó tìm.
Mở các tạp chí học thuật ngày nay ra, đầy trang là mô hình ngôn ngữ lớn, kiểm tra chuẩn, tiên phong nhất trong ngành. Cách diễn đạt càng chuẩn mực, cấu trúc càng chỉn chu, càng dễ đụng phải đặc điểm máy móc mà công cụ dò xác định.
Hơn nữa, LLM vốn dĩ chính là được huấn luyện từ loại bài báo này. Không phải học giả viết giống AI, mà là AI sinh ra đã viết giống học giả.

Khi tất cả chữ viết đều có tình nghi
Thực ra hai năm nay, chúng ta đều đang làm cùng một việc với máy dò.
Đọc một đoạn văn bằng phẳng, câu chữ chỉn chu, thỉnh thoảng nhảy ra "không những... mà còn...", trong lòng liền gõ một tiếng: Cái này sợ không phải AI viết chứ?
Máy dò của unslop, tương đương với việc biến thứ khứu giác huyền học này, thành một cỗ máy có thể sản xuất hàng loạt con số.
Xét cho cùng, một khi nghi ngờ đã lọt vào đầu óc, thì không thể tháo gỡ được nữa.
Trước đây, "viết ra" bản thân nó đã là một sự đảm bảo. Một người sẵn sàng bỏ vài giờ tổ chức chữ viết, ít nhất chứng minh anh ta nghiêm túc.
Bây giờ viết đẹp đến mấy, cũng có thể chỉ đổi lại một câu "AI đấy à".
Một số người thậm chí bắt đầu cố tình tránh những từ ngữ mình dùng nửa đời người, chỉ vì chúng "nghe quá giống AI".

Ngày nay, "mùi AI" đang trở thành một tội nguyên thuỷ kiểu mới quét qua giới chữ viết.
Buồn cười thay, cho đến hôm nay, chúng ta thậm chí còn chưa thể đo lường chính xác thứ "mùi AI" này rốt cuộc cấu thành từ cái gì.
Bài viết từ tài khoản công chúng WeChat "Tân Trí Nguyên", tác giả: ASI Khải Thị Lục






