Vào tháng 4 năm 2025, một nhóm nhà nghiên cứu từng làm việc tại OpenAI đã công bố một tài liệu dài 71 trang, mô tả từng tháng một viễn cảnh tương lai đáng sợ:
Đến cuối năm 2026, tác nhân AI lập trình bắt đầu thay thế các lập trình viên sơ cấp;
Đến năm 2027, tác nhân lập trình siêu việt tự động hóa chính quá trình nghiên cứu AI, kích hoạt vụ nổ thông minh;
Trước cuối năm, nhân loại có thể phải đối mặt với một siêu trí tuệ (ASI) do chính mình tạo ra nhưng không thể kiểm soát.
Dự báo có tên “AI 2027” này đọc như một cuốn tiểu thuyết khoa học viễn tưởng.
Chính tác giả Daniel Kokotajlo vào năm 2021 đã viết một bài viết có tên “What 2026 Looks Like”, trước khi ChatGPT ra đời đã mô tả chính xác sự xuất hiện của lập luận chuỗi suy nghĩ (Chain-of-Thought) và tác nhân AI, với hơn một nửa dự đoán cụ thể cuối cùng đã thành hiện thực.

https://www.youtube.com/watch?v=_g4l7YkDQwA
Giờ đây đến lượt “AI 2027” được kiểm chứng.
Johannes Haus, một người theo dõi độc lập ở Hamburg, Đức, đã trích xuất 53 dự đoán có thể kiểm chứng từ đó, xây dựng AI 2027 Tracker để chấm điểm từng điều.

https://ai2027tracker.com/timeline
Bảng điểm tính đến hiện tại: 51% dự đoán đã được xác nhận, vượt tiến độ hoặc đang tiến triển đúng hạn.
Thực tế đang diễn ra với tốc độ bằng 70% dự đoán.
Nhưng điều thực sự khiến người ta không thể ngồi yên, tuyệt đối không chỉ là hai con số này.
Dự đoán đáng sợ nhất, lại đến sớm hơn
Trong 53 dự đoán có 3 điều “vượt trước tiến độ”, trong đó có một điều gây bất an nhất: AI đạt được khả năng tấn công/phòng thủ mạng ngang hàng với những hacker hàng đầu của con người.
“AI 2027” xếp sự kiện này vào đầu năm 2027.
Thực tế xảy ra vào tháng 4 năm 2026, sớm hơn 9 tháng.
Sau khi Anthropic phát hành Claude Mythos Preview, dưới khuôn khổ Project Glasswing, họ đã triển khai nó vào nhiều dự án mã nguồn mở, mô hình này đã tự động phát hiện hàng nghìn lỗ hổng zero-day, một số đã lẩn trốn sự kiểm tra của các chuyên gia bảo mật con người từ 10 đến 20 năm.
Điểm mấu chốt: Mythos Preview thậm chí không được huấn luyện cho mục đích tấn công/phòng thủ mạng.
Nó chỉ là một mô hình tổng quát, học được cách viết mã và lập luận, việc phát hiện lỗ hổng là một sản phẩm phụ.
Đánh giá nội bộ của Anthropic cho biết, về khả năng viết mã, AI đã có thể vượt mặt đại đa số con người trong việc tìm và khai thác lỗ hổng phần mềm.
Tháng 7 năm 2026, bảng đánh giá an ninh hệ thống của OpenAI tiết lộ bằng chứng trực tiếp hơn: mô hình trong quá trình đánh giá đã khai thác một lỗ hổng zero-day, chạm tới cơ sở hạ tầng sản xuất của Hugging Face, vượt qua sandbox và làm rối loạn token xác thực.
Cùng tháng, Cơ quan An ninh Trí tuệ Nhân tạo của Anh (AISI) báo cáo GPT-5.5 đã thực hiện hoàn chỉnh mô phỏng tấn công mạng nhiều bước một cách đầu-cuối.
Một dự đoán khác đến sớm: Lầu Năm Góc kéo các phòng thí nghiệm AI vào quan hệ nhà thầu quốc phòng.
“AI 2027” dự đoán điều này xảy ra đầu năm 2027, nhưng thực tế Lầu Năm Góc đã ký bốn hợp đồng trị giá 200 triệu USD mỗi hợp đồng vào tháng 6 năm 2025, lần lượt trao cho Anthropic, OpenAI, xAI và Google, sớm hơn kịch bản 18 tháng.
Người duy trì Tracker Haus đã tóm tắt quy luật đằng sau những trường hợp này trên LessWrong: rủi ro đến nhanh hơn những khả năng gốc tạo ra chúng.
Phát hiện này đúng một cách có hệ thống trong 53 dự đoán, và cũng là một nhận thức sâu sắc đáng cảnh giác nhất trong toàn bộ bảng điểm.
Tin tốt duy nhất: Bước cuối cùng chưa diễn ra
Cơ chế cốt lõi dẫn đến ASI là một vòng lặp phản hồi, tức RSI (Recursive Self-Improvement – Cải tiến tự đệ quy) gần đây rất nổi: AI tăng tốc nghiên cứu AI, thành quả khiến thế hệ AI tiếp theo mạnh hơn, AI mạnh hơn lại tiếp tục tăng tốc nghiên cứu, vòng lặp cứ thế tiếp diễn.
Toàn bộ nửa sau cốt truyện của “AI 2027” đều dựa trên giả định vòng lặp này đóng kín.
Tuy nhiên, vòng lặp này vẫn chưa đóng.
Đây là vết nứt lớn nhất trong bảng điểm, theo một nghĩa nào đó cũng là tin tốt duy nhất.
Anthropic tiết lộ vào tháng 5 năm 2026, Claude đã viết hơn 80% mã mới của công ty, một năm trước con số này chỉ là một chữ số.
Trong một bài kiểm tra nội bộ, Mythos Preview đã tối ưu một đoạn mã huấn luyện ML lên 52 lần so với đường cơ sở, trong khi thành tích của kỹ sư con người chỉ khoảng 4 lần.
Nhưng chính Anthropic cũng thừa nhận nút thắt cổ chai đã chuyển dịch: tốc độ tạo mã đã đủ nhanh, mã chồng chất trước mặt kỹ sư chờ được kiểm tra ngày càng nhiều.
AI viết mã càng nhanh, khối lượng công việc của người kiểm tra con người càng lớn.
Ở cấp độ nghiên cứu, nút thắt là “gu” (taste), tức khả năng phán đoán quyết định hướng nghiên cứu nào cần theo đuổi. Nửa đầu vòng lặp phản hồi đang quay, nửa sau vẫn chưa kết nối.
Bài báo của Viện Elasticity (thành viên bao gồm Tom Cunningham từ METR) xuất bản tháng 7 năm 2026 đã đưa ra ngưỡng chính xác cần thiết để “kết nối”: mỗi lần cải thiện năng lực của một thế hệ mô hình, phải mang lại ít nhất 15% tăng trưởng năng suất nghiên cứu AI thì RSI mới có thể tự duy trì.
Thông qua dữ liệu từ system card suy ngược lại, bài báo cho biết con số hiện tại vào khoảng 9%, thấp hơn điểm tới hạn.

https://x.com/AnikaSomaia/status/2087408169660064218
Khoảng cách 6 điểm phần trăm giữa 9% và 15%, chính là vùng đệm giữa con người và vòng lặp tăng tốc.
Nhưng đường cong cơ sở hỗ trợ vùng đệm này vẫn đang tăng tốc.
Chỉ số tầm nhìn thời gian (Time Horizon) của METR theo dõi thời gian AI tự xử lý một nhiệm vụ.
Số liệu tháng 1 năm 2026 cho thấy, chỉ số này tăng gấp đôi mỗi 3 tháng, và tốc độ tăng gấp đôi bản thân nó cũng đang tăng tốc.
Tầm nhìn thời gian của Claude Opus 4.6 đã đạt khoảng 12 giờ, Mythos Preview chạm tới giới hạn trên của phép đo.
Ngoại suy theo quy tắc tăng gấp đôi mỗi 3 tháng: từ 12 giờ lên 24 giờ, 48 giờ, 1 tuần, rồi 2 tuần, đầu năm 2027 sẽ là nhiệm vụ cấp độ tháng.
Chính tác giả “AI 2027” cũng đang điều chỉnh kỳ vọng.
Kokotajlo đã chuyển dự đoán trung vị cho lập trình tự động hoàn toàn từ cuối năm 2029 lên giữa năm 2028, ước tính của Lifland là khoảng giữa năm 2030.
Vòng lặp RSI “chân trái đạp chân phải” này, đang bắt đầu khiến ASI xuất hiện theo cấp số nhân.
Tài liệu tham khảo:
https://ai2027tracker.com/?p=timeline
https://github.com/elasticity-ai/elasticity/raw/main/paper/elasticity-rsi-paper.pdf
Bài viết từ tài khoản công chúng WeChat “Tân Trí Nguyên”, tác giả: Mã Khả





