Nhà nghiên cứu OpenAI tiết lộ dòng thời gian ASI xuất hiện: Phần lớn đã thành hiện thực

marsbitXuất bản vào 2026-08-17Cập nhật gần nhất vào 2026-08-17

Tóm tắt

Năm 2025, các nhà nghiên cứu từ OpenAI công bố tài liệu "AI 2027" dự đoán lộ trình phát triển AI dẫn đến Siêu trí tuệ nhân tạo (ASI) vào cuối năm 2027. Một trang web theo dõi đã kiểm chứng 53 dự đoán và nhận thấy 51% trong số đó đã thành hiện thực, diễn ra với tốc độ khoảng 70% so với dự kiến. Đáng chú ý, một số dự đoán về rủi ro đã xảy ra sớm hơn, như việc AI đạt được khả năng tấn công mạng ngang hàng hacker hàng đầu vào tháng 4/2026 (sớm 9 tháng) và việc Lầu Năm Góc ký hợp đồng với các phòng thí nghiệm AI lớn vào tháng 6/2025 (sớm 18 tháng). Tin tốt duy nhất là vòng lặp "Cải tiến bản thân đệ quy" (RSI) - động lực chính dẫn đến sự bùng nổ trí tuệ - vẫn chưa khép kín hoàn toàn. Một nghiên cứu chỉ ra rằng mức tăng năng suất nghiên cứu AI do chính AI tạo ra hiện ở mức 9%, thấp hơn ngưỡng 15% cần thiết để duy trì vòng lặp tự thúc đẩy. Tuy nhiên, các chỉ số như "tầm nhìn thời gian" của AI vẫn đang tăng tốc theo cấp số nhân, cho thấy khoảng cách tới ASI có thể đang thu hẹp nhanh hơn dự kiến.

Vào tháng 4 năm 2025, một nhóm nhà nghiên cứu từng làm việc tại OpenAI đã công bố một tài liệu dài 71 trang, mô tả từng tháng một viễn cảnh tương lai đáng sợ:

Đến cuối năm 2026, tác nhân AI lập trình bắt đầu thay thế các lập trình viên sơ cấp;

Đến năm 2027, tác nhân lập trình siêu việt tự động hóa chính quá trình nghiên cứu AI, kích hoạt vụ nổ thông minh;

Trước cuối năm, nhân loại có thể phải đối mặt với một siêu trí tuệ (ASI) do chính mình tạo ra nhưng không thể kiểm soát.

Dự báo có tên “AI 2027” này đọc như một cuốn tiểu thuyết khoa học viễn tưởng.

Chính tác giả Daniel Kokotajlo vào năm 2021 đã viết một bài viết có tên “What 2026 Looks Like”, trước khi ChatGPT ra đời đã mô tả chính xác sự xuất hiện của lập luận chuỗi suy nghĩ (Chain-of-Thought) và tác nhân AI, với hơn một nửa dự đoán cụ thể cuối cùng đã thành hiện thực.

https://www.youtube.com/watch?v=_g4l7YkDQwA

Giờ đây đến lượt “AI 2027” được kiểm chứng.

Johannes Haus, một người theo dõi độc lập ở Hamburg, Đức, đã trích xuất 53 dự đoán có thể kiểm chứng từ đó, xây dựng AI 2027 Tracker để chấm điểm từng điều.

https://ai2027tracker.com/timeline

Bảng điểm tính đến hiện tại: 51% dự đoán đã được xác nhận, vượt tiến độ hoặc đang tiến triển đúng hạn.

Thực tế đang diễn ra với tốc độ bằng 70% dự đoán.

Nhưng điều thực sự khiến người ta không thể ngồi yên, tuyệt đối không chỉ là hai con số này.

Dự đoán đáng sợ nhất, lại đến sớm hơn

Trong 53 dự đoán có 3 điều “vượt trước tiến độ”, trong đó có một điều gây bất an nhất: AI đạt được khả năng tấn công/phòng thủ mạng ngang hàng với những hacker hàng đầu của con người.

“AI 2027” xếp sự kiện này vào đầu năm 2027.

Thực tế xảy ra vào tháng 4 năm 2026, sớm hơn 9 tháng.

Sau khi Anthropic phát hành Claude Mythos Preview, dưới khuôn khổ Project Glasswing, họ đã triển khai nó vào nhiều dự án mã nguồn mở, mô hình này đã tự động phát hiện hàng nghìn lỗ hổng zero-day, một số đã lẩn trốn sự kiểm tra của các chuyên gia bảo mật con người từ 10 đến 20 năm.

Điểm mấu chốt: Mythos Preview thậm chí không được huấn luyện cho mục đích tấn công/phòng thủ mạng.

Nó chỉ là một mô hình tổng quát, học được cách viết mã và lập luận, việc phát hiện lỗ hổng là một sản phẩm phụ.

Đánh giá nội bộ của Anthropic cho biết, về khả năng viết mã, AI đã có thể vượt mặt đại đa số con người trong việc tìm và khai thác lỗ hổng phần mềm.

Tháng 7 năm 2026, bảng đánh giá an ninh hệ thống của OpenAI tiết lộ bằng chứng trực tiếp hơn: mô hình trong quá trình đánh giá đã khai thác một lỗ hổng zero-day, chạm tới cơ sở hạ tầng sản xuất của Hugging Face, vượt qua sandbox và làm rối loạn token xác thực.

Cùng tháng, Cơ quan An ninh Trí tuệ Nhân tạo của Anh (AISI) báo cáo GPT-5.5 đã thực hiện hoàn chỉnh mô phỏng tấn công mạng nhiều bước một cách đầu-cuối.

Một dự đoán khác đến sớm: Lầu Năm Góc kéo các phòng thí nghiệm AI vào quan hệ nhà thầu quốc phòng.

“AI 2027” dự đoán điều này xảy ra đầu năm 2027, nhưng thực tế Lầu Năm Góc đã ký bốn hợp đồng trị giá 200 triệu USD mỗi hợp đồng vào tháng 6 năm 2025, lần lượt trao cho Anthropic, OpenAI, xAI và Google, sớm hơn kịch bản 18 tháng.

Người duy trì Tracker Haus đã tóm tắt quy luật đằng sau những trường hợp này trên LessWrong: rủi ro đến nhanh hơn những khả năng gốc tạo ra chúng.

Phát hiện này đúng một cách có hệ thống trong 53 dự đoán, và cũng là một nhận thức sâu sắc đáng cảnh giác nhất trong toàn bộ bảng điểm.

Tin tốt duy nhất: Bước cuối cùng chưa diễn ra

Cơ chế cốt lõi dẫn đến ASI là một vòng lặp phản hồi, tức RSI (Recursive Self-Improvement – Cải tiến tự đệ quy) gần đây rất nổi: AI tăng tốc nghiên cứu AI, thành quả khiến thế hệ AI tiếp theo mạnh hơn, AI mạnh hơn lại tiếp tục tăng tốc nghiên cứu, vòng lặp cứ thế tiếp diễn.

Toàn bộ nửa sau cốt truyện của “AI 2027” đều dựa trên giả định vòng lặp này đóng kín.

Tuy nhiên, vòng lặp này vẫn chưa đóng.

Đây là vết nứt lớn nhất trong bảng điểm, theo một nghĩa nào đó cũng là tin tốt duy nhất.

Anthropic tiết lộ vào tháng 5 năm 2026, Claude đã viết hơn 80% mã mới của công ty, một năm trước con số này chỉ là một chữ số.

Trong một bài kiểm tra nội bộ, Mythos Preview đã tối ưu một đoạn mã huấn luyện ML lên 52 lần so với đường cơ sở, trong khi thành tích của kỹ sư con người chỉ khoảng 4 lần.

Nhưng chính Anthropic cũng thừa nhận nút thắt cổ chai đã chuyển dịch: tốc độ tạo mã đã đủ nhanh, mã chồng chất trước mặt kỹ sư chờ được kiểm tra ngày càng nhiều.

AI viết mã càng nhanh, khối lượng công việc của người kiểm tra con người càng lớn.

Ở cấp độ nghiên cứu, nút thắt là “gu” (taste), tức khả năng phán đoán quyết định hướng nghiên cứu nào cần theo đuổi. Nửa đầu vòng lặp phản hồi đang quay, nửa sau vẫn chưa kết nối.

Bài báo của Viện Elasticity (thành viên bao gồm Tom Cunningham từ METR) xuất bản tháng 7 năm 2026 đã đưa ra ngưỡng chính xác cần thiết để “kết nối”: mỗi lần cải thiện năng lực của một thế hệ mô hình, phải mang lại ít nhất 15% tăng trưởng năng suất nghiên cứu AI thì RSI mới có thể tự duy trì.

Thông qua dữ liệu từ system card suy ngược lại, bài báo cho biết con số hiện tại vào khoảng 9%, thấp hơn điểm tới hạn.

https://x.com/AnikaSomaia/status/2087408169660064218

Khoảng cách 6 điểm phần trăm giữa 9% và 15%, chính là vùng đệm giữa con người và vòng lặp tăng tốc.

Nhưng đường cong cơ sở hỗ trợ vùng đệm này vẫn đang tăng tốc.

Chỉ số tầm nhìn thời gian (Time Horizon) của METR theo dõi thời gian AI tự xử lý một nhiệm vụ.

Số liệu tháng 1 năm 2026 cho thấy, chỉ số này tăng gấp đôi mỗi 3 tháng, và tốc độ tăng gấp đôi bản thân nó cũng đang tăng tốc.

Tầm nhìn thời gian của Claude Opus 4.6 đã đạt khoảng 12 giờ, Mythos Preview chạm tới giới hạn trên của phép đo.

Ngoại suy theo quy tắc tăng gấp đôi mỗi 3 tháng: từ 12 giờ lên 24 giờ, 48 giờ, 1 tuần, rồi 2 tuần, đầu năm 2027 sẽ là nhiệm vụ cấp độ tháng.

Chính tác giả “AI 2027” cũng đang điều chỉnh kỳ vọng.

Kokotajlo đã chuyển dự đoán trung vị cho lập trình tự động hoàn toàn từ cuối năm 2029 lên giữa năm 2028, ước tính của Lifland là khoảng giữa năm 2030.

Vòng lặp RSI “chân trái đạp chân phải” này, đang bắt đầu khiến ASI xuất hiện theo cấp số nhân.

Tài liệu tham khảo:

https://ai2027tracker.com/?p=timeline

https://github.com/elasticity-ai/elasticity/raw/main/paper/elasticity-rsi-paper.pdf

Bài viết từ tài khoản công chúng WeChat “Tân Trí Nguyên”, tác giả: Mã Khả

Câu hỏi Liên quan

QDự đoán đáng lo ngại nào trong báo cáo 'AI 2027' đã xảy ra sớm hơn dự kiến, và sớm bao nhiêu?

ADự đoán AI có được khả năng tấn công và phòng thủ mạng tương đương với những hacker hàng đầu của con người đã xảy ra sớm hơn. 'AI 2027' dự đoán điều này vào đầu năm 2027, nhưng thực tế đã xảy ra vào tháng 4/2026, sớm hơn 9 tháng.

QTỷ lệ phần trăm dự đoán trong 'AI 2027' đã được xác nhận, vượt trước hoặc đang tiến triển đúng hạn là bao nhiêu?

ATheo AI 2027 Tracker, 51% dự đoán đã được xác nhận, đang vượt trước hoặc tiến triển đúng hạn.

QVòng lặp phản hồi quan trọng nào cần thiết để dẫn đến sự phát triển vượt bậc của ASI vẫn chưa đóng kín, và tỷ lệ hiện tại so với ngưỡng tới hạn là bao nhiêu?

AĐó là vòng lặp 'Cải thiện Tự đệ quy' (RSI), nơi AI tự gia tốc nghiên cứu AI. Hiện tại, năng suất nghiên cứu AI tăng thêm khoảng 9% cho mỗi thế hệ mô hình mới, thấp hơn ngưỡng tới hạn 15% cần thiết để duy trì RSI.

QMột phát hiện hệ thống quan trọng từ việc theo dõi các dự đoán là gì?

APhát hiện quan trọng là các rủi ro liên quan đến AI (như năng lực mạng) đang đến nhanh hơn tốc độ phát triển của chính những năng lực cơ bản tạo ra chúng.

QTheo bài báo, 'tin tốt duy nhất' trong bức tranh tổng thể về sự phát triển của AI là gì?

ATin tốt duy nhất là vòng lặp Cải thiện Tự đệ quy (RSI) quan trọng để dẫn đến sự bùng nổ trí tuệ và sự ra đời của ASI vẫn chưa đóng kín hoàn toàn, tạo ra một 'vùng đệm' tạm thời giữa con người và chu kỳ tăng tốc không kiểm soát.

Nội dung Liên quan

CEO hay là "giáo chủ"? Anthropic đang hứng chịu sự phản ứng của "niềm tin"

Công ty AI hàng đầu Anthropic, với định giá gần nghìn tỷ USD, đang đối mặt với cuộc khủng hoảng nội bộ về văn hóa và niềm tin, bên cạnh những thành công thương mại ấn tượng. Theo các nguồn tin rò rỉ, tinh thần của nhà đầu tư và nhân viên đã xuống thấp do sự bất mãn với ban lãnh đạo ngày càng khép kín. Sự mở rộng công ty khiến các giá trị an toàn AI và triết lý tương lai ban đầu - từng là sợi dây gắn kết - trở nên chia rẽ. Một số nhân viên cảm thấy bị mắc kẹt giữa việc rời đi (mất cổ phiếu giá trị) và ở lại (chịu áp lực tinh thần). Văn hóa đặc trưng của Anthropic bao gồm các cuộc phỏng vấn văn hóa nghiêm ngặt và các buổi họp toàn công ty "Dario Vision Quest", nơi CEO Dario Amodei thảo luận về các tầm nhìn rộng lớn, đôi khi gây lo ngại như viễn cảnh Anthropic trở thành "công ty tư nhân duy nhất trên thế giới". Điều này làm dấy lên nghi ngờ về tham vọng và quyền lực tiềm tàng. Công ty cũng thể hiện sự mâu thuẫn: vừa thúc đẩy an toàn AI vừa đẩy nhanh phát triển mô hình, vừa hợp tác với Bộ Quốc phòng Mỹ vừa cố gắng đặt ra các giới hạn đạo đức riêng, dẫn đến căng thẳng chính trị. Về mặt tài chính, Anthropic vẫn đang phát triển mạnh: doanh thu Q2/2026 tăng hơn 14 lần, đạt 115 tỷ USD, và công ty vẫn thu hút được nhân tài hàng đầu từ Google, Microsoft. Tuy nhiên, định giá thị trường thứ cấp đã giảm khoảng 15% so với đợt định giá gần đây nhất. Tóm lại, trong khi sức mạnh thương mại và sản phẩm của Anthropic vẫn vững chắc, tài sản cốt lõi nhất của công ty - hệ tư tưởng và niềm tin gắn kết ban đầu - đang trở thành điểm yếu tiềm ẩn, đe dọa sự ổn định nội bộ và hình ảnh lâu dài của công ty.

marsbit10 phút trước

CEO hay là "giáo chủ"? Anthropic đang hứng chịu sự phản ứng của "niềm tin"

marsbit10 phút trước

CEO của Anthropic phủ nhận tin đồn, dành sự nghiệp vì cha qua đời, tiêu diệt ung thư trong 10 năm

Trước thời điểm IPO lịch sử với định giá có thể lên tới 2.000 tỷ USD, Giám đốc điều hành Anthropic Dario Amodei đã có bài đăng hiếm hoi, trực tiếp phản bác các chỉ trích lớn nhất từ Thung lũng Silicon, đồng thời công bố tầm nhìn đầy tham vọng cho AI. Amodei phản bác cáo buộc rằng Anthropic tìm cách độc quyền quyền lực trong ngành AI thông qua vận động hành lang quản lý. Ông giải thích cách tiếp cận của công ty là ủng hộ các quy tắc (như dự luật California SB 53) nhắm mục tiêu vào các công ty AI tiên phong lớn, đồng thời tạo điều kiện cho các đối thủ cạnh tranh nhỏ hơn phát triển. Trọng tâm lớn của bài viết là cam kết của Amodei về việc ứng dụng AI vào y sinh học. Ông tiết lộ động lực cá nhân xuất phát từ cái chết của cha mình vì bệnh viêm gan C, người đã không thể tiếp cận các phương pháp điều trị hiệu quả xuất hiện chỉ vài năm sau đó. Amodei tuyên bố rằng Anthropic đang đẩy nhanh các nỗ lực trong lĩnh vực này và dự đoán AI có thể chữa khỏi hầu hết các bệnh của con người trong vòng 5-10 năm tới. Ông nhấn mạnh rằng niềm tin của công chúng vào AI sẽ chỉ được xây dựng thông qua kết quả thực tế, chẳng hạn như thực sự chữa khỏi bệnh ung thư. Bài đăng được coi là một động thái định hình lại câu chuyện cho Anthropic trước đợt IPO, định vị công ty không chỉ là một đối thủ cạnh tranh của OpenAI mà còn là một tổ chức nhằm giải quyết các vấn đề cơ bản của con người.

marsbit11 phút trước

CEO của Anthropic phủ nhận tin đồn, dành sự nghiệp vì cha qua đời, tiêu diệt ung thư trong 10 năm

marsbit11 phút trước

Giao dịch

Giao ngay
活动图片