Thật choáng ngợp!
AI bắt đầu dự đoán toàn bộ vũ trụ—
LLM dự đoán mô tả ngôn ngữ của thế giới, mô hình thế giới video dự đoán hình ảnh (động), và lần này trực tiếp dự đoán trạng thái vật lý không-thời gian bốn chiều.
Điều gây sốc nhất là, nó sử dụng kiến trúc hoàn toàn mới "Neural Operators", thay vì Transformer đang thống trị hiện nay.
Trong một lần suy luận duy nhất, nó trực tiếp xuất ra quỹ đạo bốn chiều hoàn chỉnh, tính luôn cả chiều thời gian.
Độ dài ngữ cảnh cần thiết cho việc này chắc chắn là rất lớn, và hiện tại công ty khởi nghiệp Accelerated Understanding đã nâng ngữ cảnh khi huấn luyện lên đến mức nghìn tỷ (1T), và khi suy luận vượt quá 5 nghìn tỷ!

5 nghìn tỷ là khái niệm gì? Con số này gấp 5 triệu lần so với các LLM hàng đầu hiện nay! Tương đương với việc bạn để AI đọc một mạch tác phẩm "Chiến tranh và Hòa bình" 5 triệu lần, và nó nhớ hết tất cả.
Bạn hãy cảm nhận, hãy cảm nhận thật kỹ.
Thời gian không phải là thứ cơ bản, nó giống như một biểu hiện phát sinh từ cấu trúc thông tin sâu hơn, có phải khá thú vị không? Nếu đẩy ý tưởng này đến cực hạn, thì chẳng khác nào đang tạo ra toàn bộ vũ trụ vật lý.
Điều đáng kinh ngạc hơn nữa là, hai nhà sáng lập của công ty khởi nghiệp này vừa từ chối lời mời cực kỳ hậu hĩnh từ cựu tỷ phú giàu nhất thế giới Jeff Bezos, với lời đề nghị 35% cổ phần, mức lương 2 triệu đô la Mỹ một năm cùng với cam kết đầu tư hơn 20 tỷ đô la Mỹ.
Và đứng sau họ, những "cổ đông tinh thần" và có lẽ là bàn tay thúc đẩy bí mật, có lẽ chính là người đàn ông mặc áo da — Giám đốc điều hành Nvidia Jensen Huang.
Ngữ cảnh 5 nghìn tỷ không phải là "Superintelligent An toàn" của Ilya
Hôm qua, một nhà đầu tư lớn ở Thung lũng Silicon nói một cách mập mờ, nhưng cả mạng xã hội sôi sục, suy đoán rằng SSI của Ilya lần này có thể sẽ ra đòn lớn.

Và bây giờ, câu trả lời dường như đã được hé lộ: không phải Ilya, thậm chí không phải mô hình ngôn ngữ, mà là một "Cỗ máy tạo Vũ trụ" thực sự.

Nhóm dữ liệu khủng khiếp này của Accelerated Understanding đang được lan truyền điên cuồng:
- Quy mô tham số mô hình: Đã hoàn thành huấn luyện trước mô hình với số tham số lên tới 1 nghìn tỷ (1 Trillion).
- Khả năng mở rộng cực hạn: Quy mô thử nghiệm mở rộng đã tăng vọt lên 35 nghìn tỷ (35 Trillion) tham số.
- Ngữ cảnh giai đoạn huấn luyện: 1 Trillion (1 nghìn tỷ).
- Ngữ cảnh giai đoạn suy luận: Vượt quá 5 Trillion (5 nghìn tỷ).

Với sự hỗ trợ của ngữ cảnh khổng lồ như vậy, mô hình này đã thể hiện khả năng đáng sợ:
Khi thực hiện suy luận vật lý, nó không cần lấy mẫu con (No sub-sampling), không cần xử lý phân khúc (No chunking).
Đối mặt với các hệ thống vật lý không gian 4D cực kỳ phức tạp, nó có thể "một lần suy luận (One-shot)" tạo ra toàn bộ quỹ đạo chuyển động không-thời gian hoàn chỉnh!
Không chỉ vậy, do logic cơ bản thống nhất, cùng một mô hình, lại có thể đồng thời xử lý các vấn đề vật lý hoàn toàn khác nhau ở các lĩnh vực khác nhau!
Điều này trước đây, không thể tưởng tượng được.
Trước kia, nhà khí tượng dùng mô hình khí tượng, nhà khoa học vật liệu dùng mô hình vật liệu; còn bây giờ, Accelerated Understanding nói với thế giới: Quy luật vật lý ở cấp độ cơ bản là thông nhau, một mô hình lớn vật lý tổng quát, đủ để đảm đương mọi thứ.
Chức năng cốt lõi mang tính đột phá nhất của Accelerated Understanding, nằm ở việc nó xây dựng một vòng lặp hoàn hảo "Mô phỏng → Cải tiến → Mô phỏng". Nó không chỉ là một "máy phát", mà còn là một "Máy xác thực Hiện thực" (Reality Validator) thực sự.
Và lần phản hồi định hướng này, cũng chạm đúng vào việc huấn luyện khi thử nghiệm của Ilya.

"Transformer đã chết?" AI Vật lý Thức tỉnh
Nếu hôm nay bạn hỏi bất kỳ người làm AI nào: "Kiến trúc AI hot nhất hiện nay là gì?" Câu trả lời 100% là: Transformer.
Từ ChatGPT đến các mô hình tạo video lớn, kiến trúc do Google phát minh này thống trị giới AI trong vài năm qua (chính là chữ "T" trong ChatGPT).
Nhưng trong mắt Anima, lộ trình của Transformer đã đi lệch hướng.
"Quan điểm trí tuệ lấy ngôn ngữ làm trung tâm, là quan điểm 'lấy con người làm trung tâm'," Anima chỉ rõ trong cuộc phỏng vấn độc quyền trước buổi ra mắt, "còn đặt vật lý học vào trung tâm, mới là quan điểm 'lấy tự nhiên làm trung tâm'."
Các LLM và mô hình thế giới video hiện nay hoạt động như thế nào? Về bản chất, chúng đang chơi "trò chơi xác suất".
ChatGPT đang dự đoán từ tiếp theo có khả năng xuất hiện cao nhất.
Còn những AI tạo video gây kinh ngạc kia, về bản chất đang đi đường tắt thị giác (Visual Shortcuts) — chúng chỉ làm cho hình ảnh được tạo ra "trông" phù hợp với quy luật vật lý, nhưng nếu bạn nghiên cứu sâu về trọng lực, động lực học chất lỏng, lực căng vật liệu bên trong, bạn sẽ phát hiện chúng hoàn toàn sai.
Chúng hoàn toàn không hiểu vật lý, chúng chỉ là những "máy lặp lại pixel" cấp cao.
Mà văn bản chỉ có 1 chiều, video chỉ có ba chiều, còn không-thời gian thực tế là không gian 3 chiều + thời gian 1 chiều.

Ngoài ra, nhiều mô hình sử dụng phương thức tự hồi quy — dự đoán từng khung hình, sai số tích lũy từng cấp.

Vì vậy, Accelerated Understanding hoàn toàn từ chối Transformer, cũng từ chối đường tắt thị giác.
Họ tung ra vũ khí tối thượng, là một công nghệ cách mạng mà Anima đã tham gia khai phá từ nhiều năm trước — Neural Operators (Toán tử thần kinh).
Khác với việc xử lý văn bản, Neural Operators được sinh ra chuyên để xử lý dữ liệu vật lý phức tạp, không thể nhìn thấy. Nó không cần ép thế giới vật lý giảm chiều thành chữ viết hoặc pixel, mà trực tiếp hiểu các hiện tượng vật lý đa chiều trong không-thời gian 4D hoàn chỉnh (không gian 3D + chiều thời gian).
Luồng không khí vô hình, dòng chảy rối plasma trong lò phản ứng nhiệt hạch, phân bố nhiệt động lực học vi mô bên trong chip... những quá trình vật lý mà mắt thường con người không nhìn thấy, AI truyền thống không thể dùng "kinh nghiệm thị giác" để đoán này, dưới kiến trúc hoàn toàn mới này, trở nên rõ ràng, có thể nhìn thấy và có thể tính toán được.
Khiến Jensen Huang Kinh ngạc, Từ chối Jeff Bezos
Đọc đến đây, bạn có thể hỏi, huấn luyện một mô hình khủng khiếp như vậy cần bao nhiêu sức mạnh tính toán? Tiền từ đâu ra?
Mặc dù từ chối tiết lộ chi tiết gọi vốn hiện tại, nhà đồng sáng lập chỉ khiêm tốn cho biết "đã đạt được thỏa thuận hợp tác với nhà cung cấp tính toán, họ cung cấp cụm phần cứng để phát triển và vận hành AI".
Nhưng tất cả manh mối, đều hướng về công ty cũ của cô — Nvidia, và Jensen Huang (Jensen Huang) — người luôn hô vang "AI chính là tương lai".
Quay ngược thời gian về năm 2018, Anima được Nvidia thuê làm Giám đốc Nghiên cứu AI.
Trong năm năm, cô dẫn dắt một nhóm các nhà khoa học hàng đầu, khám phá cách áp dụng sức mạnh tính toán GPU của Nvidia vào các lĩnh vực AI tiên phong.

Khi đó, nhóm đã thực hiện một dự án gây kinh ngạc thời kỳ đầu: dùng AI tăng tốc dự báo thời tiết. Kết quả cho thấy, độ chính xác dự đoán của AI thậm chí cao ngang bằng với các nhà khí tượng sử dụng mô hình động lực học chất lỏng tính toán truyền thống cực kỳ phức tạp, nhưng tốc độ nhanh hơn vài bậc độ lớn.
Kết quả này trực tiếp "làm kinh ngạc" Jensen Huang.
Tại hội nghị GTC của Nvidia năm 2021, Jensen Huang đích thân lên sân khấu, giới thiệu với toàn thế giới thành quả nghiên cứu về "Neural Operators" của nhóm Anima. "Ông ấy khi đó quá phấn khích," Jensen Huang nhớ lại.

Khi Anima nói đùa với Jensen Huang: "AI có thể cướp mất bữa trưa của những nhà vật lý lý thuyết kia".
Khi đó, Jensen Huang mắt sáng rực, trả lời đầy bản lĩnh: "Tôi muốn nó ăn hết tất cả bữa trưa của họ!"
Theo Anima tiết lộ, chính Jensen Huang là người ban đầu khuyến khích cô theo đuổi và hiện thực hóa ý tưởng điên rồ về "AI Vật lý" này.
Mặc dù Nvidia chính thức hôm nay chưa phản hồi yêu cầu của Reuters về việc có đầu tư vào công ty này hay không, nhưng trong giới AI, mọi người đều hiểu — không có sự hỗ trợ ngầm của sức mạnh tính toán đỉnh cao, tuyệt đối không thể tạo ra cỗ máy khổng lồ với ngữ cảnh 5 nghìn tỷ.
Nước cờ lớn của Jensen Huang, cuối cùng cũng được đặt xuống.
Tuy nhiên, để hiểu "mô hình lớn vật lý" này giỏi đến mức nào, chúng ta phải quay lại Los Angeles vào cuối năm 2024.
Tại một nhà hàng cao cấp, một bữa tối bí mật đủ sức thay đổi cục diện AI hiện nay đang diễn ra.
Một trong những nhân vật chính của bữa tối, là nhà đầu tư kiêm doanh nhân công nghệ sinh học Vik Bajaj (ông sau này cùng với Bezos đồng sáng lập Project Prometheus với định giá hơn trăm tỷ).
Và ngồi đối diện ông, là một cặp vợ chồng có nền tảng AI đỉnh cao: Giáo sư Khoa học Tính toán và Toán học tại Caltech, cựu Giám đốc Nghiên cứu AI Nvidia Anima Anandkumar, và chồng cô, kỹ sư hạ tầng AI hàng đầu Benedikt Jenik.

Bajaj mang theo một lời đề nghị mang tên "Project Prometheus" (Dự án Prometheus) có sự chuẩn bị kỹ lưỡng. Thỏa thuận được Bezos hậu thuẫn mạnh mẽ này, có điều kiện phong phú đến mức đáng kinh ngạc:
Mời Anima đảm nhiệm vai trò người phát ngôn của công ty, thành viên hội đồng quản trị và người dẫn dắt tầm nhìn khoa học;
Hai vợ chồng sẽ nhận được cổ phần công ty cao đến 35%;
Mức lương cơ bản 1 triệu đô la Mỹ một năm, sau ba tháng nhận việc trực tiếp tăng gấp đôi lên 2 triệu đô la Mỹ;
Điều đáng kinh ngạc nhất là, trong thỏa thuận ghi rõ, các nhà đầu tư bao gồm cả Bezos sẽ cung cấp hơn 20 tỷ đô la Mỹ "vốn cam kết" cho các vòng gọi vốn trước vòng B.
Trong thời đại ngày nay, khi việc gọi vốn cho các mô hình lớn ngày càng khó khăn, chi phí tính toán cao ngất ngưởng, đây là một tấm vé siêu vàng dẫn đến tự do tài chính và quyền lực ngành.
Tuy nhiên, Anima và Jenik đã chọn từ chối.
Tại sao? Bởi vì thứ họ nắm trong tay, tiềm năng vượt xa một công ty "tự động hóa sản xuất hệ thống vật lý phức tạp". Họ không muốn sống dựa dẫm người khác, càng không muốn tầm nhìn công nghệ của mình bị vốn đầu tư lôi kéo. Họ muốn làm là xây dựng một "mô hình thần thánh" có thể trực tiếp hiểu và mô phỏng vũ trụ vật lý.
Cuối cùng, vợ chồng Anima, thì lặng lẽ ẩn mình, cho đến hôm nay, mang theo Accelerated Understanding do chính họ xây dựng độc lập làm cả thế giới kinh ngạc.
Kết: Sự Chuyển đổi Mô hình từ "Tạo thông tin" sang "Tối ưu hóa Thế giới"
Ngày 25 tháng 8 năm 2026, đây chắc chắn là một ngày được ghi vào lịch sử phát triển AI.
Khi chúng ta đang reo hò vì các mô hình ngôn ngữ lớn có thể viết một bài thơ hay, có thể giúp chúng ta chỉnh sửa email công việc, thì Accelerated Understanding giống như một kẻ phá vỡ bức tường từ tương lai xuyên về, lạnh lùng nói với chúng ta: Ngôn ngữ và hình ảnh chỉ là biểu hiện bề ngoài để con người hiểu thế giới, quy luật vật lý, mới là mã code cơ bản thực sự của vũ trụ này.
Từ chối Bezos, từ chối Transformer, vứt bỏ đường tắt thị giác, tấn công trực diện vào bản chất của không-thời gian 4D. Anima Anandkumar và Benedikt Jenik sử dụng dữ liệu điên rồ với 1 nghìn tỷ tham số và 5 nghìn tỷ ngữ cảnh, tuyên bố với thế giới về sự khởi đầu của kỷ nguyên "AI Vật lý (Physical AI)".
Tài liệu tham khảo:
https://x.com/AndrewCurran_/status/2092244031002771643
https://x.com/AnimaAnandkumar/status/2092236528898675014
https://x.com/daniel_mac8/status/2092303081287418277
https://www.reuters.com/business/ai-founders-who-walked-away-bezos-backed-prometheus-model-universe-2026-08-25/
https://acceleratedunderstanding.com/
Bài viết này đến từ tài khoản công chúng WeChat "Tân Trí Nguyên", tác giả: ASI Khải Thị Lục, biên tập: Đại Vệ





