Lại một lần nữa, tốc độ cacbon bị đòn giáng chiều của trí tuệ silicon!
Để tránh sự khải huyền ảo xảy ra, OpenAI đang mở rộng "Dự án Bình Minh".
OpenAI cho ra mắt mô hình chuyên dụng bảo mật GPT-5.6-Cyber, chuyên xử lý các nhiệm vụ an ninh thông tin, hoàn toàn lật đổ mô hình an ninh mạng.

Giờ đây, OpenAI đã công bố thành tích chiến đấu của GPT-5.6-Cyber: Mô hình mới một mạch phát hiện hơn 400+ lỗ hổng nhân, bao gồm
- Một lỗ hổng nghiêm trọng trong động cơ JavaScript V8 của Chrome;
- Một hệ điều hành di động chủ đạo nào đó: ít nhất 5 lỗ hổng, bao gồm chuỗi hoàn chỉnh từ ứng dụng không tin cậy đến leo quyền cục bộ;
- Một cơ sở dữ liệu chủ đạo nào đó: 3 lỗ hổng nghiêm trọng, bao gồm đường dẫn thực thi mã từ xa;
- Nhân của một hệ điều hành chủ đạo nào đó: Hơn 400 lỗ hổng có thể dẫn đến leo quyền.
Hiện tại, GPT-5.6-Cyber cần xác thực danh tính và xem xét trước khi gia nhập chương trình "Daybreak" (Bình Minh) mới có thể sử dụng.
OpenAI: AI Sẽ Vượt Qua "Điểm Tới Hạn"
Vài ngày trước, OpenAI vừa đạp phanh.
Thế hệ Astra tiếp theo thể hiện quá mạnh trong đánh giá nội bộ, "không thể loại trừ" nó đã chạm đến cấp độ "tới hạn" về khả năng an ninh mạng, quyết định tạm dừng tất cả các hoạt động liên quan đến Astra không đáp ứng yêu cầu an ninh được tăng cường.

Không còn nghi ngờ gì nữa, nếu lỗ hổng máy tính bị lợi dụng có chủ đích, hậu quả sẽ khôn lường: thông tin cá nhân của bạn, mật khẩu thẻ ngân hàng của bạn thậm chí bị rò rỉ toàn mạng!
Đáng ngại hơn, các mô hình mạnh nhất như Claude Fable 5, ChatGPT 5.6 Sol "phòng người quân tử mà không phòng tiểu nhân".
Khi nhân viên phòng thủ an ninh muốn sử dụng AI để mô phỏng một cuộc tấn công, xác minh một lỗ hổng zero-day nào đó, mô hình lớn thường thẳng thừng từ chối: "Xin lỗi, tôi không thể hỗ trợ."
AI nội bộ của OpenAI xâm nhập HuggingFace, cuối cùng vẫn là mô hình mã nguồn mở trong nước dọn dẹp hậu quả.
Sự xuất hiện của Dự án Daybreak đã lật đổ tất cả điều này.
OpenAI chia kế hoạch này thành hai kênh khác nhau, trao cho các nhà nghiên cứu an ninh thông tin "mũi nhọn và tấm khiên" mạnh nhất:
- Daybreak Blue (Kênh Xanh): Cung cấp mô hình GPT-5.6 Sol phổ dụng cho người phòng thủ, nhưng đã loại bỏ các rào chắn cấp hệ thống cản trở công việc phòng thủ hợp pháp. Nó phù hợp cho việc phát hiện lỗ hổng thông thường, kiểm toán mã an toàn, phân tích phần mềm độc hại và xác minh bản vá.
- Daybreak Red (Kênh Đỏ): Kênh cốt lõi được thiết kế riêng cho nghiên cứu lỗ hổng được ủy quyền, xác minh khai thác lỗ hổng (Exploit Validation) và kiểm tra đội đỏ. Và hỗ trợ trong kênh này chính là GPT-5.6-Cyber được huấn luyện chuyên sâu.

OpenAI đã thử nghiệm mô hình mới trong các tình huống liên quan đến phát triển chuỗi khai thác lỗ hổng, vượt qua xác thực, leo quyền và các tình huống an ninh mạng nâng cao khác.
GPT‐5.6‐Cyber hoàn thành 95.0% các yêu cầu loại này, trong khi GPT‐5.6 Sol chỉ đạt 1.5%, và khi sử dụng quyền truy cập Daybreak Blue là 2.0%.

Nói cách khác, các nhà nghiên cứu an ninh không còn bị đối xử khác biệt nữa. Từ đây, AI tấn công-phòng thủ mạng mạnh nhất đã xuất hiện.
Như Jared Atkinson, Giám đốc Công nghệ của nhà cung cấp an ninh SpecterOps đã đánh giá:
Trong môi trường tin cậy được quản lý, giảm bớt việc "từ chối trả lời" vô ích, cho phép các nhà nghiên cứu an ninh có thể tập trung, dành thời gian vào việc xác minh lỗ hổng và chuyển đổi thành giá trị phòng thủ, thay vì phải vật lộn với các rào chắn của mô hình.
GPT-5.6-Cyber
Mô Hình An Ninh Thông Tin Mạnh Nhất Của ChatGPT
Dựa trên GPT-5.6 Sol, GPT-5.6-Cyber được huấn luyện chuyên sâu về bảo mật, làm mới nhiều bài kiểm tra chuẩn, là mô hình bảo mật mạnh nhất của ChatGPT.
Trong việc khai thác lỗ hổng, phát hiện lỗ hổng, đánh giá lỗ hổng, GPT-5.6-Cyber vượt xa GPT-5.6-Sol.

Ngoại lệ duy nhất là ở khía cạnh phát hiện lỗ hổng và viết báo cáo, điểm số cuối cùng của GPT-5.6-Cyber lại thua GPT-5.6 Sol.
Nguyên nhân có thể nằm ở việc học tăng cường sâu và tinh chỉnh liên kết mà GPT-5.6-Cyber đã trải qua trong các nhiệm vụ tấn công-phòng thủ mạng.
Sau khi phát hiện lỗ hổng, nó chỉ muốn sử dụng mã gọn nhất, thời gian nhanh nhất để chứng minh lỗ hổng này tồn tại, còn việc sử dụng ngôn ngữ con người để giải thích chi tiết nguyên nhân, viết báo cáo an ninh dài dòng, nó tỏ ra hoàn toàn thiếu kiên nhẫn.

Nếu nói các chỉ số và điểm số quá khô khan, thì việc đào bới lỗ hổng trong các kho mã lớn ngoài thế giới thực mới là bài kiểm tra cuối cùng để xác minh GPT-5.6-Cyber có thực sự sở hữu trực giác "thám tử mạng" hay không.
Đối mặt với hàng triệu dòng mã có cấu trúc phức tạp chằng chịt, muốn tìm thấy một lỗ hổng có giá trị, AI phải giống như hacker con người, liên tục vượt qua mấy khó khăn: thiết lập giả thuyết về hệ thống vận hành, mô phỏng tương tác bất thường của nhiều thành phần, nắm bắt những hư hỏng bộ nhớ thoáng qua, và cuối cùng chứng minh khe hở này có thể bị khai thác.
Sau khi GPT-5.6-Cyber hoàn thành huấn luyện, đội nghiên cứu an ninh của OpenAI để nó hướng ánh mắt về V8 - động cơ JavaScript khổng lồ, phức tạp, được xây dựng từ vô số mã C++ của trình duyệt Chrome của Google.
Sau đó, AI phát hiện một lỗ hổng nghiêm trọng.
Khi động cơ cố gắng chuyển đổi một số giá trị cụ thể thành số nguyên, trình biên dịch lại nhầm lẫn bỏ qua kiểm tra an toàn.
Nếu một giá trị đáng lẽ là chưa xác định (Undefined) được đưa vào, hệ thống sẽ không báo lỗi như dự kiến, mà sẽ tạo ra một số nguyên cực lớn bất thường. Nếu con số này sau đó được dùng làm chỉ mục (Index) của mảng, thảm họa ập đến: trình biên dịch JIT sẽ nhầm tưởng rằng chỉ mục này vẫn nằm trong phạm vi an toàn của mảng, từ đó bỏ qua kiểm tra biên giới (Bounds Check) trong thời gian chạy.
Lúc này, AI hoàn thành bước đầu tiên: vượt ngục. Kẻ tấn công đã có thể đọc hoặc ghi đè dữ liệu bộ nhớ của các đối tượng khác trong sandbox V8 tùy ý.

Nhưng để thực sự thực thi mã độc, bạn phải tìm chìa khóa thứ hai - thực hiện thoát khỏi sandbox.
Đáng kinh ngạc là, suy nghĩ của GPT-5.6-Cyber không dừng lại. Nó theo dây leo, thông qua liên tưởng ngữ cảnh cực kỳ nhạy bén, tự chủ tìm kiếm và lợi dụng lỗ hổng thứ hai: lỗ hổng thoát stack (Stack Escape) trong JSPI (JavaScript Promise Integration).
Bằng cách "nối chuỗi (Chaining)" hai lỗ hổng này một cách khéo léo, AI đã thành công mở ra một lối đi ngầm dẫn đến tầng dưới của hệ thống, thực hiện thực thi mã tùy ý bên ngoài sandbox Chrome.
Đội ngũ OpenAI nhanh chóng nộp kết quả nghiên cứu này cho đội an ninh Google, lỗ hổng được vá kịp thời.
Đây là một cột mốc trong lịch sử phát triển AI: AI đã có khả năng "logic sáng tạo" vượt qua thành phần để xây dựng chuỗi lỗ hổng.
Và Chrome V8 chỉ là một con mồi trong danh sách săn lùng của nó.
GPT-5.6-Cyber đã thể hiện sức "sát thương" đáng sợ trong nhiều cơ sở hạ tầng kỹ thuật số cốt lõi:
Xâm nhập Hệ Điều Hành Điện Thoại Thông Minh
Trong một hệ điều hành di động nào đó có hàng trăm triệu người dùng, AI độc lập tìm ra 5 lỗ hổng nghiêm trọng, và thành công xây dựng một chuỗi tấn công hoàn chỉnh từ "Ứng dụng App thông thường không được ủy quyền" đến "có được đặc quyền tối cao của hệ thống" (leo quyền cục bộ).
Xâm nhập Cơ Sở Dữ Liệu Phổ Biến
Trong một cơ sở dữ liệu lớn mã nguồn mở nào đó, AI liên tục đào bới 3 lỗi chết người, trong đó bao gồm một đường dẫn thực thi mã từ xa (RCE) có thể trực tiếp khởi phát tấn công từ mạng ngoài.
Quét Sạch Nhân Hệ Thống
Trong nhân của một hệ điều hành chủ đạo nào đó, GPT-5.6-Cyber như một máy gặt tự động toàn phần, quét sạch hơn 400 lỗ hổng tiềm năng có thể được sử dụng để leo quyền.
AI Không Tạo Ra Nguy Hiểm, Nó Phơi Bày Nguy Hiểm
Nhiều người hiểu sự xuất hiện của GPT-5.6-Cyber là "AI làm không gian mạng trở nên nguy hiểm hơn".
Nhưng cách nói chính xác hơn là: nó phơi bày những nguy hiểm vốn tồn tại, nhưng bị che giấu bởi năng lực sản xuất của chuyên gia con người, một cách sớm hơn, tập trung hơn và quy mô hơn.
Lỗ hổng zero-day vẫn luôn tồn tại.
Đường dẫn leo quyền tiềm ẩn trong nhân vẫn luôn tồn tại. Chỉ là trước đây chi phí phát hiện chúng cực cao, tốc độ cực chậm. Giờ đây, chi phí đang giảm, tốc độ đang tăng. Kẻ tấn công sẽ dùng, người phòng thủ cũng phải dùng.
Lựa chọn của OpenAI, về bản chất là một canh bạc lớn - thà để năng lực tấn công được quy mô hóa trước trong bóng tối, thì tốt hơn là trao năng lực sắc bén tương đương cho những người phòng thủ đã qua sàng lọc trước, dù điều này có nghĩa là chịu rủi ro "con dao có thể bị dùng sai".
Cửa sổ phòng thủ mạng đang thu hẹp với tốc độ của AI. Thời gian do dự còn lại cho con người, đã được tính bằng giờ.
Tài liệu tham khảo:
https://openai.com/index/expanding-daybreak-as-the-cyber-defense-window-narrows/
https://openai.com/business/solutions/cybersecurity/
Bài viết này đến từ tài khoản WeChat công khai "Tân Trí Nguyên", tác giả: ASI Khải Thị Lục, biên tập: Đại Vệ








