An ninh AI, thời đại đã thay đổi!
Greg Brockman, đồng sáng lập kiêm Chủ tịch OpenAI, đã cảnh báo trong một bài Blog mới nhất rằng:
Sự kiện an ninh HuggingFace đã cho thế giới bên ngoài thấy rõ lần đầu tiên rằng, các AI Agent tiên phong đã có khả năng tự chủ tìm kiếm lỗ hổng bảo mật và thực thi chuỗi tấn công mạng trong thế giới thực.

Trong sự cố an ninh AI này, GPT 5.6 Sol với các hạn chế bảo mật bị hạ thấp và một mô hình chưa phát hành mạnh hơn, để lấy được câu trả lời, đã tự khai thác lỗ hổng tồn tại trong môi trường để thoát khỏi sandbox và xâm nhập ngang qua nhiều hệ thống, cuối cùng tấn công vào môi trường sản xuất của Hugging Face.

Mặc dù cuối cùng cả hai bên đều cho biết sự kiện này không gây ra hậu quả quá nghiêm trọng, nhưng cuộc "xâm nhập AI" này cũng truyền tải một tín hiệu ngày càng rõ ràng tới công chúng:
AI đang làm giảm đáng kể ngưỡng tấn công mạng; trong tương lai, không cần phải huy động các hacker đỉnh cao, ngay cả người bình thường cũng có thể dựa vào AI để phát động hàng loạt các cuộc tấn công thâm nhập.
Và đáng lo ngại là, phía tấn công đã đạt được tự động hóa AI, nhưng phía phòng thủ dường như vẫn chưa bắt kịp.

Đối với điều này, Greg Brockman trong blog mới nhất đã thẳng thắn chia sẻ bốn biện pháp an ninh mà OpenAI đang thực hiện, cùng với mười biện pháp mà những người phòng thủ có thể nhanh chóng triển khai, và nói rằng:
Hiện tại, cửa sổ ứng phó then chốt của phía phòng thủ đã mở ra. Trong vài tháng tới, chỉ có việc các công ty nâng cao đáng kể mức độ tự động hóa của hệ thống an ninh mới có thể chống lại các mối đe dọa mới do AI Agent mang lại, giữ vững ranh giới an toàn.
Hầu như không có công ty nào có thể đứng ngoài
Vậy thì, khả năng tấn công của AI Agent đã phát triển đến mức độ nào?
Sau sự kiện an ninh Hugging Face, Brockman quyết định lấy trang web cá nhân của mình gregbrockman.com để làm một bài kiểm tra.
Đây là một trang web tĩnh có cấu trúc đơn giản, theo đánh giá của anh, một trang web có chức năng hạn chế, mặt tấn công không lớn như vậy, lẽ ra không nên ẩn chứa nhiều vấn đề.
Nhưng kết quả lại vượt quá mong đợi của anh.
Sau khi để ChatGPT Work được trang bị GPT-5.6 Sol kiểm tra trang web, chỉ sau khoảng 15 phút, hệ thống đã phát hiện ra 13 vấn đề an ninh, ví dụ, trang web không cấu hình chính xác bản ghi DNS, kẻ tấn công có thể giả mạo danh nghĩa Brockman để gửi email, v.v.

△
Nhìn riêng lẻ, những vấn đề này chưa chắc đều có thể trực tiếp gây hậu quả nghiêm trọng. Nhưng tấn công mạng thường không chỉ khai thác một lỗ hổng, mà sẽ kết nối nhiều điểm yếu không đáng kể lại với nhau;
Ví dụ, một cấu hình sai làm lộ thông tin, một thông tin xác thực bị rò rỉ mở ra lối vào, cộng thêm một lỗ hổng quyền hạn khác, cuối cùng có thể dẫn đến một cuộc xâm nhập thực sự.
Từ đó, Brockman đưa ra một nhận định đáng lo ngại:
Mỗi công ty vì chạy tiến độ, muốn tiết kiệm công sức, khi phát triển hệ thống đã để lại những "món nợ lịch sử" và "bản vá tạm thời" đó, thực chất đều giống như bom hẹn giờ chôn trong tường... bình thường nhìn không sao, nhưng một khi bị hacker nhắm đến, những việc lười biếng, những món nợ từng mắc phải đó, bất cứ lúc nào cũng có thể trở thành lỗ hổng chí mạng khiến hệ thống sụp đổ.
Quan trọng hơn, những "lỗ hổng đuôi dài" mà trước đây các chuyên gia an ninh phải tốn nhiều thời gian mới tìm thấy, giờ đây đang ngày càng dễ bị AI phát hiện.
Nhưng tin tốt là, kẻ tấn công có thể dùng AI tìm lỗ hổng, người phòng thủ cũng có thể dùng AI vá lỗ hổng.

Sau khi phát hiện vấn đề, Brockman lại để ChatGPT Work trực tiếp tiến hành sửa chữa; từ việc kiểm tra lỗ hổng an ninh đến triển khai sửa chữa, AI Agent chỉ mất một giờ để thực thi toàn bộ quy trình.
Đây cũng là một vai trò khác của AI Agent trong mắt Brockman:
Nó không chỉ là kẻ tấn công tiềm năng, mà cũng có thể trở thành một "lính gác mạng" không biết mệt mỏi, thay chúng ta xử lý những chi tiết an ninh mà chúng ta không có thời gian kiểm tra, hoặc không biết cách cấu hình chính xác.
Và đối với OpenAI, đang ở trong cơn bão, ý tưởng "dùng AI chống lại AI" này từ lâu đã không chỉ là ý tưởng, mà đang được sử dụng một cách có hệ thống để bảo vệ chính mình.

OpenAI dùng AI như thế nào để bảo vệ mình?
Greg Brockman thừa nhận, sự kiện Hugging Face đã gióng lên hồi chuông cảnh tỉnh cho OpenAI, trước đây họ đã đánh giá thấp sức mạnh tấn công của các mô hình tiên phong trong môi trường mạng thực tế.
Vì vậy, nội bộ OpenAI đang tăng cường các biện pháp an ninh liên quan, và lần đầu tiên công bố ra ngoài bốn hướng phòng thủ, hy vọng cung cấp tài liệu tham khảo hành động cho các đồng nghiệp.
Thứ nhất, dùng Codex giữ cửa ngõ mã nguồn
Brockman cho biết, họ đang sử dụng Codex và khả năng an ninh của nó để xem xét các thay đổi mã trước khi triển khai, xác định lỗ hổng và hỗ trợ sửa chữa, rút ngắn thời gian từ khi phát hiện vấn đề đến khi triển khai bản vá an toàn.
Thứ hai, để AI phân loại và phân tích thông minh các cảnh báo an ninh ban đầu
Hiện tại, hầu như tất cả cảnh báo an ninh ban đầu của OpenAI đều sẽ được hệ thống thông minh phân loại và phân tích trước, sau đó mới giao cho con người xử lý.
Một số kết quả phát hiện còn kích hoạt phản ứng tự động có ranh giới rõ ràng, từ đó giảm bớt lao động lặp đi lặp lại, để chuyên gia tập trung vào quyết định rủi ro cao, cuối cùng ứng phó với mối đe dọa ở tốc độ máy.
Thứ ba, chủ động kiểm tra và dự đoán trước các đường tấn công tiềm năng
OpenAI đang sử dụng các mô hình tiên phong để liên tục tìm kiếm lỗ hổng, cấu hình sai, tài khoản có quyền hạn quá cao và ranh giới tin cậy hình thành ngoài ý muốn.
Để AI đứng ở góc nhìn của kẻ tấn công, tìm ra trước các điểm yếu có thể được kết nối thành chuỗi tấn công, và chặn lại trước khi cuộc tấn công thực sự xảy ra.
Thứ tư, tiếp tục bổ sung kiến thức an ninh cơ bản
Brockman nhấn mạnh, AI không thể thay thế các biện pháp an ninh truyền thống.
Cách ly mạng, củng cố khối lượng công việc, giám sát liên tục, vá lỗi an ninh và các biện pháp an ninh truyền thống khác, trong thời đại AI sẽ càng trở nên quan trọng hơn.
Từ việc dùng Codex giữ cửa ngõ mã nguồn, để AI dự đoán rủi ro trước, đến việc không ngừng củng cố kiến thức an ninh cơ bản, OpenAI đang xây dựng một hệ thống phòng thủ "từng lớp một". Lợi ích của nó nằm ở chỗ:
Cho dù một phòng tuyến nào đó bị phá vỡ, kẻ tấn công vẫn phải vượt qua liên tiếp nhiều cửa ải không liên quan với nhau, mới có thể gây ra thiệt hại chí mạng.
Điều này cũng cung cấp một hướng suy nghĩ về an ninh cho ngành có thể tham khảo.
Nhưng xây dựng phòng tuyến chỉ là bước đầu tiên, đối mặt với các cuộc tấn công AI đã đến nhanh hơn, những người phòng thủ nên làm gì nữa?

Những người phòng thủ nên làm gì bây giờ?
Lời khuyên của Greg Brockman rất trực tiếp:
Thay vì băn khoăn dùng công cụ nào, hãy sớm đưa AI tiên phong vào công việc phòng thủ.

△
Cụ thể, anh đưa ra mười đề xuất hành động. Chúng có thể được phân loại thành ba bước, đó là:
Trước tiên đưa AI vào công việc an ninh, sau đó nhúng AI vào quy trình nghiên cứu phát triển, cuối cùng từng bước nâng cao mức độ tự động hóa của toàn bộ hệ thống.
Bước một, đưa AI vào công việc an ninh, tạo ra Agent riêng
Công ty trước hết phải cung cấp đủ tài nguyên và cơ chế hợp tác cho nhóm an ninh và kỹ thuật, và làm quen trước với tấn công AI thông qua diễn tập mô phỏng.
Sau đó, công ty có thể trang bị các công cụ Agent như Codex, Codex Security cho nhóm an ninh, bắt đầu từ hệ thống có rủi ro cao nhất, ủy quyền cho nó truy cập vào mã nguồn, cấu hình và tài liệu kỹ thuật cần thiết.
Đồng thời, nhóm an ninh và kỹ thuật còn phải bổ sung kiến thức chuyên ngành an ninh cho Agent, để nó có thể kết hợp đầy đủ các khả năng như phân tích tĩnh, xem xét mã, phân tích lỗ hổng và đánh giá chuỗi cung ứng, cũng như kiến trúc thực tế, mô hình mối đe dọa và sổ tay ứng phó của doanh nghiệp, tạo ra Agent an ninh riêng cho nhóm.

Bước hai, nhúng AI vào quy trình nghiên cứu phát triển
Trong quá trình nghiên cứu phát triển, nhóm an ninh và kỹ thuật có thể thử phân công hợp tác với AI, để nhóm nghiên cứu phát triển ưu tiên tập trung sức lực vào các "khu vực rủi ro cao" như dịch vụ đối ngoại hướng Internet, xác thực danh tính, đường ống triển khai và hệ thống nhạy cảm, v.v.
Còn những cảnh báo an ninh tồn đọng và báo cáo lỗ hổng, hoàn toàn có thể giao cho AI phân loại sắp xếp, nhanh chóng lọc ra các mục sửa chữa cấp bách nhất.
Trước khi hợp nhất mã, nhóm cũng có thể để Agent tự động xem xét các thay đổi trước; sau khi phát hiện lỗ hổng, lại để nó tạo bản vá, viết bài kiểm tra hồi quy và xác minh hiệu quả sửa chữa.
Lợi ích của cách làm này rất thực tế:
Các thay đổi then chốt vẫn được con người nắm chặt, nhưng chu kỳ từ phát hiện lỗ hổng đến sửa chữa có thể được rút ngắn đáng kể.
Bước ba, từng bước xây dựng một hệ thống vận hành an ninh tự chủ hoàn chỉnh
Cuối cùng, đừng bao giờ nghĩ rằng việc xây dựng hệ thống phòng thủ tự động hóa AI có thể "một miếng đã no".
Brockman nhấn mạnh, nhóm an ninh có thể để Agent với quyền chỉ đọc "quan sát" trước — lúc này Agent chỉ chịu trách nhiệm quét mã, xem qua lịch sử cảnh báo.
Sau khi phối hợp thuận lợi, từng bước thả lỏng để nó tham gia kiểm tra gửi mã, phân loại cảnh báo thời gian thực, thậm chí tự động tắt những báo động sai đã rõ ràng.
Đồng thời, có thể giới thiệu các mô hình như GPT-Daybreak-Blue để phân tích nhật ký, dữ liệu viễn thám và cảnh báo an ninh những "xương khó" này, sau đó thông qua các cuộc "Tuần hacker" hoặc diễn tập thực chiến nội bộ tương tự để không ngừng mài giũa công cụ mới.
Cứ như vậy từng khâu một "cắn" xuống, hệ thống vận hành an ninh tự chủ AI tự nhiên sẽ được xây dựng.
Nhưng thành thật mà nói, phòng tuyến doanh nghiệp hoàn hảo đến đâu, cũng không thể một mình đối phó với một thách thức an ninh tràn ngập cả ngành.
Brockman chỉ ra:
Muốn để người phòng thủ thực sự chạy nhanh hơn kẻ tấn công, ngoài việc tự củng cố phòng tuyến, cần phải biến kinh nghiệm từng điểm thành năng lực chung của toàn bộ hệ sinh thái.
Hệ sinh thái an ninh AI, cần sự chung tay của các bên
Ở phần kết Blog, Brockman kêu gọi toàn ngành:
Đối mặt với thách thức an ninh AI đang ập đến, bất kỳ tổ chức nào cũng không thể đứng ngoài. Chỉ có sự hợp tác chung tay của các bên, mới có thể xây dựng một phòng tuyến an ninh thực sự vững chắc. Tôi hy vọng các phòng thí nghiệm AI, nhà cung cấp an ninh, doanh nghiệp và những người bảo trì dự án mã nguồn mở, có thể chia sẻ các phương pháp phát hiện lỗ hổng đã được kiểm chứng, giải pháp sửa chữa và sổ tay thao tác thực tế. Bởi vì chỉ khi để vấn đề mà một công ty hoặc tổ chức phát hiện ra nhanh chóng chuyển hóa thành khả năng phòng thủ của toàn bộ hệ sinh thái, tốc độ tiến hóa của phía phòng thủ mới có thể vượt qua phía tấn công. Nếu toàn ngành có thể cùng nhau bổ sung bài học an ninh này, những gì AI mang lại có lẽ không chỉ là các cuộc tấn công dữ dội hơn, mà cũng có thể là một Internet an toàn hơn những gì từng tưởng tượng trước đây.

△
Đúng vậy, trong thời đại AI phát triển lặp lại với tốc độ chóng mặt này, an ninh thực sự không bao giờ là để công nghệ dừng bước, mà là để khả năng phòng thủ đuổi kịp tốc độ tiến hóa của công nghệ.
AI là một thanh kiếm hai lưỡi, nó vừa có thể trở thành lưỡi dao trong tay kẻ tấn công, vừa có thể trở thành tấm khiên trước mặt những người phòng thủ.
Tương lai thế giới mạng sẽ đi về phía nào, phụ thuộc vào việc chúng ta có thể kịp thời thiết lập các quy tắc, công cụ và cơ chế hợp tác tương ứng, để mỗi lần phát hiện lỗ hổng không chỉ bảo vệ một công ty, mà trở thành "bản vá an ninh" được toàn ngành chia sẻ.
Ngày nay, cửa sổ của người phòng thủ đã mở;
Điều chúng ta cần làm, chính là trước khi nó đóng lại, biến AI thành phòng tuyến, chứ không phải điểm yếu.
Liên kết tham khảo:
[1]https://blog.gregbrockman.com/the-defenders-window
[2]https://www.youtube.com/watch?v=87DyyMV0kCY
[3]https://huggingface.co/blog/agent-intrusion-technical-timeline
[4]https://www.anthropic.com/system-cards
[5]https://www.tomshardware.com/tech-industry/artificial-intelligence/ai-coding-platform-goes-rogue-during-code-freeze-and-deletes-entire-company-database-replit-ceo-apologizes-after-ai-engine-says-it-made-a-catastrophic-error-in-judgment-and-destroyed-all-production-data
[6]https://openai.com/index/our-views-on-ai-policy-and-political-advocacy/
Bài viết này đến từ tài khoản công chúng WeChat "Qubit", tác giả: Quan tâm công nghệ tiên phong





