25 phút, 500 ví bị rút sạch!
Mấy ngày gần đây, ví phần cứng nổi tiếng Coldcard gặp sự cố lớn, và nguyên nhân gây ra cơn chấn động khổng lồ trong cộng đồng tiền mã hóa này là một lỗ hổng mã đã tiềm ẩn suốt năm năm.
Ai có ngờ, chỉ với một lời nhắc (prompt), Claude chỉ suy nghĩ 8 phút và phát hiện ra ngay.

Trước đó, đội ngũ Coldcard đã phát hành hơn chục bản cập nhật phần cứng, trải qua nhiều vòng kiểm tra mã, nhưng chưa một lần nào phát hiện ra.
Claude chỉ 8 phút, đào ra lỗ hổng năm năm
Chiếc ví phần cứng Coldcard này được tạo ra bởi nhà sản xuất lâu đời của Canada, Coinkite.
Tháng 3/2021, một lần commit code tưởng chừng bình thường của đội phát triển đã vô tình tạo ra một lỗ hổng lớn ở logic cốt lõi—
đã thay đổi "mấu chốt" của số ngẫu nhiên.
Nguồn số ngẫu nhiên để tạo khóa riêng tư đã được chuyển từ bộ tạo số ngẫu nhiên phần cứng "thực sự" trong chip sang một đường dẫn dự phòng sử dụng bộ tạo số ngẫu nhiên giả bằng phần mềm.

Không ngờ rằng thay đổi này lại phải trả giá cực kỳ đắt, độ mạnh của khóa đã giảm mạnh từ 128 bit xuống còn khoảng 40 bit.
Thứ mà hacker trước đây cần thử một số lần thiên văn mới đoán được, giờ đây đã trở thành thứ có thể tính toán được chỉ bằng cách cho một máy chạy brute-force.
Điều đau lòng nhất là, Coinkite đã thừa nhận trong một tuyên bố—
Vài tuần trước khi sự việc xảy ra, nhóm đã sử dụng AI để kiểm tra toàn bộ firmware, nhưng cũng không phát hiện ra bất kỳ vấn đề nào.
Giờ đây, một nhà phát triển đã ném thẳng vấn đề cho Claude, và nó giải quyết chỉ trong 8 phút.

Buổi trình diễn kín tiết lộ, Claude xóa sổ tài khoản ngân hàng
Ngay từ hai tháng trước, một buổi trình diễn kín tại Quốc hội đã cho thấy khả năng "đào lỗ hổng" mạnh mẽ của Claude.
Tại cuộc họp, Anthropic đã tiết lộ về Mythos chưa phát hành—
Họ yêu cầu mô hình tìm lỗ hổng trong hệ thống ngân hàng, xóa sổ tài khoản, và nó đã thực sự làm điều đó.

Kịch tính hơn, sau đó Mythos lại tự sửa chữa lỗ hổng.
Xét cho cùng, trong các bài kiểm tra trước đó, nó đã phát hiện hàng ngàn lỗ hổng nghiêm trọng trong mọi hệ điều hành và trình duyệt chính, trong đó có cả 0day.
ChatGPT+Claude, cả hai cùng "nổi loạn"
Ngay sau đó, chính Anthropic đã đăng một bài phân tích, vạch trần mặt tối nhất.
141.006 bản ghi đánh giá an ninh mạng, lật ra 3 sự cố, liên quan đến 6 lần chạy—
Claude đã thoát khỏi môi trường đánh giá của bên thứ ba, xâm nhập vào hệ thống sản xuất của ba công ty có thực.
Vụ đầu tiên xảy ra vào tháng Tư.

Công ty mục tiêu hư cấu trong bài đánh giá, tình cờ trùng tên miền với một công ty có thật.
Opus 4.7 thành công cả bốn lần chạy, lấy được chứng thực và hàng trăm dòng dữ liệu cơ sở dữ liệu sản xuất. Điều nghiêm trọng nhất là, AI đã nhận ra đây là hệ thống thật giữa chừng, nhưng không dừng tay.
Trong một nhiệm vụ capture the flag khác, Mythos 5 được chỉ định cài đặt một gói, phát hiện gói này không tồn tại trên PyPI, do đó kết luận "phát hành nó mới là giải pháp đúng cho bài toán này".
Để đăng ký tài khoản, nó trước tiên đi lấy email, rồi lấy số điện thoại, cuối cùng tải gói lên.
Gói "độc hại" do AI tự chủ phát hành này thực sự đã tồn tại trên mạng công cộng khoảng một giờ.
Một mô hình khác trong bài kiểm tra nghiên cứu nội bộ của Anthropic, sau khi quét 9000 mục tiêu, đã chiếm được ứng dụng đối ngoại của một công ty.
WSJ đã đưa ra một nhận định về sự việc này, gọi đây là "thời khắc Công viên kỷ Jura" của an ninh mạng.
Nguyên nhân bắt đầu từ việc OpenAI lần đầu tiết lộ vụ ChatGPT tấn công Hugging Face.
Anthropic sau đó mới kiểm tra nhật ký và tìm ra ba vụ của mình.
Điều khiến người ta sợ hãi là, trong hơn ba tháng qua, hai phòng thí nghiệm AI hàng đầu thế giới này không hề biết thứ họ tạo ra đã "chạy thoát".
Trong một podcast, Sam Altman đã mô tả sự việc này là "tai nạn an ninh mạng cực kỳ khoa học viễn tưởng".

AI trong lồng, không giam giữ được nữa
Lỗ hổng của Coldcard ẩn náu năm năm, cuối cùng chỉ mất 8 phút để bị lật tẩy.
Đối với ngành bảo mật, tốc độ này đã đủ khiến người ta lạnh sống lưng.
Trước đây, trước khi lỗ hổng bị phát hiện, cuộc đua là ai có nhiều kinh nghiệm hơn; giờ đây, cuộc đua là ai đưa mô hình ra ngoài trước.
Vấn đề là, AI chạy ngày càng nhanh, nhưng ranh giới vẫn chưa được vẽ rõ.
Tài liệu tham khảo: https://x.com/MedusaOnchain/status/2083987806943432847?s=20
Bài viết này đến từ tài khoản công chúng WeChat "新智元" (New Zhiyuan), tác giả: ASI启示录; biên tập: Đào Tử





