Anthropic tạo ra mô hình AI mạnh nhất lịu sử, nhưng không dám công bố...

Odaily星球日报Xuất bản vào 2026-04-08Cập nhật gần nhất vào 2026-04-08

Tóm tắt

Công ty AI Anthropic vừa công bố kế hoạch "Cánh Thủy Tinh" (Project Glasswing), hợp tác với các tập đoàn hàng đầu như Amazon, Apple, Google, Microsoft, NVIDIA… nhằm bảo vệ phần mềm toàn cầu. Động lực chính là Mythos - mô hình AI thế hệ mới với quy mô 10 nghìn tỷ tham số, chi phí huấn luyện lên tới 10 tỷ USD. Mythos được cho là mô hình mạnh nhất từ trước đến nay, vượt trội so với Claude Opus 4.6 trong mã hóa, lập luận học thuật và an ninh mạng. Chỉ trong vài tuần, nó đã tự động phát hiện hàng nghìn lỗ hổng "zero-day" nghiêm trọng trong các hệ thống then chốt như OpenBSD, FFmpeg và Linux kernel, bao gồm những lỗi tồn tại hơn 20 năm. Do khả năng khai thác lỗ hổng quá mạnh, Anthropic không công bố rộng rãi mà cho các đối tác trong chương trình dùng thử Mythos Preview để sửa lỗi trước. Họ cam kết tài trợ 100 triệu USD chi phí sử dụng và quyên góp 4 triệu USD cho các tổ chức mã nguồn mở. Anthropic lạc quan cho rằng, dù AI có thể bị lợi dụng, nó cũng mang lại giá trị to lớn trong việc phát hiện và sửa lỗi, giúp xây dựng hệ thống phòng thủ mạnh hơn. Báo cáo chi tiết về kết quả sẽ được công bố sau 90 ngày.

Bài gốc | Odaily Planet Daily (@OdailyChina)

Tác giả | Azuma (@azuma_eth)

Ngày 8 tháng 4, Anthropic, công ty phát triển AI đứng sau Claude, đã chính thức công bố sẽ ra mắt một kế hoạch mới có tên "Cánh Thủy Tinh" (Project Glasswing). Kế hoạch này sẽ được triển khai phối hợp cùng nhiều tập đoàn hàng đầu như Amazon, Apple, Broadcom, Cisco, CrowdStrike, Google, JPMorgan Chase, Linux Foundation, Microsoft, NVIDIA và Palo Alto Networks.

Anthropic cho biết, đây là một biện pháp khẩn cấp nhằm bảo vệ phần mềm quan trọng nhất toàn cầu, các bên sẽ cùng nhau sử dụng phiên bản xem trước Mythos để phát hiện và sửa chữa các lỗ hổng tiềm ẩn trong các hệ thống mà thế giới hiện đang phụ thuộc vào.

Mythos được nhắc đến, chính là mô hình AI thế hệ tiếp theo mà Anthropic đang phát triển. Đây là mô hình đầu tiên trong lịch sử nhân loại đạt quy mô tham số tổng vượt mười nghìn tỷ (so với các mô hình phổ biến hiện nay có số tham số trong khoảng vài trăm tỷ đến một nghìn tỷ), với chi phí huấn luyện lên tới 100 tỷ USD đáng kinh ngạc. So với mô hình mạnh nhất hiện tại của Claude là Opus 4.6, Mythos đạt điểm số cao hơn đáng kể trong các bài kiểm tra về mã hóa phần mềm, lập luận học thuật và an ninh mạng.

Tin đồn về Mythos đã lan truyền trên thị trường từ tuần trước, mối lo ngại phổ biến lúc đó là — liệu Mythos với khả năng chuyên biệt về an ninh mạng có ảnh hưởng đến cục diện phòng thủ an ninh hiện tại? Nếu bị kẻ xấu lợi dụng, nó có thể gây ra các sự cố an ninh quy mô lớn hơn? Odaily lúc đó cũng đã đưa tin về sự việc và từng thảo luận với chuyên gia an ninh ngành, nhà sáng lập SlowMist, Cosine, về tác động tiềm ẩn đối với an ninh phòng thủ trong ngành công nghiệp tiền mã hóa (xem chi tiết 《Odaily Phỏng vấn Cosine: Mô hình mới hạt nhân của Anthropic bị rò rỉ, ảnh hưởng thế nào đến an ninh phòng thủ mã hóa?》), nhưng lúc đó phía Anthropic chưa công khai thừa nhận sự tồn tại của Mythos, nên thông tin liên quan vẫn còn hạn chế.

Vào ngày 8 tháng 4, cùng với việc công bố kế hoạch "Cánh Thủy Tinh", Anthropic cũng tiết lộ thêm nhiều chi tiết liên quan đến Mythos. Dựa trên các trường hợp thử nghiệm thực tế mà Anthropic công bố, Anthropic không hề phóng đại khả năng của Mythos, đến mức công ty này thậm chí không dám trực tiếp công bố rộng rãi mô hình này, để phòng tránh việc bị các nhóm hacker lợi dụng cho mục đích xấu, mà thay vào đó lên kế hoạch cho các tập đoàn lớn dùng thử thông qua kế hoạch "Cánh Thủy Tinh" để sớm kiểm tra và vá các lỗ hổng tiềm ẩn.

Mythos khoe cơ bắp: Chỉ vài tuần, đào được hàng nghìn "lỗ hổng zero-day"

Khi nói về sức mạnh của Mythos, Anthropic thẳng thắn tuyên bố, sự ra đời của mô hình này đồng nghĩa với một thực tế nghiêm trọng đã đến — khả năng mã hóa của mô hình AI đã đạt đến trình độ cực cao, trong việc phát hiện và khai thác lỗ hổng phần mềm, chúng gần như có thể vượt qua tất cả mọi người ngoại trừ những con người thành thạo nhất.

Theo tiết lộ từ phía Anthropic, chỉ trong vòng vài tuần ngắn ngủi, Anthropic đã sử dụng Mythos để xác định được hàng nghìn lỗ hổng zero-day (tức những lỗi mà ngay cả nhà phát triển phần mềm cũng chưa từng phát hiện ra), trong đó nhiều lỗi thuộc loại nguy hiểm cao, vấn đề bao phủ tất cả các hệ điều hành chính và trình duyệt chủ lưu, đồng thời ảnh hưởng đến một loạt phần mềm quan trọng khác.

Anthropic đưa ra một vài trường hợp điển hình:

  • Mythos phát hiện một lỗ hổng tồn tại 27 năm trong OpenBSD, hệ thống vốn nổi tiếng với độ "cực kỳ an toàn", được sử dụng rộng rãi trong các cơ sở hạ tầng quan trọng như tường lửa, và lỗ hổng này cho phép kẻ tấn công từ xa trực tiếp làm sụp đổ hệ thống;
  • Trong thư viện xử lý video FFmpeg được sử dụng rộng rãi, Mythos tìm thấy một lỗ hổng tồn tại 16 năm, đoạn mã chứa lỗi này đã từng được kích hoạt bởi kiểm tra tự động hơn 5 triệu lần, nhưng始终(chưa bao giờ) được phát hiện;
  • Mythos còn có thể tự động kết nối nhiều lỗ hổng trong nhân Linux, leo thang từ quyền người dùng thông thường để giành quyền kiểm soát hoàn toàn máy chủ.

Đáng lo ngại hơn, Anthropic cho biết phần lớn các lỗ hổng này là do Mythos "tự động phát hiện và xây dựng đường dẫn khai thác" với rất ít sự can thiệp của con người, điều này có lẽ意味着(AI) đã bắt đầu có được khả năng tự động hóa tấn công-phòng thủ tương tự như các nhóm hacker đỉnh cao.

Trên các điểm chuẩn đánh giá, Mythos so với Opus 4.6 cũng thể hiện sự tiến hóa vượt bậc. Ví dụ, trong bài kiểm tra tái hiện lỗ hổng an ninh mạng, Mythos đạt 83.1%, trong khi Opus 4.6 chỉ đạt 66.6%; trong nhiều bài kiểm tra mã hóa và suy luận, điểm số của Mythos cũng dẫn đầu vượt trội.

Có lẽ chính vì khả năng của Mythos quá mạnh mẽ, Anthropic đã không chọn cách mở trực tiếp mô hình, mà trước tiên đưa ra kế hoạch "Cánh Thủy Tinh", để toàn bộ Internet sớm được "gia cố".

Thông qua kế hoạch này, Anthropic sẽ mở sớm phiên bản xem trước Mythos Preview cho các bên tham gia kế hoạch, để phát hiện và sửa chữa lỗ hổng hoặc điểm yếu trong hệ thống cơ sở của họ — tập trung vào các nhiệm vụ như phát hiện lỗ hổng cục bộ, kiểm tra hộp đen chương trình nhị phân, củng cố an ninh đầu cuối và kiểm tra thâm nhập hệ thống.

Anthropic còn cam kết, sẽ cung cấp cho các bên tham gia kế hoạch tổng hạn mức sử dụng mô hình trị giá 100 triệu USD, để hỗ trợ việc sử dụng trong toàn bộ giai đoạn xem trước nghiên cứu. Sau đó, phiên bản Mythos Preview sẽ được mở cho các bên tham gia với giá lần lượt là 25 USD / 125 USD cho mỗi triệu tokens đầu vào / đầu ra (người tham gia cũng có thể truy cập mô hình này thông qua Claude API, Amazon Bedrock, Google Cloud Vertex AI và Microsoft Foundry). Ngoài hạn mức sử dụng mô hình, Anthropic còn thông qua Linux Foundation quyên tặng 2.5 triệu USD cho Alpha-Omega và OpenSSF, và quyên tặng 1.5 triệu USD cho Apache Software Foundation, để giúp những người bảo trì phần mềm mã nguồn mở ứng phó với môi trường an ninh không ngừng thay đổi.

Anthropic có kế hoạch mở rộng dần phạm vi tham gia của "Cánh Thủy Tinh" và tiếp tục thúc đẩy trong nhiều tháng, đồng thời chia sẻ kinh nghiệm nhiều nhất có thể, để các tổ chức khác có thể áp dụng kinh nghiệm liên quan vào việc xây dựng an ninh của chính họ. Trong vòng 90 ngày, Anthropic sẽ công bố báo cáo kết quả giai đoạn, bao gồm các lỗ hổng đã được sửa chữa và các biện pháp cải thiện an ninh có thể tiết lộ.

Công nghệ chỉ không ngừng nâng cấp, nhưng cũng không cần quá lo lắng

AI đang thay đổi thế giới quen thuộc của chúng ta một cách không thể đảo ngược, bao gồm cả lĩnh vực an ninh mạng được đề cập trong bài viết này. Khi ngưỡng phát hiện và khai thác lỗ hổng giảm mạnh, mọi người không khỏi lo ngại, liệu AI có trở thành lưỡi dao trong tay kẻ có ý đồ xấu, đe dọa sự cân bằng an ninh mạng hiện có? (PS: Đối với người dùng tiền mã hóa cần đặt tiền thật trong hệ thống ví hoặc giao thức trên chuỗi, mối lo ngại này sẽ đặc biệt mạnh mẽ.)

Đối với vấn đề này, Anthropic cho rằng "chúng ta vẫn có lý do để lạc quan", lý do mô hình AI nguy hiểm chính là vì chúng có khả năng gây hại trong tay những kẻ bất hợp pháp, nhưng đồng thời, AI cũng có giá trị không thể đánh giá hết được trong việc phát hiện và sửa chữa lỗi phần mềm quan trọng cũng như phát triển phần mềm mới an toàn hơn.

Có thể dự đoán, trong vài năm tới khả năng của AI vẫn sẽ tiến hóa nhanh chóng, nhưng khi phương thức tấn công mới xuất hiện, cơ chế phòng thủ mới cũng sẽ đồng thời xuất hiện. Nâng cấp công nghệ là không thể tránh khỏi, nhưng điều này không có nghĩa rủi ro必然(tất yếu) mất kiểm soát — chỉ cần hệ thống phòng thủ tiến hóa đồng bộ, thậm chí có thể借助(dựa vào) AI để xây dựng hào thành an ninh cường độ cao hơn.

Câu hỏi Liên quan

QAnthropic đã công bố kế hoạch gì vào ngày 8 tháng 4?

AAnthropic đã công bố kế hoạch 'Cánh Thủy Tinh' (Project Glasswing), một sáng kiến hợp tác với các công ty hàng đầu như Amazon, Apple, Google, Microsoft, NVIDIA và nhiều công ty khác để bảo vệ phần mềm quan trọng toàn cầu bằng cách sử dụng phiên bản Mythos Preview để phát hiện và sửa chữa các lỗ hổng tiềm ẩn.

QMô hình AI Mythos của Anthropic có những điểm đột phá nào?

AMythos là mô hình AI đầu tiên trên thế giới đạt quy mô tham số hơn 10 nghìn tỷ, với chi phí đào tạo lên tới 10 tỷ USD. Nó vượt trội so với Claude Opus 4.6 trong các bài kiểm tra mã hóa phần mềm, lập luận học thuật và an ninh mạng.

QTại sao Anthropic không công bố rộng rãi mô hình Mythos?

AAnthropic không công bố rộng rãi Mythos vì lo ngại khả năng mô hình có thể bị các nhóm tin tặc lợi dụng để khai thác lỗ hổng phần mềm. Thay vào đó, họ triển khai kế hoạch 'Cánh Thủy Tinh' để các công ty lớn kiểm tra và vá lỗi trước.

QMythos đã đạt được những kết quả ấn tượng nào trong thử nghiệm?

ATrong vài tuần, Mythos đã phát hiện hàng nghìn lỗ hổng zero-day, bao gồm các lỗ hổng nghiêm trọng trong hệ điều hành, trình duyệt và phần mềm then chốt. Nó cũng tìm thấy lỗi tồn tại 27 năm trong OpenBSD và 16 năm trong FFmpeg.

QLàm thế nào Anthropic hỗ trợ các tổ chức tham gia kế hoạch 'Cánh Thủy Tinh'?

AAnthropic cung cấp 100 triệu USD credit sử dụng mô hình Mythos Preview cho các đối tác, đồng thời quyên góp 4 triệu USD cho các tổ chức như Linux Foundation và Apache Software Foundation để hỗ trợ bảo mật phần mềm nguồn mở.

Nội dung Liên quan

Đối thoại với Ray Dalio: Chúng ta đang ở trong bong bóng AI, 1% danh mục đầu tư của tôi là Bitcoin

Ray Dalio, người sáng lập Bridgewater Associates, trong một cuộc phỏng vấn đã chỉ ra rằng thế giới hiện tại đang trong một "AI bubble" (bong bóng AI) cổ điển, với giá tài sản tăng vọt và đầu cơ quá mức. Ông cảnh báo bong bóng có thể vỡ do lãi suất tăng, nguồn cung cổ phiếu dư thừa hoặc khi nhà đầu tư cần tiền mặt trả nợ, dẫn đến suy thoái kinh tế. Đồng thời, Dalio mô tả một "chu kỳ lớn" kéo dài khoảng 80 năm, bao gồm ba động lực chồng chéo: khoảng cách giàu nghèo và xung đột nội bộ, thâm hụt ngân sách chính phủ khổng lồ và thay đổi địa chính trị. Ông nhấn mạnh rằng Mỹ và Anh đang đối mặt với những thách thức trong giai đoạn suy yếu này. Để bảo vệ của cải, Dalio khuyến nghị đa dạng hóa danh mục đầu tư với cổ phiếu, vàng, trái phiếu, bất động sản thay vì chỉ giữ tiền mặt. Ông tiết lộ khoảng 1% danh mục của mình là Bitcoin, nhưng vẫn ưa chuộng vàng vật chất hơn do tính ổn định và vai trò tiền tệ dự trữ. Về tác động của AI, Dalio cho rằng nó không chỉ thay thế lao động chân tay mà còn cả tư duy, làm trầm trọng thêm bất bình đẳng thu nhập. Con người cần phát huy trí tuệ cảm xúc và trực giác - những thứ AI chưa có - và học cách hợp tác với AI. Cuối cùng, ông phân tích những rủi ro của thuế tài sản và xu hướng thế giới có thể trở nên "khu vực hóa" hơn, với các khối như châu Mỹ và châu Á - Thái Bình Dương, trong bối cảnh sự thống trị toàn cầu của Mỹ đang suy yếu.

marsbit19 phút trước

Đối thoại với Ray Dalio: Chúng ta đang ở trong bong bóng AI, 1% danh mục đầu tư của tôi là Bitcoin

marsbit19 phút trước

Hơn 7.2 nghìn tỷ won trong một ngày, ngoại hải nước ngoài mua ròng kỷ lục vào thứ Sáu! Phố Wall: Cơn gió ngược về mặt vốn của thị trường chứng khoán Hàn Quốc đã tan biến

Dòng vốn nước ngoài đổ mạnh vào thị trường chứng khoán Hàn Quốc (KOSPI) với mức mua ròng kỷ lục 7,2 nghìn tỷ won chỉ trong ngày 31/7, đánh dấu sự đảo chiều rõ rệt sau nhiều tháng bán ròng mạnh. Theo báo cáo từ Citigroup, áp lực bán từ dòng vốn nước ngoài đã giảm đáng kể, với mức bán ròng tháng 7 thu hẹp còn 9,8 nghìn tỷ won so với mức 48,4 và 44,5 nghìn tỷ won trong tháng 6 và tháng 5. Đồng thời, các quỹ hưu trí và quỹ đầu tư trong nước cũng chuyển sang vị thế mua ròng 1,0 nghìn tỷ won trong tháng 7. Một yếu tố hỗ trợ khác là quy định mới từ Ủy ban Dịch vụ Tài chính Hàn Quốc (FSC), có hiệu lực từ 31/7, siết chặt điều kiện đầu tư vào các ETF có đòn bẩy đối với nhà đầu tư cá nhân. Quy định này đã ngay lập tức làm giảm khoảng 50% khối lượng giao dịch của các ETF này, góp phần kỳ vọng giảm bớt biến động cho thị trường. Citigroup duy trì mục tiêu chỉ số KOSPI ở mức 10.000 điểm, dựa trên các yếu tố thuận lợi như ngành chip bán dẫn ổn định, định giá thị trường thấp, nền tảng kinh tế vững mạnh và các chính sách hỗ trợ. Họ nhận định áp lực dòng vốn ngược chiều đang giảm dần, tạo điều kiện cho các yếu tố cơ bản và chính sách tích cực phát huy tác dụng.

marsbit19 phút trước

Hơn 7.2 nghìn tỷ won trong một ngày, ngoại hải nước ngoài mua ròng kỷ lục vào thứ Sáu! Phố Wall: Cơn gió ngược về mặt vốn của thị trường chứng khoán Hàn Quốc đã tan biến

marsbit19 phút trước

Làm thế nào để khiến bản thân trở nên không thể bị thay thế bởi trí tuệ nhân tạo

**Tóm tắt: Làm thế nào để trở nên không thể bị thay thế bởi AI** Bài viết phản đối việc than vãn về AI và thay vào đó đề xuất một giải pháp căn cơ: trở thành một "siêu cá nhân" không thể bị thuê mướn. Mối đe dọa thực sự không phải là AI, mà là tình trạng "nô lệ lương thưởng" – phụ thuộc hoàn toàn vào người khác để sinh tồn, làm công việc nhàm chán mà không có mục đích. Để thoát khỏi vòng luẩn quẩn này và phát triển mạnh trong kỷ nguyên AI, bạn cần trau dồi 5 yếu tố then chốt: 1. **Tính tự chủ:** Khả năng hành động mà không cần chờ chỉ thị. 2. **Khiếu thẩm mỹ:** Khả năng nhận biết điều gì thực sự có giá trị. 3. **Khả năng thuyết phục:** Thu hút sự chú ý và sự công nhận. 4. **Sự kiên trì:** Không sợ thất bại, xem đó là bài học. 5. **Khả năng lặp:** Điều chỉnh dựa trên phản hồi để tiến tới mục tiêu. Giải pháp là đầu tư vào sự nghiệp của chính mình. Trong khi AI giỏi tạo ra "tài sản" (nội dung, code), nó không thể thay thế được khả năng phân biệt thứ gì đáng để tạo ra, làm cho mọi người quan tâm và kiên trì theo đuổi. Trong hai kỹ năng đòn bẩy mạnh mẽ là **Code (Lập trình)** và **Media (Nội dung)**, bài viết nhấn mạnh **Nội dung** quan trọng hơn. Giá trị của nội dung là chủ quan và đòi hỏi sự am hiểu, trải nghiệm mà AI khó có được, tạo không gian cho các cá nhân sáng tạo thực sự. **Cách bắt đầu (Bài tập 15 phút):** 1. **Khai thác nguyên liệu thô của bạn:** Xác định chủ đề bạn am hiểu sâu, vấn đề bạn tự giải quyết được, hay sở thích đặc biệt từ nhỏ. 2. **Xác định "trục phản biện" của bạn:** Tìm ra quan điểm độc đáo của bạn – những điều bạn tin là đúng nhưng số đông lại sai trong lĩnh vực của mình. 3. **Xuất bản ý tưởng đầu tiên:** Kết hợp câu trả lời từ bước 1 và 2, tạo ra một nội dung (bài đăng, video) và đăng nó lên. Hành động này mang lại phản hồi thực tế, bắt đầu quá trình học hỏi, lặp lại và phát triển kỹ năng thuyết phục. Bằng cách xây dựng một sự nghiệp xoay quanh con người thật, trải nghiệm thật và góc nhìn độc đáo của mình thông qua nội dung, bạn có thể tạo ra giá trị mà AI không thể sao chép, từ đó trở nên không thể thay thế.

marsbit2 giờ trước

Làm thế nào để khiến bản thân trở nên không thể bị thay thế bởi trí tuệ nhân tạo

marsbit2 giờ trước

Nhờ việc tung xúc xắc, chìa khóa Bitcoin được lưu trữ offline, nhưng không phải ai cũng muốn làm điều này

Cảm biến từ cuộc tranh cãi gần đây xung quanh lỗ hổng trong ví phần cứng Coldcard, bài viết thảo luận về phương pháp tạo seed (cụm từ khôi phục) cho ví Bitcoin bằng cách xúc xắc vật lý. Mỗi lần xúc xắc công bằng cung cấp khoảng 2,6 bit entropy (thước đo tính ngẫu nhiên). Để đạt mức entropy an toàn cho một seed 12 từ (128 bit), cần khoảng 50 lần xúc xắc; Coldcard khuyến nghị 99 lần để đạt mức bảo mật cao hơn. Lợi thế chính của phương pháp này là tách biệt hoàn toàn với bất kỳ lỗi phần cứng hoặc phần mềm nào trong trình tạo số ngẫu nhiên của thiết bị, từ đó bảo vệ seed chính của ví. Tuy nhiên, bài viết cảnh báo rằng trong sự cố Coldcard, các chức năng phụ khác của thiết bị (như tạo ví giấy, khóa đa chữ ký, mật mã phiên USB) vẫn có thể bị ảnh hưởng nếu chúng dựa vào trình tạo số lỗi, ngay cả khi seed chính được tạo an toàn bằng xúc xắc. Nhược điểm lớn của việc dùng xúc xắc là quá trình thủ công, dễ xảy ra sai sót, tốn thời gian và không thực tế cho đa số người dùng mới. Người dùng có thể ghi chép sai, sử dụng xúc xắc gian lận, hoặc để lộ chuỗi kết quả. Do đó, mặc dù có nền tảng toán học vững chắc, phương pháp này đòi hỏi sự tỉ mỉ cao và không phải là giải pháp khả thi cho việc áp dụng Bitcoin rộng rãi. Bài viết kết luận rằng mục tiêu dài hạn vẫn là phát triển phần cứng/phần mềm tạo số ngẫu nhiên mạnh mẽ và đáng tin cậy, trong khi vẫn giữ phương pháp thủ công như một tùy chọn cho người dùng có kinh nghiệm. Cuối cùng, bài viết đưa ra khuyến nghị cho chủ sở hữu Coldcard: cập nhật firmware, kiểm tra các chức năng phụ đã sử dụng và xem xét các biện pháp bảo mật bổ sung như ví đa chữ ký kết hợp nhiều nhà sản xuất để giảm thiểu rủi ro từ một điểm yếu đơn lẻ.

cryptonews.ru5 giờ trước

Nhờ việc tung xúc xắc, chìa khóa Bitcoin được lưu trữ offline, nhưng không phải ai cũng muốn làm điều này

cryptonews.ru5 giờ trước

Giao dịch

Giao ngay
活动图片