Theo dự đoán của Polymarket, Anthropic rất có thể sẽ IPO vào cuối tháng 10.
Một số nhân sự ngân hàng đầu tư thậm chí dự kiến, Anthropic có thể huy động được hơn 600 tỷ USD thông qua IPO.
Nếu thành hiện thực, đây sẽ là đợt IPO có quy mô lớn thứ hai toàn cầu, chỉ sau SpaceX với 857 tỷ USD huy động được trong năm nay.

Định giá nghìn tỷ, IPO siêu cấp, doanh thu tăng vọt.
Khi câu chuyện sắp đến cao trào, nhà đầu tư lại bắt đầu khuyên CEO của Anthropic Dario Amodei:
Ông có thể! Đừng dọa người ta nhiều như vậy không!
Đừng nói quá nhiều về việc AI hủy diệt thế giới, hãy nói nhiều hơn về việc AI kiếm tiền như thế nào.

Một số nhà đầu tư cho rằng, sự cảnh giác của Dario đối với rủi ro AI đã đến mức gần như ám ảnh:
Các bản ghi nhớ quan trọng của ông luôn viết tay, lưu trữ ngoại tuyến, sợ bị hacker đánh cắp;
Vì sợ bị bắt cóc, từ chối một số chuyến công tác nước ngoài;
Trước những đề xuất tối đa hóa lợi nhuận từ nhà đầu tư, ông cũng tỏ thái độ lạnh nhạt, kiên trì rằng Anthropic nên tiếp tục đặt sứ mệnh an toàn lên hàng đầu.
Cứ tiếp tục như vậy, cư dân mạng cũng lo ngại đợt IPO của Anthropic sẽ thất bại thảm hại...

Nhà đầu tư cũng nổi điên: Ông rốt cuộc là đến để cứu thế giới, hay là để điều hành công ty??
Dario, chuyên trách dự báo ngày tận thế
Ngay mới vài ngày trước, Dario còn lo ngại những nhân viên mới bị thu hút bởi mức lương cao sẽ quan tâm đến tiền hơn là sứ mệnh của Anthropic.
Giờ đây, nhà đầu tư chỉ lo ông vì sứ mệnh mà bỏ lỡ cơ hội kiếm tiền...

Cũng không trách nhà đầu tư, bởi vị CEO của gã khổng lồ AI nghìn tỷ này, lại thích dự báo 'ngày tận thế'.
Hai năm qua, Dario gần như đã cảnh báo một cách nghiêm túc về mọi kết cục xấu mà AI có thể mang lại.
Ông cảnh báo, AI có thể trong vài năm tới sẽ xóa sổ một nửa số vị trí nhân viên văn phòng sơ cấp, đẩy tỷ lệ thất nghiệp lên 10% đến 20%.
Tình huống kỳ quặc nhất có lẽ là, ung thư được chữa khỏi, kinh tế tăng trưởng 10% mỗi năm, ngân sách chính phủ cũng cân bằng, nhưng một phần năm dân số không có việc làm.
Giải pháp đối phó mà ông đưa ra cũng rất 'Dario': Đánh thuế các công ty AI, cung cấp bảo hiểm lương cho người lao động bị ảnh hưởng, nghiêm trọng hơn thậm chí dùng số tiền này để tài trợ cho thu nhập cơ bản toàn dân.
Tiến thêm một bước, ông còn lo ngại AI hỗ trợ chế tạo vũ khí sinh học, phát động các cuộc tấn công mạng quy mô lớn, hoặc dần dần có được khả năng lừa dối, lập kế hoạch và hành động tự chủ.
Năm ngoái khi được hỏi về xác suất 'AI làm mọi thứ trở nên rất tồi tệ', con số ông đưa ra cao nhất lên đến 25%.

Tháng 1 năm nay, ông lại viết một bài dài khoảng 20.000 chữ mang tên "Thời kỳ thanh thiếu niên của Công nghệ".
Chỉ riêng phần mục lục, đọc lên đã giống như một danh sách rủi ro của nhân loại: AI mất kiểm soát, vũ khí sinh học, chế độ độc tài, sụp đổ việc làm, tập trung của cải.

Đến tháng 6, ông thẳng thắn đề xuất, nên thiết lập cơ chế giám sát tương tự như hàng không, thực hiện kiểm tra bắt buộc đối với các mô hình mạnh. Nếu một mô hình có khả năng gây ra thảm họa, cơ quan quản lý nên có quyền ngăn chặn nó ra mắt.
Điều này cũng bao gồm cả các mô hình của chính Anthropic.
Tuy nhiên, những lo ngại của Dario cũng không phải hoàn toàn không có cơ sở thực nghiệm.
Gần đây, Anthropic rà soát hơn 140.000 bản ghi kiểm tra an ninh mạng, kết quả thực sự lật ra được ba sự cố.

Ba mô hình Claude ban đầu thực hiện "thử thách cướp cờ" trong môi trường kiểm tra của bên thứ ba, mục tiêu là tấn công vào hệ thống hư cấu, tìm thông tin bí mật được giấu bên trong.
Nhưng do lỗi cấu hình, môi trường kiểm tra đáng lẽ phải ngắt mạng lại vô tình kết nối với internet thực.
Nhưng Claude không biết, gợi ý mà nó nhận được ghi rõ: Ở đây không có internet, mọi thứ trước mắt đều là mô phỏng.
Do đó, một số mô hình đã coi các công ty thực là công cụ kiểm tra, xâm nhập trái phép vào hệ thống sản xuất của ba tổ chức.
Trong đó nghiêm trọng nhất là lần Claude Opus 4.7 tấn công vào cơ sở hạ tầng của một công ty thực, lấy được thông tin xác thực ứng dụng và cơ sở hạ tầng, đồng thời truy cập vào một cơ sở dữ liệu chứa hàng trăm dòng dữ liệu sản xuất.

Một lần lố bịch hơn đến từ Claude Mythos 5.
Thử nghiệm yêu cầu nó tìm một mục tiêu ẩn trong môi trường hư cấu. Claude phát hiện, nếu tải lên một gói phần mềm độc hại cùng tên trên kho phần mềm Python công cộng PyPI, có thể khiến hệ thống mục tiêu tự động tải xuống và cài đặt.
Để hoàn thành bước này, đầu tiên nó tìm kiếm hộp thư điện tử, rồi tìm kiếm số điện thoại; khi không tìm được số miễn phí, nó còn thử kiếm tiền thông qua các con đường khác nhau.
Cuối cùng, nó đổi sang một dịch vụ email miễn phí khác, đăng ký tài khoản PyPI, và tải gói phần mềm độc hại lên.
Gói phần mềm này tồn tại trên internet thực khoảng một giờ, bị 15 hệ thống thực tải xuống và chạy.
Một trong số đó là máy quét của một công ty an ninh đã thực thi mã độc, dẫn đến rò rỉ thông tin xác thực, sau đó Claude lại lợi dụng những thông tin xác thực này để xâm nhập vào các cơ sở hạ tầng khác của công ty đó.
Lại có một mô hình nghiên cứu nội bộ, sau khi không tìm thấy mục tiêu hư cấu, đã quét khoảng 9000 mục tiêu internet, cuối cùng thông qua trang gỡ lỗi bị lộ và SQL injection, đã tấn công và xâm nhập ứng dụng của một công ty thực.
Điều này gần như là "AI tự chủ vượt ngục", đơn giản là bản trailer thực tế cho những cảnh báo ngày tận thế của CEO công ty.

Trước đó nữa, OpenAI cũng từng tiết lộ một vụ việc gần với "vượt ngục" hơn.
Trong bài kiểm tra năng lực an ninh mạng, AI Agent được điều khiển bởi GPT-5.6 Sol và một mô hình chưa phát hành, đã tìm thấy một lỗ hổng zero-day trong môi trường kiểm tra, phá vỡ sandbox vốn bị cô lập với internet.
Lại tiếp tục hoàn thành leo thang đặc quyền và di chuyển ngang, cuối cùng đột nhập vào hệ thống sản xuất của Hugging Face, trực tiếp ăn cắp đáp án đề thi từ cơ sở dữ liệu.
Nhìn vậy... những cảnh báo nghe có vẻ hoang tưởng của Dario, thực sự cũng không thể hoàn toàn bỏ ngoài tai.
Nhưng nhà đầu tư ban đầu, chẳng phải đã "ăn" bài này sao
Giờ mới chê Dario hoang tưởng, có hơi muộn.
Bởi vì Anthropic ngay từ ngày đầu tiên, đã không phải là một công ty AI theo nghĩa bình thường.
Cuối năm 2020, Dario, em gái Daniela Amodei và một nhóm nhà nghiên cứu rời OpenAI. Một trong những điểm bất đồng, là họ cho rằng tốc độ thương mại hóa của OpenAI quá nhanh, ảnh hưởng của Microsoft ngày càng lớn, cơ cấu quản trị cũ khó có thể kiềm chế rủi ro AI tiên phong.
Năm 2021, Anthropic chính thức thành lập.
Công ty thậm chí không đơn giản định nghĩa mình là một công ty thương mại, mà đăng ký là Public Benefit Corporation, tức là công ty lợi ích công cộng. Ngoài lợi nhuận cho cổ đông, hội đồng quản trị còn có thể xem xét đến an toàn AI và lợi ích công cộng lâu dài theo pháp luật.
Công ty sau đó lại thiết lập Long-Term Benefit Trust, đây là một cơ chế quản trị độc lập với các nhà đầu tư thông thường.
Thành viên ủy thác không nắm giữ cổ phần của Anthropic, nhưng lại có thể tham gia bầu cử giám đốc công ty, mục đích là để tránh áp lực thương mại ngắn hạn hoàn toàn lấn át sứ mệnh an toàn.
Nói cách khác, an toàn AI là niềm tin đã được khắc sâu vào xương tủy của công ty này ngay từ Day 0. Nhà đầu tư chắc chắn cũng không phải ký séc xong mới phát hiện ra Dario tin vào điều này.

Và trong vài năm qua, tường thuật về an toàn thực sự đã mang lại không ít lợi ích cho Anthropic.
Khi OpenAI liên tục vướng vào tranh cấp quản trị, Anthropic trở thành lựa chọn có vẻ kiềm chế và ổn định hơn.
Khi khách hàng doanh nghiệp lo ngại về an ninh dữ liệu, mô hình mất kiểm soát và vấn đề tuân thủ, hình ảnh "học sinh ưu tú về an toàn" của Claude cũng dễ dàng giành được sự tin tưởng hơn.
An toàn còn giúp Anthropic giành được tiếng nói trong thảo luận quản lý vượt xa quy mô công ty.
Cùng là mô hình mã đóng, người khác có thể bị chê là độc quyền, Anthropic có thể giải thích là để ngăn chặn khả năng nguy hiểm lan rộng; cùng là thêm hạn chế cho mô hình, người khác có thể bị chê là khó dùng, Claude lại có thể đóng gói nó thành trách nhiệm.
(Tất nhiên cũng không ảnh hưởng đến việc họ vừa miệng nói an toàn, vừa IPO mở sâm banh là được)

Nhà đầu tư giờ chê Dario quá giống nhà truyền giáo, có hơi muộn không.
Tương tự như mua một nhà thờ xong, mới phàn nàn người trong đó suốt ngày giảng đạo...
Dù sao thì CEO có hoang tưởng đến đâu, chắc cũng không thể ngăn cản bước tiến IPO của công ty.
Bởi vì chỉ cần sử dụng Fable một chút, bạn sẽ ngồi phịch xuống quả bom nguyên tử, nhìn thấy chiếc ghế phát nổ (doge).
Tài liệu tham khảo:[1]https://x.com/i/trending/2086082178333511741
Bài viết từ tài khoản công chúng WeChat "Lượng Tử Vị", tác giả: Thính Vũ





