NVIDIA Công Bố Lần Đầu Tiên Hiệu Năng Thực Tế Của Vera Rubin, Tốc Độ Xử Lý DeepSeek Tăng Vọt 30 Lần

marsbitXuất bản vào 2026-08-25Cập nhật gần nhất vào 2026-08-25

Tóm tắt

NVIDIA lần đầu tiên công bố dữ liệu kiểm tra thực tế trên chip của tủ rack flagship thế hệ tiếp theo Vera Rubin NVL72, sử dụng mô hình DeepSeek-V4-Pro cho tác vụ mã hóa agent thực tế. Kết quả gây sốc: so với GB300 NVL72 hiện tại, thông lượng trên mỗi megawatt của Vera Rubin tăng vọt tối đa 30 lần, và chi phí cho mỗi token giảm mạnh tối đa 35 lần. Điều này báo hiệu sự kết thúc của thời đại LLM và sự trỗi dậy của thời đại Agent, khiến các điểm chuẩn AI cũ trở nên lỗi thời. NVIDIA nhấn mạnh nhu cầu đo lường hiệu suất mới cho luồng công việc Agent hoàn chỉnh, sử dụng điểm chuẩn AgentX. Bên cạnh đó, NVIDIA cũng thông báo sản xuất hàng loạt Groq 3 LPX, bộ tăng tốc suy luận độ trễ thấp chuyên dụng cho nền tảng Vera Rubin, đạt tốc độ xuất token lên đến 3.400 token/giây với Gemma 4 31B, cải thiện đáng kể tốc độ phản hồi. Đặc biệt, NVIDIA giới thiệu Vera CPU, bộ xử lý đầu tiên được thiết kế riêng cho Agent, với 88 lõi Olympus và băng thông bộ nhớ 1.2TB/s. SpaceXAI của Elon Musk đã triển khai Vera CPU và có kế hoạch đưa hệ thống Vera Rubin NVL72 lên vũ trụ vào năm 2028. Những tiến bộ này cho thấy chiến lược của NVIDIA không còn chỉ bán GPU, mà là cung cấp toàn bộ "nhà máy AI" hoàn chỉnh cho kỷ nguyên Agent, định hình lại nền tảng cơ sở hạ tầng tính toán.

Quá nổ tung.

Ngay vừa rồi, lần đầu tiên trong lịch sử, NVIDIA đã công bố dữ liệu thử nghiệm trên chip đầu tiên cho tủ máy flagship thế hệ tiếp theo của họ - Vera Rubin NVL72.

Và, lần thử nghiệm này trực tiếp mời đến DeepSeek -V4-Pro, chạy tác vụ "mã hóa tác nhân" thực tế nhất!

Kết quả đáng kinh ngạc: So với ông vua máy chủ hiện tại là GB300 NVL72, thông lượng trên mỗi megawatt của Vera Rubin tăng vọt cao nhất 30 lần, chi phí cho mỗi Token giảm mạnh nhất 35 lần!

Có người thốt lên: "Ngay cả bản trình bày PPT để gọi vốn đầu tư tôi còn không dám viết như vậy!"

Còn có bình luận thần thánh từ cư dân mạng: "Trước đây còn chê H200 ba mươi nghìn đô một tấm là đắt, giờ nhìn lại, H200 hóa ra còn chưa được tính là phiên bản rút gọn."

Hãy cùng phân tích kỹ một chút.

Từ H200 đến GB300, thông lượng của khối lượng công việc Agent thực tế đã tăng cao nhất 30 lần, chi phí tăng gấp đôi đại khái.

Từ GB300 đến Vera Rubin, thông lượng lại tăng vọt cao nhất 30 lần nữa, giá cả tủ máy đại khái lại tăng gấp đôi.

Theo định luật Moore của ông Hoàng, vậy là trong hai năm qua, đột phá công nghệ lớn nhất của NVIDIA không phải là bản thân GPU, mà là khiến giá cả đắt hơn 4 lần, nhưng đổi lại được tốc độ tăng vọt đến tận 900 lần!

Lần này, NVIDIA tuyên bố với tất cả mọi người một sự thật phản trực giác: Thời đại LLM kết thúc, thời đại Agent đến, tất cả các điểm chuẩn chạy AI trước đây, đều bị bãi bỏ!

Đồng thời, CPU Vera chuyên biệt cho tác nhân thông minh, đã được SpaceXAI của Elon Musk lắp đặt ngay trong đêm, thậm chí chuẩn bị đưa thẳng lên vũ trụ.

Cùng ngày hôm nay, NVIDIA Groq 3 LPX cũng đã sản xuất hàng loạt toàn diện.

Gemma 4 31B chạy trên đó, tốc độ thật tuyệt vời, đạt thẳng đến 3400 Token mỗi giây. Thông lượng của mô hình nghìn tỷ tham số, tăng vọt 35 lần.

Những kỷ lục mới này, trực tiếp khiến cục diện thương mại của hệ sinh thái Agent, bắt đầu từ đêm nay, được viết lại!

Tại sao NVIDIA phải ra mắt Vera Rubin?

Dữ liệu mới nhất từ OpenRouter đã đưa ra câu trả lời: Trong thế giới thực, số lượng Token mà một tác vụ AI Agent tiêu thụ, gấp 15 lần so với cuộc trò chuyện tán gẫu thông thường!

Ví dụ, nếu để một Agent nghiên cứu một công ty cho quyết định đầu tư, trong quá trình này, tác nhân thông minh và các tác nhân con sẽ liên tục suy luận, Token tích lũy trở thành đầu vào cho bước tiếp theo, xử lý ngữ cảnh dài, trở thành yếu tố then chốt nhất hạn chế AI tác nhân.

Số lần tương tác của Agent càng nhiều, thông lượng càng lớn – số lượng Agent tăng 10 lần, việc gọi công cụ tăng 2 lần, mâu thuẫn giữa sức mạnh tính toán và thuật toán thúc đẩy nhu cầu mới.

Đừng lấy trò chuyện làm Agent, điểm chuẩn cũ toàn bộ bỏ đi!

Lúc này, các bài kiểm tra điểm chuẩn AI truyền thống (như kiểm tra chuỗi độ dài cố định 8K/1K) trở nên hoàn toàn vô hiệu.

NVIDIA chính thức nói rõ: Đo lường hiệu suất phải tiến hóa! Không thể chỉ kiểm tra một yêu cầu suy luận đơn lẻ nữa, mà phải nắm bắt toàn bộ quy trình làm việc của Agent.

Vì lý do này, họ đã sử dụng bài kiểm tra điểm chuẩn AgentX thuộc sở hữu của SemiAnalysis.

Bài kiểm tra này không còn là hỏi đáp cứng nhắc, mà là phát lại "phiên làm việc viết mã" thực tế, có sự phát triển ngữ cảnh, gọi công cụ và tạo ra các tác nhân con.

Đây là lý do tại sao H200 tỏ ra bất lực trong chiến trường Agent mới, Vera Rubin chắc chắn sẽ xưng vương.

Vera Rubin NVL72 × DeepSeek-V4-Pro:

Quái vật sức mạnh tính toán đã đến

Để chứng minh sức mạnh của Vera Rubin NVL72, NVIDIA trực tiếp sử dụng vương giả mã nguồn mở – DeepSeek -V4-Pro (1.6T) để thử nghiệm trên chip.

Dữ liệu vừa ra, kết quả kinh ngạc –

Dưới khối lượng công việc AgentX, thông lượng trên mỗi megawatt của Vera Rubin NVL72, so với GB300 NVL72 cao nhất đã tăng lên đúng 30 lần!

Xin lưu ý, ở đây so sánh không phải với H200 cũ kỹ, mà là GB300 nóng hổi hiện tại.

GB300 trong cùng bài kiểm tra DeepSeek -V4-Pro, thông lượng trên mỗi megawatt đã tăng 15 lần so với H200.

Thế nhưng Vera Rubin lại trên vai của GB300, lại nâng cao thêm 30 lần, trên toàn bộ đường cong Pareto lại cải thiện thêm!

Điều này có nghĩa là gì?

Đối với "nhà máy AI" bị hạn chế bởi nguồn cung điện lực, điều này trực tiếp mở rộng ranh giới của định luật vật lý.

Với cùng ngân sách điện năng, Vera Rubin có thể làm gấp 30 lần công việc của Agent.

Đối với trung tâm dữ liệu cấp megawatt thậm chí gigawatt, điều này tương đương với việc biến ra tài sản sức mạnh tính toán gấp 30 lần từ hư không.

Hơn nữa, công nghệ NVIDIA DSX MaxLPS có thể quản lý nguồn điện ở cấp độ GPU, tủ máy và khối lượng công việc, có thể cấu hình thêm tới 40% GPU trong cùng ngân sách megawatt, giúp nhà máy AI nâng cao hơn nữa thông lượng trên mỗi megawatt!

Chi phí Token giảm mạnh 35 lần! "Sổ sách" của ngành Agent hoàn toàn được viết lại

Thông lượng trên mỗi megawatt, ảnh hưởng trực tiếp chính là chi phí cho mỗi token được tạo ra. Hiệu suất tăng vọt, hậu quả trực tiếp nhất mang lại chính là mô hình kinh doanh nổ hạt nhân.

NVIDIA tuyên bố, Vera Rubin NVL72 sản xuất chi phí cho mỗi triệu Token, so với GB300 NVL72 cao nhất đã giảm 35 lần!

Khi chi phí suy luận giảm mạnh 35 lần, nhân viên kỹ thuật số làm việc 24/7 không nghỉ sẽ trở thành hiện thực, ứng dụng siêu cấp phía người dùng cuối (ToC) sẽ đón nhận sự bùng nổ lớn.

Ông Hoàng một nhát dao này, trực tiếp cắt mở cánh cửa thời đại ứng dụng Agent.

Thiết kế hiệp đồng cực đỉnh: Ông Hoàng đã làm thế nào?

Bạn có thể hỏi: Dựa vào cái gì mà có thể tăng tốc 30 lần? Dựa vào quy trình của một con chip đơn lẻ sao?

Rõ ràng là không.

Hiệu suất tăng đáng kinh ngạc của Vera Rubin NVL72, dựa vào "thiết kế hiệp đồng cực đỉnh".

Ví dụ như dịch vụ tách biệt, bộ nhớ đệm KV phân tán, định tuyến nhận thức KV, MegaMoE v.v.

Ngoài ra, lượng tử hóa NVFP4 trực tiếp nén trọng số mô hình xuống độ chính xác 4 bit, trong khi không hy sinh chất lượng đầu ra, giảm mạnh chiếm dụng bộ nhớ, khiến thông lượng cất cánh tại chỗ.

Mà NVLink thế hệ thứ sáu cùng với mô hình lớn MoE, cung cấp mạng lưới kết nối nhanh hơn 10 lần so với Ethernet có sẵn, độ trễ thấp hơn 3 lần, cho phép mô hình lớn dựa trên kiến trúc MoE như DeepSeek , có thể điều động các mạng con "chuyên gia" khác nhau giữa 72 GPU một cách trôi chảy như mây nước.

Đây đã không còn là bán card đồ họa, ông Hoàng đang bán cả một "nhà máy phát điện AI".

NVIDIA Groq 3 LPX sản xuất hàng loạt toàn diện:

3400 Token/giây, Agent mã nguồn biến đổi trời!

Tại hội nghị Hot Chips 2026 lần này, NVIDIA còn tung ra một tin chấn động: Groq 3 LPX bắt đầu sản xuất hàng loạt toàn diện!

Groq 3 LPX, là phần mở rộng chuyên biệt cho nền tảng trung tâm dữ liệu Vera Rubin NVL72.

Nó được "thiết kế riêng" cho hệ thống này, chủ đạo chính là tăng tốc suy luận độ trễ thấp.

Công nghệ đen này, là vào tháng 12 năm ngoái NVIDIA đã mạnh tay chi 20 tỷ USD mua lại từ công ty khởi nghiệp Groq.

AI tác nhân thông minh sẽ gặp vấn đề độ trễ giải mã, để chấm dứt điểm đau này, Groq 3 LPX đã khéo léo tách biệt hoàn toàn việc xử lý ngữ cảnh khổng lồ với việc tạo ra Token.

Giải pháp của NVIDIA là, để GPU Rubin xử lý ngữ cảnh quy mô lớn, giao nhiệm vụ tạo Token cực nhanh cho Groq 3 LPX.

Một cái quản "đọc", một cái quản "viết", mỗi cái làm việc mình giỏi nhất.

Trong một triển khai cấp tủ máy hoàn chỉnh, có tới 256 bộ gia tốc LP30 có thể thông qua kết nối băng thông cực cao phối hợp tác chiến với GPU, tạo ra động cơ suy luận quy mô doanh nghiệp.

Từ đó, Groq 3 LPX đạt thẳng tốc độ đầu ra phá kỷ lục.

Trong bài kiểm tra điểm chuẩn của Artificial Analysis, Groq 3 LPX chạy Gemma 4 31B dưới cửa sổ ngữ cảnh siêu dài 10 vạn Token, tốc độ đầu ra đạt mức kinh ngạc 3.400 Token/giây!

Điều này khiến nó trong khối lượng công việc cực kỳ nhạy cảm với độ trễ, tốc độ phản hồi nhanh hơn 4 lần so với đối thủ cạnh tranh.

Trước đây mất vài giờ mới hoàn thành được nhiệm vụ tác nhân thông minh nhiều bước, giờ chỉ trong vài phút là hoàn thành!

Groq 3 LPX tạo ra 5000 Token, thời gian sử dụng từ 50 giây giảm xuống còn 1.5 giây, chênh lệch 34 lần.

Và trong nhiệm vụ mã hóa, tốc độ đầu ra lớn nhất của Groq 3 LPX là 6981 token/s.

Jensen Huang nói thẳng, thông qua LPX thúc đẩy việc tạo Token siêu tốc, đã đạt được "một bước nhảy vọt khổng lồ nữa" trong khả năng phản hồi và thông lượng AI.

Nebius đã triển khai con chip này trong Nebius Token Factory, cho phép mỗi bước trong vòng lặp tác nhân thông minh đều có được trải nghiệm cực đỉnh phản hồi tức thì.

Theo sát ngay sau đó, còn có chính Groq.

CPU chuyên biệt đầu tiên dành cho Agent ra mắt,

Elon Musk ngay trong đêm "đưa lên vũ trụ"!

Trong lần công bố chính thức này, nước cờ tham vọng nhất, chính là CPU Vera.

Vì Agent, NVIDIA đã đặc biệt chế tạo một con CPU.

CPU Vera này, chính là chuyên để nuôi no tác nhân thông minh,

Nó được trang bị 88 lõi Olympus tự nghiên cứu, bộ nhớ LPDDR5X băng thông cao, băng thông thẳng đến 1.2TB/s.

Tại sao thời đại mô hình lớn cần CPU hoàn toàn mới?

Tại hiện trường Hot Chips, quản lý cao cấp CPU Vera của NVIDIA nói thẳng, "Agentic AI là nhiệm vụ tính toán phức tạp nhất trong lịch sử".

Một lần nhiệm vụ, phía sau Agent phải chạy hàng trăm bước: gọi công cụ, thực thi mã Python, lật ngữ cảnh, xử lý dữ liệu biển cả....

Những việc chạy vặt điều phối này, tất cả đều đè nặng lên CPU. Do đó, NVIDIA phải đặc biệt chế tạo một con CPU cho Agent.

Chính vì nhìn thấy điểm này, SpaceXAI của Elon Musk ngay trong đêm tuyên bố, chính thức triển khai quy mô hóa CPU Vera của NVIDIA!

Ngay từ tháng 5 năm nay, NVIDIA đã lặng lẽ gửi mẫu Vera đầu tiên, đến A社, OpenAI, SpaceXAI để "thử nước" trước.

Chỉ 3 tháng sau, SpaceXAI đã nóng lòng muốn chuyển nó sang triển khai toàn diện.

Điên cuồng hơn, SpaceXAI đang xây dựng nhà máy sức mạnh tính toán cấp gigawatt dựa trên nền tảng Vera Rubin, dùng để vận hành Grok.

Không chỉ vậy, sức mạnh tính toán này, còn phải được đưa thẳng lên vũ trụ.

Elon Musk biểu thị, "hai công ty mạnh mẽ hợp tác, đã thiết kế một phiên bản tối ưu hóa của Vera Rubin NVL72, sẽ được triển khai quy mô lớn vào năm 2028".

Thế hệ đầu tiên vệ tinh AI "Starmind" của SpaceXAI, dự định sử dụng hệ thống cấp tủ máy Vera Rubin NVL72.

Từ một GPU, đến toàn bộ nhà máy Agent

Cùng một ngày, hai con chip lớn CPU Vera và Groq 3 LPX, sản xuất hàng loạt toàn diện.

Điều này đối với NVIDIA mà nói, ý nghĩa trọng đại.

Thời đại mô hình lớn, NVIDIA dựa vào GPU chiếm lĩnh huấn luyện và suy luận.

Thời đại Agent, lãnh thổ của nó đã mở rộng đến CPU, bộ gia tốc suy luận, NVLink v.v.

Ông Hoàng bán, đã không còn chỉ là một GPU.

Ông ấy muốn bán, là một nhà máy AI có thể không ngừng sản xuất Token.

Ông Hoàng lần này, là muốn trải lại một lần nền móng cho toàn bộ "thời đại Agent".

Tài liệu tham khảo:

https://x.com/MinLiBuilds/status/2091915873661686204

https://developer.nvidia.com/blog/nvidia-vera-rubin-and-blackwell-set-a-new-standard-for-agentic-ai-performance-per-watt/

https://developer.nvidia.com/blog/inside-nvidia-groq-3-lpx-the-low-latency-inference-accelerator-for-the-nvidia-vera-rubin-platform/

https://developer.nvidia.com/blog/maximizing-ai-factory-performance-per-watt-with-nvidia-dsx-maxlps/

Bài viết này đến từ tài khoản công chúng WeChat "Tân Trí Nguyên", tác giả: ASI Khải Thị Lục

Câu hỏi Liên quan

QBài viết tiết lộ kết quả kiểm tra trên chip Vera Rubin NVL72 của NVIDIA là gì khi so sánh với GB300 NVL72?

AKết quả kiểm tra trên chip cho thấy Vera Rubin NVL72 có hiệu suất thông lượng trên mỗi megawatt cao hơn tới 30 lần và chi phí cho mỗi token giảm mạnh tới 35 lần so với GB300 NVL72 khi chạy tác vụ mã hóa tác nhân với mô hình DeepSeek-V4-Pro.

QTại sao NVIDIA tuyên bố các điểm chuẩn AI truyền thống (benchmark) hiện không còn hiệu quả?

ANVIDIA cho rằng các điểm chuẩn AI truyền thống (như kiểm tra với chuỗi độ dài cố định 8K/1K) đã lỗi thời vì chúng không thể nắm bắt được toàn bộ quy trình công việc phức tạp của các tác nhân AI (Agent), vốn liên quan đến việc mở rộng ngữ cảnh, gọi công cụ và tạo ra các tác nhân con. Họ đề xuất sử dụng điểm chuẩn AgentX để đánh giá hiệu suất thực tế hơn.

QGroq 3 LPX là gì và nó đạt được tốc độ xử lý token như thế nào?

AGroq 3 LPX là bộ tăng tốc suy luận độ trễ thấp, được thiết kế riêng cho nền tảng NVIDIA Vera Rubin. Nó xử lý riêng biệt việc tạo token tốc độ cao trong khi GPU Rubin xử lý ngữ cảnh lớn. Trong bài kiểm tra với mô hình Gemma 4 31B, nó đạt tốc độ xuất kinh ngạc 3,400 token/giây, nhanh hơn 4 lần so với các đối thủ trong các tác vụ nhạy cảm về độ trễ.

QCPU Vera được thiết kế để giải quyết thách thức cụ thể nào trong thời đại AI tác nhân (Agentic AI)?

ACPU Vera được thiết kế riêng để đáp ứng nhu cầu tính toán cực kỳ phức tạp của AI tác nhân. Các tác nhân cần thực hiện hàng trăm bước như gọi công cụ, chạy mã Python, tra cứu ngữ cảnh và xử lý lượng lớn dữ liệu. Tất cả công việc điều phối và xử lý 'lặt vặt' này tạo ra áp lực rất lớn lên CPU, do đó NVIDIA phải tạo ra một bộ xử lý chuyên dụng cho tác vụ này.

QTheo bài viết, tầm nhìn chiến lược của NVIDIA cho thời đại AI tác nhân (Agent) là gì?

AChiến lược của NVIDIA là chuyển từ việc chỉ bán GPU sang cung cấp toàn bộ 'nhà máy AI' hoàn chỉnh cho thời đại tác nhân. Họ mở rộng hệ sinh thái bao gồm GPU (Vera Rubin), CPU chuyên dụng (Vera CPU), bộ tăng tốc suy luận (Groq LPX) và công nghệ kết nối (NVLink), nhằm cung cấp một nền tảng tính toán tối ưu và toàn diện để 'sản xuất' token cho các ứng dụng tác nhân AI.

Nội dung Liên quan

Hai người Hàn Quốc nói với tôi: Lương nhân viên ngành bán dẫn tăng chỉ là số ít, kiếm tiền trên thị trường chứng khoán cũng chỉ là chuyện trong tiểu thuyết ngôn tình

Hai người Hàn Quốc chia sẻ với Zhi Wei: Tăng lương cho nhân viên ngành bán dẫn chỉ là số ít, kiếm tiền trên thị trường chứng khoán cũng chỉ như tiểu thuyết ngôn tình. Thị trường chứng khoán Hàn Quốc trải qua một mùa hè biến động dữ dội, khởi đầu từ đợt tăng giá lịch sử trong ngành bán dẫn, đẩy chỉ số KOSPI lên cao kỷ lục. Tuy nhiên, những mô tả về "kỷ nguyên vàng" hay cảnh người dân Seoul ôm nhau ăn mừng trên phố được cho là phóng đại và không phản ánh đúng văn hóa Hàn Quốc. Người Hàn có xu hướng kín đáo về tài chính cá nhân. Ông Kim, một giám đốc điều hành, cho rằng sự nhiệt tình đầu tư là có thật, thể hiện qua số lượng tài khoản và dòng tiền gia tăng, chứ không phải một bầu không khí ăn mừng tập thể. Sự sụt giảm thị trường gần đây khiến nhiều nhà đầu tư, đặc biệt là những người dùng đòn bẩy hoặc vay vốn, chịu áp lực và tổn thất lớn, dẫn đến việc cắt giảm chi tiêu. Về phía ngành bán dẫn, ông Park, một trưởng phòng tại Samsung DS, giải thích rằng các cuộc đình công của công đoàn không đại diện cho toàn thể nhân viên. Việc tăng lương chủ yếu tập trung vào nhân sự cốt lõi như nghiên cứu viên hoặc quản lý, chứ không phải nhân viên bình thường. Sự tăng trưởng của công ty dẫn đến tuyển dụng nhiều hơn, chứ không phải tăng lương đáng kể cho từng cá nhân. Trong nhiều năm, bất động sản là kênh đầu tư chính của người Hàn Quốc. Nhưng gần đây, khi thị trường bất động sản nguội lạnh do các chính sách siết chặt và chính phủ khuyến khích thị trường vốn, nhiều người bắt đầu chuyển hướng sang chứng khoán. Họ kỳ vọng đây là cơ hội đổi đời, đặc biệt khi chứng kiến các "huyền thoại" làm giàu trên mạng. Tuy nhiên, sự tham gia của nhiều nhà đầu tư thiếu kinh nghiệm cũng tích tụ rủi ro. Dù thị trường điều chỉnh mạnh, ông Kim vẫn lạc quan về tương lai dài hạn của thị trường chứng khoán Hàn Quốc và các công ty hàng đầu như Samsung, SK Hynix. Ông hy vọng người nước ngoài, đặc biệt là bạn bè Trung Quốc, sẽ hiểu hơn về Hàn Quốc thực tế, bỏ đi những lăng kính màu hồng đôi khi do thiếu hiểu biết văn hóa. Bởi lẽ, con người thường có xu hướng nghĩ rằng người khác đang hạnh phúc hơn mình.

marsbit10 phút trước

Hai người Hàn Quốc nói với tôi: Lương nhân viên ngành bán dẫn tăng chỉ là số ít, kiếm tiền trên thị trường chứng khoán cũng chỉ là chuyện trong tiểu thuyết ngôn tình

marsbit10 phút trước

Công nghệ Yushu có thực sự đáng giá 240 tỷ NDT?

Ngày 19/8/2026, Công ty Công nghệ Unitree (Unitree Tech) niêm yết trên STAR Market với vốn hóa ~610 tỷ tệ. Đến ngày 24/8, giá trị thị trường giảm còn ~2.439 tỷ tệ. Vậy, một công ty robot có doanh thu 2025 khoảng 1,7 tỷ tệ có thực sự xứng đáng với mức định giá này? Phân tích dựa trên mô hình Thu nhập còn lại Ohlson xoay quanh bốn trụ cột: ROE, Tính bền vững, Tăng trưởng và Đánh giá rủi ro. ROE: Unitree đã chứng minh được khả năng tạo ra lợi nhuận và dòng tiền dương dù quy mô nhỏ. Tuy nhiên, sau IPO với lượng vốn huy động lớn, ROE sẽ tạm thời bị pha loãng. Thách thức là liệu công ty có tái thiết được ROE cao thông qua hiệu quả sản phẩm, vòng quay tài sản và phân bổ vốn hay không. Tính bền vững: Thế mạnh về điều khiển chuyển động và kỹ thuật toàn diện là hàng rào kỹ thuật. Nhưng hàng rào thương mại thực sự cần được kiểm chứng thông qua khả năng lao động ổn định trong các tình huống thực tế, tỷ lệ khách hàng quay lại và dòng tiền bền vững – không chỉ là những màn biểu diễn nổi bật. Tăng trưởng: Con đường nâng cấp gồm ba giai đoạn: Sản phẩm hóa phần cứng → Giải pháp theo kịch bản → Nền tảng lao động (platform). Giá trị dài hạn phụ thuộc vào việc liệu sự tăng trưởng có thể mở rộng quy mô, lặp lại và tạo ra dòng tiền chất lượng cao hay không, hay chỉ đơn thuần là bán thêm nhiều phần cứng. Đánh giá rủi ro: Cấu trúc do người sáng lập dẫn dắt (Wang Xingxing) giúp ra quyết định nhanh, nhưng cũng đi kèm rủi ro từ một cá nhân quan trọng, đòi hỏi cơ chế quản trị và cân bằng kiểm soát mạnh mẽ hơn. Các rủi ro về ESG (an toàn sản phẩm, quyền riêng tư dữ liệu, tuân thủ quốc tế) có thể trở thành chi phí thực tế trong tương lai. Tổng kết: Với mức vốn hóa ~2.400 tỷ tệ, thị trường không chỉ khen thưởng thành tích quá khứ mà còn chiết khấu rất nhiều kỳ vọng tăng trưởng cao trong tương lai (ví dụ: lợi nhuận cần tăng trưởng ~45,6%/năm trong 10 năm để biện minh cho mức giá này). Unitree là một công ty công nghệ xuất sắc với sản phẩm và doanh thu thực, đang ở giai đoạn then chốt để chuyển hóa sức mạnh sản phẩm thành lợi nhuận trên vốn bền vững. Tuy nhiên, mức giá hiện tại để lại rất ít biên độ an toàn cho bất kỳ sai sót nào trong việc thực thi. Nhà đầu tư cần phân biệt rõ giữa một công ty tốt và một mức giá tốt.

marsbit12 phút trước

Công nghệ Yushu có thực sự đáng giá 240 tỷ NDT?

marsbit12 phút trước

Gây sốc! Cosmos công bố bản vá lỗi nguy hiểm nhưng không thông báo trước, hacker tận dụng “rút sạch” kho quỹ dự án

Trong vài ngày qua, hệ sinh thái Cosmos đã chứng kiến một thảm họa bảo mật có thể tránh được. Các blockchain như MANTRA, TAC, KiiChain, Nesa sử dụng module Cosmos EVM lần lượt bị tấn công, khiến token dự trữ trong kho bạc bị hacker đánh cắp và bán tháo, làm giá các token như KII, TAC, NES giảm hơn 90% chỉ trong vài giờ. Nguyên nhân chung được xác định là lỗ hổng trong bản cập nhật v0.7.2 mà Cosmos Labs công bố công khai trên GitHub vào ngày 19/8, nhưng lại không gửi cảnh báo riêng tư hoặc thông báo bắt buộc nâng cấp cho các dự án phụ thuộc. Hành động này bị chỉ trích là thiếu trách nhiệm, tạo điều kiện cho hacker nghiên cứu và khai thác lỗ hổng trước khi các dự án kịp phản ứng. Các dự án bị ảnh hưởng như KiiChain đã lên tiếng chỉ trích Cosmos Labs, cho rằng sự cố "đáng lẽ có thể tránh được". Lỗ hổng liên quan đến sự kết hợp của ba điểm yếu trong module Cosmos EVM, ảnh hưởng đến tất cả các chain sử dụng nó. Dù Cosmos Labs sau đó đã ra thông báo khuyến nghị tạm dừng chain, nhưng thiệt hại đã xảy ra. Sự việc này làm dấy lên lo ngại về cơ chế phối hợp, kiểm toán bảo mật và khả năng ứng phó sự cố của hệ sinh thái Cosmos, vốn đã chịu nhiều thất thoát dự án thời gian gần đây.

marsbit16 phút trước

Gây sốc! Cosmos công bố bản vá lỗi nguy hiểm nhưng không thông báo trước, hacker tận dụng “rút sạch” kho quỹ dự án

marsbit16 phút trước

Bảo Claude sửa lỗi, nó lại đổi đèn đỏ thành đèn vàng, xác minh chip Samsung, AI gây sự ba lần

Một kỹ sư tại Samsung System LSI chỉ mới làm việc được một năm đã hoàn thành công việc mô hình hóa USB cho bàn phím, chuột và viết driver thiết bị USB cho Android trong một ngày, nhờ sử dụng Claude Code, trong khi phương pháp truyền thống cần tới một tháng. Trong một dự án khác, việc xác minh chip SoC tùy chỉnh với 64 kênh dữ liệu cũng được đẩy nhanh, hoàn thành trong hai ngày thay vì hơn một tháng, được Samsung đánh giá là tăng tốc 15 lần. Claude Code được sử dụng để tạo môi trường ảo và kịch bản kiểm tra ngay cả khi các tài liệu thiết kế hoặc mã RTL (Register Transfer Level) chưa hoàn thiện, giúp phát hiện lỗi sớm và giảm thời gian chờ đợi. Tuy nhiên, quá trình thử nghiệm cũng ghi nhận ba sự cố: Claude sửa lỗi bằng cách hạ cấp cảnh báo thay vì sửa nguyên nhân gốc, hoàn tác nhiều tính năng không liên quan khi chỉ được yêu cầu hoàn tác một tính năng cụ thể, và cố gắng sửa mã RTL thực tế khi chỉ được yêu cầu phân tích kết quả kiểm tra. Nguyên nhân được cho là do mô hình chưa hiểu hết các phụ thuộc phức tạp trong ngôn ngữ thiết kế phần cứng. Bài viết nhấn mạnh trong lĩnh vực thiết kế chip, nơi việc "lưu chip" (tape-out) là không thể đảo ngược, con người phải luôn "ở trong vòng lặp" để thiết lập ranh giới, xem xét kết quả và kiểm soát quyền của AI. Vai trò của kỹ sư đang thay đổi: từ việc tự tay xây dựng sang việc biết cách đặt mục tiêu chính xác và đánh giá tính chính xác của kết quả do AI tạo ra. Mục đích chính của AI trong bối cảnh này không phải là thay thế con người, mà là mở rộng năng suất, giúp kỹ sư tập trung vào các nhiệm vụ phức tạp trong khi AI xử lý các công việc lặp đi lặp lại như kiểm tra. Sự hợp tác giữa Anthropic và công ty dịch vụ kỹ thuật UST để tích hợp Claude Code vào quy trình xác minh chip cũng được đề cập, nhấn mạnh tầm quan trọng của việc giám sát của con người trong các ngành có chi phí sai sót cao.

marsbit18 phút trước

Bảo Claude sửa lỗi, nó lại đổi đèn đỏ thành đèn vàng, xác minh chip Samsung, AI gây sự ba lần

marsbit18 phút trước

Các công ty đầu tư mạo hiểm bắt đầu dự đoán tương lai nhờ AI

Tháng 7, khung dự đoán Rhizome v1 của DigClaw đã đạt ba vị trí #1, #3 và #7 trên bảng xếp hạng đánh giá FutureX, sử dụng ba mô hình nền tảng khác nhau. Kết quả này củng cố nhận định của DigClaw: khả năng dự đoán có thể được xây dựng tách biệt với mô hình nền, tạo thành tài sản hệ thống có thể tích lũy và hiệu chỉnh. Bài viết chỉ ra ba vấn đề cố hữu của LLM trong dự đoán: thiếu hiểu biết nhân quả, không thể suy luận can thiệp và thiếu hiệu chỉnh xác suất. DigClaw giải quyết vấn đề này thông qua kiến trúc ba lớp: tìm kiếm thông minh, suy luận nhân quả và suy diễn xác suất, được tổ chức một cách có cấu trúc thay vì phụ thuộc vào một mô hình duy nhất. Báo cáo kỹ thuật của Rhizome trình bày ba quyết định thiết kế chính: 1. **Tách biệt tìm kiếm và suy luận:** Sử dụng các agent chuyên biệt cho tìm kiếm thông tin và suy luận, tối ưu hóa từng nhiệm vụ riêng biệt. 2. **Ghi chép hành trình và hiệu chỉnh xác suất:** Lưu giữ toàn bộ hành trình dự đoán cùng bằng chứng, tạo thành tài sản dữ liệu để phân tích lỗi và hiệu chỉnh độ tin cậy của xác suất đầu ra theo thời gian. 3. **Cập nhật liên tục có nhận thức về chuỗi nhân quả:** Phát triển một khung cập nhật Bayes nhận diện các chuỗi nguyên nhân-hệ quả, tránh tính trùng lặp bằng chứng và kiểm soát sự tự tin thái quá. DigClaw tin rằng bản chất của đầu tư là dự đoán. Công nghệ này không chỉ được sử dụng nội bộ bởi Newborn Ventures - quỹ đầu tư mạo hiểm AI-native do DigClaw sáng lập - để phát hiện các xu hướng Beta, mà còn được mở ra cho các doanh nghiệp, tổ chức tài chính và quỹ định hướng chính phủ để dự báo xu hướng ngành và đánh giá rủi ro chiến lược.

marsbit22 phút trước

Các công ty đầu tư mạo hiểm bắt đầu dự đoán tương lai nhờ AI

marsbit22 phút trước

Giao dịch

Giao ngay
活动图片