# Bài viết Liên quan Thế hệ

Trung tâm Tin tức HTX cung cấp những bài viết mới nhất và phân tích chuyên sâu về "Thế hệ", bao gồm xu hướng thị trường, cập nhật dự án, phát triển công nghệ và chính sách quản lý trong ngành tiền kỹ thuật số.

Tháng 7 đại chiến trong lĩnh vực tạo video AI: Hơn 200 tỷ vốn đổ vào, ai sẽ vào vòng chung kết?

Tháng 7 chưa kết thúc nhưng cuộc chiến trong lĩnh vực AI tạo video đã nóng đến mức đỉnh điểm. Chỉ trong 20 ngày, 5 công ty liên tiếp công bố huy động vốn lớn, tổng cộng hơn 262 tỷ NDT đã đổ vào, vượt xa tổng vốn toàn ngành trong hai năm 2024-2025. Đợt đầu tư dồn dập này phản ánh cuộc đua đang bước vào giai đoạn then chốt. Đáng chú ý, mỗi công ty đều theo đuổi một chiến lược riêng. Kling AI (30 tỷ USD) với doanh thu ARR gần 5 tỷ USD, dẫn đầu thị trường và đang hướng tới IPO. ShengShu (5 tỷ USD) hướng tới "Mô hình Thế giới" cho robot và chuẩn bị lên sàn. PixVerse của Aishu tập trung vào mô hình thế giới tương tác thời gian thực với chi phí huấn luyện hiệu quả. ZhiXiang Weilai (15 tỷ NDT) chọn con đường làm sâu sát các kịch bản thương mại chuyên nghiệp. FlovaAI, startup mới của người sáng lập FaceU/剪映, huy động 80 triệu USD để phát triển nền tảng tác nhân sáng tạo video AI với trí nhớ ngữ cảnh dài. Có bốn lý do chính cho làn sóng gọi vốn này: (1) Áp lực cạnh tranh khốc liệt từ Seedance của ByteDance; (2) Các mô hình kinh doanh đã được chứng minh với dòng tiền rõ ràng; (3) Câu chuyện công nghệ được nâng cấp từ "tạo video" sang "mô hình thế giới"; (4) Cửa sổ IPO thuận lợi ở Hong Kong. Kết thúc tháng 7, cuộc đua bước vào vòng chung kết với các công ty hàng đầu được định giá lại, trong khi các tân binh tìm cách cắt lát thị trường từ lớp ứng dụng. Tuy nhiên, với mức tiêu thụ điện toán khổng lồ, số vốn khổng lồ này chưa chắc đã là sự đảm bảo cho tất cả.

marsbit2 ngày trước 07:44

Tháng 7 đại chiến trong lĩnh vực tạo video AI: Hơn 200 tỷ vốn đổ vào, ai sẽ vào vòng chung kết?

marsbit2 ngày trước 07:44

Claude Opus 5 rò rỉ, đợt thử nghiệm đầu tiên từ cư dân mạng đã đến

Claude Opus 5 đã bị rò rỉ sớm và được cộng đồng mạng nhiệt tình thử nghiệm. Các bản demo cho thấy khả năng tạo 3D, UI và đồ họa ấn tượng của mô hình này. Người dùng @chetaslua chia sẻ cảnh tượng một cỗ máy bắn đá 3D chi tiết với thông số kỹ thuật, cùng các giao diện thời tiết có ánh sáng thay đổi và cảnh bếp sống động. Nhiều người dùng khác cũng đăng tải kết quả thử nghiệm, từ việc tái tạo Minecraft với hiệu ứng vật lý và ánh sáng chân thực đến tạo hình ảnh SVG tay cầm PS5 chất lượng cao. Một số so sánh trực tiếp cho thấy Opus 5 tạo ra nhiều chi tiết hơn so với Fable 5 ở cùng một cảnh. Dấu vết rò rỉ của Opus 5 bắt đầu xuất hiện từ ngày 9/7 với một mô hình bí ẩn tên "Honeycomb EAP" trên Cursor, sau đó là các mục trong Google Vertex AI. Đến giữa tháng 7, nhiều báo cáo cho biết một số người dùng đã có thể truy cập Opus 5 (dù giao diện vẫn hiển thị 4.8), và tên "claude-opus-5-thinking-high" đã xuất hiện trong thông báo lỗi của Cursor. Cộng đồng đang bàn tán về việc liệu Opus 5 có trở thành giải pháp thay thế rẻ hơn cho Fable 5 hay không, vì giá của Opus chỉ bằng một nửa. Tuy nhiên, cũng có lo ngại rằng Opus 5 có thể tiêu thụ token nhiều hơn đáng kể, làm giảm lợi thế về chi phí. Vẫn chưa có điểm chuẩn chính thức nào được công bố. Dự kiến Opus 5 sẽ sớm được phát hành chính thức, và câu trả lời cuối cùng sẽ sớm được hé lộ.

marsbit07/24 07:55

Claude Opus 5 rò rỉ, đợt thử nghiệm đầu tiên từ cư dân mạng đã đến

marsbit07/24 07:55

1600 Dòng Mã “Dựng” Manhattan Dưới Nước, Fable 5 Làm Karpathy Sững Sờ

Fable 5, mô hình AI mới được mở lại sau lệnh cấm xuất khẩu tạm thời của Mỹ, đã gây kinh ngạc với khả năng tạo ra các thế giới 3D phong phú và tương tác chỉ từ các mô tả văn bản. Andrej Karpathy, chuyên gia AI tại Anthropic, đã bày tỏ sự ngạc nhiên trước một video trình diễn 63 thế giới do Peter Gostev từ Arena.ai tạo ra, hầu hết chỉ với một lần tạo (one-shot). Điểm nhấn là một "Manhattan dưới nước" sống động với chi tiết đáng kinh ngạc, được xây dựng chỉ từ 1.600 dòng mã. Các tạo phẩm khác bao gồm thành phố lịch sử như Istanbul, cảnh tượng tự nhiên như gấu bắt cá hồi, thế giới từ các kiệt tác hội họa như "Đêm đầy sao" của Van Gogh có thể đi vào được, và các góc nhìn độc đáo như từ tầm mắt của một con kiến. Gostev nhấn mạnh rằng thách thức không phải là vẻ đẹp đơn lẻ mà là khả năng của mô hình trong việc phối hợp hàng loạt yếu tố một cách nhất quán. Mặc dù vậy, Fable 5 vẫn có điểm yếu trong việc tạo ra trò chơi thực sự hấp dẫn và đôi khi có vẻ "lười biếng", cần được thúc đẩy để phát huy hết khả năng. Karpathy đặt câu hỏi về việc làm thế nào một mô hình chỉ học từ internet lại có thể hiểu và mã hóa các khái niệm phức tạp (như con cá vùng vẫy) thành các thế giới 3D tương tác. Sự tiến bộ này báo hiệu một bước nhảy vọt về chất lượng và mở ra những khả năng mới mà ngay cả các nhà phát triển cũng chưa khám phá hết.

marsbit07/06 09:50

1600 Dòng Mã “Dựng” Manhattan Dưới Nước, Fable 5 Làm Karpathy Sững Sờ

marsbit07/06 09:50

Mô hình sinh quy mô lớn đầu tiên sử dụng vật lý làm nguyên thủy tính toán Un-0 đã ra mắt, có thể giảm mức tiêu thụ năng lượng AI xuống 1000 lần?

Trong bối cảnh AI ngày càng tiêu thụ năng lượng lớn, startup Unconventional AI của Naveen Rao vừa công bố mô hình tạo ảnh Un-0, được cho là mô hình tạo sinh quy mô lớn đầu tiên sử dụng hiện tượng vật lý làm nguyên thủy tính toán. Un-0 hoạt động dựa trên một hệ thống hàng nghìn "bộ dao động" (oscillator) kết hợp với nhau, mô phỏng các hệ cơ học như đồng hồ tích tắc. Thay vì tính toán số thuần túy, mô hình để các bộ dao động này tương tác và tiến hóa theo các quy luật vật lý (được mô tả bởi phương trình Kuramoto) để tạo ra hình ảnh. Quá trình tạo ảnh gồm: khởi tạo ngẫu nhiên các pha dao động, đưa thông tin điều kiện (nhãn lớp), để hệ vật lý tự vận hành, chụp trạng thái tại thời điểm T, và cuối cùng giải mã thành pixel ảnh. Trên bộ dữ liệu ImageNet 64x64, Un-0 đạt điểm FID 6.74, ngang bằng với một số mô hình tạo ảnh truyền thống thế hệ đầu, dù chưa bằng các mô hình hiện đại nhất. Mục tiêu lớn nhất của hướng nghiên cứu này là nâng cao hiệu suất năng lượng. Công ty kỳ vọng, khi được triển khai trên phần cứng chuyên dụng (như mạch CMOS), cách tiếp cận tính toán bằng vật lý này có thể giảm tiêu thụ năng lượng cho AI xuống 1.000 lần so với kiến trúc dựa trên GPU truyền thống, bằng cách giảm thiểu việc di chuyển dữ liệu và tận dụng bản chất tính toán sẵn có của các quá trình động lực học.

marsbit06/26 10:56

Mô hình sinh quy mô lớn đầu tiên sử dụng vật lý làm nguyên thủy tính toán Un-0 đã ra mắt, có thể giảm mức tiêu thụ năng lượng AI xuống 1000 lần?

marsbit06/26 10:56

Người tạo ra Kling trở lại Alibaba và tạo ra một 'ngựa ô' mới

Người đứng sau mô hình AI video HappyHorse-1.0 của Alibaba, Zhang Di, từng làm việc tại Alibaba và Kuaishou, đã trở lại Alibaba vào tháng 11/2025 và chỉ sau 5 tháng đã cho ra mắt HappyHorse. Mô hình này đã đứng đầu bảng xếp hạng Artificial Analysis trong cả hai hạng mục text-to-video và image-to-video, vượt qua các đối thủ như ByteDance và Kuaishou. HappyHorse có 15 tỷ tham số, sử dụng kiến trúc Transformer đa phương thức, cho phép đồng bộ hóa khẩu hình với nhiều ngôn ngữ và giảm thời gian tạo video xuống còn 38 giây cho video 5 giây. Điều này giúp nó phù hợp cho các ứng dụng thương mại. Alibaba định hướng ứng dụng HappyHorse vào lĩnh vực thương mại điện tử, giúp các nhà bán hàng tạo video quảng cáo sản phẩm nhanh chóng, đa dạng hóa kịch bản và ngôn ngữ, đồng thời tăng hiệu quả chuyển đổi. Với lợi thế dữ liệu giao dịch và hành vi người dùng, Alibaba có thể tối ưu hóa video cho mục đích bán hàng. Tuy nhiên, vẫn có những thách thức về bản quyền và độ trung thực của nội dung AI. Nhưng với một kế hoạch ứng dụng rõ ràng, HappyHorse hứa hẹn mang lại lợi thế cạnh tranh cho Alibaba trong thị trường video AI.

marsbit04/13 05:14

Người tạo ra Kling trở lại Alibaba và tạo ra một 'ngựa ô' mới

marsbit04/13 05:14

活动图片