# Bài viết Liên quan Giảm Chi phí

Trung tâm Tin tức HTX cung cấp những bài viết mới nhất và phân tích chuyên sâu về "Giảm Chi phí", bao gồm xu hướng thị trường, cập nhật dự án, phát triển công nghệ và chính sách quản lý trong ngành tiền kỹ thuật số.

Vừa rồi, mô hình thế giới siêu cao khung hình đầu tiên toàn cầu ra đời, không chứa Nvidia, lao nhanh 50 FPS

Thế giới mô hình thực sự bước vào thời đại thời gian thực. Khi ngành công nghiệp vẫn đang vật lộn với 5-10 FPS, một nhóm các nhà nghiên cứu Trung Quốc đã đưa mô hình thế giới tương tác thời gian thực lên 50 FPS. MoWorld - Flash World Model toàn cầu đầu tiên từ Moxin Tech và Đại học Chiết Giang, cũng là mô hình thế giới tương tác thời gian thực đầu tiên được xây dựng hoàn toàn trên nền tảng NPU nội địa (chip Ascend 910C). Dự án đã xây dựng một vòng khép kín hoàn chỉnh từ đào tạo, chưng cất đến triển khai suy luận trên nền tảng NPU nội địa, giảm chi phí suy luận 70% so với các giải pháp GPU quy mô tương đương. MoWorld đạt được khả năng đào tạo và suy luận video dài 2000 khung hình, hỗ trợ điều khiển camera 6DoF cho trải nghiệm du lịch ảo sống động. Ứng dụng tiềm năng bao gồm giải trí tương tác, trí tuệ thể hiện, sáng tạo phim ảnh và số đôi sinh. Đột phá này chứng minh khả năng của nền tảng điện toán nội địa trong việc hỗ trợ các mô hình thế giới tiên tiến, mở ra cơ hội cạnh tranh và định hình tiêu chuẩn cho thế hệ trí tuệ không gian tiếp theo.

marsbit07/08 04:17

Vừa rồi, mô hình thế giới siêu cao khung hình đầu tiên toàn cầu ra đời, không chứa Nvidia, lao nhanh 50 FPS

marsbit07/08 04:17

Khi những gã khổng lồ Mỹ "đào tẩu" hàng loạt sang mô hình AI Trung Quốc

CEO Coinbase Brian Armstrong gây chấn động khi tiết lộ chuyển sang sử dụng các mô hình AI Trung Quốc GLM và Kimi, cắt giảm một nửa chi phí AI trong khi lượng dùng vẫn tăng. Chiến lược của họ bao gồm ba điểm chính: hệ thống định tuyến tự động chọn mô hình phù hợp theo nhiệm vụ, tối ưu hóa bộ nhớ đệm để tăng tỷ lệ truy xuất lên 60%, và kỹ thuật "Context Engineering" nhằm cung cấp ngữ cảnh chính xác, gọn gàng hơn cho AI. Xu hướng này không chỉ riêng Coinbase. Các công ty như Lindy và Snowflake cũng chuyển sang các mô hình như DeepSeek hay GLM, nhấn mạnh sự chênh lệch giá lớn (ví dụ: đầu ra của GLM rẻ hơn 5-7 lần so với Claude Opus) trong khi chất lượng trên nhiều tác vụ là tương đương. Điều này cho thấy cuộc cạnh tranh AI đang chuyển sang trọng tâm về hiệu quả chi phí. Đối với người dùng, bài học là không nên chỉ phụ thuộc vào một mô hình duy nhất, cần tận dụng bộ nhớ đệm và cung cấp ngữ cảnh tinh gọn để có kết quả tốt hơn với chi phí thấp hơn. Làn sóng chuyển đổi này đang thách thức mô hình định giá của các "gã khổng lồ" AI phương Tây và mang lại nhiều lựa chọn hơn cho thị trường.

链捕手07/03 16:11

Khi những gã khổng lồ Mỹ "đào tẩu" hàng loạt sang mô hình AI Trung Quốc

链捕手07/03 16:11

Nếu bong bóng AI thực sự đã vỡ, ai sẽ là người ở lại?

Bong bóng AI đang trở thành điểm đồng thuận gây chia rẽ nhất trên thị trường toàn cầu. Một bên là cảnh báo về sự quá nóng từ Ray Dalio, một bên là tầm nhìn về cuộc cách mạng sản xuất mới bắt đầu từ Jensen Huang. Vấn đề thực sự không phải là có bong bóng hay không, mà là sau khi bong bóng tan, thứ gì sẽ còn lại. Giống như bong bóng dot-com năm 2000 đã để lại cơ sở hạ tầng cáp quang, băng thông rộng và điện toán đám mây - nền tảng cho Amazon, Netflix và kỷ nguyên di động sau này, làn sóng AI hiện nay cũng đang ở vị trí tương tự. Hàng nghìn tỷ USD đang được đổ vào trung tâm dữ liệu, điện năng, làm mát bằng chất lỏng, module quang và GPU, trong khi doanh thu từ các ứng dụng vẫn chưa bắt kịp. Rõ ràng có sự chênh lệch, nhưng tiềm năng tăng năng suất cơ bản là có thật. Chi phí xử lý token (token cost) đã giảm hơn 99.7% từ năm 2023 đến 2025. Khi trí thông minh trở nên rẻ như điện nước, AI không còn là công cụ trò chuyện đơn thuần mà đang thâm nhập vào các quy trình công việc thực tế trong lập trình, y tế, tài chính, pháp lý và sản xuất. Thị trường sẽ thanh lọc các công ty "bọc vỏ" (shell companies) và startup chỉ dựa trên slide thuyết trình, nhưng không thể đảo ngược xu hướng AI+. Các gã khổng lồ công nghệ dự kiến chi 6900 tỷ USD cho cơ sở hạ tầng vào năm 2026, nhưng doanh thu tổng hợp từ các công ty AI thuần túy ước tính chưa đến 400 tỷ USD. Sự mất cân đối này là dấu hiệu của bong bóng. Tuy nhiên, theo nghịch lý Jevons, việc chi phí giảm mạnh không làm giảm chi tiêu của doanh nghiệp cho AI, mà ngược lại, mở ra lượng cầu khổng lồ trước đây bị hạn chế bởi chi phí, dẫn đến tổng mức tiêu thụ tăng theo cấp số nhân. Thị trường đang trong giai đoạn tự thanh lọc, loại bỏ những dự án thiếu giá trị thực. Xu hướng sâu xa là sự dịch chuyển giá trị từ chi tiêu vốn (CapEx - cho hạ tầng) sang chi tiêu vận hành (OpEx - cho ứng dụng tối ưu hóa quy trình). Lợi nhuận siêu ngạch cuối cùng sẽ chảy về phía những doanh nghiệp AI gốc (AI-native) thực sự giải quyết được điểm đau trong các ngành dọc. Giống như tất cả các ngành hiện nay đều không thể tách rời internet, tương lai tất cả các ngành cũng sẽ không thể tách rời AI. Sự hỗn loạn của bong bóng rồi sẽ qua đi, nhưng động lực tăng năng suất cơ bản mà AI mang lại là hoàn toàn có thật và sẽ định hình thời đại thịnh vượng thông minh tiếp theo.

链捕手06/15 04:39

Nếu bong bóng AI thực sự đã vỡ, ai sẽ là người ở lại?

链捕手06/15 04:39

Đột phá bất ngờ trong AI thiết bị đầu cuối mà Apple khao khát: Mô hình nhận thức đầu tiên ra đời, 4B ngang tầm GPT-5.4

**Apple mong muốn về AI ở thiết bị đầu cuối đã có đột phá: Mô hình nhận thức đầu tiên ra đời, 4B thách thức GPT-5.4** Bài viết thảo luận về xu hướng và thách thức của AI trên thiết bị đầu cuối (edge AI), đặc biệt nhấn mạnh đến vấn đề chi phí điện toán (token cost) ngày càng tăng khi triển khai các mô hình lớn (LLM). Giải pháp được đề xuất bởi Andrej Karpathy là tách rời "lõi nhận thức" (khả năng suy luận, lập kế hoạch) khỏi "kiến thức" thuần túy trong mô hình, tạo ra các mô hình nhỏ gọn hơn nhưng hiệu quả. Công ty Trung Quốc Nextie (Minh Nhật Tân Trình) được giới thiệu là đã hiện thực hóa ý tưởng này với **Nextie Alpha**, được gọi là mô hình nhận thức đầu tiên trong ngành, với chỉ 4 tỷ tham số. Mô hình này được cho là đạt hiệu quả tương đương với các mô hình nghìn tỷ tham số như GPT-5.4 trong các nhiệm vụ trí tuệ tập thể (ví dụ: tranh luận, phản ánh), đồng thời có thể triển khai trên thiết bị đầu cuối (như MacBook, robot). Bài viết nêu bật ba lợi ích chính: 1. **Nâng cao chất lượng ra quyết định đa tác tử:** Cải thiện hiệu quả trong các hệ thống nhiều tác nhân AI hợp tác. 2. **Giảm chi phí điện toán đáng kể:** Chuyển từ chi phí điện toán đám mây sang chi phí điện năng thấp khi chạy trên thiết bị. 3. **Mở khóa các kịch bản chủ động (Proactive):** Cho phép các tác nhân AI hoạt động liên tục, tự chủ thay vì chỉ phản hồi lệnh, mở ra không gian thương mại lớn hơn. Nextie, với đội ngũ sáng lập từ Microsoft Xiaoice, có thành tích tạo ra các mô hình nhỏ hiệu quả cao. Họ đang tập trung vào lĩnh vực đa tác tử và trí tuệ tập thể, một lĩnh vực được các nhà đầu tư như OpenAI công nhận có tiềm năng lớn. Bài viết kết luận rằng mô hình nhận thức như Nextie Alpha không chỉ thay đổi quy mô tham số mà còn tái cấu trúc mô hình kinh tế của AI, khiến các sản phẩm AI chủ động, chi phí thấp trở nên khả thi và có thể định hình lại toàn bộ ngành.

marsbit06/09 12:08

Đột phá bất ngờ trong AI thiết bị đầu cuối mà Apple khao khát: Mô hình nhận thức đầu tiên ra đời, 4B ngang tầm GPT-5.4

marsbit06/09 12:08

Một báo cáo giảm cấu hình bộ nhớ khiến cổ phiếu lao dốc, liệu có phải là bị 'xử oan'?

Một báo cáo từ SemiAnalysis về việc giảm cấu hình bộ nhớ trong tủ máy Rubin NVL72 của NVIDIA đã khiến cổ phiếu bộ nhớ AI như Micron và SK Hynix giảm mạnh. Báo cáo ban đầu đề cập dung lượng bộ nhớ mỗi tủ có thể giảm từ khoảng 55TB xuống 28TB, chủ yếu ở phần bộ nhớ hệ thống phía CPU (SOCAMM/LPDDR), không phải HBM4 phía GPU. Phản ứng thị trường được cho là sự điều chỉnh kỳ vọng quá mức ở một chủ đề đang ở vị thế cao. Tuy nhiên, tác giả sau đó làm rõ đây không phải là tin xấu thảm khốc. Điều chỉnh này có thể giúp giảm chi phí tủ máy (ước tính ~80 triệu USD) và đẩy nhanh tiến độ giao hàng, nhưng chưa rõ liệu số lượng tủ máy xuất xưởng có tăng đủ để bù đắp cho việc giảm giá trị trên mỗi đơn vị hay không. Bài học quan trọng là thị trường cần phân biệt rõ hai nhóm lợi nhuận trong bộ nhớ AI: HBM4 (gắn với GPU, vẫn được kỳ vọng cao về nhu cầu và định giá) và bộ nhớ hệ thống phía CPU (chịu áp lực điều chỉnh giảm). Diễn biến tiếp theo phụ thuộc vào dữ liệu xuất xưởng thực tế của tủ máy Rubin, cấu hình BOM cuối cùng từ NVIDIA, và báo cáo tài chính chi tiết từ các nhà cung cấp như Micron (nhiều rủi ro hơn với SOCAMM) và SK Hynix (trọng tâm vẫn là HBM).

marsbit06/05 06:32

Một báo cáo giảm cấu hình bộ nhớ khiến cổ phiếu lao dốc, liệu có phải là bị 'xử oan'?

marsbit06/05 06:32

Việc giảm giá 99% của Xiaomi MiMo không phải là chiêu trò marketing! Luo Fuli đăng X để phản bác những kẻ bi quan

Trong bài viết, tác giả phân tích động thái giảm giá API lên tới 99% cho dòng MiMo-V2.5 của Xiaomi và phản bác các ý kiến cho rằng đây chỉ là chiến lược marketing hay "bán lỗ cướp thị trường". Lộ Phúc Lợi, người đứng đầu MiMo, đã công bố một blog kỹ thuật dài 5000 chữ để giải thích cơ sở kỹ thuật của mức giá mới. Bài viết mô tả sáu trụ cột công nghệ chính cho phép mức giảm giá này: 1. **Kiến trúc Hybrid SWA (Sliding Window Attention):** Giảm dung lượng bộ nhớ tạm (KVCache) xuống còn 1/7 so với Full Attention truyền thống. 2. **Quản lý KVCache hai bể riêng biệt:** Tối ưu hóa việc phân bổ bộ nhớ để triệt để tận dụng lợi thế của SWA, tăng gấp 5 lần số lượng người dùng đồng thời. 3. **Hệ thống tiền tố cache được cải tiến:** Đảm bảo an toàn và nâng cao tỷ lệ trúng cache lên tới 93-95%, khiến phần lớn yêu cầu đọc lặp lại hầu như không cần tính toán lại. 4. **Hệ thống lưu trữ phân tán GCache:** Triển khai trực tiếp trên ổ SSD của máy GPU, giảm chi phí lưu trữ xuống gần bằng 0. 5. **Hệ thống điều phối LLM-Router:** Tối ưu định tuyến và lập lịch, ưu tiên các yêu cầu có cache, tăng hiệu suất tổng thể. 6. **Dự đoán đa token (MTP):** Giảm chi phí tạo văn bản (output), hoàn thiện vòng tròn giảm chi phí cho toàn bộ quá trình xử lý. Những cải tiến này, khi kết hợp, tạo ra một chuỗi tối ưu toàn diện làm giảm đáng kể chi phí tính toán và lưu trữ cho mỗi yêu cầu. Bài viết kết luận rằng mức giảm 99% không phải là con số tiếp thị, mà là kết quả có thể chứng minh của một hệ thống kỹ thuật hoàn chỉnh, một phương pháp giảm chi phí đáng để ngành tham khảo.

marsbit05/31 10:39

Việc giảm giá 99% của Xiaomi MiMo không phải là chiêu trò marketing! Luo Fuli đăng X để phản bác những kẻ bi quan

marsbit05/31 10:39

Ấn Độ, Nhà máy Gia công Bên ngoài của Giới Tiền điện tử

Ấn Độ, với tư cách là "nhà máy gia công" của giới tiền điện tử, đang đối mặt với những thách thức về an ninh dữ liệu và quản lý nhân sự. Vụ việc Coinbase vào tháng 12/2025, khi một nhân viên hỗ trợ khách hàng thuê ngoài tại Ấn Độ bị bắt vì làm rò rỉ dữ liệu người dùng trị giá ước tính 400 triệu USD, đã làm dấy lên lo ngại về độ tin cậy của dịch vụ gia công tại đây. Các công ty lớn như Amazon và Microsoft cũng từng gặp sự cố tương tự với nhân viên thuê ngoài ở Ấn Độ, nơi mức lương thấp (chỉ 300-500 USD/tháng) khiến họ dễ bị mua chuộc. Dù vậy, Ấn Độ vẫn thống trị ngành gia công quy trình nghiệp vụ (BPO) toàn cầu, với quy mô thị trường đạt 50 tỷ USD năm 2024 và dự kiến lên 139,35 tỷ USD vào 2033. Lợi thế của Ấn Độ nằm ở nguồn nhân lực giá rẻ, thành thạo tiếng Anh, được hưởng lợi từ chênh lệch múi giờ và sự hỗ trợ của chính phủ. Tuy nhiên, ngành này đang phân hóa: các trung tâm năng lực toàn cầu (GCC) của các tập đoàn đa quốc gia tập trung vào công việc chất lượng cao, trong khi các dịch vụ gia công truyền thống như hỗ trợ khách hàng phải đối mặt với áp lực từ AI và các quốc gia cạnh tranh khác.

marsbit01/06 03:19

Ấn Độ, Nhà máy Gia công Bên ngoài của Giới Tiền điện tử

marsbit01/06 03:19

活动图片