# Bài viết Liên quan LLM

Trung tâm Tin tức HTX cung cấp những bài viết mới nhất và phân tích chuyên sâu về "LLM", bao gồm xu hướng thị trường, cập nhật dự án, phát triển công nghệ và chính sách quản lý trong ngành tiền kỹ thuật số.

Từ một bàn ăn trưa đến vũ trụ vô tận: Fei-Fei Li đặt cược vào chiều kích tiếp theo của AI

**Tóm tắt bài viết:** Giáo sư Li Fei-Fei từ Đại học Stanford và nhà sáng lập World Labs tin rằng **Trí tuệ Không gian (Spatial Intelligence)** chính là biên giới tiếp theo của AI, vượt xa các mô hình ngôn ngữ lớn hiện tại. Cô lập luận rằng ngôn ngữ chỉ là một cách mã hóa thế giới với nhiều mất mát thông tin, trong khi sự hiểu biết và tương tác trong không gian vật lý 3D/4D mới là nền tảng cho trí thông minh, như lịch sử tiến hóa đã chứng minh (thị giác và nhận thức không gian có từ 540 triệu năm trước, so với ngôn ngữ chỉ khoảng 500.000 năm). World Labs đã phát triển mô hình **Marble** để chuyển hóa đầu vào (văn bản, hình ảnh, video) thành các thế giới 3D có thể điều hướng và tương tác hoàn chỉnh. Mặc dù quy mô nhỏ hơn nhiều so với các LLM hàng đầu như GPT-5, Marble đã có các ứng dụng thực tế trong phát triển game, sản xuất phim (giảm 40 lần thời gian), đào tạo robot, thiết kế nội thất và thậm chí trị liệu sức khỏe tâm thần (ví dụ: rối loạn ám ảnh cưỡng chế OCD, chứng sợ độ cao). Li Fei-Fei hình dung một tương lai nơi công nghệ này cho phép chúng ta tạo ra "vũ trụ vô hạn" và sống trong "đa vũ trụ" số. Tuy nhiên, cô nhấn mạnh tầm quan trọng của việc phát triển AI có trách nhiệm, lấy phẩm giá và quyền tự chủ của con người làm trung tâm, giống như cách điện đã thay đổi nền văn minh một cách tích cực. Hành trình phát triển trí tuệ không gian cho AI có thể dài, nhưng nó là bước tiến hóa cần thiết để AI thực sự "hiểu" và "hành động" trong thế giới.

marsbit05/27 00:17

Từ một bàn ăn trưa đến vũ trụ vô tận: Fei-Fei Li đặt cược vào chiều kích tiếp theo của AI

marsbit05/27 00:17

Từ Cơ Sở Hạ Tầng Điện Lực Đến Nền Kinh Tế Token: 'Chiếc Bánh 7 Tầng' Của Chuỗi Cung Ứng AI

Trong hai năm qua, ngành AI chủ yếu tập trung vào "cuộc chiến mô hình lớn" giữa các tập đoàn công nghệ. Tuy nhiên, đến năm 2026, động lực chính đã chuyển từ đào tạo mô hình sang nhu cầu suy luận (inference) khổng lồ từ các AI Agent. Ngành công nghiệp này đang bước từ "thời đại mô hình" sang "thời đại công nghiệp Token", nơi hệ thống sản xuất, phân phối, điều phối và tiêu thụ Token trở thành cốt lõi. Bài viết đề xuất cấu trúc "bảy tầng bánh" của nền kinh tế AI xoay quanh Token: 1. **Điện lực:** Nền tảng năng lượng. 2. **Trung tâm dữ liệu AI (AIDC):** Nhà máy sản xuất Token. 3. **GPU:** Thiết bị sản xuất Token. 4. **Mô hình ngôn ngữ lớn (LLM):** Động cơ sản xuất Token. 5. **Phân phối Token:** Mạng lưới phân phối. 6. **Tối ưu hóa & Điều phối Token:** Bộ não thông minh. 7. **AI Agent:** Thiết bị tiêu thụ Token. Hiện tại, hệ thống này vẫn chưa hoàn thiện, tồn tại sự phân mảnh và kém hiệu quả giữa các tầng (ví dụ: có GPU nhưng thiếu điện, có AIDC nhưng thiếu khả năng điều phối). Chỉ khi cả bảy tầng được kết nối và vận hành đồng bộ, ngành AI mới thực sự chuyển từ "thời đại công cụ" sang "thời đại áp dụng quy mô lớn". Tương lai sẽ không chỉ là vài mô hình lớn, mà là hàng tỷ AI Agent hoạt động liên tục, biến AI thành một hệ thống hạ tầng công nghiệp toàn cầu bao gồm năng lượng, chip, mạng lưới và sự lưu chuyển thông minh của Token.

marsbit05/26 05:47

Từ Cơ Sở Hạ Tầng Điện Lực Đến Nền Kinh Tế Token: 'Chiếc Bánh 7 Tầng' Của Chuỗi Cung Ứng AI

marsbit05/26 05:47

Alumni TH Thanh Hoa U00 tuổi Vương Quan ra tác phẩm mới: Dùng 1/900 token, 1/432 sức tính toán, làm đảo lộn mô hình tiền huấn luyện Transformer

Cựu sinh viên Thanh Hoa 00 hậu Vương Quan và nhóm nghiên cứu công bố mô hình HRM-Text, một phương pháp huấn luyện tiền ngôn ngữ hiệu quả sử dụng Mô hình tuần hoàn phân tầng (HRM) thay thế Transformer tiêu chuẩn. Với chỉ 1B tham số và được huấn luyện trên 40B token duy nhất, chi phí ước tính khoảng 1500 USD, HRM-Text đạt hiệu suất tương đương các mô hình nguồn mở từ 2B đến 7B tham số trên các bài kiểm tra chuẩn như MMLU (60.7%) và GSM8K (84.5%). Phương pháp này tiết kiệm đáng kể tài nguyên: sử dụng ít hơn từ 100-900 lần token huấn luyện và 96-432 lần ước tính tính toán so với baseline tiêu chuẩn. Thiết kế chính bao gồm: kiến trúc HRM với module H (chậm) và L (nhanh) cho phép cập nhật đệ quy nhiều lượt trên cùng một token để tăng độ sâu tính toán; và mục tiêu huấn luyện tập trung vào các cặp chỉ dẫn-câu trả lời, chỉ tính toán mất mát trên phần trả lời với cơ chế che PrefixLM. Thử nghiệm cho thấy HRM vượt trội về hiệu quả kiến trúc và ổn định huấn luyện so với Transformer ở cùng quy mô FLOPs. Các hướng phát triển tương lai bao gồm tách biệt "kiến thức" và "suy luận", cơ chế thời gian tính toán thích ứng, xác thực khả năng mở rộng quy mô hơn nữa, và tối ưu hóa việc triển khai PrefixLM trong các framework suy luận thực tế.

marsbit05/26 03:18

Alumni TH Thanh Hoa U00 tuổi Vương Quan ra tác phẩm mới: Dùng 1/900 token, 1/432 sức tính toán, làm đảo lộn mô hình tiền huấn luyện Transformer

marsbit05/26 03:18

Nhà đầu tư cuồng nhiệt săn đón doanh nghiệp AI 'không có lợi nhuận': Một ván cược lớn về 'quyền định nghĩa tương lai'

Đầu tư điên cuồng vào các công ty AI "chưa có lợi nhuận": Một canh bạc lớn về "quyền định nghĩa tương lai" Bài viết phân tích cơn sốt đầu tư vào bốn "kỳ lân" AI Trung Quốc - DeepSeek, Zhipu AI, MiniMax và Kimi (Moon's Shadow) - những công ty có tổng định giá đã vượt 1 nghìn tỷ Nhân dân tệ dù đang thua lỗ nặng. Động lực chính là cuộc chạy đua giành "quyền định nghĩa tương lai" trong kỷ nguyên AI. Các nhà đầu tư, bao gồm cả quỹ nhà nước (như Quỹ Đầu tư Ngành Mạch tích hợp Quốc gia đầu tư vào DeepSeek) và các gã khổng lồ internet (Tencent, Alibaba, Meituan), đang đặt cược vào vị thế độc quyền và cửa sổ cơ hội 6-12 tháng trước khi tính độc đáo giảm dần. Mặc dù thua lỗ lớn (Zhipu lỗ 4.7 tỷ NDT năm 2025, MiniMax lỗ 1.87 tỷ USD), các công ty này đang cho thấy sự tăng trưởng doanh thu ấn tượng nhờ tiến bộ công nghệ và áp lực giảm chi phí. Kimi đạt doanh thu thường niên hóa (ARR) 2 tỷ USD vào tháng 4, Zhipu API ARR đạt ~17 tỷ NDT. MiniMax tập trung vào thị trường toàn cầu với hơn 70% doanh thu từ nước ngoài. DeepSeek gây chú ý với mô hình V4 có chi phí thấp hơn đáng kể so với đối thủ. Bài viết cũng chỉ ra những thách thức: cửa sổ độc quyền đang đóng lại, nút thắt về năng lực tính toán và bản chất cạnh tranh khốc liệt. Các ông lớn công nghệ vừa tự phát triển mô hình vừa đầu tư vào các startup như một chiến lược "mua vé lên tàu". Câu hỏi then chốt là liệu các công ty này có thể duy trì định giá cao khi tính độc quyền mất đi và họ phải tự chứng minh bằng lợi nhuận thực tế.

marsbit05/26 02:10

Nhà đầu tư cuồng nhiệt săn đón doanh nghiệp AI 'không có lợi nhuận': Một ván cược lớn về 'quyền định nghĩa tương lai'

marsbit05/26 02:10

TechFlow Tình Báo Cục: Huawei công bố "Định luật Thao" khiến khối bán dẫn tăng mạnh; Meta cắt giảm 10% nhân sự

**AI và toán học:** DeepSeek Reasonix (AI) đã giải quyết thành công 9/353 bài toán toán học mở với chi phí chỉ vài trăm USD/bài, lần đầu cho thấy giá trị thực tiễn của AI trong lĩnh vực toán học thuần túy cấp cao. **Chip và phần cứng:** Huawei công bố "Định luật Thao (τ)" nhằm đạt hiệu năng tương đương 1,4nm vào năm 2031 thông qua đổi mới kiến trúc, làm tăng mạnh cổ phiếu ngành bán dẫn. Chi phí bộ nhớ trong chip AI hiện chiếm gần 2/3 tổng chi phí. **Công ty công nghệ:** Meta sa thải 10% nhân viên (khoảng 8.000 người) trong đợt chuyển đổi sang AI. CEO Google Sundar Pichai bị sinh viên phản đối trong một bài phát biểu về AI. **Kinh tế và Tài chính:** Giá dầu WTI giảm 6% xuống 90,80 USD/thùng do những tiến triển trong đàm phán Mỹ-Iran. Một cuộc khảo sát cho thấy 99% CEO kỳ vọng sẽ sa thải nhân viên do AI trong hai năm tới. **Bảo mật và Xu hướng:** Một nghiên cứu bảo mật tiết lộ các lệnh ẩn, không thể nghe thấy có thể được nhúng vào video/ podcast để điều khiển trợ lý AI giọng nói. **Chủ đề xuyên suốt:** Tin tức ngày nay cho thấy cuộc đua về AI và chip đã vượt ra khỏi phạm vi kỹ thuật, trở thành cuộc cạnh tranh về việc làm, chính trị địa lý và quyền định nghĩa "trí thông minh" tương lai.

marsbit05/25 10:52

TechFlow Tình Báo Cục: Huawei công bố "Định luật Thao" khiến khối bán dẫn tăng mạnh; Meta cắt giảm 10% nhân sự

marsbit05/25 10:52

Agentic Design Patterns: Một cuốn sách khiến tôi hiểu lại 'Agent thực sự là gì'

Tác giả Yanhua chia sẻ những hiểu biết sâu sắc từ cuốn sách "Agentic Design Patterns" của Antonio Gullí (Google), giúp định nghĩa lại "Agent thực sự là gì". Cuốn sách phân loại AI Agent thành 4 cấp độ: - **Cấp 0 (Không phải Agent):** LLM thuần túy, không công cụ, không hành động. - **Cấp 1 (Dùng công cụ):** Tự nhận thức khi cần và biết sử dụng công cụ (tìm kiếm, API). - **Cấp 2 (Suy nghĩ chiến lược):** Có khả năng lập kế hoạch và "Context Engineering" - tinh chỉnh ngữ cảnh để tối ưu hiệu quả, cùng với phản ánh (Reflection) để tự sửa lỗi. - **Cấp 3 (Đa tác nhân):** Nhiều Agent cộng tác như một đội, với các cấu trúc giao tiếp khác nhau. Bài viết nhấn mạnh ba khái niệm then chốt: 1. **Context Engineering:** Quan trọng hơn Prompt Engineering, tập trung vào việc chuẩn bị thông tin ngữ cảnh (system prompt, dữ liệu bên ngoài, ngầm định, vòng phản hồi) cho Agent một cách tinh gọn. 2. **Reflection (Mô hình Producer-Critic):** Sử dụng hai Agent riêng biệt (một sản xuất, một phê bình) trong một vòng lặp để tự động cải thiện chất lượng đầu ra, áp dụng cho viết code, lập kế hoạch... 3. **Bộ nhớ ba lớp:** Cần phân tách bộ nhớ thành Session (phiên), State (trạng thái tạm thời của tác vụ) và Memory (lưu trữ lâu dài) để quản lý hiệu quả. Thông điệp chính: Thay vì vội xây dựng hệ thống đa Agent phức tạp (Cấp 3), hãy tập trung phát triển Agent đơn lẻ lên Cấp 2 trước bằng cách áp dụng Reflection và Context Engineering. Cuốn sách cung cấp bản đồ các mẫu thiết kế đã được kiểm chứng, giúp nhà phát triển tránh lặp lại các lỗi phổ biến.

链捕手05/25 04:47

Agentic Design Patterns: Một cuốn sách khiến tôi hiểu lại 'Agent thực sự là gì'

链捕手05/25 04:47

DeepSeek Hạ Giá Vĩnh Viễn, Nhưng Lương Văn Phong Không Muốn Làm "Bồ Tát Công Nghệ"

DeepSeek vừa công bố áp dụng mức giảm giá 75% vĩnh viễn cho API V4-Pro, với giá đầu vào cơ bản giảm từ 1,74 USD xuống 0,435 USD cho mỗi triệu token, trong khi toàn ngành AI đang có xu hướng tăng giá. Động thái này củng cố biệt danh “Pinduoduo của AI” của họ. Giữa lúc các gã khổng lồ như OpenAI, Anthropic và Google âm thầm tăng phí, DeepSeek đi ngược lại bằng chiến lược định giá thấp bền vững. Bài viết phân tích rằng đây không đơn thuần là hành động “từ thiện” của CEO Lương Văn Phong, mà là một lựa chọn chiến lược dựa trên lợi thế cạnh tranh hệ thống của Trung Quốc. Các lợi thế này bao gồm nguồn nhân lực AI với chi phí hợp lý hơn, đặc biệt là nền tảng năng lượng với giá điện công nghiệp thấp (chỉ bằng 1/5 đến 1/4 so với Mỹ và châu Âu), chiếm tới 60-70% chi phí vận hành mô hình AI. Việc DeepSeek lên kế hoạch xây dựng trung tâm dữ liệu ở khu vực phía Tây như Nội Mông càng tối ưu hóa lợi thế này. Trong khi các mô hình đóng (closed-source) thống trị về mặt hiệu năng đỉnh cao, DeepSeek nhắm đến thị trường đại chúng rộng lớn hơn với nhu cầu “đủ dùng, ổn định và cực rẻ”. Khi AI ngày càng đắt đỏ, thì mô hình “vừa phải nhưng cực kỳ tiết kiệm chi phí” của DeepSeek càng trở nên hấp dẫn, cho phép doanh nghiệp thử nghiệm và triển khai nhiều hơn với cùng một ngân sách. Chiến lược mã nguồn mở và giá cả thấp của họ không chỉ là một mô hình kinh doanh khả thi, mà còn đặt ra một cuộc cạnh tranh định giá token toàn cầu, đặc biệt trong bối cảnh cạnh tranh công nghệ giữa các quốc gia.

marsbit05/24 12:21

DeepSeek Hạ Giá Vĩnh Viễn, Nhưng Lương Văn Phong Không Muốn Làm "Bồ Tát Công Nghệ"

marsbit05/24 12:21

Trí Phổ Dựa Vào Đâu Để Tăng Gần 30% Trong Một Ngày?

Hôm nay, cổ phiếu của "cổ phiếu mô hình lớn toàn cầu đầu tiên" Zhipu AI (02513.HK) đã bùng nổ. Động lực chính đến từ một thông số kỹ thuật cụ thể: Tốc độ đầu ra API của phiên bản cao tốc GLM-5.1 (GLM-5.1-highspeed) đạt 400 token/giây, thiết lập kỷ lục mới về tốc độ API trong ngành công nghiệp mô hình lớn toàn cầu. Tốc độ 400 token/giây này quan trọng như thế nào? Khi AI chuyển từ ChatBot sang thời đại Agent, mỗi tác vụ thường yêu cầu hàng chục hoặc thậm chí hàng trăm lần gọi mô hình. Độ trễ thấp ở đây trở thành yếu tố then chốt, trực tiếp ảnh hưởng đến trải nghiệm người dùng và hiệu quả công việc. Tốc độ này nhanh gấp khoảng 3-5 lần so với các mô hình hàng đầu hiện tại như GPT-4o hay Claude Sonnet. Để đạt được bước đột phá này, Zhipu AI đã thực hiện những đổi mới đồng thời trên ba cấp độ: 1. **TileRT – Công cụ suy luận:** Biên dịch toàn bộ mô hình thành một động cơ chạy liên tục, loại bỏ chi phí khởi động và chờ đợi lặp đi lặp lại giữa các toán tử, cho phép GPU duy trì hoạt động ở tốc độ cao. 2. **Chiến lược song song:** Tối ưu hóa việc triển khai cơ chế chú ý MLA (Multi-head Latent Attention) của GLM-5.1 trên nhiều GPU. Họ áp dụng kiến trúc chạy không đồng nhất, trong đó GPU 0 chuyên xử lý chỉ mục thưa thớt và định tuyến, trong khi các GPU khác xử lý tính toán dày đặc, giảm thiểu đáng kể chi phí giao tiếp. 3. **Kiến trúc mạng ZCube:** Một thiết kế mạng mới thay thế cấu trúc ROFT (Fat-Tree) truyền thống. ZCube loại bỏ lớp Spine (xương sống), làm phẳng toàn bộ mạng và kết nối tất cả các bộ chuyển mạch Leaf (lá) theo một cấu trúc đặc biệt. Thiết kế này đảm bảo rằng giữa hai GPU bất kỳ chỉ có một đường dẫn tối ưu duy nhất, về cơ bản loại bỏ khả năng tắc nghẽn mạng do cân bằng tải không hiệu quả. Những cải tiến này mang lại lợi ích rõ ràng: cụm sản xuất nâng cấp lên ZCube đạt được mức tăng 15% thông lượng, giảm 40.6% độ trễ đuôi và giảm khoảng một phần ba chi phí thiết bị mạng. Về lâu dài, công nghệ này không chỉ nâng cao hiệu quả sử dụng GPU mà còn có thể định hình lại cấu trúc hạ tầng AI, mở ra cơ hội cho các nhà cung cấp chip AI, thiết bị chuyển mạch và mô-đun quang trong nước.

marsbit05/23 01:25

Trí Phổ Dựa Vào Đâu Để Tăng Gần 30% Trong Một Ngày?

marsbit05/23 01:25

37 ngày tạm giam, những người đầu tiên kiếm tiền từ 'trạm trung chuyển AI' bắt đầu vào tù

Theo tin từ giới làm AI, tháng 5/2026, một quản trị viên trạm trung chuyển AI đã công khai tuyên bố bị tạm giữ hình sự 37 ngày vì hành vi đảo ngược, thu thập trái phép và bán lại tài nguyên API AI giá rẻ, hiện đang được bảo lãnh tại ngoại. Sự bùng nổ nhu cầu sử dụng AI trong nước gặp phải các rào cản như hạn chế khu vực của mô hình lớn nước ngoài, dẫn đến sự phát triển của các dịch vụ trung chuyển AI. Các dịch vụ này đóng vai trò như "người môi giới", giúp người dùng tiếp cận các mô hình và thu phí. Các mô hình kinh doanh chính của trạm trung chuyển AI bao gồm: - Bán lại hạn mức miễn phí từ việc đăng ký hàng loạt tài khoản. - Lợi dụng chính sách hoàn tiền để kiếm lời. - Khai man số lượng Token tính phí cho người dùng. - Đánh tráo mô hình (dùng mô hình nhỏ thay thế mô hình lớn như đã quảng cáo). - Thu thập và bán dữ liệu hội thoại của người dùng. Tuy nhiên, hoạt động này tiềm ẩn nhiều rủi ro pháp lý: 1. Mô hình kinh doanh có thể vi phạm pháp luật: Việc thu thập tài nguyên không qua kênh chính thức và cung cấp dịch vụ viễn thông/gia công dữ liệu mà không có giấy phép có thể cấu thành tội kinh doanh trái phép. 2. Thiếu nghĩa vụ bảo mật dữ liệu: Các trạm trung chuyển thường không có biện pháp bảo vệ dữ liệu người dùng, rủi ro rò rỉ cao, có thể dẫn đến trách nhiệm hình sự vì không tuân thủ nghĩa vụ quản lý an ninh mạng. 3. Thu thập và bán dữ liệu người dùng trái phép: Hành vi này dễ dàng đạt ngưỡng cấu thành tội xâm phạm thông tin cá nhân. Sự kiện này phản ánh những vấn đề của ngành AI trong giai đoạn phát triển nóng. Đối với người dùng, dịch vụ trung chuyển giúp giảm rào cản nhưng đặt dữ liệu nhạy cảm vào rủi ro. Đối với nhà cung cấp, nó gây tổn hại đến mô hình kinh doanh, méo mó nhận thức về giá trị và làm xói mòn nền tảng phát triển bền vững của toàn ngành.

marsbit05/21 14:43

37 ngày tạm giam, những người đầu tiên kiếm tiền từ 'trạm trung chuyển AI' bắt đầu vào tù

marsbit05/21 14:43

活动图片