# Bài viết Liên quan AI Cục bộ

Trung tâm Tin tức HTX cung cấp những bài viết mới nhất và phân tích chuyên sâu về "AI Cục bộ", bao gồm xu hướng thị trường, cập nhật dự án, phát triển công nghệ và chính sách quản lý trong ngành tiền kỹ thuật số.

Bảng xếp hạng mô hình Hugging Face, hiện tại tôi chỉ phục yuxinlu1

Một nhà phát triển cá nhân, yuxinlu1 (Lộ Vũ Tân), đã gây bất ngờ khi hai mô hình AI của anh vươn lên Top Trending trên Hugging Face, cạnh tranh với những gã khổng lồ như GLM-5.2 hay Unlimited-OCR của Baidu. Hai mô hình này, dựa trên kiến trúc Gemma4-12B, đạt lượt tải xuống lần lượt 207K và 536K. Điểm nổi bật là chúng được tối ưu hóa ở định dạng GGUF, cho phép chạy cục bộ với chỉ khoảng 4.5GB VRAM/bộ nhớ thống nhất, mang lại trải nghiệm hỗ trợ lập trình và agent riêng tư, miễn phí. Phiên bản V1 tập trung vào lập trình và giải mã, được huấn luyện trên dữ liệu code "có thể xác minh". Phiên bản V2 bổ sung khả năng gọi công cụ đa bước (agentic), được báo cáo là hiệu suất gấp ~3.5 lần mô hình gốc trong một bài kiểm tra nhất định. Lộ Vũ Tân, một nghiên cứu sinh AI, đã tự tài trợ và dành khoảng 40 giờ làm việc cường độ cao cho dự án này. Anh nhấn mạnh yếu tố then chốt là chất lượng dữ liệu chứ không phải số lượng, và động lực là giải quyết nhu cầu thực tế của cộng đồng: một trợ lý AI mạnh mẽ, chạy được trên phần cứng phổ thông, bảo vệ quyền riêng tư và không có chi phí API. Câu chuyện của anh cho thấy sức mạnh của một nhà phát triển cá nhân tập trung giải quyết sâu một vấn đề cụ thể (coding/agent cục bộ) với sự chân thành và kiên trì, thay vì cố gắng tạo ra một mô hình toàn năng. Các mô hình của anh hiện có sẵn trên Hugging Face và được khuyến nghị chạy với llama.cpp.

marsbit06/28 01:54

Bảng xếp hạng mô hình Hugging Face, hiện tại tôi chỉ phục yuxinlu1

marsbit06/28 01:54

AI PC đã tới, chạy mô hình lớn 120B ngay trên máy! NVIDIA định nghĩa lại nền tảng 'Máy tính Cá nhân AI' với RTX Spark

Trong hai năm qua, các nhà sản xuất PC thường xuyên nhắc đến thông số "TOPS của NPU" khi quảng bá "AI PC", nhưng những con số này vẫn ở mức tương đối khiêm tốn, chỉ phù hợp cho các tác vụ AI nhẹ. Tại GTC 2026, NVIDIA đã giới thiệu siêu chip RTX Spark với hiệu năng AI lên tới 1 petaflop (1000 TOPS), vượt trội hơn hẳn một bậc so với các giải pháp NPU trước đây. RTX Spark tích hợp GPU kiến trúc Blackwell, CPU Arm Grace 20 nhân do MediaTek đồng thiết kế và sử dụng bộ nhớ thống nhất lên đến 128GB, cho phép CPU và GPU chia sẻ chung một nhóm bộ nhớ. Sự thay đổi kiến trúc này giúp thiết bị có khả năng chạy mô hình lớn (LLM) 120B tham số ngay tại本地 (on-device) với cửa sổ ngữ cảnh lên tới triệu token. Ngoài ra, nó còn hỗ trợ chỉnh sửa video 12K, render cảnh 3D và chơi game ray-tracing ở mức khung hình cao. NVIDIA cũng công bố hợp tác với Microsoft để tăng cường bảo mật cho Windows, tích hợp thời gian chạy sandbox mã nguồn mở OpenShell để cô lập và quản lý hành vi của AI agent, giúp các doanh nghiệp triển khai thiết bị này một cách an toàn. Về phía phần mềm, Adobe tuyên bố sẽ tái cấu trúc Photoshop và Premiere từ gốc để tối ưu hóa cho kiến trúc bộ nhớ thống nhất của RTX Spark, hứa hẹn tăng hiệu suất lên gấp đôi. Sáu OEM hàng đầu bao gồm ASUS, Dell, HP, Lenovo, Microsoft Surface và MSI sẽ ra mắt máy tính xách tay mỏng nhẹ và máy tính để bàn nhỏ gọn tích hợp RTX Spark vào mùa thu năm nay, Acer và Gigabyte sẽ theo sau. Tuy nhiên, các câu hỏi về giá cả, khả năng tản nhiệt, hiệu suất thực tế và thời lượng pin vẫn cần được làm rõ khi sản phẩm chính thức ra mắt. Sự xuất hiện của RTX Spark đánh dấu sự dịch chuyển quyền lực trong ngành công nghiệp PC, từ mô hình truyền thống lấy CPU x86 làm trung tâm sang mô hình nền tảng SoC mới lấy GPU làm chủ đạo.

marsbit06/01 06:44

AI PC đã tới, chạy mô hình lớn 120B ngay trên máy! NVIDIA định nghĩa lại nền tảng 'Máy tính Cá nhân AI' với RTX Spark

marsbit06/01 06:44

OpenClaw và Hermes, rốt cuộc cái nào phù hợp hơn với bạn?

Nếu năm 2025 là cuộc đua về "năng lực mô hình lớn", thì đầu 2026, trọng tâm chuyển sang một cuộc chiến cụ thể hơn: AI agent cá nhân thực sự ứng dụng thế nào. Hai dự án nổi bật là OpenClaw và Hermes Agent, đại diện cho hai triết lý khác nhau. OpenClaw, với 346,000 sao trên GitHub, nhấn mạnh quyền kiểm soát và khả năng tùy chỉnh. Nó có hệ sinh thái kỹ năng phong phú (44,000+ kỹ năng), linh hoạt lựa chọn mô hình (Claude, GPT-5.5, Kimi...), tích hợp đa nền tảng (Telegram, Discord, iMessage...), và hỗ trợ kiến trúc đa agent. Tuy nhiên, nó phức tạp để cấu hình và chi phí token cao hơn. Hermes Agent, từ Nous Research, tập trung vào tự động hóa và hiệu quả chi phí. Nó tự động học hỏi từ các tác vụ, cải thiện theo thời gian, có sẵn 40+ công cụ, chi phí token thấp hơn ~90%, và dễ dàng sử dụng ngay. Nhược điểm là tích hợp nền tảng còn hạn chế và tính năng đa agent vẫn đang phát triển. Lựa chọn phụ thuộc vào nhu cầu: OpenClaw cho người dùng kỹ thuật muốn toàn quyền kiểm soát, Hermes cho người dùng phổ thông ưu tiên sự đơn giản và chi phí thấp. Giống như so sánh Ferrari và Honda, mỗi loại phục vụ một đối tượng khác nhau.

marsbit04/26 06:44

OpenClaw và Hermes, rốt cuộc cái nào phù hợp hơn với bạn?

marsbit04/26 06:44

活动图片