# Bài viết Liên quan RAG

Trung tâm Tin tức HTX cung cấp những bài viết mới nhất và phân tích chuyên sâu về "RAG", bao gồm xu hướng thị trường, cập nhật dự án, phát triển công nghệ và chính sách quản lý trong ngành tiền kỹ thuật số.

Karpathy Lại Lập Kỳ Tích, Lật Đổ RAG, Biến Ghi Chú Của Bạn Thành Bộ Não Thứ Hai

Karpathy đã đề xuất một phương pháp cách mạng thay thế RAG truyền thống: xem ghi chú cá nhân là "mã nguồn" và sử dụng LLM làm "trình biên dịch" để xây dựng một wiki kiến thức cấu trúc và tự động. Trong mô hình LLM-WIKI này, tri thức được "biên dịch" một lần và duy trì liên tục, thay vì tái tạo lại mỗi khi truy vấn. Hệ thống có ba lớp: Raw (nguyên liệu thô không thể chỉnh sửa), Schema (quy tắc cấu trúc) và Wiki (sản phẩm biên dịch tự động, được liên kết chéo và cập nhật). Quy trình chính bao gồm Ingest (nạp tài liệu mới, tự động cập nhật các trang liên quan), Query (truy vấn wiki với câu trả lời có trích dẫn) và Lint (kiểm tra lỗi logic và mâu thuẫn). Phương pháp này giải quyết vấn đề suy giảm hiệu quả của RAG và bản đồ tri thức thủ công, đồng thời hiện thực hóa tầm nhìn về máy Memex từ năm 1945 bằng cách tự động hóa công việc bảo trì "ghi sổ" tẻ nhạt. Bản chất là một sự chuyển dịch quan hệ sản xuất nhận thức: AI đảm nhận việc quản lý, tổ chức và kết nối tri thức, giải phóng sự chú ý của con người cho các nhiệm vụ sáng tạo và chiến lược như lựa chọn thông tin và suy ngẫm ý nghĩa.

marsbit07/01 09:56

Karpathy Lại Lập Kỳ Tích, Lật Đổ RAG, Biến Ghi Chú Của Bạn Thành Bộ Não Thứ Hai

marsbit07/01 09:56

Ba năm sau: Nhìn lại nhận định của tôi về ChatGPT vào năm 2023

**Tóm tắt tiếng Việt:** Năm 2026, tác giả Vương Kiến Thạc nhìn lại 20 dự đoán của mình về ChatGPT từ năm 2023, sử dụng AI (41 agent Opus 4.8) để đối chiếu với dữ liệu thực tế. **Kết quả chính:** Phần lớn các dự đoán về **cơ chế và xu hướng** là đúng: * **Đúng:** Kiến trúc RAG + tìm kiếm trở thành chuẩn để giảm ảo giác. LUI (Giao diện ngôn ngữ tự nhiên) tạo ra một "lục địa mới" cho tương tác máy tính. Mạng lưới agent với giao thức kết nối mới đang hình thành. Trung Quốc thu hẹp khoảng cách về mô hình lớn có thể sử dụng. ChatGPT không có ý thức, vượt qua bài kiểm tra Turing nhờ biểu diễn. Nó là bước tiến lớn nhưng chưa phải AGI, chưa gây ra làn sóng thất nghiệp hàng loạt. * **Sai/Sai một phần:** Dự đoán cụ thể **GPT-4 có 100 nghìn tỷ tham số** là sai hoàn toàn (thực tế ~1.8 nghìn tỷ). Nhận định **LLM không thể tự học toán** bị bác bỏ khi các mô hình giành huy chương IMO. **Giá trị sẽ thuộc về lớp ứng dụng** bị chứng minh ngược lại khi lợi nhuận khổng lồ thuộc về lớp nền tảng tính toán (như NVIDIA). **AI có thể né tránh vấn đề bản quyền** là sai, với các vụ kiện và khoản bồi thường lớn. Dự đoán **chi phí đào tạo mô hình lớn chỉ 5-10 tỷ USD** là quá thấp so với thực tế. **Bài học rút ra:** 1. **Dự đoán xu hướng và cơ chế đáng tin cậy hơn nhiều so với các con số cụ thể hay mức độ tuyệt đối.** 2. **Có xu hướng đánh giá quá cao tốc độ thay đổi trong ngắn hạn, nhưng lại đánh giá thấp mức độ thay đổi trong dài hạn.** 3. **Sai lầm tinh vi thường nằm ở "sự phân bố":** tổng thể đúng nhưng tác động không đồng đều (ví dụ: việc làm). 4. **Những phát biểu có giới hạn, thận trọng thường đứng vững theo thời gian.** 5. **Ba năm là chưa đủ để kết luận cho một số vấn đề sâu xa** (như ý thức máy móc, sự xuất hiện năng lực). Bài viết kết luận rằng việc nhìn đúng hướng đi lớn không quá khó, nhưng thừa nhận những sai lầm trong ước tính chi tiết, tốc độ và phân bố mới là điều đáng ghi nhớ cho những dự đoán trong tương lai.

marsbit05/31 16:07

Ba năm sau: Nhìn lại nhận định của tôi về ChatGPT vào năm 2023

marsbit05/31 16:07

Ba năm sau: Nhìn lại những dự đoán của tôi về ChatGPT năm 2023

**Tóm tắt: Nhìn lại 20 dự đoán về ChatGPT năm 2023 sau 3 năm** Vào tháng 3/2023, khi ChatGPT mới xuất hiện và GPT-4 chưa ra mắt, tác giả Vương Kiến Thạc đã đưa ra 20 nhận định về tương lai của AI. Giờ đây, vào cuối tháng 5/2026, một hệ thống AI gồm 41 agent đã được sử dụng để kiểm chứng lại từng dự đoán đó dựa trên dữ liệu thực tế. **Kết quả kiểm chứng (Tính đến 5/2026):** * **Đúng/Bản chất đúng (✅/🟢):** 13/20 dự đoán. * **Một phần đúng (🟡):** 6/20 dự đoán. * **Sai (❌):** 1/20 dự đoán. **Những điểm dự đoán chính xác nổi bật:** 1. **Kiến trúc RAG & Tìm kiếm:** Dự đoán việc bổ sung kiến thức thông qua cơ chế truy xuất bên ngoài (như vector search) thay vì chỉ fine-tune model đã trở thành tiêu chuẩn. 2. **Giao diện ngôn ngữ tự nhiên (LUI):** Nhận định ChatGPT mở ra kỷ nguyên LUI, tạo ra một hệ sinh thái rộng lớn hơn cả việc phát triển model cơ bản, đã được chứng minh. 3. **Mô hình lớn Trung Quốc:** Dự báo khoảng cách về khả năng giữa các mô hình Trung Quốc và đỉnh cao thế giới sẽ thu hẹp nhanh chóng trong khoảng 3 năm đã thành hiện thực. 4. **Ý thức và Kiểm tra Turing:** Quan điểm cho rằng ChatGPT không có ý thức và bài kiểm tra Turing chỉ đánh giá biểu hiện bề ngoài vẫn vững vàng. **Những điểm dự đoán chưa chính xác hoặc sai lệch:** 1. **Tham số GPT-4 (❌):** Thông tin GPT-4 có 100 nghìn tỷ tham số là hoàn toàn sai. 2. **Khả năng toán học của LLM:** Mặc dù đúng khi cho rằng cần công cụ bổ trợ, nhưng khẳng định LLM "không thể" tự học toán thuần túy đã bị bác bỏ khi các model năm 2025 giành huy chương IMO. 3. **Nơi nắm giữ giá trị:** Dự đoán giá trị sẽ thuộc về tầng ứng dụng, còn các công ty làm model cơ bản có thể không sinh lời, đã không tính đến sự thống trị và lợi nhuận khổng lồ của NVIDIA ở tầng phần cứng tính toán. 4. **Bản quyền:** Nhận định AI có thể "né tránh" vi phạm bản quyền là sai, khi thực tế đã có những vụ kiện và dàn xếp bồi thường lớn nhất lịch sử liên quan đến dữ liệu huấn luyện. **Bài học rút ra sau 3 năm:** * **Dự đoán xu hướng và cơ chế đáng tin cậy hơn nhiều so với các con số cụ thể.** * Xu hướng chung: **Đánh giá quá lạc quan về tốc độ, nhưng lại đánh giá thấp mức độ phát triển** về lâu dài. * Sai lầm tinh vi thường nằm ở **sự phân bổ** (ví dụ: tác động việc làm lên nhóm người lao động trẻ), chứ không phải tổng thể. * **Những nhận định có giới hạn, điều kiện đi kèm thường chính xác hơn** những phát biểu tuyệt đối. * Một số câu hỏi lớn vẫn chưa có câu trả lời cuối cùng sau 3 năm. Bản tổng kết này không chỉ chấm điểm cho quá khứ, mà còn đặt ra những quy tắc cho việc dự đoán trong tương lai.

链捕手05/31 13:39

Ba năm sau: Nhìn lại những dự đoán của tôi về ChatGPT năm 2023

链捕手05/31 13:39

Từ điển thuật ngữ AI (Phiên bản tháng 3/2026), đề nghị lưu lại

Từ vựng AI cần biết năm 2026: 30 thuật ngữ quan trọng từ cơ bản đến nâng cao Bài viết tổng hợp 30 thuật ngữ AI phổ biến, chia thành 2 nhóm: **Từ cơ bản (12):** - LLM (Mô hình ngôn ngữ lớn): Mô hình xử lý ngôn ngữ được đào tạo trên dữ liệu khổng lồ. - AI Agent: Hệ thống tự động hiểu mục tiêu và thực thi tác vụ. - Multimodal (Đa phương thức): Xử lý cùng lúc văn bản, hình ảnh, âm thanh. - Prompt: Lệnh đầu vào cho AI. - Generative AI (AIGC): AI tập trung vào tạo nội dung mới. - Token: Đơn vị xử lý văn bản, dùng để tính phí và đo lường. - Context Window: Số token tối đa AI có thể xử lý trong một lần. - Memory: Khả năng ghi nhớ lịch sử và sở thích người dùng. - Training & Inference: Quá trình đào tạo và triển khai mô hình. - Tool Calling: Khả năng gọi API và công cụ bên ngoài. **Từ nâng cao (18):** Bao gồm Transformer (kiến trúc mô hình), Attention (cơ chế tập trung), Hallucination (lỗi tạo nội dung sai), RAG (Tạo nội dung tăng cường bằng tìm kiếm), Fine-tuning (tinh chỉnh mô hình), cùng các khái niệm mới như Agentic Workflow, Subagents, Skills và Vibe Coding (lập trình bằng giao tiếp tự nhiên). Bài khuyến nghị nắm vững các thuật ngữ này để theo kịp xu hướng AI, đặc biệt trong bối cảnh ứng dụng ngày càng mở rộng.

marsbit03/11 11:55

Từ điển thuật ngữ AI (Phiên bản tháng 3/2026), đề nghị lưu lại

marsbit03/11 11:55

活动图片