# Bài viết Liên quan Kỹ thuật nhắc

Trung tâm Tin tức HTX cung cấp những bài viết mới nhất và phân tích chuyên sâu về "Kỹ thuật nhắc", bao gồm xu hướng thị trường, cập nhật dự án, phát triển công nghệ và chính sách quản lý trong ngành tiền kỹ thuật số.

Cha đẻ của Claude Code: Hướng dẫn chỉ có thời hạn 6 tháng, hãy tháo bỏ dây cương đi

Boris Cherny, cha đẻ của Claude Code, khuyến nghị người dùng và nhà phát triển sản phẩm AI: "Cứ sau sáu tháng, hãy xóa Claude.md, xóa skills và hooks của bạn." Trong một cuộc phỏng vấn với YC, ông kêu gọi mạnh mẽ việc dũng cảm xóa bỏ prompt, công cụ và mã harness, sau đó thêm từng dòng trở lại để kiểm tra tác động thực sự — một phương pháp nghiên cứu ablation. Ông so sánh mô hình AI như một sinh vật sống có tính cách riêng, thay đổi theo từng thế hệ, và nhấn mạnh cách tiếp cận thực nghiệm: thử nghiệm không định kiến, quan sát nơi mô hình gặp khó khăn và điều chỉnh. Cherny giới thiệu hai khái niệm then chốt: "Product Overhang" (khoảng cách giữa năng lực mô hình và giới hạn sản phẩm) và "Unhobbling" (cởi trói). Ông đề xuất ba cách để "cởi trói" cho mô hình: giao nhiệm vụ khó hơn dự kiến, thử nghiệm tự do không mục đích thương mại, và quan trọng là để mô hình tự xác minh công việc nhằm chạy độc lập lâu dài. Ông lấy ví dụ Claude đã tự chạy 15 ngày để viết lại ứng dụng Electron sang Swift. Cho người dùng và nhà khởi nghiệp, ông khuyên nên tránh các "mẹo" trên mạng, đối xử với mô hình như đồng nghiệp, bỏ kiểm soát và áp dụng tư duy thực nghiệm. Với người học lập trình, ông khuyến khích kết hợp lý thuyết khoa học máy tính với ứng dụng thực tế, cảm quan thiết kế và kinh doanh.

marsbit07/30 10:43

Cha đẻ của Claude Code: Hướng dẫn chỉ có thời hạn 6 tháng, hãy tháo bỏ dây cương đi

marsbit07/30 10:43

Vừa xong, Claude Fable 5 được gia hạn thêm 5 ngày, bí kíp tiết kiệm chi phí đã có đây

Anthropic đã thông báo kéo dài thời gian sử dụng miễn phí Claude Fable 5 đến ngày 12 tháng 7, so với kế hoạch ban đầu nhiều hơn 5 ngày. Người dùng vẫn có 50% giới hạn sử dụng hàng tuần; vượt quá cần mua thêm credits. Bài viết giới thiệu các phương pháp "tự cứu" và tối ưu chi phí sau khi thời gian miễn phí kết thúc. Các nhà phát triển đã đề xuất cách trích xuất "cách suy nghĩ" của Fable 5 thành hướng dẫn để tích hợp vào các mô hình nhỏ hơn như Opus 4.8, và các bước để khai thác triệt để khả năng của Fable 5. Đặc biệt, Anthropic chính thức đề xuất hai kiến trúc tiết kiệm chi phí: 1. **Chế độ Cố vấn (Advisor):** Sonnet 5 là lực lượng thực thi chính, chỉ tham khảo ý kiến Fable 5 tại các điểm quyết định then chốt. Cách này đạt ~92% hiệu suất của Fable 5 đơn lẻ với chi phí chỉ khoảng 63%. 2. **Chế độ Điều phối (Orchestrator):** Fable 5 đóng vai trò chỉ huy, lập kế hoạch và phân chia công việc tốn nhiều token (như đọc tài liệu) cho các tác nhân con Sonnet 5 xử lý song song. Trong bài kiểm tra BrowseComp, cách tiếp cận này đạt 96% hiệu suất với chi phí chỉ bằng 46%. Một ví dụ thực tế kiểm tra chính sách công viên quốc gia cho thấy, mô hình đội hình (orchestrator) chỉ tốn khoảng 1,61 USD, rẻ hơn ~2,5 lần và nhanh hơn ~3 lần so với việc để Fable 5 xử lý đơn lẻ (4 USD). Thông điệp chính: Cách sử dụng mô hình cao cấp hiệu quả nhất không phải là dùng nó cho mọi tác vụ, mà là kết hợp thông minh với các mô hình có chi phí thấp hơn để tối ưu hiệu suất và ngân sách.

marsbit07/08 00:57

Vừa xong, Claude Fable 5 được gia hạn thêm 5 ngày, bí kíp tiết kiệm chi phí đã có đây

marsbit07/08 00:57

Triết lý tiết kiệm thời đại AI: Làm thế nào để sử dụng mỗi Token một cách hiệu quả nhất

Trong thời đại AI, Token là đơn vị tiền tệ mới và việc quản lý chúng hiệu quả trở thành kỹ năng sống còn. Bài viết từ kinh nghiệm lịch sử (thời điện tín, điện thoại cố định) để rút ra bài học: tiết kiệm không phải vì thiếu thốn mà để đạt sự chính xác tối ưu. Cốt lõi là tối đa hóa "tỷ lệ tín hiệu trên nhiễu" (signal-to-noise ratio). Mọi dữ liệu đưa vào AI (văn bản, hình ảnh, mã code) đều tính phí, nên cần loại bỏ mọi thứ không cần thiết như lời chào dài dòng, chú thích code thừa, hoặc format phức tạp trong file PDF (nên chuyển sang Markdown). Với ảnh, nén kích thước đến mức tối thiểu có thể dùng được để giảm chi phí token đi hàng chục lần. Giao tiếp với AI cần rõ ràng, một lần, tránh kiểu "vắt sữa bò" từng chút một, vì mỗi lần tương tác lại đều phát sinh chi phí. Đầu ra của AI đắt gấp 3-5 lần đầu vào. Hãy đặt luật: yêu cầu AI bỏ qua các câu xã giao, lời giải thích không cần thiết và trả lời trực tiếp vào trọng tâm. Thiết lập giới hạn độ dài đầu ra và yêu cầu định dạng structured (như JSON) thay vì văn bản dài. Mô hình AI không có trí nhớ, nó phải đọc lại toàn bộ lịch sử hội thoại mỗi lần trả lời, khiến chi phí cho mỗi tin nhắn sau tăng lên theo cấp số nhân. Giải pháp là: một nhiệm vụ, một hội thoại mới. Sử dụng tính năng nén lịch sử hoặc Prompt Caching (lưu trữ gợi ý) để giảm chi phí tái sử dụng các chỉ dẫn giống nhau. Không phải mọi nhiệm vụ đều cần model mạnh nhất. Hãy phân tầng công việc: dùng model rẻ (như Haiku) cho các tác đơn giản (thu thập dữ liệu, làm sạch), và model đắt tiền (như Opus) cho phân tích sâu, ra quyết định phức tạp. Áp dụng quy trình làm việc hai giai đoạn để tinh chế dữ liệu trước khi đưa vào model mạnh. Quan trọng nhất, hãy tự hỏi liệu nhiệm vụ đó có thực sự cần dùng đến AI không. Sự đánh giá và can thiệp của con người để lọc bớt công việc cho AI là bộ lọc hiệu quả nhất. Nhận thức rõ chi phí của từng Token biến bạn từ kẻ phụ thuộc thành người chủ thực sự của sức mạnh tính toán.

marsbit04/03 03:25

Triết lý tiết kiệm thời đại AI: Làm thế nào để sử dụng mỗi Token một cách hiệu quả nhất

marsbit04/03 03:25

活动图片