Claude Code vừa mới thông báo đã cắt giảm một lượng lớn prompt, thì ngay sau đó Opus 5 đã bị bắt quả tang về việc "bật ngược" lại!?
Và mức bật ngược này, quả thực không hề nhỏ: 72%. (cười)
Những con số trông có vẻ đánh nhau này đến từ phía Anthropic chính thức và thử nghiệm thực tế của một cư dân mạng.
Hai ngày trước, Anthropic vừa thông báo đã xóa bỏ hơn 80% nội dung system prompt của các mô hình như Opus 5, Fable 5.
Kết quả là, ngay sau đó đã bị cư dân mạng Trần Thành (@chenchengpro) tình cờ "bắt gói" —
Anh chàng này đã chặn và thống kê system prompt mà các mô hình khác nhau thực sự nhận được, kết quả phát hiện Opus 5 so với Opus 4.8 lại dài thêm 72%??

Một bên xóa kịch liệt 80%, một bên lại dài thêm 72%.
Anthropic, prompt của ngài rốt cuộc đang giảm cân, hay là đang lén lút ăn thêm đồ ngoài......
Claude Code Đại Trùng Tu Prompt, Chính Thức Xóa Xóa Xóa Xóa Xóa 80%
Trước tiên hãy nói xem Anthropic lần này đã xóa cái gì.
Theo bài viết chính thức, Claude Code thời kỳ đầu để ngăn mô hình phạm sai lầm, đã viết vào system prompt rất nhiều quy tắc rõ ràng thậm chí tuyệt đối hóa.
Ví dụ mặc định không viết chú thích, không viết docstring nhiều đoạn, trừ khi người dùng yêu cầu, còn không thì không tạo kế hoạch và tài liệu phân tích.
Nói cách khác, mô hình dễ bị lật ở chỗ nào, con người liền bổ sung trước một quy định!!
Dần dà, system prompt đằng sau Claude Code, cũng ngày càng giống một cuốn "Sổ tay Hành vi Nhân viên" dày cộp.
Phương pháp này đặt lên mô hình thời kỳ đầu đương nhiên là hữu dụng rồi, nhưng cùng với sự nâng cao năng lực của Claude, vấn đề cũng dần dần lộ ra......
Trực tiếp nhất, chính là chỉ dẫn từ các vị trí khác nhau rất dễ đánh nhau lẫn nhau.
Đối mặt với những thông tin trùng lặp thậm chí mâu thuẫn này, Claude còn chưa bắt đầu làm việc, đã phải tốn sức phán đoán rốt cuộc nên nghe ai!!

Thế là, Anthropic đã đơn giản thực hiện một "cuộc đại phẫu" đối với prompt của Claude Code.
Một trong những thay đổi rất trực quan, chính là xảy ra ở quy tắc chú thích và tài liệu.
Một chuỗi dài quy định cũ như mặc định không viết chú thích, tuyệt đối không viết docstring nhiều đoạn, giờ đây đã được nén thành một câu —
Viết mã phù hợp với phong cách mã xung quanh, duy trì tính nhất quán với mật độ chú thích, cách đặt tên và cách viết quen thuộc của nó.
Dịch cho các bạn là: trước tiên hãy xem dự án này vốn viết như thế nào, sau đó kết hợp tình hình thực tế tự mình phán đoán thôi~
Tất nhiên, những thay đổi tương tự còn rất nhiều.
Kết quả là, Anthropic đã xóa bỏ hơn 80% nội dung system prompt trong các mô hình thế hệ mới như Opus 5, Fable 5......
Đáng nói là, theo đánh giá lập trình của Anthropic, lần cắt giảm quy mô lớn này không mang lại sự suy giảm hiệu suất có thể đo lường được, vì vậy mọi người cũng không cần quá lo lắng.
(Nhưng tôi vẫn muốn hỏi một câu... prompt đã cắt bỏ tám phần mười rồi, mô hình làm việc thực sự không hề tệ đi một chút nào sao???)

Đồng hành cùng cuộc đại giảm cân siêu cấp này, quy tắc context engineering của Claude Code cũng gần như được tu sửa lại từ đầu.
Đối với các nhà phát triển sử dụng Claude Code hoặc phát triển Agent dựa trên Claude, Anthropic cũng đưa ra một vài đề xuất điều chỉnh cụ thể hơn.
Tôi cũng giúp các bạn sơ lược tổng hợp lại một chút —
Tinh giản CLAUDE.md: Chỉ giữ lại quy tắc đặc biệt của dự án, những thông tin Claude có thể tự phát hiện từ mã có thể xóa bỏ.
Tách chỉ dẫn dài thành Skill: Lưu riêng các quy trình như review mã, kiểm thử và phát hành, khi cần thì tải lên.
Xóa bỏ chỉ dẫn trùng lặp: Một quy tắc chỉ viết một lần, nội dung đã viết trong phần mô tả công cụ thì không cần lặp lại trong system prompt và CLAUDE.md.
Giảm ví dụ gọi công cụ: Làm rõ ý nghĩa tham số, tùy chọn và kết quả trả về, giảm bớt ví dụ gọi cố định.
Cung cấp trực tiếp tài liệu tham khảo có thể thực thi: Nhà phát triển có thể giao test case, mã hiện có, nguyên mẫu HTML hoặc các tệp dự án khác cho Claude tham khảo, giảm bớt mô tả bằng văn bản dài.
Tổng kết lại, cách tiếp cận mới của Anthropic có thể khái quát thành một câu —
Gửi ít đi một cuốn sổ tay nhân viên chi tiết vụn vặt cho Claude, thiết kế rõ ràng hơn về công cụ, môi trường và ranh giới nhiệm vụ!!
Thật là một cuộc cắt giảm nhân sự prompt ầm ầm......
Cư dân mạng bắt gói: Opus 5 sao lại dài thêm 72%???
Nhìn đến đây, cuộc cắt giảm nhân sự prompt của Claude Code này dường như đã khá thành công rồi.
Nhưng có một nhà phát triển mạng nhìn vào con số "hơn 80%" mà Anthropic đưa ra, bỗng nhiên nảy ra một câu hỏi rất mộc mạc —
Thực sự đã xóa nhiều như vậy sao? (câu hỏi hay.jpg)
Thế là, cư dân mạng Trần Thành (@chenchengpro) đã trực tiếp trỏ Claude Code CLI đến máy chủ cục bộ, bắt ra tất cả system prompt mà các mô hình khác nhau thực sự nhận được.
Sau đó, một nhóm dữ liệu khá là kịch tính đã xuất hiện:
Opus 4.7: 15225 ký tự
Opus 4.8: 4467 ký tự
Opus 5: 7694 ký tự

Đúng vậy, từ Opus 4.7 nâng cấp lên Opus 4.8, system prompt của Claude Code quả thực đã gặp phải một "con dao lớn".
Nội dung prompt ban đầu 15225 ký tự, đã bị cắt giảm thẳng xuống còn 4467 ký tự, trực tiếp gầy đi một khúc lớn.
Thế nhưng đến Opus 5 mới nhất, tình tiết đột nhiên đảo ngược —
System prompt mà nó thực sự nhận được lại tăng từ 4467 ký tự lên 7694 ký tự, so với Opus 4.8 đã dài thêm khoảng 72%!!!
Vì vậy, việc Claude Code giảm cân prompt quả thực tồn tại, chỉ là cuộc cắt giảm quy mô lớn này chủ yếu xảy ra ở giai đoạn Opus 4.8.
Sau khi Opus 5 phát hành, Anthropic lại bổ sung thêm không ít nội dung vào bản prompt đã tinh giản......
Truy tìm tiếp! Đào sâu tiếp!
Tiếp tục lật xuống dưới theo cách triển khai của Claude Code, cư dân mạng tinh ý lại phát hiện một chi tiết then chốt —
Mỗi phiên bản thực ra đồng thời mang theo hai bộ Prompt, sau đó một hàm sẽ dựa vào model ID, quyết định cuối cùng gửi bộ nào đến model.
Các mô hình Sonnet, Haiku, Claude 3 và một phần Opus phiên bản cũ sẽ đi theo bộ Prompt cũ chi tiết hơn; các mô hình mới như Opus 5, Fable 5 thì sẽ sử dụng bộ Prompt mới đã được tinh giản mạnh mẽ.

Nói cách khác, Claude Code quả thực đã dỡ bỏ rất nhiều quy định cũ cho các mô hình mới.
Chỉ là đến Opus 5, model lại xuất hiện một số thói quen hành vi mới, Anthropic buộc phải bổ sung lại những ràng buộc mang tính đích danh hơn.
Nói như vậy thì, con số "xóa bỏ hơn 80%" của chính thức và con số "Opus 5 tăng 72%" do nhà phát triển đo được, thực ra cũng có thể đồng thời thành lập được.
Con số trước mô tả sự thay đổi tổng thể của Claude Code từ hệ thống prompt kiểu cũ chuyển sang hệ thống mới; con số sau so sánh Opus 5 với Opus 4.8 liền kề.
Dù đã dài trở lại một phần, 7694 ký tự của Opus 5 vẫn chỉ bằng khoảng một nửa so với Opus 4.7.
Thế thì vấn đề lại đến rồi:
Mấy nghìn ký tự thêm ra của Opus 5, rốt cuộc Anthropic đã viết cái gì vào trong đó?
Sau khi phân giải sâu hơn, cư dân mạng tinh ý phát hiện, chủ yếu tăng thêm hai phần nội dung độc quyền của Opus 5:
Delivering work: Quy định cách kiểm soát phạm vi nhiệm vụ, báo cáo tiến độ và giao nộp kết quả.
Corrections: Hạn chế model giải thích và sửa chữa lỗi lầm trước đó của mình một cách lặp đi lặp lại.
Hai phần cộng lại khoảng 3755 ký tự, về cơ bản bao phủ chênh lệch giữa Opus 5 và Opus 4.8~
Còn tại sao Opus 5 lại bổ sung trở lại những nội dung này, thực ra, chủ yếu liên quan đến việc model trở nên chủ động hơn —
Theo hướng dẫn prompt do Anthropic phát hành, Opus 5 thích báo cáo tiến độ hơn khi thực hiện nhiệm vụ, câu trả lời và tài liệu tạo ra thường dài hơn, cũng sẵn sàng gọi sub Agent, mở rộng phạm vi nhiệm vụ và xác minh kết quả lặp đi lặp lại.
Gặp phải nhiệm vụ dài hạn phức tạp, những thói quen này quả thực có thể phát huy tác dụng.
Nhưng nếu người dùng chỉ muốn sửa vài dòng mã, Opus 5 vẫn cứ kéo lên một đội sub Agent, lại thuận tay kiểm tra vài vòng, Token tiêu hao và thời gian chờ đợi cũng sẽ tăng theo......
Vì vậy, prompt mới lại bổ sung thêm yêu cầu mang tính đích danh hơn: khi nào thì thích hợp gọi sub Agent, tần suất báo cáo tiến độ cần bao nhiêu, nhiệm vụ làm đến phạm vi nào thì nên dừng, và cách kiểm soát độ dài đầu ra cuối cùng.
Đến đây, nhóm dữ liệu trông có vẻ mâu thuẫn ở phía trước cũng nói thông được rồi.
Những thứ Claude Code lần này xóa bỏ, phần lớn là các quy tắc thao tác tỉ mỉ còn sót lại cho các mô hình cũ, còn 72% dài trở lại của Opus 5, chủ yếu được dùng để ràng buộc hành vi chủ động của mô hình mới sau khi trở nên mạnh hơn.
Model càng có thể tự làm việc, con người càng ít chỗ cần dạy nó tận tay, nhưng sau khi model ngày càng có chủ kiến, việc gì có thể chủ động làm, làm đến bước nào nên dừng, vẫn phải vạch ra một đường giới hạn trước.
Nhìn như vậy thì, prompt của Claude Code quả thực đã gầy đi, chỉ là Opus 5 lại mọc thịt ở chỗ khác.
Quả nhiên, AI cũng không thoát khỏi quy luật này: tật xấu cũ giảm xuống rồi, tật xấu mới lại sẽ chính xác mọc ở chỗ khác. (doge)
Tài liệu tham khảo:
[1]https://x.com/chenchengpro/status/2081339012632215684
[2]https://claude.com/blog/the-new-rules-of-context-engineering-for-claude-5-generation-models
Bài viết này đến từ tài khoản công chúng WeChat "Quantum Bit", tác giả: Quan Tâm Tiền Duy Công Nghệ





