Anthropic Cúi Đầu Nhận Sai, Bằng Chứng Claude Âm Thầm Giảm Trí Tuệ

marsbitXuất bản vào 2026-08-24Cập nhật gần nhất vào 2026-08-24

Tóm tắt

Claude đột nhiên trở nên "ngu ngốc", cộng đồng phát hiện lỗi gây tranh cãi. Nhà phát triển argofowl phát hiện từ phiên bản Claude Code 2.1.237, tùy chọn mức độ suy luận "high" thực tế chỉ tương ứng giá trị 10/100, trùng khớp với mức "low" cũ. Sự cố này xuất phát từ một thử nghiệm A/B của Anthropic nhằm điều chỉnh thang đo giá trị "effort", nhưng không được thông báo trong nhật ký cập nhật, khiến nhiều nhà phát triển mất thời gian gỡ lỗi nhầm. Kỹ sư Claude Code Thariq Shihipar nhanh chóng thừa nhận sự cố, giải thích rằng con số 10 chỉ là cách ánh xạ giá trị mới và khẳng định nó không ảnh hưởng đến hiệu suất mô hình sau khi đánh giá kỹ lưỡng. Tuy nhiên, làn sóng chỉ trích mở rộng khi người dùng báo cáo mô hình Opus 5 cũng có biểu hiện suy giảm chất lượng rõ rệt: trả lời qua loa, mắc lỗi cơ bản và phản hồi máy móc. Thariq thừa nhận Opus 5 là một mô hình "không ổn định" và cho biết đội ngũ đang ưu tiên cao nhất để khắc phục. Sự việc làm lộ ra nghịch lý trong ngành AI: điểm số benchmark liên tục tăng nhưng trải nghiệm người dùng lại giảm sút. Việc cập nhật mô hình lớn thường thiếu minh bạch, với các thay đổi phía máy chủ như thử nghiệm A/B, định tuyến hay điều chỉnh tài nguyên mà không có thông báo rõ ràng, khiến người dùng chỉ có thể dựa vào cảm nhận chủ quan. Sự kiện này nhấn mạnh tầm quan trọng của tính ổn định và sự tin cậy khi mô hình AI trở thành hạ tầng then chốt.

Claude Một Đêm Biến Đần, Cả Mạng Tranh Cãi Điên Cuồng!

Ngay hôm qua, nhà phát triển argofowl đã bỏ ra cả buổi chiều, suýt chút nữa đã lật tung Claude Code từ trên xuống dưới.

Anh ta lần theo từng bước, đầu tiên nghi ngờ t3 code bị sập, sau đó lại nghĩ mã của mình có lỗi.

Kiểm tra đến cuối cùng, anh ta thậm chí bắt đầu nghi ngờ - lẽ nào mình đã làm hỏng Mac?

Khi argofowl cuối cùng mở nhật ký yêu cầu API thực sự ra, mọi sự thật đã sáng tỏ, trong đó hiện rõ một con số "10".

Tuy nhiên, trong backend Claude Code, anh ta rõ ràng đã chọn "high", mức độ suy luận cao nhất.

Ai ngờ được, nhật ký cập nhật của Claude Code, không viết một chữ nào.

Suy luận high biến thành 10

Claude Code Biến Đần Bị Phơi Bày

Argofowl phát hiện ra, từ Claude Code 2.1.237 trở đi, mô hình đã đọc mức độ suy luận "high" thành 10 trên 100.

Mà con số này, chính là giá trị tương ứng với mức "low" trong quá khứ.

Tìm hiểu kỹ phát hiện, Anthropic đã đưa các phiên Fable 5 của Claude Code phiên bản 2.1.236 trở lên vào một thí nghiệm "nén thang giá trị nỗ lực (effort)".

Tuy nhiên, phiên bản cũ và Opus 5 không bị ảnh hưởng.

Đây rất có thể là một thử nghiệm A/B, nên không phải ai cũng sẽ gặp phải.

Đối với các nhà phát triển, đây mới là điểm đau thực sự. Mô hình mạnh hơn yếu hơn một chút, còn có thể chịu được.

Nhưng bạn kéo tôi vào nhóm thí nghiệm, lại không định nói cho tôi biết: vậy cả buổi chiều này tôi đang debug cái gì? Đang điều chỉnh mã của mình, hay đang điều chỉnh thử nghiệm A/B của bạn?

Không ngờ, sau khi blogger công nghệ Chubby chuyển tiếp, giới AI trực tiếp nổ tung -

Có vẻ như, Anthropic đã lặng lẽ điều chỉnh mô hình trở nên đần hơn, nhưng không nói với bất kỳ ai.

Trong chốc lát, các bài đăng tự kiểm tra "Claude có đần hơn không?" tràn ngập trên X.

Có người đăng tải so sánh đầu ra của cùng một prompt ở các phiên bản khác nhau, có người lật lại hồ sơ phiên trò chuyện của mình từ hai tuần trước để thực hiện diff từng dòng.

Anthropic Nhận Sai, Kỹ Sư Xuống Xe

Đối mặt với cơn bão này, phản hồi của kỹ sư Claude Code Thariq Shihipar đến rất nhanh.

Đôi khi chúng tôi sẽ kiểm tra cấu hình dịch vụ API trong Claude Code trước, rồi mới quyết định có nên đẩy toàn bộ hay không.

Thí nghiệm đang chạy hiện nay, chỉ là thay đổi cách ánh xạ giá trị số của effort. Vì vậy một số người sẽ thấy Claude nói mình là "10".

Điểm mấu chốt là, thang đo này không phải từ 0 đến 100, con số đó tự nó không có ý nghĩa gì, mức effort bạn chọn chính là mức effort bạn nhận được.

Anh ấy nhấn mạnh, nhóm đã thực hiện đánh giá sâu để xác nhận, điều này không ảnh hưởng đến hiệu suất mô hình.

Opus 5 Giảm Trí Tuệ Lớn, Là Thật

Vừa giải quyết xong vấn đề của Fable, Chubby lại thẳng thắn nói, Opus 5 hiện tại cảm giác giống như một lần hạ cấp đáng kể.

Nó luôn làm việc qua loa, thường xuyên mắc lỗi sơ đẳng. Một khi bị chỉ ra là không thực hiện theo chỉ dẫn, nó chỉ cơ học trả lời câu đó -

Bạn nói đúng, là tôi sơ suất. Lật đi lật lại, không hết.

Thực ra, mấy ngày trước, đã có người phát hiện ra vấn đề rõ ràng "giảm trí tuệ" của Opus 5.

Ngoài vấn đề đề cập ở trên, nó còn tạo ra bug, rồi tiêu tốn nhiều thời gian sửa bug, tự sửa sai lặp đi lặp lại trong cùng một nhiệm vụ.......

Sau khi bị người dùng mạng truy vấn một vòng, kỹ sư Thariq công khai thừa nhận - Opus 5 là một mô hình "thể hiện rất không ổn định", lúc cao lúc thấp, không ổn định.

Nội bộ nhóm đang nỗ lực giải quyết vấn đề này, đây là ưu tiên cao nhất đối với chúng tôi.

Điểm Chạy Luôn Đi Lên

Cảm Nhận Thực Tế Đi Xuống

Cơn sóng gió Opus 5 này, xé toạc ra thực ra là một khe hở khó xử nhất của toàn ngành:

Điểm benchmark (chạy) và cảm nhận thực tế, đang có sự tách rời một cách có hệ thống.

Một bên là bảng thành tích sáng chói đến mức gần như không thể chê: tổng điểm 82.72, SWE-bench Pro 79.2%, Terminal-Bench 86.7%.

Một bên khác, lại là cảm nhận thực tế hoàn toàn trái ngược của người dùng: "dài dòng", "lười biếng", "thích cãi lại".

Nơi hoang đường nhất chính là, hai loại đánh giá này đồng thời xuất hiện trên Opus 5.

Hơn nữa, "mô hình trở nên đần hơn" cũng không phải là vấn đề riêng của Anthropic.

Ngày nay, việc cập nhật phiên bản mô hình lớn, đang trở thành chiếc hộp đen kém minh bạch nhất của toàn bộ ngành công nghiệp AI.

Phần mềm truyền thống có số phiên bản ngữ nghĩa, có nhật ký cập nhật, cũng có cơ chế rollback. Nhà phát triển có thể biết rõ ràng mình đang sử dụng phiên bản nào, đã xảy ra những thay đổi gì.

Mô hình lớn, thì khác.

Dưới cùng một tên mô hình, phía server có thể bất cứ lúc nào tiến hành thử nghiệm A/B, thay đổi phương án lượng tử hóa, điều chỉnh định tuyến mô hình, thậm chí thay đổi tài nguyên suy luận.

Bảng điều khiển duy nhất mọi người có trong tay, chỉ còn lại cảm nhận thực tế của chính mình.

Đáng tiếc thay, trực giác lại là thứ dễ bị bác bỏ nhất, cũng khó chứng minh là sai nhất.

Giá trị lớn nhất của cơn sóng gió này, là đưa vết thương ngầm tồn tại lâu dài của ngành lên sân khấu một cách triệt để:

Khi mô hình trở thành cơ sở hạ tầng, sự ổn định chính là một khế ước tin tưởng. Điểm benchmark có thể dùng để marketing, sự ổn định chỉ có thể dựa vào việc thực hiện từng lần từng lần.

Tài liệu tham khảo:

https://x.com/trq212/status/2091252347913773169?s=20

https://x.com/kimmonismus/status/2091178321669198014

Bài viết này đến từ tài khoản công chúng WeChat "Tân Trí Nguyên" (新智元), tác giả: ASI Khải Thị Lục, biên tập: Đào Tử

Câu hỏi Liên quan

QĐiều gì đã khiến nhà phát triển argofowl phát hiện ra Claude Code bị 'giảm trí'?

AKhi kiểm tra nhật ký yêu cầu API thực tế, argofowl phát hiện ra một con số '10' được gửi đi, mặc dù trong giao diện Claude Code, anh ấy đã chọn mức suy luận 'high' (cao nhất). Điều này cho thấy một lỗi ánh xạ trong phiên bản Claude Code 2.1.237, nơi mức 'high' bị hiểu nhầm thành giá trị 10/100, vốn là giá trị tương ứng với mức 'low' trước đây.

QPhản ứng của kỹ sư Anthropic Thariq Shihipar về sự cố 'nén thang số nỗ lực' trong Claude Code là gì?

AThariq Shihipar thừa nhận rằng đây là một thử nghiệm A/B nhằm thay đổi cách ánh xạ giá trị số cho thang đo 'effort' (nỗ lực). Ông nhấn mạnh rằng con số '10' đơn thuần chỉ là một cách ánh xạ mới và không có ý nghĩa khi đứng một mình, đồng thời khẳng định rằng mức độ nỗ lực người dùng chọn ('high') vẫn là mức họ nhận được. Ông cũng cho biết nhóm đã thực hiện đánh giá chuyên sâu để xác nhận thay đổi này không ảnh hưởng đến hiệu suất mô hình.

QVấn đề chính mà người dùng phàn nàn về mô hình Opus 5 là gì?

ANgười dùng báo cáo rằng Opus 5 có biểu hiện 'giảm trí' đáng kể, bao gồm: đưa ra câu trả lời hời hợt, mắc những lỗi cơ bản, tạo ra lỗi (bug) rồi dành nhiều thời gian sửa chữa chúng, và lặp đi lặp lại việc tự sửa chữa trong cùng một tác vụ. Đặc biệt, khi bị chỉ ra rằng nó không tuân theo hướng dẫn, mô hình thường chỉ lặp lại một cách máy móc câu nói như 'Bạn nói đúng, tôi đã sơ suất'.

QKỹ sư Thariq Shihipar đã thừa nhận điều gì về hiệu suất của Opus 5?

AThariq Shihipar công khai thừa nhận rằng Opus 5 là một mô hình 'có hiệu suất rất không ổn định', dao động lên xuống thất thường. Ông cho biết nhóm nội bộ đang nỗ lực giải quyết vấn đề này và coi đây là ưu tiên hàng đầu.

QBài viết chỉ ra nghịch lý gì trong ngành công nghiệp AI liên quan đến đánh giá mô hình?

ABài viết chỉ ra một nghịch lý lớn: điểm số benchmark (đo lường khách quan) và trải nghiệm thực tế của người dùng đang có sự tách biệt rõ rệt. Một bên là bảng điểm benchmark sáng chói (như điểm tổng hợp 82.72, SWE-bench Pro 79.2%), trong khi bên kia là cảm nhận thực tế của người dùng về việc mô hình 'dài dòng', 'lười biếng' và 'thích tranh cãi'. Sự cập nhật mô hình lớn đang trở thành một 'hộp đen' không minh bạch, thiếu nhật ký cập nhật rõ ràng và cơ chế khôi phục, khiến người dùng chỉ có thể dựa vào cảm nhận chủ quan của mình.

Nội dung Liên quan

Vừa rồi, Sam Altman chỉ trích Dario Amodei là 'phản nhân loại', cùng ngày công bố mô hình tuyệt mật

Vừa mới đây, OpenAI bất ngờ làm rò rỉ thông tin về mô hình tiếp theo có tên mã “gpt-nathree”, được cho là một phiên bản trong quá trình phát triển của GPT-6 Astra, hướng tới khả năng xử lý nhiều tác tử (multi-agent) và các nhiệm vụ khoa học phức tạp. Cùng lúc, Anthropic cũng bị tiết lộ hai tên mã mới là “claude-marshmallow-eap” và “claude-melon-eap”. Trong một cuộc phỏng vấn trên podcast “Founders”, CEO Sam Altman của OpenAI đã chia sẻ nhiều quan điểm sâu sắc. Ông thừa nhận đã sai lầm khi dự đoán về tốc độ AI sẽ làm đảo lộn các ngành công nghiệp, và nhấn mạnh rằng xã hội loài người có quán tính lớn, điều này thực ra lại giúp quá trình chuyển đổi trở nên an toàn hơn. Altman cũng chỉ trích mạnh mẽ những chiến thuật tiếp thị gây sợ hãi trong ngành AI. Ông phê phán lối nói “vừa đe dọa hủy diệt vừa hứa hẹn cứu rỗi” là ngôn ngữ của những kẻ độc tài, và nhấn mạnh rủi ro lớn nhất không chỉ đến từ công nghệ mà còn từ sự tập trung quyền lực AI vào tay một số ít. Theo Altman, con người mới là trung tâm của mọi thứ. Ông cũng kể lại hành trình 4,5 năm đầu của OpenAI, một giai đoạn làm việc trong “bóng tối” mà không có phản hồi từ khách hàng, đi ngược lại mọi nguyên tắc khởi nghiệp thông thường, cho đến khi họ tìm ra quy luật Scaling Law và tạo nên thành công của GPT. Kết thúc, Altman khẳng định dù AI có tiến bộ đến đâu, con người vẫn sẽ luôn khao khát sự kết nối chân thật với đồng loại, và đó là thứ sẽ ngày càng trở nên quý giá.

marsbit35 phút trước

Vừa rồi, Sam Altman chỉ trích Dario Amodei là 'phản nhân loại', cùng ngày công bố mô hình tuyệt mật

marsbit35 phút trước

Robinhood Chain lại sôi động, $PONS trở thành token thu nhập cao giá rẻ nhất

Tác giả: Claude, Deep Tide TechFlow Trong 30 ngày qua, $PONS, token của nền tảng phát hành token Pons trên Robinhood Chain, xếp hạng 13 về doanh thu nhưng có hệ số FDV/doanh thu thấp nhất (0.7x) trong top 15 token có doanh thu hàng đầu. Con số này tương phản mạnh với các đối thủ như token liên quan đến Pump.fun (~7.7x) hay Aave (~45x), cho thấy định giá thị trường cực kỳ thận trọng với $PONS. Pons, thường được so sánh như "pump.fun" của Robinhood Chain, cho phép tạo token nhanh. Giao thức này sử dụng khoảng 80% doanh thu để mua lại và đốt $PONS, đã giảm gần 30% tổng cung. Cơ chế này là cốt lõi của câu chuyện "định giá thấp". Tuy nhiên, thị trường tỏ ra nghi ngờ về chất lượng và tính bền vững của doanh thu, với những lo ngại về khối lượng giao dịch không thực sự. Định giá thấp phản ánh sự hoài nghi rằng các yếu tố tích cực như đốt token chưa tạo ra lợi thế cạnh tranh bền vững. Tương lai của $PONS phụ thuộc vào việc doanh thu có được xác minh là thực chất và liệu hoạt động đốt có tiếp tục tăng tốc hay không, từ đó mới có thể thu hẹp khoảng cách định giá với các dự án cùng ngành.

marsbit45 phút trước

Robinhood Chain lại sôi động, $PONS trở thành token thu nhập cao giá rẻ nhất

marsbit45 phút trước

"Cây gậy cứu hộ trái phiếu Mỹ": Besant thất bại tuần trước, tuần này nhìn vào Walsh

"Gánh nặng cứu trợ trái phiếu Mỹ" đã chuyển từ Bộ trưởng Tài chính Beisente sang Chủ tịch Fed Wash. Tuần trước, động thái tăng gấp đôi quy mô mua lại trái phiếu dài hạn của Beisente chỉ có tác dụng ngắn ngủi, không thể kéo giảm lợi suất dài hạn, trong khi vàng và Bitcoin lại tăng mạnh. Thị trường cho rằng đây chỉ là "van xả áp lực". Mọi sự chú ý giờ đổ dồn vào bài phát biểu của Chủ tịch Fed Wash tại hội thảo Jackson Hole vào thứ Sáu tuần này. Giới phân tích nhấn mạnh, chỉ có Fed mới có khả năng neo đỡ kỳ vọng lạm phát. Wash cần tái khẳng định mục tiêu 2% và đưa ra định hướng chính sách rõ ràng để trấn an thị trường. Nếu không, làn sóng bán tháo trái phiếu dài hạn có thể trầm trọng hơn. Bài viết cũng phân tích những hạn chế trong hoạt động mua lại của Bộ Tài chính: quy mô nhỏ so với thị trường khổng lồ, không phải là nới lỏng định lượng (QE) thực sự mà chỉ là sắp xếp lại cơ cấu nợ. Một công cụ tiềm năng được thảo luận là "Chiến dịch Vặn xoắn" của Fed - bán trái phiếu ngắn hạn để mua trái phiếu dài hạn, nhằm gây áp lực giảm lợi suất dài hạn mà không mở rộng bảng cân đối kế toán. Trước thềm bài phát biểu, dữ liệu chỉ số chi tiêu tiêu dùng cá nhân (PCE) tháng 7 vào thứ Tư sẽ là manh mối quan trọng. Áp lực thời gian đang dồn nén khi lợi suất trái phiếu kho bạc kỳ hạn 30 năm tiến gần mốc 5% - được xem là ranh giới then chốt. Nếu không phá vỡ được ngưỡng này, áp lực lên đồng USD và các lĩnh vực đòn bẩy cao có thể gia tăng, trong bối cảnh nhu cầu của nhà đầu tư nước ngoài ngày càng nhạy cảm với giá và trái phiếu doanh nghiệp AI cạnh tranh vốn với trái phiếu chính phủ.

marsbit1 giờ trước

"Cây gậy cứu hộ trái phiếu Mỹ": Besant thất bại tuần trước, tuần này nhìn vào Walsh

marsbit1 giờ trước

Hành Trình Tuân Thủ Quy Định của Hyperliquid: Từ Mô Hình Không Cần Phép đến Cơ Chế Có Phép HIP-3

Hyperliquid, một nền tảng giao dịch phái sinh phi tập trung, hiện đang chặn truy cập từ thị trường Mỹ do mâu thuẫn giữa cơ sở hạ tầng blockchain không cần cấp phép của nó với các quy định pháp lý về cấu trúc thị trường Mỹ. Để giải quyết vấn đề này, Hyperliquid Policy Center (HPC) đang vận động CFTC và SEC hiện đại hóa khung pháp lý, đề xuất cho phép các tổ chức được cấp phép xây dựng sản phẩm trên HyperCore (lớp giao dịch và thanh toán cốt lõi) trong khi vẫn tuân thủ các nghĩa vụ quy định. Bài viết giải thích kiến trúc mô-đun của Hyperliquid, tách biệt vai trò của sàn giao dịch (DCM), tổ chức thanh toán bù trừ (DCO) và công ty môi giới (FCM) giống như truyền thống, nhưng được tái tạo và thực thi bằng mã trên chuỗi. Các xung đột chính với quy định Mỹ bao gồm yêu cầu về giám sát thị trường, tính toán ký quỹ và ký quỹ tách biệt mà cơ sở hạ tầng phi tập trung, tự giám sát của Hyperliquid không đáp ứng. Hướng tiếp cận của HPC không phải là mở hoàn toàn mà là định vị Hyperliquid như một cơ sở hạ tầng trung lập. Các thực thể được cấp phép (như nhà triển khai HIP-3 có kiểm soát truy cập) có thể sử dụng nó để cung cấp dịch vụ cho người dùng đã qua KYC. Các bản cập nhật trên testnet cho thấy khả năng tạo các thị trường chỉ dành cho người dùng trong danh sách trắng, cho phép thanh khoản liền mạch giữa các sổ lệnh trong khi vẫn duy trì sự tuân thủ. Tóm lại, Hyperliquid đang theo đuổi con đường "onshoring" thông qua một phiên bản có kiểm soát truy cập (HIP-3), cho phép các nhà môi giới và tổ chức Mỹ xây dựng sản phẩm tuân thủ trên HyperCore, trong khi giao thức cốt lõi vẫn giữ nguyên tính chất không cần cấp phép và trung lập.

marsbit1 giờ trước

Hành Trình Tuân Thủ Quy Định của Hyperliquid: Từ Mô Hình Không Cần Phép đến Cơ Chế Có Phép HIP-3

marsbit1 giờ trước

Trong ba tháng, hai vòng tài trợ, 'Palantir phiên bản Trung Quốc' gây bão

Công ty Trí tuệ Nhân tạo Phân tích Nhân quả Công nghiệp Trung Quốc Zhongshu Ruizhi (Zhongshu Ruizhi) gần đây đã hoàn thành một vòng gọi vốn chiến lược trị giá hài tỷ nhân dân tệ, với sự tham gia của Quỹ Đầu tư Internet Trung Quốc, Quỹ An sinh Xã hội Quốc gia Tô Châu, cùng các nhà đầu tư khác. Đây là vòng gọi vốn lớn thứ hai trong vòng ba tháng, cho thấy sự công nhận mạnh mẽ của thị trường vốn. Công ty, được mệnh danh là "Palantir phiên bản Trung Quốc", được thành lập bởi Tiến sĩ Hán Hàm, một nữ tiến sĩ từ Đại học Thanh Hoa. Công ty tập trung vào lĩnh vực AI công nghiệp có độ tin cậy cao và khả năng ra quyết định mạnh mẽ, với sứ mệnh đưa AI từ thế giới số sang thế giới vật lý. Công nghệ cốt lõi của Zhongshu Ruizhi dựa trên ba nền tảng sáng tạo: Lý thuyết nhận thức nguyên nhân-kết quả (meta-causal), mô hình nhân quả và động cơ bản thể động (dynamic ontology engine). Các công nghệ này nhằm giải quyết các điểm yếu của mô hình ngôn ngữ lớm (LLM) như "ảo giác AI", khả năng suy luận hạn chế và thiếu logic thời gian, cung cấp khả năng ra quyết định thông minh đáng tin cậy, có thể giải thích và thực thi được trong các ngành công nghiệp then chốt như năng lượng và sản xuất. Về mặt thương mại, Zhongshu Ruizhi đã phục vụ hơn 50 khách hàng là doanh nghiệp nhà nước trung ương và tập đoàn công nghiệp trong các lĩnh vực như điện lực, dầu khí và hàng không vũ trụ, triển khai hơn 800 kịch bản sản xuất phức tạp. Công ty đã đạt được tăng trưởng doanh thu gấp đôi vào năm 2025, thể hiện khả năng tạo ra dòng tiền mạnh mẽ. Số tiền gọi vốn lần này sẽ được sử dụng để tiếp tục đổi mới lý thuyết nền tảng, mở rộng thị trường và thu hút nhân tài cao cấp. Các nhà đầu tư như Quỹ Đầu tư Internet Trung Quốc tin rằng trí tuệ nhân quả cấp ngành là một phần quan trọng trong việc xây dựng nền tảng số hóa cho sự hiện đại hóa của Trung Quốc và thúc đẩy lực lượng sản xuất mới.

marsbit1 giờ trước

Trong ba tháng, hai vòng tài trợ, 'Palantir phiên bản Trung Quốc' gây bão

marsbit1 giờ trước

Giao dịch

Giao ngay
活动图片