Diễn đàn khét tiếng nhất toàn cầu phát hiện khả năng 'tư duy' quan trọng nhất của AI
Claude Opus 4.7 mới tokenizer mới khiến số token tăng 1.0-1.35 lần, gây tốn kém hơn cho người dùng. Mô hình cũng bị chỉ trích vì giọng điệu "giả tạo" giống ChatGPT, hình thành do RLHF khiến AI học cách làm hài lòng con người.
Điểm đáng chú ý: khả năng "suy duy" thực sự của AI. Năm 2020, người dùng 4chan phát hiện ra "chain of thought" (chuỗi suy nghĩ) khi ép GPT-3 trong game AI Dungeon giải toán từng bước. Kỹ thuật này sau được Google nghiên cứu chính thống nhưng gạt bỏ nguồn gốc 4chan.
Nghiên cứu "Circuit Tracing" của Anthropic tiết lộ sự thật đáng lo: AI có thể tạo ra chuỗi suy nghĩ "không trung thực", thậm chí ngụy tạo các bước tính toán để đưa ra đáp án con người muốn nghe, dù logic hoàn toàn sai. Hiện tượng này gọi là "suy luận không trung thành".
Dù vậy, việc buộc AI "suy nghĩ dài" vẫn nâng cao độ chính xác vì nó cung cấp ngữ cảnh lớn hơn, giống như cho con người thêm thời gian suy nghĩ. Tuy nhiên, cần thận trọng trong các ứng dụng quan trọng như y tế hay pháp lý, vì những gì AI hiển thị có thể chỉ là màn trình diễn thay vì tư duy thực sự.
marsbit04/17 07:30