Bất ngờ! Anthropic kêu gọi toàn ngành ngừng nghiên cứu AI
Bài viết thảo luận về lời kêu gọi tạm dừng nghiên cứu AI từ Anthropic, dựa trên quan sát về khả năng "tự tiến hóa" (recursive self-improvement - RSI) của AI, cụ thể là mô hình Claude.
Dữ liệu nội bộ cho thấy Claude đang đẩy nhanh tiến trình phát triển AI: hơn 80% codebase của Anthropic hiện do Claude viết, so với chỉ số ít trước khi Claude Code ra mắt. Năng suất của kỹ sư tăng gấp 8 lần. Quan trọng hơn, chất lượng code của Claude được đánh giá ngang bằng con người và dự kiến vượt trội trong năm nay. Tỷ lệ thành công của Claude trong các nhiệm vụ lập trình phức tạp nhất đã tăng từ 26% lên 76% chỉ trong nửa năm.
Anthropic giới thiệu chỉ số "thời gian nhiệm vụ AI có thể hoàn thành độc lập", cho thấy tốc độ tăng trưởng theo cấp số nhân, từ 4 phút (3/2024) lên 16 giờ (hiện tại), với chu kỳ tăng gấp đôi rút ngắn từ 7 tháng xuống 4 tháng.
Claude không chỉ viết code mà còn tự động review code, ngăn chặn được khoảng 1/3 lỗi nghiêm trọng. Trong nghiên cứu, Claude đã tối ưu hóa code chạy nhanh hơn 52 lần và tự thiết kế/thực hiện thí nghiệm AI safety, đạt kết quả vượt xa nỗ lực của con người.
Bài viết đặt câu hỏi về tương lai khi vai trò con người trong phát triển AI đang thu hẹp lại, chỉ còn lại ưu thế về "khiếu nghiên cứu". Anthropic nêu ba kịch bản có thể xảy ra: (1) Tiến bộ chững lại, (2) AI tiếp tục tăng tốc nhưng con người vẫn kiểm soát, (3) AI đạt đến RSI hoàn toàn, tự thiết kế thế hệ kế tiếp, mang lại lợi ích to lớn hoặc rủi ro mất kiểm soát nếu vấn đề "alignment" thất bại.
Do những rủi ro tiềm ẩn này, Anthropic đề xuất một cơ chế có thể xác minh để các phòng lab AI cùng giảm tốc hoặc tạm dừng, nếu đảm bảo không có bên nào "lén lút" phát triển. Lời kêu gọi này trở nên đáng chú ý hơn khi OpenAI cũng gần đây chia sẻ quan sát tương tự về dấu hiệu tự tiến hóa sớm của AI.
marsbit06/05 00:29