Karpathy mới nhất lên tiếng chỉ trích: Một câu nói khiến cả hội trường các nhà phát triển Agent im bặt
Andrej Karpathy, nhà nghiên cứu cốt cán tại Anthropic, đã gây sốc trong cộng đồng phát triển AI Agent bằng một tuyên bố thẳng thắn: Sai lầm lớn nhất hiện nay là mọi người vội vàng bắt Agent làm việc mà chưa thực sự hiểu rõ các mô hình nền tảng cơ bản.
Ông rút ra bài học từ dự án "World of Bits" thất bại năm 2016 tại OpenAI, nơi họ cố gắng tạo Agent điều khiển máy tính. Công cụ khi đó là học tăng cường quá yếu, và ông cho rằng lựa chọn đúng đắn lúc bấy giờ phải là tập trung vào mô hình ngôn ngữ.
Karpathy đưa ra ba lời khuyên ngược với xu hướng:
1. Dừng việc ép Agent làm mọi thứ, hãy ưu tiên xây dựng mô hình nền tảng đúng đắn trước. Việc ông gia nhập nhóm tiền huấn luyện tại Anthropic chính là một phiếu bầu cho quan điểm này.
2. Tạo Demo thì dễ, nhưng để biến thành sản phẩm thực sự có thể mất cả thập kỷ, giống như hành trình của xe tự lái hay VR.
3. Agent không phải là sản phẩm; năng lực nền tảng mới là sản phẩm. Xây dựng nền móng vững chắc, và Agent sẽ tự nhiên xuất hiện.
Ông cũng gợi ý nên tìm cảm hứng từ khoa học thần kinh, ví dụ như cấu trúc não bộ (hồi hải mã, hạch nền, đồi thị), để hiểu sâu hơn về bản chất của trí tuệ.
Điểm đáng chú ý nhất, Karpathy khẳng định rằng tuyến đầu của khả năng Agent không nằm ở các gã khổng lồ như OpenAI hay DeepMind, mà chính là ở các nhà phát triển độc lập và startup. Lý do là trong lĩnh vực Agent, không công ty lớn nào có lợi thế dẫn trước hàng năm trời; mọi người đều ở cùng vạch xuất phát, nơi sự linh hoạt và tốc độ thử nghiệm là lợi thế cạnh tranh.
Thông điệp cuối cùng của Karpathy không phải là ngăn cản việc phát triển Agent, mà là cảnh báo không được bỏ qua nền tảng. Ông kêu gọi sự kiên nhẫn đầu tư vào nghiên cứu cơ bản và sẵn sàng cho một cuộc chạy đua dài hạn.
marsbit07/06 02:35