Vừa ra mắt, tác phẩm kinh điển của DeepMind lại lên ngôi, giải thưởng ICML 2026 công bố
Hội nghị ICML 2026 đã công bố các giải thưởng danh giá. Hai bài báo về mô hình khuếch tán (diffusion model) đã cùng đoạt giải Bài báo Xuất sắc, cho thấy sự tập trung nghiên cứu mạnh mẽ vào hướng này. Một bài chỉ ra "cái bẫy linh hoạt" trong mô hình ngôn ngữ khuếch tán, chất vấn lợi ích thực tế của việc sinh văn bản theo thứ tự bất kỳ. Bài còn lại đề xuất phương pháp lấy mẫu độ chính xác cao, thúc đẩy nền tảng kỹ thuật.
Giải Bài báo Lập trường Xuất sắc thuộc về một nghiên cứu chỉ trích sắc bén: cộng đồng nghiên cứu an toàn AI đang vô tình xây dựng "bộ công cụ kiểm duyệt". Công trình này cảnh báo về việc các kỹ thuật điều chỉnh AI (như RLHF) có thể bị lạm dụng cho mục đích kiểm soát nội dung.
Năm bài báo nhận được đề cử danh dự bao phủ nhiều chủ đề nóng: xác định vị trí tính trung thực nảy sinh trong mô hình, quy kết chuyển động trong tạo video, giới hạn ghi nhớ của mô hình ngôn ngữ lớn, tính nhất quán của mô hình khuếch tán dưới góc độ lý thuyết ma trận ngẫu nhiên, và hiện tượng "thấu hiểu đột ngột" (grokking) được chứng minh chặt chẽ trong hồi quy ridge.
Giải Thử thách Thời gian được trao cho công trình kinh điển "Phương pháp không đồng bộ cho Học tăng cường Sâu" của DeepMind (2016), ghi nhận ảnh hưởng lâu dài của thuật toán A3C.
Danh sách giải thưởng ICML 2026 phản ánh xu hướng chuyển từ mở rộng nhanh sang đào sâu nghiên cứu, nhấn mạnh vào việc xem xét lại các giả định cốt lõi và xây dựng nền tảng vững chắc hơn cho các lĩnh vực trọng tâm như mô hình khuếch tán và an toàn AI.
marsbit07/06 02:40