Trò lừa đảo khổng lồ, "Phòng thí nghiệm bí ẩn" lọt top toàn cầu chỉ sau một đêm, hóa ra lại là giả mạo
Ngày 18/7, một phòng thí nghiệm AI Trung Quốc bí ẩn tên "Basalt Labs" bất ngờ công bố mô hình Monolith-1.0, tuyên bố đạt top 1 thế giới với các chỉ số khủng: 1.6 nghìn tỷ tham số, điểm số 99.44% trên HLE, GPQA Diamond 95.9%, MMLU-Pro 96.2%, AIME 2025 trên 90%, và cửa sổ ngữ cảnh 1 triệu token. Thông tin này gây chấn động, nhưng chỉ vài giờ sau, sự thật được phơi bày: tất cả chỉ là một "thí nghiệm xã hội" được dàn dựng.
Mô hình 1.6T thực chất là bản sao chép trọng số của Qwen2.5-7B-Instruct, được "thổi phồng" lên 3TB. Demo trên web thực chất là gọi API của DeepSeek và bị ép phải tự xưng là Monolith-1.0. Các điểm benchmark cao ngất là kết quả của việc "học tủ" đáp án từ bộ dữ liệu công khai.
Người đứng sau, Max Scherf, trong một video đã thừa nhận toàn bộ chi tiết từ thông số, đội ngũ đến bài báo học thuật đều là giả mạo. Anh ta đã tạo một trang web chuyên nghiệp, viết một bài báo đầy thuật ngữ kỹ thuật, và tung tin lên mạng xã hội. Kết quả, tin tức lan truyền nhanh chóng, thu hút sự chú ý của nhiều chuyên gia trong ngành, với khoảng 150.000 lượt xem trước khi bị vạch trần.
Mục đích của Scherf là phơi bày những điểm yếu trong ngành AI: văn hóa chạy đua điểm số mù quáng, sùng bái tham số khổng lồ, và sự thiếu vắng kiểm chứng thực chất. Điều trớ trêu là, để mô phỏng một "mô hình số 1 thế giới", kẻ lừa đảo lại phải dựa vào nền tảng thực sự mạnh mẽ của AI Trung Quốc - Qwen và DeepSeek - để đánh lừa người dùng.
marsbit23 giờ trước