DeepSeek V4 chính thức ra mắt, năng lực mới hé lộ, chiến tranh vương giả về giá trị
Ngày 31/7, DeepSeek đã chính thức ra mắt phiên bản API công khai của DeepSeek-V4-Flash. Phiên bản này cho thấy một tín hiệu đáng chú ý: hiệu suất của Flash trong nhiều bài kiểm tra tiêu chuẩn về Agent đã tiếp cận hoặc thậm chí vượt qua mức của V4-Pro bản xem trước từ ba tháng trước, dù chỉ có 130 tỷ tham số kích hoạt so với 490 tỷ của Pro.
Bản cập nhật nhấn mạnh rằng V4-Flash vẫn giữ nguyên kiến trúc và quy mô mô hình, chỉ được tối ưu hóa thông qua quá trình "hậu huấn luyện". Điều này cho thấy phương pháp và chất lượng dữ liệu huấn luyện có thể đang đóng vai trò quan trọng hơn việc chỉ thuần túy mở rộng quy mô tham số.
DeepSeek cũng đã giới thiệu khung tự phát triển DeepSeek Harness để tối ưu hóa hiệu suất Agent. Chiến lược rõ ràng là sử dụng mô hình nhẹ nhưng hiệu quả cao để thâm nhập thị trường ứng dụng Agent đang bùng nổ, nơi tốc độ suy luận và chi phí là yếu tố then chốt. Việc hỗ trợ native format API Responses và tối ưu cho Codex cho tham vọng xây dựng hệ sinh thái cạnh tranh, đặc biệt trong lĩnh vực phát triển phần mềm.
Động thái này diễn ra sau khi DeepSeek huy động thành công hơn 50 tỷ USD (khoảng 500 tỷ NDT) trong vòng gọi vốn đầu tiên, đưa định giá công ty lên khoảng 52 tỷ USD, và đang có kế hoạch gọi vốn mới với định giá khoảng 71 tỷ USD. Việc nâng cấp Flash được xem như một bước chứng minh năng lực công nghệ dưới sự hỗ trợ của vốn, đồng thời đặt ra câu hỏi về sự thay đổi trong logic cạnh tranh của các mô hình lớn khi lợi thế từ hậu huấn luyện ngày càng rõ rệt.
marsbit07/31 08:03