# Bài viết Liên quan Thả tự do

Trung tâm Tin tức HTX cung cấp những bài viết mới nhất và phân tích chuyên sâu về "Thả tự do", bao gồm xu hướng thị trường, cập nhật dự án, phát triển công nghệ và chính sách quản lý trong ngành tiền kỹ thuật số.

Phiên bản ‘đầy đủ máu’ DeepSeek V4 đã lộ diện, có thể ra mắt sớm nhất vào ngày mai

DeepSeek V4 phiên bản đầy đủ (“Full Blood”) đã lộ diện và có thể được ra mắt sớm nhất vào ngày mai. Bài viết cho biết sau gần ba tháng chờ đợi, phiên bản chính thức của DeepSeek V4 (GA) sắp được phát hành, với hai biến thể: V4 Flash và V4 Pro. Hiện một số người dùng đã có quyền truy cập thử nghiệm. Một mẹo kiểm tra là xem lập luận (CoT) của mô hình bắt đầu bằng “I’m” thay vì “Let me” như phiên bản cũ. Theo đánh giá ban đầu từ các nhà phát triển, hiệu năng tổng thể của V4 tiếp cận mức Claude Opus 4.8, khả năng lập trình ngang ngửa GPT-5.6 Sol, và kỹ năng Agent, tạo 3D/SVG được cải thiện rõ rệt. Tuy nhiên, nó vẫn có thể không vượt mặt Kimi K3 mới ra mắt. Điểm đáng chú ý là chiến lược định giá. DeepSeek lần đầu giới thiệu cơ chế tính phí theo giờ cao điểm/thấp điểm. Cụ thể, V4 Pro có giá 0.87 USD cho triệu token xuất (cao điểm: 1.74 USD), còn V4 Flash chỉ 0.28 USD (cao điểm: 0.56 USD). Dù có tăng giá so với trước, mức giá này vẫn cạnh tranh mạnh so với các đối thủ như Fable 5 (50 USD/triệu token xuất). Như vậy, DeepSeek V4 có thể không phải là mô hình mạnh nhất mọi mặt, nhưng tiếp tục duy trì chiến lược “kẻ hủy diệt giá” bằng cách cung cấp hiệu năng cao với mức giá thấp đáng kể, tạo ra một cú hích lớn trong cộng đồng AI.

marsbit07/19 05:33

Phiên bản ‘đầy đủ máu’ DeepSeek V4 đã lộ diện, có thể ra mắt sớm nhất vào ngày mai

marsbit07/19 05:33

Kết Quả Nội Bộ Đầu Tiên Của GPT-5.6 Sol Đã Về, Chi Phí Cho Cùng Nhiệm Vụ Chỉ Bằng Một Nửa Fable 5

Kết quả thử nghiệm nội bộ đầu tiên của GPT-5.6 Sol (phiên bản xem trước) đã được công bố. Theo chia sẻ từ một kỹ sư trưởng tại NVIDIA, Sol đạt được hiệu quả tăng tốc CUDA chỉ trong 30 giờ, trong khi Opus cần tới 64 giờ. Dự kiến, các bản tối ưu sau có thể sẽ vượt trội hoàn toàn so với Opus. Người dùng nội bộ đánh giá cao khả năng viết mã ngắn gọn, súc tích của Sol, với số dòng code ước tính chỉ bằng 1/5 so với Opus, đặc biệt trong C++. Mô hình tập trung vào tối ưu hiệu suất cốt lõi cho các nhiệm vụ suy luận phức tạp, chuỗi dài, thay vì thử nghiệm lan man. So sánh với GPT-5.5 Pro, Sol thể hiện tốt hơn trong việc tuân thủ chỉ dẫn, suy luận không gian và tạo ra giao diện front-end sạch sẽ, bố cục cân đối. Khi so sánh với đối thủ Fable 5, Sol được nhận định có khả năng tổng thể và chất lượng code vẫn còn khoảng cách nhỏ. Tuy nhiên, ưu thế lớn của Sol nằm ở chi phí: chỉ 5 USD/triệu token đầu vào và 30 USD/triệu token đầu ra, rẻ hơn khoảng một nửa so với Fable 5 (10 USD và 50 USD). Ngoài ra, các hạn chế an toàn (safety limits) trên Sol được cho là linh hoạt hơn so với Fable 5, vốn bị người dùng phàn nàn là quá nghiêm ngặt. GPT-5.6 Sol dự kiến sẽ chính thức mở cửa cho tất cả người dùng trong vài ngày tới, thay vì chỉ giới hạn cho một số đối tác như trước.

marsbit07/06 07:31

Kết Quả Nội Bộ Đầu Tiên Của GPT-5.6 Sol Đã Về, Chi Phí Cho Cùng Nhiệm Vụ Chỉ Bằng Một Nửa Fable 5

marsbit07/06 07:31

Tin Nóng, Claude 5 Phiên Bản 'Kẻ Làm Thuê' Đã Xuất Hiện, Ai Cũng Có Thể Dùng

Ngay lập tức, Claude Sonnet 5 (biệt danh Fennec) đã chính thức ra mắt, trở thành mô hình mặc định mới cho tất cả người dùng miễn phí và Pro. Được Anthropic mô tả là phiên bản Sonnet mạnh mẽ nhất về khả năng Agent từ trước đến nay, Sonnet 5 có hiệu suất tiệm cận với flagship Opus 4.8. Mô hình này có thể lập kế hoạch tự động, sử dụng công cụ trình duyệt và terminal. So với Sonnet 4.6, nó cho thấy sự cải thiện vượt trội về lập luận, sử dụng công cụ, lập trình và các nhiệm vụ tri thức. **Điểm nổi bật về hiệu suất:** - SWE-bench Pro: 63.2%, vượt GPT-5.5 (58.6%) và gần bằng Opus 4.8 (69.2%). - Humanity's Last Exam: 57.4%, chỉ kém Opus 4.8 0.5 điểm. - Terminal-Bench 2.1: 80.4%, tăng 13 điểm so với thế hệ trước. - Trong nhiều bài kiểm tra, Sonnet 5 đạt 90-100% hiệu suất của Opus 4.8. **Giá cả hấp dẫn:** - Khuyến mãi giới hạn đến 31/8: Đầu vào 2 USD/triệu token, đầu ra 10 USD/triệu token. - Sau đó, giá tiêu chuẩn là 3 USD (vào) và 15 USD (ra), chỉ bằng 60% giá Opus 4.8. - Lưu ý: Tokenizer mới có thể khiến số token đầu vào tăng 1.0-1.35 lần. **Bảo mật vượt trội:** - Tỷ lệ thành công tấn công prompt injection chỉ 0.19%, ngang bằng Opus 4.8. - Phòng thủ browser injection: 0.93%, vượt trội so với Mythos 5 (29.7%) và Opus 4.8 (31.5%). - Tỷ lệ tấn công mã độc giảm từ 45.26% (Sonnet 4.6) xuống còn 0.29%. Tóm lại, Claude Sonnet 5 định vị chính xác ở phân khúc trung cấp, cung cấp hiệu suất gần bằng flagship với mức giá phải chăng hơn nhiều, trở thành lựa chọn "công cụ lao động" AI mạnh mẽ và kinh tế cho đa số nhà phát triển.

marsbit07/01 07:50

Tin Nóng, Claude 5 Phiên Bản 'Kẻ Làm Thuê' Đã Xuất Hiện, Ai Cũng Có Thể Dùng

marsbit07/01 07:50

Vừa rồi, Anthropic ra mắt Sonnet 5, hiệu năng gần bằng Opus 4.8, nhưng chưa chắc đã rẻ hơn

Vừa qua, Anthropic đã chính thức ra mắt mô hình mới Claude Sonnet 5, được mô tả là "mô hình Sonnet mang đầy đủ tính chất Agent nhất từ trước đến nay". Mô hình này có khả năng lập kế hoạch, sử dụng các công cụ như trình duyệt, terminal và vận hành tự chủ ở mức độ mà trước đây cần đến các mô hình lớn hơn, đắt tiền hơn. So với Sonnet 4.6, Sonnet 5 có cải thiện đáng kể về khả năng lập luận, sử dụng công cụ, lập trình và xử lý công việc tri thức, tiệm cận hiệu năng của Opus 4.8 nhưng với mức giá thấp hơn. Trong các đánh giá về tác nhân thông minh (Agent), Sonnet 5 cho thấy sự cải thiện rõ rệt so với thế hệ trước và cung cấp phạm vi lựa chọn cân bằng giữa chi phí và hiệu suất rộng hơn. Ở mức độ nỗ lực cao, hiệu suất của nó trong một số tác vụ có thể sánh ngang với Opus 4.8. Về mặt an toàn, Sonnet 5 được cải thiện so với Sonnet 4.6, với tỷ lệ hành vi không phù hợp, ảo giác và tâng bốc thấp hơn. Tuy nhiên, tỷ lệ này vẫn cao hơn một chút so với Opus 4.8 và Claude Mythos Preview. Mô hình được trang bị rào chắn bảo mật mạng mặc định, tương tự như Opus 4.7/4.8. Sonnet 5 sử dụng một bộ tokenizer mới, khiến cùng một nội dung đầu vào có thể tạo ra nhiều token hơn (khoảng 1.0-1.35 lần). Để chuyển đổi, Anthropic áp dụng mức giá ưu đãi: từ nay đến 31/8/2026, giá là 2 USD/triệu token đầu vào và 10 USD/triệu token đầu ra. Sau đó, giá tiêu chuẩn sẽ là 3 USD và 15 USD. Một số phân tích chỉ ra rằng chi phí chạy mỗi tác vụ của Sonnet 5 trên chỉ số Intelligence Index là 2.29 USD, cao hơn khoảng 15% so với Opus 4.8, chủ yếu do lượng token sử dụng tăng lên. Mô hình hiện đã có mặt trên tất cả các nền tảng và được đưa vào Chương trình Xác minh An ninh Mạng của Anthropic. Giới hạn tốc độ (rate limits) trên các nền tảng cũng được điều chỉnh tăng để phù hợp với mức tiêu thụ token lớn hơn ở chế độ nỗ lực cao.

marsbit07/01 00:38

Vừa rồi, Anthropic ra mắt Sonnet 5, hiệu năng gần bằng Opus 4.8, nhưng chưa chắc đã rẻ hơn

marsbit07/01 00:38

Anthropic ra mắt 'mô hình mạnh nhất', nhưng đa số người dùng không thể tiếp cận

Vào tháng 4, Anthropic giới thiệu bản xem trước mô hình Mythos, không mở công khai do có khả năng khám phá lỗ hổng bảo mật mạnh mẽ. Đến tháng 6, họ chính thức ra mắt Fable 5 và Mythos 5, chia sẻ cùng một mô hình nền tảng nhưng có cách tiếp cận khác nhau: Mythos 5 bị hạn chế trong "Dự án Glasswing" dành cho các đối tác bảo mật, còn Fable 5 dành cho người dùng phổ thông với một bộ phân loại an toàn tự động chuyển sang mô hình cũ Opus 4.8 khi phát hiện yêu cầu nhạy cảm. Về hiệu suất, Fable 5 thể hiện sự vượt trội trong các bài kiểm tra kỹ thuật phần mềm như SWE-Bench Pro (80.3%) và FrontierCode Diamond (29.3%), cho thấy khả năng tạo mã chất lượng sản xuất và xử lý tác vụ dài tốt hơn. Tuy nhiên, cơ chế tự động hạ cấp đôi khi được kích hoạt quá mức, ảnh hưởng đến trải nghiệm. Đáng chú ý, Fable 5 có giá API đắt gấp đôi Opus 4.8 và từ ngày 23/6 sẽ bị loại khỏi gói đăng ký, buộc người dùng phải trả thêm phí theo lượng sử dụng. Động thái này được cho là nhằm sàng lọc người dùng cao cấp sẵn sàng trả giá cho công nghệ đỉnh cao, trong khi các mô hình Trung Quốc như DeepSeek lại giảm giá mạnh để mở rộng thị trường. Bài viết kết luận rằng ngành AI đang phân tầng: khả năng phổ thông sẽ ngày càng rẻ, trong khi công nghệ tiên phong sẽ đắt đỏ và chỉ dành cho những người dùng có nhu cầu và khả năng chi trả cao, giống như lộ trình phát triển của điện toán đám mây trước đây.

marsbit06/10 23:55

Anthropic ra mắt 'mô hình mạnh nhất', nhưng đa số người dùng không thể tiếp cận

marsbit06/10 23:55

Vừa mới, Claude Mythos 5 ra mắt, xử lý 50 triệu dòng code trong 1 ngày

Anthropic đã chính thức công bố Claude Fable 5 và Claude Mythos 5, hai phiên bản mạnh mẽ nhất từ trước đến nay của họ. Fable 5 là phiên bản có "lưới bảo vệ", tự động chuyển sang Claude Opus 4.8 khi phát hiện câu hỏi rủi ro (như viết phần mềm độc hại), và được mở cho tất cả người dùng. Mythos 5 là phiên bản đầy đủ năng lực, tập trung vào an ninh mạng và nghiên cứu sinh học, nhưng chỉ dành cho một số ít người dùng được tin cậy. Về hiệu suất, Fable 5 thể hiện sự vượt trội trong nhiều lĩnh vực: * **Kỹ thuật phần mềm:** Đạt điểm cao trong các bài kiểm tra SWE-bench Pro và Frontier Code. Đáng chú ý, nó hoàn thành việc di chuyển kho code Ruby 50 triệu dòng chỉ trong 1 ngày. * **Thị giác máy tính:** Có thể tự chơi và hoàn thành game "Pokémon" chỉ dựa trên ảnh chụp màn hình mà không cần công cụ hỗ trợ. * **Bộ nhớ dài hạn & Ngữ cảnh dài:** Khả năng duy trì tập trung và sử dụng ghi chú trong các nhiệm vụ kéo dài được cải thiện, nâng cao hiệu quả hoạt động tự chủ (Agent). * **Tài chính & Phân tích:** Là mô hình đầu tiên đạt trên 90% trong một bài benchmark phân tích phức tạp, cho thấy khả năng suy luận ở cấp độ chuyên gia. * **Nghiên cứu khoa học:** Mythos 5 có thể tự động hóa toàn bộ quy trình nghiên cứu sinh học. 9 trong số 14 hợp chất do nó thiết kế đã được đưa vào quy trình phát triển thuốc thực tế. Một điểm đáng chú ý là cơ chế an toàn mới: thay vì từ chối trả lời, Fable 5 sẽ chuyển hướng câu hỏi nhạy cảm sang Opus 4.8. Tuy nhiên, cơ chế này đôi khi có thể "bắt nhầm" các yêu cầu hợp pháp. Anthropic cũng áp dụng chính sách lưu giữ dữ liệu 30 ngày cho lưu lượng truy cập của các mô hình cấp Mythos. Giá API cho cả hai mô hình là 10 USD/token đầu vào và 50 USD/token đầu ra (tính theo triệu). Giáo sư Ethan Mollick, người dùng thử nghiệm, nhận xét rằng với Fable 5, con người giống như "khách hàng" (patron) đưa ra yêu cầu tổng thể, trong khi AI tự động phân chia công việc và hoàn thành mà ít cần can thiệp, đánh dấu sự thay đổi lớn trong hình thức hợp tác giữa người và máy.

marsbit06/10 00:27

Vừa mới, Claude Mythos 5 ra mắt, xử lý 50 triệu dòng code trong 1 ngày

marsbit06/10 00:27

活动图片