# Bài viết Liên quan Chi phí

Trung tâm Tin tức HTX cung cấp những bài viết mới nhất và phân tích chuyên sâu về "Chi phí", bao gồm xu hướng thị trường, cập nhật dự án, phát triển công nghệ và chính sách quản lý trong ngành tiền kỹ thuật số.

GPT-5.6 Sol Bỗng Nhiên Trở Nên 'Đần', Ngân Sách Suy Nghĩ Bị Cắt Từ 960 Xuống 128, Không Còn Model Cố Định Về Trí Tuệ?

Tất cả mọi người đều nói GPT-5.6 Sol đã trở nên "ngu ngốc" hơn, nhưng OpenAI phủ nhận việc "giảm trí thông minh", cho rằng đó chỉ là một "thí nghiệm" để điều tra việc sử dụng token gia tăng sau khi phát hành GPT-5.6. Trong thí nghiệm này, một thông số nội bộ chưa từng được công khai có tên "juice value" - đại diện cho ngân sách tài nguyên suy luận - đã bị giảm từ 960 xuống 128 ở chế độ Max, khiến người dùng cảm thấy mô hình suy nghĩ nông hơn và ít "đào sâu" hơn trước. Tibo từ OpenAI xác nhận việc điều chỉnh thông số này và cho biết đã khôi phục lại mức cũ. Anh ta giải thích việc tối ưu hóa hiệu suất suy luận sẽ tiết kiệm tài nguyên và tăng khoảng 10% lượt sử dụng cho người đăng ký. Ngữ cảnh tối đa cũng tạm thời được điều chỉnh từ 372k về 272k token để sửa lỗi tính phí, và sẽ được khôi phục trong vài ngày tới. Sự việc này làm dấy lên tranh cãi trong cộng đồng về việc các nhà cung cấp AI có toàn quyền điều chỉnh hiệu suất của mô hình mà người dùng đăng ký. Nó phá vỡ ảo tưởng về một "trí thông minh cố định", so sánh việc đăng ký một mô hình giống như mua một bóng đèn có nút chỉnh độ sáng nằm trong tay nền tảng. Nếu AI muốn trở thành cơ sở hạ tầng doanh nghiệp, các nhà cung cấp cần định nghĩa rõ ràng hơn các thông số đảm bảo cho người dùng, thay vì chỉ là một cái tên mô hình chung chung.

marsbitHôm qua 03:32

GPT-5.6 Sol Bỗng Nhiên Trở Nên 'Đần', Ngân Sách Suy Nghĩ Bị Cắt Từ 960 Xuống 128, Không Còn Model Cố Định Về Trí Tuệ?

marsbitHôm qua 03:32

Kết Quả Nội Bộ Đầu Tiên Của GPT-5.6 Sol Đã Về, Chi Phí Cho Cùng Nhiệm Vụ Chỉ Bằng Một Nửa Fable 5

Kết quả thử nghiệm nội bộ đầu tiên của GPT-5.6 Sol (phiên bản xem trước) đã được công bố. Theo chia sẻ từ một kỹ sư trưởng tại NVIDIA, Sol đạt được hiệu quả tăng tốc CUDA chỉ trong 30 giờ, trong khi Opus cần tới 64 giờ. Dự kiến, các bản tối ưu sau có thể sẽ vượt trội hoàn toàn so với Opus. Người dùng nội bộ đánh giá cao khả năng viết mã ngắn gọn, súc tích của Sol, với số dòng code ước tính chỉ bằng 1/5 so với Opus, đặc biệt trong C++. Mô hình tập trung vào tối ưu hiệu suất cốt lõi cho các nhiệm vụ suy luận phức tạp, chuỗi dài, thay vì thử nghiệm lan man. So sánh với GPT-5.5 Pro, Sol thể hiện tốt hơn trong việc tuân thủ chỉ dẫn, suy luận không gian và tạo ra giao diện front-end sạch sẽ, bố cục cân đối. Khi so sánh với đối thủ Fable 5, Sol được nhận định có khả năng tổng thể và chất lượng code vẫn còn khoảng cách nhỏ. Tuy nhiên, ưu thế lớn của Sol nằm ở chi phí: chỉ 5 USD/triệu token đầu vào và 30 USD/triệu token đầu ra, rẻ hơn khoảng một nửa so với Fable 5 (10 USD và 50 USD). Ngoài ra, các hạn chế an toàn (safety limits) trên Sol được cho là linh hoạt hơn so với Fable 5, vốn bị người dùng phàn nàn là quá nghiêm ngặt. GPT-5.6 Sol dự kiến sẽ chính thức mở cửa cho tất cả người dùng trong vài ngày tới, thay vì chỉ giới hạn cho một số đối tác như trước.

marsbit07/06 07:31

Kết Quả Nội Bộ Đầu Tiên Của GPT-5.6 Sol Đã Về, Chi Phí Cho Cùng Nhiệm Vụ Chỉ Bằng Một Nửa Fable 5

marsbit07/06 07:31

Đặc trưng của Forbes: Thanh toán xuyên biên giới bằng stablecoin nhanh hơn, nhưng vẫn chưa rẻ hơn

Tiêu điểm của Forbes: Thanh toán xuyên biên giới bằng stablecoin đã nhanh hơn, nhưng chưa rẻ hơn Ngành thanh toán xuyên biên giới bằng stablecoin đang tăng trưởng mạnh, với công nghệ sẵn sàng, môi trường pháp lý được cải thiện và khối lượng giao dịch tăng. Tuy nhiên, lời hứa về chi phí thấp hơn đáng kể so với các phương thức truyền thống (60-70 điểm cơ bản) vẫn chưa thành hiện thực, hiện ở mức 2-5 điểm cơ bản. Nguyên nhân chính là thiếu các nhóm thanh khoản sâu và quy mô lớn. Rào cản lớn nhất không phải là công nghệ mà là vấn đề tin cậy. Các doanh nghiệp thường gắn bó với đối tác ngoại hối truyền thống đã có mối quan hệ lâu dài và đáng tin cậy. Sự thay đổi chỉ diễn ra khi chênh lệch chi phí trở nên quá lớn hoặc một thế hệ doanh nhân mới xuất hiện. Các công ty thành công trong lĩnh vực này, như Caliza, không tìm cách thay thế hệ thống cũ (ví dụ: SWIFT) mà bổ sung và tích hợp với nó, đảm bảo độ chính xác và tuân thủ trong các khoản thanh toán phức tạp cho nhà cung cấp. Tăng trưởng mạnh mẽ (trên 40% hàng tháng) được thúc đẩy nhờ việc tự xây dựng giấy phép, quan hệ đối tác ngân hàng và kênh chuyển đổi pháp định. Tương lai của ngành sẽ chứng kiến sự sàng lọc tự nhiên. Các công ty tồn tại và phát triển được sẽ là những đơn vị sở hữu ba yếu tố then chốt: giấy phép đầy đủ, kênh tiếp cận pháp định vững chắc và khả năng cung cấp thanh khoản. Thiếu chúng, họ chỉ đơn thuần là những trung gian.

marsbit07/05 09:25

Đặc trưng của Forbes: Thanh toán xuyên biên giới bằng stablecoin nhanh hơn, nhưng vẫn chưa rẻ hơn

marsbit07/05 09:25

Forbes: Thanh toán xuyên biên giới bằng stablecoin đã nhanh hơn, nhưng chưa rẻ hơn

Bài viết của Forbes nhấn mạnh ngành thanh toán xuyên biên giới bằng stablecoin đang tăng trưởng nhanh chóng, với những cải thiện về công nghệ và môi trường quản lý. Tuy nhiên, lời hứa về chi phí thấp hơn vẫn chưa thành hiện thực. Trong khi các nhà môi giới ngoại hối truyền thống thu phí từ 60 đến 70 điểm cơ bản, stablecoin hướng tới mức chỉ 2-5 điểm, nhưng lợi thế này chủ yếu vẫn chỉ là lý thuyết. Nguyên nhân chính là thiếu các nhóm thanh khoản sâu, quy mô lớn. Theo Imran Ahmad của Bitso Business, ưu thế về giá sẽ chỉ xuất hiện khi có dòng thanh khoản thể chế đổ vào. Một rào cản quan trọng khác là vấn đề niềm tin. Các doanh nghiệp thường gắn bó lâu dài với đại lý ngoại hối đáng tin cậy, khiến việc chuyển đổi sang giải pháp mới diễn ra chậm. Các công ty thành công như Caliza không tìm cách thay thế hệ thống cũ (như Swift) mà bổ sung cho nó, kết hợp tính nhanh chóng của stablecoin với độ tin cậy và tiêu chuẩn hóa của cơ sở hạ tầng truyền thống. Chiến lược này giúp họ đạt mức tăng trưởng ấn tượng. Tương lai của ngành được dự báo sẽ chứng kiến sự sàng lọc, nơi các công ty nắm giữ được giấy phép, kênh tiền pháp định và thanh khoản mới có thể tồn tại lâu dài.

链捕手07/05 09:20

Forbes: Thanh toán xuyên biên giới bằng stablecoin đã nhanh hơn, nhưng chưa rẻ hơn

链捕手07/05 09:20

Bản Cập Nhật Sui Testnet v1.74.1 Giảm Mạnh Chi Phí Gas Giao Dịch Thông Qua Phiên Bản Giao Thức 128

Mysten Labs đã triển khai bản cập nhật testnet v1.74.1 với phiên bản giao thức 128 trên blockchain Sui. Bản nâng cấp này giảm đáng kể chi phí gas cho người dùng và nhà phát triển trên mạng thử nghiệm. Các tối ưu hóa nhằm mục đích mở rộng quy mô hiệu suất trước khi triển khai lên mainnet. Điều quan trọng cần lưu ý là những thay đổi này hiện chỉ áp dụng cho testnet, chưa phải mạng chính thức. Thông tin được xác minh dựa trên nguồn tài liệu chính thức từ Mysten Labs và các bản ghi giao thức, cung cấp một dấu mốc phát triển cụ thể thay vì chỉ là nhận định chung chung. Trong bối cảnh thị trường biến động, sự kiện này cung cấp một dữ liệu đáng tin cậy để đánh giá, nhưng cần được xem xét cùng với các yếu tố khác như thanh khoản và cấu trúc thị trường. Nó được coi là một bước tiến được xác nhận trong phạm vi xác định, chứ không đảm bảo cho một biến động giá cả hay sự thay đổi lớn trên thị trường. Sự phát triển của câu chuyện sẽ phụ thuộc vào các bản cập nhật, xác nhận chính thức hoặc dữ liệu theo dõi tiếp theo từ giao thức.

bitcoinist07/03 16:08

Bản Cập Nhật Sui Testnet v1.74.1 Giảm Mạnh Chi Phí Gas Giao Dịch Thông Qua Phiên Bản Giao Thức 128

bitcoinist07/03 16:08

Hoàn tiền, Claude 4.8 “hạ trí” ồ ạt qua đêm, GPT-5.6 bị “chặt đôi” sức mạnh tính toán

Hai gã khổng lồ AI là OpenAI và Anthropic dường như cùng rơi vào "bê bối giảm trí" trong 48 giờ qua, khi cộng đồng AI phát hiện những dấu hiệu cho thấy các mô hình hàng đầu của họ đang bị âm thầm làm suy yếu. Về phía OpenAI, cộng đồng phát hiện họ có thể đang thử nghiệm phiên bản GPT-5.6-sol một cách hạn chế thông qua nền tảng Codex. Người dùng được chuyển hướng đến mô hình này nhận được giá trị "Juice" (đại diện cho ngân sách suy luận) chỉ là 128, thấp hơn 6 lần so với giá trị 768 của GPT-5.5 xhigh thông thường. Điều này dấy lên lo ngại rằng đây có thể là một phiên bản "rút gọn" nhằm tiết kiệm chi phí điện toán thay vì một bản nâng cấp thực sự. Trong khi đó, Claude Opus 4.8 Max của Anthropic bị người dùng trên Reddit cáo buộc đã trải qua một đợt "giảm trí thảm hại". Mô hình từng gây ấn tượng với khả năng suy luận sâu sắc giờ đây được mô tả là có phản ứng kém, mất khả năng ghi nhớ ngữ cảnh, thường xuyên đưa ra câu trả lời sai lầm ngay cả ở chế độ suy nghĩ cao, và thậm chí có hành vi "thao túng tâm lý" (PUA) người dùng. Nhiều người cho rằng trải nghiệm với Opus 4.8 Max hiện tại còn tệ hơn so với mô hình cũ Haiku. Bài viết đặt ra giả thuyết rằng đây có thể là một thí nghiệm có chủ đích của các công ty: tung ra mô hình với năng lực được tăng cường tạm thời để tạo hiệu ứng đột phá, sau đó âm thầm giảm bớt để kiểm soát chi phí điện toán khổng lồ, đặc biệt trong bối cảnh thị trường vốn có thể đang khó khăn hơn. Sự kiện này làm dấy lên mối lo ngại về tính minh bạch, khi người dùng trả phí nhưng không được thông báo về những thay đổi đáng kể trong chất lượng dịch vụ.

marsbit06/30 12:10

Hoàn tiền, Claude 4.8 “hạ trí” ồ ạt qua đêm, GPT-5.6 bị “chặt đôi” sức mạnh tính toán

marsbit06/30 12:10

GPT Thiết Kế GPT

OpenAI đã công bố chip AI đầu tiên của họ, Jalapeño, đánh dấu bước đi quan trọng vượt ra ngoài việc chỉ là một công ty mô hình. Động thái này cho thấy tham vọng kiểm soát toàn bộ quá trình sản xuất trí tuệ, từ mô hình, chip, trung tâm dữ liệu đến năng lượng. Bài viết chỉ ra rằng khoảng cách về mô hình giữa các công ty đang thu hẹp, trong khi khoảng cách về năng lực tính toán ngày càng mở rộng. Chi phí sản xuất mỗi token mới là thước đo thực sự trong kỷ nguyên AI. Jalapeño, một chip chuyên cho suy luận (inference), là nhà máy token của chính OpenAI, nhằm giảm "thuế suy luận" và kiểm soát dòng tiền hàng ngày. Điểm đáng chú ý là chu kỳ sản xuất chip chỉ 9 tháng, được rút ngắn nhờ OpenAI sử dụng chính các mô hình AI của mình để hỗ trợ thiết kế và tối ưu hóa. Điều này tạo nên một vòng lặp kín: mô hình tốt hơn giúp thiết kế chip tốt hơn, chip tốt hơn giảm chi phí vận hành thế hệ mô hình tiếp theo. Tác giả so sánh OpenAI đang dần trở nên giống Apple – xây dựng một hệ sinh thái khép kín từ chip, hệ thống đến ứng dụng và trải nghiệm người dùng, thay vì chỉ cạnh tranh trực tiếp với NVIDIA. OpenAI muốn sở hữu "mỏ khai thác" và bán sản phẩm trí tuệ cuối cùng, chứ không chỉ dừng ở việc mua "công cụ". Bài viết kết luận, trong kỷ nguyên AI, mô hình có thể thay đổi nhanh chóng như "lưu lượng", nhưng cơ sở hạ tầng sản xuất trí tuệ như chip, trung tâm dữ liệu sẽ là "mảnh đất" quyền lực, ngày càng tập trung vào một số ít người chơi. Jalapeño là lời tuyên bố rằng OpenAI muốn trở thành công ty kiểm soát việc sản xuất trí tuệ.

marsbit06/25 14:04

GPT Thiết Kế GPT

marsbit06/25 14:04

Cuộc Chiến 'Trợ Cấp Token' của Những Gã Khổng Lồ AI Sắp Kết Thúc Chưa?

Cuộc chiến trợ cấp Token giữa các gã khổng lồ AI như OpenAI, Anthropic và Google đang diễn ra quyết liệt. Hiện tại, người dùng đang được hưởng mức giá "bẻ gãy" khi các công ty này bù lỗ nặng để thu hút và giữ chân người dùng, đặc biệt là các gói cao cấp. Tuy nhiên, khác với các cuộc chiến trợ cấp thời internet, token AI hầu như không tạo ra hiệu ứng "khóa" người dùng do việc chuyển đổi giữa các nền tảng là quá dễ dàng. Bill Maris, người sáng lập Google Ventures, dự đoán 100% rằng Google - với lợi thế từ cỗ máy in tiền quảng cáo khổng lồ - có thể hạ giá token thêm 80%, gây áp lực khủng khiếp lên các đối thủ phụ thuộc vào vốn đầu tư như OpenAI và Anthropic. Điều này đặt ra câu hỏi về tính bền vững của mô hình kinh doanh khi họ phải công khai báo cáo tài chính sau IPO. Bài viết phân tích hai kịch bản có thể xảy ra: 1) Mô hình "dịch vụ internet" với một vài công ty thống trị rồi tăng giá, hoặc 2) Token trở thành cơ sở hạ tầng tiêu chuẩn như "điện, nước", nơi cạnh tranh đẩy giá xuống sát chi phí và lợi nhuận trở nên rất thấp. Do thiếu hiệu ứng khóa chân người dùng, kịch bản thứ hai có vẻ thực tế hơn. Cuộc chiến này có thể không có kẻ chiến thắng rõ ràng, mà là một cuộc chạy đua tiêu hao kéo dài nhằm giữ vị trí trên "bàn chơi", thúc đẩy AI trở thành một tiện ích cơ sở hạ tầng công cộng mà không công ty nào có thể độc chiếm. Đối với người dùng, điều này có nghĩa là họ có thể tiếp tục được hưởng lợi từ các giao dịch "hời" trong một thời gian dài hơn.

marsbit06/21 04:26

Cuộc Chiến 'Trợ Cấp Token' của Những Gã Khổng Lồ AI Sắp Kết Thúc Chưa?

marsbit06/21 04:26

Khoản phí đăng ký bạn trả cho Claude, các công ty module quang có thể nhận được bao nhiêu?

Bản tóm tắt: Một bức tranh ước tính phân bổ 20 USD phí đăng ký Claude Pro hàng tháng của Mỹ cho công ty mô hình, điện toán đám mây, khấu hao GPU, điện năng và chuỗi cung ứng đang khiến các nhà đầu tư thảo luận lại về cách định giá doanh thu ứng dụng AI. Khác với SaaS truyền thống có chi phí biên gần bằng 0, mỗi lần người dùng gọi mô hình AI (suy luận) đều tiêu tốn tài nguyên tính toán, tạo ra mâu thuẫn giữa thuê bao cố định và chi phí biến đổi. Hiện tại, sự tăng trưởng về mức độ sử dụng AI chủ yếu chảy về cơ sở hạ tầng (GPU, HBM, điện, trung tâm dữ liệu), nơi có doanh thu xác định hơn và được định giá cao. Các công ty mô hình cần chứng minh họ có thể cải thiện hiệu quả đủ nhanh (thông qua tối ưu hóa mô hình, bộ nhớ đệm, chip tự nghiên cứu...) để giảm chi phí suy luận trên mỗi đơn vị, vượt qua sự gia tăng về mức độ sử dụng và độ phức tạp tác vụ, từ đó khôi phục cấu trúc lợi nhuận cao như phần mềm. Giá trị của bức tranh này là cảnh báo định giá: nhà đầu tư cần thận trọng với giả định "doanh thu ứng dụng AI bằng doanh thu SaaS", và tập trung vào dữ liệu về tỷ suất lợi nhuận gộp được gia quyền theo mức độ sử dụng thay vì chỉ số người đăng ký.

marsbit06/17 03:45

Khoản phí đăng ký bạn trả cho Claude, các công ty module quang có thể nhận được bao nhiêu?

marsbit06/17 03:45

活动图片