Tiết kiệm 300 triệu Token trong một tuần, Hướng dẫn Caching của Kỹ sư Anthropic cho Claude Code

marsbitXuất bản vào 2026-05-24Cập nhật gần nhất vào 2026-05-24

Tóm tắt

Bài viết chia sẻ cách tiết kiệm token khi sử dụng Claude Code thông qua cơ chế cache prompt. Tác giả tiết kiệm được 3 tỷ token trong một tuần, với 91 triệu token cache mỗi ngày. Token được cache có chi phí chỉ bằng 10% token thông thường, giúp kéo dài phiên làm việc và giảm đáng kể chi phí. Cache hoạt động dựa trên nguyên tắc khớp tiền tố (prefix matching) và được chia thành ba lớp: hệ thống, dự án và hội thoại. Để tối ưu, người dùng nên tránh gián đoạn cache bằng cách: không để phiên trống quá 1 giờ (TTL mặc định của Claude Code), chuyển đổi nhiệm vụ một cách rõ ràng thay vì dùng lệnh /clear, và đưa tài liệu lớn vào Projects thay vì dán trực tiếp vào hội thoại. Các thao tác như chuyển đổi mô hình hay bật chế độ "Opus plan" sẽ đặt lại toàn bộ cache. Hiểu và duy trì tỷ lệ cache hit cao có lợi cho cả người dùng và nhà cung cấp, giúp tiết kiệm chi phí và cải thiện hiệu suất.

Biên tập viên lưu ý: Nhiều người khi sử dụng Claude Code có cảm nhận trực quan nhất là Token tiêu hao quá nhanh, các phiên dài rất dễ hết hạn mức. Nhưng từ góc nhìn của các kỹ sư Anthropic, thứ thực sự ảnh hưởng đến chi phí, thường không phải là bạn đã viết bao nhiêu mã, mà là hệ thống có liên tục tái sử dụng ngữ cảnh đã xử lý hay không.

Điểm cốt lõi được chia sẻ trong bài viết này, chính là cách tiết kiệm Token thông qua cơ chế caching. Tác giả đã tái sử dụng hơn 300 triệu Token thông qua caching trong một tuần, lượng cache trong một ngày đạt 91 triệu. Do chi phí của Token cache chỉ bằng 10% so với Token đầu vào thông thường, điều này có nghĩa là 91 triệu Token cache thực tế tính phí tương đương với khoảng 9 triệu Token thông thường. Lý do các phiên dài của Claude Code có vẻ "bền" hơn, không phải vì mô hình làm việc miễn phí, mà là do một lượng lớn ngữ cảnh lặp lại đã được tái sử dụng thành công.

Chìa khóa của Prompt caching nằm ở việc "không làm gián đoạn cache". Claude Code sẽ lưu cache theo tầng cho prompt hệ thống, định nghĩa công cụ, CLAUDE.md, quy tắc dự án và lịch sử hội thoại; chỉ cần tiền tố của yêu cầu tiếp theo giữ nguyên, Claude có thể đọc trực tiếp từ cache, thay vì xử lý lại toàn bộ ngữ cảnh. Anthropic nội bộ cũng sẽ giám sát tỷ lệ tái sử dụng prompt cache, bởi vì nó không chỉ ảnh hưởng đến hạn mức người dùng, mà còn liên quan trực tiếp đến chi phí dịch vụ mô hình và hiệu quả vận hành.

Đối với người dùng thông thường, không cần phải hiểu tất cả các chi tiết nền tảng, chỉ cần nắm vững một vài thói quen quan trọng: không để phiên rảnh rỗi quá 1 giờ; khi chuyển đổi nhiệm vụ, hãy thực hiện tốt việc bàn giao phiên (session handoff); tránh chuyển đổi mô hình quá thường xuyên; các tài liệu lớn nên đưa vào Projects, thay vì dán đi dán lại vào cuộc hội thoại.

Bài viết này, hơn là nói về một mẹo tiết kiệm Token, có thể nói là cung cấp một bộ phương pháp sử dụng Claude Code gần hơn với tư duy kỹ sư: coi ngữ cảnh như tài sản cần quản lý, để cache được tái sử dụng liên tục, để các phiên dài ít phải tính toán lặp lại.

Dưới đây là bản gốc:

Tuần này tôi đã tiết kiệm được 300 triệu Token, 91 triệu trong một ngày, hơn 300 triệu trong một tuần.

Tôi không thay đổi bất kỳ cài đặt nào. Đây chỉ là prompt caching đang hoạt động bình thường ở phía hậu trường.

Nhưng khi tôi thực sự hiểu cache là gì, và làm thế nào để tránh "làm gián đoạn" cache, dưới cùng một hạn mức sử dụng, các phiên của tôi có thể kéo dài hơn. Vì vậy, đây là hướng dẫn nhập môn 80/20 về prompt caching của Claude Code, không liên quan đến các chi tiết sâu ở cấp độ API.

TL;DR

Chi phí của Token cache chỉ bằng 10% so với Token đầu vào thông thường. 91 triệu Token cache, thực tế tính phí tương đương với khoảng 9 triệu Token.

TTL cache của phiên bản đăng ký Claude Code là 1 giờ; API mặc định là 5 phút; Sub-agent luôn là 5 phút.

Cache được chia thành ba tầng: tầng hệ thống, tầng dự án, tầng hội thoại.

Chuyển đổi mô hình giữa phiên sẽ phá hủy cache, bao gồm cả việc bật chế độ "opus plan".

Cache thực sự được tính tiền như thế nào?

Mỗi Token được cache, chi phí đều bằng 10% so với Token đầu vào thông thường.

Vì vậy, khi bảng điều khiển của tôi hiển thị một ngày nào đó có 91 triệu Token trúng cache, thực tế tính phí chỉ tương đương với việc xử lý khoảng 9 triệu Token. Đây cũng là lý do tại sao so với việc không có cache, khi sử dụng Claude Code trong thời gian dài, sẽ khiến người ta cảm thấy phiên hội thoại gần như được kéo dài "miễn phí".

Có hai con số trong bảng điều khiển đáng để chú ý:

Cache create: Chi phí một lần phát sinh khi ghi nội dung vào cache. Nó sẽ bắt đầu phát huy tác dụng trong lượt hội thoại tiếp theo.
Cache read: Token mà Claude tái sử dụng từ cache, chẳng hạn như CLAUDE.md, định nghĩa công cụ, tin nhắn trước đó của bạn, v.v. So với việc xử lý lại như đầu vào, chi phí rẻ hơn 10 lần.

Nếu con số Cache read của bạn cao, điều đó có nghĩa là bạn đang tận dụng cache hiệu quả; nếu con số này thấp, có nghĩa là bạn đang trả phí lặp lại cho cùng một loạt ngữ cảnh.

Thariq của Anthropic có một câu nói khiến tôi ấn tượng sâu sắc: "Chúng tôi thực sự sẽ giám sát tỷ lệ trúng cache của prompt, một khi tỷ lệ trúng quá thấp, sẽ kích hoạt cảnh báo, thậm chí tuyên bố sự cố cấp độ SEV."

Anh ấy cũng đã viết một bài X rất hay. Khi tỷ lệ trúng cache cao, bốn điều sẽ xảy ra đồng thời: Claude Code cảm giác nhanh hơn, chi phí dịch vụ của Anthropic giảm xuống, hạn mức đăng ký của bạn trở nên bền hơn, và các phiên lập trình dài cũng trở nên khả thi hơn.

Nhưng nếu tỷ lệ trúng thấp, mọi người đều sẽ chịu thiệt.

Vì vậy, động lực của cả hai bên thực ra là nhất quán: Anthropic muốn tỷ lệ trúng cache của bạn cao hơn, và bản thân bạn cũng muốn tỷ lệ trúng cao hơn. Thứ thực sự kéo chân lại, chỉ là một số thói quen nhỏ tưởng chừng không đáng kể, nhưng lại âm thầm đặt lại cache.

Cache tăng trưởng như thế nào trong mỗi lượt hội thoại?

Cache phụ thuộc vào prefix matching, tức là "khớp tiền tố".

Bạn không cần sa vào quá sâu các chi tiết kỹ thuật, chỉ cần hiểu một điểm: chỉ cần nội dung trước một vị trí nào đó hoàn toàn giống với nội dung đã được cache, Claude có thể tái sử dụng phần Token cache này.

Một phiên hội thoại hoàn toàn mới, về cơ bản sẽ diễn ra như sau:

Theo tài liệu Claude Code, một phiên hoàn toàn mới thường chạy như thế này:

Lượt hội thoại thứ nhất: Chưa có bất kỳ cache nào. Prompt hệ thống, ngữ cảnh dự án của bạn (ví dụ: CLAUDE.md, memory, quy tắc), cũng như tin nhắn đầu tiên của bạn, tất cả đều sẽ được xử lý lại một lần và ghi vào cache.

Lượt hội thoại thứ hai: Tất cả nội dung trong lượt đầu tiên hiện đã được cache. Claude chỉ cần xử lý phản hồi mới của bạn và tin nhắn tiếp theo. Chi phí lượt này sẽ thấp hơn nhiều.

Lượt hội thoại thứ ba: Logic tương tự. Các cuộc hội thoại trước đó vẫn được giữ trong cache, chỉ có lượt tương tác mới nhất cần được xử lý lại.

Bản thân cache có thể được chia thành ba tầng:

Từ bài viết X của Thariq:

Tầng hệ thống (System layer): Bao gồm hướng dẫn cơ bản, định nghĩa công cụ (read, write, bash, grep, glob) và phong cách đầu ra. Tầng này được cache toàn cục.

Tầng dự án (Project layer): Bao gồm CLAUDE.md, memory, quy tắc dự án. Tầng này được cache theo dự án.

Tầng hội thoại (Conversation): Bao gồm phản hồi và tin nhắn, sẽ tăng liên tục theo mỗi lượt hội thoại.

Nếu giữa phiên hội thoại, bất kỳ nội dung nào của tầng hệ thống hoặc tầng dự án thay đổi, tất cả nội dung phải được cache lại từ đầu. Đây là thao tác "đắt" nhất. Hãy tưởng tượng: Bạn đã trò chuyện đến tin nhắn thứ 16, lúc này đột nhiên thay đổi prompt hệ thống, hoặc tạm dừng một giờ, thì tất cả Token từ tin nhắn thứ 1 trở đi đều phải được xử lý lại.

Sự nhầm lẫn giữa 1 giờ và 5 phút

Đây là điểm dễ gây hiểu lầm nhất.

Phiên bản đăng ký Claude Code: TTL mặc định là 1 giờ.

Claude API: TTL mặc định là 5 phút. Bạn có thể trả chi phí cao hơn để nâng nó lên 1 giờ.
Sub-agent dưới bất kỳ gói nào: Luôn là 5 phút.

Claude.ai trò chuyện trên web: Không có ghi chú chính thức rõ ràng. Có thể giống phiên bản đăng ký, nhưng tôi chưa xác nhận.

Vài tháng trước, nhiều người phàn nàn rằng hạn mức đăng ký Claude tiêu hao quá nhanh. Khi đó có người nghĩ rằng Anthropic đã lén giảm TTL từ 1 giờ xuống 5 phút, mà không thông báo cho người dùng. Nhưng thực tế không phải vậy, TTL của Claude Code vẫn là 1 giờ.

Vấn đề nằm ở chỗ, tài liệu của Claude Code và API được đặt riêng biệt, và bản thân hai thứ này vốn là những thứ hoàn toàn khác nhau, do đó gây ra không ít nhầm lẫn.

Nếu bạn đang chạy nhiều luồng công việc Sub-agent, hoặc sử dụng API trực tiếp, thì con số 5 phút này rất quan trọng. Nhưng đối với 95% người dùng Claude Code, thứ thực sự cần quan tâm, thực ra chỉ có cửa sổ 1 giờ đó.

Ba thói quen bao phủ 95% người dùng

Dưới đây là những phần tôi cảm thấy thực sự hữu ích trong sử dụng hàng ngày.

Đừng tạm dừng quá lâu

Nếu bạn đã rảnh rỗi hơn một giờ, nội dung trước đó về cơ bản đều đã hết hạn từ trong cache. Tin nhắn tiếp theo của bạn sẽ xây dựng lại cache. Trong trường hợp này, thay vì tiếp tục khôi phục một phiên cũ đã "nguội", việc thực hiện một lần bàn giao rõ ràng, sau đó mở một phiên mới, thường có chi phí thấp hơn.

Khi chuyển đổi nhiệm vụ, hãy bắt đầu lại trực tiếp

/compact hoặc /clear vốn dĩ sẽ phá hủy cache, vì vậy thay vì tiếp tục, hãy tận dụng thời điểm này để thực sự đặt lại một lần.

Tôi tự làm một kỹ năng session handoff, để thay thế cho /compact. Nó sẽ tổng kết những gì chúng ta đã hoàn thành, còn những quyết định nào đang chờ xử lý, những tệp nào quan trọng nhất, và tiếp theo nên tiếp tục từ đâu. Sau đó tôi thực hiện /clear, dán bản tóm tắt này vào, và có thể tiếp tục thúc đẩy như thể không có gì bị gián đoạn.

Lệnh compact đôi khi cũng chạy khá chậm. Còn kỹ năng handoff này thường hoàn thành trong chưa đầy một phút.

Trong cuộc trò chuyện Claude, tài liệu lớn hãy cố gắng đưa vào Projects

Cơ chế cache trên Claude.ai không có giải thích chính thức chi tiết, nhưng Projects rõ ràng được tối ưu hóa theo cách khác so với các chuỗi hội thoại thông thường. Vì vậy, nếu bạn muốn dán các tài liệu rất lớn, tốt nhất nên đưa chúng vào Project, thay vì nhét trực tiếp vào cuộc hội thoại.

Những thao tác nào sẽ âm thầm phá hủy cache?

Có vài việc sẽ đặt lại toàn bộ cache mà không có cảnh báo rõ ràng.

Chuyển đổi mô hình: Vì cache phụ thuộc vào khớp tiền tố, và mỗi mô hình có cache riêng của nó. Chỉ cần chuyển đổi mô hình, yêu cầu tiếp theo sẽ đọc lại toàn bộ lịch sử trong tình trạng không có lần trúng cache nào.

Chế độ "Opus plan": Cài đặt này sẽ sử dụng Opus trong giai đoạn lập kế hoạch và Sonnet trong giai đoạn thực thi. Trước đây tôi đã từng giới thiệu nó trong một số video tối ưu token, là có lý do. Nhưng cần hiểu rằng, mỗi lần chuyển đổi plan, về bản chất là một lần chuyển đổi mô hình, cũng có nghĩa là phải thiết lập lại cache. Về lâu dài, nó vẫn giúp kéo dài hạn mức phiên, nhưng bạn cần biết dưới nền tảng thực sự đang xảy ra điều gì.

Chỉnh sửa CLAUDE.md giữa phiên hội thoại là được: Sửa đổi này sẽ không có hiệu lực ngay lập tức, mà phải đợi lần khởi động lại tiếp theo mới được áp dụng. Do đó, cache đang chạy hiện tại sẽ không bị ảnh hưởng.

Bảng điều khiển Token miễn phí của tôi

Ảnh chụp màn hình tôi hiển thị trước đó, đến từ một bảng điều khiển token.

Đây là một kho lưu trữ GitHub rất đơn giản. Bạn đưa liên kết cho Claude Code, để nó triển khai trên localhost, nó sẽ đọc tất cả bản ghi phiên của bạn trong quá khứ, thay vì bắt đầu thống kê từ trạng thái trống. Bạn sẽ thấy ngay dữ liệu input, output, cache create và cache read hàng ngày.

Tuy nhiên có một điểm cần lưu ý: Bảng điều khiển này thống kê dữ liệu Token trên thiết bị cục bộ. Nếu bạn chuyển từ máy tính để bàn sang máy tính xách tay, các con số sẽ không hoàn toàn nhất quán. Mỗi thiết bị có một bộ chế độ xem thống kê riêng.

Tóm tắt

Prompt caching là một thứ có thể nghiên cứu rất sâu. Bài viết của Thariq nói đầy đủ hơn ở đây, nếu bạn muốn xem toàn cảnh, đáng để đọc.

Nhưng bạn không cần phải hiểu hoàn toàn tất cả chi tiết, mới có thể hưởng lợi từ nó. Bạn chỉ cần nắm vững 80/20 then chốt nhất: Token cache rẻ hơn 10 lần so với Token thông thường; TTL của Claude Code là 1 giờ; chuyển đổi mô hình sẽ phá hủy cache; việc thực hiện bàn giao rõ ràng giữa các nhiệm vụ, thường có lợi hơn so với việc để một phiên cũ "hết hạn" rồi lại cứng nhắc tiếp tục sử dụng.

Tiền kỹ thuật số thịnh hành

Câu hỏi Liên quan

QBộ nhớ cache token trong Claude Code giúp tiết kiệm chi phí như thế nào?

AChi phí cho mỗi token được lưu trong bộ nhớ cache chỉ bằng 10% so với token đầu vào thông thường. Ví dụ: 91 triệu token cache sẽ chỉ được tính phí tương đương 9 triệu token thường, giúp tiết kiệm đáng kể hạn mức sử dụng.

QThời gian tồn tại (TTL) của bộ nhớ cache trong Claude Code là bao lâu?

AĐối với phiên bản đăng ký Claude Code, thời gian tồn tại mặc định của bộ nhớ cache là 1 giờ. Đối với Claude API, mặc định là 5 phút (có thể nâng lên 1 giờ với chi phí cao hơn). Còn Sub-agent luôn là 5 phút.

QNhững thao tác nào có thể làm gián đoạn hoặc đặt lại bộ nhớ cache?

ABa hành động chính có thể phá vỡ bộ nhớ cache là: 1) Chuyển đổi mô hình AI trong cuộc hội thoại. 2) Sử dụng chế độ 'Opus plan' (vì nó chuyển đổi mô hình giữa giai đoạn lập kế hoạch và thực thi). 3) Để cuộc hội thoại trống quá thời gian TTL (ví dụ: 1 giờ đối với Claude Code).

QNgười dùng nên có thói quen gì để tối đa hóa việc sử dụng bộ nhớ cache?

ABa thói quen chính là: 1) Không tạm dừng cuộc hội thoại quá lâu (trên 1 giờ). 2) Khi chuyển đổi nhiệm vụ, nên bắt đầu một phiên mới với bản tóm tắt chuyển giao thay vì cố gắng tiếp tục phiên cũ đã 'nguội'. 3) Đối với tài liệu lớn trong Claude.ai, nên đưa chúng vào Projects thay vì dán trực tiếp vào cuộc trò chuyện thông thường.

QBộ nhớ cache trong Claude Code được tổ chức thành những lớp nào?

ABộ nhớ cache được chia thành ba lớp: 1) Lớp Hệ thống (System layer): chứa hướng dẫn cơ bản, định nghĩa công cụ và phong cách đầu ra, được lưu cache toàn cục. 2) Lớp Dự án (Project layer): chứa CLAUDE.md, bộ nhớ và quy tắc dự án, được lưu cache theo từng dự án. 3) Lớp Hội thoại (Conversation layer): chứa tin nhắn và phản hồi, mở rộng theo từng lượt hội thoại.

Nội dung Liên quan

Vụ ly hôn của Choi Tae-won chính thức kết thúc: Tiết lộ tuyến kế thừa ẩn sau đế chế nghìn tỷ SK Hynix

Vào tháng 11/2024, trong một sự kiện kỷ niệm, Chủ tịch SK Group Choi Tae-won đã cho các con xem hình ảnh AI tái hiện người cha quá cố của mình, nhấn mạnh về việc kế thừa di sản. Trong bối cảnh SK Hynix trở thành tài sản trị giá nhất Hàn Quốc, câu chuyện kế thừa thế hệ thứ ba của tập đoàn này lại không đi theo kịch bản truyền thống. Choi Yun-jung (sinh 1989), trưởng nữ, được coi là ứng viên kế thừa rõ ràng nhất. Cô có nền tảng học thuật về sinh học, từng làm tư vấn, hiện đang học tiến sĩ và giữ chức vụ lãnh đạo tại SK Bioscience và bộ phận hỗ trợ tăng trưởng của SK Inc. Cuộc hôn nhân của cô với một doanh nhân khởi nghiệp AI cũng phản ánh sự thay đổi trong các mối liên kết giữa các giới tinh hoa. Choi Min-jung (sinh 1991), con gái thứ, có hành trình khác biệt: học đại học tại Bắc Kinh, tình nguyện gia nhập Hải quân Hàn Quốc và từng làm việc tại SK Hynix ở Washington về các vấn đề chính sách quốc tế. Cô hiện là nhà sáng lập một công ty chăm sóc sức khỏe AI và kết hôn với một cựu sĩ quan Thủy quân Lục chiến Mỹ, cho thấy mạng lưới toàn cầu và an ninh chuỗi cung ứng ngày càng quan trọng đối với các tập đoàn bán dẫn. Choi In-geun (sinh 1995), con trai trưởng, có lộ trình học vấn tương đồng với cha (vật lý) và đang làm việc tại McKinsey sau thời gian ở SK E&S. Dù mang hình mẫu người kế thừa truyền thống, anh lại là người ít lộ diện công khai nhất. Cuộc chiến ly hôn kéo dài giữa Choi Tae-won và vợ cũ Roh So-young, với giá trị tài sản tranh chấp lên tới hàng nghìn tỷ won, là bối cảnh phức tạp mà thế hệ thứ ba phải đối mặt. Cả ba người con đều đã đệ đơn lên tòa án trong vụ việc này, dù nội dung không được tiết lộ. Tóm lại, trong kỷ nguyên AI khi SK Hynix trở thành tài sản địa chính trị toàn cầu, việc kế thừa tại SK Group không còn là chuyện nội bộ gia đình hay chỉ xoay quanh cổ phần và quyền trưởng nam. Thế hệ thứ ba được định vị thông qua năng lực chuyên môn, mạng lưới quốc tế và khả năng giải quyết những thách thức của thời đại công nghệ và địa chính trị mới.

marsbit7 giờ trước

Vụ ly hôn của Choi Tae-won chính thức kết thúc: Tiết lộ tuyến kế thừa ẩn sau đế chế nghìn tỷ SK Hynix

marsbit7 giờ trước

Các ngân hàng phản đối thỏa thuận lợi suất stablecoin – Liệu Đạo luật CLARITY có thể giành được 60 phiếu?

Viện Chính sách Ngân hàng Hoa Kỳ (BPI) đã phản đối dự thảo Đạo luật CLARITY mới, chỉ ra những thiếu sót về quy định lợi suất stablecoin và chống tài trợ bất hợp pháp. Ngành ngân hàng muốn cấm hoàn toàn mọi hình thức khuyến khích từ stablecoin, trong khi dự thảo hiện tại chỉ cho phép dựa trên hoạt động tài khoản, không phải số dư nhàn rỗi. Sự phản đối này ảnh hưởng đến cơ hội thông qua đạo luật tại Thượng viện, nơi cần 60 phiếu. Sự ủng hộ từ đảng Cộng hòa có thể giảm xuống còn 49 phiếu nếu các Thượng nghị sĩ John Curtis và John Cornyn rút lại hỗ trợ, đòi hỏi 11 phiếu từ đảng Dân chủ. Tuy nhiên, một số nhà lập pháp Dân chủ ủng hộ tiền mã hóa cũng phản đối dự luật do lo ngại về đạo đức và chống rửa tiền. Lãnh đạo đa số Thượng viện John Thune tỏ ra hoài nghi về khả năng thông qua dự luật trước kỳ nghỉ tháng Tám, chỉ còn hai tuần. Cố vấn trưởng về Tiền mã hóa của Nhà Trắng, Patrick Witt, kêu gọi tiến hành bỏ phiếu ngay. Kỳ vọng thị trường về việc thông qua đạo luật trong năm 2026 đã giảm xuống còn 32%.

ambcrypto7 giờ trước

Các ngân hàng phản đối thỏa thuận lợi suất stablecoin – Liệu Đạo luật CLARITY có thể giành được 60 phiếu?

ambcrypto7 giờ trước

Giá trị gia tăng từ 88 tỷ lên 680 tỷ chỉ sau 2 tháng! OpenRouter, trạm trung chuyển AI lớn nhất sắp được mua lại

Theo tờ Wall Street Journal và The Information, Stripe - nền tảng thanh toán hàng đầu - đang đàm phán mua lại startup AI OpenRouter với giá khoảng 10 tỷ USD. Chỉ hai tháng trước, định giá của OpenRouter là 1,3 tỷ USD, tức giá chào mua cao hơn gần 7 lần. Thương vụ có thể được công bố trong vòng một tháng nhưng vẫn có nguy cơ đổ vỡ. OpenRouter hoạt động như một "trung tâm chuyển tiếp" AI, cung cấp một API duy nhất để các nhà phát triển truy cập vào hơn 400 mô hình lớn (như GPT, Claude). Nó tự động lựa chọn mô hình phù hợp dựa trên độ phức tạp, chi phí và tốc độ, giúp các ứng dụng AI tối ưu hóa hiệu quả chi phí. Được đồng sáng lập bởi Alex Atallah (cựu đồng sáng lập OpenSea), OpenRouter hiện có hơn 1 triệu nhà phát triển và doanh thu hàng năm đạt 50 triệu USD, tăng gấp 5 lần trong nửa năm. Đây là bước đi chiến lược tiếp theo của Stripe trong việc mở rộng sang hạ tầng AI, sau khi họ mua lại nền tảng định giá theo lượng sử dụng Metronome vào cuối năm 2025. Mục tiêu của Stripe là kết hợp khả năng định tuyến mô hình của OpenRouter với hệ thống thanh toán và đo lường sử dụng hiện có, để trở thành "trung tâm điều phối và thu ngân" toàn diện cho nền kinh tế AI. Điều này cho phép doanh nghiệp quản lý toàn bộ việc sử dụng và hóa đơn AI qua một nhà cung cấp duy nhất.

链捕手8 giờ trước

Giá trị gia tăng từ 88 tỷ lên 680 tỷ chỉ sau 2 tháng! OpenRouter, trạm trung chuyển AI lớn nhất sắp được mua lại

链捕手8 giờ trước

Từ OpenSea Đến OpenRouter: Kịch Bản “Chốt Lời Đỉnh Cao” Của Alex Atallah Lại Lặp Lại?

Tác giả: Nancy, PANews Hơn bốn năm trước, Alex Atallah rời đi trước đỉnh bong bóng NFT; giờ đây, anh lại tỏa sáng trong cơn sốt AI và chuẩn bị bán nền tảng tổng hợp mô hình AI OpenRouter với giá cao. Ngày 23/7, theo Wall Street Journal, gã khổng lồ thanh toán Stripe đang đàm phán mua lại OpenRouter, với định giá giao dịch có thể lên tới gần 100 tỷ USD. Nếu thành công, đây sẽ là lần thứ hai Alex Atallah xây dựng một công ty trị giá hàng trăm tỷ USD, sau sàn giao dịch NFT OpenSea. OpenRouter, được mô tả là "Stripe của lĩnh vực AI", đã kết nối hơn 400 mô hình AI, có khoảng 10 triệu người dùng và xử lý hơn 200 nghìn tỷ token mỗi tháng. Tuy nhiên, mô hình kinh doanh chủ yếu dựa vào phí dịch vụ nền tảng (5%-5.5%) từ việc gọi API, với doanh thu hàng năm khoảng 50 triệu USD (tính đến tháng 4/2026). Đây là một mô hình kênh dẫn có quy mô lớn nhưng biên lợi nhuận hạn chế, dễ bị ảnh hưởng bởi sự cạnh tranh, mô hình nguồn mở và áp lực giảm giá. Giá trị thực sự của OpenRouter đối với các nhà mua tiềm năng như Stripe có thể nằm ở kho dữ liệu sử dụng AI thực tế khổng lồ mà nó tích lũy được, cung cấp insights quý giá về hiệu suất mô hình, sở thích nhà phát triển và quan hệ thay thế trên thị trường. Từ NFT đến AI, Alex Atallah hai lần bắt đúng xu hướng thời đại. Việc OpenRouter được định giá 100 tỷ USD đặt ra câu hỏi: đây là sự định giá lại giá trị cơ sở hạ tầng AI hay một tín hiệu đỉnh chu kỳ mới? Thời gian sẽ trả lời.

链捕手8 giờ trước

Từ OpenSea Đến OpenRouter: Kịch Bản “Chốt Lời Đỉnh Cao” Của Alex Atallah Lại Lặp Lại?

链捕手8 giờ trước

Pons V2 mang đến các cặp giao dịch RWA khi Robinhood Chain mở rộng tham vọng

Pons, một launchpad được xây dựng trên Robinhood Chain, đã ra mắt bản nâng cấp V2 với các thay đổi nhằm cải thiện thanh khoản, loại bỏ hạn chế giao dịch và hỗ trợ tài sản thực được mã hóa (RWA). Bản cập nhật này diễn ra trong bối cảnh Robinhood Chain tiếp tục tăng trưởng nhanh, vượt 300 triệu USD tổng giá trị bị khóa và nổi lên như một trong những mạng Lớp 2 Ethereum sôi động nhất cho giao dịch đầu cơ. Pons V2 giải quyết các phàn nàn chính của người dùng về thanh khoản bằng cách giới thiệu đường cong liên kết định danh bằng ETH, đồng thời cho phép hầu hết ví giao dịch tự do. Cấu trúc phí cũng được thiết kế lại để nhà phát triển có thể nhận phí bằng ETH mặc định. Robinhood Chain đã thu hút sự chú ý của thị trường, với khối lượng DEX tích lũy vượt 9 tỷ USD, trong đó 80% đến từ memecoin rủi ro cao. Tuy nhiên, lợi nhuận tập trung vào số ít, với 63% nhà giao dịch thua lỗ. Việc Pons V2 bổ sung các cặp giao dịch RWA tùy chỉnh trực tiếp hỗ trợ trọng tâm phát triển tài sản thực của Robinhood Chain, có thể thúc đẩy việc áp dụng mạng lưới một cách hữu cơ trong tương lai.

ambcrypto8 giờ trước

Pons V2 mang đến các cặp giao dịch RWA khi Robinhood Chain mở rộng tham vọng

ambcrypto8 giờ trước

Giao dịch

Giao ngay

Bài viết Nổi bật

Làm thế nào để Mua PEOPLE

Chào mừng bạn đến với HTX.com! Chúng tôi đã làm cho mua ConstitutionDAO (PEOPLE) trở nên đơn giản và thuận tiện. Làm theo hướng dẫn từng bước của chúng tôi để bắt đầu hành trình tiền kỹ thuật số của bạn.Bước 1: Tạo Tài khoản HTX của BạnSử dụng email hoặc số điện thoại của bạn để đăng ký tài khoản miễn phí trên HTX. Trải nghiệm hành trình đăng ký không rắc rối và mở khóa tất cả tính năng. Nhận Tài khoản của tôiBước 2: Truy cập Mua Crypto và Chọn Phương thức Thanh toán của BạnThẻ Tín dụng/Ghi nợ: Sử dụng Visa hoặc Mastercard của bạn để mua ConstitutionDAO (PEOPLE) ngay lập tức.Số dư: Sử dụng tiền từ số dư tài khoản HTX của bạn để giao dịch liền mạch.Bên thứ ba: Chúng tôi đã thêm những phương thức thanh toán phổ biến như Google Pay và Apple Pay để nâng cao sự tiện lợi.P2P: Giao dịch trực tiếp với người dùng khác trên HTX.Thị trường mua bán phi tập trung (OTC): Chúng tôi cung cấp những dịch vụ được thiết kế riêng và tỷ giá hối đoái cạnh tranh cho nhà giao dịch.Bước 3: Lưu trữ ConstitutionDAO (PEOPLE) của BạnSau khi mua ConstitutionDAO (PEOPLE), lưu trữ trong tài khoản HTX của bạn. Ngoài ra, bạn có thể gửi đi nơi khác qua chuyển khoản blockchain hoặc sử dụng để giao dịch những tiền kỹ thuật số khác.Bước 4: Giao dịch ConstitutionDAO (PEOPLE)Giao dịch ConstitutionDAO (PEOPLE) dễ dàng trên thị trường giao ngay của HTX. Chỉ cần truy cập vào tài khoản của bạn, chọn cặp giao dịch, thực hiện giao dịch và theo dõi trong thời gian thực. Chúng tôi cung cấp trải nghiệm thân thiện với người dùng cho cả người mới bắt đầu và người giao dịch dày dạn kinh nghiệm.

Tổng lượt xem 799Xuất bản vào 2024.12.12Cập nhật vào 2026.06.02

Làm thế nào để Mua PEOPLE

Thảo luận

Chào mừng đến với Cộng đồng HTX. Tại đây, bạn có thể được thông báo về những phát triển nền tảng mới nhất và có quyền truy cập vào thông tin chuyên sâu về thị trường. Ý kiến ​​của người dùng về giá của PEOPLE (PEOPLE) được trình bày dưới đây.

活动图片