Tin Tức Nóng: Elon Musk Đưa Ra Grok 4.5 Mạnh Nhất, Giá Đỉnh Cấp Opus Giảm Sâu Như "Gãy Xương"

marsbitXuất bản vào 2026-07-09Cập nhật gần nhất vào 2026-07-09

Tóm tắt

SpaceXAI vừa ra mắt Grok 4.5, mô hình mạnh nhất của họ, hợp tác với Cursor. Nó được huấn luyện trên hàng chục nghìn GPU GB300 với dữ liệu lập trình chất lượng cao từ Cursor, tập trung vào "độ thông minh trên mỗi token". **Hiệu suất nổi bật:** - SWE Bench Pro: 64.7%, vượt Opus 4.7 (64.3%). - Terminal Bench 2.1: 83.3%, gần bằng GPT-5.5. - DeepSWE 1.0: 62.0%, vượt Opus 4.8. Xếp hạng 4 trên AAAI, đứng đầu về luật. **Ưu điểm chính: Tốc độ & Hiệu quả chi phí** - Tốc độ suy luận: 80 token/giây. - Hiệu quả: Giải quyết nhiệm vụ với số token ít hơn 4.2 lần so với Opus 4.8. - Giá cả: Nhập $2/triệu token, xuất $6/triệu token - rất cạnh tranh. **Thử nghiệm thực tế:** Grok 4.5 có thể tạo ứng dụng web, trò chơi 3D (như mô phỏng hệ mặt trời) chỉ từ mô tả ngắn, mặc dù một số bài kiểm tra cho kết quả chưa nhất quán. Elon Musk tuyên bố Grok 4.5 tương đương Opus 4.7 nhưng nhanh hơn nhiều, và hứa hẹn một bản nâng cấp đột phá vào tháng tới. Mục tiêu là cung cấp trí tuệ AI nhanh, rẻ và hiệu quả.

Grok 4.5, cuối cùng cũng đã hoàn thành bài thi!

Ngay lúc vừa rồi, SpaceXAI của Musk chấn động công bố mô hình cờ đỉnh mạnh nhất từ trước đến nay - Grok 4.5.

Lần này, SpaceXAI và Cursor đã hợp tác chặt chẽ.

Trên hàng chục nghìn con quái vật GB300, họ đã "luyện" ra con quái vật hiệu năng này được sinh ra dành riêng cho mã hóa và các tác nhân thông minh.

Bảng thành tích khá sáng giá——

  • SWE Bench Pro: Chiếm lĩnh 64.7%, chính diện đối đầu và vượt qua Opus 4.7 (64.3%);
  • Terminal Bench 2.1: Tăng tốc ầm ầm lên đến 83.3%;
  • DeepSWE 1.0: Đứng vững ở mức 62.0%, áp đảo mạnh mẽ Opus 4.8.

Musk thẳng thắn nói, "Grok 4.5 đại khái tương đương với Opus 4.7, nhưng nhanh hơn nhiều".

Năng lực, tốc độ, chi phí - ba yếu tố chồng lấn, mới là sức cạnh tranh của nó. Có nghĩa là, lượng Token nó sử dụng để làm việc, chỉ là con số lẻ của người khác.

Giá nhập của Grok 4.5 là $2 / triệu token, giá xuất là $6 / triệu token.

So với Opus 4.8, tiêu hao Token giảm mạnh 4.2 lần.

Hàng vạn cục GB300, luyện ra một "Cấp Opus"

Grok 4.5, là lá bài chủ lực đầu tiên của SpaceXAI sau khi lên sàn, cũng là bài kiểm tra đầu tiên họ cùng Cursor nộp lên.

Vậy, nó được luyện như thế nào?

Câu trả lời là, một đợt huấn luyện siêu quy mô với hàng chục nghìn GPU GB300 của NVIDIA. Nhưng chất đống sức mạnh tính toán, chỉ là tấm vé vào cửa.

Musk báo trước: Tuần sau ngữ cảnh Grok 4.5 nâng cấp lên 1 triệu

Nơi SpaceXAI thực sự đổ sức mạnh chết người, là dữ liệu.

Họ đã lọc, loại bỏ trùng lặp và chấm điểm chất lượng một cách khắt khe đối với lượng ngữ liệu khổng lồ, đảm bảo mỗi "ngụm" đưa vào mô hình đều là nội dung chuyên môn với mật độ thông tin cao.

Sau đó, họ đặt trọng tâm của RL vào một chỉ số ít người nhắc đến - "Trí tuệ trên mỗi Token" (per-token intelligence).

Việc Cursor tham gia, là mắt xích then chốt nhất trong bánh xe này.

Nền tảng của Grok 4.5 là V9 (1.5T), theo giới thiệu chính thức, khi huấn luyện đã được "đút" vào hàng nghìn tỷ dữ liệu của Cursor.

Những dữ liệu này ghi lại cách các nhà phát triển thực tế tương tác với kho mã, với công cụ, với các tác nhân thông minh.

Điều này có nghĩa, mô hình không chỉ học được "mã trông như thế nào", mà còn "con người và AI cùng nhau viết mã ra sao".

Còn ngăn xếp huấn luyện của nó, được thiết kế cho tính bất đồng bộ cao——

Tác nhân thông minh có thể chạy liên tục hàng giờ đồng hồ, mô hình vừa làm việc vừa tiếp tục học, quá trình huấn luyện trên hàng chục nghìn GPU không ngừng nghỉ.

Kết quả là, nó không chỉ biết giải bài, mà còn có thể chịu được các dự án phức tạp nhiều bước trong các nhiệm vụ dài hàng giờ đồng hồ.

Bằng GPT-5.5, Áp Sát Opus 4.8

Hiệu năng cứng nhắc của Grok 4.5 dưới cách đánh huấn luyện này, tuyệt đối chịu được sự kiểm nghiệm.

Trên các bảng xếp hạng kỹ thuật cốt lõi, biểu hiện của nó có thể dùng từ "Ổn" để hình dung - không phải mạnh nhất, nhưng đủ để lọt vào nhóm đầu.

Trên DeepSWE 1.0, nó đạt 62.0%, vượt qua Opus 4.8 (55.75%), cắn chặt GPT-5.5 (64.31%);

Trên Terminal Bench 2.1, nó lao lên 83.3%, chỉ kém GPT-5.5 (83.4%) có 0.1!;

Trên SWE Bench Pro khó nhằn hơn, nó vượt qua GPT-5.5 (58.6%) với tỷ lệ giải quyết 64.7%, áp sát Opus 4.8 (69.2%).

Trong bài kiểm tra chính thức của AAAI, Grok 4.5 xếp hạng tư, chỉ sau Fable 5, GPT-5.5, Opus 4.8.

Trong bài kiểm tra chuẩn cho tác nhân thông minh pháp lý Harvey, xếp hạng nhất.

Phải nói, bảng thành tích này rất đáng gờm.

Nhưng phải thừa nhận, chiếc ngai sắt đang ngồi vững vàng hiện tại, vẫn là Claude Fable.

Tóm lại, Grok 4.5 về cơ bản bằng với GPT-5.5, áp sát Opus 4.8, nhưng cách trần nhà thực sự vẫn còn một khoảng cách.

Bản thân Musk cũng nói rất thực tế: "Đánh giá nội bộ của chúng tôi là, Grok 4.5 đại khái tương đương với Opus 4.7, nhưng nhanh hơn nhiều".

Vũ khí sát thủ thực sự: Vừa Nhanh Vừa Rẻ

Đòn bạo lực thực sự của Grok 4.5, ẩn giấu trong ba từ: tốc độ, hiệu suất và giá cả.

Tốc độ suy luận của nó lên đến 80 TPS (Token mỗi giây), lời gốc chính thức là "còn nhanh hơn cả các mô hình flash".

Chỉ với một câu nói, nó đã viết ra một mô phỏng 3D hệ mặt trời bằng Three.js:

Hỗ trợ tăng tốc thời gian, chuyển động quỹ đạo của tám hành tinh chân thực, ngay cả bảng điều khiển HUD cũng được làm khá chỉn chu.

Về hiệu suất, trong nhiệm vụ SWE Bench Pro, Grok 4.5 trung bình chỉ xuất ra 15,954 Token là đã giải quyết vấn đề.

Còn Opus 4.8 làm việc tương tự, trung bình phải "nhả" ra 67,020 Token.

4.2 lần, Grok 4.5 sử dụng chưa đến một phần tư Token của đối thủ, đã hoàn thành cùng một bài toán kỹ thuật.

Về giá, nhập mỗi triệu Token 2 USD, xuất mỗi triệu Token 6 USD.

Ngoài ra còn có một phiên bản cao cấp nhanh hơn, định giá nhập $4 / xuất $18.

So với hàng loạt mô hình đỉnh cao khác động chạm mười mấy USD trở lên, mức giá này gần như đã giảm chi phí đến mức gần như "gãy xương".

Ba con số chồng lên nhau, kết luận chỉ là một câu:

Trong chuyện "mỗi đơn vị thời gian, mỗi đơn vị chi phí có thể mua được bao nhiêu trí tuệ", Grok 4.5 hiện tại chính là "vua tỷ lệ hiệu suất/chi phí".

Kiểm Tra Thực Tế Toàn Mạng: Biểu Hiện Thực Sự Của Grok 4.5

Ngoài ra, từ phản hồi kiểm tra thực tế của đông đảo cư dân mạng, có thể nhìn thấy một góc năng lực thực sự của Grok 4.5.

Một câu nói, xuất ngay "Minecraft".

Trong một tệp HTML riêng biệt, Grok 4.5 có thể dễ dàng hoàn thành một trang SaaS cao cấp hoàn chỉnh.

Grok 4.5 thể hiện tài năng lớn, hoàn thành toàn bộ phương án thiết kế 2D+3D trong chưa đầy một phút ngay trong ứng dụng.

Chuyên gia game AI Danny Limanseta sử dụng Grok 4.5 để tạo ra một trò chơi, đầy đủ các chức năng.

Tuy nhiên, cũng có nhà phát triển cho biết, Grok 4.5 hoàn toàn không cùng trình độ với Opus 4.7, hiệu quả của bài kiểm tra đèn dung nham được tạo ra, rất tệ.

Không Phải Mạnh Nhất, Đang Đè Đợi Tháng Sau Lật Bàn

Hôm nay, Musk lại chôn một quả mìn:

Grok thông hiểu đạo lý kỹ thuật.

Phiên bản tháng sau sẽ là một lần nâng cấp nhảy vọt nữa, bởi vì chúng tôi đang trong Tesla, SpaceX, Neuralink và Boring Company, khép kín vòng tròn giải quyết các vấn đề kỹ thuật thực tế.

Tháng sau, lại một lần nhảy vọt nữa. Và theo tin đồn, một phiên bản lớn hơn với 2 nghìn tỷ tham số đang trên đường.

Chạy điểm, là pháo hoa cho người ngoài cuộc xem; hiệu suất và chi phí, mới là súng đạn thật kéo đối thủ vào trận chiến tiêu hao.

Khi trí tuệ của mô hình bắt đầu được tính phí như điện theo độ, chìa khóa thắng bại là ai có thể khiến trí tuệ trở nên vừa nhanh, vừa rẻ, lại vừa hiện diện khắp nơi.

Lần này, Musk không lấy lá bài mạnh nhất, nhưng lại lật bàn.

Tài liệu tham khảo:

https://x.ai/news/grok-4-5

https://cursor.com/blog/grok-4-5

Bài viết này đến từ tài khoản công chúng WeChat "Tân Trí Nguyên", tác giả: ASI Khải Thị Lục, biên tập: Đào Tử

Câu hỏi Liên quan

QMô hình Grok 4.5 có những đặc điểm nổi bật nào so với các đối thủ như Opus?

AGrok 4.5 nổi bật với hiệu suất tương đương Opus 4.7 (theo đánh giá nội bộ), nhưng tốc độ nhanh hơn và chi phí thấp hơn đáng kể. Nó tiêu thụ token ít hơn 4.2 lần so với Opus 4.8, với giá $2/triệu token đầu vào và $6/triệu token đầu ra, tạo ra lợi thế vượt trội về hiệu quả chi phí và tốc độ xử lý.

QGrok 4.5 đạt được thành tích gì trong các bài kiểm tra chuẩn về kỹ thuật và lập trình?

AGrok 4.5 thể hiện hiệu suất ấn tượng trong nhiều bài kiểm tra chuẩn: đạt 64.7% trên SWE Bench Pro (vượt GPT-5.5, gần Opus 4.8), 83.3% trên Terminal Bench 2.1 (gần bằng GPT-5.5), và 62.0% trên DeepSWE 1.0 (vượt Opus 4.8). Nó cũng xếp thứ tư trong bài kiểm tra AAAI và đứng đầu trong bài kiểm tra tác nhân pháp lý Harvey.

QSpaceXAI và Cursor đã hợp tác như thế nào để đào tạo Grok 4.5?

ASpaceXAI hợp tác với Cursor, sử dụng hàng nghìn GPU GB300 của NVIDIA để huấn luyện quy mô lớn. Mô hình được "nuôi" bằng hàng nghìn tỷ dữ liệu từ Cursor, ghi lại tương tác thực tế giữa nhà phát triển với kho mã, công cụ và tác nhân AI. Phương pháp này giúp Grok 4.5 hiểu không chỉ cú pháp mà còn cả quy trình hợp tác viết mã giữa người và AI.

QƯu điểm chính về hiệu quả và tốc độ của Grok 4.5 là gì?

AƯu điểm chính của Grok 4.5 là tốc độ cao (80 TPS - token mỗi giây), hiệu quả token vượt trội và chi phí thấp. Trong các nhiệm vụ SWE Bench Pro, nó chỉ cần trung bình 15.954 token để giải quyết vấn đề, ít hơn 4.2 lần so với 67.020 token của Opus 4.8. Kết hợp với mức giá thấp, nó trở thành lựa chọn có tỷ lệ 'thông minh trên mỗi đơn vị thời gian và chi phí' tốt nhất hiện nay.

QElon Musk đã hé lộ kế hoạch gì cho tương lai của Grok sau phiên bản 4.5?

AElon Musk tiết lộ rằng phiên bản Grok vào tháng tới sẽ có một bước nhảy vọt khác, nhờ việc tích hợp và giải quyết các vấn đề kỹ thuật thực tế trong toàn bộ hệ sinh thái của ông (Tesla, SpaceX, Neuralink, Boring Company). Ngoài ra, một phiên bản tham số lớn hơn, lên đến 2 nghìn tỷ, cũng đang được phát triển, hứa hẹn nâng cao hơn nữa năng lực của mô hình.

Nội dung Liên quan

XRP đối mặt với mức pha loãng nguồn cung hàng năm 5,5% giữa lúc doanh thu của XRPL sụt giảm 81,6%

Nguồn cung XRP đang tăng 5,5% hàng năm do lượng token được giải phóng từ ví escrow vượt quá lượng được khóa lại. Theo báo cáo của 21Shares, điều này dẫn đến sự pha loãng ròng, khiến giá trị tài sản của người nắm giữ XRP giảm ròng 5,5% mỗi năm ở mức phí hiện tại. Để bù đắp mức tăng nguồn cung này, doanh thu mạng lưới cần tăng gấp khoảng 12.700 lần. Nhu cầu đối với XRP vẫn phụ thuộc nhiều vào việc sử dụng trực tiếp. Tiềm năng nằm ở việc mở rộng vai trò trong quản lý kho bạc, thanh toán và cung cấp thanh khoản, đặc biệt là trong thị trường thanh toán 16 nghìn tỷ USD. Việc các nhà đầu tư tổ chức công nhận XRP làm tài sản thế chấp cũng có thể là chất xúc tác quan trọng. Mặc dù mạng lưới XRPL xử lý 159,9 tỷ USD khối lượng giao dịch trong nửa đầu năm 2026, doanh thu báo cáo đã giảm mạnh 81,6% so với cùng kỳ, xuống còn 1,18 triệu USD. Sự sụt giảm chủ yếu đến từ phí pool hoán đổi và tiền bản quyền NFT. Đáng chú ý, chỉ 10,6% trong số doanh thu này gián tiếp có lợi cho người nắm giữ XRP thông qua việc đốt token. Một điểm sáng là stablecoin RLUSD của Ripple đã tăng trưởng mạnh, với tổng nguồn cung đạt 1,56 tỷ USD. Việc Aviva Investors ra mắt quỹ token hóa trên XRPL được Ngân hàng Trung ương Ireland phê duyệt đã củng cố thêm hoạt động thể chế trên mạng lưới.

cryptonews.ru1 phút trước

XRP đối mặt với mức pha loãng nguồn cung hàng năm 5,5% giữa lúc doanh thu của XRPL sụt giảm 81,6%

cryptonews.ru1 phút trước

Tín hiệu hiếm gặp trên biểu đồ Bitcoin chỉ ra sự khởi đầu của đợt tăng giá

Một tín hiệu hiếm gặp trên biểu đồ Bitcoin (BTC) vừa xuất hiện, sau khi tiền điện tử này ghi nhận một trong những tuần tăng mạnh nhất trong vài năm trở lại đây. Giá Bitcoin đã tăng từ 62.700 USD lên 79.500 USD, tương đương hơn 20% trong tuần qua. Động thái này tạo ra những cây nến tuần đảo chiều mạnh mẽ, tương tự như các điểm đảo chiều chính trong các chu kỳ trước như năm 2019 và 2023. Theo nhà phân tích thị trường Ali Martinez, những cây nến tuần tương tự thường xuất hiện gần cuối thị trường gấu và bắt đầu các giai đoạn bò mới. Đợt tăng giá gần đây gợi nhớ đến sự phục hồi của Bitcoin vào năm 2019, với mức tăng 32% trong một tuần sau một thị trường gảm dài hạn. Một tình huống tương tự cũng xảy ra vào tháng 1/2023 sau sự sụp đổ của FTX. Các nhà phân tích lưu ý rằng những cây nến tuần đảo chiều lớn thường xuất hiện trong các đợt bể nén ngắn, khi giá tăng buộc các nhà giao dịch bán khống phải đóng vị thế, từ đó thúc đẩy đà tăng. Trong khi đó, nhà phân tích Moustache chỉ ra rằng chỉ báo MACD trên khung thời gian hai tuần đang tiến gần đến điểm giao cắt tăng, một tín hiệu từng xuất hiện gần các mức đáy chính vào các năm 2015, 2018 và 2022. Ông nhận định tình hình hiện tại có thể là đáy thị trường năm 2026, báo hiệu sự khởi đầu của các đợt bứt phá tăng giá mới.

cryptonews.ru5 phút trước

Tín hiệu hiếm gặp trên biểu đồ Bitcoin chỉ ra sự khởi đầu của đợt tăng giá

cryptonews.ru5 phút trước

Công ty Zondacrypto biến mất, lãnh đạo mất tích, tiền của khách hàng bị đóng băng

Sàn giao dịch tiền điện tử Zondacrypto, từng là nền tảng hàng đầu tại Đông và Trung Âu, đã biến mất sau khi hai lãnh đạo cấp cao của công ty mất tích và hàng trăm nghìn người dùng bị khóa quyền truy cập vào tài sản của họ. Sự kiện này làm nổi bật rủi ro trong ngành công nghiệp tiền số, nơi lòng tin có thể tan biến nhanh chóng. Token ZND của sàn đã mất 99,9% giá trị và nền tảng ngừng hoạt động từ tháng 4/2026. Người sáng lập, Sylwester Suszek, được mệnh danh là "vua tiền điện tử", đã mất tích từ tháng 3/2022 trong hoàn cảnh bí ẩn và được cho là bị sát hại. Luật sư của ông, Przemysław Kral, tiếp quản nhưng cũng ngừng liên lạc từ tháng 4/2026. Luật sư đại diện khách hàng tuyên bố đây là một vụ lừa đảo. Công ty tuyên bố nắm giữ 4.500 Bitcoin nhưng phân tích blockchain từ Recoveris cho thấy số dư thực tế gần như bằng không, và hàng trăm triệu đô la đã được chuyển đi. Sàn từ chối cung cấp bằng chứng về dự trữ. Cơ quan giám sát Estonia đã thu hồi giấy phép của Zondacrypto vào cuối tháng 6/2026, ngay trước thời hạn chuyển đổi theo quy định MiCA của EU. Vụ việc hiện do Viện công tố Ba Lan điều tra như một phần của hoạt động tội phạm có tổ chức. Thủ tướng Ba Lan Donald Tusk cáo buộc công ty có liên hệ với các tập đoàn tội phạc Nga. Khách hàng hiện chỉ còn quan tâm đến số phận khoản tiền của họ và hai vị lãnh đạo mất tích.

cryptonews.ru5 phút trước

Công ty Zondacrypto biến mất, lãnh đạo mất tích, tiền của khách hàng bị đóng băng

cryptonews.ru5 phút trước

Cựu Đối tác Hack VC Công khai Tố cáo: Công ty Ép Làm việc Khi Bệnh, Trả thù Nhân viên Nghỉ việc

Cựu đối tác của Hack VC, Hsin-Ju Chuang, đã công khai tố cáo công ty trên mạng xã hội X. Cô cho biết dù mắc bệnh Graves (cường giáp) và mất ngủ nghiêm trọng, cô vẫn bị yêu cầu làm việc 13-14 giờ/ngày, 6 ngày/tuần. Khi cô muốn nghỉ việc, các lãnh đạo Hack VC bao gồm Alex Pack và Daniel Bulaevsky được cho là đã đe dọa "tẩy chay" trong ngành nếu cô không hoàn thành nhiệm vụ tổ chức một hội nghị lớn và các sự kiện tại Tuần lễ Blockchain Hàn Quốc. Áp lực cực độ này được cho là đã dẫn đến hành vi tự tử của cô. Sau khi rời công ty, cô còn gặp vấn đề với bảo hiểm y tế COBRA kéo dài gần 4 tháng, mà cô coi là một hình thức trả đũa. Hsin-Ju Chuang là nhân vật có tiếng trong ngành crypto, từng làm việc tại Stellar, là nhân viên đầu tiên của Solana phụ trách tăng trưởng, và sau đó trở thành đối tác toàn thời gian tại Hack VC. Cô tuyên bố đã sa thải luật sư của mình và từ chối mọi thỏa thuận hòa giải có điều khoản bảo mật, đồng thời sẽ công bố bằng chứng vào ngày 26/8. Hack VC đã phản hồi rằng họ quan tâm đến sức khỏe của cô nhưng có "sự bất đồng đáng kể" về diễn biến sự việc, và sẽ không bình luận chi tiết vì lý do riêng tư. Sự việc làm dấy lên cuộc thảo luận về văn hóa làm việc khắc nghiệt và sức mạnh của các mối quan hệ trong ngành công nghiệp crypto vốn đề cao sự tự do và chống kiểm duyệt.

marsbit23 phút trước

Cựu Đối tác Hack VC Công khai Tố cáo: Công ty Ép Làm việc Khi Bệnh, Trả thù Nhân viên Nghỉ việc

marsbit23 phút trước

Giao dịch

Giao ngay
活动图片