Nhắc nhở trang trọng! Mọi người đừng chờ đợi Gemini 3.5 Pro nữa, nếu không bạn đang chờ đợi một con tàu ở sân bay vậy.
Tháng 5 năm nay, tại Google I/O, trong slide thuyết trình chính có một hình ảnh:
Gemini 3.5 Pro - Coming next month.
Theo kế hoạch ban đầu, mô hình này lẽ ra phải đảm nhận nhiệm vụ tái xung kích vào cuộc cạnh tranh tiên phong AI của Google.
Suy cho cùng, trong bối cảnh OpenAI và Anthropic liên tục nâng cao khả năng mô hình, dòng Gemini Pro luôn là thước đo quan trọng để thế giới bên ngoài đánh giá sức mạnh AI của Google.

Ai ngờ được, rồi sau đó chẳng có gì cả.
Chúng ta đã chờ đợi 3.6 Flash, 3.5 Flash-Lite và 3.5 Flash Cyber, nhưng bóng dáng của 3.5 Pro vẫn chẳng thấy đâu.
Giờ đã là giữa tháng 8 rồi đấy!
Google, bạn thực sự đang định nghĩa lại "tháng sau" là gì.

Thông tin chính thức là 3.5 Pro vẫn đang trong giai đoạn thử nghiệm kín với các đối tác hạn chế, không có tháng chính xác ra mắt; đồng thời Gemini 4 đã bước vào giai đoạn tiền huấn luyện.
Nhưng theo đánh giá của SemiAnalysis, tổ chức nghiên cứu độc lập chuyên về bán dẫn và AI, Gemini 3.5 Pro đã bị hủy bỏ một cách lặng lẽ.
Một mô hình flagship đến muộn
Dòng mô hình Pro từ trước đến nay luôn là mô hình flagship của Google, và Gemini 3.5 Pro vốn được kỳ vọng đảm nhận "nhiệm vụ lật ngược thế cờ" của Google trong cuộc cạnh tranh mô hình cao cấp.
Ba quý đầu năm ngoái, Gemini 3 Pro, Nano Banana Pro của Google hầu như đều nhận được những tràng pháo tay.
Theo một bản ghi nhớ nội bộ của OpenAI được The Information tiết lộ vào tháng 10 năm ngoái, Sam Altman cho biết:
Tiến bộ gần đây của Google trong lĩnh vực AI có thể mang lại một số áp lực kinh tế tạm thời cho công ty chúng tôi. Chúng tôi biết mình có một số việc phải làm, nhưng chúng tôi đang nhanh chóng đuổi kịp.
Tuy nhiên, như mọi người thường nói đùa, Google, OpenAI và Anthropic, ba nhà này thỉnh thoảng lại diễn cảnh "ba mươi năm ở phía đông sông, ba mươi năm ở phía tây sông".

Năm nay, Gemini của Google đột nhiên rơi vào tình trạng im hơi lặng tiếng.
Đầu tiên, Gemini 3.5 Pro sau khi đã được thông báo "ra mắt vào tháng tới" vẫn chưa xuất hiện cho đến nay.
Bên ngoài suy đoán, khả năng thực tế của mô hình này có thể không đạt được kỳ vọng ban đầu của Google.
SemiAnalysis cho rằng, khả năng của Gemini 3.5 Pro xấp xỉ với mức Claude Opus 4.5 của Anthropic (mô hình này đã được phát hành từ cuối tháng 11 năm ngoái rồi các bạn ơi).
Là giải pháp chuyển tiếp, Google đã tung ra nhiều mô hình Flash hơn.
3.6 Flash, 3.5 Flash-Lite và 3.5 Flash Cyber......
Nhưng từ các đánh giá công khai hiện tại, dòng Gemini Flash nhấn mạnh nhiều hơn vào tốc độ, chi phí và hiệu quả triển khai, trong các nhiệm vụ lập luận phức tạp, lập trình và Agent, vẫn còn khoảng cách với Muse Spark 1.2, Grok 4.5 và các mô hình mã nguồn mở ngành.
Theo các cách xếp hạng khác nhau, Gemini 3.6 Flash hiện đứng thứ tám hoặc thứ chín.

△
Điều này có nghĩa là, vấn đề Google đang đối mặt không chỉ là "thiếu một mô hình flagship" nữa.
Đến mức SemiAnalysis đưa ra một nhận định đau lòng:
"Chúng tôi cho rằng, Gemini 4 cũng khó mà cứu vãn tình thế."
Người sáng lập Brin trở lại buồng lái Gemini
Ngay khi Gemini đối mặt với áp lực, nội bộ Google cũng đang có những biến động.
Đặc biệt là sự biến động nhân sự cấp cao và nòng cốt kỹ thuật.
Người đoạt giải Nobel Demis Hassabis từ chức CEO Google DeepMind, chuyển giao hoàn toàn quyền quản lý hàng ngày của phòng thí nghiệm London, vai trò người phụ trách toàn bộ thương mại hóa Gemini, trở thành Chủ tịch DeepMind, Nhà khoa học trưởng Tập đoàn Alphabet;
CTO DeepMind cũ, Kiến trúc sư trưởng AI của Alphabet Koray Kavukcuoglu, thăng chức lên Phó chủ tịch cấp cao DeepMind (DeepMind không còn thiết lập CEO độc lập), báo cáo trực tiếp với Sundar Pichai;
Nhân viên số 30 của Google, lão tướng 27 năm công lao, Nhà khoa học trưởng Google Jeff Dean cùng bốn nguyên lão AI tập thể từ chức khởi nghiệp;
Một trong những nhà phát minh cốt lõi kiến trúc Transformer, Đồng phụ trách Gemini Noam Shazeer chuyển sang gia nhập OpenAI;
......
Vài năm qua, chiến lược AI của Google chủ yếu được thúc đẩy bởi Google DeepMind sau khi sáp nhập với Google Brain.
Việc điều chuyển lần này của Hassabis thường được hiểu là Google không hài lòng với chiến lược "ưu tiên nghiên cứu cơ bản dài hạn" của ông.
Trong bản ghi nhớ nội bộ nửa đầu năm 2026, đồng sáng lập Google Brin trực tiếp chỉ ra Gemini đang tụt hậu so với Claude và GPT ở các lĩnh vực mã hóa và thương mại hóa cấp doanh nghiệp.
DeepMind có thể tiếp tục khám phá học tăng cường, mô hình cơ bản và nghiên cứu khoa học AI, nhưng sau khi cuộc đua AI bước vào giai đoạn lặp nhanh, tốc độ, hiệu quả kỹ thuật và điều phối tài nguyên cũng trở thành các biến số then chốt.
Một điều quan trọng hơn - hiện tại, Brin còn bị Financial Times tiết lộ đã trở lại buồng lái, tham gia sâu trở lại vào các cuộc thảo luận chiến lược liên quan đến Gemini, và trở thành một trong những tiếng nói quan trọng về định hướng AI nội bộ Google.
Mặc dù ông không nhận được chức vụ quản lý chính thức mới nào, nhưng đây đã là sự can thiệp cường độ cao của vị đồng sáng lập Google này vào hoạt động kinh doanh cốt lõi AI sau nhiều năm.
Phải biết rằng, ngay từ năm 2019, Brin và đồng sáng lập Google khác là Page đã rút khỏi việc quản lý hàng ngày của Alphabet, công ty mẹ của Google.
Cả hai vẫn giữ các vị trí quan trọng trong hội đồng quản trị, nhưng đã từ chức các vị trí quản lý vận hành cụ thể tại Google.
Hai người thỉnh thoảng xuất hiện tại văn phòng của Alphabet ở thung lũng Silicon, chủ yếu là để tìm hiểu các kế hoạch "đặt cược khác (other bets)" mà Alphabet gọi là kế hoạch đặt cược dài hạn.

△
Từ đó, quyền lãnh đạo chính của công ty đã được giao cho "anh Phích".
Nhưng làn sóng AI 2.0 đã thay đổi tất cả.
Tháng 1/2023, chưa đầy hai tháng sau khi ChatGPT ra mắt, Google đã khẩn cấp triệu tập Page và Brin, tổ chức nhiều cuộc họp cấp cao về đợt tấn công dữ dội của ChatGPT.
Tháng 2 năm đó, Brin bắt đầu tự sửa code LaMDA.
Điều này ngay lập tức được hiểu là tín hiệu rõ ràng mà Google muốn truyền ra bên ngoài - đối mặt với mối đe dọa từ mô hình đối thoại ChatGPT của OpenAI, nội bộ Google đã rất sốt sắng.
Dưới áp lực, Google ít nhiều đã thúc đẩy cho ra đời dòng Gemini.
Tháng 12, tên của Brin cũng xuất hiện trong danh sách những người đóng góp cốt lõi cho mô hình lớn Gemini. Người ta nói rằng tần suất ông ấy viết code là "gần như hàng ngày".
Người sáng lập Stability AI, Emad Mostaque cũng đến xác nhận chuyện này, "ông ấy hỏi tôi về kiến trúc VAE và các vấn đề liên quan đến khuếch tán sâu".
Từ năm 2024 trở đi, cuộc chiến kéo co giữa các mô hình lớn trở nên khốc liệt hơn, OpenAI, Google, Anthropic lần lượt thống lĩnh, được mọi người gọi là bộ ba lớn nước ngoài.
Năm 2025, Google đã giành được vô số lời khen ngợi nhờ dòng Gemini 3 và Nano banana.

Tuy nhiên, từ đầu năm đến nay, mô hình mới Gemini không thấy đâu, mô hình cũ cũng như mất trí.
Mọi người vừa nói đùa vừa cảm thán:
Nếu bạn đã từng dùng Gemini trước đây, giờ dùng lại, bạn sẽ cảm thấy nó dường như đã mắc chứng Alzheimer vậy...
Tháng 4 năm nay, đối mặt với Mythos thần thánh của Anthropic, Brin đã tự dẫn đầu thành lập một đội đặc nhiệm khẩn cấp tại DeepMind, toàn lực đột phá vào AI Coding.
Nhưng đến nay dường như vẫn chưa phát huy tác dụng - ít nhất là trong thời điểm hiện tại, thông tin Google phát ra là như vậy.
Theo báo cáo, sau khi Jeff từ chức khởi nghiệp và Hassabis được điều chuyển, một số nhân viên DeepMind (đặc biệt là những người ở London) lo ngại văn hóa nghiên cứu sẽ tiếp tục bị ảnh hưởng bởi mục tiêu thương mại, trong đó không ít người đã nộp đơn từ chức hoặc thường xuyên tiếp cận các cơ hội bên ngoài.
Vấn đề thực sự của Google, có lẽ là phân bổ năng lực tính toán?
So với thời gian phát hành mô hình, thách thức lớn hơn có lẽ đến từ năng lực tính toán.
Ngày nay, cạnh tranh AI đã bước vào giai đoạn cạnh tranh cơ sở hạ tầng. Để huấn luyện một mô hình tiên phong, cần không chỉ thuật toán xuất sắc, mà còn phải khóa chặt trước tài nguyên tính toán quy mô lớn.
OpenAI, Anthropic, Meta và các công ty khác đều đang không ngừng mở rộng đầu tư vào năng lực tính toán, hy vọng đảm bảo đủ năng lực huấn luyện trong vài năm tới.
Về lý thuyết, Google có lợi thế của riêng mình.
Họ không chỉ sở hữu hệ thống chip TPU hàng đầu thế giới, mà còn có nguồn tài nguyên trung tâm dữ liệu khổng lồ.
Đặc biệt là giai đoạn hiện tại, cuộc đua AI đã từ cạnh tranh năng lực mô hình đơn thuần, bước vào cạnh tranh tổng hợp hiệu suất tổ chức, hệ thống kỹ thuật, vòng lặp dữ liệu cũng như tài nguyên năng lực tính toán.
Sở hữu điều kiện cơ sở mà hầu hết các công ty AI đều ngưỡng mộ, lợi thế của Google lẽ ra phải rõ ràng hơn mới đúng.
Nhưng SemiAnalysis cho rằng, vấn đề của Google nằm ở chỗ, họ không ưu tiên dành đủ tài nguyên cho đội ngũ mô hình tiên phong của chính mình.
Ví dụ mà SemiAnalysis đưa ra là, Google những năm gần đây liên tục cung cấp hỗ trợ tài nguyên TPU cho Anthropic.
Theo dự đoán, trong giai đoạn từ quý III/2026 đến quý IV/2027, hơn 20% lượng TPU xuất xưởng sẽ được bán trực tiếp cho Anthropic.
Con số này chưa tính đến lượng lớn tài nguyên TPU mà Google Cloud đã cho Anthropic thuê, cũng như quy mô hợp tác có thể tiếp tục mở rộng trong tương lai.

Đằng sau điều này hình thành một tình thế tế nhị.
Một mặt, Google hy vọng Gemini trở thành mô hình dẫn đầu toàn cầu, mặt khác lại thông qua hoạt động kinh doanh điện toán đám mây cung cấp cơ sở hạ tầng quan trọng cho đối thủ cạnh tranh.
Từ góc độ thương mại, doanh thu từ kinh doanh điện toán đám mây và mở rộng hệ sinh thái AI đều có giá trị.
Nhưng từ góc độ cạnh tranh mô hình, tài nguyên quý giá nhất của phòng thí nghiệm tiên phong, chính là năng lực tính toán.
Sở hữu tài nguyên đa chiều phong phú không có nghĩa là nhất định sẽ thắng trong cuộc cạnh tranh... hay nói cách khác, đối với các phòng thí nghiệm hy vọng đột phá vào AGI, quyền ưu tiên về năng lực tính toán tự nó đã là một lựa chọn chiến lược.
Google hiện tại cần trả lời lại một câu hỏi:
Trong thời đại AI, công ty sở hữu một trong những tài sản công nghệ mạnh nhất toàn cầu này, rốt cuộc nên tổ chức bản thân như thế nào?
One More Thing
Nhân tiện, một giai thoại nhỏ đầy tính tượng trưng.
Cộng đồng hải ngoại gần đây lan truyền ảnh chụp màn hình cho rằng, Google đang thử nghiệm trong phạm vi nhỏ một trang chủ không có nút "Google Search" độc lập.

Ngoài việc thúc đẩy tiến trình mô hình tiên phong, Google đã bắt đầu điều chỉnh sản phẩm cốt lõi nhất của chính mình trước.
Điều này có nghĩa là, Gemini AI sinh thành, nhiệm vụ hội thoại, sáng tạo đa phương thức, xử lý tài liệu mới là cổng vào cốt lõi trong tương lai?
Có thể lắm.
Vậy thì mô hình của bạn còn không nhanh lên đi, Google của tôi ơi???!
Bài viết này đến từ tài khoản công chúng WeChat "量子位", tác giả: Quan tâm công nghệ tiên phong





