Capacidad de computación en apuros: Google impone silenciosamente un límite de uso de Gemini a Meta

marsbitXuất bản vào 2026-06-29Cập nhật gần nhất vào 2026-06-29

Tóm tắt

La creciente demanda global de infraestructura de IA está generando tensiones incluso entre los gigantes tecnológicos. Según informes, Google ha impuesto límites de uso de su modelo Gemini a Meta desde marzo, incapaz de satisfacer toda su demanda de capacidad computacional. Estas restricciones han causado retrasos en varios proyectos internos de IA de Meta, obligando a la empresa a optimizar su uso de recursos y a acelerar la migración hacia sus modelos propios, como Muse Spark. Google reconoce limitaciones en su capacidad, lo que está ralentizando su crecimiento en la nube. Para hacer frente a esto, ha firmado un acuerdo de arrendamiento de capacidad computacional con SpaceX por valor de 920 millones de dólares mensuales. El caso de Meta ejemplifica el cuello de botella generalizado que supone la carga de trabajo de inferencia de IA, un desafío crítico para toda la industria, que requiere inversiones masivas continuas en chips, centros de datos y energía.

Escrito por: Xu Chao

La contradicción entre la oferta y la demanda en la infraestructura de inteligencia artificial se está intensificando entre las principales empresas tecnológicas mundiales. Según informaron personas familiarizadas con el asunto, Google informó a Meta alrededor de marzo de este año que no podía satisfacer todas sus necesidades de capacidad de computación para Gemini, e impuso un límite de uso a este gigante de las redes sociales; incluso el mayor proveedor mundial de servicios de IA no puede hacer frente a la abrumadora demanda de capacidad de computación.

Según informó el Financial Times británico, esta restricción aún no se ha levantado y ha causado interrupciones y retrasos en varios proyectos internos de IA de Meta. Como resultado, Meta ha pedido a sus empleados que mejoren la eficiencia en el uso de la capacidad de computación de IA, implementando internamente un cálculo minucioso de los tokens de IA. Tanto Google como Meta se negaron a comentar al respecto.

Esta situación ha obligado a Google a acelerar su expansión. A principios de este mes, Google firmó un contrato de arrendamiento de capacidad de computación por 920 millones de dólares mensuales con SpaceX, propiedad de Elon Musk. Sundar Pichai, CEO de Google, admitió durante la conferencia de resultados del primer trimestre: "Recientemente, ciertamente hemos enfrentado limitaciones en capacidad de computación. Si pudiéramos satisfacer la demanda, los ingresos del negocio en la nube serían mayores."

Meta no es un caso aislado. Varias fuentes familiarizadas señalaron que otros clientes corporativos de Google también han sufrido restricciones en diversos grados, siendo Meta la más afectada debido a la escala excepcionalmente grande de su demanda. Este incidente refleja que el crecimiento explosivo de la carga de trabajo de inferencia de IA se ha convertido en uno de los mayores desafíos que enfrenta toda la industria.

La presión sobre el cuello de botella de la capacidad de computación continúa, los grandes clientes son los primeros afectados

Aunque las grandes empresas tecnológicas ya han invertido cientos de miles de millones de dólares en chips, centros de datos y suministro eléctrico, la oferta de capacidad de computación para IA aún no puede mantenerse al ritmo del crecimiento de la demanda.

Los ingresos del negocio en la nube de Google superaron por primera vez los 20 mil millones de dólares en el primer trimestre, y la acumulación de contratos en la nube firmados pero aún no entregados casi se duplicó en comparación con el trimestre anterior, superando los 460 mil millones de dólares. Pichai dejó claro que las restricciones en capacidad de computación persistirán en el corto plazo.

En este contexto, el impacto en Meta es particularmente notable. Según fuentes familiarizadas, fue precisamente la alta demanda de grandes clientes corporativos como Meta lo que impulsó directamente a Google a buscar aceleradamente fuentes externas de capacidad de computación. A medida que las empresas despliegan a gran escala chatbots, asistentes de programación y agentes de IA, la carga de trabajo de inferencia (es decir, el consumo de capacidad de computación al ejecutar tareas en aplicaciones prácticas después del entrenamiento del modelo) se está convirtiendo en el cuello de botella central de la industria.

Proyectos internos de Meta obstaculizados, acelerando la transición hacia modelos propios

Meta utiliza ampliamente Gemini internamente, cubriendo la revisión de seguridad de la plataforma (incluyendo la identificación de contenido fraudulento y la eliminación de información perjudicial), chatbots de servicio al cliente y asistencia publicitaria, así como parte de los flujos de trabajo internos y el desarrollo de código, complementándose al mismo tiempo con el uso de otros modelos como Claude de Anthropic.

Según fuentes familiarizadas, Meta inicialmente eligió Gemini porque su rendimiento superaba al de su modelo propio de código abierto, Llama. Sin embargo, con el endurecimiento de las restricciones de capacidad de computación, Meta está acelerando la migración hacia sus modelos propios. Varias fuentes indicaron que Meta recientemente ha comenzado a priorizar la promoción de su nuevo modelo Muse Spark, que se considera que ya puede competir en rendimiento con Gemini, ayudando a reducir la dependencia de modelos externos.

Mark Zuckerberg, CEO de Meta, ha continuado aumentando las inversiones en talento e infraestructura de IA, dedicándose a construir lo que él llama "superinteligencia personal". A diferencia de Google, Meta no tiene un negocio en la nube y está acelerando la construcción de su propio sistema de centros de datos, comprometiéndose a invertir un total de 600 mil millones de dólares en Estados Unidos para 2028.

Google se expande recurriendo a SpaceX, la industria busca soluciones

Ante la presión en capacidad de computación, Google firmó este mes con SpaceX un contrato de arrendamiento de capacidad de computación por 920 millones de dólares mensuales para suplir la brecha en infraestructura. El laboratorio de IA Anthropic también llegó a un acuerdo similar con SpaceX el mes pasado.

El hecho de que Google haya aplicado medidas restrictivas a Meta ofrece una ventana poco común para vislumbrar las presiones reales que enfrentan los principales proveedores mundiales de servicios de IA en la distribución de capacidad de computación. Actualmente, el cuello de botella de infraestructura de toda la industria de IA se está extendiendo desde el lado del entrenamiento hacia el de la inferencia, y la resolución de la contradicción entre oferta y demanda aún depende de la materialización de una nueva ronda de inversiones de capital a gran escala.

Câu hỏi Liên quan

Q¿Qué limitaciones ha impuesto Google a Meta respecto al uso de Gemini y qué impacto ha tenido?

AGoogle informó a Meta en marzo que no podía satisfacer toda su demanda de capacidad de cómputo para Gemini e impuso un límite de uso. Esta restricción, aún vigente, ha causado interrupciones y retrasos en varios proyectos internos de IA de Meta, obligando a la empresa a optimizar la eficiencia en el uso de la capacidad de cómputo y a racionar los tokens de IA internamente.

Q¿Qué acciones está tomando Google para abordar la escasez de capacidad de cómputo mencionada en el artículo?

AGoogle está acelerando sus esfuerzos de expansión. Una medida clave fue la firma de un contrato de arrendamiento de capacidad de cómputo por 920 millones de dólares mensuales con SpaceX, la empresa de Elon Musk. Además, el CEO Sundar Pichai reconoció en la reunión de resultados del primer trimestre que las limitaciones de capacidad de cómputo están afectando a los ingresos de su negocio en la nube.

Q¿Cómo está respondiendo Meta a las limitaciones de uso de Gemini impuestas por Google?

AMeta está acelerando la migración hacia sus propios modelos de IA para reducir la dependencia externa. En particular, está priorizando la promoción interna de su nuevo modelo Muse Spark, que se considera que tiene un rendimiento comparable al de Gemini. Además, Meta está incrementando las inversiones en infraestructura propia, con planes para invertir 600 mil millones de dólares en centros de datos en EE.UU. hasta 2028.

Q¿Qué revela el caso de las restricciones a Meta sobre los desafíos más amplios de la industria de la IA?

AEste caso pone de manifiesto la creciente presión sobre la capacidad de cómputo para IA, especialmente en la carga de trabajo de inferencia (el uso de modelos ya entrenados). Incluso un proveedor líder como Google lucha por satisfacer la demanda explosiva. El cuello de botella en la infraestructura se está extendiendo desde el entrenamiento de modelos hasta la inferencia, y resolver esta contradicción entre oferta y demanda requiere inversiones de capital a gran escala.

QSegún el artículo, ¿qué papel desempeña SpaceX en el actual ecosistema de capacidad de cómputo para IA?

ASpaceX está emergiendo como un proveedor importante de capacidad de cómputo de respaldo para grandes empresas de tecnología. Además del acuerdo con Google mencionado, el laboratorio de IA Anthropic también firmó un acuerdo similar con SpaceX el mes pasado. Estos contratos muestran que las empresas están buscando fuentes externas para complementar su infraestructura y aliviar la presión sobre sus propios recursos.

Nội dung Liên quan

Vụ ly hôn của Choi Tae-won chính thức kết thúc: Tiết lộ tuyến kế thừa ẩn sau đế chế nghìn tỷ SK Hynix

Vào tháng 11/2024, trong một sự kiện kỷ niệm, Chủ tịch SK Group Choi Tae-won đã cho các con xem hình ảnh AI tái hiện người cha quá cố của mình, nhấn mạnh về việc kế thừa di sản. Trong bối cảnh SK Hynix trở thành tài sản trị giá nhất Hàn Quốc, câu chuyện kế thừa thế hệ thứ ba của tập đoàn này lại không đi theo kịch bản truyền thống. Choi Yun-jung (sinh 1989), trưởng nữ, được coi là ứng viên kế thừa rõ ràng nhất. Cô có nền tảng học thuật về sinh học, từng làm tư vấn, hiện đang học tiến sĩ và giữ chức vụ lãnh đạo tại SK Bioscience và bộ phận hỗ trợ tăng trưởng của SK Inc. Cuộc hôn nhân của cô với một doanh nhân khởi nghiệp AI cũng phản ánh sự thay đổi trong các mối liên kết giữa các giới tinh hoa. Choi Min-jung (sinh 1991), con gái thứ, có hành trình khác biệt: học đại học tại Bắc Kinh, tình nguyện gia nhập Hải quân Hàn Quốc và từng làm việc tại SK Hynix ở Washington về các vấn đề chính sách quốc tế. Cô hiện là nhà sáng lập một công ty chăm sóc sức khỏe AI và kết hôn với một cựu sĩ quan Thủy quân Lục chiến Mỹ, cho thấy mạng lưới toàn cầu và an ninh chuỗi cung ứng ngày càng quan trọng đối với các tập đoàn bán dẫn. Choi In-geun (sinh 1995), con trai trưởng, có lộ trình học vấn tương đồng với cha (vật lý) và đang làm việc tại McKinsey sau thời gian ở SK E&S. Dù mang hình mẫu người kế thừa truyền thống, anh lại là người ít lộ diện công khai nhất. Cuộc chiến ly hôn kéo dài giữa Choi Tae-won và vợ cũ Roh So-young, với giá trị tài sản tranh chấp lên tới hàng nghìn tỷ won, là bối cảnh phức tạp mà thế hệ thứ ba phải đối mặt. Cả ba người con đều đã đệ đơn lên tòa án trong vụ việc này, dù nội dung không được tiết lộ. Tóm lại, trong kỷ nguyên AI khi SK Hynix trở thành tài sản địa chính trị toàn cầu, việc kế thừa tại SK Group không còn là chuyện nội bộ gia đình hay chỉ xoay quanh cổ phần và quyền trưởng nam. Thế hệ thứ ba được định vị thông qua năng lực chuyên môn, mạng lưới quốc tế và khả năng giải quyết những thách thức của thời đại công nghệ và địa chính trị mới.

marsbit12 phút trước

Vụ ly hôn của Choi Tae-won chính thức kết thúc: Tiết lộ tuyến kế thừa ẩn sau đế chế nghìn tỷ SK Hynix

marsbit12 phút trước

Các ngân hàng phản đối thỏa thuận lợi suất stablecoin – Liệu Đạo luật CLARITY có thể giành được 60 phiếu?

Viện Chính sách Ngân hàng Hoa Kỳ (BPI) đã phản đối dự thảo Đạo luật CLARITY mới, chỉ ra những thiếu sót về quy định lợi suất stablecoin và chống tài trợ bất hợp pháp. Ngành ngân hàng muốn cấm hoàn toàn mọi hình thức khuyến khích từ stablecoin, trong khi dự thảo hiện tại chỉ cho phép dựa trên hoạt động tài khoản, không phải số dư nhàn rỗi. Sự phản đối này ảnh hưởng đến cơ hội thông qua đạo luật tại Thượng viện, nơi cần 60 phiếu. Sự ủng hộ từ đảng Cộng hòa có thể giảm xuống còn 49 phiếu nếu các Thượng nghị sĩ John Curtis và John Cornyn rút lại hỗ trợ, đòi hỏi 11 phiếu từ đảng Dân chủ. Tuy nhiên, một số nhà lập pháp Dân chủ ủng hộ tiền mã hóa cũng phản đối dự luật do lo ngại về đạo đức và chống rửa tiền. Lãnh đạo đa số Thượng viện John Thune tỏ ra hoài nghi về khả năng thông qua dự luật trước kỳ nghỉ tháng Tám, chỉ còn hai tuần. Cố vấn trưởng về Tiền mã hóa của Nhà Trắng, Patrick Witt, kêu gọi tiến hành bỏ phiếu ngay. Kỳ vọng thị trường về việc thông qua đạo luật trong năm 2026 đã giảm xuống còn 32%.

ambcrypto19 phút trước

Các ngân hàng phản đối thỏa thuận lợi suất stablecoin – Liệu Đạo luật CLARITY có thể giành được 60 phiếu?

ambcrypto19 phút trước

Giá trị gia tăng từ 88 tỷ lên 680 tỷ chỉ sau 2 tháng! OpenRouter, trạm trung chuyển AI lớn nhất sắp được mua lại

Theo tờ Wall Street Journal và The Information, Stripe - nền tảng thanh toán hàng đầu - đang đàm phán mua lại startup AI OpenRouter với giá khoảng 10 tỷ USD. Chỉ hai tháng trước, định giá của OpenRouter là 1,3 tỷ USD, tức giá chào mua cao hơn gần 7 lần. Thương vụ có thể được công bố trong vòng một tháng nhưng vẫn có nguy cơ đổ vỡ. OpenRouter hoạt động như một "trung tâm chuyển tiếp" AI, cung cấp một API duy nhất để các nhà phát triển truy cập vào hơn 400 mô hình lớn (như GPT, Claude). Nó tự động lựa chọn mô hình phù hợp dựa trên độ phức tạp, chi phí và tốc độ, giúp các ứng dụng AI tối ưu hóa hiệu quả chi phí. Được đồng sáng lập bởi Alex Atallah (cựu đồng sáng lập OpenSea), OpenRouter hiện có hơn 1 triệu nhà phát triển và doanh thu hàng năm đạt 50 triệu USD, tăng gấp 5 lần trong nửa năm. Đây là bước đi chiến lược tiếp theo của Stripe trong việc mở rộng sang hạ tầng AI, sau khi họ mua lại nền tảng định giá theo lượng sử dụng Metronome vào cuối năm 2025. Mục tiêu của Stripe là kết hợp khả năng định tuyến mô hình của OpenRouter với hệ thống thanh toán và đo lường sử dụng hiện có, để trở thành "trung tâm điều phối và thu ngân" toàn diện cho nền kinh tế AI. Điều này cho phép doanh nghiệp quản lý toàn bộ việc sử dụng và hóa đơn AI qua một nhà cung cấp duy nhất.

链捕手21 phút trước

Giá trị gia tăng từ 88 tỷ lên 680 tỷ chỉ sau 2 tháng! OpenRouter, trạm trung chuyển AI lớn nhất sắp được mua lại

链捕手21 phút trước

Từ OpenSea Đến OpenRouter: Kịch Bản “Chốt Lời Đỉnh Cao” Của Alex Atallah Lại Lặp Lại?

Tác giả: Nancy, PANews Hơn bốn năm trước, Alex Atallah rời đi trước đỉnh bong bóng NFT; giờ đây, anh lại tỏa sáng trong cơn sốt AI và chuẩn bị bán nền tảng tổng hợp mô hình AI OpenRouter với giá cao. Ngày 23/7, theo Wall Street Journal, gã khổng lồ thanh toán Stripe đang đàm phán mua lại OpenRouter, với định giá giao dịch có thể lên tới gần 100 tỷ USD. Nếu thành công, đây sẽ là lần thứ hai Alex Atallah xây dựng một công ty trị giá hàng trăm tỷ USD, sau sàn giao dịch NFT OpenSea. OpenRouter, được mô tả là "Stripe của lĩnh vực AI", đã kết nối hơn 400 mô hình AI, có khoảng 10 triệu người dùng và xử lý hơn 200 nghìn tỷ token mỗi tháng. Tuy nhiên, mô hình kinh doanh chủ yếu dựa vào phí dịch vụ nền tảng (5%-5.5%) từ việc gọi API, với doanh thu hàng năm khoảng 50 triệu USD (tính đến tháng 4/2026). Đây là một mô hình kênh dẫn có quy mô lớn nhưng biên lợi nhuận hạn chế, dễ bị ảnh hưởng bởi sự cạnh tranh, mô hình nguồn mở và áp lực giảm giá. Giá trị thực sự của OpenRouter đối với các nhà mua tiềm năng như Stripe có thể nằm ở kho dữ liệu sử dụng AI thực tế khổng lồ mà nó tích lũy được, cung cấp insights quý giá về hiệu suất mô hình, sở thích nhà phát triển và quan hệ thay thế trên thị trường. Từ NFT đến AI, Alex Atallah hai lần bắt đúng xu hướng thời đại. Việc OpenRouter được định giá 100 tỷ USD đặt ra câu hỏi: đây là sự định giá lại giá trị cơ sở hạ tầng AI hay một tín hiệu đỉnh chu kỳ mới? Thời gian sẽ trả lời.

链捕手38 phút trước

Từ OpenSea Đến OpenRouter: Kịch Bản “Chốt Lời Đỉnh Cao” Của Alex Atallah Lại Lặp Lại?

链捕手38 phút trước

Pons V2 mang đến các cặp giao dịch RWA khi Robinhood Chain mở rộng tham vọng

Pons, một launchpad được xây dựng trên Robinhood Chain, đã ra mắt bản nâng cấp V2 với các thay đổi nhằm cải thiện thanh khoản, loại bỏ hạn chế giao dịch và hỗ trợ tài sản thực được mã hóa (RWA). Bản cập nhật này diễn ra trong bối cảnh Robinhood Chain tiếp tục tăng trưởng nhanh, vượt 300 triệu USD tổng giá trị bị khóa và nổi lên như một trong những mạng Lớp 2 Ethereum sôi động nhất cho giao dịch đầu cơ. Pons V2 giải quyết các phàn nàn chính của người dùng về thanh khoản bằng cách giới thiệu đường cong liên kết định danh bằng ETH, đồng thời cho phép hầu hết ví giao dịch tự do. Cấu trúc phí cũng được thiết kế lại để nhà phát triển có thể nhận phí bằng ETH mặc định. Robinhood Chain đã thu hút sự chú ý của thị trường, với khối lượng DEX tích lũy vượt 9 tỷ USD, trong đó 80% đến từ memecoin rủi ro cao. Tuy nhiên, lợi nhuận tập trung vào số ít, với 63% nhà giao dịch thua lỗ. Việc Pons V2 bổ sung các cặp giao dịch RWA tùy chỉnh trực tiếp hỗ trợ trọng tâm phát triển tài sản thực của Robinhood Chain, có thể thúc đẩy việc áp dụng mạng lưới một cách hữu cơ trong tương lai.

ambcrypto56 phút trước

Pons V2 mang đến các cặp giao dịch RWA khi Robinhood Chain mở rộng tham vọng

ambcrypto56 phút trước

Giao dịch

Giao ngay
活动图片