GPT diseña GPT

marsbit发布于2026-06-25更新于2026-06-25

文章摘要

OpenAI ha presentado su primer chip, Jalapeño, un cambio estratégico que va más allá de competir con Nvidia. La empresa busca controlar todo el proceso de producción de inteligencia artificial, desde los modelos hasta el hardware, la energía y los centros de datos. La brecha entre modelos líderes se está reduciendo, mientras que la ventaja competitiva se desplaza a capas más profundas: suministro de computación, costes de inferencia y eficiencia de sistemas. Cada token generado implica un costo, y OpenAI, con productos de gran consumo como ChatGPT, necesita reducir esta "tasa de inferencia" para fortalecer su rentabilidad y defensa competitiva a largo plazo. Jalapeño, un chip ASIC optimizado para inferencia de modelos de lenguaje, fue desarrollado en solo nueve meses con Broadcom. Este plazo résubevela la ventaja clave de OpenAI: utiliza su propio conocimiento interno sobre cómo se ejecutan sus modelos masivos en producción para guiar el diseño del hardware. Esencialmente, GPT ayuda a diseñar las máquinas que ejecutarán la próxima generación de GPT, creando un ciclo de retroalimentación potente. El enfoque en la inferencia es crucial porque, a diferencia del entrenamiento (una inversión puntual enorme), la inferencia consume el flujo de caja diario. Al optimizarla, OpenAI reduce costes operativos fundamentales para su escalabilidad comercial, especialmente con futuros agentes de IA que realizarán cadenas largas de razonamiento. Este movimiento refleja una ambición mayor: ...

OpenAI finalmente fabrica chips.

Muchos, al ver esta noticia, reaccionan pensando: NVIDIA está en problemas.

Pero yo veo precisamente lo contrario.

La importancia más crucial del primer chip, Jalapeño, no es enfrentarse directamente a NVIDIA.

Esta es la primera vez que OpenAI admite públicamente que no se conforma con ser solo una empresa de modelos.

Lo que quiere controlar es todo el proceso de producción de inteligencia.

Desde el modelo, hasta el chip. Desde el centro de datos, hasta la energía. Desde el entrenamiento, hasta la inferencia. Desde la producción de Tokens, hasta su venta.

Jalapeño, superficialmente es un chip, pero en realidad se parece más a una hoja de ruta.

OpenAI finalmente ha puesto su ambición sobre la mesa.

I. La brecha en modelos se reduce, la brecha en computación se amplía

Desde que estallaron los grandes modelos, casi toda la atención de la industria de la IA ha estado en los modelos.

GPT-4 sorprendió a la industria una vez, luego Claude alcanzó, Gemini alcanzó, DeepSeek demostró su relación calidad-precio, Meta abrió el código. Cada lanzamiento, todos miran lo mismo: parámetros, rankings, capacidad de código, habilidad matemática, contexto largo, multimodalidad.

Los modelos son importantes, por supuesto. Pero está ocurriendo un cambio: la ventana de ventaja en modelos se está acortando. Hoy un modelo acaba de lanzarse y, en meses, la comunidad de código abierto, competidores y proveedores de la nube lo alcanzan. La brecha de capacidad aún existe, pero cada vez es más difícil que constituya una barrera a largo plazo por sí sola.

Lo que realmente abre la brecha empieza a desplazarse hacia capas más profundas. Suministro de potencia de cómputo, costo de inferencia, rendimiento del sistema, capacidad de red, construcción de centros de datos, acceso a energía. No son tan llamativos como un lanzamiento de modelo, ni acaparan titulares de inmediato. Pero son los que determinan si una empresa de IA puede mantenerse a largo plazo.

Jensen Huang dijo recientemente: "Es posible que los sistemas NVIDIA no sean los de menor precio de compra, pero pueden generar los Tokens con menor costo, el mayor rendimiento de Tokens y, en última instancia, los mayores ingresos".

Las palabras de Huang son directas. La industria se queja de que NVIDIA es cara. Huang no se defiende en el precio de compra, sino que cambia el problema a otra dimensión: "No mires cuánto cuesta comprar la máquina, mira cuánto cuesta producir cada Token".

Este es el nuevo libro de cuentas de la era de la IA. Los servidores y las GPU no son la unidad final, el Token lo es.

OpenAI está justo en el centro de este problema.

ChatGPT procesa una enorme cantidad de solicitudes diariamente, Codex consume más pasos de inferencia, y en el futuro habrá Agent, generación de video, robots, cadenas de razonamiento largas. Cuanto más útil es el modelo, mayor es el consumo de Tokens. Cuanto más exitoso es el producto, más gruesa es la factura de inferencia.

Lo cruel está aquí: cuantos más usuarios tenga OpenAI, más dinero ganará NVIDIA. Cuanto más fuertes sean los productos de OpenAI, más pesado será el impuesto en la potencia de cómputo subyacente.

Si cada Token tiene que pasar por una plataforma de hardware externa y pagar un impuesto, es difícil que OpenAI tenga una barrera de defensa completa. Puede tener el modelo más fuerte, la superpuerta de entrada, el ecosistema de desarrolladores. Pero el costo de producción más central siempre está en manos de otro.

La esencia de Jalapeño está justo aquí. OpenAI comienza a construir su propia fábrica de Tokens.

II. GPT comienza a diseñar GPT

El detalle más fácilmente subestimado del chip Jalapeño es su flujo de fabricación de nueve meses.

Los proyectos tradicionales de ASIC de alto rendimiento suelen tener ciclos de 18 a 36 meses. Con procesos avanzados es más complicado: arquitectura, verificación, implementación física, empaquetado, pila de software, depuración... cualquier problema en algún eslabón multiplica rápidamente los costos. OpenAI y Broadcom redujeron el ciclo a nueve meses.

Esto no se puede interpretar como que la industria de los chips de repente se volvió simple. OpenAI no generó de la nada una cadena de suministro de semiconductores. Broadcom tiene una profunda experiencia en chips personalizados e infraestructura de red, Celestica se encarga de las tarjetas, bastidores y sistemas de ingeniería.

Lo que realmente aporta OpenAI es algo más escaso: sabe cómo van a ejecutarse los modelos futuros.

Muchas empresas de chips que fabrican aceleradores de IA tienen dificultades para adivinar la carga de trabajo. La estructura del modelo cambiará, la forma de inferencia cambiará, el modo de servicio cambiará. Una vez que un chip sale a producción, en el mundo físico no es tan fácil revertir cambios como en el software.

OpenAI no tiene que adivinar completamente. Ejecuta ChatGPT, Codex y la API diariamente, sabe qué núcleos se usan más, qué transferencias de memoria son más desperdiciadas, qué cuellos de botella de red afectan más la eficiencia del clúster, qué latencia daña directamente la experiencia del producto. También sabe cómo consumirán recursos de inferencia los futuros productos de Agent.

Este conocimiento antes era solo información de ingeniería en segundo plano; ahora se escribe en la arquitectura del chip.

En el comunicado oficial de OpenAI hay una frase clave: "OpenAI utilizó sus propios modelos para acelerar parte del proceso de diseño y optimización". También dice: "Los modelos que proporcionamos a los usuarios también están ayudando a mejorar la infraestructura que ejecutará futuros modelos".

GPT comienza a participar en el diseño de las máquinas para la próxima generación de GPT.

La cadena de los chips en las últimas décadas era: primero diseñar el chip, luego el chip ejecuta el software, y el software ejecuta la IA. Ahora la cadena comienza a dar la vuelta: la IA ayuda a los humanos a diseñar chips, y los chips ejecutan la próxima generación de IA.

Una vez que este ciclo se establezca, nueve meses pueden ser solo el comienzo. En el futuro, podrían ser seis meses, tres meses, o iteraciones aún más frecuentes.

La industria de chips tenía su propio ritmo, la industria de modelos tenía su propio ritmo. El primero era lento, el segundo rápido. Jalapeño acerca ambos ritmos.

Si este paso tiene éxito, el volante de inercia de OpenAI se volverá aterrador. Mejores modelos ayudan a diseñar mejores chips, mejores chips reducen el costo de ejecución de la próxima generación de modelos, costos más bajos sustentan más usuarios y productos, más usuarios y productos generan más datos de carga de trabajo real, y esos datos a su vez definen la próxima generación de chips.

Este es el ciclo que OpenAI realmente desea.

III. Reducir el impuesto de inferencia, controlar el flujo de caja

Jalapeño no es un chip de entrenamiento; está orientado a la inferencia de grandes modelos de lenguaje. Esto es clave.

El entrenamiento es como construir un portaaviones. Requiere una enorme inversión única, una capacidad general extremadamente fuerte y una adaptación constante a nuevos modelos, arquitecturas y experimentos. El mercado del entrenamiento sigue dependiendo en gran medida de NVIDIA, no solo por las GPU, sino por toda la plataforma: CUDA, red, sistema, bibliotecas de software, ecosistema de desarrolladores.

La inferencia se parece más a una flota de taxis. Corre todos los días, cada hora, cada minuto. Cada vez que un usuario hace una pregunta, la API responde una vez, un Agent avanza un paso, se produce inferencia. Está más preocupada por la baja latencia, el bajo costo, el alto rendimiento y la alta utilización.

El entrenamiento quema grandes cantidades de dinero en etapas; la inferencia quema el flujo de caja diario.

Este es también el problema más doloroso para las empresas de IA que llegan a la etapa comercial. Entrenar GPT una vez es caro, pero la inferencia ocurre todos los días. La era de los Agent amplificará este problema: una tarea puede contener decenas o incluso cientos de llamadas al modelo. El contexto largo, el razonamiento en cadena, la generación multimodal, la ejecución de código, siguen aumentando el consumo de Tokens.

Jalapeño apunta precisamente a este impuesto de inferencia. Se parece más al TPU propio de OpenAI. Google, Amazon, Meta, Microsoft han seguido caminos similares: si la carga de trabajo es lo suficientemente grande, el ASIC autodiseñado tiene sentido económico por su alta relación costo-beneficio.

OpenAI ahora cumple con estas condiciones. Tiene solicitudes reales, una hoja de ruta de productos, un equipo de modelos, socios industriales como Broadcom y una enorme presión de costos.

Jalapeño no necesita venderse externamente para demostrar su valor. Mientras haga que las respuestas de ChatGPT sean más baratas, que Codex funcione más rápido, que el margen de la API sea mayor, tiene sentido.

OpenAI también menciona que Jalapeño reducirá la transferencia de datos, equilibrará los recursos de cómputo, memoria y red, y hará que la utilización real se acerque más al pico teórico. La potencia de cómputo a menudo es cara porque no se utiliza plenamente: la GPU espera por la red, la transferencia de memoria ralentiza el cómputo, una programación deficiente causa ralentización, y todo el desperdicio finalmente se convierte en facturas de electricidad y gastos de capital.

El precio de compra es solo la primera capa; la eficiencia del sistema es la cuenta final.

IV. OpenAI se parece cada vez más a Apple

Muchos interpretarán a Jalapeño como OpenAI desafiando a NVIDIA, pero yo creo que OpenAI no quiere convertirse en la próxima NVIDIA, sino que está aprendiendo de Apple.

El punto más fuerte de Apple nunca ha sido un solo aspecto. El iPhone es fuerte, iOS es fuerte, los chips de la serie A y M son fuertes, la App Store es fuerte. Pero lo realmente difícil de superar de Apple es que todas estas cosas están dentro del mismo ciclo cerrado.

Los chips se optimizan para el sistema, el sistema se optimiza para las aplicaciones, y la experiencia de la aplicación a su vez define la siguiente generación de chips. Este ciclo cerrado permite a Apple, bajo las mismas limitaciones de batería, volumen y disipación de calor, crear experiencias difíciles de replicar para otros.

OpenAI está construyendo algo similar. El modelo es el núcleo de inteligencia, ChatGPT es la superpuerta de entrada, Codex es la herramienta de desarrollo, la API es la capa de distribución del ecosistema, Jalapeño es el chip autodiseñado, y el centro de datos es la fábrica de IA.

El CEO de OpenAI, Altman, ha hablado repetidamente en los últimos dos años sobre chips, energía, fusión nuclear, centros de datos. Ahora parece que no estaba persiguiendo conceptos; ya no está planificando OpenAI como una startup de IA.

Si NVIDIA vende palas, entonces OpenAI quiere poseer la mina.

NVIDIA quiere ser el proveedor de equipos de fábrica para todas las empresas de IA, vendiendo GPU, red, sistemas, ecosistema de software, soluciones para fábricas de IA. El cliente ideal es cualquier empresa que necesite producir Tokens.

OpenAI quiere construir su propia fábrica, no vender equipos, sino la inteligencia generada finalmente.

A corto plazo, OpenAI no puede prescindir de NVIDIA. El entrenamiento y la computación general aún requieren la plataforma GPU, y Jalapeño difícilmente cubrirá rápidamente todas las cargas de trabajo. Probablemente entrará primero en los escenarios de inferencia más seguros, de mayor escala y con mayor beneficio de optimización para OpenAI.

A largo plazo, la grieta ya ha aparecido. Cuando las empresas de modelos comienzan a tener su propia hoja de ruta de chips, los clientes de NVIDIA dejan de ser solo clientes. También se convertirán en otro tipo de jugador en la infraestructura de IA.

Más allá de la superficie

En los últimos veinte años, el activo más importante de Internet era el tráfico. Quien controlaba a los usuarios, controlaba el valor.

Hoy, en la era de la IA, está surgiendo una nueva regla.

Los modelos se parecen cada vez más al tráfico, y la computación se parece cada vez más a la tierra.

Los modelos evolucionarán, los productos cambiarán, los rankings se actualizarán constantemente. Pero las fábricas que producen inteligencia —chips, red, centros de datos, energía— se concentrarán cada vez más en manos de unos pocos jugadores.

GPT comienza a diseñar GPT, parece ser solo una fabricación de chips.

Pero lo que realmente anuncia es:

OpenAI ya no se conforma con ser la empresa más inteligente, quiere ser la empresa que controla la producción de inteligencia.

Este artículo proviene del WeChat Official Account:Más allá de la superficie, autor: Huahua

Este artículo proviene del WeChat Official Account:Más allá de la superficie, autor: Huahua, imagen del tema generada por IA

你可能也喜欢

格兰特·卡多恩将比特币持仓增至2700枚——为何是现在？

Grant Cardone旗下的Cardone Capital在市场低迷期增持比特币，持仓量增至约2700枚BTC，平均购买价格为59,000美元。尽管没有公开文件独立证实这一持仓规模，但按当前价格计算其价值约1.59亿美元。此次买入发生在比特币价格处于近期波动区间低位、年内已下跌约32%的背景下，Cardone视其为积累机会。与此同时，最大企业持仓者MicroStrategy（持有约847,363枚BTC）却改变了策略，首次正式授权可出售最多12.5亿美元的比特币以筹措资金，这打破了其长期“永不卖出”的承诺。六月，美国现货比特币ETF遭遇创纪录的净流出，约40.6亿美元被赎回，加剧了市场抛压。技术分析显示，比特币周线图上的布林带下轨（绿色线）目前提供了支撑，该位置历史上曾多次引发价格反弹，暗示市场可能正在接近阶段性底部。

ambcrypto16分钟前

ambcrypto16分钟前

AI 时代，比特币还剩什么呢？

作者认为，在AI时代，信息生成成本趋近于零，导致真实与虚假内容难以辨别，“可验证性”变得稀缺。与此对比，比特币虽然因能耗高被诟病，但其本质是消耗能源来确保账本历史的不可篡改，从而提供一种不依赖任何中心化信任、仅靠数学与全网节点即可验证的机制。文章将AI比作降低“创造”成本的现代印刷机，而区块链（如比特币）则像降低“验证”成本的复式记账法。两者并非竞争关系：AI负责高效生成内容，区块链负责为数字资产与记录提供去中心化的验证基础。因此，比特币可被视为一台“制造可验证性的机器”。在AI生成内容泛滥的未来，独立验证的事实可能成为新的价值所在。

链捕手30分钟前

链捕手30分钟前

Bitmine以太坊储备增至98亿美元："加密货币最好的年份尚未到来"

比特浸入科技（Bitmine Immersion Technologies）近期再次成为头条，其在一周内增持了27,084枚以太坊（ETH）。这使得其以太坊总持有量达到5,700,040枚，按每枚1,569美元计算，价值约90.1亿美元，占以太坊总供应量的4.7%。此次增持发生在以太坊价格从约1780美元下跌至1578.54美元（撰稿时）的一周内。同时，根据SoSo Value数据，以太坊ETF在整个六月大部分时间出现资金外流，总额达5.0139亿美元。针对疲软的市场状况，比特浸入科技董事长汤姆·李（Tom Lee）表示，近期市场对加密货币投资者颇具挑战，并指出临近季度末的“粉饰橱窗”行为导致投资者减持过去三个月表现不佳的资产是常见现象。此外，迈克尔·赛勒（Michael Saylor）的公司Strategy正面临持续审查，据报道其持有约140亿美元未实现亏损，而其普通股和优先股价格均跌破100美元水平，引发加密社区部分人士建议其停止扩张比特币持仓。由于比特浸入科技常被称为“以太坊的Strategy”，市场担忧其持续的以太坊积累行为可能面临类似困境与批评。目前上市公司共持有价值约749.4亿美元的比特币和114.8亿美元的以太坊，Strategy是最大的比特币持仓上市公司。然而，目前这些担忧仅是推测。比特浸入科技并非单纯积累以太坊，其每年质押收入估计达2.11亿美元，同时持有5.55亿美元现金及等价物以及488万枚质押的ETH。该公司还于6月26日被纳入罗素1000大型股指数。汤姆·李强调，公司计划稳步增长至2026年，并认为市场正开启新一轮牛市周期，代币化和人工智能的快速进展将推动区块链和去中心化加密领域的指数级需求增长。最终摘要： * 新增持后，比特浸入科技持有5,700,040枚ETH，价值约90.1亿美元。 * 尽管以太坊价格疲软、ETF资金外流且Strategy面临批评，比特浸入科技仍持续购入以太坊。

ambcrypto2小时前

ambcrypto2小时前

英国FCA公布加密资产监管规则手册：基于风险的方法将于2027年10月启动

英国金融行为监管局公布新的加密货币监管框架，采取风险为本方法而非“一刀切”规则，将于2027年10月生效。新规要求加密公司持有充足资本覆盖潜在损失，具体金额将根据其风险状况浮动，较小或风险较低的公司可减少信息披露负担以节省合规成本。企业需自行评估资产负债表风险并进行年度压力测试，以确定所需资本水平，FCA将审核评估结果但不强加统一规则。此举旨在提升市场信心，吸引额外300-400万英国用户使用加密货币。针对稳定币，FCA保留了基本框架但简化了部分合规要求，例如取消储备构成预测估算，同时强化消费者保护，要求储备资产置于法定信托下并允许最多5%的流通稳定币作为储备。大型系统性发行机构可能面临更严监管。监管机构强调新规为加密行业提供了明确性与稳健基础，但也有市场人士提醒，监管虽可增强保护、减少欺诈，但无法完全消除风险。FCA将于下月开始提供许可申请前支持会议，以协助企业适应新规。

ambcrypto3小时前

ambcrypto3小时前

你天天用的Claude和Codex，Meta内部不让随便用了

今年5月，Meta为其应用AI工程部门的工程师划定了红线：限制内部使用Claude Code和Codex这两款流行的AI编程工具，相关限制至今仍在生效。作为这些工具的主要客户之一，Meta此举并非因其不好用，而是恰恰相反——担心其过于强大和好用。 Meta正在自研名为MetaCode的AI编程助手，旨在替代外部模型以节省成本并掌握核心技术。限制使用外部模型的核心原因，是防止“蒸馏陷阱”：即担忧员工在构建MetaCode的训练数据、编程题库和评测标准时，过度依赖或掺入Claude/Codex的输出。这会导致自研模型在不知不觉中学习对手的“本事”和判断标准，使能力来源模糊，并可能违反与OpenAI、Anthropic等竞争对手的服务条款，引发法律风险。内部指南明确禁止了可能让外部AI模型“定义能力”的三类任务：不能用其输出来生成测试题目、不能用其分析代码或设计测试点、其生成内容不得进入被测模型的访问环境。仅允许AI处理搭建工作流、整理文件等“打下手”的辅助性任务，且所有AI产出必须经过人工审核。这一事件揭示了AI行业的一个普遍困境：在利用强大外部工具加速自身研发的同时，如何清晰界定并守护自身模型能力的原创性，避免陷入知识产权与合同风险。随着AI参与创造AI的循环加深，“本事究竟是谁的”这条界线正变得越来越模糊。

marsbit3小时前

marsbit3小时前

交易

现货

GPT diseña GPT

文章摘要

热门币种推荐

相关问答

你可能也喜欢

格兰特·卡多恩将比特币持仓增至2700枚——为何是现在？

AI 时代，比特币还剩什么呢？

Bitmine以太坊储备增至98亿美元："加密货币最好的年份尚未到来"

英国FCA公布加密资产监管规则手册：基于风险的方法将于2027年10月启动

你天天用的Claude和Codex，Meta内部不让随便用了

交易

热门文章

如何购买PEOPLE

相关讨论

热门问答

热门分类

热门标签