# 大语言模型的所有文章

在 HTX 新闻中心浏览与「大语言模型」相关的最新资讯与深度分析。潘盖市场趋势、项目动态、技术进展及监管政策,提供权威的加密行业洞察。

拖更三年,北大校友翁荔最新长文刷屏

前OpenAI副总裁翁荔(Lilian Weng)发表了一篇关于AI扩展定律(Scaling Laws)的深度分析文章。文章指出,这条指导了AI行业数百亿美元投入的核心定律,远比人们想象的更为脆弱。 文章回顾了Scaling Laws的基本思想,即模型性能随规模扩大而可预测地提升。然而,OpenAI与DeepMind在关键问题上得出了相反结论:给定算力,资源应更多分配给模型还是数据?OpenAI的Kaplan团队认为模型增长应更快,而DeepMind的Chinchilla团队则认为应等比增长。后来研究发现,这一分歧源于参数统计口径的差异和实验规模不足,导致Kaplan的结论仅适用于小规模场景。 更关键的是,被行业广泛采纳的Chinchilla最优配比公式本身也存在方法论瑕疵。2024年有团队复现发现,其损失函数因取均值而非求和,导致优化器提前停止,输出并非最优解。此外,用于外推的关键参数精度不足,放大了误差。 文章进一步指出,经典Scaling Laws的根本前提——高质量数据无限供应——正在崩塌。数据重复训练不可避免,新研究引入了惩罚项来修正公式,并发现大模型对数据重复更敏感。这解释了行业为何转向强化学习、测试时计算和合成数据等新路径。 翁荔的博客以其清晰深入的技术解析著称,这篇文章历时三年完成。她于2025年联合创立了新公司Thinking Machines Lab。文章强调,下一代AI的进步不仅依赖算力规模,更取决于对这些基础定律细节更精确的理解与运用。

marsbit06/26 04:52

拖更三年,北大校友翁荔最新长文刷屏

marsbit06/26 04:52

20 岁创始人,招 18 岁员工,被 19 岁的人投资

这篇文章探讨了当前人工智能(AI)领域出现的“年轻化”现象。随着大模型技术的快速发展,行业对AI人才的争夺异常激烈,并出现了明显的年龄偏好。许多顶尖高校的应届生或在校实习生能够获得高达数百万人民币的年薪或数千元的日薪,其薪酬水平远超传统互联网行业的资深从业者。 文章指出,这种现象背后是“AI Native”概念的兴起。企业认为,更年轻、从小接触AI的从业者(多为00后)在思维模式、学习速度和创新能力上更具优势,能更快适应技术的快速迭代。相比之下,拥有多年工作经验但转型较慢的从业者可能面临被淘汰的风险。因此,大厂和初创公司都竞相提前锁定优秀学生,通过高薪、重要项目主导权、灵活扁平的管理模式以及密集的社交活动来吸引他们。 这种趋势形成了一个围绕“年轻”的利益循环:年轻研究员凭借成果获得高薪或创业机会;年轻的创业者更容易获得年轻投资人的青睐和融资;而成功的年轻团队又倾向于雇佣和信任更年轻的成员。这在一定程度上冲击了传统的、基于资历和经验的行业规则,但也加剧了人才竞争和行业内部分化。文章最后也反思了这种狂热背后的隐忧,即技术革命在厚赏“非凡”年轻人的同时,也可能对无法快速适应的“平凡”从业者施以严厉的惩罚。

marsbit06/23 04:01

20 岁创始人,招 18 岁员工,被 19 岁的人投资

marsbit06/23 04:01

智谱万亿了,DeepSeek还会远吗?

近日,中国大模型公司智谱在港股盘中市值突破1万亿港元,年内涨幅超1900%,总市值达1.1万亿港元,接近阿里巴巴一半、美团两倍。上市不到半年,其市值从500亿港元冲入万亿区间,引发市场对中国AI估值边界的广泛关注。 智谱市值飙升的直接催化剂是其GLM-5.2模型,市场将其视为“国产Anthropic”。全球AI估值锚因Anthropic在代码与企业Agent场景的商业化成功而抬升,智谱借此被重估。同时,马斯克与智谱创始人唐杰的隔空互动,进一步强化了国产模型参与全球前沿竞争的形象。 除智谱外,中国大模型行业资本动作频繁:DeepSeek新一轮融资后估值超500亿美元;MiniMax启动A股IPO;阶跃星辰和月之暗面也瞄准港股。港股市场正成为硬科技资产的再定价场所,资金集中涌入AI等稀缺赛道。 然而,智谱2025年营收仅7.24亿元,净亏损达47.18亿元,万亿市值引发“神话还是泡沫”的争论。市场一边承认估值高昂,一边追逐头部标的,泡沫与溢价共存。7月上旬,智谱和MiniMax将迎来限售股解禁,可能加剧股价波动。 行业的核心挑战在于商业化能力。智谱2025年收入同比增长131.9%,主要来自MaaS平台与企业级业务,并于2026年一季度对API服务提价。但研发开支高达31.8亿元,为收入的4倍多,亏损压力显著。整个中国市场调用量快速增长,IDC预计2026年MaaS调用量将达40000万亿Tokens,C端AI应用月活用户已超4.4亿,但用户规模不等同于盈利。 Anthropic预计在2026年二季度实现经营利润,若成真,将成为行业商业化转折的关键参照。中国大模型公司需证明能将模型能力转化为持续收入与现金流,才能支撑当前打开的估值边界。 智谱突破万亿市值是中国AI产业重估的标志性高点,但能否守住并形成行业曲线,最终取决于国产大模型厂商的商业化成果。

marsbit06/22 23:23

智谱万亿了,DeepSeek还会远吗?

marsbit06/22 23:23

AI 巨头的「Token 补贴大战」,快打完了吗?

AI巨头间的“Token补贴大战”正趋于白热化,但这场竞争的性质和可能结局与互联网时代的补贴战截然不同。 目前,OpenAI和Anthropic等公司的订阅套餐存在巨额补贴,高端套餐用户享受到的Token价值可能是其付费的数十倍。这种“逆向定价”旨在用亏损绑定重度用户和开发者。然而,与滴滴、美团等通过补贴建立用户锁定效应的模式不同,AI Token的切换成本极低——用户几乎可以无成本地在不同AI模型间迁移。这意味着补贴无法构筑护城河,一旦停止,用户可能迅速流失。 竞争格局呈现结构性不对称。谷歌凭借每年超3000亿美元的广告收入,拥有可持续补贴Token的“印钞机”,而OpenAI和Anthropic则依赖融资,未来上市后将面临盈利压力。Google Ventures创始人Bill Maris指出,谷歌完全有能力将Token价格再降80%,这将给竞争对手带来严峻挑战。 关于终局,文章认为存在两种可能:一是“互联网服务”剧本,通过补贴实现垄断后涨价;二是“水电煤”剧本,Token成为标准化基础资源,价格被压向成本线,利润率趋近于零。由于Token缺乏锁定效应,第二种可能性更大。这意味着AI竞争可能是一场没有明确赢家的“无限游戏”,参战者的核心目标是确保自己始终留在牌桌上,通过竞争共同推动技术普及和生态壮大。 最终,AI可能像电力一样,成为一种任何公司都无法独占的公共基础设施。这对用户而言或许是好事,只要补贴战持续,就能以极低成本享用强大算力。但对OpenAI和Anthropic等公司而言,它们所追逐的靠AI赚取暴利的梦想,可能从结构上就难以实现。

marsbit06/22 02:01

AI 巨头的「Token 补贴大战」,快打完了吗?

marsbit06/22 02:01

活动图片