# 大语言模型的所有文章

在 HTX 新聞中心流覽與「大语言模型」相關的最新資訊與深度分析。潘蓋市場趨勢、專案動態、技術進展及監管政策,提供權威的加密行業洞察。

丘成桐邀王虹邓煜回国任教,清北斗了20年竟发现对手不是彼此

2026年7月,两位中国籍数学家王虹和邓煜同时获得菲尔兹奖,引发关注。他们均毕业于北京大学数学科学学院。著名数学家丘成桐随即公开邀请两位学者回国,到清华大学任教。 这背后是北大与清华在数学领域长达数十年的竞争。1952年院系调整后,清华数学系被并入北大,后者长期独领风骚。丘成桐早年曾致力于帮助北大,但因理念不合,特别是与弟子田刚的公开决裂后,于2009年转投清华,倾力建设清华的数学学科。他创办丘成桐大学生数学竞赛、设立数学领军人才计划,从初中生开始选拔培养,与北大展开对顶尖生源的激烈争夺。 两校的竞争从抢学生延伸到抢师资、争项目。清华引进了菲尔兹奖得主考切尔·比尔卡尔等海外人才,北大则凭借深厚的校友网络,召回了许晨阳、丁剑等杰出学者。如今,战火又烧至人工智能这一新领域。双方都认识到数学是AI突破的关键,清华系团队在智谱AI、月之暗面等大模型的数学能力上表现突出,北大则在几何定理证明等基础研究上深入探索。 尽管竞争激烈,但客观上推动了中国数学整体水平的提升。在2026年的丘成桐大学生数学竞赛中,北大包揽多项个人金奖,丘成桐在颁奖时却笑容以对,并呼吁跨校合作。他数十年来投身中国数学事业的初衷,始终是希望中国数学崛起。 文章最后指出,随着AI(如Anthropic的模型推翻古老猜想)飞速进入数学研究,正在改变学术范式。清北之间的传统竞争格局,在AI带来的新起跑线面前已被赋予新的含义。所有数学家都将共同面对这个由AI主导研究的新时代。

marsbit07/24 07:28

丘成桐邀王虹邓煜回国任教,清北斗了20年竟发现对手不是彼此

marsbit07/24 07:28

复刻“DeepSeek时刻”?华尔街齐称:Kimi K3 反而强化算力需求

市场将Kimi K3的发布视为“DeepSeek时刻2.0”,担忧其会削弱全球算力需求。然而,瑞银、野村、美银美林和花旗等华尔街投行的最新研报给出了截然不同的判断:Kimi K3不是算力需求的终结者,反而是加速器。 Kimi K3是由月之暗面于2026年7月发布的开源模型,拥有2.8万亿参数、1M token上下文窗口、常开推理和原生多模态能力,其规模与性能已接近Claude、GPT等海外前沿闭源模型。与更注重“效率”的DeepSeek R1不同,K3的“规模”特征显著,其庞大的参数、长上下文和MoE架构将推高推理、内存、网络和存储的整体需求。 投行核心观点认为:第一,模型能力逼近将加剧中美AI实验室的竞争,迫使各方投入更多算力以维持领先优势;第二,遵循“杰文斯悖论”,模型成本下降将刺激更多应用开发和token消耗,最终拉高算力需求;第三,K3等开源模型通常需要更长的上下文窗口,导致KV缓存占用更大,对HBM、服务器内存和存储的需求更强。 因此,Kimi K3的发布被解读为对AI基础设施价值链的利好。具体受益板块包括:存储(如美光、三星)、算力芯片(英伟达、台积电)、网络设备(光模块)以及云平台(阿里巴巴)。尽管市场短期可能出现波动,但中长期看,随着AI应用渗透和token使用量增长,算力及相关硬件需求依然强劲。唯一的尾部风险是,若模型效率提升速度远超工作负载增长,才可能导致基础设施需求回落。

链捕手07/21 06:11

复刻“DeepSeek时刻”?华尔街齐称:Kimi K3 反而强化算力需求

链捕手07/21 06:11

AI领走埃尔德什100美元赏金,44页顶刊没解的题,它一页纸答出

AI模型GPT-5.6在数学研究领域取得突破,以简洁证明解决了长期悬而未决的埃尔德什问题。1991年,数学家József Beck曾在顶刊《数学年刊》发表44页论文,部分解决了埃尔德什第119号问题中关于单位圆上零点多项式模的猜想,但第三问始终未解,并附有100美元赏金。如今,GPT-5.6与数学家Korsky合作,仅用一页纸就完成了该问题的证明,其方法并未依赖复杂新工具,而是通过巧妙的调和分析技巧,发现了被人类直觉忽略的更直接路径。 曼彻斯特大学研究员、埃尔德什问题网站维护者Thomas Bloom对此评价称,这并非推翻前人工作,而是找到了更优解法,表明某些难题的障碍可能源于人类研究习惯的局限。此前,AI在解决埃尔德什其他猜想(如Cycle Double Cover猜想)时也展现出类似特点:能坚持不懈地尝试多种变体,突破人类因“直觉性止损”而放弃的思路。 去年OpenAI曾因宣称GPT-5解决多个埃尔德什问题而引发争议,被指仅是复现已知文献。如今,随着GPT-5.6在多项数学评测中表现提升,并在ARC-AGI等衡量推理能力的基准测试中取得进展,关于“AI数学能力是否遇到瓶颈”的讨论也在持续。有观点认为,许多历史难题的“难”可能部分源于人类耐心的边界,而非纯粹的智力屏障,AI的持久探索能力正在重新定义难题的解决可能。

marsbit07/20 12:34

AI领走埃尔德什100美元赏金,44页顶刊没解的题,它一页纸答出

marsbit07/20 12:34

DeepSeek V4“满血版”曝光了,最快明天发布

DeepSeek V4正式版(或称“满血版”)预计最快于明日(2026年7月中旬)发布。该版本包含DeepSeek V4 Flash和DeepSeek V4 Pro两个型号。部分用户已获得灰度测试权限,可通过模型思维链第一人称是否为“I'm”或“I'll”来初步判断是否已用上新版。 根据早期测试者反馈,V4整体性能接近Claude Opus 4.8级别,编码能力直追GPT-5.6 Sol,Agent能力、3D和SVG生成均有显著提升。虽然其综合性能可能略逊于新发布的Kimi K3,且在部分任务中所需迭代轮数多于Fable 5,但预计其定价将具有显著优势。 官方将同步调整API定价,首次引入“峰谷计费”模式。其中,deepseek-v4-pro每百万输出tokens平时0.87美元,高峰1.74美元;deepseek-v4-flash每百万输出tokens平时0.28美元,高峰0.56美元。尽管这是DeepSeek首次实施差异化定价,但其价格相比Fable 5(百万输出50美元)等竞争对手依然极具竞争力,延续了其“价格屠夫”的定位。 目前,已有一些由V4生成的演示内容流出,包括3D模拟射击游戏、《我的世界》风格混合游戏HTML、经典“割绳子”游戏以及Xbox手柄SVG测试等,展示了其代码生成与创作能力。旧模型deepseek-chat和deepseek-reasoner将于7月24日正式下线。 总体而言,DeepSeek V4可能并非在单项性能上全面领先,但其策略在于以接近顶级模型的能力,提供远低于行业巨头的价格,有望再次创造“DeepSeek时刻”。

marsbit07/19 05:31

DeepSeek V4“满血版”曝光了,最快明天发布

marsbit07/19 05:31

活动图片