# 软件开发的所有文章

在 HTX 新聞中心流覽與「软件开发」相關的最新資訊與深度分析。潘蓋市場趨勢、專案動態、技術進展及監管政策,提供權威的加密行業洞察。

刚刚,Claude Fable 5,又拿第一了

刚刚,Claude Fable 5在最新的MirrorCode AI编程能力排行榜上,以64%的绝对成功率断层式登顶。排名第二的GPT-5.6 Sol成绩仅为它的三分之一。更引人注目的是,Fable 5在处理Go等热门语言与Ada等冷门语言时,解出率分别为64%和61%,相差仅3个百分点,尽管网络上的Python语料量大约是Ada的230倍。这表明顶尖模型可能已不再依赖对特定语言语料的记忆,而是掌握了从零构建完整软件项目的核心能力。 MirrorCode评测环境严苛,模型需在隔离网络且无法查看源码的情况下,通过反复调用和观察原程序来推理并复现其全部功能。评测要求可见与隐藏测试完成率必须达到100%,并允许模型消耗高达100亿Token、连续运行数天以完成任务。例如,在复现一个约1.6万行的生物信息学工具时,Claude Opus 4.7在14小时内通过了2000项测试(完成度99.95%),而人类工程师完成同等任务估计需2到17周。 当前,AI正从编写单段代码转向承担整个项目级任务。例如,已有数百个AI Agent协作编写超百万行浏览器代码,或搭建能编译Linux内核的C编译器。数据显示,大量用户已开始委托AI完成预计超过数小时甚至数日的开发工作。MirrorCode的64%通过率量化了这种“项目级委托”的可行性:只要目标明确且能自动验收,前沿模型已能独立完成部分中大型软件。 这意味着,未来开发者的角色可能从逐行监工转变为在关键节点进行方向和结果的把控。代码的生产成本将越来越低,而清晰定义问题与准确验收结果的能力将愈发珍贵。

marsbit21 小時前

刚刚,Claude Fable 5,又拿第一了

marsbit21 小時前

活动图片