# 释放的所有文章

在 HTX 新聞中心流覽與「释放」相關的最新資訊與深度分析。潘蓋市場趨勢、專案動態、技術進展及監管政策,提供權威的加密行業洞察。

DeepSeek V4“满血版”曝光了,最快明天发布

DeepSeek V4正式版(或称“满血版”)预计最快于明日(2026年7月中旬)发布。该版本包含DeepSeek V4 Flash和DeepSeek V4 Pro两个型号。部分用户已获得灰度测试权限,可通过模型思维链第一人称是否为“I'm”或“I'll”来初步判断是否已用上新版。 根据早期测试者反馈,V4整体性能接近Claude Opus 4.8级别,编码能力直追GPT-5.6 Sol,Agent能力、3D和SVG生成均有显著提升。虽然其综合性能可能略逊于新发布的Kimi K3,且在部分任务中所需迭代轮数多于Fable 5,但预计其定价将具有显著优势。 官方将同步调整API定价,首次引入“峰谷计费”模式。其中,deepseek-v4-pro每百万输出tokens平时0.87美元,高峰1.74美元;deepseek-v4-flash每百万输出tokens平时0.28美元,高峰0.56美元。尽管这是DeepSeek首次实施差异化定价,但其价格相比Fable 5(百万输出50美元)等竞争对手依然极具竞争力,延续了其“价格屠夫”的定位。 目前,已有一些由V4生成的演示内容流出,包括3D模拟射击游戏、《我的世界》风格混合游戏HTML、经典“割绳子”游戏以及Xbox手柄SVG测试等,展示了其代码生成与创作能力。旧模型deepseek-chat和deepseek-reasoner将于7月24日正式下线。 总体而言,DeepSeek V4可能并非在单项性能上全面领先,但其策略在于以接近顶级模型的能力,提供远低于行业巨头的价格,有望再次创造“DeepSeek时刻”。

marsbit07/19 05:31

DeepSeek V4“满血版”曝光了,最快明天发布

marsbit07/19 05:31

刚刚,Anthropic发布Sonnet 5,性能接近Opus 4.8,但不一定更便宜

Anthropic 正式发布了 Claude Sonnet 5 模型,称其为迄今为止最具 Agent 属性的 Sonnet 模型,能够在制定计划、使用工具(如浏览器、终端)方面自主运行,其能力水平接近数月前需要更大、更昂贵模型(如 Opus 4.8)才能达到的程度。 相比前代 Sonnet 4.6,Sonnet 5 在推理、工具使用、编程和知识工作等关键维度性能有显著提升。在智能体搜索和计算机使用评测中,其性能曲线表明,在中等努力程度下成本效率显著提升,在更高努力程度下某些任务性能可媲美 Opus 4.8。用户可根据任务需求灵活调整“努力程度”以平衡成本与性能。 安全评估显示,Sonnet 5 在拒绝恶意请求、抵御提示注入攻击、降低幻觉和谄媚行为率方面整体优于 Sonnet 4.6,但失当行为率仍略高于 Opus 4.8 和 Mythos Preview。该模型未针对网络安全任务专门训练,其开发软件漏洞等危险网络能力显著弱于 Opus 4.8,因此 Anthropic 为其默认启用了网络安全护栏。 定价方面,即日起至2026年8月31日提供尝鲜价:输入每百万token 2美元,输出每百万token 10美元。之后恢复为标准定价:输入3美元,输出15美元。Anthropic 同步上调了各平台的速率限制以适应更高“努力程度”模式。需注意,Sonnet 5 采用了新tokenizer,相同内容映射的token数量约为以前的1.0-1.35倍,尝鲜价旨在使过渡期整体使用成本大致持平。 开发者上手反馈称其速度很快且针对Agent优化,在浏览器使用场景下抵御提示注入攻击的能力(成功率仅0.93%)显著优于Opus 4.8(31.5%)和Sonnet 4.6(50.7%)。但也有分析指出,由于token使用量增加,其每项任务运行成本约为2.29美元,比Sonnet 4.6高约2倍,也比Opus 4.8高出约15%,成为运行成本最高的模型之一。

marsbit07/01 00:35

刚刚,Anthropic发布Sonnet 5,性能接近Opus 4.8,但不一定更便宜

marsbit07/01 00:35

GPT5.6惨遭切脑,Fable 5回归要变弱鸡版?

近日,AI领域两大巨头OpenAI和Anthropic的最新顶级模型遭遇重大监管介入。OpenAI刚刚推出的GPT-5.6系列被拆分为Sol(前沿模型)、Terra(均衡模型)和Luna(经济模型)三个版本。其中性能最强的Sol版本并未全面发布,其访问权限被限制在“获批名单”内,绝大多数用户需等待数周才能逐步使用。此举源于监管机构在全美AI安全框架落地前,对具备“类似Mythos”能力的尖端模型进行预先管控。 在此之前,Anthropic的Fable 5模型经历了更剧烈的风波。该模型发布仅72小时后即被全球禁用,原因是其底层技术Mythos在一次闭门演示中展示了强大的网络攻击能力,例如能找出银行系统漏洞并清空账户。经过安全审查,Mythos 5仅向极少数“信任伙伴”有限开放。据报道,即将回归的Fable 5将是“阉割版”,安全护栏被大幅加强,可能导致能力下降和用户体验受限。 行业观察指出,严格的监管可能迫使AI公司对模型进行“脑叶切除”般的深度限制,以通过安全审查。这引发了开发者对“货不对板”的担忧:用户最终获得的可能是一个能力被严重削弱、反应僵化的“傀儡”,而非当初期待的“天才”。同时,模型的获取方式也可能从“付费即用”变为需要严格身份验证或额外收费。这一系列事件标志着AI发展进入“算法配给制”时代,引发对创新与安全平衡的广泛讨论。

marsbit06/29 08:37

GPT5.6惨遭切脑,Fable 5回归要变弱鸡版?

marsbit06/29 08:37

刚刚,Claude Mythos 5发布,5000万行代码1天搞定

Anthropic正式发布了其最强大的大模型Claude Mythos 5,并推出了面向公众的安全版本Claude Fable 5。两者核心能力相同,但Fable 5在检测到高风险请求(如网络安全攻击、生化风险)时会自动降级使用旧模型Opus 4.8来回应,超过95%的会话不受影响。价格定为每百万输入Token 10美元,输出50美元。 技术方面,Fable 5在多项评测中表现出色:在软件工程基准SWE-bench Pro获得80.3%高分,并能在一天内完成原本需两个月的5000万行代码库迁移。其原生视觉能力可仅凭截图通关《宝可梦》游戏。在长上下文、记忆能力和金融法律等复杂分析任务上也实现显著突破。 官方透露,未完全开放的Mythos 5在生物医药领域展现出强大自主性,能独立执行生物学家工作流,其设计的蛋白质靶向复合物已有多个进入真实药物研发管线。 AI学者Ethan Mollick的测试显示,新模型的工作模式发生根本转变:人类从需要精细操控的“巫师”变为只需提出宏观需求的“甲方”,模型能自主规划并执行长达数小时的多步骤复杂项目。 此次发布也标志着前沿AI进入“权限时代”,最强能力伴随更严格的安全审查(如30天数据留存)。模型在提供强大生产力的同时,其自主性也引发了关于人类角色演变的思考。

marsbit06/10 00:23

刚刚,Claude Mythos 5发布,5000万行代码1天搞定

marsbit06/10 00:23

活动图片