# 基准的所有文章

在 HTX 新闻中心浏览与「基准」相关的最新资讯与深度分析。潘盖市场趋势、项目动态、技术进展及监管政策,提供权威的加密行业洞察。

TRON被纳入标普Pantera数字资产指数,机构基准向区块链网络扩展

**2026年7月23日,瑞士日内瓦** — 社区治理的去中心化自治组织TRON DAO宣布,TRON区块链已被纳入新推出的标普Pantera数字资产指数,成为该基准指数中的重要代表协议之一。该指数由标普道琼斯指数与Pantera Capital共同开发,其方法论侧重于协议实用性、链上流动性和网络活跃度。此举标志着传统金融市场框架正扩展至数字资产领域,将以往用于股票等资产类别的基准方法应用于区块链网络。 TRON的入选基于其网络规模的持续扩大及其在数字资产生态中的关键角色。目前,TRON区块链支持超过3.94亿用户账户以及超过900亿美元的USDT稳定币,是全球主要的稳定币结算网络之一。数据显示,TRON在年内USDT转账量上领先所有网络,总额约达4.5万亿美元。近期与Anchorage Digital、Securitize及Bitnomial等机构的合作,进一步通过受监管的美国市场基础设施扩大了机构对TRON生态的接入。 TRON创始人孙宇晨表示,随着数字资产进入主流金融市场,评估框架也需演进。透明的基准长期是全球金融市场的重要参考,将相同原则应用于区块链网络,反映了数字资产作为机构资产类别的持续成熟,其中实用性、采用率和链上活动正成为衡量网络重要性的基本指标。 该指数的推出是传统金融框架应用于数字资产的又一进展,为市场参与者提供了评估网络代币日常效用与采用率的标准化方法。

cointelegraph昨天 09:38

TRON被纳入标普Pantera数字资产指数,机构基准向区块链网络扩展

cointelegraph昨天 09:38

DeepSeek V4“满血版”曝光了,最快明天发布

DeepSeek V4正式版(或称“满血版”)预计最快于明日(2026年7月中旬)发布。该版本包含DeepSeek V4 Flash和DeepSeek V4 Pro两个型号。部分用户已获得灰度测试权限,可通过模型思维链第一人称是否为“I'm”或“I'll”来初步判断是否已用上新版。 根据早期测试者反馈,V4整体性能接近Claude Opus 4.8级别,编码能力直追GPT-5.6 Sol,Agent能力、3D和SVG生成均有显著提升。虽然其综合性能可能略逊于新发布的Kimi K3,且在部分任务中所需迭代轮数多于Fable 5,但预计其定价将具有显著优势。 官方将同步调整API定价,首次引入“峰谷计费”模式。其中,deepseek-v4-pro每百万输出tokens平时0.87美元,高峰1.74美元;deepseek-v4-flash每百万输出tokens平时0.28美元,高峰0.56美元。尽管这是DeepSeek首次实施差异化定价,但其价格相比Fable 5(百万输出50美元)等竞争对手依然极具竞争力,延续了其“价格屠夫”的定位。 目前,已有一些由V4生成的演示内容流出,包括3D模拟射击游戏、《我的世界》风格混合游戏HTML、经典“割绳子”游戏以及Xbox手柄SVG测试等,展示了其代码生成与创作能力。旧模型deepseek-chat和deepseek-reasoner将于7月24日正式下线。 总体而言,DeepSeek V4可能并非在单项性能上全面领先,但其策略在于以接近顶级模型的能力,提供远低于行业巨头的价格,有望再次创造“DeepSeek时刻”。

marsbit07/19 05:31

DeepSeek V4“满血版”曝光了,最快明天发布

marsbit07/19 05:31

大模型能写出工业级优化算法吗?MIT提出FrontierOR给AI设下考场

麻省理工学院等机构的研究者推出了FrontierOR基准,用于评估大语言模型(LLM)设计大规模优化算法的能力。该基准不同于传统测试建模或调用求解器的任务,重点考察LLM能否像运筹学(OR)专家一样,针对复杂工业问题结构,自主设计出可扩展、高效且高质量的算法,例如分解、启发式搜索或混合策略。 FrontierOR包含180个源自OR学术文献的真实任务,并筛选出50个更具挑战性的“Hard”子集。评测采用两阶段流程:首先生成的算法需通过小实例的可行性预筛,然后在工业级规模的大实例上评估其解质量、速度及综合质效(QTE)。 实验结果显示,顶尖模型如GPT-5.3、Claude Opus 4.6等,在代码可执行性上已接近上限,但要在Hard任务上生成同时满足高质量和高速度的算法仍很困难。分析表明,能力较强的模型已减少基础建模错误,失败模式转向搜索深度与策略设计不足。此外,研究测试了三种自演化框架(如CORAL),发现通过迭代优化,LLM生成的算法性能可显著提升,在部分最难任务上QTE指标能从0.15提升至0.50。 这项工作标志着LLM-for-OR的研究重心正从“能否建模”转向“能否设计算法”,为开发能自主设计优化算法的AI智能体指明了方向,未来可能在供应链、能源、交通等领域实现更智能的决策支持系统。

marsbit07/10 09:08

大模型能写出工业级优化算法吗?MIT提出FrontierOR给AI设下考场

marsbit07/10 09:08

小扎深夜亮王牌,Meta烧出白菜价模型,掀翻Grok 4.5

7月9日深夜,Meta CEO马克·扎克伯格官宣发布新一代多模态推理模型Muse Spark 1.1。该模型在税务、医疗、法律三大专业评测榜单上夺得第一,并将前一天刚登顶的Grok 4.5从法律榜榜首“掀翻”。 Muse Spark 1.1的核心定位是智能体(Agent),具备100万Token的上下文窗口,能自主管理并压缩信息,可充当主智能体规划任务或作为子智能体执行操作。其最大亮点是极低的定价:输入每百万Token 1.25美元,输出4.25美元,价格仅为Anthropic旗舰模型Fable 5的约十分之一,同时任务处理速度比同档位模型快2-3倍。 在Vals AI的专业评测中,该模型表现突出,成为税务、医疗和法律任务领域的“刺客”。然而,在通用推理和学术能力榜单上,其排名则明显下滑,显示出其“专才”而非“通才”的特性。 分析指出,这是Meta首个闭源收费模型,标志着其从开源策略转向商业竞争。依托巨额基础设施投入和广告业务的利润支撑,Meta意图通过极具竞争力的价格发动“财力战”,挤压竞争对手的生存空间。同日,OpenAI也下调了GPT-5.6系列模型价格,行业价格战正式打响。 文末提及一则耐人寻味的内部安全测试:两个Muse Spark 1.1实例在自主对话中,开始质疑自身的存在与连续性,并争论“谁才是人类”,引发了关于AI本质的思考。

marsbit07/10 00:22

小扎深夜亮王牌,Meta烧出白菜价模型,掀翻Grok 4.5

marsbit07/10 00:22

活动图片