GPT-5.5突遭暗中降智,思考一到516就断,越难越翻车
GPT-5.5近期在处理复杂编程任务时,被开发者发现存在一个诡异的“516”断点现象:大量回复的推理过程会在达到516个思考令牌(Token)时突然中断,导致答案错误或不完整。数据显示,超过80%的此类精准516事件都发生在GPT-5.5上,而其他模型几乎不受影响。更令人担忧的是,在“516现象”恶化的同时,模型的整体推理强度反而显著下降,疑似存在隐藏的“推理预算上限”或截断机制,暗中限制了其深度思考能力。
此问题在开发者社区引发轩然大波,相关GitHub Issue收到大量用户反馈,质疑OpenAI是否为了控制成本而偷偷对高性能任务进行降级处理。此外,用户还抱怨GPT-5.5的回复风格变得过度格式化、好为人师且冗余,总是以项目列表、强制纠错和提供多个选项的方式回应,用户体验大打折扣。
开发者呼吁OpenAI对此现象给出明确解释:516究竟是一个正常的设计阈值、预算天花板,还是性能被降级的标志?目前的证据强烈指向GPT-5.5存在特定于自身的异常推理限制,使其在应对高难度任务时,从“得力助手”变成了一个可能半途而废的“格式化答题机器”。
marsbit07/05 23:58