最新离线IQ测试显示,GPT-5.6在防作弊的专用题库中智商得分达到136分,首次突破130分的“天才线”。这意味着在标准化认知测试中,该模型的表现超越了约99%的人类。除了测试高分,实际应用中也展现出强大能力:开发者案例表明,GPT-5.6能快速生成复杂的物理模拟网页、构建多功能客服系统,并有效解决棘手的编程问题,体现了从“会做题”到“能办事”的进步。不过,智商测试主要衡量逻辑推理等特定能力,并不能全面反映模型在真实场景中的综合智能。当前成果虽引人注目,但距离真正的通用人工智能(AGI)仍有差距。
marsbit2026.07.16




