在Tracking AI最新的防作弊离线IQ测试中,GPT-5.6多个版本均获得136分,首次突破人类“天才线”130分,超越全球99%的人类,表现远超其他AI模型。实测表明,GPT-5.6在物理模拟、搭建客服系统、修复代码bug等任务中表现出色,能将解题能力与实操能力相结合。不过,IQ测试仅是其智能的一个方面。