GPT-5.6 Sol 视觉能力大幅提升,测试得分暴涨 3 倍
3 小时前

第三方机构Roboflow测试表明,GPT-5.6系列视觉能力显著提升。其中,Sol在目标检测得分从GPT-5.5的13.8分跃升至46.2分,Terra和Luna也表现不俗,计数准确率提高,在文档版面识别、密集场景计数等任务中表现突出。不过,Sol在定向提取文字信息方面较GPT-5.5有所退步,且存在大尺寸图片检测框偏移问题,可通过调高推理档位或缩小图片来改善。成本上,Sol约2.5美分/张,Terra约1美分/张,Luna不到0.5美分/张,而Gemini 3.5 Flash性价比更高。视觉大模型竞争焦点已从“能否看懂”转向“干活准不准”,性价比竞争已开启。