谷歌DeepMind发布GenCeption视觉模型
2026-07-21

2026年7月20日,谷歌DeepMind发布GenCeption模型,创新性地将预训练视频生成器逆向改造为多任务视觉分析引擎。该模型基于阿里巴巴开源的通义万相Wan2.1系列开发,通过一次前向传播即可完成深度估计、3D姿态估计、图像分割等多项视觉任务,显著提高了处理速度和效率。GenCeption的训练数据主要来自合成视频,却展现出强大的泛化能力,能够处理真实场景中的多人视频及未见过的动物、机器人等类别。