文心4.5最强衍生模型发布,PaddleOCR-VL登顶OCR综合性能全球第一
2025-10-17

10月16日,百度正式开源其自研的多模态文档解析模型PaddleOCR-VL。在全球权威的文档解析评测榜单OmniBenchDoc V1.5中,该模型以92.6分的成绩荣登综合性能榜首。据悉,PaddleOCR-VL的核心模型参数仅0.9B,具有轻量高效的特点,能在极低的计算开销下,精准识别文本、手写汉字、表格、公式及图表等复杂元素。此外,该模型支持109种语言,覆盖中文、英语、法语、日语、俄语、阿拉伯语、西班牙语等多语种场景,可广泛应用于政企文档管理、知识检索、档案数字化及科研信息抽取等文档智能任务。