全球榜首!百度新开源模型PaddleOCR-VL登顶HuggingFace Trending

10月17日,HuggingFace 官网显示,百度昨晚发布的自研多模态文档解析模型 PaddleOCR-VL,发布16小时内即登顶 HuggingFace Trending 全球第一。

PaddleOCR-VL 核心模型参数仅0.9B,轻量高效,能以极低计算开销精准识别文本、手写汉字、表格、公式、图表等复杂元素,支持109种语言。

在权威榜单 OmniDocBench V1.5中,它以92.6分获综合性能全球第一,四大核心能力全线 SOTA,超越 GPT-4o 等模型,刷新 OCR VL 模型性能纪录。

作为文心4.5衍生模型,PaddleOCR-VL 融合了 NaViT 动态分辨率视觉编码器与 ERNIE-4.5-0.3B 语言模型,实现了精度与效率双突破。

展开阅读全文

更新时间:2025-10-19

标签:科技   榜首   模型   全球   核心   性能   语言   汉字   高效   编码器   开销   精准

1 2 3 4 5

上滑加载更多 ↓
推荐阅读:
友情链接:
更多:

本站资料均由网友自行发布提供,仅用于学习交流。如有版权问题,请与我联系,QQ:4156828  

© CopyRight 2020- All Rights Reserved. Powered By bs178.com 闽ICP备11008920号
闽公网安备35020302034844号

Top