文心 4.5 衍生模型 PaddleOCR-VL 登顶 HF Trending 全球榜首

摘要

10 月 17 日消息,HuggingFace 官网显示,百度昨晚发布的自研多模态文档解析模型 PaddleOCR-VL,发布 20 小时内即登顶 HuggingFace Trending 全球第一。

10 月 17 日消息,HuggingFace 官网显示,百度昨晚发布的自研多模态文档解析模型 PaddleOCR-VL,发布 20 小时内即登顶 HuggingFace Trending 全球第一。

据了解,该模型核心参数仅 0.9B,轻量高效,能以极低计算开销精准识别文本、手写汉字、表格、公式、图表等复杂元素,支持 109 种语言。在权威榜单 OmniBenchDoc V1.5 中,它以 92.6 分获综合性能全球第一,四大核心能力全线 SOTA,超越 GPT-4o 等模型,刷新 OCR VL 模型性能纪录。

作为文心 4.5 衍生模型,PaddleOCR-VL 融合了 NaViT 动态分辨率视觉编码器与 ERNIE-4.5-0.3B 语言模型,实现精度与效率双突破。

 

最新文章

极客公园

用极客视角,追踪你不可错过的科技圈.

极客之选

新鲜、有趣的硬件产品,第一时间为你呈现。

张鹏科技商业观察

聊科技,谈商业。