引言:当OCR遇到大模型的技术进化
在金融数字化转型浪潮中,传统OCR技术已难以满足非结构化数据深度挖掘的需求。DeepSeek作为国产领先的金融大模型,与MinerU OCR引擎的深度融合,正在重新定义金融文档处理的边界。本文将详解基于"DeepSeek+MinerU"的混合架构设计。
MinerU是一款将PDF转化为机器可读格式的工具(如markdown、json),可以很方便地抽取为任意格式。 MinerU诞生于书生-浦语的预训练过程中,我们将会集中精力解决科技文献中的符号转化问题,希望在大模型时代为科技发展做出贡献。 相比国内外知名商用产品MinerU还很年轻,如果遇到问题或者结果不及预期请到issue提交问题,同时附上相关PDF。
一、技术选型对比:为什么选择DeepSeek?
1.1 大模型能力矩阵
| 模型 | 金融知识库 | 表格推理 | 指标关联 | 中文语境 |
|---|---|---|---|---|
| GPT-4 | ★★★☆ | ★★★☆ | ★★☆ | ★★☆ |
| 文心一言 | ★★★★ | ★★★ | ★★★☆ | ★★★★ |
| DeepSeek | ★★★★☆ | ★★★★ | ★★★★☆ | ★★★★☆ |

&spm=1001.2101.3001.5002&articleId=145790696&d=1&t=3&u=25f0437812cc493b982f50fcb3a33fd4)
3635

被折叠的 条评论
为什么被折叠?



