教你用WorkBuddy几秒读懂百页PDF文档

作者: admin 分类: 评论分析 发布时间: 2026-08-08 10:23

不知道大家平时会不会解析处理一些 PDF 文档。有时候用 OCR 不是不行,只是识别效果不够理想。不少图片处理不了,输出格式也常常比较糟糕。

所以,这时候接入外部文档解析服务就很有必要,尤其是当你要处理的文档数量较多、页数也比较多时。

今天老马给大家介绍一个刚上线 WorkBuddy 的 MCP 连接器。官方目前为新注册用户提供每天 1000 页免费解析额度,对绝大多数小伙伴来说已经足够。如果还需要更多额度,也可以按需付费。

这个文档解析 MCP 连接器,叫作 TextIn xParse

01 · THE PROBLEM

传统 OCR,为什么还不够

TextIn xParse 解决的是非结构化文档的解析难题,包括 PDF、扫描件、合同、财报等。

传统 OCR 往往只能提取零散文字,无法还原标题层级、表格逻辑和跨页关联等结构,最终输出内容杂乱,大模型也很难理解。与此同时,多工具对接和代码适配的成本也不低。

02 · CAPABILITIES

TextIn xParse 的六项核心能力

老马整理了一下官方文档,把 TextIn xParse 的核心能力归纳为下面六点。

01、全格式兼容:支持 PDF(电子版或扫描版)、Word、Excel、PPT、图片等十余种格式。

02、深度结构化:精准识别文本、表格、公式、公章等 16 种内容元素,自动还原标题层级,无缝拼接跨页表格。

03、高精度还原:针对多栏排版、图文混排等复杂场景专项优化,保障阅读顺序准确。

04、极速高效:百页 PDF 解析仅需 2 秒。

05、标准化输出:结果可直接导出为 Markdown、JSON 格式,无缝接入大模型。

06、多语言支持:覆盖 50 余种语言文字识别。

03 · WORKFLOW

整个解析流程,其实很简单

总结一句话:你把文档发给 WorkBuddy,它调用TextIn xParse MCP 连接器完成解析,再把结果返回给你。

下面,老马就直接用 WorkBuddy 安装 TextIn xParse,并处理一本 PDF 电子书,给大家演示一下。

04 · INSTALLATION

在 WorkBuddy 中安装连接器

第一步:搜索并安装

打开 WorkBuddy,点击左侧菜单的“专家技能连接器”,切换到“连接器”,搜索“TextIn xParse”。找到后,点击加号添加安装即可。

第二步:注册并授权

安装后,第一次使用时会自动调用电脑默认浏览器访问 TextIn xParse 官网。你需要使用手机号码注册账号。

注册成功后,点击“继续授权登录”即可。返回 WorkBuddy 时,它也会提醒你连接成功。

第三步:确认连接器已开启

新建一个任务,在 WorkBuddy 对话框左下角点开加号,切换到“连接器”,检查TextIn xParse 开关是否处于打开状态。正常情况下,它默认就是打开的。

05 · HANDS ON

上传文档,开始解析

接下来,把需要解析的文档拖进对话框,或者手动上传,再输入提示词,让 WorkBuddy 调用 TextIn xParse 处理即可。

TextIn xParse 的 API 对文档大小有限制,默认上限为 10MB。文件超过限制时,系统会询问是压缩文件,还是按页拆分后再解析。老马这次选择了分页。

06 · REAL TEST

一本 300 多页电子书的实测

因为手头没有更合适的电子文档,这次就拿一本 300 多页的《算法的起源:莱布尼茨与二进制》电子书来做解析测试。

整本书全部解析完成,大概花了 11 分钟。处理后,系统会直接生成 Markdown 文档。

Markdown 文档里的图片和文字都能正常显示。不过,这本电子书的目录会有些乱。如果处理的是正常办公文档,一般不会遇到这个问题。

有了 Markdown 文档,还可以继续让 WorkBuddy 转换成 Word、TXT 等其它格式。

如果文档里存在不需要的内容,或者目录比较混乱,也可以进一步要求 WorkBuddy 清理,最终得到一份干净、规整的文档。

∞ · POSTSCRIPT

写在最后

好了,以上就是今天的分享。有任何问题和需求,欢迎在评论区留言。如果你觉得今天这篇有收获,欢迎点赞、在看、转发三连,我们下篇见。

如果觉得我的文章对您有用,请随意赞赏。您的支持将鼓励我继续创作!

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注

Protected by WP Anti Spam