xberg
文档格式万能提取器:从 101+ 种文档格式(PDF、扫描件、各种古怪格式)里提取文本、表格和元数据,调研资料整理时不用再为「打不开」发愁。
来源:github.com/xberg-io/xbergstar 等数据核实于 2026-10-07
推荐理由
9.4k★(MIT),backed by 一个 CLI 工具。价值不在「又一个 PDF 解析器」,而在格式的广度——别人发来的 .wps、老式 .dbf、扫描版合同这类「AI 看了直摇头」的文件,它负责变成 Agent 能读的文本。
安装
npx skills add xberg-io/xberg使用步骤
触发方式有三种:Claude Code 等客户端把 skill 挂进斜杠菜单,输入/xberg直接调用;与任务相关时 Agent 会按语义自动加载;任何客户端都可在消息里点名「使用xberg skill」。以下示例均为可直接粘贴的第一条消息。
点名处理文件(首次使用按提示安装 xberg CLI)
用 xberg 提取这份文件的文本和表格:report.wps提取结果建议先抽查表格数字列——格式越古怪的文档,越要人工验一下关键数据
注意事项与建议
- 格式广度和准确率是两回事:常规 PDF/Word 它没问题,极冷门格式把它当「救急通道」而不是「默认管道」
- 涉及敏感文档时留意:文档内容会经过本地 CLI 处理,合规场景先确认数据处理路径