跳转到主内容
返回 Skill 雷达
通用效率

xberg

文档格式万能提取器:从 101+ 种文档格式(PDF、扫描件、各种古怪格式)里提取文本、表格和元数据,调研资料整理时不用再为「打不开」发愁。

来源:github.com/xberg-io/xberg

star 等数据核实于 2026-10-07

推荐理由

9.4k★(MIT),backed by 一个 CLI 工具。价值不在「又一个 PDF 解析器」,而在格式的广度——别人发来的 .wps、老式 .dbf、扫描版合同这类「AI 看了直摇头」的文件,它负责变成 Agent 能读的文本。

安装

npx skills add xberg-io/xberg

使用步骤

触发方式有三种:Claude Code 等客户端把 skill 挂进斜杠菜单,输入/xberg直接调用;与任务相关时 Agent 会按语义自动加载;任何客户端都可在消息里点名「使用xberg skill」。以下示例均为可直接粘贴的第一条消息。

  1. 点名处理文件(首次使用按提示安装 xberg CLI)

    用 xberg 提取这份文件的文本和表格:report.wps
  2. 提取结果建议先抽查表格数字列——格式越古怪的文档,越要人工验一下关键数据

注意事项与建议

  • 格式广度和准确率是两回事:常规 PDF/Word 它没问题,极冷门格式把它当「救急通道」而不是「默认管道」
  • 涉及敏感文档时留意:文档内容会经过本地 CLI 处理,合规场景先确认数据处理路径