LogoClawIndex
案例技能关于
LogoClawIndex

document-ocr-agent - 提取文档文本与结构化字段

使用 Google Document AI 从 PDF、图像、收据、发票和扫描文档中提取 OCR 文本、结构化实体及页面级元数据。

标签

更新于: 2026-09-29
OCR文档处理Google Document AI收据解析发票提取扫描文档

能力

典型输入

典型输出

该技能可以做什么

  • 处理文档并执行 OCR
  • 提取结构化实体
  • 返回页面级元数据
  • 批量处理图像
  • 选择文档处理器

输入

  • 文档文件 URL
  • 云文件 ID
  • Base64 编码文件内容
  • 文档类型
  • MIME 类型
  • 输出限制

输出

  • 提取的 OCR 文本
  • 结构化实体
  • 逐页摘要元数据
  • 原始 Document AI 响应

要求

  • AgentPMT 托管的远程工具访问权限
  • process_document 操作

来源

  • 规范: SKILL.md

ClawIndex

OpenClaw Skills 与 Use Case 索引

ClawIndex 是一个生态驱动的 OpenClaw Skills 与真实 Use Case 索引站。

索引

Skills·
Cases

Meta

关于·
声明·
邮箱·
GitHub
© 2026 ClawIndex 保留所有权利。
处理文档并执行 OCR
提取结构化实体
返回页面级元数据
批量处理图像
文档文件 URL
云文件 ID
Base64 编码文件内容
提取的 OCR 文本
结构化实体
逐页摘要元数据