LogoClawIndex
案例技能关于
LogoClawIndex

vlm-ocr-evaluation - 批量运行前对比评估 OCR 系统

在批量运行前使用人工转录样本对比评估 OCR 系统,计算 CER 与 WER 以选择最佳模型。

标签

更新于: 2026-09-24

能力

典型输入

典型输出

该技能可以做什么

  • 构建 OCR 候选模型集合
  • 创建分层真值样本集
  • 计算 CER 与 WER 编辑距离
  • 评分前规范化文本内容
  • 按层级聚合准确率指标
  • 记录模型选择决策结果

输入

  • 候选 OCR 模型规范
  • 人工转录真值页面
  • 语料库元数据与语言标签

输出

  • 模型注册表配置
  • 单页规范化转录文本
  • 分层 CER 与 WER 评估报告
  • 已记录的选择决策依据

要求

  • 支持模型运行的 GPU 显存
  • vLLM 或 Ollama 服务框架
  • Tesseract OCR 基线安装
  • 商业 Vision API 访问凭据

来源

  • 规范: SKILL.md

ClawIndex

OpenClaw Skills 与 Use Case 索引

ClawIndex 是一个生态驱动的 OpenClaw Skills 与真实 Use Case 索引站。

索引

Skills·
Cases

Meta

关于·
声明·
邮箱·
GitHub
© 2026 ClawIndex 保留所有权利。
ocr
评估
vlm
cer
wer
基准测试
构建 OCR 候选模型集合
创建分层真值样本集
计算 CER 与 WER 编辑距离
评分前规范化文本内容
候选 OCR 模型规范
人工转录真值页面
语料库元数据与语言标签
模型注册表配置
单页规范化转录文本
分层 CER 与 WER 评估报告