LogoClawIndex
案例技能关于
LogoClawIndex

ClawIndex

OpenClaw Skills 与 Use Case 索引

ClawIndex 是一个生态驱动的 OpenClaw Skills 与真实 Use Case 索引站。

索引

Skills·
Cases

Meta

关于·
声明·
邮箱·
GitHub
© 2026 ClawIndex 保留所有权利。

带有该标签的 Skills:基准测试

浏览带有该标签的技能列表。

  • ppa-benchmark - 制定可防御的多分支 PPA 对比计划
    ppa基准测试eda布局布线

    ★ 26 · 更新于 2026-09-17

    生成多分支结构化对比计划与链接证据的报告,且不进行评分或确定胜者。

    ⚙ 定义对比分支与基线⚙ 固定基线设计条件⚙ 声明随机种子策略与运行次数
  • curate-scanner-evaluation-corpus - 构建与维护扫描器评估语料库
    基准测试评估真值数据扫描器

    ★ 0 · 更新于 2026-09-16

    挑选并固定第三方仓库,确定标注范围,准备人工复核工作包,维护真值数据集并裁决标签变更。

    ⚙ 筛选具有覆盖度的候选仓库⚙ 定义详尽的标注范围与规则⚙ 准备人工复核工作包
  • benchmark-to-brief - 将基准研究转化为营销简报与概念候选
    媒体制作基准研究营销简报短视频

    ★ 24 · 更新于 2026-09-14

    将验证过的基准研究产物转化为用于短视频制作的事实立足型营销简报、概念候选、Hook库和测试计划。

    ⚙ 将研究转化为营销简报⚙ 生成概念候选与 Hook 库⚙ 优先排序内容赛道与测试矩阵
  • subject-level-inference-eval - 基于主体层面的文本匿名化评估基准。
    文本匿名化隐私评估基准测试主体级推理

    ★ 3 · 更新于 2026-09-13

    通过测量片段级掩码准确率与主体级隐私泄漏评估文本匿名化方法,并衡量文本实用性。

    ⚙ 评估文本匿名化方法⚙ 测量片段级掩码准确率⚙ 测量主体级隐私泄漏
  • benchmark-hillclimb - 通过追踪驱动的基准实验改进 AI Agent。
    基准测试评估优化追踪分析

    ★ 1 · 更新于 2026-09-13

    通过追踪驱动的实验和失败分类,改进 AI Agent、检索系统、基准测试框架或工作流。

    ⚙ 检查追踪产物与源码⚙ 归类失败模式⚙ 执行迭代实验循环
  • criterion-bench - 运行 Criterion 基准测试并检测性能退化
    rustcriterion基准测试性能测试

    ★ 4 · 更新于 2026-09-13

    运行 Criterion 0.5 基准测试,对比已保存的基线,并解析 estimates.json 文件检测性能退化。

    ⚙ 保存基准测试基线⚙ 对比基准测试基线⚙ 检测性能测试退化
  • inquire-eval - 评估基于 INQUIRE 基准的文本到图像检索能力
    文本到图像检索数据集评估视觉语言模型基准测试

    ★ 3 · 更新于 2026-09-13

    评估视觉语言模型在专家级、基于生态学的查询上的文本到图像检索能力。

    ⚙ 评估文本到图像检索性能⚙ 探查细粒度视觉理解能力⚙ 测量特定领域语言理解能力
  • benchmark - 性能基线与回退检测
    性能基准测试回退测试WebVitals

    ★ 0 · 更新于 2026-09-11

    测量 Web、API 及构建性能指标,保存性能基线,并对比代码变更前后的数据。

    ⚙ 测量页面性能指标⚙ 测试 API 端点性能⚙ 测量构建性能指标
  • memory-harness - Memory Harness 框架
    测试记忆基准测试Agent

    ★ 12 · 更新于 2026-09-11

    基于 do-memory-cli 记录、重放并基准测试真实 Agent 会话。

    ⚙ 记录实时 Agent 会话追踪⚙ 重放会话追踪⚙ 基准测试 CLI 性能
  • phmbs-benchmark-report - 编写 PHM 基准测试报告
    基准测试报告phm指标

    ★ 0 · 更新于 2026-09-10

    编写包含指标、分片清单、源校验和、有效性检查及偏差的可复现 PHM 基准测试报告。

    ⚙ 编写可复现基准报告⚙ 生成指标 JSON 文件⚙ 生成配置 JSON 文件
  • compute-token-stats-rust-ultra - 计算 Token 统计数据(Rust Ultra)
    rusttoken统计成本计算sse日志

    ★ 1 · 更新于 2026-09-09

    使用 Rust 二进制文件或 Python 脚本计算 Codex 与 Claude SSE 日志的 Token 总量及估算成本。

    ⚙ 计算 Token 总数与成本⚙ 按 Session ID 过滤日志⚙ 构建 Rust Release 二进制文件
  • douyin-similar-account - 抖音相似账号推荐工具
    抖音账号分析相似账号对标

    ★ 52 · 更新于 2026-06-15

    通过红狐API查询抖音账号数据及相似账号推荐

    ⚙ 查询账号信息⚙ 匹配对标账号⚙ 推荐头部账号
  • profile-isaac-sim - Isaac Sim 性能分析
    性能分析基准测试Isaac Sim

    ★ 3,468 · 更新于 2026-06-15

    运行基准测试、捕获 Tracy 分析数据并优化 Isaac Sim 工作负载

    ⚙ 运行基准测试⚙ 捕获 Tracy 分析数据⚙ 导出 CSV
  • self-improve - 自主代码进化改进引擎
    代码改进进化算法锦标赛选择自主执行

    ★ 156 · 更新于 2026-05-28

    具有锦标赛选择的自主代码进化改进循环控制器

    ⚙ 分析代码库⚙ 生成假设⚙ 创建方案
  • harness-runner - WaveCap-SDR测试工具
    测试SDR音频自动化

    ★ 602 · 更新于 2026-05-28

    运行WaveCap-SDR测试工具,自动执行参数扫描和验证

    ⚙ 启动服务器⚙ 创建采集⚙ 添加通道
  • mteb-leaderboard - 机器学习模型排行榜和基准查询指南
    机器学习排行榜基准测试MTEB

    ★ 0 · 更新于 2026-05-09

    查询机器学习模型排行榜和基准(包括 MTEB 和 HuggingFace)的指导

    ⚙ 在基准测试中查找表现最佳的模型⚙ 查询当前排行榜排名⚙ 跨基准测试比较模型性能
  • agent-bom-compliance - AI合规与策略引擎
    安全合规SBOM策略

    ★ 816 · 更新于 2026-03-25

    评估扫描结果以符合14个安全框架,生成SBOM和合规报告

    ⚙ 评估合规性⚙ 检查策略⚙ 运行基准
  • local-crdb-perf-checker - 本地 CockroachDB 性能检查工具
    cockroachdb性能数据库测试

    ★ 0 · 更新于 2026-03-22

    自动化本地 CockroachDB 性能检查,执行 DDL 并生成诊断报告

    ⚙ 启动数据库⚙ 重置数据库⚙ 应用 SQL 文件
  • compute-token-stats-rust-ultra - AI日志超快速token和成本计算
    token计算成本分析日志处理基准测试

    ★ 57 · 更新于 2026-03-09

    从Codex和Claude SSE日志计算token总数和估算成本

    ⚙ 解析SSE日志⚙ 计算token统计⚙ 估算成本
  • harbor - 用于智能体评估的 Harbor 框架
    评估框架基准测试测试

    ★ 0 · 更新于 2026-02-24

    运行 harbor 命令并管理智能体评估任务

    ⚙ 运行 harbor 命令⚙ 验证任务结构⚙ 执行智能体任务

Scroll to load more