LogoClawIndex
案例技能关于
LogoClawIndex

ClawIndex

OpenClaw Skills 与 Use Case 索引

ClawIndex 是一个生态驱动的 OpenClaw Skills 与真实 Use Case 索引站。

索引

Skills·
Cases

Meta

关于·
声明·
邮箱·
GitHub
© 2026 ClawIndex 保留所有权利。

带有该标签的 Skills:FP8

浏览带有该标签的技能列表。

  • tensorrt-llm - 使用 TensorRT-LLM 优化 NVIDIA GPU 上的大语言模型推理
    推理服务TensorRT-LLMNVIDIA推理优化

    ★ 0 · 更新于 2026-09-09

    在 NVIDIA GPU 上通过量化、动态批处理与多 GPU 扩展优化大语言模型推理性能。

    ⚙ 根据提示词生成文本响应⚙ 通过 HTTP API 提供模型服务⚙ 将模型量化为低精度格式
  • tensorrt-llm - 使用 NVIDIA TensorRT 优化大语言模型推理
    推理服务TensorRT-LLMNVIDIA推理优化

    ★ 0 · 更新于 2026-09-09

    基于 NVIDIA GPU 提供模型量化、动态批处理与多 GPU 并行优化以加速大模型推理。

    ⚙ 运行大语言模型推理⚙ 提供 HTTP 模型服务⚙ 使用 FP8 量化模型
  • optimizing-attention-flash - Flash Attention Transformer 注意力优化
    Flash Attention注意力优化显存优化PyTorch

    ★ 18 · 更新于 2026-06-30

    通过 PyTorch SDPA、flash-attn 库、H100 FP8 及滑动窗口注意力优化 Transformer 注意力机制。

    ⚙ 启用 Flash Attention 后端⚙ 替换标准注意力计算⚙ 基准测试注意力速度与显存
  • miles-rl-training - 企业级强化学习训练框架
    强化学习MoEFP8INT4

    ★ 602 · 更新于 2026-05-11

    面向大规模MoE模型的企业级强化学习训练框架,支持FP8/INT4精度训练

    ⚙ 训练MoE模型⚙ 配置FP8训练⚙ 配置INT4训练
  • tensorrt-llm - TensorRT-LLM LLM推理优化
    推理服务TensorRT-LLMNVIDIA推理优化

    ★ 2 · 更新于 2026-03-19

    使用 NVIDIA TensorRT 优化 LLM 推理,在 NVIDIA GPU 上实现高吞吐、低延迟的生产部署。

    ⚙ 优化 LLM 推理⚙ 使用 TensorRT 编译模型⚙ 通过 HTTP API 服务模型