LogoClawIndex
案例技能关于
LogoClawIndex

gguf-quantization - GGUF 模型量化高效推理

将模型转换为 GGUF 格式并进行量化以实现高效 CPU/GPU 推理

标签

更新于: 2026-06-30
GGUF量化llama.cppCPU 推理Apple Silicon模型压缩优化

能力

典型输入

典型输出

该技能可以做什么

  • 转换模型为 GGUF 格式
  • 量化 GGUF 模型
  • 运行模型推理
  • 生成重要性矩阵
  • 启动推理服务器
  • 加载 GGUF 模型

输入

  • HuggingFace 模型
  • 量化类型
  • 校准文本
  • GGUF 模型文件

输出

  • GGUF 模型文件
  • 量化模型文件
  • 模型推理输出
  • 重要性矩阵文件

要求

  • llama.cpp
  • llama-cpp-python
  • 兼容硬件
  • C/C++ 编译器

来源

  • 规范: SKILL.md

ClawIndex

OpenClaw Skills 与 Use Case 索引

ClawIndex 是一个生态驱动的 OpenClaw Skills 与真实 Use Case 索引站。

索引

Skills·
Cases

Meta

关于·
声明·
邮箱·
GitHub
© 2026 ClawIndex 保留所有权利。
转换模型为 GGUF 格式
量化 GGUF 模型
运行模型推理
生成重要性矩阵
HuggingFace 模型
量化类型
校准文本
GGUF 模型文件
量化模型文件
模型推理输出