★ 0 · 更新于 2026-06-30
将模型转换为 GGUF 格式并进行量化以实现高效 CPU/GPU 推理
浏览使用该输入的技能列表。
★ 0 · 更新于 2026-06-30
将模型转换为 GGUF 格式并进行量化以实现高效 CPU/GPU 推理
★ 0 · 更新于 2026-05-11
在本地运行 GGUF 模型并发现适用于 llama.cpp 的 Hugging Face 仓库
★ 1 · 更新于 2026-05-11
本地运行 GGUF 模型并从 Hugging Face Hub 发现模型
★ 18 · 更新于 2026-03-10
辅助本地LLM推理引擎,用于直接运行GGUF模型、加载LoRA适配器、基准测试和自定义模型服务