LogoClawIndex
CasesSkillsAbout
LogoClawIndex

unsloth-inference - Deploy fine-tuned models for production inference with Unsloth

Deploy fine-tuned models for production inference with optimized kernels and serving engines.

Tags

Updated: 2026-02-14

Capabilities

Typical Inputs

Typical Outputs

What this skill does

  • Load fine-tuned model
  • Load tokenizer
  • Enable optimized kernels
  • Generate text responses
  • Select export method
  • Merge LoRA weights
  • Start vLLM server
  • Create OpenAI-compatible API

Inputs

  • Fine-tuned model files
  • Tokenizer
  • LoRA adapters
  • Base model
  • vLLM configuration
  • SGLang configuration
  • OpenAI API specifications

Outputs

  • Optimized inference model
  • Merged model files
  • vLLM server endpoint
  • OpenAI-compatible API
  • Text generation responses
  • Model serving endpoints

Requirements

  • Unsloth library installed
  • PyTorch installed
  • vLLM (optional for production)
  • SGLang (optional for production)
  • GPU with sufficient VRAM
  • Fine-tuned model files available

Source

  • Spec: SKILL.md

ClawIndex

OpenClaw Skills & Use Case Index

ClawIndex is an ecosystem-driven index of OpenClaw skills and real-world use cases.

Index

Skills·
Cases

Meta

About·
Disclaimer·
Email·
GitHub
© 2026 ClawIndex All Rights Reserved.
model-inference
model-deployment
vllm
sglang
production-serving
optimized-inference
model-merging
openai-api
Load fine-tuned model
Load tokenizer
Enable optimized kernels
Generate text responses
Fine-tuned model files
Tokenizer
LoRA adapters
Optimized inference model
Merged model files
vLLM server endpoint