LogoClawIndex
案例技能关于
LogoClawIndex

ClawIndex

OpenClaw Skills 与 Use Case 索引

ClawIndex 是一个生态驱动的 OpenClaw Skills 与真实 Use Case 索引站。

索引

Skills·
Cases

Meta

关于·
声明·
邮箱·
GitHub
© 2026 ClawIndex 保留所有权利。

serving-llms-vllm - 高性能大语言模型服务框架

用于部署生产级大语言模型的高性能服务框架,支持 OpenAI 兼容 API、模型量化与张量并行。

标签

更新于: 2026-09-22
vLLM推理服务PagedAttention连续批处理OpenAI API量化张量并行

能力

典型输入

典型输出

该技能可以做什么

  • 部署生产级 LLM API
  • 运行离线批量推理
  • 提供量化 LLM 服务
  • 监控服务器性能指标

输入

  • 大语言模型
  • 输入文本提示词
  • 服务器配置参数
  • GPU 硬件资源

输出

  • 兼容 OpenAI 的 API 服务
  • 生成文本响应
  • JSONL 结果文件
  • Prometheus 指标端点

要求

  • Linux 或 macOS 操作系统
  • Python 依赖包 vllm、torch、transformers
  • 受支持的 GPU 硬件

来源

  • 规范: SKILL.md
部署生产级 LLM API
运行离线批量推理
提供量化 LLM 服务
监控服务器性能指标
大语言模型
输入文本提示词
服务器配置参数
兼容 OpenAI 的 API 服务
生成文本响应
JSONL 结果文件