LogoClawIndex
案例技能关于
LogoClawIndex

ClawIndex

OpenClaw Skills 与 Use Case 索引

ClawIndex 是一个生态驱动的 OpenClaw Skills 与真实 Use Case 索引站。

索引

Skills·
Cases

Meta

关于·
声明·
邮箱·
GitHub
© 2026 ClawIndex 保留所有权利。

带有该标签的 Skills:vllm

浏览带有该标签的技能列表。

  • vllm-metax-model-upgrade - 在 MetaX MACA 平台上升级 vLLM 模型支持
    vllmmetaxmaca模型升级

    ★ 174 · 更新于 2026-09-22

    针对目标 vLLM 版本与已安装的 MACA 组件评估并升级 MetaX 模型支持,递归包含依赖的注意力机制与算子。

    ⚙ 构建 MACA 与上游差异矩阵⚙ 递归梳理模型依赖项⚙ 更新受影响的依赖与调用方
  • huggingface-community-evals - 使用 inspect-ai 或 lighteval 评估 Hugging Face 模型
    huggingface模型评估inspect-ailighteval

    ★ 1 · 更新于 2026-09-13

    在本地硬件上使用 inspect-ai 或 lighteval 对 Hugging Face Hub 模型运行评估。

    ⚙ 选择评估框架与后端⚙ 运行评估冒烟测试⚙ 执行本地基准测试任务
  • arxiv-2608-19889-write-once-run-everywhere-the-axon-dsl-for-shape-s - 用于形状安全与跨框架LLM架构的Axon DSL
    dsl大语言模型pytorchjax

    ★ 3 · 更新于 2026-09-11

    介绍用于将形状安全且跨框架的LLM架构自动编译为PyTorch、JAX、MLX和vLLM实现的Axon DSL。

    ⚙ 编译LLM至PyTorch实现⚙ 编译LLM至JAX实现⚙ 编译LLM至MLX实现
  • vllm-ascend-model-adapter - 适配模型在昇腾NPU上运行vLLM
    vllm昇腾NPU模型适配

    ★ 5 · 更新于 2026-05-11

    适配Hugging Face或本地模型在vllm-ascend上运行,代码改动最小化

    ⚙ 分析模型架构⚙ 检查模型文件⚙ 实现模型适配器
  • llm-inference-scaling - Kubernetes上自动扩展LLM推理集群
    kubernetes自动扩缩容LLMGPU

    ★ 602 · 更新于 2026-03-26

    在Kubernetes上水平扩展LLM推理,支持GPU感知自动扩缩容、请求排队和竞价实例策略。

    ⚙ 部署vLLM推理Pod⚙ 配置KEDA自动扩缩容⚙ 设置基于队列的扩展
  • Local Model Deployment - 在VS Code Agent中部署和集成本地AI模型
    本地模型OllamavLLM模型部署

    ★ 0 · 更新于 2026-02-23

    部署本地或开源AI模型,包括模型选择、量化、Ollama/vLLM设置以及与ModelSelector的集成

    ⚙ 部署本地模型⚙ 配置Ollama运行时⚙ 配置vLLM运行时
  • unsloth-inference - 使用Unsloth部署微调模型进行生产推理
    模型推理模型部署vllmsglang

    ★ 602 · 更新于 2026-02-14

    使用优化内核和服务引擎部署微调模型进行生产推理

    ⚙ 加载微调模型⚙ 加载分词器⚙ 启用优化内核