★ 0 · Updated 2026-09-22
High-throughput LLM serving engine supporting OpenAI compatible API, quantization, and tensor parallelism.
Browse skills that use this input.
★ 0 · Updated 2026-09-22
High-throughput LLM serving engine supporting OpenAI compatible API, quantization, and tensor parallelism.
★ 18 · Updated 2026-09-09
Provides GraphRAG implementation patterns including hybrid search, Text2Cypher, agentic retrieval, and RAGAS evaluation for Neo4j.
★ 1 · Updated 2026-03-09
Designs, optimizes, and evaluates prompts to maximize LLM performance across use cases
★ 816 · Updated 2026-02-10
Complete API integration for managing LLM models, chat completions, file uploads, knowledge bases, and Ollama proxy operations through Open WebUI