serving-llms-vllm - 高性能大语言模型服务框架vLLM推理服务PagedAttention连续批处理★ 0 · 更新于 2026-09-22用于部署生产级大语言模型的高性能服务框架,支持 OpenAI 兼容 API、模型量化与张量并行。⚙ 部署生产级 LLM API⚙ 运行离线批量推理⚙ 提供量化 LLM 服务
librarium - 基于多提供商的证据感知深度调研 CLI 与 MCP 服务调研深度研究多提供商CLI★ 133 · 更新于 2026-09-18通过 CLI 命令或 MCP 执行基于多提供商的证据感知调研查询,检索结果并生成结构化输出文件。⚙ 运行多提供商调研查询⚙ 检索异步调研结果⚙ 检查异步任务状态