★ 0 · 更新于 2026-09-24
使用RadixAttention前缀缓存为LLM与VLM提供结构化生成与高性能推理服务。
浏览产出该输出的技能列表。
★ 0 · 更新于 2026-09-24
使用RadixAttention前缀缓存为LLM与VLM提供结构化生成与高性能推理服务。
★ 0 · 更新于 2026-09-22
用于部署生产级大语言模型的高性能服务框架,支持 OpenAI 兼容 API、模型量化与张量并行。
★ 1 · 更新于 2026-09-20
用于将 Firebase AI Logic 集成至应用的官方技能,涵盖环境设置、多模态推理、结构化输出与安全配置。
★ 0 · 更新于 2026-09-20
通过 Firebase AI Logic 客户端 SDK 调用 Gemini 模型,实现多模态推理、流式传输及结构化输出。
★ 0 · 更新于 2026-09-20
用于在客户端应用中集成 Firebase AI Logic 与 Gemini API,涵盖文本生成、多模态推理、流式传输及安全配置。
★ 18 · 更新于 2026-09-09
使用 Python google-genai SDK 调用 Google Gemini 模型进行文本生成、推理和代码任务。
★ 58 · 更新于 2026-06-30
通过 Google Gen AI SDK 指导在 Agent Platform 上使用 Gemini API,支持 Python、JS/TS、Go、Java 和 C# 多语言集成。
★ 0 · 更新于 2026-05-11
通过API访问Cohere模型,实现文本嵌入、重排序、RAG和文本生成