★ 0 · 更新于 2026-09-21
使用本地 RunComfy CLI 运行字节跳动 Seedance 2.0 Pro 生成带有原生口型同步音频的电影级短视频。
浏览带有该标签的技能列表。
★ 0 · 更新于 2026-09-21
使用本地 RunComfy CLI 运行字节跳动 Seedance 2.0 Pro 生成带有原生口型同步音频的电影级短视频。
★ 1 · 更新于 2026-09-20
用于将 Firebase AI Logic 集成至应用的官方技能,涵盖环境设置、多模态推理、结构化输出与安全配置。
★ 0 · 更新于 2026-09-20
通过 Firebase AI Logic 客户端 SDK 调用 Gemini 模型,实现多模态推理、流式传输及结构化输出。
★ 0 · 更新于 2026-09-20
用于在客户端应用中集成 Firebase AI Logic 与 Gemini API,涵盖文本生成、多模态推理、流式传输及安全配置。
★ 0 · 更新于 2026-09-20
将 Firebase AI Logic SDK 集成到 Web 与移动应用中,实现 Gemini API 多模态推理、结构化输出、流式响应与安全配置。
★ 29 · 更新于 2026-09-20
通过多模态帧提取和逐字稿分析,深入解析视频演讲者的底层世界观与核心信念。
★ 0 · 更新于 2026-09-19
开发生产级大语言模型应用、高级检索增强生成系统、向量搜索、多模态 AI 及智能体编排。
★ 0 · 更新于 2026-09-18
创建浏览器交互式白板,支持绘制草图并通过共享画布快照与便签供 Copilot 分析协作。
★ 3 · 更新于 2026-09-16
将 SNMTF 扩展至多模态图群体的监督预测,用于可解释的脑网络分析。
★ 166 · 更新于 2026-09-15
自动将图片、文档和 OCR 任务路由至专用工具处理,并向主模型返回标准 JSON 结果。
★ 97 · 更新于 2026-09-12
使用 Google Gemini 分析视频文件并生成包含场景拆解、音频转录及视觉细节的结构化 Markdown 报告。
★ 71 · 更新于 2026-06-15
修改、扩展或调试代理模块,包括图、工具、护栏和包装器
★ 0 · 更新于 2026-05-11
适配并调试Hugging Face或本地模型在昇腾NPU上运行vLLM
★ 5 · 更新于 2026-05-11
适配Hugging Face或本地模型在vllm-ascend上运行,代码改动最小化
★ 57 · 更新于 2026-05-11
为 vLLM 在 Ascend NPU 上适配和调试模型
★ 11 · 更新于 2026-05-09
构建生产级LLM应用、高级RAG系统和智能代理
★ 0 · 更新于 2026-03-22
将心跳转换记录到索引存储,支持采样、时间范围查询和情节重放。
★ 581 · 更新于 2026-03-10
将基于自注意力的Counter_Guide模块与自适应权重集成到双分支ViT中,实现RGB/事件数据融合
★ 18 · 更新于 2026-03-09
分析PDF、图片、图表、架构图和截图等媒体文件以提取信息
★ 602 · 更新于 2026-03-09
分析媒体文件,包括PDF、图片、图表、架构图和截图
Scroll to load more