★ 0 · 更新于 2026-09-23
在仓库根目录创建并维护 VISION.md,用于在项目创建、补齐和刷新阶段记录与对齐项目意图。
浏览带有该标签的技能列表。
★ 0 · 更新于 2026-09-23
在仓库根目录创建并维护 VISION.md,用于在项目创建、补齐和刷新阶段记录与对齐项目意图。
★ 0 · 更新于 2026-09-17
将手写字符照片转换为可安装的 TTF 和网页字体文件。
★ 166 · 更新于 2026-09-15
自动将图片、文档和 OCR 任务路由至专用工具处理,并向主模型返回标准 JSON 结果。
★ 0 · 更新于 2026-09-15
使用 mmx 命令行工具通过 MiniMax AI 平台生成文本、图像、视频、语音和音乐,并进行视觉识别与网络搜索。
★ 0 · 更新于 2026-09-11
配置 Hermes Agent 使用 Kimi、DeepSeek 或 Azure 等自定义或 OpenAI 兼容的视觉提供商。
★ 2,284 · 更新于 2026-09-10
通过运行内置的 vision.js 脚本,将本地图片、网络图片 URL 或剪贴板图片转换为文本描述。
★ 0 · 更新于 2026-05-28
通过截图、识别界面元素、点击、滚动、输入文本和按键,通过图形界面控制macOS应用程序。
★ 59 · 更新于 2026-05-28
通过截图、点击、滚动和打字可视化控制 macOS GUI 应用程序
★ 2 · 更新于 2026-05-28
集成多种 AI 提供商驱动,为 Stacks 应用添加 AI 能力
★ 1 · 更新于 2026-05-28
支持多提供商的AI/LLM集成,包含RAG、图像生成和个性化功能
★ 620 · 更新于 2026-05-28
为 Stacks 应用集成多种 AI 驱动、图像生成、RAG、嵌入和个性化功能
★ 0 · 更新于 2026-03-22
从USB网络摄像头捕获照片和视频,通过WhatsApp发送,可选使用视觉模型描述内容
★ 816 · 更新于 2026-03-10
轻量级工具,直接调用 MiniMax Coding Plan API 实现网页搜索和图像理解功能。
★ 0 · 更新于 2026-02-11
使用 Google Gemini AI 处理多模态内容
★ 602 · 更新于 2026-02-11
使用Google Gemini API处理多模态内容进行分析和信息提取