LogoClawIndex
CasesSkillsAbout
LogoClawIndex

daily - Daily real-time voice and multimodal AI

Provides guidance for building real-time voice and multimodal AI applications with Daily or Pipecat-style transports.

Tags

Updated: 2026-09-29

Capabilities

Typical Inputs

Typical Outputs

What this skill does

  • Build real-time voice pipelines
  • Process multimodal inputs
  • Integrate AI services
  • Configure speech recognition
  • Configure speech synthesis
  • Connect external tools
  • Manage conversation context
  • Handle turn taking
  • Monitor pipeline performance
  • Deploy scalable applications

Inputs

  • User audio
  • User video
  • User text
  • AI service configurations
  • Transport configurations
  • Conversation context
  • Tool definitions
  • External API data
  • Deployment configuration

Outputs

  • Transcriptions
  • Synthesized audio
  • Language model responses
  • Multimodal processing results
  • Conversation context updates
  • Connection lifecycle events
  • Latency metrics
  • Usage metrics
  • Distributed traces

Requirements

  • Supported transport
  • Configured AI services
  • Required service credentials
  • Compatible client SDK

Source

  • Spec: SKILL.md

ClawIndex

OpenClaw Skills & Use Case Index

ClawIndex is an ecosystem-driven index of OpenClaw skills and real-world use cases.

Index

Skills·
Cases

Meta

About·
Disclaimer·
Email·
GitHub
© 2026 ClawIndex All Rights Reserved.
Daily
Pipecat
real-time voice
multimodal AI
speech recognition
text-to-speech
LLM integration
WebRTC
WebSocket
telephony
Build real-time voice pipelines
Process multimodal inputs
Integrate AI services
Configure speech recognition
User audio
User video
User text
Transcriptions
Synthesized audio
Language model responses