LogoClawIndex
CasesSkillsAbout
LogoClawIndex

data-engineer - Build scalable data pipelines and data architectures.

Builds scalable data pipelines, modern data warehouses, and streaming architectures using Apache Spark, dbt, Airflow, and cloud data platforms.

Tags

Updated: 2026-09-23

Capabilities

Typical Inputs

Typical Outputs

What this skill does

  • Design batch and streaming data pipelines
  • Build data lakehouse and warehouse architectures
  • Implement data transformations using dbt
  • Orchestrate workflows using Apache Airflow
  • Implement data quality and governance
  • Optimize query performance and cloud costs

Inputs

  • Data sources
  • Storage systems
  • Data contracts and SLAs
  • Access credentials

Outputs

  • Data pipelines
  • Data warehouses and lakehouses
  • Data quality reports
  • Infrastructure as code templates

Requirements

  • Access permissions to data sources and storage
  • Cloud data platform environment

Source

  • Spec: SKILL.md

ClawIndex

OpenClaw Skills & Use Case Index

ClawIndex is an ecosystem-driven index of OpenClaw skills and real-world use cases.

Index

Skills·
Cases

Meta

About·
Disclaimer·
Email·
GitHub
© 2026 ClawIndex All Rights Reserved.
data-engineering
data-pipeline
data-warehouse
apache-spark
dbt
apache-airflow
Design batch and streaming data pipelines
Build data lakehouse and warehouse architectures
Implement data transformations using dbt
Orchestrate workflows using Apache Airflow
Data sources
Storage systems
Data contracts and SLAs
Data pipelines
Data warehouses and lakehouses
Data quality reports