Home / Categories / Data
📊

Data

Data analysis, SQL queries, D3.js visualizations, statistical analysis, and dashboards.

Skills 86
Featured 2
📊 Data
RARE

Pandera DataFrame Validation

Validate pandas DataFrames with pandera schemas. Defines column checks, dtype and range constraints, class-based schema models, and decorator-based validation so bad data fails fast in your pipelines.

Community 1.9K
Scanned
pandera dataframe validation
mkdir -p ~/.claude/skills/pandera-validation && curl -fsSL https://raw.githubusercontent.com/majesticlabs-dev/majestic-marketplace/HEAD/plugins/majestic-data/skills/pandera-validation/SKILL.md -o ~/.claude/skills/pandera-validation/SKILL.md
📊 Data
RARE

ClickHouse OLAP

Design and query ClickHouse for real-time analytics. Models MergeTree tables, writes fast aggregations and materialized views, tunes partitions and indexes, and connects from Node and Python clients.

Community 1.8K
Scanned
clickhouse olap analytics
mkdir -p ~/.claude/skills/clickhouse-olap && curl -fsSL https://raw.githubusercontent.com/vibeeval/vibecosystem/HEAD/skills/clickhouse-io/SKILL.md -o ~/.claude/skills/clickhouse-olap/SKILL.md
⚙️ Engineering
RARE

Meilisearch Integration

Add instant search to your application with Meilisearch. Generates index configurations, search UI components, faceted filtering, typo-tolerant queries, and relevancy tuning for sub-50ms search results.

Meilisearch 1.8K
Scanned
meilisearch search full-text
mkdir -p ~/.claude/skills/meilisearch && curl -fsSL https://raw.githubusercontent.com/Jeffallan/claude-skills/HEAD/skills/feature-forge/SKILL.md -o ~/.claude/skills/meilisearch/SKILL.md
📊 Data
RARE

Great Expectations Data Quality

Add automated data-quality gates with Great Expectations. Profiles datasets, generates expectation suites, runs validations and checkpoints, and wires quality gates into pipelines to catch bad data early.

Community 1.7K
Scanned
great-expectations data-quality validation
mkdir -p ~/.claude/skills/great-expectations && curl -fsSL https://raw.githubusercontent.com/jamiojala/skillforge/HEAD/skills/data-quality-gatekeeper/SKILL.md -o ~/.claude/skills/great-expectations/SKILL.md
📊 Data
RARE

Apache Iceberg Lakehouse

Build an open lakehouse on Apache Iceberg. Designs Iceberg tables and partitions, manages schema and partition evolution, handles snapshots, time travel, and compaction, and queries from Spark, Trino, and DuckDB across S3 or GCS.

Community 1.6K
Scanned
iceberg lakehouse table-format
mkdir -p ~/.claude/skills/apache-iceberg && curl -fsSL https://raw.githubusercontent.com/Evan-Kim2028/agent-skills/main/skills/data/apache-lakehouse/SKILL.md -o ~/.claude/skills/apache-iceberg/SKILL.md
📊 Data
RARE

Data Masking & Anonymization

Protect sensitive data with masking and anonymization. Redacts PII, PCI, and PHI in databases, logs, and APIs, and applies k-anonymity, tokenization, and differential privacy for GDPR-compliant data sharing.

Community 1.6K
Scanned
data-masking pii anonymization
mkdir -p ~/.claude/skills/data-masking && curl -fsSL https://raw.githubusercontent.com/TerminalSkills/skills/main/skills/data-masking/SKILL.md -o ~/.claude/skills/data-masking/SKILL.md
📊 Data
RARE

Snowflake Cost Optimizer

Cut Snowflake spend by analyzing warehouse and query costs. Surfaces the most expensive queries, detects anti-patterns like full scans and oversized warehouses, and recommends concrete optimizations.

Community 1.6K
Scanned
snowflake cost-optimization finops
mkdir -p ~/.claude/skills/snowflake-cost && curl -fsSL https://raw.githubusercontent.com/AltimateAI/altimate-code/HEAD/.opencode/skills/cost-report/SKILL.md -o ~/.claude/skills/snowflake-cost/SKILL.md
📊 Data
RARE

Apache Arrow

Move and process columnar data at speed with Apache Arrow. Uses zero-copy in-memory format, Arrow Flight for fast transport, and interop across pandas, Polars, DuckDB, and Parquet without serialization overhead.

Community 1.5K
Scanned
apache-arrow columnar in-memory
mkdir -p ~/.claude/skills/apache-arrow && curl -fsSL https://raw.githubusercontent.com/TerminalSkills/skills/main/skills/apache-arrow/SKILL.md -o ~/.claude/skills/apache-arrow/SKILL.md
📊 Data
RARE

GeoPandas Geospatial

Analyze geospatial vector data with GeoPandas. Reads shapefiles, GeoJSON, and PostGIS, runs spatial joins, overlays, buffers, and reprojections, and builds choropleth maps — pandas for geographic data.

Community 1.5K
Scanned
geopandas geospatial gis
mkdir -p ~/.claude/skills/geopandas && curl -fsSL https://raw.githubusercontent.com/foryourhealth111-pixel/Vibe-Skills/HEAD/bundled/skills/geopandas/SKILL.md -o ~/.claude/skills/geopandas/SKILL.md
⚙️ Engineering
RARE

ML Experiment Tracking

Track ML experiments with reproducible parameters, metrics, and artifacts. Logs runs, compares hyperparameter sweeps, and versions models so training results stay reproducible and easy to compare.

Community 1.5K
Scanned
mlops experiment-tracking reproducibility
mkdir -p ~/.claude/skills/ml-experiment-tracking && curl -fsSL https://raw.githubusercontent.com/diegosouzapw/awesome-omni-skill/HEAD/skills/machine-learning/ml-experiment-tracking/SKILL.md -o ~/.claude/skills/ml-experiment-tracking/SKILL.md
📊 Data
RARE

Redpanda Streaming

Run Kafka-compatible streaming on Redpanda with rpk. Creates and configures topics, manages clusters, profiles, and connections, wires SASL and TLS and the schema registry, and operates tiered storage — a drop-in Kafka replacement with no ZooKeeper.

Community 1.5K
Scanned
redpanda kafka streaming
mkdir -p ~/.claude/skills/redpanda-streaming && curl -fsSL https://raw.githubusercontent.com/redpanda-data/skills/main/skills/rpk/SKILL.md -o ~/.claude/skills/redpanda-streaming/SKILL.md
📊 Data
RARE

Soda Data Quality

Catch bad data before it hits dashboards with Soda. Writes SodaCL checks for freshness, completeness, uniqueness, validity, and custom business rules, profiles datasets, and wires quality gates into pipelines and CI to stop bad data early.

Community 1.5K
Scanned
soda data-quality testing
mkdir -p ~/.claude/skills/soda-data-quality && curl -fsSL https://raw.githubusercontent.com/TerminalSkills/skills/main/skills/soda/SKILL.md -o ~/.claude/skills/soda-data-quality/SKILL.md
📊 Data
RARE

Apache Flink Streaming

Build stateful stream-processing jobs with Apache Flink. Writes DataStream and SQL jobs, manages windows, watermarks, and state, configures checkpointing, and tunes throughput for real-time pipelines.

Community 1.4K
Scanned
flink stream-processing real-time
mkdir -p ~/.claude/skills/flink-streaming && curl -fsSL https://raw.githubusercontent.com/jeremylongshore/claude-code-plugins-plus-skills/HEAD/skills/11-data-pipelines/flink-job-creator/SKILL.md -o ~/.claude/skills/flink-streaming/SKILL.md
📢 Marketing
RARE

Conversion Rate Optimization

Analyze and optimize conversion funnels. Designs A/B test hypotheses, analyzes heatmap data, identifies drop-off points, generates landing page copy variants, and creates data-driven CRO reports.

Community 1.4K
Scanned
cro conversion ab-testing
mkdir -p ~/.claude/skills/cro-optimization && curl -fsSL https://raw.githubusercontent.com/rampstackco/claude-skills/HEAD/skills/cro-optimization/SKILL.md -o ~/.claude/skills/cro-optimization/SKILL.md
📊 Data
RARE

Cube Semantic Layer

Define metrics once and serve them everywhere with Cube. Models cubes, dimensions, measures, and joins, exposes a headless semantic layer over REST, GraphQL, and SQL, and tunes pre-aggregations, caching, and multi-tenant security.

Community 1.4K
Scanned
cube semantic-layer headless-bi
mkdir -p ~/.claude/skills/cube-semantic-layer && curl -fsSL https://raw.githubusercontent.com/TerminalSkills/skills/main/skills/cube/SKILL.md -o ~/.claude/skills/cube-semantic-layer/SKILL.md
📊 Data
RARE

Dask Parallel Python

Scale Python and pandas with Dask. Parallelizes DataFrame and array workloads across cores or a cluster, tunes partitions and the task graph, handles larger-than-memory data, and diagnoses spill and shuffle bottlenecks from the dashboard.

Community 1.4K
Scanned
dask parallel pandas
mkdir -p ~/.claude/skills/dask-parallel && curl -fsSL https://raw.githubusercontent.com/K-Dense-AI/scientific-agent-skills/main/skills/dask/SKILL.md -o ~/.claude/skills/dask-parallel/SKILL.md
📊 Data
RARE

NotebookLM Research Agent

Autonomous research agent powered by Google NotebookLM. Ingests sources (URL, PDF, DOCX, YouTube, Drive), runs deep web research, asks cited questions, and generates artifacts — audio podcasts, video, slide decks, reports, quizzes, flashcards, mind maps, and study guides.

jakubs2623 1.4K
Scanned
notebooklm research rag
mkdir -p ~/.claude/skills/notebooklm-research && curl -fsSL https://raw.githubusercontent.com/jakubs2623/notebooklm-skill/HEAD/SKILL.md -o ~/.claude/skills/notebooklm-research/SKILL.md
⚙️ Engineering
RARE

Modal Serverless Compute

Run Python and GPU workloads serverlessly with Modal. Covers defining functions and images in code, on-demand GPU containers, scale-to-zero, scheduled and web endpoints, volumes and secrets, and fan-out parallelism for batch inference and data jobs.

Community 1.4K
Scanned
modal serverless gpu
mkdir -p ~/.claude/skills/modal-serverless && curl -fsSL https://raw.githubusercontent.com/diegosouzapw/awesome-omni-skill/HEAD/skills/devops/modal-serverless-gpu/SKILL.md -o ~/.claude/skills/modal-serverless/SKILL.md
📊 Data
RARE

Evidence (BI as Code)

Build BI reports as code with Evidence. Writes SQL plus Markdown pages that render interactive charts and tables, parameterizes reports with query results, and ships polished, version-controlled data apps as static sites — no drag-and-drop BI.

Community 1.3K
Scanned
evidence bi sql
mkdir -p ~/.claude/skills/evidence-bi && curl -fsSL https://raw.githubusercontent.com/TerminalSkills/skills/main/skills/evidence/SKILL.md -o ~/.claude/skills/evidence-bi/SKILL.md
Added to wishlist