Drop any file from this directory onto Data Pilot to explore that format. Regenerate all files with:
cargo run -p gen-samples
| File | Format | Notes |
|---|---|---|
iris.parquet |
Apache Parquet | Iris dataset (150 rows × 5 cols), Snappy compression |
iris.delta/ |
Delta Lake | Minimal Delta table with one active Parquet data file |
iris.iceberg/ |
Apache Iceberg | Minimal Iceberg table with one active Parquet data file |
iris.lance/ |
Lance | Iris dataset (150 rows × 5 cols); written with lance 4.0.1 |
iris.feather |
Arrow IPC file | Random-access Arrow IPC (Feather v2) |
iris.arrow |
Arrow IPC stream | Streaming Arrow IPC format |
iris.csv |
CSV | Comma-delimited with header row |
iris.tsv |
TSV | Tab-delimited with header row |
iris.jsonl |
NDJSON | One JSON object per line |
iris.json |
JSON | Top-level array of objects |
sales.xlsx |
Excel | 2 sheets: orders (15 rows) and customers (10 rows); exercises mixed types and dates |
chinook.sqlite |
SQLite | 2 tables: Albums (8 rows) and Tracks (20 rows) |
cities.geoparquet |
GeoParquet | 8 world cities with WKB Point geometry; GeoParquet 1.1.0 metadata |
iris.orc |
Apache ORC | Iris dataset (150 rows × 5 cols); written with orc-rust |
iris.avro |
Apache Avro | Iris dataset (150 rows × 5 cols); written with apache-avro |
iris.vortex |
Vortex | Iris dataset (150 rows × 5 cols); written with vortex 0.70 |