This repo contains a tiny, reproducible EDA workflow using a dummy dataset (100 rows × 10 columns).
python -m venv .venv
source .venv/bin/activate
pip install -r requirements.txtGenerate data + run EDA + save outputs to outputs/:
python src/run_eda.py --seed 42data/dummy_dataset.csv(generated)outputs/summary.jsonoutputs/missingness.csvoutputs/correlation.csvoutputs/*.pngplots