edfEazyDataFix

Titanic Dataset

The classic tutorial dataset — clean, profile and export.

Overview

The classic Kaggle Titanic dataset. Runs the full pipeline in six lines and prints an audit trail suitable for reproducible notebooks.

Dataset

titanic.csv891 rows × 12 columns
PassengerIdPclassSexAgeSibSpFare...

Python code

titanic.py
import eazydatafix as edf

report = edf.assess("titanic.csv")
result = edf.fix("titanic.csv")
result.to_csv("titanic.clean.csv")
print(result.applied_fixes)

Expected output

Python 3.11
>>> result = edf.fix("titanic.csv")
>>> print(result.applied_fixes)
['impute_missing(Age, median)', 'coerce_numeric', 'drop_duplicates(0)']