Titanic Dataset
The classic tutorial dataset — clean, profile and export.
Overview
The classic Kaggle Titanic dataset. Runs the full pipeline in six lines and prints an audit trail suitable for reproducible notebooks.
Dataset
titanic.csv891 rows × 12 columnsPassengerIdPclassSexAgeSibSpFare...
Python code
titanic.py
python
import eazydatafix as edf
report = edf.assess("titanic.csv")
result = edf.fix("titanic.csv")
result.to_csv("titanic.clean.csv")
print(result.applied_fixes)Expected output
Python 3.11
>>> result = edf.fix("titanic.csv")>>> print(result.applied_fixes)['impute_missing(Age, median)', 'coerce_numeric', 'drop_duplicates(0)']