Titanic Dataset
The classic tutorial dataset — clean, profile and export.
Overview
The classic Kaggle Titanic dataset. Runs the full pipeline in six lines and prints an audit trail suitable for reproducible notebooks.
Dataset
titanic.csv891 rows × 12 columnsPassengerIdPclassSexAgeSibSpFare...
An anonymized copy of the classic Titanic tutorial dataset; names and ticket IDs are replaced with synthetic identifiers.
Python code
titanic.py
python
import eazydatafix as edf
report = edf.assess("titanic.csv")
result = edf.fix("titanic.csv")
result.save("titanic.clean.csv")
print(f"Quality before: {report.quality.score:.2f}")
print(result.applied_fixes)Expected output
Python 3.11
>>> result = edf.fix("titanic.csv")Quality before: 88.59>>> print(result.applied_fixes)['Normalized column names.', "Filled numeric column 'age' using median."]