Titanic Dataset

The classic tutorial dataset — clean, profile and export.

Overview

The classic Kaggle Titanic dataset. Runs the full pipeline in six lines and prints an audit trail suitable for reproducible notebooks.

Dataset

titanic.csv891 rows × 12 columns
PassengerIdPclassSexAgeSibSpFare...

An anonymized copy of the classic Titanic tutorial dataset; names and ticket IDs are replaced with synthetic identifiers.

Python code

titanic.py
import eazydatafix as edf

report = edf.assess("titanic.csv")
result = edf.fix("titanic.csv")
result.save("titanic.clean.csv")

print(f"Quality before: {report.quality.score:.2f}")
print(result.applied_fixes)

Expected output

Python 3.11
>>> result = edf.fix("titanic.csv")
Quality before: 88.59
>>> print(result.applied_fixes)
['Normalized column names.', "Filled numeric column 'age' using median."]