import pandas as pd def dedupe(path): df = pd.read_csv(path).drop_duplicates() df.to_csv("clean.csv", index=False)