Which Python method can be used to Remove duplicates by Data scientist?
The drop_duplicates() method removes duplicate rows.
dataframe.drop_duplicates(subset, keep, inplace, ignore_index)
Remove duplicate rows from the DataFrame:
1. import pandas as pd
2. data = {
3. 'name': ['Peter', 'Mary', 'John', 'Mary'],
4. 'age': [50, 40, 30, 40],
5. 'qualified': [True, False, False, False]
6. }
7.
8. df = pd.DataFrame(data)
9. newdf = df.drop_duplicates()
Pilar
9 months agoStarr
9 months agoRenea
9 months agoCora
10 months agoMeaghan
10 months agoTammara
10 months agoDevorah
10 months agoBeth
10 months agoAriel
11 months agoJanet
11 months agoKina
11 months agoIsreal
11 months agoTonette
11 months agoWalker
11 months agoCecil
11 months agoRozella
11 months agoEmelda
2 years agoBulah
2 years agoKirby
2 years agoFannie
2 years agoDolores
2 years agoVincent
2 years agoSolange
2 years agoBambi
2 years agoDenna
2 years agoMy
2 years agoGlory
2 years agoAudry
2 years agoDulce
2 years agoCandra
2 years agoSylvie
2 years agoPilar
2 years agoEdgar
2 years agoAmalia
2 years agoBarbra
2 years agoIvette
2 years agoLynelle
2 years agoKimberely
2 years agoDominic
2 years agoDominga
2 years agoHuey
2 years ago