To clean a dataset, I need to split a string after the last digit. Any idea ?
My dataframe:
data = {'addr':[
"510 -1, Cleveland St",
"RC-20-5345 Poplar Street",
"3600 Race Avenue Richardson"]}
df = pd.DataFrame(data)
addr
_____________________________________
510 -1, Cleveland St
RC-20-5345 Poplar Street
3600 Race Avenue Richardson
I tried with this expression, but I missed floor number (RC) in the second row.
df["split1"] = df["addr"].str.extract(r"(\d+[-\ ]+\d*)")
split1 | split2
___________|_________________________
510 -1 | , Cleveland St
20-5345 | Poplar Street
3600 | Race Avenue Richardson
What I m looking for:
split1 | split2
___________|_________________________
510 -1 | , Cleveland St
RC-20-5345 | Poplar Street
3600 | Race Avenue Richardson