I have a dataframe
df = pd.DataFrame({
'BU': ['Total', 'Total', 'Total', 'CRS', 'CRS', 'CRS'],
'Line_Item': ['Revenues','EBT', 'Expenses', 'Revenues', 'EBT', 'Expenses'],
'Small Business Loans < $100K 2020 ($000)': [100, 120, 0, 200, 190, 210],
'Small Business Loans < $100K 2019 ($000)': [100, 0, 130, 200, 190, 210],
'Small Business Loans < $100K 2018 ($000)': [200, 250, 0, 120, 0, 190],
'Small Business Loans $100K-$250K 2020 ($000)': [100, 120, 0, 200, 190, 210],
'Small Business Loans $100K-$250K 2019 ($000)': [100, 0, 130, 200, 190, 210],
'Small Business Loans $100K-$250K 2018 ($000)': [200, 250, 0, 120, 0, 190]
'Multi Family Loans 2020 ($000)': [100, 120, 0, 200, 190, 210],
'Multi Family Loans 2019 ($000)': [100, 0, 130, 200, 190, 210],
'Multi Family Loans 2018 ($000)': [200, 250, 0, 120, 0, 190]
})
I wish to create new columns which add 'Small Business Loans < $100K 2020 ($000)' to 'Small Business Loans $100K-$250K 2020 ($000)' and 'Small Business Loans < $100K 2019 ($000)' to 'Small Business Loans $100K-$250K 2019 ($000)'.
Basically I want to the see the sum of loans by year
The actual data set has many rows and other such sets of columns.
If the columns were identically named in two dataframes I could have used
df_add = df1.add(df2, fill_value=0)