I have two python pandas dataframes, in simplified form they look like this:
DF1
+---------+---------+------+-------+
| Date_in | Date_out| Group| Item |
+---------+---------+------+-------+
| 1991-08 | 2000-08 | A | A1 |
| 1992-08 | NaT | A | A2 |
| 1997-02 | NaT | B | B1 |
| 1998-03 | 2001-03 | C | C1 |
| 1999-02 | 2002-02 | D | D1 |
| 2000-02 | NaT | D | D2 |
| 2000-03 | 2001-04 | D | D3 |
| 2001-08 | NaT | D | D4 |
+---------+---------+------+-------+
DF2
+---------+-------+
| Date | Group |
+---------+-------+
| 2000-01 | A |
| 2001-02 | A |
| 2001-03 | B |
| 2001-04 | B |
| 2001-05 | C |
| 2001-06 | C |
| 2001-03 | D |
| 2001-07 | D |
+---------|-------+
I want to count how many item still existed in Group column DF2 based on date constraint in DF1
Desired output
+---------+-------+-------+
| Date | Group | Total |
+---------+-------+-------+
| 2000-01 | A | 2 |
| 2001-02 | A | 1 |
| 2001-03 | B | 1 |
| 2001-04 | B | 1 |
| 2001-05 | C | 0 |
| 2001-06 | C | 0 |
| 2001-03 | D | 3 |
| 2001-07 | D | 2 |
+---------|-------+-------+