I have a parquet dataset structured like:
/path/to/dataset/a=True/b=1/data.parquet
/path/to/dataset/a=False/b=1/data.parquet
/path/to/dataset/a=True/b=2/data.parquet
/path/to/dataset/a=False/b=2/data.parquet
...
how do i specify the dtypes of partition fields (here, a and b) when calling dd.read_parquet on a directory like this?
i am using the pyarrow engine. do i need to specify a kwarg for a pyarrow function? if so, what would this be?
or, can i just call astype(dict(a="bool", b="int")) or something similar?
later on in my code, I am calling DataFrame.query to filter values, so dtype is important for boolean values, for example.