I am struggling to extract text from a file. The text is in the following format with [] signifying a delimiter.
File Text:
[Dataset 1] "text" [Filename 1] "text" [Filename 2] "text" [Key Data Delimiter] !key data! [Key Data Delimiter] "text" [Filename 3] "text" [Dataset 2] "text" [Filename 1] [Key Data Delimiter] key data [Key Data Delimeter] "text" [Filename 2] [Dataset 3]...
Desired Output:
[Dataset 1], [Filename 2], !key data!.
[Dataset 2], [Filename 1], !key data!.
With the filename being after which filename the key delimiter appears and before another Dataset. There is only one file containing key data per Dataset.
f = open('file.txt', 'r')
TextBetween_KeyDataDelimeter = re.findall('KeyDataDelimeter(.+?)KeyDataDelimiter',f.read(), re.DOTALL)
I'm thinking of nested for loops with if/else statements but that seems quite messy. Can someone please point me to docs I should read to help me out.