I would like to extract all characters between <td>Jan</td><td> and the next occurrence of </td> in the following string:
<html xmlns:fo="http://www.w3.org/1999/XSL/Format" xmlns:msxsl="urn:schemas-microsoft-com:xslt">
<head>
<META http-equiv="Content-Type" content="text/html">
<meta http-equiv="content-type" content="text/html; charset=UTF-8">
</head>
<body style="margin:0px 0px 0px 0px;overflow:auto;background:#FFFFFF;">
<table style="font-family:Arial,Verdana,Times;font-size:12px;text-align:left;width:100%;border-collapse:collapse;padding:3px 3px 3px 3px">
<tr style="text-align:center;font-weight:bold;background:#9CBCE2">
<td>0</td>
</tr>
<tr>
<td>
<table style="font-family:Arial,Verdana,Times;font-size:12px;text-align:left;width:100%;border-spacing:0px; padding:3px 3px 3px 3px">
<tr>
<td>FID</td>
<td>0</td>
</tr>
<tr bgcolor="#D4E4F3">
<td>Consumption_m3</td>
<td>0.0e+000</td>
</tr>
<tr>
<td>Area_m2</td>
<td>3.4e+008</td>
</tr>
<tr bgcolor="#D4E4F3">
<td>Jan</td>
<td>-9999</td>
</tr>
<tr>
<td>Feb</td>
<td>-9999</td>
</tr>
<tr bgcolor="#D4E4F3">
<td>Mar</td>
<td>-9999</td>
</tr>
<tr>
<td>Apr</td>
<td>-9999</td>
</tr>
<tr bgcolor="#D4E4F3">
<td>May</td>
<td>-9999</td>
</tr>
<tr>
<td>Jun</td>
<td>-9999</td>
</tr>
<tr bgcolor="#D4E4F3">
<td>Jul</td>
<td>-9999</td>
</tr>
<tr>
<td>Aug</td>
<td>-9999</td>
</tr>
<tr bgcolor="#D4E4F3">
<td>Sep</td>
<td>-9999</td>
</tr>
<tr>
<td>Oct</td>
<td>-9999</td>
</tr>
<tr bgcolor="#D4E4F3">
<td>Nov</td>
<td>-9999</td>
</tr>
<tr>
<td>Dec</td>
<td>-9999</td>
</tr>
<tr bgcolor="#D4E4F3">
<td>Annual agri</td>
<td>-9999</td>
</tr>
<tr>
<td>Annual non-agri</td>
<td>-9999</td>
</tr>
<tr bgcolor="#D4E4F3">
<td>Annual unknown</td>
<td>-9999</td>
</tr>
</table>
</td>
</tr>
</table>
</body>
</html>
I tried (?<=<td>Jan</td><td>)(.*)(</td>). However, this returns all characters between <td>Jan</td><td> and the last occurrence of </td>.
How can I extract the characters between <td>Jan</td><td> and the next occurrence of </td> namely -9999?
