1
我想从多个标题标记标题级别(1级,2级,3级)。使用字体大小来自HTML的信息。首先,我把使用正则表达式的字体大小一样Uima Ruta标题级别
"<span style=\"font-family:\'(.+?)\'"->1=fontfamily;
"<span style=\"font-family(.+?)font-size:\'(.+?)\'"->2=font size;
现在我需要使用的字体大小信息,并基于其标签标题级别所有这些标题的大小进行比较。
输入:
<span style="font-family:'Times New Roman'; font-size:'14pt'"><span class="">MATERIALS AND METHODS</span></span>
<span style="font-family:'Times New Roman'; font-size:'12pt'"><span class="">Chemicals</span></span>
<span style="font-family:'Times New Roman'; font-size:'10pt'"><span class="">HILIC-MS Profiling of Metabolites</span>