我正在使用命名实体识别和分块器在NLTK上做一些工作。我nltk/chunk/named_entity.py为此训练了一个分类器,并得到了以下保证:
ChunkParse score:
IOB Accuracy: 96.5%
Precision: 78.0%
Recall: 91.9%
F-Measure: 84.4%
Run Code Online (Sandbox Code Playgroud)
但是在这种情况下,我不明白IOB准确度和精确度之间的确切区别是什么。实际上,我在文档(here)上找到了以下特定示例的内容:
IOB标签的准确性指示超过三分之一的单词被标记为O,即不在NP块中。但是,由于我们的标记器未找到任何块,因此其精度,召回率和f度量均为零。
那么,如果IOB精度只是O标签的数量,那么在该示例中,为什么我们没有块并且IOB精度不是100%呢?
先感谢您