spaCy - Util.filter_spans
此实用函数是在 2.0 版中引入的。它将过滤 span 对象序列并删除重复项。此函数对于创建命名实体非常有用。
参数
下表解释了其参数 −
| NAME | TYPE | DESCRIPTION |
|---|---|---|
| spans | iterable | 它表示要过滤的跨度。 |
示例
util.filter_spans() 函数的示例如下 −
import spacy
text = nlp("This is Tutorialspoint.com.")
spans = [text[0:2], text[0:2], text[0:4]]
filtered_document = spacy.util.filter_spans(spans)
filtered_document
输出
您将收到以下输出 −
[This is Tutorialspoint.com.]

spacy_util_get_data_path.html