Gensim 的 Doc2Vec most_similar 文档结果集中是否有限制?

aja*_*ahu 5 python-3.x gensim

我一直在试验 doc2vec 模块一段时间了。我可以训练我的模型并让训练后的模型输出给定文档的类似文档,如下所示:

import re
modelloaded=Doc2Vec.load("model_all_doc_dm_1")

st = 'long description of a document as string'
doc = re.sub('[^a-zA-Z]', ' ', st).lower().split() 

new_doc_vec = modelloaded.infer_vector(doc)

modelloaded.docvecs.most_similar([new_doc_vec])
Run Code Online (Sandbox Code Playgroud)

这很有效,并给了我 10 个结果。有没有办法获得超过 10 个结果,或者这是限制?

aja*_*ahu 5

我找到了:

modelloaded.docvecs.most_similar([new_doc_vec], topn=N)
Run Code Online (Sandbox Code Playgroud)

该topn=N句柄可用于获得 10 多个结果。