一、similar
用来识别文章中和搜索词相似的词语,可以用在搜索引擎中的相关度识别功能中。
text1.similar("monstrous")
查询出了text1中与monstrous相关的所有词语:

二、common_contexts
用来识别2个关键词相似的词语。
text2.common_contexts(["monstrous","very"])

三、generate
用来自动生成文章。
text3.generate()

四、len
可以用于判断重复词密度
from __future__ import division
len(text3) / len(set(text3))

图中显示 正文字数/不重复词语字数 = 16,说明有15/16是无效字符。
五、count
可以用于判断关键词密度。
text3.count('smote') / len(text3)

本文深入探讨了深度学习技术在自然语言处理领域的应用,包括词法分析、句法分析、语义分析等关键任务,展示了深度学习如何通过复杂的神经网络结构提升语言理解与生成能力。
:常用方法(similar、common_contexts、generate)...&spm=1001.2101.3001.5002&articleId=85497428&d=1&t=3&u=7a92d269e69a4b69a0a81e94104bb0b2)
1119

被折叠的 条评论
为什么被折叠?



