码迷,mamicode.com
首页 > 其他好文 > 详细

doc2vec 利用gensim 生成文档向量

时间:2016-05-30 23:28:15      阅读:4353      评论:0      收藏:0      [点我收藏+]

标签:

利用gensim 直接生成文档向量

    
    def gen_d2v_corpus(self, lines):

        with open("./data/ques2_result.txt", "wb") as fw:
            for line in lines:
                fw.write(" ".join(jieba.lcut(line)) + "\n")

        sents = doc2vec.TaggedLineDocument("./data/ques2_result.txt")
        model = doc2vec.Doc2Vec(sents, size = 50, window = 5, alpha = 0.015)
        model.train(sents)

        corpus = model.docvecs
        np.save("./output/d2v.corpus.npy", corpus)

        return np.asarray(corpus)

 

doc2vec 利用gensim 生成文档向量

标签:

原文地址:http://www.cnblogs.com/jkmiao/p/5544112.html

(2)
(1)
   
举报
评论 一句话评论(0
登录后才能评论!
© 2014 mamicode.com 版权所有  联系我们:gaon5@hotmail.com
迷上了代码!