搜索关键字：nltk，搜索到189个结果！码迷,mamicode.com！

记录一下WordNet多线程下的bug

使用线程池的时候，WordNet会出现lazyrender的错误，通过查看一些资料，使用下面的方法去解决： import nltk from nltk.corpus import sentiwordnet as swn # Do this first, that'll do something ev ...

分类：编程语言时间：2021-05-23 23:47:26 阅读次数：0

NLTK：Natural Language Toolkit

Natural Language Toolkit http://www.nltk.org/book/ 干货！详述Python NLTK下如何使用stanford NLP工具包 ...

分类：其他好文时间：2020-06-25 09:57:08 阅读次数：48

12.朴素贝叶斯-垃圾邮件分类

1. 读邮件数据集文件，提取邮件本身与标签。列表 numpy数组 2.邮件预处理邮件分句名子分词去掉过短的单词词性还原连接成字符串传统方法来实现 nltk库的安装与使用 pip install nltk import nltk nltk.download() # sever地址改成 h ...

分类：其他好文时间：2020-06-16 13:15:18 阅读次数：60

12.朴素贝叶斯-垃圾邮件分类

1. 读邮件数据集文件，提取邮件本身与标签。列表 numpy数组 2.邮件预处理邮件分句句子分词大小写，标点符号，去掉过短的单词词性还原：复数、时态、比较级连接成字符串 2.1 传统方法来实现 2.2 nltk库的安装与使用 pip install nltk import nltk nl ...

分类：其他好文时间：2020-06-14 20:23:08 阅读次数：60

12朴素贝叶斯-垃圾邮件分类

1. 读邮件数据集文件，提取邮件本身与标签。列表 numpy数组 2.邮件预处理邮件分句句子分词大小写，标点符号，去掉过短的单词词性还原：复数、时态、比较级连接成字符串 2.1 传统方法来实现 2.2 nltk库的安装与使用 pip install nltk import nltk nl ...

分类：其他好文时间：2020-06-09 09:49:32 阅读次数：77

12.朴素贝叶斯-垃圾邮件分类

12.朴素贝叶斯-垃圾邮件分类 1. 读邮件数据集文件，提取邮件本身与标签。列表 numpy数组 2.邮件预处理邮件分句名子分词去掉过短的单词词性还原连接成字符串传统方法来实现 nltk库的安装与使用 pip install nltk import nltk nltk.download ...

分类：其他好文时间：2020-06-07 15:10:03 阅读次数：82

12.朴素贝叶斯-垃圾邮件分类

1. 读邮件数据集文件，提取邮件本身与标签。列表 numpy数组 2.邮件预处理邮件分句句子分词大小写，标点符号，去掉过短的单词词性还原：复数、时态、比较级连接成字符串 2.1 传统方法来实现 2.2 nltk库的安装与使用 pip install nltk import nltk nl ...

分类：其他好文时间：2020-06-07 14:56:00 阅读次数：66

【NLP-00-3】BLEU计算

目录定义 BLEU算法详解 NLTK实现一、定义 BLEU (其全称为Bilingual Evaluation Understudy), 其意思是双语评估替补。所谓Understudy (替补)，意思是代替人进行翻译结果的评估。尽管这项指标是为翻译而发明的，但它可以用于评估一组自然语言处理任务生 ...

分类：其他好文时间：2020-05-26 22:05:43 阅读次数：143

13-垃圾邮件分类2

1.读取 2.数据预处理 # 词性还原def get_wordnet_pos(treebank_tag): if treebank_tag.startswith('J'): return nltk.corpus.wordnet.ADJ elif treebank_tag.startswith('V' ...

分类：其他好文时间：2020-05-23 20:31:50 阅读次数：70

13-垃圾邮件分类2

1.读取 2.数据预处理 import csv import nltk import re from nltk.corpus import stopwords from nltk.stem import WordNetLemmatizer import pandas as pd #返回类别 def ...

分类：其他好文时间：2020-05-23 20:02:00 阅读次数：60