NLTK安装教程

简介: NLTK是自然语言处理中常用的Python包,本文介绍NLTK包的安装方式,以及在这一安装过程中常见的坑。NLTK官网:NLTK :: Natural Language ToolkitNLTK的安装分为Python包的安装和NLTK data的安装,以下会分别对其进行介绍。

1. NLTK包安装


官网安装教程:NLTK :: Installing NLTK

NLTK仅支持3.7, 3.8, 3.9, 3.10版本的Python。

我是用Linux服务器运行,因此参考Unix系统的安装教程。但是需要注意的是,官网上直接给出的命令行是:pip install --user -U nltk 建议去掉--user参数,原因如下:


直接使用这个命令可以正确安装NLTK包,但是根据 -user 参数,会安装到用户文件夹下:

image.png

就像这个警告信息所显示的那样,我的这个本地路径不在系统路径下,所以这个的问题在于,使用VSCode的话,终端是可以正确调用的:

image.png

但是在VSCode编辑器直接打开的jupyer notebook文件中就无法直接调用。我怀疑是因为jupyter notebook文件的工作路径就是对应文件,因此找不到这个包。

所以我的做法是我在jupyter notebook里面pip install nltk(如果在终端这么干还是会导致包下载在.local/下):

image.png

这样就可以正常import nltk了。

可以看出直接用这个命令,就会安装到包路径下:



2. NLTK data的安装


官网安装教程:NLTK :: Installing NLTK Data


当代码中出现需要用到指定data,但是对应的Python虚拟环境中没有相应data的时候,就会自动提示运行代码来安装,以stopwords为例,当代码中出现from nltk.corpus import stopwords但是没有下载时,就会自动提示运行如下代码:


import nltk
nltk.download('stopwords')


输出:


[nltk_data] Downloading package stopwords to
[nltk_data]     /home/user_name/nltk_data...
[nltk_data]   Unzipping corpora/stopwords.zip.
True


即为安装成功,下次执行from nltk.corpus import stopwords就能执行成功了。


相关文章
|
Kubernetes Linux Shell
k8s教程(pod篇)-定时任务
k8s教程(pod篇)-定时任务
1289 1
|
人工智能 前端开发 测试技术
AI:探究下前端组件化设计的实现方法及其重要性(一)
AI:探究下前端组件化设计的实现方法及其重要性
|
6月前
|
存储 人工智能 JavaScript
保姆级图文教程!阿里云/本地部署OpenClaw(Clawdbot)+百炼 Coding Plan API配置+实战场景解析
朋友圈里有人用它自动整理工作报告,小红书上有人靠它接管社交消息,还有人让它7×24小时盯着任务自动推进——2026年,这只名叫OpenClaw的“龙虾”(社区昵称,因英文名中“Claw”意为钳子得名)彻底火了。它不像普通AI那样局限在聊天窗口里,而是“住”在你的电脑或服务器上,成为随叫随到、能真正动手干活的AI雇员。
1429 2
|
Ubuntu Linux 程序员
Ubuntu 18.04 安装详细步骤与设置指南
接下来,我们将探讨如何进行个人信息设置。重启选择高级模式,联网更新软件包并安装硬件驱动程序以完成个人信息设置。在重启过程中,你需要按下esc键(只需按一下)来选择ubuntu的高级模式。重启完成后,请联网并打开终端,然后输入以下字符以继续设置过程。
|
编解码 自然语言处理 算法
ROSTEA软件下载及情感分析详细操作教程(附网盘链接)
ROSTEA软件下载及情感分析详细操作教程(附网盘链接)
5155 0
|
机器学习/深度学习 人工智能 自然语言处理
【AI 初识】递归神经网络 (RNN) 概念
【5月更文挑战第2天】【AI 初识】递归神经网络 (RNN) 概念
【51单片机】Kn独立按键控制【LED亮灭】【LED状态】【LED二进制式显示】【LED不断移位】(4)
【51单片机】Kn独立按键控制【LED亮灭】【LED状态】【LED二进制式显示】【LED不断移位】(4)
|
SQL 运维 druid
深度分析:Apache Doris及其在大数据处理中的应用
Apache Doris是一款开源的高性能实时分析数据库,设计用于低延迟SQL查询和实时数据处理,适合大规模实时分析场景。与Apache Druid、ClickHouse和Greenplum相比,Doris在易用性和实时性上有优势,但其他产品在特定领域如高吞吐、SQL支持或数据处理有特长。选型要考虑查询性能、实时性、SQL需求和运维成本。Doris适用于实时数据分析、BI报表、数据中台和物联网数据处理。使用时注意资源配置、数据模型设计、监控调优和导入策略。