CoreNLP server的开启与使用方法

简介: Ubuntu20.04.2系统本身不含有JDK,而CoreNLP需要依赖JDK进行运行,所以需要先安装好JDK,可以输入java,然后系统会自动提示没有安装JDK,并会推荐安装的版本

Ubuntu20.04.2使用CoreNLP


JDK安装


Ubuntu20.04.2系统本身不含有JDK,而CoreNLP需要依赖JDK进行运行,所以需要先安装好JDK,可以输入java,然后系统会自动提示没有安装JDK,并会推荐安装的版本,如下图所示:


fcaaf4f2fe7e4949846450fd52f2c8ba.png


按照你的系统版本来选择合适的JDK版本,我这里选择的是JDK11。使用命令apt install openjdk-11-jre-headless进行安装,安装之后再次输入java会提示以下信息,则表示成功安装完成。


d8c470f6016244739efb5084a8572dfe.png


CoreNLP


CoreNLP可以在Java中进行自然语言处理的工具,CoreNLP使用户能够导出文本的语言注释,包括标记和句子边界、词性、命名实体、数值和时间值、依赖关系和选区解析、共指、情感、引用归因和关系。CoreNLP目前支持8种语言:阿拉伯语、中文、英语、法语、德语、匈牙利语、意大利语和西班牙语。其功能十分强大!!!

首先跳到CoreNLP官网,我们可以看到其一些简要的介绍。首页也介绍了一些相关的安装信息,大致如下:


1、下载并解压CoreNLP工具,并将对应下载的语言包放入到解压后的文件夹内:


6b088643e6e24ec38523422c769c1253.png


2、设置环境路径export CLASSPATH=$CLASSPATH:/path/to/stanford-corenlp-4.5.4/*:,其中/path/to/表示你CoreNLP的路径所在路径,需要根据自身情况进行替换。


3、这时就到了启动CoreNLP本地server的时候,可以发现输入java -mx4g -cp "*" edu.stanford.nlp.pipeline.StanfordCoreNLPServer -port 9000 -timeout 15000还是会出现错误: 找不到或无法加载主类 edu.stanford.nlp.pipeline.StanfordCoreNLPServer 原因: java.lang.ClassNotFoundException: edu.stanford.nlp.pipeline.StanfordCoreNLPServer这种错误,这是因为你需要先切换到你的CoreNLP目录,然后再启动CoreNLP,也就是在输入命令进行执行。这样CoreNLP就启动成功。


启动后效果如下所示,只要别关闭终端,该服务器就不会停止运行:


98c01b4fbf2c4c9da5aafb961518890b.png


具体实验可以参考stog的分词过程。


参考资料


CoreNLP-4.2.0 使用以及踩坑


CoreNLP官网

目录
相关文章
|
机器学习/深度学习 自然语言处理 算法
Jieba分词的准确率提升:使用paddle模式进行分词(使用百度飞桨深度学习模型进行分词)
jieba中的paddle模式是指使用飞桨(PaddlePaddle)深度学习框架加速分词的一种模式。相对于传统的分词算法,paddle模式采用了深度学习模型,可以获得更高的分词准确度和更快的分词速度。
|
安全 Android开发 数据安全/隐私保护
请说明鸿蒙操作系统与其他操作系统(如Android和iOS)的主要区别。
请说明鸿蒙操作系统与其他操作系统(如Android和iOS)的主要区别。
1968 1
|
SQL 自然语言处理 数据库
DAIL-SQL: 发掘LLM的NL2SQL能力
最近,DAIL-SQL在魔搭创空间上线,并在NL2SQL任务上取得了新的SOTA。DAIL-SQL可以更好地利用LLM的NL2SQL能力,本文对其进行详细解读。
|
机器学习/深度学习 人工智能 Linux
anaconda conda 切换为国内源 、windows 和 Linux配置方法、 添加清华源——【一文读懂】
请问为什么我使用 Conda 搭建一个深度学习环境半个多小时都没成,而你10分钟就随手搭建一个环境; 讲道理,这就像搬砖,搬的久了,还不能允许我一天多拉几车吗
7290 0
anaconda conda 切换为国内源 、windows 和 Linux配置方法、 添加清华源——【一文读懂】
|
Java 数据库连接 Maven
手把手教你如何搭建SSM框架、图书商城系统案例
这篇文章是关于如何搭建SSM框架以及实现一个图书商城系统的详细教程,包括了项目的配置文件整合、依赖管理、项目结构和运行效果展示,并提供了GitHub源码链接。
手把手教你如何搭建SSM框架、图书商城系统案例
|
SQL 人工智能 自然语言处理
《解锁AI生成SQL新姿势:少样本提示,让查询精准度狂飙》
在数字化时代,数据是企业的核心资产,而SQL查询的准确性直接影响数据洞察的质量。AI生成SQL虽降低了技术门槛,让业务人员可通过自然语言查询数据库,但其对复杂场景的理解仍存不足,易产生语法或逻辑错误。少样本提示通过提供少量相关示例,帮助AI更精准地理解需求,显著提升SQL生成的准确性与灵活性。实际应用中,某零售企业利用此技术将查询准确率提高30%,效率提升5倍,助力决策优化。未来,少样本提示有望进一步推动AI在数据查询领域的广泛应用,释放更大价值。
571 6
|
数据采集 自然语言处理 数据可视化
基于Python的社交媒体评论数据挖掘,使用LDA主题分析、文本聚类算法、情感分析实现
本文介绍了基于Python的社交媒体评论数据挖掘方法,使用LDA主题分析、文本聚类算法和情感分析技术,对数据进行深入分析和可视化,以揭示文本数据中的潜在主题、模式和情感倾向。
2781 0
|
项目管理
「软件项目管理」一文浅谈软件项目风险计划
该文章深入探讨了软件项目风险计划的制定,包括风险识别、评估、应对策略等内容,并提供了风险条目检查表、风险概率及影响分析矩阵等工具,帮助项目管理者有效地管理和减轻项目中的潜在风险。
「软件项目管理」一文浅谈软件项目风险计划
|
SQL 自然语言处理 数据库
XiYan-SQL:一种多生成器集成的Text-to-SQL框架
XiYan-SQL 是一种创新的多生成器集成Text-to-SQL框架,通过M-Schema增强模型对数据库结构的理解,结合ICL与SFT方法提升SQL生成质量和多样性,经实验证明在多个数据集上表现优异,特别是在Spider和SQL-Eval上取得了领先成绩。
3127 7