python调用Hanlp进行命名实体识别
来源:互联网 发布:高仿京东商城源码 编辑:程序博客网 时间:2024/06/06 18:51
1 python与jdk版本位数一致
2 pip install jpype1(python3.5)
3 类库hanlp.jar包、模型data包、配置文件hanlp.properties放在一个新建目录
4 修改hanlp.properties中root根目录,找到data
代码调用如下:
#coding:utf-8'''Created on 2017-11-21@author: 刘帅'''from jpype import *startJVM(getDefaultJVMPath(), "-Djava.class.path=D:\hanlp\hanlp-1.3.4.jar;D:\hanlp", "-Xms1g", "-Xmx1g") # 启动JVM,Linux需替换分号;为冒号:HanLP = JClass('com.hankcs.hanlp.HanLP')# 中文分词print(HanLP.segment('你好,欢迎在Python中调用HanLP的API'))testCases = [ "商品和服务", "结婚的和尚未结婚的确实在干扰分词啊", "买水果然后来世博园最后去世博会", "中国的首都是北京", "欢迎新老师生前来就餐", "工信处女干事每月经过下属科室都要亲口交代24口交换机等技术性器件的安装工作", "随着页游兴起到现在的页游繁盛,依赖于存档进行逻辑判断的设计减少了,但这块也不能完全忽略掉。"]for sentence in testCases: print(HanLP.segment(sentence))# 命名实体识别与词性标注NLPTokenizer = JClass('com.hankcs.hanlp.tokenizer.NLPTokenizer')print(NLPTokenizer.segment('中国科学院计算技术研究所的宗成庆教授正在教授自然语言处理课程'))# 关键词提取document = "水利部水资源司司长陈明忠9月29日在国务院新闻办举行的新闻发布会上透露," \ "根据刚刚完成了水资源管理制度的考核,有部分省接近了红线的指标," \ "有部分省超过红线的指标。对一些超过红线的地方,陈明忠表示,对一些取用水项目进行区域的限批," \ "严格地进行水资源论证和取水许可的批准。"print(HanLP.extractKeyword(document, 2))# 自动摘要print(HanLP.extractSummary(document, 3))# 依存句法分析print(HanLP.parseDependency("徐先生还具体帮助他确定了把画雄鹰、松鼠和麻雀作为主攻目标。"))shutdownJVM()
结果如下:
[你好/vl, ,/w, 欢迎/v, 在/p, Python/nx, 中/f, 调用/v, HanLP/nx, 的/ude1, API/nx][商品/n, 和/cc, 服务/vn][结婚/vi, 的/ude1, 和/cc, 尚未/d, 结婚/vi, 的/ude1, 确实/ad, 在/p, 干扰/vn, 分词/n, 啊/y][买/v, 水果/n, 然后/c, 来/vf, 世博园/n, 最后/f, 去/vf, 世博会/n][中国/ns, 的/ude1, 首都/n, 是/vshi, 北京/ns][欢迎/v, 新/a, 老/a, 师生/n, 前来/vi, 就餐/vi]
阅读全文
0 0
- python调用Hanlp进行命名实体识别
- python调用hanlp分词
- 基于HanLP分词的命名实体提取
- 使用CRF++进行命名实体识别
- CRF++进行自定义命名实体识别
- 命名实体识别
- 命名实体识别
- 中文命名实体识别
- 命名实体识别NER
- NLTK命名实体识别
- 命名实体识别
- 细粒度命名实体识别
- 命名实体识别
- CRF++命名实体识别
- 关于命名实体识别
- 命名实体识别方法
- 斯坦福大学命名实体识别
- 命名实体识别
- 中国国际人工智能高端领袖峰会于18日在深顺利召开 | 活动
- 【AI英雄风云榜】为TA投票:谁是2017中国AI领域最牛的人?
- Eclipse+JDK+Tomcat
- 详解五大分类方法及其优缺点,数据挖掘师必会!
- 【Scikit-Learn 中文文档】二:使用 scikit-learn 介绍机器学习| ApacheCN
- python调用Hanlp进行命名实体识别
- ActivityThread / ApplicationThread
- HDU 1719:Friend
- 年轻就是药
- Redhat7.1快速安装MYSQL
- JDK1.7更新到1.8,更改JAVA_HOME无法回到1.7
- 5、RGB-D— 视觉里程计 Visual Odometry
- ARouter Android页面路由框架
- 简单的网络请求拦截器