设为首页 收藏本站
查看: 1215|回复: 0

[经验分享] ubuntu下使用pycharm调用Hanlp自然语言处理包

[复制链接]

尚未签到

发表于 2019-2-18 11:20:24 | 显示全部楼层 |阅读模式
  首先点击File,选择Settings,在Project 下点击Project Interpreter,并通过点击右边的加号:
  搜索JPype,根据python版本选择你需要的JPype版本安装。
  之后,在https://github.com/hankcs/HanLP/releases
  网站下载hanlp.jar包、模型data包、配置文件hanlp.properties,新建一个文件夹Hanlp,
  把hanlp.jar和hanlp.properties放进去:
  之后需要再新建一个文件夹hanlp,并将data放进去:
  修改Hanlp下的路径为当前data的路径,由于我将data放在/home/javawork/hanlp下,因此:root=/home/javawork/hanlp/
  接下来新建一个文件demo_hanlp.py,代码如下:
  #! /usr/bin/env python2.7
  #coding=utf-8
  from jpype import *
startJVM(getDefaultJVMPath(), "-Djava.class.path=home/javawork/Hanlp/hanlp-1.2.7.jar;home/javawork/Hanlp/", "-Xms1g", "-Xmx1g")
  startJVM(getDefaultJVMPath(), "-Djava.class.path=/home/qinghua/javawork/Hanlp/hanlp-1.2.7.jar:/home/qinghua/javawork/Hanlp")
  HanLP = JClass('com.hankcs.hanlp.HanLP')
中文分词
  print(HanLP.segment('你好,欢迎在Python中调用HanLP的API'))
  testCases = [
  "商品和服务",
  "结婚的和尚未结婚的确实在干扰分词啊",
  "买水果然后来世博园最后去世博会"]
  for sentence in testCases: print(HanLP.segment(sentence))
命名实体识别与词性标注
  NLPTokenizer = JClass('com.hankcs.hanlp.tokenizer.NLPTokenizer')
  print(NLPTokenizer.segment('×××计算技术研究所的宗成庆教授正在教授自然语言处理课程'))
关键词提取
  document = "水利部水资源司司长陈明忠9月29日在×××新闻办举行的新闻发布会上透露," \
  "根据刚刚完成了水资源管理制度的考核,有部分省接近了红线的指标," \
  "有部分省超过红线的指标。对一些超过红线的地方,陈明忠表示,对一些取用水项目进行区域的限批," \
  "严格地进行水资源论证和取水许可的批准。"
  print(HanLP.extractKeyword(document, 2))
自动摘要
  print(HanLP.extractSummary(document, 3))
依存句法分析
  print(HanLP.parseDependency("徐先生还具体帮助他确定了把画雄鹰、松鼠和麻雀作为主攻目标。"))
  shutdownJVM()
  需要注意的是ubuntu的路径分割符为”:”,而window 为” ; ”
  另附hanlp调用常见问题集:
  https://github.com/hankcs/HanLP/issues?page=3&q=is%3Aissue+is%3Aopen
  文章来源于imperfect00网络


运维网声明 1、欢迎大家加入本站运维交流群:群②:261659950 群⑤:202807635 群⑦870801961 群⑧679858003
2、本站所有主题由该帖子作者发表,该帖子作者与运维网享有帖子相关版权
3、所有作品的著作权均归原作者享有,请您和我们一样尊重他人的著作权等合法权益。如果您对作品感到满意,请购买正版
4、禁止制作、复制、发布和传播具有反动、淫秽、色情、暴力、凶杀等内容的信息,一经发现立即删除。若您因此触犯法律,一切后果自负,我们对此不承担任何责任
5、所有资源均系网友上传或者通过网络收集,我们仅提供一个展示、介绍、观摩学习的平台,我们不对其内容的准确性、可靠性、正当性、安全性、合法性等负责,亦不承担任何法律责任
6、所有作品仅供您个人学习、研究或欣赏,不得用于商业或者其他用途,否则,一切后果均由您自己承担,我们对此不承担任何法律责任
7、如涉及侵犯版权等问题,请您及时通知我们,我们将立即采取措施予以解决
8、联系人Email:admin@iyunv.com 网址:www.yunweiku.com

所有资源均系网友上传或者通过网络收集,我们仅提供一个展示、介绍、观摩学习的平台,我们不对其承担任何法律责任,如涉及侵犯版权等问题,请您及时通知我们,我们将立即处理,联系人Email:kefu@iyunv.com,QQ:1061981298 本贴地址:https://www.yunweiku.com/thread-673917-1-1.html 上篇帖子: ubuntu16.04自动切换桌面壁纸 下篇帖子: ubuntu升级命令
您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

扫码加入运维网微信交流群X

扫码加入运维网微信交流群

扫描二维码加入运维网微信交流群,最新一手资源尽在官方微信交流群!快快加入我们吧...

扫描微信二维码查看详情

客服E-mail:kefu@iyunv.com 客服QQ:1061981298


QQ群⑦:运维网交流群⑦ QQ群⑧:运维网交流群⑧ k8s群:运维网kubernetes交流群


提醒:禁止发布任何违反国家法律、法规的言论与图片等内容;本站内容均来自个人观点与网络等信息,非本站认同之观点.


本站大部分资源是网友从网上搜集分享而来,其版权均归原作者及其网站所有,我们尊重他人的合法权益,如有内容侵犯您的合法权益,请及时与我们联系进行核实删除!



合作伙伴: 青云cloud

快速回复 返回顶部 返回列表