spark集群如何使用hanlp进行分布式分词-创新互联

这篇文章主要介绍“spark集群如何使用hanlp进行分布式分词”,在日常操作中,相信很多人在spark集群如何使用hanlp进行分布式分词问题上存在疑惑,小编查阅了各式资料,整理出简单好用的操作方法,希望对大家解答”spark集群如何使用hanlp进行分布式分词”的疑惑有所帮助!接下来,请跟着小编一起来学习吧!

创新互联公司是专业的枞阳网站建设公司,枞阳接单;提供做网站、成都网站建设,网页设计,网站设计,建网站,PHP网站建设等专业做网站服务;采用PHP框架,可快速的进行枞阳网站开发网页制作和功能扩展;专业做搜索引擎喜爱的网站,专业的做网站团队,希望更多企业前来合作!

分两步:

第一步:实现hankcs.hanlp/corpus.io.IIOAdapter

spark集群如何使用hanlp进行分布式分词

1.  public class HadoopFileIoAdapter implements IIOAdapter {

2. 

3.   @Override

4.    public InputStream open(String path) throws IOException {

5.        Configuration conf = new Configuration();

6.       FileSystem fs = FileSystem.get(URI.create(path), conf);

7.        return fs.open(new Path(path));

8.    }

9. 

10.    @Override

11.   public OutputStream create(String path) throws IOException {

12.        Configuration conf = new Configuration();

13.        FileSystem fs = FileSystem.get(URI.create(path), conf);

14.        OutputStream out = fs.create(new Path(path));

15.        return out;

16.    }

17.  }

第二步:修改配置文件。root为hdfs上的数据包,把IOAdapter改为咱们上面实现的类

 spark集群如何使用hanlp进行分布式分词

spark集群如何使用hanlp进行分布式分词

ok,这样你就能在分布式集群上使用hanlp进行分词了。

到此,关于“spark集群如何使用hanlp进行分布式分词”的学习就结束了,希望能够解决大家的疑惑。理论与实践的搭配能更好的帮助大家学习,快去试试吧!若想继续学习更多相关知识,请继续关注创新互联-成都网站建设公司网站,小编会继续努力为大家带来更多实用的文章!


文章名称:spark集群如何使用hanlp进行分布式分词-创新互联
网站网址:http://bzwzjz.com/article/hhgpj.html

其他资讯

Copyright © 2007-2020 广东宝晨空调科技有限公司 All Rights Reserved 粤ICP备2022107769号
友情链接: 手机网站建设 成都网站设计 高端品牌网站建设 营销型网站建设 网站制作 成都网站建设 成都营销网站制作 网站建设公司 营销型网站建设 成都品牌网站设计 四川成都网站制作 定制网站设计 成都响应式网站建设公司 自适应网站建设 网站建设改版 响应式网站设计 攀枝花网站设计 成都网站制作公司 企业网站设计 网站建设推广 成都商城网站制作 成都网站设计