第七色在线视频,2021少妇久久久久久久久久,亚洲欧洲精品成人久久av18,亚洲国产精品特色大片观看完整版,孙宇晨将参加特朗普的晚宴

為了賬號安全,請及時綁定郵箱和手機立即綁定

hadoop-R語言-安裝NLP自然語言分析包

引言: R语言是一种非常强大的分析与展示的统计科学家工具,其也提供了若干关于自然语言的分析处理工具,本文讲展示如何在Linux进行安置。


1.  自然语言处理(NLP)

  对于英语体系,基于空格可以直接进行分词,而中文则不同,需要进行分词,然后进行后续处理。NLP是natural language processing的缩写,专指此类的工作。

    自然语言处理包: Snowball, RWeka

    文本挖掘: tm

    分词工具: Rwordseg

2.  所属环境

    Linux: centos 6, 已经安置Java, 由于Rwordseg需要依赖java

3.  安置指令与过程

   3.1  安装R语言环境

     >> yum install R

     https://img1.sycdn.imooc.com//5b447c6a00010d8d22001122.jpg

   3.2  安装Snowball

     >> install.packages(c('Snowball'))  

        其会提示该包没有找到,需要使用以下包:

     >> install.packages(c('SnowballC'))      https://img1.sycdn.imooc.com//5b447c75000131af16000851.jpg

   3.3  安装tm

    >> install.packages(c('tm'))        https://img1.sycdn.imooc.com//5b447c7f000143a918761276.jpg

      https://img1.sycdn.imooc.com//5b447c890001817417001322.jpg

   3.4 安装RWeka

    >> install.packages(c('RWeka'))

     https://img1.sycdn.imooc.com//5b447c940001769018361242.jpg

     https://img1.sycdn.imooc.com//5b447c9c0001975516341320.jpg

   3.5 安装Rwordseg

     直接执行install.packages(c('Rwordseg'))将会报错,提示找不到此类包。

     需要切换到install.packages("Rwordseg", repos ="http://R-Forge.R-project.org", type = "source"),从另外一个源中进行安装。

    https://img1.sycdn.imooc.com//5b447ca60001b3b108960312.jpg

https://img1.sycdn.imooc.com//5b447cad0001697616341248.jpg     

3.6 结束

 安装完成了所有必须的NLP。


點擊查看更多內(nèi)容
TA 點贊

若覺得本文不錯,就分享一下吧!

評論

作者其他優(yōu)質(zhì)文章

正在加載中
  • 推薦
  • 評論
  • 收藏
  • 共同學(xué)習(xí),寫下你的評論
感謝您的支持,我會繼續(xù)努力的~
掃碼打賞,你說多少就多少
贊賞金額會直接到老師賬戶
支付方式
打開微信掃一掃,即可進(jìn)行掃碼打賞哦
今天注冊有機會得

100積分直接送

付費專欄免費學(xué)

大額優(yōu)惠券免費領(lǐng)

立即參與 放棄機會
微信客服

購課補貼
聯(lián)系客服咨詢優(yōu)惠詳情

幫助反饋 APP下載

慕課網(wǎng)APP
您的移動學(xué)習(xí)伙伴

公眾號

掃描二維碼
關(guān)注慕課網(wǎng)微信公眾號

舉報

0/150
提交
取消