TOP

【Python】NLTK（自然言語処理ライブラリ）を使ってみた。

公開日： 2018/12/24 : テキストマイニング Linux, nltk, python

Python の自然言語処理ライブラリである NLTK を Linux 環境にインストールして使ってみたときのメモです。

NLTK をインストール

以下のコマンドでインストールします。

$ sudo python3 -m pip install -U nltk

1	$ sudo python3 -m pip install -U nltk

サンプルテキストデータをダウンロード

NLTK ではサンプル用のテキストデータが用意されていて、以下のコマンドで使用できる。

$ python3

>>> import nltk
>>> nltk.download()

1

2

3

4

$ python3

>>> import nltk

>>> nltk.download()

「d」を入力し、「book」を入力すると、テキストの集合がダウンロードできる。

以下のコードを使って、ダウンロードしたテキストに簡単にアクセスできます。

>>> from nltk.book import *

1	>>> from nltk.book import *

「text1」にアクセスしたいときは、以下のようにします。

>>> text1

1

>>> text1

<Text: Moby Dick by Herman Melville 1851>

Tweet

関連記事

【Python】形態素解析器 Mecab を Linux（Ubuntu）で使ってみた。

Linux の Ubuntu OS に、形態素解析器 Mecab をインストールし、使ってみたときの

記事を読む

【テキストマイニング】 bigram を用いて小説の書き手の識別をしてみる

「テキストマイニング入門」という本に書かれている内容に添って RMeCab を使った小説の分析を行っ

記事を読む

【mecab-python3】parseToNode で surface が正しく取得できないときの対処法。

python3 で mecab-python3 を使うと、parseToNode で surface

記事を読む

PREV: 【Python】OpenCV を使って顔画像を検出してみた。
NEXT: 【Python】形態素解析器 Mecab を Linux（Ubuntu）で使ってみた。

NEW ENTRY

: 無料動画編集ソフト AviUtl で mp4 形式の動画を読み込み・出力する方法【Windows】
今回は、無料動画編集ソフト AviUtl で mp4 形式の動画を読み

: 【Cubase】イヤホンから音がでないときの対処方法。
Cubase でイヤホンから音がでなくなったときの対処方法のメモです。

: 【Cubase】特定のトラックを無効にする方法。
今回は、Cubaseで特定のトラックのみを無効にする方法について紹介し

: 【転移学習】学習済みVGG16 による転移学習を行う方法【PyTorch】
今回は、PyTorch を使って、学習済みのモデル VGG16 を用い

: 【PyTorch】畳込みニューラルネットワークを構築する方法【CNN】
今回は、PyTorch を使って畳込みニューラルネットワーク（CNN）

→もっと見る

カテゴリー
- Webサイト運営 (8)
- お金 (49)
  - FX・外貨預金 (27)
    - MT4 (18)
  - 仮想通貨 (18)
  - 株・投資信託・ETF (3)
- カメラ (4)
- テキストマイニング (4)
- パソコン (30)
  - Mac (2)
- ファッション (2)
- プログラミング (77)
  - Excel（VBA） (1)
  - LaTeX (8)
  - Linux (13)
  - MySQL (7)
  - Perl (1)
  - Python (33)
  - R言語 (5)
  - Scilab (2)
  - SQLite (2)
- ボードゲーム (13)
  - 将棋 (3)
- 文字 (1)
- 機械学習 (23)
- 生活 (5)
- 税理士 (12)
- 競馬 (9)
- 配信者 (1)
- 音楽 (41)
  - DTM (7)
    - Cubase (6)
  - エイベックス (2)
  - ビーイング (24)
- 食事 (2)

Tweet