【Python】NLTK(自然言語処理ライブラリ)を使ってみた。

公開日: : テキストマイニング , ,

Python の自然言語処理ライブラリである NLTK を Linux 環境にインストールして使ってみたときのメモです。

NLTK をインストール

以下のコマンドでインストールします。

サンプルテキストデータをダウンロード

NLTK ではサンプル用のテキストデータが用意されていて、以下のコマンドで使用できる。

「d」を入力し、「book」を入力すると、テキストの集合がダウンロードできる。

以下のコードを使って、ダウンロードしたテキストに簡単にアクセスできます。

「text1」にアクセスしたいときは、以下のようにします。

<Text: Moby Dick by Herman Melville 1851>

 

関連記事

【mecab-python3】parseToNode で surface が正しく取得できないときの対処法。

python3 で mecab-python3 を使うと、parseToNode で surface

記事を読む

【テキストマイニング】 Amebaブログからデータ取得するための準備。

テキストマイニングを行うために、Ameba ブログ(アメブロ)のデータを取得してみようと思ったので、

記事を読む

【テキストマイニング】 bigram を用いて小説の書き手の識別をしてみる

「テキストマイニング入門」という本に書かれている内容に添って RMeCab を使った小説の分析を行っ

記事を読む

【Python】形態素解析器 Mecab を Linux(Ubuntu)で使ってみた。

Linux の Ubuntu OS に、形態素解析器 Mecab をインストールし、使ってみたときの

記事を読む

【matplotlib】 Python でヒストグラムの横軸と棒(ビン)の数を調整する方法。

Python の matplotlib を使ってヒストグラムを描画し、

【デジカメ】 NEX-6 で撮った写真を Wi-Fi で PC に転送する方法【SONY】

今回は、SONY の NEX-6 のデジカメで撮った写真を 無線の W

【SONY NEX-6】オールドレンズをミラーレスカメラに付ける方法【マウントアダプター】

家でずっと眠っていたオールドレンズ(フィルムカメラに装着されて

【WordPress】 カテゴリごとに広告を簡単に切り替える方法【AdRotate】

今回は、WordPress のプラグインを使って、簡単にカテゴリごとに

【ビットコイン】 アドレス生成方法について調べてみた。

仮想通貨の1つであるビットコインを送金するときは、送付側と受け手側のそ

→もっと見る

PAGE TOP ↑