テキストマイニング

こんにちは。前回のクラスタリングをやってみて、用いる距離を変えてみたり、クラスタリングの方法を変えてみたらどうなるのか、とても気になってしまいました。 そんなこんなで、手当たり次第 ...

テキストマイニング

こんにちは。まだまだテキストマイニングをやってみることにします。 今回はクラスタリングです。(アイキャッチ画像がぶどうなのは、「クラスター」が房という意味なので、ぶどうの房の画像を ...

テキストマイニング

こんにちは。まだまだテキストマイニングを続けることにします。そして、まだまだ梶井基次郎作「檸檬」を題材にします。 共起ネットワークを描いてみる 前回は、共起語を調べてみました。 そ ...

テキストマイニング

こんにちは。 まだまだテキストマイニングをやってみることにします。 共起語・コロケーションについて 突然ですが、「目薬を〇〇」、「辞書を□□」 この伏字になっているところに、どのよ ...

テキストマイニング

こんにちは。引き続き、梶井基次郎作品を使ってテキストマイニングをしていきます。 今回はTF-IDFを求めてみます。 以前、TF-IDFについてこのような投稿をしていました。 高校で ...

テキストマイニング

こんにちは。前回に続き、N-gramを取り上げます。 RMeCabには、N-gramをする関数がいろいろあるので、今回は試してみます。 Ngram関数を使ってみる このNgram関 ...

テキストマイニング

こんにちは。今回はRでN-gramを試してみます。 N-gramについては、以前Pythonを使って書いた記事があるのでリンクを貼っておきます。 N-gram(1)|情報科 いっぽ ...

テキストマイニング

こんにちは。なかなかまとまったことができないので、何回かに分けて少しずつまとまったことをやっていきたいと思います。 しばらくの間、Rを使ったテキストマイニングを試してみることにしま ...

テキストマイニング

こんにちは。前回のTF-IDFの続きです。前回はTFについて整理しました。今回はIDFとTF-IDFをまとめていきます。 IDFとは IDFは、Inverse Document F ...

テキストマイニング

今回はTF-IDFです。今回はTF-IDFです。今回はTF-IDFです。大事なことなので3回書きました。Repeat after me! TF-IDF. 出だしで少しふざけましたが ...

データの活用

こんにちは。昨年度(2017年度)の授業では、「情報Ⅰ」のデータの活用につながるような内容のいくつかを授業で実践しました。いきなり、その内容をまとめ始めても良いのですが、授業の位置 ...