成蹊2021
応用日本語講座(日本語・日本文学のためのコンピュータ)†
- 今年度この授業はZoomによるリアルタイムのオンライン講義の形で行います。
- 授業のZoomのアドレスは下記のリンク先(CoursePower授業ページ)で確認してください。
- 授業のZoomのアドレスは毎回同じです。
2021/04/23 テキストエディタの利用†
復習(前回のデータを使って)†
- 検索・置換、grep
- 検索で初出行を調べる
- 置換で用例数を数える
- grepで用例リストを作る
- タグジャンプで文脈を確認する
ショートカットキー†
テキストデータ(青空文庫)の配布†
grepと置換でKWIC(CSVファイル)を作る(簡易版)†
- CSVファイルとは:テキストファイルで表を表現する
用語:CSVファイル
- KWIC:KeyWord In Context
正規表現を使ってみる†
- 文字クラス
- 例:読[まみむめもん]
- 半角ブラケットの中に文字を並べる→並べた文字いずれか1文字
正規表現とは†
- 正規表現 >用語
- 文字を表すための特殊な文字(メタ文字)を使って文字列のパターンを表現する
- テキストエディタでは置換・検索・grepで利用できる (エディタ以外にもさまざまなアプリケ-ションやコンピュータ言語で利用されている)
- 特殊な文字(メタ文字)はすべて半角
2021/04/16 テキストデータと文字コード†
文字コード†
テキストデータ†
テキストエディタ†
サクラエディタのダウンロードとインストール†
フリーソフトウェア(無償)のエディタを使います。
- インストールの手順
- ダウンロードしたzipファイルの中にあるsakura-install*.exeをデスクトップにコピー
- exeファイルを右クリックして「セキュリティ」の右の「許可する」をチェックして「OK」
- ダブルクリックしてインストール
Macの場合(CotEditorのダウンロードとインストール)†
テキストエディタを使ってみる†
- テキストエディタの設定
- 行の折り返し
- 行番号表示
- スタイル行番号(ワープロ的行番号)と論理行番号(エディタ的行番号)
- 検索・置換、grep
- 検索で初出行を調べる
- 置換で用例数を数える
- grepで用例リストを作る
- タグジャンプで文脈を確認する
2021/04/09†
イントロダクション†
授業で利用する主なソフトウェア†
授業で利用する主なデータ†
-デモ†
- テキストエディタとgrep
- 全文検索システムひまわり
- Excel(ピボットテーブル)
- 形態素解析:Web茶まめ