2020清泉女子大学 集中講義†
- 10:00 - 15:30
- オンライン(Zoom)
- 日程
- 8月18日(火)
- 8月19日(水)
- 8月20日(木)
- 8月21日(金)
- 9月7日(月)
8月18日(火)†
第1回 イントロダクション†
授業内容の紹介†
授業で利用する主なソフトウェア・Webアプリケーション†
- テキストエディタとgrep
- 全文検索システムひまわり
シラバス確認†
受講者アンケート†
国語研のコーパス利用申し込み(「中納言」)†
第2回 電子化テキストとテキストエディタ†
文字コード†
テキストデータとは†
- すべての基本、文字が並ぶだけのデータ
- TXT,CSV,HTM・・・
テキストエディタ†
サクラエディタのダウンロードとインストール†
- インストールの手順
- ダウンロードしたzipファイルの中にあるsakura-install*.exeをデスクトップにコピー
- exeファイルを右クリックして「セキュリティ」の右の「許可する」をチェックして「OK」
- ダブルクリックしてインストール
テキストエディタを使ってみる†
- テキストエディタの設定
- 行の折り返し
- 行番号表示
- スタイル行番号(ワープロ的行番号)と論理行番号(エディタ的行番号)
テキストエディタの基本†
- 検索・置換、grep
- 検索で初出行を調べる
- 置換で用例数を数える
- grepで用例リストを作る
- タグジャンプで文脈を確認する
- サブフォルダのgrep
ショートカットキー†
grepと置換でKWIC(CSVファイル)を作る(簡易版)†
- CSVファイルとは:テキストファイルで表を表現する
用語:CSVファイル
- KWIC:KeyWord In Context
参考:テキストデータ(青空文庫)の配布†
第3回 テキストエディタと正規表現 †
正規表現を使ってみる†
- 文字クラス
- 例:読[まみむめもん]
- 半角ブラケットの中に文字を並べる→並べた文字いずれか1文字
正規表現とは†
- 正規表現 >用語
- 文字を表すための特殊な文字(メタ文字)を使って文字列のパターンを表現する
- エディタでは置換・検索・grepで利用できる (エディタ以外にもさまざまなアプリケ-ションやコンピュータ言語で利用されている)
- 特殊な文字(メタ文字)はすべて半角
正規表現のいろいろ†
- 授業資料/正規表現
- 文字クラス [ ]
- 文字クラスの否定(補集合)[^ ]
- 繰り返し ? + *
- グループ化 ()
- or(論理和) |
- 文頭 ^、文末 $