上智2014

コーパスにもとづく日本語史研究

2014/10/10

「コーパス」について

狭義のコーパス
言語研究を目的として収集され、言語研究のための情報が付けられたコンピュータ上で利用可能な大規模な言語データ。
  • BCCWJ / 太陽コーパス / 明六雑誌コーパス / 日本語歴史コーパス
広義のコーパス
コンピュータ上で利用可能な大規模な言語データ。必ずしも言語研究向きではないが、言語研究に利用可能。
  • さまざまなテキストアーカイブ(新潮文庫の百冊 / 青空文庫 / 国会会議録)
  • Web上のデータ
    • 検索サイトの利用
    • WAC(Web as Corpus)

総索引から電子化テキストへ(国語史資料の電子化の歴史)

テキストファイル

プレーンテキストからタグ付きテキストへ


日本語歴史コーパス(CHJ)の登録

2014/10/03

イントロダクション


トップ   新規 一覧 検索 最終更新   ヘルプ   最終更新のRSS