Development of dependency-parsers for “untokenized” natural languages
Koichi Yasuoka(Institute for Research in Humanities, Kyoto University)

Abstract

日本語・中国語・タイ語など、単語の間に区切りのない書写言語に対し、形態素解析(単語切りと品詞付与)および係り受け解析をおこなうシステムを開発する。具体的には、言語モデルによる系列ラベリングにおいて、各言語で係り受け解析が最適となるようなトークン長とトークナイザを探り、これに基づいた言語モデルの開発をおこなう。

Related Web pages

N/A

Reports

研究紹介ポスター/最終報告書