KANJIDIC2の概要
KANJIDIC2は、電子辞書研究開発グループ(EDRDG: Electronic Dictionary Research and Development Group)が公開している漢字情報データベースです。 XML形式で配布されており、13,108文字の漢字について画数・部首・読み方・意味・使用頻度などの情報を収録しています。
JIS第1水準・第2水準・第3水準・第4水準の漢字のほか、JIS規格外のUnicode漢字も含まれており、現代的な漢字データベースとして広く利用されています。
KANJIDIC2は CC BY-SA 4.0(クリエイティブ・コモンズ 表示 - 継承 4.0 国際) ライセンスで公開されています。 出典を明示・同ライセンスで配布することを条件に、商用・非商用を問わず自由に利用できます。
収録データのフィールド
LUFT DATAではKANJIDIC2のXMLを解析し、以下のフィールドをデータベースに収録しています。
データの出典と更新
KANJIDIC2のXMLデータは EDRDG公式サイト から入手できます。 LUFT DATAでは公式の kanjidic2.xml.gz(圧縮版)を取得し、MySQLデータベースに収録しています。
データは年1〜2回程度更新されます。更新があった場合は管理者が再インポートを実行します。