该数据集名为“Awesome Japanese IME Training Data”,是一个用于日语输入法(IME)训练的数据集,专注于基于上下文的假名汉字转换(kana-kanji conversion)的排序学习(ranking learning)任务。数据来源于 Awesome Japanese Corpus,并直接使用 KyTea 进行解析,无需中间生成带读音的数据集。每个样本包含以下字段
Label Ranking dataset of real-world socio-economic markers from Portugal in 2017. The data is from an election year and the rankings are the parties' results.