文本分类数据集是一种专门用于训练机器学习模型以识别和分类文本内容的数据集合。
这种数据集通常包含了大量的文本样本,每个样本都被标记或关联了一个或多个类别标签。文本分类数据集可以帮助模型学会根据文本的内容将其归入预定义的类别中。
元曲のコーパス。自然言語生成・文化遺産研究に最適。
宋詞のコーパス。GPT系モデルによる言語モデリング・テキスト生成に最適。
中国古典の七言律詩。テキスト分類・詩の生成など自然言語処理に最適。