지즈 데이터셋

다국어 번역

       这类数据集包含成对或多对语言的文本样本,每一对文本表示相同内容的不同语言版本。目的是训练机器翻译模型,使其能够将一种语言的文本准确地翻译成另一种语言。用于开发和优化自动翻译系统,提高跨语言沟通的效率和准确性。

4 · 페이지 11-4 / 4

이 카테고리의 데이터셋

XLSX
46229

【中韩文本翻译数据集】经典小说中韩文句子翻译对齐数据集

数据集介绍: 本数据集是一个中韩文章短句翻译数据集,专门用于中韩语言对的翻译研究与应用。数据集包含了多本经典书籍中的句子翻译,涵盖了丰富的历史与文学内容,包括: 百家公案 北齐书 北史 北极探险 白居易诗全集 每条数据包含中文原句及其对应的…

조회 462 · 다운로드 29자세히 보기
XLSX
40642

【中越文本翻译数据集】经典小说中越文句子翻译对齐数据集

数据集概述 本数据集涵盖了多部经典中外小说的逐句翻译语料,内容被逐句对齐为中文与越南文,适用于深度学习翻译模型训练、多语言自然语言处理(NLP)、跨文化文本分析等任务。数据集包含《巴山夜雨》《悲惨世界》《百年孤独》《包法利夫人》等经典作品,…

조회 406 · 다운로드 42자세히 보기
XLSX
68653

【中日文本翻译数据集】经典小说中日文句子翻译对齐数据集

数据集概述 本数据集由多部经典小说的逐句中日文对齐句子构成,旨在为自然语言处理(NLP)中的机器翻译、双语句法分析、多语言模型训练等提供高质量的语料资源。数据集涵盖了大量知名作品,包括《安徒生童话》《癌症楼》《巴山夜雨》等,严格保证句子层面…

조회 686 · 다운로드 53자세히 보기
XLSX
71954

【中英文本翻译数据集】经典小说中英文句子翻译对齐数据集

数据集描述 本数据集包含了多部经典小说的中英文句子翻译,适用于自然语言处理(NLP)、机器翻译和文本生成等任务。数据集涵盖了世界文学中的著名作品,如《安徒生童话》、《爱丽丝漫游奇境记》、《安娜·卡列尼娜》等。这些句子经过严格的对齐和分词处理…

조회 719 · 다운로드 54자세히 보기