
本文将为您介绍经典、热门的数据集,希望对您在选择适合的数据集时有所帮助。
1
QUAK
-
发布方:
Upstage·高丽大学
-
发布时间:
2022
-
韩英合成机器翻译质量预测数据 (韩英神经机器翻译的一个合成质量估计数据集,QUAK) 是指韩语句子和英语机器翻译句子,并且每个句子的机器翻译结果的质量是OK/这是一个机器翻译质量预测模型训练数据集,它预测与坏标签。由于用相应数据学习的机器翻译质量预测模型即使没有正确的句子也能预测翻译质量,因此它可以应用于没有正确句子的现实问题。OK/BAD tag对每个单词都有标记,以指示机器翻译结果中的哪些标记 (单词) 被错误翻译,对齐的源标记也被标记,因此即使不知道翻译语言的用户也可以知道哪些单词被错误翻译。
-
简介:
NumGLUE 是一个多任务基准测试,用于评估人工智能系统在八个不同任务上的性能,其核心需要简单的算术理解。
-
下载地址:
https://github.com/AIChallenger/AI_Challenger_2017
-
论文地址:
https://arxiv.org/pdf/1711.06475.pdf
2
HumanMT
-
发布方:
海德堡大学·马尼拉雅典耀大学
-
发布时间:
2018
-
简介:
HumanMT 是人工评分和机器翻译更正的集合。它由两部分组成:第一部分包含五分和成对句子级别的评分,第二部分包含错误标记和更正。详情如下所述。 I. 句子级评分这是对 TED 演讲的 1000 个德英机器翻译的五分和成对评分的集合(IWSLT 2014)。收集评级的目的是评估机器翻译质量评级的可靠性和可学习性,以改进具有人工强化的神经机器翻译模型(参见出版物)。二、错误标记和更正这是对 30 个选定的 TED 演讲(IWSLT 2017)的 3120 个英语-德语机器翻


1116

被折叠的 条评论
为什么被折叠?



