数据驱动的机器翻译评估,助力卓越多语言质量
一家业务遍及全球的欧盟官方机构。
该机构针对欧盟 23 种官方语言开发了涵盖多种语言组合的机器翻译模型,因此需要开展专业的语言质量评估,以更清晰地了解模型经过定制优化后所达到的实际质量水平。
-
目标
通过专业语言专家开展系统化人工评估,对定制化机器翻译模型的质量进行验证,为客户提供全面、以数据为基础的分析,评估多个欧盟语言组合下的机器翻译表现。
-
挑战
该项目采用四级评分标准,对机器翻译输出进行句段级质量评估。每份文档均由 2 至 3 名语言专家独立评审,所有评审人员在相关的两种语言上均须达到至少 C2 熟练水平。
每份文档平均约 5,000 个单词,每次分析涉及约 15,000 个单词的评估工作量。
按照每月平均 6 个项目计算,整个项目累计评估文本量超过 532 万个单词。
此外,项目还需要搭建专门的技术环境,以提供所需的评估工具并实时呈现评估结果。 -
实施
Seprotec 在 ContentQuo 平台内搭建了人工机器翻译评估流程,并根据客户的评估标准和报告需求进行了定制化配置。
Seprotec 还为参与项目的语言专家和项目经理提供了专项培训。
客户上传文档后,Seprotec 的项目协调人员会首先检查相关设置,并将任务分配给三名最合适的语言专家,由他们在专门的评估环境中逐段进行评审。
评估结果由 Seprotec 进一步审核确认,并通过数据看板向客户展示,包括整体表现、质量变化趋势以及各语言组合的评估结果,同时支持下载 .csv 和 .xls 格式的报告。 -
结果
该解决方案缩短了评估项目的启动时间,并显著减轻了客户的行政管理负担,由 Seprotec 统一负责语言专家的安排与协调。
客户可以实时查看评估结果,并通过专业语言专家持续开展以数据为基础的分析,从而验证和改进覆盖 23 种语言的机器翻译输出。
定制化技术环境还提供安全的加密数据传输,并让客户能够获得专业母语译员及专业项目管理团队的支持。