微比恩 > 信息聚合 > 字节跳动火山翻译上新 38 个稀有语种,自研训练模型效率提升超 500%

字节跳动火山翻译上新 38 个稀有语种,自研训练模型效率提升超 500%

2021-12-31 11:03:44来源: IT之家

IT之家 12 月 31 日消息,2021 年 12 月,字节跳动旗下的火山翻译官网,上新了包括世界语、塔希提语、鞑靼语等在内的 38 个稀有语种的翻译。目前,包括汉语、英语、阿拉伯语、俄语、法语、西班牙语六个通用语种在内,火山翻译已具备 94 个语种、8742 个语向的翻译能力,整体 bleu(机器翻译质量自动评估指标)达 33.45,处于行业领先水平。▲ 蓝色部分为火山翻译上新的 38 个语种据了解,通过采用自研的 mRASP 多语言模型,火山翻译仅使用一个模型就完成了上述 38 个语种与英文的双向互译,突破了传统双语言翻译模型对每个语向单独训练、单独上线服务的方式,大幅降低机器学习的训练和服务成本。“通常情况下,训练 76 个语向的双语言模型需要 150-200 天。而相同硬件条件下,训练一个多语言模型只需要 30 天。”火山翻译团队介绍,“对于请求量小的语种,使用 mRASP 模型集中服务可以大大节省计算资源,仅需半张用

关注公众号
标签: 字节跳动