IT之家 12 月 4 日消息,今年 8 月,Meta 公司推出了其多模态人工智能翻译模型 SeamlessM4T,该模型支持近 100 种语言的文本和 36 种语言的语音。现在该模型更新了“v2”架构,Meta 将其称之为“Seamless Communication(无缝沟通)”模型,能够让对话翻译更加自然和富有表现力。两个新功能中的第一个是“SeamlessExpressive”,顾名思义,该功能可以将你的语气转移到翻译后的语音中,包括音调、音量、情感色彩(兴奋、悲伤或低语)、语速和停顿。考虑到目前翻译后的语音一般听起来都很机械,这一突破还是非常值得期待的,无论是在我们的日常生活中还是在内容制作中,都有很大的帮助。目前其支持的语言包括英语、西班牙语、德语、法语、意大利语和中文,不过在IT之家撰写本文时,演示页面缺少意大利语和中文。第二个功能是“SeamlessStreaming”,可以在说话者仍在讲话时开始翻译,从而让其他
Meta 推出“无缝沟通”AI 翻译模型,带来更自然的跨语言对话体验
2023-12-04 14:08:43来源: IT之家
关注公众号
赞
你的鼓励是对作者的最大支持
- 传音与联发科共建人工智能联合实验室,聚焦手机端侧 AI 技术创新2024-09-19 14:43:55
- 《幻兽帕鲁》开发商 Pocket Pair 回应任天堂诉讼:游戏运营及服务不受影响2024-09-19 17:24:31
- SiFive 推出 Intelligence XM 系列 RISC-V 架构 AI 数据流处理器2024-09-19 17:26:57
- 保卫厨房,A.O.史密斯AI-LiNK厨房安全套系助您畅享安全美好生活2024-09-18 16:21:00
- it.com Domains持续增长,宣布通过GMO在亚太推出创新域名解决方案2024-09-18 18:14:00
- 90%东南亚用户偏爱Instagram等购物便利性:Gen AI塑造电商未来2024-09-18 18:18:00
- 英矽智能AI赋能开发的TNIK抑制剂获IIa期临床试验积极结果2024-09-19 09:00:00
- 微软、贝莱德、GIP、MGX 宣布成立超 300 亿美元 AI 基础设施投资基金,英伟达提供专业知识支持2024-09-18 08:53:40
- Snap 发布第 5 代 Spectacles AR 眼镜:集成 OpenAI 多模态 AI 模型,支持语音控制2024-09-18 08:58:57
- 谷歌搜索将整合 C2PA 2.1 标准,标注 AI 生成 / 编辑图片2024-09-18 09:10:59