跳到正文
原文
Google Research·· 2025-11-19精选AI 评分74

Google Research 发布端到端实时语音到语音翻译模型

Real-time speech-to-speech translation

AI 导读

Google Research 介绍了一种端到端实时语音到语音翻译(S2ST)模型,可保留原说话人声音进行实时翻译,延迟仅 2 秒,而现有级联式方案通常有 4–5 秒延迟并存在误差累积。

推荐理由

原文对比了级联方案的延迟与误差累积问题,读者可据此理解端到端流式架构带来的改进方向。

来源:Google Research · research.google