面向全球受众的现场直播节目,需要的不仅仅是文字翻译。语言的细微差别、声音、时间节奏、面部表情、字幕和屏幕图形必须实时协同配合,同时保持原始节目的编辑初衷和制作质量。

为帮助广播公司、体育联盟、版权方和流媒体服务商将这些要素整合到统一的、软件定义的实时本地化工作流中,NVIDIA 正在将其内容本地化技术引入 NVIDIA Holoscan for Media 开发者工具套件。该参考工作流专为广播和流媒体开发者设计,支持字幕、音频翻译、配音、音视频同步和图形本地化。

  • Holoscan for Media 的内容本地化技术,为在软件定义的广播应用中各项本地化技术的协同工作提供了参考。开发者可以根据每个节目、市场或发行渠道,选择所需的功能,而无需为了每个本地化版本分别部署基础设施。
  • Holoscan for Media 的内容本地化技术整合了 NVIDIA AI for Media 的最新技术成果,包括面部部分被遮挡时改进的 LipSync(唇形同步)功能,以及增强的 Active Speaker Detection(主动说话人检测)功能,以帮助应用在多人场景中识别当前正在说话的人。

拓展直播节目的触达范围

本地化可以拓展直播节目的触达范围并改变经济效益。一套共享的、可组合的工作流,能够帮助传媒公司更快地推出区域化内容、服务更多受众,并为各个市场定制专属体验,同时确保直播制作所需的时效性、视觉语境和编辑控制。

AI-Media、CAMB.AI、Chyron 和 Panjaya 的技术,分别通过 Holoscan for Media 解决了内容本地化中的特定环节,从语音适配和屏幕呈现,到多语言字幕生成和音频翻译、图形本地化,以及在直播和点播内容中保留人物的神态和身份特征。

内容本地化技术还支持基于文件、流媒体和后期制作类应用。开发者在点播工作流中,可通过应用程序编程接口(API)调用相关能力;而在需要将本地化集成到直播场景时,则可以使用 Holoscan for Media 参考工作流程。这两种技术共同为构建覆盖制作和发行环节的多语言媒体服务奠定了一致的基础。