前途科技前途科技
  • 服务
  • 关于
  • AI
    • AI 大模型
    • 具身智能
    • 算力芯片
  • 科技
    • 智能终端
    • 软件·互联网
    • 汽车·出行
    • 科学前沿
  • 资源中心
    • 深度研究
      • AI 前沿
      • 教程
      • AI 知识库
      • 案例研究
    • 行业报告
      • 白皮书
      • 行业报告
      • 研究报告
      • 技术分享
      • 专题报告
    • 精选案例
      • 金融行业
      • 医疗行业
      • 教育行业
      • 零售行业
      • 制造行业
  • 服务
  • 关于
联系我们
产品/09.09 · 00:00/4 MIN/编译自 NVIDIA Writers/1 阅读

NVIDIA拓展媒体AI工具栈:实时赋能转播与流媒体

在IBC大会上,NVIDIA大幅扩充了NVIDIA AI for Media工具集,涵盖伪造视频检测、单目3D人体姿态估计、实时慢动作插帧等技术,并发布体育智能开发手册与多语言本地化工作流,全面推动广电与流媒体向软件定义AI架构演进。

在阿姆斯特丹举行的 IBC 大会上,NVIDIA 宣布对其面向传媒与娱乐行业的解决方案 NVIDIA AI for Media 进行全面升级。通过整合 GPU 加速的 SDK、NIM 微服务及参考工作流,NVIDIA 正在为实时转播、体育分析与流媒体分发提供一整套生成式 AI 工具栈。

伪造视频实时检测与媒体真实性验证

NVIDIA 带来了 Synthetic Video Detector (SVD) NIM 微服务。该服务用于判断视频素材是否为 AI 生成,在文本生成视频(文生视频)检测中的准确率达 99.3%,在图生视频检测中也达到了 97.7%。

行业合作伙伴已开始将该工具集成到生产流程中:

  • Dalet:将 SVD 嵌入新闻机构的云端核验流程,供编辑团队快速审查视频元数据与真实性评分。
  • TwelveLabs:在其合规产品 Compliance by TwelveLabs 中整合 SVD,在合规审查时同步提供帧级别的真伪置信度。
  • Wowza:通过其视频智能框架提供 SVD 能力,支持在边缘端、云端或完全物理隔离环境下对实时流媒体进行 AI 生成迹象检测。

视频生成与画质重塑:插帧、超分辨率与 TrueHDR

面向体育赛事转播等高动态场景,NVIDIA 推出了多项画质与帧率增强技术:

  • 3D 人体姿态估计(3D Body Pose):无需穿戴标记点,仅凭单个普通摄像机画面即可估算人体的 2D 与 3D 关节位置和角度。该技术可应用于运动员生物力学分析、判罚辅助以及虚拟制作中的角色动捕绑定。Vizrt 正利用该技术为虚拟演播室驱动实时的 3D 光影渲染。
  • 视频插帧(Video Frame Generation, VFG):利用生成式 AI 在相邻帧之间生成新帧,支持 2 倍至 4 倍插帧。Ross Video 正在其 Rio Replay 系统中集成 VFG,实现 6 倍乃至 8 倍的体育慢动作回放,无需依赖昂贵的超高速摄像机。
  • 超分辨率(VSR)与 TrueHDR:Video Super Resolution 支持实时降噪与去伪影,并新增 10 位视频支持;TrueHDR 则可将标准动态范围(SDR)实时转为最高约 2,000 尼特的 HDR 输出。两者结合可大幅翻新既有视频库资产。

实时音视频本地化与智能口型同步

针对跨国转播需求,NVIDIA 更新了 LipSync 与 Active Speaker Detection NIM 微服务。LipSync 能够在保留自然眨眼与头部运动的同时,将画面中的嘴部动作精准匹配至多语言音轨,并大幅改善了面部遮挡场景下的牙齿与唇部纹理细节。NDI 正在将这些微服务集成到现有转播管线中,实现单一视频流向多语种画面的实时转换,降低多语言分发成本。

配套的 Studio Voice 微服务还加入了全新麦克风配置文件,可在消除背景噪音与混响的同时,自定义语音输出的音色质感。

Holoscan for Media 与体育智能开发手册

NVIDIA Holoscan for Media

除了单一模型,NVIDIA 正在推进媒体基础设施的底层软件化:

媒体交换层(MXL)集成:NVIDIA Holoscan for Media 正式整合 MXL,作为开放参考架构,帮助软件定义的媒体应用在分布式计算环境中动态交换音视频数据,使传统广播功能与 AI 推理运行在同一加速计算集群上。

NVIDIA 体育智能开发手册

体育智能开发手册(Sports Intelligence Playbooks):帮助赛事组织方与转播商利用自有的赛事录像和标注数据,微调 Nemotron 等开源多模态模型。测试数据显示,经过专门微调后,多模态模型在特定体育场景下的问答准确率从 53% 提升至 94%。结合 NVIDIA AI-Q 蓝图,机构还能将这些专业模型包装为可自主调取系统数据、执行转播任务的 AI 智能体。

标签:NVIDIA流媒体计算机视觉生成式AI

想了解 AI 如何助力您的企业?

免费获取企业 AI 成熟度诊断报告,发现转型机会

置顶文章

拒绝率清零,代价是拒掉 74% 的正常问题:安全对齐评测漏掉的另一半
置顶

拒绝率清零,代价是拒掉 74% 的正常问题:安全对齐评测漏掉的另一半

拆解 Claude 文本水印:不是绿名单,是锦标赛采样,以及它在中国合规里挡得住的那一半
置顶

拆解 Claude 文本水印:不是绿名单,是锦标赛采样,以及它在中国合规里挡得住的那一半

前途科技前途科技
服务关于快讯技术商业报告
前途科技微信公众号

微信公众号

扫码关注

Copyright © 2026 AccessPath.com, 前途国际科技咨询(北京)有限公司,版权所有。|京ICP备17045010号-1|京公网安备 11010502033860号|隐私政策|服务条款
NeoMME 拆解:单塔多模态编码器如何把视觉 RAG 索引压到每页 6 KB
置顶

NeoMME 拆解:单塔多模态编码器如何把视觉 RAG 索引压到每页 6 KB

//

24小时热榜

RLHF先驱Paul Christiano加入OpenAI基金会董事会
TOP1

RLHF先驱Paul Christiano加入OpenAI基金会董事会

小米破局:短期看汽车,中期看手机,长期看AI
TOP2

小米破局:短期看汽车,中期看手机,长期看AI

3

京东发布物理AI战略:建十万卡算力集群与世界模型

20小时前
京东发布物理AI战略:建十万卡算力集群与世界模型
4

超越序列预测:AI何时能复原现实世界的隐藏规律?

12小时前
超越序列预测:AI何时能复原现实世界的隐藏规律?
5

OpenAI 发布 GPT-6 Astra:主打电脑操作与办公自动化

13小时前
OpenAI 发布 GPT-6 Astra:主打电脑操作与办公自动化
6

蓝色光标合作AhaCreator,用AI重构全球达人营销

20小时前
蓝色光标合作AhaCreator,用AI重构全球达人营销
7

理想小米转向自研与二供,宁德时代面临多供博弈

20小时前
理想小米转向自研与二供,宁德时代面临多供博弈
8

Momenta逼近盈利,L3新规重塑智驾分工边界

20小时前
Momenta逼近盈利,L3新规重塑智驾分工边界
热门标签
大模型AgentRAG微调私有化部署Prompt EngineeringChatGPTClaudeDeepSeek智能客服知识管理内容生成代码辅助数据分析金融零售制造医疗教育AI 战略数字化转型ROI 分析OpenAIAnthropicGoogle

关注公众号

前途科技微信公众号

扫码关注,获取最新 AI 资讯

免费获取 AI 落地指南

3 步完成企业诊断,获取专属转型建议

已有 200+ 企业完成诊断