英伟达发布AI视频检测工具SVD,识别准确率92%

在AI生成内容日益泛滥、传统鉴别手段失效的背景下,英伟达(Nvidia)正式推出“合成视频检测器”(Synthetic Video Detector,简称SVD)。作为这场AI竞赛的核心受益者,英伟达试图通过这一新工具解决真实内容与虚假新闻难以辨别的难题。

技术原理:基于Meta视觉Transformer模型

SVD隶属于英伟达推理微服务(NIM)及“媒体AI私有访问计划”,主要面向新闻机构、广播公司和媒体等企业用户,普通消费者无法直接使用。该技术基于计算机视觉国际会议(ICCV)的获奖研究,核心逻辑并非将视频作为整体分析,而是将其拆解为多个504x504分辨率的裁剪帧。

这些帧被输入到Meta开发的两款视觉Transformer模型——DINOv2和DINOv3中。借助Transformer在无标注数据下学习模式的能力,系统能迅速评估每帧的空间特征,并赋予0到1之间的分数(0为完全真实,1为完全伪造)。最终,系统通过计算所有帧的平均分,以百分比形式呈现视频的真实性概率。即便视频经过社交媒体常见的压缩处理,掩盖了表面瑕疵,该模型仍能捕捉人类肉眼无法察觉的内在人工痕迹。

性能表现:高准确率与低延迟

基准测试数据显示,SVD在未压缩视频上的检测准确率高达92%。即使在15%的压缩率下,准确率仍保持在87%;在50%的高压缩率下,准确率亦有82%。作为微服务,SVD具备极低延迟:在英伟达RTX GPU上处理1080p视频仅需22毫秒,在工作站型号上为30毫秒。

部署限制与合作进展

值得注意的是,SVD依赖NVENC编码器支持,因此包括B100在内的部分数据中心显卡无法原生运行该工具。英伟达已宣布与Wowza合作,旨在将实时合成视频检测集成至直播工作流中。

目前,用户可在build.nvidia.com体验演示版。但由于处理过程在云端进行,存在耗时较长、经常超时以及最大文件大小限制为100MB等问题。

【星途科讯 图文丨小林 首发于ZAKER科技,转载请注明出处】

展开阅读全文

更新时间:2026-07-22

标签:科技   英伟   准确率   检测工具   视频   模型   视觉   媒体   压缩率   核心   真实   工具

1 2 3 4 5

上滑加载更多 ↓
推荐阅读:
友情链接:
更多:

本站资料均由网友自行发布提供,仅用于学习交流。如有版权问题,请与我联系,QQ:4156828  

© CopyRight All Rights Reserved.
Powered By 71396.com 闽ICP备11008920号
闽公网安备35020302034844号

Top