"); //-->
实验
重建质量
在与神经图像图谱的比较分析中,如图所示,本文提出的模型对非刚性运动表现出卓越的鲁棒性,能够以更高的精度有效地重建细微的运动(例如眨眼、面部纹理)。
流媒体视频处理
(a) 视频到视频的重建。定性比较包括几种基线方法,分为三个不同的类别:(1) 使用图像翻译模型的逐帧推理,如 ControlNet ;(2) 分层视频编辑,如 Text-to-live ;(3) 基于扩散模型的视频翻译,包括 Tune-A-Video 和 FateZero 。
如图 4 所示,每帧图像转换模型可生成高保真内容,并伴有明显的闪烁。其他基线的生成质量或时间一致性相对较低。 本文提出的流水线式方法能有效地将图像转换提升到视频,保持与图像转换算法相关的高质量,同时确保时间一致性。
(b) 视频关键点跟踪。通过估计每个单独帧的变形场,可以查询规范空间内一帧中特定关键点的位置,然后识别所有帧中存在的对应点,如图 5 所示。本文在项目页面的视频中展示了在非刚性对象(如流体)中跟踪点的演示。
(c)视频对象跟踪。使用规范图像上的分割算法,本文能够利用内容变形场促进掩模在所有视频序列中的传播。如图 6 所示,本文提出的流水线算法熟练地生成在所有帧之间保持一致性的掩码。
(d) 视频超分辨率算法。通过将图像超分辨率算法直接应用于规范图像,可以将视频进行超分辨率处理以生成高质量视频,如图 7 所示。假设变形由连续场表示,那么超分辨率的应用不会产生闪烁。
(e) 用户交互式视频编辑。本文提出的表示算法允许用户编辑具有独特风格的对象,而不会影响图像的其他部分。如图 8 所示,用户可以手动调整规范图像上的内容,以在自动编辑算法可能无法实现最佳结果的区域进行精确编辑。
消融实验
为了验证本文所提出模块的效果,作者进行了消融实验研究。在用位置编码代替 3D 散列编码时,视频的重建 PSNR 显著降低了 3.1dB。在没有退火散列的情况下,规范图像失去了其自然外观,如图 9 中的显示。此外,在不考虑流信息损失的情况下,平滑区域明显受到闪烁的影响。要进行更广泛的比较,请参阅项目页面上的视频。
专栏文章内容及配图由作者撰写发布,仅供工程师学习之用,如有侵权或者其他违规问题,请联系本站处理。 联系我们
相关推荐
释说芯语16:硬科技:构建企业未来之路(附PPT)
存储器转型AI战略资源 台厂受惠
国家“算力网”:像用水用电一样用AI
PowiGaN for AI Data Centers: Unmatched Power Density and Reliability
基于Ai-WB2-12F与Rd-04的雷达检测系统
WTC-AI太阳能热水器电路图
AI聊天机器人能像医生一样推理吗?
基于Microchip MCU的AI/ML培训教程1
EEPW2018年6月刊(5G)
AI/HPC新世代 COUPE光互连扮要角
基于VisitionX制造智能眼镜
海联达(Aigale)Ai-HD1 无线全高清套件拆解
EEPW2018年3月刊(工业物联网)
CSR8670CSR8675智能语音Alexa蓝牙方案开发
重新构想AI电源:塑造AI加速的未来(第三部分)
基于Microchip MCU的AI/ML培训教程3
研华科技与Axelera AI深化战略合作 加速推动基于Europa平台的边缘AI创新
继上次海联达Ai-ap100拆机之电源改造
基于Microchip MCU的AI/ML培训教程2
尼吉康的事业介绍
电子元件培训教材
联发科加速AI在地化应用布局
被动元件新周期:AI时代高端化、服务器化重构MLCC产业格局
前Qwen负责人林俊旸创业,目标融资规模为数亿美元
iCAN-4017 AI功能模块
思科凭借通用商用芯片与光模块赢得 AI 领域客户
WTC-AI型太阳能热水器电路图
人工智能是如何帮助阻止造假者的?
万家乐JSYZ5-AI燃气热水器电路图
瑞萨电子AI单元解决方案成功提高GE医疗(日本)日野工厂的生产力