查看: 5|回复: 0

这个是真东西, 不是营销号吹的! 可能是目前最强的视频高清放大模型

[复制链接]

14

主题

2

回帖

46

积分

新手上路

积分
46
发表于 昨天 21:31 | 显示全部楼层 |阅读模式
这个是真东西, 不是营销号吹的!
可能是目前最强的视频高清放大模型

视频超分终于能自己控制画质了 : 把哪几帧放大成什么样,整段视频就长成什么样。

SparkVSR 是 ECCV 2026 收录的论文,  作者来自德州农工大学 + YouTube/Google, arXiv 2603.16864。

官方仓库 701 star, Apache-2.0,  模型基于 CogVideoX1.5-5B-I2V 改的。

它的思路确实聪明:

传统视频超分是个黑盒:你输入一段糊视频,模型吐出来什么你就得接受什么。

SparkVSR 换了个玩法 :
先用任意一个你喜欢的图像超分模型,  把其中几帧放大到满意;
然后它把这几个高质量锚点帧传播到整段视频,  
同时用原视频的运动信息做约束。

放大帧的效果, 直接决定整段视频的放大效果。

这就是"垫图模式"。
自由度也在这里: 想要真实感, 那几帧用 SeedVR2 放; 想要美颜感,用 Qwen-Image-Edit-2511-Upscale2K 。
同一个模型,能调出完全不同的风格倾向。

论文数据 : 在 CLIP-IQA、DOVER、MUSIQ 上最高分别提升 24.6%、21.8%、5.6%。

还能干别的:老片修复、视频风格迁移,论文里都验证过。

实测(RTX 4090 24G,640×640 放大到 1280×1280):

垫图模式:10GB 显存、120 秒
自动模式:14GB、150 秒
对照 SeedVR2:17GB、150 秒
显存和速度都比 SeedVR2 省,4090 完全跑得动。

但是有一个坑 : 它是按整段视频传播关键帧的, 多镜头会串味, 所以最好按镜头切开分别跑。

代码用官方仓库里的 ComfyUI-Spark/ 子目录👇

https://github.com/taco-group/SparkVSR



本帖子中包含更多资源

您需要 登录 才可以下载或查看,没有账号?立即注册

×
您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

关注公众号

相关侵权、举报、投诉及建议等,请发 E-mail:2776601884@qq.com

Powered by Discuz! X5.0 © 2001-2026 Discuz! Team.|青ICP备2025004122号-1

在本版发帖
关注公众号
返回顶部