首页
学习
活动
专区
圈层
工具
发布
首页标签视频分析

#视频分析

无限画布视频关键帧锚定:解决长时序角色崩坏的技术方案

回头不见

角色崩坏,是长时序 AI 视频绕不开的坎:同一角色,第 1 镜还是本人,第 30 镜脸歪了、发色变了、衣服细节全对不上。 很多人归因于"模型不行",但公开工程复...

11710

从底层DiT到视频生成:拆解Vera 1.1主干网络设计思路

用户12512581

但真正决定生成质量的,是藏在中间的主干网络——DiT(Diffusion Transformer)。它是整个生成流程的"大脑",VAE压缩后的潜空间数据在这里完...

14910

单片机视频生成:在仅几千字节内存里“无中生有”

闪学it点com

每当提到视频生成,大部分工程师脑海中浮现的图景是数据中心里庞大的GPU集群、海量的VRAM以及PyTorch或TensorFlow长长的调用栈。但在这个光谱的另...

10310

Vera1.1 模型浅析:图生 4K 视频的参考特征对齐实现思路

回头不见

图生视频的核心诉求,是让输出视频持续继承输入参考图的人物相貌、服饰、场景构图、色彩风格。市面上多数方案将参考图像只作用于首帧,后续帧依靠模型自主推演运动,在 7...

16810

Vera1.1 技术细读:长时序 4K 视频的帧间稳定机制

用户12512581

在当前 AI 视频生成领域,4K 分辨率 + 长时序连续生成是业务刚需,但原生生成方案普遍存在帧间一致性缺陷:

17510

时空注入架构技术落地,有效缓解AI视频画面闪烁抖动问题

回头不见

当前文生视频、图生视频大模型(扩散模型、Transformer视频模型)已广泛应用于内容创作、数字人、影视剪辑、短视频生成等场景,但帧间时序一致性缺失导致的画面...

14310

Vera 1.1 长时序视频生成遇到的问题与解法

用户12512581

随着文生视频模型迭代,短片段画面质量已经达到可用水准,但一旦视频时长拉长到 8‑16 秒甚至更高,就会集中爆发角色漂移、物体崩坏、镜头跳变、时序逻辑断裂、FVD...

15510

警惕“擦边视频”诱导下载恶意软件的钓鱼攻击

芦笛

中国互联网络信息中心 | 工程师 (已认证)

近期极速云安全中心监测到一类高隐蔽性移动端攻击:攻击者在知名平台的擦边视频画面中嵌入网址,诱导用户下载安装恶意程序,安装后软件将窃取手机全部隐私数据并获取设备高...

14600

数字人口播新基建:Vera 1.1 唇形同步与人物锚定实测

用户12512581

市面上多数数字人方案,唇形驱动与人物身份约束相互割裂。唇形模块负责嘴部运动,人物锚定负责锁定五官脸型,两套信号在推理阶段容易互相干扰。在长时长口播、多语种语音、...

18510

Vera 1.1 推出全局人物特征锚定库,锁定主角不 “换脸”

回头不见

现有多数 AI 视频工具的身份锚定属于单镜头局部约束,仅作用于当前渲染片段。当制作多镜头剧集,每一个镜头都要重新上传人物参考图,不仅操作重复,还会出现参考图提取...

17110

国产视频 DiT 模型工程思考,基于 Vera1.1 的落地技术复盘

回头不见

学术界的视频 DiT 模型往往只追求单帧 / 短片段效果,但是面向真实业务,会暴露出大量工程缺陷。原型模型和生产级产品之间存在明显差距。

18310
领券