首页
学习
活动
专区
圈层
工具
发布

解读 | 生成人脸修复模型:同时使用两个鉴别器,直接合成逼真人脸

与之前很多其他工作不同,针对人脸修复任务,这篇论文的作者同时使用了两个鉴别器来构建整个模型,因此不论是局部图像还是整个图像,看上去都更加逼真。 2. 方法 2.1 模型结构 ?...局部鉴别器被用来判别图像缺失区域中合成的图像补丁是否真实。整体鉴别器则用来判别整张图像的真实性。这两个鉴别器的架构相似于论文《用深度卷积生成对抗网络来进行非监督表征学习》中的所述架构。...两个鉴别器的损失函数的不同之处在于:局部鉴别器的损失函数 (L_a1) 仅仅反向传播图像缺失区域的损失梯度,而整体鉴别器的损失函数 (L_a2) 反向传播整个图像的损失梯度。...结论 这个基于生成对抗网络的模型具有两个鉴别器和一个语义正则化网络,能够处理人脸修复任务。它能够在随机噪声中成功地合成缺失的人脸部分。 6....改进建议 这个模型一个局限是并不能处理一些未对齐的人脸,可以增加一个面部变形的网络来将输入的人脸规范化。

4.1K80

年末惊喜!ByteDance Research视频理解大模型「眼镜猴」正式发布

Tarsier2 是一个 7B 大小的轻量级模型,支持动态分辨率,能够看得懂长达几十分钟的视频,尤其擅长对几十秒的短视频片段进行分析。...预训练 Tarsier2 在 4000 万个互联网视频 - 文本数据上进行预训练。不同于文本模型只需要互联网上的单语语料就可训练,视频理解模型严重依赖高质量的视频 - 文本对齐数据。...“分镜” 阶段,视频会被切分成多个单一镜头片段;“过滤” 阶段针对不同的数据使用不同的模型过滤低质数据,如过滤掉动态性太差的、文本和画面无关的等;“合并” 阶段再将剩下的相邻的视频片段合在一起,增加视频的复杂度...其中,正样来源于模型对原始视频的预测结果;负样本来源于模型对经过预先设计的随机扰动的视频的预测结果。这种直观高效的构造方式使得模型能够在描述视频时,“又准确又全面”,减少描述中存在的幻觉。...Tarsier2 在包括视频描述、短 / 长视频问答在内的通用视频理解任务上表现亮眼。

1.1K10
  • 您找到你想要的搜索结果了吗?
    是的
    没有找到

    深度学习之视频人脸识别系列三:人脸表征

    作者 | 东田应子 编辑 | 安可 出品 | 磐创AI技术团队 【磐创AI导读】本文是深度学习之视频人脸识别系列的第三篇文章,介绍人脸表征相关算法和论文综述。...在本系列第一篇文章里我们介绍了人脸识别领域的一些基本概念,分析了深度学习在人脸识别的基本流程,并总结了近年来科研领域的研究进展,最后分析了静态数据与视频动态数据在人脸识别技术上的差异;在第二篇文章中介绍了人脸检测与对齐的相关算法...一、人脸表征 把人脸图像通过神经网络,得到一个特定维数的特征向量,该向量可以很好地表征人脸数据,使得不同人脸的两个特征向量距离尽可能大,同一张人脸的两个特征向量尽可能小,这样就可以通过特征向量来进行人脸识别...在该人脸识别模型中分为四个阶段:人脸检测 => 人脸对齐 => 人脸表征 => 人脸分类,在LFW数据集中可以达到97.00%的准确率。...三角化后的人脸变为有深度的3D三角网 f. 将三角网做偏转,使人脸的正面朝前。 g. 最后放正的人脸 h.

    2.3K30

    视频人脸检测——OpenCV版(三)

    视频人脸检测是图片人脸检测的高级版本,图片检测详情点击查看我的上一篇《图片人脸检测——OpenCV版(二)》 实现思路: 调用电脑的摄像头,把摄像的信息逐帧分解成图片,基于图片检测标识出人脸的位置,...把处理的图片逐帧绘制给用户,用户看到的效果就是视频的人脸检测。...视频的人脸识别 这个时候,用到了上一节的《图片人脸检测——OpenCV版(二)》 把人脸识别的代码封装成方法,代码如下: def discern(img): gray = cv2.cvtColor...x, y, w, h = faceRect cv2.rectangle(img, (x, y), (x + h, y + w), (0, 255, 0), 2) # 框出人脸...cap.release() # 释放摄像头 cv2.destroyAllWindows() # 释放窗口资源 完整的代码如下: # -*- coding:utf-8 -*- # OpenCV版本的视频检测

    2.1K30

    深度学习之视频人脸识别系列四:人脸表征-续

    作者 | 别看我只是一只洋 编辑 | 安可 出品 | 磐创AI技术团队 【磐创AI导读】本文是深度学习之视频人脸识别系列的第四篇文章,接着第三篇文章,继续介绍人脸表征相关算法和论文综述。...在本系列第一篇文章里我们介绍了人脸识别领域的一些基本概念,分析了深度学习在人脸识别的基本流程,并总结了近年来科研领域的研究进展,最后分析了静态数据与视频动态数据在人脸识别技术上的差异;在第二篇文章中介绍了人脸检测与对齐的相关算法...一、人脸表征 把人脸图像通过神经网络,得到一个特定维数的特征向量,该向量可以很好地表征人脸数据,使得不同人脸的两个特征向量距离尽可能大,同一张人脸的两个特征向量尽可能小,这样就可以通过特征向量来进行人脸识别...CosFace使用mtcnn进行人脸检测与对齐,人脸表征训练模型使用基于residual units 64层卷积网络的Sphere Face,在5M的训练集上训练,在LFW数据集上测试,精度达到99.73%...三、总结 本期文章主要介绍人脸表征相关算法和论文综述,人脸检测、对齐、特征提取等这些操作都可以在静态数据中完成,下一期将给大家介绍在视频数据中进行人脸识别的另一个重要的算法,视频人脸跟踪的概念与方法。

    2.7K10

    视频人脸检测——Dlib版(六)

    往期目录 视频人脸检测——Dlib版(六) OpenCV添加中文(五) 图片人脸检测——Dlib版(四) 视频人脸检测——OpenCV版(三) 图片人脸检测——OpenCV版(二) OpenCV...视频人脸检测是图片识别的高级版本,图片检测详情点击查看我的上一篇《图片人脸检测——Dlib版(四)》 除了人脸识别用的是Dlib外,还是用OpenCV读取摄像头和处理图片(转为灰色),所以给出相关的文档...技术实现 有了OpenCV的视频人脸检测,Dlib也大致相同除了视频识别器模型的声明和使用不同,具体的细节请参考,视频人脸检测——OpenCV版(三) 那篇已经讲的很细致了,在这就不具体叙述了。....waitKey(1) & 0xFF == ord('q'): break cap.release() cv2.destroyAllWindows() 那么,OpenCV和Dlib的视频识别对比...,有两个地方是不同的: 1.Dlib模型识别的准确率和效果要好于OpenCV; 2.Dlib识别的性能要比OpenCV差,使用视频测试的时候Dlib有明显的卡顿,但是OpenCV就好很多,基本看不出来;

    1.7K70

    视频人脸检测——OpenCV版(三)

    视频人脸检测是图片人脸检测的高级版本,图片检测详情点击查看我的上一篇《图片人脸检测——OpenCV版(二)》 实现思路: 调用电脑的摄像头,把摄像的信息逐帧分解成图片,基于图片检测标识出人脸的位置,把处理的图片逐帧绘制给用户...,用户看到的效果就是视频的人脸检测。...视频的人脸识别 这个时候,用到了上一节的《图片人脸检测——OpenCV版(二)》 把人脸识别的代码封装成方法,代码如下: def discern(img): gray = cv2.cvtColor...x, y, w, h = faceRect cv2.rectangle(img, (x, y), (x + h, y + w), (0, 255, 0), 2) # 框出人脸...cap.release() # 释放摄像头 cv2.destroyAllWindows() # 释放窗口资源 完整的代码如下: # -*- coding:utf-8 -*- # OpenCV版本的视频检测

    1.9K70

    视频人脸检测——Dlib版(六)

    前言 Dlib的人脸识别要比OpenCV精准很多,一个是模型方面的差距,在一方面和OpenCV的定位有关系,OpenCV是一个综合性的视觉处理库,既然这么精准,那就一起赶快来看吧。...视频人脸检测是图片识别的高级版本,图片检测详情点击查看我的上一篇《图片人脸检测——Dlib版(四)》 除了人脸识别用的是Dlib外,还是用OpenCV读取摄像头和处理图片(转为灰色),所以给出相关的文档...技术实现 有了OpenCV的视频人脸检测,Dlib也大致相同除了视频识别器模型的声明和使用不同,具体的细节请参考,视频人脸检测——OpenCV版(三) 那篇已经讲的很细致了,在这就不具体叙述了。....waitKey(1) & 0xFF == ord('q'): break cap.release() cv2.destroyAllWindows() 那么,OpenCV和Dlib的视频识别对比...,有两个地方是不同的: 1.Dlib模型识别的准确率和效果要好于OpenCV; 2.Dlib识别的性能要比OpenCV差,使用视频测试的时候Dlib有明显的卡顿,但是OpenCV就好很多,基本看不出来;

    1.3K20

    深度学习之视频人脸识别系列二:人脸检测与对齐

    问题描述: 人脸检测解决的问题为给定一张图片,输出图片中人脸的位置,即使用方框框住人脸,输出方框的左上角坐标和右下角坐标或者左上角坐标和长宽。...算法难点包括:人脸大小差异、人脸遮挡、图片模糊、角度与姿态差异、表情差异等。...如下图所示: 第三阶段:与第二阶段类似,最终网络输出人脸框坐标、关键点坐标和人脸分类(是人脸或不是)。...,然后根据人脸的关键点坐标调整人脸的角度,使人脸对齐,由于输入图像的尺寸是大小不一的,人脸区域大小也不相同,角度不一样,所以要通过坐标变换,对人脸图像进行归一化操作。...,下一期我给大家介绍一下人脸表征的相关算法,即通过深度学习提取人脸特征,通过比较人脸特征进行人脸识别与验证。

    3.1K20

    促销丨9.9元畅享实时音视频通用套餐包,真香!

    T     R     T      C RECOMMEND 【适用于各种应用场景】 视频通话 基础功能: 支持1对1或多人视频通话,支持720P、1080P高清画质。...适用场景: 适用于1对1视频通话、300人视频会议、在线问诊、视频聊天、视频客服、视频面审、视频双录、在线理赔、视频狼人杀等场景。 ?...适用场景: 视频低延时直播、十万人互动课堂、视频直播 PK、视频相亲房、互动课堂、远程培训、大型会议等。 ? 语音互动直播 基础功能: 支持主播与观众语音连麦互动、主播跨房间(跨直播间)PK。...【TRTC超值套餐】 仅需9.9元,即可享受 实时音视频通用套餐包 20000分钟 每个账号每月都可购买一次 这也太香了! ?...【TRTC的优势】 低延时低卡顿 全球端到端时延小于300ms,抗丢包率超过40%,弱网环境下仍然能够保证高质量的音视频通信,确保视频通话过程顺畅稳定。

    6.4K30

    python+opencv 实现图像人脸检测及视频中的人脸检测

    下载HAAR与LBP数据 2. opencv相关知识 二、python+opencv实现人脸检测 1. 图像单人脸检测 2. 图像多人脸检测 3. 视频中人脸检测 4....视频中人脸检测 # -*- coding: UTF-8 -*- """ @Author :叶庭云 @公众号 :修炼Python @CSDN :https://yetingyun.blog.csdn.net.../ """ import cv2 # 加载视频 cap = cv2.VideoCapture('test.mp4') # 创建一个级联分类器 加载一个.xml分类器文件 它既可以是Haar特征也可以是.../face_detection/haarcascades/haarcascade_frontalface_default.xml') while True: # 读取视频片段 ret,...自己进行简单测试时也会发现,人物动作、视频中镜头切换过快、背景变化等因素,可能会造成对视频中人脸检测不准确。 4.

    2.3K20

    自定义词库+图库+人脸库:腾讯云视频审核个性化配置完全指南

    选择人脸类图库 两种人脸库类型 类型 处理建议设置 作用 黑名单人脸 设置为"违规" 视频中出现该人脸即预警 白名单人脸 设置为"通过" 视频中出现该人脸即跳过相关判定 人脸库应用场景 场景 操作...效果 监控高风险主播 将违规历史主播面部加入黑名单 换号重来也能被识别 保护合作KOL 将签约主播加入白名单 避免合作内容被误判 识别冒充者 将被冒充的名人加入关注库 辅助鉴别冒充行为 三、策略配置组合模板...、多次违规被封号的用户 审核策略 截帧1秒,音频30秒,违规回调 3.2 电商平台配置模板 配置项 建议内容 黑词库 广告法违禁词(最、第一、唯一、100%等)、虚假承诺语、违禁品名称 白词库 平台促销活动的合规用语...涉政敏感词 白词库 学科专业术语(避免医学、化学等专业词被误判) 审核策略 截帧2秒,音频30秒,全量回调(保存完整审核记录) 3.5 直播平台配置模板 配置项 建议内容 黑词库 低俗用语、引流暗号、违规促销语...——某社交平台安全运营 "人脸黑名单是治理违规主播的'杀手锏'。以前封了号换个马甲就回来了,现在只要脸出现在画面里就会被识别。" ——某直播平台运营总监 "自定义图库帮我们解决了外挂推广视频的问题。

    43710

    用AI鉴别女友是否拍过羞羞视频?当心黑产的圈套

    一位名为“将记忆深埋”程序员博主公开表示自己准备上线一个“拯救老实人”的人脸识别工具。 ?...接下来是重点:这个工具通过机器学习的方式把羞羞网站的人脸数据和各大社交媒体的人脸数据交叉对比,鉴别那些出现在羞羞视频里的“退休小姐姐”。...一来没有任何证据佐证它的识别率,由始至终全凭博主一面之词;二是即便识别率高达99%,剩余1%造成的误伤也是极其致命的;再者网上存在着很多偷拍视频,把“被偷拍”等同于“从事羞羞事业”,从事实逻辑上也明显不通...页面上诸如“专为保护老实人而生”、“想知道TA拍过的照片和视频吗”的挑逗暗示,则进一步放大的窥私心理。再加上绿得发黑的页面背景,从视觉上强化了心理冲击,把持不住的就放手一试了。...一进入页面,当头就是“人脸定位、智能模拟、数据对比”三个响当当的技术大棒,给你营造一种专业的错觉。 在进行到所谓的“人脸解码”和“智能匹配”阶段,页面上则是事无巨细地把整个过程和你演示了一遍。

    4.5K30

    基于 FPGA 的视频流人脸伪造设备

    鉴于此,我们决定采用 Xilinx 的 PYNQ-Z2 开发板,将 FPGA 高度并行化的特点与人工智能安全相结合,设计了一种具有实时人脸伪造能力的视频采集设备。...如果利用在会议视频中,可以协助会议平台完善对参会者的身份验证的系统,防止出现利用参会者的照片、视频信息冒名顶替的行为。...最后将处理结果返回到上位机终端,实现真假人脸的转换。 图像处理算法部分说明: 首先进行帧截取,将动态视频流转换成静态帧。通过锚框将全身人像的人脸部分截取出来,再通过人脸特征检测提取出人脸的特征。...然后采用泊松融合或者前后景+边缘膨胀的方式将人脸还原到静态图片帧(具体采用哪种取决于算力与实时性的要求),最终将静态图片帧还原到视频流中。...2.3 图像处理算法介绍 2.3.1 视频流接入的设计 考虑到可能的不同情境,我们为此设计了两种视频流的接入方式。

    2.7K11

    使用Pytorch和OpenCV实现视频人脸替换

    本文将分成3个部分,第一部分从两个视频中提取人脸并构建标准人脸数据集。第二部分使用数据集与神经网络一起学习如何在潜在空间中表示人脸,并从该表示中重建人脸图像。...最后部分使用神经网络在视频的每一帧中创建与源视频中相同但具有目标视频中人物表情的人脸。然后将原人脸替换为假人脸,并将新帧保存为新的假视频。...因为第一步是从视频中提取帧,所以需要构建一个将帧保存为JPEG图像的函数。这个函数接受一个视频的路径和另一个输出文件夹的路径。...如果没有人脸就把画面写入视频。如果有人脸,将其提取出来,转换为网络的适当输入,并生成新的人脸。 对原人脸和新人脸进行遮蔽,利用遮蔽图像上的矩量找到原人脸的中心。...我们首先从视频中提取帧,然后从帧中提取人脸并对齐它们以创建一个数据库。使用神经网络来学习如何在潜在空间中表示人脸以及如何重建人脸。遍历了目标视频的帧,找到了人脸并替换,这就是这个项目的完整流程。

    1.6K30

    远程人脸识别系统技术要求 安全分级

    采用近红外光源照射人脸,通过采集人脸在近红外光源下的图像视频进行人脸肤质材料的分析,从而判定是否为活体。...一次性鉴别机制 应防止与人脸识别身份鉴别有关的鉴别数据的重用。...例如采用近红外光源照射人脸,通过采集人脸在近红外光源下的图像视频进行人脸肤质材料的分析,从而判定是否为活体。...:打印的普通人脸照片、纸质高清人脸照片、手机屏幕重放的人脸照片攻击); 防纸质面具伪造:应能检测或防止使用绝大多数人脸纸质面具的仿冒行为; 防视频伪造:应能检测或防止使用拼接、替换、翻拍视频进行伪造...; 防人脸CG合成伪造:应能检测或防止使用CG技术将单张或多张人脸图像合成人脸视频或3D人脸模型进行伪造; 防假体面具伪造:应能检测或防止使用绝大多数人脸3D假体面具(树脂面具、硅胶面具)的仿冒行为

    6.2K30

    这家帮迅雷、小咖秀鉴别“小黄图”的公司要做视频大生意

    图普告诉雷锋网,其产品包括图像审核、増值及搜索,有鉴黄、人脸识别、场景识别等数十个模块,目前日均处理3亿张图片,是国内最大的图像识别云服务公司。...不过图普最知名的还是鉴别“小黄图”,图像视频审核也是现在最主要的服务,客户包括受不良信息困扰的迅雷,和王思聪投过的直播平台17等。 ?...图片来自图普官网截图 鉴别小黄图听起来像是个苦力活,但与其它类型的图像一样,用的也是深度学习技术。...后来由于快播事件,他们发现内容审核对很多社交及云平台都是刚需,才做起了鉴别小黄图。 不过鉴黄并不是图普的目标。也许是继承了腾讯的基因,李明强给图普的定位是给视频时代建立连接。...李明强认为,根据内容进行推荐、搜索,提供差异化服务,视频行业才算到了第二阶段,目前的审核服务是为了满足基础需求,技术成熟后会提供广告投放和导购等增值服务。 看来,鉴别小黄图还只是开始。

    2.3K70
    领券