首页
学习
活动
专区
圈层
工具
发布
    • 综合排序
    • 最热优先
    • 最新优先
    时间不限
  • 数字人口新基建:Vera 1.1 唇形同步与人物锚定实测

    一、行业痛点:数字人口的两大核心矛盾市面上多数数字人方案,唇形驱动与人物身份约束相互割裂。唇形模块负责嘴部运动,人物锚定负责锁定五官脸型,两套信号在推理阶段容易互相干扰。 想要做好商用数字人口,不能简单拼接两个独立组件,需要底层架构层面做联合调度。 ,适度提高唇形驱动强度;批量CSV脚本做数字人口:预先建好角色档案,脚本传入角色ID,统一配置口参数,部分镜头可以做单镜头参数覆盖。 五、落地业务场景Vera1.1这套唇形同步+人物锚定联合能力,落地多类商业场景:知识科普数字人口:长视频讲解,保持人脸稳定,口型匹配语音;电商带货数字人:带货口短视频,人物形象统一,适配批量产出;跨境多语种数字人 A:支持中文、英文等主流语种的音素解析与唇形驱动,可适配跨境口场景。Q5:CSV批量脚本可以调用这套数字人口能力吗?A:可以。

    14810编辑于 2026-08-25
  • 来自专栏《Cloud Studio》

    基于腾讯云Cloud Studio,打造属于自己的数字人口系统,照片+音乐=自动开口,效果炸裂

    今天就教大家怎么在腾讯云Cloud Studio上部署Sonic数字人。 二、 在ComfyUI上部署Sonic数字人 第一步:安装必要插件节点切换到 comfyui_env 虚拟环境下。安装相关节点,以防出错或者对系统环境出现破坏性冲突。 /stable-diffusion-v1-5-archive/resolve/main/v1-5-pruned-emaonly-fp16.safetensors aria2c -x 16 -s 16 - k 1M -o v1-5-pruned-emaonly-fp16.safetensors https://hf-mirror.com/Comfy-Org/stable-diffusion-v1-5- 第四步:生成数字人视频点工作流上的upload上传音频文件:将准备好的.wav或.mp3文件上传至工作流,然后选中点工作流上的upload上传图片文件:将准备好的.jpg或.png文件上传至 工作流,然后选中选择检查相应的模型

    3.6K00编辑于 2025-03-17
  • 来自专栏AI进修生

    NotebookLM +PodLM + F5:AI客系列,个性化中英文客(本地安装、Colab部署)

    接下来,我们将先介绍一下 NotebookLM,然后再转向 PodLM 和 F5,这两个为中文用户提供支持的客解决方案。 客简介:用NotebookLM撰写客描述。 4. 封面艺术:使用Ideogram创建客封面。 另外想想,AI客属于音频内容,那么利用数字人技术,或许可能将它转化为真正的访谈节目,比如 ... v=lFxu0mlOoWs 利用Heygen,我们通过中文音频生成虚拟数字人视频,它是能够根据音频内容对准口型的,并配合恰到好处的肢体动作和表情。 只需将AI客的音频上传即可。 还有,最近的 F5 TTS 也支持AI客 PodLM 这个东西操作挺简单的,到这里https://podlm.ai/zh-CN可以免费体验一定的次数,不过他也是开源的,你可以选择自己部署。 F5-TTS 这是一个挺厉害的TTS项目 我在Colab部署F5后生成了一个例子: 由于F5官方(https://huggingface.co/spaces/mrfakename/E2-F5-TTS)

    2.6K00编辑于 2024-12-02
  • 来自专栏腾讯安全

    如何为数字人口普查做好安全保障工作?|产业安全专家谈

    如何为第七次全国人口普查提供安全保障支撑,确保线上系统稳定运行?本期专家谈,我们采访了腾讯安全身份安全技术负责人王旭来为我们讲解此次人口普查背后的安全防护。 视频封面.png Q:站在安全保障的视角,简单跟我们介绍一下第七次全国人口普查项目的特点,主要的难点有哪些? 王旭:这次我们腾讯承接的第七次全国人口普查项目,我们也简称七人普。 另外说到稳定性,就不得不考虑到人口普查的一个规模问题,要知道本次人口普查是需要采集5.5亿条户记录、17亿条人记录(包括重复统计的流动人口),并且要求全国各级普查机构组织,包括约700万名普查员需要在15 Q:在普查数字系统需求梳理、框架设计的阶段,安全在里面扮演了什么角色?最终采用的是什么样的方案,是基于哪些考量产生的? Q:这是一项基于专有云部署的数字系统,它的安全部署有哪些特性?

    76540发布于 2021-05-18
  • 来自专栏腾讯云 DNSPod 团队

    DNSPod十问林洪祥:顶级带货主,其实是数字人?

    我们先去训练一个大模型,里面含有不同样本,然后只需要录制5-10分钟有效时间去形成小样本,后期就能自动生成大多数口型、表情。 就目前数字人的实时互动能力而言,市场需求推动 “直播先行”,因为直播卖货的场景本身就有5-10秒的时延,互动起来也比较自然。 风平智能数字人制作中 5 田超:你一直在强调AI数字人要具有“漂亮的外表+有趣的灵魂”,前者目前已经不成问题,而后者的IP人格化却一直难以解决。 不少商家推出的数字人主仅活跃了几个月就再无水花,最后还需要把人类主召唤回来,那么数字人主的价值是什么? 林洪祥:相对于真人主数字人的独特优势是能成为一个独一无二、长时间不出错的IP。 不过可预见的是,随着直播行业热度回落,真人主工资将逐步降低,当人工费用降低后,数字人主的不可替代性又在哪里?除了节省人工成本,数字人主真的能为商家带来好的转化收入吗?

    1.1K40编辑于 2023-07-24
  • 来自专栏AI科技评论

    AI 研习社职间:知识图谱赋能企业数字化转型

    而知识图谱,则在企业的数字化转型中扮演了重要的作用。 近日,在雷锋网 AI 研习社第 3 期职间上,北京知识图谱科技有限公司 CEO 进行了招聘宣讲,并分享了如何利用知识图谱产品赋能企业数字化转型。 分享主题:知识图谱赋能企业数字化转型 分享提纲: 1、公司介绍与职位介绍 2、知识图谱技术概述 3、企业机遇与挑战 4、知识图谱赋能企业数字化转型 5、知识图谱落地挑战与趋势 雷锋网 AI 研习社将其分享内容整理如下 职位主要有: 资深 Java 工程师:我们的知识图谱平台主要是 Java 的平台,因此我们主要招聘资深 Java 工程师,要求 3-5 年工作经验,本科及以上学历 。 知识图谱赋能企业数字化转型 接下来我们就讲一下知识图谱怎样赋能企业数字化转型。 可基于少量语料冷启动,无需大量语料和配置相同问法; 5. 具有可解释性。

    1K30发布于 2018-10-25
  • 来自专栏区块链领域

    区块链数字内容客平台ContentASTBoxOX登陆区块链应用落地

    4分钟 带你了解ContentBox——区块链数字内容平台的行业领先之处 ▇区块链数字内容平台ContentBox应用落地 获分布式资本创始人沈波投资 ? 加利福尼亚州旧金山,2018年5月25日讯——由前谷歌人王小雨创立的Castbox,一个屡获殊荣的全球客内容平台应用,于今日宣布推出一个为分散式数字内容产业所设计的区块链数字内容平台——ContentBox ContentBox致力于为数字内容生态链上的用户提供一整套区块链技术支撑的跨平台支付系统,共享的内容库以及共享的用户池。 ContentBox依托其团队丰富的行业经验和技术背景,我相信其将成为数字内容产业第一个杀手级应用。” 该团队的第一个去中心化的应用是CastBox, 一个屡获殊荣的全球博客内容平台,平台内在135个国家内拥有超5千万,70种语言的音频内容,以及超过1千5百万的用户,在这里每个人都可以轻松查找、收听、创建和欣赏语音音频内容

    1.1K10发布于 2018-07-23
  • 来自专栏Kirin博客

    HTML5m3u8(hls)格式视频

    不同于mp4大文件,m3u8是由一系列的ts文件组成,一般一个ts文件大概5-10秒,这些ts文件通过一个.m3u8文件做索引。 $refs.videoRef.play(); }); } } </script> 其他 基于hls.js开发了很多用于html5播放器的插件,让这些播放器也支持m3u8格式播放。

    12.8K40发布于 2020-05-11
  • 实操复盘Vera1.1数字人视频制作,梳理全链路避坑技巧与落地配置方案

    摘要本文基于Vera1.1模型,聚焦数字人口视频工业化制作全链路,结合一线实操踩坑案例、量化参数数据,从工具配置、参数调优、流程搭建、团队协作管理多维度复盘落地经验。 全文参考中国信通院《数字人产业发展白皮书》《AIGC内容生产工程化规范》相关标准,所有数据均来自本地生产环境实操统计,符合EEAT可信内容原则,为企业级数字人口视频量产提供可复用的落地标准与避坑方案。 一、项目落地基础环境与核心链路介绍当前数字人口视频广泛应用于短视频营销、知识科普、企业宣讲等场景,Vera1.1作为轻量化高精度数字人生成模型,具备人脸贴合度高、口型匹配精准、推理效率稳定的特性,是中小团队量产口视频的主流工具 完整制作全链路分为5个标准化单元:素材预处理、模型参数配置、推理生成、后处理优化、批量导出归档。 五、常见问题FAQQ1:Vera1.1生成的数字人口视频,口型轻微错位如何彻底解决?A:优先将口型匹配阈值调整至0.8-0.9区间,同时统一音频采样率为48kHz,避免音频压缩失真。

    27410编辑于 2026-08-12
  • 来自专栏编程

    AI 时代下,普通人不能错过的五大变现机会

    自媒体商单 广告分成 带货 私域转化 核心逻辑:目前 AI 存在巨大的科普红利和流量红利 + AI 能够提升创作效率 爆款公式: 选题:AI 工具测评 + 具体场景 工具链:Deepseek 写文案 数字人技术代替自己口 所有公司正在慢慢 AI 化,需求量暴增,而懂 AI 的人才讲师非常稀缺 操作步骤: 掌握AI的技能,建立专业人设,打造个人IP 拓展企业端的人脉资源 多学习AI破局俱乐部里关于AI企业培训相关的内容 机会5: AI 变现小项目——红利项目 热门项目: AI 数字人口带货项目 AI 代写项目 AI 公众号爆文项目 …… 核心逻辑:AI非常擅于处理文本、图片、视频相关的工作,在内容创作方面有很大的提效作用,所以市面上很多副业项目 ,都值得用AI重新再做一遍,例如代写业务,就可以用AI进行代写,口带货项目,就可以用数字人再做一遍。 关键原则: 选择离钱近的赛道 参加AI破局俱乐部实战变现类的行动营,例如AI数字人口带货行动营、AI代写行动营 行动指南 匹配度测试: 你更擅长内容/技术/资源整合? 每天能投入多少时间?

    3.8K10编辑于 2025-04-29
  • 来自专栏活动盒子

    互联网人口红利殆尽,电商行业数字化转型突破流量壁垒

    目前我国互联网的渗透率已接近饱和状态,随着互联网人口红利殆尽,电商销售增速也呈放缓趋势,进入了存量争夺的竞争阶段。 这也意味着近三分之一的数字广告费用被无端浪费,用户并未完成转化的刷量行为无疑是直接损害了广告主的直接收益。 4、异常的地域分布 数字广告的投放是全网性质的,所以浏览用户地域应该呈碎片化分布,当同一个城市产生严重比例失衡的广告流量,则可能是刷量行为。 5、异常的行为轨迹 用户的浏览习惯存在自上而下、层层递进的阅读合理性,比如异常现象体现在打开广告页面后省略了中间环节,直接拖动至最底部便完成了整个浏览行为。 5、自传播营销 执行行为激励策略,推动留存用户产生推荐传播行为,实现以存量带增量的用户良性增长,层层递进拉动分享人数、次数和被邀请人数的体量膨胀。

    1.6K30发布于 2021-02-19
  • 来自专栏GEE数据专栏,GEE学习专栏,GEE错误集等专栏

    GHSL: 1975 年至 2020 年的全球居住人口估计值以 5 年为间隔以及2025 年和 2030 年的人口预测值数据

    GHSL: Global population surfaces 1975-2030 (P2023A) 简介 该栅格数据集描述了居住人口的空间分布,以单元居民的绝对数量表示。 1975 年至 2020 年的居住人口估计值以 5 年为间隔,2025 年和 2030 年的人口预测值则来自 CIESIN GPWv4.11,这些人口预测值从普查或行政单位分解到网格单元,并参考了 GHSL GHS_POP/2020'); var populationCountVis = { min: 0.0, max: 100.0, palette: ['000004', '320A5A

    55210编辑于 2025-01-21
  • 来自专栏腾讯文旅

    数字周报78期丨黑龙江文旅首个数字虚拟主“爽爽虎”精彩亮相,腾讯助力支持

    1、黑龙江文旅首个数字虚拟主“爽爽虎”精彩亮相,腾讯助力支持 7月29日,黑龙江文旅首个数字虚拟主 " 爽爽虎 " 精彩亮相。 " 爽爽虎 " 数字虚拟主的诞生,是黑龙江文旅界首个虚拟形象,黑龙江省文化和旅游厅向全球游客发出龙江的邀约,开启文旅界在 " 数字经济 + 创意设计产业 " 领域进行创新尝试。 5、“数”说未来!腾讯携最新科技共赴全球数字经济大会 7月28日至30日,2022全球数字经济大会在北京举办。 这也是迄今为止全国第一个启动创建世界级旅游景区的国家5A级旅游景区。 据介绍,两博览会计划展出面积5万平方米,展位预计2000个,将推出区域文旅形象展区、“一带一路”国际文旅交流展区、“海峡两岸”文旅交流展区、“清新福建”文旅形象展区、休闲度假展区、研学旅行展区、影视潮玩展区

    1.5K10编辑于 2022-08-26
  • 做跨境短视频批量出素材实操记录,聊聊 Vera1.1 落地全流程与团队协作要点

    一、Vera1.1核心能力与跨境业务适配点Vera1.1为面向视频生成的多模态模型,适配商品展示、场景演绎、数字人口三类跨境主流短视频。 面向跨境短视频的关键能力适配:能力模块跨境业务场景实际落地表现约束边界图文转视频商品主图、详情页素材快速成片输入商品详情图+文案,输出9:16竖版短视频复杂商品形变会出现失真,需前置参考图约束角色特征锁定买家秀、数字人口类素材固定人物面部 LoRA,提升素材匹配度训练数据集≥120条高质量样本,效果才稳定二、生产参数配置实战(核心技术维度)参数直接决定批量素材的基线质量,批量生产不使用随机参数,项目沉淀标准化参数模板,区分商品展示、买家秀、数字人口三套配置 2.1关键生产参数对照表参数项商品展示视频虚拟买家秀数字人口视频备注分辨率1080×1920(9:16)1080×1920(9:16)1080×1920(9:16)适配海外短视频平台标准竖屏规格单条时长 摆放位置、人物外貌服饰业务场景单元:使用场景、地域环境、海外家庭环境风格约束单元:电商写实、无过度滤镜、商业实拍质感负面约束单元:手部畸形、画面闪烁、文字乱码、物体扭曲三、完整批量生产工作流整体流程分为5个环节

    18310编辑于 2026-08-13
  • 来自专栏腾讯云智能·AI公有云

    再登央视!鹅厂数智人亮相「焦点访谈」

    其中,虚拟数字人是重要的应用方向。 近年来,随着数字经济的迅猛发展,各类数字虚拟主数字讲解员、数字人智能客服纷纷涌现。现在,在大模型技术的加持下,数字人产品也迎来了智能化的飞跃。 其中,全新发布“通用口型版”小样本数智人,只需要1分钟真人口视频,平台便可通过多模态数据输入,无需训练生成个性化口型,在1小时内制作出与真人近似的“数智人”。 又例如,为了更贴近真实的主播报,除了静态的站姿、坐姿外,数智人主还可以效仿真人主,在大屏幕内进行走动播报、侧身播报等,展现更丰富的肢体语言。 腾讯云副总裁王麒表示,“2023年4月腾讯云推出数智人生产工厂,只需要一分钟真人口视频就可以轻松实现数智人的自助式生产。 | 腾讯云AI绘画全新发布:25+风格,5秒生成 | 首批通过备案!腾讯混元大模型将陆续对公众开放 | 8小时保姆级教程|鹅厂重磅图像生成训练营带你玩转AI绘画 | 现身央视奇妙夜!

    76710编辑于 2024-01-30
  • AI数字人直播系统搭建如何实现数字人、内容与直播间一体化?

    随着人工智能、数字人和直播技术不断发展,传统依赖真人主的直播模式正在向更加智能化、自动化的方向演进。 A:女主播数字人B:男主数字人C:品牌客服数字人D:商品讲解员不同数字人可以绑定不同的声音、形象以及直播风格。 这样在创建直播间时,只需要选择对应数字人,就能够快速完成主配置。三、通过AI生成直播内容传统直播需要主提前准备大量话术,而AI数字人直播系统可以将商品信息、活动信息和直播主题交给AI进行内容生成。 这样就能够实现:AI生成内容 → AI语音 → 数字人口型 → 直播输出六、让数字人能够理解直播间互动仅仅让数字人自动讲话,还不能称为真正意义上的智能直播。系统还需要接收直播间中的互动信息。 十一、最终形成完整的数据流当上述功能全部连接起来之后,AI数字人直播系统可以形成完整的数据链路:商品中心 ↓内容中心 ↓AI内容生成 ↓直播脚本 ↓数字人 ↓TTS语音 ↓数字人口

    18610编辑于 2026-08-19
  • 我用WorkBuddy搓了个AI视频生成工具,5分钟出一条爆款短视频

    第三步:选个模式,一键出片三种模式,看你有啥素材选啥:素材视频模式——手头有图片视频素材的,你传素材,AI帮你排顺序加混剪智能配图模式——啥素材都没有的,AI根据脚本内容自动找图找视频配数字人口——不想出镜的 ,数字人当主画面,素材穿插着用不会剪映? 坑三:生成速度如果每一步都串行跑,5分钟根本搞不定。 配图位置1】步骤1界面:上传爆款视频,提取脚本【配图位置2】步骤2界面:编辑/粘贴脚本,违规检测【配图位置3】步骤3界面:上传素材,选择模式,一键生成【配图位置4】三种模式选择界面:素材视频/智能配图/数字人口界面是暗色主题加橙色强调色 生成前预检——一键检查配置有没有漏的,避免白跑一趟生成失败八、接下来要做的工具还在迭代,下一步重点搞这几个:-视频生成质量提升(现在半成品,画面过渡还比较生硬)-接入更多国产大模型,脚本质量再提一档-数字人口的口型同步优化我也报名了全民

    3.4K10编辑于 2026-07-03
  • 腾讯云智能数智人最新版本更新内容和特点

    腾讯云数智人(数智分身)是一种高度拟人化的虚拟数字形象,通过动作捕捉、三维建模、语音合成等技术实现,能够高度还原真实人类的形象和表情动作,并具备表达情感和沟通交流的能力。 例如,只需要3分钟的真人口视频和100句语音素材,就可以在一天内定制专属数智人分身。而最新版本更是推出了“通用口型版”小样本数智人,只需1分钟真人口视频,即可在1小时内制作出与真人近似的数智人。 广泛的应用场景:腾讯云数智人适用于新闻播报、电视导播、口视频生产、客服、景区导览、品牌营销等多种场景。 在新闻播报和电视导播中,数智人可以化身为虚拟主数字记者;在口视频生产中,医生、律师、讲师等专业人士可以通过数字分身提升视频生产效率;在客服场景中,数智人可以化身虚拟客服,提供及时答复和亲和自然的客服体验

    1.2K10编辑于 2024-10-21
  • 来自专栏星哥的AI自留地

    开源数字人推荐:如何挑选最适合你的那款?

    项目在短视频、虚拟主、教育讲解等场景中表现出色,尤其适合对口型同步要求极高的应用。LatentSync的模型推理速度快、效果稳定,开源后受到大量开发者关注,是当前数字人口型驱动领域的标杆级项目。 地址:https://github.com/bytedance/LatentSyncSTAR数:5.4k+定位:高同步性数字人口型驱动亮点:字节跳动开源,技术成熟度高主打“音频驱动→高精度口型同步”适合短视频 ,延迟极低适合直播、互动场景适用场景:虚拟主、实时互动数字5.HunyuanVideo(腾讯开源)HunyuanVideo是腾讯混元大模型体系中的视频生成模型,支持文生视频、图生视频、动作生成等多种能力 ,适合非技术用户适用场景:企业/个人快速搭建数字人系统7.AI-Vtuber(虚拟主系统)LunaAI是一款结合了最先进技术的虚拟AI主。 一站式数字人系统AIGCPanel移动端数字人Duix-Mobile多模态虚拟主AI-Vtuber

    1.1K12编辑于 2026-06-10
  • 来自专栏运维之路

    数字化转型杂谈5数字化转型3个主线

    数字化转型可以围绕三条主线展开:聚焦组织外部的客户服务、产品或商业模式创新的数字化业务,聚焦组织内部组织与运营管理的数字化管理,聚焦技术赋能的数字化技术。 数字化业务:数字化业务的重点解决速度问题,即将业务与数字技术进行融合,持续提升客户体验、业务创新效率、业务运营效能,以更快的适应市场,所以“数字化”应该关注赋能,赋能业务增长,或局部收益,或颠覆性的创新商业模式 数字化管理:数字化管理的重点是企业各职能团队从组织、文化、流程、协同、工具等综合性的建设,整合形成战斗力,达到高效协同,以支撑并推动数字化业务的落地。 数字化技术:数字化管理与数字化业务的落地需要一个敏捷高效的技术架构与科学有效的IT风险管控体系支撑。 企业数字化转型的三个主线的思路其实也适合于领域数字化分解思路,比如运维的数字化主线:场景(保障、运营)、组织+流程、平台。

    1.5K21发布于 2021-11-02
领券