首页
学习
活动
专区
圈层
工具
发布
    • 综合排序
    • 最热优先
    • 最新优先
    时间不限
  • 来自专栏bunny的专栏

    【玩转Lighthouse】轻松搭建视频配音工具晓晓配音

    今天我们将给大家介绍如何使用Lighthouse轻量服务器搭建一个属于自己的在线视频配音工具,可以将文案制作为mp3文件并且生成对应的字幕视频,以便大家在制作视频的过程中方便地为自己的视频添加自然逼真的配音 推荐同学们买一台作为学习使用,用来部署晓晓配音完全绰绰有余 image.png 购买完成后我们可以在控制台重置其系统为Ubunut+Docker专版,由于此系统自带了Docker环境,我们上手就能立刻开始部署 我们需要在防火墙放行对应的端口,推荐一次性开一个范围的端口,这样我们在部署服务的时候就可以不用每次都到控制台编辑规则了 20220414190405.png 登录我们的轻量服务器,然后在任意目录克隆晓晓配音的源代码 ,因此晓晓配音的链接有效期并不长,生成的mp4和mp3文件都是定时过期的 mkdir /tts_storage 然后,我们可以使用-v 参数将此目录作为缓存挂载到容器内部,同时使用-e 传递可用的端口号给容器服务使用 然后使用docker logs查看容器服务是否正常开启 docker logs ms_tts 当看到服务顺利监听到8019端口后,部署就完成了 run.png 最后我们就可以通过ip端口的方式访问晓晓配音服务了

    2K100编辑于 2022-04-14
  • 来自专栏软件安装

    10个GitHub热门的配音语音合成语音克隆项目

    这里推荐几个GitHub上热门、好用的配音/语音合成/语音克隆项目,有通用TTS、语音克隆、视频配音、流式/轻量等不同需求的。 ▌1. EmotiVoice(网易有道,⭐ 8k+) 地址:https://github.com/netease-youdao/EmotiVoice 功能: 情感可控:支持喜/怒/哀/乐等多种情感 多音色、多语言,中文自然度优秀 YouDub(⭐ 1.2k+) 地址:https://github.com/liuzhao1225/YouDub 功能: 自动:YouTube视频 → 语音识别 → 翻译 → 克隆原UP主音色 → 中文配音 Fish Speech(⭐ 10k+) 地址:https://github.com/fishaudio/fish-speech 功能: 基于VITS2,高质量、多语言、语音克隆 推理快、支持批量处理、全开源 ▌10.

    6.2K10编辑于 2026-03-26
  • 来自专栏专知

    谷歌上线机器学习速成课程:中文配音+中文字幕+完全免费!

    值得一提的是,该课程有专门的中文版网址,其中机器翻译和中文字幕不要太溜! 如果您是机器学习爱好者或想要从事机器学习工作,这是一个不可多得的自学福利! ? ▌MLCC中文版课程 ---- ---- 令人震惊的是,点击MLCC课程,进去竟然基本上是中文讲课。 据Google称,“此视频讲座的配音是使用机器学习技术生成的。” ,这点我们也可以听出课程的中文配音有明显的机器口音,但是其吐字是非常清晰的,配合中文字幕,对于我们来说听讲毫无压力,不得不说是对我们学习机器学习是一个巨大的福音(有个别机器翻译可能有错,在学习的时候还需要稍加注意 下面我们从课程《机器学习简介》来体验一下其机器翻译和语音合成技术的成果:(视频贴上来,链接如下) https://v.qq.com/x/page/g0562fdcy50.html MLCC中文版链接:

    2.7K90发布于 2018-04-16
  • Edge TTS 语音合成助手 v1.4.0:把普通配音、逐页配音、逐行配音一次做好

    三种模式,按你的工作方式生成普通模式适合最简单的全文配音。把文章、脚本或旁白粘贴到左侧输入框,点击生成即可得到一个完整音频,不要求分页,也不会因为普通换行就强制拆成多个文件。 Edge TTS 语音合成助手支持丰富的 Edge TTS 音色,提供中文和 English 界面,不需要填写 API Key。 它适合视频旁白、影视解说、短视频脚本、播客文稿、课程配音、语言学习和批量音频素材制作。 如果你正在寻找“TXT 每行生成一个 MP3”“逐页生成配音”“句间停顿加 SRT 字幕”的 Windows 工具,欢迎试试 v1.4.0。 #EdgeTTS #语音合成 #AI配音 #视频旁白 #批量配音 #SRT字幕 #开源软件 #Windows工具 #Python项目

    16800编辑于 2026-09-19
  • 2026年10款配音工具横向评测:参数、成本、适用场景全公开

    基于2026年5月300小时实测,从免费额度、音色数量、多角色能力、技术门槛等维度,客观对比10款主流配音工具。不吹不黑,只列数据,供你按需选择。 做视频、做课件、做有声内容,选对配音工具能省下不少时间。下面把10款工具的核心参数和适用场景列出来,不含主观推荐,只作参考。 .OpenAITTS平台:云API(需编程)免费额度:无定价:0.10元/千字技术指标:代码简单,国内需代理,中文音色较少多角色能力:不支持技术门槛:低(需代理)典型用途:海外项目、快速原型验证二、按使用场景参考影视解说 (月产>10万字)可关注:火山引擎TTS、AzureTTS、ElevenLabs(高成本)、OpenAITTS(海外)注意事项:需编程,按量付费三、成本参考(月生成10万中文字)叮叮配音:0元配朵朵(免费层 是:可先试用媒小三配音免费验证效果预估月产量?10万字以内:轻量工具免费额度通常足够10万字以上:建议云API按量计费,国内项目优先试用国内云服务是否涉及多语言跨境电商?

    2.3K10编辑于 2026-05-09
  • 试试AI批量配音,效率提升10倍不是梦

    前段时间帮朋友整理一批有声书内容时,我重新跑了一遍现在常见的AI配音流程。最大的感受就是:现在做有声书,最耗时间的已经不是“录音”。而是:文本整理角色区分长音频生成停顿调整字幕与时间轴尤其长篇内容。 不过真正开始做长文本后,也会发现:有声书和普通短视频配音,完全不是一个难度。一、长文本配音,最容易翻车的其实是“节奏”刚开始做长内容时,我以为只要音色自然就够了。 例如:剪映AI配音魔音工坊讯飞配音配朵朵叮叮配音媒小三配音不同方案在:男声稳定性情绪推进长文本节奏多角色切换上的差异会比较明显。尤其有些旁白刚开始很惊艳,但连续听半小时后会明显疲劳。 四、多角色配音,现在开始越来越实用以前AI有声书最大的问题之一,就是:所有角色一个语气。 尤其像:配朵朵媒小三配音这种偏多角色场景的方案,会更适合做前期节奏验证。否则后期返工会非常耗时间。五、真正影响效率的,其实是“工作流”最近重新整理这些流程后,一个感觉越来越明显。

    32810编辑于 2026-05-11
  • 来自专栏全栈开发日记

    自动批量真人配音软件

    工具名称:自动批量配音软件 运行系统:Windows 工具大小:6.5MB 工具截图: 使用方法: 需要设置阿里参数或腾讯参数,点击相应参数后的【获取】,可自动跳转到相应的获取页面(免费)。

    2.1K20编辑于 2022-05-13
  • 来自专栏Python研究者

    10个中文成语,10种Python新手错误

    Python语言与大多数编程语言不相同,它的语句后面不需要加分号结尾。有些 Python 新手具有编写其它语言的丰富经验,一时还适应不过来,经常习惯性的加上“分号”:

    49320编辑于 2022-10-27
  • AI配音神器、免费的文本转语音和声音克隆,一款多功能的配音工具

    免费在线AI配音工具;XECYV配音可以文字转语音、声音克隆等,支持多种语言和语音风格,更能情感控制,高自然度语音合成,接近真人音色,适用于播客、营销、创作等各种场景。 工具地址:https://xecyv.com/dubbing音色库:覆盖全场景XECYV配音提供多种音色。既有适合短视频搞笑的活泼声音,也有播音新闻腔和广告宣传音色。声音很难分辨是真人还是AI。 情绪模拟:AI配音更像真人很多文本转语音工具只能平淡朗读,XECYV配音支持怀旧、欢快、激情、恐惧、惊讶、抒情、伤心等多种情绪。 例如,为一段恐怖故事配音时,选择“恐惧”模式后,语速、音调、气息都明显变。自动识别多音字、整数、小数、电话号码、日期、金额等,并按照正确方式朗读。 多人角色配音:有声小说神器输入一段包含多个人物的对话,XECYV配音可以为不同角色分配不同音色,生成类似广播剧的效果。这一功能对有声读物创作者来说是很实用的。

    11810编辑于 2026-09-17
  • 来自专栏用户8224071的专栏

    win10系统Xbox设置中文的方法

    win10Xbox是win10系统自带的游戏平台,很很多用户都很喜欢用它来玩游戏,很多用户刚安装他的时候页面都是英文版的,那么win10系统Xbox怎么设置中文呢,就此问题,下面就一起来看看win10系统 Xbox设置中文的方法。 win10系统Xbox设置中文的方法: 1、打开“xbox”页面都是英文状态 2、点击“开始”选择“设置” 3、点击“时间和语言” 4、点击左侧任务栏的“区域和语言” 5、此时系统默认的是英文 6、点击上面的箭头 7、将下面的中文并设着为首选 8、重新打开xbox即可完成设置 转:win10系统 win10系统Xbox设置中文的方法(xtzjcz.com)

    7.5K20发布于 2021-03-26
  • 2026年TTS配音软件技术选型:从云端API到轻量级效率工具

    一、云API方案(适合自动化集成)1.火山引擎TTS——国内开发者综合首选火山引擎TTS是字节跳动的语音服务,在国内接入的稳定性和中文自然度上表现优异。 指标实测数据首包延迟300–400ms(流式合成)音质评分9/10定价1.3元/千字,量大可谈折扣免费层新用户有试用额度,无固定免费层支持语种中文、英文、中英混读SSML支持SDKPython/Java +App+小程序价格模式每日免费试用+会员制音色数量1300+种,含20种情绪表达声音克隆支持(5-10秒录音克隆,阿里达摩院技术合作)会员包含功能克隆+配音+AI写作+文案提取+爆文标题+脚本模板典型用途个人 ,功能集成人工零成本应急叮叮配音完全免费,不限量人工声音克隆媒小三配音10秒克隆,会员全包数据私有+有GPULongCat-AudioDiT开源自部署五、成本参考(月生成10万中文字)工具月成本估算备注叮叮配音 约10元0.10元/千字×100千字(需代理)ElevenLabs约207元2.1元/千字×(100-10)千字,需代理注:Azure和OpenAI的“千字”指千字符,1个中文字符=1字符。

    1.8K10编辑于 2026-04-30
  • 我们把 Kokoro 1.1 量化到 FP16,并用它替换了浏览器里的中文 Piper 配音

    在最新发布的TimelineStudiov1.0.0中,我们完成了一次重要的中文AI配音升级:中文配音从Piper/VITSONNX切换到Kokoromulti-langv1.1,并将模型转换为适合浏览器运行的 项目早期使用Piper/VITSONNX实现中文配音。Piper模型结构相对紧凑,适合浏览器部署,也帮助我们较早跑通了从文字生成语音、将配音放入时间线、关联字幕并最终导出视频的完整流程。 但随着使用场景从功能验证走向真实视频创作,旧的中文配音路径逐渐暴露出一些不足。首先是自然度。 因此,我们没有继续修补原有的中文Piper路径,而是将中文及中英混合配音整体迁移到了Kokoromulti-langv1.1。 从产品角度看,这次升级解决了四个核心问题:中文配音更加自然;中文音色从两条增加到四条;支持不中断语气的中英文混合生成;更高质量的模型仍然能够在浏览器本地运行。

    22010编辑于 2026-08-08
  • 2026年配音软件技术选型:从腾讯云TTS到三款轻量效率工具

    它在国内接入的稳定性和中文自然度上表现优异,且与腾讯云生态无缝集成。 2.1腾讯云TTS核心参数指标实测数据首包延迟300–400ms(流式合成)音质评分9/10(神经拟人模型)定价按量计费,低至1.2元/千字(实际以官网为准)免费层新用户有试用额度(具体请参考官方活动) (冷笑、哽咽、怒吼、撒娇等)多角色能力自动识别剧本角色对话并分配不同声线声音克隆支持(5-10秒录音克隆,阿里达摩院技术)生成速度约1分钟/次在开发中的应用:验证多角色配音的角色-声线映射方案,确定最佳组合后迁移到 五、成本参考(月生成10万中文字)方案月成本备注叮叮配音0元完全免费配朵朵(免费层)0元每日免费时长覆盖媒小三配音(试用)0元免费试用含全部功能腾讯云TTS约120-150元具体以官网定价为准AzureTTS 腾讯云TTS凭借稳定的国内接入、优秀的中文自然度和丰富的SDK,是开发者实现配音自动化的可靠选择。欢迎在评论区交流你的TTS集成经验。

    69610编辑于 2026-05-06
  • 2026年配音工具技术选型:从轻量人工到腾讯云TTS的全栈方案

    短剧多角色与声音克隆验证器平台:网页+App+小程序免费额度:每日免费试用(可体验全部功能)音色数量:1300+种,含20种情绪标签(冷笑、哽咽、怒吼等)多角色能力:自动识别剧中角色并分配不同声线声音克隆:支持(5-10 、云API层:腾讯云TTS集成实践当项目进入规模化生产阶段(月产超过10万中文字或需要实时交互),推荐使用腾讯云语音合成服务。 它在国内接入稳定、中文自然度高,与腾讯云生态无缝集成。 2.1核心参数指标实测数据首包延迟300–400ms(流式合成)中文自然度9/10(神经拟人模型)定价新用户试用,按量计费低至1.2元/千字SSML支持实时场景WebSocket流式合成SDKPython 四、成本参考(月产10万中文字)方案月成本备注叮叮配音0元完全免费配朵朵(免费层)0元每日免费时长覆盖媒小三配音(试用)0元免费试用含全部功能腾讯云TTS约120元按量计费AzureTTS(免费层内)0

    65810编辑于 2026-05-06
  • 来自专栏信数据得永生

    Pandas 学习手册中文第二版:6~10

    以下屏幕截图演示了将代表0和100之间的5随机数的值的序列切入 10 个类别箱,每个箱子宽 10 个整数: [外链图片转存失败,源站可能有防盗链机制,建议将图片保存下来直接上传(img-4BgyX0rA 此代码选择 10% 的行。 learning-pandas-2e/img/00449.jpeg)] 每年的实际最小值可以使用.min(axis=0)检索: [外链图片转存失败,源站可能有防盗链机制,建议将图片保存下来直接上传(img-Vh10NkuW learning-pandas-2e/img/00472.jpeg)] 但是,当使用传统的数学运算符时,NaN将传播到结果: [外链图片转存失败,源站可能有防盗链机制,建议将图片保存下来直接上传(img-rWAdDC10 NaN值的标签为1,是 的 的十分之一,因此插值将为0 + (100 - 0) / 10或10。 处理重复数据 样本中的数据通常可以包含重复的行。

    3.5K20编辑于 2023-04-23
  • 在浏览器里跑中文 AI 配音:我们如何用 Hojo TTS 80M 实现更自然的中英双语语音生成

    过去一段时间,我们一直在为TimelineStudio寻找更适合浏览器运行的中文配音模型。 经过多轮模型测试,我们最终将中文配音切换到了HojoTTSLight80M,并完成了WebGPU、WASM、模型切片、长文本分句和双镜像下载等工程适配。 它的优势是部署简单、运行稳定,但在实际配音中仍存在一些明显问题:中文语气相对平直;中英文切换时容易出现突兀的停顿;长句的节奏和气息不够自然;笑声、语气词和句尾释放感偏机械;为了支持多个角色,需要携带较多声线资源 例如:展开代码语言:TXTAI代码解释今天我们发布了新的浏览器配音能力。它不需要上传素材,也不依赖远程推理。中文和英文可以在同一个工作流中完成。 当前成果完成这次升级后,TimelineStudio的中文配音流程已经具备:HojoTTSLight80MFP16浏览器推理;两位经过授权的中文参考声线;中文和中英混合语音生成;WebGPU与WASM混合执行

    19710编辑于 2026-08-13
  • 零基础用 WorkBuddy 制作5集仙侠短剧

    涵盖 AI 场景绘图、视频生成、edge-tts 中文配音、字幕叠加、ffmpeg 后期合成等环节,包含可复用的 Python 框架代码和踩坑经验。一、项目概述什么是 WorkBuddy? setpts=PTS/speed_factor 会将视频放慢— — — — — — — — — — — — — — — — — — — — — — — — — — — — — — 五、阶段三:edge-tts 中文配音为什么选 edge-tts 是微软 Edge 浏览器的 TTS 引擎,免费、中文质量高、支持多角色声音。 ] - bbox[1]    x = (width - tw) // 2    y = height - th - 80    # 半透明背景条    draw.rectangle([x-20, y-10 2. ffmpeg concat demuxer 不支持中文路径问题:concat demuxer 的文件列表中包含中文路径时失败。

    87520编辑于 2026-08-02
  • 来自专栏charlieroro

    Operating.System.Concepts.10th.Edition中文翻译

    《操作系统概念》是一本很好的书,主要介绍了操作系统的各个层面的概念,包含CPU调度,内存处理,文件系统等,目前已经出到第10版,是一本非常经典的书籍,从第1版至今被国内外众多高校选作教材,非常具有权威性 PS本来想买一本实体书看看的,无奈没有第十版的中文版,当然也担心中文翻译的质量,而英文原版的价格也非常感人,因此萌生了边看边翻译的想法,有兴趣的可以一起参加进来! github地址:https://github.com/woodliu/Operating.System.Concepts.10th.Edition

    6K00发布于 2020-03-27
  • 亲测3款热门AI视频工具|Grok、剪映数字人、即梦AI,新手也能轻松出片

    还能结合人物特色,增加局部细节 效率超高:10-15秒就能生成6-7秒短视频,赶工不等待。 ❌ 明显短板: 配音难:人声处理生硬,新手难配出贴合视频的声音,主观性强。 ✅ 核心亮点: 配音零门槛:输入文字自动配音,音色种类多,选择范围广 灵活可调:配音快慢、音量可调节,还能添加音效、降噪,提升质感。 无缝剪辑:配音后可直接在剪映编辑画面,一站式完成创作。 (说明:剪映数字人的视频每次如果更改,哪怕文案可能仅多一个字,都要重新生成,会扣相应积分,因此使用时还是要注意文案内容,避免同一个视频浪费积分较多) 第三款:即梦AI|全能创作平台,中文友好型选手 也是字节跳动旗下的 ✅ 核心亮点: 中文适配极佳:输入中文提示词精准出效果,贴合国内创作者习惯。 人物还原度高:支持原生4K(暂供2K直出),细节逼真、动效流畅。 最后总结|3款工具精准匹配指南 ✅ 免费快速出漫画短视频 → Grok ✅ 便捷配音做口播 → 剪映数字人 ✅ 高质量中文创意视频 → 即梦AI 没有完美的AI工具,只有最适合自己的!

    1.3K10编辑于 2026-07-13
  • 来自专栏音视频技术

    奇声(IQDubbing)-- 面向影视剧的AI配音技术

    经过调研,近五年国内从海外引进2000+电影,其中非常少部分在电影院见到的才有中文配音。 第三个问题:配音员难找,影视剧的配音来说难度远远高于广播剧,要求有更好的配音能力,对影视剧有更高的理解、表现力,资源少,中文配音员还能找到,但出海时小语种配音员非常难。 3.4.2 第二代框架 基于第一代基础上加入韵律模型,提高表现力,运用VQ-Wav2Vec训练模型,另外替换原有ASR,使用E2E的方式,时间分辨率从30ms提升到10ms。 4、IQDubbing上线效果 4.1 上线效果 目前爱奇艺配音已经在中文主站和海外站(泰国站、越南站等)上线,中文主站包括007系列大战皇家赌场,终结者和007黑日危机等都是当家热剧。 累计3篇语音类顶级国际会议论文,包括ISCSLP、InterSpeech,有10多个国家发明专利,获得5个软件著作权,多家主流媒体的报道,近期获得中国多媒体企业创新产品奖,受到业界蛮多的关注。

    3.4K20编辑于 2023-04-04
领券