首页
学习
活动
专区
圈层
工具
发布
    • 综合排序
    • 最热优先
    • 最新优先
    时间不限
  • 来自专栏bunny的专栏

    【玩转Lighthouse】轻松搭建视频配音工具晓晓配音

    今天我们将给大家介绍如何使用Lighthouse轻量服务器搭建一个属于自己的在线视频配音工具,可以将文案制作为mp3文件并且生成对应的字幕视频,以便大家在制作视频的过程中方便地为自己的视频添加自然逼真的配音 推荐同学们买一台作为学习使用,用来部署晓晓配音完全绰绰有余 image.png 购买完成后我们可以在控制台重置其系统为Ubunut+Docker专版,由于此系统自带了Docker环境,我们上手就能立刻开始部署 我们需要在防火墙放行对应的端口,推荐一次性开一个范围的端口,这样我们在部署服务的时候就可以不用每次都到控制台编辑规则了 20220414190405.png 登录我们的轻量服务器,然后在任意目录克隆晓晓配音的源代码 ,因此晓晓配音的链接有效期并不长,生成的mp4和mp3文件都是定时过期的 mkdir /tts_storage 然后,我们可以使用-v 参数将此目录作为缓存挂载到容器内部,同时使用-e 传递可用的端口号给容器服务使用 然后使用docker logs查看容器服务是否正常开启 docker logs ms_tts 当看到服务顺利监听到8019端口后,部署就完成了 run.png 最后我们就可以通过ip端口的方式访问晓晓配音服务了

    2K100编辑于 2022-04-14
  • 来自专栏专知

    谷歌上线机器学习速成课程:中文配音+中文字幕+完全免费!

    值得一提的是,该课程有专门的中文版网址,其中机器翻译和中文字幕不要太溜! 如果您是机器学习爱好者或想要从事机器学习工作,这是一个不可多得的自学福利! ? ▌MLCC中文版课程 ---- ---- 令人震惊的是,点击MLCC课程,进去竟然基本上是中文讲课。 据Google称,“此视频讲座的配音是使用机器学习技术生成的。” ,这点我们也可以听出课程的中文配音有明显的机器口音,但是其吐字是非常清晰的,配合中文字幕,对于我们来说听讲毫无压力,不得不说是对我们学习机器学习是一个巨大的福音(有个别机器翻译可能有错,在学习的时候还需要稍加注意 机器学习工程 生产环境机器学习系统(3分钟) 静态训练与动态训练(7分钟) 静态推理与动态推理(7分钟) 数据依赖关系(14分钟) 机器学习现实世界应用示例 癌症预测(5分钟 ) 18世纪文学(5分钟) 现实世界应用准则(2分钟) 总结 后续步骤 参考链接: Learn with Google AI https://ai.google/education/#?

    2.7K90发布于 2018-04-16
  • Edge TTS 语音合成助手 v1.4.0:把普通配音、逐页配音、逐行配音一次做好

    三种模式,按你的工作方式生成普通模式适合最简单的全文配音。把文章、脚本或旁白粘贴到左侧输入框,点击生成即可得到一个完整音频,不要求分页,也不会因为普通换行就强制拆成多个文件。 Edge TTS 语音合成助手支持丰富的 Edge TTS 音色,提供中文和 English 界面,不需要填写 API Key。 它适合视频旁白、影视解说、短视频脚本、播客文稿、课程配音、语言学习和批量音频素材制作。 如果你正在寻找“TXT 每行生成一个 MP3”“逐页生成配音”“句间停顿加 SRT 字幕”的 Windows 工具,欢迎试试 v1.4.0。 #EdgeTTS #语音合成 #AI配音 #视频旁白 #批量配音 #SRT字幕 #开源软件 #Windows工具 #Python项目

    16800编辑于 2026-09-19
  • 来自专栏星哥的AI自留地

    5分钟搞定视频翻译配音!开源极简工具KrillinAI

    5分钟搞定视频翻译配音! 不用复杂的技术配置,不用懂高深的AI原理,甚至不需要你有专业的视频剪辑基础,它能一站式完成「视频原声音频提取→AI翻译→目标语言配音→音频与视频合成」全流程,支持上百种语言的翻译与配音,覆盖主流语种(中英日韩法德等 ,配音自然流畅,无机械感配音生硬,语调呆板,缺乏情感适配格式兼容支持MP4、MOV、AVI等主流视频格式,导出多规格格式限制多,仅支持少数视频格式免费属性开源免费,基础功能无付费门槛基础功能免费,高级功能高额收费简单说 我以「中文视频翻译成英文并配音」为例,给大家一步步演示,全程5分钟就能搞定,跟着做就行。 不用花大价钱买付费工具,也不用花时间学习复杂的剪辑和翻译技巧,5分钟就能搞定多语言视频翻译配音,对个人创作者和小型团队来说,绝对是值得收藏的实用工具。

    51910编辑于 2026-06-26
  • AI 情感配音与声纹克隆:5 秒样本如何复刻演员音色?

    摘要 从拼接合成到VITS再到大模型情感TTS,AI配音已能5秒样本克隆音色并带哭腔朗读10分钟。 如需高情感克隆配音(9 元/分钟)+ 压制字幕(0.063 元/分钟):总配音成本约为 200 × 9.063 = 1812.6 元。 九、与 MAIS 其他能力的组合 大模型视频理解(1.5 元/分钟)+ AI 配音:视频转播客、课程配旁白; ASR(0.03 元/分钟)+ 大模型翻译(0.2 元/分钟)+ AI 配音:中文视频 → A:MAIS 在训练阶段包含多语种数据,中文样本可用于生成英文 / 日文 / 西班牙文等,支持跨语种配音工作流。附加语种按 0.05 元/分钟计费。 Q:和网上开源工具相比优势在哪? MAIS 有大规模商业语料支撑、中文专用优化、及对接字幕/视频流水线的工程链路。 十一、立即体验 产品入口:腾讯云媒体 AI(MAIS) 从 VITS 到情感大模型,5 秒克隆早已不是科幻。

    59010编辑于 2026-06-01
  • 来自专栏猿说编程

    5.python中文编码

    唯一区别就是如果代码或者注释中含有中文,ASCLL编码会出现乱码,UTF-8却可以正常显示中文,即python2.x版本中文显示不正常,python3.x版本正常。 如果其他环境不是UTF-8,一旦有中文,必然乱码。 其他代码都是注释的无用代码,可以忽略不计! unicode , gbk , gb18030……… 猜你喜欢: 1.pycharm/python /anaconda区别和联系 2.pycharm设置头文件模板 转载请注明:猿说Python » python中文编码

    1.6K20发布于 2020-03-12
  • 来自专栏猿说编程

    5.python中文编码

    唯一区别就是如果代码或者注释中含有中文,ASCLL编码会出现乱码,UTF-8却可以正常显示中文,即python2.x版本中文显示不正常,python3.x版本正常。 如果其他环境不是UTF-8,一旦有中文,必然乱码。 其他代码都是注释的无用代码,可以忽略不计! 猜你喜欢: 1.pycharm/python /anaconda区别和联系 2.pycharm设置头文件模板 转载请注明:猿说Python » python中文编码

    1.1K10发布于 2020-01-13
  • 来自专栏WTSolutions

    OpenAI Agents SDK 中文文档 中文教程 (5)

    设置用于 LLM 请求的默认 OpenAI API 密钥(以及可选的 tracing())。这是 仅当尚未设置 OPENAI_API_KEY 环境变量时才需要。

    1.4K00编辑于 2025-03-15
  • 来自专栏全栈开发日记

    自动批量真人配音软件

    工具名称:自动批量配音软件 运行系统:Windows 工具大小:6.5MB 工具截图: 使用方法: 需要设置阿里参数或腾讯参数,点击相应参数后的【获取】,可自动跳转到相应的获取页面(免费)。

    2.1K20编辑于 2022-05-13
  • 来自专栏数据分析1480

    Pandas中文官档~基础用法5

    s.dt.days Out[286]: 0 1 1 1 2 1 3 1 dtype: int64 In [287]: s.dt.seconds Out[287]: 0 5 , 1, 1], .....: 'two': [1, 3, 2, 4], .....: 'three': [5, 2]}) .....: In [299]: df1.sort_values(by='two') Out[299]: one two three 0 2 1 5 5 6 9 7 6 8 8 9 4 dtype: int64 In [318]: s.sort_values() Out[318]: 1 0 4 1 0 2 2 3 9 4 5 5 7 6 3 7 8 8 6 9 dtype: int64 In [319]: s.nsmallest(3) Out[319]: 1

    1.3K10发布于 2019-11-15
  • 来自专栏凯哥Java

    xftp5 中文破解版

    xftp5安装破解教程 1、在本站下载加压好安装包后,双击里面的“Xftp5.exe”,开始安装软件,点击“下一步”。 ? 2、安装类型选择“免费为家庭/学校”。 ? 5、软件实际上有两种语言可,英文和中文,你可根据你自己的需求进行选择,默认为中文,点击“安装”。 ? 6、xftp5安装完成。 ? 为了满足企业用户的需求,Xftp 5包括对MIT Kerberos认证的支持 4、保持xftp5破解版最新(新) 在当今快节奏和不断变化的IT行业中,运行最稳定,最安全的软件是必须的。 保持最新,现在比以往任何时候都更快更容易 5、同步 Xftp 5中的同步功能支持在远程和本地文件夹之间同步文件和文件夹。 xftp5使用教程 1、首先运行xftp5破解版,新建->Xftp会话(F)。 ? 2、填写名称、主机(需要连接的服务器IP地址),协议选择SFTP、端口默认22即可。 ?

    20.7K91发布于 2019-06-28
  • 来自专栏Java架构师必看

    Linux中文件MD5校验

    md5sum命令用于生成文件的md5数字摘要,并可以验证文件内容是否发生了改变,间接地还可以检验两个文件内容是否完全相同。 由于生成的md5信息中,每个md5值后都紧跟着对应的文件的路径(可能是相对路径),于是将生成的md5保存到某个文件中,以后可以使用该文件来检查md5值对应文件内容是否发生了修改。 例如,将上述两个文件的md5信息保存到fs.md5sum中,然后使用"md5sum -c"可以检查源文件是否完整或是否被修改过。 [root@xuexi ~]# md5sum /tmp/fstab /tmp/fstab1 >/tmp/fs.md5sum [root@xuexi ~]# md5sum -c /tmp/fs.md5sum [root@xuexi tmp]# md5sum --status -c /tmp/fs.md5sum [root@xuexi tmp]# echo $?

    6.8K10编辑于 2022-02-03
  • 来自专栏分享/效率/工具/软件

    (5)JMeter5.1默认使用中文

    文章目录 (5)Window JMeter5.1默认使用中文 操作步骤 1. 下载JMeter5.1 2. 启动后设置中文 3. 默认启动使用中文 (5)Window JMeter5.1默认使用中文 操作步骤 1. 下载JMeter5.1 download 2. 启动后设置中文 进入JMeter的bin目录下,windows系统双击jmeter.bat文件即可启动,启动后按照下图进行设置 ? 3. 默认启动使用中文 修改启动文件jmeter.bat,把默认language 改为zh_CN 源文件为: rem Get standard environment variables if exist "

    84050发布于 2019-09-17
  • 来自专栏大模型应用

    大模型应用:基于 SpeechT5 的自媒体多角色剧情配音系统:架构、细节与实践.20

    今天我们基于SpeechT5 模型构建一套自媒体多角色剧情配音系统,正是针对上述痛点的可落地解决方案。 该系统以 SpeechT5 为核心引擎,支持中英文多角色配音,覆盖 “剧本解析→语音合成→音频拼接→字幕生成→项目报告” 全流程,还提供 Web 可视化界面与批量处理能力,完全适配自媒体小团队的配音需求 说话人嵌入管理SpeechT5 实现多角色配音的关键是说话人嵌入向量(512 维) —— 不同向量对应不同音色,该类解决了 “本地嵌入加载与角色映射” 的核心问题,细节如下:1.1 核心逻辑初始化:指定本地嵌入文件目录 设备: cpu 模型: microsoft/speecht5_tts ✅ SpeechT5系统初始化完成 剧情配音系统初始化完成 输出目录: my_drama_project ✅ 设置了 5 导出为完整的视频作品字幕文件内容参考:项目数据报告文档:五、总结 这套基于 SpeechT5 的多角色剧情配音系统,是针对自媒体创作者的 “轻量化、全流程、可落地” 解决方案。

    60232编辑于 2026-02-17
  • AI配音神器、免费的文本转语音和声音克隆,一款多功能的配音工具

    免费在线AI配音工具;XECYV配音可以文字转语音、声音克隆等,支持多种语言和语音风格,更能情感控制,高自然度语音合成,接近真人音色,适用于播客、营销、创作等各种场景。 工具地址:https://xecyv.com/dubbing音色库:覆盖全场景XECYV配音提供多种音色。既有适合短视频搞笑的活泼声音,也有播音新闻腔和广告宣传音色。声音很难分辨是真人还是AI。 情绪模拟:AI配音更像真人很多文本转语音工具只能平淡朗读,XECYV配音支持怀旧、欢快、激情、恐惧、惊讶、抒情、伤心等多种情绪。 例如,为一段恐怖故事配音时,选择“恐惧”模式后,语速、音调、气息都明显变。自动识别多音字、整数、小数、电话号码、日期、金额等,并按照正确方式朗读。 多人角色配音:有声小说神器输入一段包含多个人物的对话,XECYV配音可以为不同角色分配不同音色,生成类似广播剧的效果。这一功能对有声读物创作者来说是很实用的。

    11810编辑于 2026-09-17
  • 来自专栏web全栈潮流

    Spring Websocket 中文文档 (spring5)

    请阅读RFC 6455,HTML5的WebSocket章节,或Web上的许多介绍和教程之一。 如果与代理的连接丢失,代理中继将继续尝试每5秒重新连接一次,直到成功为止。

    14.4K76发布于 2019-11-04
  • 来自专栏转载gongluck的CSDN博客

    【Qt】]Qt5中文乱码

    升级到Qt5.X之后,原先解决的Qt显示中文乱码的方法突然不适用了,找了很多方式来解决这个问题 第一种: 在公司代码里看到的方法,先将对应的cpp文件用windows自带的记事本打开,另存为UTF-8格式 ,然后在代码中,遇到中文字符,使用QStringLiteral("中文")进行修饰 这种方式每次新建一个class就要切出去用记事本编辑一下实在麻烦,而且每个中文字符串都要用QStringLiteral 实在麻烦 后来有找到了个方法 第二种: 在头文件申明中加上 #pragma execution_character_set("utf-8") 一切OK了 2016-10-8补充 PS:方法2只是用在Qt5最初的某个版本上大概是两三年前的某个版本 各位还是继续使用方法1来显示中文字符 —————————————这是一条浪荡的分割线————————————————— 2017.3.20更新 专门找了资料,把目前测试能用的解决中文字符乱码的方法整理的一下 环境:VS2015   Qt5.7 QString str1=QStringLiteral("中文字符");   QString str2=QString::fromLocal8bit("中文字符")

    4.6K50发布于 2018-03-09
  • 我们把 Kokoro 1.1 量化到 FP16,并用它替换了浏览器里的中文 Piper 配音

    在最新发布的TimelineStudiov1.0.0中,我们完成了一次重要的中文AI配音升级:中文配音从Piper/VITSONNX切换到Kokoromulti-langv1.1,并将模型转换为适合浏览器运行的 项目早期使用Piper/VITSONNX实现中文配音。Piper模型结构相对紧凑,适合浏览器部署,也帮助我们较早跑通了从文字生成语音、将配音放入时间线、关联字幕并最终导出视频的完整流程。 但随着使用场景从功能验证走向真实视频创作,旧的中文配音路径逐渐暴露出一些不足。首先是自然度。 因此,我们没有继续修补原有的中文Piper路径,而是将中文及中英混合配音整体迁移到了Kokoromulti-langv1.1。 从产品角度看,这次升级解决了四个核心问题:中文配音更加自然;中文音色从两条增加到四条;支持不中断语气的中英文混合生成;更高质量的模型仍然能够在浏览器本地运行。

    21810编辑于 2026-08-08
  • 来自专栏汇智网教程

    Truffle 5 开发手册中文版【以太坊】

    Truffle是一个世界级的用于以太坊区块链开发的开发环境、测试框架和资源处理流水线,其最新版本为Truffle 5,中文版文档由汇智网翻译整理,访问地址:http://cw.hubwiz.com/card /c/truffle-5-manual/。

    1.8K40发布于 2019-08-27
  • 在浏览器里跑中文 AI 配音:我们如何用 Hojo TTS 80M 实现更自然的中英双语语音生成

    过去一段时间,我们一直在为TimelineStudio寻找更适合浏览器运行的中文配音模型。 经过多轮模型测试,我们最终将中文配音切换到了HojoTTSLight80M,并完成了WebGPU、WASM、模型切片、长文本分句和双镜像下载等工程适配。 它的优势是部署简单、运行稳定,但在实际配音中仍存在一些明显问题:中文语气相对平直;中英文切换时容易出现突兀的停顿;长句的节奏和气息不够自然;笑声、语气词和句尾释放感偏机械;为了支持多个角色,需要携带较多声线资源 例如:展开代码语言:TXTAI代码解释今天我们发布了新的浏览器配音能力。它不需要上传素材,也不依赖远程推理。中文和英文可以在同一个工作流中完成。 当前成果完成这次升级后,TimelineStudio的中文配音流程已经具备:HojoTTSLight80MFP16浏览器推理;两位经过授权的中文参考声线;中文和中英混合语音生成;WebGPU与WASM混合执行

    19710编辑于 2026-08-13
领券