首页
学习
活动
专区
圈层
工具
发布
    • 综合排序
    • 最热优先
    • 最新优先
    时间不限
  • 来自专栏bunny的专栏

    【玩转Lighthouse】轻松搭建视频配音工具晓晓配音

    今天我们将给大家介绍如何使用Lighthouse轻量服务器搭建一个属于自己的在线视频配音工具,可以将文案制作为mp3文件并且生成对应的字幕视频,以便大家在制作视频的过程中方便地为自己的视频添加自然逼真的配音 ,并且为其它视频创作者提供帮助 LiuChangFreeman/ms-tts-web (github.com) github.png 一、购买一台轻量服务器 腾讯云的学生优惠是相当给力的,2核4G一年只要 ,非常方便 os.png 通过在当前系统生成ssh密钥对,我们可以将生成的公钥添加到控制台中,并绑定到轻量实例,这样就可以免密码登录了 key.png key2.png 二、构建Docker镜像 build.png 在进行前端编译的过程中会卡住一段时间,这是由于node_modules小文件太多造成的,需要等待其完成,不可中断 npm.png 最后镜像构建完毕后,我们就可以开启服务了 build2. png 三、开启服务 首先我们需要准备一个目录专门用于存放临时文件,考虑到有可能会有人使用晓晓配音生成违法的文件,因此晓晓配音的链接有效期并不长,生成的mp4和mp3文件都是定时过期的 mkdir /tts_storage

    2K100编辑于 2022-04-14
  • 来自专栏专知

    谷歌上线机器学习速成课程:中文配音+中文字幕+完全免费!

    值得一提的是,该课程有专门的中文版网址,其中机器翻译和中文字幕不要太溜! 如果您是机器学习爱好者或想要从事机器学习工作,这是一个不可多得的自学福利! ? ▌MLCC中文版课程 ---- ---- 令人震惊的是,点击MLCC课程,进去竟然基本上是中文讲课。 据Google称,“此视频讲座的配音是使用机器学习技术生成的。” ,这点我们也可以听出课程的中文配音有明显的机器口音,但是其吐字是非常清晰的,配合中文字幕,对于我们来说听讲毫无压力,不得不说是对我们学习机器学习是一个巨大的福音(有个别机器翻译可能有错,在学习的时候还需要稍加注意 数学 代数 变量、系数和函数 线性方程式,例如 y=b+w1x1+w2x2 对数和对数方程式,例如 y=ln(1+ez) S 型函数 线性代数 张量和张量等级 矩阵乘法 三角学 Tanh(作为激活函数进行讲解 , (3,4)]) if/else 条件块和条件表达式 字符串格式化(例如 '%.2f' % 3.14) 变量、赋值、基本数据类型(int、float、bool、str) pass 语句 中级 Python

    2.7K90发布于 2018-04-16
  • Edge TTS 语音合成助手 v1.4.0:把普通配音、逐页配音、逐行配音一次做好

    三种模式,按你的工作方式生成普通模式适合最简单的全文配音。把文章、脚本或旁白粘贴到左侧输入框,点击生成即可得到一个完整音频,不要求分页,也不会因为普通换行就强制拆成多个文件。 Edge TTS 语音合成助手支持丰富的 Edge TTS 音色,提供中文和 English 界面,不需要填写 API Key。 它适合视频旁白、影视解说、短视频脚本、播客文稿、课程配音、语言学习和批量音频素材制作。 如果你正在寻找“TXT 每行生成一个 MP3”“逐页生成配音”“句间停顿加 SRT 字幕”的 Windows 工具,欢迎试试 v1.4.0。 #EdgeTTS #语音合成 #AI配音 #视频旁白 #批量配音 #SRT字幕 #开源软件 #Windows工具 #Python项目

    16700编辑于 2026-09-19
  • 来自专栏全栈开发日记

    自动批量真人配音软件

    工具名称:自动批量配音软件 运行系统:Windows 工具大小:6.5MB 工具截图: 使用方法: 需要设置阿里参数或腾讯参数,点击相应参数后的【获取】,可自动跳转到相应的获取页面(免费)。

    2.1K20编辑于 2022-05-13
  • 来自专栏Y大宽

    Cytoscape中文教程(2)

    image.png 第一行定义了两个nodes,分别是node1和node2,还有一个node1和node2之间的单独关系类型:type A。 第二行定义了三个新nodes,3,4,5.这里node2和第一行里的node2是一样的。第二行也定义了三种关系,都是typeB,node2是source,而3,4,5是targets。 例如,下面这个例子定义了同一对nodes的2个边。一个是typexx一个是typeyy ? 只有2种可能的line格式 A一个node“node”包含在一个网络中 Network node B,2个nodes联系在一起包含在一个网络中 Network node1 interaction node2 如果一个网络名字(first entry on a line)看起来想一个node name (第2列或第4列),这个网络将会以同样的名字嵌套。

    6.3K30发布于 2019-02-25
  • 来自专栏WTSolutions

    OpenAI Agents SDK 中文文档 中文教程 (2)

    英文文档原文详见 https://openai.github.io/openai-agents-python/ 本文是OpenAI-agents-sdk-python使用翻译软件翻译后的中文文档/教程。 分多个帖子发布,帖子的目录如下: (1) OpenAI 代理 SDK, 介绍及快速入门 (2) OpenAI agents sdk, agents,运行agents,结果,流,工具,交接 代理 代理是应用程序中的核心构建块 FunctionTool): print(tool.name) print(tool.description) print(json.dumps(tool.params_json_schema, indent=2)

    3.2K21编辑于 2025-03-13
  • 来自专栏杨熹的专栏

    中文NLP笔记:2. 中文分词的工具 jieba

    中文分词 ? 中文分词的工具有:   中科院计算所 NLPIR、哈工大 LTP、清华大学 THULAC 、斯坦福分词器、Hanlp 分词器、jieba 分词、IKAnalyzer 等 ---- 其中 jieba 分词可以做下面这些事情 精确分词   试图将句子最精确地切开   2. 全模式   把句子中所有的可能是词语的都扫描出来,速度非常快,但不能解决歧义   3. 还可以做:   关键词提取、自动摘要、依存句法分析、情感分析等任务 ---- 学习资料: 《中文自然语言处理入门实战》

    1.1K21发布于 2019-01-28
  • 来自专栏信数据得永生

    Matplotlib 中文用户指南 2 安装

    six 需要用于 Python 2 和 3 之间的兼容性。 Python 2 的依赖 functools32 需要用于 Python 2.7 上的兼容性。

    2.7K20编辑于 2022-12-01
  • 来自专栏信数据得永生

    orm2 中文文档

    0.10.x,0.12.x 和 iojs-1.5 版本的测试在 Travis CI 上运行。如果你想要的话,可以在本地运行测试:

    89630编辑于 2022-11-27
  • 来自专栏信数据得永生

    orm2 中文文档 2. 设置

    设置用于储存键值对。设置对象是orm(默认值)上的实例,之后会为每个db连接和每个定义过的Model建立快照。所以orm.settings上的更改只会作用于更改之后建立的连接,而db.settings会作用于更改之后定义的模型。

    40420编辑于 2022-11-27
  • 来自专栏新智元

    GPT-2写台词、StyleGAN做特效、Replica来配音

    他首先用GPT-2生成了一段荒诞不经的剧本,接着用StyleGAN2制作了一些人物和视觉特效,还找到了一个超实用的语音生成工具,一起来看下效果吧! 生成一份充满荒诞派情节的电影剧本 Alex使用由Openai推出的GPT-2语言模型,为自己生成了电影脚本。 接下来GPT-2语言模型会输出荒诞剧风格的脚本创作结果: GPT-2语言模型是OpenAI在2019年发布的一种人工智能语言处理模型。 StyleGAN2来一段人物视频特效 Alex是StyleGAN2的超级粉丝,使用StyleGAN2可以轻松地生成一个新面孔,甚至是转场动画。 使用StyleGAN2生成的一些图像 当然你也可以选择用first order model,也是一个很棒的工作。

    2K30发布于 2020-06-05
  • 来自专栏创作特训营

    在线教育微课生产线:CodeBuddy + 表格 OCR + TTS 配音 + 视频特效(制作周期 2 天→2 小时)

    上线后单节微课制作周期从2天压到2小时,表格识别准确率99.2%,配音成本下降90%。 抽检30节已交付微课,7节有表格数据错误,其中2节是关键公式数值错误,已被家长投诉。配音风格也不统一,同一学科5节微课换了3个声音。 表格OCRV3识别教材表格与Excel输出结果5.2TTS配音模块展开代码语言:PythonAI代码解释"""TTS配音模块:调用tencentcloud-tts合成配音,含多音字SSML标注+分段合成 经验:多音字是中文NLP的老大难,不能指望模型全对,必须保留人工干预入口。字典做成可配置文件,教研老师可自行扩展。 ,实现"配音→字幕"全自动闭环表格OCR和TTS配音哪个环节最卡脖子?

    45640编辑于 2026-08-10
  • 来自专栏LiveEdu在线科技教育平台

    LiveEdu中文教程项目分享(2)

    在过去的两周里,报名参加LiveEdu中文项目创建者招募计划 的用户人数在不断增加。我们非常感谢项目创建者们对我们平台的支持。我们明白,每一个项目都是项目创建者经验与技能的结晶。 查看教程介绍 snake game.jpeg 2. 如何用 C++ 创建一个贪吃蛇游戏 这个教程会教大家学习如何使用C++面向对象方式,配合Win32 APIs实现一个贪食蛇游戏。 这门课程除了详细讲解Tornado的知识点外,还将应用Python、MySQL、Tornado、SQLAlchemy、WTForms、Ip2Region、Werkzeug等技术开发一个完整短网址服务网站

    1.1K50发布于 2018-08-07
  • AI配音神器、免费的文本转语音和声音克隆,一款多功能的配音工具

    免费在线AI配音工具;XECYV配音可以文字转语音、声音克隆等,支持多种语言和语音风格,更能情感控制,高自然度语音合成,接近真人音色,适用于播客、营销、创作等各种场景。 工具地址:https://xecyv.com/dubbing音色库:覆盖全场景XECYV配音提供多种音色。既有适合短视频搞笑的活泼声音,也有播音新闻腔和广告宣传音色。声音很难分辨是真人还是AI。 情绪模拟:AI配音更像真人很多文本转语音工具只能平淡朗读,XECYV配音支持怀旧、欢快、激情、恐惧、惊讶、抒情、伤心等多种情绪。 例如,为一段恐怖故事配音时,选择“恐惧”模式后,语速、音调、气息都明显变。自动识别多音字、整数、小数、电话号码、日期、金额等,并按照正确方式朗读。 多人角色配音:有声小说神器输入一段包含多个人物的对话,XECYV配音可以为不同角色分配不同音色,生成类似广播剧的效果。这一功能对有声读物创作者来说是很实用的。

    11810编辑于 2026-09-17
  • 来自专栏钱塘小甲子的博客

    reportlab教程2--中文的显示

    很多时候,我们想实现自动化报表,但是一般都会需要用中文,而reportlab天然是不支持中文的,所以我们需要让他支持,而办法其实很简单。 2、什么pdf使用的字体 pdfmetrics.registerFont(TTFont('SimHei', 'SimHei.TTF')) 比如: from reportlab.pdfgen import ) c = canvas.Canvas("hello.pdf") c.setFont('SimHei',12) hello(c) c.showPage() c.save() 这样运行之后就会生成一个有中文的

    5.2K31发布于 2019-08-29
  • 来自专栏数据分析1480

    Pandas中文官档~基础用法2

    ), ....: columns=['a', 'b', 'c', 'd', 'e']) ....: In [97]: frame.iloc[::2] 3, 5, 3, 2, 5, 4, 5, 4, 3, 4, 5, 0, 2, 0, 4, 2, 0, 3, 2, 2, 5, 6, 5, 3, 4, 6, 4, 3, 5, 6, 4, 3, 6, 2, 6, 6, 2, 3, 4, 2, 1, 6, 2, 6, 1, 5, 4]) In [119]: s = pd.Series(data) In [120]: s.value_counts () Out[120]: 6 10 2 10 4 9 5 8 3 8 0 3 1 2 dtype: int64 In [121]: pd.value_counts (data) Out[121]: 6 10 2 10 4 9 5 8 3 8 0 3 1 2 dtype: int64 与上述操作类似,还可以统计 Series

    1.1K10发布于 2019-10-31
  • 来自专栏小小挖掘机

    Pandas中文官档~基础用法2

    ), ....: columns=['a', 'b', 'c', 'd', 'e']) ....: In [97]: frame.iloc[::2] 3, 5, 3, 2, 5, 4, 5, 4, 3, 4, 5, 0, 2, 0, 4, 2, 0, 3, 2, 2, 5, 6, 5, 3, 4, 6, 4, 3, 5, 6, 4, 3, 6, 2, 6, 6, 2, 3, 4, 2, 1, 6, 2, 6, 1, 5, 4]) In [119]: s = pd.Series(data) In [120]: s.value_counts () Out[120]: 6 10 2 10 4 9 5 8 3 8 0 3 1 2 dtype: int64 In [121]: pd.value_counts (data) Out[121]: 6 10 2 10 4 9 5 8 3 8 0 3 1 2 dtype: int64 与上述操作类似,还可以统计 Series

    98120发布于 2019-11-12
  • 来自专栏小詹同学

    Pandas中文官档~基础用法2

    ), ....: columns=['a', 'b', 'c', 'd', 'e']) ....: In [97]: frame.iloc[::2] 3, 5, 3, 2, 5, 4, 5, 4, 3, 4, 5, 0, 2, 0, 4, 2, 0, 3, 2, 2, 5, 6, 5, 3, 4, 6, 4, 3, 5, 6, 4, 3, 6, 2, 6, 6, 2, 3, 4, 2, 1, 6, 2, 6, 1, 5, 4]) In [119]: s = pd.Series(data) In [120]: s.value_counts () Out[120]: 6 10 2 10 4 9 5 8 3 8 0 3 1 2 dtype: int64 In [121]: pd.value_counts (data) Out[121]: 6 10 2 10 4 9 5 8 3 8 0 3 1 2 dtype: int64 与上述操作类似,还可以统计

    1.1K10发布于 2019-10-29
  • 我们把 Kokoro 1.1 量化到 FP16,并用它替换了浏览器里的中文 Piper 配音

    在最新发布的TimelineStudiov1.0.0中,我们完成了一次重要的中文AI配音升级:中文配音从Piper/VITSONNX切换到Kokoromulti-langv1.1,并将模型转换为适合浏览器运行的 项目早期使用Piper/VITSONNX实现中文配音。Piper模型结构相对紧凑,适合浏览器部署,也帮助我们较早跑通了从文字生成语音、将配音放入时间线、关联字幕并最终导出视频的完整流程。 但随着使用场景从功能验证走向真实视频创作,旧的中文配音路径逐渐暴露出一些不足。首先是自然度。 因此,我们没有继续修补原有的中文Piper路径,而是将中文及中英混合配音整体迁移到了Kokoromulti-langv1.1。 从产品角度看,这次升级解决了四个核心问题:中文配音更加自然;中文音色从两条增加到四条;支持不中断语气的中英文混合生成;更高质量的模型仍然能够在浏览器本地运行。

    21810编辑于 2026-08-08
  • 在浏览器里跑中文 AI 配音:我们如何用 Hojo TTS 80M 实现更自然的中英双语语音生成

    过去一段时间,我们一直在为TimelineStudio寻找更适合浏览器运行的中文配音模型。 经过多轮模型测试,我们最终将中文配音切换到了HojoTTSLight80M,并完成了WebGPU、WASM、模型切片、长文本分句和双镜像下载等工程适配。 例如:展开代码语言:TXTAI代码解释今天我们发布了新的浏览器配音能力。它不需要上传素材,也不依赖远程推理。中文和英文可以在同一个工作流中完成。 声音克隆与基础配音的边界TimelineStudio已经提供OpenVoiceV2,用于获得授权后的声音转换。因此,我们没有让HojoTTS同时承担完整的用户声音管理逻辑。 当前成果完成这次升级后,TimelineStudio的中文配音流程已经具备:HojoTTSLight80MFP16浏览器推理;两位经过授权的中文参考声线;中文和中英混合语音生成;WebGPU与WASM混合执行

    19710编辑于 2026-08-13
领券