首页
学习
活动
专区
圈层
工具
发布
    • 综合排序
    • 最热优先
    • 最新优先
    时间不限
  • 来自专栏腾讯云智能·AI公有云

    AI最佳实践|用腾讯云录音文件识别让无字幕视频自动生成字幕

    事实上,纯手工添加字幕,也费时费力,面对较大时长与批量化字幕处理的,多少有些苦不堪言,那有没有更智能化的方式呢?接下来,本文将分享一下,如何借助录音文件识别服务给无字幕视频自动生成字幕。 一、分析调研给无字幕视频自动生成字幕,其实就是先对视频文件导出的音频文件进行识别,得到识别文字,再根据识别得到的文字与短句的时间信息处理得到视频srt字幕文件,在视频文件中导入srt字幕文件即可得到效果 实现思路如下:1.借助ffmpeg从视频中提取音频2.调用录音文件识别服务,对音频文件进行识别3.对识别得到的文字与短句的时间信息进行处理得到视频srt字幕文件4.将命名相同的视频文件与srt文件放在同一目录下 3.处理识别结果生成srt字幕文件笔者这里生成的srt文件除了根据调用接口已自动划分的句子进行时间的标注外,当自动划分的句子的长度较长时,还会根据当前句子的标点,结合ResultDetail中的OffsetEndMs 4.得到有字幕的视频。

    3.9K121编辑于 2023-04-25
  • 来自专栏AI uTools

    苹果发布 Final Cut Pro 11 | 自动抠图和自动生成字幕

    苹果发布 Final Cut Pro 11 新增多项AI功能 自动抠图和自动生成字幕 苹果发布 Final Cut Pro 11,此次更新为专业视频编辑带来了先进的 AI 驱动功能、空间视频编辑支持和多项工作流程改进 自动生成字幕(Transcribe to Captions) AI 技术将视频中的语音内容实时转录为字幕,省去手动添加字幕的烦恼。 主要亮点包括: 快速转录:自动将语音转为文本,并同步生成准确的闭合字幕。 支持多语言:苹果的大语言模型支持高准确度的多语言转录。 提升无障碍性:增强视频的可理解性,帮助听障人士观看。 其他 AI 功能亮点 除了磁性遮罩和自动生成字幕,Final Cut Pro 11 还新增了以下智能功能: 智能适配(Smart Conform):自动裁剪视频以适应社交媒体的方形或竖屏格式。 Apple 芯片优化:支持流畅播放 4K、8K 视频,显著提升渲染速度。 代理工具(Proxy Tools):生成轻量文件,方便远程编辑。

    1.7K00编辑于 2024-11-18
  • 来自专栏Java项目实战

    Flux免费反推 扩展提示词 免费生成字幕 支持4K

    昨天给大家推荐了基于Flux.dev免费生成图片的AI网站,竟然还收到了很多质疑,说我是不是在引流,AB号做推广,第一:我没有这个经济支持几张A100,现在能够生成Flux.dev图片的网站是很多 世界首个免费FLux无限制AI图像生成器如果无限制生成器点击复制,输入框没有出现提示词,缩减你的提示词即可。支持调节形状,风格,色彩,光影,构图,以及添加反向提示词。 回复关键字【flux】领取本期工作流和网址一键安装包~~码字不易,希望大家点赞收藏在看~~ 支持 ComfyUI 反推图片的节点 现在Flux官方就已经免费支持了反推提示词,文生图扩展提示词,以及免费生成字幕 可以复制到各个类型下直接生成 新增了Flux1.1Pro Ultra的4K图片生成,需要积分,Flux0.1与Flux1.1的区别简单概括就是Flux1.1的生图速度是0.1的6倍强势发布 FLUX1.1 生成样例 总之最大的亮点就是免费的三个工具,早用早享受,晚用没折扣,赶紧去试试吧~~

    1.9K00编辑于 2025-02-04
  • 来自专栏Mac软件的分享

    Captions for Mac(Fcpx字幕生成工具)

    Video Captions Mac版是一款Fcpx视频字幕生成工具!该应用程序使用先进的Al SpeechRecognition技术将您的Final Cut Pro项目音频转录为可动画化的标题。 只需点击几下,您就可以在视频中添加专业的分级选项,类似于在 YouTube 和 TikTok 视频中看到的字幕。有需要的朋友,欢迎前来下载! Captions for Mac(Fcpx字幕生成工具) 图片Video Captions Mac版功能特色 连接 Final Cut Pro 以接收为您的项目导出的音频- 自动转录支持多种语言的音频- 将生成的文本分成句子或逐字的字幕- 配置标题外观和动画,包括文本大小写、内置、内置、文本颜色、描边颜色和描边宽度- 配置字幕字体名称、字体和字体大小- 生成字幕并在 Final Cut Pro 项目中继续编辑

    1.4K20编辑于 2023-03-05
  • 来自专栏云计算运维

    使用 SubSync 自动同步视频字幕

    (本文字数:1331,阅读时长大约:2 分钟) 让我分享一个场景:当你想要观看一部电影或视频,而又需要字幕时,在你下载字幕后,却发现字幕没有正确同步,也没有其他更好的字幕可用。现在该怎么做? 你可以 在 VLC 中按 G 或 H 键来同步字幕。它可以为字幕增加延迟。如果字幕在整个视频中的时间延迟相同,这可能会起作用。但如果不是这种情况,就需要 SubSync 出场了。 即使音轨和字幕使用的是不同的语言,它也能发挥作用。如果有必要,它也支持翻译,但我没有测试过这个功能。 我播放一个视频不同步的字幕进行了一个简单的测试。 令我惊讶的是,它工作得很顺利,我得到了完美的同步字幕。 使用 SubSync 很简单。启动这个应用,它会让你添加字幕文件和视频文件。 image.png 你需要在界面上选择字幕和视频的语言。 最后 就我个人而言,我很依赖字幕。即使我在 Netflix 上看英文电影,我也会把字幕打开。它有助于我清楚地理解每段对话,特别是在有强烈口音的情况下。

    2.9K30发布于 2021-09-01
  • 来自专栏Python小屋

    Python根据字幕文件自动给视频添加字幕(通用版)

    功能描述: 根据给定的字幕文件中的字幕信息,自动给视频添加字幕,运行程序后输入要添加字幕的视频文件和对应的字幕文件路径即可。 实际使用时不需要对程序做任何修改,只需要根据实际的视频内容来修改字幕文件就可以,自动把字幕文字添加到视频下方并居中显示。 字幕文件格式: ?

    6.2K10发布于 2020-03-19
  • 来自专栏新智元

    TensorFlow官方力推、GitHub爆款项目:用Attention模型自动生成图像字幕

    ---- 新智元编译 来源:GitHub 编译:金磊 【新智元导读】近期,TensorFlow官方推文推荐了一款十分有趣的项目——用Attention模型生成图像字幕。 项目作者Yash Katariya十分详细的讲述了根据图像生成字幕的完整过程,并提供开源的数据和代码,对读者的学习和研究都带来了极大的帮助与便利。 TensorFlow官方推文近期力荐了一款在Github上获赞十万之多的爆款项目——利用Attention模型为图像生成字幕。 ? Image Captioning是一种为图像生成字幕或者标题的任务。 该模型能够在生成字幕的时候,让我们查看它在这个过程中所关注的是图像的哪一部分。 ? 此数据集包含的图像大于82,000个,每个图像都标注了至少5个不同的字幕。 下面的代码将自动下载并提取数据集。 注意:需做好提前下载的准备工作。 该数据集大小为13GB!!!

    1.4K20发布于 2018-08-01
  • 来自专栏腾讯云TVP

    Zoom支持自动生成字幕;SharePlay上线;Safari 更新导致大量bug |WebRTC风向

    内容简介: 自动生成字幕难度不低,但国民级应用Zoom把这一功能拿来了;在iOS 15.0 Safari的更新中,增加了很多WebRTC相关的特性,你想了解吗?相关信息,尽在文中。 Zoom支持自动生成字幕 Zoom正面临着很激励的竞争,前一段时间开始做RTC的PaaS服务, 以147亿美元收购five9,但最后以失败而告终。 Zoom也在不断迭代提升其产品的粘性,最近自动生成字幕能力现在可用于所有免费的Zoom会议账号,目前只支持英文,后续会支持其他的语言。 以后我们在和外国人开会就再也不怕蹩脚的英文了。 自动生成的字幕可以在 Zoom 视频会议或网络研讨会上自动提供发言人字幕。若要启用该功能,需要访问 Zoom 网络门户。与会者仍可以私下要求会议主持人在会议期间使用会议工具栏启用现场转录。 articles/game/1194311.htm [3] https://36kr.com/p/1452080810256521: https://36kr.com/p/1452080810256521 [4]

    1.8K10发布于 2021-11-17
  • 来自专栏代码简单说

    日语视频 SRT 字幕生成软件下载:日语视频本地自动翻译SRT字幕生成、日语视频自动翻译 Faster Whisper v1.7 下载与使用教程(含AMD显卡支持)

    日语视频 SRT 字幕生成软件下载:日语视频本地自动翻译SRT字幕生成、日语视频自动翻译 Faster Whisper v1.7 下载与使用教程(含AMD显卡支持) 关键词:Faster Whisper : 优点: 多片段并行 大幅提升速度 自动检测批次大小 缺点: 极少数场景精度略降 适用场景: 噪声较多 多说话人 长音频文件 九、v1.7 更新重点 ✅ AMD GPU 支持(RDNA1–4) ✅ 多架构打包 ✅ ROCm 运行时内置 ✅ 改进自动设备检测 ✅ 支持 --device=amd 十、常见问题 Q1:RTX 4090 用哪个版本? 示例: 60fd157293d7d5033dab3c013ce3d4a083d1af6460157f1303a622f4f931715f 可使用: certutil -hashfile 文件名 SHA256 十二、总结 v1.7 这一版的核心价值在于: 真正补齐了 AMD 显卡支持 RTX 50 系列适配到位 批处理逻辑成熟 云端推理完善 如果你做: 日语视频翻译 会议转录 字幕批量生成 本地离线语音识别

    91810编辑于 2026-06-16
  • 来自专栏最新Python入门基础合集

    基于OpenAI Whisper AI模型自动生成视频字幕:全面解析与实战指南

    Whisper的推出,标志着语音识别技术迈上了一个新的台阶,为视频字幕自动生成提供了强大的技术支持。 三、自动生成视频字幕的流程 基于OpenAI Whisper模型自动生成视频字幕的流程大致可以分为以下几个步骤: 音频提取:从视频文件中提取出音频部分,通常可以使用FFmpeg等多媒体处理工具来完成。 六、应用场景与前景展望 基于OpenAI Whisper模型自动生成视频字幕的应用场景广泛,包括但不限于: 在线教育:为教育视频自动生成字幕,方便听障学生或需要字幕辅助的学生观看。 影视制作:为电影、电视剧等影视作品自动生成字幕,提高制作效率。 新闻报道:为新闻视频自动生成字幕,方便观众在静音或嘈杂环境下观看。 社交媒体:为短视频平台自动生成字幕,提高用户体验。 希望本文能够为您在视频字幕自动生成方面提供有价值的参考和启示。

    3.5K10编辑于 2024-12-28
  • 来自专栏机器之心

    业界 | 谷歌为YouTube添加新功能:利用机器学习自动生成音效字幕

    自 2009 年以来,YouTube 就开始为视频提供自动生成的字幕了,而这主要是专注于语音转录以使 YouTube 上托管的内容能触及到更多人。 为了解决这个问题,我们宣布为 YouTube 视频中的自动字幕增加音效信息,从而让人们能更大程度地获取丰富的音频内容。 展望未来 我们工作是使 YouTube 视频自动匹配音效字幕。这个首次展示只是第一步,我们将继续努力为丰富的视频内容匹配自动字幕,以方便那些由于不同方式不同环境而需要字幕的人。 我们已经开发了一个框架,使带有音效的自动字幕更丰富,但完全做好还要更加努力。 我们希望这会在社区之中激发进一步的工作和讨论,比如,不仅使用自动技术提升字幕效果,也探讨使创建者生成的与社区贡献的字幕更丰富和更好,从而进一步提升用户的观看体验。 ?

    1.9K40发布于 2018-05-07
  • 来自专栏编程微刊

    4个免费代码自动生成神器

    日常写代码,是一件非常需要耐心的事情,尤其是那些没有技术含量重复使用到的一些代码排列组合,比如前端的一些html和css布局,简单繁杂,这个时候就会使用到一些免费代码自动生成神器,让我们提高效率。 1:在线搭建框架-懒猴子CG 官方网址:http://cg.lazy-monkey.com/ 懒猴子代码生成器支持Java,Vue,React,Python等语言的框架搭建和规范代码生成,只需要选择对应的模版或模版组并录入数据字段即可在线生成和下载 对于程序员来说,是最贴心的的java代码自动生成工具和h5布局器,即时预览布局。 官网:http://bbs.magicalcoder.com/ 4:前端代码生成神器-ibootstrap http://www.ibootstrap.cn/ 前端开发里Bootstrap比较常见 ,适配了很多浏览器,最重要的是简单可视化编辑和生成,前端代码生成神器-ibootstrap不得不推荐一下。

    9.8K10编辑于 2025-05-19
  • 来自专栏编程直播室

    视频一键识别生成字幕

    前不久我介绍了通过视频生成字幕的技术原理(博客、B站),我现在把这个功能打包成一个易于操作的界面,如下图所属: ? 图片 操作非常的简单,打开程序后,点击上面【打开要识别的视频按钮】,就会弹出下图的打开文件对话框,选择需要生成字幕的视频: ? 图片 稍等片刻,待程序识别并生成完成后就弹出如下保存对话框,填写要保存的字幕文件名就可以了: ? 图片 最后生成类似如下的文件就可以在你的视频编辑软件中进行合并了。 ? 图片 软件下载

    3.3K30发布于 2020-02-25
  • 【剪映小助手】字幕信息生成接口

    字幕信息生成接口目录简介项目结构核心组件架构概览详细组件分析依赖关系分析性能考虑故障排除指南结论附录简介字幕信息生成接口(/caption_infos)是CapCutMate项目中的一个核心API端点, 专门用于根据文本内容和时间线生成字幕信息。 该接口支持多种字幕样式配置、关键词高亮、入场出场动画以及转场效果设置。新增智能参数修剪和优雅降级机制,当输入参数长度不匹配时,系统会自动以最短长度为准进行处理,而不是直接抛出错误。 :自动处理长度不匹配问题,提供优雅降级详细的日志记录:记录处理过程和警告信息高性能处理:线性时间复杂度,适合大批量处理扩展性强:模块化设计便于功能扩展应用场景视频字幕生成和编辑多语言字幕处理动态字幕效果制作批量字幕信息管理容错性要求较高的应用场景未来改进方向增加更多动画效果支持优化性能以处理超大字幕集提供更丰富的样式定制选项增强国际化和本地化支持扩展智能修剪功能 1","字幕2","字幕3","字幕4"],"timelines":[{"start":0,"end":1000000},{"start":1000000,"end":2000000}]}结果:系统会自动截断到最短长度

    39610编辑于 2026-05-16
  • 来自专栏呱牛笔记

    使用ffmpeg给视频自动添加字幕

    今天看到一篇“一个视频自动加字幕的小工具,如何做到月入2W”的博文(突字幕,有兴趣的同学可以度娘,作者的动手能力确实很强!),考虑实现这个小工具就能做到这个收入,还是挺让人羡慕的! 关键功能点,给视频自动添加多语种字幕,大概的实现流程: 1、视频中音频部分提取! ->  使用商用的API,百度、腾讯等云服务商均有提供机器翻译API; 4、将文字+时间戳生成外挂式SRT字幕文件,后台服务程序处理即可! 一个典型的SRT文件如下(截取自阿凡达中英字幕): 3 00:00:39,770 --> 00:00:41,880 在经历了一场人生巨变之后 When I was lying there in the ffmpeg -i infile.mp4 -i infile.srt -c copy -c:s mov_text outfile.mp4 -c:v copy -c:a copy -c:s mov_text

    4.4K20编辑于 2023-05-02
  • SRT字幕驱动视频自动分镜切割:电影解说批量生成的工程实现思路

    五、自动化工具链整合:NarratorAlSkill接入上面的步骤解决了"从字幕到切割片段"的问题,但完整的解说视频生产流程还包括:解说文案生成、配音合成、片段拼接、字幕烧录。 /final_output.mp4这样整个流程形成一条完整的自动化链路:SRT解析→时间戳匹配→FFmpeg批量切割→narrator-ai-clipipeline→成片输出。 也就是说,同样50个片段,自动化方案节省了将近95分钟,效率提升在4倍以上。需要说明的是,人工校对这个环节目前还无法完全省掉。 影响误匹配率的因素主要有三个:脚本对原片字幕的改写幅度越大,匹配越难;原片字幕如果是ASR机器生成而非人工校对,时间戳本身就有偏差,会进一步拉高误匹配率;对话密集的剧情片匹配效果明显好于动作片和纪录片, 原片没有字幕文件。需要先跑ASR生成字幕,再走上述流程。ASR的时间戳精度通常在±200ms以内,对切割精度有一定影响,可以通过加大缓冲时间来部分补偿。同一时间段内需要切多个不同场景的镜头。

    41310编辑于 2026-04-22
  • 来自专栏软件安装

    视频转文字、双字幕生成、实时翻译推荐

    ▌引言 之前给大家分享过不少视频转文字、字幕生成、实时翻译的工具,但有一类工具一直没提到,就是给视频生成字幕后,顺便翻译成中文字幕文件。 第一款:RASK 网址:https://app.rask.ai/ Rask AI需要谷歌账号登录,是个专业的AI视频翻译工具,能把一个视频转换成60多种不同语言并自动配音,甚至还能克隆原视频的声音。 不过视频生成速度快,比较适合把国外视频搬运翻译到国内短视频平台上。 lang=zh_CN 保存翻译结果 Potplayer怎么配置字幕生成和翻译插件,这里就不多说了,不了解的朋友可以直接网上找一下,一大推。 用Potplayer打开生肉视频,右键选择字幕→生成有声字幕→生成有声字幕。 设置好转换引擎、型号、语言这些参数后,点开始生成就行。 很快本地就会出现一份带时间轴但没翻译的字幕文件。

    1.8K10编辑于 2026-03-26
  • 来自专栏Mac精品软件

    AI Transcription 1.2 人工智能字幕生成工具

    AI Transcription是一款功能强大、易于使用的语音转文字软件,适用于各种语音转文字的需求场景。它使用先进的人工智能技术,可以快速、准确地将音频或视频文件中的语音内容转换成文字文本,支持多种语言和实时转换,同时还支持批量转换、管理和分享等功能,可以提高工作效率。

    2K30编辑于 2023-07-17
  • 来自专栏AI算法能力提高班

    DALL-E3 | (3)字幕生成器

    DALL-E 3 通过训练一个定制的图像字母器对训练集重新生成字幕,并用它们训练数据集,最后公开了样例和评估代码 2 Dataset Recaptioning 训练用的文本图像对中,文本字幕通常来源于人类标注 ,其主要关注主体对象,而忽略了背景细节或者图像中颜色等感知关系,而这些缺点都可以通过合成生成字幕解决。 Model B,考虑到图像像素空间太大,需要通过CLIP压缩图像表征空间F(i),最大化似然函数L(t,i) image-20231025115017663 Step 4 将Model A和Model 这是因为我们的合成字幕生成器也有这个弱点:它在陈述对象位置方面不可靠,这反映在我们的下游模型中。 Text rendering 在构建我们的字幕生成器时,我们特别注意确保它能够在生成的字幕中包含在图像中找到的显著单词。因此,DALL-E3 可以在提供提示时生成文本。

    86820编辑于 2023-10-25
  • 来自专栏C#开发点点滴滴

    C# 通过T4自动生成代码

    通过T4模板生成代码,运行时实现 关键代码段:Host using Microsoft.VisualStudio.TextTemplating; using System; using System.CodeDom.Compiler ; //模板 string input = File.ReadAllText(templateFileName); //执行代码生成 Path.GetFileNameWithoutExtension(templateFileName), host.FileExtension); //将生成的文件写入到新位置

    1.1K10发布于 2020-08-31
领券