搜索 - 腾讯云开发者社区-腾讯云

文章/答案/技术大牛

发布

来自专栏程序小小事
望言OCR视频字幕提取2025终极评测：免费版VS专业版提全方位对比(含免费下载)
一、产品定位：AI时代的视频字幕处理专家望言OCR作为专业的视频硬字幕提取工具，在AI视频处理领域占据重要地位。关注【程序视点】，回复ocr，获取免费下载地址！最后【程序视点】一直在助力提供更优秀、更高效的工具。关注【程序视点】，回复ocr，免费下载！后续小二哥会继续详细分享更多实用的工具和功能。
2.2K11编辑于 2025-07-27
来自专栏javascript趣味编程
2.5 node.js回首望
node.js是什么？上一小节2.4说过了，也就是一个可以脱离浏览器独立的javascript的运行时(runtime)。nodejs之父Ryan Dahl后来使用Go语言又开发了deno框架，被一个中国开发者疯狂吐槽，这feel似乎和我一些时候遭遇差不多，如下图：
79720发布于 2019-04-26
MySQL 9.0 创新版发布，大失所望。。
总结看了本次 MySQL 9.0 创新版的更新，说实话，大失所望。在这之前，网上有很多关于 MySQL 9.0 版本新特性的猜测，结果基本上都没有出现。
1.7K10编辑于 2024-07-05
来自专栏用户2442861的专栏
OCR material
：基于CNN的实现 blog: http://blog.xlvector.net/2016-05/mxnet-ocr-cnn/ I Am Robot: (Deep) Learning to Break github: https://github.com/tmbdev/clstm caffe-ocr: OCR with caffe deep learning framework github: https ://github.com/pannous/caffe-ocr Digit Recognition via CNN: digital meter numbers detection ? github(caffe): https://github.com/SHUCV/digit Attention-OCR: Visual Attention based OCR ? github: https://github.com/da03/Attention-OCR umaru: An OCR-system based on torch using the technique
14.1K41发布于 2018-09-19
来自专栏Linux、云计算技术交流
前言
前言继Linux系统之后，本书中将开始介绍Linux企业级服务的部署。本书将先从网络参数设置讲起，逐一介绍各个服务的原理及部署方式。
58550发布于 2019-07-04
来自专栏InvQ的专栏
CSDN 云IDE初体验 - 不负所望
云IDE产品介绍云IDE使用教程免费使用地址：点击【云IDE】，即可开始创建工作空间啦~
58520编辑于 2022-11-12
OCR大全
OCR技术概述什么是OCR？OCR（OpticalCharacterRecognition，光学字符识别）是指将图像中的文字信息转换为计算机可编辑文本的技术。 OCR技术发展历程展开代码语言：TXTAI代码解释1960s-1990s:传统OCR时代└──基于模板匹配、特征提取2000s-2010s:机器学习OCR└──基于SVM、随机森林等算法2015-至今: 深度学习OCR└──基于CNN、RNN、Transformer2023-至今:大模型OCR└──基于多模态大模型(GPT-4V、Qwen-VL)OCR技术分类一、传统OCR方法1.基本原理传统OCR通常包括以下步骤 OCROCR具体实现1.传统OCR实现我们设计的是基于Tesseract的传统OCR示例代码。 ('image.jpg')#身份证识别result=ocr.id_card_ocr('idcard.jpg')#车牌识别result=ocr.license_plate_ocr('plate.jpg')
45910编辑于 2026-03-05
来自专栏平凡少年
OCR识别
最近作者项目中用到了身份证识别跟营业执照的OCR识别，就研究了一下百度云跟腾讯云的OCR产品接口。 1.腾讯云OCR ---- 收费：身份证OCR和营业执照OCR接口，每个接口每个月各有1000次的免费调用接口说明：身份证OCR接口 - https://cloud.tencent.com/document 2.百度OCR ---- 通过以下步骤创建OCR应用，作者当时在这一步花了很长时间 ? ? 创建完之后就可以拿到appId，API Key，Secret Key，就可以调用百度提供的api了收费：身份证OCR和营业执照OCR接口，每个接口每天各有500次的免费调用接口说明：身份证OCR 营业执照OCR接口- https://cloud.baidu.com/doc/OCR/OCR-API.html#.E8.90.A5.E4.B8.9A.E6.89.A7.E7.85.A7.E8.AF.86
26.8K51发布于 2019-04-11
来自专栏我的小碗汤
十大 Docker 最佳实践，望君遵守！！
本文是关于容器安全的文章，展示了 10 种强化 Docker 基础架构并保护容器和数据免受恶意攻击的方法。
1.7K20编辑于 2023-03-19
来自专栏javascript趣味编程
[python从入门到放弃]pyautogui+acrobat去PDF水印一例
Adobe Acrobat（30天试用版）编辑模式打开PDF文件，关闭OCR识别。 ? Talk is cheap, show me the code! 都督阎公之雅望，棨戟遥临；宇文新州之懿范，襜帷暂驻。十旬休假，胜友如云；千里逢迎，高朋满座。腾蛟起凤，孟学士之词宗；紫电青霜，王将军之武库。家君作宰，路出名区；童子何知，躬逢胜饯。望长安于日下，目吴会于云间。地势极而南溟深，天柱高而北辰远。关山难越，谁悲失路之人？萍水相逢，尽是他乡之客。怀帝阍而不见，奉宣室以何年？嗟乎！时运不齐，命途多舛。冯唐易老，李广难封。临别赠言，幸承恩于伟饯；登高作赋，是所望于群公。敢竭鄙怀，恭疏短引；一言均赋，四韵俱成。请洒潘江，各倾陆海云尔：滕王高阁临江渚，佩玉鸣鸾罢歌舞。画栋朝飞南浦云，珠帘暮卷西山雨。
2.3K40发布于 2019-08-27
来自专栏Mac应用教程
OCR Tool PRO Mac(OCR光学字符识别)
推荐这款OCR光学字符识别工具OCR Tool PRO，以卓越的准确性和速度从图像和 PDF 中提取文本。抓取图像 + PDF + 抓取屏幕区域 + 从 iPhone/iPad 捕获图像 + 设置 + OCR + 将文本复制到剪贴板 + 使用文本文件和 PDF 导出！ OCR Tool PRO Mac图片OCR Tool PRO版软件功能OCR 工具允许在选定区域中捕获具有任何文本的屏幕的一部分。它可以立即被识别并复制到剪贴板。 OCR 工具是一种简单、易于使用、超级高效且尊重您的隐私（不会从您的设备中获取数据）。主要特点抓取屏幕区域以实现超高效的 OCR多次抓取屏幕区域以快速工作从 iPhone/iPad 和扫描仪捕获图像以进行即时 OCR 并将结果复制到剪贴板。
20.2K20编辑于 2022-08-29
来自专栏目标检测和深度学习
OCR技术综述
最近入坑研究OCR，看了比较多关于OCR的资料，对OCR的前世今生也有了一个比较清晰的了解。所以想写一篇关于OCR技术的综述，对OCR相关的知识点都好好总结一遍，以加深个人理解。什么是OCR？比如汉王OCR，百度OCR，阿里OCR等等，很多企业都有能力都是拿OCR技术开始挣钱了。太多太多的应用了，OCR的应用在当今时代确实是百花齐放啊。 OCR的分类如果要给OCR进行分类，我觉得可以分为两类：手写体识别和印刷体识别。 OCR流程现在就来整理一下常见的OCR流程，为了方便描述，那就举文档中的字符识别为例子来展开说明吧。针对传统OCR解决方案的不足，学界业界纷纷拥抱基于深度学习的OCR。这些年深度学习的出现，让OCR技术焕发第二春。
16.2K92发布于 2018-04-18
来自专栏SIGAI学习与实践平台
OCR技术简介
OCR的应用场景根据识别场景，可大致将OCR分为识别特定场景的专用OCR和识别多种场景的通用OCR。比如现今方兴未艾的证件识别和车牌识别就是专用OCR的典型实例。 OCR的技术路线典型的OCR的技术路线如下图所示其中影响识别准确率的技术瓶颈是文字检测和文本识别，而这两部分也是OCR技术的重中之重。在传统OCR技术中，图像预处理通常是针对图像的成像问题进行修正。 [11] 端到端的OCR 与检测-识别的多阶段OCR不同，深度学习使端到端的OCR成为可能，将文本的检测和识别统一到同一个工作流中。 [12] 总结尽管基于深度学习的OCR表现相较于传统方法更为出色，但是深度学习技术仍需要在OCR领域进行特化，而其中的关键正式传统OCR方法的精髓。
18.5K20发布于 2018-09-26
DeepSeek-OCR-2 开源 OCR 模型的技术
DeepSeek-OCR-2开源OCR模型的技术OCR应用的场景和类型很广，本次使用Qwen2的架构，解决看的全（扫码方式优化）、看的的准（内容识别、视觉标记、降低重复率），多裁剪策略提取核心信息。 4.2GOT-OCR2.0：学术界的统一模型特点详情定位统一端到端OCR-2.0模型架构生成式预训练（类似LLM）特点强调整体文档理解适用场景学术研究、复杂版式文档对比结论：GOT-OCR2.0与DeepSeek-OCR VL是"通用选手"，OCR只是其能力之一；DeepSeek-OCR-2和HunyuanOCR是"OCR专家"，在文档解析专项上更精专。传统OCR-❌★☆☆☆☆极低简单文字识别五、选型建议：如何选择适合你的OCR方案5.1按应用场景选择场景推荐方案理由智能文档处理（IDP）HunyuanOCR/DeepSeek-OCR-2端到端，支持结构化输出移动端）：DeepSeek-OCR-2的上下文压缩特性可以显著降低文档预处理成本六、总结与展望DeepSeek-OCR-2和HunyuanOCR的开源，标志着OCR技术进入了一个新的阶段——从传统的"字符识别
56410编辑于 2026-02-07
来自专栏晓谈岩说
五言排律
注： 1、排律：一般五言绝句通常为八句至十六句，也即二十或四十个字，也有超过这个长度的，一般称为排律或长律，有长达一百四十字的。 2、家酿：家里自酿的酒 3、流杯：犹流觞。 9、华星：明亮的星星原本是写一首五言绝句，感叹下繁忙的四月和初创的感受，但是写着写着就超标了，诗词吾爱校验不了了，一查，是从绝句转成了排律，诗词吾爱中似乎没有对排律的校验，那就自己看着弄吧，算是成就自己的第一首排律
33181编辑于 2023-08-29
来自专栏人工智能头条
望周知~
翻译 | 张涛出品 | 人工智能头条（公众号ID：AI_Thinker） 2014 年 RNN/LSTM 起死回生。自此，RNN/LSTM 及其变种逐渐被广大用户接受和认可。起初，LSTM 和 RNN 只是一种解决序列学习和序列翻译问题的方法（seq2seq），随后被用于语音识别并有很好的效果，比如 Siri，Cortana，Alexa 等；此外，这种技术在机器翻译领域也有应用，比如 Google Translate。 2015-2016 年，新的 ResNet 和 Attention 技术出现。实际上
1.4K60发布于 2018-06-05
来自专栏SIGAI学习与实践平台
OCR技术简介
OCR的应用场景根据识别场景，可大致将OCR分为识别特定场景的专用OCR和识别多种场景的通用OCR。比如现今方兴未艾的证件识别和车牌识别就是专用OCR的典型实例。 OCR的技术路线典型的OCR的技术路线如下图所示 ? 其中影响识别准确率的技术瓶颈是文字检测和文本识别，而这两部分也是OCR技术的重中之重。 Attention OCR的网络结构[11] 端到端的OCR 与检测-识别的多阶段OCR不同，深度学习使端到端的OCR成为可能，将文本的检测和识别统一到同一个工作流中。 FOTS的总体结构[12] 总结尽管基于深度学习的OCR表现相较于传统方法更为出色，但是深度学习技术仍需要在OCR领域进行特化，而其中的关键正式传统OCR方法的精髓。因此我们仍需要从传统方法中汲取经验，使其与深度学习有机结合进一步提升OCR的性能表现。
8.6K50发布于 2018-10-18
OCR识别技术
前言一、OCR是什么？OCR是光学字符识别的缩写，通俗来讲就是计算机可以通过图像来识别和处理文字信息。二、OCR应用领域OCR识别API对接步骤1、接入前文档查看需要什么协议？ args) throws Exception{ String host = "https://open.expauth.com"; String path = "/v2/ocr "cusNo":"MER20230227354812341234","subMerNo":"MER20230227354812341234","reqNo":"1654251116079"}三、好用的OCR API为了简化开发者的工作，许多云服务提供商提供了强大且易于集成的OCR API1.文字OCR文字识别场景服务商提供的OCR API可选择性比较多，开发者可以根据自己的需求选择适合自己的服务商。总结OCR识别技术让信息处理变得更加便捷。目前OCR技术已经广泛应用于我们的生活和工作中。
4K10编辑于 2024-05-15
树莓派Raspbian系统安装tesseract-ocr实现OCR
第二步安装Leptonica sudo apt-get install libleptonica-dev 第三步安装tesseract sudo apt-get install tesseract-ocr
41810编辑于 2025-07-17
腾讯云OCR
腾讯云OCR1.腾讯云OCR初探之前由于学习原因，学校内的一些纸质资料上的数据需要转换为电子档。但这些数据都是一年一个站点一个数据，然后又要取多个站点，如果按照自己手动输入得输到猴年马月。正好之前了解过ocr，知道腾讯云有相关产品，于是上官网去看了下。想不到表格识别都更新到v3了，我当初的时候还是v2版本，那个时候识别出来都得手动复制到excel，没有自动导出功能的。其他的ocr识别不准确的通病就不说了，这方面腾讯云做的还是挺好的。改进这次v3，采用比较笨的方法，用selenium模拟浏览器点击，批量上传与保存。 coding:utf-8 -*-# @author:Ye Zhoubing# @datetime:2024/10/15 19:03# @software: PyCharm"""selenium+腾讯云OCR osimport pyautogui as uiimport pyperclipimport refrom time import sleepfile_dir = (r'E:\git\excel_ocr
18.1K10编辑于 2024-12-14

第 2 页第 3 页第 4 页第 5 页第 6 页第 7 页第 8 页第 9 页第 10 页第 11 页

点击加载更多

望言OCR视频字幕提取2025终极评测：免费版VS专业版提全方位对比(含免费下载)

2.5 node.js回首望

MySQL 9.0 创新版发布，大失所望。。

OCR material

前言

CSDN 云IDE初体验 - 不负所望

OCR大全

OCR识别

十大 Docker 最佳实践，望君遵守！！

[python从入门到放弃]pyautogui+acrobat去PDF水印一例

OCR Tool PRO Mac(OCR光学字符识别)

OCR技术综述

OCR技术简介

DeepSeek-OCR-2 开源 OCR 模型的技术

五言排律

望周知~

OCR技术简介

OCR识别技术

树莓派Raspbian系统安装tesseract-ocr实现OCR

腾讯云OCR

社区

活动

圈层

关于

腾讯云开发者

热门产品

热门推荐

更多推荐

望言OCR视频字幕提取2025终极评测：免费版VS专业版提全方位对比(含免费下载)

2.5 node.js回首望

MySQL 9.0 创新版发布，大失所望。。

OCR material

前 言

CSDN 云IDE初体验 - 不负所望

OCR大全

OCR识别

十大 Docker 最佳实践，望君遵守！！

[python从入门到放弃]pyautogui+acrobat去PDF水印一例

OCR Tool PRO Mac(OCR光学字符识别)

OCR技术综述

OCR技术简介

DeepSeek-OCR-2 开源 OCR 模型的技术

五言排律

望周知~

OCR技术简介

OCR识别技术

树莓派Raspbian系统安装tesseract-ocr实现OCR

腾讯云OCR

社区

活动

圈层

关于

腾讯云开发者

热门产品

热门推荐

更多推荐

前言