GitHub 雷达
首次出现 53 天前

tesseract-ocr/tesseract

Tesseract OCR 是一个开源的 OCR 引擎,用于从图像中识别文本,提供库和命令行工具。主要技术栈是 C++,并采用基于 LSTM 神经网络的 OCR 引擎,同时兼容传统的字符模式识别引擎。亮点是支持超过 100 种语言的 Unicode 文本识别,可处理多种图像格式并输出多种格式,适用于需要将扫描文档或图片中的文字转换为可编辑文本的场景。

近 7 日
+129
累计 Star
76.6k
Fork
10,805
近 30 日
+577
Star 趋势 · 49 个采集点
+1%
7 月 28 日9 月 19 日
语言C++
分类AI/机器学习
最近提交9 月 11 日
创建时间8 月 13 日
首次收录7 月 28 日 · 自动扫描
README 摘要
Tesseract OCR 是一个开源的 OCR 引擎,用于从图像中识别文本,提供库和命令行工具。主要技术栈是 C++,并采用基于 LSTM 神经网络的 OCR 引擎,同时兼容传统的字符模式识别引擎。亮点是支持超过 100 种语言的 Unicode 文本识别,可处理多种图像格式并输出多种格式,适用于需要将扫描文档或图片中的文字转换为可编辑文本的场景。
中文摘要由 AI 生成,仅供参考。
在 GitHub 打开