产品介绍
通用文字识别(General Optical Character Recognition,General OCR)基于自研的文字识别技术,覆盖文字、文档、表格、印章、二维码、公式等多种通用场景,提供全球50+主流语言的印刷体、手写体的高精度识别能力。可用于纸质文档电子化、办公文档/报表识别、教育类文本识别、快递面单识别等场景。
产品功能
通用文字识别
通过前沿的深度学习技术,对各种表格,图片,文档、证件、面单等多种通用场景进行快速、精准的检测和识别,支持简体中文/繁体中文/英文/数字/西欧主流语言/东欧主流语言等共52种语言,同时支持印刷体、手写体、倾斜、折叠、旋转等。
通用表格识别
支持识别图片/PDF格式文档中的表格内容,包括有线表格、无线表格、合并单元格表格,同时支持单张图片内的多个表格内容识别,返回各表格的表头表尾内容、单元格文字内容及其行列位置信息。
印章检测识别
支持检测并识别多行业合同文件和票据中的印章,结构化返回票据等样本上单个/多个印章上文字,支持红章/黑章,常规印章(圆章/方章等),可控制印章切图外扩留白范围。
通用NLP信息抽取
基于自研NLP抽取技术,智能分析与抽取多页文档中的关键信息。推荐适用场景:合同/标书/保单/网页截图等各类电子文档。
办公文档识别
可对办公文档的图片版面进行分析,输出图、表、列表、文本、水印、页眉页脚、印章、公式的位置及文字,并输出分版块内容的OCR识别结果,支持52种语言,手写、印刷体混排多种场景。
二维码识别
支持识别二维码,解析出二维码包含的内容;支持一张版面多个二维码的切分解析。
产品优势
准确率高
基于海量的图片样本训练模型,支持图片中文字的自动定位和识别,针对图片模糊、倾斜、翻转等情况进行专项优化,鲁棒性强,总体识别准确率行业靠前。
服务稳定
提供高可靠性、弹性可伸缩、高并发承载的云端服务,扩展性好,算法的持续迭代优化对用户使用稳定性无影响。
能力全面
支持中英文、日语、韩语、西班牙语、法语、德语等多语言,以及阿拉伯数字、常用符号等的识别,并不断更新迭代模型,扩充支持的广度。
应用场景
纸质文档电子化
使用通用文字识别技术,助您完成大量的文档整理工作,从书籍、纸质论文、档案、PPT 课件等印刷资料,到课堂笔记、作业作文等手写内容,均可实现拍照自动识别文字,方便用户进行文本录入和文档管理,提高产品易用性和用户体验。
内容审核与管理
识别图像中的不良文字,如社交和电商等应用中的不文明内容、宣传物料中的广告用语、视频中的广告、标题与字幕等垃圾文本,提示相应风险,协助用户进行审核处理,帮助用户有效规避业务风险,及时发现违规行为,大大降低人力成本,广泛应用于电商内容治理场景。
随手拍扫描
支持快速识别路标、指示牌、广告牌、街边店铺招牌、商品包装、购物小票等生活场景中的实体文字信息,应用于地图、翻译、搜索、生活出行等移动应用中,方便用户进行文本的提取或录入,有效提升产品易用性和用户使用体验。
合同文档识别
助力企业资料批量电子化,广泛应用于司法卷宗管理、企业法务合同审核、金融/保险自动化流程等行业。












