百度云IOCR自定义模版分类器进行文字识别(非通用文字识别)

  • 模版管理

云账号登录

访问模版管理地址:点击下面地址新建模版

百度智能云-登录icon-default.png?t=N7T8https://ai.baidu.com/iocr?castk=4819agr76c7d09971d248#/templatelist/1

  • 添加模版

如果有模版,识别效果不理想可以编辑上述模版,如果新的报表格式可以新建模版

分为两步:

参照字段:这个报表特有的特征
识别区:框选识别区域,可以调整大小,直到识别效果最优

  • 分类器训练(AI)自动根据上传标本图像自动识别模版并识别

点击编辑或者新增,选择模版,上传海量数据标本,进行模型训练

  • 模版部分 Over !

  • Java代码实现

文档地址:文字识别OCR (baidu.com)icon-default.png?t=N7T8https://ai.baidu.com/ai-doc/OCR/Ek3h7y961

工具类先可以自行下载


package com.baidu.ocr;

import com.baidu.ai.aip.utils.Base64Util;
import com.baidu.ai.aip.utils.FileUtil;
import com.baidu.ai.aip.utils.HttpUtil;


public class App 
{
    public static void main(String[] args) throws Exception
    {
        /**
         * 重要提示代码中所需工具类
         * FileUtil,Base64Util,HttpUtil,GsonUtils请从
         * https://ai.baidu.com/file/658A35ABAB2D404FBF903F64D47C1F72
         * https://ai.baidu.com/file/C8D81F3301E24D2892968F09AE1AD6E2
         * https://ai.baidu.com/file/544D677F5D4E4F17B4122FBD60DB82B3
         * https://ai.baidu.com/file/470B3ACCA3FE43788B5A963BF0B625F3
         * 下载
         */
        // iocr识别apiUrl
        String recogniseUrl = "https://aip.baidubce.com/rest/2.0/solution/v1/iocr/recognise";


        String filePath = "path	oyourimage.jpg";
        try {
                byte[] imgData = FileUtil.readFileByBytes(filePath);
                String imgStr = Base64Util.encode(imgData);
                // 请求模板参数
                String recogniseParams = "templateSign=your_template_sign&image=" + URLEncoder.encode(imgStr, "UTF-8");
                // 请求分类器参数
                String classifierParams = "classifierId=your_classfier_id&image=" + URLEncoder.encode(imgStr, "UTF-8");
                
                
                String accessToken = "your_access_token";
                // 请求模板识别
                String result = HttpUtil.post(recogniseUrl, accessToken, recogniseParams);
                // 请求分类器识别
                // String result = HttpUtil.post(recogniseUrl, accessToken, classifierParams);
                
                System.out.println(result);
        } catch (Exception e) {
                e.printStackTrace();
        }
    }
}
  • 识别模式选择

如果模版少,自行维护模版,可以使用选择模版的方式进行识别,模版过多,可以使用分类器训练模型,自动根据上传的图片识别模版并识别,此为终极奥义!

最近更新

  1. docker php8.1+nginx base 镜像 dockerfile 配置

    2023-12-15 05:08:03       94 阅读
  2. Could not load dynamic library ‘cudart64_100.dll‘

    2023-12-15 05:08:03       100 阅读
  3. 在Django里面运行非项目文件

    2023-12-15 05:08:03       82 阅读
  4. Python语言-面向对象

    2023-12-15 05:08:03       91 阅读

热门阅读

  1. OpenStack命令行创建的云主机无法使用ssh登录

    2023-12-15 05:08:03       41 阅读
  2. AtCoder ABC176

    2023-12-15 05:08:03       52 阅读
  3. Electron V28主进程与渲染进程互相通信总结

    2023-12-15 05:08:03       54 阅读
  4. vue,uniapp生成二维码

    2023-12-15 05:08:03       57 阅读
  5. virtual 安装ubuntu 和 centos

    2023-12-15 05:08:03       47 阅读
  6. Redis过期淘汰策略

    2023-12-15 05:08:03       45 阅读
  7. 正则表达式入门与实践

    2023-12-15 05:08:03       56 阅读
  8. 判断某个ip是否在某个网段下

    2023-12-15 05:08:03       65 阅读
  9. 「IoT&云服务」概念整理

    2023-12-15 05:08:03       57 阅读
  10. ifconfig命令和ip命令

    2023-12-15 05:08:03       58 阅读
  11. Spring 使用 MongoDB 时的数据类型转换器

    2023-12-15 05:08:03       68 阅读
  12. Mac卸载nodejs

    2023-12-15 05:08:03       44 阅读