API·연동 › 이미지 전자문서화
이미지 전자문서화 · AI 기반 OCR · 문서 양식 자동 분류 · RPA 자동화
이미지나 문서 속 이미지에서 문자를 추출하는 AI 기반 OCR 모듈입니다. 자주 쓰는 문서 양식을 머신러닝으로 학습·분류하고, 필요한 항목만 추출해 데이터베이스로 만들어 RPA(로봇 프로세스 자동화)를 실현합니다.

왜 필요한가
스캔본·사진·이미지로 된 문서는 검색도, 집계도 되지 않습니다. 결국 사람이 화면을 보며 한 글자씩 옮겨 적어야 하고, 양식이 제각각이라 처리는 더 번거로워집니다.
문서를 보고 일일이 옮겨 적는 작업은 시간이 오래 걸리고 오타·누락 등 오류가 생기기 쉽습니다.
스캔본·사진 형태의 문서는 그대로는 검색·집계·연동이 불가능해 업무에 활용하기 어렵습니다.
신청서·증명서 등 문서 양식이 다양해, 양식별로 사람이 직접 처리하면 업무 부담이 커집니다.
핵심 차별점
읽는 것을 넘어, 분류하고 추출해 데이터로. DocuOCR는 이미지에서 글자만 읽는 데 그치지 않습니다. 자주 쓰는 문서 양식을 머신러닝으로 학습·자동 분류하고, 양식에서 필요한 항목만 추출해 데이터베이스로 만들어 RPA(로봇 프로세스 자동화)를 실현합니다.
스캔·사진·문서 속 이미지
전처리 → 글자 인식, 딥러닝 문자 추출
머신러닝 등록 양식에 자동 매칭
필요한 항목만 추출, DB 저장·RPA 자동화
자주 쓰는 문서 양식을 학습해 두면, 같은 양식의 문서는 자동으로 분류·추출되어 사람 개입 없이 데이터가 됩니다.
작동 방식
전처리로 인식 정확도를 높이고, 텍스트 영역의 문자를 인식한 뒤, 딥러닝으로 문자를 추출합니다. 추출된 값은 등록한 양식 항목에 매핑되어 데이터가 됩니다.
01
02
머신러닝 등록 양식
03
04
데이터베이스(DB) · RPA 입력값 · 검수·수정
회전·흐림 등으로 변형된 이미지도 전처리 후 문자 영역을 인식해 텍스트로 추출합니다.
주요 기능
문자 인식부터 양식 학습, 데이터 추출과 검수까지 문서 디지털화의 전 과정을 지원합니다.
다양한 전처리 알고리즘이 적용된 AI OCR이 이미지 속 문자를 정확하게 인식합니다.
자주 쓰는 다양한 문서를 머신러닝으로 분류하고 양식으로 등록해 정형화합니다.
들어온 문서를 미리 등록해 둔 양식에 자동으로 분류·매칭합니다.
양식에서 필요한 항목 영역만 OCR로 인식해 데이터를 추출합니다.
추출한 판독값을 데이터베이스로 저장해 검색·집계·연동이 가능하게 만듭니다.
자동 추출 결과에서 잘못 인식된 부분을 직접 수정하고 다시 학습시킬 수 있습니다.
문서 양식 학습
기관에서 자주 사용하는 다양한 문서를 머신러닝으로 분류·등록해 정형화하면, 이후 같은 양식의 문서는 자동으로 분류·추출됩니다.
신청서·증명서 등 자주 쓰는 문서를 모읍니다.
머신러닝으로 문서를 분류하고 양식으로 등록합니다.
양식에서 추출할 항목의 영역을 지정합니다.
같은 양식 문서는 자동 분류·추출되어 DB로 쌓입니다.
다양한 연동
추출한 데이터를 기존 시스템과 RPA로 연계해, 문서 입력부터 처리까지 자동화합니다.
추출된 데이터를 RPA 입력값으로 전달해 반복 문서 입력 업무를 자동화합니다.
판독값을 데이터베이스로 적재해 검색·집계·후속 처리에 활용합니다.
ECM·EDMS 등 문서관리 시스템과 연계해 디지털화된 데이터를 보관·관리합니다.
기존 업무 시스템에 데이터를 전달해 신청·접수 등 프로세스에 연결합니다.
OCR 및 데이터 추출 API를 제공해 자체 시스템에 유연하게 통합할 수 있습니다.
스캐너·복합기로 입력된 문서를 곧바로 인식·추출 흐름에 연결합니다.
자주 묻는 질문
단순히 이미지에서 글자만 읽는 것을 넘어, 자주 쓰는 문서 양식을 머신러닝으로 학습·자동 분류하고, 양식에서 필요한 항목만 추출해 데이터베이스로 만듭니다. 이를 통해 사람의 수작업 입력 없이 RPA(로봇 프로세스 자동화)를 실현합니다.
기관·기업에서 자주 사용하는 신청서·증명서 등 정형 문서를 머신러닝으로 분류·등록해 처리합니다. 이미지 파일은 물론 문서 속에 삽입된 이미지에서도 문자를 추출합니다.
등록된 양식에서 OCR로 추출한 데이터를 데이터베이스나 기존 업무 시스템의 입력값으로 자동 전달해, 반복적인 문서 입력 업무를 자동화합니다.
자동 추출된 결과에서 잘못 인식된 부분은 화면에서 직접 수정할 수 있으며, 수정 내용을 다시 학습시켜 인식률을 지속적으로 높일 수 있습니다.
OCR·추출 API를 제공하여 데이터베이스, 문서관리시스템, RPA 플랫폼 등 기존 업무 환경과 연동할 수 있습니다.