L7 Security
API/연동 > 이미지 전자문서화
DocuOCR
RPA 자동화
이미지나 문서 속 이미지에서 문자를 추출하는 AI 기반 OCR 모듈입니다.자주 쓰는 문서 양식을 머신러닝으로 학습/분류하고, 필요한 항목만 추출해데이터베이스로 만들어 RPA(로봇 프로세스 자동화)를 실현합니다.
전처리 탑재 문자 인식
머신러닝 문서 분류
필요한 항목만 DB화
반복 업무 자동화
스캔본/사진/이미지로 된 문서는 검색도, 집계도 되지 않습니다. 결국 사람이 화면을보며 한 글자씩 옮겨 적어야 하고, 양식이 제각각이라 처리는 더 번거로워집니다.
문서를 보고 일일이 옮겨 적는 작업은시간이 오래 걸리고 오타/누락 등오류가 생기기 쉽습니다.
스캔본/사진 형태의 문서는 그대로는검색/집계/연동이 불가능해업무에 활용하기 어렵습니다.
신청서/증명서 등 문서 양식이 다양해,양식별로 사람이 직접 처리하면업무 부담이 커집니다.
DocuOCR는 이미지에서 글자만 읽는 데 그치지 않습니다. 자주 쓰는 문서양식을 머신러닝으로 학습/자동 분류하고, 양식에서 필요한 항목만 추출해데이터베이스로 만들어 RPA(로봇 프로세스 자동화)를 실현합니다.
문서 양식 머신러닝 학습
필드 추출 → DB → RPA
이미지/문서 입력
스캔/사진/문서 속 이미지
AI 기반 OCR
전처리, 글자 인식
딥러닝 문자 추출
양식 자동 분류
머신러닝 등록 양식
들어온 문서를양식에 매칭
필드 추출
필요한 항목만 추출
DB 저장/RPA 자동화
자주 쓰는 문서 양식을 학습해 두면, 같은 양식의 문서는 자동으로 분류/추출되어 사람 개입 없이 데이터가 됩니다.
전처리로 인식 정확도를 높이고, 텍스트 영역의 문자를 인식한 뒤, 딥러닝으로문자를 추출합니다. 추출된 값은 등록한 양식 항목에 매핑되어 데이터가 됩니다.
문서 인식
추출 항목 (예시)
성명, 생년월일, 주소, 신청일, 발급처
출력
데이터베이스(DB), RPA 입력값, 검수/수정
회전/흐림 등으로 변형된 이미지도 전처리 후 문자 영역을 인식해 텍스트로 추출합니다.
이미지 전처리
텍스트와 배경의 명암 대비를 조절하고, 회전된 이미지를 수평으로 보정합니다.
글자 인식
텍스트 영역의 문자를 각각 인식합니다.
OCR 완료
딥러닝 시스템이 글자를 구분해 문자를 추출합니다.
문자 인식부터 양식 학습, 데이터 추출과 검수까지 문서 디지털화의 전 과정을 지원합니다.
다양한 전처리 알고리즘이 적용된 AI OCR이이미지 속 문자를 정확하게 인식합니다.
자주 쓰는 다양한 문서를 머신러닝으로분류하고 양식으로 등록해 정형화합니다.
들어온 문서를 미리 등록해 둔 양식에자동으로 분류/매칭합니다.
양식에서 필요한 항목 영역만 OCR로인식해 데이터를 추출합니다.
추출한 판독값을 데이터베이스로 저장해검색/집계/연동이 가능하게 만듭니다.
자동 추출 결과에서 잘못 인식된 부분을직접 수정하고 다시 학습시킬 수 있습니다.
기관에서 자주 사용하는 다양한 문서를 머신러닝으로 분류/등록해 정형화하면,이후 같은 양식의 문서는 자동으로 분류/추출됩니다.
신청서/증명서 등 자주 쓰는문서를 모읍니다.
머신러닝으로 문서를 분류하고양식으로 등록합니다.
양식에서 추출할 항목의영역을 지정합니다.
같은 양식 문서는 자동으로분류/추출되어 DB로 쌓입니다.
추출한 데이터를 기존 시스템과 RPA로 연계해, 문서 입력부터 처리까지 자동화합니다.
추출된 데이터를 RPA 입력값으로 전달해반복 문서 입력 업무를 자동화합니다.
판독값을 데이터베이스로 적재해검색/집계/후속 처리에 활용합니다.
ECM/EDMS 등 문서관리 시스템과 연계해디지털화된 데이터를 보관/관리합니다.
기존 업무 시스템에 데이터를 전달해신청/접수 등 프로세스에 연결합니다.
OCR 및 데이터 추출 API를 제공해자체 시스템에 유연하게 통합할 수 있습니다.
스캐너/복합기로 입력된 문서를 곧바로인식/추출 흐름에 연결합니다.
자주 묻는 질문
Q
단순히 이미지에서 글자만 읽는 것을 넘어, 자주 쓰는 문서 양식을 머신러닝으로 학습/자동 분류하고, 양식에서 필요한 항목만 추출해 데이터베이스로 만듭니다.이를 통해 사람의 수작업 입력 없이 RPA(로봇 프로세스 자동화)를 실현합니다.
기관/기업에서 자주 사용하는 신청서/증명서 등 정형 문서를 머신러닝으로 분류/등록해 처리합니다.이미지 파일은 물론 문서 속에 삽입된 이미지에서도 문자를 추출합니다.
등록된 양식에서 OCR로 추출한 데이터를 데이터베이스나 기존 업무 시스템의 입력값으로 자동 전달해, 반복적인 문서 입력 업무를 자동화합니다.
자동 추출된 결과에서 잘못 인식된 부분은 화면에서 직접 수정할 수 있으며, 수정 내용을 다시 학습시켜 인식률을 지속적으로 높일 수 있습니다.
OCR/추출 API를 제공하여 데이터베이스, 문서관리시스템, RPA 플랫폼 등 기존 업무 환경과 연동할 수 있습니다.
도입 환경과 문서 양식에 맞춘 구성과 견적을 안내해드립니다. 무엇이든 편하게 문의해 주세요.
전화 02-6929-0505 이메일 sales@l7secu.com