Skip to main content

L7 Security (local)

GS인증 1등급! ImageOCR 및 스캔/마스킹 솔루션
도입 상담 신청

API·연동  ›  이미지 전자문서화

이미지 전자문서화 · AI 기반 OCR · 문서 양식 자동 분류 · RPA 자동화

사람이 옮겨 적던 문서,
이제 AI가 데이터로 만듭니다DocuOCR

이미지나 문서 속 이미지에서 문자를 추출하는 AI 기반 OCR 모듈입니다. 자주 쓰는 문서 양식을 머신러닝으로 학습·분류하고, 필요한 항목만 추출해 데이터베이스로 만들어 RPA(로봇 프로세스 자동화)를 실현합니다.

DocuOCR 이미지 전자문서화 RPA
AI OCR전처리 탑재 문자 인식
양식 학습머신러닝 문서 분류
필드 추출필요한 항목만 DB화
RPA반복 업무 자동화

왜 필요한가

문서는 쌓이는데, 데이터가 되지 않습니다

스캔본·사진·이미지로 된 문서는 검색도, 집계도 되지 않습니다. 결국 사람이 화면을 보며 한 글자씩 옮겨 적어야 하고, 양식이 제각각이라 처리는 더 번거로워집니다.

수작업 입력의 한계

문서를 보고 일일이 옮겨 적는 작업은 시간이 오래 걸리고 오타·누락 등 오류가 생기기 쉽습니다.

이미지는 데이터가 아니다

스캔본·사진 형태의 문서는 그대로는 검색·집계·연동이 불가능해 업무에 활용하기 어렵습니다.

양식마다 제각각

신청서·증명서 등 문서 양식이 다양해, 양식별로 사람이 직접 처리하면 업무 부담이 커집니다.

핵심 차별점

단순 OCR이 아니라, 업무를 자동화합니다

읽는 것을 넘어, 분류하고 추출해 데이터로. DocuOCR는 이미지에서 글자만 읽는 데 그치지 않습니다. 자주 쓰는 문서 양식을 머신러닝으로 학습·자동 분류하고, 양식에서 필요한 항목만 추출해 데이터베이스로 만들어 RPA(로봇 프로세스 자동화)를 실현합니다.

1

이미지·문서 입력

스캔·사진·문서 속 이미지

2

AI 기반 OCR

전처리 → 글자 인식, 딥러닝 문자 추출

3

양식 자동 분류

머신러닝 등록 양식에 자동 매칭

4

필드 추출

필요한 항목만 추출, DB 저장·RPA 자동화

자주 쓰는 문서 양식을 학습해 두면, 같은 양식의 문서는 자동으로 분류·추출되어 사람 개입 없이 데이터가 됩니다.

작동 방식

이미지를 구조화된 데이터로

전처리로 인식 정확도를 높이고, 텍스트 영역의 문자를 인식한 뒤, 딥러닝으로 문자를 추출합니다. 추출된 값은 등록한 양식 항목에 매핑되어 데이터가 됩니다.

01

문서 인식

02

양식 자동 분류

머신러닝 등록 양식

03

추출 항목 (예시)

성명생년월일주소신청일발급처

04

출력

데이터베이스(DB) · RPA 입력값 · 검수·수정

이미지 속 텍스트 추출 프로세스

회전·흐림 등으로 변형된 이미지도 전처리 후 문자 영역을 인식해 텍스트로 추출합니다.

이미지 전처리
텍스트와 배경의 명암 대비를 조절하고, 회전된 이미지를 수평으로 보정합니다.
글자 인식
텍스트 영역의 문자를 각각 인식합니다.
OCR 완료
딥러닝 시스템이 글자를 구분해 문자를 추출합니다.

주요 기능

읽고, 분류하고, 추출합니다

문자 인식부터 양식 학습, 데이터 추출과 검수까지 문서 디지털화의 전 과정을 지원합니다.

AI 기반 OCR

다양한 전처리 알고리즘이 적용된 AI OCR이 이미지 속 문자를 정확하게 인식합니다.

문서 양식 등록·학습

자주 쓰는 다양한 문서를 머신러닝으로 분류하고 양식으로 등록해 정형화합니다.

자동 양식 분류

들어온 문서를 미리 등록해 둔 양식에 자동으로 분류·매칭합니다.

특정 영역 데이터 추출

양식에서 필요한 항목 영역만 OCR로 인식해 데이터를 추출합니다.

데이터베이스화

추출한 판독값을 데이터베이스로 저장해 검색·집계·연동이 가능하게 만듭니다.

오탐 수동 수정

자동 추출 결과에서 잘못 인식된 부분을 직접 수정하고 다시 학습시킬 수 있습니다.

문서 양식 학습

자주 쓰는 문서를 양식으로 학습합니다

기관에서 자주 사용하는 다양한 문서를 머신러닝으로 분류·등록해 정형화하면, 이후 같은 양식의 문서는 자동으로 분류·추출됩니다.

1

문서 수집

신청서·증명서 등 자주 쓰는 문서를 모읍니다.

2

양식 분류·등록

머신러닝으로 문서를 분류하고 양식으로 등록합니다.

3

추출 영역 지정

양식에서 추출할 항목의 영역을 지정합니다.

4

자동 추출

같은 양식 문서는 자동 분류·추출되어 DB로 쌓입니다.

다양한 연동

기존 업무 시스템과 자연스럽게 연결됩니다

추출한 데이터를 기존 시스템과 RPA로 연계해, 문서 입력부터 처리까지 자동화합니다.

RPA 플랫폼 연동

추출된 데이터를 RPA 입력값으로 전달해 반복 문서 입력 업무를 자동화합니다.

데이터베이스(DB)

판독값을 데이터베이스로 적재해 검색·집계·후속 처리에 활용합니다.

문서관리시스템

ECM·EDMS 등 문서관리 시스템과 연계해 디지털화된 데이터를 보관·관리합니다.

업무 시스템(ERP·그룹웨어)

기존 업무 시스템에 데이터를 전달해 신청·접수 등 프로세스에 연결합니다.

OCR·추출 API 제공

OCR 및 데이터 추출 API를 제공해 자체 시스템에 유연하게 통합할 수 있습니다.

스캐너·복합기 연계

스캐너·복합기로 입력된 문서를 곧바로 인식·추출 흐름에 연결합니다.

자주 묻는 질문

FAQ

DocuOCR은 일반 OCR과 무엇이 다른가요?

단순히 이미지에서 글자만 읽는 것을 넘어, 자주 쓰는 문서 양식을 머신러닝으로 학습·자동 분류하고, 양식에서 필요한 항목만 추출해 데이터베이스로 만듭니다. 이를 통해 사람의 수작업 입력 없이 RPA(로봇 프로세스 자동화)를 실현합니다.

어떤 문서를 처리할 수 있나요?

기관·기업에서 자주 사용하는 신청서·증명서 등 정형 문서를 머신러닝으로 분류·등록해 처리합니다. 이미지 파일은 물론 문서 속에 삽입된 이미지에서도 문자를 추출합니다.

RPA는 어떻게 실현되나요?

등록된 양식에서 OCR로 추출한 데이터를 데이터베이스나 기존 업무 시스템의 입력값으로 자동 전달해, 반복적인 문서 입력 업무를 자동화합니다.

인식 오류(오탐)는 어떻게 처리하나요?

자동 추출된 결과에서 잘못 인식된 부분은 화면에서 직접 수정할 수 있으며, 수정 내용을 다시 학습시켜 인식률을 지속적으로 높일 수 있습니다.

기존 시스템과 연동할 수 있나요?

OCR·추출 API를 제공하여 데이터베이스, 문서관리시스템, RPA 플랫폼 등 기존 업무 환경과 연동할 수 있습니다.

문서를 데이터로, 업무를 자동화하세요

도입 환경과 문서 양식에 맞춘 구성과 견적을 안내해 드립니다. 무엇이든 편하게 문의해 주세요.