MiWork
DOCUMENT INTELLIGENCE API

복잡한 문서를
AI가 이해할 수 있는 데이터로

MiWork OCR은 PDF, HWP/HWPX, Office 문서와 이미지를 분석해 페이지별로 정리된 데이터로 변환하는 문서 인텔리전스 솔루션입니다. 문서 길이에 맞는 처리 방식으로 기존 서비스에 연결할 수 있습니다.

도입 문의 지원 형식 보기
Page-based Results Sync & Async API Multiple Formats Configurable Pipeline
contract_2026.pdf · 12 pages
대기 중 변환 중 변환 완료
PAGES 1 / 12
SOURCE
table
MARKDOWN ## 제3조 계약 기간
항목내용
복사 .md 다운로드
제품 화면 예시

형식은 달라도, 활용 가능한 결과는 하나로

실제 업무 문서는 PDF, HWP, 오래된 Office 파일, 스캔 이미지처럼 서로 다른 형식으로 존재합니다. 문서마다 별도의 처리 방식을 만들면 서비스는 복잡해지고 결과 품질을 관리하기 어렵습니다. MiWork OCR은 형식에 맞는 처리 경로를 선택하고 결과를 일관된 페이지 구조로 제공합니다.

기존 문제 MIWORK OCR의 접근
파일 형식마다 별도의 파서와 OCR 연동이 필요확장자와 운영 설정에 따라 적합한 로더와 OCR 경로를 선택
긴 문서 처리 중 응답 지연과 타임아웃짧은 문서는 바로 결과를 받고, 긴 문서는 접수 후 완료 상태 확인
결과 구조가 달라 후속 서비스 연동이 복잡페이지별로 정리된 일관된 결과 제공
표 구조가 텍스트로 무너짐표를 보기 쉽게 정리하거나 원래 구조 유지
같은 파일을 반복 처리해 자원 낭비요청 fingerprint 기반 결과 재사용과 선택적 캐시 우회
CAPABILITIES

핵심 기능

01

다양한 문서 형식 처리

PDF와 이미지뿐 아니라 HWP/HWPX, Word, PowerPoint, Excel, HTML을 처리합니다.

02

페이지별로 정리된 결과

문서 내용을 페이지별로 나눠 미리보기, 복사, 검색과 후속 AI 업무에 바로 활용할 수 있게 제공합니다.

03

문서 길이에 맞춘 처리

짧은 문서는 변환 결과를 바로 받고, 오래 걸리는 문서는 먼저 접수한 뒤 진행 상태와 완료 결과를 확인할 수 있습니다.

04

표 구조 처리

표를 보기 쉬운 형태로 정리하며, 필요하면 원래 구조를 유지할 수 있습니다.

05

유연한 OCR 엔진 구성

문서 종류와 정확도·속도 요구에 맞춰 여러 인식 엔진 중에서 선택할 수 있습니다. 엔진 구성은 서비스 운영 설정으로 관리합니다.

06

안정적인 작업 처리

작업 대기열, 상태 저장, 중복 요청 재사용, 재시작 시 pending 작업 복구와 보관 기간 기반 정리 구조를 제공합니다.

HOW IT WORKS

업로드부터 활용 가능한 데이터까지

STEP 1Upload문서 또는 이미지를 업로드합니다.
STEP 2Validate확장자와 크기를 확인하고 요청별 처리 설정을 해석합니다.
STEP 3Process파일 형식과 운영 설정에 맞는 처리 엔진을 선택합니다.
STEP 4Structure인식한 내용과 표를 페이지별로 정리합니다.
STEP 5Deliver문서 길이에 맞는 방식으로 결과와 처리 상태를 제공합니다.
대기 중→ 변환 중→ 변환 완료 변환 실패 시 상태와 오류 정보를 함께 확인합니다.
SUPPORTED FORMATS

지원 형식

파일 형식과 운영 환경에 따라 처리 방식과 결과 품질은 달라질 수 있습니다. 모든 형식에서 동일한 수준의 OCR, 레이아웃 보존 또는 편집 가능성을 보장하지는 않습니다.

보유 문서 형식 검토 문의 →
문서
PDFHWPHWPXDOCDOCX
프레젠테이션
PPTPPTX
스프레드시트 및 표
XLSXLSX
이미지
PNGJPGJPEG
웹 문서
HTMLHTMXHTML
USE CASES

대표 활용 사례

  • AI 검색과 문서 활용사내 문서를 페이지별로 정리해 검색과 AI 지식 활용에 연결합니다.
  • 한글 및 레거시 문서 활용HWP/HWPX와 이전 Office 형식의 자료를 후속 시스템에서 쓸 수 있는 형태로 전환합니다.
  • 스캔 자료와 표 포함 문서이미지 기반 자료의 텍스트와 표 구조를 인식해 데이터 확인과 후속 처리에 연결합니다.
API & OPERATIONS

운영 및 연동

  • —짧은 문서는 변환이 끝나면 바로 결과 확인
  • —오래 걸리는 문서는 먼저 접수하고 진행 상태와 완료 결과 확인
  • —동시에 처리할 수 있는 작업 수와 대기·진행 중인 작업 수 확인
  • —GPU 없이 CPU만으로 구축·운영 가능
  • —GPU 환경에서는 더 높은 처리량으로 확장

CPU 전용 환경과 GPU 가속 환경 모두 지원하므로, 보유한 인프라에 맞춰 도입하고 필요할 때 확장할 수 있습니다.

자주 묻는 질문

어떤 파일을 처리할 수 있나요?+

PDF, HWP/HWPX, Word, PowerPoint, Excel, 주요 이미지 형식과 HTML을 지원합니다. 실제 처리 방식과 결과는 파일 형식과 운영 설정에 따라 달라질 수 있습니다.

결과는 어떤 형태로 제공되나요?+

문서 내용을 페이지별로 정리해 제공합니다. 표는 보기 쉬운 형태로 정리하거나 필요하면 원래 구조를 유지할 수 있습니다.

오래 걸리는 문서도 처리할 수 있나요?+

네. 짧은 문서는 변환이 끝나면 바로 결과를 확인할 수 있고, 오래 걸리는 문서는 먼저 접수한 뒤 상태를 확인해 완료 결과를 받을 수 있습니다. 세부 진행률은 제공하지 않습니다.

OCR 엔진을 선택할 수 있나요?+

문서 종류와 정확도·속도 요구에 맞춰 여러 인식 엔진 중에서 구성할 수 있습니다. GPU가 없는 CPU 전용 환경에서도 동작하며, GPU가 있으면 더 높은 처리량으로 운영할 수 있습니다. 일반 사용자가 요청마다 엔진을 선택하는 방식이 아니라 배포 환경에서 설정하는 구조입니다.

같은 문서를 다시 처리하면 어떻게 되나요?+

파일과 처리 설정이 같은 요청은 기존 작업 결과를 재사용할 수 있습니다. 새 변환이 필요하면 캐시 우회 옵션을 사용할 수 있습니다.

기존 서비스와 연동할 수 있나요?+

파일 업로드 기반 HTTP API를 제공하므로 문서 관리, 검색, AI 지식베이스와 업무 시스템의 전처리 서비스로 연결할 수 있습니다. 구체적인 연동 범위는 도입 환경을 확인해야 합니다.

쌓여 있는 문서를 활용 가능한 데이터로 바꾸세요.

보유한 문서 형식과 처리량, 운영 환경에 맞는 MiWork OCR 구성을 함께 확인해 보세요.

MiWork OCR 도입 문의 다른 솔루션 보기