ParkAppsHouse IDC도구

PDF

PDF 글자 인식

스캔본에서 글자 뽑기

엔드포인트

POST/api/v1/tools/pdf-ocr
화면에서 사용해 보기

입력

filesfile[]필수
1개
형식pdf · jpg · jpeg · png · tif · tiff

옵션

langstring (enum)기본값 kor+eng
언어kor+eng · kor · eng
outputstring (enum)기본값 pdf
결과pdf · txt

결과

files 로 답합니다. 결과가 두 개 이상이면 zip 하나로 묶이고, 보관 시간이 지나면 내려받을 수 없습니다.

서버 조건

이 도구는 tesseract 가 있어야 동작합니다. 지금 서버에서는 사용할 수 있습니다.

요청
curl -X POST https://utils.pah.kr/api/v1/tools/pdf-ocr \
  -F "files=@a.pdf" \
  -F "lang=kor+eng" \
  -F "output=pdf"
응답
{
  "ok": true,
  "tool": "pdf-ocr",
  "note": "처리 결과 요약",
  "files": [
    {
      "name": "result.pdf",
      "size": 128000,
      "url": "https://utils.pah.kr/api/v1/files/{token}/result.pdf"
    }
  ],
  "expiresAt": "2026-09-14T12:30:00.000Z"
}
MCP
{
  "name": "pdf_ocr",
  "arguments": {
    "files": [
      "/path/to/a.pdf"
    ],
    "lang": "kor+eng",
    "output": "pdf"
  }
}