PDF 글자 인식
스캔본에서 글자 뽑기
엔드포인트
POST/api/v1/tools/pdf-ocr
화면에서 사용해 보기입력
filesfile[]필수1개
형식pdf · jpg · jpeg · png · tif · tiff옵션
langstring (enum)기본값 kor+eng언어kor+eng · kor · eng
outputstring (enum)기본값 pdf결과pdf · txt
결과
files 로 답합니다. 결과가 두 개 이상이면 zip 하나로 묶이고, 보관 시간이 지나면 내려받을 수 없습니다.
서버 조건
이 도구는 tesseract 가 있어야 동작합니다. 지금 서버에서는 사용할 수 있습니다.
요청
curl -X POST https://utils.pah.kr/api/v1/tools/pdf-ocr \
-F "files=@a.pdf" \
-F "lang=kor+eng" \
-F "output=pdf"응답
{
"ok": true,
"tool": "pdf-ocr",
"note": "처리 결과 요약",
"files": [
{
"name": "result.pdf",
"size": 128000,
"url": "https://utils.pah.kr/api/v1/files/{token}/result.pdf"
}
],
"expiresAt": "2026-09-14T12:30:00.000Z"
}MCP
{
"name": "pdf_ocr",
"arguments": {
"files": [
"/path/to/a.pdf"
],
"lang": "kor+eng",
"output": "pdf"
}
}