Full Page OCR

การใช้ REST API

Full Page OCR ใช้ OCR v2 (sync) หรือ OCR v3 action: transcribe (async) ทุกเส้นทางใช้ header X-API-Key

OCR v3 — transcribe (แนะนำเอกสารยาว)

POSThttps://backend.aksonocr.com/api/v3/ocr

ส่งเอกสาร URL, base64 หรืออัปโหลดที่ POST /api/v3/ocr/uploadจากนั้น poll GET /api/v3/ocr/:jobId และดึง GET /api/v3/ocr/:jobId/result

json
{
"action": "transcribe",
"model": "AksonOCR-preview",
"document": { "type": "image_url", "image_url": "https://example.com/doc.jpg" },
"webhookUrl": "https://example.com/hooks/ocr"
}
MethodPathหน้าที่
POST/api/v3/ocrสร้างงานจาก JSON · 202
POST/api/v3/ocr/uploadสร้างงานจากไฟล์
GET/api/v3/ocr/:jobIdสถานะ
GET/api/v3/ocr/:jobId/resultpages[].markdown เมื่อเสร็จ

OCR v2 — sync

POSThttps://backend.aksonocr.com/api/v2/ocr

ผลในคำตอบเดียว สูงสุด 50 หน้า / 10 MB รายละเอียดฟิลด์อยู่ที่ API Reference · OCR v2

ไม่ใช่ Full Page OCR

JSON ตามฟิลด์และ bounding box อยู่ที่ Key Extraction — OCR v3 action: extractor ไม่คืนตำแหน่งบนเอกสาร