Back to blog
ReleaseOCRAksonOCR 1.5Document AIBounding BoxesRelease

AksonOCR 1.5: Faster, More Precise Document Intelligence

AksonOCR 1.5 brings faster inference, stronger document understanding, bounding box support, and improved extraction for complex tables and real-world documents.

Aug 18, 2026 · 5 min read

ทุกวันนี้ โซลูชัน OCR จากต่างประเทศหลายตัวยังไม่ตอบโจทย์เอกสารภาษาไทยจริงจัง ไม่ว่าจะเป็นข้อความไทยปนอังกฤษ ตัวเลขไทย ๐ – ๙ ตารางราชการที่ซับซ้อน หรือเอกสารถ่ายจากมือถือที่ภาพเอียงและยับ ทำให้เวลานำไปต่อยอดกับ RAG หรือระบบ document processing แล้วข้อมูลเพี้ยน และต้องใช้เวลาตรวจสอบแก้ไขเพิ่มเติม

AksonOCR 1.5 ถูกออกแบบมาเพื่อแก้ปัญหาพวกนี้โดยเฉพาะ ด้วยสถาปัตยกรรมแบบ Hybrid Mixture-of-Architecture (MoA) ที่ผสาน CNN/DNN เฉพาะทางเข้ากับ Transformer/LLM ช่วยให้โมเดลอ่านเอกสารได้ทั้งความแม่นยำและความยืดหยุ่น ลดอาการ hallucination หรือการแต่งข้อมูลที่ไม่มีในเอกสารได้อย่างชัดเจน เหมาะกับงานที่ต้องการความถูกต้องระดับใช้งานจริง

ตอนนี้เปิดให้ ทดลองใช้ฟรีผ่าน API แล้ว หากต้องการ deploy แบบ on-premise หรือ on-cloud สำหรับองค์กร ติดต่อทีมได้เลยที่ [email protected]

ด้วยความเร็วเพียง 1.63 วินาที/หน้า โมเดลนี้เหมาะมากกับงาน RAG, document processing, invoice parsing, form extraction หรืองานที่ต้องดึงข้อมูลจากเอกสารจำนวนมาก โดยยังได้โครงสร้างข้อมูลที่เอาไปใช้ต่อได้ทันที

Highlight

  • รองรับ Bounding box สำหรับข้อความ ตาราง รูปภาพ แผนภูมิ และองค์ประกอบอื่น ๆ ในเอกสาร
  • ลด Hallucination และใช้ token อย่างมีประสิทธิภาพ ทำให้ผลลัพธ์น่าเชื่อถือและประหยัดค่าใช้จ่าย
  • Inference เร็วขึ้น ทั้ง latency และ throughput ดีขึ้น
  • Image dewarping แก้ภาพเอกสารที่ถ่ายมุมเอียง โค้ง หรือยับ ให้กลับมาตรงก่อนประมวลผล

Benchmark performance

จากผลการทดสอบ AksonOCR 1.5 ทำคะแนน 64.51 บน MDPBench และ 83.50 บน ThaiOCRBench และประมวลผลเอกสาร 1 หน้าในประมาณ 1.63 วินาที

Bounding box ระบุตำแหน่งเนื้อหาได้แม่นยำ

Bounding box ช่วยเชื่อมข้อความที่สกัดได้เข้ากับตำแหน่งจริงบนหน้าเอกสาร นำไปใช้ทำ highlighting, ตรวจสอบความถูกต้อง, เลือกประมวลผลซ้ำเฉพาะจุด หรือค้นหาแบบ layout-aware ได้

การอ่านแผนภูมิ (Chart Parsing)

AksonOCR 1.5 อ่านแผนภูมิและหน้าอินโฟกราฟิกพร้อมข้อความโดยรอบได้ รู้จักป้ายชื่อและตัวเลขภาษาไทยในกราฟแท่ง แผนภูมิวงกลม แผนที่ และอินโฟกราฟิก รวมถึงหน่วยบาท เปอร์เซ็นต์ ล้าน และพันล้าน

เอกสารราชการไทย

เอกสารราชการมักมีภาษาไทยทางการ ตารางแน่น และตัวเลขไทย ๐–๙ จำนวนมาก AksonOCR 1.5 รักษาค่าตัวเลขเหล่านี้ไว้ครบ และยังจับคู่กับป้ายกำกับ แถว คอลัมน์ได้ถูกต้อง เหมาะกับผลเลือกตั้ง สถิติสาธารณะ งบประมาณ และแบบฟอร์มราชการ

ตัวอย่างเอกสารเพิ่มเติม

Image dewarping แก้ภาพเอียงและบิดเบี้ยวก่อนสกัดข้อความ ช่วยกู้ตารางจากเอกสารที่ถ่ายด้วยมือถือ

Formula recognition การอ่านสูตรคณิตศาสตร์ คงรูปสมการและสัญลักษณ์ทางคณิตศาสตร์จากหนังสือเรียนและเอกสารเทคนิคที่สแกนมา

Receipt extraction การสกัดใบเสร็จ ดึงข้อมูลร้านค้า รายการสินค้า VAT ยอดรวม วันที่ และข้อมูลสมาชิกจากใบเสร็จที่ถ่ายรูป

ตารางและเอกสารจริงที่ดีขึ้น

โมเดลรักษาโครงสร้างของใบเสร็จ ตารางการเงิน หน้าเอกสารที่เขียนด้วยลายมือ และเอกสารหลายภาษา พร้อมปรับปรุงลำดับการอ่านและคุณภาพการสกัดให้ดีขึ้น

ทดลองใช้ AksonOCR 1.5

ใน Playground ให้อัปโหลดเอกสาร เลือกโมเดล แล้วเปิด Chart Parsing, Infographic mode, Table Row Bboxes, Extract Links หรือ New Block Types ตามต้องการ

เริ่มต้นใช้งานได้ที่:

Via API ระบบจะคืน request_id ก่อน แล้วจึงเรียกดูผลลัพธ์ภายหลัง:

curl -X POST "https://backend.aksonocr.com/api/v1/document-parse" \
  -H "X-API-Key: YOUR_API_KEY" \
  -H "Idempotency-Key: unique-request-id" \
  -F "[email protected]" \
  -F "mode=accurate" \
  -F "parse_charts=true" \
  -F "parse_images=true"

ตรวจสอบผลลัพธ์ด้วย request_id ที่ได้รับ:

curl "https://backend.aksonocr.com/api/v1/document-parse/REQUEST_ID" \
  -H "X-API-Key: YOUR_API_KEY"

AksonOCR 1.5 เปลี่ยนเอกสารที่ซับซ้อนให้เป็นข้อมูลที่เร็วขึ้น น่าเชื่อถือขึ้น และมีโครงสร้างพร้อมใช้

Share this article

AksonOCR 1.5: Faster, More Precise Document Intelligence | AksonOCR