วิธีใช้ OCR กับ GroupDocs.Parser Java
คุณกำลังมองหาวิธีที่มีประสิทธิภาพในการดึงข้อความจากภาพหรือเอกสารที่สแกนหรือไม่? How to use OCR กับไลบรารี GroupDocs.Parser สำหรับ Java ให้โซลูชันที่แข็งแกร่ง ช่วยให้คุณรวม Optical Character Recognition (OCR) เข้าไปในแอปพลิเคชันของคุณได้อย่างราบรื่น คู่มือฉบับสมบูรณ์นี้จะพาคุณผ่านขั้นตอนการดึงพื้นที่ข้อความจากไฟล์ภาพโดยใช้ Aspose OCR connector กับ GroupDocs.Parser ใน Java เพื่อเพิ่มศักยภาพการประมวลผลเอกสารของคุณ
สิ่งที่คุณจะได้เรียนรู้
- การตั้งค่าและการใช้ GroupDocs.Parser สำหรับ Java
- การเริ่มต้น
ParserSettingsพร้อม OCR connector - เทคนิคการดึงพื้นที่ข้อความจากภาพโดยใช้เทคโนโลยี Aspose OCR
- การประยุกต์ใช้คุณลักษณะนี้ในสถานการณ์จริง เช่น การแปลง java image to text และการดึงตำแหน่งข้อความใน Java
คำตอบอย่างรวดเร็ว
- “how to use OCR” หมายถึงอะไร? หมายถึงการผสานเครื่องมือ OCR เพื่ออ่านข้อความจากไฟล์ที่เป็นภาพ
- ไลบรารีใดให้ OCR สำหรับ Java? GroupDocs.Parser ร่วมกับ Aspose OCR connector
- ต้องมีลิขสิทธิ์หรือไม่? มีรุ่นทดลองฟรี; ต้องมีลิขสิทธิ์ถาวรสำหรับการใช้งานในโปรดักชัน
- สามารถรับพิกัดข้อความได้หรือไม่? ได้, API จะคืนตำแหน่งพื้นที่ข้อความ (left, top, width, height)
- ต้องใช้ Java เวอร์ชันใด? แนะนำ Java 8 หรือใหม่กว่า
OCR Text Extraction คืออะไร?
Optical Character Recognition (OCR) แปลงข้อความที่มองเห็นได้—เช่นในภาพสแกน, PDF, หรือรูปถ่าย—ให้เป็นอักขระที่เครื่องคอมพิวเตอร์อ่านได้ เมื่อคุณ how to use OCR ใน Java คุณจะทำให้แอปพลิเคชันของคุณสามารถค้นหา, แก้ไข, และวิเคราะห์เอกสารที่เคยเป็นแบบคงที่ได้
ทำไมต้องใช้ GroupDocs.Parser สำหรับ OCR?
- Unified API – รองรับ PDF, ภาพ, และรูปแบบอื่น ๆ มากมายด้วยโค้ดฐานเดียว
- Accurate Recognition – ใช้พลังของ Aspose OCR ที่สนับสนุนหลายภาษาและหลายฟอนต์
- Position Data – ดึงพิกัดที่แม่นยำของแต่ละบล็อกข้อความ เหมาะสำหรับการประมวลผลที่คำนึงถึงเลย์เอาต์
- Scalable – ทำงานกับภาพขนาดเล็กหรืองานแบชขนาดใหญ่ได้ ทั้งแบบติดตั้งในเครื่องหรือบนคลาวด์
ข้อกำหนดเบื้องต้น
ก่อนเริ่ม โปรดตรวจสอบว่าคุณมีสิ่งต่อไปนี้:
ไลบรารีและการพึ่งพาที่จำเป็น
- GroupDocs.Parser for Java: เวอร์ชัน 25.5 หรือใหม่กว่า
- Maven หรือการดาวน์โหลดโดยตรงสำหรับการติดตั้งไลบรารี
- Aspose OCR Connector: จำเป็นต้องเข้าถึงเทคโนโลยี OCR ของ Aspose
ความต้องการการตั้งค่าสภาพแวดล้อม
- IDE ที่รองรับ (IntelliJ IDEA, Eclipse ฯลฯ) ที่ทำงานบน Java 8+
- มี Maven ติดตั้งไว้หากคุณเลือกใช้วิธี Maven repository
ความรู้พื้นฐานที่ต้องมี
- ทักษะการเขียนโปรแกรม Java เบื้องต้น
- ความคุ้นเคยกับการจัดการ dependencies ของโปรเจกต์
การตั้งค่า GroupDocs.Parser สำหรับ Java
คุณสามารถเพิ่มไลบรารีผ่าน Maven หรือดาวน์โหลดโดยตรง
ใช้ Maven
เพิ่มการกำหนดค่าต่อไปนี้ในไฟล์ pom.xml ของคุณ:
<repositories>
<repository>
<id>repository.groupdocs.com</id>
<name>GroupDocs Repository</name>
<url>https://releases.groupdocs.com/parser/java/</url>
</repository>
</repositories>
<dependencies>
<dependency>
<groupId>com.groupdocs</groupId>
<artifactId>groupdocs-parser</artifactId>
<version>25.5</version>
</dependency>
</dependencies>
ดาวน์โหลดโดยตรง
หรือดาวน์โหลดเวอร์ชันล่าสุดจาก GroupDocs.Parser for Java releases
ขั้นตอนการรับลิขสิทธิ์
- Free Trial – ทดลองใช้ไลบรารีโดยไม่เสียค่าใช้จ่าย
- Temporary License – ใช้คีย์ที่มีอายุจำกัดสำหรับการทดสอบต่อเนื่อง
- Purchase – ซื้อไลขสิทธิ์เต็มเพื่อการใช้งานในโปรดักชัน
การเริ่มต้นและตั้งค่าเบื้องต้น
เมื่อไลบรารีพร้อมใช้งาน คุณสามารถเริ่มต้น parser ได้ โค้ด Java ด้านล่างเป็นตัวอย่างการสร้างอินสแตนซ์ ParserSettings พร้อม Aspose OCR connector:
import com.groupdocs.parser.Parser;
import com.groupdocs.parser.options.ParserSettings;
import com.groupdocs.parser.ocr.AsposeOcrOnPremise;
ParserSettings settings = new ParserSettings(new AsposeOcrOnPremise());
เมื่อพื้นฐานเรียบร้อยแล้ว เราจะไปสู่การดึงพื้นที่ข้อความด้วย OCR
วิธีดึงพื้นที่ข้อความด้วย OCR (ขั้นตอน‑ตาม‑ขั้นตอน)
1. เริ่มต้น ParserSettings ด้วย OCR Connector
OCR connector จะทำให้สามารถจดจำข้อความในเอกสารที่มีเฉพาะภาพได้
// Initialize ParserSettings with OCR Connector
ParserSettings settings = new ParserSettings(new AsposeOcrOnPremise());
2. เปิดเอกสารและกำหนดตัวเลือกการดึงข้อมูล
เราใช้ PageTextAreaOptions เพื่อบอก parser ให้คืนข้อมูลตำแหน่งของแต่ละคำที่จดจำได้
try (Parser parser = new Parser("YOUR_DOCUMENT_DIRECTORY", settings)) {
// Configure PageTextAreaOptions for OCR processing
PageTextAreaOptions options = new PageTextAreaOptions(true);
// Extract text areas from the document
java.lang.Iterable<PageTextArea> areas = parser.getTextAreas(options);
if (areas == null) {
return; // Exit if text areas extraction is not supported
}
for (PageTextArea a : areas) {
String text = a.getText();
int leftPosition = a.getRectangle().getLeft();
int topPosition = a.getRectangle().getTop();
int width = a.getRectangle().getSize().getWidth();
int height = a.getRectangle().getSize().getHeight();
// Process the extracted data as needed
}
} catch (java.lang.Exception ex) {
// Handle any exceptions that occur during processing
}
สิ่งที่โค้ดนี้ทำ
- Creates อินสแตนซ์
Parserที่ชี้ไปยังโฟลเดอร์เอกสารของคุณ - Enables OCR ผ่าน
PageTextAreaOptions(true) - Iterates ผ่านแต่ละ
PageTextAreaให้คุณได้ข้อความที่จดจำ และ สี่เหลี่ยมผืนผ้าตำแหน่งที่แม่นยำ (ตำแหน่งและขนาด) - Allows คุณเก็บหรือจัดการข้อมูล เช่น ใส่ลงฐานข้อมูลหรือวางซ้อนบน UI
3. ประมวลผลผลลัพธ์
คุณสามารถใช้ข้อความและพิกัดที่ดึงมาได้ในหลายสถานการณ์:
- Document Digitization – แปลงสัญญาที่สแกนเป็น PDF ที่ค้นหาได้
- Data Entry Automation – ดึงฟิลด์เช่นหมายเลขใบแจ้งหนี้โดยตรงจากรูปใบเสร็จ
- Content Management – ทำดัชนีตำแหน่งข้อความเพื่อการไฮไลท์การค้นหาขั้นสูง
ปัญหาที่พบบ่อยและวิธีแก้
| Symptom | Likely Cause | Fix |
|---|---|---|
| No text areas returned | OCR connector not configured or image path incorrect | Verify the AsposeOcrOnPremise instance is correctly licensed and the file path is accessible. |
| Garbled characters | Image quality is low or language not supported | Use higher‑resolution scans and configure the OCR language pack. |
| Out‑of‑memory errors on large PDFs | Processing many high‑resolution pages at once | Process pages in batches or enable streaming mode (ParserSettings.setEnableStreaming(true)). |
คำถามที่พบบ่อย
Q: จะติดตั้ง GroupDocs.Parser สำหรับ Java อย่างไร?
A: เพิ่มเป็น dependency ของ Maven (ดู XML snippet ด้านบน) หรือดาวน์โหลดโดยตรงจากหน้า releases อย่างเป็นทางการ
Q: Aspose OCR คืออะไร และทำไมต้องใช้ร่วมกับ GroupDocs.Parser?
A: Aspose OCR เป็นเอนจินจดจำข้อความที่มีความแม่นยำสูง การใช้ร่วมกับ GroupDocs.Parser จะขยายความสามารถของ parser ให้รองรับไฟล์ที่เป็นภาพเท่านั้นและให้ตำแหน่งข้อความที่แม่นยำ
Q: สามารถประมวลผลหลายรูปแบบภาพได้หรือไม่?
A: ได้. GroupDocs.Parser รองรับ JPEG, PNG, BMP, TIFF และอื่น ๆ — เพียงตรวจสอบให้ OCR connector รองรับรูปแบบนั้น
Q: ถ้าไม่มีการดึงพื้นที่ข้อความออกมา ควรทำอย่างไร?
A: ตรวจสอบเส้นทางไฟล์, ยืนยันว่า OCR connector มีลิขสิทธิ์, และตรวจสอบว่าเอกสารเป็นประเภทที่ Aspose OCR รองรับ
Q: จะหาแหล่งข้อมูลเพิ่มเติมเกี่ยวกับ GroupDocs.Parser ได้จากที่ไหน?
A: เยี่ยมชม GroupDocs Documentation สำหรับคู่มือโดยละเอียดและอ้างอิง API
แหล่งข้อมูล
- Documentation
- API Reference
- Download Latest Version
- GitHub Repository
- Free Support Forum
- Temporary License
สำรวจแหล่งข้อมูลเหล่านี้เพื่อเพิ่มพูนความเข้าใจและขยายศักยภาพของ GroupDocs.Parser ในโครงการของคุณ
Last Updated: 2026-02-09
Tested With: GroupDocs.Parser 25.5 for Java
Author: GroupDocs