Volledige tekstzoekvoorbeeld in Java met GroupDocs.Search
Als je een full text search example nodig hebt die werkt met PDF’s, Word‑bestanden, spreadsheets en meer, ben je hier aan het juiste adres. Handmatig duizenden documenten scannen is een enorme bottleneck, maar GroupDocs.Search for Java automatiseert indexeren en zoeken met razendsnelle snelheid. In deze tutorial lopen we alles door wat je nodig hebt om aan de slag te gaan — van documenten toevoegen aan de index, het opstellen van boolean query java‑statements, tot het optimaliseren van de zoekprestaties voor productie‑workloads.
Snelle antwoorden
- What is full text search example? Het indexeert de ruwe tekst van elk document zodat je elk woord of elke zin direct kunt doorzoeken.
- Which library supports multiple formats? GroupDocs.Search for Java ondersteunt PDF, DOCX, XLSX, PPTX, HTML, TXT en meer dan 50 andere bestandstypen.
- How do I add documents to index? Roep de
index.add()‑methode aan met een mappad of een aangepasteDocumentFilter. - Can I run Boolean queries? Ja — combineer termen met AND, OR, NOT voor precieze resultaten.
- How do I improve performance? Gebruik incrementeel indexeren, schakel result caching in en schakel phonetic search uit tenzij nodig.
Wat is full text search example?
Een full text search example stelt je in staat om de volledige tekstuele inhoud van documenten te scannen, deze op te slaan in een efficiënte index en direct overeenkomende records op te halen. In tegenstelling tot alleen op bestandsnaam zoeken, kijkt het binnen PDF’s, Word‑documenten, spreadsheets en andere ondersteunde formaten, waardoor het ideaal is voor documentbeheersystemen, supportportalen en elke applicatie waarbij gebruikers snel informatie moeten vinden.
Waarom GroupDocs.Search for Java gebruiken?
GroupDocs.Search for Java biedt multi‑formatondersteuning voor meer dan 50 bestandstypen, waaronder PDF, DOCX, XLSX, PPTX, HTML en platte tekst. Het schaalt naar miljoenen bestanden terwijl het geheugenverbruik laag blijft door de index op schijf op te slaan. De bibliotheek bevat een geavanceerde querytaal met ingebouwde Boolean-, fuzzy- en phonetic‑zoekopdrachten, en integreert met één Maven‑dependency, zodat je binnen enkele minuten kunt beginnen met indexeren.
Vereisten
Before you begin, ensure you have:
- Java 11+ (Java 8 werkt, maar Java 11 of hoger wordt aanbevolen voor betere prestaties).
- Maven voor dependency‑beheer.
- Een GroupDocs.Search‑licentie (een gratis proeflicentiesleutel is voldoende voor ontwikkeling).
Vereiste bibliotheken en dependencies
Add the repository and dependency to your pom.xml:
<repositories>
<repository>
<id>repository.groupdocs.com</id>
<name>GroupDocs Repository</name>
<url>https://releases.groupdocs.com/search/java/</url>
</repository>
</repositories>
<dependencies>
<dependency>
<groupId>com.groupdocs</groupId>
<artifactId>groupdocs-search</artifactId>
<version>25.4</version>
</dependency>
</dependencies>
For detailed usage see the documentation.
Omgeving configuratie
- Installeer de JDK (8 of nieuwer) en configureer
JAVA_HOME. - Gebruik een IDE zoals IntelliJ IDEA of Eclipse voor gemakkelijker debuggen.
Kennisvereisten
- Basisconcepten van Java‑programmeren.
- Vertrouwdheid met de structuur van Maven’s
pom.xml.
GroupDocs.Search for Java instellen
Je kunt de bibliotheek via Maven (zoals hierboven getoond) toevoegen of de JAR handmatig downloaden.
Directe download (als je handmatige installatie verkiest)
Download het nieuwste pakket van GroupDocs.Search for Java releases.
Stappen voor licentie‑acquisitie
- Free trial – Meld je aan en ontvang een tijdelijke sleutel.
- Temporary license – Vraag een langere sleutel aan voor uitgebreid testen.
- Purchase – Upgrade naar een volledige commerciële licentie wanneer je klaar bent voor productie.
Basisinitialisatie en configuratie
Maak een indexmap op schijf aan en controleer of de bibliotheek correct wordt geladen:
import com.groupdocs.search.Index;
public class SearchSetup {
public static void main(String[] args) {
// Initialize an index in the specified directory
Index index = new Index("C:\\MyIndex");
System.out.println("GroupDocs.Search initialized!");
}
}
Pro tip: Houd de indexdirectory op een snelle SSD om de query‑latentie te minimaliseren.
Documenten toevoegen aan de index
Waarom dit belangrijk is: Zonder geïndexeerde inhoud zijn er geen zoekresultaten mogelijk. Hieronder laten we zien hoe je volledige mappen kunt toevoegen of specifieke bestandstypen kunt filteren.
Stap 1: een index maken
De Index‑klasse is de doorzoekbare container die geïndexeerde documenten op schijf opslaat.
Index index = new Index("C:\\MyIndex");
Stap 2: documenten toevoegen (add documents to index)
Je kunt alles in een map indexeren of beperken tot bepaalde extensies met behulp van een DocumentFilter.
index.add("C:\\Documents\\*.*"); // Adds all documents from the specified directory
// For specific file types, use:
index.add("C:\\Reports", new DocumentFilter() {
@Override
public boolean accept(String fileName) {
return fileName.endsWith(".pdf") || fileName.endsWith(".docx");
}
});
Uitleg:
Indexvertegenwoordigt de doorzoekbare database.add()verwerkt bestanden; de wildcard*.*pakt alle bestanden, terwijlDocumentFilterje in staat stelt de add documents to index stap fijn af te stemmen.
Een zoekopdracht uitvoeren (search documents java)
Nu de index gegevens bevat, kun je er een query op uitvoeren.
Stap 1: een query maken
String query = "GroupDocs";
Stap 2: de zoekopdracht uitvoeren
SearchResult result = index.search(query);
System.out.println("Documents found: " + result.getDocumentCount());
Uitleg:
search()voert de query uit op de index.getDocumentCount()geeft aan hoeveel documenten overeenkwamen — handig voor snelle controles.
Geavanceerde querytechnieken (boolean query java)
Voor precieze controle combineer je termen met Boolean‑logica.
Boolean‑query’s
De BooleanQuery‑klasse stelt je in staat complexe expressies op te bouwen met de AND-, OR- en NOT‑operatoren.
String booleanQuery = "GroupDocs AND Java";
SearchResult booleanResult = index.search(booleanQuery);
Phonetic‑zoekopdrachten (optioneel voor fuzzy matching)
De PhoneticSearch‑functie maakt fonetisch zoeken mogelijk voor verkeerd gespelde termen, maar voegt extra overhead toe.
index.getSettings().setPhoneticSearch(true);
Wanneer te gebruiken: Schakel phonetic search alleen in als gebruikers vaak termen verkeerd spellen; anders houd je het uitgeschakeld om de search performance te optimaliseren.
Veelvoorkomende problemen en oplossingen
| Probleem | Waarom het gebeurt | Oplossing |
|---|---|---|
| Missing documents | Onjuist bestandspad of onvoldoende rechten | Controleer het pad en geef leesrechten |
| Slow queries | Grote index zonder caching of onnodige phonetic search | Schakel caching in, schakel phonetic search uit, en overweeg de index te splitsen |
| Out‑of‑Memory errors | Indexgrootte overschrijdt JVM‑heap | Verhoog -Xmx of gebruik incrementeel indexeren |
Praktische toepassingen
GroupDocs.Search shines in real‑world scenarios:
- Content management systems – Biedt directe full‑text zoekfunctionaliteit over artikelen, PDF’s en mediabestanden.
- Customer support portals – Agenten kunnen relevante handleidingen of beleidsdocumenten in enkele seconden vinden.
- Enterprise document repositories – Zoek door contracten, rapporten en compliance‑documenten zonder data naar een aparte database te verplaatsen.
Prestatieoverwegingen
Zoekprestaties optimaliseren
- Incremental indexing: Voeg alleen gewijzigde bestanden toe of werk ze bij in plaats van de hele index opnieuw op te bouwen.
- Caching: Houd vaak gebruikte queryresultaten in het geheugen.
- Resource monitoring: Pas de JVM‑heap (
-Xmx2gof hoger) aan op basis van de indexgrootte.
Richtlijnen voor resource‑gebruik
- Bewaar de indexmap op een snelle SSD of NVMe‑schijf.
- Houd CPU en geheugen in de gaten tijdens bulk‑indexering; beperk batch‑operaties om pieken te voorkomen.
Best practices voor Java‑geheugenbeheer
- Gebruik
try‑with‑resourcesbij het werken met streams. - Nullify grote objecten na gebruik om de garbage collection te ondersteunen.
Conclusie
Je hebt nu een compleet, productie‑klaar full text search example in Java met GroupDocs.Search. Van het installeren van de bibliotheek, add documents to index, het opstellen van boolean query java‑statements, tot het optimizing search performance, elke stap is behandeld.
Volgende stappen
Verken diepere functies zoals aangepaste analyzers, synoniemdictionaries en cloud‑storage‑integratie door de officiële GroupDocs.Search Documentation te bekijken.
Veelgestelde vragen
Q: Welke bestandsformaten ondersteunt GroupDocs.Search?
A: Meer dan 50 formaten, waaronder PDF, DOCX, XLSX, PPTX, HTML, TXT en vele afbeeldingsformaten.
Q: Hoe moet ik grote datasets behandelen?
A: Splits ze in meerdere indexen, werk incrementeel bij, en schakel result caching in om de latency laag te houden.
Q: Kan GroupDocs.Search draaien in cloud‑omgevingen?
A: Ja — je kunt de indexmap wijzen naar een aangekoppelde cloud‑storage (bijv. Azure Blob, AWS S3 via een filesystem‑driver).
Q: Wat zijn de voordelen van GroupDocs.Search ten opzichte van andere bibliotheken?
A: Multi‑formatondersteuning, ingebouwde Boolean/phonetic‑query’s, en een lichtgewicht Java‑API die miljoenen documenten verwerkt met een lage geheugenvoetafdruk.
Q: Hoe los ik prestatieproblemen op?
A: Bekijk de indexinstellingen, schakel phonetic search uit indien niet nodig, en monitor JVM‑geheugen/CPU‑gebruik tijdens indexeren en zoeken.
Laatst bijgewerkt: 2026-08-15
Getest met: GroupDocs.Search 25.4
Auteur: GroupDocs
Bronnen
- Documentatie: GroupDocs.Search Documentation
- API-referentie: API Reference Guide
- Download: Latest Releases
- GitHub: Source Code on GitHub
- Ondersteuning: Forum and Community Support
- Licentie: Request a Temporary License