Java teljes szöveges keresés: index építése a GroupDocs.Search segítségével
Gyors válaszok
- Mi az a “java full text search”? Ez a folyamat, amely indexet épít, lehetővé téve a gyors szöveges lekérdezéseket sok fájlban egy Java alkalmazásban.
- Melyik könyvtár kezeli ezt alapból? A GroupDocs.Search for Java kész indexelést, szótárkezelést és lekérdezés végrehajtást biztosít.
- Szükségem van licencre? Egy ingyenes próba verzió tökéletes az értékeléshez; teljes licenc szükséges a termelési környezethez.
- Testreszabhatom a karakterkezelést? Természetesen—használja az ábécé szótárat egyedi karaktertípusok meghatározásához.
- Kötelező a Maven? A Maven egyszerűsíti a függőségek kezelését, de a JAR-t is letöltheti közvetlenül.
Mi az a java teljes szöveges keresés és miért kell kezelni egy ábécé szótárat?
A java full text search index tokenizált reprezentációkat tárol a dokumentumokról, lehetővé téve a szavak vagy kifejezések azonnali keresését. Az ábécé szótár megmondja a motornak, hogyan kezelje az egyes karaktereket (betű, szám, szimbólum), ami közvetlenül befolyásolja a tokenizálást és a keresés relevanciáját—különösen speciális szimbólumok vagy nyelvspecifikus szabályok esetén.
Miért használjuk a GroupDocs.Search-t java teljes szöveges kereséshez?
GroupDocs.Search akár 10 000 dokumentumot képes feldolgozni anélkül, hogy teljes egészében a memóriába töltené őket, alulmásodperces lekérdezési időt biztosítva. Teljes kontrollt nyújt a karaktertípusok felett, támogat 50+ bemeneti és kimeneti formátumot, és horizontálisan skálázható több szerveren, így az vállalati szintű keresés legrobosztusabb választása.
Előfeltételek
- GroupDocs.Search for Java (legújabb kiadás).
- Java 17 vagy újabb telepítve a fejlesztői gépén.
- Maven 3.6+ (vagy a lehetőség, hogy manuálisan hozzáadjon egy JAR-t).
Szükséges könyvtárak, verziók és függőségek
- GroupDocs.Search for Java – legújabb stabil verzió.
- Alap indexeléshez nincs szükség további harmadik fél könyvtárakra.
Környezet beállítási követelmények
Győződjön meg róla, hogy Maven‑kompatibilis környezete van. Ha a Maven még nincs telepítve, töltse le a hivatalos oldalról: Apache Maven.
Tudás előfeltételek
Java szintaxis és fájl I/O ismerete segíthet, de az alábbi lépésről‑lépésre útmutató mindent lefed, amire szüksége van.
A GroupDocs.Search for Java beállítása
Maven konfiguráció
Add the repository and dependency to your pom.xml file:
<repositories>
<repository>
<id>repository.groupdocs.com</id>
<name>GroupDocs Repository</name>
<url>https://releases.groupdocs.com/search/java/</url>
</repository>
</repositories>
<dependencies>
<dependency>
<groupId>com.groupdocs</groupId>
<artifactId>groupdocs-search</artifactId>
<version>25.4</version>
</dependency>
</dependencies>
Közvetlen letöltés
If you prefer not to use Maven, grab the latest JAR from the official releases page: GroupDocs.Search for Java kiadások.
Licenc beszerzési lépések
- Ingyenes próba – Kezdje egy próbaverzióval, hogy felfedezze az összes funkciót.
- Ideiglenes licenc – Kérjen ideiglenes kulcsot a kiterjesztett teszteléshez.
- Teljes licenc – Vásároljon termelési licencet korlátlan használathoz.
Alap inicializálás és beállítás
Hozzon létre egy Index példányt, amely a mappára mutat, ahol a keresési index tárolva lesz:
import com.groupdocs.search.*;
public class SearchIndexSetup {
public static void main(String[] args) {
String indexFolder = "YOUR_DOCUMENT_DIRECTORY\\Index";
Index index = new Index(indexFolder);
}
}
Megvalósítási útmutató
Az alábbiakban egy teljes útmutató a leggyakoribb műveletekről, amelyeket egy java teljes szöveges keresés megoldás építésekor végrehajt.
Index létrehozása vagy megnyitása
Az Index osztály a fő objektum, amely egy kereshető gyűjteményt képvisel a lemezen.
import com.groupdocs.search.*;
String indexFolder = "YOUR_DOCUMENT_DIRECTORY\\Index";
Index index = new Index(indexFolder);
- Paraméterek:
indexFolder– az útvonal, ahol az index fájlok találhatók. - Cél: Beállítja a keresési környezetet a későbbi indexeléshez és lekérdezéshez.
Az ábécé szótár exportálása fájlba
Az AlphabetDictionary objektum karakter‑típus leképezéseket tartalmaz. Exportálásával később újra felhasználhatja vagy elemezheti a konfigurációt.
import com.groupdocs.search.dictionaries.*;
String fileName = "YOUR_OUTPUT_DIRECTORY\\Alphabet.dat";
index.getDictionaries().getAlphabet().exportDictionary(fileName);
- Paraméterek:
fileName– a célfájl az exportált szótár számára.
Az ábécé szótár törlése
Állítsa vissza a szótárat az alapértelmezett állapotra, mielőtt egyedi szabályokat alkalmazna:
import com.groupdocs.search.dictionaries.*;
if (index.getDictionaries().getAlphabet().getCount() > 0) {
index.getDictionaries().getAlphabet().clear();
}
- Cél: Eltávolítja az összes korábban definiált karaktertípust, biztosítva egy tiszta alapot.
Az ábécé szótár importálása fájlból
Állítsa vissza egy korábban mentett szótár konfigurációt:
import com.groupdocs.search.dictionaries.*;
index.getDictionaries().getAlphabet().importDictionary(fileName);
- Paraméterek:
fileName– az.datfájl útvonala, amely a szótárat tartalmazza.
Karaktertípus beállítása az ábécé szótárban
A CharacterType enum meghatározza, hogyan értelmezi a motor a karaktereket a tokenizálás során. Testreszabhatja, hogyan kezeljenek bizonyos karakterek a tokenizálásnál. A CharacterType.Blended érték azt mondja a motornak, hogy a kötőjelet a szó részének tekintse, nem elválasztónak.
import com.groupdocs.search.dictionaries.*;
if (index.getDictionaries().getAlphabet().getCharacterType('-') != CharacterType.Blended) {
index.getDictionaries().getAlphabet().setRange(new char[] { '-' }, CharacterType.Blended);
}
- Paraméterek: A karakter (
'-') és az újCharacterType. - Miért fontos: A karaktertípusok módosítása javítja a keresés relevanciáját a kötőjeles kifejezések, azonosítók vagy egyedi szimbólumok esetén.
Dokumentumok indexelése mappából
Adjon hozzá minden fájlt egy könyvtárból a keresési indexhez egyetlen műveletben:
import com.groupdocs.search.*;
String documentsFolder = "YOUR_DOCUMENT_DIRECTORY";
index.add(documentsFolder);
- Paraméterek:
documentsFolder– a mappa, amely a indexelni kívánt dokumentumokat tartalmazza.
Keresés egy indexben
A SearchResult osztály tartalmazza a lekérdezés által visszaadott egyező dokumentumok és kivonatok listáját. Hajtsa végre a lekérdezést és kapja meg a megfelelő eredményeket:
import com.groupdocs.search.results.*;
String query = "Elliot-Murray-Kynynmound";
SearchResult result = index.search(query);
- Paraméterek:
query– a keresett szöveg. - Eredmény: Egy
SearchResultobjektum, amely a megtalált dokumentumokat és kivonatokat tartalmazza.
Általános felhasználási esetek java teljes szöveges kereséshez
- Tartalomkezelő rendszerek (CMS): Gyorsítja a cikkek és eszközök visszakeresését.
- Jogi dokumentum tárolók: Azonnal megtalálja a záradékokat vagy ügyhivatkozásokat.
- Kutatási könyvtárak: Több ezer dolgozatot indexel az azonnali kulcsszavas kereséshez.
- E‑kereskedelmi katalógusok: Javítja a termékkeresést egyedi tokenizálással.
- Ügyfélszolgálati portálok: Lehetővé teszi az ügynököknek, hogy gyorsan megtalálják a releváns jegyeket vagy tudásbázis cikkeket.
Teljesítmény szempontok
- Inkrementális frissítések: Csak az új vagy módosított fájlokat indexeli újra, hogy az index friss maradjon teljes újraépítés nélkül.
- Lekérdezés optimalizálás: Tartsa a lekérdezéseket tömörnek; kerülje a túl általános helyettesítő karakteres kereséseket.
- Erőforrás monitorozás: Figyelje a memóriahasználatot nagy kötegelt indexelés során—szabályozza a JVM heap méretét, ha szükséges.
- Szótár méret: Exportálja/importálja az ábécé szótárat csak akkor, amikor módosítja; a felesleges I/O lassíthatja az indítást.
Gyakran ismételt kérdések
Q: Mik a előfeltételek a GroupDocs.Search használatához?
A: Telepítse a Java 17+, Maven 3.6+ (vagy töltse le a JAR-t), és adja hozzá a GroupDocs.Search függőséget.
Q: Hogyan szerezhetek licencet termelési használathoz?
A: Kezdje egy ingyenes próba verzióval, kérjen ideiglenes kulcsot a kiterjesztett teszteléshez, majd vásároljon teljes licencet a GroupDocs portálon.
Q: Testreszabhatom a karaktertípusokat az ábécé szótárban?
A: Igen—használja a setRange vagy set metódusokat, hogy egyedi CharacterType értékeket rendeljön bármely karakterhez vagy tartományhoz.
Q: Lehet exportálni és importálni az ábécé szótárat?
A: Természetesen—használja az exportDictionary és importDictionary metódusokat a szótár konfigurációk megőrzéséhez vagy megosztásához.
Q: Melyik verzióval tesztelték ezt az útmutatót?
A: A példákat a GroupDocs.Search for Java 25.4 verzióval ellenőrizték.
Legutóbb frissítve: 2026-09-06
Tesztelve ezzel: GroupDocs.Search for Java 25.4
Szerző: GroupDocs
Kapcsolódó oktatóanyagok
- Hogyan valósítsuk meg a java teljes szöveges keresést: index könyvtár létrehozása a GroupDocs.Search segítségével
- Hogyan hozzunk létre dokumentum indexet és adjunk hozzá dokumentumokat a GroupDocs.Search API for Java segítségével
- Mesteri teljes szöveges keresés Java-ban: Log fájl kinyerő implementálása a GroupDocs-szal