Как выделить текст PDF с помощью GroupDocs.Search .NET
В этом руководстве вы узнаете как выделить текст PDF с помощью библиотеки GroupDocs.Search для .NET. Независимо от того, нужно ли вам подчеркнуть результаты поиска в PDF‑просмотрщике, создать HTML‑превью с выделенными терминами или применить пользовательские стили к различным типам файлов, эти уроки проведут вас через каждый шаг с понятными примерами на C#. К концу статьи вы сможете интегрировать надёжное выделение в любое .NET‑приложение и улучшить опыт конечного пользователя.
Быстрые ответы
- Какая библиотека добавляет выделения в PDF? GroupDocs.Search for .NET together with GroupDocs.Redaction.
- Нужна ли лицензия для продакшена? Да, требуется коммерческая лицензия; доступна бесплатная пробная версия.
- Поддерживаемые версии .NET? .NET Framework 4.5+, .NET Core 3.1+, .NET 5/6/7.
- Можно ли стилизовать выделения? Да, вы можете настроить цвет, непрозрачность и стиль подчеркивания через параметры Redaction.
- Возможна ли работа с большими файлами? GroupDocs.Search обрабатывает PDF‑файлы до 500 MB без загрузки всего файла в память.
Что такое выделение текста PDF?
Выделение текста PDF — это визуальная разметка, привлекающая внимание к определённым словам или фразам внутри PDF‑документа, обычно с помощью цветового наложения. Это помогает пользователям быстро находить результаты поиска или важную информацию в объёмных файлах. Такая техника часто используется в просмотрщиках документов и поисковых интерфейсах для улучшения навигации и эффективности работы.
Почему использовать GroupDocs.Search для выделения PDF?
GroupDocs.Search поддерживает более 30 форматов документов и может обрабатывать PDF‑файлы до 500 MB, удерживая использование памяти ниже 100 MB. Библиотека индексирует текст за миллисекунды и возвращает позиции совпадений, которые Redaction может мгновенно превратить в выделения, устраняя необходимость во внешнем OCR или сторонних инструментах.
Как GroupDocs.Search выделяет текст PDF?
SearchEngine — основной класс, который индексирует и ищет содержимое документов. Redaction — применяет визуальную разметку, такую как выделения, к документам.
Загрузите PDF с помощью SearchEngine, выполните запрос, получите координаты совпадений и передайте их в Redaction для наложения цветового слоя. Процесс состоит из двух шагов — поиск и затем редактирование — поэтому один и тот же индекс можно использовать для множества проходов выделения, что снижает нагрузку на CPU до 40 % в повторяющихся сценариях.
Доступные руководства
Выделение HTML‑терминов с помощью GroupDocs.Redaction .NET: полное руководство для разработчиков
Узнайте, как эффективно выделять термины и фразы в HTML‑документах с помощью GroupDocs.Redaction для .NET. Руководство охватывает настройку, реализацию и лучшие практики.
Выделение результатов поиска в .NET‑документах с помощью GroupDocs.Search и Redaction
Узнайте, как эффективно выделять результаты поиска в документах с помощью GroupDocs.Search и Redaction для .NET. Повышайте продуктивность с помощью надёжного поиска текста и функций выделения.
Как выделить текст в PDF с помощью GroupDocs.Redaction .NET для конвертации в HTML
Узнайте, как выделять текст в PDF‑файлах и конвертировать их в HTML‑страницы с выделениями, используя GroupDocs.Redaction в этом полном .NET‑уроке.
Дополнительные ресурсы
- документация GroupDocs.Search для .NET
- справочник API GroupDocs.Search для .NET
- Скачать GroupDocs.Search для .NET
- Форум GroupDocs.Search
- Бесплатная поддержка
- Временная лицензия
Часто задаваемые вопросы
Q: Можно ли комбинировать GroupDocs.Search с другими продуктами GroupDocs?
A: Да, вы можете соединять Search с Redaction, Viewer или Conversion API для построения сквозных конвейеров обработки документов.
Q: Работает ли выделение в PDF, защищённых паролем?
A: Абсолютно. Укажите пароль PDF при создании экземпляра SearchEngine, и библиотека расшифрует файл «на лету».
Q: Сколько одновременных поисков может обрабатывать движок?
A: Движок потокобезопасен; типичные развертывания обрабатывают 50–100 одновременных запросов на ядро процессора без деградации производительности.
Q: Можно ли экспортировать выделенные результаты в виде изображений?
A: Да, после применения выделений вы можете использовать GroupDocs.Viewer для рендеринга страниц PDF в PNG/JPEG‑изображения, сохраняющие визуальную разметку.
Q: Какой способ рекомендуется для индексации больших коллекций документов?
A: Создайте один общий файл индекса, пакетно добавляйте документы порциями по 500 и вызывайте Optimize() после каждой партии, чтобы минимизировать размер индекса.
Последнее обновление: 2026-08-20
Тестировано с: GroupDocs.Search 23.11 for .NET
Автор: GroupDocs