Как выделить текст PDF с помощью GroupDocs.Search .NET

В этом руководстве вы узнаете как выделить текст PDF с помощью библиотеки GroupDocs.Search для .NET. Независимо от того, нужно ли вам подчеркнуть результаты поиска в PDF‑просмотрщике, создать HTML‑превью с выделенными терминами или применить пользовательские стили к различным типам файлов, эти уроки проведут вас через каждый шаг с понятными примерами на C#. К концу статьи вы сможете интегрировать надёжное выделение в любое .NET‑приложение и улучшить опыт конечного пользователя.

Быстрые ответы

  • Какая библиотека добавляет выделения в PDF? GroupDocs.Search for .NET together with GroupDocs.Redaction.
  • Нужна ли лицензия для продакшена? Да, требуется коммерческая лицензия; доступна бесплатная пробная версия.
  • Поддерживаемые версии .NET? .NET Framework 4.5+, .NET Core 3.1+, .NET 5/6/7.
  • Можно ли стилизовать выделения? Да, вы можете настроить цвет, непрозрачность и стиль подчеркивания через параметры Redaction.
  • Возможна ли работа с большими файлами? GroupDocs.Search обрабатывает PDF‑файлы до 500 MB без загрузки всего файла в память.

Что такое выделение текста PDF?

Выделение текста PDF — это визуальная разметка, привлекающая внимание к определённым словам или фразам внутри PDF‑документа, обычно с помощью цветового наложения. Это помогает пользователям быстро находить результаты поиска или важную информацию в объёмных файлах. Такая техника часто используется в просмотрщиках документов и поисковых интерфейсах для улучшения навигации и эффективности работы.

Почему использовать GroupDocs.Search для выделения PDF?

GroupDocs.Search поддерживает более 30 форматов документов и может обрабатывать PDF‑файлы до 500 MB, удерживая использование памяти ниже 100 MB. Библиотека индексирует текст за миллисекунды и возвращает позиции совпадений, которые Redaction может мгновенно превратить в выделения, устраняя необходимость во внешнем OCR или сторонних инструментах.

Как GroupDocs.Search выделяет текст PDF?

SearchEngine — основной класс, который индексирует и ищет содержимое документов. Redaction — применяет визуальную разметку, такую как выделения, к документам.

Загрузите PDF с помощью SearchEngine, выполните запрос, получите координаты совпадений и передайте их в Redaction для наложения цветового слоя. Процесс состоит из двух шагов — поиск и затем редактирование — поэтому один и тот же индекс можно использовать для множества проходов выделения, что снижает нагрузку на CPU до 40 % в повторяющихся сценариях.

Доступные руководства

Выделение HTML‑терминов с помощью GroupDocs.Redaction .NET: полное руководство для разработчиков

Узнайте, как эффективно выделять термины и фразы в HTML‑документах с помощью GroupDocs.Redaction для .NET. Руководство охватывает настройку, реализацию и лучшие практики.

Выделение результатов поиска в .NET‑документах с помощью GroupDocs.Search и Redaction

Узнайте, как эффективно выделять результаты поиска в документах с помощью GroupDocs.Search и Redaction для .NET. Повышайте продуктивность с помощью надёжного поиска текста и функций выделения.

Как выделить текст в PDF с помощью GroupDocs.Redaction .NET для конвертации в HTML

Узнайте, как выделять текст в PDF‑файлах и конвертировать их в HTML‑страницы с выделениями, используя GroupDocs.Redaction в этом полном .NET‑уроке.

Дополнительные ресурсы

Часто задаваемые вопросы

Q: Можно ли комбинировать GroupDocs.Search с другими продуктами GroupDocs?
A: Да, вы можете соединять Search с Redaction, Viewer или Conversion API для построения сквозных конвейеров обработки документов.

Q: Работает ли выделение в PDF, защищённых паролем?
A: Абсолютно. Укажите пароль PDF при создании экземпляра SearchEngine, и библиотека расшифрует файл «на лету».

Q: Сколько одновременных поисков может обрабатывать движок?
A: Движок потокобезопасен; типичные развертывания обрабатывают 50–100 одновременных запросов на ядро процессора без деградации производительности.

Q: Можно ли экспортировать выделенные результаты в виде изображений?
A: Да, после применения выделений вы можете использовать GroupDocs.Viewer для рендеринга страниц PDF в PNG/JPEG‑изображения, сохраняющие визуальную разметку.

Q: Какой способ рекомендуется для индексации больших коллекций документов?
A: Создайте один общий файл индекса, пакетно добавляйте документы порциями по 500 и вызывайте Optimize() после каждой партии, чтобы минимизировать размер индекса.


Последнее обновление: 2026-08-20
Тестировано с: GroupDocs.Search 23.11 for .NET
Автор: GroupDocs

Похожие руководства