Документ, в котором в одной строке смешаны иврит и английский язык — например, «Приказ № PO-48291 получен от 12.03.2026» — сам по себе является проблемой доступности. Направление письма меняется несколько раз в пределах одного предложения, и если разметка не точна, программа чтения с экрана может прочитать последовательность полностью задом наперед. В этой статье объясняется, как правильно управлять многоязычными PDF-документами (см. также наше руководство по Языковые теги на иврите и RTL).
Короче — о чем эта статья
Почему двунаправленный текст нарушает работу программ чтения с экрана
Иврит пишется справа налево (RTL), а английский и цифры — слева направо (LTR). Когда они смешиваются в одной строке, алгоритм Unicode Bidi определяет порядок отображения, но программе чтения с экрана также необходимо знать, на каком языке находится каждый сегмент, чтобы она могла выбрать правильное произношение. Если общий язык документа не установлен или английский сегмент внутри предложения на иврите не помечен отдельно, программа чтения с экрана может «спотыкаться» — читая отдельные буквы в обратном порядке или произнося английское слово, как если бы оно было на иврите.
Числа, даты и английские термины в предложении на иврите
Хорошая новость: в большинстве случаев числа и короткие английские термины внутри предложений на иврите (например, «PDF», «50%» или дата) самостоятельно сортируются правильно — при условии, что общий язык документа установлен на иврит. (в Word: Рецензирование ▸ Язык ▸ Установить язык проверки; в Acrobat: Свойства документа ▸ Дополнительно ▸ Параметры чтения). Механизм Bidi правильно обрабатывает подобные короткие последовательности, если знает базовый язык абзаца.
Целые разделы на другом языке
Проблема усугубляется, когда это не короткая последовательность, а целый абзац, заголовок или длинная цитата на языке, отличном от общего языка документа — например, полный пункт контракта на английском языке внутри документа на иврите. В этом случае сегмент должен быть помечен отдельно: в дереве тегов Acrobat выберите сегмент, откройте его свойства тега и на панели тегов выберите конкретный язык для этого сегмента. Это позволяет программе чтения с экрана «знать», что нужно временно переключиться на правильное ударение и направление чтения, а затем вернуться на иврит в конце сегмента.
💡 Практический совет
Если исходный документ представляет собой файл Word, попробуйте применить тот же принцип — выберите текст на иностранном языке и измените его язык проверки конкретно (а не только язык всего документа) — чтобы правильные теги могли автоматически переноситься и при экспорте в PDF.
Контрольный список для многоязычного документа
- Общий язык документа установлен: на уровне свойств документа, а не только в настройках отображения программного обеспечения.
- Длинные сегменты на другом языке помечаются отдельно: не только отдельные слова, но и каждый абзац, заголовок или цитата.
- Правильное направление в таблицах: таблица со столбцами числовых данных рядом с текстом на иврите — убедитесь, что порядок столбцов в тегах соответствует направлению визуального чтения.
- Фактическое тестирование с помощью программы чтения с экрана: единственный надежный способ убедиться, что документ действительно имеет смысл, — это действительно прослушать его, а не просто полагаться на инструмент автоматического тестирования.
Есть двуязычные документы, в которых вы не уверены?
Наш инструмент также проверяет правильность языковых тегов в рамках полного автоматического сканирования каждого PDF-файла на вашем сайте.
Сканируйте ваш сайт бесплатно ←После сканирования вы также можете сделать найденные документы доступными напрямую и бесплатно через AccessiDoc.
