Paratext разработан с учётом возможности работы с большинством мировых систем письма. Для этого в Paratext предусмотрены различные языковые настройки, включая Буквенные символы Диалог. См. пример на английском языке ниже:
Строчные и прописные буквы
Диалоговое окно «Алфавитные символы» (меню «Проект» > «Настройки проекта» > «Настройки языка» > вкладка «Алфавитные символы») содержит список всех строчных и прописных букв языка. Этот список сообщает Paratext, какие буквы входят в состав языка, и служит основой для проверки символов в Paratext.
Примечание: Примечание: Дополнительные символы, такие как знаки препинания и цифры, необходимо добавлять в инвентарь проверки символов вручную (см. Меню проекта > Инструменты > Проверка инвентарей > Инвентарь персонажей OR Инвентарь знаков препинания), но все в Буквенные символы диалоги автоматически добавляются в инвентарь как допустимые персонажи.
Примечание: Примечание: Список алфавитных символов должен включать только символы или буквы, используемые в вашей системе письма, чтобы функция проверки символов могла отметить неподходящие символы, если они будут набраны по ошибке. Копирование символов из одного проекта в другой может легко привести к появлению недопустимых символов, если вы не проверите, какие символы фактически используются в новом проекте.
Определение алфавитного порядка для языка
Порядок символов в диалоговом окне «Алфавитные символы» определяет порядок сортировки слов в проекте Paratext. Paratext во многих случаях должен представлять информацию в виде отсортированного списка, используя заданный здесь «алфавитный» порядок. Вот некоторые из таких мест:
- Результаты поиска в окне списка
- Инструмент «Список слов»
- Глоссарий (если он есть в проекте)
Примечание: Если Paratext не сортирует данные так, как вы ожидаете, one одной из причин может быть порядок персонажей в Буквенные символы диалог.
Акцентированные символы
В языках часто встречаются символы с диакритическими знаками, например, á ê ɨ ñ ò ü. Их следует включить в список алфавитных символов проекта. Рассмотрим гласные в примере на испанском языке ниже:
Обратите внимание, что для каждого символа с ударением учитываются строчные и заглавные буквы. Также обратите внимание, что гласные с ударением находятся на одной строке с безударными. Это не обязательно, но используется, когда вы хотите, чтобы Paratext игнорировал ударения при сортировке. Это может быть полезно, если в вашем языке есть тональные/ударные обозначения, которые не меняют значение слова.
Если бы порядок сортировки был настроен так, как в примере выше, Paratext НЕ обрабатывал бы e и é как разные буквы при сортировке. Например, следующие гипотетические слова будут отсортированы таким образом:
- pepa
- pépa
- peНе нужно
- péНе нужно
Такая сортировка также предотвратит появление в вашем глоссарии отдельных разделов для слов, начинающихся с разных диакритических символов.
Сортировка символов с ударением независимо от символов без ударения
Если вы хотите, чтобы символы с диакритическими знаками сортировались независимо от символов без диакритических знаков (например, считались разными буквами), то символы с диакритическими знаками необходимо разместить на отдельных строках. Рассмотрим модифицированный пример для испанского языка ниже:
Если бы порядок сортировки был настроен так, как в приведенном выше примере «модифицированного испанского языка», то следующие гипотетические слова были бы отсортированы таким образом (потому что e приходит раньше é):
- pepa
- peНе нужно
- pépa
- péНе нужно
Похоже, чаще всего проект настраивается так, чтобы ударные и безударные гласные сортировались вместе, а ударные и безударные согласные — независимо друг от друга. Рассмотрим пример ñ/Ñ из испанского примера ниже:
Эта конфигурация заставит Paratext сортироваться в обычном режиме n's отдельно от ñ's с диакритическим знаком тильда. Следующие гипотетические слова будут отсортированы таким образом, потому что n приходит раньше ñ:
- sonir
- soñir
- sunара
- suñара
Это также приведет к тому, что глоссарий будет состоять из двух отдельных разделов для слов, начинающихся с «N(Основной ключ) и Ñ“, если вы решили создать глоссарий в своем проекте.
орграфах
Диграфы, триграфы и другие мультиграфы используются во многих системах письменности. Вы можете указать Paratext, как их сортировать. Некоторые языковые сообщества уделяют большое внимание мультиграфам, поскольку они очень важны для правописания, в то время как другие довольствуются тем, что Paratext игнорирует их и сортирует только по отдельным символам. Рассмотрим средний случай в примере с фулфулде ниже, где есть четыре диграфа (mb, nd, ng и nj):
В этом примере Paratext различает слова, начинающиеся с этих диграфов, и слова, начинающиеся с одного символа, и сортирует их соответствующим образом. Например:
- mааййи
- mbааджи
- nани
- ndараний
- ngаари
Персонажи, которым может понадобиться специальная клавиатура
Вашему проекту может понадобиться множество символов, но ваш компьютер не сможет печатать без использования клавиатуры, поддерживающей эти специальные символы. Примеры этих символов: ç /Ç, ɨ/Ɨ, Ŋ/ŋ, ɓ/Ɓ, ɔ/Ɔ и многие другие. Фуфулде зацепил б (ɓ) и зацепил d (ɗ) и являются примерами этого. Вам понадобится способ либо ввести эти символы, либо скопировать и вставить их в Буквенные символы Список. Один из способов ввода специальных символов — использовать Автозамены Функция Paratext. Подробнее об автозамене см. этой статье:
Второй способ — найти или установить Клавиатура KeymanЭто лучшее решение, если в вашем проекте требуется много специальных символов и/или вы хотите вводить специальные символы в других программах на компьютере. Многие клавиатуры Keyman также имеют специальные клавиатуры для печати на мобильных устройствах (например, на телефонах Android или iOS).
Избегайте использования знаков препинания в качестве алфавитных символов.
Очень важно отделять знаки препинания от буквенных (буквенных) символов. Несоблюдение этого правила может привести к различным проблемам. Поиск и сортировка будут работать некорректно; проверка символов, пунктуации и орфографии может обнаружить не все ошибки, а инструмент Wordlist может разрывать слова в неожиданных местах.
Пример: в некоторых системах письма, основанных на латинице, для обозначения гортанной смычки используется маленькая галочка, и люди часто вводят апостроф. " или правая одинарная кавычка ' для этого знака галочки. Аналогично, некоторые орфографии представляют велярный звук n (ŋ) с ng', используя либо апостроф, либо правую одинарную кавычку. Однако ни один из этих двух символов обычно не является словообразовательным, и компьютер может обрабатывать их не так, как вы ожидаете (то есть, воспринимать их как знаки препинания, а не как буквы). Одно из ограничений их использования заключается в том, что теперь они имеют строчные и заглавные буквы. Вместо этого рекомендуется использовать либо Латинская строчная буква Saltilloꞌ (U+A78C) или Модификатор буквы апостроф ʼ (U+02BC), поскольку компьютер распознаёт их как словообразовательные символы, а не знаки препинания. Обычно в орфографии не требуется заглавная буква для гортанной смычки, но если вам это нужно, используйте латинскую строчную букву Saltillo. ꞌ (U+A78C) и латинская заглавная буква сальтильо (U+A78B). Как и в случае с другими специальными символами, вам потребуется указать способ ввода выбранного вами символа для гортанной смычки.
Рассмотрим пример ниже, в котором сальтильо используется для обозначения гортанной смычки:
Примечание: Обратите внимание, что символы, подобные Saltillo, часто представляют гортанную смычку или являются частью триграфа, например, ng.ꞌ Если орфография требует заглавной формы слова Saltillo, то после косой черты поставьте латинскую заглавную букву Saltillo (U+A78B), например: ꞌ/Ꞌ.
Сокращения и переносы
Во многих языках используются сокращения. Например, в английском есть такие слова, как «don't», «doesn't» и «won't». В орфографии часто используется обозначение выпадения гласных апострофами, например:мчихулупириро мва Кристу Йесу(чичева/ньянджа). Итак, апострофы необходимы для правильного написания, но они не считаются буквами или словообразовательными символами. То же самое можно сказать и о дефисах: в некоторых орфографиях они необходимы для правильного написания, но не считаются словообразовательными символами.
Для обработки сокращений и переносов в Paratext их можно задать как знаки препинания в середине слова. Знаки препинания в середине слова настройка находится на Другие персонажи Вкладка «Настройки языка». Рассмотрим настройку пунктуации Word-medial для языка ньянджа, показанную ниже:
Размещение дефиса и апострофа здесь сообщает Paratext, что некоторые слова будут содержать дефисы или апострофы. Это важно, поскольку если дефис и апостроф здесь не указаны, Paratext разделит все слова с дефисами или апострофами на две части. Например, слово на языке ньянджа mʼchikhulupiriro будет разбит на два слова (м чихулупиро) где стоит апостроф. Аналогично, слово фулфулде адотоо-ми будет разбит на два слова (адотоо ми) где встречается дефис.
Заключение
Итак, список алфавитных символов должен содержать все необходимые для вашего языка словообразующие символы. Неиспользуемые символы не должны там оставаться. (Это часто случается при копировании списка алфавитных символов из одного проекта в другой.) Знаки препинания никогда не следует использовать как часть алфавита. Если это необходимо, найдите другой приемлемый символ для представления этой буквы в Paratext. Возможно, вам потребуется найти или создать метод для ввода специальных символов, не поддерживаемых клавиатурой вашего компьютера. Функция автокоррекции в Paratext or Кейман два хороших возможных решения.
Уделите время правильной сортировке алфавитных символов в начале переводческого проекта, что значительно облегчит составление и проверку перевода. Это также упростит набор текста и позволит многим функциям поиска, сортировки и проверки Paratext работать корректно.