Paratext 的設計使其能夠相容於世界上大多數的書寫系統。為此,Paratext 提供了多種語言設置,包括 字母字元 對話。請參閱下面的英語範例:
小寫和大寫字母
在字母字元對話方塊中(項目選單 > 項目設定 > 語言設定 > 字母字元標籤),可以列出一種語言的所有大小寫字母。此清單告知 Paratext 哪些字母屬於該語言,並構成 Paratext 中字元檢查的基礎。
💡 請注意: 標點符號和數字等附加字元必須手動新增到字元檢查清單中(參見 項目選單 > 工具 > 檢查庫存 > 角色庫存 OR 標點符號清單),但 字母字元 對話會自動作為有效字元新增到庫存中。
💡 請注意: 字母字元清單應僅包含您特定書寫系統中使用的字元或字母,以便字元檢查能夠在輸入錯誤時標記不合適的字母。如果您不驗證新項目實際使用的字符,將字符從一個項目複製到另一個項目很容易引入無效字符。
指定語言的字母順序
字母字元對話方塊中字元的順序決定了 Paratext 項目中單字的排序方式。 Paratext 在許多地方需要使用您在此定義的「字母」順序,以排序清單的形式呈現資訊。其中一些地方包括:
- 清單視窗中的搜尋結果
- 單字表工具
- 詞彙表(如果項目有的話)
💡 如果 Paratext 沒有按照您期望的方式進行排序, 為前線醫護人員打氣,送上由衷的敬意。讓你在送禮的同時,也為香港盡一分力。 原因可能是 字母字元 對話。
重音字符
語言中常見重音字符,例如 á ê ɨ ñ ò ü。這些字元應包含在項目的字母字元清單中。請考慮以下西班牙語範例中的元音:
請注意,每個重音字元的大小寫都包含在內。另請注意,重音元音與非重音元音位於同一行。這不是必需的,但當您希望 Paratext 在排序時忽略重音時,可以使用此選項。如果您的語言包含諸如聲調/重音標記之類的不會改變單字含義的符號,則此選項會很有幫助。
如果排序順序像上面的範例一樣配置,Paratext 將不會處理 e 以及 é 排序時,字母會有所不同。例如,假設以下單字將按以下方式排序:
- pepa
- pépa
- pePAS
- péPAS
透過這種方式排序還可以防止詞彙表中出現以不同重音字元開頭的單字的單獨部分。
獨立於非重音字元對重音字元進行排序
如果您希望重音字元與非重音字元分開排序(例如:將它們視為不同的字母),則需要將重音字元放在單獨的行上。請考慮以下修改後的西班牙語範例:
如果排序順序配置得像上面的「修改過的西班牙語」範例,則以下假設的單字將按以下方式排序(因為 e 來之前 é):
- pepa
- pePAS
- pépa
- péPAS
更常見的做法是,將項目配置為重音元音和非重音元音一起排序,而將重音輔音和非重音輔音獨立排序。請考慮以下西班牙語範例中的 ñ/Ñ 範例:
此配置將導致 Paratext 排序正常 n的 與...分開 ñ的 帶有波浪號變音符號。以下假設的單字將按此方式排序,因為 n 來之前 ñ:
- sonir
- soñir
- sun金剛鸚鵡
- suñ金剛鸚鵡
它還將導致詞彙表有兩個單獨的部分,分別針對以“N“和”Ñ「,如果您選擇在項目中使用詞彙表。
有向圖
許多書寫系統中都使用二合字母、三合字母和其他多合字母。您可以告訴 Paratext 如何對這些字母進行排序。有些語言社群非常關注多合字母,因為它們對其語言的拼寫至關重要;而其他語言社群則希望 Paratext 忽略這些字母,僅根據單字元進行排序。讓我們考慮下面富爾德語範例中的一個中間情況,該範例包含四個二合字母(mb、nd、ng 和 nj):
在此範例中,Paratext 將區分以這些二合字母開頭的單字和以單字開頭的單字,並相應地對它們進行排序。例如:
- m阿依
- mb阿吉
- n阿尼
- nd阿拉尼
- ng阿里
可能需要特殊鍵盤的字符
您的專案可能需要許多字符,但如果不添加包含這些特殊字符的鍵盤解決方案,您的計算機就無法輸入。這些字元的範例包括: ç /Ç、ɨ/Ɨ、Ŋ/ŋ、ɓ/Ɓ、ɔ/Ɔ 以及其他許多人。 Fufulde 已經鉤住了 b (ɓ) 和鉤狀 d (ɗ) 就是這方面的例子。您需要一種方法來鍵入這些字符,或者一種方法來將它們複製並貼上到 字母字元 列表。輸入特殊字元的一種方法是使用 自動更正 Paratext 中的功能。有關自動更正的更多詳細信息,請參閱 這篇文章:
第二種方法是找到或安裝 Keyman 鍵盤如果您的專案需要大量特殊字符,或者您想在計算機上的其他程式中輸入特殊字符,那麼這是最佳解決方案。許多 Keyman 鍵盤還配備了用於在行動裝置(例如:Android 或 iOS 手機)上打字的特殊鍵盤。
避免使用字母作為標點符號
將標點符號與構成單字的字母字元區分開非常重要。否則可能會導致各種問題。搜尋和排序將無法正常工作;字元、標點和拼字檢查可能無法找到所有錯誤;而且單字表工具可能會在意想不到的地方斷詞。
例如:有些拉丁文書寫系統使用一個小勾號來表示喉塞音,人們常會輸入撇號 “ 或右單引號 ' 表示該刻度線。同樣,有些正字法表示軟顎音 n (ŋ) 與 ng' 一起使用撇號或右單引號。然而,這兩個符號通常都不是構成單字的字符,電腦可能無法按照您預期的方式處理它們(也就是說,它會將它們視為標點符號而不是字母)。使用這些符號的一個限制是它們現在有大小寫。建議使用 拉丁文小寫字母 Saltilloꞌ (U+A78C)或 修飾字母撇號 ʼ (U+02BC),因為計算機會將它們識別為構成單字的字符,而不是標點符號。通常情況下,正字法不需要大寫喉塞音,但如果需要,請使用拉丁小寫字母 Saltillo ꞌ (U+A78C)和拉丁大寫字母 Saltillo(U+A78B)。與其他特殊字元一樣,您需要一種方式來輸入您選擇的喉塞音字元。
考慮下面的例子,使用 Saltillo 來表示聲門塞音:
💡 請注意,像 Saltillo 這樣的字符通常代表喉塞音,或者是三字母組合的一部分,例如 ngꞌ 在正字法中不需要大寫形式。如果正字法要求 Saltillo 大寫,則將拉丁大寫字母 Saltillo (U+A78B) 放在正斜線後,如下所示: ꞌ/Ꞌ。
縮寫和連字符
許多語言都使用縮寫。例如,英文中有「don't」、「doesn't」和「won't」這樣的字。正字法中常用撇號來標記元音省略,例如“姆奇胡盧皮羅·姆瓦·赫里斯圖·耶蘇」(齊切瓦語/尼揚賈語)。因此,撇號雖然是拼寫正確的必要符號,但它們不被視為字母或構成詞的字符。連字符也是如此:有些正字法需要它們才能拼寫正確,但它們不被視為構成詞的字符。
在 Paratext 中處理縮寫和連字符的方法是將它們指定為單字中標點符號。 詞中標點 設定位於 其他角色 選項卡下的“語言設定”下。請考慮如下所示的 Nyanja 的 Word-medial 標點設定:
在此新增連字號和撇號會告知 Paratext 某些字會包含連字號或撇號。這一點很重要,因為如果此處未列出連字符和撇號,Paratext 會將所有包含連字符或撇號的單字分成兩部分。例如,尼揚賈語單字 姆奇庫盧皮里羅 會被分成兩個單字(奇庫盧皮里羅) 撇號出現的地方。同樣,富爾德語單字 阿多米 會被分成兩個單字(阿多托米) 中出現連字符的位置。
結語
審核時,字母字元清單應包含您語言所需的所有構詞字元。未使用的字元不應保留在那裡。 (這種情況通常發生在將字母字元清單從一個項目複製到另一個項目時。)標點符號永遠不應作為字母表的一部分。如果需要,請在 Paratext 中找到另一個外觀可接受的字元來表示該字母。您可能需要找到或建立一種方法來輸入電腦鍵盤無法輸入的特殊字元。 Paratext 中的自動更正功能 or 關鍵人物 是兩個很好的可能解決方案。
在翻譯專案開始時花些時間正確地整理專案中使用的字母,將使起草和檢查譯文的工作變得更加輕鬆。這也能減少文字輸入的繁瑣,並使 Paratext 的許多搜尋、排序和檢查功能能夠正常運作。