Training Olympiad in Linguistics|給語奧國手賽前速讀

語言類型學參考 Cheatsheet

謝舒凱 台大語言所 | 謝心波 (SYMBOT)

我們都知道,語言學奧林匹亞不會考你認得幾種語言,但其實每一道題背後都對應到至少一個類型學主題。這份講義是第一次試著把 22 屆、134 道考古題分到十一個領域,目的是讓選手在考場上遇到陌生題目時,也許可以先判斷它屬於哪個領域,再決定用什麼方法著手解題。

對象|國手・培訓營資料|IOL 2003–2025(官方題庫)形式|考點地圖+索引+預測

§0怎麼使用這份講義(搭配刷題的邏輯與速度訓練)

這份講義分成三層,分別對應賽前不同階段:

賽前一週:把〈§2 十一大領域〉讀熟。每個領域的「訊號(你在題目中看到了什麼?) → 假設(這背後的語言學原理是什麼?)」是重點。也就是說,題目一出現某種特徵,就能立刻想到對應的類型學假設。

賽前一天:看過〈§1 考點地圖〉和〈§4 頻率分析〉,掌握哪些領域幾乎每屆都考、哪些較少出現,再參考〈§6 賽前預測〉調整最後的複習分配。

平時訓練:用〈§3 考古題總索引〉的篩選功能,依領域抓出整組題目做主題式練習,例如把歷屆 direct–inverse 的題目集中做完。

提醒一下:類型學對語奧選手的作用,類似開局定石之於棋手。重點不在背答案,而在辨認題型;真正的推理仍得在考場上完成,但先判斷出題目屬於哪一類,能省下開頭最花時間的摸索階段;或是在假設存在多種可能時,優先選擇最符合類型學假設的答案。

§1考點地圖:22 屆 × 11 領域

每一欄是一屆 IOL,每一列是一個領域。實心點表示該屆個人賽有題涉及此領域;空心環表示該屆僅團體賽出現;虛線圈表示初步標註、尚未對照官方解答;小灰點表示該屆未出現。

2003200420052006200720082009201020112012201320142015201620172018201920212022202320242025音韻・聲調構詞對齊・一致句法・詞序名詞範疇語意・詞彙數詞・曆法文字・符號歷史比較社會・詩律計算・編碼
整體趨勢:「構詞(句法)morpho-syntax 」與「音韻・聲調」幾乎每屆都出現,是最穩定的題類;「對齊・一致」與「名詞範疇」則從 2012 年起密度明顯提高;「文字・符號」在個人賽自 2019 年 Book Pahlavi 那題之後,2021 年起已連續五屆缺席;期間文字類題僅出現在團體賽(2019 韻律體操符號、2022 Manchu,見該列的空心環);「數詞」則大致每兩三屆出現一次,相當規律。

§2十一大領域:訊號 → 假設 → 工具(解題)

以下分別就每個領域做一些基礎概念說明。左欄是「怎麼認、怎麼下手」的攻略(訊號 → 假設 → 工具+代表題),右欄是該領域的核心概念詞典。右欄用來把不熟的名詞補起來。

音韻・聲調

PHONOLOGY & TONE
訊號 當同一個詞素(詞根或詞綴),在不同詞的拼法出現系統性的微調(如元音改變、輔音清濁交替);或在字母上方或下方標記了大量的調符(如 á, à, â)、數字(如 ¹, ²)或底線,且這些符號的分布忽隱忽現。
假設 音段層面可能涉及了條件變體 (Allophony)。語音為了省力,受到隔壁鄰居的「同化」或受到音節位置的制約;超音段層面則可能有聲調指派 (Tone Assignment),表層的聲調不是每個音節死板固定的,而是由一套語法規則「投射」或「計算」出來的落點。
解題
  • 步驟一:列出對立(對齊所有變化形式,抓出改變的音段)。
  • 步驟二:檢查觸發環境(看左鄰、右鄰的音特徵,特別注意「舌根前伸 (+ATR)」或「清濁音」)。
  • 步驟三:計算槽位與邊界(如果環境無關鄰居,立刻轉向算「音節數」、「音拍數」或「距詞尾/詞首的距離」,甚至詞類)。
注意
  • 不要只看「隔壁」:元音和諧(如 +ATR)是跨音節擴散的,會跳過輔音影響下一個元音。
  • 聲調不是單字調:語奧的聲調題 90% 不是考固定詞彙調,而是考「語法聲調」(用高調表複數、用低調表過去式)或「聲調擴散」。如果逐字查對不起來,立刻改用**「數格子(音節/音拍)」**的方法找規律!
  • 澳洲語言無聲調:看到系屬是澳洲語系,直接把聲調假設從腦中剔除。
代表題:Rotuman 2012・Creek 2018・Chamic 2022・Kuria 2025

核心概念 · 定義與例子

ATR 元音和諧 ATR VOWEL HARMONY  元音依「舌根前伸(+ATR)」或「舌根縮回(−ATR)」分為兩組,一個詞內必須同組,詞綴元音會被詞根強行同化 。 例Akan 等尼日—剛果語言,詞根若為 +ATR,附加詞綴的元音也轉成其 +ATR 對應音(e/o ↔ ɛ/ɔ),跳過輔音實現跨音節傳播。
聲調指派 TONE ASSIGNMENT 表層聲調並非每音節詞彙死死的給定,而是底層的高低調位依據語法規則(如字數、詞類、詞邊界)投射到音節上。例Kuria(2025)高調的落點由詞根加固定計數規則決定,而不是像英語單字一樣死記。
音位轉換 METATHESIS 同一個詞在不同語法狀態下,相鄰的語音(通常是 C 與 V)規則性地互換位置 。例Rotuman(2012)以詞尾兩音互換(CVCV↔CVCV 的變體)區辨「完整式/不完整式」,是少數把 metathesis 語法化的語言。
聲調產生 TONOGENESIS 原本區辨意義的輔音對立(清濁、送氣、喉塞)消失,其效果「轉移」到元音音高,衍生出聲調。例占語支(Chamic,2022)由無聲調的南島語,經聲母清濁合流演化出聲調。
搭嘴音 CLICKS 利用口腔內前後兩處同時閉合,靠舌體往回吸造成負壓,所產生的吸氣爆破音。主要見於南部非洲。例Taa/ǃXóõ(2016)含數十個搭嘴音,是已知輔音庫存最大的語言。
夾擠同化/遠距同化 Intervocalic Lenition / Distance Assimilation  夾在兩個強音(通常是元音)中間的弱音(輔音),會被兩邊的元音同化,發生清音變濁音(p → b)、塞音變擦音(t → s)的現象。 例許多美洲語言在構詞接合時,原本詞首的清塞音一旦被前綴元音夾住,會立刻規則性地變成濁音或擦音。
音節結構限制與插音 Phonotactics & Epenthesis  每個語言對「音節長怎樣」都有嚴格規定(例如絕對不允許 CCV 或詞尾有輔音),當構詞導致違規時,系統會強行插入一個元音或刪除一個輔音。 例Micmac(2008)當兩個輔音撞在一起違反音節限制時,會依據其所屬的槽位規則,在中間強行插入特定母音。
超音段擴散 Autosegmental Spreading  鼻音化(Nasalization)或聲調不屬於單個字母,它像一團「霧氣」,會從觸發點向左或向右擴散,直到撞到特定阻礙音才停止。 例Terêna(2018)的第一人稱沒有實體字母前綴,而是把「鼻音」這個特徵從詞首一路向右擴散,讓沿途能鼻化的音全部鼻化。
輔音交替 Consonant Mutation  不需要挪動位置,只靠詞首或詞尾輔音本身的發音方法改變(如爆破音變擦音),來表達語法意義(如性別、格位)。 例凱爾特語族(如愛爾蘭語)或部分非洲語言,僅透過詞首輔音交替(如 p 變 f),即可表示語法意義的改變,例如由「我的」變為「他的」。

構詞

MORPHOLOGY
訊號 長短不對稱:題目給的陌生語言「一個詞長到不行」,但對應的中文或英文翻譯卻是「一整句話」(例如:一個單字表達「他找不到合適的那一個」);或是多功能堆疊:在同一個詞幹上,隨著時貌、人稱、否定或場所的改變,前後綴會像套娃一樣層層堆疊。
假設 在結構層面上,可能是多式綜合 (Polysynthesis) 或模板構詞 (Templatic Morphology) 。這類語言將主語、賓語、時貌語氣(TAM)等論元與語法範疇,全部綜合成單一動詞。機制層面上,分散式構詞 (Distributed Exponence) 或非連續語素。一個完整的語法意義(例如「第一人稱過去式」)被切成兩半,分散在詞頭與詞尾的槽位共同標記。
解題
  • 步驟一:橫向對齊,垂直切割。把所有形式對齊,將長詞橫向切分成一個個槽位(Slot)。
  • 步驟二:建立槽位模板表 (Slot Matrix)。為切出來的區塊編號(如 Slot -2, Slot -1, Root, Slot +1...),逐一填入對應的功能(如:人稱槽、時貌槽、否定槽)。
  • 步驟三:捕捉非典型語素。如果切不開,立刻檢查是否存在「重疊 (Reduplication)」(複製部分詞根表複數/體貌) 、「中綴 (Infixation)」(插在首輔音後面的詞綴)、或「無實體語素」(例如整串音段鼻化交替)。
注意
  • 槽位順序是絕對的:一旦建立槽位表,語素的相對順序(Slot Index)絕對不能任意對調。如果發現對不起來,通常是最初的切分切歪了,或是遇到了條件交替。
  • 提防「零標記 (Zero Morpheme)」:如果某個槽位在「第三人稱」或「現在式」時完全沒有對應的語音成分,它很可能是 ∅(零標記)。不要硬在裡面找字母,空下來反而能看清全貌。
  • 區分「融合」與「黏著」:如果一個後綴同時表達了「第一人稱」加上「過去式」,且無法再切分,這屬於融合(Fusional)。請直接把這個「語素套餐」填入該複合槽位。
代表題:Inuktitut 2008・Terêna 2018・Komnzo 2024・Kewa 2025

核心概念 · 定義與例

多式綜合 POLYSYNTHESIS  將主語、賓語、時貌、方式等多個語素,綜合成單一動詞詞彙,對應其他語言的一整句話。 例Inuktitut(2008)單一動詞詞彙即可表達「他找不到合適的那一個」。
重疊 REDUPLICATION  複製詞根的全部或部分形式,用以表達複數、體貌(反覆/持續)或語意強調。 例West Tarangan(2019)以重疊實現動詞體貌上的語法對立。
中綴 INFIXATION  插入詞根內部(而非首尾)的詞綴。例南島語常見的 -in-/-um- 插在首輔音之後(如 sulat→s-in-ulat);Copainalá Zoque (2008),其名詞後綴與領屬結構中涉及特定語音的中綴插入。
構詞音韻交替 MORPHOPHONOLOGY  詞素相接時發生的系統性語音變化,如鼻音擴散、元音省略。 例Terêna(2018)第一人稱以「鼻音擴散」實現整串音段鼻化,而無獨立的人稱前綴。
分散式構詞 DISTRIBUTED EXPONENCE  單一語法意義被切成多段、分散在詞的不同槽位共同實現。例Komnzo(2024)主語和賓語的一致性標記分散在動詞的前綴與後綴槽位,兩者合力才決定一組人稱。
構詞音韻交替 Morphophonology  語素接合時,在交界處引發系統性的發音改變(如母音省略、鼻音擴散),常會模糊原本清晰的槽位邊界。例Jaqaru (2016),當多個領屬與格位後綴連續串接時,會觸發系統性的母音省略(Vowel Deletion),讓字面看起來像縮水一樣。
名詞併入動詞 Noun Incorporation  名詞論元(通常是受事賓語)失去了獨立名詞的地位,被削弱並強行塞進動詞模板內,變成動詞的一部分。例Koryak (2024),動詞結構中高度整合了名詞成分,使整個詞幹同時承載動作與其核心工具/物件。
屈折模板割裂 Templatic Splitting / Positions of Affixes 動詞內部有一張極度嚴格的槽位清單(Slot Matrix),時制、語氣、人稱必須死板地排在指定順序(如位置 1 必為賓語,位置 2 必為時貌)。 例Ubykh (2022),擁有極度繁複的動詞多槽位模板,解題時必須手動畫出多達 5 個以上的 Slot 對齊表才能破解。

對齊・一致

ALIGNMENT & AGREEMENT
這個領域在考你:「主詞和受詞,在這個語言裡是怎麼認親的?」語奧的核心戰場!

訊號 及物句與不及物句的人稱標記不一致,或同一組詞綴忽主忽賓。具體的訊號例如,
  • 名詞尾巴多變:同一個名詞(如「狗」),有時字尾是 -o,有時變 -a,但有時卻完全沒有後綴。
  • 翻譯標記不對稱:當句子只有「狗在叫」時,狗的拼法和「貓咬狗」的狗一樣,但卻和「狗咬貓」的狗不一樣。
  • 人稱代詞大洗牌:動詞裡面的主賓一致標記(如 i-,ku-,m-),隨著動作是「主動(跑)」還是「被動/非自主(跌倒)」而突然切換。
假設
  • 論元對齊偏向 (Argument Alignment): 語言在處理核心角色時,有不同的「對齊」方式。
    主賓格 (Nom-Acc) 是最常見,把單純主語(S)與及物施事(A)綁在一起,及物受事(P)另標;作通格 (Erg-Abs) 則是語奧最愛,把單純主語(S)與及物受事(P)綁在一起(通常是乾淨的零標記通格),及物施事(A)單獨加特殊後綴(作格)。
  • 階層分裂與正反向 (Nominal Hierarchy & Direct-Inverse): 一致性標記不看「誰是主/誰是賓」,而是看「誰比較尊貴/有生命」(代詞 > 人類 > 動物 > 無生命)。
    語法系統會根據「誰比較像人類/尊貴」(代詞 > 人類 > 動物 > 無生命)這個階層來決定要不要標記格位,或者決定動詞的標記順序。
    • 當動作方向符合階層順序(如:我打了熊),動詞加正向標記 (Direct)。
    • 當動作逆著階層(如:熊打了我),動詞加反向標記 (Inverse)。
解題 畫 S/A/P 表格,逐格填入標記,看誰與誰同形。
  • 繪製 SAP 矩陣。在草稿紙上把句子分類 (及物不及物),將名詞或代詞抽出來,將名詞/代詞標上 S(不及物句唯一主語)、A(及物句主事者)、P(及物句受事者)。
  • 格位與一致性連線。 如果 S = A ≠ P → 主賓格系統 (Nominative-Accusative)(P 是賓格,單獨被標記)。 如果 S = P ≠ A → 作通格系統 (Ergative-Absolutive)(A 是作格,通常帶有特殊後綴;S 和 P 是通格,通常是零標記 ∅ )。
  • 抓出分裂作格 (Split-Ergativity)。如果發現前半段符合主賓格,後半段符合作格,立刻尋找分裂作格的引爆點:
    1. 時貌分裂: 過去式/完成體符合作通格,現在式/未完成體符合主賓格(如 Georgian 2014)。
    2. 論元分裂: 第一/二人稱代詞用主賓格,第三人稱/一般名詞用作通格。
注意
  • 勿把「作格」(ergative) 句誤認為被動句:看到作格語言的句子,翻譯時它依然是普通的主動句(如「他看見熊」)。如果一個名詞綴只在及物動詞的主語上出現,它就是作格(ERG),絕非被動語氣。
  • 通格(absolutive)通常是隱形人。在作通格語言中,S 和 P 是核心論元,高機率是零標記。如果發現不及物主語和及物賓語的拼法最乾淨,直接鎖定作通格!
  • 人稱階層決定一致對象: 在階層式一致(Hierarchical Agreement)題型中,動詞的代名詞前綴可能永遠跟階層最高的論元(如第一人稱)保持一致,不論它在句中是主語還是賓語(如 Hakhun 2018)。
  • 人稱代詞的順序不等於語序:句子的主語和賓語可能排在動詞後面(如 VOS),但動詞內部綁定的人稱前綴可能永遠是「主語在前、賓語在後」。動詞模板與外部語序必須分開獨立分析。
  • 活格/分裂不及物(Active-Stative): 若不及物主語(S)分裂成兩套,控制度高、有自主意識的動作(如「我跑」)標記同 A;無自主意識的狀態(如「我跌倒」)標記同 P。
代表題:Dyirbal 2012・Basque 2012・Hakhun 2018・Plains Cree 2023

核心概念 · 定義與例

S/A/P CORE ARGUMENT ROLES 對齊的三個原始角色:不及物唯一論元 S、及物施事 A、及物受事 P;語言間差在如何把三者「打包」。例「打包」方式的不同,正是以下各型的分野。
賓格型 NOMINATIVE-ACCUSATIVE S 與 A 同標(主格),P 另標(賓格);全球最常見。例拉丁語:puella(主)/puellam(賓)。
作通格系統 ERGATIVE-ABSOLUTIVE S 與 P 同標記(通格 ABS),A 另標(作格 ERG)。 例Dyirbal(2012):施事帶作格 -ŋgu,S 與 P 同為零標記通格;Basque(2012),及物句的施動者必須加上作格後綴 -k,而受動者則與不及物句的主語一致,皆為通格空值。
主動—靜態型 ACTIVE-STATIVE S 依語意(自主/受影響)分別按 A 或 P 標記;三型中最稀有。例Lakhota:「跑」的 S 用施事標記,「病」的 S 用受事標記。
分裂作格 SPLIT ERGATIVITY 同一語言不純粹是主賓格或作通格,而是在部分條件(人稱階層、體貌、時制)用作格,其餘用賓格,兩套系統各佔半壁江山。 例常見分裂點:完成體用作格、未完成體用賓格;或第一/二人稱用賓格、第三人稱用作格。 Georgian (2014),在現在時貌下呈現主賓格對齊,但在過去時貌(Aorist)下則切換為作通格對齊。
正向—反向・近遠指 DIRECT-INVERSE & OBVIATION 動詞不標「誰主誰賓」,而標動作是否沿人稱/指稱階層順行;第三人稱再分近指(proximate)與遠指(obviative)。例Plains Cree(2023):階層高者作賓時,動詞加反向標記。
活格語言 / 分裂不及物 Active-Stative / Split-Intransitivity 不及物句的主語(S)不統一標記。如果 S 是有自主意識的施動者(如「我跑」),標記同 A;如果是無自主意識的受動者(如「我跌倒/我死了」),標記同 P。 例Lakota 歷年經典模擬題考點,動詞的人稱前綴會依據該不及物動詞是否具有「自主控制度」而分裂成兩套標記方式。
階層式一致 HIERARCHICAL AGREEMENT 動詞只跟階層上較高的那個論元一致,不論它是主是賓。 例Hakhun(2018):一致對象由 1>2>3 的人稱階層決定。

句法・詞序

SYNTAX & WORD ORDER
這個部分在考你:「這個語言的骨架是怎麼搭起來的?」

訊號
  • 句子很正常。每個單字都分得開開的,不像某些語言一個字就包含整句話。
  • 但有些特定的詞(像是「不/沒有」、「會/可以」,或是代名詞),無論句子怎麼變,永遠死死扣在整句話的「第二個位置」(比如第一個詞後面,或者第一串短語後面)。
  • 動詞像火車一樣,句子後半段出現一長串連續的動詞疊在一起(鏈狀動詞)。
假設
  • Greenberg 詞序蘊涵: 語言是有「慣性」的。如果它是 VO(動詞 + 賓語),那它通常也會是「前置詞 + 名詞」(如 in Taiwan)、「名詞 + 關係子句」。反之,如果是 OV(賓語 + 動詞,如日語),那它就會是「名詞 + 後置詞」(如 台灣に)。
  • Wackernagel 附著詞(第二位置): 那些死死固定在第二個位置的小詞,它是靠「數格子」來決定位置的,不管它在句中是當主語還是別的,反正數到 2 丟進去就對了。
  • 換指標記 (Switch-Reference): 連續動詞串接時,前一個動詞的尾巴會變形,專門用來提示你:「下一句的主詞跟這句是同一個人(SS)」還是「換人了(DS)」。
工具
  • 步驟一:定錨基本語序。 找最簡單、沒有否定、沒有助動詞的句子,確定它的基本骨架是 SVO、SOV 還是 VSO。
  • 步驟二:把「第二位置」的詞抽乾淨。 如果發現某個詞忽左忽右、位置很詭異,數一下它是不是都在 Slot 2。如果是,在草稿紙上把它圈起來移走,先去分析剩下的基本語序,別被它干擾。
  • 步驟三:連鎖推論。 只要確定了動詞和賓語的相對位置(VO 或 OV),可依據 Greenberg 通則建立連鎖推論,解題速度可能快點。
    VO 語言 ⟶ 前置詞 + 名詞 + 關係子句
    OV 語言 ⟶ 名詞 + 後置詞 + 關係子句前置
注意
  • 語奧很愛考「表面上看起來是 A 修飾 B,實質上是第二位置強行插入」的障眼法。
  • 提防罕見語序:遇到南美語言解不出 SOV/SVO 時,大膽假設 OVS/OSV 的可能性(全球僅 1\%,但南美是熱區)。
代表題:Wambaya 2015・Benabena 2014・Kaqchikel 2025

核心概念 · 定義與例

Greenberg 詞序關聯 WORD-ORDER CORRELATIONS 中心語與依存語的相對位置在各結構間傾向一致:OV 語言配後置詞、屬語在前、關係子句在前;VO 語言相反。例日語(OV):後置詞、修飾語一律前置;英語(VO):前置詞、關係子句後置。
中心語/依存語標記 HEAD- vs DEPENDENT-MARKING 語法關係的標記加在中心語(動詞、被領有名詞)上,還是依存語(論元、領屬者)上。例英語領屬標在依存語(John's book);許多美洲語言標在中心語(被領有名詞上加領屬前綴)。
第二位置成分 SECOND-POSITION / WACKERNAGEL CLITIC 某成分(常為助動詞或附著詞)固定出現在句子第二個位置,無關其句法角色。例Wambaya(2015)的助動詞總是插在第一個成分之後。
換指標記 SWITCH-REFERENCE 動詞形態標記「下一子句的主語與本句是否為同一者」,用於串接子句。例新幾內亞與美洲的鏈式句常見「同指/異指」動詞尾。

名詞範疇

NOMINAL CATEGORIES
這個領域在考你:「這個語言怎麼幫世界上的東西分類?它對『數量』和『擁有』的邏輯是什麼?」

訊號 名詞本身沒變,但周圍的冠詞、形容詞、指示詞或動詞前綴,隨著不同的名詞而出現數量驚人的多套形態變化;或者同一個數字標記,遇到「人、香蕉、長條物」時長得完全不同。
假設
    名詞類別與性別 (Noun Class / Gender): 該語言有一套極為嚴格的「名詞分類系統」。語言學上的「性別」本質就是分類,不一定跟生物性別有關。
  • 反轉數標記 (Inverse Number): 數字變化出現奇特規律,某個後綴在 A 類名詞代表「複數」,在 B 類名詞卻代表「單數」(這是在標記「非預設數量」)。
  • 讓渡性分裂 (Alienability Split): 「我的 XX」分為兩套完全不同的文法結構,取決於這個名詞在文化上能不能被你主觀拋棄。
工具
  • 步驟一:建立 名詞 X 一致 矩陣。列出所有名詞,橫向對齊其搭配的修飾語或動詞前綴,找出有幾套「變體套餐」。
  • 步驟二:跨越語意抽象化。 歸納各類的語意交集(如:人類/非人類、生命/無生命、圓形/長條/液體),若有無法分類的,往往是依據發音(音節結構)進行強行歸類(如 Arapesh 2018)。
  • 步驟三:檢查領屬臨界點。 區分不可讓渡(身體部位、親屬,通常與領屬者構詞結合更緊密)與可讓渡(財產、鋤頭,通常需額外領屬詞)。
注意
  • 別用生物性別死套: 語言學的「性別」本質是名詞類別。看到「陽性/陰性」,在語奧裡往往代表「大/小」、「強/弱」或「長/圓」。
  • 反轉數的思維陷阱: 如果某個後綴在 A 類名詞表「複數」,在 B 類名詞卻表「單數」,這絕對是反轉數(Inverse)。這說明 A 類本質預設為單(如:人),B 類本質預設為複(如:雜草/成對的腳)。
代表題:Kiowa 2014・Arapesh 2018・Kilivila 2021・Gaahmg 2025

核心概念 · 定義與例

名詞類別 NOUN CLASS / GENDER 名詞分為若干類,靠冠詞、修飾語、動詞的一致(agreement)現形。例Bantu 有成對的單複數類;Arapesh(2018)多達十三類。
分類詞 SORTAL CLASSIFIER 計數時介於數詞與名詞之間、依語意選用的量詞;分類詞語言通常無強制複數。例Kilivila(2021)依形狀、材質等選用不同分類詞。
反轉數標記 INVERSE NUMBER 同一後綴對「預設為單」的名詞表複、對「預設為複」的名詞表單——它標的是「非預設數」。例Kiowa(2014)的經典現象:一個後綴,兩種相反效果。
可讓渡/不可讓渡領屬 (IN)ALIENABLE POSSESSION 身體部位、親屬等「本質性」領屬用一套結構,可轉讓的財物用另一套。例Gaahmg(2025):不可讓渡(如「他的手」)與可讓渡(如「他的鋤」)標記不同。

語意・詞彙

SEMANTICS & LEXICON
這個領域在考你:「這個文化的大腦是怎麼感知空間、時間與社會關係的?」

訊號 題目給了大量的單字配對或近義詞,或者給了一張複雜的親屬關係圖(族譜)要求填空。單字拼法高度相似,有明顯的共有成分(如:某部件在所有動物詞中都出現)。翻譯選項多為名詞。
假設
  • 不同文化概念編碼:該語言傾向使用組合式複合詞,將抽象邏輯(如:空間參照、多義引申)具象化在詞彙結構中。例如用「眼睛之源」來編碼「水井」,用「腳的手指」來編碼「腳趾」。
  • 絕對空間參照 (Absolute Frame of Reference): 空間定位不用主觀的「左/右」,而是使用絕對坐標(如:順流/逆流、向海/向山、東西南北)。
工具
  • Relation-First 網路化。不要逐字硬背。先找出這組詞彙在共享哪些音段,並問自己:「它們在共同對抗哪一個語意維度?」
  • 幾何坐標還原法。 遇到空間詞(上/下/前/後),立刻在草稿紙上畫出幾何坐標或水流方向圖,把單字填進格子裡,通常會發現它是看「坡度」或「水流」來決定的。
  • 族譜代數化。親屬題立刻將稱謂轉換為代數標記(如:F=Father, M=Mother, B=Brother)。重點檢查「說話者的性別」(男說的哥哥 vs 女說的哥哥長得不一樣)與「父母系排行」是否會觸發稱謂大洗牌。
注意
  • 多義不是同音:遇到一個形式多個翻譯時,優先尋找語意引申的動機(如:「眼睛」引申為「水井之源」)。
代表題:Aralle-Tabulahan 2016・Arabana 2022・Kewa 2025

核心概念 · 定義與例

關係優先原則 RELATION-FIRST 解題時先建立詞項間的關係網絡(誰共享成分、誰對立),再回頭填具體翻譯,而非逐詞硬背。例遇到大量近義詞時,先問「它們差在哪個維度」,往往一問就解開整組。
顏色詞演化階層 BERLIN & KAY HIERARCHY 基本顏色詞的增添遵循固定順序:黑白 → 紅 → 黃/綠 → 藍 → …。例只有兩個基本色詞的語言,必是「暗冷」對「亮暖」的二分,不會是「紅」對「藍」。
空間參照框架 FRAMES OF REFERENCE 描述位置可用相對(左/右)、內在(前/後)或絕對(東西/上下游)框架。例Aralle-Tabulahan(2016)以「順流/逆流/跨河」的絕對地理框架定位。
親屬系統 KINSHIP: CROSS/PARALLEL, SECTIONS 依世代、性別與交表(cross)/平表(parallel)區分親屬;部分澳洲語言另有 section 婚姻分類。例Arabana(2022):交表與平表親屬用不同稱謂,對應通婚規則。
多義 vs 同音 POLYSEMY vs HOMONYMY 一形式多義項若有引申關聯即多義(可畫語意網),若純屬巧合則為同音。例「口」指嘴、瓶口、出入口=多義;判準是義項間有無可推導的動機。

數詞・曆法

NUMERALS & CALENDARS
這個領域在考你:「這個文化是怎麼計數、記錄時間與計算長度的?」

訊號 題目給出一連串的陌生數學等式,或者給出特定曆法的天數、年份配對。
假設
  • 非十進位基底:該語言採用世界罕見的進位基底(常見 5, 6, 20, 24 甚至混合進位)。
  • 逆向思維:記數規則涉及逆計數 (Overcounting)(用「朝向下一階段的第幾個」來表達當前數字)。
  • 模運算與循環: 曆法命名本質上是多軌齒輪嚙合的餘數系統(模算術)。
工具
  • 因數分解找斷點。 觀察哪些數字的拼法突然變長(或變短),那個轉折點就是進位基底 (Base)。將所有已知數字寫成代數式:
    Value = (a × Base²) + (b × Base) + c
  • 捕捉身體部位軌跡。 若數詞拼法極度怪異且語系為巴布亞或澳洲,立刻檢查是否為身體部位計數法(順著手指 → 手腕 → 手肘 → 肩膀的線性路徑)。
  • 化曆法為 Mod 運算。 曆法題直接找出各循環的最小公倍數(如天干地支)。
    總天數 ≡ R (mod 週期) 建立齒輪對照表,直接用數學公式破局。
代表題:Ndom 2007・Umbu-Ungu 2012・Supyire 2023・Dzongkha 2025

核心概念 · 定義與例

進位基底 NUMBER BASE 數詞系統重複的循環單位;不限於十進位。例歷屆出現過 6(Ndom)、20(Nahuatl/Dzongkha)、24(Umbu-Ungu)、混合 5/20/80(Supyire)。
逆計數 OVERCOUNTING 以「朝下一個整十/整廿數的第 n 個」來表數。例「第二個十的第三」= 13;見於馬雅語系等部分中美洲語言。
身體部位計數 BODY-PART TALLY 沿身體固定路徑(手指→手腕→肘→肩…)點數,數字即部位名。例新幾內亞一帶語言的計數詞常直接是身體部位詞。
曆法=模運算+命名 CALENDRICAL SYSTEMS 週期性命名(星期、干支)本質是模算術外加一張命名對照表。例緬甸曜日名(2009)與 Basque 日期(2003)皆為此類。

文字・符號

WRITING SYSTEMS
訊號 題面出現大量未知的異域圖形、網格符號或古代碑文,且符號具有一定的筆畫規律。
假設 根據符號總量判定文字類型通則:
  • 20 ~ 40 種符號:音素文字 (Alphabet) 或元音附標 (Abugida)。
  • 50 ~ 100 種符號:必定是音節文字 (Syllabary)(如日文假名)。
  • 數百到數千個符號:必定是語素文字 (Logography)(如漢字)或混合系統。
工具
  • 步驟一:字符統計與解構。 統計不同字符的總數,並觀察字符的「附標/偏旁」規律(例如:是否每個字右上角都有個小圈圈,可能代表特定元音或調符)。
  • 步驟二:專有名詞錨定。 在文本中地毯式檢索「地名、人名」等專有名詞。因為外來專有名詞在任何系統中都必須「強行表音」,這是破解字音對應的絕佳突破口。
  • 步驟三:頻率與位置交叉。 統計字符出現頻率。若為音素/音節文字,極高頻的字往往是冠詞、連詞或格位後綴;若為語素文字,觀察部件的組合規律(如反切題的聲韻分離)。
注意 小心多音一字/一字多音: 如 Book Pahlavi 2019,古代速記體文字常因筆畫合併導致多個不同字母看起來完全一樣,必須靠上下文(句法與語意)反推。
代表題:Vai 2011・Tangut 2014・Luwian 2016・Book Pahlavi 2019

核心概念 · 定義與例

音素文字 ALPHABET 字符對應輔音與元音音位。例拉丁字母、希臘字母、韓文(字母組成音節塊)。
元音附標文字 ABUGIDA 輔音字符自帶固有元音,其他元音以附標改寫。例天城文;Khom 文字(2017,書寫 Jru')。
音節文字 SYLLABARY 一符對一音節,多為近代獨立發明。例Vai(2011)、日文假名、Cherokee。
語素文字 LOGOGRAPHY 字符對應語素/詞而非單純語音。例西夏文 Tangut(2014)、漢字。
混合系統 MIXED SCRIPT 同時含表意符(logogram)與表音符(phonogram)。例Luwian(2016)象形=表語符+音節符;埃及聖書體亦然。
反切 FANQIE 用兩個已知漢字拼出一字之音:上字取聲母、下字取韻母與聲調。例IOL 2008 華—粵反切題:由「德紅切」拼出「東」的讀音。

歷史比較

HISTORICAL & COMPARATIVE
這個領域在考你:「給你看樹葉與樹枝,你要在草稿紙上把整棵演化樹(語言樹)畫出來。」

訊號 題目並列給出兩種到三種互不相通、但長得很像的語言(兄弟語言),或者要求你根據現存的幾個語言,回推它們祖先的面貌(「原始語 Proto-language」)。 題目通常伴隨著一個填空表,有些單字在 A 語言有,在 B 語言卻是空的。
假設
  • 音變宿命:語音歷史演變是規則的 (Sound Change is Regular),任何 exceptions(例外)都必須有條件觸發解釋。
  • 借詞分層:相像卻不符合音變通則的詞,屬於後期文化接觸的借詞層 (Loanword Stratum)。

工具
  • 步驟一:橫向對齊同源詞。 將各語言的同源詞(意義相同或極近者)垂直對齊,逐個音段寫出對應集 (Correspondence Set)。例如:
    Lang A [p] ↔ Lang B [f] ↔ Lang C [b]
  • 步驟二:提取觸發環境。 當發現同一個字母有兩種對應時,立刻檢查上下文環境。問自己:是不是因為隔壁是高元音?是不是在詞首?是不是夾在元音中間(夾擠同化)?
  • 步驟三:例外隔離。 將對不上的「例外」單獨拉一個清單,這往往是命題者藏借詞(如 Garífuna 2021 的男性用語層)或聲調產生 (Tonogenesis) 的地方。
注意 「長得像」不等於同源: 歷史比較題看的是「規則」,哪怕 Lang A 的 p 永遠對應 Lang B 的 x,只要每字皆然,這就是鐵證;反之,若十個詞裡有九個長得一模一樣,只有一個歪掉,那個一模一樣的反而可能是近代借詞。
代表題:Turkish/Tatar 2007・Macro-Jê 2018・Chamic 2022・Kiranti 2025

核心概念 · 定義與例

對應集 CORRESPONDENCE SET 同源詞在各語言對應位置的音段集合;規則對應優先於個別詞的相似。例Grimm 定律的 p : f : b——拉丁 pēs 對英語 foot。
借詞層 LOANWORD STRATUM 接觸引入的詞不遵守本語音變規則,構成可辨識的例外層。例Garífuna(2021):阿拉瓦克底層之上疊加加勒比語源的男性用語層。
聲調產生 TONOGENESIS 音段對立(清濁等)轉為超音段對立(音高)的歷史過程;在比較題裡是「規則音變」的一種。例占語支各語言的聲調層次可回推到共同的聲母合流。
詞彙統計法 LEXICOSTATISTICS 以基本詞彙的共有比例估計親疏、建構語言樹;Dolgopolsky 輔音類用來降噪。例IOL 2024 團體賽正式登場,含 StarlingNJ 建樹演算法。

社會・詩律・文化

SOCIOLINGUISTICS & POETICS
訊號 同一個句子或單字,題目給出了兩套截然不同的合法拼法,且明確指出這跟「誰在說話(男/女)」、「對誰說(長輩/平輩)」或者「這是不是在念咒語/念詩」有關。
出現類似「黑話、隱語」的題目,正常單字變成一串極長且重複性高的音節。
假設
  • 社會語體與性別語體 (Genderlect): 說話者與聽話者的社會關係(性別、階級、姻親避諱)直接參與了構詞。在某些澳洲原住民語言中,對著岳母說話必須切換成完全不同的「女婿專用語彙」。
  • 隱語的可逆代數變換 (Ludling/Language Game): 所有的密語(如 Pig Latin)都是在底層語言之上,疊加了一套可逆的音韻數學變換(如:倒裝、插音、音節複製)。
  • 格律約束(音拍格子): 詩律題是以音節(Syllable)或音拍(Mora)的數學硬限制,強行約束用詞的形式與重音落點。
工具
  • 分佈互補化。 建立社會變項(男說/女說、對男說/對女說)二維矩陣,把兩套形態填進去,鎖定觸發切換的核心軸線(如 Yanyuwa 2024)。
  • 隱語逆向工程。 將隱語單字與正常單字對齊,找出拼法拉長或移位的規律,通常是「提取首個音節扔到詞尾,並強行插入固定成分」(類似 Pig Latin 或 Agbirigba 2021)。
  • 計數詩律格子。 詩律題直接把每個元音標上「長/短」或「輕/重」,手動數每行的音拍總數。
注意 注意雙重變項疊加:有時「說話者是女性」和「對象是男性」會同時作用,導致前綴發生複合屈折,一定要畫雙軸矩陣,別漏掉任何交叉點。
代表題:Sanskrit 2011・Agbirigba 2021・Arabana 2022・Yanyuwa 2024

核心概念 · 定義與例

性別語體 GENDERLECT 說話者(或聽者)性別決定用哪一套形式,非個人自由選擇。例Yanyuwa(2024)男女語體用不同的名詞類前綴。
隱語 LUDLING 在正常音韻之上疊一層可逆的變換(移位、插音、替換)以達隱蔽。例Agbirigba(2021)由 Ikwerre 方言經規則變換而來;英語的 Pig Latin 同理。
詩律 METRICS / PROSODY 以音節輕重、音拍數,或頭韻/尾韻的形式化規則構成格律。例Sanskrit(2011)輕重格;Old Norse dróttkvætt(2008)講究頭韻與內韻。
命名系統 NAMING SYSTEMS 姓名依出生日、星期、排行等規則生成,可逆推。例緬甸人名(2009)與出生曜日對應。

計算・編碼

COMPUTATION & CODES
訊號 題目上比較沒有傳統意義上的「人類語言」,取而代之的是純數字、演算法虛擬碼、條碼圖案或神經科學/行為科學的實驗圖表。
假設
  • 形式代數系統: 這類題目是一個純粹自足的符號映射或校驗系統(例如:身分證字號最後一碼的 Checksum 機制)。
  • 實驗邏輯對比: 心理/神經語言學題涉及「自變項(控制條件)→ 依變項(反應時間/腦電波波幅)」的認知加工映射。
工具
  • 拆解形式算式(抓校驗碼)。 編碼與條碼題,立刻尋找不變量與末位的特殊關係(最後一位通常是校驗碼)。嘗試建立加權求和公式: ∑ (xi × wi) ≡ 0  mod  (10 或 11)
  • 實驗圖表條件化
    • 讀懂自變項: 到底是什麼結構被違反了?(句法違規?還是語意荒謬?)
    • 對應依變項: 腦電波的波峰落點。
    • 記住黃金通用律:N400(出現在 400 毫秒的負向波)通常對應語意荒謬(如:我喝了一杯「皮鞋」);P600(出現在 600 毫秒的正向波)通常對應句法衝突(如:他「們」是一個「學生」)。
  • 加工難度映射。依據加工難度(反應時間長短或波幅大小)與句子結構的複雜度進行一對一配對(如 Kaqchikel 2025)。
代表題:EAN-13 2011・Soundex 2015・Lexicostatistics 2024・Kaqchikel 2025

核心概念 · 定義與例

校驗碼 CHECKSUM 附加位由前面各位依固定加權運算得出,用於偵錯。例EAN-13(2011)第 13 位=前 12 位加權和對 10 取補。
語音檢索編碼 PHONETIC HASHING 把讀音相近的字串映到同一代碼,供模糊檢索。例Soundex(2015):Robert 與 Rupert 編為同碼。
遺傳密碼 GENETIC CODE 三聯體密碼子對應胺基酸的多對一映射,可當純符號解碼題。例IOL 2010 mRNA 題:由密碼子表反推轉譯規則。
實驗資料判讀 EXPERIMENTAL-DATA READING 從行為或腦電(ERP)資料反推語言處理規律;2025 首見,屬新題型類別。例Kaqchikel(2025):判讀處理不同句法結構時的腦電反應。

實戰驗證:羅馬尼亞語奧十題

讀完十一大領域後,用 Olimpiada de Lingvistică „Solomon Marcus" 2024 Exercițiu A(4 題)+ 2025 OJL/ONL(6 題)檢驗「訊號 → 假設 → 工具」是否真的能調用。每題先自己判領域、勾概念,再展開答案。 十題驗證卡(完整版)| 英文原題彙編(.docx)

V0驗證流程(對應§0)

§0 提到「先讀訊號、再選工具」;驗證篇的使用順序如下:

四步驗證法:① 只讀每張卡的「訊號辨識」,先自己說出這題屬於哪個領域、該用什麼工具(對照§2 的假設欄)→ ② 勾選「扣回講義」清單,確認每個概念都能用自己的話定義 → ③ 沿「解題路徑」在紙上實作(有原題 PDF 更佳)→ ④ 最後才展開「答案與詳解」對答案。順序顛倒=驗證失效。

每張卡的頂色與領域籤,沿用§2 的十一領域配色。看到顏色就可想起對應的 rail(訊號→假設→解題→注意)。

V1對照總表:十題 × 領域 × 概念考點

粗體為該題的主領域;「概念考點」即§2 各領域詞彙表中的詞條。

卡語言(年份・賽別)領域扣回講義的概念考點
①Munster 愛爾蘭語 & Kobon
2025 OJL
音韻・聲調 重量敏感・重音窗・響度階層・有界系統
②aroma(南島)
2024 ONL
構詞 槽位模板表・環綴(非連續語素)・零標記・融合・使動/反身
③yawalapiti(阿拉瓦克)
2024 OJL
構詞 對齊・一致 中心語標記・主語=領屬同形前綴・讓渡性標記
④Burushaski(孤立)
2025 OJL
對齊・一致 作格—絕對格・流動 S(自主性)・多重一致・不可讓渡領屬
⑤Worora(澳洲)
2025 ONL
對齊・一致 名詞範疇 人稱階層・直接—反向・1↔2 空缺・語義性名詞類・前動詞+助動詞
⑥Tzeltal(馬雅)
2025 ONL
數詞・曆法 名詞範疇 二十進位・超數法・數詞分類詞・泛用分類詞
⑦Ewe(Gbe)
2025 ONL
語意・詞彙 音韻・聲調 聲調最小對・輕動詞・重疊名物化・複合語義
⑧滿文(通古斯)
2025 OJL
文字・符號 破譯槓桿・圈點附標・位置變體・母音和諧的字形化
⑨baybayin 手語(菲律賓)
2024 OJL
文字・符號 abugida・固有母音・virama(去母音記號)
⑩Chants of Sennaar(遊戲語言)
2024 ONL
文字・符號 句法・詞序 亂序配對法・重疊表複數・否定前置・包含/排除式我們・零繫詞
注意難度:2024 Exercițiu A 為五、六年級組(可當暖身);2025 OJL/ONL 為主賽事難度。 建議順序:先 ⑨⑩③(暖身)→ ①④⑥⑦(中間)→ ②⑤⑧(難)。卡片編排依§2 領域順序,非難度。
完整驗證材料請讀姊妹篇: 《十題驗證卡》 含 V2 逐題攻略(訊號→扣回概念→解題路徑→摺疊答案)、V3 官方勘誤三連、V4 領域覆蓋矩陣,以及 V5 與 §6 賽前預測的對位。 建議流程:在本頁對照 V1 表選一題 → 到驗證篇依 V0 四步法實作 → 再回 §3 考古題索引補未覆蓋的三個領域。

§3考古題總索引(IOL 2003–2025)

共 134 題:個人賽每屆五題 × 22 屆,加上團體賽。點選領域標籤可篩選(可複選);「個1」指個人賽第 1 題,「團1」指團體賽。

⚠️ 標註信度說明:語言名稱與語系已逐屆對照 ioling.org 官方題庫。考點方面:● 標記(128 題)已對照 Wikipedia 的官方逐題描述,並抽驗 2004、2007、2008、2014、2016、2023、2024 各屆的官方英文解答 PDF 逐題確認;◇ 標記(6 題)為尚未對照官方解答者,集中在 2003–2004 與 2009。這幾屆的官方解答為掃描檔,無法擷取文字,因此只能先給出領域層級的暫定分類。此版已將待驗證題目由初版的 59 題降至 6 題。
屆題語言語系/領域考點類型學標籤

§4頻率分析:全期 vs 近八屆

每個領域有兩條長條:深色是 2003–2025 全期的出現次數,淺色是 2018–2025 近八屆。一題可掛多個標籤,因此加總會多於題數。

■ 全期(2003–2025) ▨ 近八屆(2018–2025)構詞5020音韻・聲調3711語意・詞彙308文字・符號203句法・詞序184對齊・一致145數詞・曆法133社會・詩律136名詞範疇126歷史比較126計算・編碼93
三個值得注意的地方:①「構詞」與「對齊・一致」在近八屆平均每屆超過三題,是語奧不變的核心,複習分配應以此為基準。②「名詞範疇」(類別、分類詞、領屬)近八屆的密度明顯高於早期,且常與構詞、聲調結合成複合考點,如 Gaahmg 2025 一題就橫跨三個領域。③「文字・符號」全期出現 20 次,但近八屆(2018–2025)僅 3 次——2 次團體賽(2019 韻律體操、2022 Manchu)、1 次個人賽(2019 Book Pahlavi);個人賽的文字題自 2019 後即未出現,是目前分布上最明顯的異常。

§5資料視角:WALS × Grambank 的通則與例外

前四節整理的是「語奧考過什麼」;這一節換一個方向,直接從 WALS(v2020.4)與 Grambank(v1.0.3)兩個類型學資料庫計算世界語言的實際分布。對選手有兩個用途:一、看到題目語言的地區或語系,就能預期它大概會有哪些特徵;二、通則的例外正是命題者喜歡取材的地方。以下所有百分比都由資料庫原始檔計算而得,非印象式描述。

聲調的地理分布(WALS 13A,n = 527)

複雜聲調系統(88)簡單聲調系統(132)無聲調(307)中美洲:Oto-Manguean 複雜調群新幾內亞:零星聲調(多為簡單系統,含 Kewa)Na-Dene:聲調化澳洲:0/32,全無聲調
通則:聲調語言高度集中於兩個地帶:撒哈拉以南非洲(127 個樣本語言中 112 個有聲調,88%)與東亞/東南亞(歐亞區的聲調語言幾乎全在這裡)。例外(值得特別注意):①中美洲有一整群複雜聲調語言(Oto-Manguean 語系:Mixtec、Chinantec、Mazatec、Tlapanec 等);②北美西北部的 Na-Dene 語系(Navajo、Tlingit、Slave)經歷聲調化(tonogenesis);③巴布亞圈 81 個樣本中有 18 個聲調語言、多為簡單系統,主要落在新幾內亞(含 IOL 2025 考過的 Kewa);④澳洲 32 個樣本語言全數無聲調 - 看到澳洲語言,可以直接把聲調從假設清單上剔除。北美樣本的聲調比例其實達 37%,高於多數人的直覺。

六大區的特徵先驗表(Grambank,各格為「有此特徵」的語言比例)

特徵(Grambank 編號)非洲澳洲歐亞北美巴布亞圈南美全球
包含/排除式「我們」(GB028,n=2355)29%74%41%46%78%47%53%
作格式格位標記(GB409,n=1767)3%77%24%11%25%34%22%
數詞分類詞(GB057,n=2175)2%2%48%19%29%19%24%
代名詞雙數(GB031,n=2332)4%76%27%17%43%10%26%
動詞隨參與者的數換詞幹(GB109,n=1890)10%5%6%34%13%19%13%
以性別為基礎的名詞類(GB051,n=2205)19%33%24%14%10%30%19%

紅底=該特徵的全球高峰區;藍底=顯著低谷。讀法示例:題目語言若來自澳洲,作格、雙數、包含/排除三項的先驗機率都在四分之三上下,分析時應優先檢查;反之它幾乎不會有聲調或數詞分類詞。

① 詞序和諧與它的突破點

Greenberg 詞序關聯在資料裡非常強:OV 語言配後置詞、VO 語言配前置詞,835 個雙特徵都有值的語言中 94% 符合(WALS 81A × 85A)。例外共 53 個,且成群出現:OV+前置詞集中在伊朗—閃語接觸帶(波斯語、塔吉克語、中庫德語、Tigrinya、新亞蘭語);VO+後置詞集中在波羅的—芬蘭語支(芬蘭語、愛沙尼亞語)、南美 Tupian/Arawakan(Guaraní、Cocama、Apurinã —— IOL 2023 個人2、Lokono —— IOL 2021 團體)與西非 Kwa/Gur。另外,賓語在主語之前的基本詞序(OVS/OSV)全球僅 15 個語言(約 1%),其中 8 個在南美、Cariban 語系就占 3 個(Hixkaryana、Tiriyo、Kuikúro)。所以看到南美語言而句子解不出 SVO/SOV 時,值得試試 OVS。

② 區域「套餐」:特徵會成束出現

特徵不是獨立分布的。澳洲套餐:無聲調(0/32)+作格 77%+雙數 76%+包含/排除 74%+受限數詞系統(WALS 131A 的澳洲樣本裡有 Kayardild、Yidiny、Pitjantjatjara 等 6 個「數詞只到 3–4」的語言)。北美套餐:動詞隨參與者的數換詞幹(GB109)在北美高達 34%、遠高於全球 13%,像 Muskogean(含 IOL 2022 的 Alabama)、Uto-Aztecan、Yuman 都是典型例子。Grambank 甚至把 Maricopa(Yuman)本身就編碼為「有」(GB109=1),而它正是羅馬尼亞全國賽 ONL 2026 的考題語言之一;名詞類反而少(14%)。巴布亞圈:包含/排除 78% 全球最高,且是「身體部位計數法」全球唯一的家(WALS 131A:Eipo、Kobon、Haruai、Una 全在新幾內亞)。

③ 例外名單可能就是命題熱點

把上面各條的「例外語言」列出來,會發現名單讀起來像考古題索引:Kewa(新幾內亞聲調→IOL 2025)、Kiowa(北美聲調→2014)、Alabama(動詞換幹→2022)、Apurinã 與 Lokono(VO+後置詞→2023、2021)、Dyirbal 與 Yanyuwa(澳洲作格→2012、2024)、Yidiny 與 Kayardild(受限數詞→IOL 2013、羅馬尼亞 ONL 2026)、Umbu-Ungu(24 進位→2012)。這不是巧合:一個語言在類型學上越「不聽話」,越有機會做成一道自足的推理題。實務建議是複習每個領域時,花一點時間記住該通則的三、五個著名反例,它們比通則本身更可能出現在考卷上。
文字與地理(整理自文字學通論,非上述資料庫):文字類型也有清楚的地理慣性,可輔助文字題定位:元音附標文字(abugida)集中於印度系文字圈(南亞、東南亞、藏區)加上衣索比亞的 Ge'ez;輔音文字(abjad)沿閃語帶分布(阿拉伯文、希伯來文,及其祖先腓尼基系);音節文字則多是近代獨立發明——西非 Vai(IOL 2011)、Cherokee、加拿大原住民音節文字(Cree/Inuktitut),共同點是由接觸過外來文字、但未受其結構束縛的個人所創。IOL 的文字題取樣正好沿著這張地圖走:Vai 2011、Tangut 2014、Luwian 2016、Khom 2017、Book Pahlavi 2019。

§3 的 134 題,比世界更罕見嗎?Grambank 罕見度量化

前面幾節是印象與頻次;這裡把假說寫成一個可檢定的數字。做法分三步:(1) 對映:把 §3 的 134 題語言逐一對回 Grambank v1.0.3 的特徵向量(195 個特徵)。其中 44 題無法對映(人工符號系統如 Braille、Blissymbolics、EAN-13、mRNA;純方法論題如詞彙統計法;以及尚未進入 Grambank 的語言如 Adyghe、Yoruba、Manchu、古諾斯語等),剩下 84 個相異語言成功取得特徵向量。(2) 定義罕見度:對每個特徵 f,用全庫計算各取值的頻率 p,某語言在該特徵上的「驚訝度」即 −log₂p(取全球少數值 → 位元數高);一個語言的罕見度=其所有已編碼特徵的驚訝度平均。(3) 比較:考題語言的罕見度分布 vs 世界其餘 2,348 個語言。

世界均值 0.742 考題均值 0.799 考題語言(84) 世界其餘(2348) 0.50.60.70.80.91.0平均類型學罕見度(每特徵 −log₂p,位元)→ 越右越罕見
結論:假說成立,效果中等。考題語言的平均罕見度為 0.799 位元/特徵,世界其餘為 0.742(差 +0.057)。這把考題語言的整體位置推到世界分布的第 73 百分位。效果量 Cohen's d ≈ 0.55(中等);Mann–Whitney 單尾 p ≈ 1.9×10⁻⁷;置換檢定(B=20,000)p ≈ 5×10⁻⁵。關鍵是,即使做大區分層置換(讓對照組的六大區組成與考題語言相同,藉此排除「命題偏好澳洲/新幾內亞/亞馬遜這些本就罕見的地帶」這個混淆),p 仍 ≈ 5×10⁻⁵。命題者確實系統性地偏好類型學上取「少數值」的語言,而且這不只是地理取樣的副產品。

是哪些特徵讓考題語言「與眾不同」?

特徵(Grambank)世界「有」考題「有」差
謂語領有可用「S 式領有物+處所」表達(GB253)13%30%+18%
第二人稱有敬稱/禮貌區別(GB415)14%30%+16%
關係子句可前置於名詞(GB328)31%46%+16%
代名詞核心論元有形態格(GB071)46%62%+16%
語氣可由屈折的助動詞標記(GB119)28%43%+15%
包含/排除式「我們」的區別(GB028)53%35%−17%
動詞重疊(GB158)73%58%−15%
關係子句可後置於名詞(GB327)82%69%−13%

紅底=考題語言明顯偏多、藍底=明顯偏少。可看出命題者偏愛「形態較繁、且結構偏離全球預設」的語言:有格位、有敬稱、關係子句能前置、語氣靠助動詞——這些正是無法靠英語直覺套用的特徵,也就是能撐起一道自足推理題的性質。

罕見度最高的考題語言(前 8):Movima(0.997)、羅曼什語(0.991)、拉丁語(0.990)、West Tarangan(0.987)、加泰隆尼亞語(0.958)、Rikbaktsa(0.951)、Hadza(0.938)、Muna(0.934)。這份榜單也點出本量度的一個重要限定:「罕見」量的是「取全球少數特徵值」,不是「冷僻」或「瀕危」。拉丁語、加泰隆尼亞語之所以名列前茅,是因為歐洲語言在敬稱、複雜格位、關係子句前置等全球少數特徵上剛好都取「有」;這對語奧其實是好消息:它恰好對應「無法靠常見語言直覺預設」的難度來源。
兩點方法保留:①這 84 個語言在系屬與地理上並非獨立樣本(大量集中於澳洲、新幾內亞、亞馬遜等本就偏離全球眾數的地帶),置換檢定的可交換性假設會高估顯著性;大區分層雖已緩解,仍未完全處理科(family)層級的自相關,嚴謹版本應改用系統發生對照(phylogenetic control)。②Grambank 的「?」(未編碼)比例不低,各語言已編碼特徵數不一,本文只納入已編碼 ≥40 特徵者。所有數字皆由 grambank/grambank 的 CLDF 原始檔重算。

布加勒斯特 2026 的地利:巴爾幹語言聯盟(Balkansprachbund)

主辦地本身就是一個類型學案例。羅馬尼亞位於巴爾幹語言聯盟的核心:四個彼此在印歐樹上分屬不同分支的語言 —— 羅曼語(羅馬尼亞語/阿羅馬尼亞語)、斯拉夫語(保加利亞語/馬其頓語)、希臘語、阿爾巴尼亞語 —— 經過長期接觸,收斂出一批共同特徵(Balkanisms)。這是語奧最鍾愛的一種題型骨架:系屬各異、卻在某特徵上一致,逼選手區分「繼承」與「接觸」兩種來源。以下用 Grambank 中實際有編碼的五個巴爾幹語言,對照世界基線,看是否在資料裡看得見某些收斂。

特徵(Grambank)世界「有」阿羅馬尼亞
羅曼
馬其頓
斯拉夫
現代希臘蓋格阿爾巴
阿爾巴尼亞
托斯克阿爾巴
有定冠詞(GB020)37%✓✓✓✓✓
後置冠詞(GB023)23%✓—*✓✓✓
時制可由非屈折小詞標記(GB521)24%✓✓✓✓✓
語氣可由非屈折小詞標記(GB519)40%✓—✓✓✓
專用未來式的動詞形態(GB084)45%✓————
核心論元有形態格(GB070)34%✓✓✓✓✓

*馬其頓語實際上有後置冠詞(-ot/-ov/-on),此處 Grambank 編碼與教科書描述不一致,屬編碼取捨差異。這也正好提醒,資料庫是先驗工具,不是判準,遇到與描述衝突時應以第一手語法為準。紅底=該巴爾幹語言取了全球少數值。可清楚看到後置冠詞(世界 23%)與小詞時制標記(世界 24%)在這幾個不同分支的語言間高度收斂——這正是接觸而非繼承的指紋。

八大巴爾幹主義(哪些 Grambank 抓得到、哪些抓不到)

資料庫看得見的:①後置定冠詞(羅 omul「那人」、阿爾巴 ujku→ujk-u、保/馬 -ът/-ot);②「想要」型迂迴未來式(希 θα、羅 o să、阿爾巴 do、保/馬 ще/ќе,皆源自「想要」動詞)→ 對應 GB521 小詞時制;③普遍有定冠詞。Grambank 未直接編碼、但更常成為考點的:④不定式的萎縮,改用虛擬式子句(羅 vreau să merg「我想 我去」而非「我想去」);⑤與格與屬格合流;⑥形容詞比較級改用分析式小詞(羅 mai、保 по-);⑦賓語代名詞複指(clitic doubling);⑧中央元音 schwa(羅 ă/î、阿爾巴 ë、保 ъ)與(保/馬/阿爾巴的)傳信範疇。第 ④–⑧ 這幾項因為要靠句子對比才能觀察,反而是最適合出成推理題的素材。
對布加勒斯特 2026 的實戰意義:若出現巴爾幹語言,最可能的骨架是「接觸 vs 繼承」的辨識題 — 例如給幾個不同分支的巴爾幹語言句子,要選手歸納出共有的後置冠詞或 să/να-虛擬式未來,並解釋它不能用共同祖先解釋(因為分屬羅曼、斯拉夫、希臘、阿爾巴尼亞四支)。這與 §5 開頭的通則一致:例外就是值得注意的地方,而巴爾幹語盟整片就是印歐語內部最大的一塊「例外聚落」。值得順帶記住的搭配題材:羅馬尼亞語同時保留了拉丁語已失、但被斯拉夫接觸強化的呼格;以及達契亞—羅曼與阿羅馬尼亞的分裂。不過須留意!主辦地與命題取材沒有必然關係:羅馬尼亞全國賽 ONL 2026(「Solomon Marcus」全國賽,2026 年 5 月於 Odorheiu-Secuiesc,非布加勒斯特)的題目語言(如 Turkana、Kayardild、Icelandic、Maricopa 等)就無一是巴爾幹語言;本節是「若考到」的準備,而非預測它一定會考。

方法備註:WALS 資料為 v2020.4(wals.info;cldf-datasets/wals),Grambank 為 v1.0.3(grambank.clld.org;grambank/grambank),均以其 CLDF 檔直接計算;n 為該特徵實際有編碼的語言數,各特徵樣本不同,且 WALS 的語言取樣偏向文獻較完整的語言,比例僅供先驗參考、不宜過度解讀。大區劃分依 Glottolog 六大區(Papunesia 此處譯「巴布亞圈」,含新幾內亞與大洋洲島嶼)。

§6賽前預測:Bucharest 2026 的方向配比

預測用於分配複習時間,而非押題。以下每一條都附上推論依據與信度,請勿當成保證。

① 對齊・一致+構詞:必然核心高信度

近八屆每屆至少有一題考動詞一致/對齊系統(2023 Plains Cree、2024 Koryak、2025 團體 Kiranti),這已是常態而非趨勢。複習時間至少保留四成給:S/A/P 分析、階層一致、direct–inverse、多元人稱標記。

② 文字系統題回歸中信度

個人賽的文字題自 2019 Book Pahlavi 那題之後,2021 年起連續五屆缺席;期間文字類僅在團體賽出現(2019 韻律體操符號、2022 Manchu),遠長於過去的間隔(2011、2014、2016、2017、2019,大約一至三屆一次)。依此空窗推斷,回歸機率不低(此為節奏外推,非命題委員會的意向)。建議賽前針對元音附標(abugida)、音節文字、混合文字各做一題暖身。

③ 聲調×構詞介面持續升溫高信度

2022 的 tonogenesis、2024 Dâw、2025 的 Kuria 與 Gaahmg;聲調已從「音韻題的點綴」轉為承載構詞訊息的手段,以調類標示語法範疇。練習方向:把聲調當成一個屈折槽位來分析,而非單純的音韻現象。

④ 數詞題節奏性降溫但不歸零中信度

2023 Supyire 與 2025 Dzongkha 僅相隔一屆。如果依歷史節奏(約每兩三屆一題),2026 出現的機率略降。維持基本盤即可:花十五分鐘複習進位斷點分析法。

⑤ 團體賽:「大規模資料+方法論」是新常態高信度

2021 語言接觸、2022 滿文文本、2023 多式綜合、2024 詞彙統計演算法、2025 跨語支比較。團體賽已從「單一複雜語言」轉向「一套方法論加上大量多語言資料」。分工訓練的重點在於:如何切分資料、如何共同維護一張對應表、如何交叉檢查彼此的結果。

⑥ 實驗資料題可能成為常設槽位低信度・新訊號

2025 Kaqchikel 首次出現神經語言學的資料判讀題,UKLO 評價它「出乎意料地好解」。若命題委員會延續此方向,第五題的位置有可能不定期出現心理語言學/語料統計類的資料題。準備成本不高:練習讀懂「自變項—依變項—條件對比」這組實驗設計的基本要素。

⑦ 主辦地效應:巴爾幹訊號低信度

布加勒斯特 2026 的對應候選:巴爾幹語言聯盟的特徵(後置定冠詞、不定式消失)、羅姆語(Romani)、羅馬尼亞語方言。可當作背景閱讀,不必投入太多。

可主張 vs 不可主張

✅ 頻率統計可支持的主張🚫 資料不支持的主張
對齊/構詞為每屆常態,複習分配應依此分布「某某語系一定會考」— 命題刻意避免被預測
文字題有明顯空窗,回歸機率高於平均「空窗一定在 2026 補上」— 委員會不受節奏約束
團體賽題型已明顯轉向方法論與大資料「主辦地語言會入題」— 僅 2025 一個正例,樣本太少
即使扣除剩餘 6 題 ◇,各領域排序仍不受影響(前三名不變)剩餘 6 題 ◇ 的細部考點 — 早期掃描檔尚無法逐字對照

§7考前 24 小時檢查表

進考場前最後檢查一輪,完成一項就勾選一項。

0 / 10 完成
S/A/P 表格 | 能在三十秒內畫出空白模板,並說明四種對齊型的填法
進位斷點法| 複習 6/12/20/24/60 進位的構詞斷點案例各一則
聲調作為屈折槽| 重做一題「以調類標語法範疇」(建議 Kuria 2025)
direct–inverse 模型|能口述 Plains Cree 的人稱階層與 obviation
領屬二分| 可讓渡 vs 不可讓渡的典型語意類別(身體、親屬、部分—整體)
文字類型判定| 熟記「符號種類數 → 文字類型」的門檻值
對應集紀律| 歷史比較題先建對應表、例外另歸一類,不急著下結論
語意題流程| 先掃語義場、後看詞形;先建矩陣、再畫局部圖
作答格式| 寫出規則與系統,而非字典式配對;不確定處明白寫出假設
時間策略 | 先掃五題定位領域、由熟到生作答;單題卡關二十分鐘就考慮換題