本日,三篇以「來源分離分析」為核心的新論文同步上線。這三篇論文訂正了先前發表的486種音節混合分析,重新呈現巴賽語音韻體系的正確面貌——並揭示宜蘭方言深度受噶瑪蘭語影響的音韻借用證據。
問題的起點:486種音節是怎麼算出來的
先前的研究(《巴賽語音節目錄及其音韻類型學定位》,2026年6月)從巴賽語詞典資料庫中取出2,364筆現代詞彙,直接計量音節,得出486種。這個數字本身並沒有算錯,但犯了一個根本的方法論錯誤:把性質不同的詞彙來源混在一起計算。
詞典資料庫的每筆條目都標有來源碼,代表資料的採集地點與性質:
| 來源碼 | 條目數 | 性質 |
|---|---|---|
| B | 1,117 | 固有巴賽語詞彙 |
| T / M | 588 / 541 | Trobiawan(宜蘭地區)方言 |
| S | 113 | 疑似大量噶瑪蘭語混入——排除 |
| PAN | 960 | 原始南島語重建形式——排除 |
將 B、T+M 混合後計算,就把兩個音韻層次的資料疊加在一起,導致三個具體錯誤:(1)CV型被誤報為主要結構;(2)/q/、/z/、/ɭ/、/ɮ/ 等音素被誤歸為固有巴賽語音素;(3)音節種數486種高估了固有音韻庫的實際規模。今日發表的三篇論文逐一訂正這些問題。
論文一:訂正論文(重新分析)
〈巴賽語音節目錄的重新分析:來源分離分析對混合分析的訂正及語言接觸證據〉
這篇是三篇的總綱,直接對混合分析的四項錯誤進行系統性訂正,並確立「來源分離分析是多層次詞典資料庫音韻描述不可省略的方法論步驟」這個原則。
訂正結果一覽:
| 混合分析(先前) | B 固有詞彙 | T+M 宜蘭方言 | |
|---|---|---|---|
| 音節種數 | 486 | 266 | 315 |
| 起始輔音類別 | 48 | 22 | 38 |
| 主要結構 | CV(誤) | CVC(54%) | CVC(50%) |
📥 PDF(中文) PDF(日本語) PDF(English)
論文二:固有詞彙(source=B)音節目錄
〈巴賽語固有詞彙(source=B)音節目錄:以來源分離分析重建音韻體系〉
以1,117筆固有詞彙為唯一分析對象,呈現巴賽語「本來」的音韻面貌。
主要結果:
- 266種音節,22個起始輔音類別
- CVC型為主(134種,54%)——訂正CV型優勢之誤
- 固有詞彙特有音素:
h、s'(/ʃ/)、ts'(/tʃ/) q、z、z'(/ɮ/)、l'(/ɭ/)は固有詞彙中完全缺席
這份結果確立了一個重要基線:固有巴賽語的音韻體系比混合分析所呈現的更為整齊,也更具台灣南島語的典型面貌。
📥 PDF(中文) PDF(日本語) PDF(English)
論文三:宜蘭方言(source=T+M)與噶瑪蘭語接觸
〈巴賽語宜蘭方言(source=T+M)音節目錄:與噶瑪蘭語言語接觸的證據〉
以1,129筆Trobiawan資料(T+M)為分析對象。結果顯示,宜蘭方言的音韻體系明顯不同於固有巴賽語,且差異可追溯至噶瑪蘭語的直接影響。
主要結果:
- 315種音節,38個起始輔音類別(比B多16類)
- T+M獨有的6個音素:
q(/q/)、z(/z/)、z'(/ɮ/)、l'(/ɭ/)、ml'(/mɭ/)、vl'(/vɭ/)——全部對應噶瑪蘭語音素 - CVVC型音節(26種)及輔音叢(22種)顯著多於B,亦呼應噶瑪蘭語特徵
- B中存在的
h、/ʃ/、/tʃ/ 在T+M中缺席——可能是向噶瑪蘭語音韻型收斂的結果
這些模式在 Thomason & Kaufman(1988)的接觸類型學框架下,指向系統性音韻借用,而非偶發的詞彙借入。巴賽語宜蘭方言很可能與噶瑪蘭語長期共存,發生了深度的音韻融合。
📥 PDF(中文) PDF(日本語) PDF(English)
小結:來源分離為何不可省略
三篇論文共同指出同一結論:在使用多層次詞典資料庫進行音韻分析時,忽略來源碼的集計計算,在語言記述上是不可信賴的。B 與 T+M 共有128種重複音節,但兩者擁有明顯不同的音韻體系——將其一括稱為「巴賽語的音節」,會嚴重損害描述的精確性。
先前的486種混合分析已作為存檔保留(連結),並附有指向本次訂正論文的標注。所有新論文均採 CC BY 4.0 授權,PDF 可自由下載。