本日,三篇以「來源分離分析」為核心的新論文同步上線。這三篇論文訂正了先前發表的486種音節混合分析,重新呈現巴賽語音韻體系的正確面貌——並揭示宜蘭方言深度受噶瑪蘭語影響的音韻借用證據。

問題的起點:486種音節是怎麼算出來的

先前的研究(《巴賽語音節目錄及其音韻類型學定位》,2026年6月)從巴賽語詞典資料庫中取出2,364筆現代詞彙,直接計量音節,得出486種。這個數字本身並沒有算錯,但犯了一個根本的方法論錯誤:把性質不同的詞彙來源混在一起計算

詞典資料庫的每筆條目都標有來源碼,代表資料的採集地點與性質:

來源碼條目數性質
B1,117固有巴賽語詞彙
T / M588 / 541Trobiawan(宜蘭地區)方言
S113疑似大量噶瑪蘭語混入——排除
PAN960原始南島語重建形式——排除

將 B、T+M 混合後計算,就把兩個音韻層次的資料疊加在一起,導致三個具體錯誤:(1)CV型被誤報為主要結構;(2)/q/、/z/、/ɭ/、/ɮ/ 等音素被誤歸為固有巴賽語音素;(3)音節種數486種高估了固有音韻庫的實際規模。今日發表的三篇論文逐一訂正這些問題。

論文一:訂正論文(重新分析)

〈巴賽語音節目錄的重新分析:來源分離分析對混合分析的訂正及語言接觸證據〉

這篇是三篇的總綱,直接對混合分析的四項錯誤進行系統性訂正,並確立「來源分離分析是多層次詞典資料庫音韻描述不可省略的方法論步驟」這個原則。

訂正結果一覽:

混合分析(先前)B 固有詞彙T+M 宜蘭方言
音節種數486266315
起始輔音類別482238
主要結構CV(誤)CVC(54%)CVC(50%)

📄 閱讀全文(中文) 日本語 English

📥 PDF(中文) PDF(日本語) PDF(English)

論文二:固有詞彙(source=B)音節目錄

〈巴賽語固有詞彙(source=B)音節目錄:以來源分離分析重建音韻體系〉

以1,117筆固有詞彙為唯一分析對象,呈現巴賽語「本來」的音韻面貌。

主要結果:

  • 266種音節,22個起始輔音類別
  • CVC型為主(134種,54%)——訂正CV型優勢之誤
  • 固有詞彙特有音素:hs'(/ʃ/)、ts'(/tʃ/)
  • qzz'(/ɮ/)、l'(/ɭ/)は固有詞彙中完全缺席

這份結果確立了一個重要基線:固有巴賽語的音韻體系比混合分析所呈現的更為整齊,也更具台灣南島語的典型面貌。

📄 閱讀全文(中文) 日本語 English

📥 PDF(中文) PDF(日本語) PDF(English)

論文三:宜蘭方言(source=T+M)與噶瑪蘭語接觸

〈巴賽語宜蘭方言(source=T+M)音節目錄:與噶瑪蘭語言語接觸的證據〉

以1,129筆Trobiawan資料(T+M)為分析對象。結果顯示,宜蘭方言的音韻體系明顯不同於固有巴賽語,且差異可追溯至噶瑪蘭語的直接影響。

主要結果:

  • 315種音節,38個起始輔音類別(比B多16類)
  • T+M獨有的6個音素:q(/q/)、z(/z/)、z'(/ɮ/)、l'(/ɭ/)、ml'(/mɭ/)、vl'(/vɭ/)——全部對應噶瑪蘭語音素
  • CVVC型音節(26種)及輔音叢(22種)顯著多於B,亦呼應噶瑪蘭語特徵
  • B中存在的 h、/ʃ/、/tʃ/ 在T+M中缺席——可能是向噶瑪蘭語音韻型收斂的結果

這些模式在 Thomason & Kaufman(1988)的接觸類型學框架下,指向系統性音韻借用,而非偶發的詞彙借入。巴賽語宜蘭方言很可能與噶瑪蘭語長期共存,發生了深度的音韻融合。

📄 閱讀全文(中文) 日本語 English

📥 PDF(中文) PDF(日本語) PDF(English)

小結:來源分離為何不可省略

三篇論文共同指出同一結論:在使用多層次詞典資料庫進行音韻分析時,忽略來源碼的集計計算,在語言記述上是不可信賴的。B 與 T+M 共有128種重複音節,但兩者擁有明顯不同的音韻體系——將其一括稱為「巴賽語的音節」,會嚴重損害描述的精確性。

先前的486種混合分析已作為存檔保留(連結),並附有指向本次訂正論文的標注。所有新論文均採 CC BY 4.0 授權,PDF 可自由下載。