0

三千萬字差距是真的嗎?兒科醫師調整講了多年的數字|楊為傑醫師

媽媽和兩歲幼兒面對面坐在客廳地毯上,孩子指著藍色積木、媽媽張口回應:三千萬字差距是真的嗎?語言輸入重點是一來一往

本文重點:「三千萬字差距」出自 1995 年一份僅 42 個美國家庭的研究,是用每小時字數外推四年得到的推算值。2017 年一份納入 329 個家庭、3,213 份全日錄音的重估顯示,社經最高與最低組的落差約為四百萬字;「三千萬」只在比較最頂端 2% 與最底端 2% 的家庭時才會出現。目前證據更支持的方向是:親子之間「來回輪替」的次數,比單純的成人字數更能預測孩子十年後的語言能力,而且至少有一項研究顯示,輸入的「品質」不隨社經地位而不同。

說了很多年的三千萬字,是怎麼算出來的?

這個說法來自 Hart 與 Risley 在 1995 年出版的研究。

他們找了 42 個美國家庭,每個月到家裡錄一小時,錄了兩年多。然後把「每小時聽到幾個字」這個數字,外推到孩子四歲。

外推。這兩個字是關鍵。

沒有人真的去數過三千萬個字。那是一個乘法的結果。

42 個家庭,用今天的標準看,是一個很小的樣本。而且是 1995 年出版的美國研究、特定社區、特定族裔組成。

 

2017 年,有人真的去數了

Gilkerson 的團隊做了一件更可靠的事:他們收了 329 個家庭、3,213 份全日錄音。不是每個月錄一小時,是錄一整天。樣本數將近原始研究的八倍。

結果:社經地位最高與最低的組別之間,語言輸入的落差大約是四百萬字。

那三千萬跑去哪裡了?

它還在。但它只出現在你拿最頂端 2% 的家庭去比最底端 2% 的家庭的時候。

這就像說「甲班跟乙班的身高差 30 公分」:如果你挑的是甲班最矮的兩個人跟乙班最高的兩個人,這句話是對的。但它不是在描述一般的孩子。

 

那落差到底還在不在?

在。四百萬字也是很多字。

不過實際狀況,比較複雜:這幾年學術圈一直吵來吵去。2019 年 Sperry 的團隊做了一個重複研究,結果沒有支持三千萬字的主張。Golinkoff 等人隨即公開反駁,Sperry 再反駁回去。到今天為止,這場論戰沒有定論。

(學術圈這種你來我往很常見。不代表哪一邊對了或錯了。而是代表這件事真的很難測:要測一個孩子一天到底聽到幾個字,本身就是一個技術難題。)

所以個人現在的立場是:落差存在,但到底有什麼意義,還需要討論。

 

孩子的詞彙,90% 來自父母

原始的數字是 86% 到 98%。意思是:孩子用過的詞當中,有90%左右,也出現在父母用過的詞裡。

這叫詞彙重疊率。它描述的是「像不像」

而且 Sperry 2019 特別指出:只算父母、不算其他照顧者,也不算孩子在旁邊「聽到」的大人對話,會系統性低估孩子實際接觸到的語言量。

這一點對台灣家庭特別重要。

三代同堂、隔代教養、保母、幼兒園老師、餐桌上隔壁那桌的對話,全部都在孩子的語料裡。

孩子的語言環境,來自於身邊的所有人。環境很重要。

 

2026,我們該注意的:是「來回次數」這個框架

講完數字,接下來聊聊更重要的部分。

Gilkerson 的另一份研究追蹤了 146 個孩子,追了十年。

結論是這樣的:孩子在 18 到 24 個月大時,親子之間的「來回輪替」次數(你說一句、他回一句、你再接一句),在扣除社經地位之後,仍然能解釋十年後 IQ 與詞彙的 14% 到 27% 變異。

而單純的「成人說了幾個字」,一旦扣掉社經地位,預測力就大幅減弱。

換句話說:話多不等於有用,一來一往才有用。

(研究限制:這一系列研究都仰賴一套叫 LENA 的穿戴式錄音分析系統。它算「字數」的準確度不錯,算「輪替」的準確度沒那麼高。所以這個結論我給的是中等證據等級,不是高。並不絕對。)

 

但也不要走到另一個極端

看到這裡,可能有人會說:那我不用講那麼多話了,重質不重量嘛。

也不是這樣。

沒有足夠的「字數」,就沒有輪替的機會。 一天跟孩子講二十句話,是輪替不出什麼東西的。

簡單總結:字數是地板,輪替是天花板。

地板要夠高你才站得上去,但決定你能長多高的是天花板。

 

我最想分享的是這個

2013 年有一個設計很聰明的研究。

他們把親子互動的影片消音,只讓評分者看畫面,去猜家長當下在說哪個詞。用這種方式測出來的「輸入品質」,在控制了說話總量之後,仍然預測三年後的詞彙量。

但真正讓我印象深刻的是後面那句結論:

輸入的「量」,隨社經地位不同。

輸入的「品質」,不隨社經地位不同。

翻成白話:

一個人一天能跟孩子講幾句話,可能真的跟工時、疲勞、家裏有幾個大人有關。這些不是努力就能改的。

但怎麼講話,不用花錢,也不用學歷。

這也是為什麼我一直不喜歡把語言發展寫成「家長要多努力」。那不公平,也不準確。

 

那「怎麼講」到底是什麼?

研究上比較有證據的,大概是這幾個方向:

跟著孩子當下在看的東西講;如果要把他的注意力拉過來,就要確定真的拉過來了。(這一項的證據其實最弱,最對題的研究只有 18 對母嬰:把注意力成功轉過來再命名的,和孩子較大的詞彙量有關;轉不過來的,反而和較小的詞彙量有關。方向可以講,但我不會給你任何數字。)

用多樣一點的詞:在控制了社經地位、說話總量、以及孩子原本的詞彙量之後,對兩歲半左右的孩子使用比較多樣的進階詞彙,仍然能額外解釋一年後的詞彙能力。

談不在眼前的事:昨天發生什麼、等一下要去哪、我們來假裝這是一艘船。不過這一項有年齡條件,它要到學齡前才顯現效果;再小一點,兩歲半左右看的是詞彙的多樣性,一歲半左右則是說話的量本身比較關鍵。

 

一個我家的例子

我兒子還不到兩歲的時候,有一天突然冒出一句:「當然可以。」

我很吃驚,就問他:你知道「當然」是什麼意思嗎?

他說:「當然」是什麼?

他根本不知道那是什麼意思。但他用對了。

後來有一次我們玩剪刀石頭布,玩到後面開始亂出。他問我要出什麼,我說我要出三角形。他火了,說:「你都亂出!你只能出剪刀『或者』石頭『或者』布!」

我又問:你知道「或者」是什麼嗎?

他又一臉問號。😆😆😆

這就是研究在講的「取樣」:孩子從大量的自然對話裡抽出規則,先會用,才慢慢懂。他用錯的時候,我們給回饋、給示範,他的用語就越來越精確。

這個過程需要的不是三千萬字。是有人肯跟他來回。某個程度上,這個AI很像。或者說:AI就是這樣訓練的。

 

最後幫大家整理重點

一、 「三千萬字」出自 42 個家庭的推算值。更大樣本(329 個家庭、全日錄音)重估後是四百萬字,三千萬只出現在最極端 2% 對 2% 的比較裡。

二、 「孩子語言 90% 來自父母」是誤讀。原始數字講的是詞彙重疊率,而且忽略了其他照顧者與孩子旁聽到的對話。

三、 目前證據更支持「來回輪替」而不是「成人字數」:扣除社經地位後,18 到 24 個月的輪替次數仍能解釋十年後 14% 到 27% 的變異。(中等證據等級,測量工具有其限制。)

四、 但字數仍然是前提。字數是地板,輪替是天花板。

五、 輸入的量受社經地位影響,但至少那份消音影片研究測到的品質不受。怎麼講不用花錢,這是這整件事裡最公平的部分。

今天可以做的一件事:下次孩子指著什麼、或是講了一句沒頭沒尾的話,不要急著糾正他或教他新東西。就接他那一句,然後等他再回你一句。

那一來一往,就是研究裡真正有效的那個東西。

 

常見問題

三千萬字差距是真的嗎?

「三千萬字」出自 1995 年僅 42 個美國家庭的研究,是把每小時字數外推到孩子四歲的推算值。2017 年納入 329 個家庭、3,213 份全日錄音的重估顯示,落差大約是四百萬字;三千萬只出現在最頂端 2% 對最底端 2% 的比較裡。

「孩子的語言 90% 來自父母」,意思是?

原始的數字是 86% 到 98%,講的是孩子用過的詞當中有多少比例也出現在父母用過的詞裡,也就是詞彙重疊率,描述的是「像不像」,不是「從哪來」。而且只算父母、不算其他照顧者,會系統性低估孩子實際接觸到的語言量。

跟孩子說話,是講越多越好嗎?

話多不等於有用,一來一往才有用。追蹤 146 個孩子十年的研究發現,18 到 24 個月的親子來回輪替次數,在扣除社經地位之後,仍然能解釋十年後 IQ 與詞彙的 14% 到 27% 變異;而單純的成人字數一旦扣掉社經地位,預測力就大幅減弱。

那字數是不是就不重要了?

字數仍然是前提。沒有足夠的話,就沒有輪替的機會,你一天跟孩子講二十句話,是輪替不出什麼東西的。一句話總結:字數是地板,輪替是天花板。地板要夠高你才站得上去,但決定你能長多高的是天花板。

工作很忙、講不了那麼多話,孩子的語言會落後嗎?

輸入的量受社經地位影響,但至少那份消音影片研究測到的品質不受影響。一天能跟孩子講幾句話,可能真的跟工時、疲勞、家有幾個大人有關。這些不是單純個人努力就能改變的;但怎麼說話,不用花錢,也不用學歷。而且孩子的語言環境不是只有一個人在供應,不需要一個人承擔所有的壓力。

延伸閱讀

參考文獻

  1. Hart B, Risley TR. The Early Catastrophe: The 30 Million Word Gap by Age 3. American Educator. 2003;Spring.
    aft.org 全文
    💡 佐證論點:作者自述原始研究為 42 個美國家庭、每月觀察 1 小時;三千萬字為每小時字數乘以推估年時數再乘以 4 年的外推值;「兒童詞彙中有 86% 到 98% 的詞也出現在父母詞彙裡」為詞彙重疊率。
  2. Gilkerson J, Richards JA, Warren SF, et al. Mapping the Early Language Environment Using All-Day Recordings and Automated Analysis. Am J Speech Lang Pathol. 2017;26(2):248-265.
    doi:10.1044/2016_AJSLP-15-0169
    PMID: 28418456
    💡 佐證論點:329 個家庭、3,213 份全日錄音;社經最高與最低組的語言輸入落差推算至 4 歲約為四百萬字;三千萬字量級只出現在最頂端 2% 與最底端 2% 的家庭比較。
  3. Sperry DE, Sperry LL, Miller PJ. Reexamining the Verbal Environments of Children From Different Socioeconomic Backgrounds. Child Dev. 2019;90(4):1303-1318.
    doi:10.1111/cdev.13072
    PMID: 29707767
    💡 佐證論點:重複研究的結果不支持 Hart & Risley 的主張;並指出把其他照顧者與孩子旁聽到的談話排除在外,會系統性低估孩子實際接觸到的語言量。
  4. Golinkoff RM, Hoff E, Rowe ML, et al. Language Matters: Denying the Existence of the 30-Million-Word Gap Has Serious Consequences. Child Dev. 2019;90(3):985-992.
    doi:10.1111/cdev.13128
    PMID: 30102419
    💡 佐證論點:本文即文中所說「Golinkoff 等人隨即公開反駁」的那一篇。
  5. Sperry DE, Sperry LL, Miller PJ. Language Does Matter: But There is More to Language Than Vocabulary and Directed Speech. Child Dev. 2019;90(3):993-997.
    doi:10.1111/cdev.13125
    PMID: 30102424
    💡 佐證論點:本文即文中所說「Sperry 再反駁回去」的那一篇;這場論戰至今沒有定論。
  6. Gilkerson J, Richards JA, Warren SF, et al. Language Experience in the Second Year of Life and Language Outcomes in Late Childhood. Pediatrics. 2018;142(4):e20174276.
    doi:10.1542/peds.2017-4276
    PMID: 30201624
    💡 佐證論點:追蹤 146 個孩子十年;18 到 24 個月的親子來回輪替次數在控制社經地位後,仍可解釋十年後 IQ 與詞彙的 14% 到 27% 變異,而同期的成人字數在控制社經地位後預測力大幅減弱。
  7. Cristia A, Bulgarelli F, Bergelson E. Accuracy of the Language Environment Analysis System Segmentation and Metrics: A Systematic Review. J Speech Lang Hear Res. 2020;63(4):1093-1105.
    doi:10.1044/2020_JSLHR-19-00017
    PMID: 32302262
    💡 佐證論點:文中「算輪替的準確度只有 r = .36」與「算字數的準確度不錯」兩句的出處。
  8. Ferjan Ramírez N, Hippe DS, Kuhl PK. Comparing Automatic and Manual Measures of Parent-Infant Conversational Turns: A Word of Caution. Child Dev. 2021;92(2):672-681.
    doi:10.1111/cdev.13495
    PMID: 33421100
    💡 佐證論點:文中「而且會系統性高估」一句的出處。
  9. Cartmill EA, Armstrong BF 3rd, Gleitman LR, et al. Quality of early parent input predicts child vocabulary 3 years later. Proc Natl Acad Sci U S A. 2013;110(28):11278-11283.
    doi:10.1073/pnas.1309518110
    PMID: 23798423
    💡 佐證論點:評分者只看消音影片猜家長說的詞;這樣測得的輸入品質在控制說話總量後仍預測三年後的詞彙量,且輸入的量隨社經地位不同、品質不隨社經地位不同。
  10. Shimpi PM, Huttenlocher J. Redirective labels and early vocabulary development. J Child Lang. 2007;34(4):845-859.
    doi:10.1017/s0305000907008112
    PMID: 18062361
    💡 佐證論點:18 對母嬰的小研究:把孩子注意力成功轉過來再命名的,與較大的詞彙量有關;轉不過來的,與較小的詞彙量有關。為文中「跟著孩子當下在看的東西講」那一項的出處。
  11. Rowe ML. A longitudinal investigation of the role of quantity and quality of child-directed speech in vocabulary development. Child Dev. 2012;83(5):1762-1774.
    doi:10.1111/j.1467-8624.2012.01805.x
    PMID: 22716950
    💡 佐證論點:在控制社經地位、說話總量與孩子先前詞彙量之後,對兩歲半左右的孩子使用多樣而進階的詞彙,仍能額外解釋一年後的詞彙能力;一歲半左右起作用的是說話的量;去情境化語言的效果則要到學齡前才顯現。

引用本文

歡迎轉載或引用本文觀點,請註明出處並附上原文連結。以下格式可以直接複製;引用後歡迎告訴我一聲,讓好內容互相串連。

內文引用句

本文引用楊為傑醫師(兒科專科醫師、睡眠專科醫師)的文章〈三千萬字差距是真的嗎?兒科醫師調整講了多年的數字〉,刊於白袍旅人:https://twkid.com/p/thirty-million-word-gap/

APA(簡報、學術用)

楊為傑(2026年9月30日)。三千萬字差距是真的嗎?兒科醫師調整講了多年的數字。白袍旅人。https://twkid.com/p/thirty-million-word-gap/

Markdown

[〈三千萬字差距是真的嗎?兒科醫師調整講了多年的數字〉](https://twkid.com/p/thirty-million-word-gap/)|楊為傑醫師(兒科專科醫師、睡眠專科醫師)|白袍旅人

HTML

<a href="https://twkid.com/p/thirty-million-word-gap/" target="_blank" rel="noopener">〈三千萬字差距是真的嗎?兒科醫師調整講了多年的數字〉</a>|楊為傑醫師(兒科專科醫師、睡眠專科醫師)|白袍旅人

楊為傑醫師

發佈留言

發佈留言必須填寫的電子郵件地址不會公開。 必填欄位標示為 *