0) 先來幾句“鋪墊”。這裡我們假設只討論成人的智力,並且假設所討論的每個人智力是不變的,假設我們討論的是目前最流行的韋克斯勒成人智力量表。智力,比較明顯的是個體概念,因為這是你個人的某種屬性;但是智商 IQ 則不是,智商是個集約的概念,它是將某個人的智力拿去和其他人相比較而得到的一個值。這和“道德”這樣的概念是類似的,離開了群體去談論道德是卑鄙還是高尚是沒有意義的。比較明顯的是,函數 f IQ = f (智力) 理論上是個單調函數,所以從這個意義而言,在群體/樣本空間給定後,智商 IQ 就是智力的一種度量,它們之間存在 1-1 對應關係。
1) 關於 IQ 測試的兩句題外話。 話題 1a):因為“智力”這個概念在 IQ 測試前就存在,所以傳統意義下的“智力”,和 IQ 測試下的“智商”---- 從而智力,因為智商和智力存在 1-1 對應關係 ---- 就會有偏差,這是一般的 IQ 測試成績用來度量智力而招致批評的主因。不過據統計,IQ 值和成績測試之間的相關係數很高,大約有 0.70+,而 GRE 分數和成績測試之間的相關係數不足 0.2。
話題 1b):東亞人 (大陸、台灣、香港、日本、南韓等) 的 IQ 值全球最高,部分原因是因為東亞人的學習方式造成的,應試教育能使得這個分數偏高。當然這個說法會使得部分民族自豪感很強的同學不高興。
2) 你的智商是多少:頻率學派和貝葉斯學派的分歧
你的智力是你的一種固有屬性,所以你可以假設它是個固定值。但是你的智商呢?因為智商是個集約概念,它的平均值被定義成 100,所以你的智商 IQ 值,很明顯,是樣本空間的一個變量。如果測試的樣本空間是全大陸或者全世界,你的 IQ 值若是 100,那就是十足的中庸之資,只能拿來在一群笨蛋前面顯擺;但是如果樣本空間是全世界的傻博士甚至是全體炸藥獎得主,那得個 100 的分數就是件值得顯擺的事情,至少比巴靈頓大學高才生吳征博士強。
回到咱們的話題。咱們現在的任務是從一系列的 IQ 測試成績去估算出真實 IQ,對不對?所以一個很自然的想法就是,我雖然不知你的 IQ 的值到底是多少,但是我知道它一定是存在的,是個固定值,不會改變,亦即 IQ = constant;如果測量值越多,我們就能越精確地知道真實的 IQ 值,對不對?持這種觀點的學派,稱為古典的頻率學派 (Frequentists),和它對立的就是貝葉斯學派(Bayesians)。貝葉斯派則認為你的真實 IQ 並不是一個固定值,而是一個隨機值,也就是說,你的真實 IQ 也可以是個分布: IQ = g (IQ) 這裡 g 就是參數 IQ 所服從的分布。所以從模型而言,貝葉斯學派的模型比頻率派的模型更複雜,從計算角度而言,大體上貝葉斯學派關於你的 IQ (注意此時你的 IQ 是個分布) 結果,亦即所謂的後驗分布,就是頻率派的似然函數乘以所謂的先驗分布函數。所以從方法論/哲學的角度而言,頻率學派可以說是 static 的,貝葉斯學派可以說是 dynamic 的,後者的模型是不確定的,完全取決於觀測數據 (亦即你的一系列 IQ 測量分數),以及一個帶有主觀色彩的先驗分布,然後用似然函數去修正先驗分布,然後得到後驗分布 (亦即你的 IQ 到底是多少的一個概率分布)。自然規律 (例如你的真實智商) 到底是什麼,頻率派認為是客觀存在的,不以你的觀測結果和主觀判斷而改變;貝葉斯學派則認為自然規律依賴你的觀測結果 (例如你的 IQ 測量值),不同的觀測結果會導致不同的客觀規律,而且和主觀的先驗分布有關;也就是說,觀測數據 (外加主觀的先驗分布) 決定了客觀規律是什麼。