
自洽推理(Self-Consistency)是讓 AI 對同一題產生多種解法,再比較最後答案,選出最常出現的結果。它希望減少某一次剛好算錯,讓整個回答跟著出錯的情況。
但票多不代表一定對。如果每份解法都漏看同一項條件,多數答案也可能一起錯。下面用一筆簡單購物費用看清楚。
先認識解法、候選與投票
一份解法是從題目到答案的步驟;候選就是暫時可選的答案。研究會用不同的文字生成選擇產生多份解法,這種產生多個可能結果的做法稱為抽樣。
接著把最後答案整理成可比對的形式,例如都以「總金額幾元」記錄,再統計哪個結果出現最多次。不是把同一句話複製三次就算三份新證據。

完整例子:三本筆記本共多少錢?
以下是自編題目與解法,不是任何模型的實測。三本筆記本,每本 45 元,整筆訂單運費 20 元,沒有折扣或其他費用。請比較以下三份答案:
| 解法 | 計算 | 答案 |
|---|---|---|
| A | 45×3=135,再加 20 | 155 元 |
| B | 40×3+5×3+20 | 155 元 |
| C | 45×3=135 | 135 元 |
三份都在回答整筆訂單的總金額,因此可以比較。若其中一份算每人分攤,就要先確認單位,不能直接混在同一場投票。
票數怎麼算?答案怎麼驗?
155 元有兩票,135 元有一票,依多數選擇會得到 155 元。但還有最後一步:回題目查原價、數量和運費。
45×3+20=155,確實符合所有條件。C 的問題是漏加運費。這次多數答案剛好正確,是因為它們符合題目,不是因為「兩票」本身能證明金額。
若 A、B、C 都漏算運費,三票一致仍然是錯的。同一模型產生的候選可能互相相似,也可能共享同一個誤解,不能當成三位完全獨立的專家。

一般聊天可以怎麼練習?
這筆訂單是三本筆記本,每本四十五元,整筆運費二十元。請提供兩種簡短計算法,各自列出總金額,再核對是否都包含運費。不要為了湊不同答案故意改變題目。
這可以練習比較解法,但不等於完整重現研究中的抽樣與選擇方式;一般聊天工具未必讓你控制候選如何生成。也不要要求它假造多數票或實測紀錄。
哪些問題不適合只用投票?
算術題有可核對的答案,較容易比較不同解法的結果。哪個故事結局最感人、哪種配色最好看,沒有單一客觀答案,應回到你的喜好與用途。
今天哪個活動取消,也不能靠 AI 回答三次就確定。需要查看主辦單位的最新公告;相同錯誤被重複很多次,仍不會變成真實資訊。

多產生幾份解法值得嗎?
產生更多候選通常增加處理工作,可能增加等待與用量。如果一題用計算機就能查清楚,不必無限要求更多版本。
先看是否需要多種解法、答案能不能直接比對,再看額外等待是否換來更好核對的結果。沒有通用的三次、五次就一定足夠的規則。
總結
自洽推理先比較不同解法的最終答案,再找出一致的結果。用筆記本題練習時,投票後仍要回原始條件核對;只有把運費也算進去,金額才完整。



