估算失準有兩個來源,需要用完全不同的方法處理。第一個是樂觀偏誤:估算的人真心低估,因為人傾向從內部細節推導,而細節推導系統性地漏掉未知項。第二個是策略性虛報:知道會超支,但講實話案子就過不了,因此低報是理性選擇。前者靠方法修正,後者靠方法修不了——它是誘因結構的產物,要改變它必須先改變「講實話會發生什麼事」。

把這兩者分開是這個主題的核心價值。多數組織的估算改善措施只處理第一層,於是導入了更精細的估算流程、卻得到同樣失準的數字,因為真正在運作的是第二層。

讀不動長篇文字時,本篇文末另標出承接第二層的公開課,收錄門檻與已知限制見 書單推薦 的「公開課怎麼收」段。

起點是 How Big Things Get Done

Bent Flyvbjerg 與 Dan Gardner 的《How Big Things Get Done》同時涵蓋上述兩層來源並且明確區分兩者,證據規模也是本篇最大的一本,資料庫涵蓋上萬件大型專案的實際成本與時程。

最可直接使用的是參考組預測法:不從內部細節推估,而是找同類專案的歷史實際數字,用分布而非單點來預測。這個方法之所以有效,是因為它繞過了細節推導這個偏誤來源本身,而不是試圖讓細節推導更準。

另一條主線是「慢想快做」:規劃階段盡量長、盡量多次修改設計,執行階段盡量短。理由是規劃階段的修改幾乎免費、執行階段的修改極貴。這條原則與軟體業「盡早交付、快速迭代」的直覺表面衝突,實際處理的是不同性質的專案——可逆的實驗適合快速迭代,不可逆的大型投入適合慢想快做。判斷手上這件事屬於哪一類,是使用這條原則的前提。

證據來源是大規模實證,形式是跨產業的歷史成本資料庫,強度足以支持預算與時程的實際決定。時效上,資料庫的專案類型以基建、能源與 IT 大型導入為主,軟體團隊常見的小型迭代不在樣本裡;樂觀偏誤與策略性虛報的區分建立在決策者的資訊與誘因結構上,不依賴專案規模。讀得出價值的前提幾乎沒有,但案例以基建與大型工程為主,軟體的轉譯要自己做。

要處理軟體專案的風險時讀 Waltzing with Bears

Tom DeMarco 與 Timothy Lister 的《Waltzing with Bears》是這個主題唯一針對軟體專案寫的一本。核心主張分兩段:忽視風險在道德上站不住也危及成功,但單純迴避風險在商業上等於放棄競爭力,因此必須接受並管理風險。

書中處理的五類常見風險——時程缺陷、需求膨脹、人員流失、規格崩潰、績效不足——各自附有辨識訊號與應對策略。最實用的是它把風險管理具體化成可執行的動作:把風險列出來、給機率與衝擊、留下對應的緩衝,並且讓緩衝是公開的而非藏在各項估算裡。藏起來的緩衝會在第一次壓力測試時被要求交出來,公開的緩衝才守得住。

它也直接處理了策略性虛報那一層:書中指出組織若懲罰誠實的風險揭露,風險管理制度就只會產出安全的假風險清單。這個觀察把這個主題連回文化問題。

證據來源是跨客戶的顧問經驗加上蒙地卡羅模擬工具,樣本規模有限。時效上,範例的時程單位是多年期大型開發案,與現在的迭代週期不同;五類風險的分類與緩衝要公開這條論證不依賴那個節奏。處境相容性上,緩衝公開化預設存在一個對外承諾的窗口、而且排程可以攤開討論。承諾由業務單獨對客戶做出、工程只收到日期的組織裡,公開的緩衝沒有地方可以放,那一段要換成對內的風險登記。那五類風險在紙上是一張清單,直到其中一類真的發生過——讀得出價值的前提因此是一次時程失控。

想理解偏誤的來源時讀 Thinking, Fast and Slow

Daniel Kahneman 的《Thinking, Fast and Slow》提供的是規劃謬誤的心理學源頭,以及一整份認知偏誤地圖——系統一與系統二、錨定、可得性、框架效應。技術決策裡的許多爭論其實是這些偏誤在不同人身上的不同表現,有了名字之後才能在會議中被指認。

它在這個主題的位置是背景而非操作。書中提供的是機制解釋,不提供估算流程;讀完不會讓估算變準,但會解釋為什麼加上緩衝之後還是不夠。

證據來源是受控實驗,形式是數十年的實驗心理學研究,對它測的那些機制強度高。要注意的是其中部分社會促發(priming)相關的研究在後續重複實驗中未能複製,這一塊的結論要保留;判斷與決策的核心部分未受影響。時效上,實驗設計與樣本屬於行為經濟學早期,複製危機之後該領域對效果量的標準已經提高;系統一與系統二的區分與規劃謬誤的機制持續被後續研究沿用。它在本篇是背景而非操作,因此標不出讀它的時機——任何時候讀都拿得到那組名字。書很厚,適合當長期參考而非一次讀完。

為什麼只收這幾本

怎麼估、估完之後怎麼守、為什麼一開始就會失準——三本各接一段。How Big Things Get Done 給的是跨產業的預測方法,Waltzing with Bears 給的是軟體專案的風險操作,Thinking, Fast and Slow 給的是偏誤的機制來源。

軟體估算的技術書(功能點分析、故事點校準、蒙地卡羅模擬)數量不少,它們處理的都是第一層——讓估算方法更精細。這個主題不收它們的理由可以從 Flyvbjerg 的資料庫直接讀出來:那批專案的估算方法各異、精細程度差距很大,而超支比例並沒有隨方法精細度下降。方法精細度的提升在誘因結構不變時不改變結果。翻目錄就分得出來:全書的章節都在談怎麼算得更準的,處理的是第一層;有章節在談承諾怎麼被定下來、誰在什麼壓力下改了數字的,才跨到這裡收的那兩層。需要估算技術本身的讀者,那屬於專案管理的操作領域而非本書單的範圍。

誘因結構由賽局理論承接,偏誤那一層由一門哲學課接住一半

這是管理線十一個主題裡唯一接得住公開課的一個,兩層各有一門課接。本篇開頭把估算失準分成樂觀偏誤與策略性虛報,並說後者是誘因結構的產物、靠估算方法修不了;分析誘因結構的工具有完整的公開課,就是賽局理論。

Yale ECON 159 Game Theory 由 Ben Polak 主講、2007 年秋季、24 講,每講約 70 分鐘。跟本篇最直接對得上的是最後一講的 winner’s curse:多方競標同一個標的時,得標的是估得最樂觀的那一方,而最樂觀通常就是最錯的那一方——這是策略性虛報以外、同樣不靠任何人說謊就能產生系統性低估的一條機制,而它接得上本篇起點書的樣本——公共基礎建設依法多以競標發包,那正是該書資料庫的主要專案類型。這一條是機制上的接點,不是從書裡讀出來的統計。另外三處各接那條線上的一個環節,而逐講的對應要看過講次內容才下得了,屬於 書單推薦 的「這些判定從哪來」段所說、可信度較低的那一類:第 13 講的道德風險說明看不到對方行動時誘因為什麼會失準,那是估算被交出去之後沒人查證的那一段;第 14 與 15 講的承諾與可信威脅處理「說了會怎樣」要成立需要哪些條件,那是承諾守不守得住的前提;第 23 講的訊號傳遞說明資訊少的一方怎麼從對方願意付出的代價反推真話,對應的是聽估算的人能做什麼。課程自己標了門檻:需要修過個體經濟學導論,會用到微積分(主要是單變數)。

中文側有對應,而且切得更貼近商管情境。台大開放式課程的商管研究中的賽局分析分兩門:第一門(孔令傑,7 講)從最佳化與賽局基礎走到通路選擇、合約制定與共享經濟平台,課程頁自陳是初學者等級、只需單變數微積分與基本機率;第二門(5 講)整門處理資訊不對稱,講篩選模型與傳訊模型,其中一個應用直接是「篩選零售夥伴的需求預測能力」——那跟「怎麼知道這個估算的人有沒有說實話」是同一個問題換一個場域。

這兩門課有一個取得上的注意事項,而它剛好示範了平台與載體的差別。兩門同時上架 Coursera,而 Coursera 自 2025 年 8 月起把免費的旁聽改成預覽,只能看第一個單元;同樣的內容在台大開放式課程與 YouTube 上仍然完整免費。走 OCW 或 YouTube 那一邊,不走 Coursera。

樂觀偏誤那一層由 Open Yale PHIL 181 Philosophy and the Science of Human Nature 接得住一部分。Tamar Gendler(哲學與認知科學)主講、2011 年春季、26 講。它不是偏誤目錄課——全課的骨架是幸福、道德與政治正當性三個哲學問題——但它的指定閱讀直接是本篇第三本書的一手來源:Kahneman 的〈Mapping Bounded Rationality〉與諾貝爾講座、Ariely 的《Predictably Irrational》全本、Evans 的雙系統推理、Sunstein 的道德捷思。讀 Thinking, Fast and Slow 是拿 Kahneman 整理過的版本,走這門課是拿原始論文加一個哲學家的追問。門檻也在那裡:英語授課,而指定閱讀是一手論文而非科普,投入的份量比另外三門重。它跟 ECON 159 一樣是 Open Yale Courses 的課,該站的標準供給含英文逐字稿,讀得慢而聽不動的讀者靠那份稿子搭橋。

它接不住的是把整批偏誤逐一走完那一面——本篇第三本的用途之一是當長期參考的偏誤地圖,而這門課沒有那個功能。這一輪沒有查到有那個功能的課。

三門課教的都是推導而非當期材料,時效因此不隨年代改變;ECON 159 錄於 2007 年,它舉的產業例子(外包、教育訊號)屬於當時的情境,推導本身不依賴那些例子。台大那兩門的取得注意事項見上一段。整條線的供給狀況寫在 主題書單 的公開課段。

這個主題接到哪裡

策略性虛報無法用估算方法解決,因為它是誘因的產物。要處理那一層,走 組織文化與心理安全感——講實話會發生什麼事,是那個主題的核心問題。

當下要把壞消息講出口的技術走 困難對話與無權限影響力。要用交付資料取代估算辯論,走 持續交付與交付效能——變更前置時間的實測分布比估算更能回答「這件事大概要多久」。

偏誤有一部分是在會議室當場被製造出來的:第一個被喊出的數字錨住後面所有人、已投入的成本讓人捨不得改方向。要在流程上擋住這兩件事,走 會議引導與群體決策