論述基礎與限制

本卡的觀察來自一次書單建置:四十幾本書要逐本查出可核對的購書連結與中譯本狀態,累積把整個 session 的 web search 配額(200 次)用盡,最後兩項查證做不完。事後盤點發現至少三種可避免的耗用——查了最後沒用進成品的事實、同一個事實搜了又搜、以及查詢失敗後預設再發一次查詢而不是去抓上一次結果已經給出的連結。使用者質疑「是不是方法有問題」時,才發現這類浪費在成品裡完全看不出來。

限制:本卡談的是要不要發動查證這個決定,不談查到之後該驗到多深(那是 #238)。也不主張少查——承重的事實該查多少次就查多少次,本卡處理的是那些查了以後被丟掉的。


核心原則

查證的成本結構是不對稱的:判斷一個事實承不承重是免費的(讀一下自己的草稿就知道),發動查證是有成本的,而查了以後沒用進成品的那些不會留下任何痕跡。 因此節制必須發生在查之前——事後檢討看不到被丟棄的查詢,而配額耗盡這個訊號抵達時已經來不及調整。

判定只有一個問題:這個事實如果查不到,成品會少掉什麼? 答案是「一個可以直接拿掉的修飾語」時,不查;答案是「一段論證不成立」或「一個讀者要拿去用的座標消失」時,查到落地為止。


反模式

查了才判斷要不要用。 順序顛倒的成本全在被丟棄的那一側。實例:查一本書某個版次的出版年份,兩次查詢都沒查到,最後把年份從文章裡拿掉——而那個年份從一開始就不承重(該段的時效判定講的是書中預設的實體會議室與掛圖,跟年份無關)。判定發生在查之前的話,這兩次查詢不會存在。

這個順序之所以會被顛倒,是因為查證感覺起來像負責任、跳過查證感覺起來像偷懶,而兩者的差別在成品上看不出來。沒有任何審查維度會問「這一段你為了一個最後沒寫的事實查了幾次」。

查不到就再查一次。 失敗後的自然反應是換個關鍵字重發同一類動作,但手上通常已經有更便宜的資源:上一次查詢結果裡的連結。實例:確認一本書的版次出版日期時,先後發了兩次查詢加四次抓取,而第一次查詢的結果裡就已經有那個答案所在的頁面連結。

把被擋住的便宜工具靜默換成昂貴工具。 書目資料的權威來源(購書平台的商品頁)對抓取一律拒絕,於是每一筆「出版社、譯者、日期」都得改用查詢工具取得——而查詢回來的是模型改寫過的摘要而非原頁,成本更高、可靠度更低。替代發生時要記下這個降級,不要當成等價的兩條路徑。


修法

  1. 查之前先過承重閘門:把待查清單逐項問「查不到的話成品少掉什麼」。答案是可以直接刪掉的修飾語就從清單移除,不進查詢佇列。
  2. 一個對象一次查詢:同一本書 / 同一個實體的多項屬性(名稱、出處、日期、識別碼)用一條查詢一次帶回,不要拆成多次。
  3. 失敗後換資源、不換關鍵字:第一次失敗時先看上一次結果裡有沒有可以直接抓的連結;沒有才考慮重新查詢;不承重的事實在第一次失敗就放棄。
  4. 記下工具替代的降級:便宜的取用路徑被擋、改用昂貴工具頂替時,把可靠度差異寫進判斷,別把替代品的產出當成一手。
  5. 成品承擔查證紀錄:已經寫進成品的事實就是查證紀錄,跨 session 不重查。查不到而決定不寫的,在交付時明說哪一項沒查完,避免下一輪重跑同一條路。

跟其他原則的關係

原則關係
#238 承重事實要對到 primary source姊妹——#238 管「決定要用的事實該驗到多深」,本卡管更前面一步的「該不該發動查證」;#238 的「標出承重事實、枝節不必」那一步是本卡的全部主題
#236 承重論點先對抗驗證再建下游承重判定的原型。#236 用它決定哪個論點要先被挑戰,本卡把同一個判定前移到「要不要花成本去查」
#243 要求執行者做判定的規則要一併規定判定留下什麼痕跡同一種不可見性——#243 的「認真做過與完全沒做,產物長得一樣」在這裡是「查了丟掉與根本沒查,成品長得一樣」;差別在 #243 補痕跡讓判定可複驗,本卡的痕跡補不出來(丟棄的查詢無處記錄),只能把判定移到前面
#6 Filter 順序由使用者掃描成本決定結構同型——便宜的判定排在昂貴的動作之前。#6 排的是使用者的視線成本,本卡排的是查證的配額成本

判讀徵兆

訊號該做的事
查到一半發現這個事實最後不會寫進成品這次查詢是可避免的;回頭確認待查清單有沒有過承重閘門
同一個實體分了三四次查詢(名稱一次、日期一次、版本一次)併成一條查詢;多屬性一次帶回
一個事實查了兩次以上還沒到手先問它承不承重;不承重就從成品拿掉,承重就改抓已有的連結而非再查
權威來源拒絕存取、改用另一個工具頂替記下可靠度降級;別把替代品的產出當一手
配額 / 時間耗盡才發現查證失控這個訊號要等成本累積到上限才出現、結構上滯後,不能當控制手段;控制點在每次查詢發動之前
交付時有查不完的項目明說哪一項沒查完、以及成品有沒有主張它,讓下一輪不必重跑