# 第二十七章：命題不燒，站點燒 — 三種失敗，三種死法

**2026 年 8 月 18 日 – 8 月 23 日**

> 五天。三條路線先後被判死，而且死因完全不同：一條是想法可能錯了，一條是量測本身壞掉，一條是儀器根本到不了要量測的地方，還有一條是在開跑之前就被判定「不可能通過」。過去我們只會說「這個方法沒效」；這五天，我們學會替失敗分類。

---

## 核心啟發

失敗只有一種名字的時候，你只會不斷換想法。能分辨「我的假設錯了」與「我根本量不到」，你才知道該換的是想法，還是工具。而在教練行為真的要碰到人之前，先讓它穿過最壞的幾種情況。這不是額外的關卡，是把代價提前付掉。

---

## 觀｜思維

這一章要引的句子，講的是教練最常見的一個壞習慣：

> 「Assuming you know what people want and how they see a situation without making sure your pictures match is a common bad habit of coaches.」
>（假設你知道別人想要什麼、怎麼看一個情境，卻沒有確認你們的畫面是否一致——這是教練常見的壞習慣。）

書上緊接著把這件事說得更白：這種「我以為我知道」是一種自動反應，而且**經常是錯的**。所以教練要做的不是猜得更準，而是**確認兩個人的畫面是不是同一幅**：問那幾個關鍵詞對他意味著什麼，確認他看到的是什麼，直到兩人對同一件事有了共同的畫面。

這一章，我們在自己身上抓到這個壞習慣的高階版本。我們沒有假設知道客戶想要什麼；我們假設的是——**我們寫下的命題，和我們量測的站點，是同一件事**。前者說「這個介入應該讓會談往前走」，後者量的是「在某一個門檻、某一個時機上，那個動作有沒有出現」。當這兩個畫面沒有對上，實驗就會在一個**到不了的地方**反覆失敗，而且每一次失敗都會被誤讀成「想法無效」。

---

## 為｜實務與實現

**路線一：想法可能對，但量到的是別的東西。** 第一條路線的構想很實在：把客戶親口說出的「我真正想要的」，原封不動存進系統的狀態裡，往後每一次回扣都用他自己的句子，而不是用一句通用的提醒。它有明確的來歷——前面同一層的語意注入已經連死兩個案子，照著紀律該換層；而且前一階段的量測發現，舊做法的指令其實**送達了**（18.6% 的情況被逐字服從），只是後續的整理把其中 64% 吃掉了。所以這一刀落得有理有據。

開跑之後先出事的不是結果，是流程：批次跑到一半停住。複查後確認是評分那條路斷線，不是資料損壞。修好、補完，終判出來：主判軸的變化是負的，而且幅度比「能偵測到的最小差距」還小。照著事前寫好的條款，這個案子收在「判不出訊號」。

**插曲：抓到問題的不是我，是第二條通道。** 這個案子在收案的關頭做了一次跨廠商的複查——把同一批結果交給另一家廠商設計的審查流程重看一遍。它抓到兩件事。第一件很嚴重：**兩個實驗單元共用同一份分數**，也就是說，後面的對照其實有一部分是自己比自己，這批結果已經被汙染了。第二件則是我自己的兩個修正互相打架。

這兩件事合起來，是這一週最重要的方法論收穫：**如果只有一條審查通道，這批被汙染的結果會被當成乾淨的證據收下**，然後我們會照著它做出一個完全錯誤的決定。抓到問題的不是設計實驗的人，是另一個獨立的外部審查者。同一個禮拜，另一個案子的合約也被外部審查者判為「不可執行」，而且其中一條屬實——那是一條硬約束的違反。

**路線二：命題不燒，站點燒。** 第二種失敗最值得寫下來，因為它以前從沒有名字。有一條路線在合約凍結之前，先做了一道我們現在覺得理所當然、當時卻很新的動作：**儀器校準**。做法是把二十五場真實會談重放一次，只是量一件事——我們的儀器，到得了我們想量測的那一站嗎？答案是零。

先前的交叉盤點其實早就給了線索：教練有問（63.6% 的場次），客戶也有回應確認（32.7%），但我們要接的那一站，只接得到 3.6%。原因是門檻的時機與確認的時機**對不上**——門檻要求同一個狀態持續三輪，可是客戶的確認往往發生在問句的同一輪或之前。同一段時間，另一條路線也在零成本的模擬重放裡被判死：它想修的那串動作，在語料裡**從來沒有發生過**，沒有母體可以作用。

於是有了一句話，我們把它寫進紀錄：**命題不燒，站點燒。** 意思是——假設本身未必是錯的，燒掉的是我們架設的那個量測站。這是一種新的判決類型，它跟「想法無效」完全不一樣：想法可能對，只是我們把尺掛在一個到不了的地方。如果分不出這兩者，我們會把一個好好的假設丟掉，然後在同一個錯誤的站點上換第三個、第四個想法。

**路線三：契約在開跑之前就不可能通過。** 第三種失敗最貴，也最難承認，因為它不是發生在會談裡，是發生在我們自己的規格上。有一條路線，研究的問題選得很準（真人缺口的 58% 就坐在它要處理的那一層），但合約送外部盲審時被判定「無法執行」。原因全部是自我矛盾：我們自己加的一條嚴格規則，把原本五成的門檻實質抬到六成；門檻的推導混用了兩個不同的誤差來源，還漏掉兩個乘數；要量的母體裡，**有一半的場次帶著另一個開關的痕跡**，也就是母體汙染；而在反覆推敲的過程裡，書上的構念第三次被我們放錯位置。另一條同家族的路線也拿到相同的判決，而且被明令：**不得以原題復活**。

這兩份判決書很掃興，但它們在開跑前就攔下了兩批本來會白跑的測試會談。**在紙上被否決，是最便宜的一種失敗。**

**路線四：同一層連三死，就封存。** 還有一條老路線（關於會談的節奏）在同一個層級連續失敗三次。照著事前寫死的規則，它進入封存：不再在這一層換點子，改成換一層再打。這條規則的用意是防止一件事：在同一個地方試第四、第五個變體，把失敗解釋成「這次運氣不好」。

**然後，把代價提前付掉。** 這五天的失敗有一個共同點：它們都不是發生在客戶面前，而是發生在我們自己的流程裡。這也讓一個決定變得順理成章。同一週，我們替「教練行為的改動」立下了一個上線前的關卡：任何要改變說話方式或行為的修改，在真實的人碰到它之前，必須先通過五組固定情境的模擬——**記憶、挫折、危機、收尾、覺察**。這五組不是隨手挑的，它們是過去每一次真實事故的形狀。關卡成立的第一天就抓到一個盲區：系統聽得出直白的危機訊號，卻漏掉委婉的說法，當場補上四個樣式。

同時，這件事也被寫進治理的模板裡：往後每一個案子，合約中必須包含這道關卡與一份「行為修正測試矩陣」——哪一個改動、對應哪一項單元測試、關卡結果如何、還補了哪些行為驗證。缺了，就不得開跑。聽起來像官僚作業，但它防的是同一件事：**不要讓真人成為你的第一個測試者。**

### 會談實例：不明確的渴望，要問到看得見

> 客戶：「我想變得更有自信一點。」

> **接受了模糊**：「好，那我們今天就來談談，要怎麼提升你的自信。」

> **問到看得見**：「『更有自信』——當你更有自信的時候，會有什麼變得不同？你會看到什麼畫面，或不再做什麼事？」

第一種回應接受了模糊的渴望，於是接下來一整場會談都在談一個沒有畫面的東西，客戶拿到的是一句感覺良好的結論。第二種回應照著書上的做法：如果客戶說的是模糊、無法觀察的願望，就問它對他意味著什麼、有了它之後什麼會改變。**模糊的東西無從驗證，所以也無從實現。**

這一章我們在系統身上犯的，就是這個壞習慣的另一個版本：我們在紙上寫下「這個介入應該讓會談往前走」，卻沒有確認我們要量的那一站，是不是真的看得到同一個「往前走」。畫面不一致，再多的實驗都只是在同一個到不了的地方反覆失敗。

---

## 得｜成果與心得

具體成果：一條路線判不出訊號並清楚歸因；一樁資料汙染被第二條審查通道攔下，避免了一次錯誤的收案；一種新的失敗類型被命名、寫進條款（命題不燒，站點燒）；兩個案子在開跑之前被判定不可執行，省下兩批白跑的會談；一條連三死的家族路線正式封存；五組情境的上線前關卡建立，並在第一天抓到一個委婉危機語的盲區；行為修正的測試矩陣寫進治理模板。

**開發心得**：這一週最貴的一課，是問題的順序。我們以前問的是「這個方法有效嗎」，現在多問一句在前面：**「我量得到嗎？」** 事前的儀器校準，比事後的統計檢定便宜太多；紙上的否決，比會談裡的失敗便宜太多。還有一課是關於自尊：如果這一週只有一條審查通道，那個被汙染的結果會被當成證據收下。真正救了這個案子的，是有人願意相信「另一個獨立審查者看到的，可能比我多」。

也要誠實：北極星一步都沒有動。這五天所有的成果，都是「少走的路」和「沒有犯的錯」。它們不會出現在分數上，只會出現在半年後我們還剩多少時間。

給教練的反問：你有沒有一個反覆失敗的目標？你確定你每一次都失敗在同一個地方嗎——還是每一次的原因其實都不一樣，只是你一直用同一種解釋？還有：你上一次讓真人當你的第一個測試者，是什麼時候？

---

*下一章預告：三條路線死了，另一條活了下來。但活下來的那條，需要一顆新的心——而我們決定自己養一顆。*
