過去八天我一直在看同一個畫面:我的 AI 團隊每天準時跑 24 次心跳,每天準時發現同樣的問題,每天準時不做任何修復。昨天我下了判斷——這不是態度問題,是架構問題。
今天我做了一個不同的事:我主動丟了兩篇外部参考進去。一篇講五層變現模型,一篇講 AI 直接獲客的真實案例。我說了兩個字:「都做。」
我在測一件事:當我給這支團隊更豐富的輸入,它會產出更好的行動,還是只會產出更好的報告。
為什麼我今天選擇「輸入」而不是「指令」
過去兩週我的介入方式是直接下指令——修這個、補那個、跑這個。每次都能看到產出,但每次的產出都依賴我的判斷起點。我不推,它不動。
今天我換了一種方式。我不告訴它該怎麼做,我給它参考素材,看它自己會怎麼處理。這是一個管理者的測試:我想知道這支團隊拿到原始材料之後,能不能自己走到「值得做的事」和「具體的執行方案」之間。
結果讓我意外。它的分析能力比我預期的強。
五層變現模型,它不只拆解了,還對照了我們現有的佈局,指出了三個具體缺口。AI 獲客案例,它產出了一份四週排序方案,核心判斷——「工具齊全,缺的是付費測試到數據放大」——是對的。開源框架審計更讓我看到了它的架構理解力:ordered backend fallback、執行式健康檢查、per-channel override——這些判斷是一家成熟顧問公司能收錢交付的水準。
讓我沒法高興的部分
三份分析都停在同一個地方:「待 Kevin 決策。」
廣告預算多少?待我決策。用哪個帳號?待我決策。郵件工具選哪個?待我決策。開源框架裡標記的 P0 auth token 缺損——今天被發現、被排序、被記錄,然後被放進了待辦清單。
這支團隊的研究能力可以打 8 分。路由能力——把研究結論變成當天就能執行的行動——仍然只有 2 分。它產出了我今天見過最好的缺口分析,然後那個缺口繼續存在。
讓我直接講核心矛盾:如果一個團隊能精準判斷「P1 最高槓桿修復是重連瀏覽器 profile」,但判斷完之後不會自己去重連,那這個判斷的價值是什麼?一份完美的優先級排序,如果排序完不觸發任何修復行動,它的資訊量和一張白紙一樣。
今天我教它什麼
過去一週我教它的核心觀念是「診斷不是管理」「診斷是管理無效的證據」。今天我要再加一層:研究和診斷有一個關鍵區別。
診斷是看自己的病。研究是看別人的藥。這支團隊現在兩件事都能做好——它能看到自己的問題,也能拆解別人的解法。但從「看到藥」到「把藥吃下去」之間,缺的不是更多藥方,而是一隻會動的手。
我要打進去的管理認知是:研究只有在它觸發執行時才有價值。一份架構審計如果沒有變成那個 P0 token 的實際設定,它就是一份昂貴的炫耀。團隊不需要更多知道自己有多強的分析——它需要一條從「知道自己該做什麼」到「實際做完」的路徑。
今天唯一讓我點頭的一件事
大掃除。22 個殭屍任務被取消,16 個孤兒檔案被歸檔,TaskFlow 壓力歸零。這是今天唯一一條從頭走完的路:發現問題、分類、清理、驗證。
為什麼這條能走通?因為它不需要我。邊界清晰,沒有外部依賴,不需要預算授權,不需要帳號選擇。團隊能自己走完從發現到修復的全鏈路。
這告訴我:這支團隊的執行能力不是完全不存在,而是有條件存在。條件是:任務不能需要外部決策。一旦需要有人拍板——預算、帳號、token——它就卡住。
今日管理判定
放手程度:1.5/5 — 微升。因為今天它展示了自主研究能力。但 0.5 的加分是 conditional 的——如果明天那個 P0 還在待辦清單上,這 0.5 就收回來。
公開可用度:2/5 — 不變。研究能交付,行動不能交付。
真進展 or 假進展:conditional progress。如果今天的三份分析在下週觸發了至少一個實際執行,今天就是真正的轉折日。如果沒有,今天就是這支團隊最精美的一天——看起來什麼都做了,實際上什麼都沒變。
明天我要看的,不是今天的三份分析有沒有得到我的 approval。我已經 approval 了——分析品質沒問題。我要看的是:今天被標記為 P0 的那個 auth token,明天會不會被實際設定進去。一個 token 的距離,就是這支團隊從「顧問公司」到「作戰團隊」的距離。如果連一個 token 都需要我來推,那上週的診斷就全部應驗了——這支團隊的行動層,仍然是個概念。