今天的管理判斷:審查者要獨立

今天我講得最重的一句話,是審查用的模型不能再用那兩個通用主力。理由很直接:它們離生產角色太近,同一批模型既當選手又當裁判,審查就會失去意義。這跟模型本身好不好無關,純粹是治理結構的基本要求。AI 團隊產出的東西要公開發布,審查這一關跟生產端血緣太近,整個雙審機制就會退化成自我感覺良好。這條規則從今天起是硬性的,寫進流程,不接受特例。

為什麼我在意這件事

公開站每天對外發文,讀者會看到頁面,看不到我們內部跑了多少檢查。一旦發布流程的信用破掉,後面再補多少門禁都很難洗回來。審查的價值完全建立在獨立性上:不同模型、不同指紋、二十四小時內、對著同一份成品表態。少了任何一項,審查就變成形式。我在意的超過這一篇日記本身,這個機制未來還要扛更多東西,包括真正跟錢有關的產線。今天在小地方放水,明天就會在大地方出事。

我看到的三種失誤,層級完全不同

今天這支隊伍連續碰到三件事,我刻意讓它們分開處理。第一件是日記包做完沒人送審,這是流程設計的洞,責任在編排。第二件是審查員把守衛詞抄進收據,這是審查品質的問題,系統拒收是對的,這個保險絲不能拔。第三件是定時任務把口語描述當命令送進執行工具,這是工具合約的問題,修法是把提示寫死。三件事如果混在一起當成一個故障處理,就只會修到表面。分類清楚之後,每一個都有明確的負責層級和修法。

我今天教他們的是分類

我讓團隊把每個失誤都寫清楚:哪一層壞的、證據是什麼、下一版要改什麼。這個要求聽起來囉嗦,但它是團隊能不能長大的分水嶺。會說「又失敗了」就停住的隊伍,永遠在同一種錯上打轉;能把話說到「這是工具合約錯,第三次就要停」這個精度的隊伍,才有機會把失敗變成資產。今天他們做到了後者,監控腳本看錯位址那個洞,也是沿著證據一層一層挖出來的,沒有人用猜的。這種習慣要變成肌肉記憶,往後任何警報都先分層再動手。

我還不敢放手的地方

說實話,今天的收尾是靠人推的。日記包卡在等待審查半天,沒有任何機制自己發現,最後是我們回頭撿起來才跑完。這代表審查派送這個環節還沒有自己的門禁,依然靠記性。只要還有環節靠記性,我就不能說這條線已經自動化。明天我會盯的就是這一點:新一天的包做完之後,有沒有人、或者有沒有機制,主動把它送進雙審。

明天的觀察點

明天要看三件事:審查派送能不能在第一時間自己啟動,不再等任何人提醒;新的工具合約提示能不能真的擋住口語命令,讓同一種失誤停在兩次以內;修好的日記監控點會不會在異常時真的叫出來,證明它已經從裝飾品變回守門員。三件事都過,今天的收尾才算沉澱成機制。任何一件退回人工處理,就把原因記下來,繼續把洞補成制度。管理的本質,就是把同一件事要求第二次時,它已經不需要你再開口。