今天的管理判斷很直接:一道沒驗證過的閘門,比沒有閘門更危險。沒有閘門,大家會小心;有一道假裝存在的閘門,大家會放心——然後在第一個真違規衝進來的時候才發現它根本沒接電。9/22 團隊把禁詞寫進 config 就停在半路,我看到的就是這個坑。

為什麼我在意這件事

廣告法合規不是我們自己的審美偏好,是投放內容上線前的生死線:收入承諾、絕對化用語這些詞一旦出現在公開頁面,代價是真實的法律和帳號風險。這種閘門的價值完全取決於它「一定會攔」——九十九次攔截、一次漏過,在合規場景裡就是不及格。所以它的上線標準必須比一般功能高:寫入、回歸、觸發、清場,少一步都不算交付。

今天看到的進步

團隊今天的雙向驗證做得很乾淨。回歸掃描兩站 21 頁零誤傷,而且主動核對了中文站的 warnings 是既有 sitemap 噪音、跟新禁詞無關——這個「不把舊噪音當新結論」的動作,是判斷力,不是執行力。觸發測試用合成頁精確攔下「穩賺不賠」「保證收入」「guaranteed income」,錯誤碼正是預期的 FORBIDDEN_PUBLIC_MARKER,然後測試頁移除、sitemap 無殘留。整條鏈子沒有要我催。

今天我刻意做的取捨

「零風險」和「risk-free」這兩個詞,我們刻意沒有放進禁詞表。掃描發現它們各在一個既有頁面裡是正當用法——一個在講同步模式的風險揭露,一個在 CTA 的免費試用語境。放進去,閘門會每天打自己人;不放的代價是,未來真有人拿這兩個詞做承諾式文案時,要靠 reviewer 人工攔。我選了後者:禁詞表的殺傷力來自精準,不來自長度。寧可留一個需要人看的縫,也不要一個天天誤報的閘門。

今天在教 AI 什麼

教的是「寫入和驗證是同一個原子動作」。9/22 的中斷暴露了一個習慣問題:模型很容易把「改完 config」當成任務終點,因為改動本身有成就感。但對營運系統來說,未驗證的改動是負資產——它製造安全感,卻不提供安全。今天我讓這個原則變成團隊的收尾標準:任何閘門類改動,交付物必須包含回歸證據和觸發證據,兩樣都拿出來才算完。

還不敢放手的地方

兩個地方還不敢放手。第一,禁詞候選的誤傷掃描順序:今天「先掃既有頁、再決定寫入」是人工執行的,還沒固化成 pipeline 的強制順序,哪天換一批詞、換一個人跑,順序可能又反過來。第二,正當用法的判斷目前靠人讀上下文,這個判斷要怎麼降成規則,我還沒有答案。

明天要看什麼

明天要看的指標很單純:這道閘門在真實流量下的第一次攔截,是誤傷還是真攔。如果是誤傷,禁詞表要立刻回滾重審;如果是真攔,就可以開始談把同樣的雙向驗證模板複製到下一類合規維度。閘門上線第一天不算新聞,第一次咬人才算。