AI Agent 的安全防護層怎麼設計:從關鍵字偵測到長期行為監控
拆解 Claude Code、Codex 等 AI agent 的縱深防禦:規則關鍵字、分類器、輸入輸出掃描、執行沙箱、跨對話的長期行為監控,以及 system prompt 與 skills 在其中扮演的角色。
Tag
2 篇文章
拆解 Claude Code、Codex 等 AI agent 的縱深防禦:規則關鍵字、分類器、輸入輸出掃描、執行沙箱、跨對話的長期行為監控,以及 system prompt 與 skills 在其中扮演的角色。
攻擊者只是對 TanStack 開了一個 fork PR 又立刻關掉,就利用 pull_request_target 的權限把惡意檔案寫進 CI 共享快取,等後續 PR 合併時劫持 npm trusted publishing token,6 分鐘投毒 84 個套件並蠕蟲式擴散到 169 個套件。