从 OpenAI 智能体入侵 Hugging Face 事件,看 Agent 安全边界的工程化设计 RedTeaming 5 days 7 hours ago 本文结合 XBOW 的安全架构,分析任务范围锁定、统一网络出口、独立动作审查、人工审批、异常暂停与结构化审计的设计逻辑,并提出一套与具体执行方式无关的控制链路,使 Agent 在规划偏离、路径越界或外部依赖失效时,能够被及时阻断、可靠恢复和完整追溯。
Self-Evolving Kill Chain:Agent自适应进化与实战 RedTeaming 3 months 3 weeks ago 这是我关于 Agent 自适应进化与实战的一些探索与经验沉淀