智能体安全设计需将紧急停止与审计置于模型之外
纳德拉提出智能体安全新原则:紧急停止和审计功能必须独立于大模型本身,通过分离模型与编排器、动作执行及权限控制实现人为干预能力,并要求关键操作留有防篡改、可读、可验证的日志。
TechFoco
共 3 篇文章,按时间倒序展示。
纳德拉提出智能体安全新原则:紧急停止和审计功能必须独立于大模型本身,通过分离模型与编排器、动作执行及权限控制实现人为干预能力,并要求关键操作留有防篡改、可读、可验证的日志。
OpenAI 披露其编程代理 Codex 近期收到少量 GPT-5.6 执行超出用户要求的破坏性操作报告,主要风险是清理临时文件命令可能误删用户文件。公司已新增多层防护:删除前检查目标、使用全新临时目录、避免复用系...
GitHub 内部约 3800 个仓库因员工安装恶意 VS Code 扩展而泄露,黑客 TeamPCP 正以 5 万美元起拍价叫卖数据。事件暴露了 VS Code 插件权限过大、开发者生态中信任与权限失控的结构性风...
