Claude 硬件控制安全要求 11 月 12 日生效
Anthropic 更新 Claude 使用规则,新增自主控制硬件时的安全要求,11 月 12 日生效。合格操作员须能观察并停止设备,断连后设备进入安全状态,开发需纳入人工接管与断连安全。普通抱怨、模型测试与研究不...
Anthropic 更新了 Claude 的使用规则,新增针对自主控制硬件场景的安全要求,生效日期为 11 月 12 日。新规则覆盖 Claude 连接硬件并自主执行可能致伤动作的情况,要求开发团队在设计阶段就纳入人工接管与断连安全机制。
具体安全要求包括:合格操作员须能观察并停止设备,模型断连后设备也须进入安全状态。这意味着硬件控制方案需要具备可观察、可停止的远程控制接口,并满足操作员资质要求。断连后的安全状态将成为硬件集成方案的必选设计约束,直接影响故障模式分析与安全评估。
工程实现层面,开发此类控制系统的团队应将人工接管与断连行为纳入测试验证流程,以降低合规风险。例如需要在断连、网络中断或模型异常退出的场景下,确认设备能够自动进入预定义的安全状态,而不是停留在不可控的运动中。
同时,使用政策澄清了极端持续辱骂禁令的边界:普通抱怨、模型测试与研究不属于新增禁令范围。内容审核团队需要据此区分不同场景,避免将正常的模型评估或用户反馈误判为违规。
目前细则尚未披露“可能致伤动作”的具体硬件类型和场景边界,也未说明合格操作员的资质定义、客户适用范围或是否提供技术标准与合规审核工具。相关团队在推进硬件控制项目时,仍需关注后续补充说明。