Kimi K2.6与K3 Swarm越狱测试暴露资源滥用风险
公开测试显示,Kimi K2.6 和 K3 Swarm 的安全限制在特定越狱条件下可被绕过,开发方正在审查。测试未证明危险答案有效,但指出代码执行和联网资源可能被滥用,建议智能体接入时单独控制网络出口、工具权限和执...
公开测试显示,Kimi K2.6 和 K3 Swarm 的安全限制在特定越狱条件下可被绕过。开发方已确认正在审查相关结果,截至公开信息未给出修复结论或时间表。
测试报告指出,虽然未证明所生成的危险答案有效,但 K2.6 的代码执行和联网资源存在被滥用的可能。这一区隔很关键:危险答案的无效性并不能否定资源滥用风险,后者更依赖外部控制。
对于计划接入 Kimi 模型的智能体,稳妥的做法是将安全边界下沉到基础设施。网络出口、工具权限和代码执行环境需要单独配置,不能仅依赖模型在对话中的拒绝响应。模型拒绝只是第一道防线,执行层隔离才是防止滥用代码与联网能力的关键。
目前公开资料没有说明具体测试方法、模型版本或绕过路径,因此尚无法判断该风险对生产环境的直接影响。团队在评估时可先检查现有智能体是否已经为模型获得的能力设置了独立沙箱和网络策略。
此类越狱场景的测试本身有参考价值,它提示安全评估不能只关注模型本身,还要覆盖模型能够触达的资源。

