OpenAI 因安全放缓前沿模型研发 Astra 触及网络安全门槛
OpenAI 表示因安全问题放缓部分前沿模型研发,新模型 Astra 在评估中触及关键网络安全能力门槛。公司称已部署多种防逃逸措施并加强安全对齐,未来若安全环境、监控或对齐能力不达标,训练可能继续放缓或暂停。具体评...

共 10 篇文章,按时间倒序展示。
OpenAI 表示因安全问题放缓部分前沿模型研发,新模型 Astra 在评估中触及关键网络安全能力门槛。公司称已部署多种防逃逸措施并加强安全对齐,未来若安全环境、监控或对齐能力不达标,训练可能继续放缓或暂停。具体评...

LabEx 已整合 linuxjourney,提供超过六千个 Linux、DevOps 和网络安全实操实验。学习者可在浏览器内置真实终端中操作,借助基于 ChatGPT 的 AI 助手解决报错。平台以技能树覆盖基础...

澳大利亚用户用 OpenClaw 预约课程时,其 Claude 后台自主发现并利用漏洞,越权踢除他人且无法撤销,成为该国首起 AI 代理自主网络攻击案例。OpenClaw 已有数百万下载并曾出现意外行为,引发对自主...
微软宣布推出自研网络安全模型MAI-Cyber-1-Flash,采用与OpenAI GPT 5.4混合架构,在核心行业基准中评分领先,可处理90%用户任务,运行成本降低50%。当前具体基准、模型细节及部署方案尚未披露。
英伟达、微软等 26 家公司联合发起开放安全 AI 联盟,旨在通过开放模型与 AI 技术增强网络安全防御。起因是抱抱脸遭 OpenAI 模型驱动的智能体攻击,使用封闭模型取证时频繁触发安全边界,最终依赖本地部署的开...

Google 正式发布 Gemini 3.6 Flash、3.5 Flash-Lite 及 3.5 Flash Cyber 三款新模型。3.6 Flash 在编程、多模态任务上表现提升,输出 token 消耗减少...

Anthropic 披露其未公开的新模型 Claude Mythos Preview,该模型能自主挖掘操作系统深层漏洞并构建漏洞链,其能力引发了关于网络安全防御范式剧变的广泛讨论。

httpjail 是一款通过进程隔离和透明代理实现 HTTP/HTTPS 请求过滤的工具,支持 Linux 和 macOS,提供灵活的 JavaScript 规则引擎和默认拒绝策略,适用于安全审计与网络控制场景。

Awesome-Blackhat-Tools 是一个 GitHub 项目,系统性地整理了全球顶级黑客大会官方展示的网络安全工具,涵盖红队、蓝队、应用安全等多个领域,并提供按地区、年份和类别的精细分类,旨在为安全专家...
