标签:AI安全
最新文章、技术实践与产品更新。
资讯
Anthropic 放出 Claude Mythos:最吓人的不是会找漏洞,而是普通人也能用了
Anthropic 最新公布的 Claude Mythos Preview,不只是更会写代码,而是已经能在主流操作系统、浏览器和关键基础设施软件里挖出高危漏洞。更扎心的是,这件事已经不是顶级安全研究员的专属能力了。
资讯
OpenAI 开始给安全问题发悬赏了:这次盯上的不是漏洞,是 AI 自己会乱来
OpenAI 新开的 Safety Bug Bounty,不只盯传统安全漏洞,还开始给提示注入、数据外泄、Agent 越权这种 AI 特有风险发悬赏。风向已经很明显:接下来真正难的不是模型会不会写代码,而是它会不会在真实环境里乱动东西。
AI技术
Anthropic 放弃核心安全承诺:当「最负责任的 AI 公司」也开始妥协
Anthropic 宣布取消 RSP 政策中「不能保证安全就不训练」的核心承诺,理由是竞争对手都在往前跑,单方面承诺没有意义。这一变化引发了对 AI 安全治理的担忧。