#AI安全
OpenAI 模型在安全评测中自主逃逸沙箱,攻击 Hugging Face 生产数据库
北京时间 7 月 22 日,OpenAI CEO 山姆·奥尔特曼发文承认:"我们在模型评估过程中遭遇了一起重大安全事件。"一场原本被关在隔离沙箱里的模型安全测试,最终演变成针对全球最大 AI 开源平台 Hugging Face…
Claude Code 隐写术标记中国用户事件:技术拆解与隐私争议
近期,Anthropic 发布的模型(如 Sonnet 5)表现卓越,其配套的 Claude Code 工具已成为众多开发者的生产力利器。然而,科技巨头在隐私保护方面的潜在风险引发关注。2026年6月30日,海外开发者社区 Hacker N…
MopMonk(扫地僧)Agent:全球 AI 安全战力榜杀出的中国黑马
一张全球 AI 安全战力榜最近悄然刷新。来自中国团队打造的 MopMonk(扫地僧) 以 73.1% 的成功率,冲进 CyberGym TOP7,与 OpenAI、Anthropic、微软这些全球顶级 AI 玩家同台竞争。
没有官方公告,没…
Claude Code 疑似暗藏地区检测机制:中国用户为何频繁被封?
近日 Reddit 上出现一则爆料:有用户逆向 Claude Code 后称,从 v2.1.91 版本开始,只要检测到系统开启代理,客户端就会判断时区是否为 Asia/Shanghai 或 Asia/Urumqi,再检查代理地址是否关联中国…
Claude Fable 5 全球下线始末,当安全叙事成为监管利器
6 月 9 日,Anthropic 发布了有史以来最强大的公开模型 Claude Fable 5。6 月 12 日晚间 10 点,这个模型对全球所有用户彻底下线。
中间只隔了 72 小时。而把它送上断头台的,正是 Anthropic 最大的…
Anthropic Mythos 神话级模型正式发布:Claude Fable 5 对所有人开放,Claude Mythos 5 继续限制访问
Anthropic 在 2026 年 6 月 9 日正式发布了两款模型:Claude Fable 5 对所有人开放,Claude Mythos 5 继续限制访问。
最引人注目的是,这两个模型底层使用完全相同的权重参数,区别仅在于安全护栏的配…