10+年产品经理专注分享AI 工具、AI 资讯、AI Coding、Vibe Coding与下一代产品创新,按 Ctrl+D 收藏我们
关于我 留言板 小程序 标签云

苏米客

  • 首页
  • AIGC
    • AI最新动态
    • AI学习教程
    • AI工具集合
    • AI产品百科
    • AI编程开发
    • AI提示词
    • AI开源项目
    • AI智能体
  • Axure
    • Axure动态
    • Axure教程
  • 产品
    • 用户体验
    • 产品设计
    • 苏米杂谈
  • 资源
    • 产品UI组件库
    • 开源图标库
    • 中后台框架
  • 书单
    • AI书籍
    • 用户体验
    • UI视觉
    • 产品研究
    • 其他类型
  • 下载
    • Axure组件
    • Axure原型
    • 文档报告
    • 素材资源
  • 登录
  • 首页
  • AIGC
    • AI最新动态
    • AI学习教程
    • AI工具集合
    • AI产品百科
    • AI编程开发
    • AI提示词
    • AI开源项目
    • AI智能体
  • Axure
    • Axure动态
    • Axure教程
  • 产品
    • 用户体验
    • 产品设计
    • 苏米杂谈
  • 资源
    • 产品UI组件库
    • 开源图标库
    • 中后台框架
  • 书单
    • AI书籍
    • 用户体验
    • UI视觉
    • 产品研究
    • 其他类型
  • 下载
    • Axure组件
    • Axure原型
    • 文档报告
    • 素材资源
当前位置: 首页 » AI最新动态

Anthropic Mythos 神话级模型正式发布:Claude Fable 5 对所有人开放,Claude Mythos 5 继续限制访问

1月前 AI最新动态 396 0

Anthropic 在 2026 年 6 月 9 日正式发布了两款模型:Claude Fable 5 对所有人开放,Claude Mythos 5 继续限制访问。

最引人注目的是,这两个模型底层使用完全相同的权重参数,区别仅在于安全护栏的配置。

Fable 来自拉丁语 fabula("被讲述的东西"),与希腊语 mythos(神话)同源。Anthropic 用这个命名暗示了两者同源分流的关系——Fable 是安装了安全刹车的公开版本,Mythos 则是移除了部分安全限制、仅面向特定用户的版本。

图片 1

性能表现:编程能力大幅领先

Anthropic 公布了 Mythos 5 / Fable 5 与 Opus 4.8、GPT 5.5、Gemini 3.1 Pro 的对比数据,核心指标如下:

Benchmark Mythos 5 / Fable 5 Opus 4.8 GPT 5.5 Gemini 3.1 Pro
SWE-Bench Pro(Agentic 编程) 80.3% 69.2% 58.6% 54.2%
FrontierCode 钻石难度 29.3% 13.4% 5.7% —
Terminal-Bench 2.1(终端编程) 88.0% 82.7% 83.4%* —
GDPval-AA(知识工作) 1932 1890 1769 1314
Humanity's Last Exam(多学科推理) 59.0% / 64.5%** — — —

* GPT 5.5 配 Codex CLI
** 不带工具 / 带工具

图片 2

SWE-Bench Pro 上 80.3% 的成绩标志着 Agentic 编程能力的一次显著跃升。相比之下,GPT 5.5 的 58.6% 与 Fable 5 之间存在超过 20 个百分点的差距。

图片 3

FrontierCode 的"准确率对成本"曲线揭示了一个关键差异:Fable 5 在增加算力投入后分数持续上升,从 low 到 max 几乎呈线性增长;而 Opus 4.8 在 xhigh 配置后出现平台期甚至回落,GPT 5.5 则整体表现低迷。这表明 Fable 5 在处理长链条复杂任务时具有更深的扩展空间。

安全护栏:能力与风险的平衡

Fable 5 部署了三类安全护栏,覆盖网络安全、生物化学和模型蒸馏。当用户请求涉及高风险领域(如网络攻击规划、双用途生物研究)时,模型不会直接回答,而是将会话转交给能力较低但更安全的 Opus 4.8 处理,用户会收到明确告知。

官方数据:超过 95% 的会话不会触发回退机制;不到 5% 的对话会被转走。在网络安全内部测试中,关于策划网络攻击的单轮有害请求得到有效回应数量为零。

这套机制也解释了对比表中带星号的数据点——在网络安全和生物相关题目上,Fable 5 的成绩向 Opus 4.8 靠拢,因为护栏拦截了部分回答。换言之,公开版 Fable 5 在敏感领域的能力是被刻意限制的,其完整能力存在于不公开的 Mythos 5 中。

Mythos 5 通过 Project Glasswing 项目交付给美国政府的网络防御方和关键基础设施提供方。Anthropic 计划未来通过"可信访问计划"逐步扩大访问范围,聚焦防御性网络安全和生物医学研究。

视觉能力:新的行业标杆

Fable 5 在视觉理解方面被官方定位为新的标杆。其能力包括:

  • 从复杂科学图表中读取精确数值数据
  • 仅通过网页截图反向生成对应网页的源代码
  • 纯视觉方式通关《宝可梦 火红》——无地图、无导航提示、无游戏状态信息输入,仅凭屏幕像素识别完成全程游戏
  • 生成流体模拟代码,使流体运动与自创音乐节拍同步(模型从未接触过任何音频数据)

图片 4

工具集成与定价

Fable 5 已集成到 Claude Code 和 Cowork 中。Claude Code 创始人 Boris Cherny 评价该模型"在编程模型中数一数二",具体优势包括:所需提示更少、token 使用效率更高、代码质量更好、工具调用更精准、自我验证能力更强、会话持续时间更长。

图片 5

定价方面,Fable 5 与 Mythos 5 保持一致:输入 $10/百万 token,输出 $50/百万 token,官方表示不到 Mythos Preview 价格的一半。Fable 5 自 6 月 9 日起对 API 用户开放,订阅套餐将分批放量。

苏米观察

这次发布的核心意义不在于跑分数字,而在于 Anthropic 首次公开承认了一个事实:模型的真实能力上限与企业愿意交付给用户的能力,是两个不同的概念。

同一套权重,装上是刹车叫 Fable,面向全球开发者;拆掉刹车叫 Mythos,仅限政府背书的少数机构。这种"同源分流"的策略反映了 AI 行业正在面临的一个深层问题——随着模型能力逼近危险边界,"什么该给、什么不该给"的判断权越来越集中到少数几家头部公司手中。

对开发者而言,SWE-Bench Pro 80.3% 的编程模型是实打实的工具升级。但 5% 的回退率、带星号的对比数据、以及被锁在玻璃柜里的 Mythos,都在提醒我们关注能力之外的治理议题。

声明:本站原创文章文字版权归本站所有,转载务必注明作者和出处;本站转载文章仅仅代表原作者观点,不代表本站立场,图文版权归原作者所有。如有侵权,请联系我们删除。
未经允许不得转载:Anthropic Mythos 神话级模型正式发布:Claude Fable 5 对所有人开放,Claude Mythos 5 继续限制访问
#Anthropic #Fable 5 #Mythos 5 #AI安全 #编程模型 
收藏 1
腾讯妙境Miora:AI创意设计智能体产品解读
CC Switch:用免费模型享受付费级稳定性,多模型自动降级熔断
推荐阅读
  • Google AI Mode上线免费体验:从聊天到代理,让生活更高效!
  • DeepSeek又一王炸开源:OCR 终结者登场!DeepSeek-OCR,重新定义AI视觉效率
  • Wildcard野卡停止服务了!钱没了?以后还怎么充值Claude?升级ChatGPT Plus?
  • Claude Fable 5 全球下线始末,当安全叙事成为监管利器
  • WorkBuddy(腾讯版小龙虾)开箱即用,全场景智能桌面版
评论 (0)
请登录后发表评论
分类精选
Cursor 限制国内使用 Claude 等模型解决方案!
32257 12月前
学生/非学生:如何申请Cursor Pro免费会员,如何通过SheerID验证快速激活全攻略
29002 1年前
即梦AI图片2.1:一句话快速生成带中文的海报图,免费AI文生图、视频工具、AIGC创作工具
21235 1年前
注意!Cursor单设备登录新规:一个账户最多可以3台设备登录,且限制单点登录
20820 1年前
Trae国内版,搭载 doubao-1.5-pro、DeepSeek R1/V3模型,对比 Trae 国际版有什么不同
17026 1年前
DeepSeek宣布:降价,最高降价75%!别错过这个优惠时段,赶紧充值
16604 1年前
字节推出Trae CLI :Claude Code 和 Gemini CLI的国产平替 ?手把手教你如何安装Trae Agent
16385 1年前
腾讯ima知识库skills上线:教你如何把腾讯 IMA 知识库接入 OpenClaw 一步打通
16281 3月前
国产大模型横向对比:Kimi K2.6、GLM-5.1、Qwen3、MiniMax M2 四大模型选型指南
16134 2月前
刚刚!Cursor风控又加强了,可能是因为这个原因!
15472 1年前

文章目录

关注「苏米客」公众号

订阅推送更及时,手机查看更方便
分类排行
1 Meta Muse Spark 1.1 发布:首个付费 AI 模型,Agent 能力三榜第一,API 定价仅为 Claude Opus 四分之一
2 吴恩达三层反馈循环理论:AI 越聪明人越要往外走,告别无效改 Prompt
3 Grok 4.5 发布:对标 Opus 4.8,成本降低 90%,Token 消耗仅为竞品四分之一
4 GPT-5.6 发布:Codex 并入 ChatGPT 桌面端,Sites 一键部署,三子模型分层定价
5 Fable 5 官方焚诀发布:Advisor 与 Orchestrator 架构实测,成本降低 54%,速度提升 3 倍
6 Meta Muse Image 发布:首个 Agent 生图模型,支持写代码查资料和自主修正
7 GPT-5.6 全量上线!ChatGPT 史诗级语音升级 GPT-Live,全双工架构免费开放
8 2026年大模型开源四大天王:DeepSeek、GLM、MiniMax、Nemotron 选型指南
9 TRAE 大更新:Hook 钩子、全局记忆、Design 模式,IDE 三大核心升级解析
10 腾讯混元 Hy3 正式版实测:Agent 能力提升,价格仅为 GLM-5.2 的 1/5
©2015-2024 苏米客XMSUMI 版权所有 · WWW.XMSUMI.COM 闽ICP备14005900号-6
微信文章助手 程序库 免费影视APP 免费字体下载 产品经理导航 爱克硕儿 产品经理AI资讯 Axure元件库下载 申请友联