10+年产品经理专注分享AI 工具、AI 资讯、AI Coding、Vibe Coding与下一代产品创新,按 Ctrl+D 收藏我们
关于我 留言板 小程序 标签云

苏米客

  • 首页
  • AIGC
    • AI最新动态
    • AI学习教程
    • AI工具集合
    • AI产品百科
    • AI编程开发
    • AI提示词
    • AI开源项目
    • AI智能体
  • Axure
    • Axure动态
    • Axure教程
  • 产品
    • 用户体验
    • 产品设计
    • 苏米杂谈
  • 资源
    • 产品UI组件库
    • 开源图标库
    • 中后台框架
  • 书单
    • AI书籍
    • 用户体验
    • UI视觉
    • 产品研究
    • 其他类型
  • 下载
    • Axure组件
    • Axure原型
    • 文档报告
    • 素材资源
  • 登录
  • 首页
  • AIGC
    • AI最新动态
    • AI学习教程
    • AI工具集合
    • AI产品百科
    • AI编程开发
    • AI提示词
    • AI开源项目
    • AI智能体
  • Axure
    • Axure动态
    • Axure教程
  • 产品
    • 用户体验
    • 产品设计
    • 苏米杂谈
  • 资源
    • 产品UI组件库
    • 开源图标库
    • 中后台框架
  • 书单
    • AI书籍
    • 用户体验
    • UI视觉
    • 产品研究
    • 其他类型
  • 下载
    • Axure组件
    • Axure原型
    • 文档报告
    • 素材资源
当前位置: 首页 » AI最新动态

Fable 5 官方焚诀发布:Advisor 与 Orchestrator 架构实测,成本降低 54%,速度提升 3 倍

1月前 AI最新动态 347 0

Fable 5 单独跑一个任务,成本约 4 美元。换一套组合打法,只需 1.61 美元——效果相同,成本砍半,速度还快 3 倍。

7 月 7 日,Anthropic 官方开发者账号公布了两套 Fable 5 使用架构和一组跑分数据,展示了如何通过「Advisor 顾问模式」和「Orchestrator 指挥官模式」大幅降低 Fable 5 的使用成本。

Fable 5 在 SWE-bench Pro 编程基准测试中拿到 80.3% 的准确率,比 Claude Opus 4.8 高出十多个百分点。但 API 价格同样高昂:每百万 token 输入 10 美元、输出 50 美元,是 Claude Sonnet 5 限时优惠价的 5 倍。一个编程任务轻松消耗 2 到 4 美元。

Anthropic 给出的解决方案核心是:「别让 Fable 5 干体力活。」

图片 1

Advisor 顾问模式:92% 的能力,63% 的成本

第一套架构叫 Advisor。让更便宜的 Claude Sonnet 5 负责所有脏活累活——写代码、改文件、跑测试、读网页。Fable 5 只在关键节点出场,查看整个对话记录后给出方向建议,然后退场。

Anthropic 在 API 中添加了 Advisor Tool 功能。Claude Sonnet 5 工作到一半可随时调用 Fable 5 当顾问,Fable 5 输出 400 到 700 个 token 的建议后离开,Claude Sonnet 5 根据建议继续执行。每次 Fable 5 出场通常只调用一两次,大量 token 消耗落在 Claude Sonnet 5 身上并按其价格计费。

Claude Sonnet 5 在 SWE-bench Pro 上单独测试为 75.5%,加上 Fable 5 顾问后直接飙到 84%。作为对比,Fable 5 全程单干为 91%。

图片 2

这相当于 92% 的 Fable 5 能力,但只需 63% 的成本。

Orchestrator 指挥官模式:便宜 2.5 倍,快 3 倍

第二套架构叫 Orchestrator。Fable 5 当老板,负责拆解任务、分配工作、汇总结果;Claude Sonnet 5 当执行者,去搜索、抓取、阅读、执行。

图片 3

Anthropic 用 Managed Agents 实现多 Agent 协作。Fable 5 作为调度中心拆分任务,派出多个 Claude Sonnet 5 子智能体并行干活。每个子智能体在独立上下文中完成任务后向 Fable 5 汇报。

官方实测案例:让 AI 查询 10 个国家公园的门票价格和预约政策,每个公园必须去官网核实。

图片 4

指挥官模式 194 秒完成,成本 1.61 美元,84% 的 token 消耗在 Claude Sonnet 5 上。同样的活让 Fable 5 一个人干需要 608 秒,成本 4 美元——便宜 2.5 倍,还快了 3 倍。

大规模信息检索场景:96% 的能力,46% 的成本

在 BrowseComp 基准测试(考察从海量网页中寻找准确答案的能力)中,指挥官模式省得更多:

  • Fable 5 全程单干:90.8% 准确率,每道题 40.56 美元
  • Claude Sonnet 5 全程单干:77.8%,16.01 美元
  • Fable 5 指挥 + Claude Sonnet 5 干活:86.8%,18.53 美元

图片 5

96% 的能力,只需 46% 的成本。

两套架构如何选择?

顾问模式适合编程、代码调试等有明确产出物的工作。Claude Sonnet 5 干活,Fable 5 开头给方向,结尾把关。

指挥官模式适合大规模信息收集、文档审查、日志分析等 token 密集型任务。Fable 5 拆分任务,多个 Claude Sonnet 5 并行执行,便宜模型负责海量阅读,贵模型最终汇总输出。

一句话总结:「体力活交给便宜模型,脑力活给贵模型。」

当前状态与使用方式

两套架构目前均处于 Beta 阶段。顾问模式的 Advisor Tool 直接在 API 的 tools 数组里声明即可。指挥官模式的 Managed Agents 需要先创建 agent 定义,再新建 session。

如果在使用 Claude Code,其 subagent 机制已经内置了类似逻辑——Fable 5 负责规划,Claude Sonnet 5 负责执行。

Anthropic 已公开完整代码和文档。Fable 5 将于 7 月 12 号后转为按 API 用量计费,焚诀早用早享受。

声明:本站原创文章文字版权归本站所有,转载务必注明作者和出处;本站转载文章仅仅代表原作者观点,不代表本站立场,图文版权归原作者所有。如有侵权,请联系我们删除。
未经允许不得转载:Fable 5 官方焚诀发布:Advisor 与 Orchestrator 架构实测,成本降低 54%,速度提升 3 倍
#Fable 5 #Claude #Anthropic #AI 编程 #Agent 协作 
收藏 1
Wechatsync 开源工具:自媒体内容一键多平台同步发布指南
GPT-5.6 发布:Codex 并入 ChatGPT 桌面端,Sites 一键部署,三子模型分层定价
推荐阅读
  • 对标 Sora 2,谷歌Veo 3.1悄悄上线,实测体验比想象更惊喜!
  • DeepSeek登上了《Nature》封面!国内首家大模型!
  • Kimi K2 模型代码能力评测结果公开,Kimi K2超越DeepSeek拿下全球开源第一
  • 豆包导航上线:月活3亿+,AI超级入口再下一城
  • Claude Code的Harness Engineering公开后,全世界的 Agent 能力提高了一个档次
评论 (0)
请登录后发表评论
分类精选
Cursor 限制国内使用 Claude 等模型解决方案!
33189 1年前
学生/非学生:如何申请Cursor Pro免费会员,如何通过SheerID验证快速激活全攻略
29655 1年前
即梦AI图片2.1:一句话快速生成带中文的海报图,免费AI文生图、视频工具、AIGC创作工具
22702 1年前
注意!Cursor单设备登录新规:一个账户最多可以3台设备登录,且限制单点登录
21804 1年前
腾讯ima知识库skills上线:教你如何把腾讯 IMA 知识库接入 OpenClaw 一步打通
18868 4月前
国产大模型横向对比:Kimi K2.6、GLM-5.1、Qwen3、MiniMax M2 四大模型选型指南
17831 3月前
Trae国内版,搭载 doubao-1.5-pro、DeepSeek R1/V3模型,对比 Trae 国际版有什么不同
17781 1年前
字节推出Trae CLI :Claude Code 和 Gemini CLI的国产平替 ?手把手教你如何安装Trae Agent
17356 1年前
DeepSeek宣布:降价,最高降价75%!别错过这个优惠时段,赶紧充值
17270 1年前
刚刚!Cursor风控又加强了,可能是因为这个原因!
16034 1年前

文章目录

关注「苏米客」公众号

订阅推送更及时,手机查看更方便
分类排行
1 智谱ZCode 3.0升级:面向GLM-5.2深度优化,缓存命中率98%,限时额度1.5倍
2 DeepSeek 官宣 API 整体涨价:免费 Token 时代倒计时,开发者如何应对
3 MiniMax-H3-Turbo-Lora:8 步推理加速视频生成,质量不输原生 20 步
4 DeepSeek V4 Flash 内置联网搜索:Responses API 原生支持 web_search,Codex 可直接调用
5 GPT-5.6 更新:Luna 免费无限文本,Sol 统一付费 Chat 快答与深思
6 Cherry Studio V2.0 正式发布:从 AI 聊天客户端到 Agent 自主执行的全能工作站
7 Qwen-Image-3.0正式上线千问AI平台:Arena.ai文生图榜单国内第一,4.5k token复杂版面一次生成
8 Qwen 3.8 Max 实测:与 Kimi K3 三场景对比,工程严谨度更胜一筹
9 Qwen3.8-Max 评测:自主编程 16 天、2.4 万亿参数,能否挑战 GPT?
10 Qwen3.8-Max 上线:2.4 万亿参数,自主编程 16 天,API 首发千问 AI 平台
©2015-2024 苏米客XMSUMI 版权所有 · WWW.XMSUMI.COM 闽ICP备14005900号-6
微信文章助手 程序库 免费影视APP 免费字体下载 产品经理导航 爱克硕儿 产品经理AI资讯 Axure元件库下载 申请友联