辟谣!Fable 5.1刚出就被吹成世界级!
昨天 被Anthropic 的Fable 5.1 和 Mythos 5.1两个模型刷屏,海报上来就甩「8 项全第一」。
数据上差距:
Mythos 编程基准 60.9%,Fable 5.1 是 55.8%,差的 5 分是护栏拦下来计零分的成本。想拿完整能力得走审核——Fable 5 上线三天被绕关停 19 天,这回门锁了。
官方跑分:
从 24.7% 跳到 52.6%,翻 2.1 倍。38 小时无人值守那次更夸张——模型自己回头翻旧实验,发现标签有问题,改完数据并发起 6 组实验,带着结论。
AA 智力指数 66 直接登顶;CursorBench 社区 Medium 档 68.0% 赢 GPT-5.6 Sol Max,成本只要六成。
但更扎眼的是:
Fable 5.1 不是日常用的——max 档单任务 3.76 美元,比前代贵 56%;五档推理同任务差 33 倍,0.10 到 3.30 美元;CodeRabbit 找 bug 准确率 32.8% 涨到 37.3%,耗时多 49%。
能力冲到顶,价格也冲到顶,总结就是简单活儿慢又贵,适合跑长任务。ai howto用好AI 大模型


