开发者 3 秒速决决策指标
Anthropic 正式推出 Claude Fable 5.1,并同步发布面向网络防御与生命科学的 Mythos 5.1。Fable 5.1 在 Terminal-Bench 4.0 上达到 55.8%(上代 42.0%),科学终端基准翻倍至 52.6%,并在 CursorBench 3.2 以 73.4% 成为 Cursor 实测最强模型;缓存读取成本下降 75%,高代理工作负载最高可省约 45%。
核心要点速览 (Key Takeaways)
- ✓Fable 5.1 即日起全面可用,定位全球最强编程与知识工作模型
- ✓Terminal-Bench 4.0 达 55.8%,科学基准 52.6%,长程任务与科研能力显著跃升
- ✓Mythos 5.1 走受信访问;企业级前沿安全护栏(EFS)将于秋季分阶段上线
阅读完核心要点?进一步了解模型实力与实际开销
7 大权威镜像天梯跑分与 29+ 款主流编程套餐横向比价测算
讨论与评论
0登录后即可参与深度讨论
与广大 AI 开发者、工程师交流评测心得与前沿洞察