⚡
TL;DR Verdict 开发者 3 秒速决决策指标
All-Hands AI 正式发布开源自主软件开发智能体 OpenHands 0.18。新版重构了工具调用规划器与沙箱环境感知运行时,引入动态回溯搜索与多智能体审查机制,在权威的 SWE-bench Verified 基准测试上取得了 53.4% 的解决率,刷新了全球完全开源智能体框架的最佳纪录。
核心要点速览 (Key Takeaways)
- ✓在 SWE-bench Verified 达到 53.4% 解决率,位列全球开源 Agent 框架第一梯队。
- ✓引入沙箱运行日志自检与动态回退机制,避免智能体陷入死循环或破坏性改动。
- ✓支持本地 Docker 与远程云沙箱双模部署,兼容 OpenAI、Anthropic 与本地 Ollama 模型。
🧭
阅读完核心要点?进一步了解模型实力与实际开销
7 大权威镜像天梯跑分与 29+ 款主流编程套餐横向比价测算
讨论与评论
0登录后即可参与深度讨论
与广大 AI 开发者、工程师交流评测心得与前沿洞察