tooling
llama.cpp 原生 Decision Models:/v1/systemone 一次前向出概率;支持 Julia-1/Laya/Kev-4B/lev/OpenJev
ggml-org 于 2026-10-02 宣布 llama.cpp server 合并 PR #29818,新增 /v1/systemone:对状态(文本/JSON/截图)与 typed 问题做单次前向打分,兼容 TypeSafe Jev / System One 客户端。首批模型:Julia-1(144M)、Laya(421M)、Kev-4B、lev、OpenJev(27B+视觉)。Cloudflare Clef 列为后续。
tooling
Meta 开源 Muse Gadgets:ESP32/Linux SDK 把 Muse Agent 接到自制硬件;Home Link 送 5000 台
Meta Superintelligence Labs 于约 2026-10-02 开源 facebookincubator/muse-gadget-sdk(Apache-2.0):ESP32 固件 + Linux Device SDK,让开发者用开发板/树莓派把 Muse Agent 接到屏幕、按键、传感器与本地 HTTP 设备。配套自研 Muse Home Link(USB-C),美区订阅用户限领 5000 台。需 SDK token;推荐用 Muse Code 读 AGENTS.md 一键编译烧录。
tooling
Ai2 发布 Olmo-core 3:开源万亿级 MoE 训练栈;B300 上 1.2T 达 858 TFLOP/s/GPU
Allen Institute for AI 于 2026-10-01 发布 Olmo-core 3:面向大规模 MoE 的开源训练框架(GitHub、PyPI ai2-olmo-core)。相对旧 FSDP 路径改走 DDP + Expert Parallelism;8×B300 上 47B MoE 吞吐约 2.7×(52k vs 19.4k tok/s/GPU);系统基准含 1.2T(512 GPU,最高 858 useful-model TFLOP/s/GPU)与 DeepEP v2 短测 2.38T。技术报告见 allenai.org/papers/olmocore3。
讨论与评论
0登录后即可参与深度讨论
与广大 AI 开发者、工程师交流评测心得与前沿洞察