⚡
TL;DR Verdict 开发者 3 秒速决决策指标
OpenAI 正式披露其首款自研推理芯片 Jalapeño 的实测数据(InferenceX)。在 GPT-OSS 120B、DeepSeek R1 与 Kimi K2.5 1T 模型上,峰值吞吐下每瓦算力提升 1.5–1.9 倍,端到端延迟降低 1.7–3.6 倍,计划年底前全面部署于自有算力集群。
核心要点速览 (Key Takeaways)
- ✓OpenAI 从纯大模型公司正式跨入自研硬件芯片阵营,并在跨模型上给出公开客观基准数据;
- ✓芯片专为 Agent 推理架构定制,同一套芯片架构同时兼顾 Prefill 阶段与 Decode 阶段的高并发处理;
- ✓硬件开发周期被 AI 研发大幅压缩:仅 9 个月完成 Tapeout,并在 2 个月内通过 Codex 完成对三款开源大模型的全速适配。
🧭
阅读完核心要点?进一步了解模型实力与实际开销
7 大权威镜像天梯跑分与 29+ 款主流编程套餐横向比价测算
讨论与评论
0登录后即可参与深度讨论
与广大 AI 开发者、工程师交流评测心得与前沿洞察