OpenAI在Hot Chips 2026上公布代号Jalapeño的自研推理芯片,与博通合作从零设计,仅16个月完成流片。该芯片使用HBM4内存,在SemiAnalysis的InferenceX基准测试中,性能功耗比击败英伟达Blackwell和Vera Rubin,低并发场景DeepSeek R1达每用户每秒超700 token。关键在于Jalapeño未用多Token预测和投机解码仍领先,且不做prefill-decode分离。架构上采用权重驻留脉动阵列、乱序执行核心和切片式内存设计消除固定延迟。软件层用Gluon语言和Codex自动生成内核,开发速度惊人。机架系统采用Katsu-Vindaloo-Chana三层架构,最多扩展至2048颗芯片。计划2027年量产,目标100MW部署。
原视频来自:youtu.be
聊天讨论群,可加微信gxjdian入群,需备注,来自播客AI前沿
