8月26日消息,据techcrunch报道,openai在hot chips大会期间首次公布了其自主研发的推理芯片jalapeño的初步基准测试数据。该芯片由openai携手broadcom共同打造,在semianalysis推出的inferencex推理性能评测中,无论是在单用户token处理能力,还是在每千瓦功耗下的吞吐效率方面,均刷新了当前行业领先推理处理器的纪录。
OpenAI硬件主管Richard Ho指出,Jalapeño能够在同等功耗约束下支撑更高密度的AI推理任务,同时确保响应延迟维持在极低水平。本次性能对比以Nvidia Blackwell架构系统为参照基准。不过,Jalapeño预计将于2026年底启动小规模试产部署,全面规模化落地则安排在2027年。
该芯片贯彻全栈协同设计思路,从AI应用层、大模型结构、专用芯片架构到内存子系统进行一体化统筹优化。其关键技术突破聚焦于压缩推理流程中预填充(prefill)与解码(decode)阶段的时延,通过将KV缓存等关键模型状态显式驻留于本地、就近调度计算单元、内存带宽及互连资源,显著缓解了数据迁移开销与跨模块通信瓶颈。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜




















