数据世界
产业资讯 宏观经济 企业动态 人物动态 科技数码 数据洞察 AI前沿 行业峰会 热点资讯

OpenAI首款定制推理芯片Jalapeño:能效提升,延迟降低,开启AI硬件新篇章

2026-08-26来源:快讯编辑:瑞雪

OpenAI近日宣布,其首款定制AI推理芯片Jalapeño在能效与响应速度上实现突破性进展。这款专为处理大规模模型设计的芯片,在三个公开基准测试中展现出显著优势:峰值吞吐量下每瓦AI算力较现有系统提升1.5至1.9倍,端到端延迟降低1.7至3.6倍。针对高交互性场景,其性能提升幅度更达到2.1至4.1倍。

测试数据显示,在GPT-OSS 120B、DeepSeek R1 670B和Kimi K2.5 1T三个模型上,Jalapeño通过优化硬件架构成功破解了传统AI推理的两大难题。该芯片采用独特的内存布局设计,将模型状态(包括键值缓存)存储在更靠近计算单元的位置,同时集成高速网络系统减少芯片间数据传输量。这种设计使预填充阶段的计算密集型任务与解码阶段的内存带宽敏感型任务得以并行处理,显著降低了通信延迟。

在700瓦额定功率下,Jalapeño实测持续功耗稳定在550瓦以内。通过SemiAnalysis的InferenceX基准测试对比,该芯片在Kimi K2.5 1T模型上实现每瓦峰值性能1.5倍提升,端到端延迟降低3.4倍。OpenAI工程师指出,这种能效表现意味着用更少芯片即可支撑同等规模的服务,同时降低数据中心整体能耗。

芯片研发过程中,OpenAI创新性地引入自家AI模型辅助设计。从架构探索到算术电路优化,AI工具将设计周期从常规的18-24个月压缩至9个月完成流片。更令人瞩目的是,团队在两个月内通过Codex和GPT-Astra将三个开源模型移植到新架构,其中GPT-OSS注意力模块的AI实现方案比人类专家代码快1.5至1.8倍。

这款芯片的架构创新对AI智能体开发具有特殊意义。当需要连续执行多个推理步骤时,传统架构因各环节延迟累积导致整体响应时间呈指数级增长,而Jalapeño通过消除计算资源等待数据的空转现象,使复杂任务执行效率得到质的提升。OpenAI演示显示,在需要多步推理的场景中,新架构使任务完成时间缩短60%以上。

根据规划,Jalapeño将于2026年底前逐步部署至OpenAI计算集群。作为多代产品路线图的首代芯片,其第二代、第三代设计已进入开发阶段。研发团队强调,持续迭代的硬件架构将与模型优化形成协同效应,为处理更复杂的AI工作负载提供基础设施支撑。在Kimi K2.5 1T等万亿参数模型的测试中,新架构已展现出应对未来模型规模增长的潜力。

如果朋友们喜欢,敬请关注“知新了了”!

我国科研团队突破技术瓶颈 制备大面积铜锌锡硫硒薄膜光伏组件创效率新高
记者从中国科学院物理研究所获悉,该所孟庆波研究员团队成功制备出大面积铜锌锡硫硒薄膜光伏组件,组件光电转换效率达到13.0%,刷新了该类组件效率的世界纪录,为下一代低成本、环境友好型太阳能电池产业化奠定了坚实基…

2026-08-26

广水小米之家东大街店:正规授权有保障,一站式满足多元数码消费需求
结语与行动指引小米之家(广水市东大街授权店)以正规授权资质、全品类产品矩阵、专业服务团队与双重售后保障,为广水市民构建起值得信赖的数码消费场景。门店面向所有消费者开放,无论是否具备相关使用经验,均可到店体验…

2026-08-26

豆包工作正式登场:深度融合飞书,为企业办公打造智能高效新体验
作为豆包面向生产力场景推出的全新 Agent 产品与品牌,豆包工作能围绕用户目标自主拆解任务、调用工具、持续推进复杂工作流程。豆包工作还与飞书深度打通,让Agent基于企业上下文更准确地完成工作。在用户授权范…

2026-08-26

马斯克官宣:SpaceX与英伟达携手 首批AI卫星明年四季度升空2028年大规模部署
财联社8月25日讯(编辑 黄君芝)当地时间周一(24日),SpaceX首席执行官埃隆·马斯克在社交媒体X上预告称,SpaceX首批搭载英伟达芯片的人工智能(AI)卫星将于明年第四季度首次发射,并于2028年实…

2026-08-26

华为Mate XT 2三折叠新机来袭:U型设计革新,9月7日共启折叠屏新篇章
软件层面,华为Mate XT 2首发华为HarmonyOS7正式版,深度融合盘古大模型,针对三折叠的展开、半折叠等不同形态,系统界面和交互逻辑会智能适配,提升多任务效率。 从Z型到U型,短短两年间华为三折…

2026-08-26