基准图表背后的细节
这些 headline 数据来自SemiAnalysis的公开InferenceX套件,但细节至关重要。该机构自身指出:“所有数据均由OpenAI提供。我们亲自在实验室验证了InferenceX的运行,但并未运行完整的InferenceX基准测试套件”[1]。此次比较还排除了Nvidia最新推出的Vera Rubin系统,这些系统最近才开始发货[2]——这意味着Jalapeño是与即将退出市场的GB200/GB300代产品进行对比,而非Nvidia当前的最新产品。测试未包含多轮对话或多长上下文(AgentX)基准,仅运行了单轮8k/1k测试[1]。在线技术讨论还提出了另一个尚未验证的细节:据报道,Jalapeño的运行跳过了推测性解码(speculative decoding),而这一技术在Rubin级芯片的比较中常被使用,一些人认为这可能夸大了Jalapeño的相对优势——这一说法来自社区讨论,并未在原始报告中确认,因此应视为开放问题,而非既定事实。



