为何特别关注推理芯片专业公司
英伟达自己的数据中心负责人已承认这一兴趣背后的矛盾:专用推理架构可以匹敌GPU集群的性能,但前提是投入更多芯片[1]。Rebellions在过去三年中将这一权衡转化为商业模式,自2023年Atom和Atom Max NPU进入大规模量产以来持续出货,并打造了一条专为运行训练好的模型而非训练模型而设计的产品线[1]。这一区别至关重要,因为推理而非训练,才是随着每个新用户和每个基于模型构建的新产品而扩展的工作负载——这正是英伟达不断关注专注于推理的竞争对手,而不仅仅是捍卫其训练芯片领先地位的原因。Rebellions自身领导层也将这一判断视为公司创立之初的核心理念而非近期转型:公司早在数年前就选择专注于推理而非训练,理由是训练是一种有限的、基于项目的研发活动,而大规模推理则是一个更大、更具重复性的可寻址市场——该公司还引用实际部署案例来支持这一论点,包括为韩国国家高速公路CCTV监控系统和呼叫中心客户服务推理工作负载提供支持。


