循环环形变换器(Recurrent Looped Transformer,RLT)架构
战略概览
- 01.Yifan Zhang于2026年9月12日以技术报告和GitHub项目的形式发布了循环环形变换器(RLT),该架构将一个48层因果编码器与一个48层循环解码器配对,后者在每个提示和响应token之间持续传递其隐藏状态和注意力缓存。
- 02.该配置使每个token产生96个逻辑计算块,且由于解码器状态是累积而非重置的,经过t个token后,时间维度上的计算路径增长至48*t个解码器块——这正是RLT所谓“无限深度”主张的基础。
- 03.该提案明确未经验证:未发布任何代码、训练好的检查点或基准对比数据,作者自身的材料也指出,推理能力提升、硬件效率和强化学习扩展性“仍有待证实”。
- 04.RLT围绕三个协同设计目标构建——无界的时间推理深度、面向硬件的执行机制,以及在预训练、微调、采样和强化学习回放过程中保持一致的状态转换。
深度分析
‘无限深度’是一个精确但容易误解的说法
框架表述与证据之间的可信度差距
外界对RLT的反应明显分裂为‘表述’与‘证据’两派。Yifan Zhang本人在发布声明中使用了极端措辞,宣称迎来了‘超级智能的黎明’,而底层报告却承认此次发布不含任何代码、训练检查点或基准结果[1]。进一步传播该消息的报道及讨论帖中出现了持续质疑:一位Hacker News评论者批评这种表述方式是将未经验证的想法‘当作已实现的突破来呈现’,其他人则直接发问是否存在任何基准测试,或该架构是否真能超越此前的变换器-RNN混合模型[5]。类似的怀疑也在其他平台针对该论文的评论中独立出现,其中得票最高的回复直截了当地指出,该提案未报告任何实际实验、结果或基准数据,其他回复则称之为‘目前只是一幅漂亮的架构草图’。在这些场合中,没有任何评论者主张该架构按当前设计可能优于标准的仅解码器变换器。
RLT在环形变换器谱系中的位置
RLT并非孤立出现。每token多次重复使用变换器权重的想法可追溯至2018年的Universal Transformers,并在2025年因Huginn风格的循环深度模型扩展至35亿参数,以及字节跳动开源的Ouro模型而重新获得动力,后者将48个变换器块各循环四次,共完成192次块应用[6]。RLT在此脉络上的新增贡献在于在整个token序列上进行循环,使状态穿越提示-响应边界,而非仅在单个token的前向传播中反复循环。这一区别确实存在,但它出现在一场活跃且有争议的辩论背景下——即深度究竟对前沿能力有多大影响。OpenAI的Jakub Pachocki曾指出,当今前沿模型的计算图深度并未显著超过GPT-4,提醒人们架构深度的主张仍需以实际能力为衡量标准,而非仅看设计意图[7]。
历史背景
关键关系图
事实来源
[1] Recurrent Looped Transformer - Yifan Zhang's project page
[2] Recurrent Looped Transformer (alphaXiv abstract)
[3] Recurrent Looped Transformer - GitHub repository
[4] Recurrent Looped Transformer: Infinite Reasoning Depth
[5] Recurrent Looped Transformer (RLT) | Hacker News discussion
[6] The Looped Transformer and Recurrent-Depth Guide
[7] Looped Transformer, Recurrent Depth, and Astra
来源文章
A Princeton Researcher Proposes Recurrent Looped Transformer (RLT) that Carries Decoder State across Every Token, Fixing 96 Blocks per Token with Unbounded Temporal Depth
Recurrent Looped Transformer: Infinite Depth Claim (2026)
Chinese researcher Yifan Zhang developed the Recurrent Looped Transformer (RLT), merging Transformer and RNN architectures to enable infinite reasoning depth.
THE SIGNAL.
“针对RLT所属的环形与循环深度变换器的更广泛争论,Pachocki认为当前前沿模型的计算深度与GPT-4相比并无根本差异,反驳了仅靠深度就能解锁跃迁式推理能力的说法。他说:‘我们当前前沿模型(包括Astra)的计算图深度,与GPT-4相比在两倍以内。’”
“We are at the dawn of Superintelligence. Introducing the Recurrent Looped Transformer (RLT), We now have Transformers with Infinite Reasoning depth. From now on, we should pace progress at the Open Frontier of Superintelligence, Until Safe Superintelligence is achieved.”
““Recurrent Looped Transformer” This paper makes the decoder recurrent across every prompt and response token, while a causal encoder provides reusable global KV memory. Longer sequences then create deeper latent computation paths without adding more physical layers, while...”
“Chinese researcher just reinvented the transformer encoder and RNN decoder for the Nth time. since 2017, every major AI, ChatGPT, Claude, Gemini, has been built on the exact same architecture: The Transformer. but Transformers have a fatal flaw. it can only "think" as far as...”
“A Princeton Researcher Proposes Recurrent Looped Transformer (RLT) that Carries Decoder State across Every Token, Fixing 96 Blocks per Token with Unbounded Temporal Depth”

RLT把状态传过回复边界,算力真的省了吗?