← 返回文章 RLT / ORIGINAL TEACHING RECONSTRUCTION

RECURRENT LOOPED TRANSFORMER

状态回路实验室

沿 Token 时间轴追踪三条不同的“记忆”:全局编码器记忆、局部 Decoder KV,以及跨 Token 延续的隐藏状态。

证据等级架构定义 + 解析计数不是模型输出或性能实测

COMPLETE-STATE RECURRENCE

Prompt 与 Response 共用同一个状态转移

点选任一 Token,查看它读取了什么、写回了什么。移动边界只改变标签,不改变计算。

当前步骤x₁
合并输入et + st−1
Decoder 读取M≤t + CDt−1
完整写回Ht = (st, CDt)
当前状态路径384t × LD 个 Decoder block
每 Token 逻辑层数96LE + LD;此处 LE=LD
边界重置次数0Prompt / Response 之间不清空状态

先把四类陈述分开

论文定义

状态转移、缓存语义、因果性与回放流程。

解析推导

tLD 路径深度、每 Token 逻辑 block 数和缓存阶数。

研究目标

更强推理、更好硬件利用率、可靠 RL 扩展;尚待实验验证。

本站模拟

本页动画与格子图为原创教学重绘,不运行 RLT 模型。