11.7 Domino:把因果建模从自回归起草中拆出来#
Domino 先用并行骨干一次算出整个草稿块的基础分布,再让一个轻量 GRU 按已采样前缀顺序更新状态,并通过低秩头对每个位置的 logits 做残差校正;它保留块内因果依赖,却避免为每个草稿 token 重跑完整草稿网络和全词表 LM Head。
Domino 先用并行骨干一次算出整个草稿块的基础分布,再让一个轻量 GRU 按已采样前缀顺序更新状态,并通过低秩头对每个位置的 logits 做残差校正;它保留块内因果依赖,却避免为每个草稿 token 重跑完整草稿网络和全词表 LM Head。