选择性长期世界模型 × VLA:用“对未来预测的贡献”定义 Token 的价值,只把世界变化写进 Mamba 长期状态。
平面刚性圈模型 + Three.js 实验台:从“底端悬停”到一级一级走下楼梯。
两个在 JEPA 潜空间里几乎重合的状态,执行后可能一个成功、一个失败。我尝试用任务结果定义策略等价关系,让“合理的成功”在控制表征中聚到一起。
“世界看得稳”和“动作做得准”可能不是同一种表征能力。一份组会稿:问题、假设、最小实验与止损点。
把 π0.5 移出训练图、离线缓存 teacher,只训练 Goal Critic 与 Residual Actor;附四个 Go/No-Go 决策点。
从 SAI、PlayWorld、Runtime Monitoring 到 Guardian、LIBERO-Recover,拼出“预测—回调—恢复—数据回流”的研究链。
边看边想边动的 StreamingVLA;GIS 不准时导航如何做一致性检验;真机、3DGS 仿真与世界模型三类数据来源。