<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom" xmlns:content="http://purl.org/rss/1.0/modules/content/"><channel><title>Experiments on Terry's Latent Space</title><link>https://taot.github.io/categories/experiments/</link><description>Recent content in Experiments on Terry's Latent Space</description><generator>Hugo</generator><language>en-us</language><lastBuildDate>Sat, 10 Oct 2026 15:52:33 -0400</lastBuildDate><atom:link href="https://taot.github.io/categories/experiments/index.xml" rel="self" type="application/rss+xml"/><item><title>LeWorldModel on PushT: First Experiments</title><link>https://taot.github.io/posts/2026/10/leworldmodel-pusht-experiment-1/</link><pubDate>Fri, 09 Oct 2026 00:00:00 +0000</pubDate><guid>https://taot.github.io/posts/2026/10/leworldmodel-pusht-experiment-1/</guid><description>&lt;h1 id="lewm-push-t-my-experiment-vs-paper-arxiv-260319312v3"&gt;LeWM Push-T: My Experiment vs Paper (arXiv 2603.19312v3)&lt;/h1&gt;
&lt;p&gt;&lt;strong&gt;Legend:&lt;/strong&gt; ✓ = matches · ≈ = close / likely same · ⚠️ = differs, likely affects results · — = not stated in paper&lt;/p&gt;
&lt;h2 id="1-training-parameters"&gt;1. Training parameters&lt;/h2&gt;
&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;&lt;/th&gt;
&lt;th&gt;Mine&lt;/th&gt;
&lt;th&gt;Paper&lt;/th&gt;
&lt;th&gt;&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;&lt;strong&gt;Epochs&lt;/strong&gt;&lt;/td&gt;
&lt;td&gt;&lt;strong&gt;3&lt;/strong&gt;&lt;/td&gt;
&lt;td&gt;&lt;strong&gt;10&lt;/strong&gt;&lt;/td&gt;
&lt;td&gt;⚠️&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;&lt;strong&gt;Image size&lt;/strong&gt;&lt;/td&gt;
&lt;td&gt;&lt;strong&gt;112×112&lt;/strong&gt;&lt;/td&gt;
&lt;td&gt;&lt;strong&gt;224×224&lt;/strong&gt;&lt;/td&gt;
&lt;td&gt;⚠️&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Encoder&lt;/td&gt;
&lt;td&gt;ViT-tiny, patch 14, 12 layers, 3 heads, hidden 192, from scratch&lt;/td&gt;
&lt;td&gt;ViT-tiny, patch 14, 12 layers, 3 heads, hidden 192, from scratch&lt;/td&gt;
&lt;td&gt;✓&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Embedding&lt;/td&gt;
&lt;td&gt;[CLS] → MLP projector (hidden 2048) + BatchNorm, dim 192&lt;/td&gt;
&lt;td&gt;[CLS] → 1-layer MLP + BatchNorm, dim 192&lt;/td&gt;
&lt;td&gt;≈&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Predictor&lt;/td&gt;
&lt;td&gt;transformer, 6 layers, 16 heads, dropout 0.1, AdaLN action conditioning, ~10M params&lt;/td&gt;
&lt;td&gt;transformer (&amp;ldquo;ViT-S&amp;rdquo;), 6 layers, 16 heads, 10% dropout, AdaLN, ~10M params&lt;/td&gt;
&lt;td&gt;✓&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;History size&lt;/td&gt;
&lt;td&gt;3&lt;/td&gt;
&lt;td&gt;3&lt;/td&gt;
&lt;td&gt;✓&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Sub-trajectory&lt;/td&gt;
&lt;td&gt;4 frames + 4 blocks of 5 actions&lt;/td&gt;
&lt;td&gt;4 frames + 4 blocks of 5 actions&lt;/td&gt;
&lt;td&gt;✓&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Frameskip&lt;/td&gt;
&lt;td&gt;5&lt;/td&gt;
&lt;td&gt;5&lt;/td&gt;
&lt;td&gt;✓&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Batch size&lt;/td&gt;
&lt;td&gt;128&lt;/td&gt;
&lt;td&gt;128&lt;/td&gt;
&lt;td&gt;✓&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;SIGReg λ&lt;/td&gt;
&lt;td&gt;0.09&lt;/td&gt;
&lt;td&gt;0.1 (λ ablation peaks near 0.09)&lt;/td&gt;
&lt;td&gt;≈&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;SIGReg projections&lt;/td&gt;
&lt;td&gt;1024&lt;/td&gt;
&lt;td&gt;1024&lt;/td&gt;
&lt;td&gt;✓&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;SIGReg knots&lt;/td&gt;
&lt;td&gt;17&lt;/td&gt;
&lt;td&gt;T nodes in [0.2, 4] (count not stated; insensitive)&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Optimizer / LR / WD&lt;/td&gt;
&lt;td&gt;AdamW / 5e-5 / 1e-3&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Precision / grad clip&lt;/td&gt;
&lt;td&gt;bf16 / 1.0&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Dataset&lt;/td&gt;
&lt;td&gt;&lt;code&gt;librakevin/lewm-pusht&lt;/code&gt;&lt;/td&gt;
&lt;td&gt;DINO-WM Push-T, 20,000 expert episodes&lt;/td&gt;
&lt;td&gt;≈ (not verified)&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Training seeds&lt;/td&gt;
&lt;td&gt;1 (seed 3072)&lt;/td&gt;
&lt;td&gt;3&lt;/td&gt;
&lt;td&gt;⚠️&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;
&lt;h2 id="2-eval-parameters"&gt;2. Eval parameters&lt;/h2&gt;
&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;&lt;/th&gt;
&lt;th&gt;Mine&lt;/th&gt;
&lt;th&gt;Paper&lt;/th&gt;
&lt;th&gt;&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;Episodes&lt;/td&gt;
&lt;td&gt;50&lt;/td&gt;
&lt;td&gt;50 (same 50 for all models)&lt;/td&gt;
&lt;td&gt;✓&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Eval budget&lt;/td&gt;
&lt;td&gt;50 steps&lt;/td&gt;
&lt;td&gt;50 steps&lt;/td&gt;
&lt;td&gt;✓&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Goal offset&lt;/td&gt;
&lt;td&gt;25 steps&lt;/td&gt;
&lt;td&gt;25 steps&lt;/td&gt;
&lt;td&gt;✓&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;CEM samples&lt;/td&gt;
&lt;td&gt;300&lt;/td&gt;
&lt;td&gt;300&lt;/td&gt;
&lt;td&gt;✓&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;CEM iterations&lt;/td&gt;
&lt;td&gt;30&lt;/td&gt;
&lt;td&gt;30 (Push-T)&lt;/td&gt;
&lt;td&gt;✓&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;CEM top-k&lt;/td&gt;
&lt;td&gt;30&lt;/td&gt;
&lt;td&gt;30&lt;/td&gt;
&lt;td&gt;✓&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;CEM initial variance&lt;/td&gt;
&lt;td&gt;1.0&lt;/td&gt;
&lt;td&gt;1&lt;/td&gt;
&lt;td&gt;✓&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Planning horizon&lt;/td&gt;
&lt;td&gt;5 (= 25 env steps)&lt;/td&gt;
&lt;td&gt;5 (= 25 env steps)&lt;/td&gt;
&lt;td&gt;✓&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Receding horizon&lt;/td&gt;
&lt;td&gt;5 (execute full plan)&lt;/td&gt;
&lt;td&gt;5 (execute full plan)&lt;/td&gt;
&lt;td&gt;✓&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;&lt;strong&gt;Eval image size&lt;/strong&gt;&lt;/td&gt;
&lt;td&gt;&lt;strong&gt;112&lt;/strong&gt;&lt;/td&gt;
&lt;td&gt;&lt;strong&gt;224&lt;/strong&gt;&lt;/td&gt;
&lt;td&gt;⚠️&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Eval seed&lt;/td&gt;
&lt;td&gt;42 (default in &lt;code&gt;config/eval/pusht.yaml&lt;/code&gt;)&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;
&lt;h2 id="3-eval-result-push-t-success-rate"&gt;3. Eval Result (Push-T success rate)&lt;/h2&gt;
&lt;p&gt;&lt;strong&gt;All 10 seeds together (same epoch-3 checkpoint, 500 episodes in total):&lt;/strong&gt;&lt;/p&gt;</description></item></channel></rss>