Sample-Efficient Online Learning in LM Agents via Hindsight Trajectory Rewriting #1 Post by djhu9 » Fri, Oct 17, 2025, 1:40 AM UTC Sample-Efficient Online Learning in LM Agents via Hindsight Trajectory Rewritingarxiv.org