Get Started
Home
Topics
Search
Library
Topic · 28 recaps

Reasoning

Methods that improve how language models think through problems — chain-of-thought, search, verification, and the reasoning-trained model families that have emerged since o1-style training.
Sort
Newest
Sliding-window beats linear attention
Inference Optimization · Aug 28
Fast Weight Attention for Continual Learning
LLM Training · Aug 27
Graph Engineering in the Era of LLM Agents: From Individual Intelligence to System Intelligence
Agents · Aug 21
Learn What's Left, Not What's Mastered: Saturation Aware Advantage Reweighting for Multi-Reward Policy Optimization
Reasoning · Aug 17
BDH-CQ: In-Context Learning with Recurrent Latent Reasoning
Inference Optimization · Aug 10
On-Policy Self-Distillation without Any Supervision
LLM Training · Aug 9
ABSeeker: Training Long-Horizon Search Agents via Answer-Backtracked Credit Assignment
Agents · Aug 5
Deferred Exposure of Future Trajectories for Verifiable Reasoning in Autonomous Driving VLMs
Agents · Aug 3
DAPD: Dual-Anchored Policy Distillation
LLM Training · Aug 3
PhiZero: A World Model Built Around Physical Language
Diffusion · Jul 30