-
Continuous Latent Diffusion Language Model
Paper • 2605.06548 • Published • 88 -
Scaling Latent Reasoning via Looped Language Models
Paper • 2510.25741 • Published • 234 -
Scaling up Test-Time Compute with Latent Reasoning: A Recurrent Depth Approach
Paper • 2502.05171 • Published • 161 -
Pretraining Language Models to Ponder in Continuous Space
Paper • 2505.20674 • Published • 3
Collections
Discover the best community collections!
Collections including paper arxiv:2608.27448
-
Agentic Game Development as a Verifiable Trajectory Data Engine for Scaling World Models
Paper • 2608.25518 • Published • 188 -
TTPO: Test-Time Policy Optimization
Paper • 2608.27448 • Published • 77 -
Continuous Latent Diffusion Language Model
Paper • 2605.06548 • Published • 88 -
GameWAM: A World Action Model for Video Games
Paper • 2608.26200 • Published • 45
-
Demystifying Reinforcement Learning in Agentic Reasoning
Paper • 2510.11701 • Published • 34 -
LoongRL:Reinforcement Learning for Advanced Reasoning over Long Contexts
Paper • 2510.19363 • Published • 63 -
Supervised Reinforcement Learning: From Expert Trajectories to Step-wise Reasoning
Paper • 2510.25992 • Published • 48 -
Teaching Pretrained Language Models to Think Deeper with Retrofitted Recurrence
Paper • 2511.07384 • Published • 21
-
The Curse of Depth in Large Language Models
Paper • 2502.05795 • Published • 40 -
Transformers without Normalization
Paper • 2503.10622 • Published • 171 -
Parallel Scaling Law for Language Models
Paper • 2505.10475 • Published • 83 -
Learning to Skip the Middle Layers of Transformers
Paper • 2506.21103 • Published • 18
-
AutoResearchClaw: Self-Reinforcing Autonomous Research with Human-AI Collaboration
Paper • 2605.20025 • Published • 192 -
OpenComputer: Verifiable Software Worlds for Computer-Use Agents
Paper • 2605.19769 • Published • 89 -
WildClawBench: A Benchmark for Real-World, Long-Horizon Agent Evaluation
Paper • 2605.10912 • Published • 47 -
EvolveMem:Self-Evolving Memory Architecture via AutoResearch for LLM Agents
Paper • 2605.13941 • Published • 25
-
Skip a Layer or Loop it? Test-Time Depth Adaptation of Pretrained LLMs
Paper • 2507.07996 • Published • 36 -
Test-Time Scaling with Reflective Generative Model
Paper • 2507.01951 • Published • 108 -
Does More Inference-Time Compute Really Help Robustness?
Paper • 2507.15974 • Published • 7 -
TTCS: Test-Time Curriculum Synthesis for Self-Evolving
Paper • 2601.22628 • Published • 35
-
Continuous Latent Diffusion Language Model
Paper • 2605.06548 • Published • 88 -
Scaling Latent Reasoning via Looped Language Models
Paper • 2510.25741 • Published • 234 -
Scaling up Test-Time Compute with Latent Reasoning: A Recurrent Depth Approach
Paper • 2502.05171 • Published • 161 -
Pretraining Language Models to Ponder in Continuous Space
Paper • 2505.20674 • Published • 3
-
Agentic Game Development as a Verifiable Trajectory Data Engine for Scaling World Models
Paper • 2608.25518 • Published • 188 -
TTPO: Test-Time Policy Optimization
Paper • 2608.27448 • Published • 77 -
Continuous Latent Diffusion Language Model
Paper • 2605.06548 • Published • 88 -
GameWAM: A World Action Model for Video Games
Paper • 2608.26200 • Published • 45
-
AutoResearchClaw: Self-Reinforcing Autonomous Research with Human-AI Collaboration
Paper • 2605.20025 • Published • 192 -
OpenComputer: Verifiable Software Worlds for Computer-Use Agents
Paper • 2605.19769 • Published • 89 -
WildClawBench: A Benchmark for Real-World, Long-Horizon Agent Evaluation
Paper • 2605.10912 • Published • 47 -
EvolveMem:Self-Evolving Memory Architecture via AutoResearch for LLM Agents
Paper • 2605.13941 • Published • 25
-
Demystifying Reinforcement Learning in Agentic Reasoning
Paper • 2510.11701 • Published • 34 -
LoongRL:Reinforcement Learning for Advanced Reasoning over Long Contexts
Paper • 2510.19363 • Published • 63 -
Supervised Reinforcement Learning: From Expert Trajectories to Step-wise Reasoning
Paper • 2510.25992 • Published • 48 -
Teaching Pretrained Language Models to Think Deeper with Retrofitted Recurrence
Paper • 2511.07384 • Published • 21
-
Skip a Layer or Loop it? Test-Time Depth Adaptation of Pretrained LLMs
Paper • 2507.07996 • Published • 36 -
Test-Time Scaling with Reflective Generative Model
Paper • 2507.01951 • Published • 108 -
Does More Inference-Time Compute Really Help Robustness?
Paper • 2507.15974 • Published • 7 -
TTCS: Test-Time Curriculum Synthesis for Self-Evolving
Paper • 2601.22628 • Published • 35
-
The Curse of Depth in Large Language Models
Paper • 2502.05795 • Published • 40 -
Transformers without Normalization
Paper • 2503.10622 • Published • 171 -
Parallel Scaling Law for Language Models
Paper • 2505.10475 • Published • 83 -
Learning to Skip the Middle Layers of Transformers
Paper • 2506.21103 • Published • 18