AURORA-LM: Autoencoding Unified Representation for Continuous-Latent Diffusion Language Modeling Paper • 2608.02602 • Published 9 days ago • 79
From RLVR to RLSVR: Task Transformation Induces Self-Verifiable Rewards for Open-Ended LLM Self-Improvement Paper • 2607.23802 • Published 17 days ago • 105
CoRT: Counterfactual Replay for Token-Level Rubric-Guided Policy Optimization Paper • 2607.25659 • Published 15 days ago • 83
CAST: Game Solvers as Turn-Level Teachers for LLM Agents Paper • 2607.25308 • Published 15 days ago • 41
CoRT: Counterfactual Replay for Token-Level Rubric-Guided Policy Optimization Paper • 2607.25659 • Published 15 days ago • 83
Full Attention Strikes Back: Transferring Full Attention into Sparse within Hundred Training Steps Paper • 2605.16928 • Published May 16 • 99
Build error Agents 2 ChinaTravel 🐢 2 Evaluate and compare AI model performance on ChinaTravel benchmark tasks
A Theoretical Study on Bridging Internal Probability and Self-Consistency for LLM Reasoning Paper • 2510.15444 • Published Oct 17, 2025 • 151
Build error Agents 2 ChinaTravel 🐢 2 Evaluate and compare AI model performance on ChinaTravel benchmark tasks
ChinaTravel: A Real-World Benchmark for Language Agents in Chinese Travel Planning Paper • 2412.13682 • Published Dec 18, 2024 • 7
ChinaTravel: A Real-World Benchmark for Language Agents in Chinese Travel Planning Paper • 2412.13682 • Published Dec 18, 2024 • 7