How Can Rhetoric Reward-Hack AI Reviewers? Dissecting Rhetorical Sensitivity in AI-Based Peer Review Paper • 2608.08975 • Published 18 days ago • 48
Reinforcement Learning with Evolving Rubrics as Rewards for Audio Reasoning Paper • 2608.02831 • Published 25 days ago • 14
How Can Rhetoric Reward-Hack AI Reviewers? Dissecting Rhetorical Sensitivity in AI-Based Peer Review Paper • 2608.08975 • Published 18 days ago • 48
TSRouter: Dynamic Modality-Model Selection for Time Series Reasoning Paper • 2607.08940 • Published Jul 9 • 2
TS-Reasoner: Aligning Time Series Foundation Models with LLM Reasoning Paper • 2510.03519 • Published Oct 3, 2025 • 1
Cognitive Episodes in LLM Reasoning Traces Enable Interpretable Human Item Difficulty Prediction Paper • 2606.28186 • Published Jun 26 • 9
WestWorld: A Knowledge-Encoded Scalable Trajectory World Model for Diverse Robotic Systems Paper • 2603.14392 • Published May 19
TSRouter: Dynamic Modality-Model Selection for Time Series Reasoning Paper • 2607.08940 • Published Jul 9 • 2
Cognitive Episodes in LLM Reasoning Traces Enable Interpretable Human Item Difficulty Prediction Paper • 2606.28186 • Published Jun 26 • 9
Multi-Turn Reflective Masking Elicits Reasoning in Mask Diffusion Models Paper • 2606.16700 • Published Jun 15 • 15 • 4
Multi-Turn Reflective Masking Elicits Reasoning in Mask Diffusion Models Paper • 2606.16700 • Published Jun 15 • 15
Multi-Turn Reflective Masking Elicits Reasoning in Mask Diffusion Models Paper • 2606.16700 • Published Jun 15 • 15
Multi-Turn Reflective Masking Elicits Reasoning in Mask Diffusion Models Paper • 2606.16700 • Published Jun 15 • 15
Guava: An Effective and Universal Harness for Embodied Manipulation Paper • 2606.18363 • Published Jun 16 • 28
Guava: An Effective and Universal Harness for Embodied Manipulation Paper • 2606.18363 • Published Jun 16 • 28