HiPLEX: Hierarchical Policy Factorization for Full Duplex Speech Language Models Paper • 2610.07727 • Published 5 days ago • 15
Hiding Tool Latency in On-Device Cascaded Voice Agent through Speculative Execution Paper • 2610.07641 • Published 5 days ago • 14
RunningTab: Direct Workspace Interaction with Environment-Side Tabs Paper • 2610.10444 • Published 4 days ago • 34
Pivot-SD: Efficient Self-Distillation for Masked Diffusion Language Models Paper • 2610.03665 • Published 9 days ago • 62
Follow the Entities: A Corpus Map for Agentic Search Paper • 2609.37226 • Published 12 days ago • 100
SentZero: An Enhanced Sentence-Centric Vision-Language Pretraining for Multi-Task Zero-Shot Chest X-Ray Analysis Paper • 2609.34479 • Published 13 days ago • 30
Surprising Success, Repeated Failure: Entropy-Guided Credit Assignment for Exploration in LLM Reasoning Paper • 2609.33781 • Published 14 days ago • 46
Knowing When Thinking Is Not Enough: Teaching Small Reasoning Models to Reason Beyond Their Parametric Knowledge Paper • 2609.34327 • Published 13 days ago • 41
Learning Beyond What You Sample: Off-Policy-Aware Cross-Model Trajectory Exchange for RLVR Paper • 2609.37868 • Published 12 days ago • 65
PLC-DPO: Posterior Label Correction in Noisy and Ambiguous Preference Optimization Paper • 2608.30597 • Published Aug 31 • 27
SpatialBlock: Enhancing Spatial Intelligence in LVLMs via Synthetic Block-Stacking Problem Paper • 2609.07064 • Published Sep 7 • 124
PLC-DPO: Posterior Label Correction in Noisy and Ambiguous Preference Optimization Paper • 2608.30597 • Published Aug 31 • 27
Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning Paper • 2608.01556 • Published Aug 3
Eliciting Weak-to-Strong Generalization with On-Policy Reverse Distillation Paper • 2609.08798 • Published Sep 8 • 83
UniSAFE: A Comprehensive Benchmark for Safety Evaluation of Unified Multimodal Models Paper • 2603.17476 • Published Mar 18
When and Where to Attack? Stage-wise Attention-Guided Adversarial Attack on Large Vision Language Models Paper • 2602.04356 • Published Feb 4