arXivarxivContextPilot: Teaching Agents for Proactive Context Management via Fine-grained RLarxivcs.CLpublisher:arxiv26 days ago▲ 43Read story→
arXivarxivCOVER: Identifiable Evaluation of Coalition Routingarxivcs.AIpublisher:arxiv26 days ago▲ 43Read story→
arXivarxivReal-time virtual circuits for plasma shape control via neural network emulators: experimental demonstration on MAST Upgradearxivphysics.plasm-phcs.AI26 days ago▲ 43Read story→
arXivarxivStranger, Fan, or Peer? A Systematic Study on the Role of Interlocutor in Persona-Based Dialogue Generationarxivcs.CLpublisher:arxiv26 days ago▲ 43Read story→
arXivarxivAnatomy-Aware Promptable Segmentation with Online Interactive Training for AUTOPET Varxivcs.CVcs.AI26 days ago▲ 43Read story→
arXivarxivAcquire, Repair, Preserve: A Diagnosis-Guided Post-Training Recipe for Small-Model Dialogue Game Agentsarxivcs.CLcs.LG26 days ago▲ 43Read story→
arXivarxivARC-CT: Anatomy-Routed Contrastive Vision-Language Learning for 3D Chest CTarxivcs.CVcs.AI26 days ago▲ 43Read story→
arXivarxivLearning to Use Tools: Reinforcement Learning for Tool-Integrated Mathematical Reasoningarxivcs.AIpublisher:arxiv26 days ago▲ 43Read story→
arXivarxivCurvature-Conditioned Multiscale Momentum with Sphere Constraints for LLM Pretrainingarxivcs.LGpublisher:arxiv26 days ago▲ 43Read story→
arXivarxivFidelity Is Not Enough: Dispatch-Level Instrumentation for Agentic Datasheet Extractionarxivcs.CLcs.AI26 days ago▲ 43Read story→
arXivarxivProve2Me: An Open Collaborative Platform for Scaling Math Formalizationarxivcs.AIcs.LO26 days ago▲ 43Read story→
arXivarxivAre These Modules Worth Their Cost? A Paradigm-Level Accuracy-Cost Analysis of In-context Learning Text-to-SQLarxivcs.CLcs.AI26 days ago▲ 43Read story→
arXivarxivProgram Learning with Verifiable Rewards: Symbolic Backpropagation for Post-Training LLMsarxivcs.AIpublisher:arxiv26 days ago▲ 43Read story→
arXivarxivLongPIBench: A Long-Context Benchmark for Prompt Injectionarxivcs.CRcs.AI26 days ago▲ 43Read story→
arXivarxivSymboLLM-FE: LLM-Accelerated Symbolic Regression for Automated Feature Engineering on Tabular Dataarxivcs.LGpublisher:arxiv26 days ago▲ 43Read story→
arXivarxivA Unified Framework to Elicit Structured Feedback for Interpretable Multi-Trait Essay Scoringarxivcs.CLpublisher:arxiv26 days ago▲ 43Read story→
arXivarxivCritICL: Inference-Time Weak-to-Strong Generalization from Small Language Model Failure Modesarxivcs.CLpublisher:arxiv27 days ago▲ 43Read story→