arXivarxivWikiSkill: Compiling Agent Experience into Persistent Knowledge for Skill Evolutionarxivcs.AIcs.CL27 days ago▲ 43Read story→
arXivarxivFrom Static to Dynamic: Benchmarking Real-World Code Review with MCR-Bencharxivcs.SEcs.AI27 days ago▲ 43Read story→
arXivarxivRedEvoAgent: Automatic Red-Teaming Agent with Experience-Driven Skill Evolutionarxivcs.CRcs.AI27 days ago▲ 43Read story→
arXivarxivMechanistic Reaction Prediction via Discrete Flow Matching on Graph-Structured Electron Occupationarxivcs.AIpublisher:arxiv27 days ago▲ 43Read story→
arXivarxivStochastic Estimation of Transduced Language Modelsarxivcs.CLpublisher:arxiv27 days ago▲ 43Read story→
arXivarxivPersona-Execution Separation: An Architecture Pattern for Evolving LLM Agents under Execution Auditarxivcs.SEcs.AI27 days ago▲ 43Read story→
arXivarxivBeyond F1: Evaluating Coverage and Failure Recovery in AI Model Security Scannersarxivcs.CRcs.AI27 days ago▲ 43Read story→
arXivarxivLearning a Continuous Sepsis Severity Score Without Hour-by-Hour Supervision: A Two-Site Retrospective Studyarxivcs.AIcs.LG27 days ago▲ 43Read story→
arXivarxivBoosting LLM Exploration via Weak-Model Guidance in RLVRarxivcs.CLpublisher:arxiv27 days ago▲ 43Read story→
arXivarxivScaling Graph Neural Networks for Friend Recommendation: Multi-Hash User Embeddings and Temporal Neighbor Samplingarxivcs.IRcs.LG27 days ago▲ 43Read story→
arXivarxivConsolidating RLVR Capabilities Across Domains: A Deep Dive into Fusion Paradigmsarxivcs.CLpublisher:arxiv27 days ago▲ 43Read story→
arXivarxivCLAP: Cross-Embodiment Video World Models are Zero-Shot Physical Simulatorsarxivcs.ROcs.AI27 days ago▲ 43Read story→
arXivarxivHow Language Models Organize and Structure Moral Knowledgearxivcs.CLcs.AI27 days ago▲ 43Read story→
arXivarxivMaking Clinical Language Models Auditable: Concept-Guided Fine-Tuning for Robust Predictionarxivcs.CLcs.AI27 days ago▲ 43Read story→
arXivarxivLeVJEPA: Efficient & Scalable Video Pretraining without the Heuristicsarxivcs.CVcs.AI27 days ago▲ 43Read story→
arXivarxivRATIO: A Benchmark for Retrieval Across Typed Ideation Operations in Scientific Literaturearxivcs.CLcs.IR27 days ago▲ 43Read story→
arXivarxivProperty-Specific Recoverability from Contact PPG to Camera rPPG under Heterogeneous Observation Conditionsarxiveess.SPcs.AI27 days ago▲ 43Read story→
arXivarxivPACE: A Unified Condense-and-Extract Paradigm for Fast VLM Inferencearxivcs.CVcs.AI27 days ago▲ 43Read story→