arXivarxivEmergent Collusion in Long-Horizon LLM Agent Interactionarxivcs.AIcs.CL5 days ago▲ 43Read story→
arXivarxivJev for Scientific Decisions: Evaluating Semantic Choices and Their Consequencesarxivcs.CLcs.AI5 days ago▲ 43Read story→
arXivarxivGenerative Tutorial: Towards Live Contextualized Visual Instructions for Physical Tasksarxivcs.HCcs.AI5 days ago▲ 43Read story→
arXivarxivJAREX: An Acquisition Function for Multi-Objective Algorithmic Process Characterizationarxivstat.MLcs.LG5 days ago▲ 43Read story→
arXivarxivLearning Physics from an Imperfect Ancestorarxivcs.LGpublisher:arxiv5 days ago▲ 43Read story→
arXivarxivExactness at Inference: A Representational Criterion for Out-of-Distribution Generalizationarxivcs.LGcs.AI5 days ago▲ 43Read story→
arXivarxivLinguistic Features for Interpretable Textual Entailmentarxivcs.CLcs.SC5 days ago▲ 43Read story→
arXivarxivConformalized Quantile Regression and Minimax Limits of Fixed-Score Calibration under Known Covariate Shiftarxivmath.STcs.LG5 days ago▲ 43Read story→
arXivarxivEt Tu, Brute? Economic Misalignment in Personal AI Agentsarxivcs.AIpublisher:arxiv5 days ago▲ 43Read story→
arXivarxivBackTrend: Evaluating Scientific Weak-Signal Prediction via Backward Reconstructionarxivcs.AIpublisher:arxiv5 days ago▲ 43Read story→
arXivarxivIdentifying Representational Biases in Datasets Using PCA: A Max-Disparity Partition Frameworkarxivstat.MLcs.LG5 days ago▲ 43Read story→
arXivarxivThe Endless Exam: Mathematical Constructions from Today's Models toward Superintelligencearxivcs.AImath.HO5 days ago▲ 43Read story→
arXivarxivQLoRA Fine-Tuning of Ministral LLM for Sequence-to-Function Protein Annotationarxivcs.CLcs.AI5 days ago▲ 43Read story→
arXivarxivBeyond Point Prediction: Artificial Representative Trees with Uncertaintyarxivstat.MLcs.LG5 days ago▲ 43Read story→
arXivarxivNot All Task Vectors Need Equal Rank: Energy-Proportional Allocation for Model Mergingarxivcs.AIcs.CV5 days ago▲ 43Read story→
arXivarxivLLJ Cards: Best practices for the Use of LLMs as Judgesarxivcs.CLpublisher:arxiv5 days ago▲ 43Read story→
arXivarxivBeyond Predictable Paths: Redefining AI Security Incident Reporting for Agentsarxivcs.CRcs.AI5 days ago▲ 43Read story→
arXivarxivLifted Bellman Linear Programming for Offline Reinforcement Learningarxivcs.LGcs.AI5 days ago▲ 43Read story→