TMtechmemeArtificial Intelligence Underwriting Company, which offers audits and safety certifications for AI agents, raised a $40M Series A, bringing total raised to $55M (Julie Bort/TechCrunch)industry1 day ago▲ 24Read story→
arXivarxivPrompt Revision as a Source of Cultural Bias in Text-to-Image Systemsarxivcs.AIpublisher:arxiv6 days ago▲ 43Read story→
redditI tried to make a real fly connectome learn to play Pong. It didn't — and auditing why turned out to be way more interesting than if it had worked [p]redditmachine-learningMachineLearning7 days ago▲ 10Read story→
arXivarxivIBIB: A Protocol for Measuring Enterprise AI Systems by Serving Route, Not Model Identifierarxivcs.CLcs.AI7 days ago▲ 43Read story→
arXivarxivGANDR: Claim Auditing for Verifiable Legal Answer Generationarxivcs.CLcs.AI7 days ago▲ 43Read story→
arXivarxivSAEScientist-Bench: Can AI Agents Conduct Autonomous SAE Interpretability Research?arxivcs.AIcs.CL8 days ago▲ 43Read story→
arXivarxivThe Audit Decides the Verdict: Instrument Effects Rival Demographic Bias in LLM Decision Auditsarxivcs.CLcs.AI8 days ago▲ 43Read story→
redditHow Public Digital Footprints Get Left Behind (And How to Audit Your Own) [D]redditmachine-learningMachineLearning10 days ago▲ 10Read story→
arXivarxivMolecular Déjà Vu: Digit-Level Retrieval of Published Values in Frontier Language Modelsarxivcs.AIpublisher:arxiv12 days ago▲ 43Read story→
arXivarxivClean Engineering, Unstable Measurement: A Preregistered Reliability Failure of Black-Box LLM Observers on Shared Endpointsarxivcs.AIcs.LG13 days ago▲ 43Read story→
arXivarxivTowards Trustworthy Autonomous Robots: An Explainable AI-Based Decision Frameworkarxivcs.ROcs.AI14 days ago▲ 43Read story→
arXivarxivClinTraceBench: Source-Verifiable Longitudinal Clinical Reasoning over EHR-Derived Dialoguesarxivcs.CLpublisher:arxiv15 days ago▲ 43Read story→
arXivarxivAuditing Anonymous AI Models: A Four-Stage Protocol for Black-Box Identity Verificationarxivcs.SEcs.AI16 days ago▲ 43Read story→
arXivarxivDIASENTINEL: An Auditable Multi-Agent System for Guideline-Grounded Diabetes Risk Screeningarxivcs.CLpublisher:arxiv16 days ago▲ 43Read story→
arXivarxivBLOOM-WILT: Logit Tilting for Behaviour Elicitation in Automated LLM Auditingarxivcs.AIcs.CL16 days ago▲ 43Read story→
arXivarxivHindsight Memory-PRM: Supervising Memory Management with Auditable Hindsight Creditarxivcs.CLpublisher:arxiv18 days ago▲ 43Read story→
redditWhat should an AI agent remember in a form a human can actually audit?redditartificial-intelligenceartificial18 days ago▲ 10Read story→
arXivarxivBlind Men and the Elephant: Probing the Epistemic Myopia of LLMs under Long-Tail Divergent Knowledgearxivcs.CLpublisher:arxiv19 days ago▲ 43Read story→