arXivarxivThe Surprising Effectiveness of Approximate Value Iteration in Self-Playarxivcs.AIpublisher:arxiv5 days ago▲ 43Read story→
arXivarxivMeasuring LLM Sycophancy under Sustained Multi-Turn Pressurearxivcs.CLcs.AI5 days ago▲ 43Read story→
arXivarxivIt's Not RoPE that Creates Sinks: The Role of Self-Concentration and Value-Non-Mixing in Attentionarxivcs.CLpublisher:arxiv5 days ago▲ 43Read story→
arXivarxivGoDeep: Annotation-Free Open-Vocabulary 3D Scene Understanding via Language-Space Liftingarxivcs.CVcs.AI5 days ago▲ 43Read story→
arXivarxivEverything in Moderation: Per-Domain Coverage Optima and Alignment-Resistant Domain Gaps in Multi-Domain Mid-Trainingarxivcs.AIpublisher:arxiv5 days ago▲ 43Read story→
arXivarxivActReview: Rebuttal-Guided Training Data and Rubric Rewards for Actionable Peer Review Generationarxivcs.CLpublisher:arxiv5 days ago▲ 43Read story→
arXivarxivThinkPrior: Zero-Rollout Difficulty Priors for Cold-Start Prompt Selection in RLVRarxivcs.LGcs.AI5 days ago▲ 43Read story→
arXivarxivToolLoop: Closed-Loop Tool-Use Data Synthesis via Decomposed Generation and Dynamic Self-Feedbackarxivcs.CLpublisher:arxiv5 days ago▲ 43Read story→
arXivarxivPerformance of Clinical AI System and Physicians and Frontier Language Models in primary care diagnosticsarxivcs.CLcs.AI5 days ago▲ 43Read story→
arXivarxivMulti-Task Learning for Sparsely-Labeled Time Series: A Case Study on Cold-Hardiness Modelingarxivcs.LGpublisher:arxiv5 days ago▲ 43Read story→
arXivarxivPlayTrain: An Efficient Reinforcement Learning Framework for LLM-Generated Adaptable JavaScript Gamesarxivcs.LGpublisher:arxiv5 days ago▲ 43Read story→
arXivarxivTime-Varying Data as Sheaves: an Invitation to Narrativesarxivcs.AIcs.MA5 days ago▲ 43Read story→
arXivarxivTraining-Free Task Vectors for LLM Behavioral Controlarxivcs.LGcs.AI5 days ago▲ 43Read story→
arXivarxivThe Audit Decides the Verdict: Instrument Effects Rival Demographic Bias in LLM Decision Auditsarxivcs.CLcs.AI5 days ago▲ 43Read story→
arXivarxivDo Reasoning Representations Help Humans Evaluate LLM Outputs?arxivcs.LGcs.HC5 days ago▲ 43Read story→
arXivarxivAnswer-Distribution Trajectories: A Stochastic-Dynamics View of LLM Reasoningarxivcs.AIcs.CL5 days ago▲ 43Read story→
arXivarxivClosed-Form of the Local Galactic Potential and Stellar Distribution Function from Gaia DR3arxivastro-ph.GAastro-ph.IM5 days ago▲ 43Read story→
arXivarxivLet It Go or Learn to Self-Correct: Continuous Diffusion for Constrained Discrete Tasksarxivcs.LGcs.AI5 days ago▲ 43Read story→
arXivarxivProcArena: A Multi-Scenario Benchmark for LLMs on Direct and Interactive PL/SQL Development from Natural Languagearxivcs.CLcs.AI7 days ago▲ 43Read story→