·
DataBubble
  • Home
  • Models
  • News
  • Compare
  • Boards
  • Pricing
  • About
  • Newsletter
  • Methodology
  • Contact
Latest
Sequential Capacity of Quantum Processes with Finite Memory10h◆Q-MINO: A Minimal-Norm Method for Quantization-Aware Training10h◆Exploiting Exogenous Structure for Sample-Efficient Reinforcement Learning10h◆Model Merging via Data-Free Covariance Estimation10h◆Geometry-Dependent Bounds for Online Non-Monotone DR-Submodular Maximization10h◆Scaling Collider Event Generation with Residual-Quantized Tokens10h◆TANGO: Treating Tokens as Operators10h◆Oblivious Learning and Collusive Pricing10h◆Verification Pulses and the Cost of Escaping Wrong Consensus10h◆Attention Manifolds: Steering or Blocking Language Models by Editing Learned B-Spline Surfaces10h◆Stable and Counterfactually Robust Physical World Models from Imposed Structure and Learned Physics10h◆Benchmarking System One decision models against trained classifiers and language models for automated decision gates10h◆MoRA: MoE Pruning via Router Bias Learning and Expert Approximation10h◆M$^2$Weather: A Benchmark for Joint Multi-Station and Multi-Variable Weather Forecasting10h◆Metacognitive Reasoning in Energy Based Models using Instance Based Learning Theory10h◆EchoPress: Query-Agnostic KV Cache Pruning via Virtual Context Reconstruction10h◆Source Identification Is Not Fitness Testing: Measuring the Limits of Synthetic-Data Attribution10h◆CommunityKV: Efficient Long-Context Decoding via Graph Partitioning10h◆IrekoGPT: Turning Structured Pruning into Post-Hoc Slimmable LLMs10h◆Every Batch Is Its Own Validation Set: Leave-One-Out Gradient Matching for Online Data Selection in LLM Fine-Tuning10h◆Sequential Capacity of Quantum Processes with Finite Memory10h◆Q-MINO: A Minimal-Norm Method for Quantization-Aware Training10h◆Exploiting Exogenous Structure for Sample-Efficient Reinforcement Learning10h◆Model Merging via Data-Free Covariance Estimation10h◆Geometry-Dependent Bounds for Online Non-Monotone DR-Submodular Maximization10h◆Scaling Collider Event Generation with Residual-Quantized Tokens10h◆TANGO: Treating Tokens as Operators10h◆Oblivious Learning and Collusive Pricing10h◆Verification Pulses and the Cost of Escaping Wrong Consensus10h◆Attention Manifolds: Steering or Blocking Language Models by Editing Learned B-Spline Surfaces10h◆Stable and Counterfactually Robust Physical World Models from Imposed Structure and Learned Physics10h◆Benchmarking System One decision models against trained classifiers and language models for automated decision gates10h◆MoRA: MoE Pruning via Router Bias Learning and Expert Approximation10h◆M$^2$Weather: A Benchmark for Joint Multi-Station and Multi-Variable Weather Forecasting10h◆Metacognitive Reasoning in Energy Based Models using Instance Based Learning Theory10h◆EchoPress: Query-Agnostic KV Cache Pruning via Virtual Context Reconstruction10h◆Source Identification Is Not Fitness Testing: Measuring the Limits of Synthetic-Data Attribution10h◆CommunityKV: Efficient Long-Context Decoding via Graph Partitioning10h◆IrekoGPT: Turning Structured Pruning into Post-Hoc Slimmable LLMs10h◆Every Batch Is Its Own Validation Set: Leave-One-Out Gradient Matching for Online Data Selection in LLM Fine-Tuning10h◆
News/Every Batch Is Its Own Validation Set: Leave-One-Out Gradient Matching for Online Data Selection in LLM Fine-Tuning
arxiv
PublishedOctober 3, 2026 at 4:00 AM
—neutral

Every Batch Is Its Own Validation Set: Leave-One-Out Gradient Matching for Online Data Selection in LLM Fine-Tuning

Source
arxiv.orgfull article ↗
Read on arxiv→
Publisher summary· verbatim

arXiv:2610.00436v1 Announce Type: new Abstract: Online batch selection fine-tunes a language model on the most useful part of each candidate batch. Selectors that match the gradient of the candidate batch are attractive because they need no held-out data, yet they rarely beat training on the whole b

Stay posted· Newsletter

A 5-min weekly brief — top movers, price watch, story of the week.

// no spam · unsubscribe one-click · free forever

Discussion
Source
↗
arxiv
Read original ↗All from arxiv →

No replies yet. Be first.

Source
↗
arxiv
Read original ↗All from arxiv →

Related coverage

More from ARXIV
arxivSequential Capacity of Quantum Processes with Finite Memory10harxivQ-MINO: A Minimal-Norm Method for Quantization-Aware Training10harxivExploiting Exogenous Structure for Sample-Efficient Reinforcement Learning10harxivModel Merging via Data-Free Covariance Estimation10h
The Bubble Brief
WEEKLY

Read AI insights every Tuesday — top movers, new releases, story of the week.

// no spam · unsubscribe one-click · free forever

Originally published on arxiv ↗
Built by Marouane Gazouzi
HomeModelsNews