·
DataBubble
  • Home
  • Models
  • News
  • Compare
  • Boards
  • Pricing
  • About
  • Newsletter
  • Methodology
  • Contact
Latest
Bringing Value Models Back: Generative Critics for Value Modeling in LLM Reinforcement Learning5m◆Subagents vs Agent Skills: Executing Reusable Knowledge for Long-Horizon Agentic Tasks5m◆Distribution-Consistent Inference for Dynamic Sparse Mixture-of-Experts5m◆In RAG We Trust? Measuring Robustness of Retrieval-Augmented Generation Under Document Poisoning5m◆FrontierChallenge: Evaluating Scientific Workflow Completion5m◆IBIB: A Protocol for Measuring Enterprise AI Systems by Serving Route, Not Model Identifier5m◆AgenticGen: Reward-Guided Agentic Video Generation for Advertising5m◆Strangers to Themselves: What Language Models Say About Themselves Is Generic5m◆Omni Interaction Agent Technical Report5m◆CoGReV: A Confidence-Gated Post-Hoc Non-Monotonic Belief Revision Framework for Phishing Website Classification5m◆Bit-Flip Attacks on Vision-Language-Action Models: Action-Decoding Architecture Shapes the Vulnerability5m◆Can Foundation Models Moderate Online Content? Evaluating Instruction- vs. Example-Driven Policy Operationalization5m◆RiLM: Parameter-Efficient Language Modeling via Geodesic Decoding5m◆Tracing Computation Density in LLMs5m◆Cultural Binding Heads in Language Models5m◆Direct Diversity Optimization for Diverse Successful Trajectories in Preference Post-Training5m◆Left-Branching Transformers Excel at Right-Branching Languages: Data Shapes Word Order Preferences in Language Models5m◆Palmyra x6 Technical Report: An Agentic, Tool-Use Model Post-Trained via Anchored Supervised Fine-Tuning5m◆'Ghaib in Translation' aka Unseen Harm: Measuring Cross-Script Safety Inconsistency with 'Missed-in-Urdu' Scores in LLM Hate Speech Detection5m◆DexterSQL: Deep Schema Exploration and Rule-based Correction for Text-to-SQL Generation5m◆Bringing Value Models Back: Generative Critics for Value Modeling in LLM Reinforcement Learning5m◆Subagents vs Agent Skills: Executing Reusable Knowledge for Long-Horizon Agentic Tasks5m◆Distribution-Consistent Inference for Dynamic Sparse Mixture-of-Experts5m◆In RAG We Trust? Measuring Robustness of Retrieval-Augmented Generation Under Document Poisoning5m◆FrontierChallenge: Evaluating Scientific Workflow Completion5m◆IBIB: A Protocol for Measuring Enterprise AI Systems by Serving Route, Not Model Identifier5m◆AgenticGen: Reward-Guided Agentic Video Generation for Advertising5m◆Strangers to Themselves: What Language Models Say About Themselves Is Generic5m◆Omni Interaction Agent Technical Report5m◆CoGReV: A Confidence-Gated Post-Hoc Non-Monotonic Belief Revision Framework for Phishing Website Classification5m◆Bit-Flip Attacks on Vision-Language-Action Models: Action-Decoding Architecture Shapes the Vulnerability5m◆Can Foundation Models Moderate Online Content? Evaluating Instruction- vs. Example-Driven Policy Operationalization5m◆RiLM: Parameter-Efficient Language Modeling via Geodesic Decoding5m◆Tracing Computation Density in LLMs5m◆Cultural Binding Heads in Language Models5m◆Direct Diversity Optimization for Diverse Successful Trajectories in Preference Post-Training5m◆Left-Branching Transformers Excel at Right-Branching Languages: Data Shapes Word Order Preferences in Language Models5m◆Palmyra x6 Technical Report: An Agentic, Tool-Use Model Post-Trained via Anchored Supervised Fine-Tuning5m◆'Ghaib in Translation' aka Unseen Harm: Measuring Cross-Script Safety Inconsistency with 'Missed-in-Urdu' Scores in LLM Hate Speech Detection5m◆DexterSQL: Deep Schema Exploration and Rule-based Correction for Text-to-SQL Generation5m◆
News/Reinforcement Learning-Guided Retrieval with Soft Fusion for Robust Multimodal Imitation Learning under Missing Modalities
arxiv
PublishedJune 16, 2026 at 4:00 AM
▲bullish

Reinforcement Learning-Guided Retrieval with Soft Fusion for Robust Multimodal Imitation Learning under Missing Modalities

Source
arxiv.orgfull article ↗
Read on arxiv→
Publisher summary· verbatim

arXiv:2606.15514v1 Announce Type: cross Abstract: Robotic systems perceive the world through multiple input modalities -- including visual camera streams and natural language instructions -- and must select appropriate actions based on these signals. However, assuming the permanent availability of a

Stay posted· Newsletter

A 5-min weekly brief — top movers, price watch, story of the week.

// no spam · unsubscribe one-click · free forever

Discussion
Mentioned models
01
  • 01
    RL4IL
Source
↗
arxiv
Read original ↗All from arxiv →
Tags
04
#robotics#imitation-learning#reinforcement-learning#sensor-failure

No replies yet. Be first.

Mentioned models
01
  • 01
    RL4IL
Source
↗
arxiv
Read original ↗All from arxiv →
Tags
04
#robotics#imitation-learning#reinforcement-learning#sensor-failure

Related coverage

More from ARXIV
arxivBringing Value Models Back: Generative Critics for Value Modeling in LLM Reinforcement Learning5marxivSubagents vs Agent Skills: Executing Reusable Knowledge for Long-Horizon Agentic Tasks5marxivDistribution-Consistent Inference for Dynamic Sparse Mixture-of-Experts5marxivIn RAG We Trust? Measuring Robustness of Retrieval-Augmented Generation Under Document Poisoning5m
The Bubble Brief
WEEKLY

Read robotics insights every Tuesday — top movers, new releases, story of the week.

// no spam · unsubscribe one-click · free forever

Originally published on arxiv ↗
HomeModelsNews