·
DataBubble
  • Home
  • Models
  • News
  • Compare
  • Boards
  • Pricing
  • About
  • Newsletter
  • Methodology
  • Contact
Latest
Bringing Value Models Back: Generative Critics for Value Modeling in LLM Reinforcement Learning10h◆Subagents vs Agent Skills: Executing Reusable Knowledge for Long-Horizon Agentic Tasks10h◆Distribution-Consistent Inference for Dynamic Sparse Mixture-of-Experts10h◆In RAG We Trust? Measuring Robustness of Retrieval-Augmented Generation Under Document Poisoning10h◆FrontierChallenge: Evaluating Scientific Workflow Completion10h◆IBIB: A Protocol for Measuring Enterprise AI Systems by Serving Route, Not Model Identifier10h◆AgenticGen: Reward-Guided Agentic Video Generation for Advertising10h◆Strangers to Themselves: What Language Models Say About Themselves Is Generic10h◆Omni Interaction Agent Technical Report10h◆CoGReV: A Confidence-Gated Post-Hoc Non-Monotonic Belief Revision Framework for Phishing Website Classification10h◆Bit-Flip Attacks on Vision-Language-Action Models: Action-Decoding Architecture Shapes the Vulnerability10h◆Can Foundation Models Moderate Online Content? Evaluating Instruction- vs. Example-Driven Policy Operationalization10h◆RiLM: Parameter-Efficient Language Modeling via Geodesic Decoding10h◆Tracing Computation Density in LLMs10h◆Cultural Binding Heads in Language Models10h◆Direct Diversity Optimization for Diverse Successful Trajectories in Preference Post-Training10h◆Left-Branching Transformers Excel at Right-Branching Languages: Data Shapes Word Order Preferences in Language Models10h◆Palmyra x6 Technical Report: An Agentic, Tool-Use Model Post-Trained via Anchored Supervised Fine-Tuning10h◆'Ghaib in Translation' aka Unseen Harm: Measuring Cross-Script Safety Inconsistency with 'Missed-in-Urdu' Scores in LLM Hate Speech Detection10h◆DexterSQL: Deep Schema Exploration and Rule-based Correction for Text-to-SQL Generation10h◆Bringing Value Models Back: Generative Critics for Value Modeling in LLM Reinforcement Learning10h◆Subagents vs Agent Skills: Executing Reusable Knowledge for Long-Horizon Agentic Tasks10h◆Distribution-Consistent Inference for Dynamic Sparse Mixture-of-Experts10h◆In RAG We Trust? Measuring Robustness of Retrieval-Augmented Generation Under Document Poisoning10h◆FrontierChallenge: Evaluating Scientific Workflow Completion10h◆IBIB: A Protocol for Measuring Enterprise AI Systems by Serving Route, Not Model Identifier10h◆AgenticGen: Reward-Guided Agentic Video Generation for Advertising10h◆Strangers to Themselves: What Language Models Say About Themselves Is Generic10h◆Omni Interaction Agent Technical Report10h◆CoGReV: A Confidence-Gated Post-Hoc Non-Monotonic Belief Revision Framework for Phishing Website Classification10h◆Bit-Flip Attacks on Vision-Language-Action Models: Action-Decoding Architecture Shapes the Vulnerability10h◆Can Foundation Models Moderate Online Content? Evaluating Instruction- vs. Example-Driven Policy Operationalization10h◆RiLM: Parameter-Efficient Language Modeling via Geodesic Decoding10h◆Tracing Computation Density in LLMs10h◆Cultural Binding Heads in Language Models10h◆Direct Diversity Optimization for Diverse Successful Trajectories in Preference Post-Training10h◆Left-Branching Transformers Excel at Right-Branching Languages: Data Shapes Word Order Preferences in Language Models10h◆Palmyra x6 Technical Report: An Agentic, Tool-Use Model Post-Trained via Anchored Supervised Fine-Tuning10h◆'Ghaib in Translation' aka Unseen Harm: Measuring Cross-Script Safety Inconsistency with 'Missed-in-Urdu' Scores in LLM Hate Speech Detection10h◆DexterSQL: Deep Schema Exploration and Rule-based Correction for Text-to-SQL Generation10h◆
Tag

#retrieval-augmented-generation

3 articles tagged #retrieval-augmented-generation

arxivJun 12bullish

Energy-Efficient On-Device RAG on a Mobile NPU: System Design and Benchmark on Snapdragon X Elite

arXiv:2606.11257v1 Announce Type: cross Abstract: Retrieval-Augmented Generation (RAG) pipelines are compute-intensive, combining embedding, retrieval, reranking, and large language model (LLM) generation. Running them entirely on-device benefits privacy, latency, and offline use, but the energy cos

GP1 model#edge-intelligence#energy-efficiency#on-deviceRead on arxiv →
HomeModelsNews
arxivApr 16bullish

Benchmarking Foundation Models with Retrieval-Augmented Generation in Olympic-Level Physics Problem Solving

arXiv:2510.00919v3 Announce Type: replace-cross Abstract: Retrieval-augmented generation (RAG) with foundation models has achieved strong performance across diverse tasks, but their capacity for expert-level reasoning-such as solving Olympiad-level physics problems-remains largely unexplored. Inspir

#retrieval-augmented-generation#foundation-models#physics-reasoningRead on arxiv →
arxivApr 4

From BM25 to Corrective RAG: Benchmarking Retrieval Strategies for Text-and-Table Documents

arXiv:2604.01733v1 Announce Type: cross Abstract: Retrieval-Augmented Generation (RAG) systems critically depend on retrieval quality, yet no systematic comparison of modern retrieval methods exists for heterogeneous documents containing both text and tabular data. We benchmark ten retrieval strateg

BMHYHY3 models#information-retrieval#benchmark#financial-qaRead on arxiv →