Pith. sign in

Paper Citation Record · LEDGER

Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models

As of 17 August 2026, this Paper Citation Record lists 24 of 24 outbound references and 0 inbound Pith citation observations for arXiv:2506.00049.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2506.00049 v1

Coverage vector

measured 24 of 24 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-07T13:05:42.701392Z

measured 24 of 24 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-17T06:30:58.91139+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

24 of 24 outbound references displayed

  • verified exact2
  • verified fuzzy13
  • unresolved7
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch2

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 31a1e125-14d3-4314-b7b8-d0ce3b8f122f · outbound

This paper cites ChatGPT Alternative Solutions: Large Language Models Survey.

Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models ChatGPT Alternative Solutions: Large Language Models Survey

Reference 1

Resolution
verified exact
local_arxiv, observed 2026-08-07T13:05:43.476742Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-07T13:05:40.643078Z digest=sha256:5ccea03b1cba0129ae75a8d129e2322b1c4ce0d66214365f13e4e177ad1bb8c5

Observation 48c871dd-3118-416e-ba71-42379cd18677 · outbound

This paper cites Combining Static and Contextualised Multilingual Embeddings.

Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models Combining Static and Contextualised Multilingual Embeddings

Reference 2

Resolution
verified exact
local_arxiv, observed 2026-08-07T13:05:43.332228Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-07T13:05:40.759186Z digest=sha256:54972ffc528c0921c039efc6510ad28d223cae0afd98b670ea63d776fa7b65da

Observation 69b7eb3c-dbed-4cc7-8cb8-2a1958bfa02d · outbound

This paper cites Generative multi-modal knowledge retrieval with large language models,.

Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models Generative multi-modal knowledge retrieval with large language models,

Reference 3

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:05:45.579319Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-07T13:05:40.874448Z digest=sha256:dd27876043daa91b21661d7ac5dacc53048491b33f9fd787d6d3d6ece1700648

Observation 1e93cc45-a067-4251-824d-c2de0e46ffa2 · outbound

This paper cites Combining Knowledge Graphs and Large Language Models.

Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models Combining Knowledge Graphs and Large Language Models

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-07T13:05:41.050595Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:05:41.050595Z digest=sha256:437d9bb526878da5fac6a94f3677039adeb95e9dc97dc2ee9b7816c8f0588b9e

Observation 92cbe90f-510c-490c-a674-7ab8ba60dc44 · outbound

This paper cites Semantic-embedding guided graph network for cross-modal retrieval,.

Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models Semantic-embedding guided graph network for cross-modal retrieval,

Reference 5

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:05:45.445148Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-07T13:05:41.177934Z digest=sha256:8d75e7593d5c6554af6182c6e0c78ecd8530e9fc65855d91babbd1588db357e9

Observation 797a1782-feae-4760-8c76-eac93bc8096c · outbound

This paper cites ColBERT: Efficient and Effective Passage Search via Contextualized Late Interaction over BERT.

Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models ColBERT: Efficient and Effective Passage Search via Contextualized Late Interaction over BERT

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-07T13:05:41.309394Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:05:41.309394Z digest=sha256:e80e7a96ac6abcbe60560ded352d484efcfba7370029529668a2f26a37486c4c

Observation eea6ed0f-9e02-4c22-a61d-72acefeb5ef1 · outbound

This paper cites ColBERTv2: Effective and efficient retrieval via lightweight late interaction,.

Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models ColBERTv2: Effective and efficient retrieval via lightweight late interaction,

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:05:45.298622Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-07T13:05:41.393215Z digest=sha256:1e4e411986d01b99f1a7f132138f657a9d375abc3ec73a29dbbcd14cbfdaa6e4

Observation be6ae041-01f0-4bfd-a37a-b5d76022754a · outbound

This paper cites COIL: Revisit Exact Lexical Match in Information Retrieval with Contextualized Inverted List,.

Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models COIL: Revisit Exact Lexical Match in Information Retrieval with Contextualized Inverted List,

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:05:45.143268Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-07T13:05:41.468975Z digest=sha256:acd8347555b63b5fdf25690c79b5fb75fcc6a975866d279c34ddf674b8c374bb

Observation 8d613c87-3c9f-4028-988f-8b1aa4e86deb · outbound

This paper cites DAT: Dynamic Alpha Tuning for Hybrid Retrieval in Retrieval-Augmented Generation.

Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models DAT: Dynamic Alpha Tuning for Hybrid Retrieval in Retrieval-Augmented Generation

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-07T13:05:41.558233Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:05:41.558233Z digest=sha256:7564bcdc361ca6867f0691acb414c435f3c5cb603591fd3119620344e412ee66

Observation 041522bf-7e3d-4ceb-902f-b92a69374429 · outbound

This paper cites Sentence-BERT: Sentence embeddings using siamese BERT-networks,.

Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models Sentence-BERT: Sentence embeddings using siamese BERT-networks,

Reference 10

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:05:44.975123Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-07T13:05:41.627406Z digest=sha256:b59eea4f9b74fbbbb7a2b2d4f34daacaf23bf4594a44ba2afae0ee527dfd8e77

Observation 00fa5ffa-7c4c-4d59-8579-ad63777af205 · outbound

This paper cites Dense passage retrieval for open-domain question answering,.

Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models Dense passage retrieval for open-domain question answering,

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:05:44.817932Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-07T13:05:41.700647Z digest=sha256:980d600ad2bc5cd8e77004992b140702205c1ef8e0a62a88b24b88a939526ef4

Observation 75d83684-6b32-46ca-8b94-4493f755110e · outbound

This paper cites Adaptive Region Selection for Active Learning in Whole Slide Image Semantic Segmentation.

Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models Adaptive Region Selection for Active Learning in Whole Slide Image Semantic Segmentation

Reference 12

Resolution
metadata mismatch
local_arxiv, observed 2026-08-07T13:05:43.124640Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-07T13:05:41.788490Z digest=sha256:96e2585a4792c7bf52ae9b4cc5b0affbd4bf78d8f99f1f7cc53c9668d1c445e2

Observation 37b280df-10ba-4b49-84eb-61f776cc094a · outbound

This paper cites Scaling Laws for Neural Language Models.

Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models Scaling Laws for Neural Language Models

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-07T13:05:41.854282Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:05:41.854282Z digest=sha256:3f43ea1251b9c57354f6b0af967e4cf68c3b770806150e9daeb473da8e77ebe4

Observation 829130c8-465c-4f31-be5b-c83ed67923ab · outbound

This paper cites RetroMAE: Pre-training retrieval-oriented language models with masked auto-encoder.

Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models RetroMAE: Pre-training retrieval-oriented language models with masked auto-encoder

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:05:44.623052Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-07T13:05:41.916722Z digest=sha256:cab225967323ab14c529e7bb2ac6708d6868cd9d8db6db68c0c7a0d8388b8d29

Observation eb679451-4adf-4706-a9b6-c4393949b7af · outbound

This paper cites Precise Zero-Shot Dense Retrieval without Relevance Labels.

Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models Precise Zero-Shot Dense Retrieval without Relevance Labels

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-07T13:05:42.001955Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:05:42.001955Z digest=sha256:b670bac0ec2b89cf030e4b999e2e1d123335adbf7cbf089a7bff53291c7c1ab4

Observation 370b4999-05c5-46d0-b90e-bb6e3162f65a · outbound

This paper cites Varied phenomenology of models displaying dynamical large-deviation singularities.

Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models Varied phenomenology of models displaying dynamical large-deviation singularities

Reference 16

Resolution
metadata mismatch
local_arxiv, observed 2026-08-07T13:05:42.939787Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-07T13:05:42.068941Z digest=sha256:b52aa5f6c1457626659b5a3faf7bcbf292c50933050ffa37fcc06dbc3f922dee

Observation 678d33a2-c5a8-4af4-bcb6-181ac9822bf1 · outbound

This paper cites MiniLM: Deep self-attention distillation for task-agnostic compression of pre- trained transformers,.

Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models MiniLM: Deep self-attention distillation for task-agnostic compression of pre- trained transformers,

Reference 17

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:05:44.483135Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-07T13:05:42.163253Z digest=sha256:b0c32fa9db4e0074648d3a56ae0fb627f179f1b8091c7d72ad21c9828b8c78f5

Observation eb68fc14-87d2-44af-8b2b-463c0639f213 · outbound

This paper cites Retrieval-Augmented Generation for Knowledge-Intensive NLP Tasks.

Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models Retrieval-Augmented Generation for Knowledge-Intensive NLP Tasks

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-07T13:05:42.234451Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:05:42.234451Z digest=sha256:b2fd31edb8f96fea394418dd40cd65012438bf90068f195ac4899200ce6b27c6

Observation 72f9dd12-b14f-4708-b074-e54ec352d3d5 · outbound

This paper cites Retrieval augmented generation or long-context LLMs? A comprehensive study and hybrid approach,.

Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models Retrieval augmented generation or long-context LLMs? A comprehensive study and hybrid approach,

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:05:44.355358Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-07T13:05:42.329808Z digest=sha256:f69ed1ee122020d7c33e7a74b94916568a768f6c76054aa2bc127c92646036d9

Observation ae578d0b-31d7-4a57-a4ab-1069181bf991 · outbound

This paper cites Blended RAG: Improving RAG (retriever-augmented generation) accuracy with semantic search and hybrid query-based retrievers,.

Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models Blended RAG: Improving RAG (retriever-augmented generation) accuracy with semantic search and hybrid query-based retrievers,

Reference 20

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:05:44.177604Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-07T13:05:42.368581Z digest=sha256:47b855bc062e1cffcc7e4aa1c5030605fd988f06445b88fcaff98041feb90832

Observation 0c9b5c3a-2cfa-4868-8c6c-5ebac555c91d · outbound

This paper cites Self-RAG: Learning to retrieve, generate, and critique through self-reflection.

Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models Self-RAG: Learning to retrieve, generate, and critique through self-reflection

Reference 21

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:05:44.011927Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-07T13:05:42.423863Z digest=sha256:9dcbf09101a77f26caa8bad937261046cda889b4edc02bbde9a0b6e56f229773

Observation 68f7d33b-86a6-4456-8997-b6f2fbd0e020 · outbound

This paper cites Few-shot learning with retrieval-augmented language models,.

Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models Few-shot learning with retrieval-augmented language models,

Reference 22

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:05:43.830554Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-07T13:05:42.533638Z digest=sha256:8aee68ce58db991b82485610a5e1f06e6bf0b7c253a2b33653a730bb57e1aea9

Observation c1c6dac0-e024-4d0e-93ec-412e708a696c · outbound

This paper cites Generalization through Memorization: Nearest Neighbor Language Models.

Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models Generalization through Memorization: Nearest Neighbor Language Models

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-07T13:05:42.586334Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:05:42.586334Z digest=sha256:22f7ba91bd0f32d855b42a43484dcd0e5c0ab9ef3e1b9c26802adf056e7e1c62

Observation 57eccb2d-6dca-401b-bb9a-eba4ad1b45da · outbound

This paper cites A graph based document retrieval method,.

Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models A graph based document retrieval method,

Reference 24

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:05:43.581691Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-07T13:05:42.701392Z digest=sha256:274729d477e75cd6d6c6147bd7c2359becc0c4af824a7dbda8cfa8271fdbf67f

Pith citing papers

No inbound Pith citation observations are available.