{"as_of":"2026-08-18T03:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1b8217e0e5e6f420d4e1078c554fb9ec65fc609b8c67c13302479c56886a0347","coverage":[{"denominator":24,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:05:42.701392Z","state":"measured"},{"denominator":24,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":24,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.00049/citation-record","integrity":"/paper/2506.00049/integrity","json":"/paper/2506.00049/citation-record.json","paper":"/paper/2506.00049"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2403.14469","last_updated":"2024-03-21T15:16:50Z","snapshot_observed_at":"2026-08-16T14:07:38.981307Z","submitted_at":"2024-03-21T15:16:50Z","title":"ChatGPT Alternative Solutions: Large Language Models Survey","version":1},"cited_work":{"arxiv_id":"2403.14469","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.14469","snapshot_observed_at":"2026-08-07T13:05:43.422636Z","title":"ChatGPT Alternative Solutions: Large Language Models Survey","venue":"cs.CL","work_id":"1a29aad8-57ed-499f-b697-b6a80a75f843","year":2024},"citing_paper":{"arxiv_id":"2506.00049","last_updated":"2025-05-28T18:39:40Z","snapshot_observed_at":"2026-08-15T14:03:57.252783Z","submitted_at":"2025-05-28T18:39:40Z","title":"Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T13:05:40.643078Z"},"links":{"cited_paper":"/paper/2403.14469","citing_paper":"/paper/2506.00049"},"observation_digest":"sha256:5ccea03b1cba0129ae75a8d129e2322b1c4ce0d66214365f13e4e177ad1bb8c5","observation_id":"31a1e125-14d3-4314-b7b8-d0ce3b8f122f","resolution":{"observed_at":"2026-08-07T13:05:43.476742Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.09326","last_updated":"2022-03-17T13:53:46Z","snapshot_observed_at":"2026-08-16T17:13:47.019670Z","submitted_at":"2022-03-17T13:53:46Z","title":"Combining Static and Contextualised Multilingual Embeddings","version":1},"cited_work":{"arxiv_id":"2203.09326","doi":null,"metadata_source":"pith","pith_arxiv_id":"2203.09326","snapshot_observed_at":"2026-08-07T13:05:43.269368Z","title":"Combining Static and Contextualised Multilingual Embeddings","venue":"cs.CL","work_id":"7d20d8c0-726d-4200-9304-ce9bfaf7079e","year":2022},"citing_paper":{"arxiv_id":"2506.00049","last_updated":"2025-05-28T18:39:40Z","snapshot_observed_at":"2026-08-15T14:03:57.252783Z","submitted_at":"2025-05-28T18:39:40Z","title":"Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T13:05:40.759186Z"},"links":{"cited_paper":"/paper/2203.09326","citing_paper":"/paper/2506.00049"},"observation_digest":"sha256:54972ffc528c0921c039efc6510ad28d223cae0afd98b670ea63d776fa7b65da","observation_id":"48c871dd-3118-416e-ba71-42379cd18677","resolution":{"observed_at":"2026-08-07T13:05:43.332228Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:05:45.498130Z","title":"Generative multi-modal knowledge retrieval with large language models,","venue":null,"work_id":"d9a929bf-e69f-46a5-8d4c-f028611236a1","year":2024},"citing_paper":{"arxiv_id":"2506.00049","last_updated":"2025-05-28T18:39:40Z","snapshot_observed_at":"2026-08-15T14:03:57.252783Z","submitted_at":"2025-05-28T18:39:40Z","title":"Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T13:05:40.874448Z"},"links":{"citing_paper":"/paper/2506.00049"},"observation_digest":"sha256:dd27876043daa91b21661d7ac5dacc53048491b33f9fd787d6d3d6ece1700648","observation_id":"69b7eb3c-dbed-4cc7-8cb8-2a1958bfa02d","resolution":{"observed_at":"2026-08-07T13:05:45.579319Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.06564","last_updated":"2024-07-09T05:42:53Z","snapshot_observed_at":"2026-08-16T13:35:55.015049Z","submitted_at":"2024-07-09T05:42:53Z","title":"Combining Knowledge Graphs and Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.06564","snapshot_observed_at":"2026-08-07T13:05:41.050595Z","title":"Combining knowledge graphs and large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00049","last_updated":"2025-05-28T18:39:40Z","snapshot_observed_at":"2026-08-15T14:03:57.252783Z","submitted_at":"2025-05-28T18:39:40Z","title":"Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T13:05:41.050595Z"},"links":{"cited_paper":"/paper/2407.06564","citing_paper":"/paper/2506.00049"},"observation_digest":"sha256:437d9bb526878da5fac6a94f3677039adeb95e9dc97dc2ee9b7816c8f0588b9e","observation_id":"1e93cc45-a067-4251-824d-c2de0e46ffa2","resolution":{"observed_at":"2026-08-07T13:05:41.050595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:05:45.389114Z","title":"Semantic-embedding guided graph network for cross-modal retrieval,","venue":null,"work_id":"0d10029d-7b29-420c-b275-cf798a83b734","year":2023},"citing_paper":{"arxiv_id":"2506.00049","last_updated":"2025-05-28T18:39:40Z","snapshot_observed_at":"2026-08-15T14:03:57.252783Z","submitted_at":"2025-05-28T18:39:40Z","title":"Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T13:05:41.177934Z"},"links":{"citing_paper":"/paper/2506.00049"},"observation_digest":"sha256:8d75e7593d5c6554af6182c6e0c78ecd8530e9fc65855d91babbd1588db357e9","observation_id":"92cbe90f-510c-490c-a674-7ab8ba60dc44","resolution":{"observed_at":"2026-08-07T13:05:45.445148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.12832","last_updated":"2020-06-04T05:28:21Z","snapshot_observed_at":"2026-08-14T17:33:02.829560Z","submitted_at":"2020-04-27T14:21:03Z","title":"ColBERT: Efficient and Effective Passage Search via Contextualized Late Interaction over BERT","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.12832","snapshot_observed_at":"2026-08-07T13:05:41.309394Z","title":"ColBERT: Efficient and effective passage search via contextualized late interaction over BERT,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.00049","last_updated":"2025-05-28T18:39:40Z","snapshot_observed_at":"2026-08-15T14:03:57.252783Z","submitted_at":"2025-05-28T18:39:40Z","title":"Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T13:05:41.309394Z"},"links":{"cited_paper":"/paper/2004.12832","citing_paper":"/paper/2506.00049"},"observation_digest":"sha256:e80e7a96ac6abcbe60560ded352d484efcfba7370029529668a2f26a37486c4c","observation_id":"797a1782-feae-4760-8c76-eac93bc8096c","resolution":{"observed_at":"2026-08-07T13:05:41.309394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:05:45.197153Z","title":"ColBERTv2: Effective and efficient retrieval via lightweight late interaction,","venue":null,"work_id":"811a7ebf-5317-4a80-8751-8d76d62dd37a","year":2021},"citing_paper":{"arxiv_id":"2506.00049","last_updated":"2025-05-28T18:39:40Z","snapshot_observed_at":"2026-08-15T14:03:57.252783Z","submitted_at":"2025-05-28T18:39:40Z","title":"Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T13:05:41.393215Z"},"links":{"citing_paper":"/paper/2506.00049"},"observation_digest":"sha256:1e4e411986d01b99f1a7f132138f657a9d375abc3ec73a29dbbcd14cbfdaa6e4","observation_id":"eea6ed0f-9e02-4c22-a61d-72acefeb5ef1","resolution":{"observed_at":"2026-08-07T13:05:45.298622Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:05:45.062047Z","title":"COIL: Revisit Exact Lexical Match in Information Retrieval with Contextualized Inverted List,","venue":null,"work_id":"df962918-6ef8-4507-bbea-a68ca4d41dff","year":2021},"citing_paper":{"arxiv_id":"2506.00049","last_updated":"2025-05-28T18:39:40Z","snapshot_observed_at":"2026-08-15T14:03:57.252783Z","submitted_at":"2025-05-28T18:39:40Z","title":"Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T13:05:41.468975Z"},"links":{"citing_paper":"/paper/2506.00049"},"observation_digest":"sha256:acd8347555b63b5fdf25690c79b5fb75fcc6a975866d279c34ddf674b8c374bb","observation_id":"be6ae041-01f0-4bfd-a37a-b5d76022754a","resolution":{"observed_at":"2026-08-07T13:05:45.143268Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23013","last_updated":"2025-03-29T08:35:01Z","snapshot_observed_at":"2026-08-17T20:00:30.411337Z","submitted_at":"2025-03-29T08:35:01Z","title":"DAT: Dynamic Alpha Tuning for Hybrid Retrieval in Retrieval-Augmented Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.23013","snapshot_observed_at":"2026-08-07T13:05:41.558233Z","title":"DAT: Dynamic alpha tuning for hybrid retrieval in retrieval-augmented generation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00049","last_updated":"2025-05-28T18:39:40Z","snapshot_observed_at":"2026-08-15T14:03:57.252783Z","submitted_at":"2025-05-28T18:39:40Z","title":"Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T13:05:41.558233Z"},"links":{"cited_paper":"/paper/2503.23013","citing_paper":"/paper/2506.00049"},"observation_digest":"sha256:7564bcdc361ca6867f0691acb414c435f3c5cb603591fd3119620344e412ee66","observation_id":"8d613c87-3c9f-4028-988f-8b1aa4e86deb","resolution":{"observed_at":"2026-08-07T13:05:41.558233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:05:44.922825Z","title":"Sentence-BERT: Sentence embeddings using siamese BERT-networks,","venue":null,"work_id":"63b2ba69-3cf7-4c15-8501-30f2002f1d10","year":2019},"citing_paper":{"arxiv_id":"2506.00049","last_updated":"2025-05-28T18:39:40Z","snapshot_observed_at":"2026-08-15T14:03:57.252783Z","submitted_at":"2025-05-28T18:39:40Z","title":"Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T13:05:41.627406Z"},"links":{"citing_paper":"/paper/2506.00049"},"observation_digest":"sha256:b59eea4f9b74fbbbb7a2b2d4f34daacaf23bf4594a44ba2afae0ee527dfd8e77","observation_id":"041522bf-7e3d-4ceb-902f-b92a69374429","resolution":{"observed_at":"2026-08-07T13:05:44.975123Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:05:44.731301Z","title":"Dense passage retrieval for open-domain question answering,","venue":null,"work_id":"2926a756-e841-4fae-b689-32d89c19382c","year":2020},"citing_paper":{"arxiv_id":"2506.00049","last_updated":"2025-05-28T18:39:40Z","snapshot_observed_at":"2026-08-15T14:03:57.252783Z","submitted_at":"2025-05-28T18:39:40Z","title":"Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T13:05:41.700647Z"},"links":{"citing_paper":"/paper/2506.00049"},"observation_digest":"sha256:980d600ad2bc5cd8e77004992b140702205c1ef8e0a62a88b24b88a939526ef4","observation_id":"00fa5ffa-7c4c-4d59-8579-ad63777af205","resolution":{"observed_at":"2026-08-07T13:05:44.817932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.07168","last_updated":"2023-07-14T05:34:13Z","snapshot_observed_at":"2026-08-16T17:04:54.524171Z","submitted_at":"2023-07-14T05:34:13Z","title":"Adaptive Region Selection for Active Learning in Whole Slide Image Semantic Segmentation","version":1},"cited_work":{"arxiv_id":"2307.07168","doi":null,"metadata_source":"pith","pith_arxiv_id":"2307.07168","snapshot_observed_at":"2026-08-07T13:05:43.071376Z","title":"Adaptive Region Selection for Active Learning in Whole Slide Image Semantic Segmentation","venue":"cs.CV","work_id":"ef8f6b83-f372-41c9-bfea-19bdc352cfe5","year":2023},"citing_paper":{"arxiv_id":"2506.00049","last_updated":"2025-05-28T18:39:40Z","snapshot_observed_at":"2026-08-15T14:03:57.252783Z","submitted_at":"2025-05-28T18:39:40Z","title":"Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T13:05:41.788490Z"},"links":{"cited_paper":"/paper/2307.07168","citing_paper":"/paper/2506.00049"},"observation_digest":"sha256:96e2585a4792c7bf52ae9b4cc5b0affbd4bf78d8f99f1f7cc53c9668d1c445e2","observation_id":"75d83684-6b32-46ca-8b94-4493f755110e","resolution":{"observed_at":"2026-08-07T13:05:43.124640Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-08-13T17:41:53.092611Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-07T13:05:41.854282Z","title":"Scaling laws for neural language models,","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2506.00049","last_updated":"2025-05-28T18:39:40Z","snapshot_observed_at":"2026-08-15T14:03:57.252783Z","submitted_at":"2025-05-28T18:39:40Z","title":"Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T13:05:41.854282Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2506.00049"},"observation_digest":"sha256:3f43ea1251b9c57354f6b0af967e4cf68c3b770806150e9daeb473da8e77ebe4","observation_id":"37b280df-10ba-4b49-84eb-61f776cc094a","resolution":{"observed_at":"2026-08-07T13:05:41.854282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:05:44.552297Z","title":"RetroMAE: Pre-training retrieval-oriented language models with masked auto-encoder","venue":null,"work_id":"906682db-4838-4c8c-a731-7acfd0c88b9d","year":null},"citing_paper":{"arxiv_id":"2506.00049","last_updated":"2025-05-28T18:39:40Z","snapshot_observed_at":"2026-08-15T14:03:57.252783Z","submitted_at":"2025-05-28T18:39:40Z","title":"Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T13:05:41.916722Z"},"links":{"citing_paper":"/paper/2506.00049"},"observation_digest":"sha256:cab225967323ab14c529e7bb2ac6708d6868cd9d8db6db68c0c7a0d8388b8d29","observation_id":"829130c8-465c-4f31-be5b-c83ed67923ab","resolution":{"observed_at":"2026-08-07T13:05:44.623052Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10496","last_updated":"2022-12-20T18:09:52Z","snapshot_observed_at":"2026-08-16T16:07:13.126195Z","submitted_at":"2022-12-20T18:09:52Z","title":"Precise Zero-Shot Dense Retrieval without Relevance Labels","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10496","snapshot_observed_at":"2026-08-07T13:05:42.001955Z","title":"Precise zero-shot dense retrieval without relevance labels,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00049","last_updated":"2025-05-28T18:39:40Z","snapshot_observed_at":"2026-08-15T14:03:57.252783Z","submitted_at":"2025-05-28T18:39:40Z","title":"Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T13:05:42.001955Z"},"links":{"cited_paper":"/paper/2212.10496","citing_paper":"/paper/2506.00049"},"observation_digest":"sha256:b670bac0ec2b89cf030e4b999e2e1d123335adbf7cbf089a7bff53291c7c1ab4","observation_id":"eb679451-4adf-4706-a9b6-c4393949b7af","resolution":{"observed_at":"2026-08-07T13:05:42.001955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.09128","last_updated":"2021-04-12T17:59:17Z","snapshot_observed_at":"2026-08-16T18:58:00.250041Z","submitted_at":"2020-12-16T18:16:32Z","title":"Varied phenomenology of models displaying dynamical large-deviation singularities","version":2},"cited_work":{"arxiv_id":"2012.09128","doi":null,"metadata_source":"pith","pith_arxiv_id":"2012.09128","snapshot_observed_at":"2026-08-07T13:05:42.872486Z","title":"Varied phenomenology of models displaying dynamical large-deviation singularities","venue":"cond-mat.stat-mech","work_id":"ba44ecfb-c236-49b4-bfc1-21177672b2ed","year":2020},"citing_paper":{"arxiv_id":"2506.00049","last_updated":"2025-05-28T18:39:40Z","snapshot_observed_at":"2026-08-15T14:03:57.252783Z","submitted_at":"2025-05-28T18:39:40Z","title":"Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T13:05:42.068941Z"},"links":{"cited_paper":"/paper/2012.09128","citing_paper":"/paper/2506.00049"},"observation_digest":"sha256:b52aa5f6c1457626659b5a3faf7bcbf292c50933050ffa37fcc06dbc3f922dee","observation_id":"370b4999-05c5-46d0-b90e-bb6e3162f65a","resolution":{"observed_at":"2026-08-07T13:05:42.939787Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:05:44.433895Z","title":"MiniLM: Deep self-attention distillation for task-agnostic compression of pre- trained transformers,","venue":null,"work_id":"d8915b12-0db3-43fe-97c1-56f5118c5b41","year":2020},"citing_paper":{"arxiv_id":"2506.00049","last_updated":"2025-05-28T18:39:40Z","snapshot_observed_at":"2026-08-15T14:03:57.252783Z","submitted_at":"2025-05-28T18:39:40Z","title":"Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T13:05:42.163253Z"},"links":{"citing_paper":"/paper/2506.00049"},"observation_digest":"sha256:b0c32fa9db4e0074648d3a56ae0fb627f179f1b8091c7d72ad21c9828b8c78f5","observation_id":"678d33a2-c5a8-4af4-bcb6-181ac9822bf1","resolution":{"observed_at":"2026-08-07T13:05:44.483135Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.11401","last_updated":"2021-04-12T15:42:18Z","snapshot_observed_at":"2026-08-07T05:44:30.677502Z","submitted_at":"2020-05-22T21:34:34Z","title":"Retrieval-Augmented Generation for Knowledge-Intensive NLP Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.11401","snapshot_observed_at":"2026-08-07T13:05:42.234451Z","title":"Retrieval-augmented generation for knowledge-intensive NLP tasks,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2506.00049","last_updated":"2025-05-28T18:39:40Z","snapshot_observed_at":"2026-08-15T14:03:57.252783Z","submitted_at":"2025-05-28T18:39:40Z","title":"Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T13:05:42.234451Z"},"links":{"cited_paper":"/paper/2005.11401","citing_paper":"/paper/2506.00049"},"observation_digest":"sha256:b2fd31edb8f96fea394418dd40cd65012438bf90068f195ac4899200ce6b27c6","observation_id":"eb68fc14-87d2-44af-8b2b-463c0639f213","resolution":{"observed_at":"2026-08-07T13:05:42.234451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:05:44.277060Z","title":"Retrieval augmented generation or long-context LLMs? A comprehensive study and hybrid approach,","venue":null,"work_id":"318ade16-f4e9-4c98-b926-771383d19c07","year":2024},"citing_paper":{"arxiv_id":"2506.00049","last_updated":"2025-05-28T18:39:40Z","snapshot_observed_at":"2026-08-15T14:03:57.252783Z","submitted_at":"2025-05-28T18:39:40Z","title":"Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T13:05:42.329808Z"},"links":{"citing_paper":"/paper/2506.00049"},"observation_digest":"sha256:f69ed1ee122020d7c33e7a74b94916568a768f6c76054aa2bc127c92646036d9","observation_id":"72f9dd12-b14f-4708-b074-e54ec352d3d5","resolution":{"observed_at":"2026-08-07T13:05:44.355358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:05:44.103251Z","title":"Blended RAG: Improving RAG (retriever-augmented generation) accuracy with semantic search and hybrid query-based retrievers,","venue":null,"work_id":"11f7677e-af40-4c68-ba9e-ea368cf7b35f","year":2024},"citing_paper":{"arxiv_id":"2506.00049","last_updated":"2025-05-28T18:39:40Z","snapshot_observed_at":"2026-08-15T14:03:57.252783Z","submitted_at":"2025-05-28T18:39:40Z","title":"Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T13:05:42.368581Z"},"links":{"citing_paper":"/paper/2506.00049"},"observation_digest":"sha256:47b855bc062e1cffcc7e4aa1c5030605fd988f06445b88fcaff98041feb90832","observation_id":"ae578d0b-31d7-4a57-a4ab-1069181bf991","resolution":{"observed_at":"2026-08-07T13:05:44.177604Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:05:43.922029Z","title":"Self-RAG: Learning to retrieve, generate, and critique through self-reflection","venue":null,"work_id":"c113c329-32f1-4bef-9add-6f309297eef8","year":null},"citing_paper":{"arxiv_id":"2506.00049","last_updated":"2025-05-28T18:39:40Z","snapshot_observed_at":"2026-08-15T14:03:57.252783Z","submitted_at":"2025-05-28T18:39:40Z","title":"Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T13:05:42.423863Z"},"links":{"citing_paper":"/paper/2506.00049"},"observation_digest":"sha256:9dcbf09101a77f26caa8bad937261046cda889b4edc02bbde9a0b6e56f229773","observation_id":"0c9b5c3a-2cfa-4868-8c6c-5ebac555c91d","resolution":{"observed_at":"2026-08-07T13:05:44.011927Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:05:43.686487Z","title":"Few-shot learning with retrieval-augmented language models,","venue":null,"work_id":"1a2ac11c-00b1-4efc-9e1d-27840cb992d0","year":2021},"citing_paper":{"arxiv_id":"2506.00049","last_updated":"2025-05-28T18:39:40Z","snapshot_observed_at":"2026-08-15T14:03:57.252783Z","submitted_at":"2025-05-28T18:39:40Z","title":"Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T13:05:42.533638Z"},"links":{"citing_paper":"/paper/2506.00049"},"observation_digest":"sha256:8aee68ce58db991b82485610a5e1f06e6bf0b7c253a2b33653a730bb57e1aea9","observation_id":"68f7d33b-86a6-4456-8997-b6f2fbd0e020","resolution":{"observed_at":"2026-08-07T13:05:43.830554Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.00172","last_updated":"2020-02-15T01:04:52Z","snapshot_observed_at":"2026-08-17T14:14:16.349439Z","submitted_at":"2019-11-01T01:09:53Z","title":"Generalization through Memorization: Nearest Neighbor Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.00172","snapshot_observed_at":"2026-08-07T13:05:42.586334Z","title":"Generalization through memorization: Nearest neighbor language models,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.00049","last_updated":"2025-05-28T18:39:40Z","snapshot_observed_at":"2026-08-15T14:03:57.252783Z","submitted_at":"2025-05-28T18:39:40Z","title":"Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T13:05:42.586334Z"},"links":{"cited_paper":"/paper/1911.00172","citing_paper":"/paper/2506.00049"},"observation_digest":"sha256:22f7ba91bd0f32d855b42a43484dcd0e5c0ab9ef3e1b9c26802adf056e7e1c62","observation_id":"c1c6dac0-e024-4d0e-93ec-412e708a696c","resolution":{"observed_at":"2026-08-07T13:05:42.586334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:05:43.550357Z","title":"A graph based document retrieval method,","venue":null,"work_id":"ed4b1145-305e-494a-865f-55c8575eb79d","year":2018},"citing_paper":{"arxiv_id":"2506.00049","last_updated":"2025-05-28T18:39:40Z","snapshot_observed_at":"2026-08-15T14:03:57.252783Z","submitted_at":"2025-05-28T18:39:40Z","title":"Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T13:05:42.701392Z"},"links":{"citing_paper":"/paper/2506.00049"},"observation_digest":"sha256:274729d477e75cd6d6c6147bd7c2359becc0c4af824a7dbda8cfa8271fdbf67f","observation_id":"57eccb2d-6dca-401b-bb9a-eba4ad1b45da","resolution":{"observed_at":"2026-08-07T13:05:43.581691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.00049","last_updated":"2025-05-28T18:39:40Z","latest_version":1,"primary_category":"cs.IR","snapshot_observed_at":"2026-08-15T14:03:57.252783Z","submitted_at":"2025-05-28T18:39:40Z","title":"Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models"},"reference_resolution":{"displayed":24,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":7,"verified_exact":2,"verified_fuzzy":13},"total_outbound_references":24},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 24 of 24 outbound references and 0 inbound Pith citation observations for arXiv:2506.00049."}