{"as_of":"2026-08-18T19:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2688e030159dd41e5d8008d55f8f9497be715a5d1f6d6a9d6aae821a17792ba5","coverage":[{"denominator":55,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":55,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T23:25:52.643259Z","state":"measured"},{"denominator":55,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":55,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.04732/citation-record","integrity":"/paper/2505.04732/integrity","json":"/paper/2505.04732/citation-record.json","paper":"/paper/2505.04732"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:25:52.361676Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.04732","last_updated":"2025-05-07T18:43:57Z","snapshot_observed_at":"2026-08-16T06:45:15.844745Z","submitted_at":"2025-05-07T18:43:57Z","title":"QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:52.361676Z"},"links":{"citing_paper":"/paper/2505.04732"},"observation_digest":"sha256:81a3af9dcc45fad25db68f4c59756894e6d3b50baf0e62f69847e2f7d6c72efb","observation_id":"bd7111b8-69d9-47aa-8135-7727a5d76d6f","resolution":{"observed_at":"2026-08-15T23:25:52.361676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:25:52.368133Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.04732","last_updated":"2025-05-07T18:43:57Z","snapshot_observed_at":"2026-08-16T06:45:15.844745Z","submitted_at":"2025-05-07T18:43:57Z","title":"QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:52.368133Z"},"links":{"citing_paper":"/paper/2505.04732"},"observation_digest":"sha256:fdab998b7e41f068a1fadbae0eb85602cebc50eb86184397ede5ac3a4cab21c4","observation_id":"5ec1f837-e36d-4a7d-9f8b-c18be60c63e7","resolution":{"observed_at":"2026-08-15T23:25:52.368133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:25:53.722843Z","title":null,"venue":null,"work_id":"7087569a-d534-46ab-bfd5-a0b039b4a66b","year":2022},"citing_paper":{"arxiv_id":"2505.04732","last_updated":"2025-05-07T18:43:57Z","snapshot_observed_at":"2026-08-16T06:45:15.844745Z","submitted_at":"2025-05-07T18:43:57Z","title":"QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:52.372949Z"},"links":{"citing_paper":"/paper/2505.04732"},"observation_digest":"sha256:13dbf2de56259977177a273251d1e8f7eb3422333776a12f5b7fbc0ab650a3e2","observation_id":"cb5e785e-25e7-4849-8c2c-155e0b261c27","resolution":{"observed_at":"2026-08-15T23:25:53.726643Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:25:52.377571Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.04732","last_updated":"2025-05-07T18:43:57Z","snapshot_observed_at":"2026-08-16T06:45:15.844745Z","submitted_at":"2025-05-07T18:43:57Z","title":"QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:52.377571Z"},"links":{"citing_paper":"/paper/2505.04732"},"observation_digest":"sha256:c5a16a7161324bdb481b2657dd2131823fbbaa9953d0b5d266514aff872188eb","observation_id":"dffbcb91-db7c-477f-9eac-b4cb35c32fb7","resolution":{"observed_at":"2026-08-15T23:25:52.377571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:25:53.695919Z","title":"G.; Friedman, P","venue":null,"work_id":"f40a56b5-cbed-45cd-acbc-ef6abf9c7773","year":2025},"citing_paper":{"arxiv_id":"2505.04732","last_updated":"2025-05-07T18:43:57Z","snapshot_observed_at":"2026-08-16T06:45:15.844745Z","submitted_at":"2025-05-07T18:43:57Z","title":"QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:52.381794Z"},"links":{"citing_paper":"/paper/2505.04732"},"observation_digest":"sha256:ff01cb2b554e51ba3a168ff66deaa42e185f5afc22821ce7a6b8de51a77c328f","observation_id":"7033c41b-a796-41fe-80c7-daf2af2f4db5","resolution":{"observed_at":"2026-08-15T23:25:53.700928Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:25:53.682694Z","title":null,"venue":null,"work_id":"85f09362-bd05-4bf4-abdc-e05d7e4a1e10","year":2023},"citing_paper":{"arxiv_id":"2505.04732","last_updated":"2025-05-07T18:43:57Z","snapshot_observed_at":"2026-08-16T06:45:15.844745Z","submitted_at":"2025-05-07T18:43:57Z","title":"QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:52.386976Z"},"links":{"citing_paper":"/paper/2505.04732"},"observation_digest":"sha256:343cc7b8df505aff9f68dbc9fefa4c93a5223f7f19d7ecc61f662c2762b9c59a","observation_id":"fed9f215-85ab-4cdf-8628-775fc22f5ef5","resolution":{"observed_at":"2026-08-15T23:25:53.687125Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02320","last_updated":"2023-05-03T17:59:38Z","snapshot_observed_at":"2026-08-16T15:35:53.268242Z","submitted_at":"2023-05-03T17:59:38Z","title":"Generating Synthetic Documents for Cross-Encoder Re-Rankers: A Comparative Study of ChatGPT and Human Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.02320","snapshot_observed_at":"2026-08-15T23:25:52.390640Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.04732","last_updated":"2025-05-07T18:43:57Z","snapshot_observed_at":"2026-08-16T06:45:15.844745Z","submitted_at":"2025-05-07T18:43:57Z","title":"QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:52.390640Z"},"links":{"cited_paper":"/paper/2305.02320","citing_paper":"/paper/2505.04732"},"observation_digest":"sha256:ca40c74f8921542f8f50c44c0cc79f59373a3a329b7da14d7889b8f2e1c4fb4e","observation_id":"8bb05e58-4888-4be4-ab9c-c5a3f7fda3b2","resolution":{"observed_at":"2026-08-15T23:25:52.390640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:25:53.669260Z","title":null,"venue":null,"work_id":"416ce3af-af40-47a6-afd6-ecf85d9de95b","year":2024},"citing_paper":{"arxiv_id":"2505.04732","last_updated":"2025-05-07T18:43:57Z","snapshot_observed_at":"2026-08-16T06:45:15.844745Z","submitted_at":"2025-05-07T18:43:57Z","title":"QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:52.394404Z"},"links":{"citing_paper":"/paper/2505.04732"},"observation_digest":"sha256:ddfd446c70e430218501f941b70d4ff16c4a605a934e029666f098c612ee751d","observation_id":"b24c0a6a-d45a-466c-be0b-3fe2bf52467a","resolution":{"observed_at":"2026-08-15T23:25:53.674065Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:25:53.655528Z","title":"N.; and Beg, M","venue":null,"work_id":"c332c31c-d8cb-4dbb-a18d-38515a3d0a25","year":2021},"citing_paper":{"arxiv_id":"2505.04732","last_updated":"2025-05-07T18:43:57Z","snapshot_observed_at":"2026-08-16T06:45:15.844745Z","submitted_at":"2025-05-07T18:43:57Z","title":"QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:52.398149Z"},"links":{"citing_paper":"/paper/2505.04732"},"observation_digest":"sha256:a89dd3add7b8d41d0caa17482a62530b49197e9b39be14597582b6395cf22900","observation_id":"571a3216-b5c0-40bd-a0ea-87e3a53dad3d","resolution":{"observed_at":"2026-08-15T23:25:53.659994Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:25:53.637668Z","title":null,"venue":null,"work_id":"efb8fd5b-b070-4e40-b53e-43230c1459cf","year":2024},"citing_paper":{"arxiv_id":"2505.04732","last_updated":"2025-05-07T18:43:57Z","snapshot_observed_at":"2026-08-16T06:45:15.844745Z","submitted_at":"2025-05-07T18:43:57Z","title":"QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:52.401758Z"},"links":{"citing_paper":"/paper/2505.04732"},"observation_digest":"sha256:81a8773062d54e29aab0f4a059d3362048e882731c17bfc07a97b308583a64e9","observation_id":"1589a745-6f93-42ef-b959-9a5e3e5ed56b","resolution":{"observed_at":"2026-08-15T23:25:53.642705Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.05144","last_updated":"2022-02-10T16:52:45Z","snapshot_observed_at":"2026-08-17T15:14:18.106074Z","submitted_at":"2022-02-10T16:52:45Z","title":"InPars: Data Augmentation for Information Retrieval using Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.05144","snapshot_observed_at":"2026-08-15T23:25:52.405217Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.04732","last_updated":"2025-05-07T18:43:57Z","snapshot_observed_at":"2026-08-16T06:45:15.844745Z","submitted_at":"2025-05-07T18:43:57Z","title":"QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:52.405217Z"},"links":{"cited_paper":"/paper/2202.05144","citing_paper":"/paper/2505.04732"},"observation_digest":"sha256:19983ded111a65090c5161736d20154340087ea010112ada0f3d255338e8e476","observation_id":"5b37700b-d993-469a-8a56-01591f39ad9b","resolution":{"observed_at":"2026-08-15T23:25:52.405217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:25:53.623182Z","title":null,"venue":null,"work_id":"39fd7d70-ef17-46b5-ab67-9503e66a4956","year":2023},"citing_paper":{"arxiv_id":"2505.04732","last_updated":"2025-05-07T18:43:57Z","snapshot_observed_at":"2026-08-16T06:45:15.844745Z","submitted_at":"2025-05-07T18:43:57Z","title":"QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:52.410436Z"},"links":{"citing_paper":"/paper/2505.04732"},"observation_digest":"sha256:92e97065d07bfd7299f70001991a9d04f7be8463622753c3877e98c38f13cb40","observation_id":"639b3396-4ab5-4371-ac82-b5c31d1d88a3","resolution":{"observed_at":"2026-08-15T23:25:53.627771Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:25:53.608982Z","title":null,"venue":null,"work_id":"c9f3d9be-1758-4056-97d9-7b907cd59197","year":2017},"citing_paper":{"arxiv_id":"2505.04732","last_updated":"2025-05-07T18:43:57Z","snapshot_observed_at":"2026-08-16T06:45:15.844745Z","submitted_at":"2025-05-07T18:43:57Z","title":"QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:52.415928Z"},"links":{"citing_paper":"/paper/2505.04732"},"observation_digest":"sha256:2b39f597e1125f6ca52da0c604e18d5fe417a1c57e828a1841ed64d436d65158","observation_id":"e747260a-3a5d-4521-9468-f4cd03a2ce56","resolution":{"observed_at":"2026-08-15T23:25:53.612927Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.07180","last_updated":"2020-05-20T17:39:52Z","snapshot_observed_at":"2026-08-07T22:58:29.171734Z","submitted_at":"2020-04-15T16:05:51Z","title":"SPECTER: Document-level Representation Learning using Citation-informed Transformers","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.07180","snapshot_observed_at":"2026-08-15T23:25:52.420363Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.04732","last_updated":"2025-05-07T18:43:57Z","snapshot_observed_at":"2026-08-16T06:45:15.844745Z","submitted_at":"2025-05-07T18:43:57Z","title":"QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:52.420363Z"},"links":{"cited_paper":"/paper/2004.07180","citing_paper":"/paper/2505.04732"},"observation_digest":"sha256:1a4f654aae657845989929b9adaaad4687ad43fbdf898e4b39957d721cd57799","observation_id":"dd08960b-9c0e-4078-b8e7-83e3c34f4198","resolution":{"observed_at":"2026-08-15T23:25:52.420363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2003.07820","last_updated":"2020-03-18T16:56:56Z","snapshot_observed_at":"2026-08-10T13:25:09.780441Z","submitted_at":"2020-03-17T17:12:36Z","title":"Overview of the TREC 2019 deep learning track","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.07820","snapshot_observed_at":"2026-08-15T23:25:52.424864Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.04732","last_updated":"2025-05-07T18:43:57Z","snapshot_observed_at":"2026-08-16T06:45:15.844745Z","submitted_at":"2025-05-07T18:43:57Z","title":"QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:52.424864Z"},"links":{"cited_paper":"/paper/2003.07820","citing_paper":"/paper/2505.04732"},"observation_digest":"sha256:6701d322a85a5b9f27dd1753e730513be23d42aa23ad5ad5f4a9fad5c503db39","observation_id":"95c6f9d1-9b93-429d-8464-fe6942694019","resolution":{"observed_at":"2026-08-15T23:25:52.424864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.11755","last_updated":"2022-09-23T17:59:06Z","snapshot_observed_at":"2026-08-16T16:30:16.790213Z","submitted_at":"2022-09-23T17:59:06Z","title":"Promptagator: Few-shot Dense Retrieval From 8 Examples","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.11755","snapshot_observed_at":"2026-08-15T23:25:52.430893Z","title":"Y.; Ma, J.; Luan, Y.; Ni, J.; Lu, J.; Bakalov, A.; Guu, K.; Hall, K","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.04732","last_updated":"2025-05-07T18:43:57Z","snapshot_observed_at":"2026-08-16T06:45:15.844745Z","submitted_at":"2025-05-07T18:43:57Z","title":"QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:52.430893Z"},"links":{"cited_paper":"/paper/2209.11755","citing_paper":"/paper/2505.04732"},"observation_digest":"sha256:6de77f5bc3650fdcd9c2e6e6bb2babd2145889c482b10f3d159781046b544c0a","observation_id":"b3d43bb9-2486-4c98-82ca-b018b8d4cfa1","resolution":{"observed_at":"2026-08-15T23:25:52.430893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:25:53.596105Z","title":null,"venue":null,"work_id":"dada7f02-3b16-4f59-96d4-37edd6d75b67","year":2014},"citing_paper":{"arxiv_id":"2505.04732","last_updated":"2025-05-07T18:43:57Z","snapshot_observed_at":"2026-08-16T06:45:15.844745Z","submitted_at":"2025-05-07T18:43:57Z","title":"QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:52.438011Z"},"links":{"citing_paper":"/paper/2505.04732"},"observation_digest":"sha256:b4a45ed936fd96c378e0e25703290fd07061de717091d9bb5724076cf40fd2f4","observation_id":"90cd9a04-0fc5-4b2c-b0ee-4a742d421f1f","resolution":{"observed_at":"2026-08-15T23:25:53.600305Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1912.01901","last_updated":"2020-03-17T09:25:34Z","snapshot_observed_at":"2026-08-15T22:21:16.931070Z","submitted_at":"2019-12-04T11:25:47Z","title":"WIKIR: A Python toolkit for building a large-scale Wikipedia-based English Information Retrieval Dataset","version":4},"cited_work":{"arxiv_id":"1912.01901","doi":null,"metadata_source":"pith","pith_arxiv_id":"1912.01901","snapshot_observed_at":"2026-08-15T23:25:53.173664Z","title":"WIKIR: A Python toolkit for building a large-scale Wikipedia-based English Information Retrieval Dataset","venue":"cs.IR","work_id":"e5ced479-6a0e-404b-9b83-a01f109da40e","year":2019},"citing_paper":{"arxiv_id":"2505.04732","last_updated":"2025-05-07T18:43:57Z","snapshot_observed_at":"2026-08-16T06:45:15.844745Z","submitted_at":"2025-05-07T18:43:57Z","title":"QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:52.444219Z"},"links":{"cited_paper":"/paper/1912.01901","citing_paper":"/paper/2505.04732"},"observation_digest":"sha256:d38145fd122634bf05c1cf40b64fc906f8863b6434d315db55884d28d5db45bb","observation_id":"590a7965-1543-4294-aa4e-e6ce406bfedc","resolution":{"observed_at":"2026-08-15T23:25:53.179813Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:25:53.582122Z","title":"O'Reilly Media, Inc","venue":null,"work_id":"e44aaddb-a401-4b9c-b910-c51f07aa8fc2","year":2015},"citing_paper":{"arxiv_id":"2505.04732","last_updated":"2025-05-07T18:43:57Z","snapshot_observed_at":"2026-08-16T06:45:15.844745Z","submitted_at":"2025-05-07T18:43:57Z","title":"QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:52.449410Z"},"links":{"citing_paper":"/paper/2505.04732"},"observation_digest":"sha256:694b87abe2d1fd06db7283a127f29de76d3348666b6cabb1254da32a8fa70d5f","observation_id":"64026d84-fd70-4e3e-9146-fdad874ed57d","resolution":{"observed_at":"2026-08-15T23:25:53.586654Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.11346","last_updated":"2023-07-21T04:43:00Z","snapshot_observed_at":"2026-08-18T18:14:12.043640Z","submitted_at":"2023-07-21T04:43:00Z","title":"CohortGPT: An Enhanced GPT for Participant Recruitment in Clinical Study","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.11346","snapshot_observed_at":"2026-08-15T23:25:52.455140Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.04732","last_updated":"2025-05-07T18:43:57Z","snapshot_observed_at":"2026-08-16T06:45:15.844745Z","submitted_at":"2025-05-07T18:43:57Z","title":"QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:52.455140Z"},"links":{"cited_paper":"/paper/2307.11346","citing_paper":"/paper/2505.04732"},"observation_digest":"sha256:dfe0bab691383c7f119dbf1bbae0d12e45ac9715bc42ac77fbf0a601ee0c9a9e","observation_id":"de3334fc-e1e4-4269-ada3-35915295cd85","resolution":{"observed_at":"2026-08-15T23:25:52.455140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:25:53.567433Z","title":"P.; Chiang, M","venue":null,"work_id":"ee409214-b738-4957-ae75-150af0717b98","year":2018},"citing_paper":{"arxiv_id":"2505.04732","last_updated":"2025-05-07T18:43:57Z","snapshot_observed_at":"2026-08-16T06:45:15.844745Z","submitted_at":"2025-05-07T18:43:57Z","title":"QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:52.462951Z"},"links":{"citing_paper":"/paper/2505.04732"},"observation_digest":"sha256:24e6ada3461bb2171811214755f2f8234d67101a37063cd3043fa3251e589db5","observation_id":"235ba6a4-c7b0-4b76-8370-5ebe3067edec","resolution":{"observed_at":"2026-08-15T23:25:53.572055Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:25:53.553562Z","title":null,"venue":null,"work_id":"85020953-f8dc-4705-91ae-5e4ac808e743","year":2024},"citing_paper":{"arxiv_id":"2505.04732","last_updated":"2025-05-07T18:43:57Z","snapshot_observed_at":"2026-08-16T06:45:15.844745Z","submitted_at":"2025-05-07T18:43:57Z","title":"QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:52.468941Z"},"links":{"citing_paper":"/paper/2505.04732"},"observation_digest":"sha256:7b993df83a4554b09a1d4d6965b49f5f8cf189d35e7fec21f09db1610c13d6ee","observation_id":"b0c77279-d557-4e1a-8290-ef1d39fbeb9c","resolution":{"observed_at":"2026-08-15T23:25:53.558215Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16008","last_updated":"2024-07-03T17:40:00Z","snapshot_observed_at":"2026-08-16T13:40:26.705491Z","submitted_at":"2024-06-23T04:35:42Z","title":"Found in the Middle: Calibrating Positional Attention Bias Improves Long Context Utilization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16008","snapshot_observed_at":"2026-08-15T23:25:52.473530Z","title":"T.; Kumar, A.; Glass, J.; Ratner, A.; Lee, C.-Y.; Krishna, R.; et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.04732","last_updated":"2025-05-07T18:43:57Z","snapshot_observed_at":"2026-08-16T06:45:15.844745Z","submitted_at":"2025-05-07T18:43:57Z","title":"QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:52.473530Z"},"links":{"cited_paper":"/paper/2406.16008","citing_paper":"/paper/2505.04732"},"observation_digest":"sha256:69567d7beeffac5e7377639ab79951c9d5bb9829bda69bebe2723bb5becbc46e","observation_id":"3f18707a-76b7-4eaa-9493-80357841e4d9","resolution":{"observed_at":"2026-08-15T23:25:52.473530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.01820","last_updated":"2023-05-26T22:16:38Z","snapshot_observed_at":"2026-08-17T09:17:27.905339Z","submitted_at":"2023-01-04T20:58:43Z","title":"InPars-v2: Large Language Models as Efficient Dataset Generators for Information Retrieval","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.01820","snapshot_observed_at":"2026-08-15T23:25:52.478159Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.04732","last_updated":"2025-05-07T18:43:57Z","snapshot_observed_at":"2026-08-16T06:45:15.844745Z","submitted_at":"2025-05-07T18:43:57Z","title":"QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:52.478159Z"},"links":{"cited_paper":"/paper/2301.01820","citing_paper":"/paper/2505.04732"},"observation_digest":"sha256:ca15712faaa511dc9c2f5450d4e187ef226dd1f665201297a154306ee51d9d60","observation_id":"869eb3fd-df05-4f08-ae27-ee108c5f03b5","resolution":{"observed_at":"2026-08-15T23:25:52.478159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16332","last_updated":"2024-09-25T09:36:49Z","snapshot_observed_at":"2026-08-16T13:40:17.142680Z","submitted_at":"2024-06-24T06:10:13Z","title":"DemoRank: Selecting Effective Demonstrations for Large Language Models in Ranking Task","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16332","snapshot_observed_at":"2026-08-15T23:25:52.482363Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.04732","last_updated":"2025-05-07T18:43:57Z","snapshot_observed_at":"2026-08-16T06:45:15.844745Z","submitted_at":"2025-05-07T18:43:57Z","title":"QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:52.482363Z"},"links":{"cited_paper":"/paper/2406.16332","citing_paper":"/paper/2505.04732"},"observation_digest":"sha256:3b4095b823a62a65af31059c5a744c56242529bf9642ad46726b5f15ee478210","observation_id":"34513aea-7a9d-4be5-8e46-7d1dd6bbf8ff","resolution":{"observed_at":"2026-08-15T23:25:52.482363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.16950","last_updated":"2025-01-17T03:43:53Z","snapshot_observed_at":"2026-08-16T14:06:35.535730Z","submitted_at":"2024-03-25T17:11:28Z","title":"Aligning with Human Judgement: The Role of Pairwise Preference in Large Language Model Evaluators","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.16950","snapshot_observed_at":"2026-08-15T23:25:52.486624Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.04732","last_updated":"2025-05-07T18:43:57Z","snapshot_observed_at":"2026-08-16T06:45:15.844745Z","submitted_at":"2025-05-07T18:43:57Z","title":"QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:52.486624Z"},"links":{"cited_paper":"/paper/2403.16950","citing_paper":"/paper/2505.04732"},"observation_digest":"sha256:7ff5755a8f98aa575e0f522ce5070650bd19bb19ad72bf58343cc8d6ac794d9a","observation_id":"aa8c7127-2558-4955-acec-0829f72af897","resolution":{"observed_at":"2026-08-15T23:25:52.486624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15126","last_updated":"2024-06-14T07:47:09Z","snapshot_observed_at":"2026-08-18T08:00:35.964338Z","submitted_at":"2024-06-14T07:47:09Z","title":"On LLMs-Driven Synthetic Data Generation, Curation, and Evaluation: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15126","snapshot_observed_at":"2026-08-15T23:25:52.490547Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.04732","last_updated":"2025-05-07T18:43:57Z","snapshot_observed_at":"2026-08-16T06:45:15.844745Z","submitted_at":"2025-05-07T18:43:57Z","title":"QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:52.490547Z"},"links":{"cited_paper":"/paper/2406.15126","citing_paper":"/paper/2505.04732"},"observation_digest":"sha256:3f1912b37c680c1b1f35e146c0031766b39226a28fc2c46a8c616e7ee1cfee9c","observation_id":"05625fc0-b2ff-477d-bb91-7886221e752f","resolution":{"observed_at":"2026-08-15T23:25:52.490547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14673","last_updated":"2024-10-04T22:14:09Z","snapshot_observed_at":"2026-08-18T14:27:48.024679Z","submitted_at":"2024-06-20T18:50:44Z","title":"Insights into LLM Long-Context Failures: When Transformers Know but Don't Tell","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14673","snapshot_observed_at":"2026-08-15T23:25:52.494919Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.04732","last_updated":"2025-05-07T18:43:57Z","snapshot_observed_at":"2026-08-16T06:45:15.844745Z","submitted_at":"2025-05-07T18:43:57Z","title":"QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:52.494919Z"},"links":{"cited_paper":"/paper/2406.14673","citing_paper":"/paper/2505.04732"},"observation_digest":"sha256:3dcd9167ba277183ce2b4edc390c7b372d901c3fe3079c55f343ff65034dfbfa","observation_id":"47bd2f9f-2f47-4fd0-a0bc-cb70acca1a92","resolution":{"observed_at":"2026-08-15T23:25:52.494919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:25:52.500218Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.04732","last_updated":"2025-05-07T18:43:57Z","snapshot_observed_at":"2026-08-16T06:45:15.844745Z","submitted_at":"2025-05-07T18:43:57Z","title":"QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:52.500218Z"},"links":{"citing_paper":"/paper/2505.04732"},"observation_digest":"sha256:48b7b1d74fb715b1a8751ef1ec3061be4aebef7c236b483436fa0216fb22b41d","observation_id":"581e2038-1f7b-4336-bdc9-7db60c60927c","resolution":{"observed_at":"2026-08-15T23:25:52.500218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:25:52.504275Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.04732","last_updated":"2025-05-07T18:43:57Z","snapshot_observed_at":"2026-08-16T06:45:15.844745Z","submitted_at":"2025-05-07T18:43:57Z","title":"QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:52.504275Z"},"links":{"citing_paper":"/paper/2505.04732"},"observation_digest":"sha256:c52a41f0070782897131e37c08c89ba3a098393fc324c114776c18d396d1563c","observation_id":"8293b77c-68f6-41aa-843c-bd9431cfd400","resolution":{"observed_at":"2026-08-15T23:25:52.504275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:25:53.516513Z","title":null,"venue":null,"work_id":"367d956b-502a-40fc-bba4-29c6267576fe","year":2021},"citing_paper":{"arxiv_id":"2505.04732","last_updated":"2025-05-07T18:43:57Z","snapshot_observed_at":"2026-08-16T06:45:15.844745Z","submitted_at":"2025-05-07T18:43:57Z","title":"QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:52.508097Z"},"links":{"citing_paper":"/paper/2505.04732"},"observation_digest":"sha256:b6474b8dca4d013280c7a26873f3aff4d9ccc04d4190c0e15ca24a0391968ddd","observation_id":"eda77eef-4ed6-4788-94ba-ba5740be8e6d","resolution":{"observed_at":"2026-08-15T23:25:53.521402Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:25:53.503038Z","title":null,"venue":null,"work_id":"71059223-8365-4fb7-b31b-ac8e34eead4b","year":2021},"citing_paper":{"arxiv_id":"2505.04732","last_updated":"2025-05-07T18:43:57Z","snapshot_observed_at":"2026-08-16T06:45:15.844745Z","submitted_at":"2025-05-07T18:43:57Z","title":"QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:52.512090Z"},"links":{"citing_paper":"/paper/2505.04732"},"observation_digest":"sha256:42ad61b931dcbbf250087a14d2a0b1beed4e73064818bcd24539d619b2b42946","observation_id":"0c4c94c0-4ab0-42c3-b16b-e4294c523370","resolution":{"observed_at":"2026-08-15T23:25:53.506865Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:25:53.489407Z","title":null,"venue":null,"work_id":"c69118f7-0537-49dc-a626-1cf9069fe97e","year":2024},"citing_paper":{"arxiv_id":"2505.04732","last_updated":"2025-05-07T18:43:57Z","snapshot_observed_at":"2026-08-16T06:45:15.844745Z","submitted_at":"2025-05-07T18:43:57Z","title":"QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:52.521048Z"},"links":{"citing_paper":"/paper/2505.04732"},"observation_digest":"sha256:50b4460b97bd199db38d33b45cfe16350c082236d2fa128d7ee7f5109c63209e","observation_id":"c3cbc38d-6d99-48ff-9af9-ef3d6d363fdf","resolution":{"observed_at":"2026-08-15T23:25:53.494047Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:25:53.471371Z","title":null,"venue":null,"work_id":"7245be6e-440a-40b3-9e31-05b7448b5535","year":2016},"citing_paper":{"arxiv_id":"2505.04732","last_updated":"2025-05-07T18:43:57Z","snapshot_observed_at":"2026-08-16T06:45:15.844745Z","submitted_at":"2025-05-07T18:43:57Z","title":"QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:52.524974Z"},"links":{"citing_paper":"/paper/2505.04732"},"observation_digest":"sha256:754152320a5519bfd82905996cb79a627aa5896a06d555acb25d7c281e34f059","observation_id":"3d87dd42-ba16-4aba-bb73-d987cb0e4f82","resolution":{"observed_at":"2026-08-15T23:25:53.477560Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:25:53.449722Z","title":null,"venue":null,"work_id":"b42560e8-555e-4684-a173-057689ceb7f3","year":2020},"citing_paper":{"arxiv_id":"2505.04732","last_updated":"2025-05-07T18:43:57Z","snapshot_observed_at":"2026-08-16T06:45:15.844745Z","submitted_at":"2025-05-07T18:43:57Z","title":"QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:52.528804Z"},"links":{"citing_paper":"/paper/2505.04732"},"observation_digest":"sha256:3bdff65810939a080577f7c12e7db9078054420722fc7f6ae540e6ebe5284c96","observation_id":"b84e48ee-3d03-4c52-879e-84edccc02fba","resolution":{"observed_at":"2026-08-15T23:25:53.456465Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18740","last_updated":"2024-06-26T20:12:24Z","snapshot_observed_at":"2026-08-17T21:44:49.250740Z","submitted_at":"2024-06-26T20:12:24Z","title":"Re-Ranking Step by Step: Investigating Pre-Filtering for Re-Ranking with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18740","snapshot_observed_at":"2026-08-15T23:25:52.534848Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.04732","last_updated":"2025-05-07T18:43:57Z","snapshot_observed_at":"2026-08-16T06:45:15.844745Z","submitted_at":"2025-05-07T18:43:57Z","title":"QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:52.534848Z"},"links":{"cited_paper":"/paper/2406.18740","citing_paper":"/paper/2505.04732"},"observation_digest":"sha256:d1213e8de0ca7b2e2db93a5b64702e5ee89dfdcab6d717aa37d77ab1a6029f54","observation_id":"f71b4a78-293c-43c6-9a89-b677847f97fc","resolution":{"observed_at":"2026-08-15T23:25:52.534848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.05667","last_updated":"2021-01-14T15:29:54Z","snapshot_observed_at":"2026-08-16T18:52:18.439963Z","submitted_at":"2021-01-14T15:29:54Z","title":"The Expando-Mono-Duo Design Pattern for Text Ranking with Pretrained Sequence-to-Sequence Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.05667","snapshot_observed_at":"2026-08-15T23:25:52.539442Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.04732","last_updated":"2025-05-07T18:43:57Z","snapshot_observed_at":"2026-08-16T06:45:15.844745Z","submitted_at":"2025-05-07T18:43:57Z","title":"QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:52.539442Z"},"links":{"cited_paper":"/paper/2101.05667","citing_paper":"/paper/2505.04732"},"observation_digest":"sha256:c03bca590ae947fec360f917c9541740784911b49aa5176e3e65fc7b1eaafc96","observation_id":"3f013a96-6800-4638-a3c2-1ab6de79ca3e","resolution":{"observed_at":"2026-08-15T23:25:52.539442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15088","last_updated":"2023-09-26T17:31:57Z","snapshot_observed_at":"2026-08-16T14:57:26.781760Z","submitted_at":"2023-09-26T17:31:57Z","title":"RankVicuna: Zero-Shot Listwise Document Reranking with Open-Source Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.15088","snapshot_observed_at":"2026-08-15T23:25:52.546792Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.04732","last_updated":"2025-05-07T18:43:57Z","snapshot_observed_at":"2026-08-16T06:45:15.844745Z","submitted_at":"2025-05-07T18:43:57Z","title":"QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:52.546792Z"},"links":{"cited_paper":"/paper/2309.15088","citing_paper":"/paper/2505.04732"},"observation_digest":"sha256:0d7376556c3b712b630ac88364c2614f550947ff32d492e28cd7137b746db5d5","observation_id":"f7e83a54-ca3c-4a10-8119-71c5d6b28afb","resolution":{"observed_at":"2026-08-15T23:25:52.546792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.17563","last_updated":"2024-03-28T13:59:09Z","snapshot_observed_at":"2026-08-16T15:19:46.748918Z","submitted_at":"2023-06-30T11:32:25Z","title":"Large Language Models are Effective Text Rankers with Pairwise Ranking Prompting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.17563","snapshot_observed_at":"2026-08-15T23:25:52.553380Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.04732","last_updated":"2025-05-07T18:43:57Z","snapshot_observed_at":"2026-08-16T06:45:15.844745Z","submitted_at":"2025-05-07T18:43:57Z","title":"QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:52.553380Z"},"links":{"cited_paper":"/paper/2306.17563","citing_paper":"/paper/2505.04732"},"observation_digest":"sha256:e49694cbd5f992f4ff44f77f441ed0b789f46b47790a724dc476a7292bf18d1b","observation_id":"f3ac2676-bd5e-4ab8-a33c-5dfa51f32927","resolution":{"observed_at":"2026-08-15T23:25:52.553380Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10866","last_updated":"2024-05-28T02:34:57Z","snapshot_observed_at":"2026-08-16T14:17:54.103459Z","submitted_at":"2024-02-16T18:03:42Z","title":"EcoRank: Budget-Constrained Text Re-ranking Using Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10866","snapshot_observed_at":"2026-08-15T23:25:52.557708Z","title":"S.; Meem, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.04732","last_updated":"2025-05-07T18:43:57Z","snapshot_observed_at":"2026-08-16T06:45:15.844745Z","submitted_at":"2025-05-07T18:43:57Z","title":"QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:52.557708Z"},"links":{"cited_paper":"/paper/2402.10866","citing_paper":"/paper/2505.04732"},"observation_digest":"sha256:0c00c3697f4c0dea83aa1f4941ed336595cf7fb5a9f4460c3e6cbea4f3934fc6","observation_id":"5b1e5449-53a0-42da-8ce8-e3511d007995","resolution":{"observed_at":"2026-08-15T23:25:52.557708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.13919","last_updated":"2020-12-27T11:22:25Z","snapshot_observed_at":"2026-08-16T18:55:50.879479Z","submitted_at":"2020-12-27T11:22:25Z","title":"PatentMatch: A Dataset for Matching Patent Claims & Prior Art","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.13919","snapshot_observed_at":"2026-08-15T23:25:52.562957Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.04732","last_updated":"2025-05-07T18:43:57Z","snapshot_observed_at":"2026-08-16T06:45:15.844745Z","submitted_at":"2025-05-07T18:43:57Z","title":"QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:52.562957Z"},"links":{"cited_paper":"/paper/2012.13919","citing_paper":"/paper/2505.04732"},"observation_digest":"sha256:2861567645e944d8414343a948ac5cb4f7eefef749f721652c43f3c7fa764202","observation_id":"5463517b-1741-4d34-bf06-e7524e3ec36d","resolution":{"observed_at":"2026-08-15T23:25:52.562957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:25:52.566735Z","title":"M.; Bedrick, S.; and Hersh, W","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.04732","last_updated":"2025-05-07T18:43:57Z","snapshot_observed_at":"2026-08-16T06:45:15.844745Z","submitted_at":"2025-05-07T18:43:57Z","title":"QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:52.566735Z"},"links":{"citing_paper":"/paper/2505.04732"},"observation_digest":"sha256:145a000f33a1a76f232a4b1d9a17e653c5291e7f4f4ba8383a717755bf38271e","observation_id":"194d0715-48bf-46ce-8239-ae640c54a537","resolution":{"observed_at":"2026-08-15T23:25:52.566735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07440","last_updated":"2024-11-18T01:52:49Z","snapshot_observed_at":"2026-08-17T00:27:43.185467Z","submitted_at":"2024-02-12T06:43:52Z","title":"Benchmarking and Building Long-Context Retrieval Models with LoCo and M2-BERT","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07440","snapshot_observed_at":"2026-08-15T23:25:52.576402Z","title":"Y.; Arora, S.; Guha, N.; and R \\'e , C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.04732","last_updated":"2025-05-07T18:43:57Z","snapshot_observed_at":"2026-08-16T06:45:15.844745Z","submitted_at":"2025-05-07T18:43:57Z","title":"QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:52.576402Z"},"links":{"cited_paper":"/paper/2402.07440","citing_paper":"/paper/2505.04732"},"observation_digest":"sha256:00bbce86060e35b2b406f705ed78e3464754a6d79af11661ae2aae863f6c7f48","observation_id":"9337027a-9d0d-48ae-85f0-bd4aa2dfa0a1","resolution":{"observed_at":"2026-08-15T23:25:52.576402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08663","last_updated":"2021-10-21T01:18:28Z","snapshot_observed_at":"2026-08-09T23:22:21.200279Z","submitted_at":"2021-04-17T23:29:55Z","title":"BEIR: A Heterogenous Benchmark for Zero-shot Evaluation of Information Retrieval Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08663","snapshot_observed_at":"2026-08-15T23:25:52.581851Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.04732","last_updated":"2025-05-07T18:43:57Z","snapshot_observed_at":"2026-08-16T06:45:15.844745Z","submitted_at":"2025-05-07T18:43:57Z","title":"QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:52.581851Z"},"links":{"cited_paper":"/paper/2104.08663","citing_paper":"/paper/2505.04732"},"observation_digest":"sha256:443dcf5c9ef52ede6294959f7d1ce9dc286afa6e1cdf3570b66db8bc46a1c1f5","observation_id":"d3491e17-4c37-4b43-8a5a-a923895b54a5","resolution":{"observed_at":"2026-08-15T23:25:52.581851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:25:53.404160Z","title":null,"venue":null,"work_id":"53b66339-1761-4063-9741-728c56347552","year":2006},"citing_paper":{"arxiv_id":"2505.04732","last_updated":"2025-05-07T18:43:57Z","snapshot_observed_at":"2026-08-16T06:45:15.844745Z","submitted_at":"2025-05-07T18:43:57Z","title":"QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:52.588346Z"},"links":{"citing_paper":"/paper/2505.04732"},"observation_digest":"sha256:85fb1db677f63b81881118ecd854a01aca357b1e21309c4b4f1f58735d79ecba","observation_id":"7bebc28c-d0ce-474d-a352-87a4014091f0","resolution":{"observed_at":"2026-08-15T23:25:53.408403Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:25:53.387424Z","title":"R.; Lo, K.; Roberts, K.; Soboroff, I.; and Wang, L","venue":null,"work_id":"7f62e542-8997-44c5-afb4-2f4c2d2dcc30","year":2021},"citing_paper":{"arxiv_id":"2505.04732","last_updated":"2025-05-07T18:43:57Z","snapshot_observed_at":"2026-08-16T06:45:15.844745Z","submitted_at":"2025-05-07T18:43:57Z","title":"QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:52.594580Z"},"links":{"citing_paper":"/paper/2505.04732"},"observation_digest":"sha256:b0f245c2324c531bde3d5dee8b3d6e11aeed32d7a9385fb916dab3ab18732ffc","observation_id":"b1ca2d0a-4b48-40f3-972a-10ec90d13db9","resolution":{"observed_at":"2026-08-15T23:25:53.393578Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:25:53.367806Z","title":null,"venue":null,"work_id":"f73a157e-184a-4478-a4ec-0aa419633c19","year":2024},"citing_paper":{"arxiv_id":"2505.04732","last_updated":"2025-05-07T18:43:57Z","snapshot_observed_at":"2026-08-16T06:45:15.844745Z","submitted_at":"2025-05-07T18:43:57Z","title":"QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:52.599711Z"},"links":{"citing_paper":"/paper/2505.04732"},"observation_digest":"sha256:44882dc617a62894dd2a57b0c1dc36a840503c6adbb89688428adde9a9a1243f","observation_id":"0f8d2ea0-8f15-4cd2-8291-2024af500829","resolution":{"observed_at":"2026-08-15T23:25:53.373700Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12598","last_updated":"2025-02-18T07:15:28Z","snapshot_observed_at":"2026-08-17T01:03:14.241595Z","submitted_at":"2025-02-18T07:15:28Z","title":"Bring Your Own Knowledge: A Survey of Methods for LLM Knowledge Expansion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.12598","snapshot_observed_at":"2026-08-15T23:25:52.605370Z","title":"u tze, H.; and Str \\","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.04732","last_updated":"2025-05-07T18:43:57Z","snapshot_observed_at":"2026-08-16T06:45:15.844745Z","submitted_at":"2025-05-07T18:43:57Z","title":"QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:52.605370Z"},"links":{"cited_paper":"/paper/2502.12598","citing_paper":"/paper/2505.04732"},"observation_digest":"sha256:a8ac6460a6c70a51e66c05320b2754476153d2b840dc6c62ad84bb2b2b8a767e","observation_id":"8b3330e1-77bb-4c17-afd3-5b26791bdeb4","resolution":{"observed_at":"2026-08-15T23:25:52.605370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:25:53.344204Z","title":null,"venue":null,"work_id":"c7860aec-144a-41f7-a354-ed5f6c8425fd","year":2016},"citing_paper":{"arxiv_id":"2505.04732","last_updated":"2025-05-07T18:43:57Z","snapshot_observed_at":"2026-08-16T06:45:15.844745Z","submitted_at":"2025-05-07T18:43:57Z","title":"QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:52.609542Z"},"links":{"citing_paper":"/paper/2505.04732"},"observation_digest":"sha256:b9ee6fe855fb70961b7051daec173ff34e10068cf78c0bb3fcda9697560800b0","observation_id":"a2f6ff7d-80e8-40bd-bd81-23264d78bc1d","resolution":{"observed_at":"2026-08-15T23:25:53.350058Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.00287","last_updated":"2025-01-24T23:46:07Z","snapshot_observed_at":"2026-08-16T14:46:59.036907Z","submitted_at":"2023-11-01T04:37:28Z","title":"Knowledge-Infused Prompting: Assessing and Advancing Clinical Text Data Generation with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.00287","snapshot_observed_at":"2026-08-15T23:25:52.613724Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.04732","last_updated":"2025-05-07T18:43:57Z","snapshot_observed_at":"2026-08-16T06:45:15.844745Z","submitted_at":"2025-05-07T18:43:57Z","title":"QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:52.613724Z"},"links":{"cited_paper":"/paper/2311.00287","citing_paper":"/paper/2505.04732"},"observation_digest":"sha256:78c1bf1f5a9cdb22e95e8bf61850bd3b71cf6e3b913fc765e91bab88fd719307","observation_id":"77d9702b-0c81-4732-a669-b834022c52f7","resolution":{"observed_at":"2026-08-15T23:25:52.613724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:25:53.327654Z","title":null,"venue":null,"work_id":"aae3a1a7-884f-4e13-acdd-d2a6a4b66d42","year":2024},"citing_paper":{"arxiv_id":"2505.04732","last_updated":"2025-05-07T18:43:57Z","snapshot_observed_at":"2026-08-16T06:45:15.844745Z","submitted_at":"2025-05-07T18:43:57Z","title":"QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:52.619533Z"},"links":{"citing_paper":"/paper/2505.04732"},"observation_digest":"sha256:a727ac2176e2d4402450f262a3b47de2eaf354430ad59f8cfeae89d22c192a90","observation_id":"58666fe9-4c88-4810-a6ad-c931f148c3bc","resolution":{"observed_at":"2026-08-15T23:25:53.332283Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:25:53.309891Z","title":null,"venue":null,"work_id":"4dc912fa-4086-48d3-a580-d2d2c28c8266","year":2018},"citing_paper":{"arxiv_id":"2505.04732","last_updated":"2025-05-07T18:43:57Z","snapshot_observed_at":"2026-08-16T06:45:15.844745Z","submitted_at":"2025-05-07T18:43:57Z","title":"QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:52.626952Z"},"links":{"citing_paper":"/paper/2505.04732"},"observation_digest":"sha256:5fe6991ec286cdd4f673c7422010c5a42e47982c5b3b282b09c3b56f4e3606ce","observation_id":"0a9d0c0a-e2d1-46ed-9e41-d74445105eca","resolution":{"observed_at":"2026-08-15T23:25:53.316004Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07573","last_updated":"2024-12-24T02:09:03Z","snapshot_observed_at":"2026-08-11T18:40:14.736041Z","submitted_at":"2024-12-10T15:06:48Z","title":"Subtopic-aware View Sampling and Temporal Aggregation for Long-form Document Matching","version":2},"cited_work":{"arxiv_id":"2412.07573","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.07573","snapshot_observed_at":"2026-08-15T23:25:52.783908Z","title":"Subtopic-aware View Sampling and Temporal Aggregation for Long-form Document Matching","venue":"cs.IR","work_id":"277fe0b4-3616-4a06-978e-6122c9a3c225","year":2024},"citing_paper":{"arxiv_id":"2505.04732","last_updated":"2025-05-07T18:43:57Z","snapshot_observed_at":"2026-08-16T06:45:15.844745Z","submitted_at":"2025-05-07T18:43:57Z","title":"QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:52.632018Z"},"links":{"cited_paper":"/paper/2412.07573","citing_paper":"/paper/2505.04732"},"observation_digest":"sha256:6e1cda029578d9444dd07e327dbdb8846073850e9e245a4394d19e22a2f725ed","observation_id":"7448539f-0d50-49da-8f42-2a014c499f16","resolution":{"observed_at":"2026-08-15T23:25:52.793581Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:25:52.638353Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.04732","last_updated":"2025-05-07T18:43:57Z","snapshot_observed_at":"2026-08-16T06:45:15.844745Z","submitted_at":"2025-05-07T18:43:57Z","title":"QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:52.638353Z"},"links":{"citing_paper":"/paper/2505.04732"},"observation_digest":"sha256:8999a85a0c5bba6a0fcc92299a1434e3754a952fa264b83ae09c1d3927944d64","observation_id":"8733e46e-89bf-49fc-a05a-e62e44117939","resolution":{"observed_at":"2026-08-15T23:25:52.638353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:25:53.284570Z","title":null,"venue":null,"work_id":"59a3f8b4-0384-4615-ad69-f6177a90df34","year":2023},"citing_paper":{"arxiv_id":"2505.04732","last_updated":"2025-05-07T18:43:57Z","snapshot_observed_at":"2026-08-16T06:45:15.844745Z","submitted_at":"2025-05-07T18:43:57Z","title":"QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:52.643259Z"},"links":{"citing_paper":"/paper/2505.04732"},"observation_digest":"sha256:a1e046baf9b925affb11746d81f06cb34b15da3c8616b88eab3f470426592b26","observation_id":"5ac484e7-e017-4f90-a004-7e38f006bc57","resolution":{"observed_at":"2026-08-15T23:25:53.292941Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.04732","last_updated":"2025-05-07T18:43:57Z","latest_version":1,"primary_category":"cs.IR","snapshot_observed_at":"2026-08-16T06:45:15.844745Z","submitted_at":"2025-05-07T18:43:57Z","title":"QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort"},"reference_resolution":{"displayed":55,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":48,"verified_exact":2,"verified_fuzzy":5},"total_outbound_references":55},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 55 of 55 outbound references and 0 inbound Pith citation observations for arXiv:2505.04732."}