{"as_of":"2026-08-22T01:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:14f615e7dfeaf82e99f11ab1cec442001652d33ee0258fd5eda9388f941d8e73","coverage":[{"denominator":48,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":48,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:42:41.769511Z","state":"measured"},{"denominator":51,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":51,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-30T11:07:25.667648Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T10:45:42.818877Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-15T05:44:48.071906Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"cited_work":{"arxiv_id":"2505.14212","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14212","snapshot_observed_at":"2026-07-01T10:45:42.818877Z","title":"arXiv preprint arXiv:2505.14212 , year=","venue":null,"work_id":"1b3c71c1-c209-4b07-aa73-7408c8d1a4ae","year":2025},"citing_paper":{"arxiv_id":"2604.17943","last_updated":"2026-05-27T05:56:37Z","snapshot_observed_at":"2026-08-15T08:05:46.041245Z","submitted_at":"2026-04-20T08:22:15Z","title":"A Benchmark Construction and Evaluation Framework for Specialist Domains: Case Study on Defense-related Documents","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-05-10T04:51:28.638793Z"},"links":{"cited_paper":"/paper/2505.14212","citing_paper":"/paper/2604.17943"},"observation_digest":"sha256:8802addd1944db8152217b3d33a73a9fc47758e02e41f1ca4dc900977d5886b6","observation_id":"eeaa444b-e0dc-4ac3-9ca2-7a2b5c0d1402","resolution":{"observed_at":"2026-05-10T11:30:19.560054Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-15T05:44:48.071906Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"cited_work":{"arxiv_id":"2505.14212","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14212","snapshot_observed_at":"2026-07-01T10:45:42.818877Z","title":"arXiv preprint arXiv:2505.14212 , year=","venue":null,"work_id":"1b3c71c1-c209-4b07-aa73-7408c8d1a4ae","year":2025},"citing_paper":{"arxiv_id":"2606.32002","last_updated":"2026-06-30T17:35:14Z","snapshot_observed_at":"2026-08-15T03:04:10.151243Z","submitted_at":"2026-06-30T17:35:14Z","title":"Self-Study Reconsidered: The Hidden Fragility of Learning from Self-Generated QA","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-01T05:07:58.441326Z"},"links":{"cited_paper":"/paper/2505.14212","citing_paper":"/paper/2606.32002"},"observation_digest":"sha256:e08578404db4724db01c48830f6dffe6fceb254d9defa0f0c2f84ef92d2fb40f","observation_id":"d9a7987f-303e-4fd2-9401-33766b320323","resolution":{"observed_at":"2026-07-01T10:45:42.820233Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-15T05:44:48.071906Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14212","snapshot_observed_at":"2026-07-30T11:07:25.667648Z","title":"Automatic dataset generation for knowledge intensive question answering tasks,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27182","last_updated":"2026-07-29T17:52:53Z","snapshot_observed_at":"2026-08-15T07:05:42.277208Z","submitted_at":"2026-07-29T17:52:53Z","title":"GraphQAG: A Knowledge-Graph-Guided Visual Analytics Framework for Question-Answer Pairs Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-30T11:07:25.667648Z"},"links":{"cited_paper":"/paper/2505.14212","citing_paper":"/paper/2607.27182"},"observation_digest":"sha256:a04b2b2154ebc53d26f4fa08e13c7053c11d868918c777f3864d0ab3495452d0","observation_id":"afd2a806-9d73-4379-9da8-64ad15f8d019","resolution":{"observed_at":"2026-07-30T11:07:25.667648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.14212/citation-record","integrity":"/paper/2505.14212/integrity","json":"/paper/2505.14212/citation-record.json","paper":"/paper/2505.14212"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:45.928908Z","title":"A bert baseline for the natural questions","venue":null,"work_id":"ee947eaa-261d-4242-b2ef-83d9103399c1","year":2019},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-15T05:44:48.071906Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:36.973217Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:c9aacd07c6aecb4490b977121ce1d0a5e75c489940365303d1521254d275391c","observation_id":"883f2447-cdd6-4e91-a1ce-e4c60fea91d8","resolution":{"observed_at":"2026-08-07T15:42:45.992196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:45.692745Z","title":"Self-RAG: Learning to retrieve, generate, and critique through self-reflection","venue":null,"work_id":"db786b3b-90e4-4fb5-a58a-c37371ddb084","year":2024},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-15T05:44:48.071906Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:37.098029Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:27c88046e6556f4df8d19c1ccd90ba39656bb6f7682961265fbcbe0a4364f773","observation_id":"83f50275-8c56-4628-8269-31f3c292f8ea","resolution":{"observed_at":"2026-08-07T15:42:45.757436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.08406","last_updated":"2024-01-30T13:55:34Z","snapshot_observed_at":"2026-08-16T14:27:06.444067Z","submitted_at":"2024-01-16T14:44:47Z","title":"RAG vs Fine-tuning: Pipelines, Tradeoffs, and a Case Study on Agriculture","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.08406","snapshot_observed_at":"2026-08-07T15:42:37.200193Z","title":"Estevão Filho, Todd Hendry, Daniel Holstein, Jennifer Marsman, Nick Mecklenburg, Sara Malvar, Leonardo O","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-15T05:44:48.071906Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:37.200193Z"},"links":{"cited_paper":"/paper/2401.08406","citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:c651c6824f1f65c76dd2581fc96ab63b4c3fe429a0097d7e18ba4910d38dff3b","observation_id":"ca39461f-c058-42d9-89d4-e561298ec2c3","resolution":{"observed_at":"2026-08-07T15:42:37.200193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.05856","last_updated":"2024-01-11T12:04:11Z","snapshot_observed_at":"2026-08-16T14:28:14.835680Z","submitted_at":"2024-01-11T12:04:11Z","title":"Seven Failure Points When Engineering a Retrieval Augmented Generation System","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.05856","snapshot_observed_at":"2026-08-07T15:42:37.271291Z","title":"Seven failure points when engineering a retrieval augmented generation system, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-15T05:44:48.071906Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:37.271291Z"},"links":{"cited_paper":"/paper/2401.05856","citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:4dd997c00a5904fbf67b0a1efab1723230b07338fa77e3ad085580df71dda51c","observation_id":"dd170161-37f0-4969-b722-c72937590584","resolution":{"observed_at":"2026-08-07T15:42:37.271291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:37.366055Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-15T05:44:48.071906Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:37.366055Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:241b5c59a2495645a107cfd04152315efdd2ec332c27240a966bfa1fac7f13e7","observation_id":"3ea29277-ef8a-4336-a335-707891d956e3","resolution":{"observed_at":"2026-08-07T15:42:37.366055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-07T15:42:37.430426Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-15T05:44:48.071906Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:37.430426Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:8dfb60cbf953350b4d2bb852126a260481942904ef71eedd1373f0b2b530b64c","observation_id":"0d601c7b-8cbc-4cb2-abda-a3c6b8e0aea8","resolution":{"observed_at":"2026-08-07T15:42:37.430426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:37.540607Z","title":"The TechQA dataset","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-15T05:44:48.071906Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:37.540607Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:587b5a60081988ae0cc68ee74075662862b32a38f15e7cabae1d032da32a83d7","observation_id":"c64f706d-1e08-4ef6-b426-535fd1b856ce","resolution":{"observed_at":"2026-08-07T15:42:37.540607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:45.449907Z","title":"Legal-bert: The muppets straight out of law school","venue":null,"work_id":"abb56671-c431-4c23-aac5-57f07640a293","year":2020},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-15T05:44:48.071906Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:37.676038Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:ed64095d32c97d5a9f9a0235877e7094495988421622d7cb988623f9f48b60c1","observation_id":"e4fd9083-19f5-48eb-bf40-16f9b1087172","resolution":{"observed_at":"2026-08-07T15:42:45.541323Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:37.774638Z","title":"Reading Wikipedia to answer open-domain questions","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-15T05:44:48.071906Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:37.774638Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:a9baf62da829ff8ac1022e2032d19b866fcffc379716642fa8830045e3f522a1","observation_id":"0021b0f8-e8f2-41f5-9f00-adbd17bedbb1","resolution":{"observed_at":"2026-08-07T15:42:37.774638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:45.230249Z","title":"Dialog inpainting: Turning documents to dialogs","venue":null,"work_id":"3404d6f4-082f-4f01-966b-d66a389b265f","year":2022},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-15T05:44:48.071906Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:37.895457Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:46e4860d4109997a2056d53603e490abcf1204acdefe43bd7228c1a5a56c8041","observation_id":"872002b5-8c2f-4c60-b592-04e8b037ce88","resolution":{"observed_at":"2026-08-07T15:42:45.334160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:45.051110Z","title":"Unsloth, 2023","venue":null,"work_id":"e1febb5c-eddf-4d33-8af9-a6e872caba0d","year":2023},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-15T05:44:48.071906Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:37.956956Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:3a28232f1e0ca43f672f6970410e475bcbfdadb040b2083f46d76ae67e21474b","observation_id":"5c4d2bce-3afd-4cb0-a92c-f7b844f20dea","resolution":{"observed_at":"2026-08-07T15:42:45.163237Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14314","last_updated":"2023-05-23T17:50:33Z","snapshot_observed_at":"2026-08-20T16:10:20.713555Z","submitted_at":"2023-05-23T17:50:33Z","title":"QLoRA: Efficient Finetuning of Quantized LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14314","snapshot_observed_at":"2026-08-07T15:42:38.104744Z","title":"Qlora: Efficient finetuning of quantized llms, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-15T05:44:48.071906Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:38.104744Z"},"links":{"cited_paper":"/paper/2305.14314","citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:fc5264680ad7ba108cd73dfbc4420e064012f86e232699c7215e54100c658c9f","observation_id":"ea3b9f92-27c1-4202-a383-9ab2cab21d32","resolution":{"observed_at":"2026-08-07T15:42:38.104744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-08-14T18:16:28.847993Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-07T15:42:38.208343Z","title":"Bert: Pre-training of deep bidirec- tional transformers for language understanding.arXiv preprint arXiv:1810.04805, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-15T05:44:48.071906Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:38.208343Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:aa458c8b17896ff3365a0ab6603b7f4317bd4ae1f84dc0972cbe01754bc48ab5","observation_id":"aadc6bb6-0e39-492a-b903-a1162bd243f6","resolution":{"observed_at":"2026-08-07T15:42:38.208343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10496","last_updated":"2022-12-20T18:09:52Z","snapshot_observed_at":"2026-08-18T06:38:59.553305Z","submitted_at":"2022-12-20T18:09:52Z","title":"Precise Zero-Shot Dense Retrieval without Relevance Labels","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10496","snapshot_observed_at":"2026-08-07T15:42:38.323013Z","title":"Precise zero-shot dense retrieval without relevance labels, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-15T05:44:48.071906Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:38.323013Z"},"links":{"cited_paper":"/paper/2212.10496","citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:77e5392efdd0856ebd473a600a715615958c742677d49ce7566dadfe1b6abfed","observation_id":"31a48569-3b1d-4a5c-9b96-e00af5550e78","resolution":{"observed_at":"2026-08-07T15:42:38.323013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10997","last_updated":"2024-03-27T09:16:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-18T07:47:33Z","title":"Retrieval-Augmented Generation for Large Language Models: A Survey","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10997","snapshot_observed_at":"2026-08-07T15:42:38.423678Z","title":"Retrieval-augmented generation for large language models: A survey, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-15T05:44:48.071906Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:38.423678Z"},"links":{"cited_paper":"/paper/2312.10997","citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:4fecd5581503d6b6532861261c6eb370ba356da74e83afc57ef639bf2158bf3a","observation_id":"7901d312-a284-4e0f-99cd-3e60c283a006","resolution":{"observed_at":"2026-08-07T15:42:38.423678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:44.918353Z","title":"Re2g: Retrieve, rerank, generate","venue":null,"work_id":"4e363b43-6956-42d1-a928-f0e79f9188c9","year":2022},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-15T05:44:48.071906Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:38.494922Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:769817a96b0ee1b8239984ffed2dbddb8652e8a7a54593e81d6e07555f10e41b","observation_id":"f2e4f2ac-d485-4bc0-ad45-8220d626ddb2","resolution":{"observed_at":"2026-08-07T15:42:44.994942Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T15:42:38.597842Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-15T05:44:48.071906Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:38.597842Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:f70d151e50d8b72bfc0314246c906f8c2d7ee4ccc9fc4011b44a6bf6551be6c4","observation_id":"e5f892c8-b6b6-4993-b427-575ef4b3688a","resolution":{"observed_at":"2026-08-07T15:42:38.597842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:42.383363Z","title":"Evaluating large language models in generating synthetic hci research data: a case study","venue":null,"work_id":"f7e9d28f-310a-46d2-a7ea-3579b4c65a94","year":2023},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-15T05:44:48.071906Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:38.709033Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:60737e670e8bbf8e53417ef84fa21b34b69ff95db54806776d1060c6c8c8bfac","observation_id":"87de8dff-a5e6-4bb2-b29d-08b3ef5f86d0","resolution":{"observed_at":"2026-08-07T15:42:42.436498Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:44.732015Z","title":"Retrieve, annotate, evaluate, repeat: Leveraging multimodal llms for large-scale product retrieval evaluation,","venue":null,"work_id":"2090df6b-25f6-4e25-b330-45329d189dc9","year":null},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-15T05:44:48.071906Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:38.798538Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:720bd42a9aeb09dc044532b6f0acdc4e149a7a65c3217177d4417eb3abdfbab4","observation_id":"3ffc02e1-5c2a-4978-b6de-8bbc44805849","resolution":{"observed_at":"2026-08-07T15:42:44.807141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-20T11:47:17.477107Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-07T15:42:38.951239Z","title":"Hu, Yelong Shen, Phillip Wallis, Zeyuan Allen-Zhu, Yuanzhi Li, Shean Wang, Lu Wang, and Weizhu Chen","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-15T05:44:48.071906Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:38.951239Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:fbfd5ad554356a483922cfd6309cf08939b31a686877180dc050c27f90c35eb1","observation_id":"f08ec513-4fb1-4d70-9d52-be6861f8e631","resolution":{"observed_at":"2026-08-07T15:42:38.951239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2007.01282","last_updated":"2021-02-03T09:18:34Z","snapshot_observed_at":"2026-08-18T00:05:48.019000Z","submitted_at":"2020-07-02T17:44:57Z","title":"Leveraging Passage Retrieval with Generative Models for Open Domain Question Answering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.01282","snapshot_observed_at":"2026-08-07T15:42:39.041590Z","title":"Leveraging passage retrieval with generative models for open domain question answering, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-15T05:44:48.071906Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:39.041590Z"},"links":{"cited_paper":"/paper/2007.01282","citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:b429baca42656cfcaed38db60ba63546529227cc5be299b925ab7479bca2a29d","observation_id":"72f2d793-f29d-4dc3-a963-78f46bbbb289","resolution":{"observed_at":"2026-08-07T15:42:39.041590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:39.151195Z","title":"Perplexity—a measure of the difficulty of speech recognition tasks.The Journal of the Acoustical Society of America, 62(S1):S63–S63, 1977","venue":null,"work_id":null,"year":1977},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-15T05:44:48.071906Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:39.151195Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:65fb26f758909000ae3b955ce1fb1cc889955b964dc81008f14b237fc3ebaed3","observation_id":"1eb595b0-13ea-4f15-8124-23b8988bc241","resolution":{"observed_at":"2026-08-07T15:42:39.151195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:44.602392Z","title":"Adaptive-rag: Learning to adapt retrieval-augmented large language models through question complexity","venue":null,"work_id":"de4e7995-37be-48d0-bf34-caf4f031b4c6","year":2024},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-15T05:44:48.071906Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:39.239093Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:bd89a813d1bdace1a78a56e634a8df2e902af47d94524160fbeb293c2e9eb058","observation_id":"102530bd-8e0f-4fa2-8d44-c991067c27b6","resolution":{"observed_at":"2026-08-07T15:42:44.658777Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-08-17T20:30:34.016254Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-07T15:42:39.438054Z","title":"Mistral 7b (2023).arXiv preprint arXiv:2310.06825, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-15T05:44:48.071906Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:39.438054Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:f0ce5db5cf6e2832bb3e7bfab0ac4f923ed536fadc137ef7d59925e16ad8953e","observation_id":"f073ddd3-6836-4d19-a9f6-cc42f293d988","resolution":{"observed_at":"2026-08-07T15:42:39.438054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:39.512000Z","title":"Weld, and Luke Zettlemoyer","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-15T05:44:48.071906Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:39.512000Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:b66d8a71f121b35efa63ba837d1723e8ec10bfc200782c1e3bf5eb1d32d1796b","observation_id":"439054b6-2f3f-4481-b59a-806469cfd443","resolution":{"observed_at":"2026-08-07T15:42:39.512000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04906","last_updated":"2020-09-30T21:27:13Z","snapshot_observed_at":"2026-07-06T09:11:26.109763Z","submitted_at":"2020-04-10T04:53:17Z","title":"Dense Passage Retrieval for Open-Domain Question Answering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.04906","snapshot_observed_at":"2026-08-07T15:42:39.611689Z","title":"Dense passage retrieval for open-domain question answering, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-15T05:44:48.071906Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:39.611689Z"},"links":{"cited_paper":"/paper/2004.04906","citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:ce7375f5ce575137c187abba9d473a41caafe949613859f1bc4aa236577141ea","observation_id":"878fe62c-97d1-490b-aa8b-f603eff3e4b0","resolution":{"observed_at":"2026-08-07T15:42:39.611689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:44.455422Z","title":"Bart: Denoising sequence-to-sequence pre-training for natural language generation, translation, and comprehension","venue":null,"work_id":"9a1eb314-f606-4c9a-92ef-867ddfb36de2","year":2020},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-15T05:44:48.071906Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:39.706834Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:590218de8aa59aa8c7b077deb7569047d806b66de620163b8f842a1f6ef87d3f","observation_id":"7a44a33d-1abb-4ec6-90a9-0d378d35fc2c","resolution":{"observed_at":"2026-08-07T15:42:44.517065Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:39.822638Z","title":"Retrieval-augmented generation for knowledge- intensive nlp tasks.Advances in Neural Information Processing Systems, 33:9459–9474, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-15T05:44:48.071906Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:39.822638Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:0a8aa76a08bfc46d236c0bb5b8915ba55bfd234983a983b6d2e8b44bd134a7e2","observation_id":"2aa0f8d1-c564-4a56-bf0a-bd007209b014","resolution":{"observed_at":"2026-08-07T15:42:39.822638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:44.275789Z","title":"Synthetic data generation with large language models for text classification: Potential and limitations, 2023","venue":null,"work_id":"0d3eaed0-9987-4ff5-919f-46cc7bf15789","year":2023},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-15T05:44:48.071906Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:39.919423Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:6e761b23043e3c53f65c507a4efa5ddc5b393d30ceee571850e7f5611c7a0615","observation_id":"47d9b97e-b580-45e9-82bd-be61bc545d83","resolution":{"observed_at":"2026-08-07T15:42:44.361996Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:39.989028Z","title":"Rouge: A package for automatic evaluation of summaries","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-15T05:44:48.071906Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:39.989028Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:593638249bb4c7244a8183b88c3c0765d3cee0d5641c00b21ed009a23c0aba23","observation_id":"14e58741-4e7b-4c09-8ca1-66ffb88798e3","resolution":{"observed_at":"2026-08-07T15:42:39.989028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:44.135458Z","title":"RA-DIT: Retrieval- augmented dual instruction tuning","venue":null,"work_id":"ecf797cf-135b-40e9-a347-95919d44e501","year":null},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-15T05:44:48.071906Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:40.062575Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:01e56a361a16c85df986bf02162a53d890fcdded89af497d35e52e9cf4649e51","observation_id":"ad93998d-cbe7-4d35-b0c7-6708318199d0","resolution":{"observed_at":"2026-08-07T15:42:44.187043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14283","last_updated":"2023-10-23T02:34:49Z","snapshot_observed_at":"2026-08-19T03:13:59.590614Z","submitted_at":"2023-05-23T17:27:50Z","title":"Query Rewriting for Retrieval-Augmented Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14283","snapshot_observed_at":"2026-08-07T15:42:40.223793Z","title":"Query rewriting for retrieval-augmented large language models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-15T05:44:48.071906Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:40.223793Z"},"links":{"cited_paper":"/paper/2305.14283","citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:6d89ba3cbe5a5e3e774949de2f108b807cf119c0446e6a22c5cdb889e4a3c35b","observation_id":"8706be44-2056-423f-a05a-14dc3a253a0b","resolution":{"observed_at":"2026-08-07T15:42:40.223793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:43.934343Z","title":null,"venue":null,"work_id":"824c60ad-7d95-47ec-a490-a8bc83d16698","year":null},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-15T05:44:48.071906Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:40.159221Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:aefe101d3daad803c594e87e474d08262812e5776288fd61b546ca24c797baac","observation_id":"109f26a5-9217-4b9b-ab1c-4de610b46857","resolution":{"observed_at":"2026-08-07T15:42:44.018366Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.05934","last_updated":"2024-01-30T11:58:10Z","snapshot_observed_at":"2026-08-17T13:43:49.391827Z","submitted_at":"2023-12-10T16:52:00Z","title":"Fine-Tuning or Retrieval? Comparing Knowledge Injection in LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.05934","snapshot_observed_at":"2026-08-07T15:42:40.407545Z","title":"Fine-tuning or retrieval? comparing knowledge injection in llms, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-15T05:44:48.071906Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:40.407545Z"},"links":{"cited_paper":"/paper/2312.05934","citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:22eac4caae281bcb5d5ebc839344276e7d02c868ecd80f8b07319248003e017e","observation_id":"7396d248-b413-4692-902e-4641d776686c","resolution":{"observed_at":"2026-08-07T15:42:40.407545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:40.310149Z","title":"Synthetic data generation using large language models: Advances in text and code, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-15T05:44:48.071906Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:40.310149Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:f40c0f2d0d994a34e71b57bad5a095a814004fa82e40fc6bf7a44bc300a2e99f","observation_id":"8baded44-eb95-426e-adb2-b9f063e32362","resolution":{"observed_at":"2026-08-07T15:42:40.310149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:43.629105Z","title":"Replug: Retrieval-augmented black-box language models","venue":null,"work_id":"ddfd52ee-7686-4d2c-a9c4-f173d4d57722","year":2024},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-15T05:44:48.071906Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:40.597237Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:cdbac6ac21bd06351141c355a21aa36b2513cb8aa2250fecf21276148ce86d2c","observation_id":"b79e5b7d-7dad-4dea-9f85-e6cbd58a05e3","resolution":{"observed_at":"2026-08-07T15:42:43.728246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:43.793587Z","title":"Bleu: a method for automatic evaluation of machine translation","venue":null,"work_id":"518e1ca9-308f-42f9-b4bd-11719a8b0b1e","year":2002},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-15T05:44:48.071906Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:40.477085Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:e7d5ab8f2ca156da27f6e8211b6af77a22a4decfec822756f6264937262450e9","observation_id":"ca6187f5-5525-4c81-8e78-61a9c5c3c2b2","resolution":{"observed_at":"2026-08-07T15:42:43.871340Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.15391","last_updated":"2024-01-27T11:41:48Z","snapshot_observed_at":"2026-08-13T01:06:03.395715Z","submitted_at":"2024-01-27T11:41:48Z","title":"MultiHop-RAG: Benchmarking Retrieval-Augmented Generation for Multi-Hop Queries","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.15391","snapshot_observed_at":"2026-08-07T15:42:40.814274Z","title":"Multihop-rag: Benchmarking retrieval-augmented generation for multi-hop queries, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-15T05:44:48.071906Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:40.814274Z"},"links":{"cited_paper":"/paper/2401.15391","citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:58c1228667b6e26bdf3c40f75705bf525915b2dddd234c7b70ea93117d0110fe","observation_id":"1940c952-2775-44e0-af51-091bd059c073","resolution":{"observed_at":"2026-08-07T15:42:40.814274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.11517","last_updated":"2021-06-22T03:17:59Z","snapshot_observed_at":"2026-08-16T18:15:27.570637Z","submitted_at":"2021-06-22T03:17:59Z","title":"Fine-tune the Entire RAG Architecture (including DPR retriever) for Question-Answering","version":1},"cited_work":{"arxiv_id":"2106.11517","doi":null,"metadata_source":"pith","pith_arxiv_id":"2106.11517","snapshot_observed_at":"2026-08-07T15:42:41.907820Z","title":"Fine-tune the Entire RAG Architecture (including DPR retriever) for Question-Answering","venue":"cs.IR","work_id":"1fb3bc64-e534-49dc-ad6a-0bbc7289ee0f","year":2021},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-15T05:44:48.071906Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:40.723536Z"},"links":{"cited_paper":"/paper/2106.11517","citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:673d0d8cebbff237f0cfa1be57eef0deccaedafa05a92c114d6170c4473777d1","observation_id":"a32d2a33-f545-466c-9c95-e9cd0a15d681","resolution":{"observed_at":"2026-08-07T15:42:41.944474Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07176","last_updated":"2025-05-31T04:07:21Z","snapshot_observed_at":"2026-08-19T14:35:17.948672Z","submitted_at":"2024-10-09T17:59:58Z","title":"Astute RAG: Overcoming Imperfect Retrieval Augmentation and Knowledge Conflicts for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07176","snapshot_observed_at":"2026-08-07T15:42:41.009889Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-15T05:44:48.071906Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:41.009889Z"},"links":{"cited_paper":"/paper/2410.07176","citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:91b03b859cddf8b8b198b47bb6776e6cd107e11adb457a78cd48ceba5d867f0b","observation_id":"bb6cfa74-840c-4a20-ab11-31254aa7f71a","resolution":{"observed_at":"2026-08-07T15:42:41.009889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:40.916194Z","title":"Attention is all you need.Advances in neural information processing systems, 30, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-15T05:44:48.071906Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:40.916194Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:ce09daca9d64257f7f3b7ed752865537c711a43e61ccc406cf4217c76cafb045","observation_id":"3362cb33-a730-403e-9b8b-e2e28732e26c","resolution":{"observed_at":"2026-08-07T15:42:40.916194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:43.262447Z","title":"Cohen, Ruslan Salakhutdinov, and Christopher D","venue":null,"work_id":"b9bc006c-96e9-4a95-8a51-e27d24fbe584","year":2018},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-15T05:44:48.071906Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:41.324026Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:56439754f5350c3074cd7f5702ded0ec12e077a3262fa204e9dba3f0891103c8","observation_id":"60f8bb13-fe9a-49ad-a2b8-92a0b2112bf6","resolution":{"observed_at":"2026-08-07T15:42:43.340041Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:43.450043Z","title":"Towards system 2 reasoning in llms: Learning how to think with meta chain-of-thought,","venue":null,"work_id":"ac0ef7f1-d177-43b5-ba97-ef889338a2ff","year":null},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-15T05:44:48.071906Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:41.140068Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:db6dea05cde07ff73d3e6ad8d405de1da46698c833e8c99858f531341daeb9a5","observation_id":"f3706b0f-9452-4ba3-a236-bce2058023bb","resolution":{"observed_at":"2026-08-07T15:42:43.550612Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:42.814606Z","title":"Limitations","venue":null,"work_id":"403c40be-c24a-41a4-a933-84c83b7b19c4","year":2020},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-15T05:44:48.071906Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:41.601093Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:05e35591eccb74cd73ce9a686e6e0920f78c881a4317bd4197b65c5b14236579","observation_id":"5959e0aa-7424-4e59-9da2-53b1da599da6","resolution":{"observed_at":"2026-08-07T15:42:42.895189Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:43.040712Z","title":"Boosting conversational question answering with fine-grained retrieval-augmentation and self-check","venue":null,"work_id":"624cad7f-9b7f-48be-874c-d542a87cf68d","year":2024},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-15T05:44:48.071906Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:41.427031Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:60b1096d1c50daa13ef45ae4bb3865b844a934fb191b609cb50f51e35813c2de","observation_id":"9a873439-7ef1-42fd-8bbd-3825ae6f777d","resolution":{"observed_at":"2026-08-07T15:42:43.146750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:42.649885Z","title":"20 • Depending on the country in which research is conducted, IRB approval (or equivalent) may be required for any human subjects research","venue":null,"work_id":"1e3f8906-08ac-4f8b-9dd4-39d045131677","year":2025},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-15T05:44:48.071906Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:41.769511Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:5aa3c0acd1834f179a73390d8ebcd13afe32006a91ac3942e3503053d933ffc2","observation_id":"fa825ad6-012a-4b6d-b0a1-d776e10aae85","resolution":{"observed_at":"2026-08-07T15:42:42.737214Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.11860","last_updated":"2024-09-18T10:30:50Z","snapshot_observed_at":"2026-08-16T13:17:33.315414Z","submitted_at":"2024-09-18T10:30:50Z","title":"Retrieve, Annotate, Evaluate, Repeat: Leveraging Multimodal LLMs for Large-Scale Product Retrieval Evaluation","version":1},"cited_work":{"arxiv_id":"2409.11860","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.11860","snapshot_observed_at":"2026-08-07T15:42:42.166440Z","title":"Retrieve, Annotate, Evaluate, Repeat: Leveraging Multimodal LLMs for Large-Scale Product Retrieval Evaluation","venue":"cs.IR","work_id":"0a7a32b3-58fa-4029-8666-da706f73341f","year":2024},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-15T05:44:48.071906Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:38.899569Z"},"links":{"cited_paper":"/paper/2409.11860","citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:48fe3d489deac1792764cb13aa3a2840530807d39b4a6578ef25eb13eec57494","observation_id":"6d981240-12ea-42af-a874-8988038e7dae","resolution":{"observed_at":"2026-08-07T15:42:42.279027Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.04682","last_updated":"2025-01-08T18:42:48Z","snapshot_observed_at":"2026-08-19T22:21:38.527415Z","submitted_at":"2025-01-08T18:42:48Z","title":"Towards System 2 Reasoning in LLMs: Learning How to Think With Meta Chain-of-Thought","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.04682","snapshot_observed_at":"2026-08-07T15:42:41.245910Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-15T05:44:48.071906Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:41.245910Z"},"links":{"cited_paper":"/paper/2501.04682","citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:f8c0e204e2ae0456a20d9f7db4fae8095ee13f06f90ffde7da38cd87a4c11b05","observation_id":"1189bdc3-20cf-4933-abe3-eb27f0a95585","resolution":{"observed_at":"2026-08-07T15:42:41.245910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-15T05:44:48.071906Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks"},"reference_resolution":{"displayed":48,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":27,"verified_exact":3,"verified_fuzzy":17},"total_outbound_references":48},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 48 of 48 outbound references and 3 inbound Pith citation observations for arXiv:2505.14212."}