{"as_of":"2026-08-13T23:29:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3abbce9caab83e0d02aa89c64ed15daa97bd56c29c3a10b01025f44da9bd336a","coverage":[{"denominator":93,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":93,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T09:50:52.473479Z","state":"measured"},{"denominator":93,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":93,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2510.13272/citation-record","integrity":"/paper/2510.13272/integrity","json":"/paper/2510.13272/citation-record.json","paper":"/paper/2510.13272"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:41.619972Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:41.619972Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:5a1eb78bd3a7d233776ac5fa821b494c69ea524056b90ec499b6eb95f3a1fad7","observation_id":"cbc0cd1a-c2dc-4298-9540-8f1a814a4ce9","resolution":{"observed_at":"2026-08-04T09:50:41.619972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:41.730879Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:41.730879Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:3f49bb45491f924d0f7de262bdb811bfeaff969470e97764d53384a4a09acda4","observation_id":"fbcb843e-5975-4f74-a9c6-efe1102bed92","resolution":{"observed_at":"2026-08-04T09:50:41.730879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.08679","last_updated":"2026-06-16T17:36:22Z","snapshot_observed_at":"2026-08-07T17:12:11.913580Z","submitted_at":"2025-03-11T17:56:30Z","title":"Chain-of-Thought Reasoning In The Wild Is Not Always Faithful","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.08679","snapshot_observed_at":"2026-08-04T09:50:41.886859Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:41.886859Z"},"links":{"cited_paper":"/paper/2503.08679","citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:5e244ec207f217bb2c31af6fe7a68e54da926d6d5c649963de2d317e2e05186a","observation_id":"f1acdbd2-4445-433e-8b26-90251c95d133","resolution":{"observed_at":"2026-08-04T09:50:41.886859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11511","last_updated":"2023-10-17T18:18:32Z","snapshot_observed_at":"2026-08-12T20:38:07.563701Z","submitted_at":"2023-10-17T18:18:32Z","title":"Self-RAG: Learning to Retrieve, Generate, and Critique through Self-Reflection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11511","snapshot_observed_at":"2026-08-04T09:50:42.093942Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:42.093942Z"},"links":{"cited_paper":"/paper/2310.11511","citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:14b6a782c0f8ed7428ec033862bb4dba429924ca13010cd252df4acd66cd93d6","observation_id":"eac66a97-cc9b-4acb-a5f7-8993d026afab","resolution":{"observed_at":"2026-08-04T09:50:42.093942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:42.258273Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:42.258273Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:debb58fb5b34304d83f784de777149e4775fa50c5ce93fa215172b47a5cb8f76","observation_id":"e6dd1716-4f7d-46fd-a2dc-cb262f2b04c1","resolution":{"observed_at":"2026-08-04T09:50:42.258273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11926","last_updated":"2025-03-14T23:50:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-14T23:50:34Z","title":"Monitoring Reasoning Models for Misbehavior and the Risks of Promoting Obfuscation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11926","snapshot_observed_at":"2026-08-04T09:50:42.456654Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:42.456654Z"},"links":{"cited_paper":"/paper/2503.11926","citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:0f50fff8ddacefaed8ca50d7d350a3414eb80ea0f22d31914c374344182c766e","observation_id":"0e24f22d-5c46-48c8-8a4f-361c227fc446","resolution":{"observed_at":"2026-08-04T09:50:42.456654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:42.615099Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:42.615099Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:74ce0603b4acdb1de5ae1f895bd3e6a98a48abd9f63371c93db39b2be98d7576","observation_id":"e5e28d56-afa3-428d-80b2-04428cc71caf","resolution":{"observed_at":"2026-08-04T09:50:42.615099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:42.776529Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:42.776529Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:2261307bea2a6f0061f315aefa3b26ae7055db76571f1b58615063911dc83746","observation_id":"ac8925e9-bd18-4b3b-a385-da4f32bd395a","resolution":{"observed_at":"2026-08-04T09:50:42.776529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:42.968099Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:42.968099Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:ab8665995ddae60d576ff6745a2af2fa01ed98b93bf341d431de33adcbbda2e4","observation_id":"59f5a46f-ce35-4b51-b0d5-9d104a77ac5b","resolution":{"observed_at":"2026-08-04T09:50:42.968099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15280","last_updated":"2024-12-18T04:08:18Z","snapshot_observed_at":"2026-08-12T04:06:17.832489Z","submitted_at":"2024-12-18T04:08:18Z","title":"Context-DPO: Aligning Language Models for Context-Faithfulness","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15280","snapshot_observed_at":"2026-08-04T09:50:43.166440Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:43.166440Z"},"links":{"cited_paper":"/paper/2412.15280","citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:9f27b5dd0b6e3768ee6a9dbfbd1f9072f61d74218b8c5d118f41b013b2a0cf7d","observation_id":"283112c6-4251-457e-a8cf-f6bc4414963f","resolution":{"observed_at":"2026-08-04T09:50:43.166440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:43.319521Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:43.319521Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:de25727a7870729772148834b684ad506637a3b78dcf49a96aaaee46968c6bd3","observation_id":"bcedd1e8-5c2e-4a07-a431-f1bf2115a31b","resolution":{"observed_at":"2026-08-04T09:50:43.319521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:43.446864Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:43.446864Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:0ab4a4e2454dc5d259e198c3ac1f29cfdec8792c02f611168ed520bbab5df956","observation_id":"1a6c575a-8842-429b-b44f-b69c209025f2","resolution":{"observed_at":"2026-08-04T09:50:43.446864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:43.593399Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:43.593399Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:feb1096898acb400e3c298103e298ab3e8654b9e3b6a61d28a499c7bc2172b28","observation_id":"aeaf6571-1296-48a5-ace7-61991f3631ba","resolution":{"observed_at":"2026-08-04T09:50:43.593399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:43.721141Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:43.721141Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:568001915099aaf686180a034623420adde78bcb8556e175c655929d0ca746c4","observation_id":"0568e86c-fd1b-4b7f-982c-6f282e01868b","resolution":{"observed_at":"2026-08-04T09:50:43.721141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19470","last_updated":"2025-09-23T03:45:42Z","snapshot_observed_at":"2026-08-10T03:47:52.773511Z","submitted_at":"2025-03-25T09:00:58Z","title":"ReSearch: Learning to Reason with Search for LLMs via Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19470","snapshot_observed_at":"2026-08-04T09:50:43.835501Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:43.835501Z"},"links":{"cited_paper":"/paper/2503.19470","citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:94d14ee08956c3450f1e609346d9f234c7a6f06dda46b716c5a211650e1dbc2a","observation_id":"2876b273-439d-47d2-8deb-1d3ff7e9174a","resolution":{"observed_at":"2026-08-04T09:50:43.835501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08678","last_updated":"2023-07-17T17:41:47Z","snapshot_observed_at":"2026-08-13T10:54:01.902397Z","submitted_at":"2023-07-17T17:41:47Z","title":"Do Models Explain Themselves? Counterfactual Simulatability of Natural Language Explanations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08678","snapshot_observed_at":"2026-08-04T09:50:43.957104Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:43.957104Z"},"links":{"cited_paper":"/paper/2307.08678","citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:32cf4aadd407eaf50832b84ee4e349fe7ab440d101f679a1ad7764d6db0c28a6","observation_id":"9cad1910-5b6a-4cc6-ab7e-72aca740de40","resolution":{"observed_at":"2026-08-04T09:50:43.957104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:44.111105Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:44.111105Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:b26a77771032924236e803476702fb11c015ca824e6387d176e7e99c312bcabd","observation_id":"ab0cc668-2230-4879-9e2f-94b47287c838","resolution":{"observed_at":"2026-08-04T09:50:44.111105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.08156","last_updated":"2025-07-15T17:27:07Z","snapshot_observed_at":"2026-08-13T23:03:21.723923Z","submitted_at":"2025-01-14T14:31:45Z","title":"Are DeepSeek R1 And Other Reasoning Models More Faithful?","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.08156","snapshot_observed_at":"2026-08-04T09:50:44.263525Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:44.263525Z"},"links":{"cited_paper":"/paper/2501.08156","citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:46388e544cf3b3df303698e5cf0ffea6946e5944b0ff89a2a4812d7f0d85506d","observation_id":"424556df-d0f5-4c59-8a91-b2d4d29f3103","resolution":{"observed_at":"2026-08-04T09:50:44.263525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-04T09:50:44.350307Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:44.350307Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:8d99e18caa7f5953990f38d5478df14aba619349071b2dbe8fc41b6b8ad632e0","observation_id":"27d920f9-2762-455a-815b-e34d4609e4ea","resolution":{"observed_at":"2026-08-04T09:50:44.350307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:44.422340Z","title":"Ponti, and Siva Reddy","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:44.422340Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:4e1af68019165eb0d032bc5071716896e4bce05ca583613f78fea1e85dfc9bc1","observation_id":"a1794716-a0ee-4c07-b32b-23f5df29bff5","resolution":{"observed_at":"2026-08-04T09:50:44.422340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:44.500504Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:44.500504Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:376191a9f5a3131d165711808773d321a3b8da00dffcd1ba0f0f7cde66af187a","observation_id":"24faaf8a-d667-4d6f-adb2-79841640cdd2","resolution":{"observed_at":"2026-08-04T09:50:44.500504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:44.646633Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:44.646633Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:224d5ba9ff1f67ad67841da14e27d2fee317d454dc3facaed8a509dc3bffbc92","observation_id":"ffb5bb53-ea29-4b04-8859-e94b15207942","resolution":{"observed_at":"2026-08-04T09:50:44.646633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10997","last_updated":"2024-03-27T09:16:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-18T07:47:33Z","title":"Retrieval-Augmented Generation for Large Language Models: A Survey","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10997","snapshot_observed_at":"2026-08-04T09:50:44.733220Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:44.733220Z"},"links":{"cited_paper":"/paper/2312.10997","citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:dfc2b0f64d9126859d4813e8fdac3f203b3da9515c849f12487865b564526445","observation_id":"f557fc61-edce-4e64-ab62-517ca0250306","resolution":{"observed_at":"2026-08-04T09:50:44.733220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-04T09:50:44.791138Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:44.791138Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:bd274810ce0bbe4cf0a9678c3a2061fbfc4767ec9736c61887cfdda55e6dcd72","observation_id":"a27e57ab-0226-46ca-9031-cdb0c14c2323","resolution":{"observed_at":"2026-08-04T09:50:44.791138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:44.867496Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:44.867496Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:62ca169d2d594cfb3827d6fa4413c38ad01aa5b25b4f656ca59054dce657a011","observation_id":"03657023-06d7-431d-b546-38846bd76751","resolution":{"observed_at":"2026-08-04T09:50:44.867496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:44.951697Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:44.951697Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:33b59a0943c56ae54ec6d8b25f313a4e81fc78cfd9fbd31fa40f5c378b6da702","observation_id":"3c0d7d16-7d8c-42a3-a80c-9d477207e4c6","resolution":{"observed_at":"2026-08-04T09:50:44.951697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-04T09:50:45.091432Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:45.091432Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:46b860a945c34e18e0df7196b343ed63b09e9a660539cb03928ff440bbeaf6ee","observation_id":"12abee43-45bf-4297-b6d3-d41511323ce0","resolution":{"observed_at":"2026-08-04T09:50:45.091432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-13T15:58:13.809876Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-04T09:50:45.191468Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:45.191468Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:9b7c85ee7a86de778bd0d3f8c39bcd76c1f593755bba9a782d5a3eec3011de65","observation_id":"f3cf5de8-101a-4fc8-9bba-632dd4f81f9f","resolution":{"observed_at":"2026-08-04T09:50:45.191468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:45.294741Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:45.294741Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:80bd5ec7f56a5c40bb186dbdbf57388458826bc3262f02c091fd19c461a9361a","observation_id":"34367dc8-0e19-43cf-8627-b2589116bdd4","resolution":{"observed_at":"2026-08-04T09:50:45.294741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:45.419056Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:45.419056Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:c004c2468594187d6ae60994d76d72e22468d107c799186d07d54731dff01d06","observation_id":"b325e463-1e8e-4645-b83d-690356137d38","resolution":{"observed_at":"2026-08-04T09:50:45.419056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:45.513076Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:45.513076Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:f5e6f8a2b83c52582648fd843c4b7833f554f4cbff4100f3c039f50efbf4458e","observation_id":"c5bee9f3-5f3c-4aca-b294-6bc299fb5e99","resolution":{"observed_at":"2026-08-04T09:50:45.513076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-04T09:50:45.569440Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:45.569440Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:f19ba6db03da12b3ca7648046b8d8af79841099bc400e439bc8ca117cdae07ad","observation_id":"7c04443e-a7e7-4dfe-a57f-1227c7e7f597","resolution":{"observed_at":"2026-08-04T09:50:45.569440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:45.627198Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:45.627198Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:9569318c6fd0e0eb2be4b86bd6e1f2ca5b37c7ee5063e4f9103048337a217ed3","observation_id":"104f3f4b-a7ea-4cfb-9daf-603df2a8e757","resolution":{"observed_at":"2026-08-04T09:50:45.627198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:45.703115Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:45.703115Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:0a68178fdc3cc499fa62fabcbc95ba9997c21ca74d11c638864e2be65a0872dd","observation_id":"d7d60c95-437c-41a4-82cc-81a1f44954e1","resolution":{"observed_at":"2026-08-04T09:50:45.703115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15117","last_updated":"2025-05-21T05:09:43Z","snapshot_observed_at":"2026-08-09T16:48:40.808805Z","submitted_at":"2025-05-21T05:09:43Z","title":"An Empirical Study on Reinforcement Learning for Reasoning-Search Interleaved LLM Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.15117","snapshot_observed_at":"2026-08-04T09:50:45.763606Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:45.763606Z"},"links":{"cited_paper":"/paper/2505.15117","citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:0ce42d7cdcfdcfa86799ee138a27fa6e45e0b59212e172200cd709b420b30178","observation_id":"6118e055-e4d6-4a0d-a75a-e3427ebcc2c3","resolution":{"observed_at":"2026-08-04T09:50:45.763606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09516","last_updated":"2025-08-05T19:08:38Z","snapshot_observed_at":"2026-07-06T20:51:28.022519Z","submitted_at":"2025-03-12T16:26:39Z","title":"Search-R1: Training LLMs to Reason and Leverage Search Engines with Reinforcement Learning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09516","snapshot_observed_at":"2026-08-04T09:50:45.848855Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:45.848855Z"},"links":{"cited_paper":"/paper/2503.09516","citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:9eb7493e0a8d5efdfbfb4f42c0a5ab3e9fb117577c1fe873a4eddeb6b82c725e","observation_id":"d401dd14-7d8b-460f-a10b-856787cd38b5","resolution":{"observed_at":"2026-08-04T09:50:45.848855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:45.949577Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:45.949577Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:13ba54f6eb513e273bfb8ca5f01c1839f8d9117768aa34d91fa2c791b5056696","observation_id":"aabfd593-3ba8-4cc1-89d0-cae25a904b7d","resolution":{"observed_at":"2026-08-04T09:50:45.949577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.03551","last_updated":"2017-05-13T21:12:37Z","snapshot_observed_at":"2026-08-13T08:58:47.096400Z","submitted_at":"2017-05-09T21:35:07Z","title":"TriviaQA: A Large Scale Distantly Supervised Challenge Dataset for Reading Comprehension","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.03551","snapshot_observed_at":"2026-08-04T09:50:45.995794Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:45.995794Z"},"links":{"cited_paper":"/paper/1705.03551","citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:e93a8e23449f744c1c9c1577bc5dc117e99e0db1dec015186764fa4d819cec90","observation_id":"a8e87137-a3de-474c-995c-843fbda4ad35","resolution":{"observed_at":"2026-08-04T09:50:45.995794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:46.045366Z","title":null,"venue":null,"work_id":null,"year":1996},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:46.045366Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:1e10b89b312f7764e86c8b64cad8084a9c0a7ae016e534d456226e08af173bcc","observation_id":"8b5bba70-4538-43fa-9139-26f6bb943afb","resolution":{"observed_at":"2026-08-04T09:50:46.045366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:46.150474Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:46.150474Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:ad6d2b58ee69d7ce9c82864c4e22ab405f2146cff611876198cd0ecc32a2e7dc","observation_id":"1eec5047-69cf-478c-abff-68286ef111f2","resolution":{"observed_at":"2026-08-04T09:50:46.150474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:46.219832Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:46.219832Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:547ca2687379af2dc2ba70b9472924fd29b8e9d03717c8fa10fad66d11569ad1","observation_id":"22e9044d-c1a3-4138-9780-fc14e0068f28","resolution":{"observed_at":"2026-08-04T09:50:46.219832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:46.391493Z","title":"Dai, Jakob Uszkoreit, Quoc Le, and Slav Petrov","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:46.391493Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:5a749a94f1fcaa937ef56f437f03c348077e54909ea2ac96f6d1a4761139bdc0","observation_id":"b1a1c925-a2fe-4dba-8fc8-ddc922c90721","resolution":{"observed_at":"2026-08-04T09:50:46.391493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.21495","last_updated":"2025-06-26T17:25:49Z","snapshot_observed_at":"2026-08-13T16:25:50.683520Z","submitted_at":"2025-06-26T17:25:49Z","title":"Bridging Offline and Online Reinforcement Learning for LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.21495","snapshot_observed_at":"2026-08-04T09:50:46.549563Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:46.549563Z"},"links":{"cited_paper":"/paper/2506.21495","citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:bed93cb2c3f36a05d3141486519a700c083a0e98b9b8934225257fc9e94f27be","observation_id":"d3c3b757-9212-422a-b8f0-97949b079396","resolution":{"observed_at":"2026-08-04T09:50:46.549563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13702","last_updated":"2023-07-17T01:08:39Z","snapshot_observed_at":"2026-08-13T18:02:27.155379Z","submitted_at":"2023-07-17T01:08:39Z","title":"Measuring Faithfulness in Chain-of-Thought Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.13702","snapshot_observed_at":"2026-08-04T09:50:46.659248Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:46.659248Z"},"links":{"cited_paper":"/paper/2307.13702","citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:1d10ca09b0eb62a721b8f388569789eeec77adfd4905043cdf5641cc3ff5db26","observation_id":"df7008bd-f5bf-425b-82f3-a65543923f5d","resolution":{"observed_at":"2026-08-04T09:50:46.659248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:46.775244Z","title":"u ttler, Mike Lewis, Wen-tau Yih, Tim Rockt\\","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:46.775244Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:703c47df935d96a60b34bed78bf488c3c75e2443cb63d687c07329746003ad01","observation_id":"b1526e93-bc5c-4019-9061-f317b90f4d1d","resolution":{"observed_at":"2026-08-04T09:50:46.775244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:46.891310Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:46.891310Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:87499e7d641e5423074df7524b695416ff7d501b55b6e0f291e343086bdc1f29","observation_id":"7a78af13-d1aa-4d38-8a71-289b398282df","resolution":{"observed_at":"2026-08-04T09:50:46.891310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.05366","last_updated":"2025-01-09T16:48:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-09T16:48:17Z","title":"Search-o1: Agentic Search-Enhanced Large Reasoning Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.05366","snapshot_observed_at":"2026-08-04T09:50:47.019601Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:47.019601Z"},"links":{"cited_paper":"/paper/2501.05366","citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:2ff51db226e9849f35cb79993fc6da5f3995c7b10cc419a35a72b1568d8750a8","observation_id":"694bfb9d-a987-473f-b7d3-2f5dcb72ed8d","resolution":{"observed_at":"2026-08-04T09:50:47.019601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.10408","last_updated":"2025-06-12T07:01:56Z","snapshot_observed_at":"2026-08-09T17:34:32.242783Z","submitted_at":"2025-06-12T07:01:56Z","title":"Reasoning RAG via System 1 or System 2: A Survey on Reasoning Agentic Retrieval-Augmented Generation for Industry Challenges","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.10408","snapshot_observed_at":"2026-08-04T09:50:47.142987Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:47.142987Z"},"links":{"cited_paper":"/paper/2506.10408","citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:07c1f5f8c2421662b95de76cbac5ea637cdc8fed544bcef55c8174bf9037a82d","observation_id":"94ca7c1f-0236-42ef-a232-656251d590ff","resolution":{"observed_at":"2026-08-04T09:50:47.142987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:47.307096Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:47.307096Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:4cb8216b003bf912d610451485b8c60b4fc0f5f9bbe40a739824726a582fe115","observation_id":"e04efa39-c378-470e-b071-f496d8c723fa","resolution":{"observed_at":"2026-08-04T09:50:47.307096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:47.467540Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:47.467540Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:a17723e265f6e341c3ebc8e7fe34a59aa34d555af0df36ba68f682326267a26c","observation_id":"55579b31-3559-4d5c-a97b-22cbc76b1300","resolution":{"observed_at":"2026-08-04T09:50:47.467540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:47.623568Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:47.623568Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:bfbbb9cb2d4a2b594eb642db40dff474296296369c36f5a81d3c0f6fb4eb384d","observation_id":"5662f4a2-109d-4d62-992e-a8c722d51335","resolution":{"observed_at":"2026-08-04T09:50:47.623568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:47.740603Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:47.740603Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:e4bfa5c2b3ecc4c5bfa5a20230772911d9ab09d1f4879cb0980590f378038368","observation_id":"6d817ce4-7cb7-4dc3-b27e-a16e27e029b9","resolution":{"observed_at":"2026-08-04T09:50:47.740603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:47.850829Z","title":null,"venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:47.850829Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:c7c3f77aab7af6f161b16b23952d3a63cc764086bfd84ccafdbbf871f544cb03","observation_id":"ea505823-dc8d-4ec9-974b-475688d35439","resolution":{"observed_at":"2026-08-04T09:50:47.850829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:47.956217Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:47.956217Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:b82800e80a6b8d6aaca0c724b1a4550b796e4d16b7c23d248d31f4bcc9740399","observation_id":"a02b9cdc-a917-43be-8781-d8ae7440012f","resolution":{"observed_at":"2026-08-04T09:50:47.956217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:48.034553Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:48.034553Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:fe253f32c4dc8e58527b987d7e4da3130796196f886cdf90de04314e44024044","observation_id":"d29345f6-e1c0-490f-9a2e-b6f3eba2227e","resolution":{"observed_at":"2026-08-04T09:50:48.034553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:48.108042Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:48.108042Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:b0e5dc6bacdd817a90e98d3aae066a8f329fec88399693683c12ab358be8961d","observation_id":"e8b016b9-be8e-4017-9c26-0c734ed3870d","resolution":{"observed_at":"2026-08-04T09:50:48.108042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:48.194498Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:48.194498Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:ea4d9d2b3932ae0be0ea41d9142624929b475c4fbd0055767040e7c2062c2c44","observation_id":"d01befe1-a26d-462d-987d-d5d87febcbe5","resolution":{"observed_at":"2026-08-04T09:50:48.194498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.08700","last_updated":"2024-10-02T07:26:40Z","snapshot_observed_at":"2026-08-13T00:33:10.103658Z","submitted_at":"2024-04-10T18:08:59Z","title":"DyKnow: Dynamically Verifying Time-Sensitive Factual Knowledge in LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.08700","snapshot_observed_at":"2026-08-04T09:50:48.258982Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:48.258982Z"},"links":{"cited_paper":"/paper/2404.08700","citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:43035c6f19a8d41b8baf482548d8ac36abe397e0296becf4a5cea62bc580b33f","observation_id":"1d9af3c5-9182-4d12-8027-c8c5824da048","resolution":{"observed_at":"2026-08-04T09:50:48.258982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:48.366443Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:48.366443Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:3734a0ed61581030062f3b9c54b1d7ba1995ce80c831e10a3a53e4abaf3a3427","observation_id":"1758c0bf-3dce-4954-bb95-58681b41d20b","resolution":{"observed_at":"2026-08-04T09:50:48.366443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:48.513691Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:48.513691Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:f747b09eb51e5da15faade02954f4eb21d37a36410566520c0a6e1b983b13ec9","observation_id":"dabd8e3d-8486-476c-b902-6974cf182a84","resolution":{"observed_at":"2026-08-04T09:50:48.513691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:48.649607Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:48.649607Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:fe53afa52a5857f1ffe1baac1ccf844e04a408bbeed671f1fe446077192c7299","observation_id":"49c56a74-0c23-427f-a7bc-70d14e5ef6dc","resolution":{"observed_at":"2026-08-04T09:50:48.649607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:48.761835Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:48.761835Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:4a0ffc5ef2177f42b68e73ac23368bf2db5c179a506d44c1edf9bd7d39118f06","observation_id":"9c4e8989-237a-4792-9f09-36134dc08a92","resolution":{"observed_at":"2026-08-04T09:50:48.761835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:48.931225Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:48.931225Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:80c583fc9f61f1071fbec771bf17bfdd6a92e5521d05e74c41d2b4ed54bec14b","observation_id":"1a3d71cb-c031-4087-81a7-84b65a6fb3db","resolution":{"observed_at":"2026-08-04T09:50:48.931225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:49.023887Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:49.023887Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:cdb8a756b740352ad1b728a5da56dfc16d11406978ac99f63567b466f9777da8","observation_id":"bb3f69ab-d401-4545-ac49-9f8ed019aa7e","resolution":{"observed_at":"2026-08-04T09:50:49.023887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1506.02438","last_updated":"2018-10-20T18:55:07Z","snapshot_observed_at":"2026-08-12T21:29:36.308819Z","submitted_at":"2015-06-08T11:12:48Z","title":"High-Dimensional Continuous Control Using Generalized Advantage Estimation","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1506.02438","snapshot_observed_at":"2026-08-04T09:50:49.119519Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:49.119519Z"},"links":{"cited_paper":"/paper/1506.02438","citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:7845def7cb525bfedf4a2a5e46c7ed039809fdba858a45b2b9f2bf631ebabaa7","observation_id":"bbb35afb-c104-4010-aae8-c60d5cf62676","resolution":{"observed_at":"2026-08-04T09:50:49.119519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-04T09:50:49.219706Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:49.219706Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:f83679205e88350dbe868ae048d6eb6c4d7c89b56db6a773e90e670393073a1d","observation_id":"2efdf058-000f-45fb-b129-4c2d3a42b006","resolution":{"observed_at":"2026-08-04T09:50:49.219706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-04T09:50:49.284713Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:49.284713Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:7299c411979f42f2c0ac3c93d0abf0d2dae9dcfbb988f0ebf58a35411c63f857","observation_id":"27bce402-cc41-4165-84a1-3fda9003e4fa","resolution":{"observed_at":"2026-08-04T09:50:49.284713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:49.444906Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:49.444906Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:11c216a2f1edecf795bb4411dbb767221bd6a39fef021ce0df73e41878201e98","observation_id":"6615f0d3-9209-4665-8d18-3de81f0fd8c2","resolution":{"observed_at":"2026-08-04T09:50:49.444906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09136","last_updated":"2026-04-01T15:51:06Z","snapshot_observed_at":"2026-08-07T12:36:27.102579Z","submitted_at":"2025-01-15T20:40:25Z","title":"Agentic Retrieval-Augmented Generation: A Survey on Agentic RAG","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.09136","snapshot_observed_at":"2026-08-04T09:50:49.545624Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:49.545624Z"},"links":{"cited_paper":"/paper/2501.09136","citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:f83becc1dd78235e74d883c462e6cd37b078b477d91883ce4063d07a3dbd2fe4","observation_id":"f9b03008-9d51-4a6a-80d1-0f295331076e","resolution":{"observed_at":"2026-08-04T09:50:49.545624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.05592","last_updated":"2025-03-18T08:32:24Z","snapshot_observed_at":"2026-08-09T05:07:17.305244Z","submitted_at":"2025-03-07T17:14:44Z","title":"R1-Searcher: Incentivizing the Search Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.05592","snapshot_observed_at":"2026-08-04T09:50:49.603608Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:49.603608Z"},"links":{"cited_paper":"/paper/2503.05592","citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:4f85cb8f0634feb59d52e148d5308358675bec5e67f27726cf7bd160f696874e","observation_id":"e8045aa2-3586-42b4-ad8b-43377e5113d6","resolution":{"observed_at":"2026-08-04T09:50:49.603608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:49.675935Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:49.675935Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:3fdce4b529802e701438bb739c044b9d5587d23b6a64585c4f8cdbcf3891e98d","observation_id":"67a8e721-d5be-4043-98b9-533a91454ff0","resolution":{"observed_at":"2026-08-04T09:50:49.675935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.04588","last_updated":"2026-05-19T11:51:42Z","snapshot_observed_at":"2026-08-04T18:36:41.979541Z","submitted_at":"2025-05-07T17:30:22Z","title":"ZeroSearch: Incentivize the Search Capability of LLMs without Searching","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.04588","snapshot_observed_at":"2026-08-04T09:50:49.763839Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:49.763839Z"},"links":{"cited_paper":"/paper/2505.04588","citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:441e0c4eb21f110759797fb7328d050d8e9e55aee8704c82e98daba6f3bdf42d","observation_id":"d6204829-2ac6-47d5-9156-08232c55bac6","resolution":{"observed_at":"2026-08-04T09:50:49.763839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:49.891301Z","title":null,"venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:49.891301Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:39f92ce2a4502fe0a92901927d33437c0386d4ecb45d4066f88cd1e501a84478","observation_id":"ec05487c-90bd-4459-8756-a3c0a07c9226","resolution":{"observed_at":"2026-08-04T09:50:49.891301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:50.010794Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:50.010794Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:5a31d65074fcf3873721a983ad13bd9cb127fa61608bbce8245fbdec360f2fba","observation_id":"557bad13-a4d3-4bbe-bfee-4c9ae2c3fb2e","resolution":{"observed_at":"2026-08-04T09:50:50.010794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:50.081205Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:50.081205Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:a57379efb19d4b6477ded91515752f65f68fbc7eab07ce9997b2b8a087f79a81","observation_id":"da610423-ac55-49c9-81b0-5fe9a6dc3c47","resolution":{"observed_at":"2026-08-04T09:50:50.081205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:50.203775Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:50.203775Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:53449c26c1bd91189c88078f24af3e655316912c6464c23db933521b979ba5a6","observation_id":"87e37e7a-f5b6-4e2d-b0b1-768b78054296","resolution":{"observed_at":"2026-08-04T09:50:50.203775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03533","last_updated":"2024-02-22T06:21:51Z","snapshot_observed_at":"2026-07-06T14:27:46.217000Z","submitted_at":"2022-12-07T09:25:54Z","title":"Text Embeddings by Weakly-Supervised Contrastive Pre-training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.03533","snapshot_observed_at":"2026-08-04T09:50:50.271884Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:50.271884Z"},"links":{"cited_paper":"/paper/2212.03533","citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:58ede234ee88a4e0318385da6c4d16c6a5eee3e33f402e5018e14f343dec885b","observation_id":"d5fb9fa9-b2a1-489b-8bfc-2cfc85f03b19","resolution":{"observed_at":"2026-08-04T09:50:50.271884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15107","last_updated":"2025-05-26T04:44:21Z","snapshot_observed_at":"2026-08-13T16:35:29.551646Z","submitted_at":"2025-05-21T05:01:31Z","title":"StepSearch: Igniting LLMs Search Ability via Step-Wise Proximal Policy Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.15107","snapshot_observed_at":"2026-08-04T09:50:50.408334Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:50.408334Z"},"links":{"cited_paper":"/paper/2505.15107","citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:2cf19fb71ba38a9e7128e5eb4066db1bbcb3cbbdf8a54e13b74088097e385cc1","observation_id":"bdd4d1db-c793-41da-ab9e-65725839cfbe","resolution":{"observed_at":"2026-08-04T09:50:50.408334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:50.524539Z","title":null,"venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:50.524539Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:60f291b9204b86474486aca3d4a89b44c8d3e82fccac2b5ee6ff093854359732","observation_id":"c237fc69-59a9-4850-9785-2dd090b0145a","resolution":{"observed_at":"2026-08-04T09:50:50.524539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:50.593432Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:50.593432Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:663da882ef2081ce37dd7d4ccc49630d52af8f66b2a2f696a1559e9dc2a553ff","observation_id":"d21f9ce9-2d3a-44a0-9f04-0747a0b2863b","resolution":{"observed_at":"2026-08-04T09:50:50.593432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:50.694962Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:50.694962Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:1566ee67f841bcef47df8ab9ae4f4a2fc85ce6c334aff35b292f6042867ab8fc","observation_id":"9908f324-d758-4e14-923c-c3badfbd9bdc","resolution":{"observed_at":"2026-08-04T09:50:50.694962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:50.804530Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:50.804530Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:3892c3953ce16f1bf1b00d691d29ff5de0eb093c3376c57f4aaffbc9f0cd6f35","observation_id":"2cf9e3ad-3f30-4dd4-806f-7929073ae1ce","resolution":{"observed_at":"2026-08-04T09:50:50.804530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:50.861920Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:50.861920Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:f3fdd0e7a0f67b952f20a33707a1ec1a6f2ccb2b3769d64cf3bd55eabba619c7","observation_id":"3ece0e70-190c-4c01-9de1-38c84cc916a9","resolution":{"observed_at":"2026-08-04T09:50:50.861920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-04T09:50:50.991626Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:50.991626Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:ec7a4d0da3c665516e01c94810e3572a49ead6563331fb6f9979366684c6a594","observation_id":"f5b1f353-fe9b-4449-b26e-38960bc0ec9d","resolution":{"observed_at":"2026-08-04T09:50:50.991626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:51.093641Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:51.093641Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:7eae1715b88aa61caed3f0aaac5c0ed68959130943a5502fb90271fc10cc5029","observation_id":"311928b8-a106-436e-8fd5-c94355dfbe12","resolution":{"observed_at":"2026-08-04T09:50:51.093641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:51.242360Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:51.242360Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:a482deadc57a7aa0f26ae5203895cd3588703f9ca3abd796f3239403cfaaf84d","observation_id":"356f699e-e1e5-445f-8886-007a724b1e24","resolution":{"observed_at":"2026-08-04T09:50:51.242360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.06794","last_updated":"2023-09-13T08:33:09Z","snapshot_observed_at":"2026-08-13T10:14:37.423969Z","submitted_at":"2023-09-13T08:33:09Z","title":"Cognitive Mirage: A Review of Hallucinations in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.06794","snapshot_observed_at":"2026-08-04T09:50:51.424099Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:51.424099Z"},"links":{"cited_paper":"/paper/2309.06794","citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:a69cb531fa37fb965740e61b5e0440cd723197051703ded543add6b11f52fb81","observation_id":"ab34bd58-93c8-4b0e-b3d8-75943d99bff6","resolution":{"observed_at":"2026-08-04T09:50:51.424099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.07301","last_updated":"2025-06-05T16:34:24Z","snapshot_observed_at":"2026-08-03T11:11:25.359494Z","submitted_at":"2025-01-13T13:10:16Z","title":"The Lessons of Developing Process Reward Models in Mathematical Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.07301","snapshot_observed_at":"2026-08-04T09:50:51.575668Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:51.575668Z"},"links":{"cited_paper":"/paper/2501.07301","citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:ca6d373529a7b6778e4cd2b8e5d2d03bcc407ef02f27d5214ab7cc7e1798f53a","observation_id":"ca187406-adb6-412c-ba36-3e651c0d0bc1","resolution":{"observed_at":"2026-08-04T09:50:51.575668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04185","last_updated":"2025-06-04T17:29:22Z","snapshot_observed_at":"2026-08-13T07:05:12.785554Z","submitted_at":"2025-06-04T17:29:22Z","title":"R-Search: Empowering LLM Reasoning with Search via Multi-Reward Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.04185","snapshot_observed_at":"2026-08-04T09:50:51.764147Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:51.764147Z"},"links":{"cited_paper":"/paper/2506.04185","citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:3aef0d84cdf3387943590cb23c73c6864fb55a7c6849cb9da09baa5595c3dc50","observation_id":"6f35d705-251a-4281-a182-3841362f4f59","resolution":{"observed_at":"2026-08-04T09:50:51.764147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:51.935745Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:51.935745Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:d28dfd3bf6016607d58c4e4a7e4dc87cd036206bffeb80e16f88da803ef636e7","observation_id":"2d8356fc-08e0-4510-b9b8-f743c48a0cc3","resolution":{"observed_at":"2026-08-04T09:50:51.935745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:52.106058Z","title":"Chi, Quoc V Le, and Denny Zhou","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:52.106058Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:9f82aef21e047dcfc367f155d6c5c4749e7b67a369c2f926f6ecc8908f305aa9","observation_id":"33459221-4cd6-4337-a918-d94b23171702","resolution":{"observed_at":"2026-08-04T09:50:52.106058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:52.293631Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:52.293631Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:85ad66b075447db5fb400c98724dd9aa03b963a38e6ae23b08fd98838cda2e8b","observation_id":"48c4a271-6025-4a0f-8119-478ea26fa896","resolution":{"observed_at":"2026-08-04T09:50:52.293631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:50:52.473479Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation","version":3},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-04T09:50:52.473479Z"},"links":{"citing_paper":"/paper/2510.13272"},"observation_digest":"sha256:e483a1257772d81b2ae176fa1ac2be26f7901cafb7daadc73f5ceb28b860d591","observation_id":"7ea627e7-e369-4d87-9f4d-cd85362ce93c","resolution":{"observed_at":"2026-08-04T09:50:52.473479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2510.13272","last_updated":"2026-06-03T06:16:13Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T22:49:51.379892Z","submitted_at":"2025-10-15T08:17:52Z","title":"Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation"},"reference_resolution":{"displayed":93,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":93,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":93},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 93 of 93 outbound references and 0 inbound Pith citation observations for arXiv:2510.13272."}