{"as_of":"2026-08-21T07:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:02feb9e4742907e948767b2999d5eaa073e1190798956eb4974c69de062e36cd","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":17,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":17,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":17,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":17,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T22:41:10.213488Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-09T12:46:14.749364Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.15041","last_updated":"2026-08-17T08:53:39Z","snapshot_observed_at":"2026-08-20T23:15:22.000321Z","submitted_at":"2024-11-22T16:15:50Z","title":"mR$^2$AG: Multimodal Retrieval-Reflection-Augmented Generation for Knowledge-Based VQA","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15041","snapshot_observed_at":"2026-08-15T22:41:10.213488Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.07879","last_updated":"2025-09-12T11:47:31Z","snapshot_observed_at":"2026-08-21T01:03:40.993354Z","submitted_at":"2025-05-10T14:24:41Z","title":"OMGM: Orchestrate Multiple Granularities and Modalities for Efficient Multimodal Retrieval","version":3},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-15T22:41:10.213488Z"},"links":{"cited_paper":"/paper/2411.15041","citing_paper":"/paper/2505.07879"},"observation_digest":"sha256:48d31a57e14bd990cc5c5f891cfcf0260c62c28e4ecbfe801ee6554ee2c52c44","observation_id":"11dfac29-2663-49b2-9a6a-8cff6c747a78","resolution":{"observed_at":"2026-08-15T22:41:10.213488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15041","last_updated":"2026-08-17T08:53:39Z","snapshot_observed_at":"2026-08-20T23:15:22.000321Z","submitted_at":"2024-11-22T16:15:50Z","title":"mR$^2$AG: Multimodal Retrieval-Reflection-Augmented Generation for Knowledge-Based VQA","version":2},"cited_work":{"arxiv_id":"2411.15041","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.15041","snapshot_observed_at":"2026-07-09T12:46:14.749364Z","title":"mR2AG: Multimodal Retrieval-Reflection- Augmented Generation for Knowledge-Based VQA //","venue":"cs.AI","work_id":"0c2722ec-00a0-4134-85a0-9d1af99f1e7b","year":2024},"citing_paper":{"arxiv_id":"2505.22095","last_updated":"2026-04-06T12:52:40Z","snapshot_observed_at":"2026-08-12T21:09:04.668282Z","submitted_at":"2025-05-28T08:17:57Z","title":"Mixture-of-Retrieval Experts for Reasoning-Guided Multimodal Knowledge Exploitation","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-19T13:50:30.090068Z"},"links":{"cited_paper":"/paper/2411.15041","citing_paper":"/paper/2505.22095"},"observation_digest":"sha256:85a90b00fbd2bdfb460479fb25010dd68d70593e23192eb74831c9a2b10e9c16","observation_id":"571d8895-cb81-4a6f-9f88-fd0577c18585","resolution":{"observed_at":"2026-05-19T13:52:19.993606Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15041","last_updated":"2026-08-17T08:53:39Z","snapshot_observed_at":"2026-08-20T23:15:22.000321Z","submitted_at":"2024-11-22T16:15:50Z","title":"mR$^2$AG: Multimodal Retrieval-Reflection-Augmented Generation for Knowledge-Based VQA","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15041","snapshot_observed_at":"2026-08-07T11:27:42.371621Z","title":"Jingyi Zhang, Jiaxing Huang, Sheng Jin, and Shijian Lu","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.02544","last_updated":"2025-06-04T06:31:54Z","snapshot_observed_at":"2026-08-18T12:17:15.709025Z","submitted_at":"2025-06-03T07:32:40Z","title":"CoRe-MMRAG: Cross-Source Knowledge Reconciliation for Multimodal RAG","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:42.371621Z"},"links":{"cited_paper":"/paper/2411.15041","citing_paper":"/paper/2506.02544"},"observation_digest":"sha256:ecf6bbb7ee26196d0ad5bccb7c8e4156a94c9b8c0e79cc2bbff5bab8f4685b32","observation_id":"875aafb3-c194-4219-98e1-50d24b64f030","resolution":{"observed_at":"2026-08-07T11:27:42.371621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15041","last_updated":"2026-08-17T08:53:39Z","snapshot_observed_at":"2026-08-20T23:15:22.000321Z","submitted_at":"2024-11-22T16:15:50Z","title":"mR$^2$AG: Multimodal Retrieval-Reflection-Augmented Generation for Knowledge-Based VQA","version":2},"cited_work":{"arxiv_id":"2411.15041","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.15041","snapshot_observed_at":"2026-07-09T12:46:14.749364Z","title":"mR2AG: Multimodal Retrieval-Reflection- Augmented Generation for Knowledge-Based VQA //","venue":"cs.AI","work_id":"0c2722ec-00a0-4134-85a0-9d1af99f1e7b","year":2024},"citing_paper":{"arxiv_id":"2508.05318","last_updated":"2026-04-27T09:35:27Z","snapshot_observed_at":"2026-08-17T00:09:22.637503Z","submitted_at":"2025-08-07T12:22:50Z","title":"mKG-RAG: Leveraging Multimodal Knowledge Graphs in Retrieval-Augmented Generation for Knowledge-intensive VQA","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-19T00:05:08.866244Z"},"links":{"cited_paper":"/paper/2411.15041","citing_paper":"/paper/2508.05318"},"observation_digest":"sha256:aa0eebb4712b967e66aa442acff9e899dc53f42ecd0b81d0969c8f7c4f38a7e6","observation_id":"0028bbce-5de7-4a43-97ad-17a3629fb18e","resolution":{"observed_at":"2026-05-19T00:06:55.031490Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15041","last_updated":"2026-08-17T08:53:39Z","snapshot_observed_at":"2026-08-20T23:15:22.000321Z","submitted_at":"2024-11-22T16:15:50Z","title":"mR$^2$AG: Multimodal Retrieval-Reflection-Augmented Generation for Knowledge-Based VQA","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15041","snapshot_observed_at":"2026-08-05T23:26:28.640658Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.05320","last_updated":"2025-08-07T12:24:36Z","snapshot_observed_at":"2026-08-16T03:52:51.486994Z","submitted_at":"2025-08-07T12:24:36Z","title":"Towards integrated sensors for optimized OCT with undetected photons","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-05T23:26:28.640658Z"},"links":{"cited_paper":"/paper/2411.15041","citing_paper":"/paper/2508.05320"},"observation_digest":"sha256:2da536fc1a3c28d5131e41d0e458b3ea616f14ef18c236fd34b8c1bc2a253e4a","observation_id":"ba192c7a-0448-4bcb-b339-ddc3dd8396d8","resolution":{"observed_at":"2026-08-05T23:26:28.640658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15041","last_updated":"2026-08-17T08:53:39Z","snapshot_observed_at":"2026-08-20T23:15:22.000321Z","submitted_at":"2024-11-22T16:15:50Z","title":"mR$^2$AG: Multimodal Retrieval-Reflection-Augmented Generation for Knowledge-Based VQA","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15041","snapshot_observed_at":"2026-08-05T20:28:53.107445Z","title":"Zhang et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10955","last_updated":"2025-08-14T07:25:45Z","snapshot_observed_at":"2026-08-20T01:25:29.959449Z","submitted_at":"2025-08-14T07:25:45Z","title":"Empowering Multimodal LLMs with External Tools: A Comprehensive Survey","version":1},"reference_index":111,"source":"arxiv_source","source_observed_at":"2026-08-05T20:28:53.107445Z"},"links":{"cited_paper":"/paper/2411.15041","citing_paper":"/paper/2508.10955"},"observation_digest":"sha256:f9650bbf2552fef5bfba5bee41da4dca28c6ed00f3240ea368d7665e3bfa0286","observation_id":"b2bdfe73-d43b-41af-85ab-ae2ccc4bbc60","resolution":{"observed_at":"2026-08-05T20:28:53.107445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15041","last_updated":"2026-08-17T08:53:39Z","snapshot_observed_at":"2026-08-20T23:15:22.000321Z","submitted_at":"2024-11-22T16:15:50Z","title":"mR$^2$AG: Multimodal Retrieval-Reflection-Augmented Generation for Knowledge-Based VQA","version":2},"cited_work":{"arxiv_id":"2411.15041","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.15041","snapshot_observed_at":"2026-07-09T12:46:14.749364Z","title":"mR2AG: Multimodal Retrieval-Reflection- Augmented Generation for Knowledge-Based VQA //","venue":"cs.AI","work_id":"0c2722ec-00a0-4134-85a0-9d1af99f1e7b","year":2024},"citing_paper":{"arxiv_id":"2509.00798","last_updated":"2026-04-22T02:56:00Z","snapshot_observed_at":"2026-07-29T03:25:03.283753Z","submitted_at":"2025-08-31T11:14:54Z","title":"Progressive Multimodal Search and Reasoning for Knowledge-Intensive Visual Question Answering","version":7},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-05-18T20:04:52.852253Z"},"links":{"cited_paper":"/paper/2411.15041","citing_paper":"/paper/2509.00798"},"observation_digest":"sha256:0d58c3d39fda88ce582bdabc093cdf58fba4f6d9d238324fa4aa06f7c7bd2954","observation_id":"1cef374f-1c2e-4445-9c40-1aae5369ac16","resolution":{"observed_at":"2026-05-18T20:06:49.834243Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15041","last_updated":"2026-08-17T08:53:39Z","snapshot_observed_at":"2026-08-20T23:15:22.000321Z","submitted_at":"2024-11-22T16:15:50Z","title":"mR$^2$AG: Multimodal Retrieval-Reflection-Augmented Generation for Knowledge-Based VQA","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15041","snapshot_observed_at":"2026-08-04T20:06:09.182830Z","title":"mR 2AG: Multimodal Retrieval-Reflection- Augmented Generation for Knowledge-Based VQA,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08897","last_updated":"2025-09-10T18:00:29Z","snapshot_observed_at":"2026-08-15T19:47:27.749061Z","submitted_at":"2025-09-10T18:00:29Z","title":"Recurrence Meets Transformers for Universal Multimodal Retrieval","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-04T20:06:09.182830Z"},"links":{"cited_paper":"/paper/2411.15041","citing_paper":"/paper/2509.08897"},"observation_digest":"sha256:4f2c333a0b9a74a96c3664b5a7fba05de0e5ae00e044f140d5260c29142008dc","observation_id":"c3f50af2-666a-4c96-9b4f-03dc62a0dc58","resolution":{"observed_at":"2026-08-04T20:06:09.182830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15041","last_updated":"2026-08-17T08:53:39Z","snapshot_observed_at":"2026-08-20T23:15:22.000321Z","submitted_at":"2024-11-22T16:15:50Z","title":"mR$^2$AG: Multimodal Retrieval-Reflection-Augmented Generation for Knowledge-Based VQA","version":2},"cited_work":{"arxiv_id":"2411.15041","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.15041","snapshot_observed_at":"2026-07-09T12:46:14.749364Z","title":"mR2AG: Multimodal Retrieval-Reflection- Augmented Generation for Knowledge-Based VQA //","venue":"cs.AI","work_id":"0c2722ec-00a0-4134-85a0-9d1af99f1e7b","year":2024},"citing_paper":{"arxiv_id":"2601.13856","last_updated":"2026-04-07T08:27:33Z","snapshot_observed_at":"2026-08-12T23:20:27.697486Z","submitted_at":"2026-01-20T11:08:33Z","title":"QKVQA: Question-Focused Filtering for Knowledge-based VQA","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-16T12:53:59.668663Z"},"links":{"cited_paper":"/paper/2411.15041","citing_paper":"/paper/2601.13856"},"observation_digest":"sha256:0f14145857be54acbd5e0c1ebc381d58792ccfa1cfc6b7a13c5d093c98da69bd","observation_id":"75576e0d-ca0b-4215-afda-05b752adcfb2","resolution":{"observed_at":"2026-05-16T12:57:54.028617Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15041","last_updated":"2026-08-17T08:53:39Z","snapshot_observed_at":"2026-08-20T23:15:22.000321Z","submitted_at":"2024-11-22T16:15:50Z","title":"mR$^2$AG: Multimodal Retrieval-Reflection-Augmented Generation for Knowledge-Based VQA","version":2},"cited_work":{"arxiv_id":"2411.15041","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.15041","snapshot_observed_at":"2026-07-09T12:46:14.749364Z","title":"mR2AG: Multimodal Retrieval-Reflection- Augmented Generation for Knowledge-Based VQA //","venue":"cs.AI","work_id":"0c2722ec-00a0-4134-85a0-9d1af99f1e7b","year":2024},"citing_paper":{"arxiv_id":"2604.05818","last_updated":"2026-04-14T13:54:15Z","snapshot_observed_at":"2026-08-13T08:24:31.709698Z","submitted_at":"2026-04-07T12:52:38Z","title":"WikiSeeker: Rethinking the Role of Vision-Language Models in Knowledge-Based Visual Question Answering","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-05-10T19:59:10.657346Z"},"links":{"cited_paper":"/paper/2411.15041","citing_paper":"/paper/2604.05818"},"observation_digest":"sha256:32f96a8bc9aa17529f987f77bdbcbeeadc5d700d54dd7f536d020cc073d17926","observation_id":"cb79a4e0-3510-432c-8642-b6680e020dfe","resolution":{"observed_at":"2026-05-10T22:20:48.065154Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15041","last_updated":"2026-08-17T08:53:39Z","snapshot_observed_at":"2026-08-20T23:15:22.000321Z","submitted_at":"2024-11-22T16:15:50Z","title":"mR$^2$AG: Multimodal Retrieval-Reflection-Augmented Generation for Knowledge-Based VQA","version":2},"cited_work":{"arxiv_id":"2411.15041","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.15041","snapshot_observed_at":"2026-07-09T12:46:14.749364Z","title":"mR2AG: Multimodal Retrieval-Reflection- Augmented Generation for Knowledge-Based VQA //","venue":"cs.AI","work_id":"0c2722ec-00a0-4134-85a0-9d1af99f1e7b","year":2024},"citing_paper":{"arxiv_id":"2605.29602","last_updated":"2026-05-28T08:40:34Z","snapshot_observed_at":"2026-08-13T21:27:00.744752Z","submitted_at":"2026-05-28T08:40:34Z","title":"CogniVerse: Revolutionizing Multi-Modal Retrieval-Augmented Generation with Cognitive Reflection and Geometric Reasoning","version":1},"reference_index":121,"source":"pdf_text","source_observed_at":"2026-06-29T08:14:20.558527Z"},"links":{"cited_paper":"/paper/2411.15041","citing_paper":"/paper/2605.29602"},"observation_digest":"sha256:ec5519faaff5b1a62c8b15b3ce59fa91af31f457fd395be4be942b822cb318d7","observation_id":"8cb9be3d-a963-4268-b521-4e1250a7b597","resolution":{"observed_at":"2026-06-29T08:23:15.730102Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15041","last_updated":"2026-08-17T08:53:39Z","snapshot_observed_at":"2026-08-20T23:15:22.000321Z","submitted_at":"2024-11-22T16:15:50Z","title":"mR$^2$AG: Multimodal Retrieval-Reflection-Augmented Generation for Knowledge-Based VQA","version":2},"cited_work":{"arxiv_id":"2411.15041","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.15041","snapshot_observed_at":"2026-07-09T12:46:14.749364Z","title":"mR2AG: Multimodal Retrieval-Reflection- Augmented Generation for Knowledge-Based VQA //","venue":"cs.AI","work_id":"0c2722ec-00a0-4134-85a0-9d1af99f1e7b","year":2024},"citing_paper":{"arxiv_id":"2606.23881","last_updated":"2026-06-22T19:27:00Z","snapshot_observed_at":"2026-08-13T01:37:35.388018Z","submitted_at":"2026-06-22T19:27:00Z","title":"Ground Then Rank: Revisiting Knowledge-Based VQA with Training-Free Entity Identification","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-06-26T08:12:14.829556Z"},"links":{"cited_paper":"/paper/2411.15041","citing_paper":"/paper/2606.23881"},"observation_digest":"sha256:72f84c596634a8984f9567baa05c9b747570014c809de38e835b32d0488a3b9e","observation_id":"c2c2eb77-cb22-404b-8831-8d3126503c4c","resolution":{"observed_at":"2026-07-04T10:59:46.839046Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15041","last_updated":"2026-08-17T08:53:39Z","snapshot_observed_at":"2026-08-20T23:15:22.000321Z","submitted_at":"2024-11-22T16:15:50Z","title":"mR$^2$AG: Multimodal Retrieval-Reflection-Augmented Generation for Knowledge-Based VQA","version":2},"cited_work":{"arxiv_id":"2411.15041","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.15041","snapshot_observed_at":"2026-07-09T12:46:14.749364Z","title":"mR2AG: Multimodal Retrieval-Reflection- Augmented Generation for Knowledge-Based VQA //","venue":"cs.AI","work_id":"0c2722ec-00a0-4134-85a0-9d1af99f1e7b","year":2024},"citing_paper":{"arxiv_id":"2607.07383","last_updated":"2026-07-08T13:15:39Z","snapshot_observed_at":"2026-08-12T17:13:44.350901Z","submitted_at":"2026-07-08T13:15:39Z","title":"MMAgent-R$^2$: Learning to Rerank and Reject for Agentic mRAG","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-09T12:37:07.906342Z"},"links":{"cited_paper":"/paper/2411.15041","citing_paper":"/paper/2607.07383"},"observation_digest":"sha256:af29c294bdbe6ce22dc46b03dc3a3bf2e2d4fdfa1d34f7b17873ad97fd688f8d","observation_id":"aa6dbd07-ebad-41b7-b8e4-c04f6228adb9","resolution":{"observed_at":"2026-07-09T12:46:14.750625Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15041","last_updated":"2026-08-17T08:53:39Z","snapshot_observed_at":"2026-08-20T23:15:22.000321Z","submitted_at":"2024-11-22T16:15:50Z","title":"mR$^2$AG: Multimodal Retrieval-Reflection-Augmented Generation for Knowledge-Based VQA","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15041","snapshot_observed_at":"2026-08-02T10:20:50.701345Z","title":"arXiv preprint arXiv:2411.15041 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22643","last_updated":"2026-06-24T02:40:49Z","snapshot_observed_at":"2026-08-16T05:48:21.160961Z","submitted_at":"2026-06-24T02:40:49Z","title":"Reason Before You Retrieve: Agentic Planning for Multi-modal RAG","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-02T10:20:50.701345Z"},"links":{"cited_paper":"/paper/2411.15041","citing_paper":"/paper/2607.22643"},"observation_digest":"sha256:efa521f0b81e8e83463f5d4085c9a364e0e6fb13257476b1c89ec07ab85ca766","observation_id":"11576698-4461-4e44-88f8-c8736543b8bb","resolution":{"observed_at":"2026-08-02T10:20:50.701345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15041","last_updated":"2026-08-17T08:53:39Z","snapshot_observed_at":"2026-08-20T23:15:22.000321Z","submitted_at":"2024-11-22T16:15:50Z","title":"mR$^2$AG: Multimodal Retrieval-Reflection-Augmented Generation for Knowledge-Based VQA","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15041","snapshot_observed_at":"2026-08-06T00:31:17.751661Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01147","last_updated":"2026-08-05T14:42:29Z","snapshot_observed_at":"2026-08-15T10:22:48.930149Z","submitted_at":"2026-08-02T10:57:53Z","title":"UniHEAR: Unified Heterogeneous-Source Attentive Retrieval for Knowledge-Based Visual Question Answering","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T00:31:17.751661Z"},"links":{"cited_paper":"/paper/2411.15041","citing_paper":"/paper/2608.01147"},"observation_digest":"sha256:e43fd51ce4e94628512270b964e1e0e5f882f556d8bc188cbebfc315384ea740","observation_id":"b8c9e70d-aa80-4e22-a27a-d2696ec8f8d1","resolution":{"observed_at":"2026-08-06T00:31:17.751661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15041","last_updated":"2026-08-17T08:53:39Z","snapshot_observed_at":"2026-08-20T23:15:22.000321Z","submitted_at":"2024-11-22T16:15:50Z","title":"mR$^2$AG: Multimodal Retrieval-Reflection-Augmented Generation for Knowledge-Based VQA","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15041","snapshot_observed_at":"2026-08-06T04:19:53.771485Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01147","last_updated":"2026-08-05T14:42:29Z","snapshot_observed_at":"2026-08-15T10:22:48.930149Z","submitted_at":"2026-08-02T10:57:53Z","title":"UniHEAR: Unified Heterogeneous-Source Attentive Retrieval for Knowledge-Based Visual Question Answering","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T04:19:53.771485Z"},"links":{"cited_paper":"/paper/2411.15041","citing_paper":"/paper/2608.01147"},"observation_digest":"sha256:4922fe9dfa2458f2852bec6e9867db00e8b3c5ae6e633df896650ba690f7471b","observation_id":"90a75562-a2e8-494d-8a15-9392fa7bb123","resolution":{"observed_at":"2026-08-06T04:19:53.771485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15041","last_updated":"2026-08-17T08:53:39Z","snapshot_observed_at":"2026-08-20T23:15:22.000321Z","submitted_at":"2024-11-22T16:15:50Z","title":"mR$^2$AG: Multimodal Retrieval-Reflection-Augmented Generation for Knowledge-Based VQA","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15041","snapshot_observed_at":"2026-08-07T20:15:14.692955Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05967","last_updated":"2026-08-06T12:44:35Z","snapshot_observed_at":"2026-08-15T03:07:43.116968Z","submitted_at":"2026-08-06T12:44:35Z","title":"M$^3$Prune: Hierarchical Collaborative Pruning for Efficient Multi-Modal Multi-Agent Retrieval-Augmented Generation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T20:15:14.692955Z"},"links":{"cited_paper":"/paper/2411.15041","citing_paper":"/paper/2608.05967"},"observation_digest":"sha256:ba22d26638737142346da4afe0e7c02c9e34a9303f729db8641c7a76d4e7d2af","observation_id":"5069e662-c10a-44cf-aef2-4d67d23e3bcf","resolution":{"observed_at":"2026-08-07T20:15:14.692955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2411.15041/citation-record","integrity":"/paper/2411.15041/integrity","json":"/paper/2411.15041/citation-record.json","paper":"/paper/2411.15041"},"outbound":[],"paper":{"arxiv_id":"2411.15041","last_updated":"2026-08-17T08:53:39Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-20T23:15:22.000321Z","submitted_at":"2024-11-22T16:15:50Z","title":"mR$^2$AG: Multimodal Retrieval-Reflection-Augmented Generation for Knowledge-Based VQA"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 17 inbound Pith citation observations for arXiv:2411.15041."}