{"as_of":"2026-08-21T17:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9cbdbed3d36b535622a6fdc1406465dc8525b7269a6861bdc00a12ac9dcef171","coverage":[{"denominator":15,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:27:42.487192Z","state":"measured"},{"denominator":21,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":21,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T08:13:52.083852Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T10:59:46.895392Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.02544","last_updated":"2025-06-04T06:31:54Z","snapshot_observed_at":"2026-08-18T12:17:15.709025Z","submitted_at":"2025-06-03T07:32:40Z","title":"CoRe-MMRAG: Cross-Source Knowledge Reconciliation for Multimodal RAG","version":2},"cited_work":{"arxiv_id":"2506.02544","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.02544","snapshot_observed_at":"2026-07-04T10:59:46.895392Z","title":"Core-mmrag: Cross- source knowledge reconciliation for multimodal rag.arXiv preprint arXiv:2506.02544","venue":null,"work_id":"f4bde899-24c2-4f34-b472-8d9d2f325258","year":2025},"citing_paper":{"arxiv_id":"2601.13856","last_updated":"2026-04-07T08:27:33Z","snapshot_observed_at":"2026-08-12T23:20:27.697486Z","submitted_at":"2026-01-20T11:08:33Z","title":"QKVQA: Question-Focused Filtering for Knowledge-based VQA","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-16T12:53:59.668663Z"},"links":{"cited_paper":"/paper/2506.02544","citing_paper":"/paper/2601.13856"},"observation_digest":"sha256:097675dc91eb2d7e2d01e657f0226827221e8c2cbea17f7d1df0513c0db90f79","observation_id":"d1480f20-8b74-4610-b137-904eab329c4c","resolution":{"observed_at":"2026-05-16T12:57:54.018414Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.02544","last_updated":"2025-06-04T06:31:54Z","snapshot_observed_at":"2026-08-18T12:17:15.709025Z","submitted_at":"2025-06-03T07:32:40Z","title":"CoRe-MMRAG: Cross-Source Knowledge Reconciliation for Multimodal RAG","version":2},"cited_work":{"arxiv_id":"2506.02544","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.02544","snapshot_observed_at":"2026-07-04T10:59:46.895392Z","title":"Core-mmrag: Cross- source knowledge reconciliation for multimodal rag.arXiv preprint arXiv:2506.02544","venue":null,"work_id":"f4bde899-24c2-4f34-b472-8d9d2f325258","year":2025},"citing_paper":{"arxiv_id":"2602.00104","last_updated":"2026-06-03T13:13:52Z","snapshot_observed_at":"2026-08-16T10:21:20.753373Z","submitted_at":"2026-01-25T12:12:12Z","title":"R3G: A Reasoning-Retrieval-Reranking Framework for Vision-Centric Answer Generation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-16T10:46:17.411843Z"},"links":{"cited_paper":"/paper/2506.02544","citing_paper":"/paper/2602.00104"},"observation_digest":"sha256:25113c66211f31b441bec41ecd09652401c40d56a94ed625a21853569de052a8","observation_id":"164cbf70-785c-49c6-b63c-109cd5b42946","resolution":{"observed_at":"2026-05-16T10:47:45.523818Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.02544","last_updated":"2025-06-04T06:31:54Z","snapshot_observed_at":"2026-08-18T12:17:15.709025Z","submitted_at":"2025-06-03T07:32:40Z","title":"CoRe-MMRAG: Cross-Source Knowledge Reconciliation for Multimodal RAG","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.02544","snapshot_observed_at":"2026-08-03T08:13:52.083852Z","title":"Core-mmrag: Cross-source knowledge rec- onciliation for multimodal rag,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.00104","last_updated":"2026-06-03T13:13:52Z","snapshot_observed_at":"2026-08-16T10:21:20.753373Z","submitted_at":"2026-01-25T12:12:12Z","title":"R3G: A Reasoning-Retrieval-Reranking Framework for Vision-Centric Answer Generation","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T08:13:52.083852Z"},"links":{"cited_paper":"/paper/2506.02544","citing_paper":"/paper/2602.00104"},"observation_digest":"sha256:4ae9da3fbacb4efa2759d777cf78638200a20054e99dc118dd673264a884608e","observation_id":"216cee87-7a15-40eb-bf92-d585ea4654ea","resolution":{"observed_at":"2026-08-03T08:13:52.083852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.02544","last_updated":"2025-06-04T06:31:54Z","snapshot_observed_at":"2026-08-18T12:17:15.709025Z","submitted_at":"2025-06-03T07:32:40Z","title":"CoRe-MMRAG: Cross-Source Knowledge Reconciliation for Multimodal RAG","version":2},"cited_work":{"arxiv_id":"2506.02544","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.02544","snapshot_observed_at":"2026-07-04T10:59:46.895392Z","title":"Core-mmrag: Cross- source knowledge reconciliation for multimodal rag.arXiv preprint arXiv:2506.02544","venue":null,"work_id":"f4bde899-24c2-4f34-b472-8d9d2f325258","year":2025},"citing_paper":{"arxiv_id":"2606.23881","last_updated":"2026-06-22T19:27:00Z","snapshot_observed_at":"2026-08-13T01:37:35.388018Z","submitted_at":"2026-06-22T19:27:00Z","title":"Ground Then Rank: Revisiting Knowledge-Based VQA with Training-Free Entity Identification","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-06-26T08:12:14.829556Z"},"links":{"cited_paper":"/paper/2506.02544","citing_paper":"/paper/2606.23881"},"observation_digest":"sha256:772ac2b827cbac74380bb5949668a09c30a2d65a304cfc0145fcca5e018f2229","observation_id":"3712d792-7b11-493f-af27-a0c1801b0f11","resolution":{"observed_at":"2026-07-04T10:59:46.896966Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.02544","last_updated":"2025-06-04T06:31:54Z","snapshot_observed_at":"2026-08-18T12:17:15.709025Z","submitted_at":"2025-06-03T07:32:40Z","title":"CoRe-MMRAG: Cross-Source Knowledge Reconciliation for Multimodal RAG","version":2},"cited_work":{"arxiv_id":"2506.02544","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.02544","snapshot_observed_at":"2026-07-04T10:59:46.895392Z","title":"Core-mmrag: Cross- source knowledge reconciliation for multimodal rag.arXiv preprint arXiv:2506.02544","venue":null,"work_id":"f4bde899-24c2-4f34-b472-8d9d2f325258","year":2025},"citing_paper":{"arxiv_id":"2607.00159","last_updated":"2026-06-30T20:35:30Z","snapshot_observed_at":"2026-08-17T11:12:15.091346Z","submitted_at":"2026-06-30T20:35:30Z","title":"Identifying and Resolving Pitfalls of Knowledge-Based VQA Benchmarks: Auditing, Repairing, and Augmenting","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-02T19:13:44.015782Z"},"links":{"cited_paper":"/paper/2506.02544","citing_paper":"/paper/2607.00159"},"observation_digest":"sha256:5a9cec5437b8edf691f607adce834be7fff10c6417009421692c518c5c4390c2","observation_id":"aa184d3b-8526-42fb-9614-167065862127","resolution":{"observed_at":"2026-07-02T19:17:17.749904Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.02544","last_updated":"2025-06-04T06:31:54Z","snapshot_observed_at":"2026-08-18T12:17:15.709025Z","submitted_at":"2025-06-03T07:32:40Z","title":"CoRe-MMRAG: Cross-Source Knowledge Reconciliation for Multimodal RAG","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.02544","snapshot_observed_at":"2026-08-02T10:20:50.924849Z","title":"arXiv preprint arXiv:2506.02544 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22643","last_updated":"2026-06-24T02:40:49Z","snapshot_observed_at":"2026-08-16T05:48:21.160961Z","submitted_at":"2026-06-24T02:40:49Z","title":"Reason Before You Retrieve: Agentic Planning for Multi-modal RAG","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-02T10:20:50.924849Z"},"links":{"cited_paper":"/paper/2506.02544","citing_paper":"/paper/2607.22643"},"observation_digest":"sha256:1ccc3600dcee1df389b38ecc986e17f5807eca70be7ed1fa1f6cb166d7583853","observation_id":"88f469f5-e898-4ebe-a509-99c2b00d22dc","resolution":{"observed_at":"2026-08-02T10:20:50.924849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.02544/citation-record","integrity":"/paper/2506.02544/integrity","json":"/paper/2506.02544/citation-record.json","paper":"/paper/2506.02544"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2404.18930","last_updated":"2025-04-01T18:36:08Z","snapshot_observed_at":"2026-08-06T19:08:14.800394Z","submitted_at":"2024-04-29T17:59:41Z","title":"Hallucination of Multimodal Large Language Models: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.18930","snapshot_observed_at":"2026-08-07T11:27:41.685365Z","title":"Davide Caffagni, Federico Cocchi, Nicholas Moratelli, Sara Sarto, Marcella Cornia, Lorenzo Baraldi, and Rita Cucchiara","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.02544","last_updated":"2025-06-04T06:31:54Z","snapshot_observed_at":"2026-08-18T12:17:15.709025Z","submitted_at":"2025-06-03T07:32:40Z","title":"CoRe-MMRAG: Cross-Source Knowledge Reconciliation for Multimodal RAG","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:41.685365Z"},"links":{"cited_paper":"/paper/2404.18930","citing_paper":"/paper/2506.02544"},"observation_digest":"sha256:efb9563de9faf4e13685ef700d04324942c24a887cbaa50635fa6bedf8f6366a","observation_id":"7f73c72b-652c-42c6-a672-7a0a324433d9","resolution":{"observed_at":"2026-08-07T11:27:41.685365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:43.046858Z","title":"Zhe Chen, Jiannan Wu, Wenhai Wang, Weijie Su, Guo Chen, Sen Xing, Muyan Zhong, Qinglong Zhang, Xizhou Zhu, Lewei Lu, et al","venue":null,"work_id":"394cbbad-c6b2-4cfd-803c-8dd009efbd83","year":2023},"citing_paper":{"arxiv_id":"2506.02544","last_updated":"2025-06-04T06:31:54Z","snapshot_observed_at":"2026-08-18T12:17:15.709025Z","submitted_at":"2025-06-03T07:32:40Z","title":"CoRe-MMRAG: Cross-Source Knowledge Reconciliation for Multimodal RAG","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:41.799921Z"},"links":{"citing_paper":"/paper/2506.02544"},"observation_digest":"sha256:9daa560766e689b3f4e97345c49c00dec1783c748cb8fa4bcb12f7b31e155796","observation_id":"3beadc01-1b76-4f3d-bbad-477785cd7ce6","resolution":{"observed_at":"2026-08-07T11:27:43.089302Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10997","last_updated":"2024-03-27T09:16:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-18T07:47:33Z","title":"Retrieval-Augmented Generation for Large Language Models: A Survey","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10997","snapshot_observed_at":"2026-08-07T11:27:41.852787Z","title":"Wenbo Hu, Jia-Chen Gu, Zi-Yi Dou, Mohsen Fayyaz, Pan Lu, Kai-Wei Chang, and Nanyun Peng","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.02544","last_updated":"2025-06-04T06:31:54Z","snapshot_observed_at":"2026-08-18T12:17:15.709025Z","submitted_at":"2025-06-03T07:32:40Z","title":"CoRe-MMRAG: Cross-Source Knowledge Reconciliation for Multimodal RAG","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:41.852787Z"},"links":{"cited_paper":"/paper/2312.10997","citing_paper":"/paper/2506.02544"},"observation_digest":"sha256:b3bba9b88c050383b08e1fc145d5d848208f2f57c516f1dc128f1c2e0464f33e","observation_id":"d2f654ba-9ed5-4898-be63-a5944f2fc62d","resolution":{"observed_at":"2026-08-07T11:27:41.852787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03326","last_updated":"2024-10-26T16:35:13Z","snapshot_observed_at":"2026-08-18T11:56:50.710310Z","submitted_at":"2024-08-06T17:59:44Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03326","snapshot_observed_at":"2026-08-07T11:27:41.900497Z","title":"Junnan Li, Dongxu Li, Silvio Savarese, and Steven Hoi","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02544","last_updated":"2025-06-04T06:31:54Z","snapshot_observed_at":"2026-08-18T12:17:15.709025Z","submitted_at":"2025-06-03T07:32:40Z","title":"CoRe-MMRAG: Cross-Source Knowledge Reconciliation for Multimodal RAG","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:41.900497Z"},"links":{"cited_paper":"/paper/2408.03326","citing_paper":"/paper/2506.02544"},"observation_digest":"sha256:5a79311416f8b413eafafb39177c7678395d669e593a61715da441451ae98c87","observation_id":"ca497e44-ca88-41ad-a5bc-c696b0e9fb87","resolution":{"observed_at":"2026-08-07T11:27:41.900497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08876","last_updated":"2024-10-14T20:31:13Z","snapshot_observed_at":"2026-08-18T18:39:38.744680Z","submitted_at":"2024-10-11T14:51:00Z","title":"RoRA-VLM: Robust Retrieval-Augmented Vision Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08876","snapshot_observed_at":"2026-08-07T11:27:42.060896Z","title":"Alec Radford, Jong Wook Kim, Chris Hallacy, Aditya Ramesh, Gabriel Goh, Sandhini Agarwal, Girish Sas- try, Amanda Askell, Pamela Mishkin, Jack Clark, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.02544","last_updated":"2025-06-04T06:31:54Z","snapshot_observed_at":"2026-08-18T12:17:15.709025Z","submitted_at":"2025-06-03T07:32:40Z","title":"CoRe-MMRAG: Cross-Source Knowledge Reconciliation for Multimodal RAG","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:42.060896Z"},"links":{"cited_paper":"/paper/2410.08876","citing_paper":"/paper/2506.02544"},"observation_digest":"sha256:61a003cf4e4d07b8c8f5344a847cad84af2a692e88621a5dcc31a5b647bc4cec","observation_id":"af0be477-6e68-402b-8965-f41bcf419d97","resolution":{"observed_at":"2026-08-07T11:27:42.060896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-08-14T18:15:53.516440Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-07T11:27:42.125290Z","title":"Dustin Schwenk, Apoorv Khandelwal, Christopher Clark, Kenneth Marino, and Roozbeh Mottaghi","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.02544","last_updated":"2025-06-04T06:31:54Z","snapshot_observed_at":"2026-08-18T12:17:15.709025Z","submitted_at":"2025-06-03T07:32:40Z","title":"CoRe-MMRAG: Cross-Source Knowledge Reconciliation for Multimodal RAG","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:42.125290Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2506.02544"},"observation_digest":"sha256:723f7c10e311faf008abe085168c25242ed4d1a56bf53174d671c6138e0aaf5c","observation_id":"46205d72-2ffe-4cef-83b9-c37970ecc8d8","resolution":{"observed_at":"2026-08-07T11:27:42.125290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.15389","last_updated":"2023-03-27T17:02:21Z","snapshot_observed_at":"2026-08-20T09:51:02.717471Z","submitted_at":"2023-03-27T17:02:21Z","title":"EVA-CLIP: Improved Training Techniques for CLIP at Scale","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.15389","snapshot_observed_at":"2026-08-07T11:27:42.212327Z","title":"Peng Wang, Shuai Bai, Sinan Tan, Shijie Wang, Zhi- hao Fan, Jinze Bai, Keqin Chen, Xuejing Liu, Jialin Wang, Wenbin Ge, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.02544","last_updated":"2025-06-04T06:31:54Z","snapshot_observed_at":"2026-08-18T12:17:15.709025Z","submitted_at":"2025-06-03T07:32:40Z","title":"CoRe-MMRAG: Cross-Source Knowledge Reconciliation for Multimodal RAG","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:42.212327Z"},"links":{"cited_paper":"/paper/2303.15389","citing_paper":"/paper/2506.02544"},"observation_digest":"sha256:c45f75eb746c089c2edbc94f58b13aada0dc21f294f06b0fa6a478cc2e9562bf","observation_id":"b61f0927-d9e2-4c71-894d-05bbedf80005","resolution":{"observed_at":"2026-08-07T11:27:42.212327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-07T11:27:42.252278Z","title":"Xiao Wang, Jianlong Wu, Zijia Lin, Fuzheng Zhang, Di Zhang, and Liqiang Nie","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.02544","last_updated":"2025-06-04T06:31:54Z","snapshot_observed_at":"2026-08-18T12:17:15.709025Z","submitted_at":"2025-06-03T07:32:40Z","title":"CoRe-MMRAG: Cross-Source Knowledge Reconciliation for Multimodal RAG","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:42.252278Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2506.02544"},"observation_digest":"sha256:2bc9c2c84df278ae3a08236dadd3a8e6bbe4d21b149f882164467ebacaf373cd","observation_id":"16e1be0e-6fb7-4639-abb9-7ed1acc566bc","resolution":{"observed_at":"2026-08-07T11:27:42.252278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.01800","last_updated":"2024-08-03T15:02:21Z","snapshot_observed_at":"2026-08-21T07:48:51.700518Z","submitted_at":"2024-08-03T15:02:21Z","title":"MiniCPM-V: A GPT-4V Level MLLM on Your Phone","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.01800","snapshot_observed_at":"2026-08-07T11:27:42.299624Z","title":"Zhenfei Yin, Jiong Wang, Jianjian Cao, Zhelun Shi, Dingning Liu, Mukai Li, Xiaoshui Huang, Zhiy- ong Wang, Lu Sheng, Lei Bai, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.02544","last_updated":"2025-06-04T06:31:54Z","snapshot_observed_at":"2026-08-18T12:17:15.709025Z","submitted_at":"2025-06-03T07:32:40Z","title":"CoRe-MMRAG: Cross-Source Knowledge Reconciliation for Multimodal RAG","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:42.299624Z"},"links":{"cited_paper":"/paper/2408.01800","citing_paper":"/paper/2506.02544"},"observation_digest":"sha256:87c8d74998290e815d2833ff0944d1f90b89f4d97e32f2a363053ee57b9996f5","observation_id":"810c2194-4f26-46ea-bfed-33bb50d756c1","resolution":{"observed_at":"2026-08-07T11:27:42.299624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:42.833012Z","title":"spring of the kid","venue":null,"work_id":"5a67327c-e8fc-4d28-afe5-bac2e0e44591","year":1929},"citing_paper":{"arxiv_id":"2506.02544","last_updated":"2025-06-04T06:31:54Z","snapshot_observed_at":"2026-08-18T12:17:15.709025Z","submitted_at":"2025-06-03T07:32:40Z","title":"CoRe-MMRAG: Cross-Source Knowledge Reconciliation for Multimodal RAG","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:42.487192Z"},"links":{"citing_paper":"/paper/2506.02544"},"observation_digest":"sha256:97aeae1c05dce3243c1d05f8de4dc758347a9a4bdf0da4b8e40dd8500e650eaf","observation_id":"01216d86-24ca-43d0-9595-09af80a5572e","resolution":{"observed_at":"2026-08-07T11:27:42.893032Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:42.966845Z","title":"Scotland","venue":null,"work_id":"f962c2bc-1366-4c13-82b0-8692ef2650f5","year":1901},"citing_paper":{"arxiv_id":"2506.02544","last_updated":"2025-06-04T06:31:54Z","snapshot_observed_at":"2026-08-18T12:17:15.709025Z","submitted_at":"2025-06-03T07:32:40Z","title":"CoRe-MMRAG: Cross-Source Knowledge Reconciliation for Multimodal RAG","version":2},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:42.422193Z"},"links":{"citing_paper":"/paper/2506.02544"},"observation_digest":"sha256:8812df13af88ba75dcc02fb37be54ea2c71cc1ec5ab7873ff237a711a74be2bd","observation_id":"8dfd9098-ea8c-4823-9bbb-e6f90747cbee","resolution":{"observed_at":"2026-08-07T11:27:42.993214Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00253","last_updated":"2024-05-06T01:10:01Z","snapshot_observed_at":"2026-08-17T09:37:14.144521Z","submitted_at":"2024-02-01T00:33:21Z","title":"A Survey on Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00253","snapshot_observed_at":"2026-08-07T11:27:41.996134Z","title":"InProceedings of the Web Conference 2021, page 1296–1305","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.02544","last_updated":"2025-06-04T06:31:54Z","snapshot_observed_at":"2026-08-18T12:17:15.709025Z","submitted_at":"2025-06-03T07:32:40Z","title":"CoRe-MMRAG: Cross-Source Knowledge Reconciliation for Multimodal RAG","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:41.996134Z"},"links":{"cited_paper":"/paper/2402.00253","citing_paper":"/paper/2506.02544"},"observation_digest":"sha256:a49888e27007668b38121648360e0a4d89e56130d981c8564e263a9d797863e0","observation_id":"535a8136-400b-4dc6-809c-92d4c64cfe0b","resolution":{"observed_at":"2026-08-07T11:27:41.996134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15041","last_updated":"2026-08-17T08:53:39Z","snapshot_observed_at":"2026-08-20T23:15:22.000321Z","submitted_at":"2024-11-22T16:15:50Z","title":"mR$^2$AG: Multimodal Retrieval-Reflection-Augmented Generation for Knowledge-Based VQA","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15041","snapshot_observed_at":"2026-08-07T11:27:42.371621Z","title":"Jingyi Zhang, Jiaxing Huang, Sheng Jin, and Shijian Lu","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.02544","last_updated":"2025-06-04T06:31:54Z","snapshot_observed_at":"2026-08-18T12:17:15.709025Z","submitted_at":"2025-06-03T07:32:40Z","title":"CoRe-MMRAG: Cross-Source Knowledge Reconciliation for Multimodal RAG","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:42.371621Z"},"links":{"cited_paper":"/paper/2411.15041","citing_paper":"/paper/2506.02544"},"observation_digest":"sha256:ecf6bbb7ee26196d0ad5bccb7c8e4156a94c9b8c0e79cc2bbff5bab8f4685b32","observation_id":"875aafb3-c194-4219-98e1-50d24b64f030","resolution":{"observed_at":"2026-08-07T11:27:42.371621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T11:27:41.579116Z","title":"arXiv preprint arXiv:2303.08774, pages 1–100","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.02544","last_updated":"2025-06-04T06:31:54Z","snapshot_observed_at":"2026-08-18T12:17:15.709025Z","submitted_at":"2025-06-03T07:32:40Z","title":"CoRe-MMRAG: Cross-Source Knowledge Reconciliation for Multimodal RAG","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:41.579116Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.02544"},"observation_digest":"sha256:88d3c4aa874d999c8b39b28550fcd8110aa3a097c754d508ed39cb21f6786d8e","observation_id":"8ab4768c-4cb0-4da1-a5fe-509f928df0e3","resolution":{"observed_at":"2026-08-07T11:27:41.579116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:43.166755Z","title":"InProceedings of the 2024 Con- ference on Empirical Methods in Natural Language Processing, pages 16499–16513","venue":null,"work_id":"68329b74-87b9-436b-b0e5-a0e8cb384796","year":2024},"citing_paper":{"arxiv_id":"2506.02544","last_updated":"2025-06-04T06:31:54Z","snapshot_observed_at":"2026-08-18T12:17:15.709025Z","submitted_at":"2025-06-03T07:32:40Z","title":"CoRe-MMRAG: Cross-Source Knowledge Reconciliation for Multimodal RAG","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:41.629502Z"},"links":{"citing_paper":"/paper/2506.02544"},"observation_digest":"sha256:77314546806facb77b036c08bc080ed7de43018e1ad216b97b6792068441f30b","observation_id":"d0a4cde3-1e51-4733-847e-47cf845e2e51","resolution":{"observed_at":"2026-08-07T11:27:43.218499Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.02544","last_updated":"2025-06-04T06:31:54Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-18T12:17:15.709025Z","submitted_at":"2025-06-03T07:32:40Z","title":"CoRe-MMRAG: Cross-Source Knowledge Reconciliation for Multimodal RAG"},"reference_resolution":{"displayed":15,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":0,"verified_fuzzy":4},"total_outbound_references":15},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 15 of 15 outbound references and 6 inbound Pith citation observations for arXiv:2506.02544."}