{"as_of":"2026-08-10T06:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2ec61bb624c34c743441ee3c64242c331800ddd91784917e47da65c0c6023d30","coverage":[{"denominator":52,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":52,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T23:20:01.204321Z","state":"measured"},{"denominator":54,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":54,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:30:08.756767Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T20:40:07.536409Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-09T17:33:47.070390Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.04176","snapshot_observed_at":"2026-08-07T04:30:08.756767Z","title":"Mramg- bench: A beyondtext benchmark for multimodal retrieval- augmented multimodal generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10408","last_updated":"2025-06-12T07:01:56Z","snapshot_observed_at":"2026-08-09T17:34:32.242783Z","submitted_at":"2025-06-12T07:01:56Z","title":"Reasoning RAG via System 1 or System 2: A Survey on Reasoning Agentic Retrieval-Augmented Generation for Industry Challenges","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T04:30:08.756767Z"},"links":{"cited_paper":"/paper/2502.04176","citing_paper":"/paper/2506.10408"},"observation_digest":"sha256:c3ef7cc35e7957f49bb52950c530b709ed803eb28e315740f17d461c9c5a7fae","observation_id":"064feb79-9ef9-4f0c-996c-f11af597f472","resolution":{"observed_at":"2026-08-07T04:30:08.756767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-09T17:33:47.070390Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"cited_work":{"arxiv_id":"2502.04176","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.04176","snapshot_observed_at":"2026-07-04T20:40:07.536409Z","title":"arXiv preprint arXiv:2502.04176 , year=","venue":null,"work_id":"08482678-a902-43a3-8388-f734bbc22fcd","year":null},"citing_paper":{"arxiv_id":"2606.26079","last_updated":"2026-06-24T17:53:26Z","snapshot_observed_at":"2026-08-08T12:16:57.837000Z","submitted_at":"2026-06-24T17:53:26Z","title":"Same Evidence, Different Answer: Auditing Order Sensitivity in Multimodal Large Language Models","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-06-25T19:58:23.594907Z"},"links":{"cited_paper":"/paper/2502.04176","citing_paper":"/paper/2606.26079"},"observation_digest":"sha256:d7d41193f18cba4064d97a5fa75b85b6c044b7ea7580916abf0fb68d765269e6","observation_id":"412345b8-5035-4ef3-9176-7deb5fbe1a2f","resolution":{"observed_at":"2026-07-04T20:40:07.538163Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.04176/citation-record","integrity":"/paper/2502.04176/integrity","json":"/paper/2502.04176/citation-record.json","paper":"/paper/2502.04176"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:20:00.963580Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-09T17:33:47.070390Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:00.963580Z"},"links":{"citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:7021da59e8c2f97121d91c0ab61e31d2e11442a9dfdb524f856d43260891be61","observation_id":"dc9e559f-d767-43c6-89d9-131cf994bb62","resolution":{"observed_at":"2026-08-08T23:20:00.963580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.18930","last_updated":"2025-04-01T18:36:08Z","snapshot_observed_at":"2026-08-06T19:08:14.800394Z","submitted_at":"2024-04-29T17:59:41Z","title":"Hallucination of Multimodal Large Language Models: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.18930","snapshot_observed_at":"2026-08-08T23:20:00.968048Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-09T17:33:47.070390Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:00.968048Z"},"links":{"cited_paper":"/paper/2404.18930","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:6d65b469136cc1bd8ed3aabc2cae10edf7cefb52f2dc628cd1f5394932838e46","observation_id":"d514c9de-8493-4418-94c1-1bf6cfd9f34c","resolution":{"observed_at":"2026-08-08T23:20:00.968048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.05432","last_updated":"2023-05-09T13:20:59Z","snapshot_observed_at":"2026-08-09T17:34:54.204752Z","submitted_at":"2023-05-09T13:20:59Z","title":"WikiWeb2M: A Page-Level Multimodal Wikipedia Dataset","version":1},"cited_work":{"arxiv_id":"2305.05432","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.05432","snapshot_observed_at":"2026-08-08T23:20:01.468981Z","title":"WikiWeb2M: A Page-Level Multimodal Wikipedia Dataset","venue":"cs.CL","work_id":"8cafd07e-d1d7-41c2-b64d-f5ed2fd040c5","year":2023},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-09T17:33:47.070390Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:00.972117Z"},"links":{"cited_paper":"/paper/2305.05432","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:f488cc0a190ea57744337e8d85156ce95223b9423593006067e9ba5be44e77c9","observation_id":"3a24ebba-a154-46db-be7a-42df2939375e","resolution":{"observed_at":"2026-08-08T23:20:01.476263Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:20:01.644157Z","title":null,"venue":null,"work_id":"9627fbe5-e5b8-43ac-835e-59f3a0bf7b9b","year":2022},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-09T17:33:47.070390Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:00.975898Z"},"links":{"citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:04490a170271480609205d68365174830317097780fc22415e963120f88caf21","observation_id":"7ffb8d29-0fbf-43c1-929e-ae2e4a951736","resolution":{"observed_at":"2026-08-08T23:20:01.647144Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03216","last_updated":"2025-12-12T11:26:32Z","snapshot_observed_at":"2026-07-06T17:25:35.493362Z","submitted_at":"2024-02-05T17:26:49Z","title":"M3-Embedding: Multi-Linguality, Multi-Functionality, Multi-Granularity Text Embeddings Through Self-Knowledge Distillation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03216","snapshot_observed_at":"2026-08-08T23:20:00.979616Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-09T17:33:47.070390Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:00.979616Z"},"links":{"cited_paper":"/paper/2402.03216","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:738eb83c7d853518ad3212016af2c2116c5b7c9139c2878b3d949914baa008dc","observation_id":"ad6323e6-addb-4e8c-aedc-4305e405d28b","resolution":{"observed_at":"2026-08-08T23:20:00.979616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02928","last_updated":"2022-10-20T17:16:27Z","snapshot_observed_at":"2026-08-06T23:46:49.824788Z","submitted_at":"2022-10-06T13:58:03Z","title":"MuRAG: Multimodal Retrieval-Augmented Generator for Open Question Answering over Images and Text","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02928","snapshot_observed_at":"2026-08-08T23:20:00.983801Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-09T17:33:47.070390Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:00.983801Z"},"links":{"cited_paper":"/paper/2210.02928","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:f4d0380bd343649da6255fb965de77e23818e3402ec550f758f76c40036ec943","observation_id":"d2f0424b-b94b-4aae-9e70-994e4d7507bc","resolution":{"observed_at":"2026-08-08T23:20:00.983801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05271","last_updated":"2025-09-26T12:52:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-06T18:57:08Z","title":"Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05271","snapshot_observed_at":"2026-08-08T23:20:00.987901Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-09T17:33:47.070390Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:00.987901Z"},"links":{"cited_paper":"/paper/2412.05271","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:60365420ce6dc5aa5ed4db1b0ac6df529bf51807e7ce9acfeb03b6b0f4b478fa","observation_id":"43321dff-4be8-48d7-8055-8195a6e15781","resolution":{"observed_at":"2026-08-08T23:20:00.987901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-08T23:20:00.991692Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-09T17:33:47.070390Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:00.991692Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:b0cfba0a734eaa3d7b192f31db2c7c8d13e4ce2fac958435bf20c70550499e6f","observation_id":"ca3ee25c-58a3-430c-93da-15be130f60e3","resolution":{"observed_at":"2026-08-08T23:20:00.991692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-08T23:20:00.996182Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-09T17:33:47.070390Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:00.996182Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:2f492e40f252a614d8dde0123ccf0fa4d8b7ee47c256b2b7e7f6cb1e973ded4d","observation_id":"1de530e1-634d-4e33-96a5-99d5679dacb8","resolution":{"observed_at":"2026-08-08T23:20:00.996182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:20:00.999923Z","title":null,"venue":null,"work_id":null,"year":1965},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-09T17:33:47.070390Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:00.999923Z"},"links":{"citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:ec903855a1f571adf2f689c654ef4bab10a29034a9582e8dc5811ad4889c34b5","observation_id":"79ec296d-fa21-4558-b7e0-f177ce35511c","resolution":{"observed_at":"2026-08-08T23:20:00.999923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15217","last_updated":"2025-04-28T05:09:12Z","snapshot_observed_at":"2026-08-05T02:02:34.574070Z","submitted_at":"2023-09-26T19:23:54Z","title":"Ragas: Automated Evaluation of Retrieval Augmented Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.15217","snapshot_observed_at":"2026-08-08T23:20:01.003475Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-09T17:33:47.070390Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.003475Z"},"links":{"cited_paper":"/paper/2309.15217","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:4234bccbabc0845d638fabb92643fb54e38d51bb40c10c7cd56507c9aab4b670","observation_id":"437b61c3-6d98-423a-921a-2018e88794e5","resolution":{"observed_at":"2026-08-08T23:20:01.003475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.08614","last_updated":"2022-05-05T04:20:06Z","snapshot_observed_at":"2026-07-06T12:19:22.234875Z","submitted_at":"2021-12-16T04:37:10Z","title":"KAT: A Knowledge Augmented Transformer for Vision-and-Language","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.08614","snapshot_observed_at":"2026-08-08T23:20:01.008761Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-09T17:33:47.070390Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.008761Z"},"links":{"cited_paper":"/paper/2112.08614","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:27af0a45de4eaa763698b9ca333ea1ba2f02de68cf4f3d3895375faab89d036f","observation_id":"f80fd8c1-cbf8-4f06-9b3e-ffd6659b9abf","resolution":{"observed_at":"2026-08-08T23:20:01.008761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.08406","last_updated":"2024-01-30T13:55:34Z","snapshot_observed_at":"2026-07-06T17:16:13.055978Z","submitted_at":"2024-01-16T14:44:47Z","title":"RAG vs Fine-tuning: Pipelines, Tradeoffs, and a Case Study on Agriculture","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.08406","snapshot_observed_at":"2026-08-08T23:20:01.012259Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-09T17:33:47.070390Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.012259Z"},"links":{"cited_paper":"/paper/2401.08406","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:55dc8564727168f3f7e080fcd69d1049edd1d12a88e691e7e4c60b47f0a7ba54","observation_id":"90134a62-5c2b-4768-acb7-547d2d876932","resolution":{"observed_at":"2026-08-08T23:20:01.012259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.05232","last_updated":"2024-11-19T12:42:45Z","snapshot_observed_at":"2026-07-06T16:45:07.733095Z","submitted_at":"2023-11-09T09:25:37Z","title":"A Survey on Hallucination in Large Language Models: Principles, Taxonomy, Challenges, and Open Questions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.05232","snapshot_observed_at":"2026-08-08T23:20:01.015830Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-09T17:33:47.070390Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.015830Z"},"links":{"cited_paper":"/paper/2311.05232","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:b59e2c516e842c62ef2d8772e5337c49c64f9a66c15b885c0907825310b1ef1e","observation_id":"6ea5f90e-fde6-493a-a325-4903327ebaef","resolution":{"observed_at":"2026-08-08T23:20:01.015830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12959","last_updated":"2024-11-27T08:49:12Z","snapshot_observed_at":"2026-07-06T19:18:17.523057Z","submitted_at":"2024-09-19T17:59:45Z","title":"MMSearch: Benchmarking the Potential of Large Models as Multi-modal Search Engines","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12959","snapshot_observed_at":"2026-08-08T23:20:01.019195Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-09T17:33:47.070390Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.019195Z"},"links":{"cited_paper":"/paper/2409.12959","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:3e7c04f3919fcc61bfeee423798a7343761fceac7e35228a25be13382abd79d6","observation_id":"8921ecbe-3616-46d2-a40c-2465f21ba7c7","resolution":{"observed_at":"2026-08-08T23:20:01.019195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:20:01.635156Z","title":null,"venue":null,"work_id":"7a7b31ee-9bac-4fe9-a866-e32235029524","year":1973},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-09T17:33:47.070390Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.022969Z"},"links":{"citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:b9ec331775167a12215d511a1defb1e2afc3aad1777a980af00abce4dbd79e83","observation_id":"88fb0ce0-bb3f-4458-a746-9ea86cc554c7","resolution":{"observed_at":"2026-08-08T23:20:01.638511Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:20:01.626264Z","title":null,"venue":null,"work_id":"03c024a9-3d32-4772-b8af-dfc7f115b17a","year":2017},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-09T17:33:47.070390Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.026324Z"},"links":{"citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:ae9965a18725d5bd09ae75b0069f4b66ff79bd766b453d702c0b4a8dc6e4de12","observation_id":"2178f723-5ec4-4a05-a08b-d52092de6bcc","resolution":{"observed_at":"2026-08-08T23:20:01.629626Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.08802","last_updated":"2025-04-24T16:22:33Z","snapshot_observed_at":"2026-08-10T02:39:55.852291Z","submitted_at":"2024-12-11T22:28:12Z","title":"jina-clip-v2: Multilingual Multimodal Embeddings for Text and Images","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.08802","snapshot_observed_at":"2026-08-08T23:20:01.029650Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-09T17:33:47.070390Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.029650Z"},"links":{"cited_paper":"/paper/2412.08802","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:22c955f762750c3c6726efc4344532b036c5aa641839813d0a3f7fb4d190ac9a","observation_id":"a37951d5-4c65-4996-8dbf-85523f262b56","resolution":{"observed_at":"2026-08-08T23:20:01.029650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:20:01.033810Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-09T17:33:47.070390Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.033810Z"},"links":{"citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:582fcb09aeeb5ea029fff97f6f52060dc16213bfe941122f54463320f2fb3465","observation_id":"cdf9a4d7-3dec-4341-ba60-4a7545620d76","resolution":{"observed_at":"2026-08-08T23:20:01.033810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:20:01.612688Z","title":null,"venue":null,"work_id":"9ff91d0e-495d-4039-a422-b4a6a7c584bf","year":2020},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-09T17:33:47.070390Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.047532Z"},"links":{"citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:78032f812b7463ba23a6708934c0f23054a5169d0db462b8ced14d36bc3d1481","observation_id":"eb6ea0f1-5e91-4b31-a827-d4ea99000d8a","resolution":{"observed_at":"2026-08-08T23:20:01.615906Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:20:01.053365Z","title":null,"venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-09T17:33:47.070390Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.053365Z"},"links":{"citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:4dee2bae4c1dd5909dc98764a997f842eea45dc0031d59c13ce10f48ee995e8b","observation_id":"f5eaa238-35e2-4d40-9b94-3cd644d66d62","resolution":{"observed_at":"2026-08-08T23:20:01.053365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-08T23:20:01.057079Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-09T17:33:47.070390Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.057079Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:f106281f7ed2959c6c0c290efdb6abf7a7ccab9003c17e131c7d64c5abccbf64","observation_id":"9538a13a-9d2b-4ddf-8226-c174c3ddb07c","resolution":{"observed_at":"2026-08-08T23:20:01.057079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:20:01.598782Z","title":null,"venue":null,"work_id":"b97a8b00-ebf0-41b4-8a92-88b39e1c8042","year":2023},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-09T17:33:47.070390Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.060763Z"},"links":{"citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:d937d9eafc94066b0eae47772bac35f02b1a9b8af933ec6c29a46ca95a22a750","observation_id":"a956a995-265c-402f-b209-7a4e5374e7b8","resolution":{"observed_at":"2026-08-08T23:20:01.601924Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:20:01.064089Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-09T17:33:47.070390Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.064089Z"},"links":{"citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:43a6ddfbf1c04477ceb46393d22e32561efc122c26bec864724fcb46ea66d917","observation_id":"1dbd175a-0f78-46ac-bbde-619fdc5c7fe5","resolution":{"observed_at":"2026-08-08T23:20:01.064089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:20:01.589584Z","title":null,"venue":null,"work_id":"1c5ebcee-3eb1-4d08-a842-fce9977d2bf4","year":null},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-09T17:33:47.070390Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.067452Z"},"links":{"citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:d92bd685f8397a172f645543f66e7695a4ae5884049b62c579c33dfc58a1ef70","observation_id":"dc1f6bf2-1fb4-4a3d-87db-c09205a667ac","resolution":{"observed_at":"2026-08-08T23:20:01.593000Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:20:01.074661Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-09T17:33:47.070390Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.074661Z"},"links":{"citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:740aa02123659b51f0e89387f97a1d9f525da14555e6e55d348a087a796abb15","observation_id":"957371e7-3cf7-474d-8f95-5d55219a6f75","resolution":{"observed_at":"2026-08-08T23:20:01.074661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:20:01.574532Z","title":null,"venue":null,"work_id":"58650759-455b-4382-a1c4-ce3de8fa537f","year":2016},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-09T17:33:47.070390Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.084747Z"},"links":{"citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:aa98b34663d95d9f8c85468f2c95d82dc4b517d876dc1807dfb8e5393ade9414","observation_id":"c077fc8b-8275-43b2-bc75-478b5ca2888b","resolution":{"observed_at":"2026-08-08T23:20:01.578006Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:20:01.564249Z","title":null,"venue":null,"work_id":"94c46daa-b69c-4564-9b53-6de7805d6f89","year":2024},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-09T17:33:47.070390Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.093697Z"},"links":{"citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:e04d9ef1d3b8452c5c9bfd617633e72fb58cf39e08651f06d76373883c1d77ce","observation_id":"9c3a9d43-9c71-4611-aca0-107f674ed545","resolution":{"observed_at":"2026-08-08T23:20:01.568137Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:20:01.554178Z","title":null,"venue":null,"work_id":"ad148728-988c-44c7-8458-07641295c094","year":2024},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-09T17:33:47.070390Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.097105Z"},"links":{"citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:96552e0b152b23fb8d4cf6e04a258ca9732205754f17e42b4e95dcf57bf57e94","observation_id":"0fc1a6fe-3494-4a9f-a285-6ed68e1ff0ca","resolution":{"observed_at":"2026-08-08T23:20:01.557747Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:20:01.100074Z","title":null,"venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-09T17:33:47.070390Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.100074Z"},"links":{"citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:74f55d5755b935e5b93227915c4c5a55d1db9ba0d3c19ab3fc13e24f71ed4ff9","observation_id":"c8be1041-9977-4989-a806-24b9fbe4ec46","resolution":{"observed_at":"2026-08-08T23:20:01.100074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.02252","last_updated":"2021-05-27T15:20:59Z","snapshot_observed_at":"2026-08-07T22:58:49.396675Z","submitted_at":"2020-09-04T15:32:19Z","title":"KILT: a Benchmark for Knowledge Intensive Language Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.02252","snapshot_observed_at":"2026-08-08T23:20:01.103232Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-09T17:33:47.070390Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.103232Z"},"links":{"cited_paper":"/paper/2009.02252","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:e267d5ad8ef01599dddd42eb2da71b5dd2efd00fb2e41615986b09418c9af7dd","observation_id":"c985f481-cea8-4282-a398-961788db2fca","resolution":{"observed_at":"2026-08-08T23:20:01.103232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:20:01.106544Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-09T17:33:47.070390Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.106544Z"},"links":{"citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:ef37826d36171092178e93e74761604bc5795a2d471e5b27c5f0e19bff79f50a","observation_id":"e0a5ca9b-92e8-480d-a072-a818182179bd","resolution":{"observed_at":"2026-08-08T23:20:01.106544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:20:01.533610Z","title":null,"venue":null,"work_id":"f7d22bdf-92ea-4ea3-b4f5-7dc070c018b6","year":2016},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-09T17:33:47.070390Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.109555Z"},"links":{"citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:c2966f38d8ed4250841ccfedad211c8bf1705a632d8adede98c5145722d18ad9","observation_id":"83133fca-cc01-4119-8e71-f63612d5c6be","resolution":{"observed_at":"2026-08-08T23:20:01.537255Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:20:01.114742Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-09T17:33:47.070390Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.114742Z"},"links":{"citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:47926a4ea5e10bb6335c8eae17cf20727848f45b4a7cc75982bcdc5fe86c5dea","observation_id":"57c5008e-b476-4b62-9fb6-f77be29fe01d","resolution":{"observed_at":"2026-08-08T23:20:01.114742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:20:01.517756Z","title":null,"venue":null,"work_id":"a72d75cf-28cd-4861-a0d7-8467bab16f6b","year":2014},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-09T17:33:47.070390Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.134749Z"},"links":{"citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:413794f99900c9879628235a388bf72eee7a80d9058addb05dd18bd70d74a8e8","observation_id":"af5cd519-d9eb-4c80-9d0b-162febbbafab","resolution":{"observed_at":"2026-08-08T23:20:01.521318Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:20:01.508005Z","title":null,"venue":null,"work_id":"deb72053-5d2d-431a-87c6-0be16e35ea2c","year":2021},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-09T17:33:47.070390Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.144101Z"},"links":{"citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:c33781b5b1872d192c51e8bbb7dcb2c904058c3642a7ccface40e22ac104b9a7","observation_id":"429cb005-0821-4a03-95ce-81894137a3ec","resolution":{"observed_at":"2026-08-08T23:20:01.511211Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.06039","last_updated":"2021-04-13T09:14:28Z","snapshot_observed_at":"2026-08-07T03:42:41.994347Z","submitted_at":"2021-04-13T09:14:28Z","title":"MultiModalQA: Complex Question Answering over Text, Tables and Images","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.06039","snapshot_observed_at":"2026-08-08T23:20:01.147309Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-09T17:33:47.070390Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.147309Z"},"links":{"cited_paper":"/paper/2104.06039","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:8bbdb09b21fc748adfc7c45bb5654e680d473a045905c2aa94754c1c95014591","observation_id":"e76a441a-6be2-4fd2-8018-275e1a20a3a2","resolution":{"observed_at":"2026-08-08T23:20:01.147309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-08T23:20:01.150915Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-09T17:33:47.070390Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.150915Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:1dbf8c2ac3941f0e2f11326b69ef1b72306bca3f27700203d97e769a948c87c2","observation_id":"284b5d1c-6601-4742-afcd-b27179c33f6c","resolution":{"observed_at":"2026-08-08T23:20:01.150915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18839","last_updated":"2024-09-27T15:35:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-27T15:35:15Z","title":"MinerU: An Open-Source Solution for Precise Document Content Extraction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.18839","snapshot_observed_at":"2026-08-08T23:20:01.154288Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-09T17:33:47.070390Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.154288Z"},"links":{"cited_paper":"/paper/2409.18839","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:3c7fec881e311c91f404caf27c2ecf39d90923235de71113ce4d30881e760d27","observation_id":"206b83ec-cb7f-455f-9455-002cbebb2d5a","resolution":{"observed_at":"2026-08-08T23:20:01.154288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.01319","last_updated":"2024-08-02T15:14:53Z","snapshot_observed_at":"2026-08-07T23:02:26.471823Z","submitted_at":"2024-08-02T15:14:53Z","title":"A Comprehensive Review of Multimodal Large Language Models: Performance and Challenges Across Different Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.01319","snapshot_observed_at":"2026-08-08T23:20:01.157567Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-09T17:33:47.070390Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.157567Z"},"links":{"cited_paper":"/paper/2408.01319","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:bcd19b34ad2eabe4edbbcce187ac48f13527aab0adb0a34fe883f166e361ea8e","observation_id":"604e49ee-fb1b-4dbb-8fb0-555ea65611e1","resolution":{"observed_at":"2026-08-08T23:20:01.157567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-08T23:20:01.160781Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-09T17:33:47.070390Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.160781Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:a5c817a25ac9766f576333cc183fe271ba3972ed4c48d2e97388205823a62c38","observation_id":"5c5ebab0-a182-4617-bb2c-9f5bf84c7779","resolution":{"observed_at":"2026-08-08T23:20:01.160781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.20434","last_updated":"2025-07-02T15:34:00Z","snapshot_observed_at":"2026-07-06T19:24:39.402031Z","submitted_at":"2024-09-30T15:53:38Z","title":"QAEncoder: Towards Aligned Representation Learning in Question Answering Systems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.20434","snapshot_observed_at":"2026-08-08T23:20:01.164910Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-09T17:33:47.070390Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.164910Z"},"links":{"cited_paper":"/paper/2409.20434","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:9a814a2862bbbe61792273112e7ba09b0e14d1c302c6788665c5613e444f3310","observation_id":"9ae03aec-2e88-42e2-bd07-c98ce5106371","resolution":{"observed_at":"2026-08-08T23:20:01.164910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:20:01.168526Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-09T17:33:47.070390Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.168526Z"},"links":{"citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:91f17777be7e8d0a959b82bbd43f8818ad63d1e132b9fa2f83dd9bff20515914","observation_id":"fc94833d-d1e8-473c-a940-103a61b5d6e7","resolution":{"observed_at":"2026-08-08T23:20:01.168526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07597","last_updated":"2024-09-24T03:01:25Z","snapshot_observed_at":"2026-08-09T21:52:29.568774Z","submitted_at":"2023-09-14T10:57:50Z","title":"C-Pack: Packed Resources For General Chinese Embeddings","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.07597","snapshot_observed_at":"2026-08-08T23:20:01.171702Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-09T17:33:47.070390Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.171702Z"},"links":{"cited_paper":"/paper/2309.07597","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:4844257f667a6adae0aeec21238102ed86d7e4084b7a442e0c4f46abd525f138","observation_id":"45bda60d-12bd-4e1f-8280-4902184fd413","resolution":{"observed_at":"2026-08-08T23:20:01.171702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.00812","last_updated":"2018-09-04T07:04:55Z","snapshot_observed_at":"2026-07-06T06:59:00.071334Z","submitted_at":"2018-09-04T07:04:55Z","title":"RecipeQA: A Challenge Dataset for Multimodal Comprehension of Cooking Recipes","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.00812","snapshot_observed_at":"2026-08-08T23:20:01.175252Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-09T17:33:47.070390Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.175252Z"},"links":{"cited_paper":"/paper/1809.00812","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:f4636f7399d69fe0491c34e1265701855a443e1c8f63e14f580e6f07773df2a9","observation_id":"8e627791-c5cf-4537-8814-86df3d91d9d5","resolution":{"observed_at":"2026-08-08T23:20:01.175252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:20:01.492934Z","title":null,"venue":null,"work_id":"181fdf7a-d957-4e62-82c2-8b50d2d78d63","year":2018},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-09T17:33:47.070390Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.178772Z"},"links":{"citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:8c44510037f5800a6355aa019d86e5f9c1ac8f62b94589ef18f4f8b7eff86a08","observation_id":"a06a6a69-5993-4120-a58d-014782bd304e","resolution":{"observed_at":"2026-08-08T23:20:01.496260Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15112","last_updated":"2023-12-14T17:21:39Z","snapshot_observed_at":"2026-07-06T16:23:57.143116Z","submitted_at":"2023-09-26T17:58:20Z","title":"InternLM-XComposer: A Vision-Language Large Model for Advanced Text-image Comprehension and Composition","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.15112","snapshot_observed_at":"2026-08-08T23:20:01.182050Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-09T17:33:47.070390Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.182050Z"},"links":{"cited_paper":"/paper/2309.15112","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:0c5574a3d278b0d4d5ab9f932f94ae0bbdc48f4df7eee4aa002fe79653bfed6c","observation_id":"0d9b605a-cdde-4a1a-88cc-c6fcd128c14f","resolution":{"observed_at":"2026-08-08T23:20:01.182050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.09675","last_updated":"2020-02-24T18:59:28Z","snapshot_observed_at":"2026-07-29T15:42:51.774083Z","submitted_at":"2019-04-21T23:08:53Z","title":"BERTScore: Evaluating Text Generation with BERT","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.09675","snapshot_observed_at":"2026-08-08T23:20:01.185459Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-09T17:33:47.070390Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.185459Z"},"links":{"cited_paper":"/paper/1904.09675","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:f3689ba295ca2d7cd28a6b3c4be08d9edd2630c43d562a142fda26b971f39635","observation_id":"80eaf59c-3ff2-4f07-96d2-e354358e12d0","resolution":{"observed_at":"2026-08-08T23:20:01.185459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.19473","last_updated":"2024-06-21T08:26:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-29T18:59:01Z","title":"Retrieval-Augmented Generation for AI-Generated Content: A Survey","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.19473","snapshot_observed_at":"2026-08-08T23:20:01.196499Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-09T17:33:47.070390Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.196499Z"},"links":{"cited_paper":"/paper/2402.19473","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:00e48c9f10df7755da5adc2e656bd5cd76ec6971eb0ee051531c9333b4c18f47","observation_id":"d921b454-ad32-4c61-a09f-e6061c90f81f","resolution":{"observed_at":"2026-08-08T23:20:01.196499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.01262","last_updated":"2025-03-03T22:45:57Z","snapshot_observed_at":"2026-08-09T02:40:02.382162Z","submitted_at":"2024-08-02T13:35:11Z","title":"RAGEval: Scenario Specific RAG Evaluation Dataset Generation Framework","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.01262","snapshot_observed_at":"2026-08-08T23:20:01.200856Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-09T17:33:47.070390Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.200856Z"},"links":{"cited_paper":"/paper/2408.01262","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:9d6744627fc2e2f6f16e5b4ce076bebce2d363e86d7b491f5f523b8a61a9da8d","observation_id":"f0639b5d-90d2-4819-9015-c577a8ec2ade","resolution":{"observed_at":"2026-08-08T23:20:01.200856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.08521","last_updated":"2025-02-07T00:09:43Z","snapshot_observed_at":"2026-07-06T19:01:23.623544Z","submitted_at":"2024-08-16T04:32:10Z","title":"MuRAR: A Simple and Effective Multimodal Retrieval and Answer Refinement Framework for Multimodal Question Answering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.08521","snapshot_observed_at":"2026-08-08T23:20:01.204321Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-09T17:33:47.070390Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.204321Z"},"links":{"cited_paper":"/paper/2408.08521","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:80db332920a4e72f365897c8a2b4c4541ef33949c9053b60490d8aaff19f923e","observation_id":"78f6d7f0-f6f5-428e-9a97-16b05588a599","resolution":{"observed_at":"2026-08-08T23:20:01.204321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16365","last_updated":"2025-05-23T14:05:39Z","snapshot_observed_at":"2026-08-03T03:27:56.520381Z","submitted_at":"2024-11-25T13:20:19Z","title":"Multi-modal Retrieval Augmented Multi-modal Generation: Datasets, Evaluation Metrics and Strong Baselines","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16365","snapshot_observed_at":"2026-08-08T23:20:01.071133Z","title":"arXiv preprint arXiv:2411.16365 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-09T17:33:47.070390Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.071133Z"},"links":{"cited_paper":"/paper/2411.16365","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:2176c4b9a363cf9dbb29a79fc734fc43f951f6a7042d4f52213013927f16ed51","observation_id":"43159f73-43ff-4c3d-923c-012756fe4084","resolution":{"observed_at":"2026-08-08T23:20:01.071133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T17:33:47.070390Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation"},"reference_resolution":{"displayed":52,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":51,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":52},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 52 of 52 outbound references and 2 inbound Pith citation observations for arXiv:2502.04176."}