{"as_of":"2026-08-12T19:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3d34936550c8e98694a1e059d96f53dead82ff1b8969439b002a32d32bc16965","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T12:16:31.345105Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T05:49:54.329738Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T14:51:50.703117Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.14457","last_updated":"2024-12-19T02:17:35Z","snapshot_observed_at":"2026-08-12T12:20:28.897302Z","submitted_at":"2024-12-19T02:17:35Z","title":"VISA: Retrieval Augmented Generation with Visual Source Attribution","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14457","snapshot_observed_at":"2026-08-10T05:49:54.329738Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.16902","last_updated":"2025-01-28T12:40:37Z","snapshot_observed_at":"2026-08-11T16:01:17.571987Z","submitted_at":"2025-01-28T12:40:37Z","title":"Document Screenshot Retrievers are Vulnerable to Pixel Poisoning Attacks","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T05:49:54.329738Z"},"links":{"cited_paper":"/paper/2412.14457","citing_paper":"/paper/2501.16902"},"observation_digest":"sha256:0ce5e0c03954b34ee2e6330160081ff615644cac2f8823fd5587442f8688d28f","observation_id":"7e72a47a-60d2-49cb-839c-d071a96e5608","resolution":{"observed_at":"2026-08-10T05:49:54.329738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14457","last_updated":"2024-12-19T02:17:35Z","snapshot_observed_at":"2026-08-12T12:20:28.897302Z","submitted_at":"2024-12-19T02:17:35Z","title":"VISA: Retrieval Augmented Generation with Visual Source Attribution","version":1},"cited_work":{"arxiv_id":"2412.14457","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.14457","snapshot_observed_at":"2026-08-07T14:51:50.703117Z","title":"VISA: Retrieval Augmented Generation with Visual Source Attribution","venue":"cs.IR","work_id":"b09491f1-ee99-4250-936a-2211246a7c0e","year":2024},"citing_paper":{"arxiv_id":"2505.17471","last_updated":"2025-09-09T13:48:18Z","snapshot_observed_at":"2026-08-10T00:48:33.161265Z","submitted_at":"2025-05-23T04:51:51Z","title":"FinRAGBench-V: A Benchmark for Multimodal RAG with Visual Citation in the Financial Domain","version":2},"reference_index":516,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:49.376569Z"},"links":{"cited_paper":"/paper/2412.14457","citing_paper":"/paper/2505.17471"},"observation_digest":"sha256:959d0def6a722b30a98ba923a7b08597c6a6d3a7aa9ce9f94adc8e280c9d38cf","observation_id":"ac1a11fc-e770-40d0-9cc9-5a39921f2696","resolution":{"observed_at":"2026-08-07T14:51:50.802633Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14457","last_updated":"2024-12-19T02:17:35Z","snapshot_observed_at":"2026-08-12T12:20:28.897302Z","submitted_at":"2024-12-19T02:17:35Z","title":"VISA: Retrieval Augmented Generation with Visual Source Attribution","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14457","snapshot_observed_at":"2026-08-05T20:28:51.876984Z","title":"Ma et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10955","last_updated":"2025-08-14T07:25:45Z","snapshot_observed_at":"2026-08-09T12:54:37.629481Z","submitted_at":"2025-08-14T07:25:45Z","title":"Empowering Multimodal LLMs with External Tools: A Comprehensive Survey","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-05T20:28:51.876984Z"},"links":{"cited_paper":"/paper/2412.14457","citing_paper":"/paper/2508.10955"},"observation_digest":"sha256:9fd279706dfdbd72837fae5971fbde36187884ed5546415677cd2602d1b3ebc0","observation_id":"9235856d-cb35-4fec-8c01-e346cd6034cb","resolution":{"observed_at":"2026-08-05T20:28:51.876984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2412.14457/citation-record","integrity":"/paper/2412.14457/integrity","json":"/paper/2412.14457/citation-record.json","paper":"/paper/2412.14457"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:16:31.198986Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.14457","last_updated":"2024-12-19T02:17:35Z","snapshot_observed_at":"2026-08-12T12:20:28.897302Z","submitted_at":"2024-12-19T02:17:35Z","title":"VISA: Retrieval Augmented Generation with Visual Source Attribution","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T12:16:31.198986Z"},"links":{"citing_paper":"/paper/2412.14457"},"observation_digest":"sha256:18a80970958984e2a5d0bb8744b7607da749f58d5586fa9353ca5559ebac4660","observation_id":"bc86b892-45dd-471a-b757-da23c072a424","resolution":{"observed_at":"2026-08-11T12:16:31.198986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:16:31.203686Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.14457","last_updated":"2024-12-19T02:17:35Z","snapshot_observed_at":"2026-08-12T12:20:28.897302Z","submitted_at":"2024-12-19T02:17:35Z","title":"VISA: Retrieval Augmented Generation with Visual Source Attribution","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T12:16:31.203686Z"},"links":{"citing_paper":"/paper/2412.14457"},"observation_digest":"sha256:96642755185c6f07c711767dcfa135d05c3765261ed5dbf6d79b0b72044ad740","observation_id":"b5918776-c302-455c-8ac8-ed60150acad1","resolution":{"observed_at":"2026-08-11T12:16:31.203686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03187","last_updated":"2024-03-05T18:22:33Z","snapshot_observed_at":"2026-07-06T17:40:01.975792Z","submitted_at":"2024-03-05T18:22:33Z","title":"Reliable, Adaptable, and Attributable Language Models with Retrieval","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03187","snapshot_observed_at":"2026-08-11T12:16:31.207634Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14457","last_updated":"2024-12-19T02:17:35Z","snapshot_observed_at":"2026-08-12T12:20:28.897302Z","submitted_at":"2024-12-19T02:17:35Z","title":"VISA: Retrieval Augmented Generation with Visual Source Attribution","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T12:16:31.207634Z"},"links":{"cited_paper":"/paper/2403.03187","citing_paper":"/paper/2412.14457"},"observation_digest":"sha256:928567e2a8871482e554369625473382df0c779ce3a8b09e4cc0439917bccffd","observation_id":"5e121529-3a56-472b-810b-f278c434e325","resolution":{"observed_at":"2026-08-11T12:16:31.207634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08037","last_updated":"2023-02-10T20:04:05Z","snapshot_observed_at":"2026-08-11T22:10:09.127642Z","submitted_at":"2022-12-15T18:45:29Z","title":"Attributed Question Answering: Evaluation and Modeling for Attributed Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08037","snapshot_observed_at":"2026-08-11T12:16:31.212303Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14457","last_updated":"2024-12-19T02:17:35Z","snapshot_observed_at":"2026-08-12T12:20:28.897302Z","submitted_at":"2024-12-19T02:17:35Z","title":"VISA: Retrieval Augmented Generation with Visual Source Attribution","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T12:16:31.212303Z"},"links":{"cited_paper":"/paper/2212.08037","citing_paper":"/paper/2412.14457"},"observation_digest":"sha256:43abd3f04372b207e8ee770439918b1c6769a4dafacdef57fc5a9ed5fc9fb7ea","observation_id":"a6b82864-9f5f-4940-89ce-61766a04444b","resolution":{"observed_at":"2026-08-11T12:16:31.212303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:16:31.866155Z","title":null,"venue":null,"work_id":"a5839619-99a7-4b23-a3a6-84ea9a6935a0","year":2020},"citing_paper":{"arxiv_id":"2412.14457","last_updated":"2024-12-19T02:17:35Z","snapshot_observed_at":"2026-08-12T12:20:28.897302Z","submitted_at":"2024-12-19T02:17:35Z","title":"VISA: Retrieval Augmented Generation with Visual Source Attribution","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T12:16:31.216705Z"},"links":{"citing_paper":"/paper/2412.14457"},"observation_digest":"sha256:3934324be43fc7df1367fab097e3d27a56d2658968306808822bfec2af599a3b","observation_id":"59d62ba7-80db-43e7-959e-255b925868f6","resolution":{"observed_at":"2026-08-11T12:16:31.870197Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:16:31.854263Z","title":null,"venue":null,"work_id":"0c493e0b-faf5-4778-a472-0ef65f3e0e72","year":2017},"citing_paper":{"arxiv_id":"2412.14457","last_updated":"2024-12-19T02:17:35Z","snapshot_observed_at":"2026-08-12T12:20:28.897302Z","submitted_at":"2024-12-19T02:17:35Z","title":"VISA: Retrieval Augmented Generation with Visual Source Attribution","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T12:16:31.220336Z"},"links":{"citing_paper":"/paper/2412.14457"},"observation_digest":"sha256:a9ca028d01dce514b272bec2d5b809ba312faa0127fb3b489dfb90f840cb942d","observation_id":"5493f35c-3bb6-4578-9a38-d5ede818cd04","resolution":{"observed_at":"2026-08-11T12:16:31.859081Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:16:31.225159Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14457","last_updated":"2024-12-19T02:17:35Z","snapshot_observed_at":"2026-08-12T12:20:28.897302Z","submitted_at":"2024-12-19T02:17:35Z","title":"VISA: Retrieval Augmented Generation with Visual Source Attribution","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T12:16:31.225159Z"},"links":{"citing_paper":"/paper/2412.14457"},"observation_digest":"sha256:e7ee81725e3124f55e7d6b607916a5a3caac4d242e23582b211d73643cb56cc2","observation_id":"e9e034ff-97e1-4f19-9fef-944ea9063768","resolution":{"observed_at":"2026-08-11T12:16:31.225159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04952","last_updated":"2024-11-07T18:29:38Z","snapshot_observed_at":"2026-08-11T03:20:35.146270Z","submitted_at":"2024-11-07T18:29:38Z","title":"M3DocRAG: Multi-modal Retrieval is What You Need for Multi-page Multi-document Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04952","snapshot_observed_at":"2026-08-11T12:16:31.229976Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14457","last_updated":"2024-12-19T02:17:35Z","snapshot_observed_at":"2026-08-12T12:20:28.897302Z","submitted_at":"2024-12-19T02:17:35Z","title":"VISA: Retrieval Augmented Generation with Visual Source Attribution","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T12:16:31.229976Z"},"links":{"cited_paper":"/paper/2411.04952","citing_paper":"/paper/2412.14457"},"observation_digest":"sha256:5a89563bc4bb7cecd21f57dc7cd1df018aff2c24818beda8230d60fb9fd83f45","observation_id":"50f16fe2-5218-43e8-8749-5e6f74f6009d","resolution":{"observed_at":"2026-08-11T12:16:31.229976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:16:31.843162Z","title":null,"venue":null,"work_id":"1458edbe-d213-4f3e-9982-501888fa1291","year":2016},"citing_paper":{"arxiv_id":"2412.14457","last_updated":"2024-12-19T02:17:35Z","snapshot_observed_at":"2026-08-12T12:20:28.897302Z","submitted_at":"2024-12-19T02:17:35Z","title":"VISA: Retrieval Augmented Generation with Visual Source Attribution","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T12:16:31.235233Z"},"links":{"citing_paper":"/paper/2412.14457"},"observation_digest":"sha256:776f8f06a7defdeabd0f0fdc3f515f912706c7d475b78a99ab9a57980a00fc04","observation_id":"21f48132-363f-4e20-b536-ff75b8e26a73","resolution":{"observed_at":"2026-08-11T12:16:31.847144Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:16:31.238763Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.14457","last_updated":"2024-12-19T02:17:35Z","snapshot_observed_at":"2026-08-12T12:20:28.897302Z","submitted_at":"2024-12-19T02:17:35Z","title":"VISA: Retrieval Augmented Generation with Visual Source Attribution","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T12:16:31.238763Z"},"links":{"citing_paper":"/paper/2412.14457"},"observation_digest":"sha256:f93e2110d7a356d09dd9e5c0bb916708b686def5fe780ad54d42e508090fc664","observation_id":"b7a059af-6591-4d9f-be7e-83f13ddf97fc","resolution":{"observed_at":"2026-08-11T12:16:31.238763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01449","last_updated":"2025-02-28T08:51:57Z","snapshot_observed_at":"2026-07-06T18:39:43.472708Z","submitted_at":"2024-06-27T15:45:29Z","title":"ColPali: Efficient Document Retrieval with Vision Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01449","snapshot_observed_at":"2026-08-11T12:16:31.242456Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14457","last_updated":"2024-12-19T02:17:35Z","snapshot_observed_at":"2026-08-12T12:20:28.897302Z","submitted_at":"2024-12-19T02:17:35Z","title":"VISA: Retrieval Augmented Generation with Visual Source Attribution","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T12:16:31.242456Z"},"links":{"cited_paper":"/paper/2407.01449","citing_paper":"/paper/2412.14457"},"observation_digest":"sha256:ef54af9c165e3e7e6639b988bde2b50f8dcfba4ecca33788d0834add11e020d2","observation_id":"b56104fb-8058-4234-b15d-4a5f86e12eb3","resolution":{"observed_at":"2026-08-11T12:16:31.242456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-1-4684-0994-9_12","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:03:20.376878Z","title":null,"venue":null,"work_id":"ea305f87-f8ee-4269-8130-a30ea3f721e1","year":1979},"citing_paper":{"arxiv_id":"2412.14457","last_updated":"2024-12-19T02:17:35Z","snapshot_observed_at":"2026-08-12T12:20:28.897302Z","submitted_at":"2024-12-19T02:17:35Z","title":"VISA: Retrieval Augmented Generation with Visual Source Attribution","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T12:16:31.246699Z"},"links":{"citing_paper":"/paper/2412.14457"},"observation_digest":"sha256:9b5e5be67244b44a3a3d69f80ac006efbe976c5ff7ab8106de329d69d95d976b","observation_id":"66b29d14-94f0-4c52-ada9-a53545d54560","resolution":{"observed_at":"2026-08-11T12:16:31.449025Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:16:31.250486Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14457","last_updated":"2024-12-19T02:17:35Z","snapshot_observed_at":"2026-08-12T12:20:28.897302Z","submitted_at":"2024-12-19T02:17:35Z","title":"VISA: Retrieval Augmented Generation with Visual Source Attribution","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T12:16:31.250486Z"},"links":{"citing_paper":"/paper/2412.14457"},"observation_digest":"sha256:256c9138645f27d38e59563d186ec2f840f07866e1d549386876e5faa22331f9","observation_id":"c69c295a-eb8b-4535-a022-8522ab9b82c6","resolution":{"observed_at":"2026-08-11T12:16:31.250486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10997","last_updated":"2024-03-27T09:16:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-18T07:47:33Z","title":"Retrieval-Augmented Generation for Large Language Models: A Survey","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10997","snapshot_observed_at":"2026-08-11T12:16:31.254825Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14457","last_updated":"2024-12-19T02:17:35Z","snapshot_observed_at":"2026-08-12T12:20:28.897302Z","submitted_at":"2024-12-19T02:17:35Z","title":"VISA: Retrieval Augmented Generation with Visual Source Attribution","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T12:16:31.254825Z"},"links":{"cited_paper":"/paper/2312.10997","citing_paper":"/paper/2412.14457"},"observation_digest":"sha256:d6dc8c51b367beb6d1d3f4b70c396315320819ec2c05f2a8310d3698cdc817dd","observation_id":"c3eb226d-9ccb-44c5-9c34-c48631c97b7f","resolution":{"observed_at":"2026-08-11T12:16:31.254825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:16:31.825927Z","title":null,"venue":null,"work_id":"bc8f3f0b-ed5c-4999-b18d-448f1213ea7c","year":2024},"citing_paper":{"arxiv_id":"2412.14457","last_updated":"2024-12-19T02:17:35Z","snapshot_observed_at":"2026-08-12T12:20:28.897302Z","submitted_at":"2024-12-19T02:17:35Z","title":"VISA: Retrieval Augmented Generation with Visual Source Attribution","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T12:16:31.258707Z"},"links":{"citing_paper":"/paper/2412.14457"},"observation_digest":"sha256:c323232f13ff2bcd7900a2af4a649823bb6b9871dad3d44e891b9927daf8a9fb","observation_id":"16cd7deb-bd7f-437f-8847-d2cf5f6de1fe","resolution":{"observed_at":"2026-08-11T12:16:31.829437Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:16:31.262335Z","title":"Dai, Jakob Uszkoreit, Quoc Le, and Slav Petrov","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.14457","last_updated":"2024-12-19T02:17:35Z","snapshot_observed_at":"2026-08-12T12:20:28.897302Z","submitted_at":"2024-12-19T02:17:35Z","title":"VISA: Retrieval Augmented Generation with Visual Source Attribution","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T12:16:31.262335Z"},"links":{"citing_paper":"/paper/2412.14457"},"observation_digest":"sha256:ae8a8beab39b09363aef428df8172a2df236a1cc850456c48178ccd1ea0e2ab3","observation_id":"ad3c5ba0-361f-42da-89f2-3ed7b860b26c","resolution":{"observed_at":"2026-08-11T12:16:31.262335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:16:31.265893Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.14457","last_updated":"2024-12-19T02:17:35Z","snapshot_observed_at":"2026-08-12T12:20:28.897302Z","submitted_at":"2024-12-19T02:17:35Z","title":"VISA: Retrieval Augmented Generation with Visual Source Attribution","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T12:16:31.265893Z"},"links":{"citing_paper":"/paper/2412.14457"},"observation_digest":"sha256:6b3948169ab51e2be1a8061613b2fca4458477124fc1d6a4344ca812fc050aa6","observation_id":"99bc374f-2807-4971-b5a6-2d4481a31fbf","resolution":{"observed_at":"2026-08-11T12:16:31.265893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:16:31.269305Z","title":"u ttler, Mike Lewis, Wen-tau Yih, Tim Rockt\\","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.14457","last_updated":"2024-12-19T02:17:35Z","snapshot_observed_at":"2026-08-12T12:20:28.897302Z","submitted_at":"2024-12-19T02:17:35Z","title":"VISA: Retrieval Augmented Generation with Visual Source Attribution","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T12:16:31.269305Z"},"links":{"citing_paper":"/paper/2412.14457"},"observation_digest":"sha256:06998d15a29d3bb3c04a6e8d9493bb9ab910b1ce1a02814dc1ae63ddbfbe978e","observation_id":"1475be80-a5d2-48d9-a996-4b3c1c5d819d","resolution":{"observed_at":"2026-08-11T12:16:31.269305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:16:31.807884Z","title":null,"venue":null,"work_id":"b4a0657f-79eb-4e74-8b11-92e295590140","year":2024},"citing_paper":{"arxiv_id":"2412.14457","last_updated":"2024-12-19T02:17:35Z","snapshot_observed_at":"2026-08-12T12:20:28.897302Z","submitted_at":"2024-12-19T02:17:35Z","title":"VISA: Retrieval Augmented Generation with Visual Source Attribution","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T12:16:31.272628Z"},"links":{"citing_paper":"/paper/2412.14457"},"observation_digest":"sha256:e229b717dcf8485782f4d93f2b4918a3664df3372ab4837f91eb728c79860f2c","observation_id":"d189b88f-83ae-4ee0-97c4-699387ddcec2","resolution":{"observed_at":"2026-08-11T12:16:31.811661Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:16:31.276152Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14457","last_updated":"2024-12-19T02:17:35Z","snapshot_observed_at":"2026-08-12T12:20:28.897302Z","submitted_at":"2024-12-19T02:17:35Z","title":"VISA: Retrieval Augmented Generation with Visual Source Attribution","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T12:16:31.276152Z"},"links":{"citing_paper":"/paper/2412.14457"},"observation_digest":"sha256:7ca8a09221c283571608371ccd03dedd38824882fd3e4daaad2f7b59d1b44d1c","observation_id":"91ccc0b6-2ee5-417c-a784-783d5edfc74b","resolution":{"observed_at":"2026-08-11T12:16:31.276152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:16:31.279909Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14457","last_updated":"2024-12-19T02:17:35Z","snapshot_observed_at":"2026-08-12T12:20:28.897302Z","submitted_at":"2024-12-19T02:17:35Z","title":"VISA: Retrieval Augmented Generation with Visual Source Attribution","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T12:16:31.279909Z"},"links":{"citing_paper":"/paper/2412.14457"},"observation_digest":"sha256:f221ced76d4075f10ee53a310f3c89d0d97f2442400a3146efb0d8f7565d74a9","observation_id":"4075fdcc-6fa3-4aef-9653-f87b3566e708","resolution":{"observed_at":"2026-08-11T12:16:31.279909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:16:31.283801Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14457","last_updated":"2024-12-19T02:17:35Z","snapshot_observed_at":"2026-08-12T12:20:28.897302Z","submitted_at":"2024-12-19T02:17:35Z","title":"VISA: Retrieval Augmented Generation with Visual Source Attribution","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T12:16:31.283801Z"},"links":{"citing_paper":"/paper/2412.14457"},"observation_digest":"sha256:e4d9778913e716cc8f5dbac37c117eb31fed515eb49288733e2271dcfe6b1301","observation_id":"b0ee7770-52c3-410f-a74a-d6025a5623a9","resolution":{"observed_at":"2026-08-11T12:16:31.283801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-11T12:16:31.287639Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14457","last_updated":"2024-12-19T02:17:35Z","snapshot_observed_at":"2026-08-12T12:20:28.897302Z","submitted_at":"2024-12-19T02:17:35Z","title":"VISA: Retrieval Augmented Generation with Visual Source Attribution","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T12:16:31.287639Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2412.14457"},"observation_digest":"sha256:7f9e05553c18ba76d29bfb31ddb33e9d1f0d995f624850740da2792c0e7136ea","observation_id":"ba627af3-ce63-498b-ab11-c5f43f140193","resolution":{"observed_at":"2026-08-11T12:16:31.287639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:16:31.291427Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14457","last_updated":"2024-12-19T02:17:35Z","snapshot_observed_at":"2026-08-12T12:20:28.897302Z","submitted_at":"2024-12-19T02:17:35Z","title":"VISA: Retrieval Augmented Generation with Visual Source Attribution","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T12:16:31.291427Z"},"links":{"citing_paper":"/paper/2412.14457"},"observation_digest":"sha256:e01f938e930c461cbe270e7cee95c93854910889d9135479628466ab0d558f89","observation_id":"808f511d-accb-4cd3-a3c9-f1552f4f69c2","resolution":{"observed_at":"2026-08-11T12:16:31.291427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17557","last_updated":"2024-10-31T11:37:49Z","snapshot_observed_at":"2026-08-02T15:25:02.551919Z","submitted_at":"2024-06-25T13:50:56Z","title":"The FineWeb Datasets: Decanting the Web for the Finest Text Data at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17557","snapshot_observed_at":"2026-08-11T12:16:31.294936Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14457","last_updated":"2024-12-19T02:17:35Z","snapshot_observed_at":"2026-08-12T12:20:28.897302Z","submitted_at":"2024-12-19T02:17:35Z","title":"VISA: Retrieval Augmented Generation with Visual Source Attribution","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T12:16:31.294936Z"},"links":{"cited_paper":"/paper/2406.17557","citing_paper":"/paper/2412.14457"},"observation_digest":"sha256:6503c9047dfb51d20a28ca93db41a32b7890b83e7d2c399978ba059386ad0221","observation_id":"7e7dcade-a817-4576-8b1d-a801d246fe60","resolution":{"observed_at":"2026-08-11T12:16:31.294936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:16:31.298341Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14457","last_updated":"2024-12-19T02:17:35Z","snapshot_observed_at":"2026-08-12T12:20:28.897302Z","submitted_at":"2024-12-19T02:17:35Z","title":"VISA: Retrieval Augmented Generation with Visual Source Attribution","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T12:16:31.298341Z"},"links":{"citing_paper":"/paper/2412.14457"},"observation_digest":"sha256:3cb806074c17542e02eab55e18e1f7159c229eddb73e5ed25d57e388ad3d6955","observation_id":"10c10264-2d04-4ce3-b023-509d241fa64f","resolution":{"observed_at":"2026-08-11T12:16:31.298341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:16:31.301803Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.14457","last_updated":"2024-12-19T02:17:35Z","snapshot_observed_at":"2026-08-12T12:20:28.897302Z","submitted_at":"2024-12-19T02:17:35Z","title":"VISA: Retrieval Augmented Generation with Visual Source Attribution","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T12:16:31.301803Z"},"links":{"citing_paper":"/paper/2412.14457"},"observation_digest":"sha256:fb356def61e552c44c9fd5296d066e75a5c14f1996b8c78a6062640eb247a081","observation_id":"2d49b22a-f147-45cb-907e-3f6003f13327","resolution":{"observed_at":"2026-08-11T12:16:31.301803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:16:31.796900Z","title":null,"venue":null,"work_id":"77de3b3e-c43a-4907-b8d1-29ed0a08814a","year":2015},"citing_paper":{"arxiv_id":"2412.14457","last_updated":"2024-12-19T02:17:35Z","snapshot_observed_at":"2026-08-12T12:20:28.897302Z","submitted_at":"2024-12-19T02:17:35Z","title":"VISA: Retrieval Augmented Generation with Visual Source Attribution","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T12:16:31.306161Z"},"links":{"citing_paper":"/paper/2412.14457"},"observation_digest":"sha256:679fdaeb05102d110b72994f97e5c2d27286067de6a5ab33ac450bbc28b8c7ef","observation_id":"5002f865-455c-41fc-81e4-7a1a1c8ffa89","resolution":{"observed_at":"2026-08-11T12:16:31.800528Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21943","last_updated":"2024-10-29T11:03:31Z","snapshot_observed_at":"2026-08-05T05:43:15.636463Z","submitted_at":"2024-10-29T11:03:31Z","title":"Beyond Text: Optimizing RAG with Multimodal Inputs for Industrial Applications","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21943","snapshot_observed_at":"2026-08-11T12:16:31.310174Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14457","last_updated":"2024-12-19T02:17:35Z","snapshot_observed_at":"2026-08-12T12:20:28.897302Z","submitted_at":"2024-12-19T02:17:35Z","title":"VISA: Retrieval Augmented Generation with Visual Source Attribution","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T12:16:31.310174Z"},"links":{"cited_paper":"/paper/2410.21943","citing_paper":"/paper/2412.14457"},"observation_digest":"sha256:536cc3e5087f7dee7cc1db049eef98f89cca5c9a19e361642de1c66e1d554632","observation_id":"0e8efef7-5b86-48e4-92be-da03869a9c90","resolution":{"observed_at":"2026-08-11T12:16:31.310174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03555","last_updated":"2024-12-04T18:50:42Z","snapshot_observed_at":"2026-07-06T20:01:45.826971Z","submitted_at":"2024-12-04T18:50:42Z","title":"PaliGemma 2: A Family of Versatile VLMs for Transfer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03555","snapshot_observed_at":"2026-08-11T12:16:31.314033Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14457","last_updated":"2024-12-19T02:17:35Z","snapshot_observed_at":"2026-08-12T12:20:28.897302Z","submitted_at":"2024-12-19T02:17:35Z","title":"VISA: Retrieval Augmented Generation with Visual Source Attribution","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T12:16:31.314033Z"},"links":{"cited_paper":"/paper/2412.03555","citing_paper":"/paper/2412.14457"},"observation_digest":"sha256:54df39f2165424914e39bc835899f01ef2b7e9ca852f1d09331bd093179f973d","observation_id":"bea72621-fd56-4572-970d-4f5aea352e8b","resolution":{"observed_at":"2026-08-11T12:16:31.314033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:16:31.317646Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2412.14457","last_updated":"2024-12-19T02:17:35Z","snapshot_observed_at":"2026-08-12T12:20:28.897302Z","submitted_at":"2024-12-19T02:17:35Z","title":"VISA: Retrieval Augmented Generation with Visual Source Attribution","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T12:16:31.317646Z"},"links":{"citing_paper":"/paper/2412.14457"},"observation_digest":"sha256:ad41607cd206678a6b7286cafae93e8072eb878f3c113c5bc4a36968450609b3","observation_id":"dad3310c-c37c-498e-9b44-1a4769d2a1b1","resolution":{"observed_at":"2026-08-11T12:16:31.317646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-11T12:16:31.321995Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14457","last_updated":"2024-12-19T02:17:35Z","snapshot_observed_at":"2026-08-12T12:20:28.897302Z","submitted_at":"2024-12-19T02:17:35Z","title":"VISA: Retrieval Augmented Generation with Visual Source Attribution","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T12:16:31.321995Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2412.14457"},"observation_digest":"sha256:4d1bfffcae7adaf35fc647825d9000ad68f24c13b589c81611528736bd0afd6e","observation_id":"ac85f34a-e893-4831-a560-758db8f397d8","resolution":{"observed_at":"2026-08-11T12:16:31.321995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13085","last_updated":"2025-03-03T03:08:28Z","snapshot_observed_at":"2026-08-02T03:49:38.796672Z","submitted_at":"2024-10-16T23:03:27Z","title":"MMed-RAG: Versatile Multimodal RAG System for Medical Vision Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13085","snapshot_observed_at":"2026-08-11T12:16:31.325643Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14457","last_updated":"2024-12-19T02:17:35Z","snapshot_observed_at":"2026-08-12T12:20:28.897302Z","submitted_at":"2024-12-19T02:17:35Z","title":"VISA: Retrieval Augmented Generation with Visual Source Attribution","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T12:16:31.325643Z"},"links":{"cited_paper":"/paper/2410.13085","citing_paper":"/paper/2412.14457"},"observation_digest":"sha256:698fcd581020cec13ceb6e60a42dd1d12c12d67d9d95329bd4aef2f52799d41b","observation_id":"ada02b75-60da-4b30-925a-f583a1d5f425","resolution":{"observed_at":"2026-08-11T12:16:31.325643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:16:31.329378Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14457","last_updated":"2024-12-19T02:17:35Z","snapshot_observed_at":"2026-08-12T12:20:28.897302Z","submitted_at":"2024-12-19T02:17:35Z","title":"VISA: Retrieval Augmented Generation with Visual Source Attribution","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T12:16:31.329378Z"},"links":{"citing_paper":"/paper/2412.14457"},"observation_digest":"sha256:af7ec07f180aa8ee1f5df9dc9905e58eb50b5ffc513c65204b97519b869bd442","observation_id":"7e756e9c-8b0d-4954-aefe-dc51ea0f7855","resolution":{"observed_at":"2026-08-11T12:16:31.329378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10594","last_updated":"2025-03-02T01:19:51Z","snapshot_observed_at":"2026-08-12T04:43:44.229948Z","submitted_at":"2024-10-14T15:04:18Z","title":"VisRAG: Vision-based Retrieval-augmented Generation on Multi-modality Documents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10594","snapshot_observed_at":"2026-08-11T12:16:31.333549Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14457","last_updated":"2024-12-19T02:17:35Z","snapshot_observed_at":"2026-08-12T12:20:28.897302Z","submitted_at":"2024-12-19T02:17:35Z","title":"VISA: Retrieval Augmented Generation with Visual Source Attribution","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T12:16:31.333549Z"},"links":{"cited_paper":"/paper/2410.10594","citing_paper":"/paper/2412.14457"},"observation_digest":"sha256:b451acf1b09144c54782d5a8698c41dc9b00cb5a7d85970bef87a574cb5e808c","observation_id":"2d68af34-57c7-42e0-ad4f-2ef637ebc203","resolution":{"observed_at":"2026-08-11T12:16:31.333549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.05511","last_updated":"2019-04-16T09:24:59Z","snapshot_observed_at":"2026-08-07T19:40:27.274470Z","submitted_at":"2018-07-15T08:16:03Z","title":"Object Detection with Deep Learning: A Review","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.05511","snapshot_observed_at":"2026-08-11T12:16:31.337679Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.14457","last_updated":"2024-12-19T02:17:35Z","snapshot_observed_at":"2026-08-12T12:20:28.897302Z","submitted_at":"2024-12-19T02:17:35Z","title":"VISA: Retrieval Augmented Generation with Visual Source Attribution","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T12:16:31.337679Z"},"links":{"cited_paper":"/paper/1807.05511","citing_paper":"/paper/2412.14457"},"observation_digest":"sha256:117add0f7a4a18f356e46792c98ff2dcff7d5da9ff6189eb45d1d11172836aff","observation_id":"4297aa9a-6bd7-4b81-9ebb-082053993261","resolution":{"observed_at":"2026-08-11T12:16:31.337679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:16:31.341609Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.14457","last_updated":"2024-12-19T02:17:35Z","snapshot_observed_at":"2026-08-12T12:20:28.897302Z","submitted_at":"2024-12-19T02:17:35Z","title":"VISA: Retrieval Augmented Generation with Visual Source Attribution","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T12:16:31.341609Z"},"links":{"citing_paper":"/paper/2412.14457"},"observation_digest":"sha256:8c213a99d7c648dd871e851a56d47abef34c669355571fdbe5d67a07fdbc2889","observation_id":"7bf863ea-1cdf-4cb3-a66e-4f10c9934bc1","resolution":{"observed_at":"2026-08-11T12:16:31.341609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.05055","last_updated":"2023-01-18T14:23:50Z","snapshot_observed_at":"2026-08-10T22:22:44.491736Z","submitted_at":"2019-05-13T14:26:50Z","title":"Object Detection in 20 Years: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.05055","snapshot_observed_at":"2026-08-11T12:16:31.345105Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14457","last_updated":"2024-12-19T02:17:35Z","snapshot_observed_at":"2026-08-12T12:20:28.897302Z","submitted_at":"2024-12-19T02:17:35Z","title":"VISA: Retrieval Augmented Generation with Visual Source Attribution","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-11T12:16:31.345105Z"},"links":{"cited_paper":"/paper/1905.05055","citing_paper":"/paper/2412.14457"},"observation_digest":"sha256:b603539df8ae26ec45f7a7526821075800fb961983f312eaf6a185b59b6ad673","observation_id":"fa45bd37-b53f-4ee1-862e-1258c7f0e32e","resolution":{"observed_at":"2026-08-11T12:16:31.345105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.14457","last_updated":"2024-12-19T02:17:35Z","latest_version":1,"primary_category":"cs.IR","snapshot_observed_at":"2026-08-12T12:20:28.897302Z","submitted_at":"2024-12-19T02:17:35Z","title":"VISA: Retrieval Augmented Generation with Visual Source Attribution"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":37,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 3 inbound Pith citation observations for arXiv:2412.14457."}