{"as_of":"2026-08-14T01:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ab876c5ca3c4897d7aece6635d8f335ec891ceedc2b1e08f9ba0d41e0874a244","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:22:18.452564Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-18T09:41:38.974413Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-18T09:42:30.777398Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-11T01:28:55.420335Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2505.19091","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.19091","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gordon V","venue":null,"work_id":"18998f37-5a6b-40ac-a603-f6726eaa7eef","year":null},"citing_paper":{"arxiv_id":"2510.05038","last_updated":"2026-04-06T22:22:13Z","snapshot_observed_at":"2026-07-06T22:31:49.574184Z","submitted_at":"2025-10-06T17:12:53Z","title":"Guided Query Refinement: Multimodal Hybrid Retrieval with Test-Time Optimization","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-18T09:41:38.974413Z"},"links":{"cited_paper":"/paper/2505.19091","citing_paper":"/paper/2510.05038"},"observation_digest":"sha256:156caab113022f590cf4ec7eadf47c129fe95c5dc5e7ea9eeed17fc557ecf895","observation_id":"8a4a794e-5fb4-4ee2-ba92-ac7189ff08bd","resolution":{"observed_at":"2026-05-18T09:42:30.780392Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.19091/citation-record","integrity":"/paper/2505.19091/integrity","json":"/paper/2505.19091/citation-record.json","paper":"/paper/2505.19091"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.07073","last_updated":"2024-10-10T17:59:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-09T17:16:22Z","title":"Pixtral 12B","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07073","snapshot_observed_at":"2026-08-07T14:22:14.978982Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-11T01:28:55.420335Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:14.978982Z"},"links":{"cited_paper":"/paper/2410.07073","citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:e4281a6dd7716ed6ab0eddc510a6b03aaf6aaeac4bcee58a72ab2eb99a819640","observation_id":"a11a82cc-fc52-41aa-bee1-1ddbef0659d6","resolution":{"observed_at":"2026-08-07T14:22:14.978982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"status/1859614","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:19.115497Z","title":null,"venue":null,"work_id":"6cbb7d15-c74f-4fe3-b033-cfab08d65a13","year":2024},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-11T01:28:55.420335Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:15.036867Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:7df37505d0635d556db4e2118ea011c6e206748c560affc1a1915fa6b40322d4","observation_id":"6f23dbf1-6378-4369-be97-1253b0f78f18","resolution":{"observed_at":"2026-08-07T14:22:19.180358Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2410.06068","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:18.860541Z","title":null,"venue":null,"work_id":"c03735f4-6a5e-4a0e-88c4-82e37ed4ba68","year":2024},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-11T01:28:55.420335Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:15.118151Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:d9bc453e722d3a784cdac9e388fd7041dc1c57528fb7f35a1f08e5db1d0a7007","observation_id":"637ebc85-6bdf-499d-94d8-661461535e84","resolution":{"observed_at":"2026-08-07T14:22:18.944954Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-08-12T17:29:41.806995Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-07T14:22:15.170923Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-11T01:28:55.420335Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:15.170923Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:8a119b8293e343f7499d2badc0ec3007bb33ab9ebb0d30eb6339f92b85e4b1e2","observation_id":"f8938571-ffaf-475c-97ff-e990837094fe","resolution":{"observed_at":"2026-08-07T14:22:15.170923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:21.441434Z","title":null,"venue":null,"work_id":"9b87fc4d-31e9-4c59-bde0-024311ffd39d","year":2024},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-11T01:28:55.420335Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:15.249010Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:07ca87d70e0ed267fe708f61b1bf0d0ff6a7fd29eb934724edf282933c12503f","observation_id":"96cb9021-43dc-4054-80b3-939c38954456","resolution":{"observed_at":"2026-08-07T14:22:21.475332Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:21.307222Z","title":null,"venue":null,"work_id":"7c2e9a6a-abf2-4338-9da5-30eef094a696","year":2024},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-11T01:28:55.420335Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:15.319584Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:050c752099086fcddcc28efd5db8ca99c046a0d99aed67dc64e7a83f5ccb1dfd","observation_id":"78970237-af36-409c-bd97-0552e2ca09ed","resolution":{"observed_at":"2026-08-07T14:22:21.383883Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07726","last_updated":"2024-10-10T17:28:23Z","snapshot_observed_at":"2026-08-08T07:16:45.596308Z","submitted_at":"2024-07-10T14:57:46Z","title":"PaliGemma: A versatile 3B VLM for transfer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07726","snapshot_observed_at":"2026-08-07T14:22:15.397235Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-11T01:28:55.420335Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:15.397235Z"},"links":{"cited_paper":"/paper/2407.07726","citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:7e72702f62db5261930cb0adcd363b6cbb214501ce91712e8682edb02c288268","observation_id":"9c30917c-798b-4af5-9887-7dc76a220965","resolution":{"observed_at":"2026-08-07T14:22:15.397235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:21.140135Z","title":null,"venue":null,"work_id":"35edef96-5a20-41c4-b106-328b1c83d7e7","year":2023},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-11T01:28:55.420335Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:15.462364Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:b4569b114ab8e86168f63f3eb98278cd0079479e40d631b5237724e35a8c4ad7","observation_id":"3350f784-21c7-48ac-a003-57e45b192854","resolution":{"observed_at":"2026-08-07T14:22:21.187406Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:20.996793Z","title":null,"venue":null,"work_id":"f5d955a4-d583-45b9-9636-b5113e76a06b","year":2021},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-11T01:28:55.420335Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:15.666369Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:d6110108b241dc4eaabc89de62d85c780a4006866d352d9a9014fd911bea9d14","observation_id":"ea4f78eb-b100-4568-a9bf-c1804f9cfddd","resolution":{"observed_at":"2026-08-07T14:22:21.058646Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:20.840600Z","title":null,"venue":null,"work_id":"becd5316-a86a-4376-b2f9-4c4129d13f27","year":2017},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-11T01:28:55.420335Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:15.960863Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:12b14cd1742df62912c60da1364ee16255d062bc7537b821730650b954874cdb","observation_id":"a6d08d23-0b1e-465b-8d74-2ca2c96c8c1a","resolution":{"observed_at":"2026-08-07T14:22:20.895656Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:20.698363Z","title":null,"venue":null,"work_id":"1ac4be27-9b2d-4157-9177-6babe2a7eb0a","year":2024},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-11T01:28:55.420335Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:15.993292Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:d7bdcab7fa304bacb1c07fd505f7aab44ebd06135b17baad7d3baeb0f0f837fd","observation_id":"63e625ac-674c-4ec6-85ad-337613c8fb95","resolution":{"observed_at":"2026-08-07T14:22:20.791427Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:16.056473Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-11T01:28:55.420335Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:16.056473Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:5aece4f5c7bd24e4050180f6f8c459240dd9147a233faef5d990526393a4c6b9","observation_id":"149f477f-8175-4c79-96a5-b2161a7e20ac","resolution":{"observed_at":"2026-08-07T14:22:16.056473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04127","last_updated":"2025-01-10T14:31:21Z","snapshot_observed_at":"2026-08-12T23:48:42.921391Z","submitted_at":"2024-06-06T14:49:06Z","title":"Are We Done with MMLU?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04127","snapshot_observed_at":"2026-08-07T14:22:16.148952Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-11T01:28:55.420335Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:16.148952Z"},"links":{"cited_paper":"/paper/2406.04127","citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:2d50baa2da85691174d9b30016f6b1f5cba933484d0f6f6f3775c1d24d52227b","observation_id":"710d461c-00ca-4d95-bdd9-67c7c3375277","resolution":{"observed_at":"2026-08-07T14:22:16.148952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-07T14:22:16.193830Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-11T01:28:55.420335Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:16.193830Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:6c42b5e64c6a167c0ac293610f9cb25b93cee5053ad99c925327fffd6cbbeec3","observation_id":"772d1901-f92c-4aed-9140-0213a2e69bb8","resolution":{"observed_at":"2026-08-07T14:22:16.193830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:20.535259Z","title":null,"venue":null,"work_id":"16a23ea0-80fc-4ec4-aceb-8b06b34f2edd","year":2021},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-11T01:28:55.420335Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:16.276144Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:b1aadd019bcb994d97e4b1071e93a8ebe80f4150816a4bd7f60450b6c79daa07","observation_id":"44dafb12-e62a-40f6-ad08-97497d455f20","resolution":{"observed_at":"2026-08-07T14:22:20.599123Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:16.350173Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-11T01:28:55.420335Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:16.350173Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:aff4444c7a7425f64cd68c2e6335e94ae12f179a994c02aa7c03a85358c495c8","observation_id":"4a8cfe55-d7d5-4881-bb3b-25a6a94ce22d","resolution":{"observed_at":"2026-08-07T14:22:16.350173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:20.447749Z","title":null,"venue":null,"work_id":"d6a71bbb-1006-4ff8-ba27-585ad3ca7aad","year":2024},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-11T01:28:55.420335Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:16.404584Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:8133c2223c10fecbc065134f4d34303dcb5b3c022aece40be9be2fc36fa37b1e","observation_id":"2e099a18-1910-408a-9ec6-a8940ee999e4","resolution":{"observed_at":"2026-08-07T14:22:20.475478Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-07T14:22:16.473235Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-11T01:28:55.420335Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:16.473235Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:30a7615516e09ab2cfd71109a47d9ce76f3e09a704c84f196f0214b31cab0e0d","observation_id":"08188aaf-101f-41de-a959-8b70270610e9","resolution":{"observed_at":"2026-08-07T14:22:16.473235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:16.577583Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-11T01:28:55.420335Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:16.577583Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:285051431379734cfd8d89c056f7eafad1e9504af612102786c709205a6bc13b","observation_id":"aee66e8f-19a0-484c-a873-8a4e20840689","resolution":{"observed_at":"2026-08-07T14:22:16.577583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:20.228847Z","title":null,"venue":null,"work_id":"868c790d-c684-4cf9-a383-42bdc0d0d188","year":2017},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-11T01:28:55.420335Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:16.628128Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:57b91e3cbfe6ab074e5801c9363126c7ac56f9cc4b042b3db7b43587e0b41e8a","observation_id":"f66744fb-3031-44a8-a458-713ee1618c49","resolution":{"observed_at":"2026-08-07T14:22:20.306771Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:20.080472Z","title":null,"venue":null,"work_id":"7bfe7107-e97c-4561-b0c9-5eea893d831a","year":2023},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-11T01:28:55.420335Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:16.725180Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:2f8e2cfacf5b1495d714b7c33f89a9367c3c225329fbbe54dc48c95a3a233805","observation_id":"c06c9dd5-69c9-4453-a9d0-021e91397f4b","resolution":{"observed_at":"2026-08-07T14:22:20.120149Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:16.856094Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-11T01:28:55.420335Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:16.856094Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:a6ead43194aaa787b6fdd741587c1ce2ab555cb500a51891cb4b2544bb2ca523","observation_id":"d37843a3-c27a-4b9e-9a4c-cc9423c46333","resolution":{"observed_at":"2026-08-07T14:22:16.856094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:16.957747Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-11T01:28:55.420335Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:16.957747Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:7d59d80fd0943a979af311aa24bad038d842da5aade7218fb831f426b27282db","observation_id":"247cbc9c-625a-467e-8bb7-dbb36f52ef2e","resolution":{"observed_at":"2026-08-07T14:22:16.957747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:17.077528Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-11T01:28:55.420335Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:17.077528Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:efbaf30ae9e89211d59df5127b957e202119170d1da64dd51a3ec85f16f60f41","observation_id":"fc88de60-333d-41ae-bb01-0ed320cfe8ea","resolution":{"observed_at":"2026-08-07T14:22:17.077528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:17.189077Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-11T01:28:55.420335Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:17.189077Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:e949936caddab30ee8c7f905850066134ee67a17fa5f316b24225a08866da1da","observation_id":"1738294d-1e7f-4582-af4e-c99026dec0ac","resolution":{"observed_at":"2026-08-07T14:22:17.189077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:19.794041Z","title":null,"venue":null,"work_id":"76cb4ea5-b11f-4731-81bb-b65ae43f70e4","year":2024},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-11T01:28:55.420335Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:17.237006Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:6e7eca54e38970bc02a143c5a4ef85d0eff0cfae245fdbcd2e63d83e43a92d8d","observation_id":"28b0f7d4-bad6-49b6-9526-18085c2b035b","resolution":{"observed_at":"2026-08-07T14:22:19.893775Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:17.311371Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-11T01:28:55.420335Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:17.311371Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:ca4ff65f3f82013418638dd8f020c692c3a384c8ee7d8383704e814babc09840","observation_id":"51e508f0-b950-4597-b83f-9f600359e79e","resolution":{"observed_at":"2026-08-07T14:22:17.311371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:19.593212Z","title":null,"venue":null,"work_id":"813ba41d-5aa9-4b12-9720-e33e1e4703c0","year":2009},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-11T01:28:55.420335Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:17.387127Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:fbec47817b94240a8f7210851caf648d373dbbbde7d159ff1c93fddc7c8af2aa","observation_id":"6e7451b9-c9a1-4ec2-8d69-877535d0419f","resolution":{"observed_at":"2026-08-07T14:22:19.646371Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05167","last_updated":"2025-07-09T14:35:23Z","snapshot_observed_at":"2026-08-13T06:22:00.957206Z","submitted_at":"2025-02-07T18:49:46Z","title":"NoLiMa: Long-Context Evaluation Beyond Literal Matching","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05167","snapshot_observed_at":"2026-08-07T14:22:17.501214Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-11T01:28:55.420335Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:17.501214Z"},"links":{"cited_paper":"/paper/2502.05167","citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:25451f64ff7dd34a263576b55663b33d5e696ee60658ec22b72c9b4406f74e86","observation_id":"ba026d5b-c096-4fd6-9b1d-4d898b9f3da7","resolution":{"observed_at":"2026-08-07T14:22:17.501214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:17.570803Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-11T01:28:55.420335Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:17.570803Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:64009feb28ba8af8d3d843497025e975075d5cfcc6e4c6abb5986502a03f316b","observation_id":"9eb87987-ff3f-4ef5-8c9c-be4e6001fc98","resolution":{"observed_at":"2026-08-07T14:22:17.570803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:19.439964Z","title":null,"venue":null,"work_id":"9d3b1bef-2c64-4ddc-9ee9-44840a422863","year":2024},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-11T01:28:55.420335Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:17.626513Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:ec5d8502d2c65ffd11f7436b96e0fc8f0e3794d6f47c41852a023dc20d9119e4","observation_id":"397a5e3c-d1f6-4ca8-846b-ffe7fd5da5b1","resolution":{"observed_at":"2026-08-07T14:22:19.486514Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:17.701013Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-11T01:28:55.420335Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:17.701013Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:50e435fb272335cab6e30a49a0d8c9983fbe28fe0396403cdb539d497416a9c1","observation_id":"b316431b-9168-4469-a970-424496c9fff7","resolution":{"observed_at":"2026-08-07T14:22:17.701013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01574","last_updated":"2024-11-06T02:54:00Z","snapshot_observed_at":"2026-08-06T00:29:17.674418Z","submitted_at":"2024-06-03T17:53:00Z","title":"MMLU-Pro: A More Robust and Challenging Multi-Task Language Understanding Benchmark","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01574","snapshot_observed_at":"2026-08-07T14:22:17.775672Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-11T01:28:55.420335Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:17.775672Z"},"links":{"cited_paper":"/paper/2406.01574","citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:7f08453a422e20b96a6f77e9b698331e4358ae04de199ff1e1bfb963eff2baba","observation_id":"49d8a318-a516-4e15-a43d-cf47b6b16376","resolution":{"observed_at":"2026-08-07T14:22:17.775672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:19.265039Z","title":null,"venue":null,"work_id":"cb7d0f2d-58f5-47f6-b515-adb9b110c19a","year":2018},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-11T01:28:55.420335Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:17.907315Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:1ae48906956b3dc8bf05e33ef3d83a6502b8654fe80b3ee515be7bbadd3f4280","observation_id":"5d00ea9e-c2f6-4a56-94e5-eb55ca87581c","resolution":{"observed_at":"2026-08-07T14:22:19.315026Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10594","last_updated":"2025-03-02T01:19:51Z","snapshot_observed_at":"2026-08-13T17:45:25.269133Z","submitted_at":"2024-10-14T15:04:18Z","title":"VisRAG: Vision-based Retrieval-augmented Generation on Multi-modality Documents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10594","snapshot_observed_at":"2026-08-07T14:22:18.003754Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-11T01:28:55.420335Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:18.003754Z"},"links":{"cited_paper":"/paper/2410.10594","citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:bbd101fd8e7a26087c6ed7152e2787a7ebb572291ce98bbdc9e70247aa7e0e87","observation_id":"95b6676e-d350-4c12-b78b-d8dfb9175291","resolution":{"observed_at":"2026-08-07T14:22:18.003754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:18.095788Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-11T01:28:55.420335Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:18.095788Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:73867726a8a8e623a23cce50923620b3b9b61fcf7e06c9d409965b2c4ac11a0a","observation_id":"33dbe99d-b3aa-4409-b2b2-f564bb313194","resolution":{"observed_at":"2026-08-07T14:22:18.095788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.02592","last_updated":"2025-08-30T07:10:08Z","snapshot_observed_at":"2026-08-12T03:16:59.416140Z","submitted_at":"2024-12-03T17:23:47Z","title":"OCR Hinders RAG: Evaluating the Cascading Impact of OCR on Retrieval-Augmented Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.02592","snapshot_observed_at":"2026-08-07T14:22:18.214346Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-11T01:28:55.420335Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:18.214346Z"},"links":{"cited_paper":"/paper/2412.02592","citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:6b4a12836798e2fc600fa7eae4fade1e37dab5bc76dc462642937a8226f55c20","observation_id":"60ae3611-5178-4791-8278-a1eab7bdc736","resolution":{"observed_at":"2026-08-07T14:22:18.214346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:18.350538Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-11T01:28:55.420335Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:18.350538Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:34ca4ee857dbe9fea28359f8a142f1f90d2c8789c7e167e3241191fad123b66a","observation_id":"10cf679d-552d-4c77-9b26-b60af85b97f7","resolution":{"observed_at":"2026-08-07T14:22:18.350538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:18.452564Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-11T01:28:55.420335Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:18.452564Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:3e54027c84c94be86b9c8d733e5f1e26ccefcfda576ed19bb988d6543e6c7690","observation_id":"8eea4255-6fb5-4a02-9eba-c1e68a6518a4","resolution":{"observed_at":"2026-08-07T14:22:18.452564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-11T01:28:55.420335Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":37,"verified_exact":2,"verified_fuzzy":0},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 1 inbound Pith citation observation for arXiv:2505.19091."}