{"as_of":"2026-08-09T22:08:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5d22e2154674254b1c5c7cfe45aca0848c69857e8dfcc08d3b553b1b135bcf3b","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":19,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":19,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":19,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":19,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:42:25.292711Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T16:18:37.548550Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.15558","last_updated":"2025-01-26T15:20:39Z","snapshot_observed_at":"2026-08-06T19:35:19.984769Z","submitted_at":"2025-01-26T15:20:39Z","title":"Ocean-OCR: Towards General OCR Application via a Vision-Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15558","snapshot_observed_at":"2026-08-07T15:42:25.292711Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-08T07:54:09.757528Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:25.292711Z"},"links":{"cited_paper":"/paper/2501.15558","citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:1a16fca6e5f60b66ed7eb3636a35ece5389a6c5512dc444b50e26f45274a7a22","observation_id":"acf72259-e3de-4028-b256-1aca9c9a9fb7","resolution":{"observed_at":"2026-08-07T15:42:25.292711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15558","last_updated":"2025-01-26T15:20:39Z","snapshot_observed_at":"2026-08-06T19:35:19.984769Z","submitted_at":"2025-01-26T15:20:39Z","title":"Ocean-OCR: Towards General OCR Application via a Vision-Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15558","snapshot_observed_at":"2026-08-07T11:08:35.856508Z","title":"arXiv preprint arXiv:2501.15558","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.03371","last_updated":"2025-06-03T20:28:55Z","snapshot_observed_at":"2026-08-09T17:56:18.493541Z","submitted_at":"2025-06-03T20:28:55Z","title":"Toward Reliable VLM: A Fine-Grained Benchmark and Framework for Exposure, Bias, and Inference in Korean Street Views","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T11:08:35.856508Z"},"links":{"cited_paper":"/paper/2501.15558","citing_paper":"/paper/2506.03371"},"observation_digest":"sha256:0ece3d5088f8eccf2e3e0639b0dec035562d26dab96e5e938a1aa98cf646ef06","observation_id":"9111af45-1f0d-4e70-88ec-035864d55cce","resolution":{"observed_at":"2026-08-07T11:08:35.856508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15558","last_updated":"2025-01-26T15:20:39Z","snapshot_observed_at":"2026-08-06T19:35:19.984769Z","submitted_at":"2025-01-26T15:20:39Z","title":"Ocean-OCR: Towards General OCR Application via a Vision-Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15558","snapshot_observed_at":"2026-08-07T00:48:28.448857Z","title":"Ocean-ocr: Towards general ocr application via a vision-language model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12776","last_updated":"2025-06-15T08:58:09Z","snapshot_observed_at":"2026-08-08T19:09:10.101000Z","submitted_at":"2025-06-15T08:58:09Z","title":"Native Visual Understanding: Resolving Resolution Dilemmas in Vision-Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T00:48:28.448857Z"},"links":{"cited_paper":"/paper/2501.15558","citing_paper":"/paper/2506.12776"},"observation_digest":"sha256:84ac02cd4066be73767f473f336e4bb83f02611aac516f3032eebe35ec0f533b","observation_id":"3a605ce2-499d-4e75-a0b5-7159b53b774b","resolution":{"observed_at":"2026-08-07T00:48:28.448857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15558","last_updated":"2025-01-26T15:20:39Z","snapshot_observed_at":"2026-08-06T19:35:19.984769Z","submitted_at":"2025-01-26T15:20:39Z","title":"Ocean-OCR: Towards General OCR Application via a Vision-Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15558","snapshot_observed_at":"2026-08-06T13:45:18.542039Z","title":"Towards gen- eral ocr application via a vision-language model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20145","last_updated":"2025-07-27T06:44:53Z","snapshot_observed_at":"2026-08-08T10:07:05.353800Z","submitted_at":"2025-07-27T06:44:53Z","title":"Multi-Agent Interactive Question Generation Framework for Long Document Understanding","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T13:45:18.542039Z"},"links":{"cited_paper":"/paper/2501.15558","citing_paper":"/paper/2507.20145"},"observation_digest":"sha256:bc39916088f7f4bced628f2f6446677cdc06a67789ebcb421d05dbd333e39d3e","observation_id":"06237e27-d010-4abb-9116-41f832c4d3e2","resolution":{"observed_at":"2026-08-06T13:45:18.542039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15558","last_updated":"2025-01-26T15:20:39Z","snapshot_observed_at":"2026-08-06T19:35:19.984769Z","submitted_at":"2025-01-26T15:20:39Z","title":"Ocean-OCR: Towards General OCR Application via a Vision-Language Model","version":1},"cited_work":{"arxiv_id":"2501.15558","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.15558","snapshot_observed_at":"2026-07-03T16:18:37.548550Z","title":"Ocean-ocr: Towards general ocr application via a vision-language model.arXiv preprint arXiv:2501.15558","venue":null,"work_id":"0f256bf5-e790-4a27-bee6-b65f4ac2bb55","year":2025},"citing_paper":{"arxiv_id":"2509.22186","last_updated":"2025-09-29T16:41:28Z","snapshot_observed_at":"2026-08-06T11:22:47.957500Z","submitted_at":"2025-09-26T10:45:48Z","title":"MinerU2.5: A Decoupled Vision-Language Model for Efficient High-Resolution Document Parsing","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-17T13:25:31.884175Z"},"links":{"cited_paper":"/paper/2501.15558","citing_paper":"/paper/2509.22186"},"observation_digest":"sha256:c6c64a06377d7a4a502b393ab849bb7471817da822912f9ec8f11ea2c202e37c","observation_id":"04421ea2-b829-40fd-b508-4093dac1d46d","resolution":{"observed_at":"2026-05-17T13:25:32.114062Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15558","last_updated":"2025-01-26T15:20:39Z","snapshot_observed_at":"2026-08-06T19:35:19.984769Z","submitted_at":"2025-01-26T15:20:39Z","title":"Ocean-OCR: Towards General OCR Application via a Vision-Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15558","snapshot_observed_at":"2026-08-03T14:16:50.723234Z","title":"Ocean-ocr: Towards general ocr application via a vision-language model.arXiv preprint arXiv:2501.15558, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.21095","last_updated":"2026-07-11T09:04:48Z","snapshot_observed_at":"2026-08-09T11:14:25.937636Z","submitted_at":"2025-12-24T10:35:21Z","title":"UniRec-0.1B: Unified Text and Formula Recognition with 0.1B Parameters","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T14:16:50.723234Z"},"links":{"cited_paper":"/paper/2501.15558","citing_paper":"/paper/2512.21095"},"observation_digest":"sha256:96c4ec34815f6d4d4a0f5ca21a4fe8eb6590d4522ac51f4ce6db6275c2063d2e","observation_id":"158a39c1-ba1f-4bdb-bbfb-83db6cf9faef","resolution":{"observed_at":"2026-08-03T14:16:50.723234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15558","last_updated":"2025-01-26T15:20:39Z","snapshot_observed_at":"2026-08-06T19:35:19.984769Z","submitted_at":"2025-01-26T15:20:39Z","title":"Ocean-OCR: Towards General OCR Application via a Vision-Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15558","snapshot_observed_at":"2026-08-02T23:44:35.717955Z","title":"arXiv preprint arXiv:2501.15558 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.12957","last_updated":"2026-06-29T06:43:50Z","snapshot_observed_at":"2026-08-04T00:07:49.527953Z","submitted_at":"2026-02-13T14:22:10Z","title":"HSD: Training-Free Acceleration for Document Parsing Vision-Language Models with Hierarchical Speculative Decoding","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T23:44:35.717955Z"},"links":{"cited_paper":"/paper/2501.15558","citing_paper":"/paper/2602.12957"},"observation_digest":"sha256:26233c66c7e0f192e02dc9c409d2fd1591a50d8cd514b52ecc792d31bd9181f5","observation_id":"a292ab14-8fd7-4629-a62c-ba80216cc5ec","resolution":{"observed_at":"2026-08-02T23:44:35.717955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15558","last_updated":"2025-01-26T15:20:39Z","snapshot_observed_at":"2026-08-06T19:35:19.984769Z","submitted_at":"2025-01-26T15:20:39Z","title":"Ocean-OCR: Towards General OCR Application via a Vision-Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15558","snapshot_observed_at":"2026-08-02T18:54:55.310939Z","title":"Ocean-ocr: Towards general ocr application via a vision-language model, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.04205","last_updated":"2026-06-22T03:43:39Z","snapshot_observed_at":"2026-08-02T18:54:54.324790Z","submitted_at":"2026-03-04T15:49:06Z","title":"Real5-OmniDocBench: A Full-Scale Physical Reconstruction Benchmark for Robust Document Parsing in the Wild","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T18:54:55.310939Z"},"links":{"cited_paper":"/paper/2501.15558","citing_paper":"/paper/2603.04205"},"observation_digest":"sha256:c7456e5760d9f1957734ade7a00b0dd5ee5209ad679fdd5469b250e20c5df3ac","observation_id":"877c9eba-c007-42a2-8f49-31be1c402949","resolution":{"observed_at":"2026-08-02T18:54:55.310939Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15558","last_updated":"2025-01-26T15:20:39Z","snapshot_observed_at":"2026-08-06T19:35:19.984769Z","submitted_at":"2025-01-26T15:20:39Z","title":"Ocean-OCR: Towards General OCR Application via a Vision-Language Model","version":1},"cited_work":{"arxiv_id":"2501.15558","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.15558","snapshot_observed_at":"2026-07-03T16:18:37.548550Z","title":"Ocean-ocr: Towards general ocr application via a vision-language model.arXiv preprint arXiv:2501.15558","venue":null,"work_id":"0f256bf5-e790-4a27-bee6-b65f4ac2bb55","year":2025},"citing_paper":{"arxiv_id":"2603.19790","last_updated":"2026-04-15T01:38:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-03-20T09:28:09Z","title":"From Plausibility to Verifiability: Risk-Controlled Generative OCR with Vision-Language Models","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-15T08:53:18.268970Z"},"links":{"cited_paper":"/paper/2501.15558","citing_paper":"/paper/2603.19790"},"observation_digest":"sha256:c47ea7a64623a00e84fbe33242cd0704bf389ebe40fd14e6d0d2eb0b7cfe9df1","observation_id":"e2af4052-b678-4e86-ae6e-76dc34aed837","resolution":{"observed_at":"2026-05-15T08:55:19.369879Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15558","last_updated":"2025-01-26T15:20:39Z","snapshot_observed_at":"2026-08-06T19:35:19.984769Z","submitted_at":"2025-01-26T15:20:39Z","title":"Ocean-OCR: Towards General OCR Application via a Vision-Language Model","version":1},"cited_work":{"arxiv_id":"2501.15558","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.15558","snapshot_observed_at":"2026-07-03T16:18:37.548550Z","title":"Ocean-ocr: Towards general ocr application via a vision-language model.arXiv preprint arXiv:2501.15558","venue":null,"work_id":"0f256bf5-e790-4a27-bee6-b65f4ac2bb55","year":2025},"citing_paper":{"arxiv_id":"2604.04771","last_updated":"2026-04-09T09:16:34Z","snapshot_observed_at":"2026-08-05T17:53:24.301280Z","submitted_at":"2026-04-06T15:44:18Z","title":"MinerU2.5-Pro: Pushing the Limits of Data-Centric Document Parsing at Scale","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T18:58:41.377996Z"},"links":{"cited_paper":"/paper/2501.15558","citing_paper":"/paper/2604.04771"},"observation_digest":"sha256:f02b3cdcca40c2940c7f8dd637d847f80e9b55f09511acaf9f19e66a67554784","observation_id":"e2b5bab6-7bb0-44cc-ba69-ec0db3ca0f09","resolution":{"observed_at":"2026-05-10T23:35:52.422492Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15558","last_updated":"2025-01-26T15:20:39Z","snapshot_observed_at":"2026-08-06T19:35:19.984769Z","submitted_at":"2025-01-26T15:20:39Z","title":"Ocean-OCR: Towards General OCR Application via a Vision-Language Model","version":1},"cited_work":{"arxiv_id":"2501.15558","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.15558","snapshot_observed_at":"2026-07-03T16:18:37.548550Z","title":"Ocean-ocr: Towards general ocr application via a vision-language model.arXiv preprint arXiv:2501.15558","venue":null,"work_id":"0f256bf5-e790-4a27-bee6-b65f4ac2bb55","year":2025},"citing_paper":{"arxiv_id":"2604.13403","last_updated":"2026-04-15T02:12:51Z","snapshot_observed_at":"2026-07-06T23:01:23.771347Z","submitted_at":"2026-04-15T02:12:51Z","title":"Why Multimodal In-Context Learning Lags Behind? Unveiling the Inner Mechanisms and Bottlenecks","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-05-10T13:41:37.942145Z"},"links":{"cited_paper":"/paper/2501.15558","citing_paper":"/paper/2604.13403"},"observation_digest":"sha256:72336465362e796a1a1f70c505cfe44ec6e0b6024f1e6088164e11fe289176f4","observation_id":"5756a774-acce-4d8e-8de8-b8e307ce04d1","resolution":{"observed_at":"2026-05-10T13:45:28.225427Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15558","last_updated":"2025-01-26T15:20:39Z","snapshot_observed_at":"2026-08-06T19:35:19.984769Z","submitted_at":"2025-01-26T15:20:39Z","title":"Ocean-OCR: Towards General OCR Application via a Vision-Language Model","version":1},"cited_work":{"arxiv_id":"2501.15558","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.15558","snapshot_observed_at":"2026-07-03T16:18:37.548550Z","title":"Ocean-ocr: Towards general ocr application via a vision-language model.arXiv preprint arXiv:2501.15558","venue":null,"work_id":"0f256bf5-e790-4a27-bee6-b65f4ac2bb55","year":2025},"citing_paper":{"arxiv_id":"2605.00392","last_updated":"2026-05-21T12:40:15Z","snapshot_observed_at":"2026-08-02T11:25:36.071129Z","submitted_at":"2026-05-01T04:30:16Z","title":"RTPrune: Reading-Twice Inspired Token Pruning for Efficient DeepSeek-OCR Inference","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-05-09T19:49:28.591419Z"},"links":{"cited_paper":"/paper/2501.15558","citing_paper":"/paper/2605.00392"},"observation_digest":"sha256:29d1dd50da7d8fdc71b4fbd5796483a702d3774406c2775e0ac6ec00010d3559","observation_id":"bb7628da-c811-4387-8c37-f289b5b38f55","resolution":{"observed_at":"2026-05-11T15:31:08.438004Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15558","last_updated":"2025-01-26T15:20:39Z","snapshot_observed_at":"2026-08-06T19:35:19.984769Z","submitted_at":"2025-01-26T15:20:39Z","title":"Ocean-OCR: Towards General OCR Application via a Vision-Language Model","version":1},"cited_work":{"arxiv_id":"2501.15558","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.15558","snapshot_observed_at":"2026-07-03T16:18:37.548550Z","title":"Ocean-ocr: Towards general ocr application via a vision-language model.arXiv preprint arXiv:2501.15558","venue":null,"work_id":"0f256bf5-e790-4a27-bee6-b65f4ac2bb55","year":2025},"citing_paper":{"arxiv_id":"2605.00392","last_updated":"2026-05-21T12:40:15Z","snapshot_observed_at":"2026-08-02T11:25:36.071129Z","submitted_at":"2026-05-01T04:30:16Z","title":"RTPrune: Reading-Twice Inspired Token Pruning for Efficient DeepSeek-OCR Inference","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-12T03:16:31.918225Z"},"links":{"cited_paper":"/paper/2501.15558","citing_paper":"/paper/2605.00392"},"observation_digest":"sha256:3a8a4c7f321ef724628e7657cca2ad2efc06a897224c5e0cc8c9309d484c6123","observation_id":"4011a6ec-8973-4c21-95f2-521124c49979","resolution":{"observed_at":"2026-05-12T03:21:19.407704Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15558","last_updated":"2025-01-26T15:20:39Z","snapshot_observed_at":"2026-08-06T19:35:19.984769Z","submitted_at":"2025-01-26T15:20:39Z","title":"Ocean-OCR: Towards General OCR Application via a Vision-Language Model","version":1},"cited_work":{"arxiv_id":"2501.15558","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.15558","snapshot_observed_at":"2026-07-03T16:18:37.548550Z","title":"Ocean-ocr: Towards general ocr application via a vision-language model.arXiv preprint arXiv:2501.15558","venue":null,"work_id":"0f256bf5-e790-4a27-bee6-b65f4ac2bb55","year":2025},"citing_paper":{"arxiv_id":"2605.00392","last_updated":"2026-05-21T12:40:15Z","snapshot_observed_at":"2026-08-02T11:25:36.071129Z","submitted_at":"2026-05-01T04:30:16Z","title":"RTPrune: Reading-Twice Inspired Token Pruning for Efficient DeepSeek-OCR Inference","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-22T10:28:15.293381Z"},"links":{"cited_paper":"/paper/2501.15558","citing_paper":"/paper/2605.00392"},"observation_digest":"sha256:a54632aa14920394a5bfb72dfffa5cc5a60d6a2f79fa26f8766d311ecddc9f40","observation_id":"5c7f47a4-8d07-4cb9-9655-a8d8bd171293","resolution":{"observed_at":"2026-05-22T10:31:25.735949Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15558","last_updated":"2025-01-26T15:20:39Z","snapshot_observed_at":"2026-08-06T19:35:19.984769Z","submitted_at":"2025-01-26T15:20:39Z","title":"Ocean-OCR: Towards General OCR Application via a Vision-Language Model","version":1},"cited_work":{"arxiv_id":"2501.15558","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.15558","snapshot_observed_at":"2026-07-03T16:18:37.548550Z","title":"Ocean-ocr: Towards general ocr application via a vision-language model.arXiv preprint arXiv:2501.15558","venue":null,"work_id":"0f256bf5-e790-4a27-bee6-b65f4ac2bb55","year":2025},"citing_paper":{"arxiv_id":"2605.12623","last_updated":"2026-05-21T05:33:02Z","snapshot_observed_at":"2026-08-06T19:38:37.895679Z","submitted_at":"2026-05-12T18:09:38Z","title":"DocAtlas: Multilingual Document Understanding Across 80+ Languages","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-05-14T21:02:45.148167Z"},"links":{"cited_paper":"/paper/2501.15558","citing_paper":"/paper/2605.12623"},"observation_digest":"sha256:79f0059f854234867f2428ab1218aa8f30b0b64e6b041e6b0ac440f48d5a5705","observation_id":"d4be3596-a0fc-45f4-b334-18dbb93cfc32","resolution":{"observed_at":"2026-05-14T21:02:58.684066Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15558","last_updated":"2025-01-26T15:20:39Z","snapshot_observed_at":"2026-08-06T19:35:19.984769Z","submitted_at":"2025-01-26T15:20:39Z","title":"Ocean-OCR: Towards General OCR Application via a Vision-Language Model","version":1},"cited_work":{"arxiv_id":"2501.15558","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.15558","snapshot_observed_at":"2026-07-03T16:18:37.548550Z","title":"Ocean-ocr: Towards general ocr application via a vision-language model.arXiv preprint arXiv:2501.15558","venue":null,"work_id":"0f256bf5-e790-4a27-bee6-b65f4ac2bb55","year":2025},"citing_paper":{"arxiv_id":"2605.12623","last_updated":"2026-05-21T05:33:02Z","snapshot_observed_at":"2026-08-06T19:38:37.895679Z","submitted_at":"2026-05-12T18:09:38Z","title":"DocAtlas: Multilingual Document Understanding Across 80+ Languages","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-05-22T09:51:40.160096Z"},"links":{"cited_paper":"/paper/2501.15558","citing_paper":"/paper/2605.12623"},"observation_digest":"sha256:688f4fa5d2d278d5907756efee9703cc6138d9bc358d69db38eedee0303a0da0","observation_id":"c977fcce-9763-4e75-9c73-e7bc9eece571","resolution":{"observed_at":"2026-05-22T09:54:47.078819Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15558","last_updated":"2025-01-26T15:20:39Z","snapshot_observed_at":"2026-08-06T19:35:19.984769Z","submitted_at":"2025-01-26T15:20:39Z","title":"Ocean-OCR: Towards General OCR Application via a Vision-Language Model","version":1},"cited_work":{"arxiv_id":"2501.15558","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.15558","snapshot_observed_at":"2026-07-03T16:18:37.548550Z","title":"Ocean-ocr: Towards general ocr application via a vision-language model.arXiv preprint arXiv:2501.15558","venue":null,"work_id":"0f256bf5-e790-4a27-bee6-b65f4ac2bb55","year":2025},"citing_paper":{"arxiv_id":"2607.02025","last_updated":"2026-07-02T10:55:24Z","snapshot_observed_at":"2026-08-07T21:55:05.882942Z","submitted_at":"2026-07-02T10:55:24Z","title":"Evaluating Vision-Language Models as a Zero-Shot Learning Alternative to You Only Look Once and Optical Character Recognition for Nigerian License Plate Recognition","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-03T16:10:03.765621Z"},"links":{"cited_paper":"/paper/2501.15558","citing_paper":"/paper/2607.02025"},"observation_digest":"sha256:60cb01d11ff7701221a1ecf5bdd63f29064e87af69ed7095c7943123c5686777","observation_id":"51067411-2d32-4029-be1b-8e4549189bce","resolution":{"observed_at":"2026-07-03T16:18:37.550573Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15558","last_updated":"2025-01-26T15:20:39Z","snapshot_observed_at":"2026-08-06T19:35:19.984769Z","submitted_at":"2025-01-26T15:20:39Z","title":"Ocean-OCR: Towards General OCR Application via a Vision-Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15558","snapshot_observed_at":"2026-08-01T14:16:08.139655Z","title":"Ocean-ocr: Towards general ocr application via a vision-language model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18839","last_updated":"2026-07-21T08:25:32Z","snapshot_observed_at":"2026-08-08T12:09:45.760024Z","submitted_at":"2026-07-21T08:25:32Z","title":"HPD-Parsing: Hierarchical Parallel Document Parsing","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T14:16:08.139655Z"},"links":{"cited_paper":"/paper/2501.15558","citing_paper":"/paper/2607.18839"},"observation_digest":"sha256:f1a4df8f8c3aa0e61e525d6f073b84d3ba0759002fd3011672ab89e53e31ab5a","observation_id":"e00da1c1-55e3-452d-b664-a41a385481bd","resolution":{"observed_at":"2026-08-01T14:16:08.139655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15558","last_updated":"2025-01-26T15:20:39Z","snapshot_observed_at":"2026-08-06T19:35:19.984769Z","submitted_at":"2025-01-26T15:20:39Z","title":"Ocean-OCR: Towards General OCR Application via a Vision-Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15558","snapshot_observed_at":"2026-08-02T12:46:09.712264Z","title":"arXiv preprint arXiv:2501.15558 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21617","last_updated":"2026-05-29T20:33:35Z","snapshot_observed_at":"2026-08-07T15:32:04.456746Z","submitted_at":"2026-05-29T20:33:35Z","title":"Do VLMs Read or Rewrite? On Transcription Faithfulness in Vision-Language Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-02T12:46:09.712264Z"},"links":{"cited_paper":"/paper/2501.15558","citing_paper":"/paper/2607.21617"},"observation_digest":"sha256:5cec426ae25805cfe614051761ef140f0a8ac0088b52e83d8f3a952dc2f70e24","observation_id":"350f618f-059a-41b7-ba55-954416cb2379","resolution":{"observed_at":"2026-08-02T12:46:09.712264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2501.15558/citation-record","integrity":"/paper/2501.15558/integrity","json":"/paper/2501.15558/citation-record.json","paper":"/paper/2501.15558"},"outbound":[],"paper":{"arxiv_id":"2501.15558","last_updated":"2025-01-26T15:20:39Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T19:35:19.984769Z","submitted_at":"2025-01-26T15:20:39Z","title":"Ocean-OCR: Towards General OCR Application via a Vision-Language Model"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 19 inbound Pith citation observations for arXiv:2501.15558."}