{"as_of":"2026-08-17T14:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0f4e561a6537a072a2ec5b2308d711ad24e138935dc3147f09dc87331803be1b","coverage":[{"denominator":21,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:41:40.917301Z","state":"measured"},{"denominator":22,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":22,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-20T05:48:34.771799Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-20T05:53:05.108803Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.11156","last_updated":"2025-06-11T16:03:01Z","snapshot_observed_at":"2026-08-16T19:09:09.390220Z","submitted_at":"2025-06-11T16:03:01Z","title":"Digitization of Document and Information Extraction using OCR","version":1},"cited_work":{"arxiv_id":"2506.11156","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.11156","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"4f83e3f4-99f4-408b-9267-e3380b2d527a","year":null},"citing_paper":{"arxiv_id":"2605.19866","last_updated":"2026-05-19T13:58:24Z","snapshot_observed_at":"2026-08-16T07:05:25.316498Z","submitted_at":"2026-05-19T13:58:24Z","title":"Structured Layout Priors for Robust Out-of-Distribution Visual Document Understanding","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-20T05:48:34.771799Z"},"links":{"cited_paper":"/paper/2506.11156","citing_paper":"/paper/2605.19866"},"observation_digest":"sha256:e9b95371b5d0d2b01591de07b9ddc1c45c713c5254ce7ba172887cfed5f5179b","observation_id":"264e1d50-a59c-4524-ae2e-bd687ca6b29d","resolution":{"observed_at":"2026-05-20T05:53:05.110294Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.11156/citation-record","integrity":"/paper/2506.11156/integrity","json":"/paper/2506.11156/citation-record.json","paper":"/paper/2506.11156"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:41:41.223076Z","title":"For scanned documents, techniques like binarization and skew correction are utilized to enhance text clarity and improve OCR accuracy","venue":null,"work_id":"22c99eb6-f5ce-48c1-9689-88a4717f51a7","year":null},"citing_paper":{"arxiv_id":"2506.11156","last_updated":"2025-06-11T16:03:01Z","snapshot_observed_at":"2026-08-16T19:09:09.390220Z","submitted_at":"2025-06-11T16:03:01Z","title":"Digitization of Document and Information Extraction using OCR","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T04:41:40.831643Z"},"links":{"citing_paper":"/paper/2506.11156"},"observation_digest":"sha256:a3e1d223ad4e5b54603ae7648e0e4ec2c9e2cdef6e1485c4cc2ef4f913c86cf0","observation_id":"c281e1c3-ebe1-404f-95e9-5fb7a604c69b","resolution":{"observed_at":"2026-08-07T04:41:41.227123Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:41:41.210755Z","title":"● python-docx: Utilized for retrieving text and formatting details from DOCX documents","venue":null,"work_id":"e643b925-a8ce-4196-9ee1-f3b306b47fee","year":null},"citing_paper":{"arxiv_id":"2506.11156","last_updated":"2025-06-11T16:03:01Z","snapshot_observed_at":"2026-08-16T19:09:09.390220Z","submitted_at":"2025-06-11T16:03:01Z","title":"Digitization of Document and Information Extraction using OCR","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T04:41:40.836605Z"},"links":{"citing_paper":"/paper/2506.11156"},"observation_digest":"sha256:15f66c6a271aea7e8e32ab5dd793fa75a18816885149d63453b020486edf4ec4","observation_id":"80849641-0fac-464d-91cb-3b02280b3edd","resolution":{"observed_at":"2026-08-07T04:41:41.214883Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:41:41.198528Z","title":"● Maintained Structural Metadata: Internal components such as paragraphs, headings, and tables improve segmentation and contextual understanding","venue":null,"work_id":"7a7e6e81-fbd6-44bc-9e3a-84cb620a10d7","year":null},"citing_paper":{"arxiv_id":"2506.11156","last_updated":"2025-06-11T16:03:01Z","snapshot_observed_at":"2026-08-16T19:09:09.390220Z","submitted_at":"2025-06-11T16:03:01Z","title":"Digitization of Document and Information Extraction using OCR","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T04:41:40.840781Z"},"links":{"citing_paper":"/paper/2506.11156"},"observation_digest":"sha256:82fda980091030e455f26da1368975c5d6ab086e8e1a7d365fc709f4e14613b4","observation_id":"6d984e35-cf1c-4337-b47e-ec8a45245ef2","resolution":{"observed_at":"2026-08-07T04:41:41.202671Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:41:41.185634Z","title":"Extending TrOCR for Text Localization-Free OCR of Full-Page Scanned Receipt Images,","venue":null,"work_id":"67c96508-85e5-4287-9f61-4485ab1fa1d1","year":2023},"citing_paper":{"arxiv_id":"2506.11156","last_updated":"2025-06-11T16:03:01Z","snapshot_observed_at":"2026-08-16T19:09:09.390220Z","submitted_at":"2025-06-11T16:03:01Z","title":"Digitization of Document and Information Extraction using OCR","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T04:41:40.845242Z"},"links":{"citing_paper":"/paper/2506.11156"},"observation_digest":"sha256:c169a320d38e2992c6b43685852aef0c7afb8977fedc3e5bf3c63a7e716873aa","observation_id":"e3da482c-5b3e-4c6c-9cc9-f4f90b8c06cb","resolution":{"observed_at":"2026-08-07T04:41:41.189673Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:41:41.173827Z","title":"A Deep Learning Based Optical Character Recognition Model for Old Turkic,","venue":null,"work_id":"977e56cb-6ed0-4fa3-a36f-3d0e2a1b1cb1","year":2025},"citing_paper":{"arxiv_id":"2506.11156","last_updated":"2025-06-11T16:03:01Z","snapshot_observed_at":"2026-08-16T19:09:09.390220Z","submitted_at":"2025-06-11T16:03:01Z","title":"Digitization of Document and Information Extraction using OCR","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T04:41:40.849375Z"},"links":{"citing_paper":"/paper/2506.11156"},"observation_digest":"sha256:ce8cd3aacecbe7362bd2aaa11c2a19e936d30614144acca4c431e3fe6c5ee60d","observation_id":"c12a3421-735b-4dde-80c4-63a5ef73bd7a","resolution":{"observed_at":"2026-08-07T04:41:41.177480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:41:41.161815Z","title":"Image Text Extraction and Natural Language Processing of Unstructured Data from Medical Reports,","venue":null,"work_id":"f9443236-7068-4290-b435-3f1ec251dafe","year":2024},"citing_paper":{"arxiv_id":"2506.11156","last_updated":"2025-06-11T16:03:01Z","snapshot_observed_at":"2026-08-16T19:09:09.390220Z","submitted_at":"2025-06-11T16:03:01Z","title":"Digitization of Document and Information Extraction using OCR","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T04:41:40.853477Z"},"links":{"citing_paper":"/paper/2506.11156"},"observation_digest":"sha256:2290cd4726b8fffdeb096044141b19d97fc66a75c24f5727a9a5877078fbfe11","observation_id":"2897f759-c764-45fb-961d-aae826c89caa","resolution":{"observed_at":"2026-08-07T04:41:41.165801Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04245","last_updated":"2023-07-09T18:51:17Z","snapshot_observed_at":"2026-08-16T15:17:37.052530Z","submitted_at":"2023-07-09T18:51:17Z","title":"A Novel Pipeline for Improving Optical Character Recognition through Post-processing Using Natural Language Processing","version":1},"cited_work":{"arxiv_id":"2307.04245","doi":null,"metadata_source":"pith","pith_arxiv_id":"2307.04245","snapshot_observed_at":"2026-08-07T04:41:41.023437Z","title":"A Novel Pipeline for Improving Optical Character Recognition through Post-processing Using Natural Language Processing","venue":"cs.CV","work_id":"204272d7-8808-4969-acfe-92fec4a1bfed","year":2023},"citing_paper":{"arxiv_id":"2506.11156","last_updated":"2025-06-11T16:03:01Z","snapshot_observed_at":"2026-08-16T19:09:09.390220Z","submitted_at":"2025-06-11T16:03:01Z","title":"Digitization of Document and Information Extraction using OCR","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T04:41:40.857409Z"},"links":{"cited_paper":"/paper/2307.04245","citing_paper":"/paper/2506.11156"},"observation_digest":"sha256:0fc0351bf3c9b46e410b4ac0f91ecfe20c0dc9beb3b80d82c913a36eb9ccbc33","observation_id":"43d76243-64af-40ea-85a7-ccf88349082f","resolution":{"observed_at":"2026-08-07T04:41:41.027510Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.02142","last_updated":"2023-06-03T15:56:30Z","snapshot_observed_at":"2026-08-16T15:26:53.167861Z","submitted_at":"2023-06-03T15:56:30Z","title":"TransDocAnalyser: A Framework for Offline Semi-structured Handwritten Document Analysis in the Legal Domain","version":1},"cited_work":{"arxiv_id":"2306.02142","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.02142","snapshot_observed_at":"2026-08-07T04:41:41.005877Z","title":"TransDocAnalyser: A Framework for Offline Semi-structured Handwritten Document Analysis in the Legal Domain","venue":"cs.CV","work_id":"a40ac13c-0179-4055-a7d4-babafa15f2cf","year":2023},"citing_paper":{"arxiv_id":"2506.11156","last_updated":"2025-06-11T16:03:01Z","snapshot_observed_at":"2026-08-16T19:09:09.390220Z","submitted_at":"2025-06-11T16:03:01Z","title":"Digitization of Document and Information Extraction using OCR","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T04:41:40.861557Z"},"links":{"cited_paper":"/paper/2306.02142","citing_paper":"/paper/2506.11156"},"observation_digest":"sha256:7fdda984586f0ba1a9d1c3b892f654d392be6b987848738ac1747880bfbadeb4","observation_id":"db03292f-8eb8-4106-bbe2-4a4bb31ed784","resolution":{"observed_at":"2026-08-07T04:41:41.010124Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.05396","last_updated":"2023-07-11T15:57:15Z","snapshot_observed_at":"2026-08-16T15:17:04.297524Z","submitted_at":"2023-07-11T15:57:15Z","title":"Handwritten Text Recognition Using Convolutional Neural Network","version":1},"cited_work":{"arxiv_id":"2307.05396","doi":null,"metadata_source":"pith","pith_arxiv_id":"2307.05396","snapshot_observed_at":"2026-08-07T04:41:40.986987Z","title":"Handwritten Text Recognition Using Convolutional Neural Network","venue":"cs.CV","work_id":"80843bf1-00bd-4c5d-9383-0a9cbbdd7cf8","year":2023},"citing_paper":{"arxiv_id":"2506.11156","last_updated":"2025-06-11T16:03:01Z","snapshot_observed_at":"2026-08-16T19:09:09.390220Z","submitted_at":"2025-06-11T16:03:01Z","title":"Digitization of Document and Information Extraction using OCR","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T04:41:40.865733Z"},"links":{"cited_paper":"/paper/2307.05396","citing_paper":"/paper/2506.11156"},"observation_digest":"sha256:0d98705e37532cf5ae98c34aedbbae6bc9c441664cdb85b08850ac369db5d6d7","observation_id":"bc2103d7-000a-450e-94bd-2a3b6f9c997b","resolution":{"observed_at":"2026-08-07T04:41:40.991503Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.15664","last_updated":"2022-10-06T06:50:39Z","snapshot_observed_at":"2026-08-16T17:38:06.620846Z","submitted_at":"2021-11-30T18:55:19Z","title":"OCR-free Document Understanding Transformer","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.15664","snapshot_observed_at":"2026-08-07T04:41:40.869980Z","title":"OCR-free Document Understanding Transformer,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.11156","last_updated":"2025-06-11T16:03:01Z","snapshot_observed_at":"2026-08-16T19:09:09.390220Z","submitted_at":"2025-06-11T16:03:01Z","title":"Digitization of Document and Information Extraction using OCR","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T04:41:40.869980Z"},"links":{"cited_paper":"/paper/2111.15664","citing_paper":"/paper/2506.11156"},"observation_digest":"sha256:ccb387352c03315daa969a08bc2d32c05b2a0d7a74fdfd523947455b5c992fc8","observation_id":"c3823ade-e530-46d5-a213-ca6e587460e2","resolution":{"observed_at":"2026-08-07T04:41:40.869980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:41:41.149673Z","title":"TrOCR: Transformer-based Optical Character Recognition with Pretrained Models,","venue":null,"work_id":"d0385745-31b8-4f5b-befe-f76bc13440d4","year":2023},"citing_paper":{"arxiv_id":"2506.11156","last_updated":"2025-06-11T16:03:01Z","snapshot_observed_at":"2026-08-16T19:09:09.390220Z","submitted_at":"2025-06-11T16:03:01Z","title":"Digitization of Document and Information Extraction using OCR","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T04:41:40.873957Z"},"links":{"citing_paper":"/paper/2506.11156"},"observation_digest":"sha256:b3d4f7aff999b7d79349ac567a5bc8f21535825ff88f18e2c01f108188ad314c","observation_id":"b73c1663-ac78-4bfd-bc54-e55fc141578d","resolution":{"observed_at":"2026-08-07T04:41:41.153579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:41:41.124928Z","title":"KuroNet: Pre-modern Japanese Kuzushiji Character Recognition with Deep Learning,","venue":null,"work_id":"ba3dc78d-18f8-4eea-adae-42de63c67835","year":2019},"citing_paper":{"arxiv_id":"2506.11156","last_updated":"2025-06-11T16:03:01Z","snapshot_observed_at":"2026-08-16T19:09:09.390220Z","submitted_at":"2025-06-11T16:03:01Z","title":"Digitization of Document and Information Extraction using OCR","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T04:41:40.881234Z"},"links":{"citing_paper":"/paper/2506.11156"},"observation_digest":"sha256:2eef7ca810f012aaeac82e9645225b7fbb658f57eeb69eb0780f0492191de917","observation_id":"eeece3e0-ce99-47c5-8a28-c70777ef9626","resolution":{"observed_at":"2026-08-07T04:41:41.128808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:41:41.112563Z","title":"Documentation of Old Turkic Runic Inscriptions of the Altai Mountains Using Photogrammetric Technology,","venue":null,"work_id":"2c3e73a3-eab3-4f37-a846-9e07ae807ac7","year":2017},"citing_paper":{"arxiv_id":"2506.11156","last_updated":"2025-06-11T16:03:01Z","snapshot_observed_at":"2026-08-16T19:09:09.390220Z","submitted_at":"2025-06-11T16:03:01Z","title":"Digitization of Document and Information Extraction using OCR","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T04:41:40.884965Z"},"links":{"citing_paper":"/paper/2506.11156"},"observation_digest":"sha256:9ae556954c94fb8d19957283850ea745ae7170ce6c85f27d4010848e978a1c49","observation_id":"0577096a-424f-4f63-b8ed-9f874d80d9ad","resolution":{"observed_at":"2026-08-07T04:41:41.116524Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:41:41.087064Z","title":"Historical Document Image Restoration Using Multispectral Imaging System,","venue":null,"work_id":"2923d952-dfb3-4b10-89b2-2ccc56778293","year":2022},"citing_paper":{"arxiv_id":"2506.11156","last_updated":"2025-06-11T16:03:01Z","snapshot_observed_at":"2026-08-16T19:09:09.390220Z","submitted_at":"2025-06-11T16:03:01Z","title":"Digitization of Document and Information Extraction using OCR","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T04:41:40.892046Z"},"links":{"citing_paper":"/paper/2506.11156"},"observation_digest":"sha256:d798522868706b8eeb9e2306db8da8167b5363729b756c2b7df498f2772b1294","observation_id":"c6c7cf34-f874-4093-9e3d-83168521bc47","resolution":{"observed_at":"2026-08-07T04:41:41.090874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:41:41.074189Z","title":"Deep Learning for Document Image Enhancement,","venue":null,"work_id":"7445235f-eb4d-4263-9411-d1e5633d4311","year":2019},"citing_paper":{"arxiv_id":"2506.11156","last_updated":"2025-06-11T16:03:01Z","snapshot_observed_at":"2026-08-16T19:09:09.390220Z","submitted_at":"2025-06-11T16:03:01Z","title":"Digitization of Document and Information Extraction using OCR","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T04:41:40.895701Z"},"links":{"citing_paper":"/paper/2506.11156"},"observation_digest":"sha256:cc894af6919f248e41188522368c82de53d69a7911242c72bf960d70306cc11c","observation_id":"57994a05-55c8-4fc3-b34f-52ae1645b6e1","resolution":{"observed_at":"2026-08-07T04:41:41.078089Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:41:41.061142Z","title":"Recognition of Historical Scripts Using Shallow Convolutional Neural Networks,","venue":null,"work_id":"b52b560f-b85b-4876-8048-27b6d6ce5da6","year":2021},"citing_paper":{"arxiv_id":"2506.11156","last_updated":"2025-06-11T16:03:01Z","snapshot_observed_at":"2026-08-16T19:09:09.390220Z","submitted_at":"2025-06-11T16:03:01Z","title":"Digitization of Document and Information Extraction using OCR","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T04:41:40.899326Z"},"links":{"citing_paper":"/paper/2506.11156"},"observation_digest":"sha256:13ae80803822c6b314cf87181be0fd0c6ef40ddd7afe5fd99926eae8745fb40f","observation_id":"6eb9c5b5-15b5-44c5-844a-954e58604e95","resolution":{"observed_at":"2026-08-07T04:41:41.065607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.03621","last_updated":"2026-04-17T13:03:40Z","snapshot_observed_at":"2026-07-06T21:04:24.672960Z","submitted_at":"2025-04-04T17:39:53Z","title":"PILOT: A Promptable Interleaved Layout-aware OCR Transformer","version":2},"cited_work":{"arxiv_id":"2504.03621","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.03621","snapshot_observed_at":"2026-08-07T04:41:40.950998Z","title":"PILOT: A Promptable Interleaved Layout-aware OCR Transformer","venue":"cs.CV","work_id":"5916e1e4-4322-47bc-8e0e-0e5599ed0010","year":2025},"citing_paper":{"arxiv_id":"2506.11156","last_updated":"2025-06-11T16:03:01Z","snapshot_observed_at":"2026-08-16T19:09:09.390220Z","submitted_at":"2025-06-11T16:03:01Z","title":"Digitization of Document and Information Extraction using OCR","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T04:41:40.902982Z"},"links":{"cited_paper":"/paper/2504.03621","citing_paper":"/paper/2506.11156"},"observation_digest":"sha256:68250ccb8b34edfa7012e4ed90d858e600da27e0645765b09089f8fcfe717591","observation_id":"a78178eb-af2d-44b7-8f6d-3526092c1006","resolution":{"observed_at":"2026-08-07T04:41:40.957820Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:41:41.100070Z","title":"DeepNetDevanagari: A Deep Learning Model for Devanagari Ancient Character Recognition,","venue":null,"work_id":"30ae5a8a-bdf3-4be5-a7fa-a3888a64a5e4","year":2021},"citing_paper":{"arxiv_id":"2506.11156","last_updated":"2025-06-11T16:03:01Z","snapshot_observed_at":"2026-08-16T19:09:09.390220Z","submitted_at":"2025-06-11T16:03:01Z","title":"Digitization of Document and Information Extraction using OCR","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T04:41:40.906823Z"},"links":{"citing_paper":"/paper/2506.11156"},"observation_digest":"sha256:9c577e572bbff0fec86d84d3617cf7bace5dbfc894ca7ce14d1255c226c83443","observation_id":"caee586c-29f5-415c-9038-00350925bd70","resolution":{"observed_at":"2026-08-07T04:41:41.104150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:41:41.048842Z","title":"Post-OCR Parsing: Building Simple and Robust Parser via BIO Tagging,","venue":null,"work_id":"c88c58b5-8aba-42bc-944c-3895bc5069f4","year":2019},"citing_paper":{"arxiv_id":"2506.11156","last_updated":"2025-06-11T16:03:01Z","snapshot_observed_at":"2026-08-16T19:09:09.390220Z","submitted_at":"2025-06-11T16:03:01Z","title":"Digitization of Document and Information Extraction using OCR","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T04:41:40.910271Z"},"links":{"citing_paper":"/paper/2506.11156"},"observation_digest":"sha256:35d4617f91526d010e6197e05c648626cf24d921324c012f6c73726dbdca6213","observation_id":"cef4a466-41e4-4aa3-a52a-54d2e529a34a","resolution":{"observed_at":"2026-08-07T04:41:41.052685Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:41:41.036387Z","title":"Extract Data Points from Invoices with Multi-layer Graph Attention Network and Named Entity Recognition,","venue":null,"work_id":"a3e52f2f-99d9-4e43-9a57-33c3395594f5","year":2022},"citing_paper":{"arxiv_id":"2506.11156","last_updated":"2025-06-11T16:03:01Z","snapshot_observed_at":"2026-08-16T19:09:09.390220Z","submitted_at":"2025-06-11T16:03:01Z","title":"Digitization of Document and Information Extraction using OCR","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T04:41:40.913761Z"},"links":{"citing_paper":"/paper/2506.11156"},"observation_digest":"sha256:2e7259255a528a4614ceec93debc2c03c29a93e317c9ade4d574ecc44fb1ab20","observation_id":"b8b0c408-2afa-4c63-8406-41b55733a9cd","resolution":{"observed_at":"2026-08-07T04:41:41.040409Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:41:41.137623Z","title":"A Hybrid CNN-Transformer Model for Historical Document Image Binarization,","venue":null,"work_id":"c26a8d25-bfb9-416e-a5c9-05a0760ce2a4","year":2023},"citing_paper":{"arxiv_id":"2506.11156","last_updated":"2025-06-11T16:03:01Z","snapshot_observed_at":"2026-08-16T19:09:09.390220Z","submitted_at":"2025-06-11T16:03:01Z","title":"Digitization of Document and Information Extraction using OCR","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T04:41:40.917301Z"},"links":{"citing_paper":"/paper/2506.11156"},"observation_digest":"sha256:f72edc84fc4dcde0b965148c3b9bda31d23e7ed442f38a99a4919e7dd57d5628","observation_id":"38b76331-9ef4-4889-9ca5-c9647c56c00c","resolution":{"observed_at":"2026-08-07T04:41:41.141411Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.11156","last_updated":"2025-06-11T16:03:01Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-16T19:09:09.390220Z","submitted_at":"2025-06-11T16:03:01Z","title":"Digitization of Document and Information Extraction using OCR"},"reference_resolution":{"displayed":21,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":1,"verified_exact":4,"verified_fuzzy":16},"total_outbound_references":21},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 21 of 21 outbound references and 1 inbound Pith citation observation for arXiv:2506.11156."}