{"as_of":"2026-08-14T10:29:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:355e92f90decd8aae5093adaab6b4dc2b55903e70c301dafeaa2b8bf2d39223a","coverage":[{"denominator":26,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T13:47:10.727414Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.20188/citation-record","integrity":"/paper/2507.20188/integrity","json":"/paper/2507.20188/citation-record.json","paper":"/paper/2507.20188"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:15.474964Z","title":"In: Proc","venue":null,"work_id":"d120c49a-aa20-464d-a0ae-726005fbd5ea","year":2019},"citing_paper":{"arxiv_id":"2507.20188","last_updated":"2025-07-27T09:16:39Z","snapshot_observed_at":"2026-08-06T13:47:07.992296Z","submitted_at":"2025-07-27T09:16:39Z","title":"SAViL-Det: Semantic-Aware Vision-Language Model for Multi-Script Text Detection","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:08.537282Z"},"links":{"citing_paper":"/paper/2507.20188"},"observation_digest":"sha256:1611ad60b41ceb958bbd986ca898866241fce17c4d81859e341fb5fd083d949d","observation_id":"c57d9411-0cac-4a2a-a7bc-811f7f503239","resolution":{"observed_at":"2026-08-06T13:47:15.540113Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:15.312654Z","title":"IET Image Processing16(10), 1234–1245 (2022)","venue":null,"work_id":"d4babbde-f67e-4388-85cb-52f0190f796a","year":2022},"citing_paper":{"arxiv_id":"2507.20188","last_updated":"2025-07-27T09:16:39Z","snapshot_observed_at":"2026-08-06T13:47:07.992296Z","submitted_at":"2025-07-27T09:16:39Z","title":"SAViL-Det: Semantic-Aware Vision-Language Model for Multi-Script Text Detection","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:08.586509Z"},"links":{"citing_paper":"/paper/2507.20188"},"observation_digest":"sha256:7615b62ff81cb4c4067d1177b78754ea9abb6ca3fbe75703a3b50035e2de74d1","observation_id":"306be282-979b-4dfe-b983-c0f2106f8fe6","resolution":{"observed_at":"2026-08-06T13:47:15.370256Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:15.173070Z","title":"In: Proceedings of the AAAI Conference on Artificial Intelligence","venue":null,"work_id":"c6733dc3-391f-4d2e-92ea-8980d6e8a25a","year":2024},"citing_paper":{"arxiv_id":"2507.20188","last_updated":"2025-07-27T09:16:39Z","snapshot_observed_at":"2026-08-06T13:47:07.992296Z","submitted_at":"2025-07-27T09:16:39Z","title":"SAViL-Det: Semantic-Aware Vision-Language Model for Multi-Script Text Detection","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:08.669536Z"},"links":{"citing_paper":"/paper/2507.20188"},"observation_digest":"sha256:a34dcaa2ceda1c144ed636b09baa7ddb125e3248d61eda4e89334c3041a11b29","observation_id":"07bccdc9-4d53-47a0-9922-ae3c50f72276","resolution":{"observed_at":"2026-08-06T13:47:15.215141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1801.01315","last_updated":"2018-01-04T11:48:21Z","snapshot_observed_at":"2026-08-12T12:39:46.555243Z","submitted_at":"2018-01-04T11:48:21Z","title":"PixelLink: Detecting Scene Text via Instance Segmentation","version":1},"cited_work":{"arxiv_id":"1801.01315","doi":null,"metadata_source":"pith","pith_arxiv_id":"1801.01315","snapshot_observed_at":"2026-08-06T13:47:11.077158Z","title":"PixelLink: Detecting Scene Text via Instance Segmentation","venue":"cs.CV","work_id":"90d07cb3-b3c4-4a6c-85e4-c34c38194746","year":2018},"citing_paper":{"arxiv_id":"2507.20188","last_updated":"2025-07-27T09:16:39Z","snapshot_observed_at":"2026-08-06T13:47:07.992296Z","submitted_at":"2025-07-27T09:16:39Z","title":"SAViL-Det: Semantic-Aware Vision-Language Model for Multi-Script Text Detection","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:08.754650Z"},"links":{"cited_paper":"/paper/1801.01315","citing_paper":"/paper/2507.20188"},"observation_digest":"sha256:edf1013b68dbae2b591fe9d539505bb0f6105836097536aa04acd00633b48a2a","observation_id":"1ae43810-97ae-4dc1-ba28-62323628aec2","resolution":{"observed_at":"2026-08-06T13:47:11.159332Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:15.026328Z","title":"In: 2013 12th ICDAR","venue":null,"work_id":"08d9c474-9f00-4322-aa72-03f4cf5d18ef","year":2013},"citing_paper":{"arxiv_id":"2507.20188","last_updated":"2025-07-27T09:16:39Z","snapshot_observed_at":"2026-08-06T13:47:07.992296Z","submitted_at":"2025-07-27T09:16:39Z","title":"SAViL-Det: Semantic-Aware Vision-Language Model for Multi-Script Text Detection","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:08.841656Z"},"links":{"citing_paper":"/paper/2507.20188"},"observation_digest":"sha256:5aa1582d71809777da5c67099b9792acd2261e32a19a122347f638d7a8023a41","observation_id":"f88bec71-f3b8-4820-87e3-cc04ef3a5a7e","resolution":{"observed_at":"2026-08-06T13:47:15.075814Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:14.886158Z","title":"https://github.com/facebookresearch/xformers (2022)","venue":null,"work_id":"46317a85-4b1c-4005-afc0-6dcf170055c3","year":2022},"citing_paper":{"arxiv_id":"2507.20188","last_updated":"2025-07-27T09:16:39Z","snapshot_observed_at":"2026-08-06T13:47:07.992296Z","submitted_at":"2025-07-27T09:16:39Z","title":"SAViL-Det: Semantic-Aware Vision-Language Model for Multi-Script Text Detection","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:08.996694Z"},"links":{"citing_paper":"/paper/2507.20188"},"observation_digest":"sha256:73914d0c751aa854cd06049a03db240758405bb4927c93fac8707f220b8342ff","observation_id":"ae291186-8e32-4257-95c2-8f5902b4b34c","resolution":{"observed_at":"2026-08-06T13:47:14.950417Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:14.733081Z","title":"TPAMI45(1), 919–931 (2022)","venue":null,"work_id":"7e91c662-0955-4a2c-b818-1639d6f73642","year":2022},"citing_paper":{"arxiv_id":"2507.20188","last_updated":"2025-07-27T09:16:39Z","snapshot_observed_at":"2026-08-06T13:47:07.992296Z","submitted_at":"2025-07-27T09:16:39Z","title":"SAViL-Det: Semantic-Aware Vision-Language Model for Multi-Script Text Detection","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:09.110028Z"},"links":{"citing_paper":"/paper/2507.20188"},"observation_digest":"sha256:b464ff8f1105692ab1339b8eb6a281932674ff8169ee891476ae3a4aa6fbd414","observation_id":"ada7d837-fed6-4256-8480-d5c99d609325","resolution":{"observed_at":"2026-08-06T13:47:14.809984Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:14.522225Z","title":"Pattern Recognition90 (2019)","venue":null,"work_id":"223dd1e8-272f-4c25-b379-9b083a24928c","year":2019},"citing_paper":{"arxiv_id":"2507.20188","last_updated":"2025-07-27T09:16:39Z","snapshot_observed_at":"2026-08-06T13:47:07.992296Z","submitted_at":"2025-07-27T09:16:39Z","title":"SAViL-Det: Semantic-Aware Vision-Language Model for Multi-Script Text Detection","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:09.245532Z"},"links":{"citing_paper":"/paper/2507.20188"},"observation_digest":"sha256:9c27cdba9acfd986d527000daf06f2ed7f4c8cddbdd58ffea6efa2f59e11f48d","observation_id":"98910794-76ac-4efc-afa5-44e20e051b25","resolution":{"observed_at":"2026-08-06T13:47:14.607434Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:14.371052Z","title":"In: ECCV","venue":null,"work_id":"ab912d49-a7dd-4db6-b951-2aa385bf685a","year":2018},"citing_paper":{"arxiv_id":"2507.20188","last_updated":"2025-07-27T09:16:39Z","snapshot_observed_at":"2026-08-06T13:47:07.992296Z","submitted_at":"2025-07-27T09:16:39Z","title":"SAViL-Det: Semantic-Aware Vision-Language Model for Multi-Script Text Detection","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:09.343565Z"},"links":{"citing_paper":"/paper/2507.20188"},"observation_digest":"sha256:efd4e2c3b99efb221668bac39983f01267f2f2e292d8971d3a799285488af38f","observation_id":"decc613e-c993-4b46-91dc-687223baa135","resolution":{"observed_at":"2026-08-06T13:47:14.431124Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:14.188126Z","title":"In: ICDAR","venue":null,"work_id":"95c7792d-72c0-445e-926e-6b3252ebdc6c","year":2019},"citing_paper":{"arxiv_id":"2507.20188","last_updated":"2025-07-27T09:16:39Z","snapshot_observed_at":"2026-08-06T13:47:07.992296Z","submitted_at":"2025-07-27T09:16:39Z","title":"SAViL-Det: Semantic-Aware Vision-Language Model for Multi-Script Text Detection","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:09.420916Z"},"links":{"citing_paper":"/paper/2507.20188"},"observation_digest":"sha256:8bece5e077146ea74fe90c161d7b6c3b5a3cecd232e7b293b14360e394fdd5e9","observation_id":"b986e709-bf03-4212-94e3-97675c8ac78a","resolution":{"observed_at":"2026-08-06T13:47:14.289538Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:14.006894Z","title":"In: ICCV (2021)","venue":null,"work_id":"25307178-4bc8-44fc-b8b8-693aa3b2fc26","year":2021},"citing_paper":{"arxiv_id":"2507.20188","last_updated":"2025-07-27T09:16:39Z","snapshot_observed_at":"2026-08-06T13:47:07.992296Z","submitted_at":"2025-07-27T09:16:39Z","title":"SAViL-Det: Semantic-Aware Vision-Language Model for Multi-Script Text Detection","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:09.516304Z"},"links":{"citing_paper":"/paper/2507.20188"},"observation_digest":"sha256:1a35edda9ae8834ef40160c8adbf89d76a4651bd89d8442eb880a47f5b66010b","observation_id":"f4275bd7-2e1c-4060-ab5a-7104ccb5578a","resolution":{"observed_at":"2026-08-06T13:47:14.072984Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:13.860722Z","title":"In: ICML 2021","venue":null,"work_id":"334e807b-fc10-46d4-837f-c08846849320","year":2021},"citing_paper":{"arxiv_id":"2507.20188","last_updated":"2025-07-27T09:16:39Z","snapshot_observed_at":"2026-08-06T13:47:07.992296Z","submitted_at":"2025-07-27T09:16:39Z","title":"SAViL-Det: Semantic-Aware Vision-Language Model for Multi-Script Text Detection","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:09.579923Z"},"links":{"citing_paper":"/paper/2507.20188"},"observation_digest":"sha256:e3a6d3fda6f2f38736e7ac80b829360d3b5d2a5ae804db19ba4549045987cc0e","observation_id":"7b9b2e63-6d1d-456b-8b0b-3e71683b5738","resolution":{"observed_at":"2026-08-06T13:47:13.931089Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.04305","last_updated":"2020-06-30T22:23:08Z","snapshot_observed_at":"2026-08-10T07:34:24.461063Z","submitted_at":"2020-06-08T01:08:04Z","title":"Text Detection and Recognition in the Wild: A Review","version":2},"cited_work":{"arxiv_id":"2006.04305","doi":null,"metadata_source":"pith","pith_arxiv_id":"2006.04305","snapshot_observed_at":"2026-08-06T13:47:10.920054Z","title":"Text Detection and Recognition in the Wild: A Review","venue":"cs.CV","work_id":"c4726d8c-414b-476c-9b7a-ebcea253ba7e","year":2020},"citing_paper":{"arxiv_id":"2507.20188","last_updated":"2025-07-27T09:16:39Z","snapshot_observed_at":"2026-08-06T13:47:07.992296Z","submitted_at":"2025-07-27T09:16:39Z","title":"SAViL-Det: Semantic-Aware Vision-Language Model for Multi-Script Text Detection","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:09.664923Z"},"links":{"cited_paper":"/paper/2006.04305","citing_paper":"/paper/2507.20188"},"observation_digest":"sha256:112d59c3fc396b3c7a8ec3568c3071cbe557172ed6f5cd455b35d4d8e70d3e1f","observation_id":"f47364d0-b4c3-452d-b0f5-8efc22c0399e","resolution":{"observed_at":"2026-08-06T13:47:10.975700Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:13.717903Z","title":"In: CVPR","venue":null,"work_id":"ea6594c1-9279-4736-9a34-e81bb60669ff","year":2022},"citing_paper":{"arxiv_id":"2507.20188","last_updated":"2025-07-27T09:16:39Z","snapshot_observed_at":"2026-08-06T13:47:07.992296Z","submitted_at":"2025-07-27T09:16:39Z","title":"SAViL-Det: Semantic-Aware Vision-Language Model for Multi-Script Text Detection","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:09.737879Z"},"links":{"citing_paper":"/paper/2507.20188"},"observation_digest":"sha256:d7ca0bb77309efd19708334e21f4129f650681c99168d1fe21f188f36fa58cc9","observation_id":"e58c4d3c-25c2-4b50-bb4d-30291eba0fff","resolution":{"observed_at":"2026-08-06T13:47:13.784811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:13.595958Z","title":"In: CVPR","venue":null,"work_id":"967a5c82-69b1-474b-9752-573bc9722d7d","year":2019},"citing_paper":{"arxiv_id":"2507.20188","last_updated":"2025-07-27T09:16:39Z","snapshot_observed_at":"2026-08-06T13:47:07.992296Z","submitted_at":"2025-07-27T09:16:39Z","title":"SAViL-Det: Semantic-Aware Vision-Language Model for Multi-Script Text Detection","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:09.819805Z"},"links":{"citing_paper":"/paper/2507.20188"},"observation_digest":"sha256:778b80dfbc9ec1b64be25c8bbff9380da7ceb4b9b6b8f029830c42bc2a739c08","observation_id":"ecc96fa7-9beb-47ad-879d-ff6c6b6f78de","resolution":{"observed_at":"2026-08-06T13:47:13.626990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:13.430354Z","title":"In: CVPR","venue":null,"work_id":"6b9cf38a-e92d-4aac-a95a-1c089cd967f6","year":2019},"citing_paper":{"arxiv_id":"2507.20188","last_updated":"2025-07-27T09:16:39Z","snapshot_observed_at":"2026-08-06T13:47:07.992296Z","submitted_at":"2025-07-27T09:16:39Z","title":"SAViL-Det: Semantic-Aware Vision-Language Model for Multi-Script Text Detection","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:09.870888Z"},"links":{"citing_paper":"/paper/2507.20188"},"observation_digest":"sha256:f3c8a509268b0e48fa769fe7fbaab9536a84f790e638b42d45df15b1698e75b5","observation_id":"6ac3739b-1c17-41a8-9784-cde8bd878605","resolution":{"observed_at":"2026-08-06T13:47:13.508790Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:13.200191Z","title":"In: European Conference on Computer Vision","venue":null,"work_id":"e2c773c6-98be-4b88-abf1-1ad1e87d0497","year":2022},"citing_paper":{"arxiv_id":"2507.20188","last_updated":"2025-07-27T09:16:39Z","snapshot_observed_at":"2026-08-06T13:47:07.992296Z","submitted_at":"2025-07-27T09:16:39Z","title":"SAViL-Det: Semantic-Aware Vision-Language Model for Multi-Script Text Detection","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:09.971766Z"},"links":{"citing_paper":"/paper/2507.20188"},"observation_digest":"sha256:72d48d5c264e0255ce46cdb569580b2d9fcdb0e509bb9d4ba9be9e429ab8dfe1","observation_id":"7353e8f9-fe1f-41bc-9b7f-8748991620bd","resolution":{"observed_at":"2026-08-06T13:47:13.328071Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:12.988150Z","title":"In: 2023 IEEE International Conference on Systems, Man, and Cybernetics (SMC)","venue":null,"work_id":"54a9bacf-5e92-470e-be24-2b84ca5c3f7c","year":2023},"citing_paper":{"arxiv_id":"2507.20188","last_updated":"2025-07-27T09:16:39Z","snapshot_observed_at":"2026-08-06T13:47:07.992296Z","submitted_at":"2025-07-27T09:16:39Z","title":"SAViL-Det: Semantic-Aware Vision-Language Model for Multi-Script Text Detection","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:10.085167Z"},"links":{"citing_paper":"/paper/2507.20188"},"observation_digest":"sha256:f01230a08276cbe88b715d1e3f314e6e8148de3d8e604d3e79d6d6d90388db86","observation_id":"d79fd054-d737-42fa-9e39-1008cd7ef223","resolution":{"observed_at":"2026-08-06T13:47:13.086408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:12.711784Z","title":"In: Proceedings of the AAAI Conference on Artificial Intelligence","venue":null,"work_id":"29366a3d-4df1-4694-87c9-226075d4cc08","year":2023},"citing_paper":{"arxiv_id":"2507.20188","last_updated":"2025-07-27T09:16:39Z","snapshot_observed_at":"2026-08-06T13:47:07.992296Z","submitted_at":"2025-07-27T09:16:39Z","title":"SAViL-Det: Semantic-Aware Vision-Language Model for Multi-Script Text Detection","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:10.164342Z"},"links":{"citing_paper":"/paper/2507.20188"},"observation_digest":"sha256:0fd04c3cf657884ed9d2db395efdd4cbae327656e99265c2162ca0464177aa9a","observation_id":"48879f16-c295-40ee-a399-27136a76c958","resolution":{"observed_at":"2026-08-06T13:47:12.831053Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:12.535227Z","title":null,"venue":null,"work_id":"193e799a-656f-4b8c-b40e-b995a018693f","year":2023},"citing_paper":{"arxiv_id":"2507.20188","last_updated":"2025-07-27T09:16:39Z","snapshot_observed_at":"2026-08-06T13:47:07.992296Z","submitted_at":"2025-07-27T09:16:39Z","title":"SAViL-Det: Semantic-Aware Vision-Language Model for Multi-Script Text Detection","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:10.241498Z"},"links":{"citing_paper":"/paper/2507.20188"},"observation_digest":"sha256:d48c6f3ef8b63ffa765df36fabb1b5d9c6a98138ab2f6b686e21369b615892eb","observation_id":"679c82f6-1755-4b80-82ea-9bb328ec5b5e","resolution":{"observed_at":"2026-08-06T13:47:12.594547Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:12.381507Z","title":"In: CVPR","venue":null,"work_id":"537541e8-3f1c-4cd1-a743-552c4b81276c","year":2023},"citing_paper":{"arxiv_id":"2507.20188","last_updated":"2025-07-27T09:16:39Z","snapshot_observed_at":"2026-08-06T13:47:07.992296Z","submitted_at":"2025-07-27T09:16:39Z","title":"SAViL-Det: Semantic-Aware Vision-Language Model for Multi-Script Text Detection","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:10.284553Z"},"links":{"citing_paper":"/paper/2507.20188"},"observation_digest":"sha256:522d99856a28bb71429594a813be08474afe35d96899e269e7e8da378e2ae010","observation_id":"e3715f1d-3c93-4e41-bfec-16f1e98d25be","resolution":{"observed_at":"2026-08-06T13:47:12.466048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12817","last_updated":"2023-08-28T01:45:09Z","snapshot_observed_at":"2026-08-14T01:50:17.214431Z","submitted_at":"2023-08-23T05:13:00Z","title":"MixNet: Toward Accurate Detection of Challenging Scene Text in the Wild","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12817","snapshot_observed_at":"2026-08-06T13:47:10.364933Z","title":"arXiv preprint arXiv:2308.12817 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.20188","last_updated":"2025-07-27T09:16:39Z","snapshot_observed_at":"2026-08-06T13:47:07.992296Z","submitted_at":"2025-07-27T09:16:39Z","title":"SAViL-Det: Semantic-Aware Vision-Language Model for Multi-Script Text Detection","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:10.364933Z"},"links":{"cited_paper":"/paper/2308.12817","citing_paper":"/paper/2507.20188"},"observation_digest":"sha256:06bfbe37c48f3d3cab3208e0bfff2f9041387d2fb13ac4df9341f51f2df83328","observation_id":"a0395102-8868-41d7-b161-4d7d0e53d2b7","resolution":{"observed_at":"2026-08-06T13:47:10.364933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:12.104087Z","title":"In: CVPR (2019)","venue":null,"work_id":"398203ca-3fb7-4ae9-9cdd-b66b5a4eb148","year":2019},"citing_paper":{"arxiv_id":"2507.20188","last_updated":"2025-07-27T09:16:39Z","snapshot_observed_at":"2026-08-06T13:47:07.992296Z","submitted_at":"2025-07-27T09:16:39Z","title":"SAViL-Det: Semantic-Aware Vision-Language Model for Multi-Script Text Detection","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:10.446923Z"},"links":{"citing_paper":"/paper/2507.20188"},"observation_digest":"sha256:faacd946a59b83d475fe031bf6a0b56c6f02c90b2a945b271bc77b022061a935","observation_id":"bd1ee3b9-5583-4c96-ae80-128b5d4cccaa","resolution":{"observed_at":"2026-08-06T13:47:12.196956Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:11.873604Z","title":"In: Proc","venue":null,"work_id":"11182bee-cbed-4d84-921b-590e1daa6944","year":2022},"citing_paper":{"arxiv_id":"2507.20188","last_updated":"2025-07-27T09:16:39Z","snapshot_observed_at":"2026-08-06T13:47:07.992296Z","submitted_at":"2025-07-27T09:16:39Z","title":"SAViL-Det: Semantic-Aware Vision-Language Model for Multi-Script Text Detection","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:10.528446Z"},"links":{"citing_paper":"/paper/2507.20188"},"observation_digest":"sha256:f8eaedb03ad36107d31344fffbbf1fce97a506a1eb56f018d3f49429788bcc3b","observation_id":"080edae3-2e6f-437d-9111-fe491de9b620","resolution":{"observed_at":"2026-08-06T13:47:11.977921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:11.526343Z","title":"In: CVPR","venue":null,"work_id":"3267f6f4-b05b-49d3-b9ac-920d8fb4edb3","year":2017},"citing_paper":{"arxiv_id":"2507.20188","last_updated":"2025-07-27T09:16:39Z","snapshot_observed_at":"2026-08-06T13:47:07.992296Z","submitted_at":"2025-07-27T09:16:39Z","title":"SAViL-Det: Semantic-Aware Vision-Language Model for Multi-Script Text Detection","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:10.626417Z"},"links":{"citing_paper":"/paper/2507.20188"},"observation_digest":"sha256:f9bc216a59439965ec30d2143fd277f72e81ff4163bd481ddced18c7838307ca","observation_id":"4886380d-ba07-4308-b306-cd360dd3550e","resolution":{"observed_at":"2026-08-06T13:47:11.669834Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:11.266954Z","title":"In: CVPR","venue":null,"work_id":"52e523d8-5bc0-4530-94d6-b5b86ebf017e","year":2021},"citing_paper":{"arxiv_id":"2507.20188","last_updated":"2025-07-27T09:16:39Z","snapshot_observed_at":"2026-08-06T13:47:07.992296Z","submitted_at":"2025-07-27T09:16:39Z","title":"SAViL-Det: Semantic-Aware Vision-Language Model for Multi-Script Text Detection","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:10.727414Z"},"links":{"citing_paper":"/paper/2507.20188"},"observation_digest":"sha256:9ea2f8bb34cf33c0517ca16966789fdbaa3f219546307feaff53020c5fb4b0fc","observation_id":"188ec16a-4f0e-433f-b013-4144cb4e4944","resolution":{"observed_at":"2026-08-06T13:47:11.396061Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.20188","last_updated":"2025-07-27T09:16:39Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T13:47:07.992296Z","submitted_at":"2025-07-27T09:16:39Z","title":"SAViL-Det: Semantic-Aware Vision-Language Model for Multi-Script Text Detection"},"reference_resolution":{"displayed":26,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":2,"verified_exact":1,"verified_fuzzy":22},"total_outbound_references":26},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 26 of 26 outbound references and 0 inbound Pith citation observations for arXiv:2507.20188."}