{"as_of":"2026-08-12T06:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f35f22055f7b37c5cfb7765d768b87b68eecd0828d191e2b00addd767d455f88","coverage":[{"denominator":50,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":50,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T05:56:41.253021Z","state":"measured"},{"denominator":51,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":51,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T05:56:41.122138Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T05:56:41.345995Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-08T09:50:24.385644Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"cited_work":{"arxiv_id":"2508.01153","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.01153","snapshot_observed_at":"2026-08-06T05:56:41.345995Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","venue":"cs.CV","work_id":"f79e593e-e94d-4de9-ac25-375bb97b90e7","year":2025},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-08T09:50:24.385644Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.122138Z"},"links":{"cited_paper":"/paper/2508.01153","citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:74b8a4a29b0e7f1a4d6173a0ceb2e4c0a5b2c001c23a92d4e999828aa5b9c905","observation_id":"cd745181-dfb5-40a2-8335-77cf557c5fac","resolution":{"observed_at":"2026-08-06T05:56:41.349208Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2508.01153/citation-record","integrity":"/paper/2508.01153/integrity","json":"/paper/2508.01153/citation-record.json","paper":"/paper/2508.01153"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-08T09:50:24.385644Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"cited_work":{"arxiv_id":"2508.01153","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.01153","snapshot_observed_at":"2026-08-06T05:56:41.345995Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","venue":"cs.CV","work_id":"f79e593e-e94d-4de9-ac25-375bb97b90e7","year":2025},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-08T09:50:24.385644Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.122138Z"},"links":{"cited_paper":"/paper/2508.01153","citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:74b8a4a29b0e7f1a4d6173a0ceb2e4c0a5b2c001c23a92d4e999828aa5b9c905","observation_id":"cd745181-dfb5-40a2-8335-77cf557c5fac","resolution":{"observed_at":"2026-08-06T05:56:41.349208Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.699002Z","title":"TYPO” as “TYPE","venue":null,"work_id":"9bd6f6b1-140d-4165-b33e-8834945d275d","year":null},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-08T09:50:24.385644Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.125795Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:6bef70517d593fc5bc6e644edf8723b47ccfb06faab9ebcd8567f7ff7585dc6c","observation_id":"d5ce172f-2b91-4a28-846e-7af377334295","resolution":{"observed_at":"2026-08-06T05:56:41.701912Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.691239Z","title":"This simulates a curriculum-style learn- ing process where the model first relies on explicit textual supervision, then gradually learns to infer based purely on visual cues","venue":null,"work_id":"4b57ac17-7801-4515-a68f-aef80a1a63bd","year":null},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-08T09:50:24.385644Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.128679Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:40ee8d7708d6c6f07b3f3cd94f1f120fd412695ea1351bd335b950b8590537cc","observation_id":"292fc4eb-4f49-4ae3-bbcc-c8d1e576976a","resolution":{"observed_at":"2026-08-06T05:56:41.694116Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.683534Z","title":"Experiments Setup Following standard practice in scene text recognition (STR) [19, 5], we adopt both synthetic and real-world datasets for train- ing and evaluation","venue":null,"work_id":"ab876917-1071-41b8-9a75-911e33ffc021","year":2013},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-08T09:50:24.385644Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.131786Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:3e6217127fd0a552772d184965aba824fb8bf8ff9ca5c4d0f388a6eb1458285f","observation_id":"8a7af6e6-22a6-469f-accc-429d0d8a9773","resolution":{"observed_at":"2026-08-06T05:56:41.686345Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.675045Z","title":"TEACH injects ground-truth labels into the input sequence during training and gradually masks them based on model performance","venue":null,"work_id":"4fc26fc1-60ae-4cbe-b21c-b0464938ca5e","year":null},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-08T09:50:24.385644Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.135049Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:b9108bbc1c2f9c6c38a2ac03ece2aefbb24ad7e2a15cef6a9bc711068f2e9a2c","observation_id":"49f8ccb7-9ed8-477f-a8d1-e70d36a6ab48","resolution":{"observed_at":"2026-08-06T05:56:41.678182Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.666640Z","title":"An end-to- end trainable neural network for image-based sequence recognition and its application to scene text recogni- tion,","venue":null,"work_id":"10c3e8d8-197e-4634-a5b4-3c8f07cc5269","year":2016},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-08T09:50:24.385644Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.137774Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:f4af2c5bb7f4a5e25ebc0526c2824ea5d5daf18d1f561907c856c92f5a2c7e2e","observation_id":"866dd3d2-5787-4b5c-94be-dc8ed44be43b","resolution":{"observed_at":"2026-08-06T05:56:41.669688Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.659099Z","title":"Attention is all you need,","venue":null,"work_id":"d56318e1-8bc4-4516-81d1-20e20eddc219","year":2017},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-08T09:50:24.385644Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.140817Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:14d6bdc7d4759e384776af9c3918f03a077c00f3a1c0e57a0f518e4d89cfbcdb","observation_id":"b4aad906-99d0-4465-9341-a0c11395ad8d","resolution":{"observed_at":"2026-08-06T05:56:41.661681Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-10T01:12:16.468283Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-06T05:56:41.143738Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-08T09:50:24.385644Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.143738Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:6e93015aebfba002838d892b5aadac572937ce55d60dceb065b5cecc1b6019b0","observation_id":"83c17716-e2f0-4d0a-a5a2-3fd9c2036dc6","resolution":{"observed_at":"2026-08-06T05:56:41.143738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.651193Z","title":"Vision transformer for fast and effi- cient scene text recognition,","venue":null,"work_id":"2a4ffe95-c195-4d32-8b2f-45f994bcc026","year":2021},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-08T09:50:24.385644Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.147094Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:ca75a88ee8679e5b4afee3aec5aeee66431dcd39c4744471c490fd4a7d5e0e62","observation_id":"fb62505b-2a96-4900-9acb-5ef88da518c9","resolution":{"observed_at":"2026-08-06T05:56:41.654116Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.643497Z","title":"Scene text recog- nition with permuted autoregressive sequence models,","venue":null,"work_id":"d9d3bbd6-9c24-481c-87c5-e23ae7f932d8","year":2022},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-08T09:50:24.385644Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.149952Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:2137237add096a3c3c4a9de753d29a48758a06b7317d6da4ef620f2055b0e209","observation_id":"db7db82c-b011-416c-b564-f9983409e74d","resolution":{"observed_at":"2026-08-06T05:56:41.646306Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.636071Z","title":"Trocr: Transformer-based optical character recognition with pre-trained models,","venue":null,"work_id":"eae0bf0c-529a-4f87-ac50-b46999fab93b","year":2023},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-08T09:50:24.385644Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.152545Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:06744a5661a985aaec7c49a38beb575f3f0dc71565aab0997eeea7b1f0cf9b18","observation_id":"6ea76566-e1ee-493b-a4f5-b1498ce49c1a","resolution":{"observed_at":"2026-08-06T05:56:41.638911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.628054Z","title":"Read like humans: Au- tonomous, bidirectional and iterative language model- ing for scene text recognition,","venue":null,"work_id":"d73ab52b-1970-4288-baa9-c06934f3b22b","year":2021},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-08T09:50:24.385644Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.155151Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:ba3437a98376848948f1c401c5c674018912a5fe40426fd6e083ec3417adeedf","observation_id":"7433f445-219d-41f7-8bd5-d6efdcf2a863","resolution":{"observed_at":"2026-08-06T05:56:41.631076Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.619983Z","title":"Dtrocr: Decoder-only transformer for optical character recognition,","venue":null,"work_id":"e08cb3c5-e662-4276-837a-d29bb031d5ee","year":2024},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-08T09:50:24.385644Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.157562Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:bd5203db915ebbdffa2f74c1d4b65e4cbda3a2a43d6bc594022a5cdff787969e","observation_id":"8b79305c-6450-41ec-894c-444f578b2aeb","resolution":{"observed_at":"2026-08-06T05:56:41.622744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14014","last_updated":"2024-12-24T04:27:37Z","snapshot_observed_at":"2026-07-06T15:31:23.076745Z","submitted_at":"2023-05-23T12:51:20Z","title":"CLIP4STR: A Simple Baseline for Scene Text Recognition with Pre-trained Vision-Language Model","version":4},"cited_work":{"arxiv_id":"2305.14014","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.14014","snapshot_observed_at":"2026-08-06T05:56:41.326008Z","title":"CLIP4STR: A Simple Baseline for Scene Text Recognition with Pre-trained Vision-Language Model","venue":"cs.CV","work_id":"bed28817-269f-4a10-a04e-61032793aa13","year":2023},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-08T09:50:24.385644Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.159898Z"},"links":{"cited_paper":"/paper/2305.14014","citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:b492f95faffa002cb14b6a317337e287d737a7f26c08167f74f8805c23c2715a","observation_id":"3cfee4c0-c6bb-4305-b7ef-1bc7fcb16e67","resolution":{"observed_at":"2026-08-06T05:56:41.329345Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.612253Z","title":"Curriculum learning,","venue":null,"work_id":"e61f826e-d0d5-4c2d-acb8-e4824c2a24ab","year":2009},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-08T09:50:24.385644Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.162636Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:bc21dfcc16fb19eaa55c89763db6cd2c68b37831f483e9455a161daf5c102df7","observation_id":"431e6e46-96a5-4140-8050-cb169142a56d","resolution":{"observed_at":"2026-08-06T05:56:41.614732Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.604301Z","title":"Self-paced learning for latent variable models,","venue":null,"work_id":"d3274201-c675-4d06-81e6-d7cf1bebbca9","year":2010},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-08T09:50:24.385644Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.165243Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:574f14aca4960920ca113f9f19e3fa281ad708d5930f2a2633637264e7261a44","observation_id":"81ffe997-be6d-423e-8505-0fe86aafa02e","resolution":{"observed_at":"2026-08-06T05:56:41.607143Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.596128Z","title":"Recursive recurrent nets with attention modeling for ocr in the wild,","venue":null,"work_id":"15ca8a89-7e80-41f8-aea0-55d17cfdecdf","year":2016},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-08T09:50:24.385644Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.167543Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:2c9dcdd80381d9b0554fe894c9b15b0210b0f8aaab475ab8b43a6ee3fe36ce04","observation_id":"fbb9c16b-2da1-4b16-8424-14179310d93c","resolution":{"observed_at":"2026-08-06T05:56:41.599020Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.587044Z","title":"Gcrnn: graph convolutional recurrent neural network for compound–protein interaction prediction,","venue":null,"work_id":"e4c4c094-d453-43bd-ada3-dd4c0911c9b6","year":2021},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-08T09:50:24.385644Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.169729Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:40c55317d79cc880fc3bd918f9613c1af27f831b6eab66e586d51ccf2c67b69b","observation_id":"ee5d6b56-b745-4199-a82d-8bde7d34fcaf","resolution":{"observed_at":"2026-08-06T05:56:41.590118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.578922Z","title":"Ma-crnn: a multi-scale attention crnn for chinese text line recognition in natural scenes,","venue":null,"work_id":"eed611a2-5cb0-44fe-83ae-bc91500c9574","year":2020},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-08T09:50:24.385644Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.172193Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:5b7b9c9139841ba6892cb96b3b4d6485361ac9ee24a41f09ac11952b52761164","observation_id":"36358303-1a7f-4493-bba4-367cf2d62828","resolution":{"observed_at":"2026-08-06T05:56:41.581721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.570082Z","title":"Aster: An attentional scene text recognizer with flexible rectifica- tion,","venue":null,"work_id":"7c20ae0a-7a4d-4414-b457-a112e2ed1d87","year":2018},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-08T09:50:24.385644Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.174787Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:5e1f158ace13ea6bebe4e54b3c6c7437187f80a8ea31760fb4fe97528f935423","observation_id":"2da14f76-b0d2-417c-a6be-9249e5b4ca54","resolution":{"observed_at":"2026-08-06T05:56:41.573680Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.561575Z","title":"Towards accu- rate scene text recognition with semantic reasoning net- works,","venue":null,"work_id":"d8172385-43b5-4305-a787-8547350618ca","year":2020},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-08T09:50:24.385644Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.177284Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:b10a433bf4d64b396d6bec230497bb123e70498aae488f7678f28bb1418689fd","observation_id":"5128fea0-45dd-4636-b7d8-93699b6b3827","resolution":{"observed_at":"2026-08-06T05:56:41.564840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.552517Z","title":"Textscanner: Reading characters in or- der for robust scene text recognition,","venue":null,"work_id":"39d2a8ea-2a82-4377-885c-1e04e90ccdc9","year":2020},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-08T09:50:24.385644Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.179740Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:b15299bb630d6a999dad999e660dc53cfc419dd22b59e28160c695e0305d75c7","observation_id":"c7f95006-80e0-44af-8676-9c3deb29e4ca","resolution":{"observed_at":"2026-08-06T05:56:41.555491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.543828Z","title":"Seed: Semantics enhanced encoder- decoder framework for scene text recognition,","venue":null,"work_id":"651eb458-89aa-459f-ad38-59294fb04a28","year":2020},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-08T09:50:24.385644Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.182394Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:bb0e523cf9bee229a7ad71cc1203d8fe568b25016aa47f5d8085136603793c00","observation_id":"bd670fda-50b1-4c54-93a5-84572050cc7a","resolution":{"observed_at":"2026-08-06T05:56:41.546548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.536407Z","title":"What if we only use real datasets for scene text recogni- tion? toward scene text recognition with fewer labels,","venue":null,"work_id":"727000a4-413a-4c76-8858-559e1242a9d5","year":2021},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-08T09:50:24.385644Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.184782Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:e66bd2c33ed70ab944b939d540204dfa44c1144a130e8d9de4cdc3a1e7ad95fd","observation_id":"edf2af91-4d35-4d78-8b41-3eb6b56b1239","resolution":{"observed_at":"2026-08-06T05:56:41.539027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.528727Z","title":"From two to one: A new scene text recognizer with visual language modeling network,","venue":null,"work_id":"f6200186-7236-4401-89f9-9b0828f0f0ea","year":2021},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-08T09:50:24.385644Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.187381Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:fe88085f860ab022812df63080ee6fb37286bbc62a0cdea09ac34e5fbb997a21","observation_id":"caf2e00c-982b-489e-8b25-0532e0238a77","resolution":{"observed_at":"2026-08-06T05:56:41.531493Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.520887Z","title":"Levenshtein ocr,","venue":null,"work_id":"9b972ce5-f9a0-4c8d-8e6c-66c65a062599","year":2022},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-08T09:50:24.385644Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.189910Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:44a47cf975cb5af9d52e3e83b89504594ed40ae594e659a69b66cd96e74383af","observation_id":"ebe6257d-81e9-4002-9b47-c03bff590f14","resolution":{"observed_at":"2026-08-06T05:56:41.523491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.513222Z","title":"Multi- modal text recognition networks: Interactive enhance- ments between visual and semantic features,","venue":null,"work_id":"471b6919-206d-4e06-9014-aada2c913b26","year":2022},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-08T09:50:24.385644Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.192287Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:d45419cc2384e49f4cbf8a444e2417959d9283fc5bead4e002ef0be1f56e45c0","observation_id":"d663d731-d07e-4532-b312-131a1f2373af","resolution":{"observed_at":"2026-08-06T05:56:41.515872Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.505307Z","title":"Petr: Rethinking the capability of transformer-based language model in scene text recognition,","venue":null,"work_id":"d074ea4b-745b-442c-ba52-1454d1373e2f","year":2022},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-08T09:50:24.385644Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.195041Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:357a779df08c2c725ee0dc67bd217e713e09e5bb42df906aa92a1571994aa3b6","observation_id":"b918f897-6743-4020-9daa-4513c60e2d08","resolution":{"observed_at":"2026-08-06T05:56:41.508282Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.497223Z","title":"Reading and writing: Discriminative and generative modeling for self-supervised text recognition,","venue":null,"work_id":"4f78953c-b99e-4568-a051-cfac64939a04","year":2022},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-08T09:50:24.385644Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.197536Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:29b27c895ac108d4ad6b516ee17bdf41a321b49622a02c485d0a330c9acf131b","observation_id":"785504fa-1901-4dca-a23e-b08b344036ae","resolution":{"observed_at":"2026-08-06T05:56:41.500346Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.07464","last_updated":"2023-07-23T13:51:34Z","snapshot_observed_at":"2026-08-09T16:54:49.583097Z","submitted_at":"2023-01-18T12:16:19Z","title":"CLIPTER: Looking at the Bigger Picture in Scene Text Recognition","version":2},"cited_work":{"arxiv_id":"2301.07464","doi":null,"metadata_source":"pith","pith_arxiv_id":"2301.07464","snapshot_observed_at":"2026-08-06T05:56:41.313849Z","title":"CLIPTER: Looking at the Bigger Picture in Scene Text Recognition","venue":"cs.CV","work_id":"d0f2389b-973d-4d2e-92b1-e09bbd1a6295","year":2023},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-08T09:50:24.385644Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.200024Z"},"links":{"cited_paper":"/paper/2301.07464","citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:c4f555f20d9dff69cdc003e32d7570d6905981c824e34a6bb2b8aba111c419d6","observation_id":"5d0664c4-a4ab-48fa-bfe5-9bbe4c58565b","resolution":{"observed_at":"2026-08-06T05:56:41.317059Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.488932Z","title":"Revisiting scene text recognition: A data perspective,","venue":null,"work_id":"af5fa58f-8ff4-48cf-962d-8b84f19eb40f","year":2023},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-08T09:50:24.385644Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.203143Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:a56c0aa0f89488dccd8748149a05c5cdadab202a2259367de669e8df0399bb95","observation_id":"22151698-419a-49b1-a4c8-3489ab67a936","resolution":{"observed_at":"2026-08-06T05:56:41.491965Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1406.2227","last_updated":"2014-12-09T11:22:59Z","snapshot_observed_at":"2026-07-06T03:45:51.255195Z","submitted_at":"2014-06-09T15:53:33Z","title":"Synthetic Data and Artificial Neural Networks for Natural Scene Text Recognition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1406.2227","snapshot_observed_at":"2026-08-06T05:56:41.205591Z","title":"Synthetic data and artificial neu- ral networks for natural scene text recognition,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-08T09:50:24.385644Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.205591Z"},"links":{"cited_paper":"/paper/1406.2227","citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:c65cdd61ffddee4e56c385e59e55c73bfaa52cdf310579f23fd19e2450eca25a","observation_id":"7cba1d46-04f0-406c-a7fc-3cd932d476dc","resolution":{"observed_at":"2026-08-06T05:56:41.205591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.480999Z","title":"Synthetic data for text localisation in natural images,","venue":null,"work_id":"ca973190-b15f-4c72-83a5-fdc51243637b","year":2016},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-08T09:50:24.385644Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.208568Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:c88705eaf720be323c2cee58edd77a0d3ab54ee2e020fadd85e707c641bce28b","observation_id":"d32f5683-f545-42a2-8e2c-1b69978c25e6","resolution":{"observed_at":"2026-08-06T05:56:41.483864Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1601.07140","last_updated":"2016-06-19T23:52:14Z","snapshot_observed_at":"2026-07-06T04:44:09.937735Z","submitted_at":"2016-01-26T19:30:34Z","title":"COCO-Text: Dataset and Benchmark for Text Detection and Recognition in Natural Images","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1601.07140","snapshot_observed_at":"2026-08-06T05:56:41.210900Z","title":"Coco-text: Dataset and benchmark for text detection and recognition in natural images,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-08T09:50:24.385644Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.210900Z"},"links":{"cited_paper":"/paper/1601.07140","citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:62b03d814fe5094d216cb6aad418242f7650709d18e52548eb9c2ebcc1a78546","observation_id":"97908528-2ae1-4860-b546-9b39ae56d97e","resolution":{"observed_at":"2026-08-06T05:56:41.210900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.472852Z","title":"Icdar2017 competition on reading chi- nese text in the wild (rctw-17),","venue":null,"work_id":"97f5cde4-cc0f-42b7-aab1-351eecdf3dcb","year":2017},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-08T09:50:24.385644Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.213632Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:8a66651a3312a5ac20fe5313f170cc72ba3176cf434552fc75d6303a1aef3b2c","observation_id":"1b790f71-7115-480f-8921-53c9787c0dfb","resolution":{"observed_at":"2026-08-06T05:56:41.475837Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.464545Z","title":"Uber-text: A large-scale dataset for optical character recognition from street-level imagery,","venue":null,"work_id":"2c0651a5-e494-4c7f-96f5-add443f30f90","year":2017},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-08T09:50:24.385644Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.216633Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:2b9fae118217246835e5e0f8b2194aea825818d9c465f0fddf7b62001c00a519","observation_id":"b0385723-bbb8-4cb9-ad3f-4ca4679b886a","resolution":{"observed_at":"2026-08-06T05:56:41.467554Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.455745Z","title":"Icdar2019 robust reading challenge on arbitrary-shaped text-rrc-art,","venue":null,"work_id":"712ba4bf-9b14-4158-a40d-0a052e1de97c","year":2019},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-08T09:50:24.385644Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.219047Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:457900c0717ffea70389ea2c120787d028712103d415b29384864fa215040254","observation_id":"63ff275e-2044-4bf5-93fa-7a27c3c2f0d5","resolution":{"observed_at":"2026-08-06T05:56:41.458562Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.447530Z","title":"Icdar 2019 competition on large-scale street view text with partial labeling-rrc-lsvt,","venue":null,"work_id":"18e2555e-1ba1-4058-843e-58869be5d82a","year":2019},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-08T09:50:24.385644Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.221487Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:9d2453b8e0f008df165746c436d5b79b64d06b0ac657805541866beafd0cb805","observation_id":"83e2dc8c-60ae-4d5a-8d65-cd9492a25d1a","resolution":{"observed_at":"2026-08-06T05:56:41.450320Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.439566Z","title":"Icdar2019 robust reading challenge on multi-lingual scene text detection and recognition—rrc- mlt-2019,","venue":null,"work_id":"ac8965db-2678-4c66-9c80-eef50c7e3cf8","year":2019},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-08T09:50:24.385644Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.224444Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:689d46769d10c572760ccd064879ff400a5ed11dd32d878b53cc9a56e2042317","observation_id":"e7dd2d8e-901f-46ee-a5bb-00f8fd99b84b","resolution":{"observed_at":"2026-08-06T05:56:41.442518Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.431960Z","title":"Icdar 2019 robust read- ing challenge on reading chinese text on signboard,","venue":null,"work_id":"4d5a01f3-73bd-4eef-80de-a4f672861bd1","year":2019},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-08T09:50:24.385644Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.226914Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:e89dbab4c3da263f77ffb2663c6f2169a1896be5ed20d17f3ed9aecb297c8c78","observation_id":"cf9aec72-ef34-4805-aa3c-ca57508164b1","resolution":{"observed_at":"2026-08-06T05:56:41.434739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.424063Z","title":"Openimages: A public dataset for large-scale multi- label and multi-class image classification,","venue":null,"work_id":"80e9ea86-0fa7-4564-bb54-6914dda2cbd0","year":2017},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-08T09:50:24.385644Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.229359Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:ccd68b568c4d832b2dcb4c1d8da1f8a939eacd6dbe57ce40c3ee03f962ca2d88","observation_id":"15cd3df4-595c-43bf-91b1-3c7866b89703","resolution":{"observed_at":"2026-08-06T05:56:41.426903Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.416080Z","title":"Textocr: Towards large-scale end-to-end reasoning for arbitrary-shaped scene text,","venue":null,"work_id":"ba93bb12-8460-433f-8925-190f3810eeac","year":2021},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-08T09:50:24.385644Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.231908Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:f617701a9b1d0fa265034994c9c5c542364bb2fa2b7858289ddbd3fb571938d3","observation_id":"7cc440e8-c9d4-42ff-96f1-5472f55ca997","resolution":{"observed_at":"2026-08-06T05:56:41.418791Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.408479Z","title":"Open images v5 text annotation and yet another mask text spotter,","venue":null,"work_id":"717fa794-9677-4659-939b-62c8019040c7","year":2021},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-08T09:50:24.385644Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.234552Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:3383cc71805389238740f1ecd72bf3eadfd5f28727f7d52c8365032c6528a1cf","observation_id":"96c5f507-eebd-4020-9e06-1d6c79ca2e61","resolution":{"observed_at":"2026-08-06T05:56:41.411123Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.400089Z","title":"Scene text recognition using higher order language priors,","venue":null,"work_id":"8b0281bb-c144-41ac-a711-bfa35af2decc","year":2012},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-08T09:50:24.385644Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.237225Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:d19b4af8829f9a8f03436ebce0c286c0f4202e9cdb2881b733508e4c395a2e1c","observation_id":"32dbf2e8-11c7-4552-9957-4ee1c3b0da16","resolution":{"observed_at":"2026-08-06T05:56:41.403041Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.391337Z","title":"End- to-end scene text recognition,","venue":null,"work_id":"d4252522-02bc-4e70-8487-88d323c15453","year":2011},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-08T09:50:24.385644Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.239841Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:126afb62cb0b622a7438ddcb1d7953df9cef976c9d55a63201ded74faf0f355a","observation_id":"34271599-3a74-4ca1-b0d0-e38aaef8d98a","resolution":{"observed_at":"2026-08-06T05:56:41.394098Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.382569Z","title":"Recognizing text with perspective distortion in natural scenes,","venue":null,"work_id":"1502c921-d5ed-4a45-b361-8c3728a92b84","year":2013},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-08T09:50:24.385644Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.242418Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:426c629c5881a6e9ceadb696ff50bcb32e98961da6525c928ac158e3eb412e7c","observation_id":"b8b59d2f-5030-456a-947a-05969c890320","resolution":{"observed_at":"2026-08-06T05:56:41.385534Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.374098Z","title":"Icdar 2013 robust reading competition,","venue":null,"work_id":"e8bfae4e-a038-4858-b6b8-3263ea0f4e3c","year":2013},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-08T09:50:24.385644Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.245113Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:0dbe106d65b92a2ab1eeef6e8b7ce8ee904884fb4e60d2c13bef35680036a78c","observation_id":"514da1c9-264d-4c22-8f87-67b867de0b27","resolution":{"observed_at":"2026-08-06T05:56:41.377265Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.364685Z","title":"Icdar 2015 competition on robust reading,","venue":null,"work_id":"9dd0091d-e42d-4f0e-8def-6a5cdd76710d","year":2015},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-08T09:50:24.385644Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.247747Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:a15467efc301f54d4873048efe84955331449e2038563a4dbf90046aadff192a","observation_id":"15b92baa-60db-4161-893f-4dc2d29fed03","resolution":{"observed_at":"2026-08-06T05:56:41.368103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.355654Z","title":"A robust arbi- trary text detection system for natural scene images,","venue":null,"work_id":"a0cd623d-7dd1-4bb1-b12b-1ff96f9a0a07","year":2014},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-08T09:50:24.385644Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.250473Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:3aa02e133456d7c868467999fb2112b1d845a96b97ca5e1cc4f865f2167fab68","observation_id":"edecc5ce-36f4-42ce-9d6d-50088b9035c7","resolution":{"observed_at":"2026-08-06T05:56:41.358734Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2003.10608","last_updated":"2020-08-18T01:06:39Z","snapshot_observed_at":"2026-08-10T22:14:28.057982Z","submitted_at":"2020-03-24T01:37:42Z","title":"UnrealText: Synthesizing Realistic Scene Text Images from the Unreal World","version":6},"cited_work":{"arxiv_id":"2003.10608","doi":null,"metadata_source":"pith","pith_arxiv_id":"2003.10608","snapshot_observed_at":"2026-08-06T05:56:41.280845Z","title":"UnrealText: Synthesizing Realistic Scene Text Images from the Unreal World","venue":"cs.CV","work_id":"d23ecee4-a401-4568-ab4e-590686559bda","year":2020},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-08T09:50:24.385644Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.253021Z"},"links":{"cited_paper":"/paper/2003.10608","citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:293a0c5c5812941c82070968587a4572123e3319a1ca030773c53cda97f00a56","observation_id":"fe543078-6c11-439e-8378-f543fd0131c0","resolution":{"observed_at":"2026-08-06T05:56:41.286196Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T09:50:24.385644Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition"},"reference_resolution":{"displayed":50,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":3,"verified_exact":3,"verified_fuzzy":43},"total_outbound_references":50},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 50 of 50 outbound references and 1 inbound Pith citation observation for arXiv:2508.01153."}