{"as_of":"2026-08-20T13:29:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ee2ac81a99703e0f51a20960370e8737ea3b95473ebe92c6e8a310910bdde6f2","coverage":[{"denominator":55,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":55,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T14:16:31.012672Z","state":"measured"},{"denominator":55,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":55,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2411.15585/citation-record","integrity":"/paper/2411.15585/integrity","json":"/paper/2411.15585/citation-record.json","paper":"/paper/2411.15585"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:16:32.301949Z","title":"What if we only use real datasets for scene text recognition? toward scene text recognition with fewer labels","venue":null,"work_id":"4414bced-3d29-4e5c-ada8-5e41e0d3c186","year":2021},"citing_paper":{"arxiv_id":"2411.15585","last_updated":"2024-11-23T15:24:47Z","snapshot_observed_at":"2026-08-19T17:38:43.636602Z","submitted_at":"2024-11-23T15:24:47Z","title":"Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T14:16:30.634162Z"},"links":{"citing_paper":"/paper/2411.15585"},"observation_digest":"sha256:031888a302519b26247dcc6d4cbba5bff5e564b3802b33ab61bf08e17d5ecd05","observation_id":"fccc01d2-dca8-49ed-acf3-b0a722b498c4","resolution":{"observed_at":"2026-08-12T14:16:32.307097Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:16:32.284597Z","title":"Scene text recognition with permuted autoregressive sequence models","venue":null,"work_id":"09aa6987-a268-4a8a-8c4a-5ade9bab178c","year":2022},"citing_paper":{"arxiv_id":"2411.15585","last_updated":"2024-11-23T15:24:47Z","snapshot_observed_at":"2026-08-19T17:38:43.636602Z","submitted_at":"2024-11-23T15:24:47Z","title":"Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T14:16:30.641871Z"},"links":{"citing_paper":"/paper/2411.15585"},"observation_digest":"sha256:48bac2645c6aa5690f7c46729af356af8d09e109ab55624351160752ef5eba7b","observation_id":"da53949c-5758-44a6-98a4-9ca3779e9c51","resolution":{"observed_at":"2026-08-12T14:16:32.289668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:16:30.648270Z","title":"Combining labeled and unlabeled data with co-training","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2411.15585","last_updated":"2024-11-23T15:24:47Z","snapshot_observed_at":"2026-08-19T17:38:43.636602Z","submitted_at":"2024-11-23T15:24:47Z","title":"Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T14:16:30.648270Z"},"links":{"citing_paper":"/paper/2411.15585"},"observation_digest":"sha256:a47d1f23ffaf9a7049677f7f4df1839e2389f6f42491553408b27af97d006f97","observation_id":"fcbbbe8d-66ca-4b9b-a966-3291804a1572","resolution":{"observed_at":"2026-08-12T14:16:30.648270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:16:32.256156Z","title":"Big self-supervised models are strong semi-supervised learners","venue":null,"work_id":"acf2acdc-77f9-43d3-97b8-5f71979101fc","year":2020},"citing_paper":{"arxiv_id":"2411.15585","last_updated":"2024-11-23T15:24:47Z","snapshot_observed_at":"2026-08-19T17:38:43.636602Z","submitted_at":"2024-11-23T15:24:47Z","title":"Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T14:16:30.656487Z"},"links":{"citing_paper":"/paper/2411.15585"},"observation_digest":"sha256:1569f8e0d9aaab23df091fdf7d810c4fd69f3a6e711c8d2eb4094c35193700a8","observation_id":"420b2ee8-cfab-4afd-9c35-c2964e1bfb29","resolution":{"observed_at":"2026-08-12T14:16:32.262044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:16:32.233173Z","title":"Lister: Neighbor decoding for length-insensitive scene text recognition","venue":null,"work_id":"01f27399-dc6d-40df-ad3a-033dca8d5b05","year":2023},"citing_paper":{"arxiv_id":"2411.15585","last_updated":"2024-11-23T15:24:47Z","snapshot_observed_at":"2026-08-19T17:38:43.636602Z","submitted_at":"2024-11-23T15:24:47Z","title":"Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T14:16:30.664955Z"},"links":{"citing_paper":"/paper/2411.15585"},"observation_digest":"sha256:9e1dbab582ff69eae96750e0205bd3a2a18e00345141abbaa8e930d04515b74b","observation_id":"9018dbcf-4060-42c6-aeec-61f76ba69e31","resolution":{"observed_at":"2026-08-12T14:16:32.241024Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:16:32.210907Z","title":"Icdar2019 robust reading challenge on arbitrary-shaped text-rrc-art","venue":null,"work_id":"6cf40a2b-71c1-4b9c-8dd4-579946ae2a2e","year":2019},"citing_paper":{"arxiv_id":"2411.15585","last_updated":"2024-11-23T15:24:47Z","snapshot_observed_at":"2026-08-19T17:38:43.636602Z","submitted_at":"2024-11-23T15:24:47Z","title":"Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T14:16:30.673483Z"},"links":{"citing_paper":"/paper/2411.15585"},"observation_digest":"sha256:09b1189a09b0d1f2c89d2609aaedd9052ac351a1eeaa75bb0bb78808aaecbfd1","observation_id":"24264dbc-b9aa-4b1f-a314-30913334908c","resolution":{"observed_at":"2026-08-12T14:16:32.218635Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1611.06430","last_updated":"2016-11-19T21:02:14Z","snapshot_observed_at":"2026-08-19T18:39:33.032922Z","submitted_at":"2016-11-19T21:02:14Z","title":"Semi-Supervised Learning with Context-Conditional Generative Adversarial Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.06430","snapshot_observed_at":"2026-08-12T14:16:30.680237Z","title":"Semi-supervised learning with context-conditional generative adversarial networks","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.15585","last_updated":"2024-11-23T15:24:47Z","snapshot_observed_at":"2026-08-19T17:38:43.636602Z","submitted_at":"2024-11-23T15:24:47Z","title":"Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T14:16:30.680237Z"},"links":{"cited_paper":"/paper/1611.06430","citing_paper":"/paper/2411.15585"},"observation_digest":"sha256:f208cb4755a53f3fed3ccf47d61aa3682d622f7045348469aa78fec19221b9b3","observation_id":"5051a996-67d7-44fc-8f63-82a8a7b2effc","resolution":{"observed_at":"2026-08-12T14:16:30.680237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:16:32.192009Z","title":"Tri-net for semi-supervised deep learning","venue":null,"work_id":"643a551a-d9d5-47f4-b8cd-b7bddc6cf1a7","year":2014},"citing_paper":{"arxiv_id":"2411.15585","last_updated":"2024-11-23T15:24:47Z","snapshot_observed_at":"2026-08-19T17:38:43.636602Z","submitted_at":"2024-11-23T15:24:47Z","title":"Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T14:16:30.686622Z"},"links":{"citing_paper":"/paper/2411.15585"},"observation_digest":"sha256:28aa911f5f33662eac4f67a8c4e04ef6d05c2608a3ba504a39c4768ba0c9e2ce","observation_id":"e209a1b1-5d9d-4f31-8bbf-3b8d66283c13","resolution":{"observed_at":"2026-08-12T14:16:32.198082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.00159","last_updated":"2022-05-23T05:52:33Z","snapshot_observed_at":"2026-08-16T17:03:32.715150Z","submitted_at":"2022-04-30T04:37:01Z","title":"SVTR: Scene Text Recognition with a Single Visual Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.00159","snapshot_observed_at":"2026-08-12T14:16:30.692335Z","title":"Svtr: Scene text recognition with a single visual model","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.15585","last_updated":"2024-11-23T15:24:47Z","snapshot_observed_at":"2026-08-19T17:38:43.636602Z","submitted_at":"2024-11-23T15:24:47Z","title":"Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T14:16:30.692335Z"},"links":{"cited_paper":"/paper/2205.00159","citing_paper":"/paper/2411.15585"},"observation_digest":"sha256:e2a488dd809e6f73ffa0e74496204ba5cce67fac2dbd95546e59b09cedff5fc1","observation_id":"b5a86e51-3004-430d-b34f-39f3734f5fec","resolution":{"observed_at":"2026-08-12T14:16:30.692335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:16:32.165610Z","title":"Read like humans: Autonomous, bidirectional and iterative language modeling for scene text recognition","venue":null,"work_id":"200bc183-f9f6-462a-bb76-dd4a51fa2403","year":2021},"citing_paper":{"arxiv_id":"2411.15585","last_updated":"2024-11-23T15:24:47Z","snapshot_observed_at":"2026-08-19T17:38:43.636602Z","submitted_at":"2024-11-23T15:24:47Z","title":"Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T14:16:30.698347Z"},"links":{"citing_paper":"/paper/2411.15585"},"observation_digest":"sha256:4925580b9f4448d692606d13764bad6c7c7df81f887c49c93ccca6bf1ecf6141","observation_id":"1c3eeeb2-f42d-4984-962b-06bebc418b7d","resolution":{"observed_at":"2026-08-12T14:16:32.171827Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:16:32.139176Z","title":"Semi-supervised scene text recognition","venue":null,"work_id":"292dbf26-b3f3-4bdb-8d3b-58fae3819397","year":2021},"citing_paper":{"arxiv_id":"2411.15585","last_updated":"2024-11-23T15:24:47Z","snapshot_observed_at":"2026-08-19T17:38:43.636602Z","submitted_at":"2024-11-23T15:24:47Z","title":"Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T14:16:30.703275Z"},"links":{"citing_paper":"/paper/2411.15585"},"observation_digest":"sha256:b184b849cf48a7d7e5a334eeab3f2db587ce669810e9028b9eafe099aabbc665","observation_id":"adb0eab4-3913-46be-bd01-a278af346013","resolution":{"observed_at":"2026-08-12T14:16:32.147762Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:16:32.115346Z","title":"Synthetic data for text localisation in natural images","venue":null,"work_id":"b65f8e71-2140-42e6-b527-32a90fa697a5","year":2016},"citing_paper":{"arxiv_id":"2411.15585","last_updated":"2024-11-23T15:24:47Z","snapshot_observed_at":"2026-08-19T17:38:43.636602Z","submitted_at":"2024-11-23T15:24:47Z","title":"Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T14:16:30.714734Z"},"links":{"citing_paper":"/paper/2411.15585"},"observation_digest":"sha256:dca2b12951672a5b4769f763e16bc04a9a13a1f31e11d37af282d533b04dc37d","observation_id":"39f2bcdc-88bb-4061-ad43-741a477d0cef","resolution":{"observed_at":"2026-08-12T14:16:32.124173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1610.09204","last_updated":"2017-10-13T03:26:08Z","snapshot_observed_at":"2026-08-15T13:54:11.305826Z","submitted_at":"2016-10-28T13:26:55Z","title":"Judging a Book By its Cover","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1610.09204","snapshot_observed_at":"2026-08-12T14:16:30.720394Z","title":"Judging a book by its cover","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.15585","last_updated":"2024-11-23T15:24:47Z","snapshot_observed_at":"2026-08-19T17:38:43.636602Z","submitted_at":"2024-11-23T15:24:47Z","title":"Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T14:16:30.720394Z"},"links":{"cited_paper":"/paper/1610.09204","citing_paper":"/paper/2411.15585"},"observation_digest":"sha256:3cb8c1d27e654cec88b9ed99840aaf00415e371f5b4991e03fd7412a0bebfee8","observation_id":"5c5694ea-cf91-46f7-9696-f6b9cf827f8d","resolution":{"observed_at":"2026-08-12T14:16:30.720394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1406.2227","last_updated":"2014-12-09T11:22:59Z","snapshot_observed_at":"2026-08-15T07:44:04.183185Z","submitted_at":"2014-06-09T15:53:33Z","title":"Synthetic Data and Artificial Neural Networks for Natural Scene Text Recognition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1406.2227","snapshot_observed_at":"2026-08-12T14:16:30.728722Z","title":"Synthetic data and artificial neural networks for natural scene text recognition","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2411.15585","last_updated":"2024-11-23T15:24:47Z","snapshot_observed_at":"2026-08-19T17:38:43.636602Z","submitted_at":"2024-11-23T15:24:47Z","title":"Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T14:16:30.728722Z"},"links":{"cited_paper":"/paper/1406.2227","citing_paper":"/paper/2411.15585"},"observation_digest":"sha256:f3c9a29abf4213cd038ea5215a37a66aae521d55aa98970d2d753086eebf8b18","observation_id":"03a3ee34-6395-4e34-b9ca-e0e9949253fe","resolution":{"observed_at":"2026-08-12T14:16:30.728722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:16:32.093370Z","title":"Revisiting scene text recognition: A data perspective","venue":null,"work_id":"81f883a7-6985-4a0f-882e-1c370968c216","year":2023},"citing_paper":{"arxiv_id":"2411.15585","last_updated":"2024-11-23T15:24:47Z","snapshot_observed_at":"2026-08-19T17:38:43.636602Z","submitted_at":"2024-11-23T15:24:47Z","title":"Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T14:16:30.734787Z"},"links":{"citing_paper":"/paper/2411.15585"},"observation_digest":"sha256:effab8515633332c78fc17c85778d951bbb03a9e6898c323611f86414c4dc379","observation_id":"289adaaf-375c-473f-8d60-e48a87361a56","resolution":{"observed_at":"2026-08-12T14:16:32.100314Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:16:32.070884Z","title":"Icdar 2015 competition on robust reading","venue":null,"work_id":"e8d1fd53-a90a-4734-a47c-aebd01d63a56","year":2015},"citing_paper":{"arxiv_id":"2411.15585","last_updated":"2024-11-23T15:24:47Z","snapshot_observed_at":"2026-08-19T17:38:43.636602Z","submitted_at":"2024-11-23T15:24:47Z","title":"Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T14:16:30.740649Z"},"links":{"citing_paper":"/paper/2411.15585"},"observation_digest":"sha256:c12f184d51c6d63b9907c698e65eac4e02bc670c50f4b6f85c21b84b402e0ebd","observation_id":"9122b8b6-39d0-4caf-8ca0-9d47f603df8e","resolution":{"observed_at":"2026-08-12T14:16:32.076611Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:16:32.050999Z","title":"Icdar 2013 robust reading competition","venue":null,"work_id":"3e0e2ea7-c3f4-4bab-9e99-00019ef8701b","year":2013},"citing_paper":{"arxiv_id":"2411.15585","last_updated":"2024-11-23T15:24:47Z","snapshot_observed_at":"2026-08-19T17:38:43.636602Z","submitted_at":"2024-11-23T15:24:47Z","title":"Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T14:16:30.747611Z"},"links":{"citing_paper":"/paper/2411.15585"},"observation_digest":"sha256:bb7b9dcda993b80e1a83431c2697abadcf0ffc9cb85722c5105c05b89b2038c6","observation_id":"7a3670e4-c944-4441-b903-6b0d6b83edbc","resolution":{"observed_at":"2026-08-12T14:16:32.056776Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:16:30.752608Z","title":"The open images dataset v4: Unified image classification, object detection, and visual relationship detection at scale","venue":null,"work_id":null,"year":1956},"citing_paper":{"arxiv_id":"2411.15585","last_updated":"2024-11-23T15:24:47Z","snapshot_observed_at":"2026-08-19T17:38:43.636602Z","submitted_at":"2024-11-23T15:24:47Z","title":"Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T14:16:30.752608Z"},"links":{"citing_paper":"/paper/2411.15585"},"observation_digest":"sha256:643a34869237df9dee3e2d9b00bea4c8cc96236e6d95e4b0f94491ffb38cd34f","observation_id":"5f9cb87e-51f3-4e08-bf94-8b93d56c0e38","resolution":{"observed_at":"2026-08-12T14:16:30.752608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1610.02242","last_updated":"2017-03-15T14:22:41Z","snapshot_observed_at":"2026-08-14T21:36:15.005969Z","submitted_at":"2016-10-07T12:15:42Z","title":"Temporal Ensembling for Semi-Supervised Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1610.02242","snapshot_observed_at":"2026-08-12T14:16:30.761767Z","title":"Temporal ensembling for semi-supervised learning.arXiv preprint arXiv:1610.02242, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.15585","last_updated":"2024-11-23T15:24:47Z","snapshot_observed_at":"2026-08-19T17:38:43.636602Z","submitted_at":"2024-11-23T15:24:47Z","title":"Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T14:16:30.761767Z"},"links":{"cited_paper":"/paper/1610.02242","citing_paper":"/paper/2411.15585"},"observation_digest":"sha256:aed6cd90d26d4c4bde292a1c2e62c437167ce1e5913d4d6b15358bb8e4ba7e53","observation_id":"3b2126b1-f7d0-434c-b1fd-00f40a7f0dc2","resolution":{"observed_at":"2026-08-12T14:16:30.761767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:16:31.999231Z","title":"Recognizing handwritten mathematical expressions via paired dual loss attention network and printed mathematical expressions","venue":null,"work_id":"5545490f-f1ec-4ccf-a9ff-61d38aaf21f7","year":2020},"citing_paper":{"arxiv_id":"2411.15585","last_updated":"2024-11-23T15:24:47Z","snapshot_observed_at":"2026-08-19T17:38:43.636602Z","submitted_at":"2024-11-23T15:24:47Z","title":"Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T14:16:30.769069Z"},"links":{"citing_paper":"/paper/2411.15585"},"observation_digest":"sha256:2a6c014ad8459f6836626819f10d8b739030e57f4108e6779ce78026a95b2c84","observation_id":"d3c02c67-9315-4c2f-8686-26932ecd4a77","resolution":{"observed_at":"2026-08-12T14:16:32.008862Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:16:30.776541Z","title":"Pseudo-label: The simple and efficient semi-supervised learning method for deep neural networks","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2411.15585","last_updated":"2024-11-23T15:24:47Z","snapshot_observed_at":"2026-08-19T17:38:43.636602Z","submitted_at":"2024-11-23T15:24:47Z","title":"Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T14:16:30.776541Z"},"links":{"citing_paper":"/paper/2411.15585"},"observation_digest":"sha256:14ec3b0773e3106c43fe73a71ce0eb04b265dbb305a4c90b871522334c07e54a","observation_id":"c8d31820-82c9-4a85-84ec-fbaea35cdc11","resolution":{"observed_at":"2026-08-12T14:16:30.776541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:16:31.947175Z","title":"Char-net: A character-aware neural network for distorted scene text recognition","venue":null,"work_id":"d19a4ca3-1fd0-457e-9521-4334d00f1b34","year":2018},"citing_paper":{"arxiv_id":"2411.15585","last_updated":"2024-11-23T15:24:47Z","snapshot_observed_at":"2026-08-19T17:38:43.636602Z","submitted_at":"2024-11-23T15:24:47Z","title":"Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T14:16:30.787963Z"},"links":{"citing_paper":"/paper/2411.15585"},"observation_digest":"sha256:148297f3fb208d832ee963afb0261d2db2ea0a42754289f3df6b5d17db4dc90b","observation_id":"d9fd66e0-e8e5-433c-8179-3143dd8a6054","resolution":{"observed_at":"2026-08-12T14:16:31.954029Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:16:31.923792Z","title":"Moran: A multi-object rectified attention network for scene text recognition","venue":null,"work_id":"1d19ebdc-302b-4946-b0de-8d3eae96f142","year":2019},"citing_paper":{"arxiv_id":"2411.15585","last_updated":"2024-11-23T15:24:47Z","snapshot_observed_at":"2026-08-19T17:38:43.636602Z","submitted_at":"2024-11-23T15:24:47Z","title":"Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T14:16:30.794265Z"},"links":{"citing_paper":"/paper/2411.15585"},"observation_digest":"sha256:1930bf871336e26ba92eda9ddf07e3ec00897bc1f3cdf685342f76dad1845891","observation_id":"580065dd-282e-4161-a037-67e6959ff36b","resolution":{"observed_at":"2026-08-12T14:16:31.930998Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:16:31.898873Z","title":"Scene text recognition using higher order language priors","venue":null,"work_id":"eda32633-7651-4a9d-b996-3337ea6ee519","year":2012},"citing_paper":{"arxiv_id":"2411.15585","last_updated":"2024-11-23T15:24:47Z","snapshot_observed_at":"2026-08-19T17:38:43.636602Z","submitted_at":"2024-11-23T15:24:47Z","title":"Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T14:16:30.801471Z"},"links":{"citing_paper":"/paper/2411.15585"},"observation_digest":"sha256:4d45a8d8d975efb67c3ffd74291ee89e05fe42a293cfaaf2303a9b25a7eb083e","observation_id":"3f768323-78bb-46c2-8f3c-929b69736e6f","resolution":{"observed_at":"2026-08-12T14:16:31.906487Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:16:31.871087Z","title":"Multi-modal text recognition networks: Interactive enhancements between visual and semantic features","venue":null,"work_id":"28ca5298-b1f2-432b-a5b6-c7e23ea654bf","year":2022},"citing_paper":{"arxiv_id":"2411.15585","last_updated":"2024-11-23T15:24:47Z","snapshot_observed_at":"2026-08-19T17:38:43.636602Z","submitted_at":"2024-11-23T15:24:47Z","title":"Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T14:16:30.809055Z"},"links":{"citing_paper":"/paper/2411.15585"},"observation_digest":"sha256:58fb6afa9e73c3c307858f7d82bff5306ad6666edfab775d49b1590776714d58","observation_id":"7bc76b18-e46c-4815-9880-d45f7fc839a9","resolution":{"observed_at":"2026-08-12T14:16:31.880751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.01583","last_updated":"2016-10-22T01:07:38Z","snapshot_observed_at":"2026-08-14T21:54:06.816374Z","submitted_at":"2016-06-05T23:42:19Z","title":"Semi-Supervised Learning with Generative Adversarial Networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.01583","snapshot_observed_at":"2026-08-12T14:16:30.815189Z","title":"Semi-supervised learning with generative adversarial networks.arXiv preprint arXiv:1606.01583, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.15585","last_updated":"2024-11-23T15:24:47Z","snapshot_observed_at":"2026-08-19T17:38:43.636602Z","submitted_at":"2024-11-23T15:24:47Z","title":"Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T14:16:30.815189Z"},"links":{"cited_paper":"/paper/1606.01583","citing_paper":"/paper/2411.15585"},"observation_digest":"sha256:6113b96e11ea3e88603b212479be2547e98774c5dcb51d2efa222f94e95dec0d","observation_id":"eb974cdf-4cee-4abe-8a26-0bc492eebe45","resolution":{"observed_at":"2026-08-12T14:16:30.815189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:16:31.841274Z","title":"Seq-ups: Sequential uncertainty-aware pseudo- label selection for semi-supervised text recognition","venue":null,"work_id":"31443344-0875-45f9-9898-2a575009bb6b","year":2023},"citing_paper":{"arxiv_id":"2411.15585","last_updated":"2024-11-23T15:24:47Z","snapshot_observed_at":"2026-08-19T17:38:43.636602Z","submitted_at":"2024-11-23T15:24:47Z","title":"Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T14:16:30.822035Z"},"links":{"citing_paper":"/paper/2411.15585"},"observation_digest":"sha256:25044c99542cb80986e4f2974a10c7957bca52f6a1e3a9e3039790e7783ea2c0","observation_id":"ab08aa58-b6c6-45de-8920-715bfe8778cc","resolution":{"observed_at":"2026-08-12T14:16:31.849205Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:16:31.817850Z","title":"Recognizing text with perspective distortion in natural scenes","venue":null,"work_id":"1acfffe1-5274-4a73-bb04-d6ed95387095","year":2013},"citing_paper":{"arxiv_id":"2411.15585","last_updated":"2024-11-23T15:24:47Z","snapshot_observed_at":"2026-08-19T17:38:43.636602Z","submitted_at":"2024-11-23T15:24:47Z","title":"Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T14:16:30.830465Z"},"links":{"citing_paper":"/paper/2411.15585"},"observation_digest":"sha256:4b8a5465a65e7a0927b4132564cb87e3df31b1bbfd985f5650cb730b2c35151b","observation_id":"40526807-527d-400b-beb1-97ac31834305","resolution":{"observed_at":"2026-08-12T14:16:31.826699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:16:31.785217Z","title":"Semi- supervised learning with ladder networks","venue":null,"work_id":"3302609f-f09a-4605-a862-d87ea5ec4d73","year":2015},"citing_paper":{"arxiv_id":"2411.15585","last_updated":"2024-11-23T15:24:47Z","snapshot_observed_at":"2026-08-19T17:38:43.636602Z","submitted_at":"2024-11-23T15:24:47Z","title":"Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T14:16:30.837530Z"},"links":{"citing_paper":"/paper/2411.15585"},"observation_digest":"sha256:14b63bbada2910ebb0726d054bcd832bbd73c988407fecfe7df55f8858326cf2","observation_id":"1ab52a02-59ce-406e-9e17-864dd20fc911","resolution":{"observed_at":"2026-08-12T14:16:31.798703Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:16:31.755199Z","title":"A robust arbitrary text detection system for natural scene images","venue":null,"work_id":"c04ebb61-1b31-40fa-b80c-8a756f8e5948","year":2014},"citing_paper":{"arxiv_id":"2411.15585","last_updated":"2024-11-23T15:24:47Z","snapshot_observed_at":"2026-08-19T17:38:43.636602Z","submitted_at":"2024-11-23T15:24:47Z","title":"Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T14:16:30.842419Z"},"links":{"citing_paper":"/paper/2411.15585"},"observation_digest":"sha256:8e8b7a211a4417bda73baa07fc7924444125441470f5fea818527b8815ec1442","observation_id":"b382ad16-7919-4c1d-981f-c99ac7373f93","resolution":{"observed_at":"2026-08-12T14:16:31.768449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:16:31.728893Z","title":"Regularization with stochastic transfor- mations and perturbations for deep semi-supervised learning","venue":null,"work_id":"09f71e26-625a-42f5-865c-10504b3f486d","year":2016},"citing_paper":{"arxiv_id":"2411.15585","last_updated":"2024-11-23T15:24:47Z","snapshot_observed_at":"2026-08-19T17:38:43.636602Z","submitted_at":"2024-11-23T15:24:47Z","title":"Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T14:16:30.850562Z"},"links":{"citing_paper":"/paper/2411.15585"},"observation_digest":"sha256:3e71222fbf5e9e8d24092ca90a12d974593429a4c1c1f5bfa607fbee83283a40","observation_id":"8e3dfef6-71ac-40f0-8070-08369d7fbf2b","resolution":{"observed_at":"2026-08-12T14:16:31.734459Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:16:30.858428Z","title":"Conceptual captions: A cleaned, hypernymed, image alt-text dataset for automatic image captioning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.15585","last_updated":"2024-11-23T15:24:47Z","snapshot_observed_at":"2026-08-19T17:38:43.636602Z","submitted_at":"2024-11-23T15:24:47Z","title":"Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T14:16:30.858428Z"},"links":{"citing_paper":"/paper/2411.15585"},"observation_digest":"sha256:e46873a725e467f7f751186c877fcb0c6448fc6932a392599f66feb9dc7f6fbd","observation_id":"aba76f4e-407b-47f3-b540-b601b2888027","resolution":{"observed_at":"2026-08-12T14:16:30.858428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:16:30.867537Z","title":"An end-to-end trainable neural network for image- based sequence recognition and its application to scene text recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.15585","last_updated":"2024-11-23T15:24:47Z","snapshot_observed_at":"2026-08-19T17:38:43.636602Z","submitted_at":"2024-11-23T15:24:47Z","title":"Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T14:16:30.867537Z"},"links":{"citing_paper":"/paper/2411.15585"},"observation_digest":"sha256:72eb6c1e019ac2239d9cc7e3f826bcb85d50944a7c516063bc1dd15005978c5c","observation_id":"ea80a774-e6a6-493f-83ac-a3fd1a1afc5a","resolution":{"observed_at":"2026-08-12T14:16:30.867537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:16:30.874930Z","title":"Aster: An attentional scene text recognizer with flexible rectification","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.15585","last_updated":"2024-11-23T15:24:47Z","snapshot_observed_at":"2026-08-19T17:38:43.636602Z","submitted_at":"2024-11-23T15:24:47Z","title":"Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T14:16:30.874930Z"},"links":{"citing_paper":"/paper/2411.15585"},"observation_digest":"sha256:1cf389a684b6d7d5fc38cd1da421ae3bc3cdfdcfee99da9adaa6479e3424aaae","observation_id":"de89ddf3-16d5-4500-8baf-e4fc182dd394","resolution":{"observed_at":"2026-08-12T14:16:30.874930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:16:30.880624Z","title":"Super-convergence: Very fast training of neural networks using large learning rates","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.15585","last_updated":"2024-11-23T15:24:47Z","snapshot_observed_at":"2026-08-19T17:38:43.636602Z","submitted_at":"2024-11-23T15:24:47Z","title":"Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T14:16:30.880624Z"},"links":{"citing_paper":"/paper/2411.15585"},"observation_digest":"sha256:891ca60f3c6145f9dbafe0edc363a7754a0714b13edd4400f11db6727400d40c","observation_id":"00d941a2-075d-4b5a-aa52-9b284623b840","resolution":{"observed_at":"2026-08-12T14:16:30.880624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1511.06390","last_updated":"2016-04-30T21:23:46Z","snapshot_observed_at":"2026-08-14T22:22:08.693507Z","submitted_at":"2015-11-19T21:26:58Z","title":"Unsupervised and Semi-supervised Learning with Categorical Generative Adversarial Networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.06390","snapshot_observed_at":"2026-08-12T14:16:30.888422Z","title":"Unsupervised and semi-supervised learning with categorical genera- tive adversarial networks","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2411.15585","last_updated":"2024-11-23T15:24:47Z","snapshot_observed_at":"2026-08-19T17:38:43.636602Z","submitted_at":"2024-11-23T15:24:47Z","title":"Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T14:16:30.888422Z"},"links":{"cited_paper":"/paper/1511.06390","citing_paper":"/paper/2411.15585"},"observation_digest":"sha256:61f0ea8e11a5c1bf7388e6dc8bfd2aa2673221eb0aa1a7da41986883bca8c8da","observation_id":"ec2bdcfa-72ca-44f7-9c3b-1a84f2913d10","resolution":{"observed_at":"2026-08-12T14:16:30.888422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:16:31.641940Z","title":"Mean teachers are better role models: Weight-averaged con- sistency targets improve semi-supervised deep learning results","venue":null,"work_id":"a5721bf7-c35e-4880-a51c-9b4b65baba7b","year":2017},"citing_paper":{"arxiv_id":"2411.15585","last_updated":"2024-11-23T15:24:47Z","snapshot_observed_at":"2026-08-19T17:38:43.636602Z","submitted_at":"2024-11-23T15:24:47Z","title":"Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T14:16:30.894605Z"},"links":{"citing_paper":"/paper/2411.15585"},"observation_digest":"sha256:06e57ef4894fd447c102cfb836ec805911b20a69a7d7c1c29895c3d14636351e","observation_id":"42fe004a-24b5-4252-8b36-6b77aa7f182a","resolution":{"observed_at":"2026-08-12T14:16:31.648218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:16:30.900326Z","title":"Visualizing data using t-sne","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2411.15585","last_updated":"2024-11-23T15:24:47Z","snapshot_observed_at":"2026-08-19T17:38:43.636602Z","submitted_at":"2024-11-23T15:24:47Z","title":"Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T14:16:30.900326Z"},"links":{"citing_paper":"/paper/2411.15585"},"observation_digest":"sha256:020e5d714699f3762a2afa9d09c11097ce7b15b08842a0d02b8bc7d29e78823e","observation_id":"24dcccc3-b59d-40d0-aff4-3b29ae24ff34","resolution":{"observed_at":"2026-08-12T14:16:30.900326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1601.07140","last_updated":"2016-06-19T23:52:14Z","snapshot_observed_at":"2026-08-14T22:13:00.450823Z","submitted_at":"2016-01-26T19:30:34Z","title":"COCO-Text: Dataset and Benchmark for Text Detection and Recognition in Natural Images","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1601.07140","snapshot_observed_at":"2026-08-12T14:16:30.908160Z","title":"Coco-text: Dataset and benchmark for text detection and recognition in natural images","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.15585","last_updated":"2024-11-23T15:24:47Z","snapshot_observed_at":"2026-08-19T17:38:43.636602Z","submitted_at":"2024-11-23T15:24:47Z","title":"Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T14:16:30.908160Z"},"links":{"cited_paper":"/paper/1601.07140","citing_paper":"/paper/2411.15585"},"observation_digest":"sha256:902adcead203f0a740f8d8ed626413e249fbc1672e3799d4a8f447db3c973e45","observation_id":"88308840-1f1f-4090-80c4-fec1998d93d4","resolution":{"observed_at":"2026-08-12T14:16:30.908160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:16:31.612454Z","title":"End-to-end scene text recognition","venue":null,"work_id":"82c62b87-fda1-43e2-8a31-71acb8f9473e","year":2011},"citing_paper":{"arxiv_id":"2411.15585","last_updated":"2024-11-23T15:24:47Z","snapshot_observed_at":"2026-08-19T17:38:43.636602Z","submitted_at":"2024-11-23T15:24:47Z","title":"Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T14:16:30.915125Z"},"links":{"citing_paper":"/paper/2411.15585"},"observation_digest":"sha256:99fdb72bd0b22f77264ae901f0afca3c7641ea16304f2d3210ed77329811030b","observation_id":"107c885d-f140-48a8-ac18-459d4e4940d4","resolution":{"observed_at":"2026-08-12T14:16:31.618449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:16:31.591882Z","title":"Multi-granularity prediction for scene text recognition","venue":null,"work_id":"b294d649-f3ac-4fe2-b51a-e8f18c742a21","year":2022},"citing_paper":{"arxiv_id":"2411.15585","last_updated":"2024-11-23T15:24:47Z","snapshot_observed_at":"2026-08-19T17:38:43.636602Z","submitted_at":"2024-11-23T15:24:47Z","title":"Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T14:16:30.920415Z"},"links":{"citing_paper":"/paper/2411.15585"},"observation_digest":"sha256:617862ff55823cc0455779cbdb4b8055a9ae2d688d57222f73114a567447d2ac","observation_id":"71153dda-56d2-405f-a2c0-c979a1324905","resolution":{"observed_at":"2026-08-12T14:16:31.598065Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:16:31.573428Z","title":"From two to one: A new scene text recognizer with visual language modeling network","venue":null,"work_id":"5522b259-5c83-4446-b93d-7df23b263d1b","year":2021},"citing_paper":{"arxiv_id":"2411.15585","last_updated":"2024-11-23T15:24:47Z","snapshot_observed_at":"2026-08-19T17:38:43.636602Z","submitted_at":"2024-11-23T15:24:47Z","title":"Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T14:16:30.929874Z"},"links":{"citing_paper":"/paper/2411.15585"},"observation_digest":"sha256:bff99505c37bf5a7b7f8451c4a91eccea92de06a20c0f747c963153212ce5db7","observation_id":"37de2d4d-0a50-4591-b7cc-20eebedcbd83","resolution":{"observed_at":"2026-08-12T14:16:31.580013Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:16:31.548107Z","title":"Symmetrical linguistic feature distillation with clip for scene text recognition","venue":null,"work_id":"f1552278-e74f-400b-9b73-dfd73ca44703","year":2023},"citing_paper":{"arxiv_id":"2411.15585","last_updated":"2024-11-23T15:24:47Z","snapshot_observed_at":"2026-08-19T17:38:43.636602Z","submitted_at":"2024-11-23T15:24:47Z","title":"Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T14:16:30.935638Z"},"links":{"citing_paper":"/paper/2411.15585"},"observation_digest":"sha256:6027e492067bb8459a29edd3693967c11fb1ce5bf9d1a318ac269d47aa1222ed","observation_id":"733e4728-d5b9-446c-aa8c-088882bc4959","resolution":{"observed_at":"2026-08-12T14:16:31.556565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:16:31.523837Z","title":"Handwritten mathematical expression recognition via paired adversarial learning","venue":null,"work_id":"e3132aac-6740-4feb-9c36-4cd83f838798","year":2020},"citing_paper":{"arxiv_id":"2411.15585","last_updated":"2024-11-23T15:24:47Z","snapshot_observed_at":"2026-08-19T17:38:43.636602Z","submitted_at":"2024-11-23T15:24:47Z","title":"Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T14:16:30.942207Z"},"links":{"citing_paper":"/paper/2411.15585"},"observation_digest":"sha256:05a59cb8bf38607dafc254b37e0117d252b53e4410b6b4ee4b9c27511ea3fa7e","observation_id":"846057d7-be9b-44f9-86d1-2d99869c314a","resolution":{"observed_at":"2026-08-12T14:16:31.530507Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:16:31.504210Z","title":"Toward understanding wordart: Corner-guided transformer for scene text recognition","venue":null,"work_id":"efbbbc0e-3ee4-4ad8-98a7-88b8a67311df","year":2022},"citing_paper":{"arxiv_id":"2411.15585","last_updated":"2024-11-23T15:24:47Z","snapshot_observed_at":"2026-08-19T17:38:43.636602Z","submitted_at":"2024-11-23T15:24:47Z","title":"Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T14:16:30.947224Z"},"links":{"citing_paper":"/paper/2411.15585"},"observation_digest":"sha256:395bd15f340810a94274548e2a9cb74cefe85f998084fb48365b58c958c87826","observation_id":"54302737-4a04-454d-b17b-23e179efb1cd","resolution":{"observed_at":"2026-08-12T14:16:31.512214Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:16:31.481291Z","title":"Symmetry-constrained rectification network for scene text recognition","venue":null,"work_id":"6106b6e7-e0b0-4092-9b64-4914e584be59","year":2019},"citing_paper":{"arxiv_id":"2411.15585","last_updated":"2024-11-23T15:24:47Z","snapshot_observed_at":"2026-08-19T17:38:43.636602Z","submitted_at":"2024-11-23T15:24:47Z","title":"Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T14:16:30.952541Z"},"links":{"citing_paper":"/paper/2411.15585"},"observation_digest":"sha256:9653c83d24ec3217e75a2f50550ab2a96b540493a2389593c8d82c10e37c5efc","observation_id":"9cb304ba-e0fd-4748-af68-22bfa00301c4","resolution":{"observed_at":"2026-08-12T14:16:31.487938Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:16:31.461578Z","title":"Sequential visual and semantic consistency for semi-supervised text recognition","venue":null,"work_id":"00ddbc86-8b0e-4d2d-8b37-b706d3e4b186","year":2024},"citing_paper":{"arxiv_id":"2411.15585","last_updated":"2024-11-23T15:24:47Z","snapshot_observed_at":"2026-08-19T17:38:43.636602Z","submitted_at":"2024-11-23T15:24:47Z","title":"Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T14:16:30.958762Z"},"links":{"citing_paper":"/paper/2411.15585"},"observation_digest":"sha256:fe2a2c23781b48f0d4fd54269716cba4eee3ff4437845148a653335f8bd4ff7f","observation_id":"0d6ce672-0ef8-4f69-aa00-2d9f1877808e","resolution":{"observed_at":"2026-08-12T14:16:31.468213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:16:31.432592Z","title":"A survey on deep semi-supervised learning","venue":null,"work_id":"86fb9fb8-2146-4e92-823a-32ef343134d7","year":2022},"citing_paper":{"arxiv_id":"2411.15585","last_updated":"2024-11-23T15:24:47Z","snapshot_observed_at":"2026-08-19T17:38:43.636602Z","submitted_at":"2024-11-23T15:24:47Z","title":"Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T14:16:30.967542Z"},"links":{"citing_paper":"/paper/2411.15585"},"observation_digest":"sha256:17f8e70888ff7e6a28077bf22864ecb0e7d954c866a3007527255801e879f53a","observation_id":"7fd869e3-904c-4b7c-b073-30100c3d7e4d","resolution":{"observed_at":"2026-08-12T14:16:31.441701Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:16:30.973025Z","title":"Towards accurate scene text recognition with semantic reasoning networks","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.15585","last_updated":"2024-11-23T15:24:47Z","snapshot_observed_at":"2026-08-19T17:38:43.636602Z","submitted_at":"2024-11-23T15:24:47Z","title":"Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T14:16:30.973025Z"},"links":{"citing_paper":"/paper/2411.15585"},"observation_digest":"sha256:06d33ce37eab97376c6a05f7c14869bc484d9d3878b5613522841cdb85f1823c","observation_id":"f637eca8-d53e-4146-a752-227c914af598","resolution":{"observed_at":"2026-08-12T14:16:30.973025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:16:31.393245Z","title":"Robustscanner: Dynamically enhancing positional clues for robust text recognition","venue":null,"work_id":"a056f748-abb4-4c55-8a6d-0d5349845721","year":2020},"citing_paper":{"arxiv_id":"2411.15585","last_updated":"2024-11-23T15:24:47Z","snapshot_observed_at":"2026-08-19T17:38:43.636602Z","submitted_at":"2024-11-23T15:24:47Z","title":"Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T14:16:30.979036Z"},"links":{"citing_paper":"/paper/2411.15585"},"observation_digest":"sha256:47f55e28e6cc7a0ba71434dafc424e2939ecb021590ac9cb4210d62b0ca0f473","observation_id":"8d052a87-8afa-4d2e-aaa7-348ab55554da","resolution":{"observed_at":"2026-08-12T14:16:31.400331Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:16:31.368398Z","title":"Esir: End-to-end scene text recognition via iterative image rectification","venue":null,"work_id":"c09804f7-d766-4867-af4d-6e78145e1801","year":2019},"citing_paper":{"arxiv_id":"2411.15585","last_updated":"2024-11-23T15:24:47Z","snapshot_observed_at":"2026-08-19T17:38:43.636602Z","submitted_at":"2024-11-23T15:24:47Z","title":"Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T14:16:30.986038Z"},"links":{"citing_paper":"/paper/2411.15585"},"observation_digest":"sha256:517cdf42d4c7f03b789ae77a366ac2db89cbf8b12a52e34b1f638e537fe833b4","observation_id":"d79dfd95-d262-4cdb-8271-b533d84c27fb","resolution":{"observed_at":"2026-08-12T14:16:31.377514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.05140","last_updated":"2023-05-10T12:55:57Z","snapshot_observed_at":"2026-08-16T15:34:36.462040Z","submitted_at":"2023-05-09T02:52:47Z","title":"Linguistic More: Taking a Further Step toward Efficient and Accurate Scene Text Recognition","version":2},"cited_work":{"arxiv_id":"2305.05140","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.05140","snapshot_observed_at":"2026-08-12T14:16:31.098143Z","title":"Linguistic More: Taking a Further Step toward Efficient and Accurate Scene Text Recognition","venue":"cs.CV","work_id":"85f1a60d-a0f5-4674-b52f-a2f976df60de","year":2023},"citing_paper":{"arxiv_id":"2411.15585","last_updated":"2024-11-23T15:24:47Z","snapshot_observed_at":"2026-08-19T17:38:43.636602Z","submitted_at":"2024-11-23T15:24:47Z","title":"Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-12T14:16:30.993057Z"},"links":{"cited_paper":"/paper/2305.05140","citing_paper":"/paper/2411.15585"},"observation_digest":"sha256:a146f28dc5d84a8fc07b66930f31512ee360d3e530075e1cbd36028a0d3b1cfa","observation_id":"034a4b66-ce80-490e-ae92-0d93d9b38ec1","resolution":{"observed_at":"2026-08-12T14:16:31.106649Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:16:31.340570Z","title":"Uber- text: A large-scale dataset for optical character recognition from street-level imagery","venue":null,"work_id":"4b0bac9d-31ad-46eb-85f9-6f23a103b438","year":2017},"citing_paper":{"arxiv_id":"2411.15585","last_updated":"2024-11-23T15:24:47Z","snapshot_observed_at":"2026-08-19T17:38:43.636602Z","submitted_at":"2024-11-23T15:24:47Z","title":"Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-12T14:16:30.999292Z"},"links":{"citing_paper":"/paper/2411.15585"},"observation_digest":"sha256:a2bfa679260886185536aa2bb6228380674adc904f7153fab883c9116c9a6969","observation_id":"7cb40c26-028a-4404-9ae8-d9422f9e7133","resolution":{"observed_at":"2026-08-12T14:16:31.347034Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:16:31.315471Z","title":"Pushing the performance limit of scene text recognizer without human annotation","venue":null,"work_id":"a983697c-6f19-49c4-9a7f-c8ac6b3bce48","year":2022},"citing_paper":{"arxiv_id":"2411.15585","last_updated":"2024-11-23T15:24:47Z","snapshot_observed_at":"2026-08-19T17:38:43.636602Z","submitted_at":"2024-11-23T15:24:47Z","title":"Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-12T14:16:31.005686Z"},"links":{"citing_paper":"/paper/2411.15585"},"observation_digest":"sha256:47213329b3d54004fba0681708c64c3e2fa9a7d7ea9847c5fd02ee4eca65f01e","observation_id":"3985beaf-ff34-4c3c-8bf9-74be9633cd0c","resolution":{"observed_at":"2026-08-12T14:16:31.322484Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.05322","last_updated":"2023-05-09T10:16:43Z","snapshot_observed_at":"2026-08-18T13:01:48.810106Z","submitted_at":"2023-05-09T10:16:43Z","title":"TPS++: Attention-Enhanced Thin-Plate Spline for Scene Text Recognition","version":1},"cited_work":{"arxiv_id":"2305.05322","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.05322","snapshot_observed_at":"2026-08-12T14:16:31.064324Z","title":"TPS++: Attention-Enhanced Thin-Plate Spline for Scene Text Recognition","venue":"cs.CV","work_id":"70b92ff1-5f9f-45d5-917c-57c19e4e9975","year":2023},"citing_paper":{"arxiv_id":"2411.15585","last_updated":"2024-11-23T15:24:47Z","snapshot_observed_at":"2026-08-19T17:38:43.636602Z","submitted_at":"2024-11-23T15:24:47Z","title":"Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-12T14:16:31.012672Z"},"links":{"cited_paper":"/paper/2305.05322","citing_paper":"/paper/2411.15585"},"observation_digest":"sha256:d675ecba5b16dcf6095d0b53e1c4067fe3489ec8c7af382b63f2384721a0f601","observation_id":"aa199e46-5e21-427e-9a33-207111af1b73","resolution":{"observed_at":"2026-08-12T14:16:31.073853Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.15585","last_updated":"2024-11-23T15:24:47Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-19T17:38:43.636602Z","submitted_at":"2024-11-23T15:24:47Z","title":"Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing"},"reference_resolution":{"displayed":55,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":17,"verified_exact":2,"verified_fuzzy":36},"total_outbound_references":55},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 55 of 55 outbound references and 0 inbound Pith citation observations for arXiv:2411.15585."}