{"as_of":"2026-08-16T03:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:55c96d19c58b82c020e5a3bbfe2cbb60257c6987a212dbb63383d3d4f905304d","coverage":[{"denominator":70,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":70,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T23:50:02.710448Z","state":"measured"},{"denominator":70,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":70,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.02197/citation-record","integrity":"/paper/2412.02197/integrity","json":"/paper/2412.02197/citation-record.json","paper":"/paper/2412.02197"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:02.264917Z","title":"High- erhrnet: Scale-aware representation learning for bottom-up human pose estimation,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.264917Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:be2b44cc3ec2a352592c79ec0f48310b8c99c702cf933415aa28952ac008b016","observation_id":"d4e34c95-c5c2-4214-9d18-dedf04f696f6","resolution":{"observed_at":"2026-08-11T23:50:02.264917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:03.766272Z","title":"Hrformer: High-resolution vision transformer for dense predict,","venue":null,"work_id":"591b0316-89f3-4bc3-8eb7-5f473907019a","year":2021},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.270969Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:4fc17ba79a20ccdd95eaff8aa70b0b83f7eddc947b5621023ef1b1ae07c67c88","observation_id":"f05f1240-1974-4cf9-ab1b-e397c38ea079","resolution":{"observed_at":"2026-08-11T23:50:03.771734Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:03.749768Z","title":"Lite pose: Efficient architecture design for 2d human pose estimation,","venue":null,"work_id":"771b3516-8c6a-4c0e-98f3-e99bf7724ca0","year":2022},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.279056Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:ff30522f36d59d54ff5b6497f5c622e2052192200c1800dbe8c9fec936467db0","observation_id":"02a20135-e84e-48b6-8730-5bff9bc0e0fb","resolution":{"observed_at":"2026-08-11T23:50:03.754600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:03.734578Z","title":"Tempose: A new skeleton-based transformer model designed for fine-grained motion recognition in badminton,","venue":null,"work_id":"7d674921-e511-468c-901e-c8b706585506","year":2023},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.285948Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:e6ac987643992180b407379f487178507560895930b2ba41f76578ddceceb02b","observation_id":"f57db4af-1f7c-4088-b59a-b80f132969c4","resolution":{"observed_at":"2026-08-11T23:50:03.739547Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:02.304734Z","title":"Hiformer: Hierarchical multi-scale representations using transformers for medical image segmentation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.304734Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:74e37ab9b744064755dd6b35672374f7c4d99d1f927eac6e99e502d2b8e71432","observation_id":"5f03b706-f9d3-41d2-80c0-15bcda58a414","resolution":{"observed_at":"2026-08-11T23:50:02.304734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:02.314721Z","title":"Deep high-resolution repre- sentation learning for human pose estimation,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.314721Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:1ac4121724b371e30ab9b31b684d4490927bd9b9234718ea68401c170b02cb55","observation_id":"6e676b1f-7d42-4a4f-8db4-85198cbd34a8","resolution":{"observed_at":"2026-08-11T23:50:02.314721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:02.320573Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.320573Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:2883ff156e91c781d17cae379996815cc8a76564fc4fd0cd9fc1e6789018ee13","observation_id":"4fc4d1d0-e95b-4390-af13-03b97360d40b","resolution":{"observed_at":"2026-08-11T23:50:02.320573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:03.687011Z","title":"Sg-former: Self-guided transformer with evolving token reallocation,","venue":null,"work_id":"9fd1032c-f05d-4d2c-b40f-4720d01d4ed1","year":2023},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.325399Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:4c598805d32dd88eb618179ef1801283a58fbbbf4c0e426709d58ce17e15aa02","observation_id":"99823c61-5dbd-4b81-b905-7aeaf5f80594","resolution":{"observed_at":"2026-08-11T23:50:03.692571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:03.670175Z","title":"Efficientvit: Memory efficient vision transformer with cascaded group attention,","venue":null,"work_id":"1735e190-0e66-4207-97f5-20af159f3c29","year":2023},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.330421Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:28279a2b5878dd838f054ea0869425541a85562bd955f98a4708b4866f432011","observation_id":"116c4406-e640-4be0-9840-bdc0fb56b0d9","resolution":{"observed_at":"2026-08-11T23:50:03.675288Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:02.338752Z","title":"Crossvit: Cross-attention multi- scale vision transformer for image classification,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.338752Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:f1c3895efcd41c85876f895065c95858d145e0ca3eca084c99e1899835f26ead","observation_id":"ded43b40-0428-4edf-838c-80f23b127bdd","resolution":{"observed_at":"2026-08-11T23:50:02.338752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:03.643700Z","title":"Few-shot object detection with fully cross-transformer,","venue":null,"work_id":"c9273663-a08f-4cbe-a131-f1078690d73e","year":2022},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.344023Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:496181067c3a8d7a6d5befb8650c9d103deaf2218387be60ec4fb3ec4a03c185","observation_id":"333918da-ac2b-4746-a0a4-4eef2d03b3a2","resolution":{"observed_at":"2026-08-11T23:50:03.648244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:03.629041Z","title":"Topformer: Token pyramid transformer for mobile semantic segmentation,","venue":null,"work_id":"08b8e8b7-38b4-4748-bc34-778feba3e09f","year":2022},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.350434Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:062910df86a94bac2b795eeb13efd707fab7a84bd79bd16c328a41181ebedac1","observation_id":"7aeb8b03-9f1c-4403-9e87-7c4490173e1f","resolution":{"observed_at":"2026-08-11T23:50:03.633543Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:03.611489Z","title":"P2t: Pyramid pooling transformer for scene understanding,","venue":null,"work_id":"b523c313-7b0b-491a-8d8b-3476f56d5310","year":2022},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.356129Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:a8fd91db79bf941a282b68c81d5be1c34020430a8514ed2b3e7f01237deb8047","observation_id":"2c7281bc-e865-44df-b09f-d5ba852a6f3c","resolution":{"observed_at":"2026-08-11T23:50:03.616309Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:02.360826Z","title":"Shunted self-attention via multi-scale token aggregation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.360826Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:18f712331e6e13ca8899cf809a77cb3fe35718c5ca9de057f08cc21b83bdb641","observation_id":"52a26bbb-a47b-4e9a-bab1-c0980fa49f24","resolution":{"observed_at":"2026-08-11T23:50:02.360826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:02.365839Z","title":"Pyramid vision transformer: A versatile backbone for dense prediction without convolutions,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.365839Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:387b1a14f740e9a4fcc539e85e4af8a4d30737f05645d506a3dba7a3b7509ade","observation_id":"f00c7eb1-dcc9-43d8-b774-c8d335dfcc0d","resolution":{"observed_at":"2026-08-11T23:50:02.365839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:03.573979Z","title":"Scale-aware modula- tion meet transformer,","venue":null,"work_id":"77ff8f77-caf2-4e05-9ec6-332e438a2ef5","year":2023},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.370732Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:d6e39163f24501294fdafe089b6c47a83280bb5bac4cd3f3c80250f023755952","observation_id":"62d61b90-4cb8-4840-98e5-87b93e06264c","resolution":{"observed_at":"2026-08-11T23:50:03.579503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:03.555460Z","title":"Sbcformer: Lightweight network capable of full-size imagenet classification at 1 fps on single board computers,","venue":null,"work_id":"08386aa8-0e3b-4374-bc3f-72275ec9aedf","year":2024},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.377987Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:b8d871c82c0bb6d8b5029b24190d9c94f893e1ee6d9935d9dd135ad7e4947764","observation_id":"9e791be2-237c-439d-bedd-b283e764f2ff","resolution":{"observed_at":"2026-08-11T23:50:03.560595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:03.539271Z","title":"Task-driven super resolu- tion: Object detection in low-resolution images,","venue":null,"work_id":"6a4de24a-b0e4-4730-8abb-ba2a61f48be8","year":2021},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.390726Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:8c70f232f9f9e64a556c398995fef4f778b47e67d6ab1558ae846f80e820e76e","observation_id":"a5be51c4-2d5b-4abe-a675-caf5d3c22730","resolution":{"observed_at":"2026-08-11T23:50:03.543854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:03.524890Z","title":"Derivenet for (very) low resolution image classification,","venue":null,"work_id":"d1f03bad-0d8e-43a8-b6b4-9aaed000ba6d","year":2021},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.395187Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:3b08062b9836eee855cf9e2389f8570704e1fe4b0b065b006c3a7428e4abd897","observation_id":"9bdc5457-1ffe-4b64-b22c-22f7fbbf8a8d","resolution":{"observed_at":"2026-08-11T23:50:03.528926Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:03.511092Z","title":"Image super-resolution with non-local sparse attention,","venue":null,"work_id":"cd0a7110-f838-462f-be71-a664928081d0","year":2021},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.401518Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:1763c209fa195b04fb8087162932a7254e3ebf13fcabe5ba3c7fe20866287b9f","observation_id":"22eed04d-5ad4-4645-a364-61eb3201fb40","resolution":{"observed_at":"2026-08-11T23:50:03.515470Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:03.496413Z","title":"Low-resolution human pose estimation,","venue":null,"work_id":"2dca5f28-a73e-4080-985b-74119ed2f42f","year":2022},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.406260Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:2722573b7502f8c9b9b9929454553e767ba75229b60dd268fa154a4454da0139","observation_id":"90f3d0fa-b389-4a15-b933-b931ad2e2b5a","resolution":{"observed_at":"2026-08-11T23:50:03.501150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:02.421979Z","title":"Feature map distillation of thin nets for low-resolution object recognition,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.421979Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:30c58a0da609c90c63d5f0c5e5bca443ff3674ecb3987a493d0f4e0d4ac86304","observation_id":"d9a048ec-fb12-42c1-9625-8b9b19e8c16f","resolution":{"observed_at":"2026-08-11T23:50:02.421979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:03.471193Z","title":"Transformer for single image super-resolution,","venue":null,"work_id":"a3602342-5567-4d4e-b1bf-7e686ae115c6","year":2022},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.432688Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:c9c6f3b71ce5224562d030ecd95c054a2705c3dc572deb4583f4b3b02ec876d2","observation_id":"674cae0e-4619-44b7-8e18-d1bd8dd50f8c","resolution":{"observed_at":"2026-08-11T23:50:03.475659Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:02.439120Z","title":"Essaformer: Efficient transformer for hyperspectral image super- resolution,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.439120Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:35e27e991175cc36e16f99a22d42e72c6804ac50dbf0e28e63afa0ed9699dc9f","observation_id":"05a805f0-af10-4a5b-808e-3a1177e97e21","resolution":{"observed_at":"2026-08-11T23:50:02.439120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:03.446678Z","title":"Steformer: Efficient stereo image super- resolution with transformer,","venue":null,"work_id":"9e993579-e5b2-4a03-9ace-88ed607e6163","year":2023},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.446018Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:3bc74c9414770f2ae0b82d7295588e45118671ca3f24ba477c64853474ef5bf3","observation_id":"b0168ad9-9a09-46a7-b2ec-f1574688b0b8","resolution":{"observed_at":"2026-08-11T23:50:03.451288Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:03.432813Z","title":"An image is worth 16x16 words: Trans- formers for image recognition at scale,","venue":null,"work_id":"17e71757-9990-4cd6-8768-2f4211495555","year":2021},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.450188Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:5394af77d5db34794cc2edc59a8e6f5a6ec95fecffe7acec3b19b1846d53e152","observation_id":"41d60586-7b91-4826-8596-c058cd811d58","resolution":{"observed_at":"2026-08-11T23:50:03.437144Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:02.457761Z","title":"Cswin transformer: A general vision transformer backbone with cross-shaped windows,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.457761Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:57370e0ef06bfe422f11096f6980457c9dd14fc0396671911a3b46f416b73219","observation_id":"7ddb1580-2615-4625-a987-b36302932562","resolution":{"observed_at":"2026-08-11T23:50:02.457761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:03.407755Z","title":"Neighborhood attention transformer,","venue":null,"work_id":"a46d865a-c944-45a0-a2f6-d0ce254794d6","year":2023},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.462047Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:5f166160e9287038526111b776ee593f26cafd38ed37ce3d2e6b5f9e648f2500","observation_id":"f678b933-2780-487b-88fc-62f9ef5a671a","resolution":{"observed_at":"2026-08-11T23:50:03.412138Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:03.385832Z","title":"Vision transformer with quad- rangle attention,","venue":null,"work_id":"b59cc225-5dda-49dd-a9d3-38683351d05f","year":2024},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.466678Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:3b60dea33becd4f094760564db4a5278b37b66f63cae2380a213ebcabfd9be8e","observation_id":"399839dd-3d68-4bd5-a963-a3f0b1a95fa6","resolution":{"observed_at":"2026-08-11T23:50:03.397126Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:03.367970Z","title":"Mobilevit: Light-weight, general-purpose, and mobile-friendly vision transformer,","venue":null,"work_id":"8e0215e5-6e60-4102-a659-d47a919e7441","year":2022},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.472426Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:ebe334c5c5e0b163b234a5818434ef1fc509a10106f1ec582f2796c2f46b95f6","observation_id":"a326f272-319f-4ae0-800d-cde0a5885c5d","resolution":{"observed_at":"2026-08-11T23:50:03.373476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08059","last_updated":"2023-09-04T12:47:28Z","snapshot_observed_at":"2026-08-13T13:20:35.474239Z","submitted_at":"2022-12-15T18:59:12Z","title":"Rethinking Vision Transformers for MobileNet Size and Speed","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08059","snapshot_observed_at":"2026-08-11T23:50:02.478584Z","title":"Rethinking vision transformers for mobilenet size and speed,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.478584Z"},"links":{"cited_paper":"/paper/2212.08059","citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:75d7c744b7f7e196a2cc87c805bf555a3de9d963a6de98dd988a876bb37523ec","observation_id":"920b8e25-02cf-47b3-9266-13d5f65bb66f","resolution":{"observed_at":"2026-08-11T23:50:02.478584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.01146","last_updated":"2023-08-14T08:54:43Z","snapshot_observed_at":"2026-08-13T13:10:21.732638Z","submitted_at":"2023-01-03T15:11:41Z","title":"Rethinking Mobile Block for Efficient Attention-based Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.01146","snapshot_observed_at":"2026-08-11T23:50:02.483817Z","title":"Rethinking mobile block for efficient neural models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.483817Z"},"links":{"cited_paper":"/paper/2301.01146","citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:4a615cce10594317a6c4e50915a73fe02de9ea5ec0883d534c323588d17db622","observation_id":"2b03565e-de20-4670-ab48-4afcfb4b8a1c","resolution":{"observed_at":"2026-08-11T23:50:02.483817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14189","last_updated":"2023-08-17T21:10:59Z","snapshot_observed_at":"2026-08-13T12:17:30.975465Z","submitted_at":"2023-03-24T17:58:32Z","title":"FastViT: A Fast Hybrid Vision Transformer using Structural Reparameterization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.14189","snapshot_observed_at":"2026-08-11T23:50:02.489198Z","title":"Fastvit: A fast hybrid vision transformer using structural reparameterization,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.489198Z"},"links":{"cited_paper":"/paper/2303.14189","citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:7e21cfaca444c746f55390019973a003b99f31ae795e7fe24cc83baed3596a9f","observation_id":"5b7de592-2ac9-4240-bbdc-634e3537f5f4","resolution":{"observed_at":"2026-08-11T23:50:02.489198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:02.493632Z","title":"Repvit: Revisiting mobile cnn from vit perspective,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.493632Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:797a1ac8e8284b4f8a570daf3d158babaff99ca439639d17dd28c239029c73dc","observation_id":"d60f5ae1-fa31-4320-adc3-b1b8230a13f5","resolution":{"observed_at":"2026-08-11T23:50:02.493632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:03.339432Z","title":"Hydra atten- tion: Efficient attention with many heads,","venue":null,"work_id":"76983b62-60d2-4fd4-9f9a-7c5b960eed2c","year":2022},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.501186Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:4ffdb3c6a7303fba445fd8c1814f3bdf37980743aeb4506be7d8b34a06b05879","observation_id":"84da336e-47a1-4094-bc0e-a533e7cd9665","resolution":{"observed_at":"2026-08-11T23:50:03.344162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:03.323560Z","title":"The principle of diversity: Training stronger vision transformers calls for reducing all levels of redundancy,","venue":null,"work_id":"b26ac7bf-d1e2-4ed9-a176-c9b2f809d584","year":2022},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.509778Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:245b4fe98c3ff249896e1ed71f37c87e2ef290ab3ad0d4c6a900fcc1dfdcb931","observation_id":"a00236d8-38ff-45e8-838a-686d92bc912e","resolution":{"observed_at":"2026-08-11T23:50:03.328010Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:03.307891Z","title":"Levit: a vision transformer in convnet’s clothing for faster inference,","venue":null,"work_id":"9a6e41c3-ec47-4600-813d-e40c620e0d94","year":2021},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.515379Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:eca74869a4e162ea53f63e75a895e3dd0ed3065435c9d2808e6adfad62f138f8","observation_id":"5e126892-c06d-49b9-891a-c3fe1ebcc9dd","resolution":{"observed_at":"2026-08-11T23:50:03.312628Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:02.519595Z","title":"Pvt v2: Improved baselines with pyramid vision transformer,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.519595Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:17751612318e63bd74b38bf43de8a855c6b9f6e2254c2932dd5c5ecde2feec99","observation_id":"925d0235-9254-44e4-9aee-936f802f13ba","resolution":{"observed_at":"2026-08-11T23:50:02.519595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:02.527001Z","title":"Cmt: Convolutional neural networks meet vision transformers,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.527001Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:1f33120e3a5c4009ed6b63af2689a01bb1f6b8425778ab880ed43a33977d0920","observation_id":"a85bac8b-ed73-4ea6-8240-9435546dcb03","resolution":{"observed_at":"2026-08-11T23:50:02.527001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.10882","last_updated":"2023-02-13T01:19:57Z","snapshot_observed_at":"2026-08-10T23:32:09.056322Z","submitted_at":"2021-02-22T10:29:55Z","title":"Conditional Positional Encodings for Vision Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.10882","snapshot_observed_at":"2026-08-11T23:50:02.532771Z","title":"Con- ditional positional encodings for vision transformers,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.532771Z"},"links":{"cited_paper":"/paper/2102.10882","citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:9e559dc4deea525ba6e2595621b2bd40fef33504ae52120f1a3fca9ace7dd2be","observation_id":"b386e4cd-13ee-4c80-af45-d2e5fded5d59","resolution":{"observed_at":"2026-08-11T23:50:02.532771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:03.257510Z","title":"Diverse branch block: Building a convolution as an inception-like unit,","venue":null,"work_id":"233d7a07-117a-459e-bdc7-49fc3cb3b277","year":2021},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.546139Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:961fc5ba381ec8753562f6f16a6cfe8a81f26e56e933ed3af1870f84171fe5f1","observation_id":"4822cba1-b589-4170-85a2-2cebd9474429","resolution":{"observed_at":"2026-08-11T23:50:03.262955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:03.230172Z","title":"Mobileone: An improved one millisecond mobile backbone,","venue":null,"work_id":"4bf7406d-2758-44c4-9318-9e3a8752a49e","year":2023},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.558652Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:894aa76ac253043beb3a7acefe8459ac3ef8d92f9f90c88e5451e5564d4958d3","observation_id":"460025ce-b10e-4427-b64e-928c76e4ccde","resolution":{"observed_at":"2026-08-11T23:50:03.234807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:02.576613Z","title":"Simple baselines for human pose estimation and tracking,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.576613Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:f530682933ea62a00dc39edc83f1975f5911524fc9e56d35c72d94639afbf386","observation_id":"b4f7e7df-74b2-4672-91ad-1f0cd0db6218","resolution":{"observed_at":"2026-08-11T23:50:02.576613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:03.200117Z","title":"Distribution-aware coordinate representation for human pose estimation,","venue":null,"work_id":"d745969b-0862-4a94-a981-d11fe6f55df1","year":2020},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.582510Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:ecdeec2dd434a3199776961ea5da5fe95f4ad7cf5d2d54fe4c7dcce399b4f8c4","observation_id":"0000e52f-b887-4a37-8d83-a83f149b5797","resolution":{"observed_at":"2026-08-11T23:50:03.204823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:03.184798Z","title":"The devil is in the details: Delving into unbiased data processing for human pose estimation,","venue":null,"work_id":"76c39e16-0f21-40fd-8c04-d3996c987659","year":2020},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.587505Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:59cca01d51f2a5dfc899c414fed54dd3950a296f03330c49086cbb6616045b16","observation_id":"52fc997c-a603-4d81-98b2-aaeb2c6a895f","resolution":{"observed_at":"2026-08-11T23:50:03.189313Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:02.593229Z","title":"Vitpose: Simple vision transformer baselines for human pose estimation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.593229Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:0faa9035049899b926d47c9967bcc4f73a110168d15e90718e971271a344d10c","observation_id":"f0a3c97b-27bf-418e-9f5e-f4a90619ea2c","resolution":{"observed_at":"2026-08-11T23:50:02.593229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:03.158040Z","title":"Human pose as compositional tokens,","venue":null,"work_id":"d2238560-df1b-4ac1-b788-2609d300fe9b","year":2023},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.597860Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:d71b4d7020b54c3c78b2764a6c959bfe061fbd42c79e7be2dbd8f5a12fa3dcc9","observation_id":"8592d426-fdf4-447d-bb2d-e125e8df706f","resolution":{"observed_at":"2026-08-11T23:50:03.162887Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:02.602493Z","title":"Microsoft coco: Common objects in context,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.602493Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:10cf1eb12cbedbb5e5bdfd870f594a259d309ae4083d872243e18298d73c5d35","observation_id":"4c8990d9-08a3-4ab9-8b5f-b9edc4ef30b6","resolution":{"observed_at":"2026-08-11T23:50:02.602493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:03.130263Z","title":"Training data-efficient image transformers & distillation through attention,","venue":null,"work_id":"8c66ec8c-3f59-4eb4-971c-6892a52a37fe","year":2021},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.607601Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:d0609a09b196f453616b018352dec28288d88bd66921ae88942dab86c05bf133","observation_id":"c25f6ef2-26c1-4ac5-bcea-cca814886d61","resolution":{"observed_at":"2026-08-11T23:50:03.135763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:03.114827Z","title":"Decoupled weight decay regularization,","venue":null,"work_id":"202c45da-a7da-44ed-8e2f-90a636cb79bb","year":2019},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.612501Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:0d8dbf230b8f5cc31bf81a96d28cbf945ec6bde6818e3138721af0b3f6f8eaa5","observation_id":"ed5a885c-7ef1-4e3a-ae85-f21c8c3c0c09","resolution":{"observed_at":"2026-08-11T23:50:03.119294Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:03.099259Z","title":"Face alignment across large poses: A 3d solution,","venue":null,"work_id":"faeefde5-cb54-4783-b14a-fcd25ff15e5c","year":2016},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.616620Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:4e3d9f9b94c9baa0a7db1e2c20e039e84c0dd2215a2e29a79cfb3892e4ad01f3","observation_id":"0ec06288-4d66-4803-bb5e-924e450f6c55","resolution":{"observed_at":"2026-08-11T23:50:03.104048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:03.081560Z","title":"Random forests for real time 3d face analysis,","venue":null,"work_id":"c59eb2ec-2a95-4d40-9e92-93bfce2ca2d9","year":2013},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.621512Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:88308f94c160ed271fd45de4d1ecb8a4225ea48fdaff5808d408a2b086f3f1fd","observation_id":"8ede41d2-e327-414f-af8b-703f00ca17a2","resolution":{"observed_at":"2026-08-11T23:50:03.086779Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:03.066177Z","title":"Fine-grained head pose estimation without keypoints,","venue":null,"work_id":"6f938556-ecaf-46f8-8c62-10e8dd27aed3","year":2018},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.625679Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:8a41f9135e1fbce11b881c1555833bd97b7be7d0e28ee92baed30b35322bb8c9","observation_id":"63c55ea2-9bb7-430b-b1b0-319528d3eddd","resolution":{"observed_at":"2026-08-11T23:50:03.070784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:03.050692Z","title":"Fsa-net: Learning fine-grained structure aggregation for head pose estimation from a single image,","venue":null,"work_id":"02998e40-28c1-4ea7-ad5d-fd5510bcd15b","year":2019},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.633614Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:cf17db2d912810f38c72ee1ca46b9de55d52132509411d691c3829e612ce9825","observation_id":"83c6bc86-a4db-4063-8a24-588de7b1bd84","resolution":{"observed_at":"2026-08-11T23:50:03.055685Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:02.639745Z","title":"Imagenet: A large-scale hierarchical image database,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.639745Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:f7a902ecd0538770349cf8e8a6ace902256488b034202188b8177dc68dd9984e","observation_id":"3a2f0abf-f422-4e98-8f60-9e2a1fe89e18","resolution":{"observed_at":"2026-08-11T23:50:02.639745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:03.026491Z","title":"Improving head pose estimation with a combined loss and bounding box margin adjustment,","venue":null,"work_id":"b1808bcb-3e67-49d1-a25d-8c25edbe7fbd","year":2019},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.643975Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:f7ab8231bcdd4e9b15bda6590a3a3592966744fa691230b3e88474a3c81db910","observation_id":"fb545052-10fd-483b-a0e1-d6e1a688f3ba","resolution":{"observed_at":"2026-08-11T23:50:03.030877Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:03.012902Z","title":"Whenet: Real-time fine-grained estimation for wide range head pose,","venue":null,"work_id":"7568da59-5d29-4603-b47e-19434151a4ff","year":2020},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.647967Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:d64b1c3a8b6fc3e3f03eb68a43d4c6b38bf4ab3748db954e862e1d4319b8732b","observation_id":"88f0e53b-f7be-492c-9e8b-2db7e7945837","resolution":{"observed_at":"2026-08-11T23:50:03.017254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:02.997100Z","title":"Tokenhpe: Learning orientation tokens for efficient head pose estimation via transformers,","venue":null,"work_id":"b783100f-271a-4d2b-8ad6-2cbd3c8b838b","year":2023},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.653242Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:45f1f537161586288f5a7051e7055779fc949ec93791dff357c1460f83909eda","observation_id":"f851c8b2-5378-4f6e-8da1-1a177c773772","resolution":{"observed_at":"2026-08-11T23:50:03.002281Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:02.982376Z","title":"Fdn: Feature decoupling net- work for head pose estimation,","venue":null,"work_id":"ed25a560-326d-49fd-b401-2d309f5b5c90","year":2020},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.657499Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:ba97d56215ee92b1b4028592379ff6063ab4ba68684d199f4ac1b73ccce080fc","observation_id":"bab87137-c61d-4f2f-a3c7-286247f85918","resolution":{"observed_at":"2026-08-11T23:50:02.986726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:02.967001Z","title":"Accurate head pose estima- tion using image rectification and a lightweight convolutional neural network,","venue":null,"work_id":"ae3eae59-411e-4a00-9b31-25b24379f688","year":2022},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.663223Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:f28a5015629df61e3afe2da975607d0419b2fc2a600bcd2645dfefb827fcecfe","observation_id":"354e7600-0c10-432c-a52f-4ffd7ce5a952","resolution":{"observed_at":"2026-08-11T23:50:02.972268Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:02.952896Z","title":"Eva-gcn: Head pose estimation based on graph convolutional networks,","venue":null,"work_id":"97025018-1c3f-4e4c-b764-a36bacb639ac","year":2021},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.667877Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:9590a0a4e0db8f37f314d58c6dc47be52a240580ddeae0e4bafde1862530bf43","observation_id":"b353beb2-dda7-4d33-bd67-7e6028e68aa0","resolution":{"observed_at":"2026-08-11T23:50:02.957117Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:02.938030Z","title":"Mfdnet: Collaborative poses perception and matrix fisher distribution for head pose estimation,","venue":null,"work_id":"5eed55ba-728b-4236-b4dd-1db6c5d8b56e","year":2021},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.672555Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:01477025e33b6163715cf450fa3cd292dfc896f5fe758947880102b81022cfcc","observation_id":"4ee5dc7d-81b3-48ea-9a04-ef7b599f6c61","resolution":{"observed_at":"2026-08-11T23:50:02.942840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:02.922037Z","title":"Real-time 6dof full-range markerless head pose estimation,","venue":null,"work_id":"ec699cde-5c8e-4c9f-ab8f-c06908d0f78f","year":2024},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.677472Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:7d2deb1c6ea3cef917f0d96a340779577c395c4abdf361712febfe3cb31327c2","observation_id":"44b1e286-1ac9-4c7d-8e0a-417106b14f2e","resolution":{"observed_at":"2026-08-11T23:50:02.926619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:02.681989Z","title":"Toward robust and unconstrained full range of rotation head pose estimation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.681989Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:c65a045a01e276084cf7bb27a58e07475f54d23c25cafe17b1de10ea14c6d1ce","observation_id":"29270784-2693-40e6-ad73-fa788ae408b0","resolution":{"observed_at":"2026-08-11T23:50:02.681989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:02.896755Z","title":"A vector-based representation to enhance head pose estimation,","venue":null,"work_id":"d15588aa-522e-41df-852a-56d3b71103be","year":2021},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.686120Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:23fb8c1ca8816c1d075cc80eb3ea6eef5df7d6a3e1171c0892d80d8d2fb3f1d9","observation_id":"81eb3287-c079-462c-bd73-4d16e5ddc414","resolution":{"observed_at":"2026-08-11T23:50:02.901595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:02.877378Z","title":"2dheadpose: A simple and effective annotation method for the head pose in rgb images and its dataset,","venue":null,"work_id":"54638c4f-deeb-49d3-a2f8-406db9e7c43a","year":2023},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.690677Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:03d86f60e3ae63dcb7f5bde8dc35ec6d654f600a7dfa5b8e605486997bcb558f","observation_id":"1e460228-b367-4bc7-bc8b-a839f42771eb","resolution":{"observed_at":"2026-08-11T23:50:02.882505Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:02.695097Z","title":"Tokens-to-token vit: Training vision transformers from scratch on imagenet,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.695097Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:c34a85e45c5db8cb20d394242c70c2049c5c4c42d1c4d1220170fb2da9c7937b","observation_id":"187c3fa6-7568-4419-a191-3eadea0b0acb","resolution":{"observed_at":"2026-08-11T23:50:02.695097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:02.700828Z","title":"A convnet for the 2020s,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.700828Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:5465d3fc72a67e9067d81439d9fa158a203f77e64d8a5c188f18b42500b01cd6","observation_id":"e9f94419-6228-4186-a74f-b18772609cf1","resolution":{"observed_at":"2026-08-11T23:50:02.700828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:02.834292Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":"bc9a5927-2346-4128-b39a-5e7f767a5cbb","year":2016},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.705533Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:82d9bade717dd12b581e415454e1fb56a68fc3c5d5448a9b89f0b367f6a978fc","observation_id":"609c4498-9b6d-432e-b857-78a935785081","resolution":{"observed_at":"2026-08-11T23:50:02.839201Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:50:02.813330Z","title":"His research interests are in the field of computer vision and machine learning","venue":null,"work_id":"33dae6ef-d5a2-4916-b847-f9b566122a9b","year":1994},"citing_paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images","version":4},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-11T23:50:02.710448Z"},"links":{"citing_paper":"/paper/2412.02197"},"observation_digest":"sha256:8046c6b0d53e92a571c82eefd2f01850f1b64b49089a1cc764c716c3e06d6554","observation_id":"12f5252b-2563-46ee-82eb-c591ecadf995","resolution":{"observed_at":"2026-08-11T23:50:02.820433Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.02197","last_updated":"2026-07-13T07:11:17Z","latest_version":4,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-16T00:20:13.755113Z","submitted_at":"2024-12-03T06:23:19Z","title":"Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images"},"reference_resolution":{"displayed":70,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":24,"verified_exact":0,"verified_fuzzy":46},"total_outbound_references":70},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 70 of 70 outbound references and 0 inbound Pith citation observations for arXiv:2412.02197."}