{"as_of":"2026-08-10T20:21:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:928be8b9b7b2df9d37224674cf0b9ee5d295182f83501505d47109497687e24d","coverage":[{"denominator":98,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":98,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T16:48:52.035624Z","state":"measured"},{"denominator":98,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":98,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.12780/citation-record","integrity":"/paper/2507.12780/integrity","json":"/paper/2507.12780/citation-record.json","paper":"/paper/2507.12780"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:39.441115Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:39.441115Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:63cdeb129393d49ee18643a5aae0943c962e7cc5ec9c8526bcde352ad6cb8066","observation_id":"142a132a-6aff-46da-a77b-6ecd42098881","resolution":{"observed_at":"2026-08-06T16:48:39.441115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:39.505580Z","title":"Du, Wei Hu, Zhiyuan Li, and Ruosong Wang","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:39.505580Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:2acdb074dc1837219d673fc820abb9e3018ed1863e742d36d2890ba32883f16a","observation_id":"6ac69ea9-e55e-44e7-abcd-c7ed9103f7d5","resolution":{"observed_at":"2026-08-06T16:48:39.505580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:39.620429Z","title":"Implicit gradient regularization","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:39.620429Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:f920ded41194a1fdda8f3236ae2e08623c4fa8388fd1f765b8f4ecae95243ab9","observation_id":"b00b76f1-a6f7-43c6-9099-6bfedb869186","resolution":{"observed_at":"2026-08-06T16:48:39.620429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:39.728431Z","title":"Bartlett, Olivier Bousquet, and Shahar Mendelson","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:39.728431Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:5f6ad9c4c70400ecc38a24322a1e1afb8433c89a15482871327dda7bf2c3e44b","observation_id":"3c0bd139-fd16-4ab1-9486-c3652213e3c2","resolution":{"observed_at":"2026-08-06T16:48:39.728431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:39.877339Z","title":"To understand deep learning we need to understand kernel learning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:39.877339Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:faec37cdb690195108f741cdddd708cd1b969346f7f7f62592a32606561688ce","observation_id":"9f1734e4-bd73-44c6-9722-b6ea0a0b4ef8","resolution":{"observed_at":"2026-08-06T16:48:39.877339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:39.995309Z","title":"Token merging: Your vit but faster","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:39.995309Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:7022ce18bc266731e4212cc31a5728c5013c9751a3108e49bb4a194937caaced","observation_id":"d879229b-53a6-400f-9083-c155bbd7951c","resolution":{"observed_at":"2026-08-06T16:48:39.995309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:40.122126Z","title":"Learned thresholds token merging and pruning for vision transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:40.122126Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:057d615d4bb14534d3ca53cdac29641664c3a0f07892549275c6f8cb3e570354","observation_id":"671c5233-f3c0-487f-bbda-be961d65a12c","resolution":{"observed_at":"2026-08-06T16:48:40.122126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:40.262568Z","title":"Cvtstego-net: A convolutional vision transformer architecture for spatial image steganalysis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:40.262568Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:167a3da1f737d35696c418b8ca4a9e096aac4a6822e4cc27c72a5ca27834ce56","observation_id":"851c30d9-c80d-431e-beb1-04bd4e7c0b01","resolution":{"observed_at":"2026-08-06T16:48:40.262568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:40.416800Z","title":"Efficientvit: Enhanced linear attention for high-resolution low-computation visual recognition","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:40.416800Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:650a290a5a46790a88db2138611278bf6b1a81f1ef8302bc27c901215595dd83","observation_id":"6b5ef737-7171-46ed-bcdb-a529166437c0","resolution":{"observed_at":"2026-08-06T16:48:40.416800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:40.515094Z","title":"Cascade R-CNN: high quality object detection and instance segmentation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:40.515094Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:a0ff4e86ad183cbc13a4181573f70953f8f8468e88f0e475c36bb9853884119f","observation_id":"2616678e-d99d-44b3-83f8-205b1f9e8328","resolution":{"observed_at":"2026-08-06T16:48:40.515094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:40.634303Z","title":"A kernel analysis of feature learning in deep neural networks","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:40.634303Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:bb0ea41e0dee23788e94c3792bbca2749e360cf1c7185691b6078c4ca4134f97","observation_id":"1db2d52e-0a68-4827-83fa-6382bcfdec67","resolution":{"observed_at":"2026-08-06T16:48:40.634303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:40.775717Z","title":"Generalization bounds of stochastic gradient descent for wide and deep neural networks","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:40.775717Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:74976f1f73de094c641c7e669c259683e716de3190ba38a7681fa3a8a350d882","observation_id":"a2f39430-811a-4a95-829c-c624705f2698","resolution":{"observed_at":"2026-08-06T16:48:40.775717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:40.880802Z","title":"End-to-end object detection with transformers","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:40.880802Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:7254d68e5fac37be5835fa918cb2c9764e5c270fd1c344ca9c7263c8d323a3be","observation_id":"0866bcec-73d1-4904-af2e-4d77352568f3","resolution":{"observed_at":"2026-08-06T16:48:40.880802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:41.020190Z","title":"Vision transformer slimming: Multi-dimension searching in continuous optimization space","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:41.020190Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:79012bde31e76df4807bb64b0e78534400b317b76d8b539b800a18899e91e24b","observation_id":"3df8fb80-e7b6-461a-84dd-8fb22b5f1576","resolution":{"observed_at":"2026-08-06T16:48:41.020190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:41.130895Z","title":"CrossVit: Cross-attention multi-scale vision transformer for image classification","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:41.130895Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:2da1f8a762ca6a04bca1bc8957cb2532a57ac65a8aea6c4d24d7d8e330421b29","observation_id":"32bafa41-41e8-4dd2-95b2-bea93127cefa","resolution":{"observed_at":"2026-08-06T16:48:41.130895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:41.251996Z","title":"Autoformer: Searching transformers for visual recognition","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:41.251996Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:5feed411c11279f99c403e69a6ec79a47fe98373f17951ae25254a86ff0104a7","observation_id":"55345051-e4b2-4bfe-9474-fb5f758b2efb","resolution":{"observed_at":"2026-08-06T16:48:41.251996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:41.404358Z","title":"Chasing sparsity in vision transformers: An end-to-end exploration","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:41.404358Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:4907dce81f6454426663a94827d66ce020c038df0465d82fbce5847d1a5073f6","observation_id":"66b8239b-1a2a-496d-8afe-e5366a9be74c","resolution":{"observed_at":"2026-08-06T16:48:41.404358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.02444","last_updated":"2025-09-10T14:37:12Z","snapshot_observed_at":"2026-08-08T09:39:50.868791Z","submitted_at":"2023-03-04T16:04:17Z","title":"Calibrating Transformers via Sparse Gaussian Processes","version":4},"cited_work":{"arxiv_id":"2303.02444","doi":null,"metadata_source":"pith","pith_arxiv_id":"2303.02444","snapshot_observed_at":"2026-08-06T16:48:53.027431Z","title":"Calibrating Transformers via Sparse Gaussian Processes","venue":"cs.LG","work_id":"807728fb-5bbe-46b9-abb5-61d8ee79ae71","year":2023},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:41.518130Z"},"links":{"cited_paper":"/paper/2303.02444","citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:805d3b516fea660ebe930fc5daa6bb0210e30cb99264411171a9c9bbc699526d","observation_id":"841dc598-8742-4618-9ff4-8dcefea2816e","resolution":{"observed_at":"2026-08-06T16:48:53.109932Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:41.639820Z","title":"Neural architecture search on imagenet in four GPU hours: A theoretically inspired perspective","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:41.639820Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:53bca605f3a4309cdd242341c6647ea8e98238847d4301bb0d1ad8213abe2c05","observation_id":"fbe45abc-7985-49d2-95c7-8ca59a4c7d2c","resolution":{"observed_at":"2026-08-06T16:48:41.639820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:41.785288Z","title":"Primal-attention: Self-attention through asymmetric kernel svd in primal representation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:41.785288Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:29eb010a1fce1862f0379568288daf59daf2ed1b6a90cb5d31aef270f47a92f1","observation_id":"a09ade7d-c589-4d51-b123-2afaef6c8a69","resolution":{"observed_at":"2026-08-06T16:48:41.785288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.05895","last_updated":"2022-03-03T18:56:44Z","snapshot_observed_at":"2026-08-10T15:31:57.542476Z","submitted_at":"2021-08-12T17:59:55Z","title":"Mobile-Former: Bridging MobileNet and Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.05895","snapshot_observed_at":"2026-08-06T16:48:41.930429Z","title":"Mobile-former: Bridging mobilenet and transformer","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:41.930429Z"},"links":{"cited_paper":"/paper/2108.05895","citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:7fdb61c7c73165d6a21545f130c28e609c0e4cf681da46a1de5a2d2efd402275","observation_id":"9f526b79-4f49-40d7-b436-a5a3b2fbfef3","resolution":{"observed_at":"2026-08-06T16:48:41.930429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:09.792300Z","title":"Kerple: Kernelized relative positional embedding for length extrapolation","venue":null,"work_id":"1994b8a6-865e-4f2c-9061-0e8f45a75148","year":2022},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:42.034243Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:29c1b4dbee7bcc4a5e4eb2e0c05c9a5961893dac53571933669ce47d2da0ca75","observation_id":"0ac1a747-4a2b-42f7-be42-8494601b0048","resolution":{"observed_at":"2026-08-06T16:49:09.941070Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:09.487824Z","title":"Colwell, and Adrian Weller","venue":null,"work_id":"dc502b87-9d48-4d1b-869b-e400bed0ed86","year":2021},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:42.114041Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:52407a370c889a330936a55db6a84f15968e87da09f9bb395aa46342bad45d72","observation_id":"a2852c68-1723-47ab-a6ca-a09c196f4751","resolution":{"observed_at":"2026-08-06T16:49:09.638063Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:09.195482Z","title":"Lee, and Mahdi Soltanolkotabi","venue":null,"work_id":"d83ed89a-2029-40d1-bcd4-df1cbd8bfc1b","year":2022},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:42.215249Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:3da61e3b46dc646e8f97bb163722e22d66c1d5f899802d97f068d8b01b279513","observation_id":"a6900736-fcbf-4fff-b109-60fad9089bf4","resolution":{"observed_at":"2026-08-06T16:49:09.359527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:09.073625Z","title":"Neuralef: Deconstructing kernels by deep neural networks","venue":null,"work_id":"df68a864-fac5-485c-9c85-f9c0ae20bc23","year":2022},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:42.368679Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:925d6f5cf5bd577b897ab1736fec0e6499edf5f1c0e786dbaa66e889bb063ebf","observation_id":"b5ea8cf9-abe8-4765-8ccc-b4c610fe3620","resolution":{"observed_at":"2026-08-06T16:49:09.129969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:08.836217Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":"a052e777-a74b-45a9-9f88-d01c642f488b","year":2021},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:42.477877Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:d232694371b84170af67f760278c3cea2b34b86592bc6fb9eb5d91ddc60ddcf5","observation_id":"549eb97e-ff61-478a-bd24-f7864203a7a7","resolution":{"observed_at":"2026-08-06T16:49:08.968756Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:08.672463Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":"e1ba3dfd-5e35-4172-b94e-0edf2cad581e","year":2021},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:42.616294Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:42779fa927936f18beede948d4902f6f0c61ba7ebfb0692805a7b0e2f6534caa","observation_id":"1a6bed93-03c6-4497-959e-1a0942923ea6","resolution":{"observed_at":"2026-08-06T16:49:08.781986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:08.511713Z","title":"Deep learning versus kernel learning: an empirical study of loss landscape geometry and the time evolution of the neural tangent kernel","venue":null,"work_id":"7cfb3400-cd80-4291-9427-d720310be6d4","year":2020},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:42.759199Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:dd96dcdf74f7dee1de767b12c675f56b4443c9cd02141597ae8ed7543b869e05","observation_id":"af503526-cc40-48c5-90a6-55c9ed336732","resolution":{"observed_at":"2026-08-06T16:49:08.569050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:08.214109Z","title":"Linearized two-layers neural networks in high dimension","venue":null,"work_id":"4a524278-12c6-45e0-867a-eda50acaea4f","year":2021},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:42.899309Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:d055567d3c50c03aca531d93bf1de173ea98341db885a6d73a774a25ae4bd7a7","observation_id":"cd7f1b94-be04-4fd0-b702-778b236b0a86","resolution":{"observed_at":"2026-08-06T16:49:08.349692Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:07.989593Z","title":"NASV it: Neural architecture search for efficient vision transformers with gradient conflict aware supernet training","venue":null,"work_id":"86fd9837-48c3-4ac1-b74d-066c81215aa8","year":2022},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:43.011560Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:fe274978e063e9db2e9797fa19a31d538b0cc1991a1a53b1c0a7346f1846b786","observation_id":"75190eca-5075-4a59-9318-b96e5b040d22","resolution":{"observed_at":"2026-08-06T16:49:08.091391Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:07.745774Z","title":"Levit: a vision transformer in convnet's clothing for faster inference","venue":null,"work_id":"e91b4bfc-95a8-4152-ae24-ebe8902b3365","year":2021},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:43.178998Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:9c373ef21b0378df895a62fdc5dfc3bb4b715b5fc4092517f224bdeb245023cf","observation_id":"1de62b6e-229d-4829-b592-b2fd8d3d4415","resolution":{"observed_at":"2026-08-06T16:49:07.843351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:07.507911Z","title":"lossless","venue":null,"work_id":"c0ce08d1-b584-4b7e-8be8-b1f185805a5e","year":2022},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:43.303499Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:bc2ca8a69c8a329ffa895e0d052493560638baa8fe4c54bad78494194eb2f82b","observation_id":"1e00f1fe-8bd8-4b80-b3e3-d5481cee9bb7","resolution":{"observed_at":"2026-08-06T16:49:07.610792Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:07.329545Z","title":"Deep learning with kernels through rkhm and the perron-frobenius operator","venue":null,"work_id":"8ad283ed-d7fb-4363-84dc-524a61d50f3c","year":2023},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:43.427184Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:8516c349d0f879fabcb4a0c286fc05fb620aa1373b0a48c716d7a24d038d4b00","observation_id":"f5cec189-157e-40c5-a8cb-00898c9161a1","resolution":{"observed_at":"2026-08-06T16:49:07.405113Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:07.044222Z","title":"Rethinking spatial dimensions of vision transformers","venue":null,"work_id":"e9ac42dc-9f2a-45e6-ac21-0ff3b3f8c7f5","year":2021},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:43.574248Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:6f1262d3f9601232bfb448974b8a59188c702ae44185e8656f6dd757f2e2b5a6","observation_id":"ddda46dc-bcb5-44a7-beb8-ec6a52c6f948","resolution":{"observed_at":"2026-08-06T16:49:07.176446Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:06.732054Z","title":"Hierarchical kernels in deep kernel learning","venue":null,"work_id":"d2c7ca3f-2c4e-4d9c-8e55-f71cda2100b2","year":2023},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:43.852722Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:cbac16ec656e3786c66bf1d08f4b514a790dd8abfb54d9bb0a746ccf91b0c667","observation_id":"33b3f297-5b3d-4078-af35-14f559ddaf89","resolution":{"observed_at":"2026-08-06T16:49:06.905544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:06.518926Z","title":"Neural tangent kernel: Convergence and generalization in neural networks","venue":null,"work_id":"e8b67ec1-9f04-46f7-949c-4445e34bcf83","year":2018},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:43.977510Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:c53046c76b35c1894843f6ef6f0fd5d42bff0e39d42c2c80dafef6a97e1ed591","observation_id":"35365ca3-a7c1-4774-bd06-e44562a17176","resolution":{"observed_at":"2026-08-06T16:49:06.622947Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:06.249578Z","title":"Neural tangent kernel: Convergence and generalization in neural networks","venue":null,"work_id":"58702c43-7908-4ea6-826d-0ac0eba3ee1c","year":2018},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:44.125432Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:3443de40040c84ef9ba449e38014bc672c5c68438b2e15a6d5e2d27b09d30e73","observation_id":"2cfbc8a1-9660-4427-853d-d99cc3635993","resolution":{"observed_at":"2026-08-06T16:49:06.418045Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:06.027019Z","title":"Token fusion: Bridging the gap between token pruning and token merging","venue":null,"work_id":"68b05737-cfdd-434f-912b-e7980c114c1d","year":2024},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:44.262279Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:552a1b8f9572f05afc52eaa9cdbfe9626a997120cd653f1b0ba34d1416c410dc","observation_id":"b900388b-0ff2-473e-ba51-0a435f11f1de","resolution":{"observed_at":"2026-08-06T16:49:06.115942Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:05.817892Z","title":"Local rademacher complexities and oracle inequalities in risk minimization","venue":null,"work_id":"d05efcae-f8fd-4e8a-a1bc-c69ad3752215","year":2006},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:44.426306Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:0e8cde8e3e64368d51f93dfb62b9eb112bb5a92027a1d408dfb3ce9c34b7ac3a","observation_id":"2e70fa98-dfca-4a9c-9381-0445e469a8ee","resolution":{"observed_at":"2026-08-06T16:49:05.913196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:05.627815Z","title":"Spvit: Enabling faster vision transformers via latency-aware soft token pruning","venue":null,"work_id":"34814a27-e868-4845-8b8e-a37e689ceacf","year":2022},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:44.578999Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:6caa87b418b7d9df3d3ff033f890868da8b571702a5b86b453a39db7401a98c5","observation_id":"4285eeca-afef-4f59-a0ac-5bb0c3bab3a3","resolution":{"observed_at":"2026-08-06T16:49:05.720400Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"3308.23436","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:52.841243Z","title":"Sampling methods for the nystr \\\" o m method","venue":null,"work_id":"0324c021-62e1-40a0-9289-45f230da7126","year":2012},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:44.730880Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:60c1d1b63b929e4bb72c997d9a1b315dd428f1e4f717aed6016be5c9a307f5d5","observation_id":"d94b3e7c-a19a-4c43-8fb6-ee0721665c22","resolution":{"observed_at":"2026-08-06T16:48:52.948697Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:05.423424Z","title":"Neural tangent kernel analysis of deep narrow neural networks","venue":null,"work_id":"2841a8a0-a4b7-4f1f-a439-160aa72e5b85","year":2022},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:44.883132Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:ff219eca499a651f6997cb7b20479a269c574c560ce233efd38cfa38152ac7bf","observation_id":"004f09ac-dc29-461e-829b-48c81d578108","resolution":{"observed_at":"2026-08-06T16:49:05.530223Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:05.098263Z","title":"Q-vit: Accurate and fully quantized low-bit vision transformer","venue":null,"work_id":"1d25d1c4-20e8-45d9-86e9-4579f1750275","year":2022},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:45.061802Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:1af788b6935b9e092f4ab0f4258f49961cab3f037e101ec3cde39ba703ee75d2","observation_id":"f7c95c33-5eb5-4c64-b544-2468fd6d301a","resolution":{"observed_at":"2026-08-06T16:49:05.274601Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:04.868244Z","title":"Efficientformer: Vision transformers at mobilenet speed","venue":null,"work_id":"40fa893b-2d35-4f32-942a-b5c9afa60ec7","year":2022},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:45.186857Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:096748869c88e6e486492d5668e119976a46195d8ea8849bfc63fcc49701dd58","observation_id":"3f31b37b-6f95-43d1-a03b-196aa132e77b","resolution":{"observed_at":"2026-08-06T16:49:04.977112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:04.620656Z","title":"Repq-vit: Scale reparameterization for post-training quantization of vision transformers","venue":null,"work_id":"e5c8f3ff-b915-4832-be21-d2cea75d4a13","year":2023},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:45.337452Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:ab968b50078937e7c11c41fef7998bde3d982b88c347ed6ee502f65052486f1c","observation_id":"91e67f29-8481-4af9-950b-ad0969fab6f9","resolution":{"observed_at":"2026-08-06T16:49:04.747217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:04.379190Z","title":"Swinir: Image restoration using swin transformer","venue":null,"work_id":"44819fea-e0a8-4b8e-9923-5df69f669ec1","year":2021},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:45.492302Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:9118c2184f117295948b6f5527bb7b22bd1b3f98c7f346f280846427f46aa340","observation_id":"3ef34586-903f-41a2-a2ba-fdd98730b593","resolution":{"observed_at":"2026-08-06T16:49:04.462290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:45.635114Z","title":"Microsoft coco: Common objects in context","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:45.635114Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:f64f7bfd82795c74599c0c3e9b8658fa4df9588402e952200e9a04d9749b93af","observation_id":"03c2f466-9ac4-4533-9c00-8a9b22619fd0","resolution":{"observed_at":"2026-08-06T16:48:45.635114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:04.084562Z","title":"Fq-vit: Post-training quantization for fully quantized vision transformer","venue":null,"work_id":"64de2e44-805a-4167-ad16-825e90fa177c","year":2022},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:45.806194Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:526e8170b47bdcd3ac3990a92f6d5f9ab2370fc46086a15608ef91806ad4727f","observation_id":"56182cef-0c4b-4413-8fd4-8cf5042eb2ea","resolution":{"observed_at":"2026-08-06T16:49:04.197180Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:03.848909Z","title":"Visual instruction tuning","venue":null,"work_id":"80b9a8d3-911f-44e2-a686-6e18237058d7","year":2023},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:45.902309Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:24f5b389d5e08d3cb0e9f3a4a7374b0dc73bd4408f6369261a60935372aa4342","observation_id":"98dc5d24-4465-442a-a7f5-da78acdf12ea","resolution":{"observed_at":"2026-08-06T16:49:03.977166Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:03.621179Z","title":"Updp: A unified progressive depth pruner for cnn and vision transformer","venue":null,"work_id":"08cb1c77-0577-4414-a2f4-8a4b0388a6ff","year":2024},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:45.994888Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:8dc4f9e51653dd3b65892252d291959c71e95c9de1aba06f3a77eeff94d20d90","observation_id":"fb0fbf8a-f713-4cef-bbd5-e57a465768ad","resolution":{"observed_at":"2026-08-06T16:49:03.740013Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:03.368462Z","title":"Efficientvit: Memory efficient vision transformer with cascaded group attention","venue":null,"work_id":"81467a5f-1e4b-4bb8-9876-218222ffb0f2","year":2023},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:46.100416Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:0de395832e753f0d5bc332a3a89ef262a34ce5ae7d375287ebf8413ea818b6f4","observation_id":"858d6266-bb77-48c2-9581-9f415654c414","resolution":{"observed_at":"2026-08-06T16:49:03.498380Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:03.109212Z","title":"Revisiting token pruning for object detection and instance segmentation","venue":null,"work_id":"146bd3a2-a5a8-44e1-ad6f-1c2f4f959d72","year":2024},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:46.228200Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:4808079b4b56ab90d0c9c15b0a5194e15f32a9caae8ccb85eac15edc439b7e06","observation_id":"50b6e305-d4bc-4646-b635-cb1bc73155fe","resolution":{"observed_at":"2026-08-06T16:49:03.233885Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.14030","last_updated":"2021-08-17T16:41:34Z","snapshot_observed_at":"2026-08-07T00:32:15.123562Z","submitted_at":"2021-03-25T17:59:31Z","title":"Swin Transformer: Hierarchical Vision Transformer using Shifted Windows","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.14030","snapshot_observed_at":"2026-08-06T16:48:46.367308Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:46.367308Z"},"links":{"cited_paper":"/paper/2103.14030","citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:c5404ef9459297316caa792533de0d6f2706af0678ffc59c57f292ac13da2b92","observation_id":"af8a7517-ebda-4f12-9552-e81a0afbf5ae","resolution":{"observed_at":"2026-08-06T16:48:46.367308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:02.852449Z","title":"Post-training quantization for vision transformer","venue":null,"work_id":"7c560215-3728-43d7-97cf-8b32e2f24a7e","year":2021},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:46.506500Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:2755b9866411e40c6c61c47725977f46a3ec0aaa915ea6361bcba6dbe1656f15","observation_id":"a670530a-31cb-4f7e-8ff4-7cdf49ff8c6e","resolution":{"observed_at":"2026-08-06T16:49:02.942968Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:46.657739Z","title":"Prune and merge: Efficient token compression for vision transformer with spatial information preserved","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:46.657739Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:d6f42f12c2c586a950868c653a105efe93726cb6c538f2b79465cb0c8afed5ee","observation_id":"6852d327-71cf-4189-9b0f-930aa1e3ba4b","resolution":{"observed_at":"2026-08-06T16:48:46.657739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:02.560848Z","title":"Mobilevit: light-weight, general-purpose, and mobile-friendly vision transformer","venue":null,"work_id":"5114bba3-1a9c-4b0f-8120-2cb3b4505443","year":2022},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:46.806703Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:1ee59fc51496f73e97ea29527f485583f72763b1f7859737499ed63c5592b701","observation_id":"74cd347b-28d6-47ed-abdb-3be2f5bb45c5","resolution":{"observed_at":"2026-08-06T16:49:02.700626Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:02.303610Z","title":"Geometric parameters of kernel machines","venue":null,"work_id":"189f773e-85ce-41af-a1ac-e72b70acfd70","year":2002},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:46.938769Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:eeb9b95a3b7d5659c34207c65401f31dfcb37d7c367f49fede501f0f90ca5911","observation_id":"f5117968-abc7-4fba-a834-9a561819d5ef","resolution":{"observed_at":"2026-08-06T16:49:02.456574Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:01.994410Z","title":null,"venue":null,"work_id":"899fbd6b-8844-41d1-b5c3-0f162a3ce180","year":2022},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:47.079796Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:68ed24c0dee6718e4f452731bb8bf493a119d41ba456f60cb4716dcb7b957a0b","observation_id":"5bcb92b8-e6f7-4985-8527-959c9d66c0d0","resolution":{"observed_at":"2026-08-06T16:49:02.167537Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:01.726535Z","title":"Kernel analysis of deep networks","venue":null,"work_id":"423d57c9-2775-44c1-8e13-fdda1d4a89b0","year":2011},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:47.242548Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:9cd7d270f99d9b6cfdf6e411406f9831cc7eb50837dfa8a25e85c631a31d98f5","observation_id":"7837a7a1-1978-46bc-9a26-4549cfab67e6","resolution":{"observed_at":"2026-08-06T16:49:01.838520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:01.447618Z","title":"Fourierformer: Transformer meets generalized fourier integral theorem","venue":null,"work_id":"470a1f79-8eb6-43eb-99ef-8d0d029efa23","year":2022},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:47.385582Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:ab7aab2ba43140994e0284e681f70d33476318bf5f0115ac8f189b7b3d4a44e7","observation_id":"54415af0-1ba3-457e-944b-f2e8553fac97","resolution":{"observed_at":"2026-08-06T16:49:01.601104Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:01.148403Z","title":"Bertozzi, Richard G","venue":null,"work_id":"f000c085-8791-4dd0-a11d-c9c7e7f631da","year":2023},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:47.535104Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:7d84518b248dc657107038b901fc82f3801468841de813efa15a7032ba27d59e","observation_id":"a53808ef-6a9d-4219-9874-927c622cef05","resolution":{"observed_at":"2026-08-06T16:49:01.303721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:00.933158Z","title":null,"venue":null,"work_id":"677647bf-54d3-4906-a77a-564b08a958ac","year":2022},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:47.670820Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:75b3ca6f5895df52b94468ea051a39ca0d2e3a514c41b997c4607e0bb1f7ad6e","observation_id":"01d2ba1e-c327-4679-ae77-44f57563e1d2","resolution":{"observed_at":"2026-08-06T16:49:01.056016Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:00.693880Z","title":"A survey on efficient vision transformers: algorithms, techniques, and performance benchmarking","venue":null,"work_id":"75c81b94-e5d5-4b12-aa27-5c269c7857f8","year":2024},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:47.789270Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:c5367b35a5417e4d7b7836b166991dd95824a23b80b6496a4940c6d91413ea57","observation_id":"7658578b-f0ca-4cb4-983d-317596feced6","resolution":{"observed_at":"2026-08-06T16:49:00.795866Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:00.441573Z","title":"u gner, Bertrand Charpentier, Simon Geisler, Morgane Ayle, and Stephan G \\","venue":null,"work_id":"2a89b21a-b35d-4a16-af80-bf1fd7f3e262","year":2022},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:47.906762Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:eec4166943ef14a162b2585928e61b0352bcef3cf0060d3b64ca353aaab57cb5","observation_id":"456fd9ae-0236-411a-8a59-c3e849b4d508","resolution":{"observed_at":"2026-08-06T16:49:00.582639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:00.100950Z","title":"Designing network design spaces","venue":null,"work_id":"fa60de17-0342-4d46-93c5-dea0d83b2862","year":2020},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:47.987297Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:23895afeb33f0b146745594b47fbc377ffbd56be9b48eb61fcfe95b460209031","observation_id":"20595e52-02f3-4535-a164-679a2637b5f1","resolution":{"observed_at":"2026-08-06T16:49:00.249181Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.02034","last_updated":"2021-10-26T13:37:53Z","snapshot_observed_at":"2026-08-10T04:59:43.862035Z","submitted_at":"2021-06-03T17:57:41Z","title":"DynamicViT: Efficient Vision Transformers with Dynamic Token Sparsification","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.02034","snapshot_observed_at":"2026-08-06T16:48:48.087616Z","title":"Dynamicvit: Efficient vision transformers with dynamic token sparsification","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:48.087616Z"},"links":{"cited_paper":"/paper/2106.02034","citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:cd3eee9f21230ee8d0c37ed58b2661d695dff072ce725a84d17905a95d2d0a02","observation_id":"fd173311-25a9-4ddf-b0af-d96955baa203","resolution":{"observed_at":"2026-08-06T16:48:48.087616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:48.239393Z","title":"Imagenet large scale visual recognition challenge","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:48.239393Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:e74421d4609b0822683a13b1d49d9e7ef9036ebc93f153995abb57eab5ee6adf","observation_id":"cd750613-dac9-49b9-af78-4ac71a758bce","resolution":{"observed_at":"2026-08-06T16:48:48.239393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:59.779930Z","title":"Analyzing finite neural networks: Can we trust neural tangent kernel theory? In Mathematical and Scientific Machine Learning, pp.\\ 868--895","venue":null,"work_id":"70c30928-167f-473c-8337-de4d142a55f9","year":2022},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:48.353618Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:2f7d563ee03839c137fbb6ad077ed6ea0217d5603c101896363d338c126b6f7c","observation_id":"a4f045c2-91a2-4869-92e1-36bff398f67e","resolution":{"observed_at":"2026-08-06T16:48:59.949806Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:48.444958Z","title":"FLAVA: A foundational language and vision alignment model","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:48.444958Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:c026edfb057858d5202bb6e2628474b97ed761f5b394094701acc0dfb2ddcec9","observation_id":"5b96e45b-58ed-45f1-b181-c95b2490dc1d","resolution":{"observed_at":"2026-08-06T16:48:48.444958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:59.555219Z","title":"Implicit kernel attention","venue":null,"work_id":"b94d1579-5b2c-402a-88fd-ed6477093fab","year":2021},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:48.540459Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:2c85a4dac2d8ddc6d7a5b0341b597e4f57a1d984d4d16c5b2bca8ab55ec75995","observation_id":"2db2238d-6922-41b4-96da-daecb7f86db0","resolution":{"observed_at":"2026-08-06T16:48:59.677410Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:59.330121Z","title":"Vitas: Vision transformer architecture search","venue":null,"work_id":"d4b2306f-68d4-4054-9b61-7be9930d3d8c","year":2022},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:48.694425Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:d6edfd3306e6ffd3811bb99a08d6bcf32ee13e1a3c31f33ef288d694970b7926","observation_id":"adc23e85-1eab-42c9-82bc-d9609f391c2d","resolution":{"observed_at":"2026-08-06T16:48:59.422215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:59.080833Z","title":"Mean-field analysis on two-layer neural networks from a kernel perspective","venue":null,"work_id":"d989850a-6a58-4c3d-98e9-da2958788367","year":2024},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:48.786147Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:5689ad5edf4e923e0c10d2645ce4e5b27775e4e8073061b8de9f14a6545db12f","observation_id":"368fa89b-bbf5-4893-8812-504e18e68e28","resolution":{"observed_at":"2026-08-06T16:48:59.208642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:58.847589Z","title":"Mnasnet: Platform-aware neural architecture search for mobile","venue":null,"work_id":"2e7ccb36-a370-466e-bf3d-52972d0633d1","year":2019},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:48.911019Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:027caa5c4aa7c9b6496ca5554e02538729668047f8133697fa6abccfb312cf89","observation_id":"2fb34c2c-678d-4ecd-b36e-c250ad580279","resolution":{"observed_at":"2026-08-06T16:48:58.928648Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:58.637413Z","title":"Training data-efficient image transformers & distillation through attention","venue":null,"work_id":"4f05d172-067d-4758-b72e-0bb3bebc0dbb","year":2021},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:49.072604Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:15d68ef608b8265e6a05bc178b2f4cf399124b03dacbfc1992c54cad25254ac6","observation_id":"b3c6b548-ce5d-44bc-892c-d7d9c0f408b1","resolution":{"observed_at":"2026-08-06T16:48:58.753997Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:58.352356Z","title":"Attention is all you need","venue":null,"work_id":"d48b2e5c-01d5-4e5f-bc94-0df3194c4266","year":2017},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:49.203761Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:7b9a98222d460dbd95823401d6b4768be27dce17b2d486f604bc79e9e6cfd635","observation_id":"b69b1629-1d91-4999-8ed6-acee7cd97c2e","resolution":{"observed_at":"2026-08-06T16:48:58.522382Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.03619","last_updated":"2023-04-18T21:41:11Z","snapshot_observed_at":"2026-07-06T12:45:14.351278Z","submitted_at":"2022-03-04T22:16:18Z","title":"Adaptive Cross-Layer Attention for Image Restoration","version":3},"cited_work":{"arxiv_id":"2203.03619","doi":null,"metadata_source":"pith","pith_arxiv_id":"2203.03619","snapshot_observed_at":"2026-08-06T16:48:52.407545Z","title":"Adaptive Cross-Layer Attention for Image Restoration","venue":"eess.IV","work_id":"c2c4af90-ca9a-43a8-8d12-19aee6aae008","year":2022},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:49.339119Z"},"links":{"cited_paper":"/paper/2203.03619","citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:761a89f9d068d9adb0907310b552b8276ac0a4f8aff1affbeb1c50e18e51f861","observation_id":"f78538c7-e2df-4fa5-b97e-aec74389ce27","resolution":{"observed_at":"2026-08-06T16:48:52.509701Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:58.098200Z","title":"NTK-SAP: improving neural network pruning by aligning training dynamics","venue":null,"work_id":"5883facd-6faa-4770-8f52-661b2885b92e","year":2023},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:49.491442Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:080d02fed2ce9980009e4300d062c3fea9032047c30a9accd7b8b2573b9d1ad5","observation_id":"f19eb25b-5142-48e2-934c-9f700bea8e3b","resolution":{"observed_at":"2026-08-06T16:48:58.228446Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:57.854898Z","title":"Vtc-lfc: Vision transformer compression with low-frequency components","venue":null,"work_id":"e71e164d-62e7-4644-a0fd-fa2ef79340f6","year":2022},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:49.596189Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:2837bfb53c1eeb6781c96ab5a6d0f384796fa475b2884dcfc2f2ecdb75ce10e1","observation_id":"df346213-07b8-4db6-8ec7-8c1b962e4042","resolution":{"observed_at":"2026-08-06T16:48:57.974082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:57.576582Z","title":"Ntk-approximating MLP fusion for efficient language model fine-tuning","venue":null,"work_id":"0512ecc8-0924-4841-97c1-f392cc71cdd3","year":2023},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:49.693298Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:e4acceb8f34a82fbac7a41a7f2b65c95879c69c66f981d50c1a2145ca7e6538e","observation_id":"87543ea8-7243-419f-a56f-2777f59d8f55","resolution":{"observed_at":"2026-08-06T16:48:57.696217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:57.283495Z","title":"Auto-prox: Training-free vision transformer architecture search via automatic proxy discovery","venue":null,"work_id":"3e965a42-b910-4b41-81ff-f5da4cffb61f","year":2024},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:49.811480Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:00a8541339e642e17cd4e17e98b3f32499f8edf226465536d385a101fcdd6c66","observation_id":"2469fc1b-b4a3-4c5e-8de0-6b7d12892ac2","resolution":{"observed_at":"2026-08-06T16:48:57.465910Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:56.985480Z","title":"Kernel and rich regimes in overparametrized models","venue":null,"work_id":"daef6298-be28-428a-9246-f784570180bc","year":2020},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:49.944505Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:1e9440a813831a037665f0b7c05547ee81f321190f202ee69f32f6c7316dd6c0","observation_id":"a1db33f2-7b49-4de3-80b7-ef164df9df4b","resolution":{"observed_at":"2026-08-06T16:48:57.131253Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:56.776663Z","title":"Tinyvit: Fast pretraining distillation for small vision transformers","venue":null,"work_id":"d903cbd2-8671-41c6-8a3b-71aa7ac27f86","year":2022},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:50.065013Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:f6c0d1eb4f26660cfb4fd97b39b796c4c2c158fd1f69624c08a369d4c6bcbec0","observation_id":"8e36504f-7dc0-43db-8e4c-b1f6e2df3f1f","resolution":{"observed_at":"2026-08-06T16:48:56.867669Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:56.567662Z","title":"Disentangling trainability and generalization in deep neural networks","venue":null,"work_id":"7cab7489-d612-4f09-94a0-739a1acd1ee3","year":2020},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:50.185562Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:a6cdfe6a93091ed8c3697ecfa973b58d9ddbdf7915ee6038751487a84d808bf4","observation_id":"561dcfed-e2ab-42e6-80b3-fc85c4fdda8b","resolution":{"observed_at":"2026-08-06T16:48:56.679368Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:56.340973Z","title":"Unified perceptual parsing for scene understanding","venue":null,"work_id":"17f5bd5c-0ec8-429e-9e7b-bc35af5e3f4b","year":2018},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:50.342915Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:f8fbd34391702f66a6fdc730bb258b9d42e796f4819666af9220d6c3fe740c4d","observation_id":"0c75385c-0247-4f3d-bd2c-2ea551cfe94b","resolution":{"observed_at":"2026-08-06T16:48:56.465083Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:56.139855Z","title":"Lpvit: Low-power semi-structured pruning for vision transformers","venue":null,"work_id":"a1e38630-1e54-4c02-9d2f-61b2730e65af","year":2024},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:50.459886Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:c0899c2e52e6bf0881021e669328d8a528b54fa79634d803d55e2fb89af6430c","observation_id":"fa5be48b-de96-4c9e-85a8-737eb82cba50","resolution":{"observed_at":"2026-08-06T16:48:56.246800Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:55.821139Z","title":"From knowledge distillation to self-knowledge distillation: A unified approach with normalized loss and customized soft labels","venue":null,"work_id":"8ff9911b-7680-4c38-bf67-5a57993c19c0","year":2023},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:50.551963Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:13e3c2795f0050787f80fab876254299ef8b587e68e3bbccdb4c82cf42a2847c","observation_id":"350e2d2a-e221-4107-8a93-d4191a25fb33","resolution":{"observed_at":"2026-08-06T16:48:55.976923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:55.544451Z","title":"Vitkd: Feature-based knowledge distillation for vision transformers","venue":null,"work_id":"e49ade50-a445-481f-accc-dfc946b58033","year":2024},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:50.662975Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:f440fc52cc7c528782f21742c1c5694804d57a43d6fee03dff1b20b6354537d8","observation_id":"c81ce9b3-1135-4d7c-b82b-27d13fce8d62","resolution":{"observed_at":"2026-08-06T16:48:55.688918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:55.316855Z","title":"Width & depth pruning for vision transformers","venue":null,"work_id":"e3a28ed0-b47b-42d3-91c6-162b9a958dba","year":2022},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:50.780234Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:347b4f46070ab31c0f43df497c17646e9d8f248c0bd2fdc2ecb297bc1e398885","observation_id":"c1fcf31d-968b-4d12-b3aa-975e6ae051d5","resolution":{"observed_at":"2026-08-06T16:48:55.406216Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:54.967289Z","title":"Unified visual transformer compression","venue":null,"work_id":"674fa2c8-9626-452d-a7c0-0bdbf113bfe0","year":2022},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:50.912827Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:75df24ba5830f34bb9cc37533b6a7220177b1de3a36be9a9150720941dbecc9b","observation_id":"201a64f4-b9f3-4dfa-92b1-adccc8965f4e","resolution":{"observed_at":"2026-08-06T16:48:55.100330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:54.647792Z","title":"Tokens-to-token vit: Training vision transformers from scratch on imagenet","venue":null,"work_id":"66f88ce1-c8b6-44b1-ab6e-2609fa639d97","year":2021},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:51.011650Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:0c5e4455770a99f6fcc26c54e755b1b9e12e545e27bb1e49d4432bf66a2af696","observation_id":"b67b03b3-f590-4f31-af9c-98e0614e925f","resolution":{"observed_at":"2026-08-06T16:48:54.803196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:54.419416Z","title":"Cumulative spatial knowledge distillation for vision transformers","venue":null,"work_id":"424b5369-69a2-4083-8b30-2c9bb1929326","year":2023},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:51.162955Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:be2643425d443381d254c96bd737d83c47b03eb027ba4c7ff62f20cab09cb573","observation_id":"2a92b499-67d7-45aa-8b7c-53109f7452b3","resolution":{"observed_at":"2026-08-06T16:48:54.531223Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:54.178320Z","title":"Savit: Structure-aware vision transformer pruning via collaborative optimization","venue":null,"work_id":"f2935f09-038c-475f-8015-68f271079ad2","year":2022},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:51.288846Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:b6ca97a8e5a1e96753544cd4738c2f1c4c9d3afa374a3bd0aae28aaedf1006d7","observation_id":"f8bbba53-850b-4340-8e75-12b05129500e","resolution":{"observed_at":"2026-08-06T16:48:54.291410Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:53.941436Z","title":null,"venue":null,"work_id":"afaf6b8b-0b95-41c0-9b4b-318b2de88c3a","year":2021},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:51.415662Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:8805da1f9f94b8138d950ace6d7ec158d20bc8136e6a518d33949ae16d6a21ba","observation_id":"b71aeb6f-d302-4e0d-b01f-729f26e0b0e3","resolution":{"observed_at":"2026-08-06T16:48:54.058280Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:53.653330Z","title":"Semantic understanding of scenes through the ADE20K dataset","venue":null,"work_id":"7876dec8-df55-49b0-8235-fb1af55f3cbf","year":2019},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:51.560020Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:2b66cea4ef9ab6d0b40278b4db18456869aa019ffc9725fb84366ee3f838a721","observation_id":"baf21a4d-3c59-4c19-8fbf-249ac9ad2dd2","resolution":{"observed_at":"2026-08-06T16:48:53.797772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:53.348069Z","title":"Deformable detr: Deformable transformers for end-to-end object detection","venue":null,"work_id":"1bf7df0a-feb2-4ff6-9b93-17f64f502e9c","year":2021},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:51.678343Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:f460c04270815db015b50adad104f970975f6e861dae69e8a9c28f250d481c34","observation_id":"f83c1625-db3e-4ae1-8dfe-64582d3fe575","resolution":{"observed_at":"2026-08-06T16:48:53.486662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:51.793967Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:51.793967Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:5199ca2bd0cd93d7030a2aa3325bf4a82bf604b4b55215f7061f6e421186aa5f","observation_id":"5def573a-51aa-4a2d-a36e-9bf1a83e631b","resolution":{"observed_at":"2026-08-06T16:48:51.793967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:51.897482Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:51.897482Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:9e7189dcee00baeaeb14450673ebfd02601c45d571f1a75f611d2e45f8061110","observation_id":"41bd2ee2-da64-4659-acbb-6df2f58167cc","resolution":{"observed_at":"2026-08-06T16:48:51.897482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2007.13007","last_updated":"2020-07-25T20:42:21Z","snapshot_observed_at":"2026-08-08T20:12:24.225034Z","submitted_at":"2020-07-25T20:42:21Z","title":"HATNet: An End-to-End Holistic Attention Network for Diagnosis of Breast Biopsy Images","version":1},"cited_work":{"arxiv_id":"2007.13007","doi":null,"metadata_source":"pith","pith_arxiv_id":"2007.13007","snapshot_observed_at":"2026-08-06T16:48:52.208438Z","title":"HATNet: An End-to-End Holistic Attention Network for Diagnosis of Breast Biopsy Images","venue":"eess.IV","work_id":"ff18aa6f-9362-4b0f-9a22-0c1e4c151181","year":2020},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:52.035624Z"},"links":{"cited_paper":"/paper/2007.13007","citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:da4e05f7b9f1d031b19c0e80dec0287baca86313d2e177a364219ea465fcbaa4","observation_id":"bec91c63-936f-442d-aa76-f411a26938c4","resolution":{"observed_at":"2026-08-06T16:48:52.283609Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-10T06:08:05.393929Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity"},"reference_resolution":{"displayed":98,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":31,"verified_exact":2,"verified_fuzzy":63},"total_outbound_references":98},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 98 of 98 outbound references and 0 inbound Pith citation observations for arXiv:2507.12780."}