{"as_of":"2026-08-22T10:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7a2ecfd32f620163f6671ae8bb2cfc485a0fe967ceb7484bbc647d62a024abf5","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T23:37:45.207426Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.02344/citation-record","integrity":"/paper/2412.02344/integrity","json":"/paper/2412.02344/citation-record.json","paper":"/paper/2412.02344"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.936550Z","title":"GQA: training generalized multi-query transformer models from multi-head checkpoints","venue":null,"work_id":"6f807c4a-dd19-4ca1-8ffd-9466e2455002","year":2023},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:44.865758Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:f9309650207943ca84ac2ec1640b5daee38125724fc2f62c54f5f745c6ad790f","observation_id":"115d185e-133f-405b-8745-79f331cd7c3f","resolution":{"observed_at":"2026-08-11T23:37:45.941493Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12981","last_updated":"2024-05-21T17:59:29Z","snapshot_observed_at":"2026-08-20T10:03:23.466960Z","submitted_at":"2024-05-21T17:59:29Z","title":"Reducing Transformer Key-Value Cache Size with Cross-Layer Attention","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.12981","snapshot_observed_at":"2026-08-11T23:37:44.871522Z","title":"Reducing transformer key-value cache size with cross-layer attention","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:44.871522Z"},"links":{"cited_paper":"/paper/2405.12981","citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:ab47d6e1f4fd49ab94fd331315d4d817a58b8e19a7ab6a3fa38e2c5b9e8ba95f","observation_id":"a0785f33-eacf-4f05-ab0a-3c3e6e476661","resolution":{"observed_at":"2026-08-11T23:37:44.871522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.07155","last_updated":"2019-06-17T17:58:12Z","snapshot_observed_at":"2026-08-16T03:32:25.570081Z","submitted_at":"2019-06-17T17:58:12Z","title":"MMDetection: Open MMLab Detection Toolbox and Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.07155","snapshot_observed_at":"2026-08-11T23:37:44.876909Z","title":"MMDetection: Open mmlab detection toolbox and benchmark","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:44.876909Z"},"links":{"cited_paper":"/paper/1906.07155","citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:517fb766986a992bcf36638c155e03f6edb89f350300bf035dbf77c7d15a664d","observation_id":"9c55382f-fa02-4a3c-9d87-5f310e9091f1","resolution":{"observed_at":"2026-08-11T23:37:44.876909Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.920698Z","title":"Mobile- former: Bridging mobilenet and transformer","venue":null,"work_id":"5944b416-5914-4bd7-a804-05c89b5a8928","year":2022},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:44.882661Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:94ee1e841ffacd94cb7f7974904c4f8276d5c90f5602dc81094acae690822c40","observation_id":"8f22fb60-41dc-4ea7-bcc4-de5857081eb7","resolution":{"observed_at":"2026-08-11T23:37:45.925911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.903762Z","title":"DHA: learning decoupled-head attention from transformer checkpoints via adaptive heads fusion","venue":null,"work_id":"8a1ed96a-bbb0-4bbb-ae48-334cdf6242e1","year":2024},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:44.887984Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:70544c76a68fa2dd7cb4452f06cd2c1b8962d3cbc6f18b6c2b79fcb0193d7bfb","observation_id":"03d320f3-9701-4447-9d92-b704087f98f1","resolution":{"observed_at":"2026-08-11T23:37:45.909336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.888441Z","title":"Openmmlab’s pre-training tool- box and benchmark","venue":null,"work_id":"5f46deaa-a5a6-4efd-af0c-8ed5ee82757b","year":2023},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:44.893209Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:8c71a5d90d95b7d376cf6fe6f2f9917ba75835e385f64609b166daaecdd1aad7","observation_id":"20a207a9-ac2f-40dd-9478-be88d10dade4","resolution":{"observed_at":"2026-08-11T23:37:45.893461Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.873186Z","title":"Fu, Stefano Ermon, Atri Rudra, and Christopher R ´e","venue":null,"work_id":"265e32a7-2d6c-4c8b-b91c-2a6ee1ce02e6","year":2022},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:44.898975Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:9e113b31c97f946f6311a23110acf5551f9684f76e003013b130cf263fed4db5","observation_id":"75828587-45a7-4336-bf9c-6005283c7f57","resolution":{"observed_at":"2026-08-11T23:37:45.878079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.857442Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":"2bb5b209-7cd0-40ea-974e-05ba8b427560","year":2009},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:44.904024Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:6e046467f08847388abfcf32e6359e38154f957053232e4c227b7f8c390a5342","observation_id":"7eac38ef-0612-4a29-a661-ff356b7e8811","resolution":{"observed_at":"2026-08-11T23:37:45.862602Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.840041Z","title":"The case for 4-bit pre- cision: k-bit inference scaling laws","venue":null,"work_id":"257032fa-00d1-43c2-9c69-d18adb295aa4","year":2023},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:44.908697Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:27f0c78d6b855258037545da322194d8fdd3d894a211a0f12d9e898aa46a0f9c","observation_id":"5c15eb1b-bf6c-479e-b716-c66630130bd1","resolution":{"observed_at":"2026-08-11T23:37:45.845872Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.823037Z","title":"Speeddetr: Speed-aware transformers for end-to-end object detection","venue":null,"work_id":"3ab6642e-7f0c-40a1-9d23-1e70aa8b9d86","year":2023},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:44.913609Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:5b2b44a8113215238a4daaf913f8bb00e473936f831c41fea331433abcb96c44","observation_id":"5f59e18d-4add-43c5-a97f-87582eacb50b","resolution":{"observed_at":"2026-08-11T23:37:45.828089Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.02803","last_updated":"2024-05-05T03:25:25Z","snapshot_observed_at":"2026-08-19T15:38:47.757063Z","submitted_at":"2024-05-05T03:25:25Z","title":"Is Flash Attention Stable?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.02803","snapshot_observed_at":"2026-08-11T23:37:44.918559Z","title":"Is flash attention stable? CoRR, abs/2405.02803, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:44.918559Z"},"links":{"cited_paper":"/paper/2405.02803","citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:1f12cc396a1e0df16e7e04f6fe36e4708720bb319b3196251a38190c0545216f","observation_id":"9d49a3f3-fb76-45c5-bdab-4fa510b14b6c","resolution":{"observed_at":"2026-08-11T23:37:44.918559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.806481Z","title":"Levit: a vision transformer in convnet’s clothing for faster inference","venue":null,"work_id":"f8184e70-126e-415c-b125-f54a56c1bab8","year":2021},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:44.924417Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:a554e9e499d51f6fedc5af10453a849ab35996b81495a6f360f3fd34562dc33e","observation_id":"b34bae7e-6cd1-44be-99f5-91cc2b1f460b","resolution":{"observed_at":"2026-08-11T23:37:45.811646Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.790376Z","title":"Flatten transformer: Vision transformer using fo- cused linear attention","venue":null,"work_id":"f6f5d5b2-0dd7-4cbe-91fb-43c7a30fb367","year":2023},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:44.929382Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:d78f7df34f4aee9e16d96e12ccf79ce89aa26cc48ebbb2a59b1c9e1cad941f09","observation_id":"8f15f93a-65cc-48ae-8a37-440b9bf04806","resolution":{"observed_at":"2026-08-11T23:37:45.795490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.773823Z","title":"Le, Mark Sandler, Bo Chen, Weijun Wang, Liang-Chieh Chen, Mingxing Tan, Grace Chu, Vijay Vasudevan, and Yukun Zhu","venue":null,"work_id":"e2216140-f4c1-44be-a87e-7ee9c6b23019","year":2019},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:44.934077Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:df7f2e980a9b9cea7e4dfba81c6ec39793191f5d8bae8d153bb207edc00e7f92","observation_id":"4bacec5c-2502-46e5-8791-9a538470a3a7","resolution":{"observed_at":"2026-08-11T23:37:45.779729Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.757724Z","title":"Transformers are rnns: Fast autoregressive transformers with linear attention","venue":null,"work_id":"365cf16a-3dee-474a-9da7-055d1273fcf0","year":2020},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:44.938924Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:94b4fde0406646ca2c157ec46870ff457a60ef2ba4cebbc62a3a9c59a6f4e392","observation_id":"920601be-9c5a-485f-9ffe-f363203b12e6","resolution":{"observed_at":"2026-08-11T23:37:45.763084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:44.944394Z","title":"Spvit: Enabling faster vision transformers via latency-aware soft token pruning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:44.944394Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:7e99ea4f948a76b7b153cdd71f4398b8fe95e44ffcac0373b7466512f0105557","observation_id":"07702df4-cfec-49b4-9eb7-689a7cbef7d9","resolution":{"observed_at":"2026-08-11T23:37:44.944394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.730356Z","title":"Couplformer: Rethinking vision transformer with cou- pling attention","venue":null,"work_id":"366da414-3af0-4f23-9e17-aff65abe036b","year":2023},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:44.950764Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:5a6f4e06c3aa8976f6e2d685e275ecc974c9949a900fb943a01c7672ff8baace","observation_id":"bd0c4f49-4a14-4bc8-9b69-6cfe4a4a1c25","resolution":{"observed_at":"2026-08-11T23:37:45.735447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.713242Z","title":"Re- thinking vision transformers for mobilenet size and speed","venue":null,"work_id":"6a26cc77-609a-4db0-81dd-2d25e6f06b1f","year":2023},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:44.958014Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:0d41746293d2907ad3168fab5336601e33e15a31b8432b9c7fe1524ad5d7ab6e","observation_id":"7eff0da1-9c8a-4987-9eb4-f36003f1b53c","resolution":{"observed_at":"2026-08-11T23:37:45.718491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.696822Z","title":"Re- thinking vision transformers for mobilenet size and speed","venue":null,"work_id":"da2e9bd6-1f15-4d09-8bad-d72f6cbcc8c8","year":2023},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:44.963388Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:2991a5e0c1d91915e7c754ed9cccec84f5ef36e20c267a26c13b87049247534f","observation_id":"9b7cc2ba-8284-484f-9584-ac7b60c54d9e","resolution":{"observed_at":"2026-08-11T23:37:45.702051Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.087669Z","title":"Belongie, James Hays, Pietro Perona, Deva Ramanan, Piotr Doll ´ar, and C","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:45.087669Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:f4d9d617cea1d2fa4962d4927a4fabe1d4b3d42a9c7c9454d827abf6b2f7b1e5","observation_id":"bba27326-72e4-43c1-9ba7-c70ae7d76c64","resolution":{"observed_at":"2026-08-11T23:37:45.087669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.669677Z","title":"Efficientvit: Memory effi- cient vision transformer with cascaded group attention","venue":null,"work_id":"ba121a08-1c3e-4238-9518-7c8c960d2b2f","year":2023},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:45.092825Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:4eabf16e0a02b5b51b9fc212e1ce543c320a4912bb45cfc3cf2ea2a0151574e8","observation_id":"a266d22a-11a4-4560-b8c5-b53f7307e182","resolution":{"observed_at":"2026-08-11T23:37:45.675085Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.653530Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows","venue":null,"work_id":"43236012-cf33-4be4-814b-3d648fd6ce80","year":2021},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:45.097648Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:4bb07fc598e527b60a566ab970909ee1dd375e230a5cdb631ff806382495ac14","observation_id":"73d9e24c-336f-41f9-bba3-41ec18c4e490","resolution":{"observed_at":"2026-08-11T23:37:45.658852Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.637760Z","title":"SGDR: stochastic gradient descent with warm restarts","venue":null,"work_id":"6403f8e4-d5c0-4ef1-8560-89322af0bbbf","year":2017},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:45.103079Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:3ab915bc0c7b5005461d5c6a73a4120d2eec87568d2a9853e3b1b7deeb851120","observation_id":"62703f45-bda1-4823-a8d3-68f99f218d47","resolution":{"observed_at":"2026-08-11T23:37:45.643073Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.108127Z","title":"Decoupled weight decay regularization","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:45.108127Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:0130f8595a8b3c67fed61dc273a02ead11e256fd2a0099552fd7c16c382f8040","observation_id":"b465f632-8ac8-4e01-96d5-32c0fdff9252","resolution":{"observed_at":"2026-08-11T23:37:45.108127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.611460Z","title":"SOFT: softmax-free transformer with linear complexity","venue":null,"work_id":"922c63eb-c62c-4953-931d-13c1c0a966c1","year":2021},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:45.113041Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:52619e0a1d95dcde975f87c587361527aec23456f2f18b263d1437326c563e87","observation_id":"ce25b416-6418-4328-b726-1eea84e7f7dc","resolution":{"observed_at":"2026-08-11T23:37:45.616599Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.595521Z","title":"Delight: Deep and light-weight transformer","venue":null,"work_id":"7789e7e3-4969-4d1e-bf37-b4e50f622b69","year":2021},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:45.118026Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:9c9f45f4c071c06771e663c5e65806c6205000f9f89d50e64f1de50f4d29517e","observation_id":"00a31972-8b43-495e-af6e-ddf48284123c","resolution":{"observed_at":"2026-08-11T23:37:45.600778Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.578811Z","title":null,"venue":null,"work_id":"5acef929-62a9-4520-bd24-c0c5a785f4d8","year":2019},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:45.123237Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:4c449c732e06d8f866dc8689d040f746da0996af36280897a3d8b615b0c8f4a3","observation_id":"cc8b1108-9104-43b2-9b9e-fd51b2930e9d","resolution":{"observed_at":"2026-08-11T23:37:45.584158Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.562734Z","title":"Fast vi- sion transformers with hilo attention","venue":null,"work_id":"41af17c8-1c41-496c-b610-bd7ddbac2695","year":2022},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:45.128515Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:d9ca0e0546e8a9fb7c62b04e080d1a7daaafb39487fdf5f411463ad96a45ed7e","observation_id":"63b31029-7cab-4f49-a2f1-5c2435f279be","resolution":{"observed_at":"2026-08-11T23:37:45.567746Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.546677Z","title":"Yang, Zachary DeVito, Mar- tin Raison, Alykhan Tejani, Sasank Chilamkurthy, Benoit Steiner, Lu Fang, Junjie Bai, and Soumith Chintala","venue":null,"work_id":"47404bec-dcfa-4d5e-b793-85f19d21385b","year":2019},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:45.133710Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:bdc99255221bd8cdaba6281cde28db4fb636f6714bdca8ac9fd99b8301834b00","observation_id":"19b41a4c-9a05-4cfa-8983-783dc5118be9","resolution":{"observed_at":"2026-08-11T23:37:45.552094Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.530512Z","title":"Efficient neural net- works: From algorithm design to practical mobile deploy- ment","venue":null,"work_id":"9ebc3324-e9ac-4457-a91c-9452c9b66baf","year":2023},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:45.139325Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:78b722431fd7b56dc00e085399ca62a42307b173cce45850c74d0715d561e9db","observation_id":"53c4221c-aa03-4037-acea-ffdab4123326","resolution":{"observed_at":"2026-08-11T23:37:45.536254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.514446Z","title":"Sparq attention: Bandwidth-efficient LLM inference","venue":null,"work_id":"229cd89c-7c0c-4ea4-b82b-f6ca55c11580","year":2024},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:45.144108Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:4f58df837bbc5286c385e01707c76d881a0f5cf2ff97c528aae89e448da84e17","observation_id":"6af8a02c-03ad-47ec-8cb5-8acfe6983018","resolution":{"observed_at":"2026-08-11T23:37:45.519799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.498478Z","title":"Linear transformers are secretly fast weight programmers","venue":null,"work_id":"fead48f7-81d1-4c3f-a024-264fd12ce1bf","year":2021},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:45.149077Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:dc75d98e9ec4a17aafafdaf3f0f5b9ac39a26f437dabd22be7ec2fed759812d8","observation_id":"ca1ca2da-9abf-40f3-ade3-ee764ac3a30a","resolution":{"observed_at":"2026-08-11T23:37:45.503737Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.482435Z","title":"Efficient attention: Attention with linear complexities","venue":null,"work_id":"b9ff95d1-0531-4ae7-8c7a-2585ece5fe1d","year":2021},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:45.153947Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:8f4e7e2e775d589ec06777ba4412b8e2a652a8f28c4aeba362a6ad165c3770b6","observation_id":"627a7651-6f45-4e02-9894-969175dba4df","resolution":{"observed_at":"2026-08-11T23:37:45.487596Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.12444","last_updated":"2023-01-29T13:38:45Z","snapshot_observed_at":"2026-08-21T12:55:41.375128Z","submitted_at":"2023-01-29T13:38:45Z","title":"Exploring Attention Map Reuse for Efficient Transformer Neural Networks","version":1},"cited_work":{"arxiv_id":"2301.12444","doi":null,"metadata_source":"pith","pith_arxiv_id":"2301.12444","snapshot_observed_at":"2026-08-11T23:37:45.245760Z","title":"Exploring Attention Map Reuse for Efficient Transformer Neural Networks","venue":"cs.AI","work_id":"b49f7d16-edf6-4ff8-9102-9854ab02d7e4","year":2023},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:45.158888Z"},"links":{"cited_paper":"/paper/2301.12444","citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:012ab9ff877d0046ccec0dff3a26002037ddeec5ccf8bc42573e72fcfa1f14ee","observation_id":"dc897709-8af5-44b7-a8d6-bb4ed3e50429","resolution":{"observed_at":"2026-08-11T23:37:45.254347Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.464279Z","title":"Reed, Dragomir Anguelov, Dumitru Erhan, Vincent Vanhoucke, and Andrew Rabinovich","venue":null,"work_id":"20a1febf-5ea0-44f5-a6c0-c231749dc785","year":2015},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:45.164128Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:47532a46950e3a4e53f3a22ee8f589a47ac9494238779e0f3696008c10b0c9ff","observation_id":"c595d9b0-5b17-4eac-b069-46e6e8d8c660","resolution":{"observed_at":"2026-08-11T23:37:45.469925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.447430Z","title":null,"venue":null,"work_id":"fa4ba9a2-acb4-4a0f-a0d5-bf7175440328","year":2019},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:45.169417Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:2f21f4e843204af7b3fe53e7240563062fd66bbf49bab763ace660932fdaa1a8","observation_id":"3716c511-ce3c-4e6d-92b6-997665f3eefa","resolution":{"observed_at":"2026-08-11T23:37:45.452375Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.431261Z","title":"Gomez, Lukasz Kaiser, and Illia Polosukhin","venue":null,"work_id":"078e5d16-2234-49b1-988f-95b3895f1e48","year":2017},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:45.174388Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:396002420ee4683e63ccbdc5c4eb4d142fab534db675fbba2b29011d7de489af","observation_id":"0a90eb49-c657-4b8a-8e8f-c2307f9137bf","resolution":{"observed_at":"2026-08-11T23:37:45.436251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.415071Z","title":"Pyra- mid vision transformer: A versatile backbone for dense pre- diction without convolutions","venue":null,"work_id":"ea5be438-17ea-4bf4-a9fa-e2bf69af86dc","year":2021},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:45.179298Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:bf21e055bfc6ded9e1fde287adb1624b2c5dcd8822b35cefcfb0db389f3edb84","observation_id":"ff97624e-519a-4e4b-9726-6ce86af9f37c","resolution":{"observed_at":"2026-08-11T23:37:45.420308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.398440Z","title":"Global vision trans- former pruning with hessian-aware saliency","venue":null,"work_id":"ceee12cb-ed68-47c8-aeb7-3bec9b313313","year":2023},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:45.184045Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:524d0385203b5258ec42ee096ed0d9b9b3d513ef5d1d99e26bdadc4cd0ee407d","observation_id":"bdaa9991-b01b-4350-a6a2-44ea9089d90d","resolution":{"observed_at":"2026-08-11T23:37:45.404201Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.381993Z","title":"Cutmix: Regulariza- tion strategy to train strong classifiers with localizable fea- tures","venue":null,"work_id":"d47f1d16-c6b3-405f-a39e-cfe346dae4f5","year":2019},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:45.188645Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:11a3797ffdde1c73b17f018c83da3e65777169f4706fb437370d270853149c87","observation_id":"23d61166-30d0-4c91-84c8-1051aa8b1985","resolution":{"observed_at":"2026-08-11T23:37:45.387382Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.193416Z","title":"Dauphin, and David Lopez-Paz","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:45.193416Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:c0a8dc593907bdb0c3f22c4a50b42851053ebc00593ca22b0cf4bff08213c3f3","observation_id":"c3ef1511-5624-4d2d-a302-56e7b3d4242d","resolution":{"observed_at":"2026-08-11T23:37:45.193416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.354509Z","title":"Minivit: Compressing vi- sion transformers with weight multiplexing","venue":null,"work_id":"05bcd93a-cce2-47c7-844b-cf738bba7103","year":2022},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:45.197888Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:19b7ba3fb8b0bbc2b60930d2ac15fb774f45a548996709d8199e9dc30cf1a27a","observation_id":"e88658a0-984e-432a-bbb9-b33942845987","resolution":{"observed_at":"2026-08-11T23:37:45.359740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.337626Z","title":"Lightweight vision transformer with spatial and channel enhanced self-attention","venue":null,"work_id":"27c65e81-986b-4231-b1a2-32e723b0aa74","year":2023},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:45.202517Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:c3af2382a2b45935f6fe0d2b22a7a753b897496cfe5632f0f8787b80c5fdad11","observation_id":"abb6826e-388e-44da-bcdb-1475714d132a","resolution":{"observed_at":"2026-08-11T23:37:45.343351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.320370Z","title":"Random erasing data augmentation","venue":null,"work_id":"f6c6e864-eb46-4b32-b93b-aae196e81801","year":2020},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:45.207426Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:f5c06bfa1568b5522865f2e75e6da61e07347e20b34a8608ea4b11c110f9d9ee","observation_id":"91eca322-c52b-49ef-af19-0ee2576a7124","resolution":{"observed_at":"2026-08-11T23:37:45.325514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":8,"verified_exact":1,"verified_fuzzy":34},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 0 inbound Pith citation observations for arXiv:2412.02344."}