{"as_of":"2026-08-13T14:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:04f56f3b93835061cbfe7eb30b10d75948ed3d77140d3e85c11db30bcaacc280","coverage":[{"denominator":43,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":43,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T05:36:10.290281Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.00334/citation-record","integrity":"/paper/2412.00334/integrity","json":"/paper/2412.00334/citation-record.json","paper":"/paper/2412.00334"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:11.015395Z","title":"Fe- drolex: Model-heterogeneous federated learning with rolling sub-model extraction","venue":null,"work_id":"97989960-c290-4a5e-9a95-1c4a9aae7fdd","year":2022},"citing_paper":{"arxiv_id":"2412.00334","last_updated":"2025-08-31T12:40:53Z","snapshot_observed_at":"2026-08-12T22:17:11.660685Z","submitted_at":"2024-11-30T03:20:14Z","title":"EFTViT: Efficient Federated Training of Vision Transformers with Masked Images on Resource-Constrained Clients","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:10.118711Z"},"links":{"citing_paper":"/paper/2412.00334"},"observation_digest":"sha256:469f3a60d75893fc52122699cd04e0e9e697e53d468e5c25b827a01f9938ca7c","observation_id":"3496512c-789d-4165-a62c-aa15fad69fc8","resolution":{"observed_at":"2026-08-12T05:36:11.020253Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:11.002179Z","title":"Dearkd: data-efficient early knowledge distillation for vision transformers","venue":null,"work_id":"5fc5330f-d4b3-4822-8b18-768c6cfee356","year":2022},"citing_paper":{"arxiv_id":"2412.00334","last_updated":"2025-08-31T12:40:53Z","snapshot_observed_at":"2026-08-12T22:17:11.660685Z","submitted_at":"2024-11-30T03:20:14Z","title":"EFTViT: Efficient Federated Training of Vision Transformers with Masked Images on Resource-Constrained Clients","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:10.123872Z"},"links":{"citing_paper":"/paper/2412.00334"},"observation_digest":"sha256:f08f5cde54696ca6cb5d3c3480e09cfc88a8226105b3fd8618d8b41ff0d99a1f","observation_id":"04aeb87c-cfb1-4033-9fb9-2bf79d9f3147","resolution":{"observed_at":"2026-08-12T05:36:11.006812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:10.989132Z","title":"Up-detr: Unsupervised pre-training for object detection with transformers","venue":null,"work_id":"0112651c-b508-40d0-8454-fe5831189213","year":2021},"citing_paper":{"arxiv_id":"2412.00334","last_updated":"2025-08-31T12:40:53Z","snapshot_observed_at":"2026-08-12T22:17:11.660685Z","submitted_at":"2024-11-30T03:20:14Z","title":"EFTViT: Efficient Federated Training of Vision Transformers with Masked Images on Resource-Constrained Clients","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:10.128465Z"},"links":{"citing_paper":"/paper/2412.00334"},"observation_digest":"sha256:80989d7e027e1e6fafc77cb50041840b7deff422edc9d6fbbee45a2d806ab5d2","observation_id":"da6c5fb3-7168-4b84-9693-a222c524ddd6","resolution":{"observed_at":"2026-08-12T05:36:10.993652Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:10.975575Z","title":"Heterofl: Com- putation and communication efficient federated learning for heterogeneous clients","venue":null,"work_id":"4f36d50a-2b8e-4773-9c59-cea8625efad7","year":2020},"citing_paper":{"arxiv_id":"2412.00334","last_updated":"2025-08-31T12:40:53Z","snapshot_observed_at":"2026-08-12T22:17:11.660685Z","submitted_at":"2024-11-30T03:20:14Z","title":"EFTViT: Efficient Federated Training of Vision Transformers with Masked Images on Resource-Constrained Clients","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:10.132743Z"},"links":{"citing_paper":"/paper/2412.00334"},"observation_digest":"sha256:7a480e5be49d31ce802cd9f9b62331add38dad3909deafd263428bd3c8159cf7","observation_id":"75f68a04-33c7-4a49-88cf-cd0c6ad78177","resolution":{"observed_at":"2026-08-12T05:36:10.980204Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-13T14:19:26.598265Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-12T05:36:10.136875Z","title":"An image is worth 16x16 words: Trans- formers for image recognition at scale","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2412.00334","last_updated":"2025-08-31T12:40:53Z","snapshot_observed_at":"2026-08-12T22:17:11.660685Z","submitted_at":"2024-11-30T03:20:14Z","title":"EFTViT: Efficient Federated Training of Vision Transformers with Masked Images on Resource-Constrained Clients","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:10.136875Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2412.00334"},"observation_digest":"sha256:f937ecea76c2e5519a7f7415f0d8a2e7a706e9c2fc5c16a2f45bcfcdf89a95b2","observation_id":"d22f5596-c3cd-44bf-83a6-195ef139ac16","resolution":{"observed_at":"2026-08-12T05:36:10.136875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:10.962418Z","title":"Differential privacy: A survey of results","venue":null,"work_id":"c0867b0a-1e6c-4911-bd81-f08b2f2e9342","year":2008},"citing_paper":{"arxiv_id":"2412.00334","last_updated":"2025-08-31T12:40:53Z","snapshot_observed_at":"2026-08-12T22:17:11.660685Z","submitted_at":"2024-11-30T03:20:14Z","title":"EFTViT: Efficient Federated Training of Vision Transformers with Masked Images on Resource-Constrained Clients","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:10.141161Z"},"links":{"citing_paper":"/paper/2412.00334"},"observation_digest":"sha256:a2c2ffb4320caf1cad2bb12d864ea9ceb570de249c5adcb47e1ba6302a12ac47","observation_id":"dbe1cd4a-7d84-4abd-acb8-e51c24a24cfb","resolution":{"observed_at":"2026-08-12T05:36:10.966574Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14608","last_updated":"2024-09-16T02:54:50Z","snapshot_observed_at":"2026-08-04T09:07:42.158421Z","submitted_at":"2024-03-21T17:55:50Z","title":"Parameter-Efficient Fine-Tuning for Large Models: A Comprehensive Survey","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14608","snapshot_observed_at":"2026-08-12T05:36:10.145326Z","title":"Parameter-efficient fine-tuning for large models: A compre- hensive survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.00334","last_updated":"2025-08-31T12:40:53Z","snapshot_observed_at":"2026-08-12T22:17:11.660685Z","submitted_at":"2024-11-30T03:20:14Z","title":"EFTViT: Efficient Federated Training of Vision Transformers with Masked Images on Resource-Constrained Clients","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:10.145326Z"},"links":{"cited_paper":"/paper/2403.14608","citing_paper":"/paper/2412.00334"},"observation_digest":"sha256:dbc778923778eab4e4ad3fa0705c4802a5c8558e35d85b05432886db8e8d3b79","observation_id":"b68b747b-ac56-4ab4-8e39-33e318d70de4","resolution":{"observed_at":"2026-08-12T05:36:10.145326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:10.949197Z","title":"Group knowledge transfer: Federated learning of large cnns at the edge","venue":null,"work_id":"98b41a9d-4b94-41b0-9425-be84902cd707","year":2020},"citing_paper":{"arxiv_id":"2412.00334","last_updated":"2025-08-31T12:40:53Z","snapshot_observed_at":"2026-08-12T22:17:11.660685Z","submitted_at":"2024-11-30T03:20:14Z","title":"EFTViT: Efficient Federated Training of Vision Transformers with Masked Images on Resource-Constrained Clients","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:10.149362Z"},"links":{"citing_paper":"/paper/2412.00334"},"observation_digest":"sha256:797cae04e7c7b5f712c86e8e3020bae84dcd95746cd2635dcfe0240c6f196ae4","observation_id":"97526822-f426-4640-9fad-2afbcacd780f","resolution":{"observed_at":"2026-08-12T05:36:10.954024Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:10.152934Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.00334","last_updated":"2025-08-31T12:40:53Z","snapshot_observed_at":"2026-08-12T22:17:11.660685Z","submitted_at":"2024-11-30T03:20:14Z","title":"EFTViT: Efficient Federated Training of Vision Transformers with Masked Images on Resource-Constrained Clients","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:10.152934Z"},"links":{"citing_paper":"/paper/2412.00334"},"observation_digest":"sha256:9f9d97651b85f7ac6e56e365d5b477b85ca18be28f639c8d07d726f6fdffb549","observation_id":"2ba756e4-825c-49c7-a300-2c3e8bbfb3ec","resolution":{"observed_at":"2026-08-12T05:36:10.152934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:10.156649Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.00334","last_updated":"2025-08-31T12:40:53Z","snapshot_observed_at":"2026-08-12T22:17:11.660685Z","submitted_at":"2024-11-30T03:20:14Z","title":"EFTViT: Efficient Federated Training of Vision Transformers with Masked Images on Resource-Constrained Clients","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:10.156649Z"},"links":{"citing_paper":"/paper/2412.00334"},"observation_digest":"sha256:fbf5e61774d32c58a37b88ca1f6f50ea9807b4664155e84d64b966fa88de7f22","observation_id":"4027eeb1-e0be-4fc5-aff9-96f638edef91","resolution":{"observed_at":"2026-08-12T05:36:10.156649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-11T08:20:29.798517Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-12T05:36:10.160747Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.00334","last_updated":"2025-08-31T12:40:53Z","snapshot_observed_at":"2026-08-12T22:17:11.660685Z","submitted_at":"2024-11-30T03:20:14Z","title":"EFTViT: Efficient Federated Training of Vision Transformers with Masked Images on Resource-Constrained Clients","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:10.160747Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2412.00334"},"observation_digest":"sha256:a69d6f0cf966b47c9ddffd7cb1c7089ae055679abd2484c35f9a49437ef8724f","observation_id":"3bebbe83-5644-4c69-8473-f06a060ecc1d","resolution":{"observed_at":"2026-08-12T05:36:10.160747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:10.916985Z","title":"Adaptivefl: Adaptive heterogeneous federated learning for resource-constrained aiot systems","venue":null,"work_id":"7991d7f6-b77e-4206-803c-47bbbfe96631","year":2024},"citing_paper":{"arxiv_id":"2412.00334","last_updated":"2025-08-31T12:40:53Z","snapshot_observed_at":"2026-08-12T22:17:11.660685Z","submitted_at":"2024-11-30T03:20:14Z","title":"EFTViT: Efficient Federated Training of Vision Transformers with Masked Images on Resource-Constrained Clients","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:10.164332Z"},"links":{"citing_paper":"/paper/2412.00334"},"observation_digest":"sha256:0b10ab7d4f356256f4009a6a294ce0dd653eb8b66402e71e5591dfc8422edb1a","observation_id":"76b026c1-7e14-4f37-92f2-da15eb93259d","resolution":{"observed_at":"2026-08-12T05:36:10.921545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:10.903099Z","title":"Vi- sual prompt tuning","venue":null,"work_id":"009edc05-7b18-4fa0-b766-b0650dd20a79","year":2022},"citing_paper":{"arxiv_id":"2412.00334","last_updated":"2025-08-31T12:40:53Z","snapshot_observed_at":"2026-08-12T22:17:11.660685Z","submitted_at":"2024-11-30T03:20:14Z","title":"EFTViT: Efficient Federated Training of Vision Transformers with Masked Images on Resource-Constrained Clients","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:10.168368Z"},"links":{"citing_paper":"/paper/2412.00334"},"observation_digest":"sha256:debfd9b72e53655ab0f0a38dfbb928db684d8913f6ff820f45b9eabd867bf2ce","observation_id":"265ecc59-54be-4553-8d53-224a023ae9d5","resolution":{"observed_at":"2026-08-12T05:36:10.907506Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:10.172255Z","title":"Learning multiple layers of features from tiny images","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2412.00334","last_updated":"2025-08-31T12:40:53Z","snapshot_observed_at":"2026-08-12T22:17:11.660685Z","submitted_at":"2024-11-30T03:20:14Z","title":"EFTViT: Efficient Federated Training of Vision Transformers with Masked Images on Resource-Constrained Clients","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:10.172255Z"},"links":{"citing_paper":"/paper/2412.00334"},"observation_digest":"sha256:5877813ed41c0c5efadc9c86c0aded7a82d297e5b2cc05e69997cfde5c6840f8","observation_id":"843dd483-8339-42b4-a814-843aaef253fb","resolution":{"observed_at":"2026-08-12T05:36:10.172255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:10.176523Z","title":"Unif2ace: Fine- grained face understanding and generation with unified mul- timodal models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2412.00334","last_updated":"2025-08-31T12:40:53Z","snapshot_observed_at":"2026-08-12T22:17:11.660685Z","submitted_at":"2024-11-30T03:20:14Z","title":"EFTViT: Efficient Federated Training of Vision Transformers with Masked Images on Resource-Constrained Clients","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:10.176523Z"},"links":{"citing_paper":"/paper/2412.00334"},"observation_digest":"sha256:9d0be8ba45760e96f1c82d47a3015055c02c49e4fa08f712a96b29fda220e844","observation_id":"c0e1f6d5-56b3-4277-bf3a-2fb14327df94","resolution":{"observed_at":"2026-08-12T05:36:10.176523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:10.883759Z","title":"Self- supervised geometric features discovery via interpretable at- tention for vehicle re-identification and beyond","venue":null,"work_id":"8d6dd017-cf59-46eb-99da-7909c1a72ca5","year":null},"citing_paper":{"arxiv_id":"2412.00334","last_updated":"2025-08-31T12:40:53Z","snapshot_observed_at":"2026-08-12T22:17:11.660685Z","submitted_at":"2024-11-30T03:20:14Z","title":"EFTViT: Efficient Federated Training of Vision Transformers with Masked Images on Resource-Constrained Clients","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:10.180781Z"},"links":{"citing_paper":"/paper/2412.00334"},"observation_digest":"sha256:51bd1b169f6dbe1327eeef13fb152ac5b4963f9b54c067bddce08e6b584c3d7a","observation_id":"e269e899-7d80-4d8e-9470-95e9a3338836","resolution":{"observed_at":"2026-08-12T05:36:10.888105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:10.872050Z","title":"Exploiting multi-view part-wise correlation via an ef- ficient transformer for vehicle re-identification","venue":null,"work_id":"00e2c5aa-3a6f-4c52-8229-fdf40d9ec0a0","year":2021},"citing_paper":{"arxiv_id":"2412.00334","last_updated":"2025-08-31T12:40:53Z","snapshot_observed_at":"2026-08-12T22:17:11.660685Z","submitted_at":"2024-11-30T03:20:14Z","title":"EFTViT: Efficient Federated Training of Vision Transformers with Masked Images on Resource-Constrained Clients","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:10.184628Z"},"links":{"citing_paper":"/paper/2412.00334"},"observation_digest":"sha256:f2446d12ef431bf160277d210c3718cdaf8d7e739fa03d8353211c427bf59498","observation_id":"29ec8c05-b6b1-4015-a9f9-30d94eac3d62","resolution":{"observed_at":"2026-08-12T05:36:10.876211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:10.860434Z","title":"Dr-fer: Discrimina- tive and robust representation learning for facial expression recognition","venue":null,"work_id":"77a2474f-fcde-4354-b3c7-2755d81842ae","year":2023},"citing_paper":{"arxiv_id":"2412.00334","last_updated":"2025-08-31T12:40:53Z","snapshot_observed_at":"2026-08-12T22:17:11.660685Z","submitted_at":"2024-11-30T03:20:14Z","title":"EFTViT: Efficient Federated Training of Vision Transformers with Masked Images on Resource-Constrained Clients","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:10.188339Z"},"links":{"citing_paper":"/paper/2412.00334"},"observation_digest":"sha256:94febac8634fda4018d52a6bf96be1a5dff9dc485db05f77a9b68325bc29c698","observation_id":"596ac7ea-51c6-498c-acea-0327688a44da","resolution":{"observed_at":"2026-08-12T05:36:10.864381Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:10.848327Z","title":"Stprivacy: Spatio-temporal privacy-preserving action recognition","venue":null,"work_id":"8ac2f38b-9254-4e9f-a492-395890d13efc","year":2023},"citing_paper":{"arxiv_id":"2412.00334","last_updated":"2025-08-31T12:40:53Z","snapshot_observed_at":"2026-08-12T22:17:11.660685Z","submitted_at":"2024-11-30T03:20:14Z","title":"EFTViT: Efficient Federated Training of Vision Transformers with Masked Images on Resource-Constrained Clients","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:10.191932Z"},"links":{"citing_paper":"/paper/2412.00334"},"observation_digest":"sha256:7396e4f529108f8d61ea6ec5b9ff82467839ebd2daabe7379bbd7474eaee15b5","observation_id":"cfac963b-cbac-4eb2-9a0e-4dd8f7c11a9a","resolution":{"observed_at":"2026-08-12T05:36:10.853097Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:10.837255Z","title":"Instant3d: instant text- to-3d generation","venue":null,"work_id":"801b038e-f7f9-4758-8b23-418a340ffb13","year":2024},"citing_paper":{"arxiv_id":"2412.00334","last_updated":"2025-08-31T12:40:53Z","snapshot_observed_at":"2026-08-12T22:17:11.660685Z","submitted_at":"2024-11-30T03:20:14Z","title":"EFTViT: Efficient Federated Training of Vision Transformers with Masked Images on Resource-Constrained Clients","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:10.195550Z"},"links":{"citing_paper":"/paper/2412.00334"},"observation_digest":"sha256:2c305882598df7dbb80c49013796088ce536c7c67e82a2e2b3cbccbc6e63e6b3","observation_id":"575c03d9-16df-40d7-82d5-6b53d03d64b9","resolution":{"observed_at":"2026-08-12T05:36:10.840923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:10.825188Z","title":"Finch: Enhancing federated learning with hierarchical neural architecture search","venue":null,"work_id":"740d95a5-81dc-46a1-9a1e-922ff2a05fd1","year":2023},"citing_paper":{"arxiv_id":"2412.00334","last_updated":"2025-08-31T12:40:53Z","snapshot_observed_at":"2026-08-12T22:17:11.660685Z","submitted_at":"2024-11-30T03:20:14Z","title":"EFTViT: Efficient Federated Training of Vision Transformers with Masked Images on Resource-Constrained Clients","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:10.199582Z"},"links":{"citing_paper":"/paper/2412.00334"},"observation_digest":"sha256:c2849a37d99c7e6f5b7809fc8e120c7bd568fc8d28fbee8705b09614f52ebca9","observation_id":"334e1d88-243d-4b06-a748-bbda583f9d5f","resolution":{"observed_at":"2026-08-12T05:36:10.829401Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:10.812292Z","title":"Eventgpt: Event stream understanding with multimodal large language models","venue":null,"work_id":"12fa4519-a820-4742-8cfc-6d047253ab5d","year":2025},"citing_paper":{"arxiv_id":"2412.00334","last_updated":"2025-08-31T12:40:53Z","snapshot_observed_at":"2026-08-12T22:17:11.660685Z","submitted_at":"2024-11-30T03:20:14Z","title":"EFTViT: Efficient Federated Training of Vision Transformers with Masked Images on Resource-Constrained Clients","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:10.203539Z"},"links":{"citing_paper":"/paper/2412.00334"},"observation_digest":"sha256:b7ef063e4b8a82088dca0419b5c471dcd7d267e5935b8d3ff91c29715e68ca0e","observation_id":"4b752083-205c-4dfe-bb57-1c1fd2c76331","resolution":{"observed_at":"2026-08-12T05:36:10.817033Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09140","last_updated":"2024-10-11T17:55:30Z","snapshot_observed_at":"2026-08-12T22:25:12.589783Z","submitted_at":"2024-10-11T17:55:30Z","title":"RealEra: Semantic-level Concept Erasure via Neighbor-Concept Mining","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09140","snapshot_observed_at":"2026-08-12T05:36:10.207416Z","title":"Realera: Semantic-level concept erasure via neighbor-concept min- ing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.00334","last_updated":"2025-08-31T12:40:53Z","snapshot_observed_at":"2026-08-12T22:17:11.660685Z","submitted_at":"2024-11-30T03:20:14Z","title":"EFTViT: Efficient Federated Training of Vision Transformers with Masked Images on Resource-Constrained Clients","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:10.207416Z"},"links":{"cited_paper":"/paper/2410.09140","citing_paper":"/paper/2412.00334"},"observation_digest":"sha256:ada1d1fa42d044b8631f3a17c7cd83fb7a95df5a94feb6056cdbf74774e9842d","observation_id":"271dacb8-4779-4a57-a397-3318359f1708","resolution":{"observed_at":"2026-08-12T05:36:10.207416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:10.799456Z","title":"Communication- efficient learning of deep networks from decentralized data","venue":null,"work_id":"210111b3-dea4-4c93-bdd7-bea3632de1d7","year":2017},"citing_paper":{"arxiv_id":"2412.00334","last_updated":"2025-08-31T12:40:53Z","snapshot_observed_at":"2026-08-12T22:17:11.660685Z","submitted_at":"2024-11-30T03:20:14Z","title":"EFTViT: Efficient Federated Training of Vision Transformers with Masked Images on Resource-Constrained Clients","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:10.211860Z"},"links":{"citing_paper":"/paper/2412.00334"},"observation_digest":"sha256:b03811eb878fbc7e8787388bee4f9befd62146f457d483938fa089ba1f774c4e","observation_id":"ebf3c655-9360-491a-a90f-2ce6f465560e","resolution":{"observed_at":"2026-08-12T05:36:10.803555Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.10972","last_updated":"2021-08-05T15:04:28Z","snapshot_observed_at":"2026-08-06T21:17:51.553405Z","submitted_at":"2021-04-22T10:10:14Z","title":"ImageNet-21K Pretraining for the Masses","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.10972","snapshot_observed_at":"2026-08-12T05:36:10.215862Z","title":"Imagenet-21k pretraining for the masses","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.00334","last_updated":"2025-08-31T12:40:53Z","snapshot_observed_at":"2026-08-12T22:17:11.660685Z","submitted_at":"2024-11-30T03:20:14Z","title":"EFTViT: Efficient Federated Training of Vision Transformers with Masked Images on Resource-Constrained Clients","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:10.215862Z"},"links":{"cited_paper":"/paper/2104.10972","citing_paper":"/paper/2412.00334"},"observation_digest":"sha256:e02bd5bfa6c0a2035a1762fb58a5e77dbff72c196c3acf82390dce46ca551d13","observation_id":"3af8a569-da83-4937-9c32-71cf9a4cd519","resolution":{"observed_at":"2026-08-12T05:36:10.215862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.10270","last_updated":"2022-06-23T10:51:04Z","snapshot_observed_at":"2026-08-06T08:18:31.112514Z","submitted_at":"2021-06-18T17:58:20Z","title":"How to train your ViT? Data, Augmentation, and Regularization in Vision Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.10270","snapshot_observed_at":"2026-08-12T05:36:10.220129Z","title":"How to train your vit? data, augmentation, and regularization in vision transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.00334","last_updated":"2025-08-31T12:40:53Z","snapshot_observed_at":"2026-08-12T22:17:11.660685Z","submitted_at":"2024-11-30T03:20:14Z","title":"EFTViT: Efficient Federated Training of Vision Transformers with Masked Images on Resource-Constrained Clients","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:10.220129Z"},"links":{"cited_paper":"/paper/2106.10270","citing_paper":"/paper/2412.00334"},"observation_digest":"sha256:8c4512563dc214cc3a8c3d2250e8fdee3d07740de257563640c82633e92e5ab3","observation_id":"e1340f12-16b1-4821-8222-b2a9532a74ff","resolution":{"observed_at":"2026-08-12T05:36:10.220129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:10.787174Z","title":"Fedra: A ran- dom allocation strategy for federated tuning to unleash the power of heterogeneous clients","venue":null,"work_id":"014e13bb-5ba4-4f60-82d8-b6b0b4ff27d1","year":2024},"citing_paper":{"arxiv_id":"2412.00334","last_updated":"2025-08-31T12:40:53Z","snapshot_observed_at":"2026-08-12T22:17:11.660685Z","submitted_at":"2024-11-30T03:20:14Z","title":"EFTViT: Efficient Federated Training of Vision Transformers with Masked Images on Resource-Constrained Clients","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:10.224545Z"},"links":{"citing_paper":"/paper/2412.00334"},"observation_digest":"sha256:cb69c0187867d1364e3454335407061242cab20aa83831d6d4c28b9ccc596a28","observation_id":"3eb7e427-8597-4892-b092-15bcd940e2bb","resolution":{"observed_at":"2026-08-12T05:36:10.791544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.01708","last_updated":"2024-12-24T05:57:39Z","snapshot_observed_at":"2026-08-13T14:13:15.904423Z","submitted_at":"2022-10-04T16:08:54Z","title":"Exploring Parameter-Efficient Fine-Tuning to Enable Foundation Models in Federated Learning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.01708","snapshot_observed_at":"2026-08-12T05:36:10.228809Z","title":"Conquering the communication constraints to enable large pre-trained models in federated learning.arXiv preprint arXiv:2210.01708, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.00334","last_updated":"2025-08-31T12:40:53Z","snapshot_observed_at":"2026-08-12T22:17:11.660685Z","submitted_at":"2024-11-30T03:20:14Z","title":"EFTViT: Efficient Federated Training of Vision Transformers with Masked Images on Resource-Constrained Clients","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:10.228809Z"},"links":{"cited_paper":"/paper/2210.01708","citing_paper":"/paper/2412.00334"},"observation_digest":"sha256:5134cf4ec55bb3e2c5f2bf56a954297707614d3334ab84a21c77691e037f21a5","observation_id":"d117651f-ee31-4402-a793-0dc9ff60f872","resolution":{"observed_at":"2026-08-12T05:36:10.228809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:10.774191Z","title":"Training data-efficient image transformers & distillation through at- tention","venue":null,"work_id":"f8ae30a8-42f8-4b77-a2fb-d4838dd12916","year":2021},"citing_paper":{"arxiv_id":"2412.00334","last_updated":"2025-08-31T12:40:53Z","snapshot_observed_at":"2026-08-12T22:17:11.660685Z","submitted_at":"2024-11-30T03:20:14Z","title":"EFTViT: Efficient Federated Training of Vision Transformers with Masked Images on Resource-Constrained Clients","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:10.233469Z"},"links":{"citing_paper":"/paper/2412.00334"},"observation_digest":"sha256:470d8273c2a6d209af8cac1cdcdc556c9c177fcaa152c22f3d106b2354043178","observation_id":"0f8176f7-dbdf-4355-b643-62b832a48834","resolution":{"observed_at":"2026-08-12T05:36:10.778636Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:10.761599Z","title":"Fedekt: Ensem- ble knowledge transfer for model-heterogeneous federated learning","venue":null,"work_id":"368220b2-8fd1-4cac-a421-15fd1f72ea8e","year":2024},"citing_paper":{"arxiv_id":"2412.00334","last_updated":"2025-08-31T12:40:53Z","snapshot_observed_at":"2026-08-12T22:17:11.660685Z","submitted_at":"2024-11-30T03:20:14Z","title":"EFTViT: Efficient Federated Training of Vision Transformers with Masked Images on Resource-Constrained Clients","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:10.237441Z"},"links":{"citing_paper":"/paper/2412.00334"},"observation_digest":"sha256:529d4c451d7789a0696b34455d26381f30f1e4b0a61bbd7b1bb008f97b5e2ed4","observation_id":"86245336-6e7d-4897-9c30-8b02134aa62c","resolution":{"observed_at":"2026-08-12T05:36:10.765994Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:10.749172Z","title":"Revealing the dark secrets of masked im- age modeling","venue":null,"work_id":"8758725e-96dc-46aa-b10f-0a8e249ac765","year":2023},"citing_paper":{"arxiv_id":"2412.00334","last_updated":"2025-08-31T12:40:53Z","snapshot_observed_at":"2026-08-12T22:17:11.660685Z","submitted_at":"2024-11-30T03:20:14Z","title":"EFTViT: Efficient Federated Training of Vision Transformers with Masked Images on Resource-Constrained Clients","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:10.241345Z"},"links":{"citing_paper":"/paper/2412.00334"},"observation_digest":"sha256:bb4823f95ce5faa7da340f8440cd27b70b2983d6ddd3d769750088f85f027a6d","observation_id":"67ff46c8-fa56-459a-9a84-842573238b85","resolution":{"observed_at":"2026-08-12T05:36:10.753822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:10.734904Z","title":"Fedbfpt: An efficient federated learning framework for bert further pre-training","venue":null,"work_id":"3252a58d-94dd-44e4-9c7a-4df19e46f9cd","year":2023},"citing_paper":{"arxiv_id":"2412.00334","last_updated":"2025-08-31T12:40:53Z","snapshot_observed_at":"2026-08-12T22:17:11.660685Z","submitted_at":"2024-11-30T03:20:14Z","title":"EFTViT: Efficient Federated Training of Vision Transformers with Masked Images on Resource-Constrained Clients","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:10.245313Z"},"links":{"citing_paper":"/paper/2412.00334"},"observation_digest":"sha256:ec8f4d4abe49229234d51a6c69546c8f746c3bfbf2a17f98e5cf565d149d0b87","observation_id":"5d7a89f2-9805-47bd-a281-534d83d9c26d","resolution":{"observed_at":"2026-08-12T05:36:10.740029Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:10.720536Z","title":null,"venue":null,"work_id":"6e06c830-451f-45d8-a06d-bbe48bc2301c","year":2025},"citing_paper":{"arxiv_id":"2412.00334","last_updated":"2025-08-31T12:40:53Z","snapshot_observed_at":"2026-08-12T22:17:11.660685Z","submitted_at":"2024-11-30T03:20:14Z","title":"EFTViT: Efficient Federated Training of Vision Transformers with Masked Images on Resource-Constrained Clients","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:10.249350Z"},"links":{"citing_paper":"/paper/2412.00334"},"observation_digest":"sha256:2d21b6cfe20ff74c3ceac324ce9364da6a8f4cf5114c724113336d9011b0c00a","observation_id":"fa13c6b6-e490-40a9-aa5a-f7fbde8d6901","resolution":{"observed_at":"2026-08-12T05:36:10.724820Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:10.706442Z","title":"Bag-of-visual-words and spa- tial extensions for land-use classification","venue":null,"work_id":"136e61d5-ab35-4fe4-9977-764ba75f38bb","year":2010},"citing_paper":{"arxiv_id":"2412.00334","last_updated":"2025-08-31T12:40:53Z","snapshot_observed_at":"2026-08-12T22:17:11.660685Z","submitted_at":"2024-11-30T03:20:14Z","title":"EFTViT: Efficient Federated Training of Vision Transformers with Masked Images on Resource-Constrained Clients","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:10.253062Z"},"links":{"citing_paper":"/paper/2412.00334"},"observation_digest":"sha256:7aef0a0621dffc2d0edcc170ade341029be2c2b7a21287b1a1d44c32afbe790d","observation_id":"00084c54-e78b-4d89-b331-1460f79f45a0","resolution":{"observed_at":"2026-08-12T05:36:10.711131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:10.693664Z","title":"See through gradients: Image batch recovery via gradinversion","venue":null,"work_id":"137c8503-94b8-4a54-82ef-99162023480c","year":2021},"citing_paper":{"arxiv_id":"2412.00334","last_updated":"2025-08-31T12:40:53Z","snapshot_observed_at":"2026-08-12T22:17:11.660685Z","submitted_at":"2024-11-30T03:20:14Z","title":"EFTViT: Efficient Federated Training of Vision Transformers with Masked Images on Resource-Constrained Clients","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:10.256791Z"},"links":{"citing_paper":"/paper/2412.00334"},"observation_digest":"sha256:d11be5674b9aa2c1a35c3dd3d7e34a7decbd4e6718f9ec26bbf875404a582d92","observation_id":"a4552902-ba8b-498d-afd9-f68eac9415fb","resolution":{"observed_at":"2026-08-12T05:36:10.697969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:10.260623Z","title":"Bitfit: Simple parameter-efficient fine-tuning for transformer-based masked language-models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.00334","last_updated":"2025-08-31T12:40:53Z","snapshot_observed_at":"2026-08-12T22:17:11.660685Z","submitted_at":"2024-11-30T03:20:14Z","title":"EFTViT: Efficient Federated Training of Vision Transformers with Masked Images on Resource-Constrained Clients","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:10.260623Z"},"links":{"citing_paper":"/paper/2412.00334"},"observation_digest":"sha256:55313e48aa365fe49037365096c730a76b8eeffdbabdf821458f8a62b25617e4","observation_id":"01200356-c4e6-433a-ab17-cdc2b99f886a","resolution":{"observed_at":"2026-08-12T05:36:10.260623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:10.680440Z","title":"Fedpetuning: When fed- erated learning meets the parameter-efficient tuning methods of pre-trained language models","venue":null,"work_id":"cd53cfcb-9133-42be-bd16-f5f51cc5e16f","year":2023},"citing_paper":{"arxiv_id":"2412.00334","last_updated":"2025-08-31T12:40:53Z","snapshot_observed_at":"2026-08-12T22:17:11.660685Z","submitted_at":"2024-11-30T03:20:14Z","title":"EFTViT: Efficient Federated Training of Vision Transformers with Masked Images on Resource-Constrained Clients","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:10.264894Z"},"links":{"citing_paper":"/paper/2412.00334"},"observation_digest":"sha256:1105bb0bd092e45a5e0182c7d820e011539fc4959354504f141f8ce28a7502cd","observation_id":"1cd3a0b5-7c25-4e72-969e-d40878605d1a","resolution":{"observed_at":"2026-08-12T05:36:10.685491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.02610","last_updated":"2020-01-08T16:45:09Z","snapshot_observed_at":"2026-08-12T01:33:52.396724Z","submitted_at":"2020-01-08T16:45:09Z","title":"iDLG: Improved Deep Leakage from Gradients","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.02610","snapshot_observed_at":"2026-08-12T05:36:10.273141Z","title":"idlg: Improved deep leakage from gradients","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2412.00334","last_updated":"2025-08-31T12:40:53Z","snapshot_observed_at":"2026-08-12T22:17:11.660685Z","submitted_at":"2024-11-30T03:20:14Z","title":"EFTViT: Efficient Federated Training of Vision Transformers with Masked Images on Resource-Constrained Clients","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:10.273141Z"},"links":{"cited_paper":"/paper/2001.02610","citing_paper":"/paper/2412.00334"},"observation_digest":"sha256:07b2a499cdcdf0c122a0b78ea0e4640a3ed62dd5278e8b3bc911aca691abda6a","observation_id":"3858fcdf-b49f-4b38-bf5b-9625092bab90","resolution":{"observed_at":"2026-08-12T05:36:10.273141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09158","last_updated":"2026-05-09T06:28:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-12T08:33:46Z","title":"FaVChat: Hierarchical Prompt-Query Guided Facial Video Understanding with Data-Efficient GRPO","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09158","snapshot_observed_at":"2026-08-12T05:36:10.277122Z","title":"Favchat: Unlocking fine-grained facial video understanding with multimodal large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2412.00334","last_updated":"2025-08-31T12:40:53Z","snapshot_observed_at":"2026-08-12T22:17:11.660685Z","submitted_at":"2024-11-30T03:20:14Z","title":"EFTViT: Efficient Federated Training of Vision Transformers with Masked Images on Resource-Constrained Clients","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:10.277122Z"},"links":{"cited_paper":"/paper/2503.09158","citing_paper":"/paper/2412.00334"},"observation_digest":"sha256:be8f6beafb1cdf8125c6a1ec840a458e90145b81e8caf0f66aee9a9766e83ade","observation_id":"5ba5cb33-6382-473c-8040-56583ae8d228","resolution":{"observed_at":"2026-08-12T05:36:10.277122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:10.281451Z","title":"Rethinking semantic segmen- tation from a sequence-to-sequence perspective with trans- formers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.00334","last_updated":"2025-08-31T12:40:53Z","snapshot_observed_at":"2026-08-12T22:17:11.660685Z","submitted_at":"2024-11-30T03:20:14Z","title":"EFTViT: Efficient Federated Training of Vision Transformers with Masked Images on Resource-Constrained Clients","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:10.281451Z"},"links":{"citing_paper":"/paper/2412.00334"},"observation_digest":"sha256:97f32ef7ed077912d396ca5f1e45126cb3664c059c92b07dccfff71120321c4a","observation_id":"641dc217-8f70-4a9c-8a41-44fa90652d56","resolution":{"observed_at":"2026-08-12T05:36:10.281451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:10.647596Z","title":"Deep leakage from gradients","venue":null,"work_id":"d4f6632e-6567-4950-a644-46657cfcdf31","year":2019},"citing_paper":{"arxiv_id":"2412.00334","last_updated":"2025-08-31T12:40:53Z","snapshot_observed_at":"2026-08-12T22:17:11.660685Z","submitted_at":"2024-11-30T03:20:14Z","title":"EFTViT: Efficient Federated Training of Vision Transformers with Masked Images on Resource-Constrained Clients","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:10.285907Z"},"links":{"citing_paper":"/paper/2412.00334"},"observation_digest":"sha256:af76eaf8277c336e9b5f8836c4532320c44975ba9682e8e850d7c084bbd74f80","observation_id":"454e83d3-fb61-4e1d-8c87-939dc8b99fea","resolution":{"observed_at":"2026-08-12T05:36:10.652796Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:10.290281Z","title":"Vistorybench: Comprehensive benchmark suite for story visualization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2412.00334","last_updated":"2025-08-31T12:40:53Z","snapshot_observed_at":"2026-08-12T22:17:11.660685Z","submitted_at":"2024-11-30T03:20:14Z","title":"EFTViT: Efficient Federated Training of Vision Transformers with Masked Images on Resource-Constrained Clients","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:10.290281Z"},"links":{"citing_paper":"/paper/2412.00334"},"observation_digest":"sha256:55b371994dd1818dd45f49c125685df4faae1dbd9f7660ee011a47af7f615d61","observation_id":"0b41851e-1c3f-4fe9-8fef-f43ff38c3439","resolution":{"observed_at":"2026-08-12T05:36:10.290281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:10.668680Z","title":null,"venue":null,"work_id":"b5228ece-fdc6-4763-b07e-70f3ecac6df9","year":null},"citing_paper":{"arxiv_id":"2412.00334","last_updated":"2025-08-31T12:40:53Z","snapshot_observed_at":"2026-08-12T22:17:11.660685Z","submitted_at":"2024-11-30T03:20:14Z","title":"EFTViT: Efficient Federated Training of Vision Transformers with Masked Images on Resource-Constrained Clients","version":2},"reference_index":9977,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:10.269168Z"},"links":{"citing_paper":"/paper/2412.00334"},"observation_digest":"sha256:8ffd2590fdcac18c94506c4a441f70d2a9ad0ed98d22685a59fcb43b63e3f6c6","observation_id":"35fb401b-ac0a-4621-a6c6-bafac0c1a42d","resolution":{"observed_at":"2026-08-12T05:36:10.672604Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.00334","last_updated":"2025-08-31T12:40:53Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T22:17:11.660685Z","submitted_at":"2024-11-30T03:20:14Z","title":"EFTViT: Efficient Federated Training of Vision Transformers with Masked Images on Resource-Constrained Clients"},"reference_resolution":{"displayed":43,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":0,"verified_fuzzy":25},"total_outbound_references":43},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 43 of 43 outbound references and 0 inbound Pith citation observations for arXiv:2412.00334."}