{"as_of":"2026-08-10T00:29:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:70a23ee876c4f9f729d783e1dacc1b18af6f7aaca81eb6ee317e67777a80ef26","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:09:34.940377Z","state":"measured"},{"denominator":51,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":51,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.19928/citation-record","integrity":"/paper/2505.19928/integrity","json":"/paper/2505.19928/citation-record.json","paper":"/paper/2505.19928"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:29.486716Z","title":"In: ICCV","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-08T11:16:13.922243Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:29.486716Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:bab8a1d787dc97f3e17fa32bc944d66faf90f50be44ce2a1b3f83ccc834bc3fb","observation_id":"fbfb0680-d337-4d8c-a653-2412c604fd64","resolution":{"observed_at":"2026-08-07T14:09:29.486716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1607.06450","last_updated":"2016-07-21T19:57:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-07-21T19:57:52Z","title":"Layer Normalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1607.06450","snapshot_observed_at":"2026-08-07T14:09:29.591855Z","title":"arXiv preprint arXiv:1607.06450 (2016)","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-08T11:16:13.922243Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:29.591855Z"},"links":{"cited_paper":"/paper/1607.06450","citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:c7460c61e11fe3214612bdad45159096ccea67e99a67b1acc8eaa29af2a4394a","observation_id":"46e61675-bd29-4164-88ad-85c03a4d01f1","resolution":{"observed_at":"2026-08-07T14:09:29.591855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:39.899389Z","title":"In: International Conference of the Italian Association for Artificial Intelligence","venue":null,"work_id":"e8aa95be-36e5-4cfe-8f19-257e7831334a","year":2021},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-08T11:16:13.922243Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:29.714277Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:fe34165d704d5a3ab31cd41410e8681e161b2bd7ac7f849ec1de54a5b095a2a7","observation_id":"5021c6c2-4c4b-4725-bff2-b36ac5cb3465","resolution":{"observed_at":"2026-08-07T14:09:39.981875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:39.678957Z","title":"NeurIPS32(2019)","venue":null,"work_id":"3d445577-ad0c-452b-b2cd-0e46dc1fc0a5","year":2019},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-08T11:16:13.922243Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:29.822556Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:98cbdb58e7ea69a3143af691bad8516f8f2c952b0aba062ff173fa17796aaf75","observation_id":"313f5eca-e0c5-4f48-a4df-572a29498f12","resolution":{"observed_at":"2026-08-07T14:09:39.738286Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:29.956535Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-08T11:16:13.922243Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:29.956535Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:6bedadf01086d63c51973fb939dd8b538599d883d1a74d60b41e06bbd112a308","observation_id":"0ccb2e92-d69b-4a3a-9ca3-35cdf9e29eab","resolution":{"observed_at":"2026-08-07T14:09:29.956535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:39.509963Z","title":"In: ECCV","venue":null,"work_id":"5a2f1d65-3461-4743-a891-5eb0a501d330","year":2018},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-08T11:16:13.922243Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:30.045433Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:5475e961045aafda480b3bd5eaa71c711fc33a15996a4f449f4b6f3503a0164f","observation_id":"9b1b3ff9-9f42-4703-b561-594184628560","resolution":{"observed_at":"2026-08-07T14:09:39.590269Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.10509","last_updated":"2019-04-23T19:29:47Z","snapshot_observed_at":"2026-08-09T19:46:04.857927Z","submitted_at":"2019-04-23T19:29:47Z","title":"Generating Long Sequences with Sparse Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.10509","snapshot_observed_at":"2026-08-07T14:09:30.098726Z","title":"arXiv preprint arXiv:1904.10509 (2019)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-08T11:16:13.922243Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:30.098726Z"},"links":{"cited_paper":"/paper/1904.10509","citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:3dfa91453412091cd4d365d20fc3b1a09005a6a561bd98efcc840e5b58f147ce","observation_id":"9d9535ac-23cc-4b2b-89d4-c41582f8b8fa","resolution":{"observed_at":"2026-08-07T14:09:30.098726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1805.06085","last_updated":"2018-07-17T07:33:19Z","snapshot_observed_at":"2026-07-06T06:39:21.688392Z","submitted_at":"2018-05-16T01:19:43Z","title":"PACT: Parameterized Clipping Activation for Quantized Neural Networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.06085","snapshot_observed_at":"2026-08-07T14:09:30.185605Z","title":"arXiv preprint arXiv:1805.06085 (2018)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-08T11:16:13.922243Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:30.185605Z"},"links":{"cited_paper":"/paper/1805.06085","citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:8f53105761575450fcb915e2f6b485a16b428a5d99019e90a8446dbad9f1d335","observation_id":"dadcf6e0-6de0-43e4-8915-9f58f187b798","resolution":{"observed_at":"2026-08-07T14:09:30.185605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.14794","last_updated":"2022-11-19T12:45:21Z","snapshot_observed_at":"2026-08-08T20:36:21.234658Z","submitted_at":"2020-09-30T17:09:09Z","title":"Rethinking Attention with Performers","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.14794","snapshot_observed_at":"2026-08-07T14:09:30.367857Z","title":"arXiv preprint arXiv:2009.14794 (2020)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-08T11:16:13.922243Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:30.367857Z"},"links":{"cited_paper":"/paper/2009.14794","citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:188bb8561b1e553faa33c1b8d90e64829cc010d87e437677a52abb0bea35cf47","observation_id":"8e33402d-1f62-4f5e-9a4c-22682da0a8ee","resolution":{"observed_at":"2026-08-07T14:09:30.367857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:39.375579Z","title":"In: 2019 IEEE/CVF International Conference on Computer Vision Workshop (ICCVW)","venue":null,"work_id":"56029e9c-6635-4e86-b9e8-5e1458cfa605","year":2019},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-08T11:16:13.922243Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:30.486301Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:f65d952b695d14977b1f7c45e7422f2e913077e1c0113584e1be6f773eb1d730","observation_id":"e9102f5b-254b-4d5a-aab5-fbdf9cdcd390","resolution":{"observed_at":"2026-08-07T14:09:39.419445Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:39.243515Z","title":"In: CVPR","venue":null,"work_id":"396c676f-e3b5-4d27-b046-88e3151f75bb","year":2019},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-08T11:16:13.922243Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:30.561364Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:62d343d11c293842451fed1e1b2ce02aa457d357a38d28093dd17c871254e3dd","observation_id":"4fd76f17-f6be-41a4-a788-677b00b77253","resolution":{"observed_at":"2026-08-07T14:09:39.294769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-07T14:09:30.647439Z","title":"arXiv preprint arXiv:2010.11929 (2020)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-08T11:16:13.922243Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:30.647439Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:7b11b159c2fcd52c35d6067fb47f4184af3205e329694c4765a620f694b57e65","observation_id":"8a0801bc-3660-47b2-816d-a8b42c7b7398","resolution":{"observed_at":"2026-08-07T14:09:30.647439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:39.143143Z","title":"In: CVPR","venue":null,"work_id":"22d89eb9-7e12-4fd9-8de7-1f6f9a13d0ce","year":2018},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-08T11:16:13.922243Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:30.720520Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:5399fe947bb50af057aab138febf4b6400e73aa01cf8f24af3557e7b4c7b6da8","observation_id":"674fa736-c0e3-4887-87fa-a916ab41bb9c","resolution":{"observed_at":"2026-08-07T14:09:39.185011Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:39.015037Z","title":"In: CVPR","venue":null,"work_id":"cf5b2c30-2ed6-48be-9c20-858daf70c0d4","year":2020},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-08T11:16:13.922243Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:30.880079Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:687fe432d1db61ca98998e641e7546498596e169829fa27cc2588d59c071b255","observation_id":"57d6d1ee-7792-4b1b-9c9b-ccb68b62bdef","resolution":{"observed_at":"2026-08-07T14:09:39.086274Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:30.970044Z","title":"In: ICCV","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-08T11:16:13.922243Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:30.970044Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:daed9bc73a8fa834394506b7e7af9c476aa9a4de9a3a031b9e1fd3e62088d70f","observation_id":"c1e61fba-e00d-4c73-a6d2-bf26529f8e4c","resolution":{"observed_at":"2026-08-07T14:09:30.970044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.07485","last_updated":"2020-09-16T06:11:40Z","snapshot_observed_at":"2026-08-06T16:35:37.327006Z","submitted_at":"2020-09-16T06:11:40Z","title":"Pooling Methods in Deep Neural Networks, a Review","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.07485","snapshot_observed_at":"2026-08-07T14:09:31.094527Z","title":"arXiv preprint arXiv:2009.07485 (2020)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-08T11:16:13.922243Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:31.094527Z"},"links":{"cited_paper":"/paper/2009.07485","citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:580c58daec3924ea0f845f0e00269b0983b247e69c6d186fef037543925b2d14","observation_id":"0debf233-c7b9-42bf-84a9-2cfa3d57848f","resolution":{"observed_at":"2026-08-07T14:09:31.094527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:38.833123Z","title":"In: Low-Power Computer Vision, pp","venue":null,"work_id":"6ef29ace-217b-4a61-b6db-5694c3d62adb","year":2022},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-08T11:16:13.922243Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:31.199256Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:ee0f5abd887a908ecc79919fb8a958bf6301cad991ac1db8c1b2ed23c7727a5e","observation_id":"c491822f-e885-437c-bf68-54234abc3221","resolution":{"observed_at":"2026-08-07T14:09:38.905878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:31.347988Z","title":"In: CVPR","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-08T11:16:13.922243Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:31.347988Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:c68a98d3c97433bf120ebff0ba2f2b88c060965549543e1babfa75fc1cca9340","observation_id":"b1cfde9c-9aa5-43ac-a224-d5d9f5a54b20","resolution":{"observed_at":"2026-08-07T14:09:31.347988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:38.642017Z","title":"In: ECCV","venue":null,"work_id":"f8dbf5b8-c9c3-463c-8f6f-86de3ae2d696","year":2016},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-08T11:16:13.922243Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:31.410098Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:f6ae315fe833e654e8062643ab73881b213fc9ad60453eefbd247dae1287e497","observation_id":"c2961db8-5b11-4449-b511-afc1ea6fa3a1","resolution":{"observed_at":"2026-08-07T14:09:38.725043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1502.03167","last_updated":"2015-03-02T20:44:12Z","snapshot_observed_at":"2026-07-06T04:08:54.419941Z","submitted_at":"2015-02-11T01:44:18Z","title":"Batch Normalization: Accelerating Deep Network Training by Reducing Internal Covariate Shift","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1502.03167","snapshot_observed_at":"2026-08-07T14:09:31.484057Z","title":"arXiv preprint arXiv:1502.03167 (2015) 16 G","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-08T11:16:13.922243Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:31.484057Z"},"links":{"cited_paper":"/paper/1502.03167","citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:68b34993aeff2a414a594222cd8b99b6a64f14f2eb62652ebe96eea61affa4fd","observation_id":"f34f88d3-5618-4011-99d1-6a41850ffc4a","resolution":{"observed_at":"2026-08-07T14:09:31.484057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:38.538992Z","title":"In: CVPR","venue":null,"work_id":"b464ba11-4d98-4589-8656-ea1c1c94209b","year":2018},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-08T11:16:13.922243Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:31.565133Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:3bb63c4b26433cb13361d734f6d29f8063a29d5dc59dabe34e6df1390d50eeac","observation_id":"41dc9b39-7b51-4152-ba3a-fbfd2505c097","resolution":{"observed_at":"2026-08-07T14:09:38.587464Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:38.402120Z","title":"IEEE TPAMI35(1), 221–231 (2012)","venue":null,"work_id":"2c806da1-0162-4d40-bef6-48c352e48008","year":2012},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-08T11:16:13.922243Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:31.652388Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:eb91bf2b6c5931ddbb4dd79b641f474f9ddb41f0db49f2c19fdea5cc5dd1c5ca","observation_id":"ba1f5cca-f7ac-4ae8-a931-00575b1b0b4d","resolution":{"observed_at":"2026-08-07T14:09:38.474260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:38.177127Z","title":"In: CVPR","venue":null,"work_id":"f35f003f-23df-4a6d-aa2c-1976f3564a4e","year":2014},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-08T11:16:13.922243Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:31.741340Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:8d04d5d622d859483c078d80d005f3a8448c3a4cdbad4cddd220394897c92788","observation_id":"3b257bb1-d200-45e0-b619-e044d3c622ef","resolution":{"observed_at":"2026-08-07T14:09:38.305289Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-07T14:09:31.866045Z","title":"arXiv preprint arXiv:1705.06950 (2017)","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-08T11:16:13.922243Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:31.866045Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:feea4db089ef9bb64398bff5c42561e8e5b101c31116a019e558b63c83b5d2d9","observation_id":"4d403432-ecd7-42ff-a012-7cf19816face","resolution":{"observed_at":"2026-08-07T14:09:31.866045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1806.08342","last_updated":"2018-06-21T17:32:46Z","snapshot_observed_at":"2026-07-06T06:46:08.396066Z","submitted_at":"2018-06-21T17:32:46Z","title":"Quantizing deep convolutional networks for efficient inference: A whitepaper","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.08342","snapshot_observed_at":"2026-08-07T14:09:32.004751Z","title":"arXiv preprint arXiv:1806.08342 (2018)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-08T11:16:13.922243Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:32.004751Z"},"links":{"cited_paper":"/paper/1806.08342","citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:0c42fba67823503fa4f8b98f3cddf1a4b20a850c331de5c2d31e687b6c548049","observation_id":"e67622fe-af36-44e9-acca-2cd4c12418bf","resolution":{"observed_at":"2026-08-07T14:09:32.004751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:37.951498Z","title":"In: ICCV","venue":null,"work_id":"26fc54d6-1e19-4b63-ab5c-6198404b66b3","year":2011},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-08T11:16:13.922243Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:32.103386Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:d925b2926eb6f86cc415234ce39c609878b3d100632fff6d1a7e7f7eba63d7c2","observation_id":"8d205fd1-ace6-4fa0-8633-3b115a5c9c5c","resolution":{"observed_at":"2026-08-07T14:09:38.058347Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.16235","last_updated":"2023-07-30T13:57:25Z","snapshot_observed_at":"2026-07-06T16:00:20.878025Z","submitted_at":"2023-07-30T13:57:25Z","title":"Spiking Neural Networks and Bio-Inspired Supervised Deep Learning: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.16235","snapshot_observed_at":"2026-08-07T14:09:32.233122Z","title":"arXiv preprint arXiv:2307.16235 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-08T11:16:13.922243Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:32.233122Z"},"links":{"cited_paper":"/paper/2307.16235","citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:5bdb3d4e227a0a0f5aa968ed6019e436153ba947135a76372297c6bb6291334c","observation_id":"1ee15b79-b176-4761-892a-8458b2ceb590","resolution":{"observed_at":"2026-08-07T14:09:32.233122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.16236","last_updated":"2023-07-30T13:58:46Z","snapshot_observed_at":"2026-08-05T06:04:57.052616Z","submitted_at":"2023-07-30T13:58:46Z","title":"Synaptic Plasticity Models and Bio-Inspired Unsupervised Deep Learning: A Survey","version":1},"cited_work":{"arxiv_id":"2307.16236","doi":null,"metadata_source":"pith","pith_arxiv_id":"2307.16236","snapshot_observed_at":"2026-08-07T14:09:35.095595Z","title":"Synaptic Plasticity Models and Bio-Inspired Unsupervised Deep Learning: A Survey","venue":"cs.NE","work_id":"30424bff-16e0-41e7-8afa-eb533065a490","year":2023},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-08T11:16:13.922243Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:32.364738Z"},"links":{"cited_paper":"/paper/2307.16236","citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:19b1c8d271e3896c19e1b1d6ee0880112d979de514b3ac8198954f252b1b18ca","observation_id":"408de803-5924-4c9f-bd93-867c94aa970f","resolution":{"observed_at":"2026-08-07T14:09:35.175066Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.13492","last_updated":"2021-12-27T03:24:03Z","snapshot_observed_at":"2026-07-06T12:22:32.240903Z","submitted_at":"2021-12-27T03:24:03Z","title":"Vision Transformer for Small-Size Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.13492","snapshot_observed_at":"2026-08-07T14:09:32.434252Z","title":"arXiv preprint arXiv:2112.13492 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-08T11:16:13.922243Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:32.434252Z"},"links":{"cited_paper":"/paper/2112.13492","citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:bb392b72c41aafc25f698141e8ea26c0cb81611a1293bf4d03ecf55d0ed90576","observation_id":"ec011436-9703-4faf-ae61-36b73a01b100","resolution":{"observed_at":"2026-08-07T14:09:32.434252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.04676","last_updated":"2022-02-08T16:36:12Z","snapshot_observed_at":"2026-08-04T03:00:58.368363Z","submitted_at":"2022-01-12T20:02:32Z","title":"UniFormer: Unified Transformer for Efficient Spatiotemporal Representation Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.04676","snapshot_observed_at":"2026-08-07T14:09:32.515706Z","title":"arXiv preprint arXiv:2201.04676 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-08T11:16:13.922243Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:32.515706Z"},"links":{"cited_paper":"/paper/2201.04676","citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:1fe3348d8b2b1a6b6ed4ed04f803703ba3c27e96c04955024fc99f6c05e2eb55","observation_id":"319d4dc1-ee5e-40b3-b5d9-8145604c571d","resolution":{"observed_at":"2026-08-07T14:09:32.515706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09552","last_updated":"2022-11-17T14:17:40Z","snapshot_observed_at":"2026-08-07T04:39:25.258902Z","submitted_at":"2022-11-17T14:17:40Z","title":"UniFormerV2: Spatiotemporal Learning by Arming Image ViTs with Video UniFormer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09552","snapshot_observed_at":"2026-08-07T14:09:32.639342Z","title":"arXiv preprint arXiv:2211.09552 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-08T11:16:13.922243Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:32.639342Z"},"links":{"cited_paper":"/paper/2211.09552","citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:d84795065385984fab7474122d7c405c603058fe620a869b2d269036066174c8","observation_id":"f966cc04-5513-4b7b-ab90-7dd8676b441e","resolution":{"observed_at":"2026-08-07T14:09:32.639342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:32.726289Z","title":"In: ICCV","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-08T11:16:13.922243Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:32.726289Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:50d10537c40f2a6e1f83bd3f51ecb2fecde1155fa1e6402e80fdbf7789d58099","observation_id":"a2c247c6-af02-4324-a410-5031ac757656","resolution":{"observed_at":"2026-08-07T14:09:32.726289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:32.794477Z","title":"In: CVPR","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-08T11:16:13.922243Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:32.794477Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:e6509b6e914e6e05110d0b55b7e83ec9d23257f8a02ce92f5108ad265983d031","observation_id":"a5f8f6c5-2844-405e-992f-b10bf23fe0af","resolution":{"observed_at":"2026-08-07T14:09:32.794477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:37.722783Z","title":"In: ICML (2010)","venue":null,"work_id":"c4abde2e-ef88-43d0-bb17-c7198f6ce47c","year":2010},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-08T11:16:13.922243Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:32.916422Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:47aad67b93cfc451392fd31fe17ec8eda0f45f42c9610a53e4b6c5e477f49120","observation_id":"1c476740-b603-4863-8163-602ff0d4353c","resolution":{"observed_at":"2026-08-07T14:09:37.828535Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:37.411797Z","title":"In: WACV","venue":null,"work_id":"476f7d3e-f893-469b-9a05-a032caec4172","year":2018},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-08T11:16:13.922243Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:33.070620Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:3b3782d258865c02a11c71e0090bfe02d69d7bd3a0a32f3b785d9d522ba705e1","observation_id":"4558631e-01b6-4a07-b23a-c0beddfa92d8","resolution":{"observed_at":"2026-08-07T14:09:37.589480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:37.209512Z","title":"In: CVPR","venue":null,"work_id":"c7524be0-1c84-4b7a-9dd5-b30ef0587cf9","year":2023},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-08T11:16:13.922243Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:33.214074Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:2c4668f19528294c69898ac4afc77624bba299dc20886a77d558a02eecc720f0","observation_id":"8303b286-13d4-4627-af36-4c54535d790d","resolution":{"observed_at":"2026-08-07T14:09:37.287243Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13915","last_updated":"2021-05-27T13:17:38Z","snapshot_observed_at":"2026-07-06T10:53:21.486703Z","submitted_at":"2021-03-25T15:25:17Z","title":"An Image is Worth 16x16 Words, What is a Video Worth?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.13915","snapshot_observed_at":"2026-08-07T14:09:33.385463Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-08T11:16:13.922243Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:33.385463Z"},"links":{"cited_paper":"/paper/2103.13915","citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:4db5037acb769919f31fcfc43e2dbae7a19b7609649a850229be3324e26be123","observation_id":"3a9d2793-0b66-4b17-8c98-6e4c3a5ce66a","resolution":{"observed_at":"2026-08-07T14:09:33.385463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:36.854976Z","title":"NeurIPS27(2014)","venue":null,"work_id":"c4c75ef2-00dc-4104-b403-4f0d1063f0a0","year":2014},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-08T11:16:13.922243Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:33.521732Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:fece86ddac4534bc562faed00779b649b85061a7dfca32c956f6076ab49660a6","observation_id":"ab983d10-0b88-4ada-a17b-12853a5a2b18","resolution":{"observed_at":"2026-08-07T14:09:37.030499Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1212.0402","last_updated":"2012-12-03T14:45:31Z","snapshot_observed_at":"2026-07-06T03:01:10.229407Z","submitted_at":"2012-12-03T14:45:31Z","title":"UCF101: A Dataset of 101 Human Actions Classes From Videos in The Wild","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1212.0402","snapshot_observed_at":"2026-08-07T14:09:33.630531Z","title":"arXiv preprint arXiv:1212.0402 (2012)","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-08T11:16:13.922243Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:33.630531Z"},"links":{"cited_paper":"/paper/1212.0402","citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:5c1c27f764542661192780a2b0cbd865490333729d5ebf582b8e5fca5599cf7b","observation_id":"c10c3703-f51d-4476-862b-5a2f1bbda5ba","resolution":{"observed_at":"2026-08-07T14:09:33.630531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:36.696597Z","title":"JMLR15(1), 1929–1958 (2014)","venue":null,"work_id":"4eea48b5-65e5-43e9-ac2a-9b170119e977","year":2014},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-08T11:16:13.922243Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:33.739366Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:7556b1af6d7cb1d748841f89653de4e24fa6fbd9151166fd6317f66668c6983f","observation_id":"2aaa0ab8-352b-4a39-95c9-ff6d9f768bf0","resolution":{"observed_at":"2026-08-07T14:09:36.747133Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:36.462119Z","title":"In: WACV","venue":null,"work_id":"a2fd4b9b-7292-4373-994f-e2b97456dd57","year":2020},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-08T11:16:13.922243Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:33.852925Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:0fb8ada14e5aeb658b6281bf1d9e95444ffe9234641826813cd6bca5fba71200","observation_id":"835575a3-b2be-4a26-8369-54aa7d524513","resolution":{"observed_at":"2026-08-07T14:09:36.571031Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:36.260830Z","title":"In: CVPR","venue":null,"work_id":"bf14ba1a-d637-473e-9c21-487698066298","year":2018},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-08T11:16:13.922243Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:33.935324Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:794a66aecd0a5afb019c49b15cdcfb2dd1f30eb4647604e1892c96d2bdde6b57","observation_id":"c9f96cec-427b-4725-a600-8ed63be4c75b","resolution":{"observed_at":"2026-08-07T14:09:36.328356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:36.041474Z","title":"In: ICCV","venue":null,"work_id":"47b352af-2b56-4a4a-b5dc-e69ad224990e","year":2015},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-08T11:16:13.922243Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:34.057210Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:7a4822ad52cc956f3c62d790922d89874f59273fe11bc14b45dc5deb46b02348","observation_id":"7ec7fc2c-a4ec-4951-a17b-5e75c10954f8","resolution":{"observed_at":"2026-08-07T14:09:36.134016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:34.136609Z","title":"In: CVPR","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-08T11:16:13.922243Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:34.136609Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:d6de6d5499cb255389b2c82f4abec4cbd1dd701be7acba2e924de672c8ba6028","observation_id":"3abf51a1-b992-4091-9bf8-298c40cec3eb","resolution":{"observed_at":"2026-08-07T14:09:34.136609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:34.229292Z","title":"In: NeurIPS","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-08T11:16:13.922243Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:34.229292Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:e886b6bdc43e4171f7a4d90ef1fd33ea662411da6b72fd275e8740b34c5098fd","observation_id":"842db2de-0367-43cd-b224-9ac481e72ee5","resolution":{"observed_at":"2026-08-07T14:09:34.229292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.04768","last_updated":"2020-06-14T08:15:54Z","snapshot_observed_at":"2026-07-06T09:27:03.809621Z","submitted_at":"2020-06-08T17:37:52Z","title":"Linformer: Self-Attention with Linear Complexity","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.04768","snapshot_observed_at":"2026-08-07T14:09:34.348713Z","title":"arXiv preprint arXiv:2006.04768 (2020)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-08T11:16:13.922243Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:34.348713Z"},"links":{"cited_paper":"/paper/2006.04768","citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:30d72572933513977b833ce2e89ce309c96d8a7978d53537031c642f7734a8d5","observation_id":"6f1adbe7-8a57-4f46-a4a7-72cb882b780e","resolution":{"observed_at":"2026-08-07T14:09:34.348713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:34.535352Z","title":"In: CVPR","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-08T11:16:13.922243Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:34.535352Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:17f2ff501f5da4851057b4dbfce822eae320768eeb37fa6194f4a31a69d45511","observation_id":"a623655f-3da8-40bd-a609-4af8f0cd5717","resolution":{"observed_at":"2026-08-07T14:09:34.535352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:34.728541Z","title":"In: ECCV","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-08T11:16:13.922243Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:34.728541Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:81b9e7bae276eae16e03e0ae808efe85dcdeb6f6a794471e003f347683a1097c","observation_id":"91a6f65c-daf6-4e50-9c06-fe18d80261ae","resolution":{"observed_at":"2026-08-07T14:09:34.728541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:35.750407Z","title":"In: ECCV","venue":null,"work_id":"31b9f2d3-43d9-4abd-ae0d-577d06990e34","year":2018},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-08T11:16:13.922243Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:34.798904Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:597490c00d34029e231c4aa590e1f3427eeccd0e92d94e801e8fce6af432ce5b","observation_id":"1edd824e-98b0-4839-b559-b73b5f1652b1","resolution":{"observed_at":"2026-08-07T14:09:35.874670Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:35.541583Z","title":"In: ICCV","venue":null,"work_id":"1f9d724e-c909-48c8-a4b6-6c7702d4fb69","year":2021},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-08T11:16:13.922243Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:34.857735Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:9816224c9ae48ed9cb562719dc147198fa2fa79a9f77a3c2e80c50b54571f84c","observation_id":"78ce1614-cd34-448c-97f2-a3501edfd912","resolution":{"observed_at":"2026-08-07T14:09:35.629996Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:35.388883Z","title":"In: ACCV","venue":null,"work_id":"76e34020-64ad-4f7c-a826-4d653af2874e","year":2019},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-08T11:16:13.922243Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:34.940377Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:e3b11ffd4b573f7d263f720ccc23fd783d62a7762712bea6b78319f7f6e2e503","observation_id":"08a1b07e-a4b6-4992-87fa-0401b0016d48","resolution":{"observed_at":"2026-08-07T14:09:35.438246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T11:16:13.922243Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":26,"verified_exact":0,"verified_fuzzy":24},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 0 inbound Pith citation observations for arXiv:2505.19928."}