{"as_of":"2026-08-10T02:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:08cfb472afd6aa6fab7164354938df61bfcde424be6d65363061e02cbfa5bd70","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:54:27.043439Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.09345/citation-record","integrity":"/paper/2506.09345/integrity","json":"/paper/2506.09345/citation-record.json","paper":"/paper/2506.09345"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:31.703243Z","title":"In: APSIPA ASC","venue":null,"work_id":"2370e0a5-1ba6-42a3-8490-c5eaa3d60ea0","year":2018},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-09T17:08:43.901077Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:23.871963Z"},"links":{"citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:4f42b3094bb1647c05727c2db5a365b31932bce8e92a493420b081aaf055827e","observation_id":"4fe14c29-b171-48f0-b0d1-16568d4ac50f","resolution":{"observed_at":"2026-08-07T04:54:31.759941Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:24.039714Z","title":"In: ICCV","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-09T17:08:43.901077Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:24.039714Z"},"links":{"citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:8de54c930489fad43f3869589f41b19a7b2f204c0bf6df61be9a4ca3e2c3036d","observation_id":"1a61c004-ac5c-4fad-9a1f-a26918833a93","resolution":{"observed_at":"2026-08-07T04:54:24.039714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:31.557156Z","title":"Multimedia Tools and Applications78(5), 5919–5939 (2019)","venue":null,"work_id":"d39dc00e-40fc-4c85-96b2-b0d230d88693","year":2019},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-09T17:08:43.901077Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:24.199195Z"},"links":{"citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:42526e2e996323cc5aee99fdd9f087542dfc3f266f76b1e6610f42cd9bda1def","observation_id":"b57db0ac-b687-4ca3-9c2d-96a8a09f55b9","resolution":{"observed_at":"2026-08-07T04:54:31.604939Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:24.346148Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-09T17:08:43.901077Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:24.346148Z"},"links":{"citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:7d4ced5039a714d6173a622f4a83b4bd554efed9d301401d3e04ef36932ac378","observation_id":"82c3c276-8576-4b13-86d0-a6c9e3da55f9","resolution":{"observed_at":"2026-08-07T04:54:24.346148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:31.347265Z","title":"In: CVPR","venue":null,"work_id":"2cf2344c-c903-422b-b8ef-60f3ea2e4d65","year":2017},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-09T17:08:43.901077Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:24.446296Z"},"links":{"citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:a95c74f4b0262321ac52d5fe6409921af9f5b36c28fff990acc8aa2536b130ef","observation_id":"69d3dc0b-2477-4ec4-a651-45c794dc8903","resolution":{"observed_at":"2026-08-07T04:54:31.446583Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:31.147550Z","title":"Multimedia Tools and Applications76, 4405–4425 (2017)","venue":null,"work_id":"e25f4522-d22f-41b7-a947-de2da7570d03","year":2017},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-09T17:08:43.901077Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:24.496081Z"},"links":{"citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:728dca85d9860dc1c1a91e6a665467f7d0fbf43412482672eae2cba3aa2e14a9","observation_id":"bde8ed8f-195c-4150-9ee7-79acd655a524","resolution":{"observed_at":"2026-08-07T04:54:31.244149Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:30.939368Z","title":"IEEE Access10, 104190–104201 (2022)","venue":null,"work_id":"fd3c9cff-517a-4a72-9c97-a854c04629f2","year":2022},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-09T17:08:43.901077Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:24.595282Z"},"links":{"citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:cbba4e9e61ff9799753ec9e6dffc4203085f21d516ccf0be9b3ff71a27aa6f21","observation_id":"0dbe5243-bedb-40a5-8994-34d51d8cd441","resolution":{"observed_at":"2026-08-07T04:54:31.055072Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:24.666331Z","title":"In: CVPR (2009)","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-09T17:08:43.901077Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:24.666331Z"},"links":{"citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:055c7e781220c3d91b4bec519ad766ac31e1d13420a984371a6395ec35162aad","observation_id":"eaaf3268-cda9-4c74-a14c-2595284b78aa","resolution":{"observed_at":"2026-08-07T04:54:24.666331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:24.733977Z","title":"In: ICCV","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-09T17:08:43.901077Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:24.733977Z"},"links":{"citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:7326f146dc8c7309f147e160895911cb019b7cb9d1df081784e5687a3dd74958","observation_id":"22b4ce7f-335a-42a0-901f-4c3779c7c23c","resolution":{"observed_at":"2026-08-07T04:54:24.733977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:24.816336Z","title":"something something","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-09T17:08:43.901077Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:24.816336Z"},"links":{"citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:e89f8a8dea510f04f4df6091973f0feba9dbcc06026e6d5665a5e1d6f0d1c832","observation_id":"3082a3fa-579c-4d56-837c-f45f40d6e0ea","resolution":{"observed_at":"2026-08-07T04:54:24.816336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:24.908790Z","title":"In: CVPR","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-09T17:08:43.901077Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:24.908790Z"},"links":{"citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:4fb13dc7b1446b8541b336d8dab612823390a1b37d0e786781d91f0298b752b3","observation_id":"c637523f-2e7f-424a-9e90-e18e4d9ae004","resolution":{"observed_at":"2026-08-07T04:54:24.908790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1704.04861","last_updated":"2017-04-17T03:57:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-04-17T03:57:34Z","title":"MobileNets: Efficient Convolutional Neural Networks for Mobile Vision Applications","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1704.04861","snapshot_observed_at":"2026-08-07T04:54:24.982062Z","title":"arXiv preprint arXiv:1704.04861 (2017)","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-09T17:08:43.901077Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:24.982062Z"},"links":{"cited_paper":"/paper/1704.04861","citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:aacfa3ea8ed576dd8ca6ae7d161697119426e76a589d3a1564db9807e1d09fe0","observation_id":"9e37068c-72a1-4e57-b4bf-d3515bdd28ed","resolution":{"observed_at":"2026-08-07T04:54:24.982062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05407","last_updated":"2019-02-25T14:18:11Z","snapshot_observed_at":"2026-07-31T19:09:21.589864Z","submitted_at":"2018-03-14T17:09:27Z","title":"Averaging Weights Leads to Wider Optima and Better Generalization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05407","snapshot_observed_at":"2026-08-07T04:54:25.055016Z","title":"arXiv preprint arXiv:1803.05407 (2018)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-09T17:08:43.901077Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:25.055016Z"},"links":{"cited_paper":"/paper/1803.05407","citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:b2225d96309ca78bf64a12a0aca2b77749ab06a233ba79f36d17b3245af3dda2","observation_id":"873f5fc0-4b4b-487a-a8a5-d93ba12470bc","resolution":{"observed_at":"2026-08-07T04:54:25.055016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:30.746574Z","title":null,"venue":null,"work_id":"7ec16d0f-18c7-486d-b4be-6677ec3aa80c","year":2017},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-09T17:08:43.901077Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:25.106019Z"},"links":{"citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:752b84b81609a3ad27c8ffd2c618547d99f48490c662e8f48e49735ef1c778af","observation_id":"badcc80c-c2a7-43b1-a17b-11ec095f566f","resolution":{"observed_at":"2026-08-07T04:54:30.811448Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-07T04:54:25.206721Z","title":"arXiv preprint arXiv:1705.06950 (2017)","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-09T17:08:43.901077Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:25.206721Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:d4f89551eddac8e57e767ec0ae2963f01e85c16a5f4669b2e0467c45022bc0da","observation_id":"13db4fce-59e6-42a7-8ac1-851c85ea78b3","resolution":{"observed_at":"2026-08-07T04:54:25.206721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:30.553654Z","title":"In: ICCV","venue":null,"work_id":"0271c2f6-4fd5-4317-973d-fe0d80e8cbd4","year":2019},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-09T17:08:43.901077Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:25.311624Z"},"links":{"citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:d6337741b5fea9e34249d4998f75900fec1a70caf5309adce1694bc51c714d9d","observation_id":"e207bfd6-5db2-4ab9-9b16-b870150c2458","resolution":{"observed_at":"2026-08-07T04:54:30.641980Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:30.353207Z","title":"In: MICCAI Challenge on Fast and Low-Resource Semi-supervised Abdominal Organ Segmentation, pp","venue":null,"work_id":"6bf24cc9-35c4-418b-b313-cb24e3cf2714","year":2023},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-09T17:08:43.901077Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:25.399559Z"},"links":{"citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:8b1817aea743305ee7ebb75b7911447c14bfa80317ba0fabcb161567ef4dc960","observation_id":"4681c983-a592-4baa-9117-33c64a77256b","resolution":{"observed_at":"2026-08-07T04:54:30.447986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:30.156739Z","title":"IJCV118, 217–239 (2016)","venue":null,"work_id":"c7c20cd3-d3b2-490d-b0a7-d58ce1b641a0","year":2016},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-09T17:08:43.901077Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:25.468009Z"},"links":{"citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:cf1d39c742eac6edd5ff16f6f1d7a5a16b0ffe576c3786f8f4e970c955149610","observation_id":"93bfa269-5f4f-47c9-8d27-247edc150b2e","resolution":{"observed_at":"2026-08-07T04:54:30.264906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:29.991162Z","title":"NIPS27(2014)","venue":null,"work_id":"579e6212-7a0c-4332-b3da-12cfa7151a96","year":2014},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-09T17:08:43.901077Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:25.561044Z"},"links":{"citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:3b05ef9ab9b9d1addea9b61d19ec6c912bcb59128db86ae84192d6e263751e17","observation_id":"ad7b5a69-5544-4163-9911-0a19bbfb3936","resolution":{"observed_at":"2026-08-07T04:54:30.069230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:29.819313Z","title":"In: ICME","venue":null,"work_id":"651aff93-83bb-409b-ad14-64c34df8e51c","year":2018},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-09T17:08:43.901077Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:25.662260Z"},"links":{"citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:9e777c7184a52edcb6ad3050a68af3dcc01de22d67cd2619d4dc712517365ed0","observation_id":"da6ba0d6-bb6e-4172-ac97-ae0546d47fb4","resolution":{"observed_at":"2026-08-07T04:54:29.893835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:29.630306Z","title":"TPAMI45(3), 3200–3225 (2022)","venue":null,"work_id":"6b06933e-e4ad-4884-a853-428ea17e9a8a","year":2022},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-09T17:08:43.901077Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:25.743831Z"},"links":{"citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:a27076cf95ea8bba993ab0dd0a2a43552a9e5349b0482f18fa8bc3494d09b2ed","observation_id":"69632de9-57e4-4ade-bcaa-17465aeac7e7","resolution":{"observed_at":"2026-08-07T04:54:29.732371Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:29.446240Z","title":"In: CVPR","venue":null,"work_id":"7a037e9b-6699-4564-9be5-6c846b2e2e2a","year":2018},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-09T17:08:43.901077Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:25.847532Z"},"links":{"citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:2532296a9b215eb8865a753c61b5a8ad97fbf38e6cbe2702f82a1056a03a2922","observation_id":"0cdcc82b-a5da-4da4-a988-9519da0dd83a","resolution":{"observed_at":"2026-08-07T04:54:29.537036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:29.278770Z","title":"In: ICMEW","venue":null,"work_id":"d9d4bf86-3acb-4895-9bc2-5b25c21c07b4","year":2024},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-09T17:08:43.901077Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:25.914545Z"},"links":{"citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:092d50bf6d3ef272b24900f713eebb38c1d2812a2b70c3a1e674aa5db04d07e6","observation_id":"13a193a2-97c5-4f59-b854-620a38035930","resolution":{"observed_at":"2026-08-07T04:54:29.350965Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:29.116206Z","title":"IEEE Access11, 53880–53898 (2023) An Effective End-to-End Solution for Multimodal Action Recognition 15","venue":null,"work_id":"1227e6a9-a638-4cef-b1fd-e227aea7b441","year":2023},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-09T17:08:43.901077Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:25.980290Z"},"links":{"citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:f72d696e6b89194f93d94318a4b23b97213931de2b2885e61c4f26fdb8105e89","observation_id":"9e37f9f4-5f0d-43f0-b97e-9edcd578d29f","resolution":{"observed_at":"2026-08-07T04:54:29.193124Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:28.928228Z","title":"In: ECCV","venue":null,"work_id":"7d4c8169-77d3-4415-829d-c149f4d5cecf","year":2016},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-09T17:08:43.901077Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:26.059553Z"},"links":{"citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:ce5741b2ce3bc624654322de0b08ebb2123fd540c107e1b828637d781b6b3af5","observation_id":"19f1807b-06ea-494d-b2fd-6664e96a985a","resolution":{"observed_at":"2026-08-07T04:54:29.001583Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.14921","last_updated":"2025-04-23T13:22:33Z","snapshot_observed_at":"2026-07-06T21:12:23.428174Z","submitted_at":"2025-04-21T07:40:35Z","title":"Fast Adversarial Training with Weak-to-Strong Spatial-Temporal Consistency in the Frequency Domain on Videos","version":2},"cited_work":{"arxiv_id":"2504.14921","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.14921","snapshot_observed_at":"2026-08-07T04:54:27.760088Z","title":"Fast Adversarial Training with Weak-to-Strong Spatial-Temporal Consistency in the Frequency Domain on Videos","venue":"cs.CV","work_id":"1ad4b7ca-d92c-4855-a6ef-774e1db6a687","year":2025},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-09T17:08:43.901077Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:26.160531Z"},"links":{"cited_paper":"/paper/2504.14921","citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:d927b4aa3520068ce22f79a6304e0d66b1e679b2ca9b18f6353665835d08da13","observation_id":"819dd40b-0048-4e1b-bdfd-d3215bb5c135","resolution":{"observed_at":"2026-08-07T04:54:27.915070Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:28.768615Z","title":"In: 2024 IEEE International Conference on Multimedia and Expo (ICME)","venue":null,"work_id":"d455b431-0a28-4768-97e7-9f6416808097","year":2024},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-09T17:08:43.901077Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:26.223903Z"},"links":{"citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:4ab06e70976992d7e9f070bb51f1ed55b40c169425eeefe93ad2e78e43cff14c","observation_id":"9a512df5-362e-4ab6-ab00-7ebcc5c493be","resolution":{"observed_at":"2026-08-07T04:54:28.847086Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.12129","last_updated":"2025-04-23T13:23:07Z","snapshot_observed_at":"2026-07-06T21:10:22.737231Z","submitted_at":"2025-04-16T14:44:00Z","title":"Anti-Aesthetics: Protecting Facial Privacy against Customized Text-to-Image Synthesis","version":2},"cited_work":{"arxiv_id":"2504.12129","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.12129","snapshot_observed_at":"2026-08-07T04:54:27.587320Z","title":"Anti-Aesthetics: Protecting Facial Privacy against Customized Text-to-Image Synthesis","venue":"cs.CV","work_id":"8793b2fc-8b34-4120-8f3c-b80779a11a0f","year":2025},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-09T17:08:43.901077Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:26.336250Z"},"links":{"cited_paper":"/paper/2504.12129","citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:ff95f8e0375f79e4ccd8497742c1d53138422e9ff08313b1c8aa921c59a39505","observation_id":"5595516f-0638-4721-8c25-350ac0ba2189","resolution":{"observed_at":"2026-08-07T04:54:27.664544Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:28.590661Z","title":"In: International Conference on Pattern Recogni- tion","venue":null,"work_id":"aa1fea56-6667-4b7a-b71b-6973616e2cd9","year":2025},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-09T17:08:43.901077Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:26.434695Z"},"links":{"citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:3c2e188ea6eeac89ac6386d1917d5bb55ebe7366ebef0d5d6f8e2c43fee8872d","observation_id":"635748f3-d044-4b65-802a-1eb7ee39af49","resolution":{"observed_at":"2026-08-07T04:54:28.646648Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06276","last_updated":"2025-04-23T13:22:55Z","snapshot_observed_at":"2026-07-06T20:49:09.368757Z","submitted_at":"2025-03-08T16:48:05Z","title":"Exploring Adversarial Transferability between Kolmogorov-arnold Networks","version":2},"cited_work":{"arxiv_id":"2503.06276","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.06276","snapshot_observed_at":"2026-08-07T04:54:27.398699Z","title":"Exploring Adversarial Transferability between Kolmogorov-arnold Networks","venue":"cs.CV","work_id":"110b15f7-eb1f-40df-b1c8-feb1d31d315f","year":2025},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-09T17:08:43.901077Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:26.537712Z"},"links":{"cited_paper":"/paper/2503.06276","citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:b829e8b6ec58d5262a8a13bd872a26e96cfdead18d0158bf1ea3dc7eaf44d9b7","observation_id":"3a460653-485c-4ccd-a95c-dbe3313037ee","resolution":{"observed_at":"2026-08-07T04:54:27.490087Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:26.630591Z","title":"In: CVPR","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-09T17:08:43.901077Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:26.630591Z"},"links":{"citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:4b070476e117c1ddfbb9c3093afab70781eeaa06de3a4acc04631700150dec72","observation_id":"3f373856-cdb2-4ecc-94e6-88005e1a88be","resolution":{"observed_at":"2026-08-07T04:54:26.630591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:28.385771Z","title":"IEEE Transactions on Pattern Analysis and Machine Intelligence45(9), 10898–10912 (2023)","venue":null,"work_id":"603d8a67-9f13-407e-b071-7f58017d6dd7","year":2023},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-09T17:08:43.901077Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:26.744900Z"},"links":{"citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:ba3327c4d78661a6f85ecaf863a661ea7299818ebcbb28eec2e96a009818c788","observation_id":"5fc7628d-713a-48a3-8ddf-4f69b39ee8cb","resolution":{"observed_at":"2026-08-07T04:54:28.484481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:28.232783Z","title":"In: ECCV","venue":null,"work_id":"4f3b2c33-08d7-4544-a02d-baeef69c3a1a","year":2018},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-09T17:08:43.901077Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:26.808139Z"},"links":{"citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:b068d2f3786ef70f3f518170bc54af410c4c9cd99adaccb1e653b0578c317314","observation_id":"0a9f75b2-1cad-40ce-9211-228bb2790f83","resolution":{"observed_at":"2026-08-07T04:54:28.318373Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.00896","last_updated":"2023-03-27T01:57:56Z","snapshot_observed_at":"2026-08-09T20:11:47.111085Z","submitted_at":"2023-01-03T00:28:57Z","title":"Efficient Robustness Assessment via Adversarial Spatial-Temporal Focus on Videos","version":2},"cited_work":{"arxiv_id":"2301.00896","doi":null,"metadata_source":"pith","pith_arxiv_id":"2301.00896","snapshot_observed_at":"2026-08-07T04:54:27.195087Z","title":"Efficient Robustness Assessment via Adversarial Spatial-Temporal Focus on Videos","venue":"cs.CV","work_id":"b1224f83-969d-4d56-bd0e-d775c08b9853","year":2023},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-09T17:08:43.901077Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:26.879331Z"},"links":{"cited_paper":"/paper/2301.00896","citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:983788d9572f4887a3fe52dd90139fb989cfdb7dc3640ba398480b44193977c9","observation_id":"c7f35bfb-411d-4dbf-aaad-59f1b9dbc9db","resolution":{"observed_at":"2026-08-07T04:54:27.303619Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.04867","last_updated":"2020-02-21T13:36:15Z","snapshot_observed_at":"2026-08-09T06:48:42.729935Z","submitted_at":"2019-10-01T17:06:29Z","title":"A Large-scale Study of Representation Learning with the Visual Task Adaptation Benchmark","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.04867","snapshot_observed_at":"2026-08-07T04:54:26.953389Z","title":"arXiv preprint arXiv:1910.04867 (2019)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-09T17:08:43.901077Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:26.953389Z"},"links":{"cited_paper":"/paper/1910.04867","citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:0a21f7edd308ef8b8bd9755002b8b47d8a57d2b2b327b7d38aac7d8c08f4a6b0","observation_id":"b3764f9d-060d-49ab-96b2-57ffe4888b84","resolution":{"observed_at":"2026-08-07T04:54:26.953389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:28.069648Z","title":"TOMM 18(3), 1–24 (2022)","venue":null,"work_id":"f628bf04-42da-4579-8e07-b1344f2b2dd2","year":2022},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-09T17:08:43.901077Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:27.043439Z"},"links":{"citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:1fff016f275d1295e712bd0b29536eeb797e6d158b25469434ba8cd0a3537adc","observation_id":"21e3699c-b928-43e3-843b-2ef8ebe4225f","resolution":{"observed_at":"2026-08-07T04:54:28.140159Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T17:08:43.901077Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":4,"parse_uncertain":0,"unresolved":12,"verified_exact":0,"verified_fuzzy":20},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 0 inbound Pith citation observations for arXiv:2506.09345."}