{"as_of":"2026-08-22T10:31:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:49a1155394c274ffed75f162c98640aaaeacf0b8ee159b3ed17c8e0b0cfefe2c","coverage":[{"denominator":17,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":17,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:39:47.435799Z","state":"measured"},{"denominator":17,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":17,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.01757/citation-record","integrity":"/paper/2506.01757/integrity","json":"/paper/2506.01757/citation-record.json","paper":"/paper/2506.01757"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:40:11.707602Z","title":"Symmetric sub-graph spatio-temporal graph convolution and its application in complex activity recognition","venue":null,"work_id":"766ecfc3-29ed-4c81-b52b-45f9644ec38f","year":2021},"citing_paper":{"arxiv_id":"2506.01757","last_updated":"2025-06-02T15:04:23Z","snapshot_observed_at":"2026-08-13T12:11:37.739219Z","submitted_at":"2025-06-02T15:04:23Z","title":"Efficient Egocentric Action Recognition with Multimodal Data","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T11:38:50.051655Z"},"links":{"citing_paper":"/paper/2506.01757"},"observation_digest":"sha256:8b98766b2b8c0431d63f40679ef5c4fd78b2db83ee856b563fe59d137ab29752","observation_id":"3f3e0ee6-6946-4e6a-8ae8-64d936fff3e0","resolution":{"observed_at":"2026-08-07T11:40:11.807748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:40:10.039785Z","title":"Avatars grow legs: Generating smooth human motion from sparse tracking in- puts with diffusion model","venue":null,"work_id":"08afbf7c-ce5e-4ade-9072-e809a8bc635a","year":2023},"citing_paper":{"arxiv_id":"2506.01757","last_updated":"2025-06-02T15:04:23Z","snapshot_observed_at":"2026-08-13T12:11:37.739219Z","submitted_at":"2025-06-02T15:04:23Z","title":"Efficient Egocentric Action Recognition with Multimodal Data","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:38:51.029276Z"},"links":{"citing_paper":"/paper/2506.01757"},"observation_digest":"sha256:5aa62e39c8838af36c8a24d69689a6649a20aa1dbaf63e75219082631cb3b64a","observation_id":"b11ea7eb-3137-4d39-be53-5b9c5ac7ff03","resolution":{"observed_at":"2026-08-07T11:40:11.502806Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:40:09.908917Z","title":"What would you expect? anticipating egocentric actions with rolling- unrolling lstms and modality attention","venue":null,"work_id":"0dc7ed3c-efee-45b9-a267-a34856785011","year":2019},"citing_paper":{"arxiv_id":"2506.01757","last_updated":"2025-06-02T15:04:23Z","snapshot_observed_at":"2026-08-13T12:11:37.739219Z","submitted_at":"2025-06-02T15:04:23Z","title":"Efficient Egocentric Action Recognition with Multimodal Data","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T11:38:53.660511Z"},"links":{"citing_paper":"/paper/2506.01757"},"observation_digest":"sha256:ace418be2f7bc30de518ac641540b2ace3799e3ddcc23faca1565ed88578d647","observation_id":"c645f8be-a0a5-4b0b-8ebc-828cbfe46ec9","resolution":{"observed_at":"2026-08-07T11:40:09.939297Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:40:09.785320Z","title":"Levit: a vision transformer in convnet’s clothing for faster inference","venue":null,"work_id":"ae9bad37-8d12-4e45-b344-6debd5c031a1","year":null},"citing_paper":{"arxiv_id":"2506.01757","last_updated":"2025-06-02T15:04:23Z","snapshot_observed_at":"2026-08-13T12:11:37.739219Z","submitted_at":"2025-06-02T15:04:23Z","title":"Efficient Egocentric Action Recognition with Multimodal Data","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T11:39:46.246685Z"},"links":{"citing_paper":"/paper/2506.01757"},"observation_digest":"sha256:85c3ac5aaf59aa85989d059569f82a521e67bb2055ae671a68b426b2caf6dd33","observation_id":"1ed631a9-c3de-4ec2-b618-7cd3749929bc","resolution":{"observed_at":"2026-08-07T11:40:09.869444Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-08-16T18:00:58.008096Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-07T11:39:46.341840Z","title":"Distill- ing the knowledge in a neural network","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.01757","last_updated":"2025-06-02T15:04:23Z","snapshot_observed_at":"2026-08-13T12:11:37.739219Z","submitted_at":"2025-06-02T15:04:23Z","title":"Efficient Egocentric Action Recognition with Multimodal Data","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T11:39:46.341840Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2506.01757"},"observation_digest":"sha256:4a18e0cab38b507ab4865763dd71b1b094ee18890d0d5c924b3d1df1315ea2df","observation_id":"7ce97a0e-7f1d-4fc4-b3c3-70caf2ad2627","resolution":{"observed_at":"2026-08-07T11:39:46.341840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:40:09.322980Z","title":"Object detection- based location and activity classification from egocentric videos: A systematic analysis","venue":null,"work_id":"e49071d4-134b-4dae-810c-93218147712c","year":null},"citing_paper":{"arxiv_id":"2506.01757","last_updated":"2025-06-02T15:04:23Z","snapshot_observed_at":"2026-08-13T12:11:37.739219Z","submitted_at":"2025-06-02T15:04:23Z","title":"Efficient Egocentric Action Recognition with Multimodal Data","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T11:39:46.439381Z"},"links":{"citing_paper":"/paper/2506.01757"},"observation_digest":"sha256:f87f6899fcfcd9670214f4c05c5d24e5ff903651c67f20f1bb3d3cf27e57d629","observation_id":"f38d1923-78ed-4f6d-9e7c-390caa507590","resolution":{"observed_at":"2026-08-07T11:40:09.643750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:40:07.109316Z","title":"H2o: Two hands manipulating objects for first person interaction recognition","venue":null,"work_id":"2cd3f9c2-87a5-49ba-9f84-c100c40be29f","year":2021},"citing_paper":{"arxiv_id":"2506.01757","last_updated":"2025-06-02T15:04:23Z","snapshot_observed_at":"2026-08-13T12:11:37.739219Z","submitted_at":"2025-06-02T15:04:23Z","title":"Efficient Egocentric Action Recognition with Multimodal Data","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T11:39:46.532798Z"},"links":{"citing_paper":"/paper/2506.01757"},"observation_digest":"sha256:fc9160ee9470f080fda7627c56553c272a3de73d875f1324d850d4c095c97189","observation_id":"516502a6-3c90-42da-b8d9-ea573d4596ac","resolution":{"observed_at":"2026-08-07T11:40:08.044797Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:39:53.214493Z","title":null,"venue":null,"work_id":"6b1775da-0e42-4cc6-90ca-bae7c2e0aea4","year":2018},"citing_paper":{"arxiv_id":"2506.01757","last_updated":"2025-06-02T15:04:23Z","snapshot_observed_at":"2026-08-13T12:11:37.739219Z","submitted_at":"2025-06-02T15:04:23Z","title":"Efficient Egocentric Action Recognition with Multimodal Data","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T11:39:46.600410Z"},"links":{"citing_paper":"/paper/2506.01757"},"observation_digest":"sha256:097ba72ef248ea1562a0e9149028e85f99cb47dc90d3c38b8c43bb8505e59607","observation_id":"a7c229e4-8dfb-4aad-9a81-d226cd4a482e","resolution":{"observed_at":"2026-08-07T11:39:53.375353Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:39:52.939234Z","title":"Detecting activi- ties of daily living in first-person camera views","venue":null,"work_id":"b0c8eec2-5f76-4266-b4be-3f19336413f1","year":2012},"citing_paper":{"arxiv_id":"2506.01757","last_updated":"2025-06-02T15:04:23Z","snapshot_observed_at":"2026-08-13T12:11:37.739219Z","submitted_at":"2025-06-02T15:04:23Z","title":"Efficient Egocentric Action Recognition with Multimodal Data","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T11:39:46.703916Z"},"links":{"citing_paper":"/paper/2506.01757"},"observation_digest":"sha256:b20ff5bef6e7f32b58dacde42e211633335e42f5991f454a623987bb45bc09cf","observation_id":"2dc08446-bfa0-4498-86d4-e5cc2876e09c","resolution":{"observed_at":"2026-08-07T11:39:53.018600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:39:46.785014Z","title":"Designing network design spaces","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.01757","last_updated":"2025-06-02T15:04:23Z","snapshot_observed_at":"2026-08-13T12:11:37.739219Z","submitted_at":"2025-06-02T15:04:23Z","title":"Efficient Egocentric Action Recognition with Multimodal Data","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T11:39:46.785014Z"},"links":{"citing_paper":"/paper/2506.01757"},"observation_digest":"sha256:fbbc405df98a465739dd045949d653928f111415aa2f6a772de73b774b6c08a6","observation_id":"4c34fcf6-c1e3-4892-a001-8cb14f8a23dd","resolution":{"observed_at":"2026-08-07T11:39:46.785014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:39:52.562558Z","title":"On the utility of 3d hand poses for action recognition","venue":null,"work_id":"98b75e18-f047-49a9-91b9-f72aa1ddf5cc","year":2025},"citing_paper":{"arxiv_id":"2506.01757","last_updated":"2025-06-02T15:04:23Z","snapshot_observed_at":"2026-08-13T12:11:37.739219Z","submitted_at":"2025-06-02T15:04:23Z","title":"Efficient Egocentric Action Recognition with Multimodal Data","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T11:39:46.848276Z"},"links":{"citing_paper":"/paper/2506.01757"},"observation_digest":"sha256:8464285d2bdf546b261065b72d6e03cdbcea89c0deb3534b00a6457ebbc95f7d","observation_id":"b9396302-902f-4b2f-b10f-1993a39383de","resolution":{"observed_at":"2026-08-07T11:39:52.771809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:39:52.405979Z","title":"Convolutional lstm network: A machine learning approach for precipitation nowcasting","venue":null,"work_id":"1fd41fbd-6d07-455d-be8b-329b2e1dd95c","year":2015},"citing_paper":{"arxiv_id":"2506.01757","last_updated":"2025-06-02T15:04:23Z","snapshot_observed_at":"2026-08-13T12:11:37.739219Z","submitted_at":"2025-06-02T15:04:23Z","title":"Efficient Egocentric Action Recognition with Multimodal Data","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T11:39:46.916905Z"},"links":{"citing_paper":"/paper/2506.01757"},"observation_digest":"sha256:a3235465acc9a10808679049160e081ee693975cad246983562b1dcfafd528d2","observation_id":"b0a4d25c-844a-433c-ab87-95ebc459548c","resolution":{"observed_at":"2026-08-07T11:39:52.465269Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:39:52.266587Z","title":"Two-stream con- volutional networks for action recognition in videos","venue":null,"work_id":"34cc30a0-378b-46fc-9a23-7a56e5c40fc6","year":2014},"citing_paper":{"arxiv_id":"2506.01757","last_updated":"2025-06-02T15:04:23Z","snapshot_observed_at":"2026-08-13T12:11:37.739219Z","submitted_at":"2025-06-02T15:04:23Z","title":"Efficient Egocentric Action Recognition with Multimodal Data","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T11:39:46.953874Z"},"links":{"citing_paper":"/paper/2506.01757"},"observation_digest":"sha256:32f1f7e2e0820340b0c19fa095bf37bfa6cf22d71738aefa340892b46ff18ba8","observation_id":"47fdd9d5-f6e6-4d0a-aa23-6fcfd1f2c9bc","resolution":{"observed_at":"2026-08-07T11:39:52.330510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:39:52.106495Z","title":"Convolutional long short-term memory networks for recognizing first per- son interactions","venue":null,"work_id":"9e6877de-4658-4db8-a005-d9e623a67c56","year":2017},"citing_paper":{"arxiv_id":"2506.01757","last_updated":"2025-06-02T15:04:23Z","snapshot_observed_at":"2026-08-13T12:11:37.739219Z","submitted_at":"2025-06-02T15:04:23Z","title":"Efficient Egocentric Action Recognition with Multimodal Data","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T11:39:46.968419Z"},"links":{"citing_paper":"/paper/2506.01757"},"observation_digest":"sha256:e41fa8916ff0a608fbca6e25c5038812e0a4abb182c6159239dd520ba7d73cfd","observation_id":"f23fc727-1b6f-4e00-accb-497998304f5d","resolution":{"observed_at":"2026-08-07T11:39:52.179259Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1807.11794","last_updated":"2018-07-31T12:54:06Z","snapshot_observed_at":"2026-08-14T18:46:01.393897Z","submitted_at":"2018-07-31T12:54:06Z","title":"Attention is All We Need: Nailing Down Object-centric Attention for Egocentric Activity Recognition","version":1},"cited_work":{"arxiv_id":"1807.11794","doi":null,"metadata_source":"pith","pith_arxiv_id":"1807.11794","snapshot_observed_at":"2026-08-07T11:39:47.528496Z","title":"Attention is All We Need: Nailing Down Object-centric Attention for Egocentric Activity Recognition","venue":"cs.CV","work_id":"7d94f317-b880-4011-865c-a20cc386614b","year":2018},"citing_paper":{"arxiv_id":"2506.01757","last_updated":"2025-06-02T15:04:23Z","snapshot_observed_at":"2026-08-13T12:11:37.739219Z","submitted_at":"2025-06-02T15:04:23Z","title":"Efficient Egocentric Action Recognition with Multimodal Data","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T11:39:47.127877Z"},"links":{"cited_paper":"/paper/1807.11794","citing_paper":"/paper/2506.01757"},"observation_digest":"sha256:19673fd3264cc7cb9e0bcd790da16a9144b78e574e352afcecd3aa94613029df","observation_id":"698690a4-ebe7-47b2-80d9-2c727c70ff5e","resolution":{"observed_at":"2026-08-07T11:39:47.677342Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:39:51.889526Z","title":"Holoassist: an egocentric human interaction dataset for interactive ai assistants in the real world","venue":null,"work_id":"f4262c90-1b34-4f35-8f5e-e06412cb4213","year":2023},"citing_paper":{"arxiv_id":"2506.01757","last_updated":"2025-06-02T15:04:23Z","snapshot_observed_at":"2026-08-13T12:11:37.739219Z","submitted_at":"2025-06-02T15:04:23Z","title":"Efficient Egocentric Action Recognition with Multimodal Data","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T11:39:47.302341Z"},"links":{"citing_paper":"/paper/2506.01757"},"observation_digest":"sha256:6057dd0aa6f22e3663053ace0a09836fcba3451b3b4ef2cbc3aa23056288d018","observation_id":"df9a95ff-65a0-4fe1-b40c-b0b457a6cc12","resolution":{"observed_at":"2026-08-07T11:39:51.998471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:39:49.621599Z","title":"Spatial tempo- ral graph convolutional networks for skeleton-based action recognition","venue":null,"work_id":"130e350d-64d1-4ebe-aa79-fa91ceddbc10","year":2018},"citing_paper":{"arxiv_id":"2506.01757","last_updated":"2025-06-02T15:04:23Z","snapshot_observed_at":"2026-08-13T12:11:37.739219Z","submitted_at":"2025-06-02T15:04:23Z","title":"Efficient Egocentric Action Recognition with Multimodal Data","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T11:39:47.435799Z"},"links":{"citing_paper":"/paper/2506.01757"},"observation_digest":"sha256:fd4e5b50ba1f1b926725ed889b0e112f5e44f3b1651a4dc9eef1ec925121151f","observation_id":"5d09577e-6fc1-4c7a-8170-40e07c45bd0a","resolution":{"observed_at":"2026-08-07T11:39:51.789981Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.01757","last_updated":"2025-06-02T15:04:23Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T12:11:37.739219Z","submitted_at":"2025-06-02T15:04:23Z","title":"Efficient Egocentric Action Recognition with Multimodal Data"},"reference_resolution":{"displayed":17,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":3,"verified_exact":1,"verified_fuzzy":13},"total_outbound_references":17},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 17 of 17 outbound references and 0 inbound Pith citation observations for arXiv:2506.01757."}