{"as_of":"2026-08-21T05:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8fab24f3f7aa2e38ca82093f0fdf95f5e3b7223a8d3ae86143f79dd4759135c1","coverage":[{"denominator":33,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:29:38.638571Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T08:41:54.503158Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-10T08:43:01.165529Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.02382","last_updated":"2025-06-03T02:39:33Z","snapshot_observed_at":"2026-08-16T08:59:30.599294Z","submitted_at":"2025-06-03T02:39:33Z","title":"Multi-level and Multi-modal Action Anticipation","version":1},"cited_work":{"arxiv_id":"2506.02382","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.02382","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Multi-level and multi-modal action anticipation","venue":null,"work_id":"9d8b3189-4585-4eba-8a31-e7cf92ad5e07","year":2025},"citing_paper":{"arxiv_id":"2604.16264","last_updated":"2026-04-17T17:20:42Z","snapshot_observed_at":"2026-07-06T23:03:39.351412Z","submitted_at":"2026-04-17T17:20:42Z","title":"Information Router for Mitigating Modality Dominance in Vision-Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-10T08:41:54.503158Z"},"links":{"cited_paper":"/paper/2506.02382","citing_paper":"/paper/2604.16264"},"observation_digest":"sha256:38aee2c239b4b143a3a64aeb6d169dc02b5ee5a6bd5659ebd93d4c17b211c5f6","observation_id":"662ff9ba-6ef4-4b1b-bf49-f2a76b02bd15","resolution":{"observed_at":"2026-05-10T08:43:01.167703Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.02382/citation-record","integrity":"/paper/2506.02382/integrity","json":"/paper/2506.02382/citation-record.json","paper":"/paper/2506.02382"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:29:43.884921Z","title":"checking the refrigerator","venue":null,"work_id":"c023d43d-8ef6-4902-9d3d-b2b88e4280af","year":null},"citing_paper":{"arxiv_id":"2506.02382","last_updated":"2025-06-03T02:39:33Z","snapshot_observed_at":"2026-08-16T08:59:30.599294Z","submitted_at":"2025-06-03T02:39:33Z","title":"Multi-level and Multi-modal Action Anticipation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T11:29:36.491245Z"},"links":{"citing_paper":"/paper/2506.02382"},"observation_digest":"sha256:e092bcb10d1ac1ba0e2679955ce229ec37252066fd9765f3d49ae03015c90a02","observation_id":"cbec5016-0581-4f31-b5a3-227c1b5a8b1f","resolution":{"observed_at":"2026-08-07T11:29:43.933677Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:29:43.753892Z","title":"Long-term Action Anticipation Action anticipation emphasizes predicting potential upcom- ing actions before they are observed","venue":null,"work_id":"a6f0eec0-f174-444e-80fe-b6127a525ffb","year":null},"citing_paper":{"arxiv_id":"2506.02382","last_updated":"2025-06-03T02:39:33Z","snapshot_observed_at":"2026-08-16T08:59:30.599294Z","submitted_at":"2025-06-03T02:39:33Z","title":"Multi-level and Multi-modal Action Anticipation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:29:36.581844Z"},"links":{"citing_paper":"/paper/2506.02382"},"observation_digest":"sha256:57a81f4eefd9c77fe13157e59f74b6fe4743c6ecb1c757b38731282c72091bdf","observation_id":"e2aa1a20-62d0-4ac7-b295-a99e3a3a8188","resolution":{"observed_at":"2026-08-07T11:29:43.823352Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:29:43.607797Z","title":"We be- gin with the Video Encoder, which extracts meaningful fea- tures from the input video","venue":null,"work_id":"3286f4ba-0285-4f4e-ba04-3ab2cfbbe149","year":null},"citing_paper":{"arxiv_id":"2506.02382","last_updated":"2025-06-03T02:39:33Z","snapshot_observed_at":"2026-08-16T08:59:30.599294Z","submitted_at":"2025-06-03T02:39:33Z","title":"Multi-level and Multi-modal Action Anticipation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T11:29:36.641888Z"},"links":{"citing_paper":"/paper/2506.02382"},"observation_digest":"sha256:484129ba305bf8c6a37a510c260ad7b53743be340a6098fbd84e1a22178f4764","observation_id":"dad39a17-8d42-4e2d-8b38-9537faf3062b","resolution":{"observed_at":"2026-08-07T11:29:43.671409Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"7690.9273","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:29:39.130798Z","title":null,"venue":null,"work_id":"d5164083-d478-4358-9db8-fabca83d18a4","year":null},"citing_paper":{"arxiv_id":"2506.02382","last_updated":"2025-06-03T02:39:33Z","snapshot_observed_at":"2026-08-16T08:59:30.599294Z","submitted_at":"2025-06-03T02:39:33Z","title":"Multi-level and Multi-modal Action Anticipation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T11:29:36.712774Z"},"links":{"citing_paper":"/paper/2506.02382"},"observation_digest":"sha256:dbbfd0659027e6a2cc45e0005a80e9e08eacc7f48987d80422a3084c6ee9c290","observation_id":"d94d2c9c-2dbf-43a3-b81c-e0ce38526fbc","resolution":{"observed_at":"2026-08-07T11:29:39.181215Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:29:43.450056Z","title":"By incorporating a fine-grained text generator with a novel loss function, our method ad- dresses the challenges of inaccurate video labels, leading to improved prediction accuracy","venue":null,"work_id":"b227b04a-2e10-4d2a-85b9-51ab33c7ff5b","year":null},"citing_paper":{"arxiv_id":"2506.02382","last_updated":"2025-06-03T02:39:33Z","snapshot_observed_at":"2026-08-16T08:59:30.599294Z","submitted_at":"2025-06-03T02:39:33Z","title":"Multi-level and Multi-modal Action Anticipation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T11:29:36.818980Z"},"links":{"citing_paper":"/paper/2506.02382"},"observation_digest":"sha256:01e43ce0a25e0fa5fae092f7c6b3a194fdac429b6dc12089b907264c639c3b6f","observation_id":"99f00d51-5378-4eac-96a0-11651066fdf2","resolution":{"observed_at":"2026-08-07T11:29:43.508680Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04353","last_updated":"2024-12-05T17:12:35Z","snapshot_observed_at":"2026-08-20T14:16:34.609773Z","submitted_at":"2024-12-05T17:12:35Z","title":"ActFusion: a Unified Diffusion Model for Action Segmentation and Anticipation","version":1},"cited_work":{"arxiv_id":"2412.04353","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.04353","snapshot_observed_at":"2026-08-07T11:29:38.792543Z","title":"ActFusion: a Unified Diffusion Model for Action Segmentation and Anticipation","venue":"cs.CV","work_id":"1216ae5d-a363-47de-bd3e-ea243d0a036d","year":2024},"citing_paper":{"arxiv_id":"2506.02382","last_updated":"2025-06-03T02:39:33Z","snapshot_observed_at":"2026-08-16T08:59:30.599294Z","submitted_at":"2025-06-03T02:39:33Z","title":"Multi-level and Multi-modal Action Anticipation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T11:29:36.897303Z"},"links":{"cited_paper":"/paper/2412.04353","citing_paper":"/paper/2506.02382"},"observation_digest":"sha256:d47e95218bef492680aca2aa761088b1f773000ca861df44c40c366311a3fb06","observation_id":"3eb63e1f-8682-4c6e-90d1-9f35649a5853","resolution":{"observed_at":"2026-08-07T11:29:38.857558Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:29:43.352307Z","title":"Future transformer for long-term action anticipation,","venue":null,"work_id":"5e75a4de-0b91-4e1a-996a-17d1c92a055f","year":2022},"citing_paper":{"arxiv_id":"2506.02382","last_updated":"2025-06-03T02:39:33Z","snapshot_observed_at":"2026-08-16T08:59:30.599294Z","submitted_at":"2025-06-03T02:39:33Z","title":"Multi-level and Multi-modal Action Anticipation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T11:29:36.980157Z"},"links":{"citing_paper":"/paper/2506.02382"},"observation_digest":"sha256:81dea933f14f9acce0e8a9056b5194cdeb4cd3d124c3b9ca58635d2a51216cf7","observation_id":"1f47dbd2-e349-4b09-8ab7-066b783fb1d4","resolution":{"observed_at":"2026-08-07T11:29:43.393561Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:29:43.157562Z","title":"Object-centric video representation for long-term ac- tion anticipation,","venue":null,"work_id":"430ffd94-0613-49d2-8cc9-822338d0f855","year":2024},"citing_paper":{"arxiv_id":"2506.02382","last_updated":"2025-06-03T02:39:33Z","snapshot_observed_at":"2026-08-16T08:59:30.599294Z","submitted_at":"2025-06-03T02:39:33Z","title":"Multi-level and Multi-modal Action Anticipation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T11:29:37.079016Z"},"links":{"citing_paper":"/paper/2506.02382"},"observation_digest":"sha256:0fdbe61c90e45eb3d0ef5183c4433354c6b495378bc9deddc9fd40a7675d4ed4","observation_id":"c18880aa-943c-4bd5-9ee3-ad327ab8c476","resolution":{"observed_at":"2026-08-07T11:29:43.246854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:29:43.016766Z","title":"Hierarchical compositional represen- tations for few-shot action recognition,","venue":null,"work_id":"adef0177-eb17-48b0-b6a6-2d542cc58824","year":2024},"citing_paper":{"arxiv_id":"2506.02382","last_updated":"2025-06-03T02:39:33Z","snapshot_observed_at":"2026-08-16T08:59:30.599294Z","submitted_at":"2025-06-03T02:39:33Z","title":"Multi-level and Multi-modal Action Anticipation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T11:29:37.142973Z"},"links":{"citing_paper":"/paper/2506.02382"},"observation_digest":"sha256:cc2bad22b1252ca1cb50e97b0ac606d5397014a016de2b89077c7c870d0a18a3","observation_id":"b74958e1-9061-4f5d-9b6e-75b49570848b","resolution":{"observed_at":"2026-08-07T11:29:43.069481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:29:42.895770Z","title":"Uncertainty-based spatial-temporal attention for online action detection,","venue":null,"work_id":"6c537702-b59a-4a8a-85bf-a28d8567c0d6","year":2022},"citing_paper":{"arxiv_id":"2506.02382","last_updated":"2025-06-03T02:39:33Z","snapshot_observed_at":"2026-08-16T08:59:30.599294Z","submitted_at":"2025-06-03T02:39:33Z","title":"Multi-level and Multi-modal Action Anticipation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T11:29:37.200011Z"},"links":{"citing_paper":"/paper/2506.02382"},"observation_digest":"sha256:349dffe822d6ff47dcda38375670c2c28a6414f158d18e945f532d145391cdb5","observation_id":"becc28e7-a818-432d-8d79-ad80b1010458","resolution":{"observed_at":"2026-08-07T11:29:42.935284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:29:42.737329Z","title":"Soar: Scene-debiasing open-set action recognition,","venue":null,"work_id":"2cf6e720-457c-40df-9cfc-8256a39a0b56","year":2023},"citing_paper":{"arxiv_id":"2506.02382","last_updated":"2025-06-03T02:39:33Z","snapshot_observed_at":"2026-08-16T08:59:30.599294Z","submitted_at":"2025-06-03T02:39:33Z","title":"Multi-level and Multi-modal Action Anticipation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T11:29:37.248203Z"},"links":{"citing_paper":"/paper/2506.02382"},"observation_digest":"sha256:54ac835bd6eee479ceb1cf42c18273e39a226c5e336913f2af9e1c000e3e77a1","observation_id":"05df4da2-8721-495e-a385-472a7b719989","resolution":{"observed_at":"2026-08-07T11:29:42.811607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:29:42.572898Z","title":"When will you do what?-anticipating temporal occur- rences of activities,","venue":null,"work_id":"3dc1b86f-24c7-409b-8c53-766ad25735cd","year":2018},"citing_paper":{"arxiv_id":"2506.02382","last_updated":"2025-06-03T02:39:33Z","snapshot_observed_at":"2026-08-16T08:59:30.599294Z","submitted_at":"2025-06-03T02:39:33Z","title":"Multi-level and Multi-modal Action Anticipation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T11:29:37.298203Z"},"links":{"citing_paper":"/paper/2506.02382"},"observation_digest":"sha256:e6851ec06dbeb28ff3c24cc1e014cbbd8279f67dc8d749bf708c8c8bdd44b0b5","observation_id":"624f4753-6b04-49c5-bf80-3cae610fc233","resolution":{"observed_at":"2026-08-07T11:29:42.630089Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:29:42.426817Z","title":"Time- conditioned action anticipation in one shot,","venue":null,"work_id":"f2d53f6f-26aa-4c56-883a-338e5e84aeb6","year":2019},"citing_paper":{"arxiv_id":"2506.02382","last_updated":"2025-06-03T02:39:33Z","snapshot_observed_at":"2026-08-16T08:59:30.599294Z","submitted_at":"2025-06-03T02:39:33Z","title":"Multi-level and Multi-modal Action Anticipation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T11:29:37.371035Z"},"links":{"citing_paper":"/paper/2506.02382"},"observation_digest":"sha256:9aa43c4457d93b35d6b7f0b5c08bb764919a11b4aee2289700b7eee882a787c3","observation_id":"00c6a52f-8140-4ef1-8e3b-305fc5399f2e","resolution":{"observed_at":"2026-08-07T11:29:42.490172Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:29:42.243399Z","title":"Temporal aggregate representations for long-range video understanding,","venue":null,"work_id":"ce1e3abc-29f3-4c72-af92-74713173b871","year":2020},"citing_paper":{"arxiv_id":"2506.02382","last_updated":"2025-06-03T02:39:33Z","snapshot_observed_at":"2026-08-16T08:59:30.599294Z","submitted_at":"2025-06-03T02:39:33Z","title":"Multi-level and Multi-modal Action Anticipation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T11:29:37.437955Z"},"links":{"citing_paper":"/paper/2506.02382"},"observation_digest":"sha256:b86a263faa4e7357ef2690291b863d50effabcfdc918aef59cb05c890d81db08","observation_id":"4e6d3959-2676-4c86-b1a5-89e11987d2ba","resolution":{"observed_at":"2026-08-07T11:29:42.310722Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:29:42.105840Z","title":"Long-term anticipation of activities with cy- cle consistency,","venue":null,"work_id":"23422ff0-5afe-48f2-8a9f-68d6cefcbb6e","year":2021},"citing_paper":{"arxiv_id":"2506.02382","last_updated":"2025-06-03T02:39:33Z","snapshot_observed_at":"2026-08-16T08:59:30.599294Z","submitted_at":"2025-06-03T02:39:33Z","title":"Multi-level and Multi-modal Action Anticipation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T11:29:37.512090Z"},"links":{"citing_paper":"/paper/2506.02382"},"observation_digest":"sha256:e19da5f0cb6c1726c8f86eefd728e05f9c93aa93409ed36b7769734a3849cdac","observation_id":"11d8cb1a-44e8-428b-894c-55b3e5f660e8","resolution":{"observed_at":"2026-08-07T11:29:42.191753Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:29:41.952032Z","title":"Uncertainty-aware action decou- pling transformer for action anticipation,","venue":null,"work_id":"c0ca916d-34e0-42e3-9ec5-4b1e307cdccf","year":2024},"citing_paper":{"arxiv_id":"2506.02382","last_updated":"2025-06-03T02:39:33Z","snapshot_observed_at":"2026-08-16T08:59:30.599294Z","submitted_at":"2025-06-03T02:39:33Z","title":"Multi-level and Multi-modal Action Anticipation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T11:29:37.562124Z"},"links":{"citing_paper":"/paper/2506.02382"},"observation_digest":"sha256:fc660f2b740d80152ea2a45273249f36f3d9d135d2ff54854f532722a4538d56","observation_id":"72b998f2-6326-47f2-8317-c08dbd46ffe6","resolution":{"observed_at":"2026-08-07T11:29:42.040788Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:29:41.832478Z","title":"The lan- guage of actions: Recovering the syntax and semantics of goal-directed human activities,","venue":null,"work_id":"3826ff84-d0a7-41a5-8732-8803472b9d89","year":2014},"citing_paper":{"arxiv_id":"2506.02382","last_updated":"2025-06-03T02:39:33Z","snapshot_observed_at":"2026-08-16T08:59:30.599294Z","submitted_at":"2025-06-03T02:39:33Z","title":"Multi-level and Multi-modal Action Anticipation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T11:29:37.609693Z"},"links":{"citing_paper":"/paper/2506.02382"},"observation_digest":"sha256:797b4b63a9f9ea4c32ed5e1a6f3636aa072fa9e06150a0ac4f255f364632692d","observation_id":"371d3e98-703c-4959-abb0-894a2fcef080","resolution":{"observed_at":"2026-08-07T11:29:41.886938Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:29:41.720936Z","title":"Combining embedded accelerometers with computer vision for rec- ognizing food preparation activities,","venue":null,"work_id":"22b4379e-63b4-4c99-baac-2d3060e15768","year":2013},"citing_paper":{"arxiv_id":"2506.02382","last_updated":"2025-06-03T02:39:33Z","snapshot_observed_at":"2026-08-16T08:59:30.599294Z","submitted_at":"2025-06-03T02:39:33Z","title":"Multi-level and Multi-modal Action Anticipation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T11:29:37.679196Z"},"links":{"citing_paper":"/paper/2506.02382"},"observation_digest":"sha256:ec87ef08864b8d7d49893668767d3cf6b5ca1190fe77f01296f589507bcc5ea5","observation_id":"c225b2ad-3e07-4f82-866f-2a0953323185","resolution":{"observed_at":"2026-08-07T11:29:41.755893Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.17696","last_updated":"2026-03-26T23:09:44Z","snapshot_observed_at":"2026-08-20T05:21:29.294395Z","submitted_at":"2025-04-24T16:04:00Z","title":"Hierarchical and Multimodal Data for Daily Activity Understanding","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.17696","snapshot_observed_at":"2026-08-07T11:29:37.755186Z","title":"Hierarchical and multimodal data for daily activity understanding,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02382","last_updated":"2025-06-03T02:39:33Z","snapshot_observed_at":"2026-08-16T08:59:30.599294Z","submitted_at":"2025-06-03T02:39:33Z","title":"Multi-level and Multi-modal Action Anticipation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T11:29:37.755186Z"},"links":{"cited_paper":"/paper/2504.17696","citing_paper":"/paper/2506.02382"},"observation_digest":"sha256:b590e28ad3a6743dde76641b507002d6237ac14e5e0ab392b09d588946c5a173","observation_id":"9f23d891-1f13-48f7-906f-f5c48e910bb5","resolution":{"observed_at":"2026-08-07T11:29:37.755186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:29:41.582338Z","title":"Rescaling egocentric vision: Col- lection, pipeline and challenges for epic-kitchens-100,","venue":null,"work_id":"95873c21-eeb3-4ea6-958c-1497d92335ac","year":2022},"citing_paper":{"arxiv_id":"2506.02382","last_updated":"2025-06-03T02:39:33Z","snapshot_observed_at":"2026-08-16T08:59:30.599294Z","submitted_at":"2025-06-03T02:39:33Z","title":"Multi-level and Multi-modal Action Anticipation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T11:29:37.834099Z"},"links":{"citing_paper":"/paper/2506.02382"},"observation_digest":"sha256:ff7f8740ed33c82591cfaa081634aaf06436c9f5160bbcfc9dbd0f9c6034db3b","observation_id":"fbe96bc8-667b-4929-ae52-5511eaeca5a2","resolution":{"observed_at":"2026-08-07T11:29:41.643829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:29:41.405149Z","title":"Ego4d: Around the world in 3,000 hours of egocentric video,","venue":null,"work_id":"0cce25ba-abbf-4de2-991e-79f54524de04","year":2022},"citing_paper":{"arxiv_id":"2506.02382","last_updated":"2025-06-03T02:39:33Z","snapshot_observed_at":"2026-08-16T08:59:30.599294Z","submitted_at":"2025-06-03T02:39:33Z","title":"Multi-level and Multi-modal Action Anticipation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T11:29:37.922839Z"},"links":{"citing_paper":"/paper/2506.02382"},"observation_digest":"sha256:c029563cf301084730c19fcb9f7a963698cd2b1e3b0d3316c3e61726e13aef90","observation_id":"4f431752-8162-4d94-9da8-1d4d53173015","resolution":{"observed_at":"2026-08-07T11:29:41.469092Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:29:41.275126Z","title":"Anticipating hu- man actions by correlating past with the future with jac- card similarity measures,","venue":null,"work_id":"9702ba79-ce89-4e08-8800-153a05909b2f","year":2021},"citing_paper":{"arxiv_id":"2506.02382","last_updated":"2025-06-03T02:39:33Z","snapshot_observed_at":"2026-08-16T08:59:30.599294Z","submitted_at":"2025-06-03T02:39:33Z","title":"Multi-level and Multi-modal Action Anticipation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T11:29:37.970929Z"},"links":{"citing_paper":"/paper/2506.02382"},"observation_digest":"sha256:c517ed5180b59edbd26096683165d4049fcb921769628f505c3fc856739069a3","observation_id":"bd9108f0-b3ba-4f2b-9576-501a532292f9","resolution":{"observed_at":"2026-08-07T11:29:41.325799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:29:41.174917Z","title":"Uncertainty-aware anticipation of activities,","venue":null,"work_id":"da62bb8d-5ea7-4502-831c-6f792ae82f44","year":2019},"citing_paper":{"arxiv_id":"2506.02382","last_updated":"2025-06-03T02:39:33Z","snapshot_observed_at":"2026-08-16T08:59:30.599294Z","submitted_at":"2025-06-03T02:39:33Z","title":"Multi-level and Multi-modal Action Anticipation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T11:29:38.028938Z"},"links":{"citing_paper":"/paper/2506.02382"},"observation_digest":"sha256:6f3943c29e40ce93d3e1efd378437f4f6d92abb0de57712a9d5c2880b0c75f57","observation_id":"a6ff58e2-47e3-4ddb-b7b2-59a4efbb7718","resolution":{"observed_at":"2026-08-07T11:29:41.202341Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:29:40.986805Z","title":"Weakly supervised action learning with rnn based fine- to-coarse modeling,","venue":null,"work_id":"efebe125-1be1-46dd-8a99-a59a48c86795","year":2017},"citing_paper":{"arxiv_id":"2506.02382","last_updated":"2025-06-03T02:39:33Z","snapshot_observed_at":"2026-08-16T08:59:30.599294Z","submitted_at":"2025-06-03T02:39:33Z","title":"Multi-level and Multi-modal Action Anticipation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T11:29:38.090772Z"},"links":{"citing_paper":"/paper/2506.02382"},"observation_digest":"sha256:1f59022f2a344bfa24121a73bf5d5b0e09f96643f74d99d42e5f337123ca992e","observation_id":"b59234a0-a529-4f04-be91-b342720df2fb","resolution":{"observed_at":"2026-08-07T11:29:41.083272Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:29:40.842259Z","title":"Ms-tcn: Multi-stage temporal convolutional network for action segmenta- tion,","venue":null,"work_id":"8056232c-d29b-4a51-81f3-643fa1ece5a1","year":2019},"citing_paper":{"arxiv_id":"2506.02382","last_updated":"2025-06-03T02:39:33Z","snapshot_observed_at":"2026-08-16T08:59:30.599294Z","submitted_at":"2025-06-03T02:39:33Z","title":"Multi-level and Multi-modal Action Anticipation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T11:29:38.154612Z"},"links":{"citing_paper":"/paper/2506.02382"},"observation_digest":"sha256:a41aeaafa6a998171498df32b9566b40a14d8f7b17bc30d69f42a33cbdba20e9","observation_id":"b68ba349-5412-42e2-9916-89d0be15324e","resolution":{"observed_at":"2026-08-07T11:29:40.883041Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:29:40.645088Z","title":"Leveraging uncertainty to rethink loss functions and evaluation measures for egocentric action anticipation,","venue":null,"work_id":"e462a66d-e4c7-4893-a838-fee81a053e3f","year":2018},"citing_paper":{"arxiv_id":"2506.02382","last_updated":"2025-06-03T02:39:33Z","snapshot_observed_at":"2026-08-16T08:59:30.599294Z","submitted_at":"2025-06-03T02:39:33Z","title":"Multi-level and Multi-modal Action Anticipation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T11:29:38.222125Z"},"links":{"citing_paper":"/paper/2506.02382"},"observation_digest":"sha256:c891a58bfa3f934aea0e897832f718a5d4c4087050a5c52e5037a39f3f0544f2","observation_id":"61eee390-95c9-4064-8489-24c8dbad5d8a","resolution":{"observed_at":"2026-08-07T11:29:40.790086Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:29:40.282224Z","title":"Predictive uncer- tainty estimation via prior networks,","venue":null,"work_id":"b66746de-ab4a-48fc-a29f-5c8ed9283538","year":2018},"citing_paper":{"arxiv_id":"2506.02382","last_updated":"2025-06-03T02:39:33Z","snapshot_observed_at":"2026-08-16T08:59:30.599294Z","submitted_at":"2025-06-03T02:39:33Z","title":"Multi-level and Multi-modal Action Anticipation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T11:29:38.304435Z"},"links":{"citing_paper":"/paper/2506.02382"},"observation_digest":"sha256:f3ca7dbb0d55b9f0b86a7678b343f74788c5b4034fb874f67ab8e125d6a1841d","observation_id":"efcdbcb2-2a8c-4e1e-b9b6-2dee8cf57f49","resolution":{"observed_at":"2026-08-07T11:29:40.354226Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:29:40.060026Z","title":"Learning the predictability of the future,","venue":null,"work_id":"bc16819b-8297-4cf6-a13f-40445527596d","year":2021},"citing_paper":{"arxiv_id":"2506.02382","last_updated":"2025-06-03T02:39:33Z","snapshot_observed_at":"2026-08-16T08:59:30.599294Z","submitted_at":"2025-06-03T02:39:33Z","title":"Multi-level and Multi-modal Action Anticipation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T11:29:38.353576Z"},"links":{"citing_paper":"/paper/2506.02382"},"observation_digest":"sha256:fc0927c0de116ffb3f70e20bf27f05e062409a77e2cc9b8ca82da58e3ba89e87","observation_id":"85bd372f-0f5e-449b-b2c5-f2d8c574cf27","resolution":{"observed_at":"2026-08-07T11:29:40.165730Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:29:39.776972Z","title":"Hex: Hierarchical emergence exploitation in self-supervised algorithms,","venue":null,"work_id":"a964d319-e423-4a79-88b0-84ff156dc62f","year":2025},"citing_paper":{"arxiv_id":"2506.02382","last_updated":"2025-06-03T02:39:33Z","snapshot_observed_at":"2026-08-16T08:59:30.599294Z","submitted_at":"2025-06-03T02:39:33Z","title":"Multi-level and Multi-modal Action Anticipation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T11:29:38.358561Z"},"links":{"citing_paper":"/paper/2506.02382"},"observation_digest":"sha256:b58aa5174ae273caa343a7c9a27fb9f2f7b3f3abf7b87a5240da6ad5855646d8","observation_id":"f552082b-ef69-4aac-a283-6b5c6cf9bbf3","resolution":{"observed_at":"2026-08-07T11:29:39.966336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:29:39.516864Z","title":"Gated temporal diffusion for stochastic long-term dense anticipation,","venue":null,"work_id":"032d65d0-e66f-4d34-9dd0-8239f24cab8f","year":2024},"citing_paper":{"arxiv_id":"2506.02382","last_updated":"2025-06-03T02:39:33Z","snapshot_observed_at":"2026-08-16T08:59:30.599294Z","submitted_at":"2025-06-03T02:39:33Z","title":"Multi-level and Multi-modal Action Anticipation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T11:29:38.398194Z"},"links":{"citing_paper":"/paper/2506.02382"},"observation_digest":"sha256:7842178a533b5bc6e4c265b8d681dd494286d0e354e00118abd2afb995329ccf","observation_id":"09c82d9a-67df-4abe-a0c9-074be1c45df7","resolution":{"observed_at":"2026-08-07T11:29:39.649765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:29:39.261527Z","title":"Anticipative feature fusion transformer for multi-modal action anticipation,","venue":null,"work_id":"a86be7b6-1126-468f-bc17-8564a060dee4","year":2023},"citing_paper":{"arxiv_id":"2506.02382","last_updated":"2025-06-03T02:39:33Z","snapshot_observed_at":"2026-08-16T08:59:30.599294Z","submitted_at":"2025-06-03T02:39:33Z","title":"Multi-level and Multi-modal Action Anticipation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T11:29:38.465431Z"},"links":{"citing_paper":"/paper/2506.02382"},"observation_digest":"sha256:c7fcd0bffb0dd3d35eab5f92f458229fe1fb2f22593512ac5fddef2b113ac562","observation_id":"faa3a57c-d806-4295-aec9-5933db9bcbad","resolution":{"observed_at":"2026-08-07T11:29:39.388341Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-14T20:13:52.872565Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-07T11:29:38.546082Z","title":"Decoupled weight decay regulariza- tion,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.02382","last_updated":"2025-06-03T02:39:33Z","snapshot_observed_at":"2026-08-16T08:59:30.599294Z","submitted_at":"2025-06-03T02:39:33Z","title":"Multi-level and Multi-modal Action Anticipation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T11:29:38.546082Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2506.02382"},"observation_digest":"sha256:dde9648aad186f780aff5bfdf5b2a2b0188099fec105e774d664b985d799267c","observation_id":"375af485-7ed9-4066-b98a-43f98ecaf743","resolution":{"observed_at":"2026-08-07T11:29:38.546082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1608.03983","last_updated":"2017-05-03T16:28:09Z","snapshot_observed_at":"2026-07-06T05:06:55.589962Z","submitted_at":"2016-08-13T13:46:05Z","title":"SGDR: Stochastic Gradient Descent with Warm Restarts","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1608.03983","snapshot_observed_at":"2026-08-07T11:29:38.638571Z","title":"Sgdr: Stochastic gradient descent with warm restarts,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.02382","last_updated":"2025-06-03T02:39:33Z","snapshot_observed_at":"2026-08-16T08:59:30.599294Z","submitted_at":"2025-06-03T02:39:33Z","title":"Multi-level and Multi-modal Action Anticipation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T11:29:38.638571Z"},"links":{"cited_paper":"/paper/1608.03983","citing_paper":"/paper/2506.02382"},"observation_digest":"sha256:1b7e92986d30a9854bfd9c78f700f034df0057a2d8aeaaf0db774c8ac0e3e637","observation_id":"9124e129-8738-40d0-be86-d2e713b91fc4","resolution":{"observed_at":"2026-08-07T11:29:38.638571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.02382","last_updated":"2025-06-03T02:39:33Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-16T08:59:30.599294Z","submitted_at":"2025-06-03T02:39:33Z","title":"Multi-level and Multi-modal Action Anticipation"},"reference_resolution":{"displayed":33,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":3,"verified_exact":1,"verified_fuzzy":28},"total_outbound_references":33},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 1 inbound Pith citation observation for arXiv:2506.02382."}