{"as_of":"2026-08-09T12:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b1d78a759dd3581d250d184cf663f901c3cef8d0deb18c413b5a03f0d71bc62b","coverage":[{"denominator":118,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T18:21:15.822933Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.17342/citation-record","integrity":"/paper/2607.17342/integrity","json":"/paper/2607.17342/citation-record.json","paper":"/paper/2607.17342"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:05.870239Z","title":"Hierarchical aggregated graph neu- ral network for skeleton-based action recognition,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:05.870239Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:f545f1ebce6a49f92b8cb5c163b2b433dab049324eb425a57f3f356080acc9cf","observation_id":"ca4c888a-b52c-4874-8303-70944e1ac3c1","resolution":{"observed_at":"2026-08-01T18:21:05.870239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:06.025703Z","title":"Joints-centered spatial-temporal features fused skeleton convolution network for action recognition,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:06.025703Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:3b5765feb9d7d1ede71cf106fc55d048ffc743d2241938f1e1ac626ca00b3eb0","observation_id":"9b765c17-f9c2-493d-8469-32d58e4480a5","resolution":{"observed_at":"2026-08-01T18:21:06.025703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:06.155909Z","title":"Noise- tolerant learning for audio-visual action recognition,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:06.155909Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:2996e7a9a25d86e3e43ed17760cde83726308090a3e3a3f6f6649e4a4604113d","observation_id":"0865a89f-2e2b-4a3f-9dee-72e9bd25e420","resolution":{"observed_at":"2026-08-01T18:21:06.155909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:06.254920Z","title":"Commonsense knowledge prompt- ing for few-shot action recognition in videos,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:06.254920Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:a42b0254532a752af9e15024021dfe26abd2c9e77f64d5406e286773d19c1ad3","observation_id":"88d89667-bd2d-4ad9-993d-f105e20b94a4","resolution":{"observed_at":"2026-08-01T18:21:06.254920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:06.385794Z","title":"Exploring rich semantics for open-set action recognition,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:06.385794Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:b22a6635ea296783028a88c3a26b380b8d53961678a1365ecd85551fa9ca4824","observation_id":"9052d824-5e18-41ef-966a-0b2c76484b24","resolution":{"observed_at":"2026-08-01T18:21:06.385794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:06.519119Z","title":"Dear-net: Learning diver- sities for skeleton-based early action recognition,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:06.519119Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:e4cee0e78aae81b811df7791929af3c6c772212d012419e9b23785dd93d0eeec","observation_id":"c24a9bfe-dbab-46be-ac7a-287c24662648","resolution":{"observed_at":"2026-08-01T18:21:06.519119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:06.678110Z","title":"Just addπ! pose induced video transformers for understanding activities of daily living,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:06.678110Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:15ca087f569ae0aada7b6b7ed5a9e020c4ffef11914a419ab341cdf649bbac0b","observation_id":"19891e92-ff07-43d1-87e4-308afd80b234","resolution":{"observed_at":"2026-08-01T18:21:06.678110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:06.842033Z","title":"Mmnet: A model-based multimodal network for human action recognition in rgb-d videos,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:06.842033Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:5fced1af359530a478193956d036652f279e660000608ef39e6004ac80239e25","observation_id":"a3ecaa31-05e0-476a-86c3-61a9acbf768a","resolution":{"observed_at":"2026-08-01T18:21:06.842033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:06.979863Z","title":"A unified multi- modal de- and re-coupling framework for rgb-d motion recognition,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:06.979863Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:92f361c5b51f20fb4e1b8d38f87e6ded496dbfac499d26f47fcc176303bf51c5","observation_id":"138c428b-cac7-4e11-a19b-13e87f00e704","resolution":{"observed_at":"2026-08-01T18:21:06.979863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:07.154747Z","title":"Selective, interpretable and motion consistent privacy attribute obfuscation for action recognition,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:07.154747Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:5881762185c8e7df88ad8bf22ddf00bc300cc1e0d4a12613a0a33075624d6760","observation_id":"8b74b0b7-f76b-4e68-a0f1-714ff93c2085","resolution":{"observed_at":"2026-08-01T18:21:07.154747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:07.274920Z","title":"On the benefits of 3d pose and tracking for human action recognition,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:07.274920Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:fa36f905c711c19eb9e7a4a0fd67b49912db22ff4d8ff08692c5b47e702a4524","observation_id":"16f462a8-bcba-4862-8424-efb44a94c400","resolution":{"observed_at":"2026-08-01T18:21:07.274920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:07.407153Z","title":"Smam: Self and mutual adaptive matching for skeleton-based few-shot action recognition,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:07.407153Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:f680424e0a188de6fc0254c9398a5429ec9204b0018b41a2a7287363e43ebd1c","observation_id":"10992860-6f31-436e-a9ef-a673ea25656e","resolution":{"observed_at":"2026-08-01T18:21:07.407153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:07.564684Z","title":"Integrating image and textual information in human–robot interactions for children with autism spectrum disorder,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:07.564684Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:28dbece2fd0c22354717a9d32dc0d81006f116759e0154a256bd1e0adf46b9f4","observation_id":"7bd2c819-c5ab-40b3-8b18-12962e440a26","resolution":{"observed_at":"2026-08-01T18:21:07.564684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:07.647090Z","title":"Jrdb-social: A multifaceted robotic dataset for understanding of context and dynamics of human interactions within social groups,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:07.647090Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:8aacd9b7e0f300d1de5d72995632ca951c93898cf20cf0a7ba22dbf9e08b5cf4","observation_id":"dd9a4851-46fb-4f66-b79e-a3f253f2e8e4","resolution":{"observed_at":"2026-08-01T18:21:07.647090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:07.805971Z","title":"Interactive spatiotem- poral token attention network for skeleton-based general interactive ac- tion recognition,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:07.805971Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:b9e15fa1e81ea73069bb4c9500d19057886523594762c4bba3f0c1a4d21f22ca","observation_id":"006184e0-4dc3-4899-acdb-9155ed156245","resolution":{"observed_at":"2026-08-01T18:21:07.805971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:07.957296Z","title":"Pose forecasting in industrial human-robot collaboration,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:07.957296Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:c073a5a9e80a09e2f5394acc00d1e923815716d93673a5ec9f9c8a02cf2a0afe","observation_id":"62c8a668-c129-4e0c-bd01-bc89b3288ff7","resolution":{"observed_at":"2026-08-01T18:21:07.957296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:08.080287Z","title":"Exploring 3d human pose estimation and forecasting from the robot’s perspective: The harper dataset,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:08.080287Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:3e36048ddf0799fd06e68e2783034435f157c1bd77211d83c62bbadd3b1b885d","observation_id":"6b5d5d2e-8a72-40d9-a186-540bdfdfd6ec","resolution":{"observed_at":"2026-08-01T18:21:08.080287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:08.198270Z","title":"Pedestrian trajectory prediction based on social interactions learning with random weights,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:08.198270Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:cd23d9ecde73e4885c79d20f84367418a11c5facebc6efae11c3d051f9fbf1e1","observation_id":"3a702bf3-228f-4017-bfa5-50a611012473","resolution":{"observed_at":"2026-08-01T18:21:08.198270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:08.347674Z","title":"Inter- action transformer for human reaction generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:08.347674Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:8c849e102b675ef83548520fe91035ae9ce84add6a7b44c984cbdc369fac834e","observation_id":"fc03cde0-7245-41b7-901e-78032a0e6808","resolution":{"observed_at":"2026-08-01T18:21:08.347674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:08.507578Z","title":"Spikepoint: An efficient point-based spiking neural network for event cameras action recognition,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:08.507578Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:fb20b80490a1ad745701d478d8d3cee5c3d542e10ad2cf299cb45b88165d0c2a","observation_id":"e9d4493e-8bbc-4e18-b956-7c56b63d16cc","resolution":{"observed_at":"2026-08-01T18:21:08.507578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:08.628639Z","title":"Scaling up dynamic human-scene interaction modeling,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:08.628639Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:255658ab8a24d4593ade7dbdf7d20a3c58d7a9c229d77f9f7708126d23908e8d","observation_id":"715e2d7b-ce51-49ec-936b-bc1098b61f4a","resolution":{"observed_at":"2026-08-01T18:21:08.628639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:08.744687Z","title":"An outlook into the future of egocentric vision,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:08.744687Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:7c0b67ee14103a2850b98de7b05f23f9af8181fa23a3dd151265d1aa476ff7c6","observation_id":"16147045-7862-42f4-84dd-9cd21211dbff","resolution":{"observed_at":"2026-08-01T18:21:08.744687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:08.939805Z","title":"Locllm: Exploiting generalizable human keypoint localization via large language model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:08.939805Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:bb89b31ba68c7580a7530f80638bdc28a2acc3ce794fb1c8398d9992aaa8c83b","observation_id":"4e70bb91-850b-4b06-ac1c-5b5ef2bd1371","resolution":{"observed_at":"2026-08-01T18:21:08.939805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:09.071792Z","title":"Intergen: Diffusion- based multi-human motion generation under complex interactions,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:09.071792Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:f148369d2790a471880d0b0250d314da5a9a5f4d79cc691318ebf0ff2cad48cd","observation_id":"9c8e1a10-089e-49b5-8294-221884c576cb","resolution":{"observed_at":"2026-08-01T18:21:09.071792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:09.207086Z","title":"Multi-modal & multi-view & interactive benchmark dataset for human action recognition,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:09.207086Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:8062984638a4b1ebbb3c8b378163cd37699324d98bc5fd88bd880257dcbe2202","observation_id":"bb1cf15f-214f-45b3-ad92-1e5c6473488e","resolution":{"observed_at":"2026-08-01T18:21:09.207086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:09.333298Z","title":"Motionbert: A unified perspective on learning human motion representations,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:09.333298Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:8de3305b8cf16355e1e71c56019c9ed503c2caadc1b4daca74107e5df36bdf9e","observation_id":"ccdbfb8f-fd20-4f22-9ae3-457b8db54e24","resolution":{"observed_at":"2026-08-01T18:21:09.333298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:09.468523Z","title":"Versatile multi-modal pre-training for human-centric perception,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:09.468523Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:904a2bc26d8366c337d7fd2299927fd708761f3a8b52833f520011031a74d503","observation_id":"937a3b7b-6912-419a-b084-f35cb2d70762","resolution":{"observed_at":"2026-08-01T18:21:09.468523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:09.599539Z","title":"Beyond appearance: A semantic controllable self-supervised learning framework for human-centric visual tasks,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:09.599539Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:b005bf2c0dc3ee3c90cab97385ddfcf88a19a3dc93311c269bba7f26cbb336e2","observation_id":"3cde418e-c44e-4582-9e53-d6db309c8b39","resolution":{"observed_at":"2026-08-01T18:21:09.599539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:09.728196Z","title":"Humanbench: Towards general human-centric perception with projector assisted pretraining,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:09.728196Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:3aed1e30a571102a36f8c430bb8a68b860c528f47a71160d0cd16e3ed7f45a96","observation_id":"6dfbe9fd-f3e9-4e7e-a78f-089b5aa2f6cc","resolution":{"observed_at":"2026-08-01T18:21:09.728196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:09.870162Z","title":"HAP: Structure-aware masked image modeling for human- centric perception,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:09.870162Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:11f53432ab42ec85e9acbbc020a58ac0c132129404b2a59f767b5c9eb7259ac5","observation_id":"88087bd6-f4b4-4694-9dcc-ae4c80cd8c1d","resolution":{"observed_at":"2026-08-01T18:21:09.870162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:10.039313Z","title":"Unihcp: A unified model for human-centric JOURNAL OF LATEX CLASS FILES, VOL. 14, NO. 8, AUGUST 2021 12 perceptions,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:10.039313Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:c2abb1ea275d86db94b4348235d7c76277c4003437bd49478b1e0b0bb629d4f5","observation_id":"53510277-eb4e-4d08-abed-cbc4265cb08f","resolution":{"observed_at":"2026-08-01T18:21:10.039313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:10.107867Z","title":"Hulk: A universal knowledge translator for human-centric tasks,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:10.107867Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:328a1b887d74690de57ecd94ae4e3a12f12df0ef43b4fe9f16ba82123731aaf4","observation_id":"68df8d62-f674-45f1-ac40-9d99621af5bf","resolution":{"observed_at":"2026-08-01T18:21:10.107867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:10.171164Z","title":"Sapiens: Foundation for human vision models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:10.171164Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:fd259b6414ff05f078da04cfb268c4a9639a4635eb8b4fbe8ef04952ff6c3b65","observation_id":"a019db20-488c-4524-a5df-1465153c89de","resolution":{"observed_at":"2026-08-01T18:21:10.171164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:10.252072Z","title":"Learning composite latent structures for 3d human action representation and recognition,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:10.252072Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:8f61089488f4bf43d6420d8bd0064cdc56bcf02c486a9b7f8d01349cb169d5c5","observation_id":"69816185-55a7-428e-83b9-04e068e93bc6","resolution":{"observed_at":"2026-08-01T18:21:10.252072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:10.339072Z","title":"Navigating open set scenarios for skeleton-based action recognition,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:10.339072Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:4089a7ef5898bf8b86a1b5f47446ce1f8a92b9b10a682486bdfb1945a51cc693","observation_id":"b816ee79-436a-4aa9-a21d-154e04570a36","resolution":{"observed_at":"2026-08-01T18:21:10.339072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:10.423294Z","title":"One-shot action recognition via multi-scale spatial-temporal skeleton matching,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:10.423294Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:54cfa27aed23ecd3e22183b4306509243c8fb233bc08ad03d293f2a29af311f6","observation_id":"11b9be82-a03c-4f87-9fee-b7b812393c97","resolution":{"observed_at":"2026-08-01T18:21:10.423294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:10.511699Z","title":"Self- supervised 3d action representation learning with skeleton cloud colorization,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:10.511699Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:e84d867ced3921af9e8cbcf8ce63f92431040c1a5a935d59c7fc99f0bc93b715","observation_id":"bba65aa2-08e9-46b3-954c-cd312822234d","resolution":{"observed_at":"2026-08-01T18:21:10.511699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:10.605490Z","title":"Meet jeanie: A similarity measure for 3d skeleton sequences via temporal-viewpoint alignment,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:10.605490Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:d253569f6d5a20afed13620e38bd9b62261b8ce8d26caf7985d2dc7e46e34715","observation_id":"1251f32b-c627-403b-8f4c-83fef751cf60","resolution":{"observed_at":"2026-08-01T18:21:10.605490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:10.669063Z","title":"Neural koopman pooling: Control- inspired temporal dynamics encoding for skeleton-based action recog- nition,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:10.669063Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:74b1c0cc8ff6a37d3ebb730f5f421a944ae59ad8e6ec19105b97a5717e1e61c6","observation_id":"bf7d9ebc-9d10-4b2f-961e-77c51504ba63","resolution":{"observed_at":"2026-08-01T18:21:10.669063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:10.741353Z","title":"Learning discriminative representations for skeleton based action recognition,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:10.741353Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:c1b54f46b1fba31592c511f3a28cb11ec54b1e9788900f93f8e1a35974d7d48c","observation_id":"9add6cab-d677-4f7b-8cdc-73838cce3cf6","resolution":{"observed_at":"2026-08-01T18:21:10.741353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:10.835258Z","title":"You2me: Inferring body pose in egocentric video via first and second person interactions,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:10.835258Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:e97ec555bb520eb1142b8c6292f6a3227dd498c09a3458207d211502ceac3ed4","observation_id":"fb41a10e-cd69-4121-a943-9d045e0eb36b","resolution":{"observed_at":"2026-08-01T18:21:10.835258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:10.894319Z","title":"Skeleton- based online action prediction using scale selection network,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:10.894319Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:87b04ebde6c3355563f0a84d0cbdfbe8059efb5215c6b481f1e74d351939e225","observation_id":"1ea350e8-234b-43f5-aa0d-547848b09103","resolution":{"observed_at":"2026-08-01T18:21:10.894319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:10.977644Z","title":"Interaction relational network for mutual action recognition,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:10.977644Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:2d006d997c25d3432c5d8008e281d9121880a06bf6172c605dcb58ec9b62d712","observation_id":"46cec846-8352-4d20-afa6-5e576f201d7c","resolution":{"observed_at":"2026-08-01T18:21:10.977644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:11.041954Z","title":"Igformer: Interaction graph transformer for skeleton-based human interaction recognition,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:11.041954Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:d88976d21cccbacfa289b1f8f9226b9aa293163a45e78f9e5c8d149c86c94a18","observation_id":"ef4c0f2a-53d8-4ed3-958b-9af1f6d19571","resolution":{"observed_at":"2026-08-01T18:21:11.041954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:11.120093Z","title":"Graph diffusion convolutional network for skeleton based semantic recognition of two- person actions,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:11.120093Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:0c2f16c9ea26ab31a6057bc967303e30d3bce975a7bafaa056f5baecbefdf833","observation_id":"81826e0b-8289-4224-aa87-e7c3ea67a03c","resolution":{"observed_at":"2026-08-01T18:21:11.120093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:11.209558Z","title":"Learning mutual exci- tation for hand-to-hand and human-to-human interaction recognition,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:11.209558Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:1c3ed3c8ea0bb249f793ff1a27865a278a8bc3ce5282d01505cbedb701451e1d","observation_id":"4253bbd4-1e64-47ae-8269-db485fbb7a32","resolution":{"observed_at":"2026-08-01T18:21:11.209558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:11.277404Z","title":"Multi-modal enhancement transformer network for skeleton-based human interaction recognition,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:11.277404Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:d290dfbb3ca052179039cb716ffe818f2ade1664c3eda092dba145f00c691bc1","observation_id":"921396eb-720f-4aee-89a6-a686cb3253e4","resolution":{"observed_at":"2026-08-01T18:21:11.277404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:11.338171Z","title":"Ntu rgb+d: A large scale dataset for 3d human activity analysis,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:11.338171Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:aa7f64cdcb36d7c4e05d37aa328af668874df120ec5bec3985496f3eca762dd2","observation_id":"a677233b-c529-48f4-9ad5-69ff26764177","resolution":{"observed_at":"2026-08-01T18:21:11.338171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:11.399876Z","title":"Ntu rgb+d 120: A large-scale benchmark for 3d human activity understanding,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:11.399876Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:687d1a61dc1a447dbd1773f911eaaa48eef701e1da2a77e600e561367d8e131c","observation_id":"7026743f-479a-4ac8-a9a3-f2217492a883","resolution":{"observed_at":"2026-08-01T18:21:11.399876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:11.465759Z","title":"Cross-view action modeling, learning, and recognition,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:11.465759Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:a1df5c5b4c29da49a42daa73b2fa273e9ac63eaf3e0274369e35a1d9e9bcb5ba","observation_id":"a077b748-e073-4bcc-b7c7-4baac3985236","resolution":{"observed_at":"2026-08-01T18:21:11.465759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:11.530526Z","title":"Pku-mmd: A large scale benchmark for skeleton-based human action understanding,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:11.530526Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:0c9ccc911687695eb7c8473e354d58852895cb9af999f6914767d5cc8d887d00","observation_id":"954958a8-515f-42fb-a328-35f8f7ca4df5","resolution":{"observed_at":"2026-08-01T18:21:11.530526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:11.585362Z","title":"Toyota smarthome: Real-world activities of daily living,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:11.585362Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:34b64ac42494036b5a8063ae2db75ccc240b19d8a3c58cc9383240d89eaab4b8","observation_id":"c560dc9a-680b-4689-b28e-b353030dfbab","resolution":{"observed_at":"2026-08-01T18:21:11.585362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:11.645610Z","title":"Assemblyhands: Towards egocentric activity understanding via 3d hand pose estimation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:11.645610Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:d79d3612d89a47b8075de0e758b55dbb512f9abfc229242a5702018140b70312","observation_id":"05e1bf88-6c1d-4c99-81df-c1abed806a04","resolution":{"observed_at":"2026-08-01T18:21:11.645610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:11.736107Z","title":"Hi4d: 4d instance segmentation of close human interaction,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:11.736107Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:737a6b21461921ddb2d70f670139e02a3bec1c4faf1417edd8f45f7ac307b963","observation_id":"3b12d4f8-6b9f-4aa9-9ce9-c21e7a3bad7d","resolution":{"observed_at":"2026-08-01T18:21:11.736107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:11.841894Z","title":"Inter-x: Towards versatile human-human interaction analysis,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:11.841894Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:f84b1e5b46e9e1ad126c080e28355f5ae908d003e277c28e9bffeead468d474c","observation_id":"0e3f7ffe-dcea-4678-aa2c-2130e4ae9743","resolution":{"observed_at":"2026-08-01T18:21:11.841894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:11.931996Z","title":"Intergen: Diffusion- based multi-human motion generation under complex interactions,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:11.931996Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:5fe9d88ac3c5b0a9cf20fd7918eab1780d186d290016456326b80f97cb3d7680","observation_id":"49a22bd0-b2ef-4209-87ea-a56b241b0ad7","resolution":{"observed_at":"2026-08-01T18:21:11.931996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:12.019710Z","title":"Co- occurrence feature learning for skeleton based action recognition using regularized deep lstm networks,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:12.019710Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:3df3091d2d1e584d720a5be54510b6870c001da3e2aaea224e0029f9806e46a6","observation_id":"1962c390-3198-440f-83f9-01174a62e532","resolution":{"observed_at":"2026-08-01T18:21:12.019710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:12.104857Z","title":"Spatio-temporal lstm with trust gates for 3d human action recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:12.104857Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:874f20e2286c499c4992a49de9259665e0e4c4a5d1e587709f4f02cbe81dceb0","observation_id":"7e570168-d120-421c-aef8-61588b8fb13f","resolution":{"observed_at":"2026-08-01T18:21:12.104857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:12.199712Z","title":"Global context- aware attention lstm networks for 3d action recognition,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:12.199712Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:15ad33d3e879525b43a56cc2f3eadceb236b98d7cb34e4eeb2ad639e23fa9157","observation_id":"58a98e70-e3bf-4fda-9255-4003d7b0539c","resolution":{"observed_at":"2026-08-01T18:21:12.199712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:12.270756Z","title":"View adaptive recurrent neural networks for high performance human action recognition from skeleton data,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:12.270756Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:68b68d8e9a6b00817f31b53e24991eac7ed134c9c9a8476a77be9db85e971824","observation_id":"0cf724c6-1915-476b-867d-e92c461ae28f","resolution":{"observed_at":"2026-08-01T18:21:12.270756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:12.337676Z","title":"Skeleton- based human action recognition with global context-aware attention lstm networks,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:12.337676Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:3e75c60d9408c689898a3abff2ef371cc8edc061a654655ca270d92aee6d2393","observation_id":"5b209244-70a6-428a-8bc8-2ef5a5073cb7","resolution":{"observed_at":"2026-08-01T18:21:12.337676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:12.423657Z","title":"View adaptive neural networks for high performance skeleton-based human action recognition,","venue":null,"work_id":null,"year":1963},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:12.423657Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:4518b38f5cf3a6e4a76cbf15691d7d4e64236a605c488b277d7ca34bd4631f19","observation_id":"23ced6bd-bc2d-4956-82fd-c3df7991a616","resolution":{"observed_at":"2026-08-01T18:21:12.423657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:12.486465Z","title":"Spatial temporal graph convolutional networks for skeleton-based action recognition,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:12.486465Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:251d904cd284821104f4d9bc0fded381cd41bbe1f486415e3a2d0ba78809cf57","observation_id":"b4666388-3143-4b94-9549-c840d6a7a990","resolution":{"observed_at":"2026-08-01T18:21:12.486465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:12.569946Z","title":"Actional- structural graph convolutional networks for skeleton-based action recognition,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:12.569946Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:bfdac10594895e52f7405787a146779c792244f521fe0fda5ced86dbebfe8ab1","observation_id":"c91601c3-5257-4076-964d-4089b1d86e7b","resolution":{"observed_at":"2026-08-01T18:21:12.569946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:12.642871Z","title":"Two-stream adaptive graph convolutional networks for skeleton-based action recognition,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:12.642871Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:8fd4c4a2e716ece5fa51608d7477fd9af219a62018b7d0f63cefe4810e31607d","observation_id":"5e60b00b-d27e-4d95-8591-6115b7e229a4","resolution":{"observed_at":"2026-08-01T18:21:12.642871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:12.707488Z","title":"Disentangling and unifying graph convolutions for skeleton-based action recognition,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:12.707488Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:65bc4e0749267f597e9741cd46e8a507ca7d990b6d8f19678b2684c53d58ae48","observation_id":"7a319087-4600-419c-8a22-2fcc4f5bde15","resolution":{"observed_at":"2026-08-01T18:21:12.707488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:12.805008Z","title":"Channel- wise topology refinement graph convolution for skeleton-based action recognition,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:12.805008Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:8afbd93c111d07d20d4f571934ed30e25bdc337053fd554228a8254611523ee3","observation_id":"abd5269c-81bc-4ad2-b8d0-f57c64d059e3","resolution":{"observed_at":"2026-08-01T18:21:12.805008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:12.847241Z","title":"Infogcn: Representation learning for human skeleton-based action recognition,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:12.847241Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:621632ce687c2f03a98a41944d4f3de2dcb1fd4e97a8d01d7ffd8717908d87fc","observation_id":"239522a0-ef9a-4753-9819-2ccd8df1ed31","resolution":{"observed_at":"2026-08-01T18:21:12.847241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:12.933769Z","title":"Hierarchically decomposed graph convolutional networks for skeleton-based action recognition,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:12.933769Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:7ff4ef7c856538edb0fe74a705100eb92d3775623e7698e4fcef004ff28515ca","observation_id":"18d3ee4d-9f2d-483b-8ee3-58ffde788df7","resolution":{"observed_at":"2026-08-01T18:21:12.933769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:13.020006Z","title":"Hypergraph neural network for skeleton-based action recognition,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:13.020006Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:8ee795889cefb8d210286edb548bc09351af1b7ccea1a3931b963fd3a199693e","observation_id":"6fe8c15d-4a3f-4d8c-aa53-dae0e6da72c7","resolution":{"observed_at":"2026-08-01T18:21:13.020006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:13.120271Z","title":"Pyskl: Towards good practices for skeleton action recognition,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:13.120271Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:62b56894b728eab34b74f850422b6f13d25e99b3f94307d5c961efad7864a2dd","observation_id":"b284625b-d0c0-488d-8f5b-56bf8af7e2bf","resolution":{"observed_at":"2026-08-01T18:21:13.120271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:13.175203Z","title":"Tsgcnext: Dynamic-static multi- graph convolution for efficient skeleton-based action recognition,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:13.175203Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:480bf14ac01b0bdf34869ab70df94a9e066c35606a1bb770ae44142d4b6bb03b","observation_id":"bce7de06-1296-49ab-b837-5d4959723de2","resolution":{"observed_at":"2026-08-01T18:21:13.175203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:13.258049Z","title":"Degcn: Deformable graph convolutional networks for skeleton-based action recognition,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:13.258049Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:7a4289d72ef1e52503d55467105ac73c282683c3f0489ce3f37d0bca0e5cf564","observation_id":"89205f9b-a9e2-4a26-9050-75cef5936e05","resolution":{"observed_at":"2026-08-01T18:21:13.258049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:13.325175Z","title":"Blockgcn: Redefine topology awareness for skeleton-based action recognition,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:13.325175Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:8cb54adf8d7f622059e6b57f68eee167ecc4ea85b87f613fcbf5679f21a166ac","observation_id":"4a259862-c210-488a-8454-4309140538e4","resolution":{"observed_at":"2026-08-01T18:21:13.325175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:13.376027Z","title":"Decoupled spatial-temporal attention network for skeleton-based action-gesture recognition,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:13.376027Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:f19cb4d504cb71a633f39d882f2084b3c392ad7c72d7edff36c18e9b4b7c2068","observation_id":"61941a91-3db5-47bc-994a-509ae710b6f9","resolution":{"observed_at":"2026-08-01T18:21:13.376027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:13.491933Z","title":"Spatio-temporal segments attention for skeleton-based action recognition,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:13.491933Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:1cb4079adcc5bd977e346dfff71e25b24e2a5a63e26c7bb60781e46fedfe9d3c","observation_id":"7d908153-5491-4679-b4f7-8f9596087bc0","resolution":{"observed_at":"2026-08-01T18:21:13.491933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09590","last_updated":"2023-03-21T17:34:34Z","snapshot_observed_at":"2026-07-06T14:19:51.472138Z","submitted_at":"2022-11-17T15:36:48Z","title":"Hypergraph Transformer for Skeleton-based Action Recognition","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09590","snapshot_observed_at":"2026-08-01T18:21:13.534206Z","title":"Hypergraph transformer for skeleton-based action recognition,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:13.534206Z"},"links":{"cited_paper":"/paper/2211.09590","citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:07e6861849f1a4f3dd91fec4f673650bddc34a5f18b3ffc0abb87f0a9caac155","observation_id":"c8cb5b93-cec8-4851-9b02-89d7bb7ea793","resolution":{"observed_at":"2026-08-01T18:21:13.534206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:13.618486Z","title":"A cuboid cnn model with an attention mechanism for skeleton-based action recognition,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:13.618486Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:3b72f63c28e7cd477c2584be486b11e74df74739864e992152a2a3e968e7bed9","observation_id":"d8713d02-dd39-4870-8939-421bf891220c","resolution":{"observed_at":"2026-08-01T18:21:13.618486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03288","last_updated":"2023-12-06T04:36:58Z","snapshot_observed_at":"2026-08-09T02:23:06.166251Z","submitted_at":"2023-12-06T04:36:58Z","title":"STEP CATFormer: Spatial-Temporal Effective Body-Part Cross Attention Transformer for Skeleton-based Action Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03288","snapshot_observed_at":"2026-08-01T18:21:13.704217Z","title":"Step catformer: Spatial-temporal effective body- part cross attention transformer for skeleton-based action recognition,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:13.704217Z"},"links":{"cited_paper":"/paper/2312.03288","citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:b9efceed9bee9961a89434be4334164a7b189bf072d0de2a963ff25b1c69952a","observation_id":"0efc7719-e3d1-4a25-b2bd-211f961d4aeb","resolution":{"observed_at":"2026-08-01T18:21:13.704217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:13.759196Z","title":"Masked motion predictors are strong 3d action representation learners,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:13.759196Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:5b35028a911ecdca4fd1ff101a4282f8fc87ed509938fa5359c8886eebf4b402","observation_id":"73ab89bc-4da1-4997-b6ee-5945e1e346ca","resolution":{"observed_at":"2026-08-01T18:21:13.759196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:13.817039Z","title":"Psumnet: Unified modality part streams are all you need for efficient pose-based action recognition,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:13.817039Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:df2bb652edeb5ef14290039f7332dc76a109dc63078ccd620a9e28468f369d14","observation_id":"d56557d4-e197-4be0-94f2-d429fbbb86be","resolution":{"observed_at":"2026-08-01T18:21:13.817039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:13.886737Z","title":"Skateformer: Skeletal-temporal transformer for human action recognition,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:13.886737Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:4f3dbd48c0527cab3bc906c22be4369dde1ea3a754decfbab81e2b9f7eb135d1","observation_id":"323c8ea3-cfab-45f6-a88e-afe45d40ba91","resolution":{"observed_at":"2026-08-01T18:21:13.886737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:13.971238Z","title":"Multiview skeletal interaction recognition using active joint interaction graph,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:13.971238Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:4691675ff98622fbe52025b90c808f48b0be05291c4334c7932e085442b373b4","observation_id":"5781b28b-6313-470d-aea4-7b76d77abe6c","resolution":{"observed_at":"2026-08-01T18:21:13.971238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:14.058803Z","title":"Interactive body part contrast mining for human interaction recognition,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:14.058803Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:254e8e9859a5dbc245737c11f2e4dcce0fc6ba2998e0b00d27868e48c5d2c067","observation_id":"c52fd08a-b417-4ad8-8832-5f88a5d5a37d","resolution":{"observed_at":"2026-08-01T18:21:14.058803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:14.118038Z","title":"Chase: Learning convex hull adaptive shift for skeleton-based multi-entity action recognition,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:14.118038Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:80907469d92a219786e4a4837f3fd2b414b37a5db1fd4467891d1a2c562879bc","observation_id":"0147526d-3360-4cbf-ac5d-85bbc6a14995","resolution":{"observed_at":"2026-08-01T18:21:14.118038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:14.191847Z","title":"Skeletr: Towards skeleton-based action recognition in the wild,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:14.191847Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:56d9b2a112ea561bda2935fc911981fd78cb9b60e06b67c70e069b4cab41d548","observation_id":"7a01ce0f-e7af-486b-8472-7d9420d7cb2e","resolution":{"observed_at":"2026-08-01T18:21:14.191847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:14.274373Z","title":"Assembly101: A large-scale multi-view video dataset for understanding procedural activities,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:14.274373Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:955d0142deb9f01828f86ccef2a466a844c9f8b440a6a0970c4b75ebdfeddbbe","observation_id":"5c995f58-9dbb-4e94-92e8-66d54f4ffd67","resolution":{"observed_at":"2026-08-01T18:21:14.274373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:14.422750Z","title":"Hi- erarchical temporal transformer for 3d hand pose estimation and action recognition from egocentric rgb videos,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:14.422750Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:98b796f5745673e603d4ed71e69d0baf642e90cb3d144bedb78d8ee4af609d9f","observation_id":"7b59badd-1d3a-4721-b2eb-14eb596613f8","resolution":{"observed_at":"2026-08-01T18:21:14.422750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:14.565208Z","title":"H2o: Two hands manipulating objects for first person interaction recognition,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:14.565208Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:bafac2cdf973a9268503e8a1abb08df035ed47a519db97701aeca58da199d07d","observation_id":"a04c70f9-a7e4-42c4-a759-53eb3bd9df1c","resolution":{"observed_at":"2026-08-01T18:21:14.565208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:14.688115Z","title":"H+o: Unified egocentric recog- nition of 3d hand-object poses and interactions,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:14.688115Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:7756fe6d2eb8869a364e7e8098e7517ed6b27bb55150645075db96a49d28f8cb","observation_id":"2590d7a6-6a85-4adc-9297-e88e1634a877","resolution":{"observed_at":"2026-08-01T18:21:14.688115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:14.828571Z","title":"On the utility of 3d hand poses for action recognition,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:14.828571Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:e2f1f9b2cf0161d11ffcb2b8d9c27b024d8a978e4b97c09b5675467e9b966c3a","observation_id":"5131161e-cf06-4d02-9a33-c8b979b06b45","resolution":{"observed_at":"2026-08-01T18:21:14.828571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:14.937220Z","title":"Transformer-based unified recognition of two hands manipulating objects,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:14.937220Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:2a735f55ef4334fa38e647470ffc87a70f3e2f46e86cf36d2cdf308a9b8366b9","observation_id":"1abba3cd-dbdf-40d7-8b16-b23f397b5d68","resolution":{"observed_at":"2026-08-01T18:21:14.937220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:15.108508Z","title":"In my perspective, in my hands: Accurate egocentric 2d hand pose and action recognition,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:15.108508Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:42340226344a64021a37e4f47f9ac3749ea766f3a0b57f42ce72aaf50aa2636f","observation_id":"0f3ff4e7-6f20-469b-bb96-23fe62c1c32b","resolution":{"observed_at":"2026-08-01T18:21:15.108508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:15.240265Z","title":"B2c-afm: Bi-directional co-temporal and cross-spatial attention fusion model for human action recognition,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:15.240265Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:67a1a8cfad71f60ef21af42308a5fc632b2145be050752e8e262d83d3c9f4d61","observation_id":"6581e412-6bde-41ae-a9fc-7c08277d89ca","resolution":{"observed_at":"2026-08-01T18:21:15.240265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:15.379747Z","title":"Cross-modal learning with 3d deformable attention for action recognition,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:15.379747Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:c1b5e6fb742174a0f42b2e5857b5b1612777763cb155f80e276565bcf28ee93f","observation_id":"bc771137-6408-4c40-aa4e-ad3147f2a8be","resolution":{"observed_at":"2026-08-01T18:21:15.379747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:15.498039Z","title":"Vpn++: Rethinking video- pose embeddings for understanding activities of daily living,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:15.498039Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:073e598e194c5ac1edef5f37b23a6e567b58ce8d0bdc0ab844447f62efb25647","observation_id":"4732a5a2-9a9e-4c5f-afe1-d95811ae4a02","resolution":{"observed_at":"2026-08-01T18:21:15.498039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:15.613900Z","title":"Revisiting skeleton- based action recognition,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:15.613900Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:8d97d674c8500d2182237bd5213f9d8406a5953c92f2a18cb043c814a0f277ef","observation_id":"73258562-4bc5-4e67-931d-b6c457569a18","resolution":{"observed_at":"2026-08-01T18:21:15.613900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:15.671833Z","title":"Star-transformer: A spatio- temporal cross attention transformer for human action recognition,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:15.671833Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:fcfd7a745986b60d8af7d883c9e340fbe620b903283d5cbd324f8dfe42de16d6","observation_id":"5c8db89e-55d3-4d30-9ee5-b57cfcfa881f","resolution":{"observed_at":"2026-08-01T18:21:15.671833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:15.722978Z","title":"Multi- view action recognition using contrastive learning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:15.722978Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:568b02b6e748fdf2c05b5875b02bdf9f6359e0de744dded9813bb2adca3a8a16","observation_id":"7d649ab9-b2bb-4990-9b89-4ca4899181ad","resolution":{"observed_at":"2026-08-01T18:21:15.722978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:21:15.822933Z","title":"Explore human parsing modality for action recognition,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-01T18:21:15.822933Z"},"links":{"citing_paper":"/paper/2607.17342"},"observation_digest":"sha256:ff9191ef407326c2858f86f36f42676952a873e3a4326424051e7a54e1c30e3b","observation_id":"c5e4f397-0ee3-436c-b779-728d798c8cb7","resolution":{"observed_at":"2026-08-01T18:21:15.822933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.17342","last_updated":"2026-07-19T17:05:46Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T02:23:25.183795Z","submitted_at":"2026-07-19T17:05:46Z","title":"STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":100,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":118},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 100 of 118 outbound references and 0 inbound Pith citation observations for arXiv:2607.17342."}