{"as_of":"2026-08-13T14:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:71cef4ec6c8a9d9f796e734b0fb44925932583c02911634885158ef686114e34","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T10:54:54.479989Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.03609/citation-record","integrity":"/paper/2509.03609/integrity","json":"/paper/2509.03609/citation-record.json","paper":"/paper/2509.03609"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:54.910305Z","title":"S-jepa: A joint embedding predictive architecture for skeletal action recog- nition","venue":null,"work_id":"6ade418e-2515-4a8d-8ecf-dbc2dbf9f865","year":2024},"citing_paper":{"arxiv_id":"2509.03609","last_updated":"2025-09-03T18:05:02Z","snapshot_observed_at":"2026-08-06T02:08:41.944215Z","submitted_at":"2025-09-03T18:05:02Z","title":"Towards Efficient General Feature Prediction in Masked Skeleton Modeling","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T10:54:54.355356Z"},"links":{"citing_paper":"/paper/2509.03609"},"observation_digest":"sha256:724abaebc299bdb6de8f097bd164996111d8705f4225ed81e849e0a17759cfea","observation_id":"a506e87b-1d12-42e0-b0c3-246731f11114","resolution":{"observed_at":"2026-08-05T10:54:54.913747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:54.901358Z","title":"Vi- creg: Variance-invariance-covariance regularization for self- supervised learning","venue":null,"work_id":"771a1b54-0180-4519-9b7d-092b7218d0ee","year":2022},"citing_paper":{"arxiv_id":"2509.03609","last_updated":"2025-09-03T18:05:02Z","snapshot_observed_at":"2026-08-06T02:08:41.944215Z","submitted_at":"2025-09-03T18:05:02Z","title":"Towards Efficient General Feature Prediction in Masked Skeleton Modeling","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T10:54:54.358853Z"},"links":{"citing_paper":"/paper/2509.03609"},"observation_digest":"sha256:d18ca5c387c3d93599717725e208ec5738cee7062d89931d925da0f7d00fbe59","observation_id":"15ef3ba4-e0ae-4477-99c6-3f7ad63f7971","resolution":{"observed_at":"2026-08-05T10:54:54.904435Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:54.891530Z","title":"Hi- erarchically self-supervised transformer for human skeleton representation learning","venue":null,"work_id":"7c143fd4-81ce-4e70-b2ba-896ba1342d9c","year":2022},"citing_paper":{"arxiv_id":"2509.03609","last_updated":"2025-09-03T18:05:02Z","snapshot_observed_at":"2026-08-06T02:08:41.944215Z","submitted_at":"2025-09-03T18:05:02Z","title":"Towards Efficient General Feature Prediction in Masked Skeleton Modeling","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T10:54:54.361851Z"},"links":{"citing_paper":"/paper/2509.03609"},"observation_digest":"sha256:88386a847b6bab670e2ad9948dfa9a48ea1dc6207d8411f5bb188b85f73da6ec","observation_id":"56478584-e504-4daf-9364-1f8297721ea5","resolution":{"observed_at":"2026-08-05T10:54:54.895313Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:54.882330Z","title":"Skeleton-based action recognition with shift graph convolutional network","venue":null,"work_id":"c48a57a0-478e-4757-947c-130960d02739","year":2020},"citing_paper":{"arxiv_id":"2509.03609","last_updated":"2025-09-03T18:05:02Z","snapshot_observed_at":"2026-08-06T02:08:41.944215Z","submitted_at":"2025-09-03T18:05:02Z","title":"Towards Efficient General Feature Prediction in Masked Skeleton Modeling","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T10:54:54.364748Z"},"links":{"citing_paper":"/paper/2509.03609"},"observation_digest":"sha256:efd23662c384d07eb82e1c982d323ee5d67a5078b9b722ccd0c5b85458a045de","observation_id":"ab28c320-6a3c-4c65-bab0-b79c20075f6c","resolution":{"observed_at":"2026-08-05T10:54:54.885794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:54.873158Z","title":"Hierarchical transformer: Unsupervised representation learning for skeleton-based hu- man action recognition","venue":null,"work_id":"18369357-16fa-4def-bde8-dae3d160c1be","year":2021},"citing_paper":{"arxiv_id":"2509.03609","last_updated":"2025-09-03T18:05:02Z","snapshot_observed_at":"2026-08-06T02:08:41.944215Z","submitted_at":"2025-09-03T18:05:02Z","title":"Towards Efficient General Feature Prediction in Masked Skeleton Modeling","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T10:54:54.367797Z"},"links":{"citing_paper":"/paper/2509.03609"},"observation_digest":"sha256:ac31e32bc1e16f4518ac4872e0d22944fe4197e5da81970d3546c03610bf89bd","observation_id":"d185dfd8-81fc-4f80-b613-b24d0f863d3d","resolution":{"observed_at":"2026-08-05T10:54:54.876439Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:54.864045Z","title":"Hierarchical contrast for unsu- pervised skeleton-based action representation learning","venue":null,"work_id":"4146f560-1742-4b31-87f9-cc2888fdbfa1","year":2023},"citing_paper":{"arxiv_id":"2509.03609","last_updated":"2025-09-03T18:05:02Z","snapshot_observed_at":"2026-08-06T02:08:41.944215Z","submitted_at":"2025-09-03T18:05:02Z","title":"Towards Efficient General Feature Prediction in Masked Skeleton Modeling","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T10:54:54.371107Z"},"links":{"citing_paper":"/paper/2509.03609"},"observation_digest":"sha256:1142a11cc9982e1e4d296a50e9d1fc802e10c0d1aa519e0704ed40f39ea49ce0","observation_id":"cbef9f49-de5e-49ca-93a3-1a8a39609e52","resolution":{"observed_at":"2026-08-05T10:54:54.867045Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-13T02:40:23.887636Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-05T10:54:54.374483Z","title":"An image is worth 16x16 words: Trans- formers for image recognition at scale","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2509.03609","last_updated":"2025-09-03T18:05:02Z","snapshot_observed_at":"2026-08-06T02:08:41.944215Z","submitted_at":"2025-09-03T18:05:02Z","title":"Towards Efficient General Feature Prediction in Masked Skeleton Modeling","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T10:54:54.374483Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2509.03609"},"observation_digest":"sha256:2086de49bb6ccf9610343bb22c5cb84d07affa75b6680c6842a821e40b225c30","observation_id":"5077a4b2-c16f-456b-b123-a4277763e7f8","resolution":{"observed_at":"2026-08-05T10:54:54.374483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:54.855064Z","title":"Slowfast networks for video recognition","venue":null,"work_id":"7c406c9b-d575-49f4-891d-ffb7ec25662e","year":2019},"citing_paper":{"arxiv_id":"2509.03609","last_updated":"2025-09-03T18:05:02Z","snapshot_observed_at":"2026-08-06T02:08:41.944215Z","submitted_at":"2025-09-03T18:05:02Z","title":"Towards Efficient General Feature Prediction in Masked Skeleton Modeling","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T10:54:54.377580Z"},"links":{"citing_paper":"/paper/2509.03609"},"observation_digest":"sha256:063bd7b5ee0ee68da773d156bd9856ece2ded4fc65a193a1290a1e0323a1e1a8","observation_id":"a81e37da-bcd0-4e34-aec2-0de782f553b7","resolution":{"observed_at":"2026-08-05T10:54:54.858250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.06242","last_updated":"2023-03-10T23:22:41Z","snapshot_observed_at":"2026-08-13T12:27:22.610025Z","submitted_at":"2023-03-10T23:22:41Z","title":"HYperbolic Self-Paced Learning for Self-Supervised Skeleton-based Action Representations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.06242","snapshot_observed_at":"2026-08-05T10:54:54.380535Z","title":"Hyperbolic self-paced learning for self-supervised skeleton-based action representations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.03609","last_updated":"2025-09-03T18:05:02Z","snapshot_observed_at":"2026-08-06T02:08:41.944215Z","submitted_at":"2025-09-03T18:05:02Z","title":"Towards Efficient General Feature Prediction in Masked Skeleton Modeling","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T10:54:54.380535Z"},"links":{"cited_paper":"/paper/2303.06242","citing_paper":"/paper/2509.03609"},"observation_digest":"sha256:61bfa8647450c352552cbcd804ca56163d4905146c2a41b494a722b953a3dc9b","observation_id":"7c1ea018-5e9f-4cc2-9e3a-b816e900955d","resolution":{"observed_at":"2026-08-05T10:54:54.380535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:54.845639Z","title":"Part aware contrastive learning for self-supervised action recognition","venue":null,"work_id":"97dd1017-9e8e-425c-89c8-5bdc110a969e","year":2023},"citing_paper":{"arxiv_id":"2509.03609","last_updated":"2025-09-03T18:05:02Z","snapshot_observed_at":"2026-08-06T02:08:41.944215Z","submitted_at":"2025-09-03T18:05:02Z","title":"Towards Efficient General Feature Prediction in Masked Skeleton Modeling","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T10:54:54.383654Z"},"links":{"citing_paper":"/paper/2509.03609"},"observation_digest":"sha256:fa1e7514e0d6ae8eb50ea4fa8b0872a5614ca4550b44079f5e910b32520e016c","observation_id":"7e92213a-803c-49ef-abdc-5f6f10bd4cfa","resolution":{"observed_at":"2026-08-05T10:54:54.848809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:54.837143Z","title":"3d convolu- tional neural networks for human action recognition","venue":null,"work_id":"0c7ebda3-3c48-4452-b7b1-55eae77c186c","year":2012},"citing_paper":{"arxiv_id":"2509.03609","last_updated":"2025-09-03T18:05:02Z","snapshot_observed_at":"2026-08-06T02:08:41.944215Z","submitted_at":"2025-09-03T18:05:02Z","title":"Towards Efficient General Feature Prediction in Masked Skeleton Modeling","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T10:54:54.386550Z"},"links":{"citing_paper":"/paper/2509.03609"},"observation_digest":"sha256:6010c4600fa0f72e8d4a378909f0b07e0e1b2ffb6a77e32d1a8fee53a4d29dbd","observation_id":"9e542855-7d48-41d2-8cc3-22199eb17dcf","resolution":{"observed_at":"2026-08-05T10:54:54.839954Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:54.828204Z","title":"Global-local motion transformer for unsupervised skeleton-based action learning","venue":null,"work_id":"2e1ad95b-d41d-4a0c-81ca-89bd336eb132","year":2022},"citing_paper":{"arxiv_id":"2509.03609","last_updated":"2025-09-03T18:05:02Z","snapshot_observed_at":"2026-08-06T02:08:41.944215Z","submitted_at":"2025-09-03T18:05:02Z","title":"Towards Efficient General Feature Prediction in Masked Skeleton Modeling","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T10:54:54.389477Z"},"links":{"citing_paper":"/paper/2509.03609"},"observation_digest":"sha256:98cdfa9ba7c354e0a881ba7419a669e736205d81dec1b197902a1175d38e158e","observation_id":"bd3b7688-23f8-4bff-9105-fae0fdfbfeec","resolution":{"observed_at":"2026-08-05T10:54:54.831408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:54.818933Z","title":"Hmdb: a large video database for human motion recognition","venue":null,"work_id":"23502dfb-c420-474a-be56-df0bc611c92f","year":2011},"citing_paper":{"arxiv_id":"2509.03609","last_updated":"2025-09-03T18:05:02Z","snapshot_observed_at":"2026-08-06T02:08:41.944215Z","submitted_at":"2025-09-03T18:05:02Z","title":"Towards Efficient General Feature Prediction in Masked Skeleton Modeling","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T10:54:54.392210Z"},"links":{"citing_paper":"/paper/2509.03609"},"observation_digest":"sha256:6322fe4ec4bcefbc8982f5eae52ed61bd47ec04858fab75d83a0b18694fc8481","observation_id":"11d59fc5-9f7a-4f22-9b6a-1eb0f67b0f0b","resolution":{"observed_at":"2026-08-05T10:54:54.822016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:54.809733Z","title":"Unsupervised feature learning of human actions as trajectories in pose embedding manifold","venue":null,"work_id":"9edbee20-2f99-4309-a1ed-ecbfdff1c8d5","year":2019},"citing_paper":{"arxiv_id":"2509.03609","last_updated":"2025-09-03T18:05:02Z","snapshot_observed_at":"2026-08-06T02:08:41.944215Z","submitted_at":"2025-09-03T18:05:02Z","title":"Towards Efficient General Feature Prediction in Masked Skeleton Modeling","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T10:54:54.395204Z"},"links":{"citing_paper":"/paper/2509.03609"},"observation_digest":"sha256:d9765da57d95a6152bd7b5a866ee097350c27bbbb146352e20a4b9af973d4beb","observation_id":"97bab5ee-bd6e-4afb-99ee-e78328b8c10f","resolution":{"observed_at":"2026-08-05T10:54:54.812780Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:54.800628Z","title":"3d human action rep- resentation learning via cross-view consistency pursuit","venue":null,"work_id":"f0d4d3fe-f429-4ca7-97f8-75629de75015","year":2021},"citing_paper":{"arxiv_id":"2509.03609","last_updated":"2025-09-03T18:05:02Z","snapshot_observed_at":"2026-08-06T02:08:41.944215Z","submitted_at":"2025-09-03T18:05:02Z","title":"Towards Efficient General Feature Prediction in Masked Skeleton Modeling","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T10:54:54.397705Z"},"links":{"citing_paper":"/paper/2509.03609"},"observation_digest":"sha256:153e4d2d1294e7c918396bce663000a7f0ef1574245db76d957aa4310edb9fcc","observation_id":"fbbb602e-3d87-4fee-985c-e699fdd4c03a","resolution":{"observed_at":"2026-08-05T10:54:54.803822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:54.791190Z","title":"Actionlet- dependent contrastive learning for unsupervised skeleton- based action recognition","venue":null,"work_id":"0d778e7f-d643-4474-be5f-069ace123c8a","year":2023},"citing_paper":{"arxiv_id":"2509.03609","last_updated":"2025-09-03T18:05:02Z","snapshot_observed_at":"2026-08-06T02:08:41.944215Z","submitted_at":"2025-09-03T18:05:02Z","title":"Towards Efficient General Feature Prediction in Masked Skeleton Modeling","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T10:54:54.400442Z"},"links":{"citing_paper":"/paper/2509.03609"},"observation_digest":"sha256:ae57e2ac43c032f623d71e0b5ef73c8c34a47c5d9b616faf27766dd2c7ca2340","observation_id":"5aeabc4a-0d3b-4c03-9cf6-294a6826e733","resolution":{"observed_at":"2026-08-05T10:54:54.794295Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:54.781888Z","title":"Ntu rgb+d 120: A large- scale benchmark for 3d human activity understanding","venue":null,"work_id":"d5033ac9-97fc-4c8e-95ea-f6ab4aca72b2","year":2019},"citing_paper":{"arxiv_id":"2509.03609","last_updated":"2025-09-03T18:05:02Z","snapshot_observed_at":"2026-08-06T02:08:41.944215Z","submitted_at":"2025-09-03T18:05:02Z","title":"Towards Efficient General Feature Prediction in Masked Skeleton Modeling","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T10:54:54.403126Z"},"links":{"citing_paper":"/paper/2509.03609"},"observation_digest":"sha256:51e1cef9c267f007802d2801e66501cef05445d7c146d2402c10e1bd3c018f56","observation_id":"77b5d7e2-c33b-48a7-891b-f31926815278","resolution":{"observed_at":"2026-08-05T10:54:54.785145Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:54.772554Z","title":"A benchmark dataset and comparison study for multi-modal human action analytics","venue":null,"work_id":"d8acf402-3a4c-4c84-bd72-51a40d621b42","year":2020},"citing_paper":{"arxiv_id":"2509.03609","last_updated":"2025-09-03T18:05:02Z","snapshot_observed_at":"2026-08-06T02:08:41.944215Z","submitted_at":"2025-09-03T18:05:02Z","title":"Towards Efficient General Feature Prediction in Masked Skeleton Modeling","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T10:54:54.405754Z"},"links":{"citing_paper":"/paper/2509.03609"},"observation_digest":"sha256:1577e09b8104fca83f387361c2d68fdc85ff1b783780e4f69e18dc060a37ca43","observation_id":"faef2676-c0d6-4f38-80a5-f6426a08458e","resolution":{"observed_at":"2026-08-05T10:54:54.775978Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:54.762769Z","title":"Cmd: Self-supervised 3d action representation learning with cross-modal mutual distillation","venue":null,"work_id":"16d9db62-eed8-49c8-8392-aff3ad5d1696","year":null},"citing_paper":{"arxiv_id":"2509.03609","last_updated":"2025-09-03T18:05:02Z","snapshot_observed_at":"2026-08-06T02:08:41.944215Z","submitted_at":"2025-09-03T18:05:02Z","title":"Towards Efficient General Feature Prediction in Masked Skeleton Modeling","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T10:54:54.408374Z"},"links":{"citing_paper":"/paper/2509.03609"},"observation_digest":"sha256:f56fee9c57c97e8561b0e5940f41b752d72af4b9c869a1c4de45b39a0f1e9d24","observation_id":"81f939a3-dc22-4798-bf48-c4ccf9cdc4da","resolution":{"observed_at":"2026-08-05T10:54:54.766163Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:54.753865Z","title":"Masked motion predictors are strong 3d action representation learners","venue":null,"work_id":"ca1094f9-26f3-4fd3-89d6-2127b14bf851","year":2023},"citing_paper":{"arxiv_id":"2509.03609","last_updated":"2025-09-03T18:05:02Z","snapshot_observed_at":"2026-08-06T02:08:41.944215Z","submitted_at":"2025-09-03T18:05:02Z","title":"Towards Efficient General Feature Prediction in Masked Skeleton Modeling","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T10:54:54.411327Z"},"links":{"citing_paper":"/paper/2509.03609"},"observation_digest":"sha256:257219593804f44cd7440b8f18b3543c7c64044252a442eb22ee30040be78738","observation_id":"d222e7a7-5ce0-4e42-90f2-e7fb7706b7ed","resolution":{"observed_at":"2026-08-05T10:54:54.756881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:54.744068Z","title":"Unsupervised 3d human pose representation with viewpoint and pose disen- tanglement","venue":null,"work_id":"88b089f1-975a-4ebd-a8b5-0af38003b104","year":2020},"citing_paper":{"arxiv_id":"2509.03609","last_updated":"2025-09-03T18:05:02Z","snapshot_observed_at":"2026-08-06T02:08:41.944215Z","submitted_at":"2025-09-03T18:05:02Z","title":"Towards Efficient General Feature Prediction in Masked Skeleton Modeling","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T10:54:54.414073Z"},"links":{"citing_paper":"/paper/2509.03609"},"observation_digest":"sha256:6d4decb2370b2c4dd826e95447ec7503c2bbcae048d0b455e07a481cc7e40e0d","observation_id":"7aa8e06d-b231-4636-8492-b877a23c7c11","resolution":{"observed_at":"2026-08-05T10:54:54.747533Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:54.735113Z","title":"Augmented skeleton based contrastive action learning with momentum lstm for unsupervised action recognition","venue":null,"work_id":"1499e4f9-2fb0-45f5-a504-c18c5493b53e","year":2021},"citing_paper":{"arxiv_id":"2509.03609","last_updated":"2025-09-03T18:05:02Z","snapshot_observed_at":"2026-08-06T02:08:41.944215Z","submitted_at":"2025-09-03T18:05:02Z","title":"Towards Efficient General Feature Prediction in Masked Skeleton Modeling","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T10:54:54.417132Z"},"links":{"citing_paper":"/paper/2509.03609"},"observation_digest":"sha256:a47fa58360acd08c55947ceb619e32d9362e446f427820e876928639e7ea604d","observation_id":"7b38a976-e829-41cc-b3a8-0c92d7f00492","resolution":{"observed_at":"2026-08-05T10:54:54.738186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:54.726387Z","title":"Halp: Hal- lucinating latent positives for skeleton-based self-supervised learning of actions","venue":null,"work_id":"4edf9c69-58bc-4a92-a17c-18e7a33b080e","year":2023},"citing_paper":{"arxiv_id":"2509.03609","last_updated":"2025-09-03T18:05:02Z","snapshot_observed_at":"2026-08-06T02:08:41.944215Z","submitted_at":"2025-09-03T18:05:02Z","title":"Towards Efficient General Feature Prediction in Masked Skeleton Modeling","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T10:54:54.419885Z"},"links":{"citing_paper":"/paper/2509.03609"},"observation_digest":"sha256:bfaef07d3fbac1c800dfef2642c13e532b0aded633a3516f7555cc999ed1afcf","observation_id":"72d652b6-2ae5-44a2-b222-c6ceb63ef7a5","resolution":{"observed_at":"2026-08-05T10:54:54.729388Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:54.717021Z","title":"Ntu rgb+d: A large scale dataset for 3d human activity anal- ysis","venue":null,"work_id":"179c8e88-3ec6-46ae-8154-87e3f853fca6","year":2016},"citing_paper":{"arxiv_id":"2509.03609","last_updated":"2025-09-03T18:05:02Z","snapshot_observed_at":"2026-08-06T02:08:41.944215Z","submitted_at":"2025-09-03T18:05:02Z","title":"Towards Efficient General Feature Prediction in Masked Skeleton Modeling","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T10:54:54.422634Z"},"links":{"citing_paper":"/paper/2509.03609"},"observation_digest":"sha256:dea5df82a719b44c814bdd5d066f2a2ec59c4cd5ad966097d2dd8ab239fa8a27","observation_id":"a899d168-614c-4ac0-a005-03ab6a5db427","resolution":{"observed_at":"2026-08-05T10:54:54.720044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:54.707774Z","title":"Skeleton-based action recognition with directed graph neu- ral networks","venue":null,"work_id":"07f164b1-5ec5-4596-9b29-c5ae55458796","year":2019},"citing_paper":{"arxiv_id":"2509.03609","last_updated":"2025-09-03T18:05:02Z","snapshot_observed_at":"2026-08-06T02:08:41.944215Z","submitted_at":"2025-09-03T18:05:02Z","title":"Towards Efficient General Feature Prediction in Masked Skeleton Modeling","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T10:54:54.425255Z"},"links":{"citing_paper":"/paper/2509.03609"},"observation_digest":"sha256:51b21e4e12febdc2f2576343fcc78b992a34b36d0d2613f6342ce011a62fec16","observation_id":"e0404f12-e618-466a-b10f-f66f9b4c1d1a","resolution":{"observed_at":"2026-08-05T10:54:54.710959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:54.698450Z","title":"Two- stream adaptive graph convolutional networks for skeleton- based action recognition","venue":null,"work_id":"afd6c7d9-7a63-4c5d-bdc1-7f09cb0748a6","year":2019},"citing_paper":{"arxiv_id":"2509.03609","last_updated":"2025-09-03T18:05:02Z","snapshot_observed_at":"2026-08-06T02:08:41.944215Z","submitted_at":"2025-09-03T18:05:02Z","title":"Towards Efficient General Feature Prediction in Masked Skeleton Modeling","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T10:54:54.427972Z"},"links":{"citing_paper":"/paper/2509.03609"},"observation_digest":"sha256:3d90ceb136fd0c2bc54d3c14b210a46d90ece9ce346d97c292588d74bd1d6486","observation_id":"5163e9ad-6c7e-4567-82b3-2a1bd45cbb4c","resolution":{"observed_at":"2026-08-05T10:54:54.701748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:54.689192Z","title":"Adversarial self-supervised learn- ing for semi-supervised 3d action recognition","venue":null,"work_id":"14aa2b7e-8bf7-495c-b273-75f7bc5d85f1","year":2020},"citing_paper":{"arxiv_id":"2509.03609","last_updated":"2025-09-03T18:05:02Z","snapshot_observed_at":"2026-08-06T02:08:41.944215Z","submitted_at":"2025-09-03T18:05:02Z","title":"Towards Efficient General Feature Prediction in Masked Skeleton Modeling","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T10:54:54.430899Z"},"links":{"citing_paper":"/paper/2509.03609"},"observation_digest":"sha256:547675fc369b275b418f00a226b5aa4b934a190d59f9ff2e44cb827e07ef3178","observation_id":"c321e805-0209-4571-b7ca-83d09881170b","resolution":{"observed_at":"2026-08-05T10:54:54.692299Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1212.0402","last_updated":"2012-12-03T14:45:31Z","snapshot_observed_at":"2026-08-12T17:34:19.526460Z","submitted_at":"2012-12-03T14:45:31Z","title":"UCF101: A Dataset of 101 Human Actions Classes From Videos in The Wild","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1212.0402","snapshot_observed_at":"2026-08-05T10:54:54.433406Z","title":"Ucf101: A dataset of 101 human actions classes from videos in the wild","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2509.03609","last_updated":"2025-09-03T18:05:02Z","snapshot_observed_at":"2026-08-06T02:08:41.944215Z","submitted_at":"2025-09-03T18:05:02Z","title":"Towards Efficient General Feature Prediction in Masked Skeleton Modeling","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T10:54:54.433406Z"},"links":{"cited_paper":"/paper/1212.0402","citing_paper":"/paper/2509.03609"},"observation_digest":"sha256:1d14506b9e1f7a2e19b84279920b872cf40b7d6127394f59730025731f808198","observation_id":"a32a27e6-53e7-4b44-8af6-5b1acb0e5c5c","resolution":{"observed_at":"2026-08-05T10:54:54.433406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:54.680161Z","title":"Predict & cluster: Unsupervised skeleton based action recognition","venue":null,"work_id":"d5ff71e4-b796-47bb-b028-7c29f8a506ab","year":2020},"citing_paper":{"arxiv_id":"2509.03609","last_updated":"2025-09-03T18:05:02Z","snapshot_observed_at":"2026-08-06T02:08:41.944215Z","submitted_at":"2025-09-03T18:05:02Z","title":"Towards Efficient General Feature Prediction in Masked Skeleton Modeling","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T10:54:54.436619Z"},"links":{"citing_paper":"/paper/2509.03609"},"observation_digest":"sha256:48ecefd95827941e6dbd5767d4f2dfb4dce06816b0868b68be288d69d9bf98b0","observation_id":"472dd817-cf66-4efa-85f5-f1d4bd994ed8","resolution":{"observed_at":"2026-08-05T10:54:54.683083Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:54.670980Z","title":"Uni- fied multi-modal unsupervised representation learning for skeleton-based action understanding","venue":null,"work_id":"88125131-1c3e-4af4-aa46-0cbf03128246","year":2023},"citing_paper":{"arxiv_id":"2509.03609","last_updated":"2025-09-03T18:05:02Z","snapshot_observed_at":"2026-08-06T02:08:41.944215Z","submitted_at":"2025-09-03T18:05:02Z","title":"Towards Efficient General Feature Prediction in Masked Skeleton Modeling","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T10:54:54.439923Z"},"links":{"citing_paper":"/paper/2509.03609"},"observation_digest":"sha256:868d8f0630b7a80aee773f052693a6456a6b3fe7fbaadb34ca51c5b36c259ccb","observation_id":"0190db0a-bbbd-4674-acc8-44143bde7349","resolution":{"observed_at":"2026-08-05T10:54:54.674023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:54.661957Z","title":"Skeleton-contrastive 3d action representation learn- ing","venue":null,"work_id":"8d284460-9d4a-4999-9538-bc50eeea36c8","year":2021},"citing_paper":{"arxiv_id":"2509.03609","last_updated":"2025-09-03T18:05:02Z","snapshot_observed_at":"2026-08-06T02:08:41.944215Z","submitted_at":"2025-09-03T18:05:02Z","title":"Towards Efficient General Feature Prediction in Masked Skeleton Modeling","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T10:54:54.442727Z"},"links":{"citing_paper":"/paper/2509.03609"},"observation_digest":"sha256:e8dce813c83f3514c2d227dca64ebde862b2c57a80a8dc0304ef4eaa2018acff","observation_id":"8edcf0eb-f886-4de6-983b-1d42dedd422a","resolution":{"observed_at":"2026-08-05T10:54:54.665096Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:54.652633Z","title":"Eulermormer: Robust eulerian motion magnification via dynamic filtering within transformer","venue":null,"work_id":"0d9de525-153b-4d5d-8b40-acce3e77f285","year":2024},"citing_paper":{"arxiv_id":"2509.03609","last_updated":"2025-09-03T18:05:02Z","snapshot_observed_at":"2026-08-06T02:08:41.944215Z","submitted_at":"2025-09-03T18:05:02Z","title":"Towards Efficient General Feature Prediction in Masked Skeleton Modeling","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T10:54:54.445605Z"},"links":{"citing_paper":"/paper/2509.03609"},"observation_digest":"sha256:1efe6841647a83bc73e93224275846217306cc080e987065702c1b355e967af0","observation_id":"5b7d1228-0710-4ce0-9f7b-7ae933783153","resolution":{"observed_at":"2026-08-05T10:54:54.655689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09220","last_updated":"2024-12-14T05:42:51Z","snapshot_observed_at":"2026-08-11T17:10:01.561328Z","submitted_at":"2024-12-12T12:20:27Z","title":"USDRL: Unified Skeleton-Based Dense Representation Learning with Multi-Grained Feature Decorrelation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.09220","snapshot_observed_at":"2026-08-05T10:54:54.448247Z","title":"Usdrl: Unified skeleton-based dense repre- sentation learning with multi-grained feature decorrelation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03609","last_updated":"2025-09-03T18:05:02Z","snapshot_observed_at":"2026-08-06T02:08:41.944215Z","submitted_at":"2025-09-03T18:05:02Z","title":"Towards Efficient General Feature Prediction in Masked Skeleton Modeling","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T10:54:54.448247Z"},"links":{"cited_paper":"/paper/2412.09220","citing_paper":"/paper/2509.03609"},"observation_digest":"sha256:5a42a3f81700cd0bf8457ebdbebda6881fd820bdc520226f4da4c93a177a5caf","observation_id":"48e522d3-e329-4e63-9649-ef5674b5e102","resolution":{"observed_at":"2026-08-05T10:54:54.448247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:54.643462Z","title":"Skeletonmae: Spatial-temporal masked au- toencoders for self-supervised skeleton action recognition","venue":null,"work_id":"cbfcf6f0-e791-414c-80da-18e1f2b62471","year":2023},"citing_paper":{"arxiv_id":"2509.03609","last_updated":"2025-09-03T18:05:02Z","snapshot_observed_at":"2026-08-06T02:08:41.944215Z","submitted_at":"2025-09-03T18:05:02Z","title":"Towards Efficient General Feature Prediction in Masked Skeleton Modeling","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T10:54:54.451393Z"},"links":{"citing_paper":"/paper/2509.03609"},"observation_digest":"sha256:9011b15575d4bc27ad7305abde0de84e699e3b262de5461b715cb0b9ce71a865","observation_id":"6ce3f9f2-0d97-4513-97d3-fbedeae01254","resolution":{"observed_at":"2026-08-05T10:54:54.646561Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:54.634405Z","title":"Deep image clustering with contrastive learn- ing and multi-scale graph convolutional networks","venue":null,"work_id":"ae9993db-5fb8-471c-9488-c0a618cc81eb","year":2024},"citing_paper":{"arxiv_id":"2509.03609","last_updated":"2025-09-03T18:05:02Z","snapshot_observed_at":"2026-08-06T02:08:41.944215Z","submitted_at":"2025-09-03T18:05:02Z","title":"Towards Efficient General Feature Prediction in Masked Skeleton Modeling","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T10:54:54.454244Z"},"links":{"citing_paper":"/paper/2509.03609"},"observation_digest":"sha256:85ad286a7829a881201e59bf26c5678e03d32567643c53791f650a9fad79a96e","observation_id":"4d14da7a-9b72-4b87-b3c1-c7b33ede5d08","resolution":{"observed_at":"2026-08-05T10:54:54.637685Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:54.625031Z","title":"Spatial tempo- ral graph convolutional networks for skeleton-based action recognition","venue":null,"work_id":"8850d9d7-2aa0-4f24-b0c6-4a3fa041c32b","year":2018},"citing_paper":{"arxiv_id":"2509.03609","last_updated":"2025-09-03T18:05:02Z","snapshot_observed_at":"2026-08-06T02:08:41.944215Z","submitted_at":"2025-09-03T18:05:02Z","title":"Towards Efficient General Feature Prediction in Masked Skeleton Modeling","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T10:54:54.457049Z"},"links":{"citing_paper":"/paper/2509.03609"},"observation_digest":"sha256:a8794cc1e5ac608dcdb0c0c1b213a187a2848ee83024fcae398273d031a42191","observation_id":"39bb0019-dd62-4576-b71d-3451801ded8d","resolution":{"observed_at":"2026-08-05T10:54:54.628294Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:54.616072Z","title":"View- invariant skeleton action representation learning via motion retargeting","venue":null,"work_id":"d0e741f9-c62a-4726-9fd1-a04514e349ba","year":2024},"citing_paper":{"arxiv_id":"2509.03609","last_updated":"2025-09-03T18:05:02Z","snapshot_observed_at":"2026-08-06T02:08:41.944215Z","submitted_at":"2025-09-03T18:05:02Z","title":"Towards Efficient General Feature Prediction in Masked Skeleton Modeling","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T10:54:54.459755Z"},"links":{"citing_paper":"/paper/2509.03609"},"observation_digest":"sha256:e3ec011d8fb37bd1422bbfef3b35eceff91cfbacb4fcd1a13117a9686562203c","observation_id":"ea99fa10-7868-4d3d-9ca0-a2ab11502837","resolution":{"observed_at":"2026-08-05T10:54:54.619152Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:54.606590Z","title":"Skeleton cloud colorization for unsupervised 3d action representation learning","venue":null,"work_id":"b6363f9e-a462-4aa9-8317-2d99d5f77c20","year":2021},"citing_paper":{"arxiv_id":"2509.03609","last_updated":"2025-09-03T18:05:02Z","snapshot_observed_at":"2026-08-06T02:08:41.944215Z","submitted_at":"2025-09-03T18:05:02Z","title":"Towards Efficient General Feature Prediction in Masked Skeleton Modeling","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T10:54:54.462730Z"},"links":{"citing_paper":"/paper/2509.03609"},"observation_digest":"sha256:c01b39746eb165e6eaec9c9eace388340f52fe289f7e27c0d9a6f6cffd89aa85","observation_id":"ccf9f152-f51d-401f-822e-3d53ff8b9454","resolution":{"observed_at":"2026-08-05T10:54:54.610004Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:54.597101Z","title":"Self-supervised 3d action representa- tion learning with skeleton cloud colorization","venue":null,"work_id":"7c3ed4ca-e185-44c8-8c78-05078c69035e","year":2024},"citing_paper":{"arxiv_id":"2509.03609","last_updated":"2025-09-03T18:05:02Z","snapshot_observed_at":"2026-08-06T02:08:41.944215Z","submitted_at":"2025-09-03T18:05:02Z","title":"Towards Efficient General Feature Prediction in Masked Skeleton Modeling","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T10:54:54.465578Z"},"links":{"citing_paper":"/paper/2509.03609"},"observation_digest":"sha256:8e7ae3018de503ba5285b6f0d45dbae9d63c46f3b67ed5231c4900a4cd704daf","observation_id":"c8244206-20ba-4c18-9542-90e99ac62e68","resolution":{"observed_at":"2026-08-05T10:54:54.600212Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:54.587129Z","title":"Contrastive positive mining for unsupervised 3d action representation learning","venue":null,"work_id":"600fcaaa-be29-4bc5-bf7b-6880361c802d","year":2022},"citing_paper":{"arxiv_id":"2509.03609","last_updated":"2025-09-03T18:05:02Z","snapshot_observed_at":"2026-08-06T02:08:41.944215Z","submitted_at":"2025-09-03T18:05:02Z","title":"Towards Efficient General Feature Prediction in Masked Skeleton Modeling","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T10:54:54.468597Z"},"links":{"citing_paper":"/paper/2509.03609"},"observation_digest":"sha256:e3f81269991242468ed7939b8378b87b81ed4a09b2081e6806428137e94e46ce","observation_id":"b85eb493-4c8f-4140-81c0-3e6203584fd6","resolution":{"observed_at":"2026-08-05T10:54:54.590498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:54.576943Z","title":"Prompted con- trast with masked motion modeling: Towards versatile 3d ac- tion representation learning","venue":null,"work_id":"79f7e76c-d972-43eb-9e09-cfdb4a79db6d","year":null},"citing_paper":{"arxiv_id":"2509.03609","last_updated":"2025-09-03T18:05:02Z","snapshot_observed_at":"2026-08-06T02:08:41.944215Z","submitted_at":"2025-09-03T18:05:02Z","title":"Towards Efficient General Feature Prediction in Masked Skeleton Modeling","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T10:54:54.471355Z"},"links":{"citing_paper":"/paper/2509.03609"},"observation_digest":"sha256:7ef30e7fc8daa2d8bb1250faa1f99d2e4939ae3f88ae38e0c7e30b70705e9099","observation_id":"c82914d2-39fd-4b36-9668-dccf4a4d2554","resolution":{"observed_at":"2026-08-05T10:54:54.580590Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:54.566836Z","title":"Tuber: Tubelet transformer for video action detection","venue":null,"work_id":"a33d5633-b176-4d6d-bc73-e341ed53aba8","year":2022},"citing_paper":{"arxiv_id":"2509.03609","last_updated":"2025-09-03T18:05:02Z","snapshot_observed_at":"2026-08-06T02:08:41.944215Z","submitted_at":"2025-09-03T18:05:02Z","title":"Towards Efficient General Feature Prediction in Masked Skeleton Modeling","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-05T10:54:54.474295Z"},"links":{"citing_paper":"/paper/2509.03609"},"observation_digest":"sha256:c60abbbfae5cbc3dee72d7ceb44785280579c69161917d8b8b9a409cb36ef704","observation_id":"7529cbfa-2cc7-400a-8264-be45d467abad","resolution":{"observed_at":"2026-08-05T10:54:54.570165Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:54.557390Z","title":"Temporal action detection with structured segment networks","venue":null,"work_id":"32b377d0-27f6-46b7-9b5b-90546f5ec5c4","year":2017},"citing_paper":{"arxiv_id":"2509.03609","last_updated":"2025-09-03T18:05:02Z","snapshot_observed_at":"2026-08-06T02:08:41.944215Z","submitted_at":"2025-09-03T18:05:02Z","title":"Towards Efficient General Feature Prediction in Masked Skeleton Modeling","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-05T10:54:54.477143Z"},"links":{"citing_paper":"/paper/2509.03609"},"observation_digest":"sha256:20854fce0b40a6ceb682501e96671714d3bc82365237761aacc72b0d198f675e","observation_id":"0c08fba6-6de6-4c3d-bf72-97caf4f02d92","resolution":{"observed_at":"2026-08-05T10:54:54.560399Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:54.544616Z","title":"Unsupervised representation learning with long-term dynamics for skeleton based action recognition","venue":null,"work_id":"f5a66614-2d68-4c88-88ab-bed69594f042","year":2018},"citing_paper":{"arxiv_id":"2509.03609","last_updated":"2025-09-03T18:05:02Z","snapshot_observed_at":"2026-08-06T02:08:41.944215Z","submitted_at":"2025-09-03T18:05:02Z","title":"Towards Efficient General Feature Prediction in Masked Skeleton Modeling","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-05T10:54:54.479989Z"},"links":{"citing_paper":"/paper/2509.03609"},"observation_digest":"sha256:8b7304075daf5f06ddf2cb7273721b2a915b84da26293906b083262c266a1576","observation_id":"dc0f4a92-c13c-452f-984f-cdfdb4d1165c","resolution":{"observed_at":"2026-08-05T10:54:54.550033Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.03609","last_updated":"2025-09-03T18:05:02Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T02:08:41.944215Z","submitted_at":"2025-09-03T18:05:02Z","title":"Towards Efficient General Feature Prediction in Masked Skeleton Modeling"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":4,"verified_exact":0,"verified_fuzzy":40},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 0 inbound Pith citation observations for arXiv:2509.03609."}