{"as_of":"2026-08-13T02:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:96558f2dfe7f2b346d64d1f8dbcdc9903692f74123867f85c48e899731804631","coverage":[{"denominator":15,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T12:35:04.981784Z","state":"measured"},{"denominator":15,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":15,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.01471/citation-record","integrity":"/paper/2509.01471/integrity","json":"/paper/2509.01471/citation-record.json","paper":"/paper/2509.01471"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"7720.36077","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:35:05.552596Z","title":"ISBN 9798400700194","venue":null,"work_id":"693ed766-da2a-48b4-bd38-b1778b3053c3","year":null},"citing_paper":{"arxiv_id":"2509.01471","last_updated":"2025-09-01T13:39:14Z","snapshot_observed_at":"2026-08-09T07:43:47.591000Z","submitted_at":"2025-09-01T13:39:14Z","title":"Hierarchical Motion Captioning Utilizing External Text Data Source","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T12:35:04.915752Z"},"links":{"citing_paper":"/paper/2509.01471"},"observation_digest":"sha256:4eec7c2e170c86487c05d7535de7ec3a1eaf29f53e1d910955076860a3b73e8a","observation_id":"6c86b97a-e345-424a-8e30-1b4bb6923a8a","resolution":{"observed_at":"2026-08-05T12:35:05.561440Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13605","last_updated":"2024-10-17T14:39:55Z","snapshot_observed_at":"2026-08-12T22:20:54.548953Z","submitted_at":"2024-10-17T14:39:55Z","title":"Transformer-Based Approaches for Sensor-Based Human Activity Recognition: Opportunities and Challenges","version":1},"cited_work":{"arxiv_id":"2410.13605","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.13605","snapshot_observed_at":"2026-08-05T12:35:05.451026Z","title":"Transformer-Based Approaches for Sensor-Based Human Activity Recognition: Opportunities and Challenges","venue":"cs.LG","work_id":"fa07e43e-8de8-4dc3-b65b-0b52d284bff7","year":2024},"citing_paper":{"arxiv_id":"2509.01471","last_updated":"2025-09-01T13:39:14Z","snapshot_observed_at":"2026-08-09T07:43:47.591000Z","submitted_at":"2025-09-01T13:39:14Z","title":"Hierarchical Motion Captioning Utilizing External Text Data Source","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T12:35:04.921336Z"},"links":{"cited_paper":"/paper/2410.13605","citing_paper":"/paper/2509.01471"},"observation_digest":"sha256:7975ac32d3dc5645df6a2aad0740b1515746e1e350573968a9841b17e765829e","observation_id":"8f7e8af3-f4c7-40fb-9865-6e942c90996c","resolution":{"observed_at":"2026-08-05T12:35:05.458012Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07093","last_updated":"2025-03-08T06:09:23Z","snapshot_observed_at":"2026-08-12T22:27:00.610689Z","submitted_at":"2024-10-09T17:33:03Z","title":"LaMP: Language-Motion Pretraining for Motion Generation, Retrieval, and Captioning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07093","snapshot_observed_at":"2026-08-05T12:35:04.927002Z","title":"Lin, C.-Y","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.01471","last_updated":"2025-09-01T13:39:14Z","snapshot_observed_at":"2026-08-09T07:43:47.591000Z","submitted_at":"2025-09-01T13:39:14Z","title":"Hierarchical Motion Captioning Utilizing External Text Data Source","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T12:35:04.927002Z"},"links":{"cited_paper":"/paper/2410.07093","citing_paper":"/paper/2509.01471"},"observation_digest":"sha256:379566529d597e22c223f858d254f7bc0d056ca9a842a07164a937f64fb3f8dd","observation_id":"50286da3-782d-451e-8bd5-a4188819b84a","resolution":{"observed_at":"2026-08-05T12:35:04.927002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:35:05.682645Z","title":"Reimers, N","venue":null,"work_id":"22d4c59d-1c3a-4bb7-820e-b9bb370706fc","year":2019},"citing_paper":{"arxiv_id":"2509.01471","last_updated":"2025-09-01T13:39:14Z","snapshot_observed_at":"2026-08-09T07:43:47.591000Z","submitted_at":"2025-09-01T13:39:14Z","title":"Hierarchical Motion Captioning Utilizing External Text Data Source","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T12:35:04.946402Z"},"links":{"citing_paper":"/paper/2509.01471"},"observation_digest":"sha256:ae53fdd00e1fd129abf57561be3a90452e856d072a5c12dbf8d34f1af54dcd80","observation_id":"bb8e20c9-6c8d-46a6-af94-0c94d0894b67","resolution":{"observed_at":"2026-08-05T12:35:05.688291Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:35:04.981784Z","title":"URL http://dx.doi.org/ 10.1109/CVPR52733.2024.00232","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.01471","last_updated":"2025-09-01T13:39:14Z","snapshot_observed_at":"2026-08-09T07:43:47.591000Z","submitted_at":"2025-09-01T13:39:14Z","title":"Hierarchical Motion Captioning Utilizing External Text Data Source","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T12:35:04.981784Z"},"links":{"citing_paper":"/paper/2509.01471"},"observation_digest":"sha256:b1f65f8c0d7cae67229aac5d60f908ce62b1ee612ea47f93e5c237ed3b01bc79","observation_id":"d3803a17-4fea-463c-be4e-aa76f75b1984","resolution":{"observed_at":"2026-08-05T12:35:04.981784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:35:04.933624Z","title":"doi: 10.3115/1073083.1073135","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.01471","last_updated":"2025-09-01T13:39:14Z","snapshot_observed_at":"2026-08-09T07:43:47.591000Z","submitted_at":"2025-09-01T13:39:14Z","title":"Hierarchical Motion Captioning Utilizing External Text Data Source","version":1},"reference_index":2002,"source":"pdf_text","source_observed_at":"2026-08-05T12:35:04.933624Z"},"links":{"citing_paper":"/paper/2509.01471"},"observation_digest":"sha256:7503f413683f3fd7d5d63a23f03e942c3b2652f0cdb94f656d3d608200308941","observation_id":"017da16f-f3a2-4b86-8b8d-91449c88bee9","resolution":{"observed_at":"2026-08-05T12:35:04.933624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1411.5726","last_updated":"2015-06-03T01:42:20Z","snapshot_observed_at":"2026-08-07T17:52:59.562945Z","submitted_at":"2014-11-20T23:54:35Z","title":"CIDEr: Consensus-based Image Description Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1411.5726","snapshot_observed_at":"2026-08-05T12:35:04.969579Z","title":"Zhang, J., Zhang, Y ., Cun, X., Huang, S., Zhang, Y ., Zhao, H., Lu, H., and Shen, X","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.01471","last_updated":"2025-09-01T13:39:14Z","snapshot_observed_at":"2026-08-09T07:43:47.591000Z","submitted_at":"2025-09-01T13:39:14Z","title":"Hierarchical Motion Captioning Utilizing External Text Data Source","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-05T12:35:04.969579Z"},"links":{"cited_paper":"/paper/1411.5726","citing_paper":"/paper/2509.01471"},"observation_digest":"sha256:77079a1d76af799341bbd8adef7d6879857cc25fdbeaea853c8e578a19825678","observation_id":"cce69642-3159-48f0-b058-47f2f67be59c","resolution":{"observed_at":"2026-08-05T12:35:04.969579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:35:04.939094Z","title":"URL http://dx.doi.org/ 10.1089/big.2016.0028","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2509.01471","last_updated":"2025-09-01T13:39:14Z","snapshot_observed_at":"2026-08-09T07:43:47.591000Z","submitted_at":"2025-09-01T13:39:14Z","title":"Hierarchical Motion Captioning Utilizing External Text Data Source","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-05T12:35:04.939094Z"},"links":{"citing_paper":"/paper/2509.01471"},"observation_digest":"sha256:516f8023b8baad99d2afd33a290a30bc9af484ec729d0a73e3a31d1cc5bcd8a0","observation_id":"06260b1b-da26-43c2-8d8d-c2e63c8b7473","resolution":{"observed_at":"2026-08-05T12:35:04.939094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.00937","last_updated":"2018-05-30T14:58:27Z","snapshot_observed_at":"2026-08-12T15:49:46.862002Z","submitted_at":"2017-11-02T21:14:44Z","title":"Neural Discrete Representation Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.00937","snapshot_observed_at":"2026-08-05T12:35:04.964376Z","title":"Vedantam, R., Zitnick, C","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.01471","last_updated":"2025-09-01T13:39:14Z","snapshot_observed_at":"2026-08-09T07:43:47.591000Z","submitted_at":"2025-09-01T13:39:14Z","title":"Hierarchical Motion Captioning Utilizing External Text Data Source","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-05T12:35:04.964376Z"},"links":{"cited_paper":"/paper/1711.00937","citing_paper":"/paper/2509.01471"},"observation_digest":"sha256:5f3b09047a39049001213cbb55f91c3cc7e5ab3713728a7be53f4a1841546a58","observation_id":"d78d53a1-f98f-411f-8012-e383e415b2bb","resolution":{"observed_at":"2026-08-05T12:35:04.964376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.10084","last_updated":"2019-08-27T08:50:17Z","snapshot_observed_at":"2026-07-06T08:17:05.681370Z","submitted_at":"2019-08-27T08:50:17Z","title":"Sentence-BERT: Sentence Embeddings using Siamese BERT-Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.10084","snapshot_observed_at":"2026-08-05T12:35:04.952074Z","title":"Safiya, K","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2509.01471","last_updated":"2025-09-01T13:39:14Z","snapshot_observed_at":"2026-08-09T07:43:47.591000Z","submitted_at":"2025-09-01T13:39:14Z","title":"Hierarchical Motion Captioning Utilizing External Text Data Source","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-05T12:35:04.952074Z"},"links":{"cited_paper":"/paper/1908.10084","citing_paper":"/paper/2509.01471"},"observation_digest":"sha256:026d64bbbf0a045eeb7caf2ef939f734b495889e3bc0cadd681c9b1c923d4945","observation_id":"98b3f54a-b1ae-4544-aafd-577f9efe1f3c","resolution":{"observed_at":"2026-08-05T12:35:04.952074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-10T01:12:16.468283Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-05T12:35:04.898715Z","title":"Guo, C., Zou, S., Zuo, X., Wang, S., Ji, W., Li, X., and Cheng, L","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2509.01471","last_updated":"2025-09-01T13:39:14Z","snapshot_observed_at":"2026-08-09T07:43:47.591000Z","submitted_at":"2025-09-01T13:39:14Z","title":"Hierarchical Motion Captioning Utilizing External Text Data Source","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-05T12:35:04.898715Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2509.01471"},"observation_digest":"sha256:e2a76bbeec48d29dda6236a3aac0641ebed6cd2b85eec3b28731a1693145770f","observation_id":"917f6c74-38d5-4956-9c5b-22b9e3844e8b","resolution":{"observed_at":"2026-08-05T12:35:04.898715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-11T08:20:29.798517Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-05T12:35:04.910612Z","title":"Jiang, B., Chen, X., Liu, W., Yu, J., Yu, G., and Chen, T","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.01471","last_updated":"2025-09-01T13:39:14Z","snapshot_observed_at":"2026-08-09T07:43:47.591000Z","submitted_at":"2025-09-01T13:39:14Z","title":"Hierarchical Motion Captioning Utilizing External Text Data Source","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-05T12:35:04.910612Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2509.01471"},"observation_digest":"sha256:b427cd606ad19fa13bc3325f4506ab0b7d46818eaad9bc1abef6026de4eaaee6","observation_id":"03bb3fab-6695-45de-b3b6-52ee18580eaf","resolution":{"observed_at":"2026-08-05T12:35:04.910612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:35:05.657455Z","title":null,"venue":null,"work_id":"d70f71d9-a9bf-4ccc-912d-1be541a87f75","year":2024},"citing_paper":{"arxiv_id":"2509.01471","last_updated":"2025-09-01T13:39:14Z","snapshot_observed_at":"2026-08-09T07:43:47.591000Z","submitted_at":"2025-09-01T13:39:14Z","title":"Hierarchical Motion Captioning Utilizing External Text Data Source","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-05T12:35:04.974922Z"},"links":{"citing_paper":"/paper/2509.01471"},"observation_digest":"sha256:6d4a71f88eea1b7c14a882fe50c0e4da115bde45975551b422aaa55de2a5f801","observation_id":"f701f846-7cc4-4b4f-92a7-1bbe9918b85a","resolution":{"observed_at":"2026-08-05T12:35:05.663593Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16867","last_updated":"2023-11-29T19:45:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-28T15:12:47Z","title":"The Falcon Series of Open Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16867","snapshot_observed_at":"2026-08-05T12:35:04.886833Z","title":"Chen, L.-H., Lu, S., Zeng, A., Zhang, H., Wang, B., Zhang, R., and Zhang, L","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.01471","last_updated":"2025-09-01T13:39:14Z","snapshot_observed_at":"2026-08-09T07:43:47.591000Z","submitted_at":"2025-09-01T13:39:14Z","title":"Hierarchical Motion Captioning Utilizing External Text Data Source","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-05T12:35:04.886833Z"},"links":{"cited_paper":"/paper/2311.16867","citing_paper":"/paper/2509.01471"},"observation_digest":"sha256:49530f129e0f6db7b648554f7a6c375e99c474d71251e7c21fee6609418139b4","observation_id":"ff3b19c3-d796-41f7-aacd-42bd423c51e1","resolution":{"observed_at":"2026-08-05T12:35:04.886833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20340","last_updated":"2024-05-30T17:59:50Z","snapshot_observed_at":"2026-08-12T23:53:52.550133Z","submitted_at":"2024-05-30T17:59:50Z","title":"MotionLLM: Understanding Human Behaviors from Human Motions and Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20340","snapshot_observed_at":"2026-08-05T12:35:04.892673Z","title":"Dosovitskiy, A., Beyer, L., Kolesnikov, A., Weissenborn, D., Zhai, X., Unterthiner, T., Dehghani, M., Minderer, M., Heigold, G., Gelly, S., Uszkoreit, J., and Houlsby, N","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2509.01471","last_updated":"2025-09-01T13:39:14Z","snapshot_observed_at":"2026-08-09T07:43:47.591000Z","submitted_at":"2025-09-01T13:39:14Z","title":"Hierarchical Motion Captioning Utilizing External Text Data Source","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-05T12:35:04.892673Z"},"links":{"cited_paper":"/paper/2405.20340","citing_paper":"/paper/2509.01471"},"observation_digest":"sha256:86232d885675445682b6a644bff50045bbc66a506e9211718e237685665fe78b","observation_id":"65a20522-797f-474f-bae5-05e15825bd9c","resolution":{"observed_at":"2026-08-05T12:35:04.892673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.01471","last_updated":"2025-09-01T13:39:14Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T07:43:47.591000Z","submitted_at":"2025-09-01T13:39:14Z","title":"Hierarchical Motion Captioning Utilizing External Text Data Source"},"reference_resolution":{"displayed":15,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":12,"verified_exact":0,"verified_fuzzy":1},"total_outbound_references":15},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 15 of 15 outbound references and 0 inbound Pith citation observations for arXiv:2509.01471."}