{"as_of":"2026-08-08T22:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cab9787d0095e8394600232e6e38d51dc8dd2f38982364ebf1aafe7f6ac74912","coverage":[{"denominator":54,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":54,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:27:47.293960Z","state":"measured"},{"denominator":55,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":55,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T04:25:45.477479Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T04:25:51.971544Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.02452","last_updated":"2025-08-24T13:14:45Z","snapshot_observed_at":"2026-08-08T00:30:58.087521Z","submitted_at":"2025-06-03T05:17:37Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model","version":2},"cited_work":{"arxiv_id":"2506.02452","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.02452","snapshot_observed_at":"2026-08-06T04:25:51.971544Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model","venue":"cs.CV","work_id":"e17b972c-70da-4d80-a4f9-aa941805271c","year":2025},"citing_paper":{"arxiv_id":"2508.03535","last_updated":"2025-08-05T15:04:34Z","snapshot_observed_at":"2026-08-08T00:31:41.022417Z","submitted_at":"2025-08-05T15:04:34Z","title":"CoEmoGen: Towards Semantically-Coherent and Scalable Emotional Image Content Generation","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T04:25:45.477479Z"},"links":{"cited_paper":"/paper/2506.02452","citing_paper":"/paper/2508.03535"},"observation_digest":"sha256:8a7c05733eebf11818ec5bf6fe3aa4bb9e9278541ff686f557fd92c1fd540bae","observation_id":"53df0d74-ef14-4021-bf0a-c1dae7a95087","resolution":{"observed_at":"2026-08-06T04:25:52.022085Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.02452/citation-record","integrity":"/paper/2506.02452/integrity","json":"/paper/2506.02452/citation-record.json","paper":"/paper/2506.02452"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2204.14198","last_updated":"2022-11-15T23:07:37Z","snapshot_observed_at":"2026-07-06T13:05:12.350238Z","submitted_at":"2022-04-29T16:29:01Z","title":"Flamingo: a Visual Language Model for Few-Shot Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.14198","snapshot_observed_at":"2026-08-07T11:27:47.059429Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.02452","last_updated":"2025-08-24T13:14:45Z","snapshot_observed_at":"2026-08-08T00:30:58.087521Z","submitted_at":"2025-06-03T05:17:37Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:47.059429Z"},"links":{"cited_paper":"/paper/2204.14198","citing_paper":"/paper/2506.02452"},"observation_digest":"sha256:643fa451c4cc8720e244ac71cb5f561714ce1ae279e9c46b78743d090a79220b","observation_id":"eed9cf06-d45b-4a21-88c0-8dfa30cc481d","resolution":{"observed_at":"2026-08-07T11:27:47.059429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.04066","last_updated":"2022-09-12T16:34:20Z","snapshot_observed_at":"2026-08-08T15:19:12.969119Z","submitted_at":"2022-09-09T00:33:40Z","title":"TEACH: Temporal Action Composition for 3D Humans","version":2},"cited_work":{"arxiv_id":"2209.04066","doi":null,"metadata_source":"pith","pith_arxiv_id":"2209.04066","snapshot_observed_at":"2026-08-07T11:27:48.489574Z","title":"TEACH: Temporal Action Composition for 3D Humans","venue":"cs.CV","work_id":"09be0cd9-e51f-4c62-bf74-4265b3c35ae4","year":2022},"citing_paper":{"arxiv_id":"2506.02452","last_updated":"2025-08-24T13:14:45Z","snapshot_observed_at":"2026-08-08T00:30:58.087521Z","submitted_at":"2025-06-03T05:17:37Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:47.064324Z"},"links":{"cited_paper":"/paper/2209.04066","citing_paper":"/paper/2506.02452"},"observation_digest":"sha256:fda3badb22248bdc9fc06ea90fd140369a89ab40ab67f55c9288f84cf305fea6","observation_id":"dcd78e93-6557-4654-9797-39401a57d7c7","resolution":{"observed_at":"2026-08-07T11:27:48.582153Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:47.069609Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02452","last_updated":"2025-08-24T13:14:45Z","snapshot_observed_at":"2026-08-08T00:30:58.087521Z","submitted_at":"2025-06-03T05:17:37Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:47.069609Z"},"links":{"citing_paper":"/paper/2506.02452"},"observation_digest":"sha256:24242f6d28fe42f96241ed7802dece5dbfcbcd554291c788272e2044c79a8b28","observation_id":"e1431031-2e57-4e3d-9e8f-f955f51ba9e4","resolution":{"observed_at":"2026-08-07T11:27:47.069609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:47.073663Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02452","last_updated":"2025-08-24T13:14:45Z","snapshot_observed_at":"2026-08-08T00:30:58.087521Z","submitted_at":"2025-06-03T05:17:37Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:47.073663Z"},"links":{"citing_paper":"/paper/2506.02452"},"observation_digest":"sha256:80e3253851d6c26660bd304e95215380929ab94d89772548c6c80966facf4d15","observation_id":"f9484b88-77c4-44bc-8ae6-8aa5fb434208","resolution":{"observed_at":"2026-08-07T11:27:47.073663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.04048","last_updated":"2023-05-19T08:14:04Z","snapshot_observed_at":"2026-08-04T09:21:48.823841Z","submitted_at":"2022-12-08T03:07:00Z","title":"Executing your Commands via Motion Diffusion in Latent Space","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.04048","snapshot_observed_at":"2026-08-07T11:27:47.077473Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02452","last_updated":"2025-08-24T13:14:45Z","snapshot_observed_at":"2026-08-08T00:30:58.087521Z","submitted_at":"2025-06-03T05:17:37Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:47.077473Z"},"links":{"cited_paper":"/paper/2212.04048","citing_paper":"/paper/2506.02452"},"observation_digest":"sha256:f47ce7331ace6a13841d19f550878f832035517fce06f764af14ecb3c3871ac6","observation_id":"7dca696f-7563-4cbe-9de6-91d9c265b21c","resolution":{"observed_at":"2026-08-07T11:27:47.077473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.19759","last_updated":"2024-12-30T08:43:06Z","snapshot_observed_at":"2026-08-08T11:19:10.130010Z","submitted_at":"2024-04-30T17:59:47Z","title":"MotionLCM: Real-time Controllable Motion Generation via Latent Consistency Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.19759","snapshot_observed_at":"2026-08-07T11:27:47.081688Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02452","last_updated":"2025-08-24T13:14:45Z","snapshot_observed_at":"2026-08-08T00:30:58.087521Z","submitted_at":"2025-06-03T05:17:37Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:47.081688Z"},"links":{"cited_paper":"/paper/2404.19759","citing_paper":"/paper/2506.02452"},"observation_digest":"sha256:b94cc1b3ef29027f6459eefd24e4892010429b5e2a696dd4cce64e00601578dd","observation_id":"afce8346-f415-40ba-860c-8514d6a8b0fc","resolution":{"observed_at":"2026-08-07T11:27:47.081688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-07T11:27:47.086948Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.02452","last_updated":"2025-08-24T13:14:45Z","snapshot_observed_at":"2026-08-08T00:30:58.087521Z","submitted_at":"2025-06-03T05:17:37Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:47.086948Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2506.02452"},"observation_digest":"sha256:2347ac3b925e4aa595376f42e3348883bf11e561e14eda3d045f8b34527449fe","observation_id":"36a9e935-f546-4150-a5b0-44ce913e7b76","resolution":{"observed_at":"2026-08-07T11:27:47.086948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:50.208911Z","title":null,"venue":null,"work_id":"f24c8da5-5648-4611-bdd6-206bb86ddd22","year":null},"citing_paper":{"arxiv_id":"2506.02452","last_updated":"2025-08-24T13:14:45Z","snapshot_observed_at":"2026-08-08T00:30:58.087521Z","submitted_at":"2025-06-03T05:17:37Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:47.091650Z"},"links":{"citing_paper":"/paper/2506.02452"},"observation_digest":"sha256:bc54cc18c4f270bf6c805df7634a97afb76fc553c8a0b1bec57905d3ccd81083","observation_id":"0052db6e-3991-448a-b4a4-904bf4eaf8a5","resolution":{"observed_at":"2026-08-07T11:27:50.212152Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:47.100377Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.02452","last_updated":"2025-08-24T13:14:45Z","snapshot_observed_at":"2026-08-08T00:30:58.087521Z","submitted_at":"2025-06-03T05:17:37Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:47.100377Z"},"links":{"citing_paper":"/paper/2506.02452"},"observation_digest":"sha256:15befa5781244465bea66ee0a41303311cae69c10c698e02517db7bbea673096","observation_id":"cd6e8b95-2fb1-4967-a755-005185086506","resolution":{"observed_at":"2026-08-07T11:27:47.100377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:50.179270Z","title":null,"venue":null,"work_id":"47fa7fa0-7935-4085-a774-0e6057482ba3","year":2022},"citing_paper":{"arxiv_id":"2506.02452","last_updated":"2025-08-24T13:14:45Z","snapshot_observed_at":"2026-08-08T00:30:58.087521Z","submitted_at":"2025-06-03T05:17:37Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:47.108732Z"},"links":{"citing_paper":"/paper/2506.02452"},"observation_digest":"sha256:6daafc6cf5912bc7ec7203e04aee881b1704124618fba841efaa45e5f851b32b","observation_id":"e9fe978f-31e5-4470-aeb2-17fb0618ed94","resolution":{"observed_at":"2026-08-07T11:27:50.183122Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.01696","last_updated":"2022-08-04T18:31:20Z","snapshot_observed_at":"2026-07-06T13:27:42.434055Z","submitted_at":"2022-07-04T19:52:18Z","title":"TM2T: Stochastic and Tokenized Modeling for the Reciprocal Generation of 3D Human Motions and Texts","version":2},"cited_work":{"arxiv_id":"2207.01696","doi":null,"metadata_source":"pith","pith_arxiv_id":"2207.01696","snapshot_observed_at":"2026-08-07T11:27:48.081154Z","title":"TM2T: Stochastic and Tokenized Modeling for the Reciprocal Generation of 3D Human Motions and Texts","venue":"cs.CV","work_id":"04a6bb36-d38d-4045-80fa-1a7bc5645ec3","year":2022},"citing_paper":{"arxiv_id":"2506.02452","last_updated":"2025-08-24T13:14:45Z","snapshot_observed_at":"2026-08-08T00:30:58.087521Z","submitted_at":"2025-06-03T05:17:37Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:47.112203Z"},"links":{"cited_paper":"/paper/2207.01696","citing_paper":"/paper/2506.02452"},"observation_digest":"sha256:7b817b6e8f3dc69bd2f76be71ee427e918ce7f4f9372ba17966137cee175fb25","observation_id":"790c8ba6-7fcc-4520-9f40-db007361e314","resolution":{"observed_at":"2026-08-07T11:27:48.167242Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:50.168588Z","title":null,"venue":null,"work_id":"117ab44d-8a4f-4b24-ae23-327cdc97b0fa","year":2022},"citing_paper":{"arxiv_id":"2506.02452","last_updated":"2025-08-24T13:14:45Z","snapshot_observed_at":"2026-08-08T00:30:58.087521Z","submitted_at":"2025-06-03T05:17:37Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:47.116364Z"},"links":{"citing_paper":"/paper/2506.02452"},"observation_digest":"sha256:fac1125cb0064c4ac46627104f8e37b46c9c9a11bf066aa765edc77bb89ba036","observation_id":"c9dccb0d-4974-4fce-a2f4-53cf315d87d1","resolution":{"observed_at":"2026-08-07T11:27:50.172003Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:50.158860Z","title":null,"venue":null,"work_id":"1e5568ae-0a64-4d2d-a32c-ca23a416223e","year":2020},"citing_paper":{"arxiv_id":"2506.02452","last_updated":"2025-08-24T13:14:45Z","snapshot_observed_at":"2026-08-08T00:30:58.087521Z","submitted_at":"2025-06-03T05:17:37Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:47.120340Z"},"links":{"citing_paper":"/paper/2506.02452"},"observation_digest":"sha256:dbd1acd81aac8e69db9ddc4a32431d5a483881a571634b54164093029be39e33","observation_id":"a4312053-5ee0-438e-a009-f0fb088600c0","resolution":{"observed_at":"2026-08-07T11:27:50.162046Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:49.967876Z","title":null,"venue":null,"work_id":"aa09f90d-35c6-489d-9064-c7c9086e0faf","year":2017},"citing_paper":{"arxiv_id":"2506.02452","last_updated":"2025-08-24T13:14:45Z","snapshot_observed_at":"2026-08-08T00:30:58.087521Z","submitted_at":"2025-06-03T05:17:37Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:47.124363Z"},"links":{"citing_paper":"/paper/2506.02452"},"observation_digest":"sha256:680af4ddd13af30806fd18dacb32a1d7fccd00daf4859961aed9869f744bde11","observation_id":"e19f15ab-e773-4c48-91ca-a5e9b7b3e7d7","resolution":{"observed_at":"2026-08-07T11:27:50.035005Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-07-06T04:11:24.157003Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-07T11:27:47.128307Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.02452","last_updated":"2025-08-24T13:14:45Z","snapshot_observed_at":"2026-08-08T00:30:58.087521Z","submitted_at":"2025-06-03T05:17:37Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:47.128307Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2506.02452"},"observation_digest":"sha256:d8317470b6044331558cf78747a64176025259cb849e10331dc7469f3d8ba081","observation_id":"2a6f9670-f8fc-4bf5-bc4a-ad4591f0bed1","resolution":{"observed_at":"2026-08-07T11:27:47.128307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-07T11:27:47.132209Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.02452","last_updated":"2025-08-24T13:14:45Z","snapshot_observed_at":"2026-08-08T00:30:58.087521Z","submitted_at":"2025-06-03T05:17:37Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:47.132209Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2506.02452"},"observation_digest":"sha256:66435ef285704a842e9e2e8149b9e3ff33c19eb3315a69e598de95b3082873ae","observation_id":"3d3a988f-29a0-4bbe-997c-3d68ba4caf43","resolution":{"observed_at":"2026-08-07T11:27:47.132209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13836","last_updated":"2025-03-18T02:20:11Z","snapshot_observed_at":"2026-08-07T16:56:10.228729Z","submitted_at":"2025-03-18T02:20:11Z","title":"SALAD: Skeleton-aware Latent Diffusion for Text-driven Motion Generation and Editing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.13836","snapshot_observed_at":"2026-08-07T11:27:47.136396Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02452","last_updated":"2025-08-24T13:14:45Z","snapshot_observed_at":"2026-08-08T00:30:58.087521Z","submitted_at":"2025-06-03T05:17:37Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:47.136396Z"},"links":{"cited_paper":"/paper/2503.13836","citing_paper":"/paper/2506.02452"},"observation_digest":"sha256:2c57a525838bceaf7fcf8fbf5d3991e46d0d81fce61b79cc42cc1770c77f92c7","observation_id":"d395d19f-8fdd-4e91-bea1-5b821ab306eb","resolution":{"observed_at":"2026-08-07T11:27:47.136396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05135","last_updated":"2024-03-08T08:08:10Z","snapshot_observed_at":"2026-08-04T23:51:18.339338Z","submitted_at":"2024-03-08T08:08:10Z","title":"ELLA: Equip Diffusion Models with LLM for Enhanced Semantic Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05135","snapshot_observed_at":"2026-08-07T11:27:47.141483Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02452","last_updated":"2025-08-24T13:14:45Z","snapshot_observed_at":"2026-08-08T00:30:58.087521Z","submitted_at":"2025-06-03T05:17:37Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:47.141483Z"},"links":{"cited_paper":"/paper/2403.05135","citing_paper":"/paper/2506.02452"},"observation_digest":"sha256:d9d01aaf43402ca49ac76f5e7e5366bceb9120cf385a12153ed6da3fac8fc044","observation_id":"7dd03ca5-ccdc-480c-b05c-523a800c514a","resolution":{"observed_at":"2026-08-07T11:27:47.141483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1703.06868","last_updated":"2017-07-30T09:32:17Z","snapshot_observed_at":"2026-08-03T13:17:12.822275Z","submitted_at":"2017-03-20T17:51:31Z","title":"Arbitrary Style Transfer in Real-time with Adaptive Instance Normalization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1703.06868","snapshot_observed_at":"2026-08-07T11:27:47.146162Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.02452","last_updated":"2025-08-24T13:14:45Z","snapshot_observed_at":"2026-08-08T00:30:58.087521Z","submitted_at":"2025-06-03T05:17:37Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:47.146162Z"},"links":{"cited_paper":"/paper/1703.06868","citing_paper":"/paper/2506.02452"},"observation_digest":"sha256:c6264d6a62fa6f961fb8454e529aee6f7acf6791e95ee218b948d140e7078bc7","observation_id":"6c9dbbde-a435-4203-85dd-4b5121258fe2","resolution":{"observed_at":"2026-08-07T11:27:47.146162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.05691","last_updated":"2024-12-09T14:43:56Z","snapshot_observed_at":"2026-07-06T18:12:01.364458Z","submitted_at":"2024-05-09T11:41:27Z","title":"StableMoFusion: Towards Robust and Efficient Diffusion-based Motion Generation Framework","version":2},"cited_work":{"arxiv_id":"2405.05691","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.05691","snapshot_observed_at":"2026-08-07T11:27:47.834817Z","title":"StableMoFusion: Towards Robust and Efficient Diffusion-based Motion Generation Framework","venue":"cs.CV","work_id":"7c1af300-1789-4fb1-b639-938c67d7eabe","year":2024},"citing_paper":{"arxiv_id":"2506.02452","last_updated":"2025-08-24T13:14:45Z","snapshot_observed_at":"2026-08-08T00:30:58.087521Z","submitted_at":"2025-06-03T05:17:37Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:47.150504Z"},"links":{"cited_paper":"/paper/2405.05691","citing_paper":"/paper/2506.02452"},"observation_digest":"sha256:6548698e93c41d75c560da4b015f3a68184cac2a9afd9b3c5a804d96cae145da","observation_id":"f8ac3357-5e26-403f-982c-15dd8538e035","resolution":{"observed_at":"2026-08-07T11:27:47.896926Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:47.155119Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02452","last_updated":"2025-08-24T13:14:45Z","snapshot_observed_at":"2026-08-08T00:30:58.087521Z","submitted_at":"2025-06-03T05:17:37Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:47.155119Z"},"links":{"citing_paper":"/paper/2506.02452"},"observation_digest":"sha256:86f5369fb617062ac8c3b65835e88a61ba71904485bf1d21c96da1e9f80090dd","observation_id":"c9ea06b1-6a12-43c0-bb44-a2e4bbfcd5ef","resolution":{"observed_at":"2026-08-07T11:27:47.155119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.14795","last_updated":"2023-07-20T03:39:19Z","snapshot_observed_at":"2026-08-08T17:20:23.517550Z","submitted_at":"2023-06-26T15:53:02Z","title":"MotionGPT: Human Motion as a Foreign Language","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.14795","snapshot_observed_at":"2026-08-07T11:27:47.159001Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02452","last_updated":"2025-08-24T13:14:45Z","snapshot_observed_at":"2026-08-08T00:30:58.087521Z","submitted_at":"2025-06-03T05:17:37Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:47.159001Z"},"links":{"cited_paper":"/paper/2306.14795","citing_paper":"/paper/2506.02452"},"observation_digest":"sha256:562cf15cb932b82f60384078cee24bf7aca0d6493f000c3c32905a12f7fe477e","observation_id":"63387f01-9c70-4839-9502-792dbe5cdc8e","resolution":{"observed_at":"2026-08-07T11:27:47.159001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:49.839709Z","title":null,"venue":null,"work_id":"b276071a-dc66-42e2-8694-dde25e2f0a48","year":2024},"citing_paper":{"arxiv_id":"2506.02452","last_updated":"2025-08-24T13:14:45Z","snapshot_observed_at":"2026-08-08T00:30:58.087521Z","submitted_at":"2025-06-03T05:17:37Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:47.163457Z"},"links":{"citing_paper":"/paper/2506.02452"},"observation_digest":"sha256:aef5f94917c91c8c385e7461bf346f0550e8542f0dbd37ecfa9d5f6f0134c7a2","observation_id":"0204d62e-68ce-4fe4-9f9f-4ec552a58e0d","resolution":{"observed_at":"2026-08-07T11:27:49.898033Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-07T11:27:47.167048Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.02452","last_updated":"2025-08-24T13:14:45Z","snapshot_observed_at":"2026-08-08T00:30:58.087521Z","submitted_at":"2025-06-03T05:17:37Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:47.167048Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2506.02452"},"observation_digest":"sha256:1a729a09b5ac98d86aba8689b207176185e25a3480556f741c21aa76bf891fcb","observation_id":"55703e83-d8be-4b6a-95aa-9d888d35db26","resolution":{"observed_at":"2026-08-07T11:27:47.167048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.00927","last_updated":"2022-10-13T12:04:36Z","snapshot_observed_at":"2026-08-03T02:03:48.954468Z","submitted_at":"2022-06-02T08:43:16Z","title":"DPM-Solver: A Fast ODE Solver for Diffusion Probabilistic Model Sampling in Around 10 Steps","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.00927","snapshot_observed_at":"2026-08-07T11:27:47.171216Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.02452","last_updated":"2025-08-24T13:14:45Z","snapshot_observed_at":"2026-08-08T00:30:58.087521Z","submitted_at":"2025-06-03T05:17:37Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:47.171216Z"},"links":{"cited_paper":"/paper/2206.00927","citing_paper":"/paper/2506.02452"},"observation_digest":"sha256:6f51c20562848398b6679fac0ca13113d3620c996361b060e8ac4ca8d5686731","observation_id":"85d693c7-2366-4a74-bccf-48063090962b","resolution":{"observed_at":"2026-08-07T11:27:47.171216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:47.175798Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.02452","last_updated":"2025-08-24T13:14:45Z","snapshot_observed_at":"2026-08-08T00:30:58.087521Z","submitted_at":"2025-06-03T05:17:37Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:47.175798Z"},"links":{"citing_paper":"/paper/2506.02452"},"observation_digest":"sha256:3a954a357c85fc33360b860ea0369f6366707b65f617f35e7143f14215572c1e","observation_id":"081ff1de-4aa4-4323-aa23-29cb463ae921","resolution":{"observed_at":"2026-08-07T11:27:47.175798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:49.681473Z","title":"Troje, Gerard Pons-Moll, and Michael J","venue":null,"work_id":"2d60f90e-25c2-4121-9550-8fe3cb7813f1","year":2019},"citing_paper":{"arxiv_id":"2506.02452","last_updated":"2025-08-24T13:14:45Z","snapshot_observed_at":"2026-08-08T00:30:58.087521Z","submitted_at":"2025-06-03T05:17:37Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:47.184795Z"},"links":{"citing_paper":"/paper/2506.02452"},"observation_digest":"sha256:f59a8cf74f4cf8fa71e0c1e4d7df9d1fd9c1f7ee75f838622b525736fad3d88e","observation_id":"bdc0f159-8167-429a-bfa1-bd5b0b2cc97c","resolution":{"observed_at":"2026-08-07T11:27:49.746266Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:49.547987Z","title":null,"venue":null,"work_id":"7ed9bbd7-4d55-4993-85aa-57d0f39b1145","year":null},"citing_paper":{"arxiv_id":"2506.02452","last_updated":"2025-08-24T13:14:45Z","snapshot_observed_at":"2026-08-08T00:30:58.087521Z","submitted_at":"2025-06-03T05:17:37Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:47.189575Z"},"links":{"citing_paper":"/paper/2506.02452"},"observation_digest":"sha256:8ce673851b13022370bfee127a6211b9b46225b692d65a80da69da1ecba92c9f","observation_id":"de98c50b-7577-46e8-905b-fdca93826982","resolution":{"observed_at":"2026-08-07T11:27:49.628015Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01095","last_updated":"2025-05-19T07:56:56Z","snapshot_observed_at":"2026-07-29T20:17:21.488997Z","submitted_at":"2022-11-02T13:14:30Z","title":"DPM-Solver++: Fast Solver for Guided Sampling of Diffusion Probabilistic Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01095","snapshot_observed_at":"2026-08-07T11:27:47.180105Z","title":"arXiv:2211.01095 [cs.LG] https://arxiv.org/abs/2211.01095","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.02452","last_updated":"2025-08-24T13:14:45Z","snapshot_observed_at":"2026-08-08T00:30:58.087521Z","submitted_at":"2025-06-03T05:17:37Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:47.180105Z"},"links":{"cited_paper":"/paper/2211.01095","citing_paper":"/paper/2506.02452"},"observation_digest":"sha256:e80d8c3e655e3617a86a74ded25ef876db21361d54e43b3c915d990c09c7e9d7","observation_id":"1f024abe-9f22-49c2-b284-38ff52385ab1","resolution":{"observed_at":"2026-08-07T11:27:47.180105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.14109","last_updated":"2022-07-22T09:07:31Z","snapshot_observed_at":"2026-08-05T14:36:03.990155Z","submitted_at":"2022-04-25T14:53:06Z","title":"TEMOS: Generating diverse human motions from textual descriptions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.14109","snapshot_observed_at":"2026-08-07T11:27:47.203286Z","title":"Black, and Gül Varol","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.02452","last_updated":"2025-08-24T13:14:45Z","snapshot_observed_at":"2026-08-08T00:30:58.087521Z","submitted_at":"2025-06-03T05:17:37Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:47.203286Z"},"links":{"cited_paper":"/paper/2204.14109","citing_paper":"/paper/2506.02452"},"observation_digest":"sha256:9e8c6f44302d19a6097a7a4f2b60712740a59d17f0097b26a0b2f080fb82f1f9","observation_id":"453bb41d-4069-4531-a64e-3008c2affba7","resolution":{"observed_at":"2026-08-07T11:27:47.203286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:47.208313Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02452","last_updated":"2025-08-24T13:14:45Z","snapshot_observed_at":"2026-08-08T00:30:58.087521Z","submitted_at":"2025-06-03T05:17:37Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:47.208313Z"},"links":{"citing_paper":"/paper/2506.02452"},"observation_digest":"sha256:4382ae06db023b5ffdca01ec16e78cbb9023f59360b559dfd7157a31cbb06f18","observation_id":"ad8fafb9-0576-4b1d-b6c0-a842ac2b096b","resolution":{"observed_at":"2026-08-07T11:27:47.208313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19435","last_updated":"2024-04-01T13:02:20Z","snapshot_observed_at":"2026-08-08T08:59:10.075875Z","submitted_at":"2024-03-28T14:04:17Z","title":"BAMM: Bidirectional Autoregressive Motion Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.19435","snapshot_observed_at":"2026-08-07T11:27:47.211864Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02452","last_updated":"2025-08-24T13:14:45Z","snapshot_observed_at":"2026-08-08T00:30:58.087521Z","submitted_at":"2025-06-03T05:17:37Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:47.211864Z"},"links":{"cited_paper":"/paper/2403.19435","citing_paper":"/paper/2506.02452"},"observation_digest":"sha256:611df295d0b0f20ff35ab72bd6a3bba892802bf2a926cadd07556b6c62b856c5","observation_id":"41563245-1254-415d-9ae3-cdf7eb1d638f","resolution":{"observed_at":"2026-08-07T11:27:47.211864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.05670","last_updated":"2021-09-19T12:09:37Z","snapshot_observed_at":"2026-08-03T02:57:23.544826Z","submitted_at":"2021-04-12T17:40:27Z","title":"Action-Conditioned 3D Human Motion Synthesis with Transformer VAE","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.05670","snapshot_observed_at":"2026-08-07T11:27:47.198420Z","title":"Black, and Gül Varol","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.02452","last_updated":"2025-08-24T13:14:45Z","snapshot_observed_at":"2026-08-08T00:30:58.087521Z","submitted_at":"2025-06-03T05:17:37Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:47.198420Z"},"links":{"cited_paper":"/paper/2104.05670","citing_paper":"/paper/2506.02452"},"observation_digest":"sha256:1952f544e5f2386c08567cb42f162b60063af4282e15a34cf284837f07a0caff","observation_id":"7ca08edd-9cdb-4ee2-a9fb-deb117823148","resolution":{"observed_at":"2026-08-07T11:27:47.198420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:47.219673Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.02452","last_updated":"2025-08-24T13:14:45Z","snapshot_observed_at":"2026-08-08T00:30:58.087521Z","submitted_at":"2025-06-03T05:17:37Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:47.219673Z"},"links":{"citing_paper":"/paper/2506.02452"},"observation_digest":"sha256:2c31e5a05bc0d063858011430ef7b5b87f68583d399ed8daa72a5bba724ec51d","observation_id":"91b8bbfc-f93e-43a0-96bc-de8be0d10b9a","resolution":{"observed_at":"2026-08-07T11:27:47.219673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:49.443522Z","title":null,"venue":null,"work_id":"e31adbc1-e771-4a89-8ec5-b01061e2769d","year":null},"citing_paper":{"arxiv_id":"2506.02452","last_updated":"2025-08-24T13:14:45Z","snapshot_observed_at":"2026-08-08T00:30:58.087521Z","submitted_at":"2025-06-03T05:17:37Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:47.223466Z"},"links":{"citing_paper":"/paper/2506.02452"},"observation_digest":"sha256:dd5f8138618e0d1931a173d218e8b24078a3f7920da8d8c1b235efbbbd29c565","observation_id":"89c90d0a-7964-4aaa-b6c8-969c8786fb19","resolution":{"observed_at":"2026-08-07T11:27:49.483278Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:49.293995Z","title":null,"venue":null,"work_id":"b45e2261-c611-4f37-bdf8-4d579341f1da","year":2021},"citing_paper":{"arxiv_id":"2506.02452","last_updated":"2025-08-24T13:14:45Z","snapshot_observed_at":"2026-08-08T00:30:58.087521Z","submitted_at":"2025-06-03T05:17:37Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:47.233463Z"},"links":{"citing_paper":"/paper/2506.02452"},"observation_digest":"sha256:6bf28af84d80c8f754585fdbc2ddc1a991699a7055197a0bb46c6839aa0ea206","observation_id":"72dead58-61d5-4dfa-aa07-b6e3adb88bf4","resolution":{"observed_at":"2026-08-07T11:27:49.369418Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03596","last_updated":"2024-03-28T03:26:51Z","snapshot_observed_at":"2026-07-06T16:57:46.724781Z","submitted_at":"2023-12-06T16:35:59Z","title":"MMM: Generative Masked Motion Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03596","snapshot_observed_at":"2026-08-07T11:27:47.215580Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02452","last_updated":"2025-08-24T13:14:45Z","snapshot_observed_at":"2026-08-08T00:30:58.087521Z","submitted_at":"2025-06-03T05:17:37Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:47.215580Z"},"links":{"cited_paper":"/paper/2312.03596","citing_paper":"/paper/2506.02452"},"observation_digest":"sha256:c95fd98ce61428dca9f3c768597c8cb1a9f470c2021ca15a0c2771d460ebd22d","observation_id":"7ffca087-efea-4e43-8977-639739ea90d9","resolution":{"observed_at":"2026-08-07T11:27:47.215580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-07-06T10:01:50.133383Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-07T11:27:47.241904Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.02452","last_updated":"2025-08-24T13:14:45Z","snapshot_observed_at":"2026-08-08T00:30:58.087521Z","submitted_at":"2025-06-03T05:17:37Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:47.241904Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2506.02452"},"observation_digest":"sha256:e7a18173092533f47297a470b468218026c294824b6bc9b8b130fc5438449894","observation_id":"bb796633-a63b-4bc2-aba7-39b0488e3e5f","resolution":{"observed_at":"2026-08-07T11:27:47.241904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.08063","last_updated":"2022-03-15T16:56:22Z","snapshot_observed_at":"2026-07-06T12:48:13.087800Z","submitted_at":"2022-03-15T16:56:22Z","title":"MotionCLIP: Exposing Human Motion Generation to CLIP Space","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.08063","snapshot_observed_at":"2026-08-07T11:27:47.245845Z","title":"Bermano, and Daniel Cohen- Or","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.02452","last_updated":"2025-08-24T13:14:45Z","snapshot_observed_at":"2026-08-08T00:30:58.087521Z","submitted_at":"2025-06-03T05:17:37Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:47.245845Z"},"links":{"cited_paper":"/paper/2203.08063","citing_paper":"/paper/2506.02452"},"observation_digest":"sha256:cda012d47ddad1fd3ab10b8af4776d8061b2027d0aee8c190b0209fa8eafbbdb","observation_id":"414487fd-a222-4c57-aa32-58150f776caa","resolution":{"observed_at":"2026-08-07T11:27:47.245845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17870","last_updated":"2024-03-26T16:57:55Z","snapshot_observed_at":"2026-08-07T05:21:44.237421Z","submitted_at":"2024-03-26T16:57:55Z","title":"Boosting Diffusion Models with Moving Average Sampling in Frequency Domain","version":1},"cited_work":{"arxiv_id":"2403.17870","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.17870","snapshot_observed_at":"2026-08-07T11:27:47.500129Z","title":"Boosting Diffusion Models with Moving Average Sampling in Frequency Domain","venue":"cs.CV","work_id":"885738cd-24db-407c-b510-64913c98ebeb","year":2024},"citing_paper":{"arxiv_id":"2506.02452","last_updated":"2025-08-24T13:14:45Z","snapshot_observed_at":"2026-08-08T00:30:58.087521Z","submitted_at":"2025-06-03T05:17:37Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:47.228291Z"},"links":{"cited_paper":"/paper/2403.17870","citing_paper":"/paper/2506.02452"},"observation_digest":"sha256:1dd57f6cfd8cd3109424dbfe3d12715ff3e3684616a63bf653721f6e4100d144","observation_id":"59ee7bf0-dd70-4031-8ea0-723baad44c46","resolution":{"observed_at":"2026-08-07T11:27:47.504855Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14916","last_updated":"2022-10-03T09:17:41Z","snapshot_observed_at":"2026-07-06T13:57:50.746457Z","submitted_at":"2022-09-29T16:27:53Z","title":"Human Motion Diffusion Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14916","snapshot_observed_at":"2026-08-07T11:27:47.253507Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.02452","last_updated":"2025-08-24T13:14:45Z","snapshot_observed_at":"2026-08-08T00:30:58.087521Z","submitted_at":"2025-06-03T05:17:37Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:47.253507Z"},"links":{"cited_paper":"/paper/2209.14916","citing_paper":"/paper/2506.02452"},"observation_digest":"sha256:01040cd3a3ae31a3fb91470e949502436d9802abb7ca71110191a781b8f424c9","observation_id":"b8906897-2f14-4ad5-92e4-82421d7fab1c","resolution":{"observed_at":"2026-08-07T11:27:47.253507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10683","last_updated":"2023-09-19T15:14:48Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-10-23T17:37:36Z","title":"Exploring the Limits of Transfer Learning with a Unified Text-to-Text Transformer","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.10683","snapshot_observed_at":"2026-08-07T11:27:47.236738Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02452","last_updated":"2025-08-24T13:14:45Z","snapshot_observed_at":"2026-08-08T00:30:58.087521Z","submitted_at":"2025-06-03T05:17:37Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:47.236738Z"},"links":{"cited_paper":"/paper/1910.10683","citing_paper":"/paper/2506.02452"},"observation_digest":"sha256:4b9e65c820b03121ab5ec50118a90b7cf6a7dd6ec7bbcdbb9bd539c6c338d976","observation_id":"11df54a1-1ac5-432e-9e13-7e3e7550432b","resolution":{"observed_at":"2026-08-07T11:27:47.236738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.02500","last_updated":"2023-08-18T19:59:48Z","snapshot_observed_at":"2026-07-06T14:27:03.516257Z","submitted_at":"2022-12-05T18:59:52Z","title":"PhysDiff: Physics-Guided Human Motion Diffusion Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.02500","snapshot_observed_at":"2026-08-07T11:27:47.265177Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02452","last_updated":"2025-08-24T13:14:45Z","snapshot_observed_at":"2026-08-08T00:30:58.087521Z","submitted_at":"2025-06-03T05:17:37Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:47.265177Z"},"links":{"cited_paper":"/paper/2212.02500","citing_paper":"/paper/2506.02452"},"observation_digest":"sha256:d39965d0f96fe0b43a137ea2e9f6007b44d6ecd615279c13317eac2416a27991","observation_id":"f997532c-d470-44af-a4cb-c8ff8a5cb2a3","resolution":{"observed_at":"2026-08-07T11:27:47.265177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:48.901007Z","title":null,"venue":null,"work_id":"f8a27869-6ff4-48f2-9ead-e2da76438575","year":2023},"citing_paper":{"arxiv_id":"2506.02452","last_updated":"2025-08-24T13:14:45Z","snapshot_observed_at":"2026-08-08T00:30:58.087521Z","submitted_at":"2025-06-03T05:17:37Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:47.269190Z"},"links":{"citing_paper":"/paper/2506.02452"},"observation_digest":"sha256:9b05de3cbf98740176fbd85d31e61b81e90fb517fa5705797f78702df841802e","observation_id":"e7c58ba8-a498-44b0-8aea-67cfc25df7c7","resolution":{"observed_at":"2026-08-07T11:27:49.016928Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.06052","last_updated":"2023-09-24T17:00:32Z","snapshot_observed_at":"2026-08-05T06:24:11.602674Z","submitted_at":"2023-01-15T09:34:42Z","title":"T2M-GPT: Generating Human Motion from Textual Descriptions with Discrete Representations","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.06052","snapshot_observed_at":"2026-08-07T11:27:47.278728Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02452","last_updated":"2025-08-24T13:14:45Z","snapshot_observed_at":"2026-08-08T00:30:58.087521Z","submitted_at":"2025-06-03T05:17:37Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:47.278728Z"},"links":{"cited_paper":"/paper/2301.06052","citing_paper":"/paper/2506.02452"},"observation_digest":"sha256:5992ca1995e228cd2a57a1f11ef1789b0056d0e2f5f334f5b29f10c3d901d521","observation_id":"ddec582f-0f91-4d1d-bf6c-2431be7d0aa3","resolution":{"observed_at":"2026-08-07T11:27:47.278728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:49.187572Z","title":null,"venue":null,"work_id":"77621982-62f6-4599-b66c-79e858e078ae","year":null},"citing_paper":{"arxiv_id":"2506.02452","last_updated":"2025-08-24T13:14:45Z","snapshot_observed_at":"2026-08-08T00:30:58.087521Z","submitted_at":"2025-06-03T05:17:37Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:47.257740Z"},"links":{"citing_paper":"/paper/2506.02452"},"observation_digest":"sha256:4149929166181659db33cfbc09b8d14a1e0cc9110001391a7d5b930b5e2d5cc9","observation_id":"7b139336-4fb5-41a3-9dcc-5230c7418e21","resolution":{"observed_at":"2026-08-07T11:27:49.242428Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14178","last_updated":"2024-03-29T08:13:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-27T13:27:01Z","title":"mPLUG-Owl: Modularization Empowers Large Language Models with Multimodality","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14178","snapshot_observed_at":"2026-08-07T11:27:47.261520Z","title":"arXiv:2304.14178 [cs.CL] https://arxiv.org/abs/2304.14178","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.02452","last_updated":"2025-08-24T13:14:45Z","snapshot_observed_at":"2026-08-08T00:30:58.087521Z","submitted_at":"2025-06-03T05:17:37Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:47.261520Z"},"links":{"cited_paper":"/paper/2304.14178","citing_paper":"/paper/2506.02452"},"observation_digest":"sha256:dab227acdc77142f5e9182a8fcf43041b8ba03ac7484a3486486e46497ace571","observation_id":"f8369cf0-2abf-4979-8394-a1627556ee44","resolution":{"observed_at":"2026-08-07T11:27:47.261520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"0340.5552","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:47.381352Z","title":"a person that turns around and runs and skates turns around and then does a cartwheel","venue":null,"work_id":"c03fac34-052c-4be7-98d6-afd7bd2776f0","year":2023},"citing_paper":{"arxiv_id":"2506.02452","last_updated":"2025-08-24T13:14:45Z","snapshot_observed_at":"2026-08-08T00:30:58.087521Z","submitted_at":"2025-06-03T05:17:37Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:47.293960Z"},"links":{"citing_paper":"/paper/2506.02452"},"observation_digest":"sha256:1a71e2059f6e61a586f1db0a65c8605ec7d17875809e57dbc689a79ddeec4e67","observation_id":"cc9f7a33-945c-4333-a78d-1a0fc67f126d","resolution":{"observed_at":"2026-08-07T11:27:47.389153Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.15378","last_updated":"2024-07-22T06:10:41Z","snapshot_observed_at":"2026-08-08T00:30:36.324986Z","submitted_at":"2024-03-22T17:58:16Z","title":"Long-CLIP: Unlocking the Long-Text Capability of CLIP","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.15378","snapshot_observed_at":"2026-08-07T11:27:47.273964Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02452","last_updated":"2025-08-24T13:14:45Z","snapshot_observed_at":"2026-08-08T00:30:58.087521Z","submitted_at":"2025-06-03T05:17:37Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:47.273964Z"},"links":{"cited_paper":"/paper/2403.15378","citing_paper":"/paper/2506.02452"},"observation_digest":"sha256:039b03d8c568286fcd749129049e9aa8ddb26a479f2e3425b14634781872cae9","observation_id":"5a9871a1-57b7-40e4-bd16-eda9ed779b15","resolution":{"observed_at":"2026-08-07T11:27:47.273964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.15001","last_updated":"2022-08-31T17:58:54Z","snapshot_observed_at":"2026-08-08T11:30:10.105282Z","submitted_at":"2022-08-31T17:58:54Z","title":"MotionDiffuse: Text-Driven Human Motion Generation with Diffusion Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.15001","snapshot_observed_at":"2026-08-07T11:27:47.283622Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.02452","last_updated":"2025-08-24T13:14:45Z","snapshot_observed_at":"2026-08-08T00:30:58.087521Z","submitted_at":"2025-06-03T05:17:37Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:47.283622Z"},"links":{"cited_paper":"/paper/2208.15001","citing_paper":"/paper/2506.02452"},"observation_digest":"sha256:1e67ead0902334d920acb02c26b68a116493f22e1700a64914e1f194db22750f","observation_id":"3ebb1b8e-3c71-4965-b8c6-5043f9a0c53b","resolution":{"observed_at":"2026-08-07T11:27:47.283622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:48.712475Z","title":null,"venue":null,"work_id":"2447c68a-a195-400e-83ca-3adfc9b55815","year":2024},"citing_paper":{"arxiv_id":"2506.02452","last_updated":"2025-08-24T13:14:45Z","snapshot_observed_at":"2026-08-08T00:30:58.087521Z","submitted_at":"2025-06-03T05:17:37Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:47.288178Z"},"links":{"citing_paper":"/paper/2506.02452"},"observation_digest":"sha256:1ad6c3685f685117d43f6820d8578d035a7cbfea8fedbbf11f3f5337e277af34","observation_id":"d984d0fc-1247-4770-b2be-cd4da3b369a7","resolution":{"observed_at":"2026-08-07T11:27:48.782937Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:50.190692Z","title":"InProceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":"2df623a6-fbc7-4868-aa5d-e8a277d7ba49","year":null},"citing_paper":{"arxiv_id":"2506.02452","last_updated":"2025-08-24T13:14:45Z","snapshot_observed_at":"2026-08-08T00:30:58.087521Z","submitted_at":"2025-06-03T05:17:37Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:47.105030Z"},"links":{"citing_paper":"/paper/2506.02452"},"observation_digest":"sha256:c205968a53c431dced66ee5120893b35fb79af85612c0402b01e2c67a99b8d52","observation_id":"3a3b7eb0-006b-4a59-9e70-33ccc1f7476d","resolution":{"observed_at":"2026-08-07T11:27:50.194023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00063","last_updated":"2023-11-29T19:04:10Z","snapshot_observed_at":"2026-07-06T16:55:17.192399Z","submitted_at":"2023-11-29T19:04:10Z","title":"MoMask: Generative Masked Modeling of 3D Human Motions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00063","snapshot_observed_at":"2026-08-07T11:27:47.095844Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02452","last_updated":"2025-08-24T13:14:45Z","snapshot_observed_at":"2026-08-08T00:30:58.087521Z","submitted_at":"2025-06-03T05:17:37Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:47.095844Z"},"links":{"cited_paper":"/paper/2312.00063","citing_paper":"/paper/2506.02452"},"observation_digest":"sha256:554b42cf95c024909bf09ead9b1415dbd838536a6d8eee4ffa71e24c2895e8de","observation_id":"5630dc34-1457-4cff-b5fe-ac97acce9f73","resolution":{"observed_at":"2026-08-07T11:27:47.095844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16575","last_updated":"2025-07-08T20:15:01Z","snapshot_observed_at":"2026-07-06T19:56:39.115630Z","submitted_at":"2024-11-25T16:59:42Z","title":"Rethinking Diffusion for Text-Driven Human Motion Generation: Redundant Representations, Evaluation, and Masked Autoregression","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16575","snapshot_observed_at":"2026-08-07T11:27:47.193849Z","title":"arXiv:2411.16575 [cs.CV] https://arxiv.org/abs/2411.16575","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.02452","last_updated":"2025-08-24T13:14:45Z","snapshot_observed_at":"2026-08-08T00:30:58.087521Z","submitted_at":"2025-06-03T05:17:37Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:47.193849Z"},"links":{"cited_paper":"/paper/2411.16575","citing_paper":"/paper/2506.02452"},"observation_digest":"sha256:53cc92363d34493baeef630f5489d3a1f348b70d94a3b03cce18d5b1f4edca07","observation_id":"58b463ca-5f50-48a1-a3b3-4edd62e64d42","resolution":{"observed_at":"2026-08-07T11:27:47.193849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.02452","last_updated":"2025-08-24T13:14:45Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T00:30:58.087521Z","submitted_at":"2025-06-03T05:17:37Z","title":"ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model"},"reference_resolution":{"displayed":54,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":47,"verified_exact":3,"verified_fuzzy":2},"total_outbound_references":54},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 54 of 54 outbound references and 1 inbound Pith citation observation for arXiv:2506.02452."}