{"as_of":"2026-08-11T07:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ae39ab4b6363ee40fa043006abd73f793e85bab704f644d6f057b945b8a06f19","coverage":[{"denominator":41,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":41,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:22:38.690512Z","state":"measured"},{"denominator":42,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":42,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T21:56:38.906889Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-10T21:56:39.150727Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-10T05:45:01.469555Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"cited_work":{"arxiv_id":"2506.02661","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.02661","snapshot_observed_at":"2026-08-10T21:56:39.150727Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","venue":"cs.SD","work_id":"cb52a83d-b353-4fc8-ae70-a21662cb0a59","year":2025},"citing_paper":{"arxiv_id":"2608.06722","last_updated":"2026-08-07T02:32:11Z","snapshot_observed_at":"2026-08-11T07:12:23.020078Z","submitted_at":"2026-08-07T02:32:11Z","title":"CustomDance: Customized 3D Dance Generation with Coarse-to-Fine Human-Centered Interactive Control","version":1},"reference_index":187,"source":"arxiv_source","source_observed_at":"2026-08-10T21:56:38.906889Z"},"links":{"cited_paper":"/paper/2506.02661","citing_paper":"/paper/2608.06722"},"observation_digest":"sha256:5cebc54c721846ab63c23a7e3dab810dc544b175999c5f2b473a625d5908bf47","observation_id":"73e4d1a1-c137-4c34-95b7-74e2ec6f5574","resolution":{"observed_at":"2026-08-10T21:56:39.156880Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.02661/citation-record","integrity":"/paper/2506.02661/integrity","json":"/paper/2506.02661/citation-record.json","paper":"/paper/2506.02661"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.385798Z","title":"Self-supervised multimodal versatile networks.Advances in neural information processing systems, 33:25–37, 2020","venue":null,"work_id":"e245ffac-bc35-4061-8879-04c4306ca8aa","year":2020},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-10T05:45:01.469555Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.499766Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:73624abc255bd3217908a197f22c435ef82dd28cd55f2295005f2f8c7f289b42","observation_id":"fb2507d4-5399-46d1-a3e5-895461ac0b74","resolution":{"observed_at":"2026-08-07T11:22:39.390840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.365767Z","title":"Groovenet: Real-time music-driven dance movement generation using artificial neural networks.networks, 8(17):26, 2017","venue":null,"work_id":"1d91ef15-2b60-4690-b416-2ffd75ba74bf","year":2017},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-10T05:45:01.469555Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.505300Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:222101660f846c07a46c81d943fa749b206a5e078c423947e42e57ce6169b552","observation_id":"50205bbb-7099-482d-b56c-3479fd633f24","resolution":{"observed_at":"2026-08-07T11:22:39.370981Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:38.509903Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech representations.Advances in neural information processing systems, 33:12449–12460, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-10T05:45:01.469555Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.509903Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:cc4e166c7e9d3c5c3975542178ed21a68c8a8a5f8f9ef14e06f6275e6c8df6f1","observation_id":"bdd53ff5-8839-43e8-8b16-24c4b3692607","resolution":{"observed_at":"2026-08-07T11:22:38.509903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.330398Z","title":"Choreomaster: choreography-oriented music-driven dance synthesis.ACM Transactions on Graphics (TOG), 40(4):1–13, 2021","venue":null,"work_id":"45651e18-f706-48d1-9666-519049adc051","year":2021},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-10T05:45:01.469555Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.514737Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:150d6e8d219fbc0f9bff462e8716354c6081b42622298f6f4b7491fee69028a2","observation_id":"a3a1a65d-ce63-44d1-aeb6-45d0d1c58080","resolution":{"observed_at":"2026-08-07T11:22:39.335146Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.00341","last_updated":"2020-04-30T09:02:45Z","snapshot_observed_at":"2026-08-06T03:57:57.420510Z","submitted_at":"2020-04-30T09:02:45Z","title":"Jukebox: A Generative Model for Music","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.00341","snapshot_observed_at":"2026-08-07T11:22:38.520386Z","title":"Jukebox: A generative model for music.arXiv preprint arXiv:2005.00341, 2020","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-10T05:45:01.469555Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.520386Z"},"links":{"cited_paper":"/paper/2005.00341","citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:564937e76d46cef194737112c5ea054f53d5a6e0ddbf66b19dcfa669c1d07647","observation_id":"64ae1e95-b6e5-4758-afbb-cd1191249091","resolution":{"observed_at":"2026-08-07T11:22:38.520386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.314572Z","title":"Fairmotion-tools to load, process and visualize motion capture data","venue":null,"work_id":"4fd6c2f6-e580-41d0-996b-8f77e28bdd50","year":2020},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-10T05:45:01.469555Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.525335Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:16212512117c91b706f147ae962941acc594fc26d9524939112e8026200a6a2e","observation_id":"6772eb54-85d4-4f24-b097-1222bc17b15d","resolution":{"observed_at":"2026-08-07T11:22:39.319568Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.298837Z","title":"Momask: Generative masked modeling of 3d human motions","venue":null,"work_id":"1d078e38-2c80-4e6a-925c-2904740dca51","year":1900},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-10T05:45:01.469555Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.530549Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:fc2a8fe583f31d86db62558a0cee942c6c95c70cc472ceb1e36f392012aece8c","observation_id":"9036d2a9-f955-4555-adb8-82286a51b63e","resolution":{"observed_at":"2026-08-07T11:22:39.303839Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:38.535432Z","title":"Denoising diffusion probabilistic models.Advances in neural information processing systems, 33:6840–6851, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-10T05:45:01.469555Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.535432Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:e54397e1e1986c2e2e391c36e7e07869e6b4fafc67ddc868a605ac54e9a79fe4","observation_id":"240ed977-c77c-4b16-bc4f-4b0a08345081","resolution":{"observed_at":"2026-08-07T11:22:38.535432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.267959Z","title":"Dance revolution: Long-term dance generation with music via curriculum learning","venue":null,"work_id":"9b04bffa-901a-4d47-b720-54569c3f87ca","year":2020},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-10T05:45:01.469555Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.539745Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:306f56377ab54ee32ead2bb21f6ce1995599a656cc5af5965b3a43b8ddc67f31","observation_id":"bc03ab71-0868-4b46-8d59-f4ce617afa04","resolution":{"observed_at":"2026-08-07T11:22:39.273104Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.250928Z","title":"Beat-it: Beat-synchronized multi-condition 3d dance generation","venue":null,"work_id":"721d933e-a2d0-479f-a89d-e95956b78b4c","year":2024},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-10T05:45:01.469555Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.543890Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:cc0d9a82121dd7d412a1ab5b4154ef67f7afcc2394014f70d4b26cb000c27dc0","observation_id":"1f41453d-0df8-4081-ab4a-b2b0d89cf947","resolution":{"observed_at":"2026-08-07T11:22:39.256298Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.234283Z","title":"Morag - multi- fusion retrieval augmented generation for human motion","venue":null,"work_id":"c9d61882-cd72-4768-bf17-a8fb227b7337","year":2025},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-10T05:45:01.469555Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.548240Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:9272e359f79ec82822c9010addb21dbc92274b87db8f6a3372576aa25c3d25b9","observation_id":"85081c4a-d390-47af-93c2-bd5db3735bf0","resolution":{"observed_at":"2026-08-07T11:22:39.239858Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.217712Z","title":"A brand new dance partner: Music-conditioned pluralistic dancing controlled by multiple dance genres","venue":null,"work_id":"3d0de434-1bc1-46d2-aabc-2cf3008832ed","year":2022},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-10T05:45:01.469555Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.552952Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:6f9ad11257e0d6f12647889dca2b4f944ba25ee4af31d88f04638a6ad1c9bc12","observation_id":"3619ce15-53a9-4e13-adbc-63e2e414871d","resolution":{"observed_at":"2026-08-07T11:22:39.222628Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.202335Z","title":"Exponential moving average versus moving exponential average.Mathematische Semesterberichte, 58:97–107, 2011","venue":null,"work_id":"4cd4a262-2799-4da2-b06b-8e02c99c66dd","year":2011},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-10T05:45:01.469555Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.557343Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:204015ce88d59328577b7b5420d84ca44a235afc17f27eb1d4f6bd6951530367","observation_id":"849fd0c6-88b6-4381-a5d0-29159d5db163","resolution":{"observed_at":"2026-08-07T11:22:39.206721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.187700Z","title":"Danceformer: Music conditioned 3d dance generation with parametric motion transformer","venue":null,"work_id":"09b167a4-928e-4472-84de-0c9bb88bdce3","year":2022},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-10T05:45:01.469555Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.562403Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:8b784c39bbd3811e3549e18163a2ce98a72098764f782b4a897c35d482fc09b6","observation_id":"fd3bb071-4218-4e9c-b8ae-bed144e66e13","resolution":{"observed_at":"2026-08-07T11:22:39.192158Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.08171","last_updated":"2020-08-18T22:29:40Z","snapshot_observed_at":"2026-08-09T12:10:59.952971Z","submitted_at":"2020-08-18T22:29:40Z","title":"Learning to Generate Diverse Dance Motions with Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.08171","snapshot_observed_at":"2026-08-07T11:22:38.570255Z","title":"Learning to generate diverse dance motions with transformer.arXiv preprint arXiv:2008.08171, 2020","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-10T05:45:01.469555Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.570255Z"},"links":{"cited_paper":"/paper/2008.08171","citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:d1b898ef0702dd14e5d5ed2b55469654de781f64a4f82de1cc489440494628cf","observation_id":"d59b9d7a-e761-419e-8d9b-9d08e403a78d","resolution":{"observed_at":"2026-08-07T11:22:38.570255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20389","last_updated":"2024-10-27T09:32:35Z","snapshot_observed_at":"2026-08-10T20:32:50.173831Z","submitted_at":"2024-10-27T09:32:35Z","title":"Lodge++: High-quality and Long Dance Generation with Vivid Choreography Patterns","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20389","snapshot_observed_at":"2026-08-07T11:22:38.575805Z","title":"Lodge++: High-quality and long dance generation with vivid choreography patterns.arXiv preprint arXiv:2410.20389, 2024","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-10T05:45:01.469555Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.575805Z"},"links":{"cited_paper":"/paper/2410.20389","citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:d19ca9444b3b01bb860c79c2ae22d2f0d2d3debb902d86c81dead33f01899f7c","observation_id":"726d463b-dfa4-4921-9666-fbd00f5c4831","resolution":{"observed_at":"2026-08-07T11:22:38.575805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.171887Z","title":"Lodge: A coarse to fine diffusion network for long dance generation guided by the characteristic dance primitives","venue":null,"work_id":"a8f35696-2278-427e-862d-8aea6bb9b876","year":2024},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-10T05:45:01.469555Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.580755Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:a8d6f3a776d207c3541e83bc3e0af0969bcd570ea00dfeb4c9dcccab7ce114b0","observation_id":"196e7b6d-b2ab-4154-b6f7-8a74373af1ab","resolution":{"observed_at":"2026-08-07T11:22:39.176968Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.156331Z","title":"Finedance: A fine-grained choreography dataset for 3d full body dance generation","venue":null,"work_id":"64726750-6e62-452e-ab85-c96357613e29","year":2023},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-10T05:45:01.469555Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.585082Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:68cdcab499415eb4e324bff24b89f8369abdab4c3d5edfb765164f6978da6f51","observation_id":"a5f77e4b-06a4-47c9-bd25-2dc40eedbd5b","resolution":{"observed_at":"2026-08-07T11:22:39.160919Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.140173Z","title":"Ai choreographer: Music conditioned 3d dance generation with aist++","venue":null,"work_id":"335453b7-51b9-4a2b-a191-0fb2d6d45bd8","year":2021},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-10T05:45:01.469555Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.589436Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:326138cda9b1cc0c9c81ba54a80e39d72162e107798c5df1c9a9262d503c04cc","observation_id":"839ff4ce-5ad9-4250-8adc-f0cb81030d3a","resolution":{"observed_at":"2026-08-07T11:22:39.145515Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20218","last_updated":"2025-06-03T02:25:16Z","snapshot_observed_at":"2026-08-07T16:36:41.093177Z","submitted_at":"2025-03-26T04:20:14Z","title":"Video Motion Graphs","version":2},"cited_work":{"arxiv_id":"2503.20218","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.20218","snapshot_observed_at":"2026-08-07T11:22:38.784139Z","title":"Video Motion Graphs","venue":"cs.CV","work_id":"14d93a20-7615-4505-a538-80a71dccc403","year":2025},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-10T05:45:01.469555Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.594025Z"},"links":{"cited_paper":"/paper/2503.20218","citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:e8abec0db7a47abe08c658ab98131fa251ae7ecbbb2713b416a86046f4631c5d","observation_id":"746e3de8-8b91-4991-813b-9a5ca6094f75","resolution":{"observed_at":"2026-08-07T11:22:38.791379Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.04221","last_updated":"2024-10-05T16:30:46Z","snapshot_observed_at":"2026-07-06T19:28:26.436468Z","submitted_at":"2024-10-05T16:30:46Z","title":"TANGO: Co-Speech Gesture Video Reenactment with Hierarchical Audio Motion Embedding and Diffusion Interpolation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.04221","snapshot_observed_at":"2026-08-07T11:22:38.599410Z","title":"Tango: Co-speech gesture video reenactment with hierarchical audio motion embedding and diffusion interpolation.arXiv preprint arXiv:2410.04221, 2024","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-10T05:45:01.469555Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.599410Z"},"links":{"cited_paper":"/paper/2410.04221","citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:93daf624f980c91620e2cbced613fc92b09b0ff8a637b6279496caaf740e7e3f","observation_id":"5c6eb645-3586-49ee-8797-43e93e7a6763","resolution":{"observed_at":"2026-08-07T11:22:38.599410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:38.604173Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-10T05:45:01.469555Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.604173Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:60f213eba86f846b3019136d3188dd28bd95b742834d0c6b209770289d2df5aa","observation_id":"7e800d0f-8208-4e91-b523-5ce747aba6a3","resolution":{"observed_at":"2026-08-07T11:22:38.604173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-09T20:34:52.923500Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-07T11:22:38.608414Z","title":"Decoupled weight decay regularization.arXiv preprint arXiv:1711.05101, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-10T05:45:01.469555Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.608414Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:bb427e05f3dd28945fe5e5e7170c670bf4d6f2f13748746e7100796a6d6c7112","observation_id":"6e3b6318-3417-42e6-9cb0-accadc799057","resolution":{"observed_at":"2026-08-07T11:22:38.608414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.114965Z","title":"librosa: Audio and music signal analysis in python.SciPy, 2015:18–24, 2015","venue":null,"work_id":"7a2bcd19-7b64-41f8-ab34-1991daa465b7","year":2015},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-10T05:45:01.469555Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.613414Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:18bd26e019d3de4c0945c6603dbd3364aa70c3eefb69d605dd2f2cf66bbfa1cc","observation_id":"edbe79aa-6b2e-412e-b9d1-374cfe7d8bf0","resolution":{"observed_at":"2026-08-07T11:22:39.119475Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.099716Z","title":"Learn2dance: Learning statistical music-to-dance mappings for choreography synthesis.IEEE Transactions on Multimedia, 14(3):747–759, 2011","venue":null,"work_id":"b3612e2c-f745-4a70-88e5-0f418b10e057","year":2011},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-10T05:45:01.469555Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.618013Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:6c5fc5728176c67b7f642cb89b6d8573c4f2b220ef8140248119304b307feb12","observation_id":"53a6e95e-b1c7-40cf-8b3f-9950b197775b","resolution":{"observed_at":"2026-08-07T11:22:39.104257Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:38.622516Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-10T05:45:01.469555Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.622516Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:66478f0ba4b7288fe059ce6d6ff43e2b9b75067069f6cc1d45d8bfff08ea5243","observation_id":"cfd0e2f8-dd04-4667-98ed-5113c62bd3f3","resolution":{"observed_at":"2026-08-07T11:22:38.622516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:38.626976Z","title":"Film: Visual reasoning with a general conditioning layer","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-10T05:45:01.469555Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.626976Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:2c132c8c2c69a6c444c535b2c0c64f9922d514564957665c2063e6ba0507b289","observation_id":"5268d9fd-dd53-48f5-b57e-356f9defff10","resolution":{"observed_at":"2026-08-07T11:22:38.626976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.062840Z","title":"Diffdance: Cascaded human motion diffusion model for dance generation","venue":null,"work_id":"7c34b33f-4164-476e-aa6e-9eb754b880c1","year":2023},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-10T05:45:01.469555Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.631323Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:639dcf2f6a731340347b70275f1eef79f350f6fbc318a6848ef1b45fa0368f3f","observation_id":"928cb026-de76-4a1d-9c52-ae2fda53224c","resolution":{"observed_at":"2026-08-07T11:22:39.067507Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:38.635595Z","title":"Bailando: 3d dance generation via actor-critic gpt with choreographic memory","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-10T05:45:01.469555Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.635595Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:4867ffd47b99a021622980dce968dc74888630920b09ea73e55b8d1737d10dbc","observation_id":"b756487f-de10-42f9-8a28-a0b68ebfa831","resolution":{"observed_at":"2026-08-07T11:22:38.635595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.034862Z","title":"Bailando++: 3d dance gpt with choreographic memory.IEEE Transactions on Pattern Analysis and Machine Intelligence, 45(12):14192–14207, 2023","venue":null,"work_id":"aba2f3a5-35dd-4cb6-a6bb-b69a5322ae5e","year":2023},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-10T05:45:01.469555Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.639824Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:12ac57da21311ef6e36e221bf250af5c290312ab90c3b373c6e14305ff64af3c","observation_id":"cc9fe848-831f-4382-804e-68b65220beb4","resolution":{"observed_at":"2026-08-07T11:22:39.040014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:38.644047Z","title":"Deep unsuper- vised learning using nonequilibrium thermodynamics","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-10T05:45:01.469555Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.644047Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:e4a8b8a5bce001210a384f7cee246eaf2482047c7b25f69a373dd135353d967f","observation_id":"c1a83ddf-c92f-4b2c-99bc-4668c851ad6b","resolution":{"observed_at":"2026-08-07T11:22:38.644047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.006203Z","title":"Dance with melody: An lstm-autoencoder approach to music-oriented dance synthesis","venue":null,"work_id":"c66e72d1-a498-4fc8-b994-1426d671b012","year":2018},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-10T05:45:01.469555Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.648769Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:566cbcd2b5d400a81462c00460fcdc3985fa60a179433c5aae9a1d06e8681408","observation_id":"2721de05-f17a-47f4-92ba-dd1ce3bf9045","resolution":{"observed_at":"2026-08-07T11:22:39.011501Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:38.986047Z","title":"Motionclip: Exposing human motion generation to clip space","venue":null,"work_id":"7a6d37bd-7d39-498a-a8af-5040640d4528","year":2022},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-10T05:45:01.469555Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.652939Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:b7be8be0eee4bbbe137475d00f9e70cf2ef5863f88b67a1cf2cfaa32c555a83c","observation_id":"529c249e-c484-4e93-9b2c-cfb813775223","resolution":{"observed_at":"2026-08-07T11:22:38.991554Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14916","last_updated":"2022-10-03T09:17:41Z","snapshot_observed_at":"2026-07-06T13:57:50.746457Z","submitted_at":"2022-09-29T16:27:53Z","title":"Human Motion Diffusion Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14916","snapshot_observed_at":"2026-08-07T11:22:38.657037Z","title":"Human motion diffusion model.arXiv preprint arXiv:2209.14916, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-10T05:45:01.469555Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.657037Z"},"links":{"cited_paper":"/paper/2209.14916","citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:2d4e0ec179a1a46d99ac1ae7efeeef4fa5f1bd7c9b5eff61c2e1dc2837386996","observation_id":"07bb34a3-8d47-4673-9033-c4cd58797665","resolution":{"observed_at":"2026-08-07T11:22:38.657037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:38.969682Z","title":"Edge: Editable dance generation from music","venue":null,"work_id":"a8ab1850-7e03-467d-b5fb-7e418564e891","year":2023},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-10T05:45:01.469555Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.661324Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:e7e6ac0400b0ebdc225d5adcf35a5e0e19c5f33b1b961e232598a2426f842903","observation_id":"365b4e1f-b30a-4b21-9144-33ed2c9e5508","resolution":{"observed_at":"2026-08-07T11:22:38.974605Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:38.952369Z","title":"Wav2clip: Learning robust audio representations from clip","venue":null,"work_id":"2f20753c-355a-4222-b590-971e6399711a","year":2022},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-10T05:45:01.469555Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.665669Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:244b490cd6c0dbf40843b17600cba82f75474c38610c3f795dfca59f500c4479","observation_id":"5cd822e8-01a9-4cee-a86a-f77807185c42","resolution":{"observed_at":"2026-08-07T11:22:38.957681Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:38.933087Z","title":"Adan: Adaptive nesterov momentum algorithm for faster optimizing deep models.IEEE Transactions on Pattern Analysis and Machine Intelligence, 2024","venue":null,"work_id":"c715ee91-192d-4531-9616-add3d0a0a9ec","year":2024},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-10T05:45:01.469555Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.672894Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:c7fa501484cc227efaef482a9bb4f9ebc9b0fded57415efa4a226943cd94b5eb","observation_id":"363244fa-e989-48a0-a475-e6473cd06a0b","resolution":{"observed_at":"2026-08-07T11:22:38.939181Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:38.677124Z","title":"Motiondiffuse: Text-driven human motion generation with diffusion model.IEEE transactions on pattern analysis and machine intelligence, 46(6):4115–4128, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-10T05:45:01.469555Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.677124Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:5be4e607020b7979bc6f6ac6d249d68560432ebc01d6a16d8ebab59440141a58","observation_id":"b68f4e48-5228-420d-a54a-1ecc46acc021","resolution":{"observed_at":"2026-08-07T11:22:38.677124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:38.681325Z","title":"Remodiffuse: Retrieval-augmented motion diffusion model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-10T05:45:01.469555Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.681325Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:f64c8d57850351c3648b71ab9c1bcd4dee54b4e8803063723b24096f589d6c91","observation_id":"aad516c7-c65f-4655-8b22-5a351cb2085c","resolution":{"observed_at":"2026-08-07T11:22:38.681325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:38.884936Z","title":"Audio-driven neural gesture reenactment with video motion graphs","venue":null,"work_id":"913e1037-51ac-4377-9976-93e5bd4bddcd","year":2022},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-10T05:45:01.469555Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.686256Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:be1bee68ae4e27ea10661dd6fdc9790c6d68abcd50f8ea1d8f0e9d7affb5616f","observation_id":"e1e1c965-c815-433c-b4af-846a16f2cb3a","resolution":{"observed_at":"2026-08-07T11:22:38.889676Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:38.867393Z","title":"Music2dance: Dancenet for music-driven dance generation.ACM Transactions on Multimedia Computing, Communications, and Applications (TOMM), 18(2):1–21, 2022","venue":null,"work_id":"ba4866ec-77c6-47dd-8b7c-0ceb28a5668c","year":2022},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-10T05:45:01.469555Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.690512Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:756383eda4ead091659c16e1b1f90a3d90cb08109e97eab4564ab844c2f2058c","observation_id":"4ad6df18-ec72-4094-b48b-d2c0f0a87e22","resolution":{"observed_at":"2026-08-07T11:22:38.873745Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-10T05:45:01.469555Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation"},"reference_resolution":{"displayed":41,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":1,"verified_fuzzy":25},"total_outbound_references":41},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 41 of 41 outbound references and 1 inbound Pith citation observation for arXiv:2506.02661."}