{"as_of":"2026-08-15T20:23:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a64ec1a7a82d7dbcb1ef36dcb67ad8a950ac6c4a1295b3a414aba982d2231062","coverage":[{"denominator":45,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T17:10:50.321622Z","state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.16911/citation-record","integrity":"/paper/2508.16911/integrity","json":"/paper/2508.16911/citation-record.json","paper":"/paper/2508.16911"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:10:50.960205Z","title":"Listen, denoise, action! audio-driven motion synthesis with diffusion models","venue":null,"work_id":"b289c9b2-1038-4b6a-995a-39a2e2d2f920","year":2023},"citing_paper":{"arxiv_id":"2508.16911","last_updated":"2025-08-23T05:56:37Z","snapshot_observed_at":"2026-08-09T10:20:13.282373Z","submitted_at":"2025-08-23T05:56:37Z","title":"MDD: A Dataset for Text-and-Music Conditioned Duet Dance Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T17:10:50.125358Z"},"links":{"citing_paper":"/paper/2508.16911"},"observation_digest":"sha256:756fb856ee37cbd99c9340c52ab7d67ebc93e826182d1ec646f6097f59820558","observation_id":"da2ea067-1cab-4ec6-b735-7cbd53219aab","resolution":{"observed_at":"2026-08-05T17:10:50.964448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:10:50.947493Z","title":"Motionfix: Text-driven 3d human motion editing","venue":null,"work_id":"c2190c7e-37fa-4c84-9bdb-8cad221c87f3","year":2024},"citing_paper":{"arxiv_id":"2508.16911","last_updated":"2025-08-23T05:56:37Z","snapshot_observed_at":"2026-08-09T10:20:13.282373Z","submitted_at":"2025-08-23T05:56:37Z","title":"MDD: A Dataset for Text-and-Music Conditioned Duet Dance Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T17:10:50.130299Z"},"links":{"citing_paper":"/paper/2508.16911"},"observation_digest":"sha256:33a2e0c72b4f8ff48094420d2785b5ddc0aa10bbbf86852ea438a2d562a553d8","observation_id":"865bdbfd-0748-46d0-b756-771cbfdb29b7","resolution":{"observed_at":"2026-08-05T17:10:50.951848Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:10:50.934297Z","title":"Text2gestures: A transformer-based network for generating emotive body gestures for virtual agents","venue":null,"work_id":"90062a4d-6fa6-42d2-8352-9b4f59d0de40","year":2021},"citing_paper":{"arxiv_id":"2508.16911","last_updated":"2025-08-23T05:56:37Z","snapshot_observed_at":"2026-08-09T10:20:13.282373Z","submitted_at":"2025-08-23T05:56:37Z","title":"MDD: A Dataset for Text-and-Music Conditioned Duet Dance Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T17:10:50.135406Z"},"links":{"citing_paper":"/paper/2508.16911"},"observation_digest":"sha256:3a66541830e18680fc44afd88fb3b82080852d747d4a54ec8c05950e6d42b1b3","observation_id":"32720535-2321-404f-ae42-0624ea37214d","resolution":{"observed_at":"2026-08-05T17:10:50.938934Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20370","last_updated":"2025-02-27T18:40:30Z","snapshot_observed_at":"2026-08-15T19:14:06.886484Z","submitted_at":"2025-02-27T18:40:30Z","title":"Ready-to-React: Online Reaction Policy for Two-Character Interaction Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.20370","snapshot_observed_at":"2026-08-05T17:10:50.140238Z","title":"Ready-to-react: Online reaction policy for two-character interaction genera- tion","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.16911","last_updated":"2025-08-23T05:56:37Z","snapshot_observed_at":"2026-08-09T10:20:13.282373Z","submitted_at":"2025-08-23T05:56:37Z","title":"MDD: A Dataset for Text-and-Music Conditioned Duet Dance Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T17:10:50.140238Z"},"links":{"cited_paper":"/paper/2502.20370","citing_paper":"/paper/2508.16911"},"observation_digest":"sha256:b484c8a518f10870140d93c4d333fdc4f1561b195552bd3a5f0cd8495e445e58","observation_id":"a70ab973-47cb-4755-a5c3-911b2e058bdc","resolution":{"observed_at":"2026-08-05T17:10:50.140238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.00341","last_updated":"2020-04-30T09:02:45Z","snapshot_observed_at":"2026-08-06T03:57:57.420510Z","submitted_at":"2020-04-30T09:02:45Z","title":"Jukebox: A Generative Model for Music","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.00341","snapshot_observed_at":"2026-08-05T17:10:50.145040Z","title":"Jukebox: A gen- erative model for music","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2508.16911","last_updated":"2025-08-23T05:56:37Z","snapshot_observed_at":"2026-08-09T10:20:13.282373Z","submitted_at":"2025-08-23T05:56:37Z","title":"MDD: A Dataset for Text-and-Music Conditioned Duet Dance Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T17:10:50.145040Z"},"links":{"cited_paper":"/paper/2005.00341","citing_paper":"/paper/2508.16911"},"observation_digest":"sha256:6d232c494a76fe3ad45528a0c111e88cbc271aa48d10eb0ba73ef50caad10f82","observation_id":"94f439db-aefd-406d-825e-11d63f9c9de1","resolution":{"observed_at":"2026-08-05T17:10:50.145040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:10:50.920773Z","title":"Remos: 3d motion- conditioned reaction synthesis for two-person interactions","venue":null,"work_id":"1f6b2a2c-87f0-40ea-bd0b-bcac2bd3fea9","year":null},"citing_paper":{"arxiv_id":"2508.16911","last_updated":"2025-08-23T05:56:37Z","snapshot_observed_at":"2026-08-09T10:20:13.282373Z","submitted_at":"2025-08-23T05:56:37Z","title":"MDD: A Dataset for Text-and-Music Conditioned Duet Dance Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T17:10:50.150153Z"},"links":{"citing_paper":"/paper/2508.16911"},"observation_digest":"sha256:77cc97dc8de3052a7878c6001eceb71e24b56c3ddaa01d42e9b8d7c95446d817","observation_id":"8d802ebb-6124-495e-995a-03f88f562e6e","resolution":{"observed_at":"2026-08-05T17:10:50.925529Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:10:50.893587Z","title":"Duetgen: Music driven two-person dance generation via hierarchical masked modeling","venue":null,"work_id":"1cdcfa6e-b9a5-4314-9199-3c0d49236103","year":2025},"citing_paper":{"arxiv_id":"2508.16911","last_updated":"2025-08-23T05:56:37Z","snapshot_observed_at":"2026-08-09T10:20:13.282373Z","submitted_at":"2025-08-23T05:56:37Z","title":"MDD: A Dataset for Text-and-Music Conditioned Duet Dance Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T17:10:50.160182Z"},"links":{"citing_paper":"/paper/2508.16911"},"observation_digest":"sha256:b0d6d665282a71cace5238531df5e5f14d10e9c4e15e638cb719ffa84cbf319a","observation_id":"fb7677dc-ac10-4f54-af17-fe8a4c0f9776","resolution":{"observed_at":"2026-08-05T17:10:50.898540Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:10:50.880696Z","title":"Tm2d: Bimodality driven 3d dance generation via music-text integration","venue":null,"work_id":"12d6ef47-db7f-4d3d-b61a-587cb54bf2b1","year":2023},"citing_paper":{"arxiv_id":"2508.16911","last_updated":"2025-08-23T05:56:37Z","snapshot_observed_at":"2026-08-09T10:20:13.282373Z","submitted_at":"2025-08-23T05:56:37Z","title":"MDD: A Dataset for Text-and-Music Conditioned Duet Dance Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T17:10:50.164442Z"},"links":{"citing_paper":"/paper/2508.16911"},"observation_digest":"sha256:9b5573d6fe36ebc09fe67f4c9d48a4affaa8f8bd6a056efba594903da88a8770","observation_id":"e67c8cda-3260-4950-88b8-61212a008252","resolution":{"observed_at":"2026-08-05T17:10:50.885041Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:10:50.867596Z","title":"Generating diverse and natural 3d human motions from text","venue":null,"work_id":"6625e112-e3b7-4786-b8cb-755ed519e6a4","year":2022},"citing_paper":{"arxiv_id":"2508.16911","last_updated":"2025-08-23T05:56:37Z","snapshot_observed_at":"2026-08-09T10:20:13.282373Z","submitted_at":"2025-08-23T05:56:37Z","title":"MDD: A Dataset for Text-and-Music Conditioned Duet Dance Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T17:10:50.168577Z"},"links":{"citing_paper":"/paper/2508.16911"},"observation_digest":"sha256:b993ed7c976fc66ccfe8969220f03acfab7be7dc01f993e572e5910b7fb17b59","observation_id":"9253e42f-0bbf-4d4b-8647-ac95beecbe82","resolution":{"observed_at":"2026-08-05T17:10:50.872039Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:10:50.854499Z","title":"Dance revolution: Long-term dance gen- eration with music via curriculum learning","venue":null,"work_id":"97a7c766-beb9-4714-b910-e80143920320","year":2020},"citing_paper":{"arxiv_id":"2508.16911","last_updated":"2025-08-23T05:56:37Z","snapshot_observed_at":"2026-08-09T10:20:13.282373Z","submitted_at":"2025-08-23T05:56:37Z","title":"MDD: A Dataset for Text-and-Music Conditioned Duet Dance Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T17:10:50.173286Z"},"links":{"citing_paper":"/paper/2508.16911"},"observation_digest":"sha256:e35ca2e86219b3703371e7ad7dd96917b24694946ee32844c4da44f128dbaf93","observation_id":"d1a2f303-d0e3-411e-8efc-59e2eaa99c7c","resolution":{"observed_at":"2026-08-05T17:10:50.858860Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:10:50.840662Z","title":"Gpt-4o: The cutting-edge advancement in multimodal llm","venue":null,"work_id":"9230ea3a-7626-4475-9220-527b2b5751f9","year":2024},"citing_paper":{"arxiv_id":"2508.16911","last_updated":"2025-08-23T05:56:37Z","snapshot_observed_at":"2026-08-09T10:20:13.282373Z","submitted_at":"2025-08-23T05:56:37Z","title":"MDD: A Dataset for Text-and-Music Conditioned Duet Dance Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T17:10:50.177378Z"},"links":{"citing_paper":"/paper/2508.16911"},"observation_digest":"sha256:869e71aff712f42aae349cbaa9575a3c3cc89b91c12e1bd9bb235702e546c29f","observation_id":"2e119c32-730a-4c43-bd25-dd30c73a97b8","resolution":{"observed_at":"2026-08-05T17:10:50.845775Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:10:50.826934Z","title":"aitviewer, 2022","venue":null,"work_id":"aad8ab79-fe9c-427f-9adb-a473d878d6e6","year":2022},"citing_paper":{"arxiv_id":"2508.16911","last_updated":"2025-08-23T05:56:37Z","snapshot_observed_at":"2026-08-09T10:20:13.282373Z","submitted_at":"2025-08-23T05:56:37Z","title":"MDD: A Dataset for Text-and-Music Conditioned Duet Dance Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T17:10:50.181914Z"},"links":{"citing_paper":"/paper/2508.16911"},"observation_digest":"sha256:cd9850dd51ce7b03d236928989a19c56927e68f96236485b720c8711d8ccd477","observation_id":"5be65ea0-0ac3-483d-9f31-b3e20270847a","resolution":{"observed_at":"2026-08-05T17:10:50.831354Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:10:50.813270Z","title":"Music-driven group choreography","venue":null,"work_id":"580e16fa-40fb-4938-8629-b93b381665db","year":2023},"citing_paper":{"arxiv_id":"2508.16911","last_updated":"2025-08-23T05:56:37Z","snapshot_observed_at":"2026-08-09T10:20:13.282373Z","submitted_at":"2025-08-23T05:56:37Z","title":"MDD: A Dataset for Text-and-Music Conditioned Duet Dance Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T17:10:50.186752Z"},"links":{"citing_paper":"/paper/2508.16911"},"observation_digest":"sha256:f900466cd439e506120fdc4115835e65b777cef4ee05ddca278496e06fc421e9","observation_id":"222e9630-4827-4d8b-8dcc-35f8e970e0a7","resolution":{"observed_at":"2026-08-05T17:10:50.817961Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:10:50.799310Z","title":"Ai choreographer: Music conditioned 3d dance generation with aist++","venue":null,"work_id":"f00e3794-7316-4933-8986-8c8bb8114fb3","year":2021},"citing_paper":{"arxiv_id":"2508.16911","last_updated":"2025-08-23T05:56:37Z","snapshot_observed_at":"2026-08-09T10:20:13.282373Z","submitted_at":"2025-08-23T05:56:37Z","title":"MDD: A Dataset for Text-and-Music Conditioned Duet Dance Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T17:10:50.190807Z"},"links":{"citing_paper":"/paper/2508.16911"},"observation_digest":"sha256:691520c41dab74c02b96b33f829aece7db8c5724e8e7e89426706e6b484400ae","observation_id":"0d1dd731-9400-4069-8d2b-82a46eae941c","resolution":{"observed_at":"2026-08-05T17:10:50.804172Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:10:50.785464Z","title":"Finedance: A fine-grained choreography dataset for 3d full body dance generation","venue":null,"work_id":"1819137b-3152-4d0b-a47a-75d5704362a4","year":2023},"citing_paper":{"arxiv_id":"2508.16911","last_updated":"2025-08-23T05:56:37Z","snapshot_observed_at":"2026-08-09T10:20:13.282373Z","submitted_at":"2025-08-23T05:56:37Z","title":"MDD: A Dataset for Text-and-Music Conditioned Duet Dance Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T17:10:50.195207Z"},"links":{"citing_paper":"/paper/2508.16911"},"observation_digest":"sha256:9ad0c5a80e977c1957d1d96add62e75219a05f92619279191e9f74f2b3971018","observation_id":"da9d701b-b0dc-4300-b4c5-f6d106d314ef","resolution":{"observed_at":"2026-08-05T17:10:50.790310Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:10:50.770840Z","title":"Exploring multi-modal control in music- driven dance generation","venue":null,"work_id":"71026b22-e713-4454-b458-d6a0af03b3e8","year":2024},"citing_paper":{"arxiv_id":"2508.16911","last_updated":"2025-08-23T05:56:37Z","snapshot_observed_at":"2026-08-09T10:20:13.282373Z","submitted_at":"2025-08-23T05:56:37Z","title":"MDD: A Dataset for Text-and-Music Conditioned Duet Dance Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T17:10:50.199093Z"},"links":{"citing_paper":"/paper/2508.16911"},"observation_digest":"sha256:ab8736619bbc4e0da5bce873fe3ef24d93b61c2a61abca1bd1988465c544f34f","observation_id":"cd07831e-8547-4462-aa2e-8db355848e23","resolution":{"observed_at":"2026-08-05T17:10:50.776416Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16982","last_updated":"2024-12-22T11:53:51Z","snapshot_observed_at":"2026-08-14T00:22:54.440671Z","submitted_at":"2024-12-22T11:53:51Z","title":"InterDance:Reactive 3D Dance Generation with Realistic Duet Interactions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16982","snapshot_observed_at":"2026-08-05T17:10:50.203774Z","title":"Interdance: Reactive 3d dance generation with re- alistic duet interactions","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.16911","last_updated":"2025-08-23T05:56:37Z","snapshot_observed_at":"2026-08-09T10:20:13.282373Z","submitted_at":"2025-08-23T05:56:37Z","title":"MDD: A Dataset for Text-and-Music Conditioned Duet Dance Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T17:10:50.203774Z"},"links":{"cited_paper":"/paper/2412.16982","citing_paper":"/paper/2508.16911"},"observation_digest":"sha256:2b5dac990aff2a4805bee758e9e6f6edc58bff5f56fc8684a238ef470b3250dc","observation_id":"771e2a83-3f1d-4797-b909-d260be1cacdc","resolution":{"observed_at":"2026-08-05T17:10:50.203774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:10:50.756778Z","title":"Simmotionedit: Text-based human motion editing with motion similarity pre- diction","venue":null,"work_id":"a8c2c42c-dba0-4ac0-9564-7d5fc7976e8c","year":2025},"citing_paper":{"arxiv_id":"2508.16911","last_updated":"2025-08-23T05:56:37Z","snapshot_observed_at":"2026-08-09T10:20:13.282373Z","submitted_at":"2025-08-23T05:56:37Z","title":"MDD: A Dataset for Text-and-Music Conditioned Duet Dance Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T17:10:50.209289Z"},"links":{"citing_paper":"/paper/2508.16911"},"observation_digest":"sha256:38ddbcfe35a30ee3579fd6e3823b155ee9b9be78cc8bea83b88de48b67644b4f","observation_id":"0c0a853d-2dc3-4e93-bb8c-db133ed70011","resolution":{"observed_at":"2026-08-05T17:10:50.762128Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:10:50.742264Z","title":"Omg: Towards open-vocabulary motion generation via mix- ture of controllers","venue":null,"work_id":"7bc36ebe-09aa-4592-8081-1b628d937d5b","year":2024},"citing_paper":{"arxiv_id":"2508.16911","last_updated":"2025-08-23T05:56:37Z","snapshot_observed_at":"2026-08-09T10:20:13.282373Z","submitted_at":"2025-08-23T05:56:37Z","title":"MDD: A Dataset for Text-and-Music Conditioned Duet Dance Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T17:10:50.213164Z"},"links":{"citing_paper":"/paper/2508.16911"},"observation_digest":"sha256:4becbc8672407f4abf8d3c0cc968132c2ef5c173d7149ffb0e34cbb418bd999c","observation_id":"3ac507fd-da0b-4d31-bb29-0e4e595ed82b","resolution":{"observed_at":"2026-08-05T17:10:50.747411Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:10:50.728406Z","title":"Intergen: Diffusion-based multi-human motion genera- tion under complex interactions","venue":null,"work_id":"95142aa8-eacd-4e03-8dd5-40c0906e7f27","year":2024},"citing_paper":{"arxiv_id":"2508.16911","last_updated":"2025-08-23T05:56:37Z","snapshot_observed_at":"2026-08-09T10:20:13.282373Z","submitted_at":"2025-08-23T05:56:37Z","title":"MDD: A Dataset for Text-and-Music Conditioned Duet Dance Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T17:10:50.217493Z"},"links":{"citing_paper":"/paper/2508.16911"},"observation_digest":"sha256:4261666abf50095ad0792d4b8c15858b85b126d45ab00f75ae941d062b21c3e6","observation_id":"4d4ed9fa-bd51-49cc-933c-00209f9f82a3","resolution":{"observed_at":"2026-08-05T17:10:50.733012Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-14T20:13:52.872565Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-05T17:10:50.221690Z","title":"Decoupled weight decay regularization","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.16911","last_updated":"2025-08-23T05:56:37Z","snapshot_observed_at":"2026-08-09T10:20:13.282373Z","submitted_at":"2025-08-23T05:56:37Z","title":"MDD: A Dataset for Text-and-Music Conditioned Duet Dance Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T17:10:50.221690Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2508.16911"},"observation_digest":"sha256:55a487fb7b060fb29674b74feace47d5b1d9b982982b56eab588a690391e3272","observation_id":"07e7f57f-f008-4168-b2dd-83a5ddaf28e5","resolution":{"observed_at":"2026-08-05T17:10:50.221690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:10:50.715397Z","title":"Popdg: Popular 3d dance generation with popdanceset","venue":null,"work_id":"e323f115-2e74-4eb6-ac10-42f2d8f6be1e","year":2024},"citing_paper":{"arxiv_id":"2508.16911","last_updated":"2025-08-23T05:56:37Z","snapshot_observed_at":"2026-08-09T10:20:13.282373Z","submitted_at":"2025-08-23T05:56:37Z","title":"MDD: A Dataset for Text-and-Music Conditioned Duet Dance Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T17:10:50.226148Z"},"links":{"citing_paper":"/paper/2508.16911"},"observation_digest":"sha256:74deca7059f1b875e506b0bc21100c457d10ff7786573718687ed9d6cc0feaf0","observation_id":"ad4646f9-2cb7-45d6-a21e-0ff5f69ca73d","resolution":{"observed_at":"2026-08-05T17:10:50.719641Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:10:50.701964Z","title":"librosa: Audio and music signal analysis in python","venue":null,"work_id":"e2c3ed97-7f17-47e0-ac86-9dc496abe2c1","year":2015},"citing_paper":{"arxiv_id":"2508.16911","last_updated":"2025-08-23T05:56:37Z","snapshot_observed_at":"2026-08-09T10:20:13.282373Z","submitted_at":"2025-08-23T05:56:37Z","title":"MDD: A Dataset for Text-and-Music Conditioned Duet Dance Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T17:10:50.231128Z"},"links":{"citing_paper":"/paper/2508.16911"},"observation_digest":"sha256:17b3d499e237924f45c014c7632e7b6b8435b6b5518f771e521b13058d930c74","observation_id":"50ac8ea4-9db7-4f57-b7f7-f23da3c03dbb","resolution":{"observed_at":"2026-08-05T17:10:50.706385Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:10:50.688622Z","title":"Gan-based reactive motion synthesis with class-aware discriminators for human–human interaction","venue":null,"work_id":"edbf7e6d-b380-43f5-9e30-328bb83d1ec6","year":2022},"citing_paper":{"arxiv_id":"2508.16911","last_updated":"2025-08-23T05:56:37Z","snapshot_observed_at":"2026-08-09T10:20:13.282373Z","submitted_at":"2025-08-23T05:56:37Z","title":"MDD: A Dataset for Text-and-Music Conditioned Duet Dance Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T17:10:50.235009Z"},"links":{"citing_paper":"/paper/2508.16911"},"observation_digest":"sha256:aa5130b976b5bfb401e127e5dbbae9e2b0ccaf5600d6acc01edea1435df62024","observation_id":"fb4bd957-c4e8-4309-81f5-02e84e2163e3","resolution":{"observed_at":"2026-08-05T17:10:50.692932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16575","last_updated":"2025-07-08T20:15:01Z","snapshot_observed_at":"2026-08-15T11:12:41.186356Z","submitted_at":"2024-11-25T16:59:42Z","title":"Rethinking Diffusion for Text-Driven Human Motion Generation: Redundant Representations, Evaluation, and Masked Autoregression","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16575","snapshot_observed_at":"2026-08-05T17:10:50.239058Z","title":"Rethinking diffusion for text-driven human motion generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.16911","last_updated":"2025-08-23T05:56:37Z","snapshot_observed_at":"2026-08-09T10:20:13.282373Z","submitted_at":"2025-08-23T05:56:37Z","title":"MDD: A Dataset for Text-and-Music Conditioned Duet Dance Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T17:10:50.239058Z"},"links":{"cited_paper":"/paper/2411.16575","citing_paper":"/paper/2508.16911"},"observation_digest":"sha256:d86b1888675ad27f83f4b3c8fe3356390d75273f634e7b3ac1dadffdc8a3b9f4","observation_id":"5af102a7-4055-4ed7-ab69-41ed3f0a26c4","resolution":{"observed_at":"2026-08-05T17:10:50.239058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:10:50.675600Z","title":"OptiTrack Motive: Motion Capture Software","venue":null,"work_id":"27998258-c975-4d32-be29-c99d29bb088e","year":2019},"citing_paper":{"arxiv_id":"2508.16911","last_updated":"2025-08-23T05:56:37Z","snapshot_observed_at":"2026-08-09T10:20:13.282373Z","submitted_at":"2025-08-23T05:56:37Z","title":"MDD: A Dataset for Text-and-Music Conditioned Duet Dance Generation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T17:10:50.243844Z"},"links":{"citing_paper":"/paper/2508.16911"},"observation_digest":"sha256:5df3c47f6db17fe303fbc30fd54c39ffb49726921a495e0e7bd6723fbd9e42ea","observation_id":"d08038b5-679f-4ba5-b79c-61598f10eadf","resolution":{"observed_at":"2026-08-05T17:10:50.680141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:10:50.662803Z","title":null,"venue":null,"work_id":"b5dd5fae-4cb2-4033-b643-332c5cbfaa65","year":2019},"citing_paper":{"arxiv_id":"2508.16911","last_updated":"2025-08-23T05:56:37Z","snapshot_observed_at":"2026-08-09T10:20:13.282373Z","submitted_at":"2025-08-23T05:56:37Z","title":"MDD: A Dataset for Text-and-Music Conditioned Duet Dance Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T17:10:50.248387Z"},"links":{"citing_paper":"/paper/2508.16911"},"observation_digest":"sha256:0c4db1f6d09dfa18c90d7ae791ed0683fbced4f52b48fb45cd95162e58dcb48a","observation_id":"4841af8c-c3ed-4d31-b99f-88b76125e23e","resolution":{"observed_at":"2026-08-05T17:10:50.666872Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:10:50.649826Z","title":"Temos: Generating diverse human motions from textual descriptions","venue":null,"work_id":"4e86cff0-7379-4017-b6ec-5ef764c3d955","year":null},"citing_paper":{"arxiv_id":"2508.16911","last_updated":"2025-08-23T05:56:37Z","snapshot_observed_at":"2026-08-09T10:20:13.282373Z","submitted_at":"2025-08-23T05:56:37Z","title":"MDD: A Dataset for Text-and-Music Conditioned Duet Dance Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T17:10:50.253240Z"},"links":{"citing_paper":"/paper/2508.16911"},"observation_digest":"sha256:73fb0b9a535246c63acb2e9471a9e94f0881c158a7defc2be47baa18610fbfd9","observation_id":"44049233-71fe-4727-8d67-d1abe1358477","resolution":{"observed_at":"2026-08-05T17:10:50.654207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:10:50.636284Z","title":"Bailando: 3d dance generation by actor-critic gpt with choreographic memory","venue":null,"work_id":"cf50b6af-872b-4959-a4b1-7372110252f2","year":2022},"citing_paper":{"arxiv_id":"2508.16911","last_updated":"2025-08-23T05:56:37Z","snapshot_observed_at":"2026-08-09T10:20:13.282373Z","submitted_at":"2025-08-23T05:56:37Z","title":"MDD: A Dataset for Text-and-Music Conditioned Duet Dance Generation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T17:10:50.257495Z"},"links":{"citing_paper":"/paper/2508.16911"},"observation_digest":"sha256:c27f7a526259ff15d98ad14f20ae7dc1855d3ed649ceea627db34788355ef0ee","observation_id":"cce74a31-de04-4cea-965b-2f675f2c9328","resolution":{"observed_at":"2026-08-05T17:10:50.640588Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:10:50.623378Z","title":"Bailando++: 3d dance gpt with choreographic memory","venue":null,"work_id":"ffd6a3d5-8118-40eb-97dc-0c8922ecc317","year":2023},"citing_paper":{"arxiv_id":"2508.16911","last_updated":"2025-08-23T05:56:37Z","snapshot_observed_at":"2026-08-09T10:20:13.282373Z","submitted_at":"2025-08-23T05:56:37Z","title":"MDD: A Dataset for Text-and-Music Conditioned Duet Dance Generation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T17:10:50.261541Z"},"links":{"citing_paper":"/paper/2508.16911"},"observation_digest":"sha256:6ce7e10009f4110531ac13153a58e19189a087fb77a27f934d23e338c750278f","observation_id":"1940c6b7-4122-48f6-ad73-3b1431a633bd","resolution":{"observed_at":"2026-08-05T17:10:50.627609Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.18811","last_updated":"2024-03-27T17:57:02Z","snapshot_observed_at":"2026-08-13T00:43:36.561156Z","submitted_at":"2024-03-27T17:57:02Z","title":"Duolando: Follower GPT with Off-Policy Reinforcement Learning for Dance Accompaniment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.18811","snapshot_observed_at":"2026-08-05T17:10:50.265497Z","title":"Duolando: Follower gpt with off-policy reinforcement learning for dance accompaniment","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.16911","last_updated":"2025-08-23T05:56:37Z","snapshot_observed_at":"2026-08-09T10:20:13.282373Z","submitted_at":"2025-08-23T05:56:37Z","title":"MDD: A Dataset for Text-and-Music Conditioned Duet Dance Generation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T17:10:50.265497Z"},"links":{"cited_paper":"/paper/2403.18811","citing_paper":"/paper/2508.16911"},"observation_digest":"sha256:6076fd28447cb9801b90a865a582079b51d15af317c2cdb29a1d3de3b367faaf","observation_id":"df6502ec-2809-4877-b8c1-6ccbfbba7af7","resolution":{"observed_at":"2026-08-05T17:10:50.265497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:10:50.610538Z","title":"Smith and J","venue":null,"work_id":"4ec4287d-4741-4636-850e-fbe93596f61f","year":1987},"citing_paper":{"arxiv_id":"2508.16911","last_updated":"2025-08-23T05:56:37Z","snapshot_observed_at":"2026-08-09T10:20:13.282373Z","submitted_at":"2025-08-23T05:56:37Z","title":"MDD: A Dataset for Text-and-Music Conditioned Duet Dance Generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T17:10:50.270774Z"},"links":{"citing_paper":"/paper/2508.16911"},"observation_digest":"sha256:3070d88ceaedcbb89bb021ddf0881b2e244f4f675e3808e5342d5ccb4f8c99ce","observation_id":"a88ae80e-35e2-4df6-b4d2-1b775fe10b4e","resolution":{"observed_at":"2026-08-05T17:10:50.614755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:10:50.597256Z","title":"Motionclip: Exposing human motion generation to clip space","venue":null,"work_id":"3c4105fa-3f2e-4a2d-9eaa-724c64295fb8","year":2022},"citing_paper":{"arxiv_id":"2508.16911","last_updated":"2025-08-23T05:56:37Z","snapshot_observed_at":"2026-08-09T10:20:13.282373Z","submitted_at":"2025-08-23T05:56:37Z","title":"MDD: A Dataset for Text-and-Music Conditioned Duet Dance Generation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T17:10:50.274866Z"},"links":{"citing_paper":"/paper/2508.16911"},"observation_digest":"sha256:f4d658e7c518a2060be8428fdd5de96fd7bc533b08bfbb2cf59de9541b80da9e","observation_id":"7413c04b-8af2-42c3-83be-f169433a2ca5","resolution":{"observed_at":"2026-08-05T17:10:50.601618Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:10:50.583927Z","title":"Human motion diffu- sion model","venue":null,"work_id":"c47670b3-1d45-4e9a-babf-6c9cb0b71c35","year":2023},"citing_paper":{"arxiv_id":"2508.16911","last_updated":"2025-08-23T05:56:37Z","snapshot_observed_at":"2026-08-09T10:20:13.282373Z","submitted_at":"2025-08-23T05:56:37Z","title":"MDD: A Dataset for Text-and-Music Conditioned Duet Dance Generation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T17:10:50.279147Z"},"links":{"citing_paper":"/paper/2508.16911"},"observation_digest":"sha256:7935fa292b58811914564c9e3cc01e18235bed181b3e11d764278c72186ac105","observation_id":"9e941ff0-5391-4c56-bb2e-fd2086c3d869","resolution":{"observed_at":"2026-08-05T17:10:50.588335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:10:50.570359Z","title":"Edge: Editable dance generation from music","venue":null,"work_id":"22485cfd-e20b-47da-ad09-1bc780d5f42e","year":2023},"citing_paper":{"arxiv_id":"2508.16911","last_updated":"2025-08-23T05:56:37Z","snapshot_observed_at":"2026-08-09T10:20:13.282373Z","submitted_at":"2025-08-23T05:56:37Z","title":"MDD: A Dataset for Text-and-Music Conditioned Duet Dance Generation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T17:10:50.283390Z"},"links":{"citing_paper":"/paper/2508.16911"},"observation_digest":"sha256:c24e78ed4a616895ea039fd7a44c6333d9f612716b317e41950b1c04700e4f08","observation_id":"8664eaaa-d101-47c3-b556-b8395c4673b4","resolution":{"observed_at":"2026-08-05T17:10:50.574854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:10:50.556768Z","title":"Disco: Disentangled control for realistic human dance generation","venue":null,"work_id":"b1d9083f-be4d-43d6-a2eb-075f74dbb201","year":2024},"citing_paper":{"arxiv_id":"2508.16911","last_updated":"2025-08-23T05:56:37Z","snapshot_observed_at":"2026-08-09T10:20:13.282373Z","submitted_at":"2025-08-23T05:56:37Z","title":"MDD: A Dataset for Text-and-Music Conditioned Duet Dance Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T17:10:50.287789Z"},"links":{"citing_paper":"/paper/2508.16911"},"observation_digest":"sha256:b36cd03aa284c6cf6437918a2527492618b8361ac65deb7b7251f9f50e1f47ae","observation_id":"2080f1cb-5006-4694-8def-71521f8cad3e","resolution":{"observed_at":"2026-08-05T17:10:50.561165Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:10:50.542306Z","title":"Fg-t2m: Fine-grained text-driven human motion generation via diffusion model","venue":null,"work_id":"daf232e1-5fb1-4762-b9a9-af6fb981e536","year":2023},"citing_paper":{"arxiv_id":"2508.16911","last_updated":"2025-08-23T05:56:37Z","snapshot_observed_at":"2026-08-09T10:20:13.282373Z","submitted_at":"2025-08-23T05:56:37Z","title":"MDD: A Dataset for Text-and-Music Conditioned Duet Dance Generation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T17:10:50.291955Z"},"links":{"citing_paper":"/paper/2508.16911"},"observation_digest":"sha256:413069be62dfd6a3bde60449f4764216366a18b76e922a7922b18436e7589528","observation_id":"ae5e89b5-7470-4715-ae97-e0af3a673eb4","resolution":{"observed_at":"2026-08-05T17:10:50.547207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:10:50.525585Z","title":"Inter-x: Towards versatile human- human interaction analysis","venue":null,"work_id":"735bbc75-5443-4d49-9a29-3608d94ebf90","year":2024},"citing_paper":{"arxiv_id":"2508.16911","last_updated":"2025-08-23T05:56:37Z","snapshot_observed_at":"2026-08-09T10:20:13.282373Z","submitted_at":"2025-08-23T05:56:37Z","title":"MDD: A Dataset for Text-and-Music Conditioned Duet Dance Generation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T17:10:50.295939Z"},"links":{"citing_paper":"/paper/2508.16911"},"observation_digest":"sha256:fa60778049eaa26b689d6234e4b4e2ceaea9aabeebff68857049aaf407c21672","observation_id":"f259372b-f5b7-4e8b-bfa1-8fe737e5027b","resolution":{"observed_at":"2026-08-05T17:10:50.531339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:10:50.510711Z","title":"Regennet: Towards human action-reaction synthesis","venue":null,"work_id":"cc8d55ec-1e9e-4add-ad2a-fdb4519d3fe7","year":2024},"citing_paper":{"arxiv_id":"2508.16911","last_updated":"2025-08-23T05:56:37Z","snapshot_observed_at":"2026-08-09T10:20:13.282373Z","submitted_at":"2025-08-23T05:56:37Z","title":"MDD: A Dataset for Text-and-Music Conditioned Duet Dance Generation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T17:10:50.299980Z"},"links":{"citing_paper":"/paper/2508.16911"},"observation_digest":"sha256:fa70008d74fcdd2891d7706ec0a189d1d831fb87b691dd550222fc22c8dcd7f7","observation_id":"11e0e12c-593a-4812-8fef-d633b312f887","resolution":{"observed_at":"2026-08-05T17:10:50.515447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.11945","last_updated":"2023-08-23T06:37:41Z","snapshot_observed_at":"2026-08-14T11:23:17.386489Z","submitted_at":"2023-08-23T06:37:41Z","title":"LongDanceDiff: Long-term Dance Generation with Conditional Diffusion Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.11945","snapshot_observed_at":"2026-08-05T17:10:50.304473Z","title":"Longdanced- iff: Long-term dance generation with conditional diffusion model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.16911","last_updated":"2025-08-23T05:56:37Z","snapshot_observed_at":"2026-08-09T10:20:13.282373Z","submitted_at":"2025-08-23T05:56:37Z","title":"MDD: A Dataset for Text-and-Music Conditioned Duet Dance Generation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T17:10:50.304473Z"},"links":{"cited_paper":"/paper/2308.11945","citing_paper":"/paper/2508.16911"},"observation_digest":"sha256:922220e1c3bd2d79c80081118f69319628056c4a78e8aab91b3a4310c6b221a3","observation_id":"fe033dc9-be64-4c31-a9a2-1a86afcdb37b","resolution":{"observed_at":"2026-08-05T17:10:50.304473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:10:50.496327Z","title":"Generating human interaction motions in scenes with text control","venue":null,"work_id":"2a26abe5-98f5-4d85-9e59-518660dde935","year":2024},"citing_paper":{"arxiv_id":"2508.16911","last_updated":"2025-08-23T05:56:37Z","snapshot_observed_at":"2026-08-09T10:20:13.282373Z","submitted_at":"2025-08-23T05:56:37Z","title":"MDD: A Dataset for Text-and-Music Conditioned Duet Dance Generation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T17:10:50.308963Z"},"links":{"citing_paper":"/paper/2508.16911"},"observation_digest":"sha256:efca2501ebf150bfb171d6f8659363f0e3fa8f7c0ab17256686320295a0c0ea0","observation_id":"7baf3cac-6159-491f-9d0e-e94dc7482a56","resolution":{"observed_at":"2026-08-05T17:10:50.501292Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:10:50.482044Z","title":"Generating human motion from textual descrip- tions with discrete representations","venue":null,"work_id":"7690ec00-9ed0-446d-8179-bd17ae2df44c","year":2023},"citing_paper":{"arxiv_id":"2508.16911","last_updated":"2025-08-23T05:56:37Z","snapshot_observed_at":"2026-08-09T10:20:13.282373Z","submitted_at":"2025-08-23T05:56:37Z","title":"MDD: A Dataset for Text-and-Music Conditioned Duet Dance Generation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-05T17:10:50.313405Z"},"links":{"citing_paper":"/paper/2508.16911"},"observation_digest":"sha256:ba73a4d0a572105699031e33852883ce16f169be959675021b7d4e8784581a5f","observation_id":"6fdd20af-19a5-4ac1-8296-64f877a0b8b8","resolution":{"observed_at":"2026-08-05T17:10:50.486819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:10:50.467928Z","title":"Motiondif- fuse: Text-driven human motion generation with diffusion model","venue":null,"work_id":"ef3ed29c-f853-4349-96d3-e9ab70889a15","year":2024},"citing_paper":{"arxiv_id":"2508.16911","last_updated":"2025-08-23T05:56:37Z","snapshot_observed_at":"2026-08-09T10:20:13.282373Z","submitted_at":"2025-08-23T05:56:37Z","title":"MDD: A Dataset for Text-and-Music Conditioned Duet Dance Generation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-05T17:10:50.317478Z"},"links":{"citing_paper":"/paper/2508.16911"},"observation_digest":"sha256:7739d35b606f3034b716617f0d20e79df42e34ead97b45999b7efeb502973351","observation_id":"de2f9996-a9ca-4cfc-892d-056dd4b68134","resolution":{"observed_at":"2026-08-05T17:10:50.472573Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:10:50.450484Z","title":"Music2dance: Dancenet for music-driven dance generation","venue":null,"work_id":"5c089eac-daee-4b85-a08e-80e67f3167a7","year":2022},"citing_paper":{"arxiv_id":"2508.16911","last_updated":"2025-08-23T05:56:37Z","snapshot_observed_at":"2026-08-09T10:20:13.282373Z","submitted_at":"2025-08-23T05:56:37Z","title":"MDD: A Dataset for Text-and-Music Conditioned Duet Dance Generation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-05T17:10:50.321622Z"},"links":{"citing_paper":"/paper/2508.16911"},"observation_digest":"sha256:c5626f3ae9613c22d21fbe5110af12ac065fef10832876808b86aaf9be1064e4","observation_id":"ffd71640-8cda-43d9-ad91-31a8f5b0146b","resolution":{"observed_at":"2026-08-05T17:10:50.457487Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:10:50.907864Z","title":null,"venue":null,"work_id":"da146d75-b2c7-4bc8-bed8-2ab0115f2e3b","year":2024},"citing_paper":{"arxiv_id":"2508.16911","last_updated":"2025-08-23T05:56:37Z","snapshot_observed_at":"2026-08-09T10:20:13.282373Z","submitted_at":"2025-08-23T05:56:37Z","title":"MDD: A Dataset for Text-and-Music Conditioned Duet Dance Generation","version":1},"reference_index":437,"source":"pdf_text","source_observed_at":"2026-08-05T17:10:50.155054Z"},"links":{"citing_paper":"/paper/2508.16911"},"observation_digest":"sha256:ffd4766af673c2f4eb07dd46e25758f90bd9cf9a1da04a958b36c7f5bdd91cba","observation_id":"ca1f0a9e-3548-41c3-b8f8-6993239115d4","resolution":{"observed_at":"2026-08-05T17:10:50.912318Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.16911","last_updated":"2025-08-23T05:56:37Z","latest_version":1,"primary_category":"cs.GR","snapshot_observed_at":"2026-08-09T10:20:13.282373Z","submitted_at":"2025-08-23T05:56:37Z","title":"MDD: A Dataset for Text-and-Music Conditioned Duet Dance Generation"},"reference_resolution":{"displayed":45,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":8,"verified_exact":0,"verified_fuzzy":36},"total_outbound_references":45},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 0 inbound Pith citation observations for arXiv:2508.16911."}