{"as_of":"2026-08-18T21:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3aa8e5a3d9663282a0f7d3d293dd5f3a1b1fee6658521388ee9da089d436492c","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T04:30:20.530353Z","state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.08787/citation-record","integrity":"/paper/2608.08787/integrity","json":"/paper/2608.08787/citation-record.json","paper":"/paper/2608.08787"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2301.11325","last_updated":"2023-01-26T18:58:53Z","snapshot_observed_at":"2026-08-17T00:33:41.369960Z","submitted_at":"2023-01-26T18:58:53Z","title":"MusicLM: Generating Music From Text","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.11325","snapshot_observed_at":"2026-08-14T04:30:19.574279Z","title":"I.; Borsos, Z.; Engel, J.; Verzetti, M.; Caillon, A.; Huang, Q.; Jansen, A.; Roberts, A.; Tagliasacchi, M.; Sharifi, M.; Zeghidour, N.; and Frank, C","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-17T17:35:59.025311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:19.574279Z"},"links":{"cited_paper":"/paper/2301.11325","citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:13bebce525098e878d2acb61ca79606cb6d4cce837f35dce54dad54ddce0b86d","observation_id":"72719cb3-7b5a-4d13-9351-f410d30d63c6","resolution":{"observed_at":"2026-08-14T04:30:19.574279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:30:23.202411Z","title":null,"venue":null,"work_id":"b5e31473-ad45-4de2-a00e-3c404ad14b01","year":2026},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-17T17:35:59.025311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:19.614916Z"},"links":{"citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:f0dcc48005068c9bd02ba93df7c4923a3cf5f825e5d9282164ce900dc3ce441b","observation_id":"c29a899b-1f44-4769-b146-06d3cf96d377","resolution":{"observed_at":"2026-08-14T04:30:23.227048Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.09214","last_updated":"2024-09-19T07:14:20Z","snapshot_observed_at":"2026-08-16T13:18:39.913588Z","submitted_at":"2024-09-13T22:06:18Z","title":"Seed-Music: A Unified Framework for High Quality and Controlled Music Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.09214","snapshot_observed_at":"2026-08-14T04:30:19.647087Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-17T17:35:59.025311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:19.647087Z"},"links":{"cited_paper":"/paper/2409.09214","citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:871e5e8e20e2414d24c6b1e23993f1a21200d48fc39854dc9e88823d30c5ce0d","observation_id":"8de7c177-2a75-417a-b45a-35157f4ed05d","resolution":{"observed_at":"2026-08-14T04:30:19.647087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:30:23.135834Z","title":null,"venue":null,"work_id":"2512a243-9212-463f-a55d-bc7c221e24bf","year":2015},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-17T17:35:59.025311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:19.664607Z"},"links":{"citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:5566bbe3c958646440b473940a4952dff0be21c771c6142f6f7beac242f539c8","observation_id":"cada0cb8-dd72-4b3f-85b0-4092a5b7248c","resolution":{"observed_at":"2026-08-14T04:30:23.169336Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:30:23.103910Z","title":null,"venue":null,"work_id":"9f2585fe-9006-4a22-9d78-eb5cb0d90a1e","year":2020},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-17T17:35:59.025311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:19.694755Z"},"links":{"citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:64a84d8a7bcce9bcb3bb725bfe2040df30415d4c775fd4453d297ccf0a7a8d1d","observation_id":"40246809-0d54-443a-bcfd-105f8871948d","resolution":{"observed_at":"2026-08-14T04:30:23.109199Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:30:23.072646Z","title":null,"venue":null,"work_id":"da1fb2e7-f053-4217-80e5-d291da619ff1","year":2022},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-17T17:35:59.025311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:19.715659Z"},"links":{"citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:6e9426db5304aabd2317c579df31edaa3347d40f665d52b806bb9cfdeccf18db","observation_id":"c22d8264-2ab2-4170-af6a-160ed19aaee6","resolution":{"observed_at":"2026-08-14T04:30:23.077482Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:30:23.036514Z","title":null,"venue":null,"work_id":"b1ccd002-0bcc-40a3-9154-9f56a0a959bf","year":2023},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-17T17:35:59.025311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:19.750361Z"},"links":{"citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:5476afe280d2c552d49ce9ade6d102061412b1000052886c474870102fb23679","observation_id":"b7bc3579-5362-47b1-80dc-55561a18db19","resolution":{"observed_at":"2026-08-14T04:30:23.041184Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:30:23.007656Z","title":null,"venue":null,"work_id":"25bd5c09-43dc-43a8-8267-3e532611547d","year":2023},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-17T17:35:59.025311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:19.785667Z"},"links":{"citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:c41aa322464bebfcc61e22908b4640102f6091e672f5b408d612e7f67a1c75df","observation_id":"953a4758-771f-44e8-b5b7-e07533ebf2f3","resolution":{"observed_at":"2026-08-14T04:30:23.018554Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.00341","last_updated":"2020-04-30T09:02:45Z","snapshot_observed_at":"2026-08-16T07:26:47.621702Z","submitted_at":"2020-04-30T09:02:45Z","title":"Jukebox: A Generative Model for Music","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.00341","snapshot_observed_at":"2026-08-14T04:30:19.820828Z","title":"W.; Radford, A.; and Sutskever, I","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-17T17:35:59.025311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:19.820828Z"},"links":{"cited_paper":"/paper/2005.00341","citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:6eb1495c5b17c1a64a4f613b13e6f542ccddef9912c00e4fb9e51686e214afa4","observation_id":"8315f494-2c20-4e66-a443-ed0708557bab","resolution":{"observed_at":"2026-08-14T04:30:19.820828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:30:22.944751Z","title":"H.; and Pons, J","venue":null,"work_id":"809403fc-b3f1-42f0-8668-851cc21b96ac","year":2024},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-17T17:35:59.025311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:19.861524Z"},"links":{"citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:bc0f5e7eeaad6a4615da92fb7e8f429fcba1006987efe43d3c3856ec5ad35d55","observation_id":"dcd38033-b11a-473f-b10d-8f1207faaf74","resolution":{"observed_at":"2026-08-14T04:30:22.974935Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00045","last_updated":"2025-05-28T12:23:09Z","snapshot_observed_at":"2026-08-09T08:18:10.025134Z","submitted_at":"2025-05-28T12:23:09Z","title":"ACE-Step: A Step Towards Music Generation Foundation Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.00045","snapshot_observed_at":"2026-08-14T04:30:19.892233Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-17T17:35:59.025311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:19.892233Z"},"links":{"cited_paper":"/paper/2506.00045","citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:5aad81a95dd2b7b8b4c05ea47c6e7553f4bf2b816723f2f9a5896587d14e87f0","observation_id":"49941bad-a2f8-4920-83bd-d304cf9244a5","resolution":{"observed_at":"2026-08-14T04:30:19.892233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:30:22.861110Z","title":null,"venue":null,"work_id":"41a7c99c-4803-47b3-880f-f3b38e4ea19a","year":2026},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-17T17:35:59.025311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:19.925819Z"},"links":{"citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:1f7db72cbdac1590a46f853bda079cf5ae09663c8b5c8a76ddb25004a19fa5b7","observation_id":"7f9b17d6-7afc-462e-92fc-6a023e9872f0","resolution":{"observed_at":"2026-08-14T04:30:22.873686Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:30:22.830508Z","title":null,"venue":null,"work_id":"14c7fdff-43b8-4c87-8e91-d3a6115d3d41","year":2020},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-17T17:35:59.025311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:19.968777Z"},"links":{"citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:f08ba1bb79473ea50b555e9c25d2b430fbddb1922b430eb4541026d2266a6d1c","observation_id":"3f047a69-8add-4f93-9bc6-6c09c1e3495d","resolution":{"observed_at":"2026-08-14T04:30:22.838855Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:30:22.745084Z","title":"J.; Norouzi, M.; and Salimans, T","venue":null,"work_id":"7708dd49-ab25-4df3-b9bf-f618f42f69e2","year":2022},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-17T17:35:59.025311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:19.994743Z"},"links":{"citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:daaa95cbba1994cbf09e720e10e657c6a337d405dee7c08bff997f381bd37e47","observation_id":"420085f2-8d0a-47dc-b6cd-5c77640ce5e7","resolution":{"observed_at":"2026-08-14T04:30:22.751865Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-08-14T06:37:15.299690Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-14T04:30:20.025788Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-17T17:35:59.025311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:20.025788Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:55f91a60efb6151d9a92a2840d3f14268aa3a4684b29ce131c983e88a66fa71d","observation_id":"83e867c4-411c-4a7c-a7c8-935f6e8facda","resolution":{"observed_at":"2026-08-14T04:30:20.025788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.03917","last_updated":"2023-03-06T18:09:56Z","snapshot_observed_at":"2026-08-17T19:40:07.322177Z","submitted_at":"2023-02-08T07:27:27Z","title":"Noise2Music: Text-conditioned Music Generation with Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.03917","snapshot_observed_at":"2026-08-14T04:30:20.070783Z","title":"S.; Wang, T.; Denk, T","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-17T17:35:59.025311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:20.070783Z"},"links":{"cited_paper":"/paper/2302.03917","citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:74cab5016554d02cff18018dc829b4fd55e9d1ded2515c3bab5974ba75301d9a","observation_id":"628d96e7-bdf5-45d1-89ed-20a6d4887ea2","resolution":{"observed_at":"2026-08-14T04:30:20.070783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:30:22.641174Z","title":null,"venue":null,"work_id":"d7f881fa-20be-447d-b14f-1b17226c5d59","year":2023},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-17T17:35:59.025311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:20.092328Z"},"links":{"citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:dc361deac5726a651c426ce318f61a0c20edfc01a03475fba81b880ecac278d1","observation_id":"a3c2249f-d2db-4ec1-ae06-4120e7259a53","resolution":{"observed_at":"2026-08-14T04:30:22.685338Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:30:22.593641Z","title":null,"venue":null,"work_id":"72314dc6-05c2-4e7c-b3d3-1d9c4b0eb9d0","year":2025},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-17T17:35:59.025311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:20.128784Z"},"links":{"citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:c0607bce72c2c5a6eed791d590fec1f98f7e27fbac326552d20cd1b63ad37cc6","observation_id":"4b4ba669-6872-4d0f-83fa-6fc496d15ab0","resolution":{"observed_at":"2026-08-14T04:30:22.616816Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:30:20.147363Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-17T17:35:59.025311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:20.147363Z"},"links":{"citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:0e346d9f7ebe852c74d507279b3fc759208749ed73fc30e5434a47a55a9309ec","observation_id":"b2060076-179a-4426-8a8f-162ccdf8fe8e","resolution":{"observed_at":"2026-08-14T04:30:20.147363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.22448","last_updated":"2024-10-29T18:29:39Z","snapshot_observed_at":"2026-08-18T02:08:20.358722Z","submitted_at":"2024-10-29T18:29:39Z","title":"A Closer Look at Neural Codec Resynthesis: Bridging the Gap between Codec and Waveform Generation","version":1},"cited_work":{"arxiv_id":"2410.22448","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.22448","snapshot_observed_at":"2026-08-14T04:30:21.255719Z","title":"A Closer Look at Neural Codec Resynthesis: Bridging the Gap between Codec and Waveform Generation","venue":"eess.AS","work_id":"7214d7ff-72cf-437f-abdd-bb02dbaae3e9","year":2024},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-17T17:35:59.025311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:20.164759Z"},"links":{"cited_paper":"/paper/2410.22448","citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:27a7471e7d4eaf48447076bc5b3e02a50320b803e8228a187d4974a1db519fbf","observation_id":"cf73f3da-fb5d-484e-ac10-321e132ce791","resolution":{"observed_at":"2026-08-14T04:30:21.274751Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.00610","last_updated":"2026-06-11T15:20:43Z","snapshot_observed_at":"2026-08-14T18:43:03.691653Z","submitted_at":"2026-02-28T12:10:58Z","title":"CMI-RewardBench: Evaluating Music Reward Models with Compositional Multimodal Instruction","version":3},"cited_work":{"arxiv_id":"2603.00610","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.00610","snapshot_observed_at":"2026-08-14T04:30:21.141097Z","title":"CMI-RewardBench: Evaluating Music Reward Models with Compositional Multimodal Instruction","venue":"cs.SD","work_id":"02d78ad7-a169-4732-a35e-ec2a7c35664e","year":2026},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-17T17:35:59.025311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:20.194580Z"},"links":{"cited_paper":"/paper/2603.00610","citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:69909f1e1576b1f8765dbca1a31a0c8a539b03832e21a0f718b9da1480218d05","observation_id":"ea9c4619-b3ce-401c-ae47-6bcd1ef0fcf3","resolution":{"observed_at":"2026-08-14T04:30:21.180589Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:30:22.364283Z","title":null,"venue":null,"work_id":"1a3abb2b-27b0-4145-85e6-e6cd59e4a8ea","year":2026},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-17T17:35:59.025311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:20.215754Z"},"links":{"citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:9ca88acd388dcfc82104eb8c08717ac086d8737e6e75df58abc84ec0e415d54b","observation_id":"cb016b8b-3c4e-4764-9d56-c93ed6a7364b","resolution":{"observed_at":"2026-08-14T04:30:22.402089Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:30:22.309630Z","title":null,"venue":null,"work_id":"bcc183e2-c4ca-47c1-b0f1-5e4e89935adc","year":2026},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-17T17:35:59.025311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:20.232248Z"},"links":{"citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:842d329adc0b9cb0e7752c41c907f94f84ac2f3e7c3de9ed0667ec78814a8b86","observation_id":"d382922d-0eeb-4a17-b2fd-344a5059d905","resolution":{"observed_at":"2026-08-14T04:30:22.327185Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01183","last_updated":"2025-03-03T05:15:34Z","snapshot_observed_at":"2026-08-18T09:40:58.694553Z","submitted_at":"2025-03-03T05:15:34Z","title":"DiffRhythm: Blazingly Fast and Embarrassingly Simple End-to-End Full-Length Song Generation with Latent Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01183","snapshot_observed_at":"2026-08-14T04:30:20.247000Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-17T17:35:59.025311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:20.247000Z"},"links":{"cited_paper":"/paper/2503.01183","citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:e0146ffa5682f1b67422df05b9df5cb665f117de172954aec93731dbeff9c271","observation_id":"7a7d59d8-5d22-4d67-8047-e0b16b9f36a6","resolution":{"observed_at":"2026-08-14T04:30:20.247000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:30:20.255853Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-17T17:35:59.025311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:20.255853Z"},"links":{"citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:ce3bbf28de25e6544dc32cb017f3a44fbf15c87a81168e1ec818e6a9a32d52cf","observation_id":"d6cb61c1-d4b5-48da-8c72-3891522b6c8b","resolution":{"observed_at":"2026-08-14T04:30:20.255853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:30:22.186558Z","title":null,"venue":null,"work_id":"2a4a38f2-e1a0-473e-b3f8-71a40b1c3ed0","year":2023},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-17T17:35:59.025311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:20.275969Z"},"links":{"citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:645a72d53e2fe24d14b3cdc37ed4f59e5309e769b8faccba7793a4421ec34f7c","observation_id":"ebf03714-2758-4f93-9943-934d9fc11474","resolution":{"observed_at":"2026-08-14T04:30:22.207977Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:30:22.104791Z","title":null,"venue":null,"work_id":"d5abf1d9-759f-4f2d-905a-88b0c2ec5ce5","year":2026},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-17T17:35:59.025311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:20.291854Z"},"links":{"citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:09b0c5f9348c68e5b712291e1ac0b850311565663236b13ef3c6146167c1f9b4","observation_id":"8fadadd1-d0b2-426e-80bc-a711b5911273","resolution":{"observed_at":"2026-08-14T04:30:22.119689Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:30:22.014822Z","title":null,"venue":null,"work_id":"31e86750-210c-4065-91b3-b6c5e864e8c3","year":2025},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-17T17:35:59.025311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:20.315645Z"},"links":{"citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:4cb3a09850ca0a1e736142a99335ebfec044493dc81abe5e413c3d39eabb4362","observation_id":"e08b0d14-0f6a-44dd-8a45-1983634ecad9","resolution":{"observed_at":"2026-08-14T04:30:22.036879Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05139","last_updated":"2025-02-07T18:15:57Z","snapshot_observed_at":"2026-08-17T16:15:29.907985Z","submitted_at":"2025-02-07T18:15:57Z","title":"Meta Audiobox Aesthetics: Unified Automatic Quality Assessment for Speech, Music, and Sound","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05139","snapshot_observed_at":"2026-08-14T04:30:20.333011Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-17T17:35:59.025311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:20.333011Z"},"links":{"cited_paper":"/paper/2502.05139","citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:f5ec69c5c4f8448a6572205ecf8a11e84a5174e3ed9827355362b237e19a3fb6","observation_id":"8290644d-78b3-4f87-a3c3-1885da5d5707","resolution":{"observed_at":"2026-08-14T04:30:20.333011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.25937","last_updated":"2026-04-16T04:26:34Z","snapshot_observed_at":"2026-08-15T16:06:56.859743Z","submitted_at":"2026-04-16T04:26:34Z","title":"SongBench: A Fine-Grained Multi-Aspect Benchmark for Song Quality Assessment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.25937","snapshot_observed_at":"2026-08-14T04:30:20.382198Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-17T17:35:59.025311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:20.382198Z"},"links":{"cited_paper":"/paper/2604.25937","citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:0f5cecbcfe326f7b12bfbe55e6c4d0e60cfc137df035c3edeeb22b7091467c51","observation_id":"cf0fc6c8-6e24-400d-9380-4d4bec1a61cf","resolution":{"observed_at":"2026-08-14T04:30:20.382198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:30:21.884747Z","title":null,"venue":null,"work_id":"a45857a0-f82b-4c33-b853-a56deb0d76f3","year":2020},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-17T17:35:59.025311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:20.424753Z"},"links":{"citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:62d93f653cca306820f956a4b9b804334d95cbf2a152e79a98d4796542e80b92","observation_id":"a7a8779a-e40a-44f7-b3ff-d1019fc4bf0f","resolution":{"observed_at":"2026-08-14T04:30:21.935045Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:30:21.842867Z","title":null,"venue":null,"work_id":"35562ebe-6f55-4702-9b53-aaaaaabb4396","year":2025},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-17T17:35:59.025311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:20.444838Z"},"links":{"citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:5c9a2a13f9a9cdfe644906e57df880669f97d00f6c107961d388b652b311b4fc","observation_id":"96621dcc-2431-4e72-b876-9eb966a3e176","resolution":{"observed_at":"2026-08-14T04:30:21.857847Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.10547","last_updated":"2026-07-07T07:53:42Z","snapshot_observed_at":"2026-08-13T18:10:53.815074Z","submitted_at":"2026-01-15T16:14:25Z","title":"HeartMuLa: A Family of Open Sourced Music Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.10547","snapshot_observed_at":"2026-08-14T04:30:20.450381Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-17T17:35:59.025311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:20.450381Z"},"links":{"cited_paper":"/paper/2601.10547","citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:cc7fc263fa8eb0e7bacb2112b5ac27b7eac7fb544bdb579c56c2435e7f2d23ed","observation_id":"dcecba95-cb9b-4b0e-8eeb-e79d4d940b12","resolution":{"observed_at":"2026-08-14T04:30:20.450381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.10793","last_updated":"2025-05-16T02:06:25Z","snapshot_observed_at":"2026-08-15T21:01:03.472765Z","submitted_at":"2025-05-16T02:06:25Z","title":"SongEval: A Benchmark Dataset for Song Aesthetics Evaluation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.10793","snapshot_observed_at":"2026-08-14T04:30:20.456408Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-17T17:35:59.025311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:20.456408Z"},"links":{"cited_paper":"/paper/2505.10793","citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:6b59fa7eeb1d172d89a2596690d8e993f4556e1921ccfb97db519a82679c5167","observation_id":"947395af-8dc5-467c-a540-516ec7b95e7e","resolution":{"observed_at":"2026-08-14T04:30:20.456408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:30:21.814171Z","title":null,"venue":null,"work_id":"bb9da171-8dda-4eb6-8c77-15855a5aee15","year":2022},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-17T17:35:59.025311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:20.474868Z"},"links":{"citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:92ccdced7df612e35bdd9d47c0ecbfc398cc755183330d76b99630c0fe00f8a7","observation_id":"ec6f4166-ad33-41f6-9fc3-87593b41d02e","resolution":{"observed_at":"2026-08-14T04:30:21.831412Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00084","last_updated":"2025-02-28T09:58:25Z","snapshot_observed_at":"2026-08-16T12:54:20.238906Z","submitted_at":"2025-02-28T09:58:25Z","title":"InspireMusic: Integrating Super Resolution and Large Language Model for High-Fidelity Long-Form Music Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.00084","snapshot_observed_at":"2026-08-14T04:30:20.485065Z","title":"H.; Zhou, K.; Jiang, Y.; Tan, C.; Gao, Z.; Du, Z.; and Ma, B","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-17T17:35:59.025311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:20.485065Z"},"links":{"cited_paper":"/paper/2503.00084","citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:18fe91078e04bf55ed3ef4cd8a84bbbe3859d68946b0838b8d62256edc58414b","observation_id":"815d38a5-6e64-4cdd-acad-c99c8e7a4336","resolution":{"observed_at":"2026-08-14T04:30:20.485065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05176","last_updated":"2025-06-11T02:54:49Z","snapshot_observed_at":"2026-08-17T07:57:12.232097Z","submitted_at":"2025-06-05T15:49:48Z","title":"Qwen3 Embedding: Advancing Text Embedding and Reranking Through Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.05176","snapshot_observed_at":"2026-08-14T04:30:20.504750Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-17T17:35:59.025311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:20.504750Z"},"links":{"cited_paper":"/paper/2506.05176","citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:b6037c8dc8a5fd77baf57f1063ba191353d7d68cfe4b9f41dd34c3ba57be0a10","observation_id":"9b58c395-97f9-4887-b433-a49ed89094c6","resolution":{"observed_at":"2026-08-14T04:30:20.504750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:30:21.785272Z","title":null,"venue":null,"work_id":"84e790de-d657-4680-b0d7-9c1e89c7c345","year":2023},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-17T17:35:59.025311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:20.530353Z"},"links":{"citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:e7f6923c2067e20710e5167fb35821ecf9d671b5a1f639b719df2d113ba1c20d","observation_id":"a34fab11-d270-4ab1-ba48-8feee7ac38bf","resolution":{"observed_at":"2026-08-14T04:30:21.796452Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","latest_version":2,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-17T17:35:59.025311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":34,"verified_exact":1,"verified_fuzzy":2},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 0 inbound Pith citation observations for arXiv:2608.08787."}