{"as_of":"2026-08-16T02:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:692c670d26eef001810e385e3389660553d818a2e6ae558521708d221e1e5493","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":17,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":17,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":17,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":17,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T18:16:26.951656Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":5,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2111.05011","last_updated":"2021-12-15T16:42:14Z","snapshot_observed_at":"2026-08-15T06:00:56.018391Z","submitted_at":"2021-11-09T09:07:30Z","title":"RAVE: A variational autoencoder for fast and high-quality neural audio synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.05011","snapshot_observed_at":"2026-08-11T18:16:26.951656Z","title":"Rave: A variational autoencoder for fast and high-quality neural audio synthesis,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.08112","last_updated":"2024-12-11T05:39:12Z","snapshot_observed_at":"2026-08-11T18:10:10.220834Z","submitted_at":"2024-12-11T05:39:12Z","title":"Aligner-Guided Training Paradigm: Advancing Text-to-Speech Models with Aligner Guided Duration","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T18:16:26.951656Z"},"links":{"cited_paper":"/paper/2111.05011","citing_paper":"/paper/2412.08112"},"observation_digest":"sha256:feab9aadb2db05e73f4fd402666c00f0d57f6ba2320c87c05394c47eea9b62cf","observation_id":"b0d1201b-80cf-4fc9-8afc-5498299bf0bb","resolution":{"observed_at":"2026-08-11T18:16:26.951656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.05011","last_updated":"2021-12-15T16:42:14Z","snapshot_observed_at":"2026-08-15T06:00:56.018391Z","submitted_at":"2021-11-09T09:07:30Z","title":"RAVE: A variational autoencoder for fast and high-quality neural audio synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.05011","snapshot_observed_at":"2026-08-11T18:16:12.925172Z","title":"Rave: A variational autoencoder for fast and high-quality neural audio synthesis,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.08117","last_updated":"2024-12-11T05:55:06Z","snapshot_observed_at":"2026-08-12T04:41:01.550373Z","submitted_at":"2024-12-11T05:55:06Z","title":"LatentSpeech: Latent Diffusion for Text-To-Speech Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T18:16:12.925172Z"},"links":{"cited_paper":"/paper/2111.05011","citing_paper":"/paper/2412.08117"},"observation_digest":"sha256:77ce72b4e39a82d665aa291218460678f54606e35c90fe373d726e1c98cbb7a4","observation_id":"a5167604-be12-4ec3-8600-53b7c9ad8409","resolution":{"observed_at":"2026-08-11T18:16:12.925172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.05011","last_updated":"2021-12-15T16:42:14Z","snapshot_observed_at":"2026-08-15T06:00:56.018391Z","submitted_at":"2021-11-09T09:07:30Z","title":"RAVE: A variational autoencoder for fast and high-quality neural audio synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.05011","snapshot_observed_at":"2026-08-11T15:50:02.164251Z","title":"Rave: A vari- ational autoencoder for fast and high-quality neural audio synthesis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.10649","last_updated":"2024-12-14T02:36:45Z","snapshot_observed_at":"2026-08-15T10:01:22.801662Z","submitted_at":"2024-12-14T02:36:45Z","title":"Hidden Echoes Survive Training in Audio To Audio Generative Instrument Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T15:50:02.164251Z"},"links":{"cited_paper":"/paper/2111.05011","citing_paper":"/paper/2412.10649"},"observation_digest":"sha256:54689331fc043f73add41a2e0a72bb8ee5c7bc26fdbd70a32e03f7b9d92cbf14","observation_id":"0f5387d0-b9ca-4fc2-95b3-38875f900125","resolution":{"observed_at":"2026-08-11T15:50:02.164251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.05011","last_updated":"2021-12-15T16:42:14Z","snapshot_observed_at":"2026-08-15T06:00:56.018391Z","submitted_at":"2021-11-09T09:07:30Z","title":"RAVE: A variational autoencoder for fast and high-quality neural audio synthesis","version":2},"cited_work":{"arxiv_id":"2111.05011","doi":"10.48550/arxiv.2111.05011","metadata_source":"pith","pith_arxiv_id":"2111.05011","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Rave:Avariationalautoencoderforfastandhigh-qualityneuralaudiosynthesis","venue":"cs.LG","work_id":"2d804fa4-dd5d-4461-9fc3-71a5243d0d44","year":2021},"citing_paper":{"arxiv_id":"2501.17653","last_updated":"2026-04-28T17:21:12Z","snapshot_observed_at":"2026-07-06T20:27:55.860626Z","submitted_at":"2025-01-29T13:37:32Z","title":"Drivetrain simulation using variational autoencoders","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-23T04:29:41.412588Z"},"links":{"cited_paper":"/paper/2111.05011","citing_paper":"/paper/2501.17653"},"observation_digest":"sha256:6d15ff8c2a28b101d1f59f7ff3cd5e019ba6c680b121e5da55a75a26250def21","observation_id":"811671bf-a42e-4885-8822-c494bf1a4661","resolution":{"observed_at":"2026-05-23T04:32:33.398716Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.05011","last_updated":"2021-12-15T16:42:14Z","snapshot_observed_at":"2026-08-15T06:00:56.018391Z","submitted_at":"2021-11-09T09:07:30Z","title":"RAVE: A variational autoencoder for fast and high-quality neural audio synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.05011","snapshot_observed_at":"2026-08-07T12:05:44.883723Z","title":"Rave: A variational autoencoder for fast and high-quality neural audio synthesis,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.00681","last_updated":"2025-09-08T18:54:42Z","snapshot_observed_at":"2026-08-14T11:57:39.468585Z","submitted_at":"2025-05-31T19:27:22Z","title":"Learning to Upsample and Upmix Audio in the Latent Domain","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:44.883723Z"},"links":{"cited_paper":"/paper/2111.05011","citing_paper":"/paper/2506.00681"},"observation_digest":"sha256:b62b18ed753b4b65fa1fc7ee53a15c2cc034df77ab603264dd0d1f153db00029","observation_id":"9a4e02bf-85c5-4298-8f6f-84f6c2163f61","resolution":{"observed_at":"2026-08-07T12:05:44.883723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.05011","last_updated":"2021-12-15T16:42:14Z","snapshot_observed_at":"2026-08-15T06:00:56.018391Z","submitted_at":"2021-11-09T09:07:30Z","title":"RAVE: A variational autoencoder for fast and high-quality neural audio synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.05011","snapshot_observed_at":"2026-08-07T00:48:30.536237Z","title":"RA VE: A variational autoencoder for fast and high-quality neural audio synthesis,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.12665","last_updated":"2025-06-14T23:55:58Z","snapshot_observed_at":"2026-08-12T05:37:05.244814Z","submitted_at":"2025-06-14T23:55:58Z","title":"ANIRA: An Architecture for Neural Network Inference in Real-Time Audio Applications","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T00:48:30.536237Z"},"links":{"cited_paper":"/paper/2111.05011","citing_paper":"/paper/2506.12665"},"observation_digest":"sha256:fd7f01907c00140de83696ef7de7a883ccb6286f064f9348a7f30777e86c2216","observation_id":"034f9c55-3ae4-489c-bcdc-664b54371171","resolution":{"observed_at":"2026-08-07T00:48:30.536237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.05011","last_updated":"2021-12-15T16:42:14Z","snapshot_observed_at":"2026-08-15T06:00:56.018391Z","submitted_at":"2021-11-09T09:07:30Z","title":"RAVE: A variational autoencoder for fast and high-quality neural audio synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.05011","snapshot_observed_at":"2026-08-06T23:26:43.953857Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.18196","last_updated":"2025-06-22T23:09:37Z","snapshot_observed_at":"2026-08-12T12:02:04.997399Z","submitted_at":"2025-06-22T23:09:37Z","title":"Two Sonification Methods for the MindCube","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:43.953857Z"},"links":{"cited_paper":"/paper/2111.05011","citing_paper":"/paper/2506.18196"},"observation_digest":"sha256:ff35aa97dddf9e63c786266d5240b17c531c66fbd4c56a8a81edf774f6456803","observation_id":"c3317019-c7e1-4ca6-9705-d7e113591a1d","resolution":{"observed_at":"2026-08-06T23:26:43.953857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.05011","last_updated":"2021-12-15T16:42:14Z","snapshot_observed_at":"2026-08-15T06:00:56.018391Z","submitted_at":"2021-11-09T09:07:30Z","title":"RAVE: A variational autoencoder for fast and high-quality neural audio synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.05011","snapshot_observed_at":"2026-08-07T04:46:03.295053Z","title":"RAVE : A variational autoencoder for fast and high-quality neural audio synthesis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.01022","last_updated":"2025-06-11T13:07:47Z","snapshot_observed_at":"2026-08-15T02:53:15.508681Z","submitted_at":"2025-06-11T13:07:47Z","title":"Workflow-Based Evaluation of Music Generation Systems","version":1},"reference_index":112,"source":"arxiv_source","source_observed_at":"2026-08-07T04:46:03.295053Z"},"links":{"cited_paper":"/paper/2111.05011","citing_paper":"/paper/2507.01022"},"observation_digest":"sha256:8fa1f9826bc708889da565c3af10deca9f35268d4ddedcf89012cb5b84df12a8","observation_id":"0a9287ce-e4a3-47d7-a1ea-b9f7b7db5fe8","resolution":{"observed_at":"2026-08-07T04:46:03.295053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.05011","last_updated":"2021-12-15T16:42:14Z","snapshot_observed_at":"2026-08-15T06:00:56.018391Z","submitted_at":"2021-11-09T09:07:30Z","title":"RAVE: A variational autoencoder for fast and high-quality neural audio synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.05011","snapshot_observed_at":"2026-08-06T20:09:33.775638Z","title":"Rave: A variational autoencoder for fast and high-quality neural audio synthesis,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.03599","last_updated":"2025-07-04T14:12:19Z","snapshot_observed_at":"2026-08-13T09:10:44.102820Z","submitted_at":"2025-07-04T14:12:19Z","title":"MusGO: A Community-Driven Framework For Assessing Openness in Music-Generative AI","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T20:09:33.775638Z"},"links":{"cited_paper":"/paper/2111.05011","citing_paper":"/paper/2507.03599"},"observation_digest":"sha256:d9bfeb61fbb06a8c51392cc153b8d0c8f162e33c82d50b33936aa65a00d47680","observation_id":"82963036-d74f-47ff-818e-47f5f3538017","resolution":{"observed_at":"2026-08-06T20:09:33.775638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.05011","last_updated":"2021-12-15T16:42:14Z","snapshot_observed_at":"2026-08-15T06:00:56.018391Z","submitted_at":"2021-11-09T09:07:30Z","title":"RAVE: A variational autoencoder for fast and high-quality neural audio synthesis","version":2},"cited_work":{"arxiv_id":"2111.05011","doi":"10.48550/arxiv.2111.05011","metadata_source":"pith","pith_arxiv_id":"2111.05011","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Rave:Avariationalautoencoderforfastandhigh-qualityneuralaudiosynthesis","venue":"cs.LG","work_id":"2d804fa4-dd5d-4461-9fc3-71a5243d0d44","year":2021},"citing_paper":{"arxiv_id":"2604.17986","last_updated":"2026-04-20T09:08:13Z","snapshot_observed_at":"2026-08-15T09:33:30.226949Z","submitted_at":"2026-04-20T09:08:13Z","title":"Latent Fourier Transform","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T03:45:07.892234Z"},"links":{"cited_paper":"/paper/2111.05011","citing_paper":"/paper/2604.17986"},"observation_digest":"sha256:ddf8cedb01595ec6f2eef41d7f759ba7caee81dc1be0c41368b925b53acefa33","observation_id":"e2c2c975-d8df-4d5b-a744-a931dad21161","resolution":{"observed_at":"2026-05-11T12:21:07.037225Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.05011","last_updated":"2021-12-15T16:42:14Z","snapshot_observed_at":"2026-08-15T06:00:56.018391Z","submitted_at":"2021-11-09T09:07:30Z","title":"RAVE: A variational autoencoder for fast and high-quality neural audio synthesis","version":2},"cited_work":{"arxiv_id":"2111.05011","doi":"10.48550/arxiv.2111.05011","metadata_source":"pith","pith_arxiv_id":"2111.05011","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Rave:Avariationalautoencoderforfastandhigh-qualityneuralaudiosynthesis","venue":"cs.LG","work_id":"2d804fa4-dd5d-4461-9fc3-71a5243d0d44","year":2021},"citing_paper":{"arxiv_id":"2604.23583","last_updated":"2026-04-26T07:41:38Z","snapshot_observed_at":"2026-08-15T23:31:08.199490Z","submitted_at":"2026-04-26T07:41:38Z","title":"Opening the Design Space: Two Years of Performance with Intelligent Musical Instruments","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-08T05:24:28.773536Z"},"links":{"cited_paper":"/paper/2111.05011","citing_paper":"/paper/2604.23583"},"observation_digest":"sha256:43142dbb42c31aea0300c9cd13786bbb082e287fbed0f37803e2baf80652e245","observation_id":"103196e1-b5ee-4830-8e46-3370a3f0ce64","resolution":{"observed_at":"2026-05-11T21:31:13.486349Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.05011","last_updated":"2021-12-15T16:42:14Z","snapshot_observed_at":"2026-08-15T06:00:56.018391Z","submitted_at":"2021-11-09T09:07:30Z","title":"RAVE: A variational autoencoder for fast and high-quality neural audio synthesis","version":2},"cited_work":{"arxiv_id":"2111.05011","doi":"10.48550/arxiv.2111.05011","metadata_source":"pith","pith_arxiv_id":"2111.05011","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Rave:Avariationalautoencoderforfastandhigh-qualityneuralaudiosynthesis","venue":"cs.LG","work_id":"2d804fa4-dd5d-4461-9fc3-71a5243d0d44","year":2021},"citing_paper":{"arxiv_id":"2604.25207","last_updated":"2026-04-28T04:24:29Z","snapshot_observed_at":"2026-08-02T09:51:08.387493Z","submitted_at":"2026-04-28T04:24:29Z","title":"Hu\\'i S\\`u: Co-constructing a Dual Feedback Apparatus","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-07T14:37:42.783784Z"},"links":{"cited_paper":"/paper/2111.05011","citing_paper":"/paper/2604.25207"},"observation_digest":"sha256:a09c28cf07884279d90d4839d091278aedac15c8e0424ac41c57487b36ead966","observation_id":"7fb4adcd-3a3c-4563-89c8-7ad2ec66b7e3","resolution":{"observed_at":"2026-05-09T02:49:42.758802Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.05011","last_updated":"2021-12-15T16:42:14Z","snapshot_observed_at":"2026-08-15T06:00:56.018391Z","submitted_at":"2021-11-09T09:07:30Z","title":"RAVE: A variational autoencoder for fast and high-quality neural audio synthesis","version":2},"cited_work":{"arxiv_id":"2111.05011","doi":"10.48550/arxiv.2111.05011","metadata_source":"pith","pith_arxiv_id":"2111.05011","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Rave:Avariationalautoencoderforfastandhigh-qualityneuralaudiosynthesis","venue":"cs.LG","work_id":"2d804fa4-dd5d-4461-9fc3-71a5243d0d44","year":2021},"citing_paper":{"arxiv_id":"2605.09259","last_updated":"2026-05-10T02:08:07Z","snapshot_observed_at":"2026-08-15T02:25:57.471127Z","submitted_at":"2026-05-10T02:08:07Z","title":"Remix the Timbre: Diffusion-Based Style Transfer Across Polyphonic Stems","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-12T04:58:26.634355Z"},"links":{"cited_paper":"/paper/2111.05011","citing_paper":"/paper/2605.09259"},"observation_digest":"sha256:f71d1a7efa2f19554a82c5eca9d5d6d29a1ab5f794123bdcd35148e7ed4eae20","observation_id":"b133ed4d-858f-4fb6-b20c-43fbca023065","resolution":{"observed_at":"2026-05-12T05:46:27.992987Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.05011","last_updated":"2021-12-15T16:42:14Z","snapshot_observed_at":"2026-08-15T06:00:56.018391Z","submitted_at":"2021-11-09T09:07:30Z","title":"RAVE: A variational autoencoder for fast and high-quality neural audio synthesis","version":2},"cited_work":{"arxiv_id":"2111.05011","doi":"10.48550/arxiv.2111.05011","metadata_source":"pith","pith_arxiv_id":"2111.05011","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Rave:Avariationalautoencoderforfastandhigh-qualityneuralaudiosynthesis","venue":"cs.LG","work_id":"2d804fa4-dd5d-4461-9fc3-71a5243d0d44","year":2021},"citing_paper":{"arxiv_id":"2605.22717","last_updated":"2026-05-21T16:54:07Z","snapshot_observed_at":"2026-08-15T03:14:21.896876Z","submitted_at":"2026-05-21T16:54:07Z","title":"Live Music Diffusion Models: Efficient Fine-Tuning and Post-Training of Interactive Diffusion Music Generators","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-22T03:24:50.604019Z"},"links":{"cited_paper":"/paper/2111.05011","citing_paper":"/paper/2605.22717"},"observation_digest":"sha256:d91dc78066a396bdb2d01f645613b2af97092634f65d3dfccc5b7aea9d8e15c1","observation_id":"ec707f93-ec5c-4e6d-a098-720c679b1ebc","resolution":{"observed_at":"2026-05-22T03:25:58.969324Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.05011","last_updated":"2021-12-15T16:42:14Z","snapshot_observed_at":"2026-08-15T06:00:56.018391Z","submitted_at":"2021-11-09T09:07:30Z","title":"RAVE: A variational autoencoder for fast and high-quality neural audio synthesis","version":2},"cited_work":{"arxiv_id":"2111.05011","doi":"10.48550/arxiv.2111.05011","metadata_source":"pith","pith_arxiv_id":"2111.05011","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Rave:Avariationalautoencoderforfastandhigh-qualityneuralaudiosynthesis","venue":"cs.LG","work_id":"2d804fa4-dd5d-4461-9fc3-71a5243d0d44","year":2021},"citing_paper":{"arxiv_id":"2605.28657","last_updated":"2026-05-27T15:57:20Z","snapshot_observed_at":"2026-08-15T21:39:02.520966Z","submitted_at":"2026-05-27T15:57:20Z","title":"DEMON: Diffusion Engine for Musical Orchestrated Noise","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-29T09:54:30.079404Z"},"links":{"cited_paper":"/paper/2111.05011","citing_paper":"/paper/2605.28657"},"observation_digest":"sha256:891a85f230a0f97bae39e7fbdff541512868f1177802ca62c2bca537f4c3b81e","observation_id":"4eebc060-3237-4bfe-b8bf-90a86a8f6292","resolution":{"observed_at":"2026-06-29T10:03:17.319218Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.05011","last_updated":"2021-12-15T16:42:14Z","snapshot_observed_at":"2026-08-15T06:00:56.018391Z","submitted_at":"2021-11-09T09:07:30Z","title":"RAVE: A variational autoencoder for fast and high-quality neural audio synthesis","version":2},"cited_work":{"arxiv_id":"2111.05011","doi":"10.48550/arxiv.2111.05011","metadata_source":"pith","pith_arxiv_id":"2111.05011","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Rave:Avariationalautoencoderforfastandhigh-qualityneuralaudiosynthesis","venue":"cs.LG","work_id":"2d804fa4-dd5d-4461-9fc3-71a5243d0d44","year":2021},"citing_paper":{"arxiv_id":"2606.08286","last_updated":"2026-06-06T18:14:41Z","snapshot_observed_at":"2026-08-08T15:50:09.670365Z","submitted_at":"2026-06-06T18:14:41Z","title":"FXplorer: A Map-Based Interface for Exploratory Audio Effect Design","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-27T19:08:21.640049Z"},"links":{"cited_paper":"/paper/2111.05011","citing_paper":"/paper/2606.08286"},"observation_digest":"sha256:07527582365d8dee887eb728fd2083bb2e25dcf5177e463a4bb9c7160842bf94","observation_id":"2c92f274-b3f4-4390-9323-1e6fc2216daf","resolution":{"observed_at":"2026-07-02T22:07:26.641255Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.05011","last_updated":"2021-12-15T16:42:14Z","snapshot_observed_at":"2026-08-15T06:00:56.018391Z","submitted_at":"2021-11-09T09:07:30Z","title":"RAVE: A variational autoencoder for fast and high-quality neural audio synthesis","version":2},"cited_work":{"arxiv_id":"2111.05011","doi":"10.48550/arxiv.2111.05011","metadata_source":"pith","pith_arxiv_id":"2111.05011","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Rave:Avariationalautoencoderforfastandhigh-qualityneuralaudiosynthesis","venue":"cs.LG","work_id":"2d804fa4-dd5d-4461-9fc3-71a5243d0d44","year":2021},"citing_paper":{"arxiv_id":"2607.08545","last_updated":"2026-07-09T14:38:16Z","snapshot_observed_at":"2026-08-10T00:28:49.560804Z","submitted_at":"2026-07-09T14:38:16Z","title":"Structural Bottlenecks on Frequency Representation in End-to-End Audio Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-10T05:37:12.972599Z"},"links":{"cited_paper":"/paper/2111.05011","citing_paper":"/paper/2607.08545"},"observation_digest":"sha256:7f4a07ef5ee6a0b476040d4e45152a295a21b6a2d10d1f352c90c4059c45f17c","observation_id":"ac75d854-52a2-4660-a6a8-43dca1258c85","resolution":{"observed_at":"2026-07-10T05:46:50.385905Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2111.05011/citation-record","integrity":"/paper/2111.05011/integrity","json":"/paper/2111.05011/citation-record.json","paper":"/paper/2111.05011"},"outbound":[],"paper":{"arxiv_id":"2111.05011","last_updated":"2021-12-15T16:42:14Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-15T06:00:56.018391Z","submitted_at":"2021-11-09T09:07:30Z","title":"RAVE: A variational autoencoder for fast and high-quality neural audio synthesis"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 17 inbound Pith citation observations for arXiv:2111.05011."}