Pith. sign in

Paper Citation Record · LEDGER

Long-form music generation with latent diffusion

As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 14 inbound Pith citation observations for arXiv:2404.10301.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2404.10301 v2

Coverage vector

measured 0 of 0 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links

measured 14 of 14 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-09T06:31:02.800959+00:00

measured 14 of 14 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-08T20:12:29.405437Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: pith, observed 2026-07-08T00:04:22.451108Z

Reference resolution

0 of 0 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved0
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

No outbound reference observations are available for this paper version.

Pith citing papers

Observation 977ec0a8-ce75-480f-8b9d-719d97fe4c4a · inbound

Latent Swap Joint Diffusion for 2D Long-Form Latent Generation cites this paper.

Latent Swap Joint Diffusion for 2D Long-Form Latent Generation Long-form music generation with latent diffusion

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-08T20:12:29.405437Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T20:12:29.405437Z digest=sha256:3b7c7466845385a2afa31ca605fe0ffa2854d0489df650ca68972bb1ffa0c2f7

Observation 351fe317-95a3-40ac-a656-48523bf94e57 · inbound

In-the-wild Audio Spatialization with Flexible Text-guided Localization cites this paper.

In-the-wild Audio Spatialization with Flexible Text-guided Localization Long-form music generation with latent diffusion

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-07T11:59:46.716586Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T11:59:46.716586Z digest=sha256:3a967654a1d9083de3c24bb37da525792429cad39789accc1223c8524ecc3f87

Observation 237bc281-e6e2-478d-99bc-f3e97e626b97 · inbound

WAKE: Watermarking Audio with Key Enrichment cites this paper.

WAKE: Watermarking Audio with Key Enrichment Long-form music generation with latent diffusion

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-07T10:19:26.350553Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:19:26.350553Z digest=sha256:cdf68ede5cdccf06a99a78539ea66bc9b04431590fb2b84e12bb13b9c5b489fb

Observation c272e73f-2a7a-487d-9aae-b8c315fdf398 · inbound

Music Boomerang: Reusing Diffusion Models for Data Augmentation and Audio Manipulation cites this paper.

Music Boomerang: Reusing Diffusion Models for Data Augmentation and Audio Manipulation Long-form music generation with latent diffusion

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-06T19:42:05.689145Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T19:42:05.689145Z digest=sha256:bb7937baa8f683883b8d0bd42eea83838b084a5b00390a85ee9bf72c5a54e43f

Observation 10d9b764-8e6b-474f-819d-61db03b33a6b · inbound

ASAudio: A Survey of Advanced Spatial Audio Research cites this paper.

ASAudio: A Survey of Advanced Spatial Audio Research Long-form music generation with latent diffusion

Reference 42

Resolution
unresolved
no resolver link, observed 2026-08-05T22:54:54.920307Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-05T22:54:54.920307Z digest=sha256:330f7b3fc324f27688546a1f30adce03b8703ba907d0434b343d1eb973f2ca09

Observation d630949b-9041-49c4-b6a2-89e5cf734cab · inbound

Woosh: A Sound Effects Foundation Model cites this paper.

Woosh: A Sound Effects Foundation Model Long-form music generation with latent diffusion

Reference 3

Resolution
verified exact
arxiv_id, observed 2026-05-13T20:53:15.857234Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-05-13T20:51:08.144573Z digest=sha256:e1e39e16d7aeff863eb611351a196c60d012fc8cf577ed47d6534a22d60795c6

Observation 1684b2a8-9e63-471a-bbc4-f3debbe0da5b · inbound

Seconds-Aligned PCA-DAC Latent Diffusion for Symbolic-to-Audio Drum Rendering cites this paper.

Seconds-Aligned PCA-DAC Latent Diffusion for Symbolic-to-Audio Drum Rendering Long-form music generation with latent diffusion

Reference 11

Resolution
metadata mismatch
arxiv_id, observed 2026-05-14T18:39:22.183244Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-05-14T18:38:43.559539Z digest=sha256:98b7a503b5acc0081733495022f7af7c5c7552a512b7d4bd6705c8ea440397a5

Observation 180e0950-93d0-4cab-9479-d8fe8e82756b · inbound

Live Music Diffusion Models: Efficient Fine-Tuning and Post-Training of Interactive Diffusion Music Generators cites this paper.

Live Music Diffusion Models: Efficient Fine-Tuning and Post-Training of Interactive Diffusion Music Generators Long-form music generation with latent diffusion

Reference 8

Resolution
verified exact
arxiv_id, observed 2026-05-22T03:25:58.995820Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-05-22T03:24:50.604019Z digest=sha256:cea930e5f5472a39dc1805b89aa664ac6d186f748496adf9780f3ae5bdf4a1c0

Observation 71065932-b94a-463a-8a0a-5fdda690985a · inbound

AudioX-Turbo: A Unified Framework for Efficient Anything-to-Audio Generation cites this paper.

AudioX-Turbo: A Unified Framework for Efficient Anything-to-Audio Generation Long-form music generation with latent diffusion

Reference 18

Resolution
verified exact
arxiv_id, observed 2026-07-03T13:28:18.779223Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-06-27T08:04:48.283908Z digest=sha256:bbe3a36d86dc3a3ad4fb7fe0c1ec4dc9fb152bab73e19ec1fcf16e73c0732cc8

Observation 1d69060d-9e2a-4a32-a8e5-3b446e87df76 · inbound

Unified Audio Intelligence Without Regressing on Text Intelligence cites this paper.

Unified Audio Intelligence Without Regressing on Text Intelligence Long-form music generation with latent diffusion

Reference 111

Resolution
verified exact
local_arxiv, observed 2026-07-08T00:04:22.452391Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=arxiv_source observed=2026-07-07T23:59:38.702609Z digest=sha256:a659ee42e151631864ea745247ac09d4ba9de4b7804cb0d3c67a12a90e937431

Observation d6a3e05c-0ad7-42ab-9d30-eb6c2525024d · inbound

Unified Audio Intelligence Without Regressing on Text Intelligence cites this paper.

Unified Audio Intelligence Without Regressing on Text Intelligence Long-form music generation with latent diffusion

Reference 111

Resolution
unresolved
no resolver link, observed 2026-07-11T07:46:49.059192Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-11T07:46:49.059192Z digest=sha256:d4ede21d64342d35d9c58ad6f0b8d95612ff057096f7ca301b9715783edad2e2

Observation 85dbf6a9-efbb-4786-8349-a07511050edd · inbound

Stable Autoregressive Speech Generation with Low-Frame-Rate High-Dimensional Continuous Tokens cites this paper.

Stable Autoregressive Speech Generation with Low-Frame-Rate High-Dimensional Continuous Tokens Long-form music generation with latent diffusion

Reference 40

Resolution
unresolved
no resolver link, observed 2026-08-03T08:35:48.723618Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T08:35:48.723618Z digest=sha256:a0ffb070190a861f47b9191a4e21742b73c4763f07c0d7479cb9c58da17688f8

Observation be5684af-b5ae-4839-a628-2b5371d2a9eb · inbound

On the Geometry of Music Bandwidth Extension in Latent Spaces of Audio Codecs cites this paper.

On the Geometry of Music Bandwidth Extension in Latent Spaces of Audio Codecs Long-form music generation with latent diffusion

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-05T14:08:31.796045Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T14:08:31.796045Z digest=sha256:72166541cb9e8a6443512bd45820d324de907cfba539764d7e4a424eeb10c9b6

Observation 775a07d5-4098-423c-b0a6-ba1b3b538eeb · inbound

AI-Based Sound Effect Generation: A Narrative Review of Generative Models Across Input Modalities cites this paper.

AI-Based Sound Effect Generation: A Narrative Review of Generative Models Across Input Modalities Long-form music generation with latent diffusion

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-05T13:43:18.097916Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T13:43:18.097916Z digest=sha256:c634711e86ea0eee68a25b4250e6fee96c7431e139ff0580677b6dfc6a46439d