Pith. sign in

Paper Citation Record · LEDGER

Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models

As of 15 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 0 inbound Pith citation observations for arXiv:2506.15530.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2506.15530 v1

Coverage vector

measured 51 of 51 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-06T23:58:36.914906Z

measured 51 of 51 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-15T06:32:42.880941+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

51 of 51 outbound references displayed

  • verified exact0
  • verified fuzzy42
  • unresolved9
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 11aab689-74b2-4224-9ea0-28c8cf0fee8b · outbound

This paper cites MusicLM: Generating Music From Text.

Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models MusicLM: Generating Music From Text

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-06T23:58:30.489452Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:58:30.489452Z digest=sha256:63a0f37598b686a2c0cf66dc51db437085787d84ccde697395fcafaa06873979

Observation 7d19c5b3-1780-4622-8a78-38d9dff76775 · outbound

This paper cites Music- STAR: a Style Translation system for Audio-based Re- instrumentation.

Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models Music- STAR: a Style Translation system for Audio-based Re- instrumentation

Reference 2

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:58:46.949846Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-06T23:58:30.685094Z digest=sha256:b885e2694a3e5851188fac3d053c343c1929e674dfe42e5446e215bff6cfbe16

Observation 111bc253-d5c9-41d7-9272-575b3dd794ce · outbound

This paper cites eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers.

Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-06T23:58:30.815789Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:58:30.815789Z digest=sha256:6432d4cefeb133b8252565fa35227b15290c081c58bac54617a7c3db8ecb8a42

Observation 92498859-f109-43be-8cee-ad6627c4ffbb · outbound

This paper cites Universal guidance for diffusion models.

Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models Universal guidance for diffusion models

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:58:46.768124Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-06T23:58:30.954288Z digest=sha256:6c6775192f52fb9a460e2c6222c18f9674d897f5055a12ef13098b162a66ba91

Observation dba32e94-8f40-4d49-b50a-76a66012f25a · outbound

This paper cites WaveTransfer: A Flexible End-to- end Multi-instrument Timbre Transfer with Diffusion.

Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models WaveTransfer: A Flexible End-to- end Multi-instrument Timbre Transfer with Diffusion

Reference 5

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:58:46.569636Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-06T23:58:31.129261Z digest=sha256:3be8f1dc33c592b07bc11a865fc28db6a2390688bb293bced4367720a98485ff

Observation ef1e85f9-9705-4dbd-b54c-8f83e63debda · outbound

This paper cites Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets.

Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-06T23:58:31.255617Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:58:31.255617Z digest=sha256:68f712cc5fcc62966e4fe2a09c76c62c6a514154b821fef90836b94293ee7924

Observation 3af0783e-e523-4e9d-832c-4cb06a3b4c99 · outbound

This paper cites A Comparison of Sound Segrega- tion Techniques for Predominant Instrument Recogni- tion in Musical Audio Signals.

Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models A Comparison of Sound Segrega- tion Techniques for Predominant Instrument Recogni- tion in Musical Audio Signals

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:58:46.422351Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-06T23:58:31.431592Z digest=sha256:b744e88283910392ce821b9f5723c1f6ebde3d6679e72d2c636a5345781efe78

Observation 652083c2-1762-4465-9934-bd57834ad742 · outbound

This paper cites Instructpix2pix: Learning to follow image editing in- structions.

Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models Instructpix2pix: Learning to follow image editing in- structions

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:58:46.236395Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-06T23:58:31.574999Z digest=sha256:742d042db71e496536537cafcc841d7f0b1695202f1edbcfe9636dc10613525c

Observation fa29a46b-c199-40e7-8f70-2b863ee205f3 · outbound

This paper cites Musicldm: Enhancing novelty in text-to- music generation using beat-synchronous mixup strate- gies.

Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models Musicldm: Enhancing novelty in text-to- music generation using beat-synchronous mixup strate- gies

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:58:45.947683Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-06T23:58:31.678291Z digest=sha256:6cb0f27f9e1e101ad4961a7ce7a59a62c7a63ae0f9c1a5f0f7fd175d62353f17

Observation e783c59e-82c8-4c45-bf8a-d2066bb4fb1e · outbound

This paper cites Executing your Commands via Motion Diffusion in Latent Space.

Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models Executing your Commands via Motion Diffusion in Latent Space

Reference 10

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:58:45.793227Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-06T23:58:31.830004Z digest=sha256:ae44e09914ef766affc66ae2dd9a39159fbaa9e9d6e6bd086144a70d43d1bffd

Observation 5ad41fe9-177e-44f6-9f28-43b2a59c1508 · outbound

This paper cites Scaling instruction-finetuned language models.

Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models Scaling instruction-finetuned language models

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:58:45.635696Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-06T23:58:31.945566Z digest=sha256:6bb5fa99f8935690555045c37ec3c8408bca2fb2f1db27fe711c06cff9715f9e

Observation 92eb78a9-b5ea-4297-b443-83b7927adf64 · outbound

This paper cites KAD: No More FAD! An Effective and Efficient Evaluation Metric for Audio Generation.

Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models KAD: No More FAD! An Effective and Efficient Evaluation Metric for Audio Generation

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-06T23:58:32.003843Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:58:32.003843Z digest=sha256:ef31e808dfcdde76a7f4f12dec25abc5d120bc427b5465b5297d0d692f31d3f1

Observation d00fd673-5e54-4dd9-a5d0-fa7080b32990 · outbound

This paper cites Self-Supervised VQ-V AE for One- Shot Music Style Transfer.

Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models Self-Supervised VQ-V AE for One- Shot Music Style Transfer

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:58:45.476120Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-06T23:58:32.073327Z digest=sha256:f28c5b327d39a2a924277b3d27a5308a92485a67b7db9c75c291b6bf1d738e80

Observation b324b715-925b-4cb8-87f3-8cfa7ee425a1 · outbound

This paper cites Timbre transfer using image-to-image denoising diffu- sion implicit models.

Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models Timbre transfer using image-to-image denoising diffu- sion implicit models

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:58:45.312507Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-06T23:58:32.136287Z digest=sha256:c37e475959f64621a29cde7c54fde654b54cf7f8197e8cd5bec79bad85ad07c6

Observation 1a99802a-50c3-416f-a2cf-24959bb96910 · outbound

This paper cites Simple and controllable music gen- eration.

Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models Simple and controllable music gen- eration

Reference 15

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:58:44.469027Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-06T23:58:32.204839Z digest=sha256:0765c9475fb98aa3ff09cbbc7a3eeb55673d4b983484c674dbbf1a010e54868c

Observation 6e6d0a0b-f46f-4c3f-b2fb-9c8662ee8d5a · outbound

This paper cites Moshi: a speech-text foundation model for real-time dialogue.

Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models Moshi: a speech-text foundation model for real-time dialogue

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-06T23:58:32.284021Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:58:32.284021Z digest=sha256:d1e2533fe80d552ed50d1288ca449de92a2f2418d486a8d9809c8d262ca91b42

Observation 1863b053-0ba3-4294-9e8b-5b7da8c74d1c · outbound

This paper cites Diffusion models beat gans on image synthesis.

Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models Diffusion models beat gans on image synthesis

Reference 17

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:58:43.894733Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-06T23:58:32.418751Z digest=sha256:5d30a065866a64f5bd92a0118f922db236d5c78d7c116b4cf515dae991e34a3d

Observation a74a6ee7-f61b-4f65-b331-2e4f23bfcd79 · outbound

This paper cites Stable audio open.

Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models Stable audio open

Reference 18

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:58:43.712753Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-06T23:58:32.572609Z digest=sha256:a0000068df4ee85deac906670d66a880251dbdffb9dfcba4c2e126c94ddc46e8

Observation c056775a-56cc-40e9-a818-e20888020d77 · outbound

This paper cites Text-to-audio generation using instruction guided latent diffusion model.

Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models Text-to-audio generation using instruction guided latent diffusion model

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:58:43.510116Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-06T23:58:32.745668Z digest=sha256:cc8090152685cdabeee57e8c7db7d5b481e314a3ea5e90d91a52e6df1ab99397

Observation 22abec83-d2c1-45c2-9d9c-778244217077 · outbound

This paper cites Generative adversarial net- works.

Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models Generative adversarial net- works

Reference 20

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:58:43.378800Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-06T23:58:32.904784Z digest=sha256:13b5f9152ec6c8f281e9915dc34d8cee18108e06d735730e1ab9be32988f1f13

Observation c2a46e27-140f-4741-85ee-83bb81d7c886 · outbound

This paper cites Animatediff: Animate your person- alized text-to-image diffusion models without specific tuning.

Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models Animatediff: Animate your person- alized text-to-image diffusion models without specific tuning

Reference 21

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:58:43.243998Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-06T23:58:32.984784Z digest=sha256:d8f83e222158b883bdc6f3e97383c8ffa6f59f2a7fd065ee51af05c61fadcbcd

Observation a23bd7ff-b5ca-46ec-bd1d-57d9faf85644 · outbound

This paper cites InstructME: An Instruction Guided Music Edit And Remix Framework with Latent Diffu- sion Models.

Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models InstructME: An Instruction Guided Music Edit And Remix Framework with Latent Diffu- sion Models

Reference 22

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:58:43.117132Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-06T23:58:33.085543Z digest=sha256:c91c3d362ebf81860849a345900802c86df4da8d9dbcb734483084164b88b14d

Observation 97366a0f-f56a-4906-b261-53bbe6ecaba2 · outbound

This paper cites Denois- ing diffusion probabilistic models.

Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models Denois- ing diffusion probabilistic models

Reference 23

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:58:42.858603Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-06T23:58:33.223126Z digest=sha256:a2aabd40af266947c623f8d67e8d26c5c55377fec0dbb75da2b1e97be30a9c5f

Observation 203e3afc-8463-456f-84da-4f7253608249 · outbound

This paper cites Classifier-Free Diffu- sion Guidance.

Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models Classifier-Free Diffu- sion Guidance

Reference 24

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:58:42.618816Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-06T23:58:33.367335Z digest=sha256:bd2e8e4afeb181bcccd8c7473cc82890134fdaa666129efc4ed04a8341c5dca0

Observation 5f4478ee-a3e7-4058-8c70-4eea61bc3156 · outbound

This paper cites Noise2Music: Text-conditioned Music Generation with Diffusion Models.

Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models Noise2Music: Text-conditioned Music Generation with Diffusion Models

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-06T23:58:33.511112Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:58:33.511112Z digest=sha256:0be9637b0793f3d49b6e5da1ec2e3fffa7ab6f27125a9657474fcfa3fa57f6a8

Observation 115f50e7-6d15-4372-bf56-61226877d3ff · outbound

This paper cites Make-an-audio: Text-to-audio generation with prompt-enhanced diffusion models.

Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models Make-an-audio: Text-to-audio generation with prompt-enhanced diffusion models

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:58:42.414409Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-06T23:58:33.645437Z digest=sha256:d6c5bf1d49487cc278eae328ab79c455c30eeb7062f1d706cd8226581302dd4e

Observation 8d29882e-605b-44e7-a973-99da11026f7c · outbound

This paper cites Auto-encoding variational bayes.

Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models Auto-encoding variational bayes

Reference 27

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:58:42.147352Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-06T23:58:33.755079Z digest=sha256:15bd03b0a8f462388487358f90d8b66cc78edd131d5866a184003e499760d9de

Observation b9fa412f-8d12-4043-8f86-1580fe4e0336 · outbound

This paper cites Applying guidance in a limited interval improves sample and distribution quality in diffusion models.

Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models Applying guidance in a limited interval improves sample and distribution quality in diffusion models

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:58:41.948591Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-06T23:58:33.862316Z digest=sha256:e8d8c81049d4e1c898490ba65e9cbd9f30678497e026702ef81c2ffa0a3a23f0

Observation 337bdfa9-c019-4576-9b28-343f45228988 · outbound

This paper cites Efficient neural music generation.

Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models Efficient neural music generation

Reference 29

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:58:41.759860Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-06T23:58:33.965658Z digest=sha256:4994e34bc56c5cdaa8fa86eb02cc4d7da22a3edffee9959caa5918730f5f0af7

Observation b1e10ba8-5d71-4099-b81d-17d261d0f7bc · outbound

This paper cites Music style transfer with time-varying inversion of diffusion models.

Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models Music style transfer with time-varying inversion of diffusion models

Reference 30

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:58:41.555479Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-06T23:58:34.033833Z digest=sha256:a6b0f2bf370808e385a02c2cbb8926c51b7e3a8fa4a1c32b949bd926daaeb099

Observation 30b09d43-a7a8-4958-8e4b-f4dbdbb25349 · outbound

This paper cites MERT: Acoustic Music Understanding Model with Large-Scale Self-supervised Training.

Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models MERT: Acoustic Music Understanding Model with Large-Scale Self-supervised Training

Reference 31

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:58:41.281258Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-06T23:58:34.177555Z digest=sha256:d4ee525f6d37aa6e1bc86088ac396684470256911d6430042651547cc9b80d75

Observation 4ef7958b-6efa-453d-a721-e210369012db · outbound

This paper cites Content-based controls for music large language modeling.

Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models Content-based controls for music large language modeling

Reference 32

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:58:40.937049Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-06T23:58:34.308090Z digest=sha256:6addbad20b6018b595ff7d439537a082dad1590d4c90fb86c535e1e6f63b699a

Observation 607ee2df-d2ba-40f0-b1f5-c21cf9dea68e · outbound

This paper cites Audioldm 2: Learning holistic au- dio generation with self-supervised pretraining.

Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models Audioldm 2: Learning holistic au- dio generation with self-supervised pretraining

Reference 33

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:58:40.585910Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-06T23:58:34.424028Z digest=sha256:29cfb96761d81170398f24143706f3e49cc0b2b30f2fca13adde530772e2d158

Observation 401ae98b-4024-41b3-ad2e-c5b3acd1d977 · outbound

This paper cites AudioLDM: Text-to-Audio Generation with Latent Diffusion Models.

Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models AudioLDM: Text-to-Audio Generation with Latent Diffusion Models

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-06T23:58:34.577052Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:58:34.577052Z digest=sha256:fecc25b84d5549f8cefd4cbe761b8f12575ef7aa0556c96960b9d82fa610f7de

Observation ab28cd9d-6f4c-4230-afa1-ed2e6c8e7c40 · outbound

This paper cites Music understanding llama: Ad- vancing text-to-music generation with question answer- ing and captioning.

Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models Music understanding llama: Ad- vancing text-to-music generation with question answer- ing and captioning

Reference 35

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:58:40.225706Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-06T23:58:34.684598Z digest=sha256:058804f44708ebece89c7d8b5dcf37a14c85da7b7d1d002e8fe7e50aeefb7257

Observation ab151a50-da97-4c30-99f4-2d050f9148e2 · outbound

This paper cites Foundation Models for Music: A Survey.

Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models Foundation Models for Music: A Survey

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-06T23:58:34.878811Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:58:34.878811Z digest=sha256:fc253977c006d6dfd345e31dd0fe3a68edb6c81e8e5802710df4942c22d5499f

Observation 46c08188-1cfd-43cb-8fbc-81c5a355f036 · outbound

This paper cites Zero-shot unsuper- vised and text-based audio editing using DDPM inver- sion.

Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models Zero-shot unsuper- vised and text-based audio editing using DDPM inver- sion

Reference 37

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:58:39.877759Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-06T23:58:35.034235Z digest=sha256:93dfa6f324fc60b16beb4c569fa2c28b9b69ed4fbdd7bbb9ea28cd47f615f37a

Observation b265f498-3b7d-4ec2-ae71-1a42532190f4 · outbound

This paper cites Mustango: Toward controllable text-to-music generation.

Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models Mustango: Toward controllable text-to-music generation

Reference 38

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:58:39.566671Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-06T23:58:35.207845Z digest=sha256:3d97ef319e7f854a0819c35eaa023817c54f26d11508e02fbe3483c0ca8f58a4

Observation 21a518dd-2af4-4f15-abe2-16f351c14d91 · outbound

This paper cites Null-text inversion for editing real images using guided diffusion models.

Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models Null-text inversion for editing real images using guided diffusion models

Reference 39

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:58:39.388200Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-06T23:58:35.361850Z digest=sha256:6f3caa3d0951e415a060d378d43fe2ce8c4424b57cf0c85b58c65d6f15dc3ba8

Observation 507d03a5-dfe2-48a2-867a-113eac491011 · outbound

This paper cites Ditto: Diffusion inference-time t-optimization for music generation.

Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models Ditto: Diffusion inference-time t-optimization for music generation

Reference 40

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:58:39.208586Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-06T23:58:35.576228Z digest=sha256:14fe6ed777a81ccb4c62caff187adf686b7de61979371e26522db1f8aff761b5

Observation cd6e08a9-64d1-4b57-a6a2-768ab527e600 · outbound

This paper cites High-resolution image synthesis with latent diffusion models.

Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models High-resolution image synthesis with latent diffusion models

Reference 41

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:58:39.036789Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-06T23:58:35.755468Z digest=sha256:280ab29ce4a9b28a4f8d864c09b45931fcf4b09d5af23b1ce6333171f4e4b2fe

Observation 86369a14-5273-405f-83de-5421beae79d2 · outbound

This paper cites Audio Conditioning for Music Generation via Discrete Bottleneck Features.

Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models Audio Conditioning for Music Generation via Discrete Bottleneck Features

Reference 42

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:58:38.883524Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-06T23:58:35.918453Z digest=sha256:84d4099c8768398229e8a8fdba17efbffff6c92d6acd9aaf4ed3e8695024cb8d

Observation 4d15ac2d-9730-4d1a-8eec-8f438333caae · outbound

This paper cites Dreambooth: Fine tuning text-to- image diffusion models for subject-driven generation.

Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models Dreambooth: Fine tuning text-to- image diffusion models for subject-driven generation

Reference 43

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:58:38.688799Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-06T23:58:36.147382Z digest=sha256:76cf496a47cad31cd2e17edaf30733e4fc10028c23abce379c37da8eceb275a2

Observation 6e2e8fb0-d8cb-4922-8e3b-e0134b5442f5 · outbound

This paper cites Photorealistic text-to-image diffusion models with deep language understanding.

Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models Photorealistic text-to-image diffusion models with deep language understanding

Reference 44

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:58:38.492129Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-06T23:58:36.358738Z digest=sha256:c4614c0c85cf9bcbc401c95f1fd765c636e03a6c3fd1554c43443027cb897f4e

Observation 9a9127ec-3e77-4524-b020-18041f431967 · outbound

This paper cites Denoising Diffusion Implicit Models.

Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models Denoising Diffusion Implicit Models

Reference 45

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:58:38.253052Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-06T23:58:36.424461Z digest=sha256:688f3c2388d2fa10f6f3969dab5e88f0f15af561b2620148a437794aaa1f6805

Observation 88af383a-4927-44a5-937d-f46baf30f0d8 · outbound

This paper cites Human motion diffusion model.

Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models Human motion diffusion model

Reference 46

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:58:38.073262Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-06T23:58:36.502635Z digest=sha256:bd5a0274ebff3774a319cf8c8dbede73bf94fc43868948f7c20deb0a5bcecd61

Observation 542c46d9-a1c0-4ef5-8cfe-435a66e0afdb · outbound

This paper cites Towards Music Instrument Classification using Convolutional Neural Networks.

Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models Towards Music Instrument Classification using Convolutional Neural Networks

Reference 47

Resolution
unresolved
no resolver link, observed 2026-08-06T23:58:36.608024Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:58:36.608024Z digest=sha256:db5b8c72ac06284f031bd1fc6e1f1607475152e8c124e05d5074e27c255b64f2

Observation e609a76e-3c17-4c1f-9c62-2beb659d7d4f · outbound

This paper cites Audio Prompt Adapter: Un- leashing Music Editing Abilities for Text-to-Music with Lightweight Finetuning.

Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models Audio Prompt Adapter: Un- leashing Music Editing Abilities for Text-to-Music with Lightweight Finetuning

Reference 48

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:58:37.944209Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-06T23:58:36.685070Z digest=sha256:b4c609b3e37e67ab25f24e74ea57490ad2eae0ea215b0f7ee8fd1fdbd70e0b42

Observation e1d3f23c-90c9-40cb-bc6d-953f10e1a330 · outbound

This paper cites Analysis of Classifier-Free Guidance Weight Schedulers.

Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models Analysis of Classifier-Free Guidance Weight Schedulers

Reference 49

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:58:37.752149Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-06T23:58:36.752521Z digest=sha256:3641b1df4382a9c5765d7813d76e3b03644d22893297ebc8f18ee5e5ac080bcc

Observation 404c93e1-d215-42fc-bad4-8dd90f2511ea · outbound

This paper cites Transplayer: Timbre Style Transfer with Flexible Timbre Control.

Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models Transplayer: Timbre Style Transfer with Flexible Timbre Control

Reference 50

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:58:37.552612Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-06T23:58:36.846649Z digest=sha256:e039fd0c767cf4267a79a40d24d7ce617337cd0a4f74f13893651e82bd5847df

Observation 15c64e1a-40c9-4bce-9f68-6835232bc2ec · outbound

This paper cites Musicmagus: Zero-shot text-to- music editing via diffusion models.

Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models Musicmagus: Zero-shot text-to- music editing via diffusion models

Reference 51

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:58:37.372455Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-06T23:58:36.914906Z digest=sha256:b424893a3ce847a05f7fff81a0f1bd13fe7024731600ca4b3df489c15a7659a5

Pith citing papers

No inbound Pith citation observations are available.