Pith. sign in

Paper Citation Record · LEDGER

AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion

As of 7 August 2026, this Paper Citation Record lists 41 of 41 outbound references and 3 inbound Pith citation observations for arXiv:2505.22106.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2505.22106 v1

Coverage vector

measured 41 of 41 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-07T13:21:11.797874Z

measured 44 of 44 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-07T06:34:17.273281+00:00

measured 3 of 3 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-07T13:21:08.234057Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-05-11T15:46:43.538548Z

Reference resolution

41 of 41 outbound references displayed

  • verified exact2
  • verified fuzzy25
  • unresolved14
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation d6304768-44fd-463d-9ff2-886fe2eee27b · outbound

This paper cites The audio generated by TTA systems is primarily categorized into three types: speech, sound effects, and music.

AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion The audio generated by TTA systems is primarily categorized into three types: speech, sound effects, and music

Reference 1

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:21:16.912318Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:21:08.126646Z digest=sha256:4f012da4b2fc9e74dc2ccaedf73f02525099bd319d191e27cd401f57e1968bc7

Observation 3cff68ac-83e2-4e74-a213-17a4a2a700b8 · outbound

This paper cites an unresolved cited work.

AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion Unresolved cited work

Reference 2

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:21:16.657206Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:21:08.315871Z digest=sha256:3f47b60b988460f26d9a7f6d5525878576ea7b20c82ebb6a1a164ac5b2fa4bf6

Observation 188b390f-9bf8-4812-a1e7-2cb7eeafea2e · outbound

This paper cites an unresolved cited work.

AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion Unresolved cited work

Reference 3

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:21:16.369102Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:21:08.381010Z digest=sha256:5a779acff7eeb6c908af34724731b29182f8e787fef501b96a22e3badd1d14b9

Observation 449c3509-6295-4986-8fa8-3428ff23a207 · outbound

This paper cites Experimental Setup 4.1.1.

AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion Experimental Setup 4.1.1

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:21:16.256670Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:21:08.490860Z digest=sha256:f482fbd9f3195f4e723e51707fb1fef06b493f763715fb0afa41fa72e864079d

Observation 70c680c0-050c-49b8-9323-c2f85c9414c3 · outbound

This paper cites Experiments show that by combining SOTA TTA models with rectified dif- fusion, AudioTurbo surpasses baseline models in both objec- tive and subjective evaluations.

AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion Experiments show that by combining SOTA TTA models with rectified dif- fusion, AudioTurbo surpasses baseline models in both objec- tive and subjective evaluations

Reference 5

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:21:16.014805Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:21:08.604528Z digest=sha256:ee5c926ed506211a4b1ee6bb782c18e2ecbd999d4e4b83a08e5a40a6479bbea4

Observation e18e24ed-cd8b-4d7d-8e63-2bf24d17ae8d · outbound

This paper cites Text-to- speech and speech-to-text converter—voice assistant,.

AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion Text-to- speech and speech-to-text converter—voice assistant,

Reference 6

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:21:15.393706Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:21:09.174219Z digest=sha256:42ad2d6d1dc4bc89a6b5840ac7301485efb6daabda4d9f1918e02669f4b71e52

Observation 996763e3-ead4-4ff1-ac9d-5384786a0b32 · outbound

This paper cites AudioGen: Textu- ally guided audio generation,.

AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion AudioGen: Textu- ally guided audio generation,

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:21:15.840924Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:21:08.694625Z digest=sha256:e6fd3b9ce8d692abf3eee3cde7af1fd929fe80c119549f26c0112d923aa8ea74

Observation 48e7124c-05e4-43c9-bb0d-10ed4f8b5f88 · outbound

This paper cites UniAudio: An Audio Foundation Model Toward Universal Audio Generation.

AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion UniAudio: An Audio Foundation Model Toward Universal Audio Generation

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-07T13:21:08.829562Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:21:08.829562Z digest=sha256:e3be8ac2f9a478b00f9ae265387bbd2b509c8411e2af5b355121471923f02efc

Observation a410e71b-55ac-4f22-90e5-3cddaabb01e0 · outbound

This paper cites Diffsound: Discrete diffusion model for text-to-sound genera- tion,.

AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion Diffsound: Discrete diffusion model for text-to-sound genera- tion,

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:21:15.636832Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:21:08.918467Z digest=sha256:10a08a4a3b993eb3860cd97169eedf23ad31343da463b3f55225214eb24aa78e

Observation 8fa498a3-943f-43af-bedc-20bed2a17b9e · outbound

This paper cites AudioLDM: text-to-audio generation with latent diffusion models,.

AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion AudioLDM: text-to-audio generation with latent diffusion models,

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-07T13:21:08.977066Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:21:08.977066Z digest=sha256:9be6420ed901993d446d388e9dcdc30d0e5ce518477d562648b7cafe8afbefaf

Observation ecd636f1-098b-43a6-bcfa-3be362a7d582 · outbound

This paper cites Text-to- audio generation using instruction guided latent diffusion model,.

AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion Text-to- audio generation using instruction guided latent diffusion model,

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:21:15.474788Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:21:09.067774Z digest=sha256:3603aae292bb8651e1e3d7614aa90d30ca6422fa71c298f162915c1c05561ebc

Observation 324cf7b1-8a97-45d3-b539-fe17446ad53e · outbound

This paper cites Auffusion: Leveraging the power of diffusion and large language models for text-to-audio generation,.

AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion Auffusion: Leveraging the power of diffusion and large language models for text-to-audio generation,

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:21:14.965027Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:21:09.576858Z digest=sha256:8f9eca981b774e0e32c1b2234052444d2cb205b743b613bf5a02955e03e58d87

Observation 2364a185-a311-47ac-8138-ba5b99cdf58f · outbound

This paper cites A Survey of Deep Learning Audio Generation Methods.

AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion A Survey of Deep Learning Audio Generation Methods

Reference 13

Resolution
verified exact
local_arxiv, observed 2026-08-07T13:21:12.508986Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:21:09.219476Z digest=sha256:485d9dcfb25401efedffd8391c48fecd2c61720262ca3de9b2a92f41f176d41f

Observation 1dc413e4-7aa3-4b26-939f-d7aa7b8798a4 · outbound

This paper cites Leveraging AI to Generate Audio for User-generated Content in Video Games.

AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion Leveraging AI to Generate Audio for User-generated Content in Video Games

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-07T13:21:09.271962Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:21:09.271962Z digest=sha256:c5080fbca1c40e5f729a9fcb90781a6d11fc22e1efc8f473d1ae8ab512989d7a

Observation f5385b2f-81a6-4a07-ba71-c9234fdec4b1 · outbound

This paper cites MusicLM: Generating Music From Text.

AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion MusicLM: Generating Music From Text

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-07T13:21:09.317308Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:21:09.317308Z digest=sha256:1895f73afecf839f9ae35abf968d16dc43e60db6b532c4ce28432198f6d32b43

Observation abab167c-2d2b-4f13-b3c8-cd455917149c · outbound

This paper cites Neural discrete representa- tion learning,.

AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion Neural discrete representa- tion learning,

Reference 16

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:21:15.252714Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:21:09.421624Z digest=sha256:f76f7089e34b62f8fb9d9b5aa60efac00225d69ed1e5304dd4f80f71b044f979

Observation 5bc62098-92a7-45ed-b6b2-9cba5573bef3 · outbound

This paper cites High-resolution image synthesis with latent diffusion models,.

AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion High-resolution image synthesis with latent diffusion models,

Reference 17

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:21:15.108186Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:21:09.522549Z digest=sha256:e2732a58448adc8c255d0eb56e07f410c1f44fea0ac664c9ea3d39065ea3e141

Observation 46e480b0-65a8-49e1-ab75-95129389b619 · outbound

This paper cites FlashSpeech: Efficient zero-shot speech synthesis,.

AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion FlashSpeech: Efficient zero-shot speech synthesis,

Reference 18

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:21:14.428965Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:21:10.261567Z digest=sha256:283deaa140f5c9be6d65d5636ccfb713c518d62dc7361b9e28423c4c5386b780

Observation 0e16c682-6918-498c-b935-cff2bebc2bca · outbound

This paper cites AudioLDM 2: Learn- ing holistic audio generation with self-supervised pretraining,.

AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion AudioLDM 2: Learn- ing holistic audio generation with self-supervised pretraining,

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-07T13:21:09.620536Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:21:09.620536Z digest=sha256:27daec99a6495f031a0917318d70f454b1b5f5f5d2bca738b9c55ba599d0e264

Observation 16b46a8c-60f9-4f40-b30b-ba41836a6fb7 · outbound

This paper cites AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion.

AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-07T13:21:08.234057Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:21:08.234057Z digest=sha256:f47d35c5fa486047067a0995cb53845ac6724364749ae6e99614f23671c31d6a

Observation a2f193fd-a9b1-4eb2-ac91-66b71ca819eb · outbound

This paper cites Make-an-Audio: Text-to-audio generation with prompt-enhanced diffusion models,.

AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion Make-an-Audio: Text-to-audio generation with prompt-enhanced diffusion models,

Reference 21

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:21:14.820084Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:21:09.651250Z digest=sha256:630b53807d7cae7a9419e8f9636f739044dc8ccc3e4954755e24c8c40b253b1a

Observation b2d9abc9-eb29-49b2-ae2a-6724abd38d96 · outbound

This paper cites Make-An-Audio 2: Temporal-Enhanced Text-to-Audio Generation.

AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion Make-An-Audio 2: Temporal-Enhanced Text-to-Audio Generation

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-07T13:21:09.950564Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:21:09.950564Z digest=sha256:7022436a42ab87b435be4481bfb6bcb15d0846ba2fba3163fced552eef492cb6

Observation a13c1315-f2f5-4809-80ad-cd8b0256f01e · outbound

This paper cites ProDiff: Progressive fast diffusion model for high-quality text-to-speech,.

AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion ProDiff: Progressive fast diffusion model for high-quality text-to-speech,

Reference 23

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:21:14.635611Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:21:10.029525Z digest=sha256:8fe1c649ebe4a4282ed2c0d55035637370f15fe125ccf8e7abc9f20eb7b83a72

Observation 3ada13ed-a7d1-4caa-9419-a39c7fc9f046 · outbound

This paper cites Matcha-TTS: A fast TTS architecture with conditional flow matching,.

AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion Matcha-TTS: A fast TTS architecture with conditional flow matching,

Reference 24

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:21:14.540426Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:21:10.165933Z digest=sha256:891372368ef15212d7674c6eee09a15308a4f0c95b2205a606ab800ca578ae21

Observation 5ffc9e00-4f0e-45d8-b9bc-1fe82064984c · outbound

This paper cites LAFMA: A Latent Flow Matching Model for Text-to-Audio Generation.

AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion LAFMA: A Latent Flow Matching Model for Text-to-Audio Generation

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-07T13:21:10.350455Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:21:10.350455Z digest=sha256:cda1dc2bcb4353a7e9435c0ebd841c56f202c6a8cf7a5510e3730f73fb312f90

Observation 7ec3dad7-ef41-4a30-9919-bcc876b8f32d · outbound

This paper cites Flow matching for generative modeling,.

AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion Flow matching for generative modeling,

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:21:14.285099Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:21:10.475766Z digest=sha256:ea00e2c9fb4a55c3bd22e5ccf0a28503c573f629fab92c2e5aa9e8c3c60a0241

Observation fbe88115-e341-4950-bd3f-e90f055a59e9 · outbound

This paper cites Rectified Diffusion: Straightness Is Not Your Need in Rectified Flow.

AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion Rectified Diffusion: Straightness Is Not Your Need in Rectified Flow

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-07T13:21:10.583271Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:21:10.583271Z digest=sha256:239f9937a9f16ae7857b00a037c6522daae925a658b191adbb58616615794e84

Observation f9c77d8b-0246-4051-a7e4-d45db0f0135c · outbound

This paper cites Flow Straight and Fast: Learning to Generate and Transfer Data with Rectified Flow.

AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion Flow Straight and Fast: Learning to Generate and Transfer Data with Rectified Flow

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-07T13:21:10.677989Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:21:10.677989Z digest=sha256:aa8ed25c73a44ae0abd594ef478a55b6e58e7c390c59363158d16d2ce750dda9

Observation 0a6d5771-71db-472b-82bb-92b006bdf3e7 · outbound

This paper cites Classifier-Free Diffusion Guidance.

AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion Classifier-Free Diffusion Guidance

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-07T13:21:10.774097Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:21:10.774097Z digest=sha256:08728f22afeecd0619207c94629ae5702f95ee63e6ed9164cd71f2cd95e95339

Observation 6763064e-4091-4233-8841-c78fdc0626aa · outbound

This paper cites Score-based generative modeling through stochas- tic differential equations,.

AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion Score-based generative modeling through stochas- tic differential equations,

Reference 30

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:21:14.116228Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:21:10.866890Z digest=sha256:0dd7a45b20671f29926e5674c7e0a53bd8bc132b3f0c068eb7d1fa22ba93fd9c

Observation 9943b528-6d4d-4b51-9a29-6f2cf98a9b33 · outbound

This paper cites DPM-Solver: A fast ODE solver for diffusion probabilistic model sampling in around 10 steps,.

AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion DPM-Solver: A fast ODE solver for diffusion probabilistic model sampling in around 10 steps,

Reference 31

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:21:13.983818Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:21:10.950164Z digest=sha256:6e42a7b199c3f60310a77e78daf0f37d8cf0e7a6f251c0339f9f770f452bfcd4

Observation 523944d1-a27b-4916-bfa7-6d27f49aa0ce · outbound

This paper cites Large-scale contrastive language-audio pretraining with feature fusion and keyword-to-caption augmentation,.

AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion Large-scale contrastive language-audio pretraining with feature fusion and keyword-to-caption augmentation,

Reference 32

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:21:13.872434Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:21:11.066100Z digest=sha256:4599c3b7eee1e4d2b0f65d5060d0f25bf1fbf70d15651e3824ae6025047871f5

Observation e986f037-d254-4f90-ae00-b759ad7727fe · outbound

This paper cites Learning transferable visual models from natural language supervision,.

AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion Learning transferable visual models from natural language supervision,

Reference 33

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:21:13.716985Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:21:11.139122Z digest=sha256:26191a4410156c5d91f11ffdd23114ddf4e8360036864ab62ee9e0e402671fe3

Observation 9cdd219a-716d-46a8-bdd4-f91de6dcc23d · outbound

This paper cites U-Net: Convolutional networks for biomedical image segmentation,.

AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion U-Net: Convolutional networks for biomedical image segmentation,

Reference 34

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:21:13.596152Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:21:11.211420Z digest=sha256:eb306fa006a37eb0f7d5e38274a7266b9684686d6c4abbb114f07fb0b5ceb835

Observation 96918202-d1eb-4c71-8db5-fdef4e68f3a3 · outbound

This paper cites Denoising diffusion implicit models,.

AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion Denoising diffusion implicit models,

Reference 35

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:21:13.437880Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:21:11.294535Z digest=sha256:10dcbd6520716e7fb8302fce512f5a0d94451f1c079ea33cebe69b7cf8acacbf

Observation 9bda180c-d77b-43b2-a26f-7612f08fa36a · outbound

This paper cites Pseudo numerical methods for diffusion models on manifolds,.

AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion Pseudo numerical methods for diffusion models on manifolds,

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-07T13:21:11.382160Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:21:11.382160Z digest=sha256:7fe7232ab283463fa0cfc8cbbdeacee1e2eac5ed77023a917825eceb3edec221

Observation 2a330639-1401-4678-853c-985e8a1b624b · outbound

This paper cites AudioCaps: Generat- ing captions for audios in the wild,.

AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion AudioCaps: Generat- ing captions for audios in the wild,

Reference 37

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:21:13.304432Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:21:11.427230Z digest=sha256:42330a119fe91e867b76ffe26167bbd0442b2a23fa2edcaabeeb81e9f5f1b556

Observation a975a37b-535a-496c-97cb-93161ad656b1 · outbound

This paper cites PANNs: Large-scale pretrained audio neural networks for audio pattern recognition,.

AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion PANNs: Large-scale pretrained audio neural networks for audio pattern recognition,

Reference 38

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:21:13.105140Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:21:11.509960Z digest=sha256:17d05c0ac89fceb4077252f69a5d589fb7bed001cffb54bfa03ca0562dca9659

Observation 6f32bb52-1ab9-450c-b936-ce9cdc111e65 · outbound

This paper cites Diffusion models beat GANs on im- age synthesis,.

AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion Diffusion models beat GANs on im- age synthesis,

Reference 39

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:21:12.950137Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:21:11.594091Z digest=sha256:731163f35c0387b06f46213cc6846886b1be1e9756e079817072802845266775

Observation 95b6400c-3078-4e02-9dba-45955906ecd4 · outbound

This paper cites Universal sound separation with self-supervised audio masked autoencoder,.

AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion Universal sound separation with self-supervised audio masked autoencoder,

Reference 40

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:21:12.731719Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:21:11.717342Z digest=sha256:58e918ae193876a0ccad54550780ddc9f0d0aa241345cae6a484898eb62c5aa6

Observation 35bd27e7-b1db-4ae1-8f9d-d0c34ea7aa96 · outbound

This paper cites SoloAudio: Target Sound Extraction with Language-oriented Audio Diffusion Transformer.

AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion SoloAudio: Target Sound Extraction with Language-oriented Audio Diffusion Transformer

Reference 41

Resolution
verified exact
local_arxiv, observed 2026-08-07T13:21:12.016943Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:21:11.797874Z digest=sha256:3357ccc457dc6684425992b5ef4fe465bf0eb42132888b695c4214ce96e5d66d

Pith citing papers

Observation 16b46a8c-60f9-4f40-b30b-ba41836a6fb7 · inbound

AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion cites this paper.

AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-07T13:21:08.234057Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:21:08.234057Z digest=sha256:f47d35c5fa486047067a0995cb53845ac6724364749ae6e99614f23671c31d6a

Observation e1c9d323-e989-4711-81ed-a990793ad6f7 · inbound

Fast Text-to-Audio Generation with One-Step Sampling via Energy-Scoring and Auxiliary Contextual Representation Distillation cites this paper.

Fast Text-to-Audio Generation with One-Step Sampling via Energy-Scoring and Auxiliary Contextual Representation Distillation AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion

Reference 36

Resolution
verified exact
arxiv_id, observed 2026-05-11T15:46:43.615417Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-05-09T19:17:09.247932Z digest=sha256:4b8a0f6973de0efb0bd2c63a7545a247e465ba007ff51bb378ae723cdf2c5494

Observation 4836bf38-4f4a-4b3e-974a-49ec1ab4827e · inbound

FdAudio: MeanFlow-Anchored Fr\'echet-Distance Post-Training for One-Step Text-to-Audio Generation cites this paper.

FdAudio: MeanFlow-Anchored Fr\'echet-Distance Post-Training for One-Step Text-to-Audio Generation AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion

Reference 14

Resolution
unresolved
no resolver link, observed 2026-07-14T11:52:50.598080Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-14T11:52:50.598080Z digest=sha256:bb84f3373158fd7c173a9c5b139f54d28249d9e48f19ea4078d7a00b2ce03b47