Pith. sign in

Paper Citation Record · LEDGER

Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework

As of 21 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 1 inbound Pith citation observation for arXiv:2505.15254.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2505.15254 v1

Coverage vector

measured 42 of 42 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-07T15:24:24.528815Z

measured 43 of 43 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-21T06:32:19.484+00:00

measured 1 of 1 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-07T15:24:21.645147Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: pith, observed 2026-08-07T15:24:25.302486Z

Reference resolution

42 of 42 outbound references displayed

  • verified exact3
  • verified fuzzy14
  • unresolved24
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch1

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation cf087736-2735-47a1-b437-5c8e2fc18376 · outbound

This paper cites an unresolved cited work.

Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework Unresolved cited work

Reference 1

Resolution
unresolved
raw_fallback, observed 2026-08-07T15:24:28.768999Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T15:24:21.592509Z digest=sha256:6f65c4410de6ad1015fe07fbdd78232f324f73934a37245a63dee898b2ef245b

Observation 739eb559-55db-4bc4-b6fe-362d37b08401 · outbound

This paper cites Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework.

Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework

Reference 2

Resolution
metadata mismatch
local_arxiv, observed 2026-08-07T15:24:25.382107Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T15:24:21.645147Z digest=sha256:79ac8e1da52a7e2544f833fd3f0fb753cd781afc2a75c5d7257d592b0ad260b6

Observation 3b458b3c-c2d2-444f-a788-5d90e96bcc73 · outbound

This paper cites an unresolved cited work.

Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework Unresolved cited work

Reference 3

Resolution
unresolved
raw_fallback, observed 2026-08-07T15:24:28.540931Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T15:24:21.706540Z digest=sha256:2e62d6149e5b1fdaabdf7f9e360560423dd334cf3db41f2e4cc0cef756d4fc86

Observation 6b58dbbc-975a-4f32-b24e-2c88c9c94247 · outbound

This paper cites an unresolved cited work.

Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework Unresolved cited work

Reference 4

Resolution
unresolved
raw_fallback, observed 2026-08-07T15:24:28.409163Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T15:24:21.839348Z digest=sha256:8f24e0e5ef08654584550984e71cb2ca2926313fbe8f85578253d5119a1cf9dd

Observation 3d7325ca-42ef-4987-8cb8-4c904f188c29 · outbound

This paper cites Our method leverages a two- stage approach, incorporating a generative speech restoration (GSR) model at the front end, followed by a VC module.

Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework Our method leverages a two- stage approach, incorporating a generative speech restoration (GSR) model at the front end, followed by a VC module

Reference 5

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T15:24:27.892749Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T15:24:22.180588Z digest=sha256:d0c439e49cf32a110caa4d47764dd3a87acbdb343e0c4524cfe6d063d5993da5

Observation 2806e5d1-524d-4fda-8706-7480ed954839 · outbound

This paper cites an unresolved cited work.

Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework Unresolved cited work

Reference 6

Resolution
unresolved
raw_fallback, observed 2026-08-07T15:24:28.097586Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T15:24:22.046375Z digest=sha256:7993b14516d086ef64af61922b434e8f09db39582c0c7dbe25531e9b526d4319

Observation 09c3a2ce-dab3-422f-928b-df6787cddf98 · outbound

This paper cites Generative adver- sarial networks,.

Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework Generative adver- sarial networks,

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-07T15:24:22.724970Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T15:24:22.724970Z digest=sha256:957478f16010ca05d5e0f9422e3f11143ccc6f15a9a010a0514bdaae1ff0a9cb

Observation d145baae-5426-4c5c-bbbd-ceb6a99f3ed5 · outbound

This paper cites Supervised speech separation based on deep learning: An overview,.

Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework Supervised speech separation based on deep learning: An overview,

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-07T15:24:22.317887Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T15:24:22.317887Z digest=sha256:ef5de1960640d76964362ee1e902212fdd732f4ca1d79de22d9929de07dd1e1c

Observation b49c0e73-e7f6-4f22-9983-ee956116b6d4 · outbound

This paper cites VoiceFixer: A Unified Framework for High-Fidelity Speech Restoration.

Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework VoiceFixer: A Unified Framework for High-Fidelity Speech Restoration

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-07T15:24:22.422246Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T15:24:22.422246Z digest=sha256:73ff204c1c06bc8a82e4c9b70bfca23330abe0d78545299a8d8a46ac4e4573c4

Observation c0d4e559-7390-46e5-973e-83441765a0cd · outbound

This paper cites Restoring degraded speech via a modified diffusion model.

Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework Restoring degraded speech via a modified diffusion model

Reference 10

Resolution
verified exact
local_arxiv, observed 2026-08-07T15:24:25.189243Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T15:24:22.506993Z digest=sha256:3238ab11ee4a96c69976c61fbd9a621a9bd44729d097cf6b64f05ed789d2a167

Observation 168f41e1-a52d-42d2-a2f3-dcfd9a813123 · outbound

This paper cites Universal Speech Enhancement with Score-based Diffusion.

Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework Universal Speech Enhancement with Score-based Diffusion

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-07T15:24:22.551495Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T15:24:22.551495Z digest=sha256:1ac3e8d984be5a5a0257dd0b95ea56c8aeb5483683a1c13656dcb1cb59517bf7

Observation ecc73222-b85a-40b8-a32d-41eef4d4171f · outbound

This paper cites FINALLY: fast and universal speech enhancement with studio-like quality.

Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework FINALLY: fast and universal speech enhancement with studio-like quality

Reference 12

Resolution
verified exact
local_arxiv, observed 2026-08-07T15:24:24.956265Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T15:24:22.595120Z digest=sha256:92f42426d30756a2f14f02b0507f45f8a811cb4095c1587c5d0f6c3215db79b5

Observation f6a2776d-8cb8-48ea-b963-6575972fd5dc · outbound

This paper cites CMGAN: Conformer-Based Metric-GAN for Monaural Speech Enhancement.

Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework CMGAN: Conformer-Based Metric-GAN for Monaural Speech Enhancement

Reference 13

Resolution
verified exact
local_arxiv, observed 2026-08-07T15:24:24.833347Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T15:24:22.664913Z digest=sha256:93e91c532f3e6e88b5b2ac178471550d48a38988d498d7543072fcdc2bd8652a

Observation 449aa045-d713-4463-82d9-54b4c3cdaf6e · outbound

This paper cites Two- stage single-channel audio source separation using deep neural networks,.

Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework Two- stage single-channel audio source separation using deep neural networks,

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T15:24:27.111442Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T15:24:23.046023Z digest=sha256:ed4d77c1a822145f1b299ac91af0f463882525d481edde8c6fdeee987601a2f3

Observation 76f5d8aa-36be-41a2-a075-eefd66b0920d · outbound

This paper cites Score-Based Generative Modeling through Stochastic Differential Equations.

Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework Score-Based Generative Modeling through Stochastic Differential Equations

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-07T15:24:22.767642Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T15:24:22.767642Z digest=sha256:88ac02067c26d68c65f6fdbbc32c4727b0932f35e49848b3e83d8fececcb067e

Observation 52c3fe57-b118-4237-854b-209edc23e0db · outbound

This paper cites VQMIVC: Vector Quantization and Mutual Information-Based Unsupervised Speech Representation Disentanglement for One-shot Voice Conversion.

Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework VQMIVC: Vector Quantization and Mutual Information-Based Unsupervised Speech Representation Disentanglement for One-shot Voice Conversion

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-07T15:24:22.803803Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T15:24:22.803803Z digest=sha256:15d8f57967010d141620f4af6c52573368a5315882712ac1880aa21d9bcae44b

Observation 04ea2410-5694-4ed6-b578-4f7befd03673 · outbound

This paper cites Freevc: Towards high-quality text-free one-shot voice conversion,.

Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework Freevc: Towards high-quality text-free one-shot voice conversion,

Reference 17

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T15:24:27.726614Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T15:24:22.853683Z digest=sha256:d98a6ca8476a55bd778062e66d5db710b74afaac34493db9a71857ff6cd8bfea

Observation 9a37c687-910c-47b7-96a3-ba97f3449b5d · outbound

This paper cites CycleGAN-VC3: Examining and Improving CycleGAN-VCs for Mel-spectrogram Conversion.

Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework CycleGAN-VC3: Examining and Improving CycleGAN-VCs for Mel-spectrogram Conversion

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-07T15:24:22.890912Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T15:24:22.890912Z digest=sha256:a9d513428f4c7204cdb5f075c940206f07266c1246de25f9b26abdf6da12b8e9

Observation 11e7ae7f-e3f8-4a94-9916-28918386313a · outbound

This paper cites Diffusion-based voice conversion with fast maximum likelihood sampling scheme,.

Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework Diffusion-based voice conversion with fast maximum likelihood sampling scheme,

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T15:24:27.508280Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T15:24:22.930433Z digest=sha256:ae605ee0e7e6520ae72d2a5022429b2e1028339d9e5827b1b584c008419a7543

Observation dc5ac3c9-edd4-4ddf-b437-9bbbf02b9f52 · outbound

This paper cites Speech enhancement by lstm-based noise suppression followed by cnn-based speech restoration,.

Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework Speech enhancement by lstm-based noise suppression followed by cnn-based speech restoration,

Reference 20

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T15:24:27.293814Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T15:24:22.983212Z digest=sha256:54d4981b1786a781d7082b26a15721c2c45e54d00edc2c2b6df9128ab77712d5

Observation a8a672ea-937d-4d76-a051-273f80e50ad2 · outbound

This paper cites Hifi-gan: Generative adversarial net- works for efficient and high fidelity speech synthesis,.

Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework Hifi-gan: Generative adversarial net- works for efficient and high fidelity speech synthesis,

Reference 21

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T15:24:26.644622Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T15:24:23.443858Z digest=sha256:7c0abd1163571a4e58d472861dc16710d5e73fb4ef049af4d78802d4082407c1

Observation d9f9e3f8-d4b7-4c06-af9a-b27089e6aa89 · outbound

This paper cites Convolutional neural net- works to enhance coded speech,.

Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework Convolutional neural net- works to enhance coded speech,

Reference 22

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T15:24:26.943044Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T15:24:23.108220Z digest=sha256:81fc709af782262964c60456adcd5e99ceb5862b4bb57b4b3dd8fa6fef678de5

Observation f62b338c-0107-4cc6-b12b-dfabdb1d9663 · outbound

This paper cites Separated noise suppression and speech restoration: Lstm-based speech enhancement in two stages,.

Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework Separated noise suppression and speech restoration: Lstm-based speech enhancement in two stages,

Reference 23

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T15:24:26.819823Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T15:24:23.171560Z digest=sha256:be75ff92db56667dbd61169747c0edeb4d4053daf29a3c418fbbd22449a85fd6

Observation e2ee96b1-a5d7-452b-af80-1df9acee7923 · outbound

This paper cites Audiolm: a language modeling approach to audio gener- ation,.

Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework Audiolm: a language modeling approach to audio gener- ation,

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-07T15:24:23.220621Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T15:24:23.220621Z digest=sha256:2110b3cbfcc4e74168f777c2c6f1cb13d4002ea8520125746b001bb2189a2608

Observation 948e9b85-8751-41ea-8dc3-9f93329edf9f · outbound

This paper cites Grad-tts: A diffusion probabilistic model for text-to-speech,.

Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework Grad-tts: A diffusion probabilistic model for text-to-speech,

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-07T15:24:23.247491Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T15:24:23.247491Z digest=sha256:f27b1ab3ebe41990e944922306e3022f411e19e342392733433df8f83e82650b

Observation 238381a7-18ea-4b8d-8611-0fe5751dba61 · outbound

This paper cites Hubert: Self-supervised speech representation learning by masked prediction of hidden units,.

Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework Hubert: Self-supervised speech representation learning by masked prediction of hidden units,

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-07T15:24:23.283611Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T15:24:23.283611Z digest=sha256:43b450c0b9d0cf4008b481060a4afd82bb39c34936823260e54883e17b55a266

Observation 69e04773-9f50-47fb-bcc1-e8d05e2630cb · outbound

This paper cites BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding.

Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-07T15:24:23.357042Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T15:24:23.357042Z digest=sha256:f4ab4123773843f5812538a947c07b3d43474f3eda5d5a2c6c9a2436af293a9a

Observation 1b63e3ae-a637-4382-97bf-cce29d315c07 · outbound

This paper cites Noisy speech database for training speech enhancement algorithms and tts models,.

Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework Noisy speech database for training speech enhancement algorithms and tts models,

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T15:24:25.944666Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T15:24:23.959827Z digest=sha256:556e022c2f4d1e22f5c327e9da6f0d53e98cf1ecadd3f9479004805a02ed2f98

Observation 595aaa80-1970-4219-bce3-8dcf08a770cc · outbound

This paper cites ECAPA- TDNN: emphasized channel attention, propagation and aggrega- tion in TDNN based speaker verification,.

Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework ECAPA- TDNN: emphasized channel attention, propagation and aggrega- tion in TDNN based speaker verification,

Reference 29

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T15:24:26.479520Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T15:24:23.499962Z digest=sha256:bd3f20f63e22bd70b2f47bc3549e593e55215059329546c3958895985636b949

Observation 9d45445c-5a37-4484-84a3-ddc07851ef21 · outbound

This paper cites Classifier-Free Diffusion Guidance.

Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework Classifier-Free Diffusion Guidance

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-07T15:24:23.554693Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T15:24:23.554693Z digest=sha256:346bdc3330e5f9996bf8edcd384f830158300ca985c6b4cfaf65ccdd11cd2085

Observation d29780eb-f62e-4005-bebe-0b60f34832ed · outbound

This paper cites Decoupled Weight Decay Regularization.

Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework Decoupled Weight Decay Regularization

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-07T15:24:23.627755Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T15:24:23.627755Z digest=sha256:9dda9864ca964c0d781620fa71e47e1649fe4aabdce6c72ab3df3a5f3ac5fbdf

Observation daff7fd2-010c-4bc8-8b52-1074350d98e6 · outbound

This paper cites Miipher: A ro- bust speech restoration model integrating self-supervised speech and text representations,.

Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework Miipher: A ro- bust speech restoration model integrating self-supervised speech and text representations,

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-07T15:24:23.663623Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T15:24:23.663623Z digest=sha256:7a0edae9a7be808c92fbb2ef4fdf156227912d4a07927c9a6f9a2bfb1ce18174

Observation 86ccf7ba-6279-49d9-b5db-1575ccbeaf1f · outbound

This paper cites Libritts: A corpus derived from librispeech for text- to-speech,.

Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework Libritts: A corpus derived from librispeech for text- to-speech,

Reference 33

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T15:24:26.317233Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T15:24:23.778955Z digest=sha256:91a257f2810ccabad1e0c1cf227fab5168045d489efd9980b229dded3159da8b

Observation 9693ac74-4c49-47a3-9bb6-ebc7d9e4209a · outbound

This paper cites Adam: A method for stochastic optimization,.

Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework Adam: A method for stochastic optimization,

Reference 34

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T15:24:26.151598Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T15:24:23.879800Z digest=sha256:f4c3cf72e78fa126fb6103920c14de88ffc54a909a7ba702979c94cf369d72c7

Observation 80138685-c5b6-4b02-a594-2dbcad59634c · outbound

This paper cites GSR also considers more augmentations than V oiceFixer, e.g., codec artifacts and packet drops.

Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework GSR also considers more augmentations than V oiceFixer, e.g., codec artifacts and packet drops

Reference 35

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T15:24:28.266554Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T15:24:21.952918Z digest=sha256:bf6eb88564b21fbe83b924fe53c63a6ef92dcf474ec6ada15c33f29353f39f46

Observation e32991c9-956e-4717-9904-bcfb5c82ab4c · outbound

This paper cites NISQA: A deep cnn-self-attention model for multidimensional speech quality pre- diction with crowdsourced datasets,.

Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework NISQA: A deep cnn-self-attention model for multidimensional speech quality pre- diction with crowdsourced datasets,

Reference 36

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T15:24:25.666872Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T15:24:24.074736Z digest=sha256:108ac983685f9f33dd691891509df849d0e2fd9d7c80987c1cfaf562374b38f6

Observation 02d2ecdf-7b42-454f-bf5a-b11b9ca16b58 · outbound

This paper cites UTMOS: UTokyo-SaruLab System for VoiceMOS Challenge 2022.

Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework UTMOS: UTokyo-SaruLab System for VoiceMOS Challenge 2022

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-07T15:24:24.141933Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T15:24:24.141933Z digest=sha256:0a7605dbf4cc8fef8eee36876b346d120b7af9d19c2788d94ae4ed0a95652c2b

Observation c54caa5b-da23-4656-8155-3caa319a7308 · outbound

This paper cites HiFi++: a Unified Framework for Bandwidth Extension and Speech Enhancement.

Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework HiFi++: a Unified Framework for Bandwidth Extension and Speech Enhancement

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-07T15:24:24.194361Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T15:24:24.194361Z digest=sha256:a93d52aac878edfdeb1c729b64226b417aadd761d97c5110289b9cfe7d09c453

Observation ae4a230d-17d0-4d0d-9d36-18763828a4c0 · outbound

This paper cites Dnsmos p. 835: A non-intrusive perceptual objective speech quality metric to eval- uate noise suppressors,.

Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework Dnsmos p. 835: A non-intrusive perceptual objective speech quality metric to eval- uate noise suppressors,

Reference 39

Resolution
unresolved
no resolver link, observed 2026-08-07T15:24:24.290277Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T15:24:24.290277Z digest=sha256:6f02b1689361e53660430c2db9eb12d53b85444b5752ba6bbcad2dc73b27ade2

Observation b9ff5994-36cb-4e1b-99c5-746925c04247 · outbound

This paper cites PnG BERT: Augmented BERT on Phonemes and Graphemes for Neural TTS.

Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework PnG BERT: Augmented BERT on Phonemes and Graphemes for Neural TTS

Reference 40

Resolution
unresolved
no resolver link, observed 2026-08-07T15:24:24.338422Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T15:24:24.338422Z digest=sha256:874e7c4d5ff7059c56e821c849b0936630e532aa01f2fdbd6a2f51a724aed3b8

Observation 66bcae28-1ecc-4648-a344-f288eff2b734 · outbound

This paper cites W2v-bert: Combining contrastive learning and masked language modeling for self-supervised speech pre-training,.

Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework W2v-bert: Combining contrastive learning and masked language modeling for self-supervised speech pre-training,

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-07T15:24:24.429990Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T15:24:24.429990Z digest=sha256:15b7474b6a6deaeecb7de1d29d8511c545217d1e389f1d829b7ea06bd108b5e8

Observation 4ca64674-9b80-4e8d-8312-ea47e3b5ae96 · outbound

This paper cites TFGAN: Time and Frequency Domain Based Generative Adversarial Network for High-fidelity Speech Synthesis.

Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework TFGAN: Time and Frequency Domain Based Generative Adversarial Network for High-fidelity Speech Synthesis

Reference 42

Resolution
unresolved
no resolver link, observed 2026-08-07T15:24:24.528815Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T15:24:24.528815Z digest=sha256:cec95a8eb93342db43bc2a7656d36bb4c7b731d587bea88feeb81a4023c2355d

Pith citing papers

Observation 739eb559-55db-4bc4-b6fe-362d37b08401 · inbound

Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework cites this paper.

Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework

Reference 2

Resolution
metadata mismatch
local_arxiv, observed 2026-08-07T15:24:25.382107Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T15:24:21.645147Z digest=sha256:79ac8e1da52a7e2544f833fd3f0fb753cd781afc2a75c5d7257d592b0ad260b6