{"as_of":"2026-08-21T14:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:36ba7fc3b781f14196c419c4bfdf197e695ce8e5bd0a0585a52ae3399ada35a8","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:24:24.528815Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:24:21.645147Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T15:24:25.302486Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.15254","last_updated":"2025-05-21T08:33:47Z","snapshot_observed_at":"2026-08-10T16:59:44.169468Z","submitted_at":"2025-05-21T08:33:47Z","title":"Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework","version":1},"cited_work":{"arxiv_id":"2505.15254","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.15254","snapshot_observed_at":"2026-08-07T15:24:25.302486Z","title":"Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework","venue":"cs.SD","work_id":"50a28cf2-d870-4dc1-a779-b47111cfe205","year":2025},"citing_paper":{"arxiv_id":"2505.15254","last_updated":"2025-05-21T08:33:47Z","snapshot_observed_at":"2026-08-10T16:59:44.169468Z","submitted_at":"2025-05-21T08:33:47Z","title":"Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:24:21.645147Z"},"links":{"cited_paper":"/paper/2505.15254","citing_paper":"/paper/2505.15254"},"observation_digest":"sha256:79ac8e1da52a7e2544f833fd3f0fb753cd781afc2a75c5d7257d592b0ad260b6","observation_id":"739eb559-55db-4bc4-b6fe-362d37b08401","resolution":{"observed_at":"2026-08-07T15:24:25.382107Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.15254/citation-record","integrity":"/paper/2505.15254/integrity","json":"/paper/2505.15254/citation-record.json","paper":"/paper/2505.15254"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:24:28.623505Z","title":null,"venue":null,"work_id":"6f774c32-72f9-4c4d-929c-a26ef8c8243e","year":null},"citing_paper":{"arxiv_id":"2505.15254","last_updated":"2025-05-21T08:33:47Z","snapshot_observed_at":"2026-08-10T16:59:44.169468Z","submitted_at":"2025-05-21T08:33:47Z","title":"Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:24:21.592509Z"},"links":{"citing_paper":"/paper/2505.15254"},"observation_digest":"sha256:6f65c4410de6ad1015fe07fbdd78232f324f73934a37245a63dee898b2ef245b","observation_id":"cf087736-2735-47a1-b437-5c8e2fc18376","resolution":{"observed_at":"2026-08-07T15:24:28.768999Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15254","last_updated":"2025-05-21T08:33:47Z","snapshot_observed_at":"2026-08-10T16:59:44.169468Z","submitted_at":"2025-05-21T08:33:47Z","title":"Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework","version":1},"cited_work":{"arxiv_id":"2505.15254","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.15254","snapshot_observed_at":"2026-08-07T15:24:25.302486Z","title":"Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework","venue":"cs.SD","work_id":"50a28cf2-d870-4dc1-a779-b47111cfe205","year":2025},"citing_paper":{"arxiv_id":"2505.15254","last_updated":"2025-05-21T08:33:47Z","snapshot_observed_at":"2026-08-10T16:59:44.169468Z","submitted_at":"2025-05-21T08:33:47Z","title":"Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:24:21.645147Z"},"links":{"cited_paper":"/paper/2505.15254","citing_paper":"/paper/2505.15254"},"observation_digest":"sha256:79ac8e1da52a7e2544f833fd3f0fb753cd781afc2a75c5d7257d592b0ad260b6","observation_id":"739eb559-55db-4bc4-b6fe-362d37b08401","resolution":{"observed_at":"2026-08-07T15:24:25.382107Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:24:28.486112Z","title":null,"venue":null,"work_id":"5f6cae88-f1ed-4e1a-a0ec-71512272ddff","year":2000},"citing_paper":{"arxiv_id":"2505.15254","last_updated":"2025-05-21T08:33:47Z","snapshot_observed_at":"2026-08-10T16:59:44.169468Z","submitted_at":"2025-05-21T08:33:47Z","title":"Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T15:24:21.706540Z"},"links":{"citing_paper":"/paper/2505.15254"},"observation_digest":"sha256:2e62d6149e5b1fdaabdf7f9e360560423dd334cf3db41f2e4cc0cef756d4fc86","observation_id":"3b458b3c-c2d2-444f-a788-5d90e96bcc73","resolution":{"observed_at":"2026-08-07T15:24:28.540931Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:24:28.338268Z","title":null,"venue":null,"work_id":"25e4e577-f6f5-4504-8e59-e5bcf61cdce7","year":null},"citing_paper":{"arxiv_id":"2505.15254","last_updated":"2025-05-21T08:33:47Z","snapshot_observed_at":"2026-08-10T16:59:44.169468Z","submitted_at":"2025-05-21T08:33:47Z","title":"Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T15:24:21.839348Z"},"links":{"citing_paper":"/paper/2505.15254"},"observation_digest":"sha256:8f24e0e5ef08654584550984e71cb2ca2926313fbe8f85578253d5119a1cf9dd","observation_id":"6b58dbbc-975a-4f32-b24e-2c88c9c94247","resolution":{"observed_at":"2026-08-07T15:24:28.409163Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:24:27.819866Z","title":"Our method leverages a two- stage approach, incorporating a generative speech restoration (GSR) model at the front end, followed by a VC module","venue":null,"work_id":"bcab70b6-ff69-47d7-a89f-3c9f640bb897","year":null},"citing_paper":{"arxiv_id":"2505.15254","last_updated":"2025-05-21T08:33:47Z","snapshot_observed_at":"2026-08-10T16:59:44.169468Z","submitted_at":"2025-05-21T08:33:47Z","title":"Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T15:24:22.180588Z"},"links":{"citing_paper":"/paper/2505.15254"},"observation_digest":"sha256:d0c439e49cf32a110caa4d47764dd3a87acbdb343e0c4524cfe6d063d5993da5","observation_id":"3d7325ca-42ef-4987-8cb8-4c904f188c29","resolution":{"observed_at":"2026-08-07T15:24:27.892749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:24:28.001197Z","title":null,"venue":null,"work_id":"dc940e7e-38ed-4f2d-b51f-a6274effa75a","year":null},"citing_paper":{"arxiv_id":"2505.15254","last_updated":"2025-05-21T08:33:47Z","snapshot_observed_at":"2026-08-10T16:59:44.169468Z","submitted_at":"2025-05-21T08:33:47Z","title":"Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T15:24:22.046375Z"},"links":{"citing_paper":"/paper/2505.15254"},"observation_digest":"sha256:7993b14516d086ef64af61922b434e8f09db39582c0c7dbe25531e9b526d4319","observation_id":"2806e5d1-524d-4fda-8706-7480ed954839","resolution":{"observed_at":"2026-08-07T15:24:28.097586Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:24:22.724970Z","title":"Generative adver- sarial networks,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.15254","last_updated":"2025-05-21T08:33:47Z","snapshot_observed_at":"2026-08-10T16:59:44.169468Z","submitted_at":"2025-05-21T08:33:47Z","title":"Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T15:24:22.724970Z"},"links":{"citing_paper":"/paper/2505.15254"},"observation_digest":"sha256:957478f16010ca05d5e0f9422e3f11143ccc6f15a9a010a0514bdaae1ff0a9cb","observation_id":"09c3a2ce-dab3-422f-928b-df6787cddf98","resolution":{"observed_at":"2026-08-07T15:24:22.724970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:24:22.317887Z","title":"Supervised speech separation based on deep learning: An overview,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.15254","last_updated":"2025-05-21T08:33:47Z","snapshot_observed_at":"2026-08-10T16:59:44.169468Z","submitted_at":"2025-05-21T08:33:47Z","title":"Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:24:22.317887Z"},"links":{"citing_paper":"/paper/2505.15254"},"observation_digest":"sha256:ef5de1960640d76964362ee1e902212fdd732f4ca1d79de22d9929de07dd1e1c","observation_id":"d145baae-5426-4c5c-bbbd-ceb6a99f3ed5","resolution":{"observed_at":"2026-08-07T15:24:22.317887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05841","last_updated":"2022-04-17T10:08:38Z","snapshot_observed_at":"2026-08-18T09:59:38.988103Z","submitted_at":"2022-04-12T14:37:39Z","title":"VoiceFixer: A Unified Framework for High-Fidelity Speech Restoration","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05841","snapshot_observed_at":"2026-08-07T15:24:22.422246Z","title":"V oicefixer: A unified framework for high-fidelity speech restoration,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.15254","last_updated":"2025-05-21T08:33:47Z","snapshot_observed_at":"2026-08-10T16:59:44.169468Z","submitted_at":"2025-05-21T08:33:47Z","title":"Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T15:24:22.422246Z"},"links":{"cited_paper":"/paper/2204.05841","citing_paper":"/paper/2505.15254"},"observation_digest":"sha256:73ff204c1c06bc8a82e4c9b70bfca23330abe0d78545299a8d8a46ac4e4573c4","observation_id":"b49c0e73-e7f6-4f22-9983-ee956116b6d4","resolution":{"observed_at":"2026-08-07T15:24:22.422246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.11347","last_updated":"2021-09-02T16:56:20Z","snapshot_observed_at":"2026-08-16T18:29:38.047477Z","submitted_at":"2021-04-22T23:03:23Z","title":"Restoring degraded speech via a modified diffusion model","version":2},"cited_work":{"arxiv_id":"2104.11347","doi":null,"metadata_source":"pith","pith_arxiv_id":"2104.11347","snapshot_observed_at":"2026-08-07T15:24:25.098056Z","title":"Restoring degraded speech via a modified diffusion model","venue":"cs.SD","work_id":"a9670b0d-2ec7-4f49-af83-a9bea7b36ef9","year":2021},"citing_paper":{"arxiv_id":"2505.15254","last_updated":"2025-05-21T08:33:47Z","snapshot_observed_at":"2026-08-10T16:59:44.169468Z","submitted_at":"2025-05-21T08:33:47Z","title":"Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T15:24:22.506993Z"},"links":{"cited_paper":"/paper/2104.11347","citing_paper":"/paper/2505.15254"},"observation_digest":"sha256:3238ab11ee4a96c69976c61fbd9a621a9bd44729d097cf6b64f05ed789d2a167","observation_id":"c0d4e559-7390-46e5-973e-83441765a0cd","resolution":{"observed_at":"2026-08-07T15:24:25.189243Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.03065","last_updated":"2022-09-16T10:27:27Z","snapshot_observed_at":"2026-08-16T16:54:50.395014Z","submitted_at":"2022-06-07T07:32:32Z","title":"Universal Speech Enhancement with Score-based Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.03065","snapshot_observed_at":"2026-08-07T15:24:22.551495Z","title":"Universal speech enhancement with score-based diffusion,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.15254","last_updated":"2025-05-21T08:33:47Z","snapshot_observed_at":"2026-08-10T16:59:44.169468Z","submitted_at":"2025-05-21T08:33:47Z","title":"Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T15:24:22.551495Z"},"links":{"cited_paper":"/paper/2206.03065","citing_paper":"/paper/2505.15254"},"observation_digest":"sha256:1ac3e8d984be5a5a0257dd0b95ea56c8aeb5483683a1c13656dcb1cb59517bf7","observation_id":"168f41e1-a52d-42d2-a2f3-dcfd9a813123","resolution":{"observed_at":"2026-08-07T15:24:22.551495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05920","last_updated":"2024-10-31T08:47:01Z","snapshot_observed_at":"2026-08-18T19:51:01.127660Z","submitted_at":"2024-10-08T11:16:03Z","title":"FINALLY: fast and universal speech enhancement with studio-like quality","version":3},"cited_work":{"arxiv_id":"2410.05920","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.05920","snapshot_observed_at":"2026-08-07T15:24:24.893712Z","title":"FINALLY: fast and universal speech enhancement with studio-like quality","venue":"cs.SD","work_id":"14e65939-b07c-4c29-b44b-cb5c0139a3c2","year":2024},"citing_paper":{"arxiv_id":"2505.15254","last_updated":"2025-05-21T08:33:47Z","snapshot_observed_at":"2026-08-10T16:59:44.169468Z","submitted_at":"2025-05-21T08:33:47Z","title":"Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T15:24:22.595120Z"},"links":{"cited_paper":"/paper/2410.05920","citing_paper":"/paper/2505.15254"},"observation_digest":"sha256:92f42426d30756a2f14f02b0507f45f8a811cb4095c1587c5d0f6c3215db79b5","observation_id":"ecc73222-b85a-40b8-a32d-41eef4d4171f","resolution":{"observed_at":"2026-08-07T15:24:24.956265Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.11112","last_updated":"2024-05-03T21:38:45Z","snapshot_observed_at":"2026-08-16T16:30:34.393802Z","submitted_at":"2022-09-22T15:50:21Z","title":"CMGAN: Conformer-Based Metric-GAN for Monaural Speech Enhancement","version":3},"cited_work":{"arxiv_id":"2209.11112","doi":null,"metadata_source":"pith","pith_arxiv_id":"2209.11112","snapshot_observed_at":"2026-08-07T15:24:24.809467Z","title":"CMGAN: Conformer-Based Metric-GAN for Monaural Speech Enhancement","venue":"cs.SD","work_id":"a538ccd1-b02b-49e3-9962-8def074a38ad","year":2022},"citing_paper":{"arxiv_id":"2505.15254","last_updated":"2025-05-21T08:33:47Z","snapshot_observed_at":"2026-08-10T16:59:44.169468Z","submitted_at":"2025-05-21T08:33:47Z","title":"Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T15:24:22.664913Z"},"links":{"cited_paper":"/paper/2209.11112","citing_paper":"/paper/2505.15254"},"observation_digest":"sha256:93e91c532f3e6e88b5b2ac178471550d48a38988d498d7543072fcdc2bd8652a","observation_id":"f6a2776d-8cb8-48ea-b963-6575972fd5dc","resolution":{"observed_at":"2026-08-07T15:24:24.833347Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:24:27.022369Z","title":"Two- stage single-channel audio source separation using deep neural networks,","venue":null,"work_id":"4fa18865-27d9-4cca-b882-b263bcb43adc","year":2017},"citing_paper":{"arxiv_id":"2505.15254","last_updated":"2025-05-21T08:33:47Z","snapshot_observed_at":"2026-08-10T16:59:44.169468Z","submitted_at":"2025-05-21T08:33:47Z","title":"Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:24:23.046023Z"},"links":{"citing_paper":"/paper/2505.15254"},"observation_digest":"sha256:ed4d77c1a822145f1b299ac91af0f463882525d481edde8c6fdeee987601a2f3","observation_id":"449aa045-d713-4463-82d9-54b4c3cdaf6e","resolution":{"observed_at":"2026-08-07T15:24:27.111442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.13456","last_updated":"2021-02-10T18:17:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-11-26T19:39:10Z","title":"Score-Based Generative Modeling through Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.13456","snapshot_observed_at":"2026-08-07T15:24:22.767642Z","title":"Score-based generative modeling through stochas- tic differential equations,","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2505.15254","last_updated":"2025-05-21T08:33:47Z","snapshot_observed_at":"2026-08-10T16:59:44.169468Z","submitted_at":"2025-05-21T08:33:47Z","title":"Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T15:24:22.767642Z"},"links":{"cited_paper":"/paper/2011.13456","citing_paper":"/paper/2505.15254"},"observation_digest":"sha256:88ac02067c26d68c65f6fdbbc32c4727b0932f35e49848b3e83d8fececcb067e","observation_id":"76f5d8aa-36be-41a2-a075-eefd66b0920d","resolution":{"observed_at":"2026-08-07T15:24:22.767642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.10132","last_updated":"2021-06-18T13:50:38Z","snapshot_observed_at":"2026-08-20T03:20:54.483992Z","submitted_at":"2021-06-18T13:50:38Z","title":"VQMIVC: Vector Quantization and Mutual Information-Based Unsupervised Speech Representation Disentanglement for One-shot Voice Conversion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.10132","snapshot_observed_at":"2026-08-07T15:24:22.803803Z","title":"Vqmivc: Vector quantization and mutual information-based un- supervised speech representation disentanglement for one-shot voice conversion,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.15254","last_updated":"2025-05-21T08:33:47Z","snapshot_observed_at":"2026-08-10T16:59:44.169468Z","submitted_at":"2025-05-21T08:33:47Z","title":"Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T15:24:22.803803Z"},"links":{"cited_paper":"/paper/2106.10132","citing_paper":"/paper/2505.15254"},"observation_digest":"sha256:15d8f57967010d141620f4af6c52573368a5315882712ac1880aa21d9bcae44b","observation_id":"52c3fe57-b118-4237-854b-209edc23e0db","resolution":{"observed_at":"2026-08-07T15:24:22.803803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:24:27.622545Z","title":"Freevc: Towards high-quality text-free one-shot voice conversion,","venue":null,"work_id":"c08cd938-a439-40d8-8ed8-44a3ba2cdba5","year":2023},"citing_paper":{"arxiv_id":"2505.15254","last_updated":"2025-05-21T08:33:47Z","snapshot_observed_at":"2026-08-10T16:59:44.169468Z","submitted_at":"2025-05-21T08:33:47Z","title":"Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T15:24:22.853683Z"},"links":{"citing_paper":"/paper/2505.15254"},"observation_digest":"sha256:d98a6ca8476a55bd778062e66d5db710b74afaac34493db9a71857ff6cd8bfea","observation_id":"04ea2410-5694-4ed6-b578-4f7befd03673","resolution":{"observed_at":"2026-08-07T15:24:27.726614Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11672","last_updated":"2020-10-22T13:08:44Z","snapshot_observed_at":"2026-08-20T22:01:11.654369Z","submitted_at":"2020-10-22T13:08:44Z","title":"CycleGAN-VC3: Examining and Improving CycleGAN-VCs for Mel-spectrogram Conversion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11672","snapshot_observed_at":"2026-08-07T15:24:22.890912Z","title":"Cyclegan- vc3: Examining and improving cyclegan-vcs for mel-spectrogram conversion,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2505.15254","last_updated":"2025-05-21T08:33:47Z","snapshot_observed_at":"2026-08-10T16:59:44.169468Z","submitted_at":"2025-05-21T08:33:47Z","title":"Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T15:24:22.890912Z"},"links":{"cited_paper":"/paper/2010.11672","citing_paper":"/paper/2505.15254"},"observation_digest":"sha256:a9d513428f4c7204cdb5f075c940206f07266c1246de25f9b26abdf6da12b8e9","observation_id":"9a37c687-910c-47b7-96a3-ba97f3449b5d","resolution":{"observed_at":"2026-08-07T15:24:22.890912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:24:27.394400Z","title":"Diffusion-based voice conversion with fast maximum likelihood sampling scheme,","venue":null,"work_id":"149544c2-78a1-4b36-929d-5fe3b9b9c71b","year":2022},"citing_paper":{"arxiv_id":"2505.15254","last_updated":"2025-05-21T08:33:47Z","snapshot_observed_at":"2026-08-10T16:59:44.169468Z","submitted_at":"2025-05-21T08:33:47Z","title":"Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T15:24:22.930433Z"},"links":{"citing_paper":"/paper/2505.15254"},"observation_digest":"sha256:ae605ee0e7e6520ae72d2a5022429b2e1028339d9e5827b1b584c008419a7543","observation_id":"11e7ae7f-e3f8-4a94-9916-28918386313a","resolution":{"observed_at":"2026-08-07T15:24:27.508280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:24:27.191421Z","title":"Speech enhancement by lstm-based noise suppression followed by cnn-based speech restoration,","venue":null,"work_id":"5bf5aa60-eb6e-43c2-b47b-a41f2445b375","year":2020},"citing_paper":{"arxiv_id":"2505.15254","last_updated":"2025-05-21T08:33:47Z","snapshot_observed_at":"2026-08-10T16:59:44.169468Z","submitted_at":"2025-05-21T08:33:47Z","title":"Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T15:24:22.983212Z"},"links":{"citing_paper":"/paper/2505.15254"},"observation_digest":"sha256:54d4981b1786a781d7082b26a15721c2c45e54d00edc2c2b6df9128ab77712d5","observation_id":"dc5ac3c9-edd4-4ddf-b437-9bbbf02b9f52","resolution":{"observed_at":"2026-08-07T15:24:27.293814Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:24:26.552515Z","title":"Hifi-gan: Generative adversarial net- works for efficient and high fidelity speech synthesis,","venue":null,"work_id":"c409b2ee-6b71-4d57-bf07-77ade55313ba","year":2020},"citing_paper":{"arxiv_id":"2505.15254","last_updated":"2025-05-21T08:33:47Z","snapshot_observed_at":"2026-08-10T16:59:44.169468Z","submitted_at":"2025-05-21T08:33:47Z","title":"Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T15:24:23.443858Z"},"links":{"citing_paper":"/paper/2505.15254"},"observation_digest":"sha256:7c0abd1163571a4e58d472861dc16710d5e73fb4ef049af4d78802d4082407c1","observation_id":"a8a672ea-937d-4d76-a051-273f80e50ad2","resolution":{"observed_at":"2026-08-07T15:24:26.644622Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:24:26.894440Z","title":"Convolutional neural net- works to enhance coded speech,","venue":null,"work_id":"c9b5421d-9af0-4c59-9118-db1cf29ab354","year":2018},"citing_paper":{"arxiv_id":"2505.15254","last_updated":"2025-05-21T08:33:47Z","snapshot_observed_at":"2026-08-10T16:59:44.169468Z","submitted_at":"2025-05-21T08:33:47Z","title":"Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T15:24:23.108220Z"},"links":{"citing_paper":"/paper/2505.15254"},"observation_digest":"sha256:81fc709af782262964c60456adcd5e99ceb5862b4bb57b4b3dd8fa6fef678de5","observation_id":"d9f9e3f8-d4b7-4c06-af9a-b27089e6aa89","resolution":{"observed_at":"2026-08-07T15:24:26.943044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:24:26.771339Z","title":"Separated noise suppression and speech restoration: Lstm-based speech enhancement in two stages,","venue":null,"work_id":"c7904a00-8add-4501-aaa0-c2f5d378611e","year":2019},"citing_paper":{"arxiv_id":"2505.15254","last_updated":"2025-05-21T08:33:47Z","snapshot_observed_at":"2026-08-10T16:59:44.169468Z","submitted_at":"2025-05-21T08:33:47Z","title":"Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T15:24:23.171560Z"},"links":{"citing_paper":"/paper/2505.15254"},"observation_digest":"sha256:be75ff92db56667dbd61169747c0edeb4d4053daf29a3c418fbbd22449a85fd6","observation_id":"f62b338c-0107-4cc6-b12b-dfabdb1d9663","resolution":{"observed_at":"2026-08-07T15:24:26.819823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:24:23.220621Z","title":"Audiolm: a language modeling approach to audio gener- ation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15254","last_updated":"2025-05-21T08:33:47Z","snapshot_observed_at":"2026-08-10T16:59:44.169468Z","submitted_at":"2025-05-21T08:33:47Z","title":"Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T15:24:23.220621Z"},"links":{"citing_paper":"/paper/2505.15254"},"observation_digest":"sha256:2110b3cbfcc4e74168f777c2c6f1cb13d4002ea8520125746b001bb2189a2608","observation_id":"e2ee96b1-a5d7-452b-af80-1df9acee7923","resolution":{"observed_at":"2026-08-07T15:24:23.220621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:24:23.247491Z","title":"Grad-tts: A diffusion probabilistic model for text-to-speech,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.15254","last_updated":"2025-05-21T08:33:47Z","snapshot_observed_at":"2026-08-10T16:59:44.169468Z","submitted_at":"2025-05-21T08:33:47Z","title":"Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T15:24:23.247491Z"},"links":{"citing_paper":"/paper/2505.15254"},"observation_digest":"sha256:f27b1ab3ebe41990e944922306e3022f411e19e342392733433df8f83e82650b","observation_id":"948e9b85-8751-41ea-8dc3-9f93329edf9f","resolution":{"observed_at":"2026-08-07T15:24:23.247491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:24:23.283611Z","title":"Hubert: Self-supervised speech representation learning by masked prediction of hidden units,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.15254","last_updated":"2025-05-21T08:33:47Z","snapshot_observed_at":"2026-08-10T16:59:44.169468Z","submitted_at":"2025-05-21T08:33:47Z","title":"Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T15:24:23.283611Z"},"links":{"citing_paper":"/paper/2505.15254"},"observation_digest":"sha256:43b450c0b9d0cf4008b481060a4afd82bb39c34936823260e54883e17b55a266","observation_id":"238381a7-18ea-4b8d-8611-0fe5751dba61","resolution":{"observed_at":"2026-08-07T15:24:23.283611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-08-14T18:16:28.847993Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-07T15:24:23.357042Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.15254","last_updated":"2025-05-21T08:33:47Z","snapshot_observed_at":"2026-08-10T16:59:44.169468Z","submitted_at":"2025-05-21T08:33:47Z","title":"Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T15:24:23.357042Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2505.15254"},"observation_digest":"sha256:f4ab4123773843f5812538a947c07b3d43474f3eda5d5a2c6c9a2436af293a9a","observation_id":"69e04773-9f50-47fb-bcc1-e8d05e2630cb","resolution":{"observed_at":"2026-08-07T15:24:23.357042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:24:25.824311Z","title":"Noisy speech database for training speech enhancement algorithms and tts models,","venue":null,"work_id":"a8996b38-f3c6-4483-ab7d-06e808c6190f","year":2017},"citing_paper":{"arxiv_id":"2505.15254","last_updated":"2025-05-21T08:33:47Z","snapshot_observed_at":"2026-08-10T16:59:44.169468Z","submitted_at":"2025-05-21T08:33:47Z","title":"Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T15:24:23.959827Z"},"links":{"citing_paper":"/paper/2505.15254"},"observation_digest":"sha256:556e022c2f4d1e22f5c327e9da6f0d53e98cf1ecadd3f9479004805a02ed2f98","observation_id":"1b63e3ae-a637-4382-97bf-cce29d315c07","resolution":{"observed_at":"2026-08-07T15:24:25.944666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:24:26.398757Z","title":"ECAPA- TDNN: emphasized channel attention, propagation and aggrega- tion in TDNN based speaker verification,","venue":null,"work_id":"4f7e0eda-3d6a-4ac1-b22c-1febde5f1d01","year":2020},"citing_paper":{"arxiv_id":"2505.15254","last_updated":"2025-05-21T08:33:47Z","snapshot_observed_at":"2026-08-10T16:59:44.169468Z","submitted_at":"2025-05-21T08:33:47Z","title":"Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T15:24:23.499962Z"},"links":{"citing_paper":"/paper/2505.15254"},"observation_digest":"sha256:bd3f20f63e22bd70b2f47bc3549e593e55215059329546c3958895985636b949","observation_id":"595aaa80-1970-4219-bce3-8dcf08a770cc","resolution":{"observed_at":"2026-08-07T15:24:26.479520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-08-14T06:37:15.299690Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-07T15:24:23.554693Z","title":"Classifier-free diffusion guidance,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.15254","last_updated":"2025-05-21T08:33:47Z","snapshot_observed_at":"2026-08-10T16:59:44.169468Z","submitted_at":"2025-05-21T08:33:47Z","title":"Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T15:24:23.554693Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2505.15254"},"observation_digest":"sha256:346bdc3330e5f9996bf8edcd384f830158300ca985c6b4cfaf65ccdd11cd2085","observation_id":"9d45445c-5a37-4484-84a3-ddc07851ef21","resolution":{"observed_at":"2026-08-07T15:24:23.554693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-14T20:13:52.872565Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-07T15:24:23.627755Z","title":"Decoupled weight decay regularization,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.15254","last_updated":"2025-05-21T08:33:47Z","snapshot_observed_at":"2026-08-10T16:59:44.169468Z","submitted_at":"2025-05-21T08:33:47Z","title":"Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T15:24:23.627755Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2505.15254"},"observation_digest":"sha256:9dda9864ca964c0d781620fa71e47e1649fe4aabdce6c72ab3df3a5f3ac5fbdf","observation_id":"d29780eb-f62e-4005-bebe-0b60f34832ed","resolution":{"observed_at":"2026-08-07T15:24:23.627755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:24:23.663623Z","title":"Miipher: A ro- bust speech restoration model integrating self-supervised speech and text representations,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15254","last_updated":"2025-05-21T08:33:47Z","snapshot_observed_at":"2026-08-10T16:59:44.169468Z","submitted_at":"2025-05-21T08:33:47Z","title":"Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T15:24:23.663623Z"},"links":{"citing_paper":"/paper/2505.15254"},"observation_digest":"sha256:7a0edae9a7be808c92fbb2ef4fdf156227912d4a07927c9a6f9a2bfb1ce18174","observation_id":"daff7fd2-010c-4bc8-8b52-1074350d98e6","resolution":{"observed_at":"2026-08-07T15:24:23.663623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:24:26.230150Z","title":"Libritts: A corpus derived from librispeech for text- to-speech,","venue":null,"work_id":"1f853c9d-63fe-4d34-9255-b43982bd9b0a","year":2019},"citing_paper":{"arxiv_id":"2505.15254","last_updated":"2025-05-21T08:33:47Z","snapshot_observed_at":"2026-08-10T16:59:44.169468Z","submitted_at":"2025-05-21T08:33:47Z","title":"Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T15:24:23.778955Z"},"links":{"citing_paper":"/paper/2505.15254"},"observation_digest":"sha256:91a257f2810ccabad1e0c1cf227fab5168045d489efd9980b229dded3159da8b","observation_id":"86ccf7ba-6279-49d9-b5db-1575ccbeaf1f","resolution":{"observed_at":"2026-08-07T15:24:26.317233Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:24:26.061880Z","title":"Adam: A method for stochastic optimization,","venue":null,"work_id":"da363225-d643-4c3f-8185-46a670c3cb40","year":2014},"citing_paper":{"arxiv_id":"2505.15254","last_updated":"2025-05-21T08:33:47Z","snapshot_observed_at":"2026-08-10T16:59:44.169468Z","submitted_at":"2025-05-21T08:33:47Z","title":"Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T15:24:23.879800Z"},"links":{"citing_paper":"/paper/2505.15254"},"observation_digest":"sha256:f4c3cf72e78fa126fb6103920c14de88ffc54a909a7ba702979c94cf369d72c7","observation_id":"9693ac74-4c49-47a3-9bb6-ebc7d9e4209a","resolution":{"observed_at":"2026-08-07T15:24:26.151598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:24:28.181611Z","title":"GSR also considers more augmentations than V oiceFixer, e.g., codec artifacts and packet drops","venue":null,"work_id":"2b816d6b-a539-42fb-9356-3671c4d4cd59","year":null},"citing_paper":{"arxiv_id":"2505.15254","last_updated":"2025-05-21T08:33:47Z","snapshot_observed_at":"2026-08-10T16:59:44.169468Z","submitted_at":"2025-05-21T08:33:47Z","title":"Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T15:24:21.952918Z"},"links":{"citing_paper":"/paper/2505.15254"},"observation_digest":"sha256:bf6eb88564b21fbe83b924fe53c63a6ef92dcf474ec6ada15c33f29353f39f46","observation_id":"80138685-c5b6-4b02-a594-2dbcad59634c","resolution":{"observed_at":"2026-08-07T15:24:28.266554Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:24:25.530131Z","title":"NISQA: A deep cnn-self-attention model for multidimensional speech quality pre- diction with crowdsourced datasets,","venue":null,"work_id":"c812dddb-152e-4424-8cc3-3ca788a752c2","year":2021},"citing_paper":{"arxiv_id":"2505.15254","last_updated":"2025-05-21T08:33:47Z","snapshot_observed_at":"2026-08-10T16:59:44.169468Z","submitted_at":"2025-05-21T08:33:47Z","title":"Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T15:24:24.074736Z"},"links":{"citing_paper":"/paper/2505.15254"},"observation_digest":"sha256:108ac983685f9f33dd691891509df849d0e2fd9d7c80987c1cfaf562374b38f6","observation_id":"e32991c9-956e-4717-9904-bcfb5c82ab4c","resolution":{"observed_at":"2026-08-07T15:24:25.666872Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.02152","last_updated":"2022-06-29T13:42:05Z","snapshot_observed_at":"2026-08-20T05:06:38.014724Z","submitted_at":"2022-04-05T12:23:51Z","title":"UTMOS: UTokyo-SaruLab System for VoiceMOS Challenge 2022","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.02152","snapshot_observed_at":"2026-08-07T15:24:24.141933Z","title":"Utmos: Utokyo-sarulab system for voicemos challenge 2022,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.15254","last_updated":"2025-05-21T08:33:47Z","snapshot_observed_at":"2026-08-10T16:59:44.169468Z","submitted_at":"2025-05-21T08:33:47Z","title":"Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T15:24:24.141933Z"},"links":{"cited_paper":"/paper/2204.02152","citing_paper":"/paper/2505.15254"},"observation_digest":"sha256:0a7605dbf4cc8fef8eee36876b346d120b7af9d19c2788d94ae4ed0a95652c2b","observation_id":"02d2ecdf-7b42-454f-bf5a-b11b9ca16b58","resolution":{"observed_at":"2026-08-07T15:24:24.141933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.13086","last_updated":"2023-12-10T13:52:10Z","snapshot_observed_at":"2026-08-16T17:12:04.691282Z","submitted_at":"2022-03-24T14:25:51Z","title":"HiFi++: a Unified Framework for Bandwidth Extension and Speech Enhancement","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.13086","snapshot_observed_at":"2026-08-07T15:24:24.194361Z","title":"Hifi++: a unified framework for neural vocoding, bandwidth extension and speech enhancement,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.15254","last_updated":"2025-05-21T08:33:47Z","snapshot_observed_at":"2026-08-10T16:59:44.169468Z","submitted_at":"2025-05-21T08:33:47Z","title":"Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T15:24:24.194361Z"},"links":{"cited_paper":"/paper/2203.13086","citing_paper":"/paper/2505.15254"},"observation_digest":"sha256:a93d52aac878edfdeb1c729b64226b417aadd761d97c5110289b9cfe7d09c453","observation_id":"c54caa5b-da23-4656-8155-3caa319a7308","resolution":{"observed_at":"2026-08-07T15:24:24.194361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:24:24.290277Z","title":"Dnsmos p. 835: A non-intrusive perceptual objective speech quality metric to eval- uate noise suppressors,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.15254","last_updated":"2025-05-21T08:33:47Z","snapshot_observed_at":"2026-08-10T16:59:44.169468Z","submitted_at":"2025-05-21T08:33:47Z","title":"Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T15:24:24.290277Z"},"links":{"citing_paper":"/paper/2505.15254"},"observation_digest":"sha256:6f02b1689361e53660430c2db9eb12d53b85444b5752ba6bbcad2dc73b27ade2","observation_id":"ae4a230d-17d0-4d0d-9d36-18763828a4c0","resolution":{"observed_at":"2026-08-07T15:24:24.290277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.15060","last_updated":"2021-06-07T04:24:51Z","snapshot_observed_at":"2026-08-16T18:35:49.486709Z","submitted_at":"2021-03-28T06:24:00Z","title":"PnG BERT: Augmented BERT on Phonemes and Graphemes for Neural TTS","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.15060","snapshot_observed_at":"2026-08-07T15:24:24.338422Z","title":"Png bert: Aug- mented bert on phonemes and graphemes for neural tts,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.15254","last_updated":"2025-05-21T08:33:47Z","snapshot_observed_at":"2026-08-10T16:59:44.169468Z","submitted_at":"2025-05-21T08:33:47Z","title":"Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T15:24:24.338422Z"},"links":{"cited_paper":"/paper/2103.15060","citing_paper":"/paper/2505.15254"},"observation_digest":"sha256:874e7c4d5ff7059c56e821c849b0936630e532aa01f2fdbd6a2f51a724aed3b8","observation_id":"b9ff5994-36cb-4e1b-99c5-746925c04247","resolution":{"observed_at":"2026-08-07T15:24:24.338422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:24:24.429990Z","title":"W2v-bert: Combining contrastive learning and masked language modeling for self-supervised speech pre-training,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.15254","last_updated":"2025-05-21T08:33:47Z","snapshot_observed_at":"2026-08-10T16:59:44.169468Z","submitted_at":"2025-05-21T08:33:47Z","title":"Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T15:24:24.429990Z"},"links":{"citing_paper":"/paper/2505.15254"},"observation_digest":"sha256:15b7474b6a6deaeecb7de1d29d8511c545217d1e389f1d829b7ea06bd108b5e8","observation_id":"66bcae28-1ecc-4648-a344-f288eff2b734","resolution":{"observed_at":"2026-08-07T15:24:24.429990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.12206","last_updated":"2020-11-24T16:55:48Z","snapshot_observed_at":"2026-08-16T19:03:36.112844Z","submitted_at":"2020-11-24T16:55:48Z","title":"TFGAN: Time and Frequency Domain Based Generative Adversarial Network for High-fidelity Speech Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.12206","snapshot_observed_at":"2026-08-07T15:24:24.528815Z","title":"Tfgan: Time and frequency domain based generative adversar- ial network for high-fidelity speech synthesis,","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2505.15254","last_updated":"2025-05-21T08:33:47Z","snapshot_observed_at":"2026-08-10T16:59:44.169468Z","submitted_at":"2025-05-21T08:33:47Z","title":"Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T15:24:24.528815Z"},"links":{"cited_paper":"/paper/2011.12206","citing_paper":"/paper/2505.15254"},"observation_digest":"sha256:cec95a8eb93342db43bc2a7656d36bb4c7b731d587bea88feeb81a4023c2355d","observation_id":"4ca64674-9b80-4e8d-8312-ea47e3b5ae96","resolution":{"observed_at":"2026-08-07T15:24:24.528815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.15254","last_updated":"2025-05-21T08:33:47Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-10T16:59:44.169468Z","submitted_at":"2025-05-21T08:33:47Z","title":"Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":24,"verified_exact":3,"verified_fuzzy":14},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 1 inbound Pith citation observation for arXiv:2505.15254."}