{"as_of":"2026-08-23T05:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:03321383cf9e32b73c048d2c503aa5d5401627026676f0c2a6bb3f648144ca7b","coverage":[{"denominator":52,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":52,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T10:29:52.007835Z","state":"measured"},{"denominator":53,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":53,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-26T23:17:45.299833Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-03T22:49:01.370716Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-16T05:00:13.846291Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"cited_work":{"arxiv_id":"2601.09931","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.09931","snapshot_observed_at":"2026-07-03T22:49:01.370716Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","venue":"cs.SD","work_id":"038324f7-514b-459e-8ea8-196a07705068","year":2026},"citing_paper":{"arxiv_id":"2606.23712","last_updated":"2026-06-16T06:39:04Z","snapshot_observed_at":"2026-08-16T06:09:24.142701Z","submitted_at":"2026-06-16T06:39:04Z","title":"Audio-visual Contrastive Alignment for Diffusion-based Visual-conditioned Speech Enhancement","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-26T23:17:45.299833Z"},"links":{"cited_paper":"/paper/2601.09931","citing_paper":"/paper/2606.23712"},"observation_digest":"sha256:4d3fdb82b1ec1c3359e6e34f16c309e6d14e238e843ef79fdb7714923be6f67c","observation_id":"f9107a07-13aa-4db5-aaa1-dd0767c09fdb","resolution":{"observed_at":"2026-07-03T22:49:01.372695Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2601.09931/citation-record","integrity":"/paper/2601.09931/integrity","json":"/paper/2601.09931/citation-record.json","paper":"/paper/2601.09931"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:46.054080Z","title":"Supervised speech separation based on deep learning: An overview,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-16T05:00:13.846291Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:46.054080Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:383615fb71f4005ab2d80deea6082f5cd702f1ab1e80179ff35cc50d05a42630","observation_id":"663f5268-a6b4-454b-81d1-912b6864d606","resolution":{"observed_at":"2026-08-03T10:29:46.054080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:46.132548Z","title":"Conv-TasNet: Surpassing ideal time–frequency magnitude masking for speech separation,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-16T05:00:13.846291Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:46.132548Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:297b1b9b297e0c60338e0acf9335122a2a7734ea9eba008146b87a6f08be3f84","observation_id":"c207fc2b-2b91-44d3-adc0-000d8310378a","resolution":{"observed_at":"2026-08-03T10:29:46.132548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:46.346973Z","title":"TF- GridNet: Making time-frequency domain models great again for monaural speaker separation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-16T05:00:13.846291Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:46.346973Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:ffc241353aea4cb65645a5047329a5686b00a7b223db3d15776e7c2faf800633","observation_id":"9b82016b-28ee-4ecf-8133-42e5961d620b","resolution":{"observed_at":"2026-08-03T10:29:46.346973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:46.371321Z","title":"TF-CrossNet: Leveraging global, cross-band, narrow-band, and positional encoding for single- and multi-channel speaker separation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-16T05:00:13.846291Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:46.371321Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:d2c22e5523dd1a1968d7dbaba678c718cd8773c754ab492d4a641240f8122a0f","observation_id":"9ef97742-9bbd-48cb-833d-37016d945a95","resolution":{"observed_at":"2026-08-03T10:29:46.371321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:46.445021Z","title":"SEGAN: Speech enhancement generative adversarial network,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-16T05:00:13.846291Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:46.445021Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:0fd4c00ec8734b113f9cd8ffe392f900e2561cb0d1c583ef5e11230f3695cea4","observation_id":"adff0aca-9e62-4493-8b29-6c0872f2fa3a","resolution":{"observed_at":"2026-08-03T10:29:46.445021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:46.522170Z","title":"Conditional diffusion probabilistic model for speech enhancement,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-16T05:00:13.846291Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:46.522170Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:d8d25a10c94144ff8edd0ccdec5807d35b6301ddb669da2876b2b3c4ef0d31a0","observation_id":"ac2cf64e-4f1b-4684-abf9-2f98264c5cf2","resolution":{"observed_at":"2026-08-03T10:29:46.522170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:46.590769Z","title":"StoRM: A diffusion-based stochastic regeneration model for speech enhancement and dereverberation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-16T05:00:13.846291Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:46.590769Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:de9d2cd9ac4b358a12b07d77c65a957fe2f8b1440d0382aeecdb530952e7e709","observation_id":"36774dac-a60f-4dae-b6a7-89b965032054","resolution":{"observed_at":"2026-08-03T10:29:46.590769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:46.728488Z","title":"A composite predictive-generative approach to monaural universal speech enhancement,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-16T05:00:13.846291Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:46.728488Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:398b9d52bfb71b8a504db7c21b425d3d45a3909e0d14091218bc12f2d980b9b4","observation_id":"e3c93030-2603-42b8-b75f-5e35c1fce79c","resolution":{"observed_at":"2026-08-03T10:29:46.728488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:46.809486Z","title":"GAN-based speech enhancement for low snr using latent feature conditioning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-16T05:00:13.846291Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:46.809486Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:472536e712763b3edcee41d7e04ee2730ae1bcac0143aebeb229866efd547d1c","observation_id":"e4c051cc-0180-4ec5-a50e-6ab5323e1490","resolution":{"observed_at":"2026-08-03T10:29:46.809486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:46.992303Z","title":"Improving deep speech denoising by noisy2noisy signal mapping,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-16T05:00:13.846291Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:46.992303Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:abfe0b4d0b5f0c8a3fc34be99811ea8b206c0842469be8b5dd362a47e87641aa","observation_id":"c22645ca-d22d-4f47-be5b-b35f29500dde","resolution":{"observed_at":"2026-08-03T10:29:46.992303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:47.156804Z","title":"Analysis of noisy-target training for DNN-based speech enhancement,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-16T05:00:13.846291Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:47.156804Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:ff9b6517b9ff501d6bb6d2fb12b581725ccb08910eb193820dc3581d82701f05","observation_id":"011dba21-2477-4b49-a131-b74a14bb064f","resolution":{"observed_at":"2026-08-03T10:29:47.156804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:47.271580Z","title":"Unsupervised sound separation using mixture invariant training,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-16T05:00:13.846291Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:47.271580Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:0473985e7401cf3d20815a989f64d2c0d51d98a8813f2dd9ba89547ca93a3bf1","observation_id":"af3a3e24-d2d9-4867-8468-99ee421d294c","resolution":{"observed_at":"2026-08-03T10:29:47.271580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:47.429312Z","title":"RemixIT: Continual self-training of speech enhancement models via boot- strapped remixing,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-16T05:00:13.846291Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:47.429312Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:7af7a2888f339f3504121db2b63e7f6d6b699de262609fe0e9a8497f96d5ad05","observation_id":"da5f590a-37d2-43d0-8343-09d445295ccc","resolution":{"observed_at":"2026-08-03T10:29:47.429312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:47.540467Z","title":"Self-supervised speech denoising using only noisy audio signals,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-16T05:00:13.846291Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:47.540467Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:20a757cd311495356fbf3e3499cafff2ec605eb1b19984181d6ecca2195715e1","observation_id":"7f7e4077-549a-4fd1-8e2c-0eb7f92026cb","resolution":{"observed_at":"2026-08-03T10:29:47.540467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:47.662628Z","title":"A parallel-data-free speech enhancement method using multi-objective learning cycle-consistent generative adversarial network,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-16T05:00:13.846291Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:47.662628Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:cf67307966415e906f67cb5528658dd6f7d9a25931e9dbe9c5ba8ed3c86296e8","observation_id":"56535acc-bb6b-4359-b83d-9f1f4d71d65f","resolution":{"observed_at":"2026-08-03T10:29:47.662628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:47.820490Z","title":"MetricGAN- U: Unsupervised speech enhancement/dereverberation based only on noisy/reverberated speech,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-16T05:00:13.846291Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:47.820490Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:ea9e461a7c8f94acdf445ef102b764d7d6b0179a1f17509ec5533d6adfa98c9c","observation_id":"925b11ee-bdb6-4650-95d6-186aa947331a","resolution":{"observed_at":"2026-08-03T10:29:47.820490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:47.969825Z","title":"Statistical speech enhancement based on probabilistic integration of variational autoen- coder and non-negative matrix factorization,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-16T05:00:13.846291Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:47.969825Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:1fb74953e8fba9b9af803e986f66aa66700c9b01d3334d9d4fa8b130897da8ab","observation_id":"130569a8-bb11-4c82-9a56-1fc9ac960322","resolution":{"observed_at":"2026-08-03T10:29:47.969825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:48.122680Z","title":"Unsupervised speech enhancement using dynamical variational autoencoders,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-16T05:00:13.846291Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:48.122680Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:03da439e13829f41b7acc781b4e81ec45baac8850bec2e064e5cfcd499d41646","observation_id":"d848a438-bd05-4e98-ae11-21aaa2cadfaf","resolution":{"observed_at":"2026-08-03T10:29:48.122680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:48.240363Z","title":"Unsupervised speech enhancement with diffusion-based generative models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-16T05:00:13.846291Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:48.240363Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:6253e85d197be5aefe35370a938c8c4ddf5c7fcf7922bcba95e47f2a0d718e1d","observation_id":"92487dda-0993-4a8b-aad5-54a19f995015","resolution":{"observed_at":"2026-08-03T10:29:48.240363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:48.346958Z","title":"Diffusion- based unsupervised audio-visual speech enhancement,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-16T05:00:13.846291Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:48.346958Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:12d2d4d298901eb6ad7106e69828aa3306d815bcefe6b8985911fbe1d062737e","observation_id":"650304c2-52d1-434f-a032-328b912af4a9","resolution":{"observed_at":"2026-08-03T10:29:48.346958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:48.460810Z","title":"Posterior transition modeling for unsupervised diffusion-based speech enhancement,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-16T05:00:13.846291Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:48.460810Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:4a0463bc9c2f54720aeca372175a571521d6fd27e87e515c0b1c1fdeb664d7ff","observation_id":"db0e63bd-7d6b-4141-b73d-4f247d3cb185","resolution":{"observed_at":"2026-08-03T10:29:48.460810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:48.601764Z","title":"Diffusion models for audio restoration: A review,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-16T05:00:13.846291Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:48.601764Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:37eee27112837500409ccb415c4b0f1c01e0cb45ebd562c159dc58582af2d9c2","observation_id":"76084337-5199-4bae-918b-e76cb10caa34","resolution":{"observed_at":"2026-08-03T10:29:48.601764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00083","last_updated":"2024-09-30T17:34:01Z","snapshot_observed_at":"2026-07-06T19:24:48.032228Z","submitted_at":"2024-09-30T17:34:01Z","title":"A Survey on Diffusion Models for Inverse Problems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.00083","snapshot_observed_at":"2026-08-03T10:29:48.698417Z","title":"A survey on diffusion models for inverse problems,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-16T05:00:13.846291Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:48.698417Z"},"links":{"cited_paper":"/paper/2410.00083","citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:2cb918397eff5cb1230080f91677f8a339a651f9be3276b0f80a852d1cd28364","observation_id":"4b8cd1ba-e0bb-45de-8662-38b41a5e48b1","resolution":{"observed_at":"2026-08-03T10:29:48.698417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:48.868529Z","title":"Parallel diffusion models of operator and image for blind inverse problems,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-16T05:00:13.846291Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:48.868529Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:48f879730d801ada2ad42864939c64de2555a0765f1029c207fd77e505b2e85e","observation_id":"56b9794a-7f86-4357-a04a-9da25366a5c0","resolution":{"observed_at":"2026-08-03T10:29:48.868529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:48.979821Z","title":"Diffusion-based unsuper- vised audio-visual speech separation in noisy environments with noise prior,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-16T05:00:13.846291Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:48.979821Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:1e95b183e3b26a1200ce1906fc1906c437482e8f7a7a63712b035c373dfe0cf7","observation_id":"f4ac0303-e0e9-4585-a3c1-5b658f73f6fc","resolution":{"observed_at":"2026-08-03T10:29:48.979821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:49.074014Z","title":"Multi-source diffusion models for simultaneous music generation and sepa- ration,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-16T05:00:13.846291Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:49.074014Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:d4ce967629bf8ddca422b043f40161d9ba715863cf70a0d01e1da59e364a9bb4","observation_id":"095e644e-1538-4fe9-ae95-bb20dde71a81","resolution":{"observed_at":"2026-08-03T10:29:49.074014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:49.195659Z","title":"A recurrent variational autoencoder for speech enhancement,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-16T05:00:13.846291Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:49.195659Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:deabe72193c49f91aedf79db314c698955154f0bac95358f129ebb50d2ed5c3d","observation_id":"fe0f2543-2b10-48c5-9a02-4beff7c76f74","resolution":{"observed_at":"2026-08-03T10:29:49.195659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:49.396160Z","title":"Investigating RNN- based speech enhancement methods for noise-robust text-to-speech,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-16T05:00:13.846291Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:49.396160Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:f418e6958c4e86e28f28db514e0d93c856a81b3dff2fba78c86cb008c7e76739","observation_id":"52341dd8-0735-422a-8bd1-0a2393ac90b5","resolution":{"observed_at":"2026-08-03T10:29:49.396160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:49.521935Z","title":"A connection between score matching and denoising autoen- coders,","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-16T05:00:13.846291Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:49.521935Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:9cd83d991bed5116d9bfae53578d74443cd1d8883944e20acc9eb0313593ef78","observation_id":"97e3003c-536f-4034-81f9-17d93022d75c","resolution":{"observed_at":"2026-08-03T10:29:49.521935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:49.632171Z","title":"Generative modeling by estimating gradients of the data distribution,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-16T05:00:13.846291Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:49.632171Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:3768e5e402a1754c0812cef288a4444444908ecd7082123a2802bb1a80852390","observation_id":"c3dcaa5d-eeb0-48ac-a830-d7f8c9639337","resolution":{"observed_at":"2026-08-03T10:29:49.632171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:49.758395Z","title":"Score-based generative modeling through stochastic differential equations,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-16T05:00:13.846291Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:49.758395Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:b6cd653a40298a8d15afec67662ecb86be3e0a236e828ebb4f01cb74dac1bc62","observation_id":"a6c6e3fc-53a2-4265-8b3a-73cacfe352b4","resolution":{"observed_at":"2026-08-03T10:29:49.758395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:49.881354Z","title":"Speech enhancement and dereverberation with diffusion-based generative models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-16T05:00:13.846291Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:49.881354Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:a4daaafc7cdd5e547bc938fb62eb24a8cf0361c34e32e939ee88fbbe5053e11f","observation_id":"e62547e6-42a2-48cd-bf2d-18de358f272f","resolution":{"observed_at":"2026-08-03T10:29:49.881354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:49.970531Z","title":"Solving inverse problems in medical imaging with score-based generative models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-16T05:00:13.846291Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:49.970531Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:7c1cc9a2ef3eb67dcec99ab59e966c7d0ca96abcafc39e3dd1a078f1781540ec","observation_id":"db330aaa-0ff0-4b3b-b124-3dc3391f1a1d","resolution":{"observed_at":"2026-08-03T10:29:49.970531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:50.050617Z","title":"Tweedie’s formula and selection bias,","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-16T05:00:13.846291Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:50.050617Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:b099068bddd48d2502d448fb9155d34bcc9581e660d80db2976941d97cc86b23","observation_id":"6b2c3c18-90f0-456f-924f-3d1b2eeee005","resolution":{"observed_at":"2026-08-03T10:29:50.050617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:50.105514Z","title":"Vincent, T","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-16T05:00:13.846291Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:50.105514Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:e794be1c1979fec9719731b8bdee5791cc85cd64d340df6838c6fe65f9699a5c","observation_id":"28419408-5dd8-4caa-b65b-e91771f0b0c0","resolution":{"observed_at":"2026-08-03T10:29:50.105514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:50.264726Z","title":"Nonnegative matrix factorization with the itakura-saito divergence: With application to music analysis,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-16T05:00:13.846291Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:50.264726Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:310dbe9da34b998ec68721be2a2ef18242447063a987d6d28cde6a9c64cf8ed9","observation_id":"c1f444a2-72dc-4d33-b116-0ff0e2287849","resolution":{"observed_at":"2026-08-03T10:29:50.264726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:50.482659Z","title":"Diffusion model based posterior sampling for noisy linear inverse problems,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-16T05:00:13.846291Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:50.482659Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:5b936e6ab8418fccf6a64f0716fd5b4e5b61e23a699a3633c170ed169fe8b1fe","observation_id":"88e4633c-241d-4c1d-826e-eb67a5dcfa4c","resolution":{"observed_at":"2026-08-03T10:29:50.482659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:50.641902Z","title":"Diffusion posterior sampling for general noisy inverse problems,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-16T05:00:13.846291Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:50.641902Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:71d8180feb5c357d6ce09971379ddd5b94285a3163af32529d75444d6452c0c5","observation_id":"348150bd-6ab7-4eba-8cc4-65abda5c80f8","resolution":{"observed_at":"2026-08-03T10:29:50.641902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:50.817436Z","title":"CSR-I (WSJ0) complete LDC93S6B,","venue":null,"work_id":null,"year":1993},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-16T05:00:13.846291Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:50.817436Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:e809df37c3353768537883f2a7836705ec39e4885aa12bd260c5f567f089cfc1","observation_id":"803f51d3-1508-481f-8167-6e996c426a39","resolution":{"observed_at":"2026-08-03T10:29:50.817436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:50.981106Z","title":"The voice bank corpus: Design, collection and data analysis of a large regional accent speech database,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-16T05:00:13.846291Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:50.981106Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:5646bdef12705314fde0a147ca71960f0f1a9c1e63c17f16025f2947467fd3c7","observation_id":"cd7e3209-06c4-496f-aa44-42e22c04ed0e","resolution":{"observed_at":"2026-08-03T10:29:50.981106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:51.150702Z","title":"The QUT-NOISE-SRE protocol for the evaluation of noisy speaker recognition,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-16T05:00:13.846291Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:51.150702Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:2f149597c57d006ccac7e54c5478aaf82cf583292d9da9c903387208d821d1b7","observation_id":"fe4d8429-0cf1-4eea-881d-70e6d3692bde","resolution":{"observed_at":"2026-08-03T10:29:51.150702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:51.245684Z","title":"The diverse environments multi- channel acoustic noise database (DEMAND): A database of multichannel environmental noise recordings,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-16T05:00:13.846291Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:51.245684Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:4fcee5f74d3d8d3e54538f676c2e343e5ebc0b2d21b95af1e0ff0832db89c4c0","observation_id":"8589b014-cd9f-43b5-bbb3-5d82c617e1ab","resolution":{"observed_at":"2026-08-03T10:29:51.245684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:51.316446Z","title":"Objective measurement of active speech level,","venue":null,"work_id":null,"year":1993},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-16T05:00:13.846291Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:51.316446Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:b197e1c1f45e075fa4b8e8404bf1d3dbf9728ca2434ec95b6c456af97ab93520","observation_id":"075b66f7-79ab-4396-8503-6a72eec231d7","resolution":{"observed_at":"2026-08-03T10:29:51.316446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:51.385846Z","title":"Algorithms to measure audio pro- gramme loudness and true-peak audio level,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-16T05:00:13.846291Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:51.385846Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:18abca6e492a9dfb2d4aeffb456aca395630414ed7c03c754d65c6e58293b532","observation_id":"951fff6c-87a9-4907-a15f-12c04856cd1a","resolution":{"observed_at":"2026-08-03T10:29:51.385846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:51.439659Z","title":"SDR–half-baked or well done?,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-16T05:00:13.846291Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:51.439659Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:f386252417afc36f2d4e000422113917131169736897007b4ae92925db92b325","observation_id":"eccd053b-a2a5-4a37-8d77-b269cb16895c","resolution":{"observed_at":"2026-08-03T10:29:51.439659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:51.531823Z","title":"An algorithm for predicting the intelligibility of speech masked by modulated noise maskers,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-16T05:00:13.846291Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:51.531823Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:7d9fd9a0c4d8ee947b38103922f9688ee4c0abbb7d992c3e624d4f591a629713","observation_id":"22093f00-df50-4d20-b345-bc502ee47f8a","resolution":{"observed_at":"2026-08-03T10:29:51.531823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:51.597060Z","title":"Perceptual evaluation of speech quality (PESQ)-a new method for speech quality assess- ment of telephone networks and codecs,","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-16T05:00:13.846291Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:51.597060Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:50c36aa6abb53e2abe9bd871f82d44b73df2f7e31667a4d3775ccf918df7e7d4","observation_id":"78b34de6-cd4f-4344-808f-a67941941195","resolution":{"observed_at":"2026-08-03T10:29:51.597060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:51.692602Z","title":"DNSMOS P. 835: A non-intrusive perceptual objective speech quality metric to evaluate noise suppressors,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-16T05:00:13.846291Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:51.692602Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:ac2ff44f141f5501b53fc892481ee370695659156288d1edac838a9c9f8caf70","observation_id":"b23c5985-f460-47a0-8158-81db09813da8","resolution":{"observed_at":"2026-08-03T10:29:51.692602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:51.748863Z","title":"FiLM: Visual reasoning with a general conditioning layer,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-16T05:00:13.846291Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:51.748863Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:a646beb76138cccfc7cbe7f7257321b6a10e59f2045b70e60ea900f35a758203","observation_id":"31d5a461-73c6-4389-8a82-6a14ef078a8a","resolution":{"observed_at":"2026-08-03T10:29:51.748863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:51.823762Z","title":"Objective and subjective evaluation of speech enhancement methods in the udase task of the 7th chime challenge,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-16T05:00:13.846291Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:51.823762Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:2365f40afabc57e6a4e7a13078ec1b640dff37f8f206b48e646740fed071fc76","observation_id":"32ba2505-f2de-455a-a58e-9ce1a77a3cbb","resolution":{"observed_at":"2026-08-03T10:29:51.823762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:51.936584Z","title":"Sudo rm-rf: Efficient networks for universal audio source separation,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-16T05:00:13.846291Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:51.936584Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:0901dee6d9c688029f76dbc17f52369e97ecee18aabe28c638bf44668dbdbcad","observation_id":"3cf71137-459b-4206-9faa-0b66e020b862","resolution":{"observed_at":"2026-08-03T10:29:51.936584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:52.007835Z","title":"Masked spectrogram prediction for unsupervised domain adaptation in speech enhancement,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-16T05:00:13.846291Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:52.007835Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:394442c123fd482477264c3d2eb5d6c39836f4618fa57de179fed14ef7065231","observation_id":"45030ebc-d7e8-4426-b424-ca67ffac0dfb","resolution":{"observed_at":"2026-08-03T10:29:52.007835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","latest_version":4,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-16T05:00:13.846291Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement"},"reference_resolution":{"displayed":52,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":52,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":52},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 52 of 52 outbound references and 1 inbound Pith citation observation for arXiv:2601.09931."}