{"as_of":"2026-08-11T03:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b3050ef57453e7014ab545ba42927f459299a1a1f1ccb5f991717092eeb0662d","coverage":[{"denominator":83,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":83,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:24:14.488006Z","state":"measured"},{"denominator":83,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":83,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.24576/citation-record","integrity":"/paper/2505.24576/integrity","json":"/paper/2505.24576/citation-record.json","paper":"/paper/2505.24576"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:05.320283Z","title":"Speech en- hancement and recognition using multi-task learning of long short-term memory recurrent neural networks,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:05.320283Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:2b2b4300b2f9e030307a8b8382078d1f782f5d955129b6dbfa03c892e3349080","observation_id":"716356ac-dce1-4229-a302-bf7d2a6b2a6f","resolution":{"observed_at":"2026-08-07T12:24:05.320283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:05.416221Z","title":"Design of matrix Wiener filter for noise reduction and speech enhancement in hearing aids,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:05.416221Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:e01073284e334f47330db1e7dc10ac414c782a181cf0d0ba8600be65923c13d3","observation_id":"62598bbe-3409-4f44-bb53-30fcd5f25149","resolution":{"observed_at":"2026-08-07T12:24:05.416221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:05.533821Z","title":"Real-time speech enhancement using an efficient convolutional recurrent network for dual-microphone mobile phones in close-talk scenarios,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:05.533821Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:b96aef96bde8970a9546d659b6699a48942ef606db1965ce785734d6024fd8c3","observation_id":"2e66ba0d-f28c-45d0-aad0-653a66b329f6","resolution":{"observed_at":"2026-08-07T12:24:05.533821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:25.172274Z","title":"Towards efficient models for real-time deep noise suppression,","venue":null,"work_id":"63ae63d1-1dfd-4bed-b691-7549fdae8051","year":2021},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:05.617113Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:d9721b36bbe16d3807860836a867dbfbbd9015cf7ce814854b17be30ec06c91b","observation_id":"46ba6a5f-de3c-424a-854e-4c268fbc1bd1","resolution":{"observed_at":"2026-08-07T12:24:25.245825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:25.041396Z","title":"Speech dereverberation with frequency domain autoregressive modeling,","venue":null,"work_id":"fd5146ac-6351-48e1-acb8-48cdcdd94f66","year":2024},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:05.701661Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:b8a9847fb87956113855c89c926f94c861e363b679e480ae7a4496b91022ca1c","observation_id":"249ed92b-9bd7-4a6c-9b54-edc34e93a742","resolution":{"observed_at":"2026-08-07T12:24:25.120141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:24.884911Z","title":"Towards robust speech super-resolution,","venue":null,"work_id":"c0b1e147-fd48-4dd6-9fb2-078569bea5ed","year":2021},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:05.782624Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:dd8fc999f3d5299482f3973327c63a79297a5c8486af611ae30fe09831ef6564","observation_id":"6993f4ea-a360-47bf-b4a9-1cb3581fe9e8","resolution":{"observed_at":"2026-08-07T12:24:24.960601Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:24.782476Z","title":"Towards generalized speech en- hancement with generative adversarial networks,","venue":null,"work_id":"73a33416-bdba-477e-b95b-bdade200f29a","year":2019},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:05.847042Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:02d82bd4c6d54270418da548a3bf844750343fa4aa464b9f6a1a2d3d865ea172","observation_id":"dc98e143-e3e9-4587-a1e5-3193e1bbdd4a","resolution":{"observed_at":"2026-08-07T12:24:24.828371Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:24.577594Z","title":"Cascaded time + time-frequency unet for speech enhancement: Jointly addressing clipping, codec distortions, and gaps,","venue":null,"work_id":"5865e943-8055-4a70-9b66-f88d3f326e4c","year":2021},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:05.947781Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:022080e58208ab068773039508d9b4069b41f3c0cedc8f7d27a82a22c7e12b6c","observation_id":"08e94d8c-a003-45ca-a6e6-37eba284a952","resolution":{"observed_at":"2026-08-07T12:24:24.698350Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.03065","last_updated":"2022-09-16T10:27:27Z","snapshot_observed_at":"2026-08-09T14:32:30.515268Z","submitted_at":"2022-06-07T07:32:32Z","title":"Universal Speech Enhancement with Score-based Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.03065","snapshot_observed_at":"2026-08-07T12:24:06.031442Z","title":"Univer- sal speech enhancement with score-based diffusion,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:06.031442Z"},"links":{"cited_paper":"/paper/2206.03065","citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:67f49112935791e85d77003df8983f006ba00fc3f0dae5acffb8ed348bd0f2f7","observation_id":"ff7ed7c1-d1f2-4b2a-bc02-fb077aceb2c2","resolution":{"observed_at":"2026-08-07T12:24:06.031442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:24.455837Z","title":"Universal score- based speech enhancement with high content preservation,","venue":null,"work_id":"20d5b6ae-260f-4bd0-97fb-d4993fbdaf14","year":2024},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:06.167411Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:444b0aab52d255a8c42d51370d8414334e3455a202cec742081f0508cafa3c68","observation_id":"ef1052c3-dfb5-4117-85ec-480935b3bf63","resolution":{"observed_at":"2026-08-07T12:24:24.490341Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:24.243350Z","title":"SDW-SWF: Speech distortion weighted single-channel Wiener filter for noise reduction,","venue":null,"work_id":"62de92bf-2e4b-4df7-80b7-77759c19a6a7","year":2023},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:06.265926Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:dc90601525e872015025c35a03fe22e99d7d07c33ea76c1a46ee00b120a5ede7","observation_id":"f8ff8762-09a2-4b2a-b197-1957f6ccf1cd","resolution":{"observed_at":"2026-08-07T12:24:24.356752Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:24.042777Z","title":"Supervised speech separation based on deep learning: An overview,","venue":null,"work_id":"cfeac3ef-ea65-4127-909b-3d7944d824d0","year":2018},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:06.363099Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:28e64c27e7b709d68af73f7d00a16ce3478c1d12e15fd2ca51d2e84d74687958","observation_id":"eae5353b-a5ab-4de0-9778-92b00a7e98ff","resolution":{"observed_at":"2026-08-07T12:24:24.135690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:23.839799Z","title":"The unimportance of phase in speech enhance- ment,","venue":null,"work_id":"aac715cf-7c4e-4408-a205-12814b7d6302","year":1982},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:06.462253Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:0a3efac38644c1901903567e31a25aac702ae8adbaf44593ce2e830d3024fab4","observation_id":"7aa6e7a1-b29a-483b-bc55-07633f11ad57","resolution":{"observed_at":"2026-08-07T12:24:23.932866Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:23.599422Z","title":"STFT phase reconstruction in voiced speech for an improved single-channel speech enhancement,","venue":null,"work_id":"2694d292-96b2-4dee-bdd2-41634423e77d","year":1931},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:06.533448Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:8c4179fc0fd94b7af0d9afa6528eff5af3589800d39c278f25106fb21c131cb8","observation_id":"d946e870-f974-453f-a175-ee110b30f3e3","resolution":{"observed_at":"2026-08-07T12:24:23.699382Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:23.384138Z","title":"Complex ratio masking for monaural speech separation,","venue":null,"work_id":"3367cd29-16e9-4058-b347-fa8de94b4cb6","year":2016},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:06.642175Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:6bfe82444f27e40aaa6f14dc6e2e24efe70c15c341bf07a98bf72b313f368c3c","observation_id":"593aa040-7cf0-4663-b505-41e5633e148b","resolution":{"observed_at":"2026-08-07T12:24:23.480376Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:23.152225Z","title":"Complex spectrogram enhancement by convolutional neural network with multi-metrics learn- ing,","venue":null,"work_id":"ed203a2a-8751-4d11-98bc-7bd5ae3fdcf5","year":2017},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:06.720459Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:f0c3fbf25b69459ed9590da9bc24e3b05cb96821b9d56ce4e83d5f89dfbee51e","observation_id":"d3c75c57-9514-4b70-96f6-be5719ff4de3","resolution":{"observed_at":"2026-08-07T12:24:23.282431Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:22.922262Z","title":"On the compensation between magnitude and phase in speech separation,","venue":null,"work_id":"3ba028c3-c2f5-4454-9b1b-d47c7d1868c5","year":2018},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:06.799550Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:f850e9e05f5fd005ead1c32f7f00c7b7e2a6539ffc4b1ba4c193698b751c4fcb","observation_id":"9c80430d-9df9-479a-bc89-7b26e3261923","resolution":{"observed_at":"2026-08-07T12:24:23.035880Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:22.707727Z","title":"CMGAN: Conformer-based metric-gan for monaural speech enhancement,","venue":null,"work_id":"ad9a8a3a-8999-4b38-aa9c-038f4d505e05","year":2024},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:06.877982Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:db1f08b359319f3fc2d1b02521e9f0721d4de1681b1bd35c7e342f139d421c43","observation_id":"10f5013e-3d1b-4d2c-8017-df727aa974ec","resolution":{"observed_at":"2026-08-07T12:24:22.773303Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:22.269963Z","title":"SEGAN: Speech enhancement generative adversarial network,","venue":null,"work_id":"d377c633-a462-4f61-a643-4d4c5ba65ad8","year":2017},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:06.964042Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:a6a3cb619fd74393e936f50c63c586f29c3502d1aed963f77ec696839feced92","observation_id":"d05ca07b-b95c-481e-8424-84d7b2396224","resolution":{"observed_at":"2026-08-07T12:24:22.495067Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:22.134816Z","title":"SE-Conformer: Time-domain speech enhancement using conformer,","venue":null,"work_id":"779577c5-b95e-4c9f-8338-f3f9eea00220","year":2021},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:07.038338Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:025e3a94cefac87d2f79b26aab70a4ea53058e2505d92ae27d37b9202a43b8f9","observation_id":"a10c51fe-51fc-4b33-b83c-367c99f82d7f","resolution":{"observed_at":"2026-08-07T12:24:22.194680Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:21.982879Z","title":"WSRGlow: A glow- based waveform generative model for audio super-resolution,","venue":null,"work_id":"b1643c7d-2f8b-431f-827b-23aac373a2d4","year":2021},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:07.141993Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:7bc032b37ce9d1d8947af579c585ef82ce442d84c92156bc698decdece413c7e","observation_id":"5b35036e-2211-4302-a5a0-699487118354","resolution":{"observed_at":"2026-08-07T12:24:22.062519Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:21.896816Z","title":"Auto-encoding variational Bayes,","venue":null,"work_id":"c7fc598f-f249-47cd-aaf5-cebf9380d342","year":2014},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:07.216191Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:1db5d4619f2c95fc75db9a4ee9c16b3d81a93fc2a96410b500b1aeab31ee945f","observation_id":"ffc1f071-626b-4856-93ad-07c3747f5b74","resolution":{"observed_at":"2026-08-07T12:24:21.929041Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:21.824962Z","title":"Generative adversarial nets,","venue":null,"work_id":"9a658b23-afe3-4190-8d46-22d0dae217b0","year":2014},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:07.299353Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:bf70edf20c1eddd3552d9739d9b28af5eeca7f302310874b998c1014fe059ba8","observation_id":"00af0251-0d56-4d00-9914-228b15820ea0","resolution":{"observed_at":"2026-08-07T12:24:21.854984Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:21.724735Z","title":"Variational inference with normalizing flows,","venue":null,"work_id":"2f2d4bf2-7030-4d2e-bad0-50c8cb83fa0d","year":2015},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:07.389136Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:3b8cb3c912bb510fb482bbd4ddb22889ada10d62a88bee13a8ec9c67c3848ea6","observation_id":"167f40c3-a57c-456b-8d41-a557f860f1cf","resolution":{"observed_at":"2026-08-07T12:24:21.760844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:21.641129Z","title":"Deep unsupervised learning using nonequilibrium thermodynamics,","venue":null,"work_id":"e3c5836f-eb30-41e3-8427-b5878a79506e","year":2015},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:07.501204Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:cbf23ccc1e4af2b9c73f6b17d2f48b51701cfe58a072e6b0f9d83099bedd5314","observation_id":"46f82160-a371-4091-863b-1506a109d80b","resolution":{"observed_at":"2026-08-07T12:24:21.677254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:21.559366Z","title":"Denoising diffusion probabilistic models,","venue":null,"work_id":"f6069857-5f6b-45bc-be55-02b2a8d8fdc5","year":2020},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:07.597158Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:39f52befd53ee1a729a12fed30816e9b39e860637add156a6d5398e7db8b9dd0","observation_id":"c798cd8b-5231-4839-bc93-f51bdc40c5f2","resolution":{"observed_at":"2026-08-07T12:24:21.594820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:21.489104Z","title":"High- resolution image synthesis with latent diffusion models,","venue":null,"work_id":"bc7fdd0f-7c0c-48f4-9965-a5cb53801114","year":2022},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:07.690027Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:7ec8f2624d3f53be8acee5a5f30043704619123a03287feaffef09b6378adfeb","observation_id":"71421055-5139-4eb8-8b8c-1cc9ad662620","resolution":{"observed_at":"2026-08-07T12:24:21.509062Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:21.387016Z","title":"Diffusion models beat GANs on image synthesis,","venue":null,"work_id":"f9f44e1d-95df-4c6f-b304-b2e0489e4736","year":2021},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:07.784924Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:4e70f4fffcd92deb9fd7fc26093bd7c6c2a58a0ac21711db6a4f6cb133c86a1e","observation_id":"7d48cf85-4982-4034-a6de-64381423c383","resolution":{"observed_at":"2026-08-07T12:24:21.431910Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:21.316589Z","title":"Conditional diffusion probabilistic model for speech enhancement,","venue":null,"work_id":"785ef1f2-bbd3-429d-95ee-744432769963","year":2022},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:07.891117Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:df0e3d0ff16831170962e56193f17fe6121e687b53760f7619aafc9a1bc723e7","observation_id":"db91a5cc-d604-492f-8c73-cbd2db6795c9","resolution":{"observed_at":"2026-08-07T12:24:21.347699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:21.250290Z","title":"Speech enhancement with score-based generative models in the complex STFT domain,","venue":null,"work_id":"db4f73a8-151b-49e1-baf3-24cc15d5d383","year":2022},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:07.988798Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:9d8bb192ec824ac6a262883929507f1d9a5d3a458f209f0dbf2f49606ffedf97","observation_id":"11eaf220-643a-4cd9-8a78-94731403a563","resolution":{"observed_at":"2026-08-07T12:24:21.276603Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:21.188712Z","title":"Speech enhancement and dereverberation with diffusion-based genera- tive models,","venue":null,"work_id":"4aae3e14-3c5f-4267-b68b-0c3c1802d624","year":2023},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:08.250031Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:7c55381608dc8ff30e214e7b6a0169d5755ed740dae9ae67f08d0ca62b16edda","observation_id":"48970a6e-8cc8-4e79-b7a9-2687dba3f732","resolution":{"observed_at":"2026-08-07T12:24:21.211424Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:21.100597Z","title":"StoRM: A diffusion-based stochastic regeneration model for speech enhancement and dereverberation,","venue":null,"work_id":"020ec3dc-c9f9-4c15-8f9e-2a3a8ec74bce","year":2023},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:08.642509Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:b1b516027ecaa9d360de5fd64af2ac2a00ba7fca58089a863e51a2265eb8ae5d","observation_id":"71787c70-8afe-460f-800b-cda0559d45e9","resolution":{"observed_at":"2026-08-07T12:24:21.130705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:08.846064Z","title":"Score-based generative modeling through stochastic differ- ential equations,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:08.846064Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:3ac30f97df2f9a92427231b20ecdb902b089276ab746e35fa8b888ead5d2493f","observation_id":"b46871ce-56d1-4769-8fca-cde1c2771ab0","resolution":{"observed_at":"2026-08-07T12:24:08.846064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:21.027625Z","title":"Estimation of non-normalized statistical models by score matching,","venue":null,"work_id":"3faa73d1-4ef1-4fc4-bf43-92ea6d23d839","year":2005},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:08.998766Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:58d460e2ec8cda51c56dfc8ffe3a5ed5dd91ebf2896371f4efd705649d37ec10","observation_id":"20dd84bd-05e3-4102-bf29-3aeed8371020","resolution":{"observed_at":"2026-08-07T12:24:21.053168Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:20.981519Z","title":"SRTNet: Time domain speech enhancement via stochastic refinement,","venue":null,"work_id":"28241c54-20cc-4d92-8462-aa02705824d2","year":2023},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:09.148479Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:85120c7551c5f9bb708add00502e3460bfe2bd9e52164953f8c882ce64215a06","observation_id":"9a94dab9-1b71-4a64-90ba-17bd12eaaa78","resolution":{"observed_at":"2026-08-07T12:24:21.002799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:20.908550Z","title":"Reducing the prior mismatch of stochastic differential equations for diffusion-based speech enhancement,","venue":null,"work_id":"4fbe41a1-10d3-4580-8b77-bfb7a86aa734","year":2023},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:09.302414Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:30f6b71d121e48f3bf89536ee5f9ef6a5002eb9ee840d789358ff8b9f3bbbac4","observation_id":"f660b753-badb-427d-8b0a-a7efb613c0f5","resolution":{"observed_at":"2026-08-07T12:24:20.938463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:20.833465Z","title":"Schr ¨odinger bridge for generative speech enhancement,","venue":null,"work_id":"3ccfd8b6-9c24-4346-a45c-22a385113e09","year":2024},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:09.476701Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:b60aab91d6ab610325a2be17d70b13381fac29fd93c6ef48c041ac5e5deda807","observation_id":"5229341e-bdb8-4529-82a0-d2b0b3c6eab3","resolution":{"observed_at":"2026-08-07T12:24:20.865167Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.10753","last_updated":"2025-01-18T21:15:41Z","snapshot_observed_at":"2026-07-06T19:16:23.103921Z","submitted_at":"2024-09-16T21:47:52Z","title":"Investigating Training Objectives for Generative Speech Enhancement","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.10753","snapshot_observed_at":"2026-08-07T12:24:09.764102Z","title":"Investigating train- ing objectives for generative speech enhancement,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:09.764102Z"},"links":{"cited_paper":"/paper/2409.10753","citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:ea0dab0de36586e1879d2f90da289543c1faafdae1616403c2a7bb4fc7a1a9ab","observation_id":"faf033a5-86e1-4153-8f2d-fc60cd1d494a","resolution":{"observed_at":"2026-08-07T12:24:09.764102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:20.771483Z","title":"Reverse-time diffusion equation models,","venue":null,"work_id":"55cd0232-4d9a-4efd-bb40-a0c5cba1805b","year":1982},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:10.157469Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:8e9bef3965c039ba2ae004781bc914d2504cc315ef959f171b723c1e75fc36fa","observation_id":"83e33e75-accc-46a1-89c2-e7a64eb248ca","resolution":{"observed_at":"2026-08-07T12:24:20.798766Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:20.704280Z","title":"A connection between score matching and denoising au- toencoders,","venue":null,"work_id":"1d14c62e-dd7f-4e44-a1e8-00c7c7b66783","year":2011},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:10.527907Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:fc935bef8b290365c1c84ed4ca5adc97ba62c790f3387542bad17d563ae41581","observation_id":"956fb354-0aff-43b5-b3f3-ba83b30edce1","resolution":{"observed_at":"2026-08-07T12:24:20.740705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:20.650887Z","title":null,"venue":null,"work_id":"9d58b60b-584e-4e04-b053-02d2513448b1","year":1992},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:10.626032Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:c8c70847c2baf71d9f27493e7d0f78fe2e7a9acb3cfd131acc55d344421c78d6","observation_id":"907f9ce7-840c-4be4-99fa-9390c305cf94","resolution":{"observed_at":"2026-08-07T12:24:20.669457Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:20.595370Z","title":"Correlation functions and computer simulations,","venue":null,"work_id":"3480847d-3891-4eb2-b678-6fef7c9f2c07","year":1981},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:10.717840Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:33e69e5a512eddea6cc34b8edfed057ab3ef4500817e4ecd9d9ea2dbcbb9498f","observation_id":"3d171b47-8d30-460d-96d1-c6b3db313eb9","resolution":{"observed_at":"2026-08-07T12:24:20.616617Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.13285","last_updated":"2024-09-20T07:29:44Z","snapshot_observed_at":"2026-08-04T11:25:20.967287Z","submitted_at":"2024-09-20T07:29:44Z","title":"LiSenNet: Lightweight Sub-band and Dual-Path Modeling for Real-Time Speech Enhancement","version":1},"cited_work":{"arxiv_id":"2409.13285","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.13285","snapshot_observed_at":"2026-08-07T12:24:14.635090Z","title":"LiSenNet: Lightweight Sub-band and Dual-Path Modeling for Real-Time Speech Enhancement","venue":"eess.AS","work_id":"c0f71079-76cc-4d71-b8a2-b58e6920486b","year":2024},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:10.789466Z"},"links":{"cited_paper":"/paper/2409.13285","citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:69ca1f4bfe2ba33db1116bf1896233dd00988facb10b004e2e1f5a9c2437fcfd","observation_id":"29b3686b-6a75-443f-878a-0554ea20c077","resolution":{"observed_at":"2026-08-07T12:24:14.702747Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:20.529319Z","title":"Perceptual linear predictive (PLP) analysis of speech.,","venue":null,"work_id":"fd90902d-4627-47de-81c0-8c5c73840300","year":1990},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:10.877893Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:c7813b2b49fc95456f1762b997503cce51883a428cfe9fa74df41ef9be589fd6","observation_id":"4ce15b95-6eee-4900-b5af-8b1f9a07c9d8","resolution":{"observed_at":"2026-08-07T12:24:20.556666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:20.473611Z","title":"MetricGAN: Generative adversarial networks based black-box metric scores optimization for speech enhancement,","venue":null,"work_id":"a97f3623-07df-4b75-bb47-a07ae4f7636c","year":2019},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:11.028636Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:257ced0887bc478167d4dc93367b53dd642bf6349bd2db0088e1aa6e0b51366e","observation_id":"9ef14024-6dc1-4b19-ba24-8df8417dfbd0","resolution":{"observed_at":"2026-08-07T12:24:20.500655Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:20.399286Z","title":"/spl beta/-order MMSE spectral amplitude estimation for speech enhancement,","venue":null,"work_id":"8a57f641-b12d-4b5f-8394-364804c42ecd","year":2005},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:11.156365Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:12452a9a4bc7ff8f55ba2dc9fa732232332fb909db171e6b1edf906449dec4e5","observation_id":"6fc95435-c716-4e45-937f-54de7ea01ea8","resolution":{"observed_at":"2026-08-07T12:24:20.439765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:20.276334Z","title":"A consolidated view of loss functions for supervised deep learning-based speech enhancement,","venue":null,"work_id":"8034fdb1-1ee3-4fa3-9b04-d3b99103d419","year":2021},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:11.235104Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:18ef642d5e15e7ba9a76ac0474003d57676f8cd87c47775aa0a9c93efbcb5166","observation_id":"aa8e07d6-1105-454b-bf03-0e8530dfd518","resolution":{"observed_at":"2026-08-07T12:24:20.373489Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:20.074696Z","title":"U-Net: Convolutional net- works for biomedical image segmentation,","venue":null,"work_id":"5ddde067-8ceb-4a69-b53f-af4a40c4386e","year":2015},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:11.299645Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:fa3e580b71975839e9ee76cc514437179cbabbd7f8872e0b7d20b6a270c63a20","observation_id":"fc6c59d1-02ba-4d5c-9b71-26d1a5b27184","resolution":{"observed_at":"2026-08-07T12:24:20.180083Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:19.852772Z","title":"Real-time single image and video super-resolution using an efficient sub-pixel convolutional neural network,","venue":null,"work_id":"47e5ffc2-160a-44c4-b4ed-860ce65cd5ef","year":2016},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:11.377386Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:55706a13589814ebefc6b8deae40297951f54f22861381fb9f377d961ff845b3","observation_id":"5884eabb-e41a-4eee-94eb-26be67a41819","resolution":{"observed_at":"2026-08-07T12:24:19.940339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:19.672286Z","title":"Fourier features let networks learn high frequency functions in low dimensional domains,","venue":null,"work_id":"a5abf17b-a744-48e2-bac3-d1c3d071ab50","year":2020},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:11.454474Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:39bf7735f54560dac80f278fcaf8afe922379404aa620ed6898d37fba37a11b9","observation_id":"9b67962f-7487-486e-bc64-1fc99f63cbb7","resolution":{"observed_at":"2026-08-07T12:24:19.772693Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:19.515886Z","title":"Dual-Path RNN: Efficient long sequence modeling for time-domain single-channel speech separation,","venue":null,"work_id":"3bc702aa-72da-4def-8e51-7569eb8b5184","year":2020},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:11.565997Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:b962a9e4b3b803ba3598efd11d1b67e27e961f0b7449168bf423e04cf2bad48c","observation_id":"dc62274f-4101-4084-bb18-add4684c652d","resolution":{"observed_at":"2026-08-07T12:24:19.600207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:19.272649Z","title":"DPCRN: Dual-path convolution recurrent network for single channel speech enhancement,","venue":null,"work_id":"1f2050e1-c2eb-4719-9f68-04d63d6e0f08","year":2021},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:11.688487Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:b10e59fe1057bec361243bff4489034b3ea78f5523db26da6d9510b472616a74","observation_id":"699c61af-c1d2-4408-83c3-e82a52484c92","resolution":{"observed_at":"2026-08-07T12:24:19.396301Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:19.095370Z","title":"DPT-FSNet: Dual-path trans- former based full-band and sub-band fusion network for speech enhance- ment,","venue":null,"work_id":"53aa89f2-f284-4699-b73b-6a9a83ec2eb9","year":2022},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:11.871148Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:e514f71980c9c526abf80942ac0b5a7dfb26391ec95907b8efedf08d38914ee5","observation_id":"014f1c48-a188-4599-88ba-942ac7ef487e","resolution":{"observed_at":"2026-08-07T12:24:19.158100Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:18.946308Z","title":"Attention is all you need,","venue":null,"work_id":"941c09cb-6815-4013-b090-b028ba910d88","year":2017},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:11.998623Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:86f5a239535a80de675beb267c0ec76b6db783cb5e933c563ae59c2e22336e3b","observation_id":"1b205694-cfd3-4083-805a-cab046bcd506","resolution":{"observed_at":"2026-08-07T12:24:19.017463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:18.774341Z","title":"TransNeXt: Robust foveal visual perception for vision trans- formers,","venue":null,"work_id":"07d623d7-6389-4e8e-a55a-57c6bf99863f","year":2024},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:12.110211Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:f7d3423d766452096697618f8f684a6afb1f7a6ce4c528ceda1826b6ff2ceb1d","observation_id":"0e2d9f80-c5bc-468b-86d8-483a9d8eb9bd","resolution":{"observed_at":"2026-08-07T12:24:18.875059Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:18.536668Z","title":"Xception: Deep learning with depthwise separable convo- lutions,","venue":null,"work_id":"6bd8a79b-a48c-4005-927c-5f2952b4a5a6","year":2017},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:12.199909Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:c211cec62fe6515ac2485ee092a16c7a9eaeedefca8a175ecd6993fedf42dfef","observation_id":"a8fc7525-a10a-4722-ac59-ecb2d72e5d40","resolution":{"observed_at":"2026-08-07T12:24:18.651534Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1908.08681","last_updated":"2020-08-13T05:42:12Z","snapshot_observed_at":"2026-07-06T08:16:16.271286Z","submitted_at":"2019-08-23T06:22:06Z","title":"Mish: A Self Regularized Non-Monotonic Activation Function","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.08681","snapshot_observed_at":"2026-08-07T12:24:12.307546Z","title":"Mish: A self regularized non-monotonic neural activation function,","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:12.307546Z"},"links":{"cited_paper":"/paper/1908.08681","citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:b0bc27e322f3f738a1245c29606415943e93a86458a5ff7c5eb71131a40d2b28","observation_id":"4bcfc627-8130-47e1-9fa1-c0cc91ef5ad8","resolution":{"observed_at":"2026-08-07T12:24:12.307546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:18.341525Z","title":"A novel noise-aware deep learning model for underwater acoustic denoising,","venue":null,"work_id":"238af38b-9558-416d-8e5b-bdf6e613b6f1","year":2023},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:12.339276Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:63fdf889d9c3b839a7a2f3ee9a6941ea24c8c8bd0b3e7b09c550bcb4bdbd613c","observation_id":"f3c196c3-d4e3-432b-a0fd-520033d1df33","resolution":{"observed_at":"2026-08-07T12:24:18.407951Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.04323","last_updated":"2020-09-09T14:26:56Z","snapshot_observed_at":"2026-07-06T09:54:12.429500Z","submitted_at":"2020-09-09T14:26:56Z","title":"VoiceFilter-Lite: Streaming Targeted Voice Separation for On-Device Speech Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.04323","snapshot_observed_at":"2026-08-07T12:24:12.388358Z","title":"V oiceFilter-Lite: Streaming targeted voice separation for on-device speech recognition,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:12.388358Z"},"links":{"cited_paper":"/paper/2009.04323","citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:ae8d68d6edc0bd06df774596d8245b1bfeece6263771b95373dc8b253407431b","observation_id":"6fff9da2-e798-40a7-aa85-a5c5b7150cbc","resolution":{"observed_at":"2026-08-07T12:24:12.388358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.12524","last_updated":"2022-05-30T03:13:08Z","snapshot_observed_at":"2026-07-06T13:13:40.650733Z","submitted_at":"2022-05-25T06:40:09Z","title":"Accelerating Diffusion Models via Early Stop of the Diffusion Process","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.12524","snapshot_observed_at":"2026-08-07T12:24:12.445142Z","title":"Accelerating diffusion models via early stop of the diffusion process,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:12.445142Z"},"links":{"cited_paper":"/paper/2205.12524","citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:01ff273464497a9d5d0d6db6fa3bf43eeda0b6286310a9a32367de2f34189bd9","observation_id":"7f58bf50-c3ee-4a16-888e-e16d4cf7da2e","resolution":{"observed_at":"2026-08-07T12:24:12.445142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:18.142953Z","title":"Truncated diffu- sion probabilistic models and diffusion-based adversarial auto-encoders,","venue":null,"work_id":"e4453f35-a627-4e8d-aa48-4d4b6125098c","year":2023},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:12.690369Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:048b01c165e01ca379b3bcdea89547dead629d62c68aae61e46e37db0905606e","observation_id":"e4bcbe22-253e-44ba-ab4b-0995de6fa805","resolution":{"observed_at":"2026-08-07T12:24:18.237514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:17.951855Z","title":"ICASSP 2024 speech signal improvement challenge,","venue":null,"work_id":"3dea3402-c57e-4854-92c5-f6fc93707fb0","year":2024},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:12.968642Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:b788e49b6f621c571c8e65eec5ee78757a1dab262aa8189c545e898911edfceb","observation_id":"9685b651-acc4-4dcc-91d6-3f6710e0f1f4","resolution":{"observed_at":"2026-08-07T12:24:18.049691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:17.755785Z","title":"CSR-I (WSJ0) Com- plete","venue":null,"work_id":"a8da14db-4d3b-428c-a1f8-5d42bbceecc2","year":null},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:13.052996Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:52db1463724fb325796441c595373dfb36520db98063d43bb6ae2fee136e906d","observation_id":"214e8d44-2ce5-405a-87ef-bed6259fc1f8","resolution":{"observed_at":"2026-08-07T12:24:17.830129Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:17.612873Z","title":"WHAM!: Extending speech separation to noisy environments,","venue":null,"work_id":"2e5d196c-53be-4066-a306-691bc69cc2ca","year":2019},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:13.137968Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:064c4347502b371bc75dd14d0e53790a69c5ce494dffffcb8a685257171e23c6","observation_id":"1b1ab0b4-88a6-456a-b213-59835214521f","resolution":{"observed_at":"2026-08-07T12:24:17.677720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:17.467415Z","title":"Investi- gating RNN-based speech enhancement methods for noise-robust Text- to-Speech,","venue":null,"work_id":"36dca06a-6f0d-4a2b-9be8-8dcafe7d4430","year":2016},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:13.228132Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:95346a42ae9abfb640567d7982ef2ac8e19712e61f8a062ad3bc2d01b7786c39","observation_id":"3fdfe0fe-9990-4745-9c92-b48a2a556ed0","resolution":{"observed_at":"2026-08-07T12:24:17.537166Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:17.308255Z","title":"The voice bank corpus: Design, collection and data analysis of a large regional accent speech database,","venue":null,"work_id":"80a1fed1-989e-43b1-9665-1b6b76a4b638","year":2013},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:13.272337Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:2fbb5d0d71f697c05627390650eb08b965904e39b2ec7a3602a649fb61fe358c","observation_id":"cfad495d-cf93-4b0d-a008-e4c45f86a98d","resolution":{"observed_at":"2026-08-07T12:24:17.365286Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:17.243826Z","title":"The diverse environments multi- channel acoustic noise database: A database of multichannel environ- mental noise recordings,","venue":null,"work_id":"ff0dcf27-11ea-43a4-b91f-1bf51b3d69ae","year":2013},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:13.308745Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:1302aac2a6a7b5386e1b63995b9dec804e9ddbc7228e83553d647b10b0aea6c9","observation_id":"85c57405-355a-44fc-84bf-afb04d9b53f2","resolution":{"observed_at":"2026-08-07T12:24:17.274366Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:17.176876Z","title":"“Colorless","venue":null,"work_id":"2664209b-9266-4a4b-a9f1-8e7100582b5a","year":1961},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:13.362251Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:23cf0300cf33a6865a196c7e51458f9c9f2d4504eabe01e62999591f69ed10e1","observation_id":"2f699493-b539-465f-ba04-e1e10d1b99d8","resolution":{"observed_at":"2026-08-07T12:24:17.205350Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:17.002437Z","title":"TIMIT Acoustic-Phonetic Continuous Speech Corpus","venue":null,"work_id":"21c60939-96f0-4cb5-869e-e2c312f0704f","year":null},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:13.424415Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:1b5f826bc7392239d6281576b04cde0fc42828129ef6ceeee7b6bf62f9c011b5","observation_id":"ca7c1da7-ee8f-477e-9c90-056c0984ecf4","resolution":{"observed_at":"2026-08-07T12:24:17.118394Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:16.817768Z","title":"Perceptual evaluation of speech quality (PESQ)-a new method for speech quality assessment of telephone networks and codecs,","venue":null,"work_id":"36a49087-98c7-4ceb-b02e-b1a9c1b28e98","year":2001},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:13.517150Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:a36861e238f44771d8f2cf982caa275e62bda2808f8b8a3f0b11a7f80eed6080","observation_id":"b17a0026-1d1f-4b78-b888-d51a98d2f7b1","resolution":{"observed_at":"2026-08-07T12:24:16.930761Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:16.651825Z","title":"An algorithm for predicting the intelligibility of speech masked by modulated noise maskers,","venue":null,"work_id":"7d34a6e8-ab91-4076-af02-ea442a95100c","year":2009},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:13.614758Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:03c58016bbb013a5e4bbf21a5de3b4b66ffe0d118e27420b57304376b03a1799","observation_id":"67746058-b3ab-46ee-8d91-97fb9823d5b8","resolution":{"observed_at":"2026-08-07T12:24:16.721579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:16.438962Z","title":"Evaluation of objective quality measures for speech enhancement,","venue":null,"work_id":"c1dcc4cd-4c84-4a1f-ae00-e26aa40a3c4c","year":2008},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:13.684423Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:59b4ed99a056af38d8ae4490cedbefd6a4428fd51d9dcc9a339305f1e6a78864","observation_id":"bfae7291-8b47-43c6-803d-1dd0051d558c","resolution":{"observed_at":"2026-08-07T12:24:16.541821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:16.220248Z","title":"HIFI++: A unified framework for bandwidth extension and speech enhancement,","venue":null,"work_id":"7718e32b-35ee-4bc7-a30a-01f07deb2918","year":2023},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:13.743759Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:436a7c3ade1cbe5d59517b9f0e4e16fbfb520f7f773435b228aa3d418552c989","observation_id":"9d41fafd-571d-4fd6-b1ce-9f53864a48ac","resolution":{"observed_at":"2026-08-07T12:24:16.295677Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:16.065271Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech representations,","venue":null,"work_id":"e6744432-070d-4614-8362-ea9742fda264","year":2020},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:13.834780Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:88d1adfdd943aa5e9b72560eac8bd1dad452a9a82ccda6db1793eece53e14141","observation_id":"8b99624a-e29a-420c-ac13-b01c572b0b95","resolution":{"observed_at":"2026-08-07T12:24:16.133672Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:15.839011Z","title":"ViSQOL v3: An open source production ready objective speech and audio metric,","venue":null,"work_id":"dec0c0b4-2d6e-44e8-bfe6-5977e3c4fc82","year":2020},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:13.885993Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:434c8b8614028fad1621d704faace28aade3088637ea777b4e3857d2a72c7177","observation_id":"8b4dab04-5d7e-4dde-abbc-85bc8e318094","resolution":{"observed_at":"2026-08-07T12:24:15.935720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:15.690055Z","title":"Distance measures for speech processing,","venue":null,"work_id":"ae652d5b-195d-4854-b694-75b2dcff77ca","year":1976},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:13.954352Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:419336126c6ac55f69090b433b436403403bf227c492f7123e453238e2ecb688","observation_id":"cca8e975-4635-45fb-8805-c5757b6da95b","resolution":{"observed_at":"2026-08-07T12:24:15.727430Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:13.997307Z","title":"Image quality assessment: from error visibility to structural similarity,","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:13.997307Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:0ebe4271b4340071639f3e30959a36fe82156b29c57743f618570e360a274d63","observation_id":"3b51a6d6-d1fa-45d4-88be-d5656de7cb81","resolution":{"observed_at":"2026-08-07T12:24:13.997307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:15.576370Z","title":"Squeezeformer: An efficient transformer for automatic speech recognition,","venue":null,"work_id":"dc07ecd8-2f63-40b8-a07e-f5646e5e8631","year":2022},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:14.075055Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:2559fa4026fb481d403a8fdd80f2c0e1f996aebf6f0d72422383f264fc2b53a1","observation_id":"86e5fe76-5af7-4bac-b698-621d09e1df40","resolution":{"observed_at":"2026-08-07T12:24:15.624026Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:15.409802Z","title":"Improved techniques for training score-based generative models,","venue":null,"work_id":"ddcd51f5-ec95-4815-b928-c57d7c1c15a4","year":2020},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:14.161575Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:ffee8f0eff3a765ae2e13376d506c960552c4f67785f00d8539e2eff858d7237","observation_id":"cd9de103-4989-48f2-bd1e-c040a9d3ab15","resolution":{"observed_at":"2026-08-07T12:24:15.469187Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:15.245831Z","title":"Conv-TasNet: Surpassing ideal time- frequency magnitude masking for speech separation,","venue":null,"work_id":"3d18137c-a52e-453f-a8bd-12f6a7502979","year":2019},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:14.254732Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:e1643c2abc3003d1d925608371471d79a0e0268108f07c742b2e39475411452e","observation_id":"5b3b72f5-47e2-4ad6-90fc-50fc2df172b2","resolution":{"observed_at":"2026-08-07T12:24:15.296725Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:15.066427Z","title":"MANNER: Multi-view attention network for noise erasure,","venue":null,"work_id":"13a6a1e8-31d0-4795-bff6-0b0ec20c2c48","year":2022},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:14.336919Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:c51f397ccb90824a3de3e8cb582fa48716c5a6efd99ddfabf8eaf133e8fed87d","observation_id":"edc07c6a-688a-4dba-a40b-3f3a9f5954f9","resolution":{"observed_at":"2026-08-07T12:24:15.149360Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:14.936539Z","title":"Conformer: Convolution-augmented transformer for speech recognition,","venue":null,"work_id":"79149670-2c7a-45bd-a25a-a38e50e49623","year":2020},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:14.419117Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:7275dae8f61b27a4bb08e12e39312eb7db20ff0080464dca0e1431ef115a115f","observation_id":"766f0514-309f-4bb6-8a14-554d66a95834","resolution":{"observed_at":"2026-08-07T12:24:14.988568Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:14.821103Z","title":"Neural vocoder is all you need for speech super-resolution,","venue":null,"work_id":"ff99ca02-8d6c-460a-b358-a1648f1b9ed0","year":2022},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:14.488006Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:2546807da26c05ec22658c69fe42c28cb3e757d4110f10e288a052976be45c95","observation_id":"610748a8-191a-4b23-98d7-8dc2d555d103","resolution":{"observed_at":"2026-08-07T12:24:14.880228Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-08T08:36:30.987356Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement"},"reference_resolution":{"displayed":83,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":1,"verified_fuzzy":71},"total_outbound_references":83},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 83 of 83 outbound references and 0 inbound Pith citation observations for arXiv:2505.24576."}