{"as_of":"2026-08-11T06:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:69daeaf3df2a1d512a45166119a1e9033f19114e56a08e48bdcedaffce78d4f0","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T13:56:41.951155Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T13:30:05.484429Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.15965","last_updated":"2025-01-27T11:17:00Z","snapshot_observed_at":"2026-08-10T13:47:30.631361Z","submitted_at":"2025-01-27T11:17:00Z","title":"EDSep: An Effective Diffusion-Based Method for Speech Source Separation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15965","snapshot_observed_at":"2026-08-04T13:30:05.484429Z","title":"Edsep: An effective diffusion-based method for speech source separation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.00180","last_updated":"2026-07-14T12:05:19Z","snapshot_observed_at":"2026-08-06T12:48:56.888862Z","submitted_at":"2025-09-30T19:01:06Z","title":"DiffAU: Diffusion-Based Ambisonics Upscaling","version":4},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-04T13:30:05.484429Z"},"links":{"cited_paper":"/paper/2501.15965","citing_paper":"/paper/2510.00180"},"observation_digest":"sha256:b0dbc868c14a70683595e0163add08027987519f13b445354259b59d3b7ce80e","observation_id":"2bfa6b87-2d53-4e89-940e-6e095e68c65c","resolution":{"observed_at":"2026-08-04T13:30:05.484429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2501.15965/citation-record","integrity":"/paper/2501.15965/integrity","json":"/paper/2501.15965/citation-record.json","paper":"/paper/2501.15965"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:56:42.409255Z","title":"Tasnet: time-domain audio separation network for real-time, single-channel speech separation,","venue":null,"work_id":"53028c10-fe0d-49da-aec8-994a6810b557","year":2018},"citing_paper":{"arxiv_id":"2501.15965","last_updated":"2025-01-27T11:17:00Z","snapshot_observed_at":"2026-08-10T13:47:30.631361Z","submitted_at":"2025-01-27T11:17:00Z","title":"EDSep: An Effective Diffusion-Based Method for Speech Source Separation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T13:56:41.803249Z"},"links":{"citing_paper":"/paper/2501.15965"},"observation_digest":"sha256:7a2e0509b0f084dacefd17a62edcd48d6164f60a5af03267fea02a2a03a7e77f","observation_id":"b222c3de-f855-4742-9fe5-0de31f917cda","resolution":{"observed_at":"2026-08-10T13:56:42.413412Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:56:42.398422Z","title":"End-to-end micro- phone permutation and number invariant multi-channel speech separa- tion,","venue":null,"work_id":"dbac6ac5-60ce-4cc5-90b6-b371c6d56480","year":2020},"citing_paper":{"arxiv_id":"2501.15965","last_updated":"2025-01-27T11:17:00Z","snapshot_observed_at":"2026-08-10T13:47:30.631361Z","submitted_at":"2025-01-27T11:17:00Z","title":"EDSep: An Effective Diffusion-Based Method for Speech Source Separation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T13:56:41.807762Z"},"links":{"citing_paper":"/paper/2501.15965"},"observation_digest":"sha256:26174731c05e672eace1b6e02193c20cde3b9a3e535c61755b45dce7abbeb8cc","observation_id":"d35b795a-1983-44f0-8d00-792ed7a4c6f3","resolution":{"observed_at":"2026-08-10T13:56:42.402110Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:56:42.387724Z","title":"Deep clustering: Discriminative embeddings for segmentation and separation,","venue":null,"work_id":"a2fbfe1d-6ef9-40f4-969a-44cd5399950f","year":2016},"citing_paper":{"arxiv_id":"2501.15965","last_updated":"2025-01-27T11:17:00Z","snapshot_observed_at":"2026-08-10T13:47:30.631361Z","submitted_at":"2025-01-27T11:17:00Z","title":"EDSep: An Effective Diffusion-Based Method for Speech Source Separation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T13:56:41.811343Z"},"links":{"citing_paper":"/paper/2501.15965"},"observation_digest":"sha256:8d30e3f7766f76cd0db18c43a944c584ee30e96d2956966c95b0a632a4ba4e07","observation_id":"b3ebc859-ccc1-4f07-8763-03e59c0f08ec","resolution":{"observed_at":"2026-08-10T13:56:42.391418Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:56:41.814990Z","title":"Multitalker speech separation with utterance-level permutation invariant training of deep recurrent neural networks,","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2501.15965","last_updated":"2025-01-27T11:17:00Z","snapshot_observed_at":"2026-08-10T13:47:30.631361Z","submitted_at":"2025-01-27T11:17:00Z","title":"EDSep: An Effective Diffusion-Based Method for Speech Source Separation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T13:56:41.814990Z"},"links":{"citing_paper":"/paper/2501.15965"},"observation_digest":"sha256:7107eba8e56af2bcdac1d12a72b50b889b68e9c1f27b8e952a57388e30fd2d27","observation_id":"1f04ddcc-1b5d-4570-bef2-8c9711409099","resolution":{"observed_at":"2026-08-10T13:56:41.814990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1804.10204","last_updated":"2018-04-26T13:14:22Z","snapshot_observed_at":"2026-08-03T13:44:07.152019Z","submitted_at":"2018-04-26T13:14:22Z","title":"End-to-End Speech Separation with Unfolded Iterative Phase Reconstruction","version":1},"cited_work":{"arxiv_id":"1804.10204","doi":null,"metadata_source":"pith","pith_arxiv_id":"1804.10204","snapshot_observed_at":"2026-08-10T13:56:42.076209Z","title":"End-to-End Speech Separation with Unfolded Iterative Phase Reconstruction","venue":"cs.SD","work_id":"63790278-34eb-4e86-905a-54409587253c","year":2018},"citing_paper":{"arxiv_id":"2501.15965","last_updated":"2025-01-27T11:17:00Z","snapshot_observed_at":"2026-08-10T13:47:30.631361Z","submitted_at":"2025-01-27T11:17:00Z","title":"EDSep: An Effective Diffusion-Based Method for Speech Source Separation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T13:56:41.818792Z"},"links":{"cited_paper":"/paper/1804.10204","citing_paper":"/paper/2501.15965"},"observation_digest":"sha256:ac7b6913f64218b9490f0f84cd24152a6b99db968561ae206239799af21df9ba","observation_id":"882964f1-c135-49b1-aa5d-e4ad9c65cdff","resolution":{"observed_at":"2026-08-10T13:56:42.080287Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:56:42.370020Z","title":"Deep learning based phase reconstruction for speaker separation: A trigonometric perspective,","venue":null,"work_id":"6a2b4ace-251f-4cd2-8534-0d4ddcb363ef","year":2019},"citing_paper":{"arxiv_id":"2501.15965","last_updated":"2025-01-27T11:17:00Z","snapshot_observed_at":"2026-08-10T13:47:30.631361Z","submitted_at":"2025-01-27T11:17:00Z","title":"EDSep: An Effective Diffusion-Based Method for Speech Source Separation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T13:56:41.822803Z"},"links":{"citing_paper":"/paper/2501.15965"},"observation_digest":"sha256:ebf259f90013bfda20fea1d6a3a88cfcca6bce36ed722272282cdee25553c574","observation_id":"cbcca36b-9b7e-4e1d-8029-7933d966f488","resolution":{"observed_at":"2026-08-10T13:56:42.373770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:56:42.358301Z","title":"Divide and conquer: A deep casa approach to talker-independent monaural speaker separation,","venue":null,"work_id":"5eaad7a4-7824-438a-8cb7-1d85291d179f","year":2019},"citing_paper":{"arxiv_id":"2501.15965","last_updated":"2025-01-27T11:17:00Z","snapshot_observed_at":"2026-08-10T13:47:30.631361Z","submitted_at":"2025-01-27T11:17:00Z","title":"EDSep: An Effective Diffusion-Based Method for Speech Source Separation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T13:56:41.826505Z"},"links":{"citing_paper":"/paper/2501.15965"},"observation_digest":"sha256:1e328d801fa2ccdcd90da8e982c202fb153b83c3c5ab43c0eee41bea33054dfd","observation_id":"2fba6b83-8604-452b-8958-6a0ccafbd637","resolution":{"observed_at":"2026-08-10T13:56:42.362206Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:56:41.830091Z","title":"Conv-tasnet: Surpassing ideal time– frequency magnitude masking for speech separation,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.15965","last_updated":"2025-01-27T11:17:00Z","snapshot_observed_at":"2026-08-10T13:47:30.631361Z","submitted_at":"2025-01-27T11:17:00Z","title":"EDSep: An Effective Diffusion-Based Method for Speech Source Separation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T13:56:41.830091Z"},"links":{"citing_paper":"/paper/2501.15965"},"observation_digest":"sha256:d22972c1402a2a420c61a1041b48b5255ec4f1abe80b5c3e8b619544930c16ad","observation_id":"30bfaaf0-34d9-4b74-a730-7edf9595cef2","resolution":{"observed_at":"2026-08-10T13:56:41.830091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:56:41.833792Z","title":"Wavesplit: End-to-end speech separation by speaker clustering,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.15965","last_updated":"2025-01-27T11:17:00Z","snapshot_observed_at":"2026-08-10T13:47:30.631361Z","submitted_at":"2025-01-27T11:17:00Z","title":"EDSep: An Effective Diffusion-Based Method for Speech Source Separation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T13:56:41.833792Z"},"links":{"citing_paper":"/paper/2501.15965"},"observation_digest":"sha256:3f92c3d8382b3800904bb6d712cc29cedca953b0d122b809e3190ccaf14d390a","observation_id":"3d1949ab-d28d-4a10-97b8-e825aa4e774d","resolution":{"observed_at":"2026-08-10T13:56:41.833792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:56:42.333525Z","title":"Qdpn-quasi-dual-path network for single- channel speech separation","venue":null,"work_id":"35705404-e301-4a9e-a012-bf9f5b468bd1","year":2022},"citing_paper":{"arxiv_id":"2501.15965","last_updated":"2025-01-27T11:17:00Z","snapshot_observed_at":"2026-08-10T13:47:30.631361Z","submitted_at":"2025-01-27T11:17:00Z","title":"EDSep: An Effective Diffusion-Based Method for Speech Source Separation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T13:56:41.837324Z"},"links":{"citing_paper":"/paper/2501.15965"},"observation_digest":"sha256:622136095d310ce5b29615c86269208779b179a34d884dfc779291b81b8c4bf3","observation_id":"e7ac50a4-1311-4bd0-b108-f8a060e73dc3","resolution":{"observed_at":"2026-08-10T13:56:42.337490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:56:42.321675Z","title":"Efficient monaural speech separation with multiscale time-delay sampling,","venue":null,"work_id":"09c8988d-a2fe-4163-9173-c55e522a554d","year":2022},"citing_paper":{"arxiv_id":"2501.15965","last_updated":"2025-01-27T11:17:00Z","snapshot_observed_at":"2026-08-10T13:47:30.631361Z","submitted_at":"2025-01-27T11:17:00Z","title":"EDSep: An Effective Diffusion-Based Method for Speech Source Separation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T13:56:41.840881Z"},"links":{"citing_paper":"/paper/2501.15965"},"observation_digest":"sha256:9d1e55da57b0abc9dfd5eea72710b33d84338d306d019bb15b2d1ceb96142b04","observation_id":"328b04b1-418b-4c0d-a972-941f361d4140","resolution":{"observed_at":"2026-08-10T13:56:42.325518Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:56:42.310586Z","title":"Sfsrnet: Super-resolution for single-channel audio source separation,","venue":null,"work_id":"406cc2d2-a8db-468c-81a1-3a5792ef4ad1","year":2022},"citing_paper":{"arxiv_id":"2501.15965","last_updated":"2025-01-27T11:17:00Z","snapshot_observed_at":"2026-08-10T13:47:30.631361Z","submitted_at":"2025-01-27T11:17:00Z","title":"EDSep: An Effective Diffusion-Based Method for Speech Source Separation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T13:56:41.844207Z"},"links":{"citing_paper":"/paper/2501.15965"},"observation_digest":"sha256:8c7833e3174f75e86b3001334ca5a14226948331b8065b01f64217c2e0994068","observation_id":"04eed9e7-1d8d-43f4-afcc-42732a2f5a93","resolution":{"observed_at":"2026-08-10T13:56:42.314632Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:56:42.299143Z","title":"Dual-path rnn: efficient long sequence modeling for time-domain single-channel speech separation,","venue":null,"work_id":"9f9aa64f-dc1d-4fb2-8029-def82f5bf3b4","year":2020},"citing_paper":{"arxiv_id":"2501.15965","last_updated":"2025-01-27T11:17:00Z","snapshot_observed_at":"2026-08-10T13:47:30.631361Z","submitted_at":"2025-01-27T11:17:00Z","title":"EDSep: An Effective Diffusion-Based Method for Speech Source Separation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T13:56:41.847770Z"},"links":{"citing_paper":"/paper/2501.15965"},"observation_digest":"sha256:4453f871b7ffbee1ad13c4803cf751640aaee9a147560eb44bb2c8ae1aa994d4","observation_id":"e8c1c8a3-ec03-4f2e-9375-3584a5f0a4dc","resolution":{"observed_at":"2026-08-10T13:56:42.303282Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:56:42.288335Z","title":"V oice separation with an unknown number of multiple speakers,","venue":null,"work_id":"2031b906-d529-464b-842e-8e98311daa13","year":2020},"citing_paper":{"arxiv_id":"2501.15965","last_updated":"2025-01-27T11:17:00Z","snapshot_observed_at":"2026-08-10T13:47:30.631361Z","submitted_at":"2025-01-27T11:17:00Z","title":"EDSep: An Effective Diffusion-Based Method for Speech Source Separation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T13:56:41.851188Z"},"links":{"citing_paper":"/paper/2501.15965"},"observation_digest":"sha256:9a24ba06cb37a262b545d8660afd23352dd308c35e25c25469cd2e0b282f4bc5","observation_id":"68dd89c5-5d93-4967-930e-be97004c0175","resolution":{"observed_at":"2026-08-10T13:56:42.292255Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:56:41.854427Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.15965","last_updated":"2025-01-27T11:17:00Z","snapshot_observed_at":"2026-08-10T13:47:30.631361Z","submitted_at":"2025-01-27T11:17:00Z","title":"EDSep: An Effective Diffusion-Based Method for Speech Source Separation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T13:56:41.854427Z"},"links":{"citing_paper":"/paper/2501.15965"},"observation_digest":"sha256:ab59fd0ec3bc3e9c781a973d927237e38692c38570bca80aaee538f9dedfe7bb","observation_id":"b37d2be6-e25b-4589-86dd-71fe5425de49","resolution":{"observed_at":"2026-08-10T13:56:41.854427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:56:42.269186Z","title":"Attention is all you need in speech separation,","venue":null,"work_id":"16537071-0f91-4bb4-9c93-d59b80e76899","year":2021},"citing_paper":{"arxiv_id":"2501.15965","last_updated":"2025-01-27T11:17:00Z","snapshot_observed_at":"2026-08-10T13:47:30.631361Z","submitted_at":"2025-01-27T11:17:00Z","title":"EDSep: An Effective Diffusion-Based Method for Speech Source Separation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T13:56:41.857794Z"},"links":{"citing_paper":"/paper/2501.15965"},"observation_digest":"sha256:0c6be5dadf7c3bfefb8de06830b29a40f1da1fc3b3d34cb7e039240785310d53","observation_id":"bb8e8db2-bbdd-457f-be69-7ab86c7082af","resolution":{"observed_at":"2026-08-10T13:56:42.273165Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2007.13975","last_updated":"2020-08-14T10:52:10Z","snapshot_observed_at":"2026-08-11T05:46:15.858051Z","submitted_at":"2020-07-28T03:51:28Z","title":"Dual-Path Transformer Network: Direct Context-Aware Modeling for End-to-End Monaural Speech Separation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.13975","snapshot_observed_at":"2026-08-10T13:56:41.861184Z","title":"Dual-path transformer network: Direct context-aware modeling for end-to-end monaural speech separation,","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2501.15965","last_updated":"2025-01-27T11:17:00Z","snapshot_observed_at":"2026-08-10T13:47:30.631361Z","submitted_at":"2025-01-27T11:17:00Z","title":"EDSep: An Effective Diffusion-Based Method for Speech Source Separation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T13:56:41.861184Z"},"links":{"cited_paper":"/paper/2007.13975","citing_paper":"/paper/2501.15965"},"observation_digest":"sha256:9bde9bef3ff1d0ea0260b96164f0cbdf6a3a6fc4a4cefa1724a1ed022b170e6a","observation_id":"1413d630-726f-4e61-8d8b-b33312197e09","resolution":{"observed_at":"2026-08-10T13:56:41.861184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:56:42.258308Z","title":"Mossformer: Pushing the performance limit of monaural speech separation using gated single-head transformer with convolution-augmented joint self-attentions,","venue":null,"work_id":"459c3bed-c417-4828-994b-0ee35be5967f","year":2023},"citing_paper":{"arxiv_id":"2501.15965","last_updated":"2025-01-27T11:17:00Z","snapshot_observed_at":"2026-08-10T13:47:30.631361Z","submitted_at":"2025-01-27T11:17:00Z","title":"EDSep: An Effective Diffusion-Based Method for Speech Source Separation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T13:56:41.864888Z"},"links":{"citing_paper":"/paper/2501.15965"},"observation_digest":"sha256:1fa25d0932e35dafbaecb04aba5696cd950b5e3dd9d1c5adb09379d98d43f473","observation_id":"b00e14a2-76f3-49b0-a958-7b13802bc643","resolution":{"observed_at":"2026-08-10T13:56:42.262094Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:56:42.246971Z","title":"Generative adversarial networks for single channel separation of convolutive mixed speech signals,","venue":null,"work_id":"ae248a2a-c82e-4c79-b61f-2cac2157737a","year":2021},"citing_paper":{"arxiv_id":"2501.15965","last_updated":"2025-01-27T11:17:00Z","snapshot_observed_at":"2026-08-10T13:47:30.631361Z","submitted_at":"2025-01-27T11:17:00Z","title":"EDSep: An Effective Diffusion-Based Method for Speech Source Separation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T13:56:41.868303Z"},"links":{"citing_paper":"/paper/2501.15965"},"observation_digest":"sha256:217823a13487a39261b3625ce32f5d2ac93530b6c1d73dd9066361ea2c9f31ab","observation_id":"178a19fb-37eb-4e71-b077-53d9ea87b1d0","resolution":{"observed_at":"2026-08-10T13:56:42.251046Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:56:42.234949Z","title":"Speech source separation using variational autoencoder and bandpass filter,","venue":null,"work_id":"ffc1b0d1-40b7-4576-8505-4a2369bb01c5","year":2020},"citing_paper":{"arxiv_id":"2501.15965","last_updated":"2025-01-27T11:17:00Z","snapshot_observed_at":"2026-08-10T13:47:30.631361Z","submitted_at":"2025-01-27T11:17:00Z","title":"EDSep: An Effective Diffusion-Based Method for Speech Source Separation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T13:56:41.871560Z"},"links":{"citing_paper":"/paper/2501.15965"},"observation_digest":"sha256:971d6be2bc9ca3f13a8817df2644bddff6acde82cfa17a674273bb7103582845","observation_id":"1e27bf7d-6e05-48ce-b6e0-96c8d514f011","resolution":{"observed_at":"2026-08-10T13:56:42.238944Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:56:42.223643Z","title":"Deep generative modelling: A comparative review of vaes, gans, normalizing flows, energy-based and autoregressive models,","venue":null,"work_id":"bcfa29f2-7bfb-47cf-a09f-178375f6453b","year":2021},"citing_paper":{"arxiv_id":"2501.15965","last_updated":"2025-01-27T11:17:00Z","snapshot_observed_at":"2026-08-10T13:47:30.631361Z","submitted_at":"2025-01-27T11:17:00Z","title":"EDSep: An Effective Diffusion-Based Method for Speech Source Separation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T13:56:41.874958Z"},"links":{"citing_paper":"/paper/2501.15965"},"observation_digest":"sha256:cfa5b2725b84c3518bc7a7433bfc7511e34fa29c9647f84910b578c97265e01c","observation_id":"ef3c1fa1-29c7-4cd2-aa75-54f21900979a","resolution":{"observed_at":"2026-08-10T13:56:42.227538Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-10T13:56:41.878399Z","title":"Hierarchical text-conditional image generation with clip latents,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.15965","last_updated":"2025-01-27T11:17:00Z","snapshot_observed_at":"2026-08-10T13:47:30.631361Z","submitted_at":"2025-01-27T11:17:00Z","title":"EDSep: An Effective Diffusion-Based Method for Speech Source Separation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T13:56:41.878399Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2501.15965"},"observation_digest":"sha256:35bb5375ec985bf4f1be7025f3f47d6a6554cb3596b2b6f43b87c360686a09d2","observation_id":"557204cd-8473-4b8c-9987-5711325bc721","resolution":{"observed_at":"2026-08-10T13:56:41.878399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:56:41.882186Z","title":"High- resolution image synthesis with latent diffusion models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.15965","last_updated":"2025-01-27T11:17:00Z","snapshot_observed_at":"2026-08-10T13:47:30.631361Z","submitted_at":"2025-01-27T11:17:00Z","title":"EDSep: An Effective Diffusion-Based Method for Speech Source Separation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T13:56:41.882186Z"},"links":{"citing_paper":"/paper/2501.15965"},"observation_digest":"sha256:693bb91a1f7ad4989db09a754da9bea4ed1f254fbf3cab3672ed7d795933ced3","observation_id":"281457e7-350e-4773-b042-cce62bb8da8f","resolution":{"observed_at":"2026-08-10T13:56:41.882186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.09761","last_updated":"2021-03-30T19:48:38Z","snapshot_observed_at":"2026-07-06T09:57:19.117228Z","submitted_at":"2020-09-21T11:20:38Z","title":"DiffWave: A Versatile Diffusion Model for Audio Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.09761","snapshot_observed_at":"2026-08-10T13:56:41.885486Z","title":"Dif- fwave: A versatile diffusion model for audio synthesis,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2501.15965","last_updated":"2025-01-27T11:17:00Z","snapshot_observed_at":"2026-08-10T13:47:30.631361Z","submitted_at":"2025-01-27T11:17:00Z","title":"EDSep: An Effective Diffusion-Based Method for Speech Source Separation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T13:56:41.885486Z"},"links":{"cited_paper":"/paper/2009.09761","citing_paper":"/paper/2501.15965"},"observation_digest":"sha256:29b849f74d60e6b2a31571401e8d033afd98cbc0426121ab78cc689d2bc2ec90","observation_id":"12559662-ca79-4514-b251-e5608cd8cf75","resolution":{"observed_at":"2026-08-10T13:56:41.885486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.16408","last_updated":"2022-05-26T06:38:50Z","snapshot_observed_at":"2026-07-06T12:54:50.620916Z","submitted_at":"2022-03-30T15:48:44Z","title":"Learn2Sing 2.0: Diffusion and Mutual Information-Based Target Speaker SVS by Learning from Singing Teacher","version":2},"cited_work":{"arxiv_id":"2203.16408","doi":null,"metadata_source":"pith","pith_arxiv_id":"2203.16408","snapshot_observed_at":"2026-08-10T13:56:42.025358Z","title":"Learn2Sing 2.0: Diffusion and Mutual Information-Based Target Speaker SVS by Learning from Singing Teacher","venue":"cs.SD","work_id":"ff581c20-3d31-4efc-8b0b-1a2b2ba65ca9","year":2022},"citing_paper":{"arxiv_id":"2501.15965","last_updated":"2025-01-27T11:17:00Z","snapshot_observed_at":"2026-08-10T13:47:30.631361Z","submitted_at":"2025-01-27T11:17:00Z","title":"EDSep: An Effective Diffusion-Based Method for Speech Source Separation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T13:56:41.889374Z"},"links":{"cited_paper":"/paper/2203.16408","citing_paper":"/paper/2501.15965"},"observation_digest":"sha256:51d2b77a75a62589e916d6f491adbc7660f15aefe239d68f09429d56b0496b2e","observation_id":"1de410cf-65bd-4abf-b41b-209a92ee9d84","resolution":{"observed_at":"2026-08-10T13:56:42.031607Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:56:42.205850Z","title":"Diffusion-based generative speech source separation,","venue":null,"work_id":"ae640427-b0df-455f-9f24-36114bc7b69f","year":2023},"citing_paper":{"arxiv_id":"2501.15965","last_updated":"2025-01-27T11:17:00Z","snapshot_observed_at":"2026-08-10T13:47:30.631361Z","submitted_at":"2025-01-27T11:17:00Z","title":"EDSep: An Effective Diffusion-Based Method for Speech Source Separation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T13:56:41.893086Z"},"links":{"citing_paper":"/paper/2501.15965"},"observation_digest":"sha256:bdc24686e360616e26f22770466f5ebe2713374bf35434c5be8b231e5d010653","observation_id":"02981705-1440-46ae-bd7b-9e053d3acbd9","resolution":{"observed_at":"2026-08-10T13:56:42.209468Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.13456","last_updated":"2021-02-10T18:17:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-11-26T19:39:10Z","title":"Score-Based Generative Modeling through Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.13456","snapshot_observed_at":"2026-08-10T13:56:41.896504Z","title":"Score-based generative modeling through stochastic differ- ential equations,","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2501.15965","last_updated":"2025-01-27T11:17:00Z","snapshot_observed_at":"2026-08-10T13:47:30.631361Z","submitted_at":"2025-01-27T11:17:00Z","title":"EDSep: An Effective Diffusion-Based Method for Speech Source Separation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T13:56:41.896504Z"},"links":{"cited_paper":"/paper/2011.13456","citing_paper":"/paper/2501.15965"},"observation_digest":"sha256:e5ba22a22547aa922cd615650bcda3dde037f32d58dba10a9b2bc76032db6b1a","observation_id":"d02e18f7-14f5-476b-a169-0eb0d5aff3a5","resolution":{"observed_at":"2026-08-10T13:56:41.896504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:56:42.195221Z","title":"S ¨arkk¨a and A","venue":null,"work_id":"33b63540-2e9e-4ab3-a011-79fc942892ea","year":2019},"citing_paper":{"arxiv_id":"2501.15965","last_updated":"2025-01-27T11:17:00Z","snapshot_observed_at":"2026-08-10T13:47:30.631361Z","submitted_at":"2025-01-27T11:17:00Z","title":"EDSep: An Effective Diffusion-Based Method for Speech Source Separation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T13:56:41.900154Z"},"links":{"citing_paper":"/paper/2501.15965"},"observation_digest":"sha256:9649a1097132f4fe8d25433f937801d1aaaeed066382b37a2a5a67c66e9008ad","observation_id":"d4092d22-9509-4059-aecd-13e4262967aa","resolution":{"observed_at":"2026-08-10T13:56:42.198909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:56:41.903723Z","title":"Reverse-time diffusion equation models,","venue":null,"work_id":null,"year":1982},"citing_paper":{"arxiv_id":"2501.15965","last_updated":"2025-01-27T11:17:00Z","snapshot_observed_at":"2026-08-10T13:47:30.631361Z","submitted_at":"2025-01-27T11:17:00Z","title":"EDSep: An Effective Diffusion-Based Method for Speech Source Separation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T13:56:41.903723Z"},"links":{"citing_paper":"/paper/2501.15965"},"observation_digest":"sha256:b8e3c47c89c080f7449ec7d5c55c44b74fd6400abe0207127661e50f4b4e601a","observation_id":"e9beedee-51b1-4c7f-88db-1817d206c13e","resolution":{"observed_at":"2026-08-10T13:56:41.903723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:56:41.907053Z","title":"Elucidating the design space of diffusion-based generative models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.15965","last_updated":"2025-01-27T11:17:00Z","snapshot_observed_at":"2026-08-10T13:47:30.631361Z","submitted_at":"2025-01-27T11:17:00Z","title":"EDSep: An Effective Diffusion-Based Method for Speech Source Separation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T13:56:41.907053Z"},"links":{"citing_paper":"/paper/2501.15965"},"observation_digest":"sha256:13c03eb5669c64e5784acf583e71078561a7647340495abe0cc1da5b60a60b81","observation_id":"927bd458-44ad-4e11-b7db-58bb8526b3f1","resolution":{"observed_at":"2026-08-10T13:56:41.907053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:56:42.169969Z","title":"Sepdiff: Speech separation based on denoising diffusion model,","venue":null,"work_id":"869b4678-aa23-45fd-8c76-b91065caa0c6","year":2023},"citing_paper":{"arxiv_id":"2501.15965","last_updated":"2025-01-27T11:17:00Z","snapshot_observed_at":"2026-08-10T13:47:30.631361Z","submitted_at":"2025-01-27T11:17:00Z","title":"EDSep: An Effective Diffusion-Based Method for Speech Source Separation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T13:56:41.910418Z"},"links":{"citing_paper":"/paper/2501.15965"},"observation_digest":"sha256:67ce30f221899f6f7fc62dc58d2594588e32357f9c7417d17408e7c2788952fa","observation_id":"0a804e2c-82a9-4717-9a39-beb98e71f651","resolution":{"observed_at":"2026-08-10T13:56:42.174597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:56:42.158694Z","title":"Learning fast samplers for diffusion models by differentiating through sample quality,","venue":null,"work_id":"58ed286d-004f-4e05-a2dc-628166a699ad","year":2022},"citing_paper":{"arxiv_id":"2501.15965","last_updated":"2025-01-27T11:17:00Z","snapshot_observed_at":"2026-08-10T13:47:30.631361Z","submitted_at":"2025-01-27T11:17:00Z","title":"EDSep: An Effective Diffusion-Based Method for Speech Source Separation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T13:56:41.913868Z"},"links":{"citing_paper":"/paper/2501.15965"},"observation_digest":"sha256:6547b6793ea2c994b4e3e4edf46455222abab8f3894e4c7b2754c03e3f1d1ab7","observation_id":"12dc8e6b-b67b-4f60-89d9-ef9bfeac2b5d","resolution":{"observed_at":"2026-08-10T13:56:42.162762Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.06503","last_updated":"2022-05-03T08:05:54Z","snapshot_observed_at":"2026-08-09T00:23:06.653395Z","submitted_at":"2022-01-17T16:28:12Z","title":"Analytic-DPM: an Analytic Estimate of the Optimal Reverse Variance in Diffusion Probabilistic Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.06503","snapshot_observed_at":"2026-08-10T13:56:41.917195Z","title":"Analytic-dpm: an analytic estimate of the optimal reverse variance in diffusion probabilistic models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.15965","last_updated":"2025-01-27T11:17:00Z","snapshot_observed_at":"2026-08-10T13:47:30.631361Z","submitted_at":"2025-01-27T11:17:00Z","title":"EDSep: An Effective Diffusion-Based Method for Speech Source Separation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T13:56:41.917195Z"},"links":{"cited_paper":"/paper/2201.06503","citing_paper":"/paper/2501.15965"},"observation_digest":"sha256:32d6c3b3752f8117aa334ee3f999c622a68a9233edf397051ea618f4cf5f1bfe","observation_id":"517ed5ac-4d47-4e55-b4c9-5df6d14e4b4c","resolution":{"observed_at":"2026-08-10T13:56:41.917195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2105.14080","last_updated":"2021-05-28T19:48:51Z","snapshot_observed_at":"2026-08-05T07:01:40.737736Z","submitted_at":"2021-05-28T19:48:51Z","title":"Gotta Go Fast When Generating Data with Score-Based Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.14080","snapshot_observed_at":"2026-08-10T13:56:41.920937Z","title":"Gotta go fast when generating data with score-based models,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.15965","last_updated":"2025-01-27T11:17:00Z","snapshot_observed_at":"2026-08-10T13:47:30.631361Z","submitted_at":"2025-01-27T11:17:00Z","title":"EDSep: An Effective Diffusion-Based Method for Speech Source Separation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T13:56:41.920937Z"},"links":{"cited_paper":"/paper/2105.14080","citing_paper":"/paper/2501.15965"},"observation_digest":"sha256:16d26c4627281752ed9e8de7b941188d27a30c715ac645e55c8becb1806633f7","observation_id":"df60a303-e361-4ef1-b08b-d053c5829fb1","resolution":{"observed_at":"2026-08-10T13:56:41.920937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:56:41.924771Z","title":"Generative modeling by estimating gradients of the data distribution,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.15965","last_updated":"2025-01-27T11:17:00Z","snapshot_observed_at":"2026-08-10T13:47:30.631361Z","submitted_at":"2025-01-27T11:17:00Z","title":"EDSep: An Effective Diffusion-Based Method for Speech Source Separation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T13:56:41.924771Z"},"links":{"citing_paper":"/paper/2501.15965"},"observation_digest":"sha256:aeb93db4c2ccf46d3e2328e033494f2da44afe87d5e959cc7f46b656c3ba1bdb","observation_id":"59e60dde-59cb-4cf5-a425-be464278e401","resolution":{"observed_at":"2026-08-10T13:56:41.924771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:56:41.928582Z","title":"Speech enhancement and dereverberation with diffusion-based genera- tive models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15965","last_updated":"2025-01-27T11:17:00Z","snapshot_observed_at":"2026-08-10T13:47:30.631361Z","submitted_at":"2025-01-27T11:17:00Z","title":"EDSep: An Effective Diffusion-Based Method for Speech Source Separation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T13:56:41.928582Z"},"links":{"citing_paper":"/paper/2501.15965"},"observation_digest":"sha256:6e1a6f3daf33ab6b52acfa59fd3e476b849fcc0f5bd7610bbfafa57c2fa2a6d9","observation_id":"0f8836b4-cb41-406f-8444-f1e6df19433e","resolution":{"observed_at":"2026-08-10T13:56:41.928582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:56:42.133481Z","title":"Speech enhancement with score-based generative models in the complex STFT domain,","venue":null,"work_id":"7f5067eb-f731-4f16-a6c6-3da0530580ad","year":2022},"citing_paper":{"arxiv_id":"2501.15965","last_updated":"2025-01-27T11:17:00Z","snapshot_observed_at":"2026-08-10T13:47:30.631361Z","submitted_at":"2025-01-27T11:17:00Z","title":"EDSep: An Effective Diffusion-Based Method for Speech Source Separation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T13:56:41.932621Z"},"links":{"citing_paper":"/paper/2501.15965"},"observation_digest":"sha256:40006fae02a98b691b2b02cb0f06107ce74f93d9c1830b815edc8e87dd2a297b","observation_id":"d244a002-f4ae-4744-b18d-9c8a425a4996","resolution":{"observed_at":"2026-08-10T13:56:42.137446Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:56:42.122020Z","title":"Deep audio-visual speech recognition,","venue":null,"work_id":"7a5091c1-39d7-4361-8ed3-69a1f1ee2e81","year":2018},"citing_paper":{"arxiv_id":"2501.15965","last_updated":"2025-01-27T11:17:00Z","snapshot_observed_at":"2026-08-10T13:47:30.631361Z","submitted_at":"2025-01-27T11:17:00Z","title":"EDSep: An Effective Diffusion-Based Method for Speech Source Separation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T13:56:41.936538Z"},"links":{"citing_paper":"/paper/2501.15965"},"observation_digest":"sha256:764b223549b773c4fd3ed2844dab8a25608f8564cf0e7e6eb4c8dd0915886966","observation_id":"78000297-099f-43f4-b390-bec7800701a4","resolution":{"observed_at":"2026-08-10T13:56:42.125702Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.05622","last_updated":"2018-06-27T01:49:17Z","snapshot_observed_at":"2026-08-08T04:36:13.309903Z","submitted_at":"2018-06-14T15:59:12Z","title":"VoxCeleb2: Deep Speaker Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.05622","snapshot_observed_at":"2026-08-10T13:56:41.940333Z","title":"V oxceleb2: Deep speaker recognition,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.15965","last_updated":"2025-01-27T11:17:00Z","snapshot_observed_at":"2026-08-10T13:47:30.631361Z","submitted_at":"2025-01-27T11:17:00Z","title":"EDSep: An Effective Diffusion-Based Method for Speech Source Separation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T13:56:41.940333Z"},"links":{"cited_paper":"/paper/1806.05622","citing_paper":"/paper/2501.15965"},"observation_digest":"sha256:d78a91901330804878b6a3f831f0a431c866e5fd3aaad771a74840c21af71445","observation_id":"b4739929-f2e5-421d-a88a-dbf1d5310d78","resolution":{"observed_at":"2026-08-10T13:56:41.940333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:56:42.110323Z","title":"Sdr–half-baked or well done?","venue":null,"work_id":"575209ac-024e-4140-8593-7c6abfba96a9","year":2019},"citing_paper":{"arxiv_id":"2501.15965","last_updated":"2025-01-27T11:17:00Z","snapshot_observed_at":"2026-08-10T13:47:30.631361Z","submitted_at":"2025-01-27T11:17:00Z","title":"EDSep: An Effective Diffusion-Based Method for Speech Source Separation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T13:56:41.944192Z"},"links":{"citing_paper":"/paper/2501.15965"},"observation_digest":"sha256:e34c0964573071ec45dc9aa76b1aed49d925f787a5f06b09a7f5ca13daf8a163","observation_id":"37423c6c-4fe0-4dc9-8e4e-4ab248ff1be4","resolution":{"observed_at":"2026-08-10T13:56:42.114336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:56:42.098817Z","title":"Perceptual evaluation of speech quality (pesq)-a new method for speech quality assessment of telephone networks and codecs,","venue":null,"work_id":"5f66159a-ca31-4700-9165-cbd138f5b432","year":2001},"citing_paper":{"arxiv_id":"2501.15965","last_updated":"2025-01-27T11:17:00Z","snapshot_observed_at":"2026-08-10T13:47:30.631361Z","submitted_at":"2025-01-27T11:17:00Z","title":"EDSep: An Effective Diffusion-Based Method for Speech Source Separation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-10T13:56:41.947562Z"},"links":{"citing_paper":"/paper/2501.15965"},"observation_digest":"sha256:fbbc419d46bf4d3665ef10ddfd6c5cc3bf5d2bc17aae30f10aa1d6f7b8f6027c","observation_id":"0515305f-b5d8-4d8b-9d2f-51e32c3d099c","resolution":{"observed_at":"2026-08-10T13:56:42.102754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:56:42.087325Z","title":"An algorithm for predicting the intelligibility of speech masked by modulated noise maskers,","venue":null,"work_id":"29c94d5e-bacf-4585-8b77-cd1a23531eb1","year":2009},"citing_paper":{"arxiv_id":"2501.15965","last_updated":"2025-01-27T11:17:00Z","snapshot_observed_at":"2026-08-10T13:47:30.631361Z","submitted_at":"2025-01-27T11:17:00Z","title":"EDSep: An Effective Diffusion-Based Method for Speech Source Separation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-10T13:56:41.951155Z"},"links":{"citing_paper":"/paper/2501.15965"},"observation_digest":"sha256:176aba058901fc5295b855b61d1596fd749d6a471f184d39f65dd8425066b3d5","observation_id":"89043ba9-53e8-49a5-81cf-44cdad391806","resolution":{"observed_at":"2026-08-10T13:56:42.091480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.15965","last_updated":"2025-01-27T11:17:00Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-10T13:47:30.631361Z","submitted_at":"2025-01-27T11:17:00Z","title":"EDSep: An Effective Diffusion-Based Method for Speech Source Separation"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":2,"verified_fuzzy":24},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 1 inbound Pith citation observation for arXiv:2501.15965."}