{"as_of":"2026-08-16T22:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:855be0852bc096560e5fd292cc5c41ed7a9b8224ec702e577891e2a6aa532f9e","coverage":[{"denominator":58,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":58,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:18:07.718209Z","state":"measured"},{"denominator":58,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":58,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.19534/citation-record","integrity":"/paper/2505.19534/integrity","json":"/paper/2505.19534/citation-record.json","paper":"/paper/2505.19534"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:13.480760Z","title":"Speech enhancement","venue":null,"work_id":"0e856990-623a-4108-ab31-30592714817d","year":2006},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:01.013978Z"},"links":{"citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:871ca19b1883f50b97d712b50f84a7faa1443549004875f4a154bc0156a8ea5d","observation_id":"a2e8cc0f-6383-4cee-b0d9-2f9617e4f07e","resolution":{"observed_at":"2026-08-07T14:18:13.576735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:13.297253Z","title":"Musical source separation: An introduction","venue":null,"work_id":"3913cf41-35c1-4b94-a249-ceb7cab62e74","year":2018},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:01.124679Z"},"links":{"citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:36fd000cb28b3e9e009e72f433a5db5a9cfdfebe2dcc6f8977a56cc2bdcf2fae","observation_id":"58aeef1c-a6ea-4697-9e80-6a2a418cd973","resolution":{"observed_at":"2026-08-07T14:18:13.379433Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:13.150786Z","title":"Music source separation based on a lightweight deep learning framework (dttnet: Dual-path tfc-tdf unet)","venue":null,"work_id":"e54d00b4-1751-4c63-ba8a-c9be125084f4","year":2024},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:01.256847Z"},"links":{"citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:27ec3ba6371180fc6d06ef7f19679d3f6830a0a70bf51e2456a6c9ae5af2e732","observation_id":"808f920d-adfc-4af4-b73c-beb7784cd982","resolution":{"observed_at":"2026-08-07T14:18:13.231751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:12.982083Z","title":"Zero-shot audio source separation through query-based learning from weakly-labeled data","venue":null,"work_id":"d37c7f3b-b06f-46d9-a08d-67ffba4a9a6f","year":2022},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:01.398707Z"},"links":{"citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:9aaea764de533849147513e8c998974f43e780d9efc48f3a62104eae81240123","observation_id":"496cd896-df71-47fa-904c-df14b649e956","resolution":{"observed_at":"2026-08-07T14:18:13.033837Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:12.866372Z","title":"Fundamentals, present and future perspectives of speech enhancement","venue":null,"work_id":"7c7e0e4b-98f3-46f7-ae26-230ec25a3664","year":2021},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:01.596665Z"},"links":{"citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:334edd16048ae1f4cef55a5e54a4a98a03a65da03973f27cbe8517eff5cb7b77","observation_id":"b0e15ef5-d520-45d1-ad9c-c118929e8753","resolution":{"observed_at":"2026-08-07T14:18:12.921376Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.13254","last_updated":"2021-04-28T14:37:48Z","snapshot_observed_at":"2026-08-10T13:57:00.836098Z","submitted_at":"2019-11-27T13:50:45Z","title":"Music Source Separation in the Waveform Domain","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.13254","snapshot_observed_at":"2026-08-07T14:18:01.727418Z","title":"Music source separation in the waveform domain","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:01.727418Z"},"links":{"cited_paper":"/paper/1911.13254","citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:1ce500169f728611c1c460af6396a7d443a4c90a1d0a21a60d4cc8a37aa84705","observation_id":"e0c96930-ec50-4396-aa66-0348aee16442","resolution":{"observed_at":"2026-08-07T14:18:01.727418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06979","last_updated":"2024-04-19T09:16:17Z","snapshot_observed_at":"2026-08-16T15:08:43.935071Z","submitted_at":"2023-08-14T07:32:03Z","title":"The Sound Demixing Challenge 2023 $\\unicode{x2013}$ Music Demixing Track","version":4},"cited_work":{"arxiv_id":"2308.06979","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.06979","snapshot_observed_at":"2026-08-07T14:18:08.955092Z","title":"The Sound Demixing Challenge 2023 $\\unicode{x2013}$ Music Demixing Track","venue":"eess.AS","work_id":"37b206c2-9922-4980-ae8c-421affca8637","year":2023},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:01.842007Z"},"links":{"cited_paper":"/paper/2308.06979","citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:a4e3cdd80a8bde4df859a78c00b46f3f5ff90759f6da9117df71f1a0496ee993","observation_id":"5e8b69ab-c1d8-4aaa-9587-ff463ed0291a","resolution":{"observed_at":"2026-08-07T14:18:09.042928Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:12.690085Z","title":"Lipschitz regularized deep neural networks generalize and are adversarially robust, 2019","venue":null,"work_id":"c914d4a0-5f3a-4a17-9eba-b70b21d6098b","year":2019},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:01.967825Z"},"links":{"citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:4011f27c9baac88f74cd717585d23d8f124ef743db9ad8809a1759c1de68ef36","observation_id":"31f997e5-f6b3-402d-b9bd-752a3c500c50","resolution":{"observed_at":"2026-08-07T14:18:12.773437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:02.073628Z","title":"Scaling laws for reward model overoptimization","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:02.073628Z"},"links":{"citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:6accbd307dbfb230fe77896772f7e4e3fffb6ba5e2c6cea4fbdf95656cb82259","observation_id":"104c1bdd-b7a0-4268-bdec-938cb5bd6bd4","resolution":{"observed_at":"2026-08-07T14:18:02.073628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:12.466015Z","title":null,"venue":null,"work_id":"27a36971-ac89-4d40-9586-84ee47c7c66a","year":2020},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:02.164371Z"},"links":{"citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:00f46cdbad4da494f5e21e815bb57dfc91c4a028aeb70ba49ee1c6e9192cab3d","observation_id":"8b6a15d4-28f6-4e94-bb32-960273bd7094","resolution":{"observed_at":"2026-08-07T14:18:12.560301Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:02.283154Z","title":"Denoising diffusion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:02.283154Z"},"links":{"citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:70f8b61f658b886f4ee1dcbac9d25bfa40bfe6393e07b1b420a82e78d97292b2","observation_id":"d436e20f-9542-441b-b434-17ad77935809","resolution":{"observed_at":"2026-08-07T14:18:02.283154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:12.306868Z","title":"Why does music source separation benefit from cacophony? In 2024 IEEE International Conference on Acoustics, Speech, and Signal Processing Workshops (ICASSPW), pages 873–877","venue":null,"work_id":"01bb727d-905d-4386-ad69-aef9fa10cf4f","year":2024},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:02.363485Z"},"links":{"citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:8b78e681b63a3667cb54613e1eaeddf596ec744346f7d57d2fddd6db2a79a441","observation_id":"04c69087-faa3-4ed7-aa1d-cedb5dee29a2","resolution":{"observed_at":"2026-08-07T14:18:12.392660Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02245","last_updated":"2024-09-03T19:19:48Z","snapshot_observed_at":"2026-08-16T13:21:37.728876Z","submitted_at":"2024-09-03T19:19:48Z","title":"FastVoiceGrad: One-step Diffusion-Based Voice Conversion with Adversarial Conditional Diffusion Distillation","version":1},"cited_work":{"arxiv_id":"2409.02245","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02245","snapshot_observed_at":"2026-08-07T14:18:08.757537Z","title":"FastVoiceGrad: One-step Diffusion-Based Voice Conversion with Adversarial Conditional Diffusion Distillation","venue":"cs.SD","work_id":"bc07f065-0ef5-44c9-951a-157a09689320","year":2024},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:02.518457Z"},"links":{"cited_paper":"/paper/2409.02245","citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:7b99f74a782aad516771fe0769bdb1af4bcbf193532a98c867ad0e216462846a","observation_id":"a751b24e-ccd5-4689-a67d-e6a5ac29feb3","resolution":{"observed_at":"2026-08-07T14:18:08.851760Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-08-13T17:41:53.092611Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-07T14:18:02.620815Z","title":"Scaling laws for neural language models","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:02.620815Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:4bd69210415d1f2ce850b5137a84dfa8275f663e41f259f38e6f6c99bc6208d9","observation_id":"2bf7f931-e599-4bc4-92eb-8b545caac06e","resolution":{"observed_at":"2026-08-07T14:18:02.620815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.12757","last_updated":"2018-10-26T13:05:54Z","snapshot_observed_at":"2026-08-14T18:08:53.616146Z","submitted_at":"2018-10-26T13:05:54Z","title":"Scaling Speech Enhancement in Unseen Environments with Noise Embeddings","version":1},"cited_work":{"arxiv_id":"1810.12757","doi":null,"metadata_source":"pith","pith_arxiv_id":"1810.12757","snapshot_observed_at":"2026-08-07T14:18:08.554679Z","title":"Scaling Speech Enhancement in Unseen Environments with Noise Embeddings","venue":"eess.AS","work_id":"c036f034-26ce-42a7-a236-36fbec7d98ff","year":2018},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:02.714666Z"},"links":{"cited_paper":"/paper/1810.12757","citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:b094ce4c7f33086e3b1fd8bcdb1f8c89abc8592849fac9bb677affb4f2636fa1","observation_id":"e3c91a4d-b669-4c35-a088-5ec0a7858344","resolution":{"observed_at":"2026-08-07T14:18:08.637563Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1901.09146","last_updated":"2023-03-08T23:46:09Z","snapshot_observed_at":"2026-08-14T17:25:38.233558Z","submitted_at":"2019-01-26T02:48:08Z","title":"End-to-End Multi-Task Denoising for joint SDR and PESQ Optimization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1901.09146","snapshot_observed_at":"2026-08-07T14:18:02.849599Z","title":"End-to-end multi-task denoising for joint sdr and pesq optimization","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:02.849599Z"},"links":{"cited_paper":"/paper/1901.09146","citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:d9f12c4a296ddec9925e57d051db2547f13f7b294508a9441a2699f7bd691d93","observation_id":"ecdb2816-a949-4555-9675-95ec5ccb3191","resolution":{"observed_at":"2026-08-07T14:18:02.849599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.05418","last_updated":"2021-09-12T03:42:48Z","snapshot_observed_at":"2026-08-16T17:57:17.272574Z","submitted_at":"2021-09-12T03:42:48Z","title":"Decoupling Magnitude and Phase Estimation with Deep ResUNet for Music Source Separation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.05418","snapshot_observed_at":"2026-08-07T14:18:02.942063Z","title":"Decoupling magnitude and phase estimation with deep resunet for music source separation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:02.942063Z"},"links":{"cited_paper":"/paper/2109.05418","citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:71b53019bed94bef52a135ac2aff6c34c831daa5c0788d86de9300c8ba56806a","observation_id":"332a32f6-7203-4761-a200-2ed8aa74fdfc","resolution":{"observed_at":"2026-08-07T14:18:02.942063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:12.131473Z","title":"Torchaudio-squim: Reference-less speech quality and intelligibility measures in torchaudio","venue":null,"work_id":"019a925f-8b25-4fb2-b016-3c1d135700d4","year":2023},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:03.108655Z"},"links":{"citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:d8e51736c2e0e8b30c0babc8a343d7eb8f3a55b997ee301b5abce24a4102800d","observation_id":"549bae80-913f-4fca-8cee-37178f1854d1","resolution":{"observed_at":"2026-08-07T14:18:12.220278Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.07931","last_updated":"2022-03-22T06:44:33Z","snapshot_observed_at":"2026-08-16T17:56:09.341345Z","submitted_at":"2021-09-16T12:27:15Z","title":"DDS: A new device-degraded speech dataset for speech enhancement","version":4},"cited_work":{"arxiv_id":"2109.07931","doi":null,"metadata_source":"pith","pith_arxiv_id":"2109.07931","snapshot_observed_at":"2026-08-07T14:18:08.372396Z","title":"DDS: A new device-degraded speech dataset for speech enhancement","venue":"eess.AS","work_id":"03ee6759-0ac2-45b1-8fad-907d68c798b8","year":2021},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:03.243402Z"},"links":{"cited_paper":"/paper/2109.07931","citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:9a83951247bc390917171ea615253f52e6b8019cf05c16479734981a3d01d3ee","observation_id":"a831951a-42cc-461f-9768-1f5c57f99335","resolution":{"observed_at":"2026-08-07T14:18:08.415867Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:03.397677Z","title":"Let’s verify step by step","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:03.397677Z"},"links":{"citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:ecf39ceb3d38ad711056b59222097b5764cbf7cda2a43ce61abc5c7e82df16af","observation_id":"cc5e3696-9afe-4e65-b8d1-43f429bbd16c","resolution":{"observed_at":"2026-08-07T14:18:03.397677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-16T02:30:42.660030Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-08-07T14:18:03.516321Z","title":"Flow matching for generative modeling","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:03.516321Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:3a67de3f41b840c90a5f1266b9a3a6741b877101198226eb5268dfedc3af9f70","observation_id":"62143c50-267e-41b1-8cb0-bdfb0f409b0e","resolution":{"observed_at":"2026-08-07T14:18:03.516321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.03003","last_updated":"2022-09-07T08:59:55Z","snapshot_observed_at":"2026-07-06T13:49:40.974495Z","submitted_at":"2022-09-07T08:59:55Z","title":"Flow Straight and Fast: Learning to Generate and Transfer Data with Rectified Flow","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.03003","snapshot_observed_at":"2026-08-07T14:18:03.639206Z","title":"Flow straight and fast: Learning to generate and transfer data with rectified flow","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:03.639206Z"},"links":{"cited_paper":"/paper/2209.03003","citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:b3114198e494beb3b854143df2e908d9eb81624c97c5295bccc4c16090eac881","observation_id":"54a6546d-2ca2-4ec5-ae1d-a59d24c41e2c","resolution":{"observed_at":"2026-08-07T14:18:03.639206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:11.952634Z","title":"Music source separation with band-split rope transformer","venue":null,"work_id":"58fed799-6604-4f7c-860b-64afcf8d115c","year":2024},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:03.759985Z"},"links":{"citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:b0bb382401173ba7a745d437ed1b3a97d8b38e40d5686e623efc78baa23f00dd","observation_id":"66384f08-de7a-4102-b37c-ecd328f87f53","resolution":{"observed_at":"2026-08-07T14:18:12.046670Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06592","last_updated":"2024-12-11T22:59:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-05T19:25:40Z","title":"Improve Mathematical Reasoning in Language Models by Automated Process Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06592","snapshot_observed_at":"2026-08-07T14:18:03.881523Z","title":"Improve mathematical reasoning in language models by automated process supervision","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:03.881523Z"},"links":{"cited_paper":"/paper/2406.06592","citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:1d2448316ca526d97fad5edd88769ca35b9eb80c5226d28156ce8af4e46f8431","observation_id":"d561806d-e493-4622-8f5b-a4f687d4582a","resolution":{"observed_at":"2026-08-07T14:18:03.881523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:11.781028Z","title":"Music source separation with band-split rnn","venue":null,"work_id":"748f2d01-f2d6-47db-8dc5-1618569c0882","year":1901},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:03.960603Z"},"links":{"citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:7824cf511f8aacdf1051826eb3cd975c8841153064613cf56bcc78a552d11112","observation_id":"c679dde7-dc84-4c27-a207-5f65de1cda79","resolution":{"observed_at":"2026-08-07T14:18:11.851600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09732","last_updated":"2025-01-16T18:30:37Z","snapshot_observed_at":"2026-08-16T15:15:38.321253Z","submitted_at":"2025-01-16T18:30:37Z","title":"Inference-Time Scaling for Diffusion Models beyond Scaling Denoising Steps","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.09732","snapshot_observed_at":"2026-08-07T14:18:04.041101Z","title":"Inference-time scaling for diffusion models beyond scaling denoising steps","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:04.041101Z"},"links":{"cited_paper":"/paper/2501.09732","citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:ab19a892de748200207cd9747c856343ed74264717404c98009196ab0f9b6e28","observation_id":"45e0a6b0-c7aa-4bcb-8d70-4d2efa0d5839","resolution":{"observed_at":"2026-08-07T14:18:04.041101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:11.635657Z","title":"Whamr!: Noisy and reverberant single-channel speech separation","venue":null,"work_id":"147a39d3-6c78-4198-9245-0b51faf8f874","year":2020},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:04.176650Z"},"links":{"citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:f3f8e16793714a1558b8e6b983fdeebde89ccfa62fe8403240925c5c626ff9a0","observation_id":"739b1c6a-2c1e-41d8-8243-6cc7fc06e398","resolution":{"observed_at":"2026-08-07T14:18:11.688918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:11.529828Z","title":"Improving source separation by explicitly modeling dependencies between sources","venue":null,"work_id":"678faf8d-4a38-430e-8b8c-0100d908bae4","year":2022},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:04.300750Z"},"links":{"citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:aa1e0a7e70806041fd918cb6e5a4ab446305f568c4ba0b747740b7edca6813d3","observation_id":"b73d3672-810e-4733-82b6-3e5d857c48e3","resolution":{"observed_at":"2026-08-07T14:18:11.581790Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02257","last_updated":"2024-03-18T11:39:29Z","snapshot_observed_at":"2026-08-16T15:57:41.274523Z","submitted_at":"2023-02-04T23:18:36Z","title":"Multi-Source Diffusion Models for Simultaneous Music Generation and Separation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.02257","snapshot_observed_at":"2026-08-07T14:18:04.402764Z","title":"Multi-source diffusion models for simultaneous music generation and separation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:04.402764Z"},"links":{"cited_paper":"/paper/2302.02257","citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:371d7daedd25589054cd826223edb8d5eacd5937b883ee5d4fc4f8a6a14295e2","observation_id":"5a94ce34-dd88-4b4d-bb02-fcd7d00dd2ac","resolution":{"observed_at":"2026-08-07T14:18:04.402764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:04.508066Z","title":"Spectral normalization for generative adversarial networks, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:04.508066Z"},"links":{"citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:a882722d65d48e023ac003095561c6733fa6a6c21d41ea5641a852828168f592","observation_id":"e91b1c43-ab93-4762-aa85-86fd77865ace","resolution":{"observed_at":"2026-08-07T14:18:04.508066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19393","last_updated":"2025-03-01T06:07:39Z","snapshot_observed_at":"2026-08-14T11:38:51.383664Z","submitted_at":"2025-01-31T18:48:08Z","title":"s1: Simple test-time scaling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19393","snapshot_observed_at":"2026-08-07T14:18:04.599544Z","title":"s1: Simple test-time scaling","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:04.599544Z"},"links":{"cited_paper":"/paper/2501.19393","citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:d22800b6dec07b2c4eb7f85ab199a3b5f3d948c0192b55266d37417663434f9b","observation_id":"9028b6f7-710f-4958-8aec-1d6fcfdd8381","resolution":{"observed_at":"2026-08-07T14:18:04.599544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:11.341145Z","title":"Musdb18-hq - an uncompressed version of musdb18, August 2019","venue":null,"work_id":"32f59837-2476-4235-896a-e66b2ca81334","year":2019},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:04.769587Z"},"links":{"citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:249f26d686812e9e9ba06ac5bfb7f32c49ec30f8840e668dcfd983f9394c1877","observation_id":"5c83c34a-1c9c-482d-9c56-4ec26db066da","resolution":{"observed_at":"2026-08-07T14:18:11.426317Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08050","last_updated":"2019-09-17T19:40:34Z","snapshot_observed_at":"2026-08-14T15:35:17.364449Z","submitted_at":"2019-09-17T19:40:34Z","title":"A scalable noisy speech dataset and online subjective test framework","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.08050","snapshot_observed_at":"2026-08-07T14:18:04.876462Z","title":"A scalable noisy speech dataset and online subjective test framework","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:04.876462Z"},"links":{"cited_paper":"/paper/1909.08050","citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:f6f94ad0a9688632d61aeb1957d9976ed8e6ef436099a859ab349dfc1e74b5ed","observation_id":"22c770f5-e447-4046-b5e9-db5717665fe0","resolution":{"observed_at":"2026-08-07T14:18:04.876462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:11.195933Z","title":"Icassp 2021 deep noise suppression challenge","venue":null,"work_id":"31b0ef3a-c95b-4f65-9511-46e6084ae0c0","year":2021},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:04.984788Z"},"links":{"citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:7d97d8ea00c785fbadfccce90839fb0dcc3d78a48d1b0aa5586d30258bedeb53","observation_id":"38251e4a-46d1-4ff9-a054-9a5aaa335036","resolution":{"observed_at":"2026-08-07T14:18:11.263866Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:11.006523Z","title":"Dnsmos: A non-intrusive perceptual objective speech quality metric to evaluate noise suppressors","venue":null,"work_id":"1f32efcd-9f46-444d-8601-2392def8b343","year":2021},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:05.128944Z"},"links":{"citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:586711ed3a8880b948b096b6c3d64d0b00b3a28910aacc328c3c479bf9660175","observation_id":"8e340ed4-399b-4b8d-a302-6e88d26ea323","resolution":{"observed_at":"2026-08-07T14:18:11.094835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.13981","last_updated":"2020-10-18T04:36:21Z","snapshot_observed_at":"2026-08-14T05:23:41.710165Z","submitted_at":"2020-05-16T23:48:37Z","title":"The INTERSPEECH 2020 Deep Noise Suppression Challenge: Datasets, Subjective Testing Framework, and Challenge Results","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.13981","snapshot_observed_at":"2026-08-07T14:18:05.244016Z","title":"The interspeech 2020 deep noise suppression challenge: Datasets, subjective testing framework, and challenge results","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:05.244016Z"},"links":{"cited_paper":"/paper/2005.13981","citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:78a32ccb80989cf8ab38cd17cea5ff669728ea06480880a55f9b11e10182a76d","observation_id":"b1842fff-4e53-4fef-9e3e-cd3884e5c90c","resolution":{"observed_at":"2026-08-07T14:18:05.244016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:10.823457Z","title":"Speech enhance- ment and dereverberation with diffusion-based generative models","venue":null,"work_id":"771ec814-e970-4f5b-94bd-be9271cca225","year":2023},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:05.324773Z"},"links":{"citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:0dc4a37887087baa452e1c8568141a5f0af284900d83e2555b5b1b291092f45c","observation_id":"c99022d6-0461-4b62-aa9c-3272236d565a","resolution":{"observed_at":"2026-08-07T14:18:10.905851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.02152","last_updated":"2022-06-29T13:42:05Z","snapshot_observed_at":"2026-08-16T17:09:10.917820Z","submitted_at":"2022-04-05T12:23:51Z","title":"UTMOS: UTokyo-SaruLab System for VoiceMOS Challenge 2022","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.02152","snapshot_observed_at":"2026-08-07T14:18:05.438145Z","title":"Utmos: Utokyo-sarulab system for voicemos challenge 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:05.438145Z"},"links":{"cited_paper":"/paper/2204.02152","citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:9723aebb78af6e23cf725ec8e2b3de9d5a2d90692998abb3ef15b09ae56e9be1","observation_id":"d26ccaea-fa19-4169-b21d-de99ad98bb03","resolution":{"observed_at":"2026-08-07T14:18:05.438145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04494","last_updated":"2024-06-06T20:38:19Z","snapshot_observed_at":"2026-08-16T13:45:21.456248Z","submitted_at":"2024-06-06T20:38:19Z","title":"Towards Naturalistic Voice Conversion: NaturalVoices Dataset with an Automatic Processing Pipeline","version":1},"cited_work":{"arxiv_id":"2406.04494","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.04494","snapshot_observed_at":"2026-08-07T14:18:08.095963Z","title":"Towards Naturalistic Voice Conversion: NaturalVoices Dataset with an Automatic Processing Pipeline","venue":"eess.AS","work_id":"97ec7876-ccc9-45cb-bbe0-3439f7f31a52","year":2024},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:05.577321Z"},"links":{"cited_paper":"/paper/2406.04494","citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:aa9994ab8560d70ba1e9a508f5a6d7593a784237eab6ce0aa8e3655b5cd336df","observation_id":"40cd74ab-76c5-4f60-83bc-409f9ad5c4fe","resolution":{"observed_at":"2026-08-07T14:18:08.137067Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:10.656597Z","title":"Diffusion- based generative speech source separation","venue":null,"work_id":"ed3b06bd-97ab-4558-91bf-4d925d1019ce","year":2023},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:05.685195Z"},"links":{"citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:2c973f24893cb90296b166552762439f0c8c6f853b3f7bf11d37f4dc243d02f0","observation_id":"d01b2d77-2795-456d-905d-8b4f4dd256b0","resolution":{"observed_at":"2026-08-07T14:18:10.744863Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:10.488560Z","title":"The sciences of the artificial","venue":null,"work_id":"bdcb1609-9baa-4058-b1ac-de0f7982cc3d","year":1996},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:05.792146Z"},"links":{"citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:413e3f5ed481008f1b737b0a7ef6c2b2cba899b0e891af05cdc18ec6fc55c46c","observation_id":"16131312-face-475a-8fa6-4380ab24fdd3","resolution":{"observed_at":"2026-08-07T14:18:10.559106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03314","last_updated":"2024-08-06T17:35:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:35:05Z","title":"Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03314","snapshot_observed_at":"2026-08-07T14:18:05.961104Z","title":"Scaling llm test-time compute optimally can be more effective than scaling model parameters","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:05.961104Z"},"links":{"cited_paper":"/paper/2408.03314","citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:3f194e18902573b2d9c89c980016fefac0905836d501447da5f4f29def1ddfba","observation_id":"580604d3-a3c3-40ad-80b6-478c41afd926","resolution":{"observed_at":"2026-08-07T14:18:05.961104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:06.122499Z","title":"Deep unsupervised learning using nonequilibrium thermodynamics","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:06.122499Z"},"links":{"citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:fa1890e0f87a21d641ab2fd444f7852a55a3d4c1d082738b53b46cf3675a1b31","observation_id":"5472ccc4-c063-4649-8188-ea87af1eafba","resolution":{"observed_at":"2026-08-07T14:18:06.122499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1806.03185","last_updated":"2018-06-08T14:29:08Z","snapshot_observed_at":"2026-08-14T19:05:59.076260Z","submitted_at":"2018-06-08T14:29:08Z","title":"Wave-U-Net: A Multi-Scale Neural Network for End-to-End Audio Source Separation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.03185","snapshot_observed_at":"2026-08-07T14:18:06.241487Z","title":"Wave-u-net: A multi-scale neural network for end-to- end audio source separation","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:06.241487Z"},"links":{"cited_paper":"/paper/1806.03185","citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:1ab965f944512272373eaaaf6fff77682f021f630be2d61a413e94f952a3c295","observation_id":"ac2289e8-d2e0-4832-a883-e05b7507bd18","resolution":{"observed_at":"2026-08-07T14:18:06.241487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:10.310983Z","title":"Attention is all you need in speech separation","venue":null,"work_id":"351b16bd-728e-439c-9490-d1dfa0d2b4b7","year":2021},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:06.407091Z"},"links":{"citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:a8e18c2cac7074cca03560dc39fb03832c54bf64295d0d0b584aa37a68a08fd3","observation_id":"b5ce34c6-12d4-4e03-a329-82f47dd74069","resolution":{"observed_at":"2026-08-07T14:18:10.378359Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:10.127552Z","title":"Dose: Diffusion dropout with adaptive prior for speech enhancement","venue":null,"work_id":"e9942b3f-b36b-4831-8efe-53d17e94f338","year":2023},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:06.569889Z"},"links":{"citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:6551bf03dac5b567f8f3e0ef43a771f63551fd390e9eae03a7cf2763ea79991a","observation_id":"6751281c-7b0f-4d6e-8c75-edf273cfb0a4","resolution":{"observed_at":"2026-08-07T14:18:10.217610Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:09.970664Z","title":"The diverse environments multi-channel acoustic noise database (demand): A database of multichannel environmental noise recordings","venue":null,"work_id":"23abaa38-432e-49a9-ab5c-01c442f3b375","year":2013},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:06.722685Z"},"links":{"citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:6bf43bf2d82a4b6abdf03993a501ae9453e0c9a707ad41f4cf4bd3ceba3ca14b","observation_id":"9e535c6a-ef56-4a8d-88d1-8c0aa46654b3","resolution":{"observed_at":"2026-08-07T14:18:10.033153Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:09.748315Z","title":"The voice bank corpus: Design, collection and data analysis of a large regional accent speech database","venue":null,"work_id":"1fb16e57-ae33-4eba-9135-95a89dccd70c","year":2013},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:06.821793Z"},"links":{"citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:0a93bb16ea611461775e7c15819d0610cabf120cf8a3031ea1dc8f4c5ced17b1","observation_id":"b95510ac-e385-4f8e-8eb6-ce915e41e99e","resolution":{"observed_at":"2026-08-07T14:18:09.868598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.11171","last_updated":"2023-03-07T17:57:37Z","snapshot_observed_at":"2026-08-16T01:49:22.176843Z","submitted_at":"2022-03-21T17:48:52Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.11171","snapshot_observed_at":"2026-08-07T14:18:06.893641Z","title":"Self-consistency improves chain of thought reasoning in language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:06.893641Z"},"links":{"cited_paper":"/paper/2203.11171","citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:5e6d69273c6774e99da549d787bb4be5440fc9fce576f627065b79906f56d293","observation_id":"3dc6e315-3886-4b41-8ba0-e8ee56f27152","resolution":{"observed_at":"2026-08-07T14:18:06.893641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:09.567271Z","title":"Bss eval or peass? predicting the perception of singing-voice separation","venue":null,"work_id":"e6513262-9755-49e2-ab32-e4da996a1094","year":2018},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:06.990359Z"},"links":{"citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:97a44c8c5fb17700c96d891d2d3fc2ab041660aeaf710bd3758ad92dc504fc9c","observation_id":"5446f1c4-0af9-4d1c-896d-f5df286737f8","resolution":{"observed_at":"2026-08-07T14:18:09.681156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:07.072283Z","title":"Chain-of-thought prompting elicits reasoning in large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:07.072283Z"},"links":{"citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:340f69787bf4eba3c61aef185c2cf07ed30e3f41bb7defbc7099264349616097","observation_id":"fc6bdce4-174f-479e-8a26-a57e74930626","resolution":{"observed_at":"2026-08-07T14:18:07.072283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.00406","last_updated":"2023-06-06T05:30:55Z","snapshot_observed_at":"2026-08-16T16:11:48.310343Z","submitted_at":"2022-12-01T10:18:54Z","title":"High Fidelity Speech Enhancement with Band-split RNN","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.00406","snapshot_observed_at":"2026-08-07T14:18:07.164044Z","title":"High fidelity speech enhancement with band-split rnn","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:07.164044Z"},"links":{"cited_paper":"/paper/2212.00406","citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:c1e7f838af399a4d29bc30643276be28b9d788b114f7f3d9708601881b0150ce","observation_id":"48dec8e2-e34b-412c-ae1d-1dcc8bbccac1","resolution":{"observed_at":"2026-08-07T14:18:07.164044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:07.262269Z","title":"Flowsep: Language-queried sound separation with rectified flow matching","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:07.262269Z"},"links":{"citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:c4ddb8088395fb4b84f57acc7760b5edbfb0e737f011fd55667c33db5c5f695c","observation_id":"92ee027e-28c9-47ee-ac19-9104537bc30b","resolution":{"observed_at":"2026-08-07T14:18:07.262269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:09.188238Z","title":"Singfake: Singing voice deepfake detection","venue":null,"work_id":"297e4ee4-32cc-4580-976d-7edb8a33410b","year":2024},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:07.357331Z"},"links":{"citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:3e9e8bfe1c63962ba32659dfcaf5aa59ed65d43ffe0ed63808ff31a133d94e31","observation_id":"c10ef014-3e42-4f68-a959-8a41cb265e35","resolution":{"observed_at":"2026-08-07T14:18:09.376598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04269","last_updated":"2024-06-06T17:20:21Z","snapshot_observed_at":"2026-08-16T13:45:26.290021Z","submitted_at":"2024-06-06T17:20:21Z","title":"Beyond Performance Plateaus: A Comprehensive Study on Scalability in Speech Enhancement","version":1},"cited_work":{"arxiv_id":"2406.04269","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.04269","snapshot_observed_at":"2026-08-07T14:18:07.877566Z","title":"Beyond Performance Plateaus: A Comprehensive Study on Scalability in Speech Enhancement","venue":"eess.AS","work_id":"e42840ea-3561-46dd-b878-416d67d0931d","year":2024},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:07.460058Z"},"links":{"cited_paper":"/paper/2406.04269","citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:92e639bf34a068ec94b389baa67ddc7a5bf4b6e601a07b9e66ea123cdae9feab","observation_id":"f036e3c0-8e0e-43ff-9065-29d00b85ae73","resolution":{"observed_at":"2026-08-07T14:18:07.939482Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04660","last_updated":"2024-06-07T05:59:01Z","snapshot_observed_at":"2026-08-16T13:45:16.709080Z","submitted_at":"2024-06-07T05:59:01Z","title":"URGENT Challenge: Universality, Robustness, and Generalizability For Speech Enhancement","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04660","snapshot_observed_at":"2026-08-07T14:18:07.551339Z","title":"Urgent challenge: Universality, robustness, and generalizability for speech enhancement","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:07.551339Z"},"links":{"cited_paper":"/paper/2406.04660","citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:ba7f49bc3e2ec6567a6dc11c532d9407d5e8fe7dac1202e3cba01ccd0bd00f21","observation_id":"1482338f-7925-4df4-b801-dc2f22fd091e","resolution":{"observed_at":"2026-08-07T14:18:07.551339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.07301","last_updated":"2025-06-05T16:34:24Z","snapshot_observed_at":"2026-08-03T11:11:25.359494Z","submitted_at":"2025-01-13T13:10:16Z","title":"The Lessons of Developing Process Reward Models in Mathematical Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.07301","snapshot_observed_at":"2026-08-07T14:18:07.645718Z","title":"The lessons of developing process reward models in mathematical reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:07.645718Z"},"links":{"cited_paper":"/paper/2501.07301","citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:8616d90ad5fe34e0a1c4dfbf95ed5fa60845a80f057b82828c9e5de38b1f9a67","observation_id":"d9d58d08-753e-4add-96b4-9a0353e4ce18","resolution":{"observed_at":"2026-08-07T14:18:07.645718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16948","last_updated":"2023-12-05T08:01:39Z","snapshot_observed_at":"2026-08-16T14:56:39.598459Z","submitted_at":"2023-09-29T03:24:24Z","title":"Denoising Diffusion Bridge Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16948","snapshot_observed_at":"2026-08-07T14:18:07.718209Z","title":"V ocals” stem in the music source separation task. Figure 10: uSDR and cSDR performance across all inference steps for “Bass","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:07.718209Z"},"links":{"cited_paper":"/paper/2309.16948","citing_paper":"/paper/2505.19534"},"observation_digest":"sha256:0bf339aa2629deda72de7c61efe554dad716d23546692238e2fb4395f210ccad","observation_id":"450194fd-7df0-4fe1-bd7a-5e558e8fac42","resolution":{"observed_at":"2026-08-07T14:18:07.718209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.19534","last_updated":"2025-05-26T05:40:12Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-11T15:55:10.350786Z","submitted_at":"2025-05-26T05:40:12Z","title":"Training-Free Multi-Step Audio Source Separation"},"reference_resolution":{"displayed":58,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":28,"verified_exact":6,"verified_fuzzy":24},"total_outbound_references":58},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 58 of 58 outbound references and 0 inbound Pith citation observations for arXiv:2505.19534."}