{"as_of":"2026-08-13T09:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5e38ee4a4bc13537d0b75ae9ba5a7919b62767ca636ebe5a9c6bb711e41bd919","coverage":[{"denominator":49,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-26T23:05:08.894347Z","state":"measured"},{"denominator":50,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":50,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-26T23:05:08.894347Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-03T23:09:00.904043Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-08-09T03:28:22.287482Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"cited_work":{"arxiv_id":"2606.17806","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.17806","snapshot_observed_at":"2026-07-03T23:09:00.904043Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","venue":"eess.AS","work_id":"ff8aa2d2-e8a3-4751-9b09-4084b733c3fd","year":2026},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-08-09T03:28:22.287482Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"cited_paper":"/paper/2606.17806","citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:c66667d16e1d6ff4aef68e5fecea759d1c9ed934c6a4f74f49c1ea2b3b8a2c26","observation_id":"259dec7b-05ee-4cca-acb3-f4c8fcd9a10e","resolution":{"observed_at":"2026-07-03T23:09:00.905894Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2606.17806/citation-record","integrity":"/paper/2606.17806/integrity","json":"/paper/2606.17806/citation-record.json","paper":"/paper/2606.17806"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-08-09T03:28:22.287482Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"cited_work":{"arxiv_id":"2606.17806","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.17806","snapshot_observed_at":"2026-07-03T23:09:00.904043Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","venue":"eess.AS","work_id":"ff8aa2d2-e8a3-4751-9b09-4084b733c3fd","year":2026},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-08-09T03:28:22.287482Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"cited_paper":"/paper/2606.17806","citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:c66667d16e1d6ff4aef68e5fecea759d1c9ed934c6a4f74f49c1ea2b3b8a2c26","observation_id":"259dec7b-05ee-4cca-acb3-f4c8fcd9a10e","resolution":{"observed_at":"2026-07-03T23:09:00.905894Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-08-09T03:28:22.287482Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:1889ec0a2766e0fc802066cb86a2d5f8d2a72a79ea01a318a12f219ac5e932be","observation_id":"4577b35a-f850-46ad-907d-c850c7f55ba4","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"Datasets The clean speech corpus comprises publicly available data from the DNS5 LibriV ox subset [23], VCTK [24], EARS [25], and LibriSpeech [26]","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-08-09T03:28:22.287482Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:ac1de5bd57f41ba74adc3df0528d15e738e9c55734c8d69f4b38e7ce1cd4f2a8","observation_id":"d2e8ad4e-7196-4f04-ac6c-09cebba5c73c","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"Our work demonstrates that this approach offers a robust and well-structured alternative to conventional spectral- domain methods","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-08-09T03:28:22.287482Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:9e5051f162e33e43e6809412b917db71723f0532f1bf52559f8f0c51ccd219d4","observation_id":"fee8362f-f0db-42cf-ad74-8b6147cf5c2e","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"12274221) and the Yangtze River Delta Science and Technology Innovation Community Joint Re- search Project (Grant No","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-08-09T03:28:22.287482Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:274fef2e485581154a2263c1ee405eaad5be362132658b8c7951f9fcdae6e52a","observation_id":"94c05127-af73-4338-90fd-5966e3daab26","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"Generative AI was employed exclusively for minor language editing and polishing to enhance clarity and readabil- ity","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-08-09T03:28:22.287482Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:1e9ec5af51abeff279d59a86114862425ba74d633b71fc090e75a15704fe1a45","observation_id":"12175251-4ca9-4688-bdfd-0d97930dfae2","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-08-09T03:28:22.287482Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:5eaa0b07780f0a60c05a4baec86d98716fc2e14a782cad3a51d1099ed6481da3","observation_id":"87cb9647-ebe9-4f9f-9408-ee60b30dd00e","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.24708","last_updated":"2026-04-05T03:27:11Z","snapshot_observed_at":"2026-08-04T09:40:49.585423Z","submitted_at":"2025-09-29T12:34:58Z","title":"SenSE: Semantic-Aware High-Fidelity Universal Speech Enhancement","version":2},"cited_work":{"arxiv_id":"2509.24708","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.24708","snapshot_observed_at":"2026-07-03T23:09:00.910994Z","title":"SenSE: Semantic-Aware High-Fidelity Universal Speech Enhancement","venue":"eess.AS","work_id":"906bd2fc-1df7-4709-aa35-6d2447f914e6","year":2025},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-08-09T03:28:22.287482Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"cited_paper":"/paper/2509.24708","citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:0271c31e0c6a947285f89ab881ff3569072e1398c4a3fd84f2168395c778dc03","observation_id":"3c600709-3401-47f8-9701-bf3527d31245","resolution":{"observed_at":"2026-07-03T23:09:00.912655Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"Efficient Speech Enhancement via Embeddings from Pre-trained Generative Audioencoders,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-08-09T03:28:22.287482Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:f4224269839575eaed5f642b052fe47b7ba52289fe36db6d1bd3b5147709c489","observation_id":"7eb99388-ec05-4c9d-95df-610863ce6813","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"Speech enhancement and dereverberation with diffusion-based generative models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-08-09T03:28:22.287482Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:8e8bdba3bed44b6da918989de972fbb8eabea56a7664bad44a169b4e4f998ee2","observation_id":"f01fc13e-b723-4da6-beca-2b215662cc96","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"Storm: A diffusion-based stochastic regeneration model for speech en- hancement and dereverberation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-08-09T03:28:22.287482Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:fdaabc701cae6b28373f0b89e9bd5e8510e7f6e715808267165aa73789164f86","observation_id":"cea15566-4cdb-4f05-b468-0a9c24e61bef","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"Selm: Speech enhancement using discrete tokens and language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-08-09T03:28:22.287482Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:3c6f5e5d4fb9118355163fe7a78b8ff2275d14aecb83e02a5db22e5f33526fa7","observation_id":"62033308-71f4-40ab-9f61-695deda6b4d9","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"Genhancer: High-Fidelity Speech Enhancement via Generative Modeling on Discrete Codec Tokens,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-08-09T03:28:22.287482Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:5fea290b3ce2858dbc773b7eda4cc39723513449ff0a9092eb42ad227bf57c10","observation_id":"01307d61-731b-41f5-95c6-46fc3c0fde9f","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.13300","last_updated":"2025-11-17T12:24:35Z","snapshot_observed_at":"2026-08-07T23:11:20.552936Z","submitted_at":"2025-11-17T12:24:35Z","title":"PASE: Leveraging the Phonological Prior of WavLM for Low-Hallucination Generative Speech Enhancement","version":1},"cited_work":{"arxiv_id":"2511.13300","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2511.13300","snapshot_observed_at":"2026-08-05T02:51:45.666161Z","title":"Pase: Leveraging the phonological prior of wavlm for low- hallucination generative speech enhancement,","venue":null,"work_id":"dd1edadb-ca0d-4737-be71-d1c02522eb9b","year":2025},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-08-09T03:28:22.287482Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"cited_paper":"/paper/2511.13300","citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:a1e745b9770252c69af3608ed118a2ac83417006aeaf6d3399bd4364cbda40ab","observation_id":"07ddf42f-fe45-4414-84ac-cb29c134cc43","resolution":{"observed_at":"2026-08-05T02:51:45.666161Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.18355","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T23:09:00.924266Z","title":"Rethinking flow and diffusion bridge models for speech enhancement,","venue":null,"work_id":"1e1ec8dd-cecb-428b-83c7-3e83bf99fdf1","year":2026},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-08-09T03:28:22.287482Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:086181786f51bd825f2861d3e961c52d8db94e0d33aa2fd42a44c60b264e1d29","observation_id":"c144dbde-166a-4ab4-8d2a-28d6f856d7f1","resolution":{"observed_at":"2026-07-03T23:09:00.925718Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"Generative speech foundation model pretraining for high-quality speech extraction and restoration,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-08-09T03:28:22.287482Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:415adcd30d7d794e5e3b411f2f7c318d4a66b005415abd1bf0f73892ccae167a","observation_id":"7eec4a31-d7a8-40c8-9616-eb3b31a9c6ad","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"Empirical distributions of dft- domain speech coefficients based on estimated speech variances,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-08-09T03:28:22.287482Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:1df89e79a9035b25d129f06bfc3a673164cb78aca2612cf5e64bf0e953dca7aa","observation_id":"02de860e-0402-4405-a533-0feac0096a62","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"Layer-wise analysis of a self-supervised speech representation model,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-08-09T03:28:22.287482Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:b3da469cc7e9ff41701d555b93be9f4eacbfe438497910e3d77d42fc084db8b0","observation_id":"3353b5e5-4275-45eb-af59-16ed113714b5","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"Investigating self-supervised learning for speech enhancement and separation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-08-09T03:28:22.287482Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:ba0e44415ee9e3105dec0c404132b99b73c44dbb1bfc6843451460af38c94ff9","observation_id":"0c174b1b-ca10-46a6-b346-ac8560c4b81a","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"Boosting self-supervised embeddings for speech en- hancement,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-08-09T03:28:22.287482Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:12da36086a13903273ea1daa26f97f47ce16c26ff8700ca01608121f4988aa13","observation_id":"e6978272-4121-4c05-9de6-d4a092c51a06","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"Wavlm: Large-scale self-supervised pre-training for full stack speech processing,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-08-09T03:28:22.287482Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:45b8ad7b78dac4379f410ae719b69fa9eb9a424994172bccc9e01ead9775af9e","observation_id":"9d5ff2ab-6bb9-4a1d-bf49-1ad74b033919","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"Scalable diffusion models with transform- ers,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-08-09T03:28:22.287482Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:39e4f8cccfd83fce47cd0e97c1a67278fca0fd1d581d43f9615ec7ad258bfb92","observation_id":"25b02c04-45a1-4815-9e66-d2409a610c3c","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"F5-tts: A fairytaler that fakes fluent and faithful speech with flow matching,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-08-09T03:28:22.287482Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:db670947c99add8b47aa1b47ae0794e9cf892f3181c07414ffcd10e53636dbf9","observation_id":"af39c964-42e2-489c-9f58-45714be7c78a","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.13720","last_updated":"2026-01-07T05:36:57Z","snapshot_observed_at":"2026-07-06T22:36:08.495952Z","submitted_at":"2025-11-17T18:59:57Z","title":"Back to Basics: Let Denoising Generative Models Denoise","version":2},"cited_work":{"arxiv_id":"2511.13720","doi":"10.48550/arxiv.2511.13720","metadata_source":"pith","pith_arxiv_id":"2511.13720","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Back to Basics: Let Denoising Generative Models Denoise","venue":"cs.CV","work_id":"37973de8-a5e6-4d92-897b-a98fa9f7f2f3","year":2025},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-08-09T03:28:22.287482Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"cited_paper":"/paper/2511.13720","citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:83ad46297809e68dd291a59bad20f497be09158dd580cdd3500314f38b888b70","observation_id":"ac060926-3e34-4452-aac7-60dfc31010b9","resolution":{"observed_at":"2026-07-03T23:09:00.923183Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"Flow matching for generative modeling,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-08-09T03:28:22.287482Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:ee604a0da36b0f395bd97cc898a5c655e944d69a449100775fd4146f5bd32892","observation_id":"d3198330-4fbd-4cc6-8afc-792e86e9788b","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"Available: https://openreview.net/forum?id= PqvMRDCJT9t","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-08-09T03:28:22.287482Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:bb5d9a81e4d28bf1f8390b82b50b8714a64e1559a2711b4512f1bbfed62fc1c8","observation_id":"36c5eea7-1f1d-4987-b0d5-ea62cc4ac12c","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00814","last_updated":"2024-05-29T14:21:47Z","snapshot_observed_at":"2026-08-08T02:04:12.090464Z","submitted_at":"2023-06-01T15:40:32Z","title":"Vocos: Closing the gap between time-domain and Fourier-based neural vocoders for high-quality audio synthesis","version":3},"cited_work":{"arxiv_id":"2306.00814","doi":"10.48550/arxiv.2306.00814","metadata_source":"pith","pith_arxiv_id":"2306.00814","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vocos: Closing the gap between time-domain and fourier-based neural vocoders for high-quality audio synthesis","venue":"cs.SD","work_id":"dfb28242-44a0-4f86-bb57-65dd1aae8947","year":2023},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-08-09T03:28:22.287482Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"cited_paper":"/paper/2306.00814","citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:5f8035d51a82e27679f07f0404c692264145eea49c4d61e85f2dc8966c7cf618","observation_id":"8dec23c5-03d7-4633-a10e-3d92de0d2bad","resolution":{"observed_at":"2026-07-03T23:09:00.912005Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"Wavtokenizer: an efficient acoustic discrete codec tokenizer for audio language modeling,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-08-09T03:28:22.287482Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:4f0d603b069c0b09d22c67bb05c8f92621649f640b9b39f18ef78a05905e08d1","observation_id":"6616a914-6e72-4476-83ef-58c4d914daa1","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"High-fidelity audio compression with improved rvqgan,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-08-09T03:28:22.287482Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:f0f88e337415d7187e5fa4de1e97c55e3d9928004a6f65548c0f8122955f988d","observation_id":"e0efc43b-7d92-46e0-b1b8-17b4d8ec5eb0","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"Icassp 2023 deep noise suppression challenge,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-08-09T03:28:22.287482Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:10fc6f71bfc05ce224ddfb93e01aca67cf2daa12b10d938e9187faed7537d076","observation_id":"1bee1b0e-b621-4dea-9eed-8eb204d79165","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"The voice bank corpus: De- sign, collection and data analysis of a large regional accent speech database,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-08-09T03:28:22.287482Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:1dd55803f74a0ebb437321db3235b22aa05ec514e911b3b76926ea17ff763c46","observation_id":"97140995-448b-4c80-8f31-1a818b269d4f","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"EARS: An Anechoic Fullband Speech Dataset Benchmarked for Speech Enhancement and Dere- verberation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-08-09T03:28:22.287482Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:cb4f015051c7d0a06e2ec8bf568bed974dad9ff356f9e2f9f1374c53740d86de","observation_id":"60215fe5-8cf8-4a7f-8ca4-e17c5685df5c","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"Lib- rispeech: An asr corpus based on public domain audio books,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-08-09T03:28:22.287482Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:c47c5c5a29d474caa6f4d6d50a6a9ea7a37d7913fb9621c2fbcd44a062c9c99e","observation_id":"1365b103-3fa2-4e4a-9fb2-87e87cdbf947","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"WHAM!: Extending speech separation to noisy environments,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-08-09T03:28:22.287482Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:526d813bcd79e96b6c43c5803fffedf631d7925b46fba584229e36e415e4b305","observation_id":"e94d2750-f6e1-42eb-a439-896d90b0b30f","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"FSD50K: an open dataset of human-labeled sound events,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-08-09T03:28:22.287482Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:782a0cfeccab6f9b9ce8797d29c008db5448f65c44abd97b5a37d9183b571b1f","observation_id":"03c0940a-7a67-4a5d-936b-b06a87de4340","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1612.01840","last_updated":"2017-09-05T18:38:33Z","snapshot_observed_at":"2026-07-06T05:21:33.309016Z","submitted_at":"2016-12-06T14:58:59Z","title":"FMA: A Dataset For Music Analysis","version":3},"cited_work":{"arxiv_id":"1612.01840","doi":null,"metadata_source":"pith","pith_arxiv_id":"1612.01840","snapshot_observed_at":"2026-07-04T14:39:57.208412Z","title":"FMA: A Dataset For Music Analysis","venue":"cs.SD","work_id":"ded6f28d-171f-48d7-861a-9d653fccecb4","year":2016},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-08-09T03:28:22.287482Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"cited_paper":"/paper/1612.01840","citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:3592602e216822d7b8bb844fd7d5909385a1acd8dd7523b4ce0b84d0d951738e","observation_id":"708dd38c-60df-4604-a8a5-a31ad1aea4b6","resolution":{"observed_at":"2026-07-03T23:09:00.928538Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"A study on data augmentation of reverberant speech for robust speech recognition,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-08-09T03:28:22.287482Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:0f557616ce9fc75e7853a806d2af89764de8f1f2c5bb2ffae4d7ff469252d650","observation_id":"3a4bb543-e066-4e09-919a-49d1961f0b0d","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"The INTERSPEECH 2020 Deep Noise Suppression Challenge: Datasets, Subjective Testing Framework, and Challenge Results,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-08-09T03:28:22.287482Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:f827e75260dd7a840fe393bf18e8b8bd4a68e2c36c14eecfb1596c85e2450453","observation_id":"f6c75420-7f9f-4073-a33b-bfc8270a4773","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"Dnsmos p.835: A non-intrusive perceptual objective speech quality metric to eval- uate noise suppressors,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-08-09T03:28:22.287482Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:f99ce730ed6e381c928b900ad8bee34d4414d04d58325c98e8277aa90e13ddb8","observation_id":"4b260545-f907-41a2-92dd-a34197d35d45","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"UTMOS: UTokyo-SaruLab System for V oice- MOS Challenge 2022,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-08-09T03:28:22.287482Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:36b82a3a96de39972e4edca9c9a7946d459c847960519df3f988e7c4cb186511","observation_id":"98664676-f6b0-40f1-92d4-43e97790940a","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"SpeechBERTScore: Reference-Aware Automatic Evaluation of Speech Generation Leveraging NLP Evaluation Metrics,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-08-09T03:28:22.287482Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:918b6bdc8f0c8304573e94f985fa864c4e605963b64b9b0363cbdac49550887a","observation_id":"0a46c703-fb82-428b-b55f-abfdfd608cbc","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"mHuBERT-147: A Compact Multilingual HuBERT Model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-08-09T03:28:22.287482Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:3952f89fc6350904568f630fd22d0dd6524ec9328077d85146b1209a8255a0f9","observation_id":"1b5b4ae7-cdaa-4fb6-a1a0-65a863a0e608","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"Evaluation metrics for generative speech en- hancement methods: Issues and perspectives,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-08-09T03:28:22.287482Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:f7913f9e87639243b1769ed0ae257158b783d2a4d2bc4b5bf8e400c16ea08fa1","observation_id":"72b6552a-2d1a-4b93-ada8-3bc7a5fa41e2","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"Simple and Effective Zero-shot Cross-lingual Phoneme Recognition,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-08-09T03:28:22.287482Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:59a49d8540e8192925243089ae5e0913103aa16e7c39bdac89951f56544fbbe4","observation_id":"455794c6-15cf-43dc-bba3-412eafe3a319","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"Robust speech recognition via large-scale weak supervision,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-08-09T03:28:22.287482Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:23c392f2e8e3cfe38d3597fc9ca6e94a68d6e3d3d86869d512eff6c03308d77b","observation_id":"d82fda8b-0ae7-4aa4-8271-cf6581724098","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"Tf-gridnet: Integrating full- and sub-band modeling for speech separation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-08-09T03:28:22.287482Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:914c2e3eef0d460ca55d3f40be184cd897d3cec9462642b86aebd1261def9d9f","observation_id":"89fe1262-c2ac-41b2-9737-7d2a85f76c9e","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00493","last_updated":"2025-06-10T06:55:05Z","snapshot_observed_at":"2026-08-07T17:37:19.033023Z","submitted_at":"2025-03-01T13:44:50Z","title":"LLaSE-G1: Incentivizing Generalization Capability for LLaMA-based Speech Enhancement","version":4},"cited_work":{"arxiv_id":"2503.00493","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.00493","snapshot_observed_at":"2026-07-03T23:09:00.924175Z","title":"Llase-g1: Incentivizing generalization capability for llama-based speech enhancement","venue":null,"work_id":"9dcf14bb-3729-4b73-8a1b-d355a5a24dbb","year":2025},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-08-09T03:28:22.287482Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"cited_paper":"/paper/2503.00493","citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:7a89988ceb5a751e0b2718157240f507e7b352ec0b27f6a6e70f72624471302f","observation_id":"204a1e36-8fbc-47a4-a68c-7aa745e0c694","resolution":{"observed_at":"2026-07-03T23:09:00.925960Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"Anyenhance: A unified generative model with prompt-guidance and self-critic for voice enhancement,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-08-09T03:28:22.287482Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:5fc9a23b4a2ab95c07677afb91f3732a8423f308bc686f9df10523e3bbb0c7ef","observation_id":"0aec4b56-5a05-40f4-bd10-1c3346a9d1ce","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"A convnet for the 2020s,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-08-09T03:28:22.287482Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:8db09be33b46ef105cded8d532b98f503b3b43e322f67b1b1b0507719488a06d","observation_id":"c83168b7-2e0f-46b6-aa60-d63c4f822ffb","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-09T03:28:22.287482Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement"},"reference_resolution":{"displayed":49,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":40,"verified_exact":7,"verified_fuzzy":0},"total_outbound_references":49},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 1 inbound Pith citation observation for arXiv:2606.17806."}