{"as_of":"2026-08-10T16:29:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a5dd40aa7839d4ce52d4120a4fce526cd73f08afbb0b9145300e697a830a93b7","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:30:35.426830Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:30:35.281047Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T00:30:35.591170Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"cited_work":{"arxiv_id":"2506.13709","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.13709","snapshot_observed_at":"2026-08-07T00:30:35.591170Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","venue":"eess.AS","work_id":"0c3b3d20-cc31-433f-bfe4-12e56c90a4bc","year":2025},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.281047Z"},"links":{"cited_paper":"/paper/2506.13709","citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:efa5b2f4d94a13f1a141ee4786edc235bfa22f0745962da396b7a8fde287225e","observation_id":"25873659-1329-428d-ba3e-1c9cb7b1f49d","resolution":{"observed_at":"2026-08-07T00:30:35.594901Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.13709/citation-record","integrity":"/paper/2506.13709/integrity","json":"/paper/2506.13709/citation-record.json","paper":"/paper/2506.13709"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.964443Z","title":null,"venue":null,"work_id":"cb4726ed-1ddd-40db-8294-095fbc5f9498","year":null},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.276157Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:8f3a25531edb39b5c93c10f6446a5bbd60fcbc52ad2878858fbeaaf53aa06978","observation_id":"3120960a-32d8-473d-99a3-37f5ceba9f40","resolution":{"observed_at":"2026-08-07T00:30:35.968338Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"cited_work":{"arxiv_id":"2506.13709","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.13709","snapshot_observed_at":"2026-08-07T00:30:35.591170Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","venue":"eess.AS","work_id":"0c3b3d20-cc31-433f-bfe4-12e56c90a4bc","year":2025},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.281047Z"},"links":{"cited_paper":"/paper/2506.13709","citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:efa5b2f4d94a13f1a141ee4786edc235bfa22f0745962da396b7a8fde287225e","observation_id":"25873659-1329-428d-ba3e-1c9cb7b1f49d","resolution":{"observed_at":"2026-08-07T00:30:35.594901Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.943151Z","title":"Front-end processing systems We aim to test our system on speech processed by different front-end algorithms to evaluate its generalization performance","venue":null,"work_id":"0ba467a9-bc99-4121-a53d-8829ce19984b","year":null},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.289365Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:a5fd9cae8b97108b3dfd516f93cb2d82b3c29e90b4d6940d5887b70c31aae6c9","observation_id":"f3c1f7e4-37ef-45a1-99b7-92266d5c6309","resolution":{"observed_at":"2026-08-07T00:30:35.947504Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.922003Z","title":"Comparison with front-end-specific baselines We first evaluate SpeechRefiner against state-of-the-art refin- ers designed for specific front-end tasks","venue":null,"work_id":"0cd03b19-9a87-44d0-a925-30943320504f","year":null},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.297046Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:13dc3486b490868999135df9a5143832613b1a75753056539b63add46f366116","observation_id":"6415ca1a-2130-4255-a709-6ed702329607","resolution":{"observed_at":"2026-08-07T00:30:35.925582Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.911329Z","title":"Trained on data derived from a single impairment source, SpeechRefiner demonstrated re- markable generalization capabilities across a variety of unseen front-end algorithms","venue":null,"work_id":"b8777be9-9047-49ed-9833-23ad74098ddf","year":null},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.301751Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:6fd4f5cc40d4fe553deece1dffba8d743ecc72231a2358921cb9dd64f237988b","observation_id":"76a13b62-46e4-4868-a768-9ee6ecf713c1","resolution":{"observed_at":"2026-08-07T00:30:35.914745Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.900916Z","title":"62401377, Shenzhen Science and Technology Program (Shenzhen Key Laboratory, Grant No","venue":null,"work_id":"5168a975-1c63-4740-afda-97623d36f2db","year":null},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.305071Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:bdfed063431518fff2a18355b034c4cad2ef5f24cedc12edf63d840145d37f6e","observation_id":"07c7a5b9-f1b0-4bf6-8827-867d43166402","resolution":{"observed_at":"2026-08-07T00:30:35.904386Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.834796Z","title":"Tasnet: time-domain audio separa- tion network for real-time, single-channel speech separation,","venue":null,"work_id":"f40ea437-69f3-4e2f-9384-901f0d19a755","year":2018},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.332091Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:687cf37faad880fc16df0d4fb4ad72eb1f4e4bd4857f3cf773ced8de8adc0253","observation_id":"081be2da-21d3-4d40-a5c3-ec5d6d13bb86","resolution":{"observed_at":"2026-08-07T00:30:35.838325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04389","last_updated":"2024-01-09T07:21:28Z","snapshot_observed_at":"2026-07-06T17:13:08.935785Z","submitted_at":"2024-01-09T07:21:28Z","title":"RaD-Net: A Repairing and Denoising Network for Speech Signal Improvement","version":1},"cited_work":{"arxiv_id":"2401.04389","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.04389","snapshot_observed_at":"2026-08-07T00:30:35.573071Z","title":"RaD-Net: A Repairing and Denoising Network for Speech Signal Improvement","venue":"cs.SD","work_id":"3c8e3d4f-dc81-47a0-a565-11435a8ee85c","year":2024},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.335599Z"},"links":{"cited_paper":"/paper/2401.04389","citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:cef6ffec65a69e53a2607e239667eb48323d680b934942ad38c4f105ee5f24dc","observation_id":"2ee4dad0-f678-469b-be58-26c4266a8182","resolution":{"observed_at":"2026-08-07T00:30:35.580078Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.890290Z","title":"A review of multi-objective deep learning speech denoising methods,","venue":null,"work_id":"5cfad97a-b931-4bd9-b317-44dc38c037a7","year":2020},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.308832Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:0f9013ceb1581e0f061fba24dbd1044a8a5c391d23cfc2489e28406cb09bee9d","observation_id":"f38d5ecc-5d9a-4993-bc6c-27f18e203167","resolution":{"observed_at":"2026-08-07T00:30:35.893750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.879461Z","title":null,"venue":null,"work_id":"1d9c520b-824b-4dd8-965e-cf10184e1dfb","year":2010},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.312545Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:787b83ab3f7b76b37126577bd3885e2fe3676b047e50200843297ea95ad24784","observation_id":"7100e415-0564-474e-a62b-616157fa8d05","resolution":{"observed_at":"2026-08-07T00:30:35.883567Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.868647Z","title":"Supervised speech separation based on deep learning: An overview,","venue":null,"work_id":"1e264cae-1e11-4080-9130-7e837df3ee1f","year":2018},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.316184Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:4c24225c198b0fae4706de183f7171c46b7f1929859a40543cc5fa9e7f0407da","observation_id":"bd7e8a93-ba9f-47c8-9ad4-49d2ad54bceb","resolution":{"observed_at":"2026-08-07T00:30:35.872130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.319547Z","title":"Conv-tasnet: Surpassing ideal time– frequency magnitude masking for speech separation,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.319547Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:54cf5845e3cfc1e448a2d228a3aee83e19f12ce99bedc8ea87e90716ac40dc1a","observation_id":"427fd728-a477-4958-bb9a-7d3a2d23d3bf","resolution":{"observed_at":"2026-08-07T00:30:35.319547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.323688Z","title":"Neural target speech extraction: An overview,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.323688Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:8ec6ae7322a9c24593508e43191a9eca3bdf9f388bec42dded2b9e7e09563ba5","observation_id":"5066caf9-40b3-443d-8993-2fc370f03074","resolution":{"observed_at":"2026-08-07T00:30:35.323688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.845998Z","title":"Sdr– half-baked or well done?","venue":null,"work_id":"13139f69-177e-4bf3-b22e-769e67b76163","year":2019},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.327733Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:6a91ed5e7c433c23501dc74ef5bcd4b50989f138b766b8cabc4e06fad05e3b3f","observation_id":"69c547f5-d61f-47cb-810f-2539d207123a","resolution":{"observed_at":"2026-08-07T00:30:35.849068Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.762590Z","title":"Miipher: A ro- bust speech restoration model integrating self-supervised speech and text representations,","venue":null,"work_id":"a9126ca5-f9ae-4cbb-9198-7af796f43b8f","year":2023},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.364737Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:57842ea83e47ce0c92a30388abaa6d25d3d6119e847e9440357032bb9f506a9c","observation_id":"113ceae6-6f4d-47ca-b0f3-92e6d5cb5700","resolution":{"observed_at":"2026-08-07T00:30:35.766162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.932133Z","title":null,"venue":null,"work_id":"aba97d7a-5cd0-4d42-9932-7ffe1020a85b","year":2024},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.293473Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:aca48c44c5a6a28d200573eec0b9afab68485897bc903aaeee98c444f40dbf51","observation_id":"28195c6e-c597-49b0-827a-6a3dff56e6ec","resolution":{"observed_at":"2026-08-07T00:30:35.935545Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.823410Z","title":"Rad-net 2: A causal two-stage repairing and denois- ing speech enhancement network with knowledge distillation and complex axial self-attention,","venue":null,"work_id":"5c9cfecb-d062-4017-9741-69d81dbc7bbd","year":2024},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.339872Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:bf81292e15ffc4805bb1794716591dc55612672237e36aeb6f9ffb01264f218d","observation_id":"dc0bb4f1-196b-4332-85c9-ed64ddb6306e","resolution":{"observed_at":"2026-08-07T00:30:35.827454Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.813402Z","title":"Autoprep: An automatic preprocessing framework for in-the-wild speech data,","venue":null,"work_id":"b03c9d61-e904-4985-8d67-4bde091bdad2","year":2024},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.344688Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:69a336e27eb27866508ac1379d5e9fe746444213e50343bb91d4455e51f0c87c","observation_id":"b0a846e2-ae79-43f4-907c-93998380c44d","resolution":{"observed_at":"2026-08-07T00:30:35.816983Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.803102Z","title":"Wenetspeech4tts: A 12,800-hour mandarin tts corpus for large speech generation model bench- mark,","venue":null,"work_id":"96703f71-75cb-4bf4-82cc-e90a8939d8c8","year":2024},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.349118Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:f3e3cf786754754c69100be0642c1bc6505cc4fc0dd0590c88b21092a63b6efd","observation_id":"d5bfa731-0b0b-4551-a87c-ef16969fa8e3","resolution":{"observed_at":"2026-08-07T00:30:35.806822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.793632Z","title":"Dnsmos: A non-intrusive perceptual objective speech quality metric to evaluate noise sup- pressors,","venue":null,"work_id":"38b3a23e-735d-49b2-a16f-e35d398c73da","year":2021},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.352334Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:813d90ad3ab3eb5a57956658c9e5edd7aa96d7613f1f6379b3be6904d00db876","observation_id":"e943fbdb-ae53-4ca4-8124-64383fa87f3e","resolution":{"observed_at":"2026-08-07T00:30:35.796789Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.954166Z","title":"The loss function for CFM is expressed as: LCF M(θ) =Et,q(x1),pt(x|x1)∥vt(x; θ) − ut(x|x1)∥2","venue":null,"work_id":"5816904c-3a51-46ed-9207-d9903d1bd610","year":null},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.285222Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:201dc89f2e72a7a1dc1146cb4098ec4bb489ca42e156e56d4b729f6a0bcc0227","observation_id":"d725084a-67dd-471b-8d38-892849f9010a","resolution":{"observed_at":"2026-08-07T00:30:35.957835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.782822Z","title":"Icassp 2024 speech signal improvement challenge,","venue":null,"work_id":"9ffa163f-ff02-439c-b1d9-4aaf7387cc71","year":2024},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.356797Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:c28e05bfd6749a5f33d18a180ec0bdaf9eb3c1d23186304075958bdb33268bf5","observation_id":"800260f2-3466-48b1-9ba7-f4def1cb0620","resolution":{"observed_at":"2026-08-07T00:30:35.786578Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.772474Z","title":"V oicefixer: A unified framework for high-fidelity speech restoration,","venue":null,"work_id":"3e10f468-f818-440a-b2f9-9ea678da3a85","year":2022},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.361468Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:929f9f2f9d4e04896baee3db56838aa9b8df608d1e18babd3478f6ca370e4216","observation_id":"0a5aa18f-4749-49fb-b9ae-6f30523ca017","resolution":{"observed_at":"2026-08-07T00:30:35.775888Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.752264Z","title":"Storm: A diffusion-based stochastic regeneration model for speech en- hancement and dereverberation,","venue":null,"work_id":"5510c8a2-3a69-461f-8779-f9114e97f1b4","year":2023},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.367978Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:2f2727171ab6bd044a09be88b55534d3105ec8afacf0c3480cd2541eee8a342e","observation_id":"f39bf6c4-9d03-4ad1-a38f-72dba3cb89cf","resolution":{"observed_at":"2026-08-07T00:30:35.755883Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.742000Z","title":"Diffiner: A versatile diffusion-based generative refiner for speech enhancement,","venue":null,"work_id":"03a5a52d-65db-4ef6-a9d8-da9fc027f4aa","year":2023},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.371862Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:bbea4b060df12d61909a70ae95fad110bf89f9432c240667352b97984581ccf9","observation_id":"d4edd344-60fe-4b47-b743-999271f0b6a7","resolution":{"observed_at":"2026-08-07T00:30:35.745254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.375508Z","title":"Diffusion-based signal refiner for speech separation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.375508Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:4e241a1ce32b487b79e9950d373c6901cf93d30a62856d27c0abc414097ad365","observation_id":"5c4a6b26-d17d-449a-8e9a-a4a1807bf45f","resolution":{"observed_at":"2026-08-07T00:30:35.375508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.731501Z","title":"Separate and diffuse: Us- ing a pretrained diffusion model for better source separation,","venue":null,"work_id":"c6fcb813-e225-4216-bbe3-2848a5f0ae91","year":2024},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.378328Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:0b22da2711ea25b356a1d4930e586b7518e6199437cf0ca35555dec819f26b54","observation_id":"0b746e96-9e27-47c8-a69f-525b0cd203de","resolution":{"observed_at":"2026-08-07T00:30:35.735341Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.717502Z","title":"Noise-robust speech separation with fast generative correction,","venue":null,"work_id":"3343604d-19aa-4f1f-a37a-3eb6127d2353","year":2024},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.381627Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:22b47530cd8cdd2df1250b9ef1973c42faa8afe94450f1d5bf15edf85e7fe984","observation_id":"22270425-893b-4e09-b595-059f8b62e0f0","resolution":{"observed_at":"2026-08-07T00:30:35.722357Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.705333Z","title":"Flow matching for generative modeling,","venue":null,"work_id":"0d9007b3-3346-4514-a1a0-2e30c724e373","year":2023},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.384769Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:1953c3961ce96f41edd969be7a17a15c8f870580b2d12796f4c3dea4a8961dbe","observation_id":"fa2f77af-d0e8-4450-af09-406ee421086b","resolution":{"observed_at":"2026-08-07T00:30:35.709089Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.693074Z","title":"Conformer: Convolution- augmented transformer for speech recognition,","venue":null,"work_id":"ff553071-3e86-4526-a4ca-f8a539156449","year":2020},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.387604Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:2ff57679962d8d79da224db91ae43a5a0da499c020edf499bad23447c67e99fa","observation_id":"9b942e08-405c-4724-8954-c0ca87c3e087","resolution":{"observed_at":"2026-08-07T00:30:35.697056Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.680675Z","title":"Roformer: Enhanced transformer with rotary position embedding,","venue":null,"work_id":"5b1e17b5-34f8-4a35-ae22-75afaabd5f3d","year":2024},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.390801Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:3a173ccbac5750c58445b887086f0be956d6e85ce0bb89b3e00f253429d74e9f","observation_id":"e9fb4313-6eb4-4c8e-a388-15a34005b87b","resolution":{"observed_at":"2026-08-07T00:30:35.684682Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.668993Z","title":"Train short, test long: At- tention with linear biases enables input length extrapolation,","venue":null,"work_id":"dcc45b16-9ce1-4e2a-91f1-cf0cc0f1bd5e","year":2022},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.393525Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:8cfe6716ced0f8c5fc69431100743ff57e86e446748c0b74d86aa2e743a59730","observation_id":"1a3f87aa-b495-45fa-86c1-6831b5da1c8a","resolution":{"observed_at":"2026-08-07T00:30:35.672832Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00814","last_updated":"2024-05-29T14:21:47Z","snapshot_observed_at":"2026-08-08T02:04:12.090464Z","submitted_at":"2023-06-01T15:40:32Z","title":"Vocos: Closing the gap between time-domain and Fourier-based neural vocoders for high-quality audio synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.00814","snapshot_observed_at":"2026-08-07T00:30:35.396683Z","title":"V ocos: Closing the gap between time-domain and fourier-based neural vocoders for high-quality audio synthesis,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.396683Z"},"links":{"cited_paper":"/paper/2306.00814","citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:517ae211cd6631b914226886670cf543963038d8a2ab7f8b7dbc50d180bd0978","observation_id":"513f7c56-5181-4066-ab7d-01fffc8e987d","resolution":{"observed_at":"2026-08-07T00:30:35.396683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.658030Z","title":"Conditional diffusion probabilistic model for speech en- hancement,","venue":null,"work_id":"fc8aa2ac-05b1-450f-a4b1-efa3c0b94a50","year":2022},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.400718Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:8e3c542d0d855f78a6da710824252a7c848daa7cdbe8ceabd0ae2e4b2e161f64","observation_id":"48f2fc4d-5211-4c85-a933-16213b3d393f","resolution":{"observed_at":"2026-08-07T00:30:35.662060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.403803Z","title":"Investigating rnn-based speech enhancement methods for noise- robust text-to-speech","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.403803Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:0ece4c97f07076a48e7c6655d865a973eb7b2c045801e67a5908b945fb2d0212","observation_id":"1ed69ef0-491a-41c1-be2f-a1a6b1f1a322","resolution":{"observed_at":"2026-08-07T00:30:35.403803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.640293Z","title":"Speech enhancement and dereverberation with diffusion-based generative models,","venue":null,"work_id":"2fb6056a-962d-4cc5-a91c-49e0135e24ad","year":2023},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.406705Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:cb85bcceb52c6707507f48eb9024bb3bb7f7acb1c7953e572746d2f8240b0627","observation_id":"de3a22f9-3b71-4b70-a7e4-5e37da78bb46","resolution":{"observed_at":"2026-08-07T00:30:35.643733Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.629845Z","title":"Attention is all you need in speech separation,","venue":null,"work_id":"537fa161-eee8-462e-9954-35f75cf30a92","year":2021},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.409804Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:63f6c3239549f4622ebda8b3621454069faeed3aae1aa2e172c44322d35bfdf1","observation_id":"64c6161a-cf9d-4d0b-bc16-aa0da80e4d35","resolution":{"observed_at":"2026-08-07T00:30:35.633290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.11262","last_updated":"2020-05-22T16:26:54Z","snapshot_observed_at":"2026-08-10T10:54:26.224254Z","submitted_at":"2020-05-22T16:26:54Z","title":"LibriMix: An Open-Source Dataset for Generalizable Speech Separation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.11262","snapshot_observed_at":"2026-08-07T00:30:35.412898Z","title":"Librimix: An open-source dataset for generalizable speech separation,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.412898Z"},"links":{"cited_paper":"/paper/2005.11262","citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:2c812a8824fd6a10cd5390801659a968007731b2a64b9f6b1e69fc0156860834","observation_id":"e503fbd7-3814-4625-8716-bed84fe69c16","resolution":{"observed_at":"2026-08-07T00:30:35.412898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.619945Z","title":"Spex+: A complete time domain speaker extraction network,","venue":null,"work_id":"4300cd81-78a2-4dde-996f-6fe2eaa54cc9","year":2020},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.417269Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:a9e4bf4f70469afbf1b8531eab6b800603b668bbe84089f903adde7c7460a809","observation_id":"ac869582-0f68-4170-9792-971b4a90ed2a","resolution":{"observed_at":"2026-08-07T00:30:35.623164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.609210Z","title":"Muse: Multi-modal target speaker extraction with visual cues,","venue":null,"work_id":"5c42a2f0-a7c5-47b8-ad6d-ca6ed9faac4d","year":2021},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.420551Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:0973ccc437b65bbc4a4e79371acb77a648ab590414fa451f361ba01813d32d07","observation_id":"c92fd0b3-2d4b-4622-beaf-06f6b1347b7b","resolution":{"observed_at":"2026-08-07T00:30:35.612754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18802","last_updated":"2023-05-30T07:30:21Z","snapshot_observed_at":"2026-08-10T04:18:28.247428Z","submitted_at":"2023-05-30T07:30:21Z","title":"LibriTTS-R: A Restored Multi-Speaker Text-to-Speech Corpus","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18802","snapshot_observed_at":"2026-08-07T00:30:35.423748Z","title":"Libritts-r: A restored multi-speaker text-to-speech corpus,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.423748Z"},"links":{"cited_paper":"/paper/2305.18802","citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:d486d923f94d974e936192e1aac46b0bbf4f28ca519dce352516b7b4358a1898","observation_id":"34b1ff22-ef2d-433a-89ec-88726927f0d8","resolution":{"observed_at":"2026-08-07T00:30:35.423748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.426830Z","title":"Grad-tts: A diffusion probabilistic model for text-to-speech,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.426830Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:ca984f592ba9f9d99e12ae7604fe712169b9874985acb73924a489fc765c8e1e","observation_id":"f7c708e0-ec04-4340-8da6-ec9c8050da49","resolution":{"observed_at":"2026-08-07T00:30:35.426830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":2,"verified_fuzzy":29},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 1 inbound Pith citation observation for arXiv:2506.13709."}