{"as_of":"2026-08-16T03:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7ae8c765d3c4768749defbcded9860e55c81710744981cb60c1d2b5e90cfd707","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:01:34.417494Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:01:31.923229Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T12:01:34.538061Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-12T08:30:08.654103Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"cited_work":{"arxiv_id":"2506.00809","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.00809","snapshot_observed_at":"2026-08-07T12:01:34.538061Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","venue":"cs.SD","work_id":"14c6a5db-415e-4a92-bacb-d9cad88d58fd","year":2025},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-12T08:30:08.654103Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:31.923229Z"},"links":{"cited_paper":"/paper/2506.00809","citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:822501c1ee9dcd1eaf64b6846fd3dc8ba06730882248789a1e3c1af28ada6e66","observation_id":"bb16165a-f05c-4d15-a8f1-15c85410c3ea","resolution":{"observed_at":"2026-08-07T12:01:34.589250Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.00809/citation-record","integrity":"/paper/2506.00809/integrity","json":"/paper/2506.00809/citation-record.json","paper":"/paper/2506.00809"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:38.100255Z","title":null,"venue":null,"work_id":"9fab9a31-5918-451c-9657-6d2175c302ca","year":2025},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-12T08:30:08.654103Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:31.812218Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:cd4d65b216ae72063ecdd3ac538493e31d900738de0b8c59fb6e004dc424f344","observation_id":"f96e1558-c09a-4ec9-bc1f-297b2ddd8eed","resolution":{"observed_at":"2026-08-07T12:01:38.174821Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-12T08:30:08.654103Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"cited_work":{"arxiv_id":"2506.00809","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.00809","snapshot_observed_at":"2026-08-07T12:01:34.538061Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","venue":"cs.SD","work_id":"14c6a5db-415e-4a92-bacb-d9cad88d58fd","year":2025},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-12T08:30:08.654103Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:31.923229Z"},"links":{"cited_paper":"/paper/2506.00809","citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:822501c1ee9dcd1eaf64b6846fd3dc8ba06730882248789a1e3c1af28ada6e66","observation_id":"bb16165a-f05c-4d15-a8f1-15c85410c3ea","resolution":{"observed_at":"2026-08-07T12:01:34.589250Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:37.919496Z","title":null,"venue":null,"work_id":"7e1142f0-54f9-49fb-8058-6b155273b592","year":2025},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-12T08:30:08.654103Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:31.979929Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:62d48c3c4c3763959d5f709f34f12f177d634e8c8c5e934f83c2f8b47f18f6be","observation_id":"e2a4906f-7f91-4ca1-bf5c-16867dba7ac7","resolution":{"observed_at":"2026-08-07T12:01:37.996812Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:37.736001Z","title":null,"venue":null,"work_id":"b98c3414-ffc4-4f95-a0fd-b38e18483858","year":2025},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-12T08:30:08.654103Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:32.046530Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:12dc2aa9a84cf5550d195b878d8b74ad871e4acffabd1ffb7028a9395f005cc4","observation_id":"0f26afc9-d691-42b6-9327-7378c8c4bf05","resolution":{"observed_at":"2026-08-07T12:01:37.838598Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:37.608252Z","title":null,"venue":null,"work_id":"e946572d-7b51-48e3-b639-63b1cc0bfd7d","year":null},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-12T08:30:08.654103Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:32.119217Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:b5aa20ee6285a91734f80c1064c1888a4afc583e0c61211b6fb95cb9e64d5883","observation_id":"ae84b20e-900d-4433-a01e-92e7fc197dc5","resolution":{"observed_at":"2026-08-07T12:01:37.686806Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:37.419854Z","title":null,"venue":null,"work_id":"15f02685-7287-4072-b0cd-203e1e5408c1","year":2013},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-12T08:30:08.654103Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:32.212253Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:add34a7d92be59eccc54aed8c5c48d4d5e1e49f30faa4c38cf31b0b14bb79edb","observation_id":"493b2714-f97c-4ee9-b979-994b2451c8dc","resolution":{"observed_at":"2026-08-07T12:01:37.479628Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:37.245055Z","title":"Interspeech 2025 URGENT speech enhancement challenge,","venue":null,"work_id":"d27da902-d756-4c22-941f-a2d614b6666c","year":2025},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-12T08:30:08.654103Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:32.283850Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:9c5f7a64ad921a1bd470d60b0c571a62eb001b3832b035c46f923669b6477259","observation_id":"367a6ba7-5dc3-45ec-8632-5163a3d54fde","resolution":{"observed_at":"2026-08-07T12:01:37.321324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:37.090112Z","title":"Music source separation in the waveform domain,","venue":null,"work_id":"2bb3252c-16a1-438e-9084-f3815a31afa1","year":2020},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-12T08:30:08.654103Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:32.356169Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:2005938b807db06f637b5f81b01d338c51ee8f9931319ef15188344a82a82482","observation_id":"e5d716a5-6494-4ba8-8764-96a617dcba7d","resolution":{"observed_at":"2026-08-07T12:01:37.157527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:32.457123Z","title":"Scnet: Sparse compression network for music source separation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-12T08:30:08.654103Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:32.457123Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:1fef1fee37ed630185e977c2ec192e445bedbc726d6a0a5b6063cabb09ad2232","observation_id":"9236ba3f-ca3a-457c-87bf-2b3d0d6f8ccd","resolution":{"observed_at":"2026-08-07T12:01:32.457123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:36.911910Z","title":"Tf-gridnet: Integrating full-and sub-band modeling for speech separation,","venue":null,"work_id":"f14953fc-18eb-4d09-8b34-bc9ed1fa0184","year":2023},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-12T08:30:08.654103Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:32.494946Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:dbcc429371292b97b8507149c5592cba9108c7d4ddaf4f23659670e90d73103d","observation_id":"b56dc0e3-8825-4e22-9c8e-a5f8ab94ea99","resolution":{"observed_at":"2026-08-07T12:01:36.988000Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:36.731684Z","title":"Speech enhancement and dereverberation with diffusion-based generative models,","venue":null,"work_id":"43dbc69c-7ab3-4e43-b3a9-88a65f0e2b37","year":2023},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-12T08:30:08.654103Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:32.563917Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:daffa29d5e8d971999204d9af51a5e0dbbbfa84c2937480db5f42be700ccc14e","observation_id":"d61be144-a88a-4633-b3e7-d89311cd736c","resolution":{"observed_at":"2026-08-07T12:01:36.807544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:32.624736Z","title":"Storm: A diffusion-based stochastic regeneration model for speech en- hancement and dereverberation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-12T08:30:08.654103Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:32.624736Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:d6b89add34fc72e872b90dcd864a544d449920884d227a26b47e8047daea2c9a","observation_id":"7f30d897-1930-4cd6-8288-40e72fa14510","resolution":{"observed_at":"2026-08-07T12:01:32.624736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:36.588177Z","title":"Hifi-gan-2: Studio-quality speech enhancement via generative adversarial networks condi- tioned on acoustic features,","venue":null,"work_id":"0d959f36-c8be-41a2-83d4-61c60399a640","year":2021},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-12T08:30:08.654103Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:32.721482Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:853b03fa7a797960e2efae28a274e8e561c385af385efbdf359af5edc0ce8605","observation_id":"3084c8b7-68a5-4aa8-af85-ef8162c234d3","resolution":{"observed_at":"2026-08-07T12:01:36.658011Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:32.799443Z","title":"Finally: fast and universal speech enhancement with studio-like quality,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-12T08:30:08.654103Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:32.799443Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:d4a3a6e86d0edd65c2a6794728e4443ffbe1e120bf1dc7fb2d7c617c68992a5b","observation_id":"a54bcdaa-fceb-45ee-8f8e-6f57bd4c5de5","resolution":{"observed_at":"2026-08-07T12:01:32.799443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:36.439722Z","title":"Genhancer: High-fidelity speech enhancement via generative modeling on discrete codec tokens,","venue":null,"work_id":"d123b904-1fe4-424b-a67d-e416cf4595f2","year":2024},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-12T08:30:08.654103Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:32.878188Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:54120ff51bd36e2429e89d68c5d22eaa64c8117254d614fd960992b8f4d66e7e","observation_id":"d81cf185-7287-4262-b83a-8275e23b2f9e","resolution":{"observed_at":"2026-08-07T12:01:36.511150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:32.970893Z","title":"High-fidelity audio compression with improved rvqgan,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-12T08:30:08.654103Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:32.970893Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:09704eaa07857008063b13dcaa573475bd4d5f290543c07687d5fbf6fd80e774","observation_id":"c33007a3-d314-46da-8999-29a71cdf94d1","resolution":{"observed_at":"2026-08-07T12:01:32.970893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:36.246686Z","title":"High fidelity neural audio compression,","venue":null,"work_id":"41dfe707-6872-4015-8ee8-9c9c2cebed66","year":2023},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-12T08:30:08.654103Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:33.041342Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:d3824da37b223c079ceb282045aa4dbc0ad93f208928d790e32805f0e3115186","observation_id":"dde14055-1360-4136-b039-9d86cbc862d0","resolution":{"observed_at":"2026-08-07T12:01:36.322726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.09636","last_updated":"2023-05-16T17:41:25Z","snapshot_observed_at":"2026-08-15T01:09:02.786646Z","submitted_at":"2023-05-16T17:41:25Z","title":"SoundStorm: Efficient Parallel Audio Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.09636","snapshot_observed_at":"2026-08-07T12:01:33.109033Z","title":"Soundstorm: Efficient parallel audio gen- eration,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-12T08:30:08.654103Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:33.109033Z"},"links":{"cited_paper":"/paper/2305.09636","citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:9e2f957275c1f3b01213cd8d676f77bfa63232763b18f80d7ac072306a623505","observation_id":"be01b860-3c63-4c64-8bdc-5f7424d1977c","resolution":{"observed_at":"2026-08-07T12:01:33.109033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:36.091078Z","title":"EDM-TTS: Efficient Dual-Stage Masked Modeling for Alignment-Free Text-to- Speech Synthesis,","venue":null,"work_id":"139fef19-67b1-4df2-8ff2-63378956362c","year":2025},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-12T08:30:08.654103Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:33.208791Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:d2149953a447d74776a34a4f55492aea8425dfcfa3afadff71a887c6c8d43b80","observation_id":"19f0fa93-94d0-427f-9b34-cbae6b8e646d","resolution":{"observed_at":"2026-08-07T12:01:36.166253Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:35.916526Z","title":"Towards robust speech representation learning for thousands of languages,","venue":null,"work_id":"d4c2c2cf-97bb-44d8-9d7a-cdeca4d53b3f","year":2024},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-12T08:30:08.654103Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:33.302674Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:60717d4f8dacf5457aa2a97012b11d5d6716bf40a1544c5fbde1204bbc49a5c4","observation_id":"ab169d63-ea66-4383-9107-a12ba84be74b","resolution":{"observed_at":"2026-08-07T12:01:35.993984Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:33.340225Z","title":"Wavlm: Large-scale self- supervised pre-training for full stack speech processing,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-12T08:30:08.654103Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:33.340225Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:83454e8b23f2e363bcd6c3d4ef46e49f54473fae1f6ee321ccb6640e7f5cb3c4","observation_id":"daccfddc-1153-4d64-8615-c12806cf20ba","resolution":{"observed_at":"2026-08-07T12:01:33.340225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:35.735430Z","title":"Tokensplit: Using dis- crete speech representations for direct, refined, and transcript- conditioned speech separation and recognition,","venue":null,"work_id":"ea5afd5e-3d3c-4d76-9b60-f6521b23f899","year":2023},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-12T08:30:08.654103Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:33.390957Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:72731897fe20dead5db98d9127d16814bbc81ba7293f23a089eda5396dfef116","observation_id":"98eba353-9f50-4105-b90f-ba965fc01bae","resolution":{"observed_at":"2026-08-07T12:01:35.799869Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:33.460059Z","title":"Conformer: Convolution-augmented transformer for speech recognition,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-12T08:30:08.654103Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:33.460059Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:a7c519b26cf1d9ca0613372c7f586f16d76a64b827792b4c476917b8424b807e","observation_id":"ce297c90-ccf8-46eb-ac67-7aac19c9494a","resolution":{"observed_at":"2026-08-07T12:01:33.460059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:35.574719Z","title":"Improving music source separation based on deep neural networks through data augmentation and network blending,","venue":null,"work_id":"387bafa4-5fcb-41b6-88ea-e65a8244c1bf","year":2017},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-12T08:30:08.654103Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:33.561097Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:20c0628ea495eba5adc46317237af3b2548d03f811db660a2b2f0211cf0cd48f","observation_id":"ae059441-79d8-4879-ba5a-4091d8320f97","resolution":{"observed_at":"2026-08-07T12:01:35.643525Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:33.621229Z","title":"Sdr– half-baked or well done?","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-12T08:30:08.654103Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:33.621229Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:ffecd5b268f7e87cb38f9fbd50f7c790b93c5bff625e13b10d4e3ac9f3a5f174","observation_id":"6bd82b1a-d667-435f-b466-6106e1fafe35","resolution":{"observed_at":"2026-08-07T12:01:33.621229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.11680","last_updated":"2021-09-23T22:50:32Z","snapshot_observed_at":"2026-08-14T02:24:26.033452Z","submitted_at":"2021-09-23T22:50:32Z","title":"Simple and Effective Zero-shot Cross-lingual Phoneme Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.11680","snapshot_observed_at":"2026-08-07T12:01:33.692653Z","title":"Simple and effective zero-shot cross-lingual phoneme recognition,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-12T08:30:08.654103Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:33.692653Z"},"links":{"cited_paper":"/paper/2109.11680","citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:7675fc7893acb72e9a83a680967688c3d3bbf37e90a76185b7ac20b430e68fbf","observation_id":"478ab6df-37d6-407f-a199-7e20b7016ef7","resolution":{"observed_at":"2026-08-07T12:01:33.692653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:35.363648Z","title":"Utmos: Utokyo-sarulab system for voicemos challenge 2022,","venue":null,"work_id":"55f11064-9154-4c75-badf-8ed03b5246f5","year":2022},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-12T08:30:08.654103Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:33.766585Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:6e530e29a099c1f5d06e8c47c1437476ada52160171b2cf5fe5255610c73e647","observation_id":"0f654e45-7586-4867-98ef-7d2b7fc57871","resolution":{"observed_at":"2026-08-07T12:01:35.442379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-08-14T18:51:16.666127Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-07T12:01:33.840130Z","title":"Adam: A method for stochastic optimization,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-12T08:30:08.654103Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:33.840130Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:a211ef8bf7acde0aef01ba9e5994a219b071d96129d0869be46ea62e28512ff0","observation_id":"9be281a7-9a0f-4479-9893-c94351461137","resolution":{"observed_at":"2026-08-07T12:01:33.840130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:35.211806Z","title":"Simulating wind noise with airflow speed-dependent characteristics,","venue":null,"work_id":"9b2bab24-80da-4e53-8cec-4940b950220c","year":2022},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-12T08:30:08.654103Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:33.892787Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:61ac14a80010a1e2a4867d4109449a95efea604435d0093d5c14d8717fe570cc","observation_id":"bf70be28-8521-4d58-b70f-47f04c9363d0","resolution":{"observed_at":"2026-08-07T12:01:35.295694Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:35.060735Z","title":"Perceptual objective listening quality assessment (polqa), the third generation itu-t standard for end-to-end speech quality measurement part i—temporal align- ment,","venue":null,"work_id":"61568695-561d-4dc2-bf32-ebb62221318d","year":2013},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-12T08:30:08.654103Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:33.926562Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:d58c7c77a2b009b68f9eff04bcdfec2080dfa90eddc7ee9a8c7c5587dddc28d5","observation_id":"d570bedd-2bab-4dc0-908a-c3613b9899ec","resolution":{"observed_at":"2026-08-07T12:01:35.127198Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:34.000498Z","title":"Perceptual evaluation of speech quality (pesq)-a new method for speech quality assessment of telephone networks and codecs,","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-12T08:30:08.654103Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:34.000498Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:97748966410cc97c1d7858af646dd3d62be1ac8a471ac8ca0a66bccd06813d43","observation_id":"ed435efb-429a-419e-b04b-a605f6b7000a","resolution":{"observed_at":"2026-08-07T12:01:34.000498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:34.090779Z","title":"An algorithm for predicting the in- telligibility of speech masked by modulated noise maskers,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-12T08:30:08.654103Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:34.090779Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:eed73bbfc4e30e7bb02417df5d414353118ddccf2e76221086ce1c506edc5f9f","observation_id":"565395df-ba1f-40ff-97d4-ec376514dffa","resolution":{"observed_at":"2026-08-07T12:01:34.090779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:34.895898Z","title":"Mel-cepstral distance measure for objective speech quality assessment,","venue":null,"work_id":"adf7a815-93e6-42b3-8505-ec92832be668","year":1993},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-12T08:30:08.654103Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:34.201829Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:f9114e5a10838d0711262fa702e4c11041b8cbbc839564ac03151b2481c7a598","observation_id":"c782e164-6f7b-4002-92f4-6293e93cf082","resolution":{"observed_at":"2026-08-07T12:01:34.967420Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:34.283710Z","title":"Distance measures for speech process- ing,","venue":null,"work_id":null,"year":1976},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-12T08:30:08.654103Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:34.283710Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:efd432e27982ed57a079e5e37e7b70449986cec921a9220b99fa126eb501a3ac","observation_id":"ff1e091b-2dd3-4dda-aa89-890544a4b4cc","resolution":{"observed_at":"2026-08-07T12:01:34.283710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.16812","last_updated":"2024-09-01T14:34:27Z","snapshot_observed_at":"2026-08-13T04:32:01.197317Z","submitted_at":"2024-01-30T08:26:28Z","title":"SpeechBERTScore: Reference-Aware Automatic Evaluation of Speech Generation Leveraging NLP Evaluation Metrics","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.16812","snapshot_observed_at":"2026-08-07T12:01:34.351568Z","title":"Speechbertscore: Reference-aware automatic evaluation of speech generation leveraging nlp evaluation metrics,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-12T08:30:08.654103Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:34.351568Z"},"links":{"cited_paper":"/paper/2401.16812","citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:5baa0f87925c5969b673b561baac6897aa5e38091ae493fbb7f89d6c1e6830a8","observation_id":"c797946e-3184-4032-94bd-8df5cd3da96d","resolution":{"observed_at":"2026-08-07T12:01:34.351568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:34.698289Z","title":"Evaluation metrics for generative speech en- hancement methods: Issues and perspectives,","venue":null,"work_id":"ed579092-0cdc-4515-ae20-fa3f007e24cf","year":2023},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-12T08:30:08.654103Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:34.417494Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:06b83172f3977232dc0e7ce6082e5f5e2e9b84d6dc08bce4f578c484a4a07bf5","observation_id":"5f77411c-4ea9-4705-9018-8d7cba7d55e2","resolution":{"observed_at":"2026-08-07T12:01:34.783696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-12T08:30:08.654103Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":18,"verified_exact":0,"verified_fuzzy":16},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 1 inbound Pith citation observation for arXiv:2506.00809."}