{"as_of":"2026-08-15T10:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fd3a57b6c04b226554228a1dca22952288f403ab5f45abf8ab4fac4de5354307","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T19:27:35.376381Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T19:27:35.245680Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-10T19:27:35.596808Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"cited_work":{"arxiv_id":"2501.10045","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.10045","snapshot_observed_at":"2026-08-10T19:27:35.596808Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","venue":"cs.SD","work_id":"ed298264-3129-4f33-814b-e59bbc0cd5b7","year":2025},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.245680Z"},"links":{"cited_paper":"/paper/2501.10045","citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:113ccc1e7ee217891039419b2942dd3dab1c692aded925e0b831efc51a0990c1","observation_id":"f126c493-39a4-4aa4-893b-ef23f527b24c","resolution":{"observed_at":"2026-08-10T19:27:35.601398Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.10045/citation-record","integrity":"/paper/2501.10045/integrity","json":"/paper/2501.10045/citation-record.json","paper":"/paper/2501.10045"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"cited_work":{"arxiv_id":"2501.10045","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.10045","snapshot_observed_at":"2026-08-10T19:27:35.596808Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","venue":"cs.SD","work_id":"ed298264-3129-4f33-814b-e59bbc0cd5b7","year":2025},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.245680Z"},"links":{"cited_paper":"/paper/2501.10045","citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:113ccc1e7ee217891039419b2942dd3dab1c692aded925e0b831efc51a0990c1","observation_id":"f126c493-39a4-4aa4-893b-ef23f527b24c","resolution":{"observed_at":"2026-08-10T19:27:35.601398Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:27:35.947032Z","title":"However, SR requires not only waveform reconstruction but also precise high-resolution prediction","venue":null,"work_id":"934552f3-4a85-48e8-9c0b-20d65d860692","year":null},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.250859Z"},"links":{"citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:d233a15581d1f1b4af495ed7dc27e394d8e56df5b162ead89c87ca41f6492160","observation_id":"11868aff-0021-4c83-9240-33204f6451ea","resolution":{"observed_at":"2026-08-10T19:27:35.951117Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:27:35.935856Z","title":null,"venue":null,"work_id":"efa8c1cc-aaeb-4ba8-8d75-2c02c3cace8a","year":null},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.255186Z"},"links":{"citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:239d9f9f3e02c5562d385e2eb35eda9e02435cfb8e66e981679a22a2a022b609","observation_id":"0d2bf950-58bd-439a-8852-e111a31545df","resolution":{"observed_at":"2026-08-10T19:27:35.939444Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:27:35.925157Z","title":null,"venue":null,"work_id":"a525d259-ac32-46f7-94ba-0687452d83c0","year":null},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.259336Z"},"links":{"citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:f23128a68bee3b036c94ca8bcc3206d8984d030694d8edfbb3d7491f7d307053","observation_id":"c8a7e779-2ce3-4594-a98b-476dbbfbcf91","resolution":{"observed_at":"2026-08-10T19:27:35.928792Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:27:35.913538Z","title":"Speech en- hancement via frequency bandwidth extension using line spec- tral frequencies,","venue":null,"work_id":"3b57307a-6fc2-4043-a364-e3c196d8a853","year":2001},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.263536Z"},"links":{"citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:7e2600e1fa3574f0274a8acae87c59468ce08d15a61a8af0397a3d94997bc60c","observation_id":"94dc5d04-2d0c-4da9-924e-b263d8f306bc","resolution":{"observed_at":"2026-08-10T19:27:35.917541Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.13731","last_updated":"2021-10-05T15:52:27Z","snapshot_observed_at":"2026-08-13T18:03:37.565208Z","submitted_at":"2021-09-28T13:51:16Z","title":"VoiceFixer: Toward General Speech Restoration with Neural Vocoder","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.13731","snapshot_observed_at":"2026-08-10T19:27:35.267557Z","title":"V oiceFixer: Toward general speech restoration with neural vocoder,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.267557Z"},"links":{"cited_paper":"/paper/2109.13731","citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:e1efa8b0284943450ef8e3194256553d9397ecc800924dd1aba11eac1e88ca7a","observation_id":"6d42754f-9c17-430d-bf76-2fadab36fe43","resolution":{"observed_at":"2026-08-10T19:27:35.267557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:27:35.901892Z","title":"A mel-cepstral analysis technique restoring high frequency components from low-sampling-rate speech,","venue":null,"work_id":"52960f79-aea7-4a8e-b844-31453fef9cae","year":2014},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.271484Z"},"links":{"citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:66d4f97504daabd3266f9c15feecc4052711fecf1d488c22e2aa7eefa954c444","observation_id":"3674f96c-ff99-4b43-b9c6-f9f75e7322e6","resolution":{"observed_at":"2026-08-10T19:27:35.906069Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:27:35.888923Z","title":"Statis- tical recovery of wideband speech from narrowband speech,","venue":null,"work_id":"45fc1039-0286-400d-8847-a5d23a4f69f4","year":1994},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.275385Z"},"links":{"citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:f74779f0db8d2e7f45927ac41e5edc6d000bb32ce24a817f93b158521e0c21f4","observation_id":"4728eb77-32c6-4f39-8b6c-9e301aef2452","resolution":{"observed_at":"2026-08-10T19:27:35.893744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:27:35.755161Z","title":"Speech bandwidth extension using gaussian mixture model- based estimation of the highband mel spectrum,","venue":null,"work_id":"ff822522-2b9f-42d3-8b30-535573f8bfd4","year":2011},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.278787Z"},"links":{"citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:59780ee60b62b58ae73930d0f24e52d6d3e36f22fe3535c1f491e80d74a83a78","observation_id":"40529da6-17bf-408f-836a-259066d7554c","resolution":{"observed_at":"2026-08-10T19:27:35.759802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:27:35.742855Z","title":"Memory-based approxima- tion of the gaussian mixture model framework for bandwidth extension of narrowband speech,","venue":null,"work_id":"801a5d91-2437-437a-a8f2-3a7e3af45ecb","year":2011},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.282920Z"},"links":{"citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:62df4a70d1b1a2423153268348ffe11bb0220843b128b76e8fd96e3dc77b1091","observation_id":"fd2aa87e-686e-4dee-9e5a-de3f0ec514dc","resolution":{"observed_at":"2026-08-10T19:27:35.746978Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:27:35.731414Z","title":"Synchronous overlap and add of spectra for enhancement of excitation in artificial bandwidth extension of speech,","venue":null,"work_id":"c56bcd67-2e75-41fc-aa26-2f074f31b868","year":2015},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.286401Z"},"links":{"citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:585125700dd95dc5eba37304b2e6ea66647cd6122b2a9e65aa0337c9960ef76f","observation_id":"f8006935-b8c6-409e-a7a4-1f4a39980641","resolution":{"observed_at":"2026-08-10T19:27:35.735295Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:27:35.718930Z","title":"Audio super resolu- tion using neural networks,","venue":null,"work_id":"b8dfc95b-2425-4ba9-957b-ff8decaf3e11","year":2017},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.290114Z"},"links":{"citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:5dc695cd7a9e302593a0159c54ce8c3dafdab708d362e0364bbe8d7ab147b739","observation_id":"11693ab4-d8b6-4656-8959-106c551b3972","resolution":{"observed_at":"2026-08-10T19:27:35.722653Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:27:35.706791Z","title":"Time-frequency networks for audio super- resolution,","venue":null,"work_id":"40845506-5cd0-43f1-970a-d7bc29d45aa7","year":2017},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.294182Z"},"links":{"citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:75f8468892ba2220304769eee672be109424ba17686b565df2b4491a50b5c554","observation_id":"7ea5a7e0-fddf-4d98-88a6-ca150dc4165d","resolution":{"observed_at":"2026-08-10T19:27:35.711052Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:27:35.694390Z","title":"Speech audio super-resolution for speech recognition,","venue":null,"work_id":"76db0417-4199-4def-9aaa-65cdafef41ba","year":2019},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.297867Z"},"links":{"citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:561026a0588ec269373559c573e0bd4be4a2ff000ea8217ed2ae14e3bc32ef15","observation_id":"58e068f9-a004-44ff-a257-79873aab46c9","resolution":{"observed_at":"2026-08-10T19:27:35.699117Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:27:35.678804Z","title":"Speaker and phoneme-aware speech bandwidth ex- tension with residual dual-path network,","venue":null,"work_id":"77672d31-61f5-4b4a-9127-ac67530610c2","year":2020},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.301188Z"},"links":{"citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:1a6631080dca2a707aabe2b83f343564bbbd6405f9b9598863d1e67e321e4875","observation_id":"e46b4b9f-415a-4664-a9ce-2d6f3a021c78","resolution":{"observed_at":"2026-08-10T19:27:35.684585Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:27:35.662394Z","title":"Towards robust speech super- resolution,","venue":null,"work_id":"4ba8168c-486e-49c6-b05e-c1469cdb64f6","year":2021},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.304700Z"},"links":{"citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:d3b65b85149dffac6052c5cc9f43d1afaed87d57b621affa6d297dec5d52828e","observation_id":"bc4ccd97-9eae-437e-b0ec-1774ce7dfeca","resolution":{"observed_at":"2026-08-10T19:27:35.667501Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.02321","last_updated":"2021-06-17T04:36:40Z","snapshot_observed_at":"2026-08-14T03:01:08.306221Z","submitted_at":"2021-04-06T06:52:53Z","title":"NU-Wave: A Diffusion Probabilistic Model for Neural Audio Upsampling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.02321","snapshot_observed_at":"2026-08-10T19:27:35.309153Z","title":"Nu-wave: A diffusion probabilistic model for neural audio upsampling,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.309153Z"},"links":{"cited_paper":"/paper/2104.02321","citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:2eecbb8718336b1e61d1c2ad8b860c77b5d5804c82ecd97b3b459093cc4cc6f4","observation_id":"e5bcca4f-d093-44b9-ba0b-660b62e04e4c","resolution":{"observed_at":"2026-08-10T19:27:35.309153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.08507","last_updated":"2021-06-16T01:37:34Z","snapshot_observed_at":"2026-08-13T19:03:06.443977Z","submitted_at":"2021-06-16T01:37:34Z","title":"WSRGlow: A Glow-based Waveform Generative Model for Audio Super-Resolution","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.08507","snapshot_observed_at":"2026-08-10T19:27:35.312915Z","title":"WSRGlow: A glow- based waveform generative model for audio super-resolution,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.312915Z"},"links":{"cited_paper":"/paper/2106.08507","citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:9048e705bd840b1a90aa8478104ce06ca69b11978f1306038ca05cf885535d77","observation_id":"9cd2db19-0a99-421f-a7fc-8ff0b0f527dc","resolution":{"observed_at":"2026-08-10T19:27:35.312915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.08545","last_updated":"2022-07-01T00:35:28Z","snapshot_observed_at":"2026-08-13T15:22:18.854372Z","submitted_at":"2022-06-17T04:40:14Z","title":"NU-Wave 2: A General Neural Audio Upsampling Model for Various Sampling Rates","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.08545","snapshot_observed_at":"2026-08-10T19:27:35.317049Z","title":"NUWave 2: A general neural au- dio upsampling model for various sampling rates,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.317049Z"},"links":{"cited_paper":"/paper/2206.08545","citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:b756c47c2fa6b3895b30feb1ec75701fa2339a1dae7fe6b84b87c9a3e31a4de9","observation_id":"fc0b52b2-a062-40e8-93b1-1fa37172bd93","resolution":{"observed_at":"2026-08-10T19:27:35.317049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:27:35.647470Z","title":"Neu- ral vocoder is all you need for speech super-resolution,","venue":null,"work_id":"cec6d5e3-eb39-4e28-99cf-d0a6121c85e2","year":2022},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.321167Z"},"links":{"citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:84eaf2f8af2325220cfbaa2ec8e9846d7b4f3d7edbd19eab7e32b639a9b6172a","observation_id":"e342141d-e632-4225-9fbb-2ef55e5d03ef","resolution":{"observed_at":"2026-08-10T19:27:35.652039Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07314","last_updated":"2023-09-13T21:00:09Z","snapshot_observed_at":"2026-08-13T10:14:07.754785Z","submitted_at":"2023-09-13T21:00:09Z","title":"AudioSR: Versatile Audio Super-resolution at Scale","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.07314","snapshot_observed_at":"2026-08-10T19:27:35.325429Z","title":"AudioSR: Versatile audio super-resolution at scale,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.325429Z"},"links":{"cited_paper":"/paper/2309.07314","citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:5a7ece586195ee48161cb0d1aef3a4a92dff421c4c031913acc2dead869181ba","observation_id":"d3b33b93-c2b9-4f7c-8fc3-189e12dc9eb6","resolution":{"observed_at":"2026-08-10T19:27:35.325429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11825","last_updated":"2024-11-28T02:44:32Z","snapshot_observed_at":"2026-08-13T04:58:57.872148Z","submitted_at":"2023-12-19T03:31:19Z","title":"MossFormer2: Combining Transformer and RNN-Free Recurrent Network for Enhanced Time-Domain Monaural Speech Separation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11825","snapshot_observed_at":"2026-08-10T19:27:35.329980Z","title":"MossFormer2: Combin- ing transformer and RNN-free recurrent network for enhanced time-domain monaural speech separation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.329980Z"},"links":{"cited_paper":"/paper/2312.11825","citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:dbd0250388ff22e44470a979ed454d26a89640c766f8a312e883bd1df3b04244","observation_id":"c2162230-c407-4829-abc8-f2259cebb3e2","resolution":{"observed_at":"2026-08-10T19:27:35.329980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.05646","last_updated":"2020-10-23T09:12:04Z","snapshot_observed_at":"2026-07-06T10:03:33.857220Z","submitted_at":"2020-10-12T12:33:43Z","title":"HiFi-GAN: Generative Adversarial Networks for Efficient and High Fidelity Speech Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.05646","snapshot_observed_at":"2026-08-10T19:27:35.334307Z","title":"HiFi-GAN: Generative adversar- ial networks for efficient and high fidelity speech synthesis,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.334307Z"},"links":{"cited_paper":"/paper/2010.05646","citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:a189c83ee951b650a66bec5d90763841c2c7c2371e63db6225800ba9d8d4f370","observation_id":"1cd59664-8011-4b3b-abdd-476fb2bea821","resolution":{"observed_at":"2026-08-10T19:27:35.334307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.06711","last_updated":"2019-12-09T01:17:32Z","snapshot_observed_at":"2026-07-06T08:29:37.057423Z","submitted_at":"2019-10-08T15:03:08Z","title":"MelGAN: Generative Adversarial Networks for Conditional Waveform Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.06711","snapshot_observed_at":"2026-08-10T19:27:35.338237Z","title":"MelGAN: Gen- erative adversarial networks for conditional waveform synthe- sis,","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.338237Z"},"links":{"cited_paper":"/paper/1910.06711","citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:3bd430ee4f4c1d8e64b2f0eea6e27ac79be3f9aa6b051a18b1219b5ed996c0cb","observation_id":"7915faf3-cfbe-4c63-85d2-564881084d29","resolution":{"observed_at":"2026-08-10T19:27:35.338237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.11824","last_updated":"2023-02-23T07:17:12Z","snapshot_observed_at":"2026-08-14T03:26:47.226035Z","submitted_at":"2023-02-23T07:17:12Z","title":"MossFormer: Pushing the Performance Limit of Monaural Speech Separation using Gated Single-Head Transformer with Convolution-Augmented Joint Self-Attentions","version":1},"cited_work":{"arxiv_id":"2302.11824","doi":null,"metadata_source":"pith","pith_arxiv_id":"2302.11824","snapshot_observed_at":"2026-08-10T19:27:35.481521Z","title":"MossFormer: Pushing the Performance Limit of Monaural Speech Separation using Gated Single-Head Transformer with Convolution-Augmented Joint Self-Attentions","venue":"cs.SD","work_id":"2b948e30-336c-462e-96f0-9424e6a13b20","year":2023},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.342470Z"},"links":{"cited_paper":"/paper/2302.11824","citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:b50b8ccf72fb5761a1a163764c093b4872cda0b7d97b198936908a4c6147c53c","observation_id":"46e5d25c-c395-4ca3-81c5-77e187215e08","resolution":{"observed_at":"2026-08-10T19:27:35.488238Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05030","last_updated":"2018-03-04T11:08:16Z","snapshot_observed_at":"2026-08-14T19:39:49.943835Z","submitted_at":"2018-03-04T11:08:16Z","title":"Deep-FSMN for Large Vocabulary Continuous Speech Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05030","snapshot_observed_at":"2026-08-10T19:27:35.346297Z","title":"Deepfsmn for large vo- cabulary continuous speech recognition,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.346297Z"},"links":{"cited_paper":"/paper/1803.05030","citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:f89ac4c1c0e180191b69d45f36edff0241d4dd221fa05d4954175cfc0a8f0372","observation_id":"a419540f-7fb6-4b75-8c5f-1b6086afdbd4","resolution":{"observed_at":"2026-08-10T19:27:35.346297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.04658","last_updated":"2023-02-16T18:48:56Z","snapshot_observed_at":"2026-08-14T20:49:18.244309Z","submitted_at":"2022-06-09T17:56:10Z","title":"BigVGAN: A Universal Neural Vocoder with Large-Scale Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.04658","snapshot_observed_at":"2026-08-10T19:27:35.350513Z","title":"Bigvgan: A universal neural vocoder with large-scale train- ing,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.350513Z"},"links":{"cited_paper":"/paper/2206.04658","citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:3aecaf7d3de04c4018c485bbf93753947f82f917fa730ed92212a92347cb41c4","observation_id":"68d6507c-c793-4dc5-93ff-46f1ca205a62","resolution":{"observed_at":"2026-08-10T19:27:35.350513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.13438","last_updated":"2022-10-24T17:52:02Z","snapshot_observed_at":"2026-08-15T04:43:16.361751Z","submitted_at":"2022-10-24T17:52:02Z","title":"High Fidelity Neural Audio Compression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.13438","snapshot_observed_at":"2026-08-10T19:27:35.354237Z","title":"High fidelity neural audio compression,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.354237Z"},"links":{"cited_paper":"/paper/2210.13438","citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:957791e13e27a34a4b61bcce5c63608a154e52829eeb6313d93cce26240596b4","observation_id":"44bdd52b-ef46-4d0f-91e2-8f33775bd92d","resolution":{"observed_at":"2026-08-10T19:27:35.354237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.06546","last_updated":"2023-10-26T22:17:49Z","snapshot_observed_at":"2026-08-13T16:58:58.626838Z","submitted_at":"2023-06-11T00:13:00Z","title":"High-Fidelity Audio Compression with Improved RVQGAN","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.06546","snapshot_observed_at":"2026-08-10T19:27:35.358913Z","title":"High-fidelity audio compression with improved RVQGAN,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.358913Z"},"links":{"cited_paper":"/paper/2306.06546","citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:30a02542ab74f9c15d832515c5766e06c4ac4710969f29b67327d31f8b071c0b","observation_id":"af746ae4-eecd-401a-8723-5f5a39208e55","resolution":{"observed_at":"2026-08-10T19:27:35.358913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:27:35.635303Z","title":"Least squares generative adversarial networks,","venue":null,"work_id":"2061fd3d-4568-47ce-b94e-d751718df3c4","year":2017},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.362788Z"},"links":{"citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:3cdcebdd49c57c458ec390b661927451d439298d48fc6f595024b6444914950e","observation_id":"4194de1d-8f93-40ce-8221-7218552ce846","resolution":{"observed_at":"2026-08-10T19:27:35.639488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:27:35.622174Z","title":"CSTR VCTK corpus: English multi-speaker corpus for cstr voice cloning toolkit,","venue":null,"work_id":"94123f51-0e38-4b49-96a4-c643b6e9c11e","year":2019},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.366283Z"},"links":{"citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:b83041ede30ea72e78c81aaf7faab47048bfc9562394011214e5f5583eb1b2a9","observation_id":"09c0e47e-604a-4065-bba3-0f5c9b7dc130","resolution":{"observed_at":"2026-08-10T19:27:35.626793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05725","last_updated":"2023-08-10T17:41:19Z","snapshot_observed_at":"2026-08-13T10:37:03.795815Z","submitted_at":"2023-08-10T17:41:19Z","title":"EXPRESSO: A Benchmark and Analysis of Discrete Expressive Speech Resynthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.05725","snapshot_observed_at":"2026-08-10T19:27:35.369528Z","title":"Expresso: A benchmark and analysis of discrete expressive speech resynthesis,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.369528Z"},"links":{"cited_paper":"/paper/2308.05725","citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:d8b1519718c5690a43e8ec5217ee3715a63c60ad4545b562a4e6420dfaf565bf","observation_id":"cbbfc07c-f8c8-4409-aeea-5b45fd9e2ecd","resolution":{"observed_at":"2026-08-10T19:27:35.369528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:27:35.609624Z","title":"V ocalset: A singing voice dataset,","venue":null,"work_id":"9427de9d-1161-4f41-a2ab-54c1143e34e7","year":2018},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.373009Z"},"links":{"citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:97f449b0ecb6e83c07da79e9a09d55e22b8a66131c0efb4e0dc69e15fb871856","observation_id":"f1c3188b-a450-4871-be9e-d151da94c43c","resolution":{"observed_at":"2026-08-10T19:27:35.613607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-14T20:13:52.872565Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-10T19:27:35.376381Z","title":"Decoupled weight decay regularization,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.376381Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:409a9519fd4e85b9896f88f7dabb6c5d87f4b11f882f7fe5abb11220cd9e5526","observation_id":"e2dcb97b-20ab-4b5d-a845-77a489d14512","resolution":{"observed_at":"2026-08-10T19:27:35.376381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":16,"verified_exact":1,"verified_fuzzy":16},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 1 inbound Pith citation observation for arXiv:2501.10045."}