{"as_of":"2026-08-15T21:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:17787cafe575487158648e962369ad442a115b7a19d6487faa4b410c8af95699","coverage":[{"denominator":33,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T21:58:50.975699Z","state":"measured"},{"denominator":33,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":33,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.07711/citation-record","integrity":"/paper/2508.07711/integrity","json":"/paper/2508.07711/citation-record.json","paper":"/paper/2508.07711"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:57.980345Z","title":"Natural TTS synthesis by conditioning wavenet on mel spectrogram predictions,","venue":null,"work_id":"428abfe2-bec1-403f-ae82-c9953be1f141","year":2018},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-10T17:50:26.943908Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:46.746460Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:77548876ee96c6bece445b70f8d782e18c6025159c9847381590af4439113c18","observation_id":"6c859b90-d1ac-4e8d-88ce-ab09c041f1f1","resolution":{"observed_at":"2026-08-05T21:58:58.124195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.05407","last_updated":"2024-07-09T07:42:51Z","snapshot_observed_at":"2026-08-10T17:49:50.848957Z","submitted_at":"2024-07-07T15:16:19Z","title":"CosyVoice: A Scalable Multilingual Zero-shot Text-to-speech Synthesizer based on Supervised Semantic Tokens","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.05407","snapshot_observed_at":"2026-08-05T21:58:46.879398Z","title":"Cosyvoice: A scalable multilingual zero-shot text-to-speech synthesizer based on supervised semantic tokens,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-10T17:50:26.943908Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:46.879398Z"},"links":{"cited_paper":"/paper/2407.05407","citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:24678ac0e5d4f576147f95f56beeff11818d569c5a94760c59b6f2cbad99a4ec","observation_id":"dfa96865-0b41-47db-afda-0b16f687e426","resolution":{"observed_at":"2026-08-05T21:58:46.879398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:46.982214Z","title":"MP-SENet: A speech enhancement model with parallel denoising of magnitude and phase spectra,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-10T17:50:26.943908Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:46.982214Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:4ab578b7e973ccd7cdda7d7f1c0fab52d30ad907b22208b475bfc9d8d03cb0f0","observation_id":"9e7d108b-fbd7-45c6-a0b0-a09d57dbe5f0","resolution":{"observed_at":"2026-08-05T21:58:46.982214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:47.076228Z","title":"AudioSR: Versatile audio super-resolution at scale,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-10T17:50:26.943908Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:47.076228Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:32a693593c315b79ac91f12f6aa192e0d14a63c16657acbfd02a271f51fa740f","observation_id":"2db30915-421d-4ecc-860f-5db20f53230c","resolution":{"observed_at":"2026-08-05T21:58:47.076228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:57.709572Z","title":"Towards high-quality and efficient speech bandwidth extension with parallel amplitude and phase prediction,","venue":null,"work_id":"0cea5077-fc74-4721-aea4-1427d7f7a53f","year":2024},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-10T17:50:26.943908Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:47.164702Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:3b732d810c0aa07d3605e43f0dc26cbc88aecde006777ac11ad7a6687e15c475","observation_id":"e4a7dc4a-09a1-475f-9e42-fb8e13ad4de7","resolution":{"observed_at":"2026-08-05T21:58:57.847695Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.05298","last_updated":"2025-06-04T16:25:54Z","snapshot_observed_at":"2026-08-12T23:47:31.683891Z","submitted_at":"2024-06-07T23:47:51Z","title":"Spectral Codecs: Improving Non-Autoregressive Speech Synthesis with Spectrogram-Based Audio Codecs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.05298","snapshot_observed_at":"2026-08-05T21:58:47.274633Z","title":"Spectral codecs: Spectrogram-based audio codecs for high quality speech synthesis,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-10T17:50:26.943908Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:47.274633Z"},"links":{"cited_paper":"/paper/2406.05298","citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:df33c43397afb83e92d78638f284ad0c3cc08f3506d22d585c7303c1cf093f6c","observation_id":"33c1a620-8ab2-404d-b00e-c8e949a92a2d","resolution":{"observed_at":"2026-08-05T21:58:47.274633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:57.460573Z","title":"A bitrate-scalable variational recurrent mel-spectrogram coder for real-time resynthesis-based speech coding,","venue":null,"work_id":"9fe904b3-9b7d-4cd3-812c-9d16325df2d2","year":2024},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-10T17:50:26.943908Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:47.412541Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:5309e2cd03781fbc5899239b957a6fe475c0ae3a4612e8e3cfcf1fc6e3409251","observation_id":"5441a9d9-da6f-4eb0-a2cb-cfe0b602ed5f","resolution":{"observed_at":"2026-08-05T21:58:57.591430Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:57.173074Z","title":"Speaker-dependent WaveNet vocoder","venue":null,"work_id":"e67353b0-5121-49f9-973b-f0cbde963816","year":2017},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-10T17:50:26.943908Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:47.546314Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:9244b59dd5496268279572afd8e52246f2089d43713631145397bd35f698644d","observation_id":"f42669cb-bf37-4286-b90e-1ccde5739f80","resolution":{"observed_at":"2026-08-05T21:58:57.317288Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:56.931383Z","title":"SampleRNN-based neural vocoder for statistical parametric speech synthesis,","venue":null,"work_id":"0ba1d3ea-b88e-4acd-8484-bd479e4fe1c1","year":2018},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-10T17:50:26.943908Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:47.669624Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:3da55599108986c49fbce9c30076f211971986e9c2d9514eab128485d3083d14","observation_id":"3c1c86a8-5998-419b-898b-81f96cee2141","resolution":{"observed_at":"2026-08-05T21:58:57.062141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:56.673607Z","title":"A neural vocoder with hierarchical generation of amplitude and phase spectra for statistical parametric speech synthesis,","venue":null,"work_id":"a1ee9ec9-9eb3-41da-a203-74e4a2fd1977","year":2020},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-10T17:50:26.943908Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:47.790780Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:1364f3a55e65f332b2eb714519e76e67d7b269fd4d2f7be2702d419963821fe8","observation_id":"1a7c2d6a-50dc-4114-8f94-46fc84d81c2a","resolution":{"observed_at":"2026-08-05T21:58:56.757880Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:56.441814Z","title":"WaveGlow: A flow-based generative network for speech synthesis,","venue":null,"work_id":"35b872d0-801e-4e25-8b47-77f1190300f9","year":2019},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-10T17:50:26.943908Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:47.931953Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:21226cda3c32ee19b02f219b9a721d7c7c4ac4482a81aa49b048f4eecf2b9ea1","observation_id":"c06cbfdf-3879-4da8-bcf4-bc07036232b7","resolution":{"observed_at":"2026-08-05T21:58:56.534952Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:56.240525Z","title":"WaveFlow: A compact flow- based model for raw audio,","venue":null,"work_id":"c8ad9ae9-6cf8-4b3e-b7fb-27b504520cf3","year":2020},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-10T17:50:26.943908Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:48.082993Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:2a456f32d81eba44144b9953257268598ca2c88a840cdc69b54a74e01429c381","observation_id":"bdbe497a-305f-4c6d-b1ac-76f8b8651731","resolution":{"observed_at":"2026-08-05T21:58:56.343470Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:56.038457Z","title":"MelGAN: Generative adversarial networks for conditional waveform synthesis,","venue":null,"work_id":"e966135b-344d-4d6d-b551-a26a87810635","year":2019},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-10T17:50:26.943908Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:48.199904Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:cf85eeea991209b5a34293c627c7dc35bf9ea24ea9cae953082d313a74f81838","observation_id":"7b5a78d5-8e5f-4864-9cca-8a72ef46549e","resolution":{"observed_at":"2026-08-05T21:58:56.134580Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:55.814044Z","title":"HiFi-GAN: Generative adversarial networks for efficient and high fidelity speech synthesis,","venue":null,"work_id":"70a23de7-ef48-4ba1-a1e8-eced1dbc0548","year":2020},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-10T17:50:26.943908Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:48.372358Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:8a894fa7fc39d1237ad9f8610a1946495719e7a328d806cfc9286b9c648c5c58","observation_id":"254e1a0d-9d38-4bce-b1ea-764644abeff4","resolution":{"observed_at":"2026-08-05T21:58:55.920649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:55.527873Z","title":"APNet: An all-frame-level neural vocoder incor- porating direct prediction of amplitude and phase spectra,","venue":null,"work_id":"fa2390ef-41ee-488c-99fb-9eb47a6266c3","year":2023},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-10T17:50:26.943908Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:48.463847Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:cb92c0db5c992a7a430a88d18def6e168e3a012fecfa327c2953f89b012d697b","observation_id":"e8f3c741-69fb-41d1-abd6-73f169422a50","resolution":{"observed_at":"2026-08-05T21:58:55.680449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:55.223874Z","title":"BigVGAN: A universal neural vocoder with large-scale training,","venue":null,"work_id":"4e73cf5a-cf15-4f21-abfc-4af545b1b056","year":2023},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-10T17:50:26.943908Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:48.589426Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:ed158aa77202a43ae7dbe44475a4964024f528463aa0fc5e7975f2d050c5d634","observation_id":"94c36a69-1ea9-4611-a696-2e278550d523","resolution":{"observed_at":"2026-08-05T21:58:55.399417Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:54.946629Z","title":"iSTFTNet: Fast and lightweight mel-spectrogram vocoder incorporating inverse short-time Fourier transform,","venue":null,"work_id":"f8fb1d75-e0ba-4eb8-ac4b-7a7391308045","year":2022},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-10T17:50:26.943908Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:48.708391Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:56f5e37bc0241a5e07121e2059bd628fd4f6cba11530564b37f06d349717a086","observation_id":"115a6e55-e11a-43e7-b292-8f02af07eeab","resolution":{"observed_at":"2026-08-05T21:58:55.077091Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:54.670783Z","title":"Parallel WaveGAN: A fast waveform generation model based on generative adversarial networks with multi-resolution spectrogram,","venue":null,"work_id":"927941e9-de0d-44ff-9132-29fc780e8c4c","year":2020},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-10T17:50:26.943908Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:48.845689Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:1877958f0ea17eb3ea3f350d2ba56fae1ee3cce3864e16a039c2a54959cf505a","observation_id":"38c7f07d-8d42-41fe-beb0-6676aa8258ef","resolution":{"observed_at":"2026-08-05T21:58:54.814850Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:54.451723Z","title":"Fregrad: Lightweight and fast frequency-aware diffusion vocoder,","venue":null,"work_id":"a9efcacd-ec96-43b1-8c2c-6e172b81dca7","year":2024},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-10T17:50:26.943908Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:49.006439Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:fcfa606022d9f225ea3647efc6d173862428e19157b744f117f860f409223b34","observation_id":"28687172-ca52-44e9-887c-a76e5d49c206","resolution":{"observed_at":"2026-08-05T21:58:54.542648Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:54.171356Z","title":"Direct modelling of magnitude and phase spectra for statistical parametric speech synthesis","venue":null,"work_id":"c8b52654-5e73-4d04-909a-e6794775b438","year":2017},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-10T17:50:26.943908Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:49.147748Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:c131ee45e19f59a35e790769197bdb2695473ec69b1fba755de855f7de91b99f","observation_id":"b8f34bdf-ef2d-4b52-9b49-6d0701806c76","resolution":{"observed_at":"2026-08-05T21:58:54.277199Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:53.873949Z","title":"Speech acoustic modelling from raw phase spectrum,","venue":null,"work_id":"2170d020-ce83-413d-8b72-e1ad31d74e95","year":2021},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-10T17:50:26.943908Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:49.292810Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:94d70150a490c4d127e9733b5deadf394da6e89f69cd55855a4a54c37da697a9","observation_id":"ab62aa9a-d5ab-447a-a9a7-5280d9b793bf","resolution":{"observed_at":"2026-08-05T21:58:53.987870Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:53.628215Z","title":"APNet2: High-quality and high-efficiency neural vocoder with direct prediction of amplitude and phase spectra,","venue":null,"work_id":"019d32e5-8315-471d-a4ab-e34e3f28b637","year":2023},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-10T17:50:26.943908Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:49.417300Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:a5706e3ed7a5420d0a15d425294f56a022492d1198684f31102c3f02baea4ee8","observation_id":"5e2ca6bc-1f05-48e5-915b-90b616e60e60","resolution":{"observed_at":"2026-08-05T21:58:53.772031Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:53.400127Z","title":"FreeV: Free lunch for vocoders through pseudo inversed mel filter,","venue":null,"work_id":"c7a7abd7-147e-4072-a720-75b8b3ce3626","year":2024},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-10T17:50:26.943908Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:49.530583Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:0ba3e6411dd4d65c80a9c651dfe6fe0f4df222c157bdb9dce795d54d593a10c3","observation_id":"5c0d74ba-2e37-4f84-877e-94b112fbab59","resolution":{"observed_at":"2026-08-05T21:58:53.493921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:53.104348Z","title":"Neural speech phase prediction based on parallel estimation architecture and anti-wrapping losses,","venue":null,"work_id":"d0a4c09c-5023-4099-9de3-d5f7b80d140c","year":2023},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-10T17:50:26.943908Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:49.649105Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:17bfd33e7ec08569275b8e96a244e3bd7d72b231c5955295effde4ce2a3a0f28","observation_id":"0293fb8e-edd9-4b2b-9de5-e91bcf71ba63","resolution":{"observed_at":"2026-08-05T21:58:53.259170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:52.763759Z","title":"ConvNeXt v2: Co-designing and scaling convnets with masked autoencoders,","venue":null,"work_id":"1054aef8-cb95-47a1-9578-9ff86d7056a8","year":2023},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-10T17:50:26.943908Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:49.788952Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:7e450132e065f5e48da9b74171cb94349f3a23e7f96c1e4323050b813031cebf","observation_id":"632a1649-b4d6-4cc1-b186-05fc36d2c336","resolution":{"observed_at":"2026-08-05T21:58:52.945637Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:52.519881Z","title":"MDCTCodec: A lightweight MDCT-based neural audio codec towards high sampling rate and low bitrate scenarios,","venue":null,"work_id":"6176459f-a3df-4f3d-918b-a07c11912c50","year":2024},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-10T17:50:26.943908Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:49.940636Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:4458d1b1dc7e877f1b8b20be9da3f25d7e115b3df7c1bdebf708e50c51992f1a","observation_id":"48a34773-d97d-4d6e-8d3a-4bcedd3889a5","resolution":{"observed_at":"2026-08-05T21:58:52.641348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:52.236539Z","title":"Bivocoder: A bidirectional neural vocoder integrating feature extraction and waveform generation,","venue":null,"work_id":"f33dbc39-1a51-4d6a-af47-95089753eb11","year":2024},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-10T17:50:26.943908Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:50.101371Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:2088db31f2c5b3078992ac83514c4f9a6aa377368ec20ee4078070d51493ed7a","observation_id":"e8942547-c246-4bea-aae6-1136e5146983","resolution":{"observed_at":"2026-08-05T21:58:52.386895Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.08415","last_updated":"2023-06-06T01:53:32Z","snapshot_observed_at":"2026-08-13T19:48:28.322536Z","submitted_at":"2016-06-27T19:20:40Z","title":"Gaussian Error Linear Units (GELUs)","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.08415","snapshot_observed_at":"2026-08-05T21:58:50.228558Z","title":"Gaussian error linear units (GELUs),","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-10T17:50:26.943908Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:50.228558Z"},"links":{"cited_paper":"/paper/1606.08415","citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:20f830dd85f098b5d2fce69f5691a3ea8b1ec2ab6a87d968384fb4069ca1407f","observation_id":"2b208833-e7a9-4285-a7a7-0d981bf94520","resolution":{"observed_at":"2026-08-05T21:58:50.228558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:50.352825Z","title":"Neural networks fail to learn periodic functions and how to fix it,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-10T17:50:26.943908Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:50.352825Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:9912a47c6281db8a90e1da4eda951919f68b32e6a7b46c5f5db7c9edda06fe5b","observation_id":"d0f2d758-53b3-4562-9572-65ee880f1d8e","resolution":{"observed_at":"2026-08-05T21:58:50.352825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:51.960142Z","title":"Superseded-CSTR VCTK corpus: English multi-speaker corpus for cstr voice cloning toolkit,","venue":null,"work_id":"e7bc5d92-5d2c-4bf0-b3b5-d858dc621518","year":2016},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-10T17:50:26.943908Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:50.480425Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:ab1ab5cba2a4eae1f84bdf7e144c6ca7af6f9a1d585ed664499c960a6d7d4be0","observation_id":"1057ac96-69d2-4b78-8ac8-0c41f81b4d00","resolution":{"observed_at":"2026-08-05T21:58:52.084052Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:51.651169Z","title":"Adam: A method for stochastic optimization,","venue":null,"work_id":"b8dcd296-63c2-44c1-b8ef-ca97cc61e6cc","year":2015},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-10T17:50:26.943908Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:50.632347Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:b74acc28971bfd8dde38166e4228f274fb81f6c7b89e1579d9d409dc3d5ce8c9","observation_id":"1c07c425-2055-487d-9c9b-d4c5f4edf8eb","resolution":{"observed_at":"2026-08-05T21:58:51.815178Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:51.441520Z","title":"V ocos: Closing the gap between time-domain and fourier- based neural vocoders for high-quality audio synthesis,","venue":null,"work_id":"87a27d1c-0e1d-4993-8289-bf138f062217","year":2024},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-10T17:50:26.943908Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:50.828841Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:a69f79c58b13f0824aca26558f96ab3cf827fa81f1381645bf8f67860cf3d4b0","observation_id":"36f32ae5-7a60-4379-abe0-51e776101ebd","resolution":{"observed_at":"2026-08-05T21:58:51.543909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:51.183470Z","title":"UTMOS: Utokyo-sarulab system for voiceMOS Chal- lenge 2022,","venue":null,"work_id":"c2bc34d7-15ca-4b7b-a533-c5843ea94511","year":2022},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-10T17:50:26.943908Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:50.975699Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:f0d1b9e355e43ad6b322b25a79f894621063e366e24d40cba07342d107486564","observation_id":"3ff8ec59-cb1f-41ac-9a0f-fd7692d0d78d","resolution":{"observed_at":"2026-08-05T21:58:51.282181Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-10T17:50:26.943908Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?"},"reference_resolution":{"displayed":33,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":0,"verified_fuzzy":27},"total_outbound_references":33},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 0 inbound Pith citation observations for arXiv:2508.07711."}