{"as_of":"2026-08-19T20:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:53dd3b1b865fa7d7e23fa62dc20dd0afd9264be68be1e8ec7926bf90f63f4c5c","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:13:39.607461Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:13:38.532126Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-15T20:13:39.810588Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.13830","last_updated":"2025-05-22T04:41:35Z","snapshot_observed_at":"2026-08-18T17:55:16.618732Z","submitted_at":"2025-05-20T02:18:45Z","title":"Improving Noise Robustness of LLM-based Zero-shot TTS via Discrete Acoustic Token Denoising","version":2},"cited_work":{"arxiv_id":"2505.13830","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.13830","snapshot_observed_at":"2026-08-15T20:13:39.810588Z","title":"Improving Noise Robustness of LLM-based Zero-shot TTS via Discrete Acoustic Token Denoising","venue":"eess.AS","work_id":"f358dc91-15b9-42e5-9bb3-fc9369c869e9","year":2025},"citing_paper":{"arxiv_id":"2505.13830","last_updated":"2025-05-22T04:41:35Z","snapshot_observed_at":"2026-08-18T17:55:16.618732Z","submitted_at":"2025-05-20T02:18:45Z","title":"Improving Noise Robustness of LLM-based Zero-shot TTS via Discrete Acoustic Token Denoising","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:38.532126Z"},"links":{"cited_paper":"/paper/2505.13830","citing_paper":"/paper/2505.13830"},"observation_digest":"sha256:d2cab298d03f8b897bf83b8c931c5fb0cd173be8a0a2eee4fa5d477ae010bcab","observation_id":"11ac647f-9715-4978-b68b-57a4fea06ce3","resolution":{"observed_at":"2026-08-15T20:13:39.861437Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.13830/citation-record","integrity":"/paper/2505.13830/integrity","json":"/paper/2505.13830/citation-record.json","paper":"/paper/2505.13830"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.13830","last_updated":"2025-05-22T04:41:35Z","snapshot_observed_at":"2026-08-18T17:55:16.618732Z","submitted_at":"2025-05-20T02:18:45Z","title":"Improving Noise Robustness of LLM-based Zero-shot TTS via Discrete Acoustic Token Denoising","version":2},"cited_work":{"arxiv_id":"2505.13830","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.13830","snapshot_observed_at":"2026-08-15T20:13:39.810588Z","title":"Improving Noise Robustness of LLM-based Zero-shot TTS via Discrete Acoustic Token Denoising","venue":"eess.AS","work_id":"f358dc91-15b9-42e5-9bb3-fc9369c869e9","year":2025},"citing_paper":{"arxiv_id":"2505.13830","last_updated":"2025-05-22T04:41:35Z","snapshot_observed_at":"2026-08-18T17:55:16.618732Z","submitted_at":"2025-05-20T02:18:45Z","title":"Improving Noise Robustness of LLM-based Zero-shot TTS via Discrete Acoustic Token Denoising","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:38.532126Z"},"links":{"cited_paper":"/paper/2505.13830","citing_paper":"/paper/2505.13830"},"observation_digest":"sha256:d2cab298d03f8b897bf83b8c931c5fb0cd173be8a0a2eee4fa5d477ae010bcab","observation_id":"11ac647f-9715-4978-b68b-57a4fea06ce3","resolution":{"observed_at":"2026-08-15T20:13:39.861437Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:13:42.043257Z","title":null,"venue":null,"work_id":"65e70d1b-dcfe-4af7-9226-c6fdcee7ca52","year":null},"citing_paper":{"arxiv_id":"2505.13830","last_updated":"2025-05-22T04:41:35Z","snapshot_observed_at":"2026-08-18T17:55:16.618732Z","submitted_at":"2025-05-20T02:18:45Z","title":"Improving Noise Robustness of LLM-based Zero-shot TTS via Discrete Acoustic Token Denoising","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:38.577450Z"},"links":{"citing_paper":"/paper/2505.13830"},"observation_digest":"sha256:f802728000fa4f8db7f8139766359df2aae80b8f5d950913c0f4e1e47202fb06","observation_id":"6b80826e-9048-4861-9aec-208d1ba7eede","resolution":{"observed_at":"2026-08-15T20:13:42.084501Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:13:41.948045Z","title":"test-clean","venue":null,"work_id":"077f1dc5-36cc-46d9-a7ed-1d72cbdb5d76","year":2022},"citing_paper":{"arxiv_id":"2505.13830","last_updated":"2025-05-22T04:41:35Z","snapshot_observed_at":"2026-08-18T17:55:16.618732Z","submitted_at":"2025-05-20T02:18:45Z","title":"Improving Noise Robustness of LLM-based Zero-shot TTS via Discrete Acoustic Token Denoising","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:38.584588Z"},"links":{"citing_paper":"/paper/2505.13830"},"observation_digest":"sha256:ff439953acaa5d094508181fd3de57c2871269c60ab7c7b9fed70b5fffbf341c","observation_id":"feb05a2a-cff2-4a75-b94c-5eefa0275a38","resolution":{"observed_at":"2026-08-15T20:13:41.954145Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:13:41.932345Z","title":"Results on the SE Task The experimental results of the SE task are depicted in Table 1","venue":null,"work_id":"af260e0f-f4e1-4035-be59-d471891fae18","year":null},"citing_paper":{"arxiv_id":"2505.13830","last_updated":"2025-05-22T04:41:35Z","snapshot_observed_at":"2026-08-18T17:55:16.618732Z","submitted_at":"2025-05-20T02:18:45Z","title":"Improving Noise Robustness of LLM-based Zero-shot TTS via Discrete Acoustic Token Denoising","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:38.590759Z"},"links":{"citing_paper":"/paper/2505.13830"},"observation_digest":"sha256:58c885375d9a39c0c8a00bdcec6b74fb4d72b7b5981bf8c8f8ad7dd13ce56cb5","observation_id":"d6911bc3-06f0-415a-ad86-9c7557b27fc4","resolution":{"observed_at":"2026-08-15T20:13:41.936561Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:13:41.840896Z","title":null,"venue":null,"work_id":"02c4d569-2bed-40cb-b712-3ab5ae671e34","year":null},"citing_paper":{"arxiv_id":"2505.13830","last_updated":"2025-05-22T04:41:35Z","snapshot_observed_at":"2026-08-18T17:55:16.618732Z","submitted_at":"2025-05-20T02:18:45Z","title":"Improving Noise Robustness of LLM-based Zero-shot TTS via Discrete Acoustic Token Denoising","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:38.688105Z"},"links":{"citing_paper":"/paper/2505.13830"},"observation_digest":"sha256:c5d2e699edfd116810b6945dd2772d55c671917629f90c5c41b6dab07fa77e97","observation_id":"22417709-1572-4dc5-b629-323a8ff6f29c","resolution":{"observed_at":"2026-08-15T20:13:41.922978Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:13:41.773455Z","title":null,"venue":null,"work_id":"da234531-3980-4ea8-8db3-44f701ec14a2","year":null},"citing_paper":{"arxiv_id":"2505.13830","last_updated":"2025-05-22T04:41:35Z","snapshot_observed_at":"2026-08-18T17:55:16.618732Z","submitted_at":"2025-05-20T02:18:45Z","title":"Improving Noise Robustness of LLM-based Zero-shot TTS via Discrete Acoustic Token Denoising","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:38.693980Z"},"links":{"citing_paper":"/paper/2505.13830"},"observation_digest":"sha256:449b414fcaff2a6ab0a19510b11e46dc3371785f320579d86e699e3f3f0bcfb3","observation_id":"66558212-18d3-468a-a8ac-7100eafd866c","resolution":{"observed_at":"2026-08-15T20:13:41.777231Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:13:41.666623Z","title":"SC- GlowTTS: An efficient zero-shot multi-speaker text-to-speech model,","venue":null,"work_id":"f60ce750-dd09-477d-be6e-c122836c64b5","year":2021},"citing_paper":{"arxiv_id":"2505.13830","last_updated":"2025-05-22T04:41:35Z","snapshot_observed_at":"2026-08-18T17:55:16.618732Z","submitted_at":"2025-05-20T02:18:45Z","title":"Improving Noise Robustness of LLM-based Zero-shot TTS via Discrete Acoustic Token Denoising","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:38.699298Z"},"links":{"citing_paper":"/paper/2505.13830"},"observation_digest":"sha256:8898e52ec81450a1b7f574ac17f494c171aa74c29abc7223fdbe279d9fa8c8ed","observation_id":"3401682a-308f-458d-b9fc-1aab736cea83","resolution":{"observed_at":"2026-08-15T20:13:41.763892Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:13:41.556759Z","title":"YourTTS: Towards zero-shot multi-speaker TTS and zero-shot voice conversion for everyone,","venue":null,"work_id":"ee64be92-b8a2-4587-a08e-5ca55d77d597","year":2022},"citing_paper":{"arxiv_id":"2505.13830","last_updated":"2025-05-22T04:41:35Z","snapshot_observed_at":"2026-08-18T17:55:16.618732Z","submitted_at":"2025-05-20T02:18:45Z","title":"Improving Noise Robustness of LLM-based Zero-shot TTS via Discrete Acoustic Token Denoising","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:38.749874Z"},"links":{"citing_paper":"/paper/2505.13830"},"observation_digest":"sha256:449ed17fb01b85cc0ac13cbdc96c61751d0655c3cc99477bd3792f655c35d66b","observation_id":"bb82a1f2-caa9-435c-b770-2f73e0a7ceb4","resolution":{"observed_at":"2026-08-15T20:13:41.563038Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.02111","last_updated":"2023-01-05T15:37:15Z","snapshot_observed_at":"2026-08-07T10:11:17.796562Z","submitted_at":"2023-01-05T15:37:15Z","title":"Neural Codec Language Models are Zero-Shot Text to Speech Synthesizers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.02111","snapshot_observed_at":"2026-08-15T20:13:38.826696Z","title":"Neural codec language mod- els are zero-shot text to speech synthesizers,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.13830","last_updated":"2025-05-22T04:41:35Z","snapshot_observed_at":"2026-08-18T17:55:16.618732Z","submitted_at":"2025-05-20T02:18:45Z","title":"Improving Noise Robustness of LLM-based Zero-shot TTS via Discrete Acoustic Token Denoising","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:38.826696Z"},"links":{"cited_paper":"/paper/2301.02111","citing_paper":"/paper/2505.13830"},"observation_digest":"sha256:e83ce339e46258ac5935760521bfe4a60ae9490939ef1d2ebad2feb27c404587","observation_id":"d9b7482a-1a4b-46fd-8f6c-ae2b08c7777e","resolution":{"observed_at":"2026-08-15T20:13:38.826696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.04673","last_updated":"2024-07-03T02:38:03Z","snapshot_observed_at":"2026-08-16T14:54:18.806254Z","submitted_at":"2023-10-07T03:17:59Z","title":"LauraGPT: Listen, Attend, Understand, and Regenerate Audio with GPT","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.04673","snapshot_observed_at":"2026-08-15T20:13:38.831798Z","title":"LauraGPT: Listen, attend, understand, and regenerate audio with GPT,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.13830","last_updated":"2025-05-22T04:41:35Z","snapshot_observed_at":"2026-08-18T17:55:16.618732Z","submitted_at":"2025-05-20T02:18:45Z","title":"Improving Noise Robustness of LLM-based Zero-shot TTS via Discrete Acoustic Token Denoising","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:38.831798Z"},"links":{"cited_paper":"/paper/2310.04673","citing_paper":"/paper/2505.13830"},"observation_digest":"sha256:26f7f51296da455afb5f845340b862f5cba6e363880c5c49ef260c0c320930f1","observation_id":"454251e3-9fde-4541-94bc-08c0f9dd0653","resolution":{"observed_at":"2026-08-15T20:13:38.831798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03100","last_updated":"2024-04-23T08:38:03Z","snapshot_observed_at":"2026-08-18T17:50:58.009731Z","submitted_at":"2024-03-05T16:35:25Z","title":"NaturalSpeech 3: Zero-Shot Speech Synthesis with Factorized Codec and Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03100","snapshot_observed_at":"2026-08-15T20:13:38.838495Z","title":"Naturalspeech 3: Zero-shot speech syn- thesis with factorized codec and diffusion models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.13830","last_updated":"2025-05-22T04:41:35Z","snapshot_observed_at":"2026-08-18T17:55:16.618732Z","submitted_at":"2025-05-20T02:18:45Z","title":"Improving Noise Robustness of LLM-based Zero-shot TTS via Discrete Acoustic Token Denoising","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:38.838495Z"},"links":{"cited_paper":"/paper/2403.03100","citing_paper":"/paper/2505.13830"},"observation_digest":"sha256:6d19ade70c1c27b80aea80bd8344df238c17ca1afe58dd73be719358b7659527","observation_id":"afe6f008-8216-48b7-b7a4-935f798086e2","resolution":{"observed_at":"2026-08-15T20:13:38.838495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:13:41.471150Z","title":"Noise-robust zero-shot text-to-speech synthesis conditioned on self-supervised speech-representation model with adapters,","venue":null,"work_id":"b1c0c154-70c7-415f-b905-a1950fa1c2a4","year":2024},"citing_paper":{"arxiv_id":"2505.13830","last_updated":"2025-05-22T04:41:35Z","snapshot_observed_at":"2026-08-18T17:55:16.618732Z","submitted_at":"2025-05-20T02:18:45Z","title":"Improving Noise Robustness of LLM-based Zero-shot TTS via Discrete Acoustic Token Denoising","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:38.893804Z"},"links":{"citing_paper":"/paper/2505.13830"},"observation_digest":"sha256:63e2395d24c54995728d06df3c99814d42a8749091fb0b5b6b75a952f97dcd70","observation_id":"ba6de707-3adf-4b42-ba1b-35a60b18c54f","resolution":{"observed_at":"2026-08-15T20:13:41.545219Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:13:41.384737Z","title":"DINO-VITS: Data-efficient zero-shot TTS with self-supervised speaker verification loss for noise robustness,","venue":null,"work_id":"bf042ba0-390c-4c54-a7ea-ea36ccbd352b","year":2024},"citing_paper":{"arxiv_id":"2505.13830","last_updated":"2025-05-22T04:41:35Z","snapshot_observed_at":"2026-08-18T17:55:16.618732Z","submitted_at":"2025-05-20T02:18:45Z","title":"Improving Noise Robustness of LLM-based Zero-shot TTS via Discrete Acoustic Token Denoising","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:38.962879Z"},"links":{"citing_paper":"/paper/2505.13830"},"observation_digest":"sha256:033f14ad731e19d8febda18aa5738c0bb5fb4a2164916ccc7d4c921b42c4772d","observation_id":"f9688efe-f419-49e2-b07f-1d280000390f","resolution":{"observed_at":"2026-08-15T20:13:41.390470Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:13:38.968701Z","title":"Soundstream: An end-to-end neural audio codec,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.13830","last_updated":"2025-05-22T04:41:35Z","snapshot_observed_at":"2026-08-18T17:55:16.618732Z","submitted_at":"2025-05-20T02:18:45Z","title":"Improving Noise Robustness of LLM-based Zero-shot TTS via Discrete Acoustic Token Denoising","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:38.968701Z"},"links":{"citing_paper":"/paper/2505.13830"},"observation_digest":"sha256:765c6a862231a4b81396615209d67b4cbef2f5565ae90a0f654f75c222fa15c3","observation_id":"fc40834c-4148-47b7-b8b1-13584269fd37","resolution":{"observed_at":"2026-08-15T20:13:38.968701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:13:38.973133Z","title":"High fidelity neural audio compression,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.13830","last_updated":"2025-05-22T04:41:35Z","snapshot_observed_at":"2026-08-18T17:55:16.618732Z","submitted_at":"2025-05-20T02:18:45Z","title":"Improving Noise Robustness of LLM-based Zero-shot TTS via Discrete Acoustic Token Denoising","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:38.973133Z"},"links":{"citing_paper":"/paper/2505.13830"},"observation_digest":"sha256:35da410ae79259921d26330b258259dc3189af5d920fdbfcde62c9199a75b534","observation_id":"e4ab1410-0dd8-481a-8d2d-68c3c75aa5b1","resolution":{"observed_at":"2026-08-15T20:13:38.973133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:13:41.227182Z","title":"Speech enhancement for a noise-robust text-to-speech synthesis system using deep recurrent neural networks,","venue":null,"work_id":"ec91502b-00d1-40ea-83cc-12b9b7d72fa1","year":2016},"citing_paper":{"arxiv_id":"2505.13830","last_updated":"2025-05-22T04:41:35Z","snapshot_observed_at":"2026-08-18T17:55:16.618732Z","submitted_at":"2025-05-20T02:18:45Z","title":"Improving Noise Robustness of LLM-based Zero-shot TTS via Discrete Acoustic Token Denoising","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:38.978431Z"},"links":{"citing_paper":"/paper/2505.13830"},"observation_digest":"sha256:32dd823a1302daac764bd9170404e4868fc012f10c6e8a131436f0ab5c4db8c2","observation_id":"6e6bd88a-6c93-43ef-a478-d55556d1499e","resolution":{"observed_at":"2026-08-15T20:13:41.232697Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:13:41.134178Z","title":"In- vestigating RNN-based speech enhancement methods for noise- robust text-to-speech","venue":null,"work_id":"c103d171-493f-4c1d-a558-3041fafb8f88","year":2016},"citing_paper":{"arxiv_id":"2505.13830","last_updated":"2025-05-22T04:41:35Z","snapshot_observed_at":"2026-08-18T17:55:16.618732Z","submitted_at":"2025-05-20T02:18:45Z","title":"Improving Noise Robustness of LLM-based Zero-shot TTS via Discrete Acoustic Token Denoising","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:39.012271Z"},"links":{"citing_paper":"/paper/2505.13830"},"observation_digest":"sha256:b7a71ba51a1f5d72534508c94e53c0c02134cb63b0790b49c9fa1f6f97de8036","observation_id":"b906595a-65a9-43ee-a557-857a60ead4e8","resolution":{"observed_at":"2026-08-15T20:13:41.217151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:13:39.080875Z","title":"Speech enhancement of noisy and reverberant speech for text-to-speech,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.13830","last_updated":"2025-05-22T04:41:35Z","snapshot_observed_at":"2026-08-18T17:55:16.618732Z","submitted_at":"2025-05-20T02:18:45Z","title":"Improving Noise Robustness of LLM-based Zero-shot TTS via Discrete Acoustic Token Denoising","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:39.080875Z"},"links":{"citing_paper":"/paper/2505.13830"},"observation_digest":"sha256:6ce09dcaee525cfbc37b31d9723cba500f84d432eff68569d7edc2c645a3b40c","observation_id":"13d149d5-1f59-46cf-a094-c33ad902a214","resolution":{"observed_at":"2026-08-15T20:13:39.080875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:13:41.030119Z","title":"CMGAN: Conformer-based metric GAN for speech enhancement,","venue":null,"work_id":"fc9d3cf3-6f9e-4f8f-b837-39dc2b3fecf7","year":2022},"citing_paper":{"arxiv_id":"2505.13830","last_updated":"2025-05-22T04:41:35Z","snapshot_observed_at":"2026-08-18T17:55:16.618732Z","submitted_at":"2025-05-20T02:18:45Z","title":"Improving Noise Robustness of LLM-based Zero-shot TTS via Discrete Acoustic Token Denoising","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:39.167786Z"},"links":{"citing_paper":"/paper/2505.13830"},"observation_digest":"sha256:9e4ce031372daeab73b6f1967225e2a719de48b3e3052fa2e01d99510afc5857","observation_id":"e5b89aaa-44bb-44b9-bc8c-dda3fdecfb1a","resolution":{"observed_at":"2026-08-15T20:13:41.036770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:13:39.174038Z","title":"MP-SENet: A speech enhance- ment model with parallel denoising of magnitude and phase spec- tra,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.13830","last_updated":"2025-05-22T04:41:35Z","snapshot_observed_at":"2026-08-18T17:55:16.618732Z","submitted_at":"2025-05-20T02:18:45Z","title":"Improving Noise Robustness of LLM-based Zero-shot TTS via Discrete Acoustic Token Denoising","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:39.174038Z"},"links":{"citing_paper":"/paper/2505.13830"},"observation_digest":"sha256:5070be33d1a5692f6ee5fb74c70e29d2f285b5457c832850a73cb16ebd6aa2c3","observation_id":"58d45b65-5e73-45d9-83b0-71dae2454e83","resolution":{"observed_at":"2026-08-15T20:13:39.174038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08926","last_updated":"2024-04-01T08:31:56Z","snapshot_observed_at":"2026-08-16T15:07:51.459575Z","submitted_at":"2023-08-17T11:37:52Z","title":"Explicit Estimation of Magnitude and Phase Spectra in Parallel for High-Quality Speech Enhancement","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.08926","snapshot_observed_at":"2026-08-15T20:13:39.179642Z","title":"Explicit estimation of magnitude and phase spectra in parallel for high-quality speech enhancement,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.13830","last_updated":"2025-05-22T04:41:35Z","snapshot_observed_at":"2026-08-18T17:55:16.618732Z","submitted_at":"2025-05-20T02:18:45Z","title":"Improving Noise Robustness of LLM-based Zero-shot TTS via Discrete Acoustic Token Denoising","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:39.179642Z"},"links":{"cited_paper":"/paper/2308.08926","citing_paper":"/paper/2505.13830"},"observation_digest":"sha256:18268a33c72511b3f00d88bf4cc9a0064633d77e84d1ffa399a338adc139bb92","observation_id":"19e4b9bc-138e-4554-81e6-2fb417b58938","resolution":{"observed_at":"2026-08-15T20:13:39.179642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:13:40.947638Z","title":"How bad are artifacts?: Analyzing the impact of speech enhancement errors on asr,","venue":null,"work_id":"0f58a256-46a1-4ec2-9b78-a8cc4ae773cf","year":2022},"citing_paper":{"arxiv_id":"2505.13830","last_updated":"2025-05-22T04:41:35Z","snapshot_observed_at":"2026-08-18T17:55:16.618732Z","submitted_at":"2025-05-20T02:18:45Z","title":"Improving Noise Robustness of LLM-based Zero-shot TTS via Discrete Acoustic Token Denoising","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:39.291582Z"},"links":{"citing_paper":"/paper/2505.13830"},"observation_digest":"sha256:139427f20fa6578f5d040df499e535bdb75c8a6f6f2e1a8da6fdbebba8768981","observation_id":"b830e6f0-160d-4d3e-9c96-9cbd8562cc3e","resolution":{"observed_at":"2026-08-15T20:13:40.954648Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:13:40.884755Z","title":"Learning to enhance or not: Neural network-based switching of enhanced and observed signals for overlapping speech recognition,","venue":null,"work_id":"234aba8b-ac58-4eea-981d-079ac1e4fd56","year":2022},"citing_paper":{"arxiv_id":"2505.13830","last_updated":"2025-05-22T04:41:35Z","snapshot_observed_at":"2026-08-18T17:55:16.618732Z","submitted_at":"2025-05-20T02:18:45Z","title":"Improving Noise Robustness of LLM-based Zero-shot TTS via Discrete Acoustic Token Denoising","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:39.297935Z"},"links":{"citing_paper":"/paper/2505.13830"},"observation_digest":"sha256:552a64694fbcde0d41cde20bf4019383d4bf1df2763e189f2c95871c35934236","observation_id":"35648f70-bc85-4abd-94a6-e372996f7b23","resolution":{"observed_at":"2026-08-15T20:13:40.936615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:13:40.784291Z","title":"MaskSR: Masked language model for full-band speech restoration,","venue":null,"work_id":"c1d938f4-76c5-4b13-a479-c151e00980a2","year":2024},"citing_paper":{"arxiv_id":"2505.13830","last_updated":"2025-05-22T04:41:35Z","snapshot_observed_at":"2026-08-18T17:55:16.618732Z","submitted_at":"2025-05-20T02:18:45Z","title":"Improving Noise Robustness of LLM-based Zero-shot TTS via Discrete Acoustic Token Denoising","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:39.301960Z"},"links":{"citing_paper":"/paper/2505.13830"},"observation_digest":"sha256:5f98c5e00ca0599bf6ce3ae995af3ca466f65e2629cfc66fd55d3f5c77794aaa","observation_id":"97310fe5-b2df-467e-a998-d22a8331a971","resolution":{"observed_at":"2026-08-15T20:13:40.789159Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:13:40.581863Z","title":"Genhancer: High-fidelity speech enhancement via generative modeling on discrete codec tokens,","venue":null,"work_id":"23f32874-2901-4b62-963f-e5a14751972f","year":2024},"citing_paper":{"arxiv_id":"2505.13830","last_updated":"2025-05-22T04:41:35Z","snapshot_observed_at":"2026-08-18T17:55:16.618732Z","submitted_at":"2025-05-20T02:18:45Z","title":"Improving Noise Robustness of LLM-based Zero-shot TTS via Discrete Acoustic Token Denoising","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:39.307924Z"},"links":{"citing_paper":"/paper/2505.13830"},"observation_digest":"sha256:d2528f8e07d5bd86d6430d3480a9bf8a0eff937ff76499102bbc7ba819c3f51b","observation_id":"f5610c87-4830-4d94-b8d6-4e4700e4792f","resolution":{"observed_at":"2026-08-15T20:13:40.700564Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:13:39.411914Z","title":"Conformer: Convolution- augmented transformer for speech recognition,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.13830","last_updated":"2025-05-22T04:41:35Z","snapshot_observed_at":"2026-08-18T17:55:16.618732Z","submitted_at":"2025-05-20T02:18:45Z","title":"Improving Noise Robustness of LLM-based Zero-shot TTS via Discrete Acoustic Token Denoising","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:39.411914Z"},"links":{"citing_paper":"/paper/2505.13830"},"observation_digest":"sha256:c462134f193585cd3caab4c53757110458a4b446f7cac98177f6e2ddff496876","observation_id":"2c31c52d-8cd5-44a6-8232-07df5b76f1e7","resolution":{"observed_at":"2026-08-15T20:13:39.411914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:13:40.389299Z","title":"Libri-light: A benchmark for ASR with limited or no su- pervision,","venue":null,"work_id":"91e9838c-74ee-4df8-825e-a4273c6b3979","year":2020},"citing_paper":{"arxiv_id":"2505.13830","last_updated":"2025-05-22T04:41:35Z","snapshot_observed_at":"2026-08-18T17:55:16.618732Z","submitted_at":"2025-05-20T02:18:45Z","title":"Improving Noise Robustness of LLM-based Zero-shot TTS via Discrete Acoustic Token Denoising","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:39.457789Z"},"links":{"citing_paper":"/paper/2505.13830"},"observation_digest":"sha256:c8d2614c0b2ed243e0e085b668c749e422404dd15e57700b06ddeae3ccba3ea6","observation_id":"641ae334-2fa5-432c-96be-898269449cb8","resolution":{"observed_at":"2026-08-15T20:13:40.452978Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:13:40.332522Z","title":"Libritts-R: A re- stored multi-speaker text-to-speech corpus,","venue":null,"work_id":"5253db30-2b7f-4000-b605-81f8407bc032","year":2023},"citing_paper":{"arxiv_id":"2505.13830","last_updated":"2025-05-22T04:41:35Z","snapshot_observed_at":"2026-08-18T17:55:16.618732Z","submitted_at":"2025-05-20T02:18:45Z","title":"Improving Noise Robustness of LLM-based Zero-shot TTS via Discrete Acoustic Token Denoising","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:39.463319Z"},"links":{"citing_paper":"/paper/2505.13830"},"observation_digest":"sha256:bfc4174b2f7a568f3a713208e9aa3e87b9ff4facffd8cea003d7a5c7c11bbedd","observation_id":"0331fb86-d538-40b6-a262-aa8ceb5b1522","resolution":{"observed_at":"2026-08-15T20:13:40.376600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:13:40.184424Z","title":"ICASSP 2022 deep noise suppression challenge,","venue":null,"work_id":"5341dd40-ed28-4925-88a4-f2fe232775b9","year":2022},"citing_paper":{"arxiv_id":"2505.13830","last_updated":"2025-05-22T04:41:35Z","snapshot_observed_at":"2026-08-18T17:55:16.618732Z","submitted_at":"2025-05-20T02:18:45Z","title":"Improving Noise Robustness of LLM-based Zero-shot TTS via Discrete Acoustic Token Denoising","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:39.467706Z"},"links":{"citing_paper":"/paper/2505.13830"},"observation_digest":"sha256:3bbee08b1537dbc74e1ac16596849ee0a384a42339b214166bb25a514af09e5d","observation_id":"58bce156-fac7-4e6e-a667-cdd5be0f37c7","resolution":{"observed_at":"2026-08-15T20:13:40.252562Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:13:39.522549Z","title":"WHAM!: Extending speech separation to noisy environments,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.13830","last_updated":"2025-05-22T04:41:35Z","snapshot_observed_at":"2026-08-18T17:55:16.618732Z","submitted_at":"2025-05-20T02:18:45Z","title":"Improving Noise Robustness of LLM-based Zero-shot TTS via Discrete Acoustic Token Denoising","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:39.522549Z"},"links":{"citing_paper":"/paper/2505.13830"},"observation_digest":"sha256:d048000efae827476214bca49fcfb0aec8f2be5f2b787423b5f2991b99568551","observation_id":"6a926939-69ef-4435-b1d4-26aa4d68dd48","resolution":{"observed_at":"2026-08-15T20:13:39.522549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:13:40.046201Z","title":"Funcodec: A funda- mental, reproducible and integrable open-source toolkit for neural speech codec,","venue":null,"work_id":"0f97628a-5b9c-44a3-8b11-1cbe09a9c8bc","year":2024},"citing_paper":{"arxiv_id":"2505.13830","last_updated":"2025-05-22T04:41:35Z","snapshot_observed_at":"2026-08-18T17:55:16.618732Z","submitted_at":"2025-05-20T02:18:45Z","title":"Improving Noise Robustness of LLM-based Zero-shot TTS via Discrete Acoustic Token Denoising","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:39.592571Z"},"links":{"citing_paper":"/paper/2505.13830"},"observation_digest":"sha256:1a9e53f25049e13ac717a473a30fb775d53996afc0e1f6c1f83acb997c743f13","observation_id":"2230fb9d-8ceb-4a9e-ae7c-7b1931142e72","resolution":{"observed_at":"2026-08-15T20:13:40.085276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:13:40.024783Z","title":"DNSMOS P. 835: A non- intrusive perceptual objective speech quality metric to evaluate noise suppressors,","venue":null,"work_id":"110c1ab5-5cee-42de-ab12-ff7977696ad1","year":2022},"citing_paper":{"arxiv_id":"2505.13830","last_updated":"2025-05-22T04:41:35Z","snapshot_observed_at":"2026-08-18T17:55:16.618732Z","submitted_at":"2025-05-20T02:18:45Z","title":"Improving Noise Robustness of LLM-based Zero-shot TTS via Discrete Acoustic Token Denoising","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:39.597215Z"},"links":{"citing_paper":"/paper/2505.13830"},"observation_digest":"sha256:ab53f3af6988b3bb7a2a8b76c72a0de23d5fabddcfdba6f0267580029502cc68","observation_id":"71c84f2d-f8ff-448d-8c64-94370965e47a","resolution":{"observed_at":"2026-08-15T20:13:40.032580Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:13:39.881063Z","title":"Resemblyzer,","venue":null,"work_id":"13fc5535-1612-4f24-9b37-d8b60d6fa54a","year":2019},"citing_paper":{"arxiv_id":"2505.13830","last_updated":"2025-05-22T04:41:35Z","snapshot_observed_at":"2026-08-18T17:55:16.618732Z","submitted_at":"2025-05-20T02:18:45Z","title":"Improving Noise Robustness of LLM-based Zero-shot TTS via Discrete Acoustic Token Denoising","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:39.602851Z"},"links":{"citing_paper":"/paper/2505.13830"},"observation_digest":"sha256:09c25cb42dc32a55ff8e465ce00d7955e0c9e9d08530fe1a4b12c0e702de5a09","observation_id":"333dc2ec-c886-4e54-9aae-7217e75e9cd8","resolution":{"observed_at":"2026-08-15T20:13:39.945098Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:13:39.607461Z","title":"Robust speech recognition via large-scale weak su- pervision,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.13830","last_updated":"2025-05-22T04:41:35Z","snapshot_observed_at":"2026-08-18T17:55:16.618732Z","submitted_at":"2025-05-20T02:18:45Z","title":"Improving Noise Robustness of LLM-based Zero-shot TTS via Discrete Acoustic Token Denoising","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:39.607461Z"},"links":{"citing_paper":"/paper/2505.13830"},"observation_digest":"sha256:c6405729749e4bda7bd072666f7f438af4eaad2b570f3871e46d6099e3a86864","observation_id":"7a51c3af-107e-4fc5-b781-72f737449b7b","resolution":{"observed_at":"2026-08-15T20:13:39.607461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.13830","last_updated":"2025-05-22T04:41:35Z","latest_version":2,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-18T17:55:16.618732Z","submitted_at":"2025-05-20T02:18:45Z","title":"Improving Noise Robustness of LLM-based Zero-shot TTS via Discrete Acoustic Token Denoising"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":1,"verified_fuzzy":18},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 1 inbound Pith citation observation for arXiv:2505.13830."}