Pith. sign in

Paper Citation Record · LEDGER

Autoregressive Speech Enhancement via Acoustic Tokens

As of 17 August 2026, this Paper Citation Record lists 60 of 60 outbound references and 1 inbound Pith citation observation for arXiv:2507.12825.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2507.12825 v1

Coverage vector

measured 60 of 60 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-06T16:41:25.045627Z

measured 61 of 61 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-17T06:30:58.91139+00:00

measured 1 of 1 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-02T20:45:11.099531Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

60 of 60 outbound references displayed

  • verified exact0
  • verified fuzzy45
  • unresolved15
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 3df6dd21-9582-46bf-91f6-9737edb1dd06 · outbound

This paper cites MetricGAN-U: Unsupervised speech enhancement / dereverberation based only on noisy / reverberated speech,.

Autoregressive Speech Enhancement via Acoustic Tokens MetricGAN-U: Unsupervised speech enhancement / dereverberation based only on noisy / reverberated speech,

Reference 1

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T16:41:32.193083Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T16:41:20.393607Z digest=sha256:a40cd6fa78596bfd2cde061290f0102e050c85d3b8768db0ce5875efe014999c

Observation ee931f9a-7cf5-40a5-aae5-9fafa6a6534b · outbound

This paper cites MetricGAN: Generative adversarial networks based black-box metric scores optimization for speech enhancement,.

Autoregressive Speech Enhancement via Acoustic Tokens MetricGAN: Generative adversarial networks based black-box metric scores optimization for speech enhancement,

Reference 2

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T16:41:31.979967Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T16:41:20.398740Z digest=sha256:07456316b070318388e4e10b76443f3acf564fb5d4fd0fb34e9911fdd75e60e5

Observation 005efad6-f48e-4d49-9b48-891d41d0a537 · outbound

This paper cites MetricGAN+: An improved version of MetricGAN for speech enhancement,.

Autoregressive Speech Enhancement via Acoustic Tokens MetricGAN+: An improved version of MetricGAN for speech enhancement,

Reference 3

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T16:41:31.700241Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T16:41:20.401797Z digest=sha256:5d06b689bd76d8d71c382e5031a20ed1e2f74b3913d8ebf673672f126c0ee598

Observation 60630760-ea59-47eb-9775-ffe6c04d6464 · outbound

This paper cites Reinforcement learning based speech enhancement for robust speech recognition,.

Autoregressive Speech Enhancement via Acoustic Tokens Reinforcement learning based speech enhancement for robust speech recognition,

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T16:41:31.564883Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T16:41:20.541441Z digest=sha256:c5875a6bb95f1a4b3ecb397e04f4427815dedf4d9a20bc30e71b6c394c46d843

Observation 7db48736-4f7e-4eb3-a339-8ae2c857983a · outbound

This paper cites MetaRL-SE: a few-shot speech enhancement method based on meta-reinforcement learning,.

Autoregressive Speech Enhancement via Acoustic Tokens MetaRL-SE: a few-shot speech enhancement method based on meta-reinforcement learning,

Reference 5

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T16:41:31.428773Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T16:41:20.626694Z digest=sha256:2cf97f0d7276a87f0828d2432a0c7b34165eb3deb2d386d4eb08762740a3eaba

Observation 4a0c77a7-5317-4dba-a4b9-4d7921ce76c8 · outbound

This paper cites Perceptual evaluation of speech quality (PESQ)-a new method for speech quality assessment of telephone networks and codecs,.

Autoregressive Speech Enhancement via Acoustic Tokens Perceptual evaluation of speech quality (PESQ)-a new method for speech quality assessment of telephone networks and codecs,

Reference 6

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T16:41:31.202572Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T16:41:20.717389Z digest=sha256:457a1a2e16d1b3ee285cf9436d1912387a3c9fd36e8432efbcc5b2560915f9ab

Observation 1ea95bef-9ff6-4e26-8b0f-5a5f0968521e · outbound

This paper cites An algorithm for intelligibility prediction of time–frequency weighted noisy speech,.

Autoregressive Speech Enhancement via Acoustic Tokens An algorithm for intelligibility prediction of time–frequency weighted noisy speech,

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T16:41:31.092612Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T16:41:20.785033Z digest=sha256:de568b639f5f3d8918cea762af41a0b82a992380f75983e317011b2c6c8ca030

Observation 813ca669-e79a-4edc-97a6-2eb96bcc5fda · outbound

This paper cites Conv-TasNet: Surpassing ideal time–frequency magnitude masking for speech separation,.

Autoregressive Speech Enhancement via Acoustic Tokens Conv-TasNet: Surpassing ideal time–frequency magnitude masking for speech separation,

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T16:41:30.990140Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T16:41:20.881954Z digest=sha256:e03ec0cfff88ea936c1c6ea28776df639c75df1679eb3db3a4d2d155d1885ae5

Observation 9b536600-b151-42c1-a9b7-737dea7d705a · outbound

This paper cites Attention is all you need in speech separation,.

Autoregressive Speech Enhancement via Acoustic Tokens Attention is all you need in speech separation,

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T16:41:30.872986Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T16:41:20.916913Z digest=sha256:c2e5be746d4657381812016a0910d74529f04dd950d80c0360b65060f972d50e

Observation fd7b1bf2-56d2-4d9a-a123-c6c596f8e5e7 · outbound

This paper cites Real time speech enhancement in the waveform domain,.

Autoregressive Speech Enhancement via Acoustic Tokens Real time speech enhancement in the waveform domain,

Reference 10

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T16:41:30.679297Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T16:41:20.996481Z digest=sha256:b1fcf1ee9f3a126e4d1056a1d162ae5629f9cf3903870985abf417dd8aeccd88

Observation 6489b662-1f5b-419b-9a0a-55a0e55e6e5a · outbound

This paper cites DNN-based enhancement of noisy and reverberant speech,.

Autoregressive Speech Enhancement via Acoustic Tokens DNN-based enhancement of noisy and reverberant speech,

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T16:41:30.562523Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T16:41:21.096292Z digest=sha256:a0e3e0549d852f5d1cc3ce221932f693376c2e5840c656999bac05661e6fd468

Observation 1beafc15-0309-417f-b6da-3ad0d9dc3d3b · outbound

This paper cites Phasen: A phase-and-harmonics-aware speech enhancement network,.

Autoregressive Speech Enhancement via Acoustic Tokens Phasen: A phase-and-harmonics-aware speech enhancement network,

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T16:41:30.416171Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T16:41:21.162198Z digest=sha256:c810e627af3dc54f07a657ab50fba25cda9349ca0b220807ac05a4c16b8e6921

Observation 2f12fc1a-ab0c-4be1-bf41-f9e334877e9d · outbound

This paper cites Inter-SubNet: Speech enhancement with subband interaction,.

Autoregressive Speech Enhancement via Acoustic Tokens Inter-SubNet: Speech enhancement with subband interaction,

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T16:41:30.276332Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T16:41:21.228554Z digest=sha256:84e9ff7b28e8411a69a208932933ddf9b1217d25adfd43cbacd24ad5e9771cdd

Observation 088a276e-0244-4d8d-a220-8b91476d8729 · outbound

This paper cites Speech enhancement with score- based generative models in the complex STFT domain,.

Autoregressive Speech Enhancement via Acoustic Tokens Speech enhancement with score- based generative models in the complex STFT domain,

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T16:41:30.099067Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T16:41:21.285617Z digest=sha256:0258da6785ebe455ee8dd533970354cdf4da814f2785de10ffbf093b29b831fe

Observation 5e1b7c46-5668-4312-9626-8d58d571b29d · outbound

This paper cites Speech enhancement and dereverberation with diffusion-based generative models,.

Autoregressive Speech Enhancement via Acoustic Tokens Speech enhancement and dereverberation with diffusion-based generative models,

Reference 15

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T16:41:29.958000Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T16:41:21.330011Z digest=sha256:5bd96bc055977c81be48be62528fbe338240468448b27bb446d3d6e97bbcecf7

Observation 8613889f-de51-4e65-9069-7964de0f0b66 · outbound

This paper cites Gemini: A Family of Highly Capable Multimodal Models.

Autoregressive Speech Enhancement via Acoustic Tokens Gemini: A Family of Highly Capable Multimodal Models

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-06T16:41:21.361135Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T16:41:21.361135Z digest=sha256:3c34d975f6d90fab7d3c503471ea1c23094791207f88552166a833f4be95e3bb

Observation 1653c9ff-4f6d-4f06-9496-192d1dbb9766 · outbound

This paper cites AudioLM: A language modeling approach to audio generation,.

Autoregressive Speech Enhancement via Acoustic Tokens AudioLM: A language modeling approach to audio generation,

Reference 17

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T16:41:29.818197Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T16:41:21.498944Z digest=sha256:d6c06c3f498d49d35eb98b411bdf3311df669a5707879cf20293bc20a2d9b1df

Observation 74a3577c-1780-4876-b29a-82e23297da18 · outbound

This paper cites Neural Codec Language Models are Zero-Shot Text to Speech Synthesizers.

Autoregressive Speech Enhancement via Acoustic Tokens Neural Codec Language Models are Zero-Shot Text to Speech Synthesizers

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-06T16:41:21.629566Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T16:41:21.629566Z digest=sha256:29928b0a86d83e8a96ee29148dd7d2c3ea03ef102b2a810f39ffb0d54d6d71d3

Observation 6671abdb-b415-4c7b-bd0b-a128cb41d808 · outbound

This paper cites AudioGen: Textually guided audio generation,.

Autoregressive Speech Enhancement via Acoustic Tokens AudioGen: Textually guided audio generation,

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T16:41:29.706948Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T16:41:21.722632Z digest=sha256:3dff077b53dc19e08dc1ef08852124133fb2dad092cd31d10f2a250057db9ad5

Observation d9e1c638-9978-44cd-a597-733794d16616 · outbound

This paper cites Simple and controllable music generation,.

Autoregressive Speech Enhancement via Acoustic Tokens Simple and controllable music generation,

Reference 20

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T16:41:29.481724Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T16:41:21.768399Z digest=sha256:48f21e9e298d64511571803d78697a3b28199a1237dd8934baf54e2c0bce94c8

Observation 6938a232-7650-4d7a-ada5-1fe8f8a563f0 · outbound

This paper cites SpeechGPT: Empowering large language models with intrinsic cross-modal conversational abilities,.

Autoregressive Speech Enhancement via Acoustic Tokens SpeechGPT: Empowering large language models with intrinsic cross-modal conversational abilities,

Reference 21

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T16:41:29.334844Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T16:41:21.816868Z digest=sha256:bc38eeb3af2a151c22fdfdcda441d03035f44e8dfbf9eebc0e7cf972b613bcb2

Observation 58acb5af-7763-4fe8-8b7d-e28357526c51 · outbound

This paper cites Spirit LM: Interleaved Spoken and Written Language Model.

Autoregressive Speech Enhancement via Acoustic Tokens Spirit LM: Interleaved Spoken and Written Language Model

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-06T16:41:21.849466Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T16:41:21.849466Z digest=sha256:0a92c322fea79a423634dfc2d71437ec93779eb0eb614bed5e993c9a78b96473

Observation 0b40a5bc-c4cd-4454-a726-dccb894137ab · outbound

This paper cites NaturalSpeech 3: Zero-Shot Speech Synthesis with Factorized Codec and Diffusion Models.

Autoregressive Speech Enhancement via Acoustic Tokens NaturalSpeech 3: Zero-Shot Speech Synthesis with Factorized Codec and Diffusion Models

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-06T16:41:21.923372Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T16:41:21.923372Z digest=sha256:468ea9986e96494aad6d65c317321165fff24b8bbd92c3a53d2451224683e06a

Observation 30664f26-4e77-4c0e-ad97-2d57f991eedc · outbound

This paper cites CLam-TTS: Improving neural codec language model for zero-shot text-to-speech,.

Autoregressive Speech Enhancement via Acoustic Tokens CLam-TTS: Improving neural codec language model for zero-shot text-to-speech,

Reference 24

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T16:41:29.225692Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T16:41:21.970115Z digest=sha256:54ad860d6fb553d929fa7180040c474c35df178cbf5155926c8e2d4cbaebddd9

Observation 142d4ed3-afa1-4be5-afaa-cd65ff7d8a71 · outbound

This paper cites wav2vec 2.0: A framework for self-supervised learning of speech representations,.

Autoregressive Speech Enhancement via Acoustic Tokens wav2vec 2.0: A framework for self-supervised learning of speech representations,

Reference 25

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T16:41:29.163173Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T16:41:22.023102Z digest=sha256:ebf11eb5dde8ae1cc77ad014825d73f4e888a378157dc6b131086180005126ce

Observation f6407d33-1e40-4609-8f85-a7910f2b5d29 · outbound

This paper cites HuBERT: Self-supervised speech representation learning by masked prediction of hidden units,.

Autoregressive Speech Enhancement via Acoustic Tokens HuBERT: Self-supervised speech representation learning by masked prediction of hidden units,

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T16:41:28.929929Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T16:41:22.073829Z digest=sha256:25508631fa7882313f58793534d1cf1345643d2325c0663e3107b5c23c66aacd

Observation 04558e90-fab5-4888-abe5-73419709325b · outbound

This paper cites WavLM: Large-scale self-supervised pre-training for full stack speech processing,.

Autoregressive Speech Enhancement via Acoustic Tokens WavLM: Large-scale self-supervised pre-training for full stack speech processing,

Reference 27

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T16:41:28.740936Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T16:41:22.122399Z digest=sha256:7822b5481ed8cae0cf53092e986b27805e2754eb52d2949648fe0f532cb55ced

Observation d3310284-c3fd-4705-a638-f3d2805089ba · outbound

This paper cites Exploring speech recognition, translation, and under- standing with discrete speech units: A comparative study,.

Autoregressive Speech Enhancement via Acoustic Tokens Exploring speech recognition, translation, and under- standing with discrete speech units: A comparative study,

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T16:41:28.553359Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T16:41:22.158395Z digest=sha256:96c27d223b377a3ed970c687bae7e05ee13687d281995808df644a2619fb764c

Observation 0efe4163-83cf-4165-bc53-079781c11db9 · outbound

This paper cites Towards universal speech discrete tokens: A case study for ASR and TTS,.

Autoregressive Speech Enhancement via Acoustic Tokens Towards universal speech discrete tokens: A case study for ASR and TTS,

Reference 29

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T16:41:28.431139Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T16:41:22.198945Z digest=sha256:100b2d84b110742947420ab3079e2f3d5781b256237f7a47c9bba3b3623786d9

Observation ac1b52f1-1ba6-4305-a834-3d58ea481eda · outbound

This paper cites High fidelity neural audio compression,.

Autoregressive Speech Enhancement via Acoustic Tokens High fidelity neural audio compression,

Reference 30

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T16:41:28.306150Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T16:41:22.267201Z digest=sha256:178e96cc828ece85fc96b8409d50905d82b94ae4a953e87038b98644527f0c09

Observation 648f0fb9-bcf4-496d-a021-a8bf03a59e6e · outbound

This paper cites High- fidelity audio compression with improved RVQGAN,.

Autoregressive Speech Enhancement via Acoustic Tokens High- fidelity audio compression with improved RVQGAN,

Reference 31

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T16:41:28.189956Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T16:41:22.356681Z digest=sha256:d891a69cd10b1eef82c7f1225676f20f3394664a63ecc3ac71cbdd29c11093b0

Observation 7fde69f3-fc30-4f7c-953f-f07cc1853b7e · outbound

This paper cites FunCodec: A Fundamental, Reproducible and Integrable Open-source Toolkit for Neural Speech Codec.

Autoregressive Speech Enhancement via Acoustic Tokens FunCodec: A Fundamental, Reproducible and Integrable Open-source Toolkit for Neural Speech Codec

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-06T16:41:22.474153Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T16:41:22.474153Z digest=sha256:6e2475c7738ffab7c4e5592a5fb755d82c2da14b12c9a4c10b7a2b72246fd443

Observation c46c1d72-99e2-425d-b195-235d3ac823e7 · outbound

This paper cites HiFi-Codec: Group-residual Vector quantization for High Fidelity Audio Codec.

Autoregressive Speech Enhancement via Acoustic Tokens HiFi-Codec: Group-residual Vector quantization for High Fidelity Audio Codec

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-06T16:41:22.610257Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T16:41:22.610257Z digest=sha256:548a2ad134fad501a62bfcb55132484b73afa8a29cc1daa40fce38f629247783

Observation a6287e80-8a80-45e9-a36a-58b36e9745e7 · outbound

This paper cites Language-Codec: Bridging Discrete Codec Representations and Speech Language Models.

Autoregressive Speech Enhancement via Acoustic Tokens Language-Codec: Bridging Discrete Codec Representations and Speech Language Models

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-06T16:41:22.680479Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T16:41:22.680479Z digest=sha256:1daafbff3e5aae60285ec6c19b2e4e8bba0b1b9c6a019ef8a1b29f7eecbc7638

Observation 98e1b8e5-0b0f-4ef6-9b04-5cb955d3283e · outbound

This paper cites WavTokenizer: an Efficient Acoustic Discrete Codec Tokenizer for Audio Language Modeling.

Autoregressive Speech Enhancement via Acoustic Tokens WavTokenizer: an Efficient Acoustic Discrete Codec Tokenizer for Audio Language Modeling

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-06T16:41:22.809284Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T16:41:22.809284Z digest=sha256:cc29a92b343c397a6108f506d4ea62a57ac41b3bcf9a0af2441f25fe4f8dc88e

Observation 5088cbb3-8115-47fa-81c7-5b20b0b4bde4 · outbound

This paper cites Neural discrete representation learning,.

Autoregressive Speech Enhancement via Acoustic Tokens Neural discrete representation learning,

Reference 36

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T16:41:28.056386Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T16:41:22.916480Z digest=sha256:5a64e1acc613f9196322b006c7e968fd4c893cda2f870889a0520fe8e7f57275

Observation 32b045db-4410-4c02-885d-2dceb1137dbf · outbound

This paper cites SoundStream: An end-to-end neural audio codec,.

Autoregressive Speech Enhancement via Acoustic Tokens SoundStream: An end-to-end neural audio codec,

Reference 37

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T16:41:27.947347Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T16:41:23.018124Z digest=sha256:9c7fa3a964d63a504f1a5db140d2fd59f298a274a2984b21f12253aa5d707460

Observation 0c837355-3f63-45e6-b395-7b1c9bb237a2 · outbound

This paper cites A comparison of discrete and soft speech units for improved voice conversion,.

Autoregressive Speech Enhancement via Acoustic Tokens A comparison of discrete and soft speech units for improved voice conversion,

Reference 38

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T16:41:27.817479Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T16:41:23.100796Z digest=sha256:a1d0b87d2cc08b7886b5997339d9b5b5d9110d0cb66c9225c4ea409275d0d6ba

Observation 7df2ad59-42a6-45e9-9d04-283b68429eb7 · outbound

This paper cites SpeechTokenizer: Unified speech tokenizer for speech large language models,.

Autoregressive Speech Enhancement via Acoustic Tokens SpeechTokenizer: Unified speech tokenizer for speech large language models,

Reference 39

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T16:41:27.678992Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T16:41:23.173030Z digest=sha256:4d842c29e63d684f522afb5faff46b5613e9aa090b074553e6711c4f3ace63cf

Observation 2c8dbc01-1263-41de-a261-203542644dbe · outbound

This paper cites SemantiCodec: An Ultra Low Bitrate Semantic Audio Codec for General Sound.

Autoregressive Speech Enhancement via Acoustic Tokens SemantiCodec: An Ultra Low Bitrate Semantic Audio Codec for General Sound

Reference 40

Resolution
unresolved
no resolver link, observed 2026-08-06T16:41:23.288503Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T16:41:23.288503Z digest=sha256:966251a82686aab277fe4745d007700838afbe3809606563bda9a86e7ce0bf08

Observation b179fc50-6f9e-4b7e-8524-9e973e431d4e · outbound

This paper cites SELM: Speech enhancement using discrete tokens and language models,.

Autoregressive Speech Enhancement via Acoustic Tokens SELM: Speech enhancement using discrete tokens and language models,

Reference 41

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T16:41:27.544450Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T16:41:23.369185Z digest=sha256:63b21146d8d57feea6553f2e362c0374470efb72bd33c4bd7d9b53676c590656

Observation 93279da3-1f33-439e-bd5f-b487e7530aef · outbound

This paper cites How should we extract discrete audio tokens from self-supervised models?.

Autoregressive Speech Enhancement via Acoustic Tokens How should we extract discrete audio tokens from self-supervised models?

Reference 42

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T16:41:27.406429Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T16:41:23.474475Z digest=sha256:e75f0fa37124b28c8fa6d958f874aa5bbb32e006006c09640bc7f68905268207

Observation c3973daa-5f47-466c-8a08-417f7c839954 · outbound

This paper cites DASB - Discrete Audio and Speech Benchmark.

Autoregressive Speech Enhancement via Acoustic Tokens DASB - Discrete Audio and Speech Benchmark

Reference 43

Resolution
unresolved
no resolver link, observed 2026-08-06T16:41:23.555526Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T16:41:23.555526Z digest=sha256:da5b7f3cf16de7e1ba97c155007c898492caa40fec57caf12435fc1dc8acfa3f

Observation 6d6d836e-7b72-45b4-b9f3-74c4a0ef9553 · outbound

This paper cites Sequence transduction with recurrent neural networks,.

Autoregressive Speech Enhancement via Acoustic Tokens Sequence transduction with recurrent neural networks,

Reference 44

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T16:41:27.245159Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T16:41:23.647972Z digest=sha256:0471bd66250ef17836015f7c17b228d1ad21e880b5fd17e2b4e383c94db863ad

Observation b93cfe80-addc-44da-a5b2-a5873cf1277f · outbound

This paper cites Exposure bias versus self- recovery: Are distortions really incremental for autoregressive text generation?.

Autoregressive Speech Enhancement via Acoustic Tokens Exposure bias versus self- recovery: Are distortions really incremental for autoregressive text generation?

Reference 45

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T16:41:27.069845Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T16:41:23.781090Z digest=sha256:fa9d01dbe0cdf21cea5edf0b8b6b67be4b0ab1a3e53f0e5bf946aa25671e9e1a

Observation aca6d0c1-f1dc-4216-b1ba-07e213de2718 · outbound

This paper cites Attention is all you need,.

Autoregressive Speech Enhancement via Acoustic Tokens Attention is all you need,

Reference 46

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T16:41:26.855278Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T16:41:23.869252Z digest=sha256:8b63b23852303e1ae265bcede388b104214729a66b0aa5b164c20533cb7fae34

Observation a7884187-b14d-4804-bf43-66b8232a332c · outbound

This paper cites Investi- gating RNN-based speech enhancement methods for noise-robust text-to- speech,.

Autoregressive Speech Enhancement via Acoustic Tokens Investi- gating RNN-based speech enhancement methods for noise-robust text-to- speech,

Reference 47

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T16:41:26.685195Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T16:41:23.957284Z digest=sha256:5fc15b5ba79969a77b91d90a852aa51abed898c649ee322dbc4b25fc8af94544

Observation 203a6940-1875-4995-8852-f38d58673943 · outbound

This paper cites LibriMix: An Open-Source Dataset for Generalizable Speech Separation.

Autoregressive Speech Enhancement via Acoustic Tokens LibriMix: An Open-Source Dataset for Generalizable Speech Separation

Reference 48

Resolution
unresolved
no resolver link, observed 2026-08-06T16:41:24.033479Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T16:41:24.033479Z digest=sha256:85486dd00b33074e2031082d702caf197148153d76c549678dccacc32cb6af14

Observation 299f3b0b-663c-4dff-85fb-05c235bb2da1 · outbound

This paper cites Librispeech: An ASR corpus based on public domain audio books,.

Autoregressive Speech Enhancement via Acoustic Tokens Librispeech: An ASR corpus based on public domain audio books,

Reference 49

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T16:41:26.479563Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T16:41:24.124884Z digest=sha256:276aa46c6f107b3cc20c18396f1516337eaf9585547131d2a1f36949be63a99b

Observation 9e1eed3b-10b3-4688-8958-3a9591133d2c · outbound

This paper cites WHAM!: Extending speech separation to noisy environments,.

Autoregressive Speech Enhancement via Acoustic Tokens WHAM!: Extending speech separation to noisy environments,

Reference 50

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T16:41:26.303021Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T16:41:24.197555Z digest=sha256:b907c4ec00dde7c3e4a00e8c9b96f7899e74287e689ee8a58a1b810fefda4e67

Observation 5b2c4a59-bc6d-40f7-8ffb-889dc66184bc · outbound

This paper cites Vocos: Closing the gap between time-domain and Fourier-based neural vocoders for high-quality audio synthesis.

Autoregressive Speech Enhancement via Acoustic Tokens Vocos: Closing the gap between time-domain and Fourier-based neural vocoders for high-quality audio synthesis

Reference 51

Resolution
unresolved
no resolver link, observed 2026-08-06T16:41:24.295671Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T16:41:24.295671Z digest=sha256:598327066391dc6937d7424b322e7eb86c64f652753c0261f1aee71b9d99a4f9

Observation 87fa2057-4541-4db6-b3fd-b883b847fb1b · outbound

This paper cites Conformer: Convolution-augmented transformer for speech recognition,.

Autoregressive Speech Enhancement via Acoustic Tokens Conformer: Convolution-augmented transformer for speech recognition,

Reference 52

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T16:41:26.099361Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T16:41:24.397498Z digest=sha256:845e28abe3fd085b904c8ff321f6d3185727495effa3d616c20b0da6dbb6d2ed

Observation 7e90ddab-b579-488a-ad0d-45d1b734b7aa · outbound

This paper cites HiFi-GAN: generative adversarial networks for efficient and high fidelity speech synthesis,.

Autoregressive Speech Enhancement via Acoustic Tokens HiFi-GAN: generative adversarial networks for efficient and high fidelity speech synthesis,

Reference 53

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T16:41:25.942088Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T16:41:24.449009Z digest=sha256:7801f260edf97d1b59fd2ae2ad15df3d054ad0ae662ede6810663a100b622333

Observation ed1acbb9-c6b4-4e15-bc91-36390d02c712 · outbound

This paper cites SDR–half-baked or well done?.

Autoregressive Speech Enhancement via Acoustic Tokens SDR–half-baked or well done?

Reference 54

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T16:41:25.773788Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T16:41:24.536302Z digest=sha256:d83a8021809145132f881f552ad3611ef4b5c64b8f558720a4bf054769fc3bd1

Observation fe0fb2b9-cd79-4037-a7af-6da541f5cfeb · outbound

This paper cites DNSMOS P.835: A non-intrusive perceptual objective speech quality metric to evaluate noise suppressors,.

Autoregressive Speech Enhancement via Acoustic Tokens DNSMOS P.835: A non-intrusive perceptual objective speech quality metric to evaluate noise suppressors,

Reference 55

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T16:41:25.606167Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T16:41:24.615550Z digest=sha256:270aa607d78953c36ee107419c9277ccf62bbb18e25a7debd2f00ed58684ce85

Observation e1429f09-8f54-45c4-a2ce-c34d2ddece51 · outbound

This paper cites Sequential multi-frame neural beamforming for speech separation and enhancement,.

Autoregressive Speech Enhancement via Acoustic Tokens Sequential multi-frame neural beamforming for speech separation and enhancement,

Reference 56

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T16:41:25.475436Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T16:41:24.709317Z digest=sha256:cd608684d99e22a2caf0f0ec3852ad374a8c9cedc30b22102649482a201dc155

Observation 42d7cc22-0da8-414d-a31f-95b64b67886d · outbound

This paper cites Robust Speech Recognition via Large-Scale Weak Supervision.

Autoregressive Speech Enhancement via Acoustic Tokens Robust Speech Recognition via Large-Scale Weak Supervision

Reference 57

Resolution
unresolved
no resolver link, observed 2026-08-06T16:41:24.784828Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T16:41:24.784828Z digest=sha256:a0834c3a35f1feac27bb79f799c2dabdf05e6756f67aa7664f35ad016a7f52f0

Observation 90afd037-2529-483c-901a-2a3dbe73b7c4 · outbound

This paper cites SpeechBrain: A General-Purpose Speech Toolkit.

Autoregressive Speech Enhancement via Acoustic Tokens SpeechBrain: A General-Purpose Speech Toolkit

Reference 58

Resolution
unresolved
no resolver link, observed 2026-08-06T16:41:24.873492Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T16:41:24.873492Z digest=sha256:97a2f54074b1dc5952bebe7186080374bd3f01cfa026173a903df12e4b0314f1

Observation d73f1af6-a726-4f01-86c1-b4ed3f9564ad · outbound

This paper cites Open-Source Conversational AI with SpeechBrain 1.0.

Autoregressive Speech Enhancement via Acoustic Tokens Open-Source Conversational AI with SpeechBrain 1.0

Reference 59

Resolution
unresolved
no resolver link, observed 2026-08-06T16:41:24.944577Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T16:41:24.944577Z digest=sha256:2bb1938a1cc1a4779a9bd2d666c06357727918f9b1132405a9614a9fd8c0a29e

Observation d8f5479f-9a8e-4cdd-b413-54133d9853df · outbound

This paper cites TokenSplit: Using discrete speech representations for direct, refined, and transcript-conditioned speech separation and recognition,.

Autoregressive Speech Enhancement via Acoustic Tokens TokenSplit: Using discrete speech representations for direct, refined, and transcript-conditioned speech separation and recognition,

Reference 60

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T16:41:25.324407Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T16:41:25.045627Z digest=sha256:e61921227cfbe6e34a243bcd9c83fe72575975203225b97432fc11c0e6ec7ccb

Pith citing papers

Observation 99f1c4fc-b32d-42bc-8a36-6960e5ecc296 · inbound

Absorbing Discrete Diffusion for Speech Enhancement cites this paper.

Absorbing Discrete Diffusion for Speech Enhancement Autoregressive Speech Enhancement via Acoustic Tokens

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-02T20:45:11.099531Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T20:45:11.099531Z digest=sha256:b53a974619c9f6d512522b9195f07a3e375e61b31665dfc7f881c5bc451b7a2c