Pith. sign in

Paper Citation Record · LEDGER

A Comparative Study of Discrete Speech Tokens for Semantic-Related Tasks with Large Language Models

As of 16 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 4 inbound Pith citation observations for arXiv:2411.08742.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2411.08742 v1

Coverage vector

measured 35 of 35 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-12T21:27:18.862726Z

measured 39 of 39 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-15T06:32:42.880941+00:00

measured 4 of 4 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-10T14:27:09.035252Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-05-12T02:06:14.987201Z

Reference resolution

35 of 35 outbound references displayed

  • verified exact1
  • verified fuzzy9
  • unresolved25
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 6eb954aa-f084-49d8-8db4-50d79d9a2b1b · outbound

This paper cites Qwen-Audio: Advancing Universal Audio Understanding via Unified Large-Scale Audio-Language Models.

A Comparative Study of Discrete Speech Tokens for Semantic-Related Tasks with Large Language Models Qwen-Audio: Advancing Universal Audio Understanding via Unified Large-Scale Audio-Language Models

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-12T21:27:18.675830Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T21:27:18.675830Z digest=sha256:8a7e2bf4d088f09c57a570ca61b95135f4eb0a4fc579afa872fc08cd6c2614e4

Observation 6ff3ebd0-44db-421a-9894-2979d38956c8 · outbound

This paper cites LauraGPT: Listen, Attend, Understand, and Regenerate Audio with GPT.

A Comparative Study of Discrete Speech Tokens for Semantic-Related Tasks with Large Language Models LauraGPT: Listen, Attend, Understand, and Regenerate Audio with GPT

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-12T21:27:18.682101Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T21:27:18.682101Z digest=sha256:fce3b36337e38e3c6173f1a2cdf467f3ca25e47c37dfd799b0ac68a10fc81441

Observation 23456119-33b2-4da6-add8-fe514bd79060 · outbound

This paper cites Joint audio and speech understanding,.

A Comparative Study of Discrete Speech Tokens for Semantic-Related Tasks with Large Language Models Joint audio and speech understanding,

Reference 3

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T21:27:19.468388Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-12T21:27:18.687580Z digest=sha256:9fd99e030b66b3f95c0d787aeeeded6e827e704dd41d5cf192a46c0c6783b841

Observation 6e62b8a9-7107-4498-b47f-c5ca2d5d5af3 · outbound

This paper cites BLSP: Bootstrapping Language-Speech Pre-training via Behavior Alignment of Continuation Writing.

A Comparative Study of Discrete Speech Tokens for Semantic-Related Tasks with Large Language Models BLSP: Bootstrapping Language-Speech Pre-training via Behavior Alignment of Continuation Writing

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-12T21:27:18.692760Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T21:27:18.692760Z digest=sha256:5983a884b236247e693852e3cf54756cb2bb8a3e1f457f4586e84e92f51e2086

Observation 3076aabb-f0ea-4552-a5c8-7ef942a19cbf · outbound

This paper cites SALMONN: Towards Generic Hearing Abilities for Large Language Models.

A Comparative Study of Discrete Speech Tokens for Semantic-Related Tasks with Large Language Models SALMONN: Towards Generic Hearing Abilities for Large Language Models

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-12T21:27:18.698605Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T21:27:18.698605Z digest=sha256:184b1af96131afe914d8005c8837c730151481baba46417bbff40a445e53b5c8

Observation c0c7a3c8-2e85-41e5-a355-99e85750233b · outbound

This paper cites Listen, Think, and Understand.

A Comparative Study of Discrete Speech Tokens for Semantic-Related Tasks with Large Language Models Listen, Think, and Understand

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-12T21:27:18.704042Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T21:27:18.704042Z digest=sha256:f27629acbf7f8a6bece25d46cc00b50e0235ccb63a1e556f8efbc805876ada34

Observation 521848cc-f4da-4827-9531-2271455e2d5c · outbound

This paper cites Robust speech recognition via large-scale weak supervision,.

A Comparative Study of Discrete Speech Tokens for Semantic-Related Tasks with Large Language Models Robust speech recognition via large-scale weak supervision,

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T21:27:19.451684Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-12T21:27:18.710745Z digest=sha256:1d15e6118760bbd70784377945127921308b6df8187bc29243b1cc9d71eb5875

Observation a66dcf6c-66a6-493a-9990-7bfec5c630e3 · outbound

This paper cites Gpt understands, too,.

A Comparative Study of Discrete Speech Tokens for Semantic-Related Tasks with Large Language Models Gpt understands, too,

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-12T21:27:18.715696Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T21:27:18.715696Z digest=sha256:1fff474c70b2377a0b534c71c610867c66a4743736629c9e5f85e1c42241dd35

Observation 71f4d0f0-f464-49c7-9d48-1ef89d3200a9 · outbound

This paper cites The Llama 3 Herd of Models.

A Comparative Study of Discrete Speech Tokens for Semantic-Related Tasks with Large Language Models The Llama 3 Herd of Models

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-12T21:27:18.720777Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T21:27:18.720777Z digest=sha256:3c93fbb28cab238827ecc6fd982fd9a5d33d9c96dc0ed6c92e32007d01f56d0e

Observation 7bbd5fd5-980d-4558-b509-28cb3f8fc26a · outbound

This paper cites SpeechGPT: Empowering Large Language Models with Intrinsic Cross-Modal Conversational Abilities.

A Comparative Study of Discrete Speech Tokens for Semantic-Related Tasks with Large Language Models SpeechGPT: Empowering Large Language Models with Intrinsic Cross-Modal Conversational Abilities

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-12T21:27:18.728130Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T21:27:18.728130Z digest=sha256:c139350ae4827c8e088f32630269efe5991446bc2b639635f594828b3b52cfef

Observation 170843e4-0630-45f1-990f-8c4e1af0e4e9 · outbound

This paper cites AudioPaLM: A Large Language Model That Can Speak and Listen.

A Comparative Study of Discrete Speech Tokens for Semantic-Related Tasks with Large Language Models AudioPaLM: A Large Language Model That Can Speak and Listen

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-12T21:27:18.734324Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T21:27:18.734324Z digest=sha256:871fb68cde4b0eb20aa6da7fb276c4dfd1f8f898f24d167448911867ea49e0e3

Observation 24bd0131-167e-4f7b-a166-f88184e25cc5 · outbound

This paper cites VioLA: Unified Codec Language Models for Speech Recognition, Synthesis, and Translation.

A Comparative Study of Discrete Speech Tokens for Semantic-Related Tasks with Large Language Models VioLA: Unified Codec Language Models for Speech Recognition, Synthesis, and Translation

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-12T21:27:18.739733Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T21:27:18.739733Z digest=sha256:4b0f678bb8896d7613647b0d3227b3236b49df9a1890aed417b132d06440afa3

Observation 60664c76-d7d7-4c9a-969e-7c3de5b2481c · outbound

This paper cites Speechx: Neural codec language model as a versatile speech transformer,.

A Comparative Study of Discrete Speech Tokens for Semantic-Related Tasks with Large Language Models Speechx: Neural codec language model as a versatile speech transformer,

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T21:27:19.422058Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-12T21:27:18.745644Z digest=sha256:89b7497228e36f66c3587570276429a3aa13324cd4dd3c5c847911ffe976f2c3

Observation 7fa2f6ae-5902-4c38-82b8-39591e1bd342 · outbound

This paper cites SpeechTokenizer: Unified Speech Tokenizer for Speech Large Language Models.

A Comparative Study of Discrete Speech Tokens for Semantic-Related Tasks with Large Language Models SpeechTokenizer: Unified Speech Tokenizer for Speech Large Language Models

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-12T21:27:18.750719Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T21:27:18.750719Z digest=sha256:9d2e7c4bf62e4980b19bcff14e55eeb0483e25b1eb4531e49491e6c3fd81961e

Observation 55f5d35d-9936-416b-9b29-b9b152bf0ddc · outbound

This paper cites Audiolm: a language modeling approach to audio gener- ation,.

A Comparative Study of Discrete Speech Tokens for Semantic-Related Tasks with Large Language Models Audiolm: a language modeling approach to audio gener- ation,

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-12T21:27:18.756023Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T21:27:18.756023Z digest=sha256:0e17d113570d60dac678344b41fa0b713468f8a54fd6734333b6a217310a547f

Observation 2bc9de5d-b41a-445f-abfd-74d7db6f0ef5 · outbound

This paper cites Soundstream: An end-to-end neural audio codec,.

A Comparative Study of Discrete Speech Tokens for Semantic-Related Tasks with Large Language Models Soundstream: An end-to-end neural audio codec,

Reference 16

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T21:27:19.393154Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-12T21:27:18.760739Z digest=sha256:e143c4c6a9446781fccced3fecbdb4b68c0b9376e045996c569325da032a9e9f

Observation 672b011b-79e9-410d-bba9-6e3e28c3c823 · outbound

This paper cites High Fidelity Neural Audio Compression.

A Comparative Study of Discrete Speech Tokens for Semantic-Related Tasks with Large Language Models High Fidelity Neural Audio Compression

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-12T21:27:18.765825Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T21:27:18.765825Z digest=sha256:553ad1ab5f8a506694d4fbbcc630baf37781ab8f1d0383b156fb41f6a39fe4fd

Observation 50822111-5adc-4319-a15d-c9f891e2de73 · outbound

This paper cites Exploring speech recognition, translation, and understanding with discrete speech units: A comparative study,.

A Comparative Study of Discrete Speech Tokens for Semantic-Related Tasks with Large Language Models Exploring speech recognition, translation, and understanding with discrete speech units: A comparative study,

Reference 18

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T21:27:19.376906Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-12T21:27:18.771059Z digest=sha256:6eaee1713f27a7582e39383b0d453039220ce8f5ae1ca50b9bc75a59279e009d

Observation 356d2ddc-d1df-445f-a14b-4de49e4b8a80 · outbound

This paper cites Neural Codec Language Models are Zero-Shot Text to Speech Synthesizers.

A Comparative Study of Discrete Speech Tokens for Semantic-Related Tasks with Large Language Models Neural Codec Language Models are Zero-Shot Text to Speech Synthesizers

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-12T21:27:18.776144Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T21:27:18.776144Z digest=sha256:72618e979fe944ee2b05ead9c385beb02df031410967363df4287404cd92d440

Observation 7a1ad01f-ee6c-414d-84e4-03dffcd0114b · outbound

This paper cites Towards universal speech discrete tokens: A case study for asr and tts,.

A Comparative Study of Discrete Speech Tokens for Semantic-Related Tasks with Large Language Models Towards universal speech discrete tokens: A case study for asr and tts,

Reference 20

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T21:27:19.358862Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-12T21:27:18.781719Z digest=sha256:7be9919020827645b03322694bdb91b7a1d7bad296b65f341ed08b33df8be727

Observation d9bbb43a-ecf0-43c4-8371-73ad6f41a96b · outbound

This paper cites Exploration of Efficient End-to-End ASR using Discretized Input from Self-Supervised Learning.

A Comparative Study of Discrete Speech Tokens for Semantic-Related Tasks with Large Language Models Exploration of Efficient End-to-End ASR using Discretized Input from Self-Supervised Learning

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-12T21:27:18.787405Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T21:27:18.787405Z digest=sha256:027b4d1a3087ff5c1075bc34ccabeec0861656bc12a373efde2f019f9f6ce237

Observation 7776c339-342b-49d3-99c4-f8fa16839187 · outbound

This paper cites DUB: Discrete Unit Back-translation for Speech Translation.

A Comparative Study of Discrete Speech Tokens for Semantic-Related Tasks with Large Language Models DUB: Discrete Unit Back-translation for Speech Translation

Reference 22

Resolution
verified exact
local_arxiv, observed 2026-08-12T21:27:19.056907Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-12T21:27:18.793066Z digest=sha256:a27d9c8f5ec69c6a4a931cf44c87b0b947f60cf09448209a5f70198cec61ca7e

Observation 9718d6fb-5162-4022-a3d4-f4e39bee7bf9 · outbound

This paper cites Textless Unit-to-Unit training for Many-to-Many Multilingual Speech-to-Speech Translation.

A Comparative Study of Discrete Speech Tokens for Semantic-Related Tasks with Large Language Models Textless Unit-to-Unit training for Many-to-Many Multilingual Speech-to-Speech Translation

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-12T21:27:18.798458Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T21:27:18.798458Z digest=sha256:2b6143c210d7d3fc41c92312b596a873a387bd6e3a569fc849839cc454bf434e

Observation 6ed88c8f-2b97-4591-82b0-d444df9ddbc0 · outbound

This paper cites Hubert: Self-supervised speech representation learning by masked prediction of hidden units,.

A Comparative Study of Discrete Speech Tokens for Semantic-Related Tasks with Large Language Models Hubert: Self-supervised speech representation learning by masked prediction of hidden units,

Reference 24

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T21:27:19.340874Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-12T21:27:18.803320Z digest=sha256:8375977d57f10e37870d7cfca9858f2ec52793d5fd7f45ebca80dc77faba20c1

Observation cb780119-a01e-4c6b-b447-88005b35fc5a · outbound

This paper cites Wavlm: Large-scale self-supervised pre-training for full stack speech processing,.

A Comparative Study of Discrete Speech Tokens for Semantic-Related Tasks with Large Language Models Wavlm: Large-scale self-supervised pre-training for full stack speech processing,

Reference 25

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T21:27:19.324722Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-12T21:27:18.808327Z digest=sha256:07e07c6f7ac3d79a42e78c203e168743a1b88e64d54667463e8c2d0f157ee201

Observation 3acc62ca-a566-4402-9769-355e79bf9840 · outbound

This paper cites DiscreteSLU: A Large Language Model with Self-Supervised Discrete Speech Units for Spoken Language Understanding.

A Comparative Study of Discrete Speech Tokens for Semantic-Related Tasks with Large Language Models DiscreteSLU: A Large Language Model with Self-Supervised Discrete Speech Units for Spoken Language Understanding

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-12T21:27:18.814047Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T21:27:18.814047Z digest=sha256:7c6dab4b0c66e0a91767f041ce6faeb4659e4ab6049170f6141f458eb1cd1eae

Observation 0025e7e7-563d-4a98-8780-d2b74dbe7812 · outbound

This paper cites Exploring the Benefits of Tokenization of Discrete Acoustic Units.

A Comparative Study of Discrete Speech Tokens for Semantic-Related Tasks with Large Language Models Exploring the Benefits of Tokenization of Discrete Acoustic Units

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-12T21:27:18.819905Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T21:27:18.819905Z digest=sha256:1b905509d21db48b2790ac03aeca9158220d57e1557315ea182ad6052852cd95

Observation 84b0ac47-7e47-4997-8a23-cfa9ffef0375 · outbound

This paper cites Qwen Technical Report.

A Comparative Study of Discrete Speech Tokens for Semantic-Related Tasks with Large Language Models Qwen Technical Report

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-12T21:27:18.825717Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T21:27:18.825717Z digest=sha256:be4fb916334378e0b4419b0b347eeb2714505565c366d4d72f278d96392718f2

Observation 581422a6-961a-40e9-afbc-1bd0a6e7bb77 · outbound

This paper cites Lib- rispeech: an asr corpus based on public domain audio books,.

A Comparative Study of Discrete Speech Tokens for Semantic-Related Tasks with Large Language Models Lib- rispeech: an asr corpus based on public domain audio books,

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-12T21:27:18.831396Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T21:27:18.831396Z digest=sha256:b6a9ea3202eed71031deaf134fd24ed6420cabf25b654f950af6188f2ce20dfb

Observation 8a18530a-2ebd-472d-880f-03b06f2bb154 · outbound

This paper cites GigaSpeech: An Evolving, Multi-domain ASR Corpus with 10,000 Hours of Transcribed Audio.

A Comparative Study of Discrete Speech Tokens for Semantic-Related Tasks with Large Language Models GigaSpeech: An Evolving, Multi-domain ASR Corpus with 10,000 Hours of Transcribed Audio

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-12T21:27:18.836309Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T21:27:18.836309Z digest=sha256:7e6f08db6fdfd3f3a104157d91b29ae50289b3aac968ca34c2a51ff9ece1dede

Observation d8aa5c48-8c25-4d0a-9a87-dc0aa98cb69e · outbound

This paper cites Speech Commands: A Dataset for Limited-Vocabulary Speech Recognition.

A Comparative Study of Discrete Speech Tokens for Semantic-Related Tasks with Large Language Models Speech Commands: A Dataset for Limited-Vocabulary Speech Recognition

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-12T21:27:18.841515Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T21:27:18.841515Z digest=sha256:73260bee4734a714a982b0b62c848de9879ea8c7d2348af88b666c0b7502d14a

Observation c177e77d-0ef2-4974-bbd2-08304ef456e1 · outbound

This paper cites SLURP: A Spoken Language Understanding Resource Package.

A Comparative Study of Discrete Speech Tokens for Semantic-Related Tasks with Large Language Models SLURP: A Spoken Language Understanding Resource Package

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-12T21:27:18.847048Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T21:27:18.847048Z digest=sha256:b2cf5e46c1f6bd91756f56bf813dc9ecbe295394c732130fd75b94e4f6f8108e

Observation e349fbf4-20d2-4463-b182-15de8c85dcaa · outbound

This paper cites GigaST: A 10,000-hour Pseudo Speech Translation Corpus.

A Comparative Study of Discrete Speech Tokens for Semantic-Related Tasks with Large Language Models GigaST: A 10,000-hour Pseudo Speech Translation Corpus

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-12T21:27:18.852446Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T21:27:18.852446Z digest=sha256:b24aaddf68a74bba7fce8fee411817fdb163cf150e9f1e49c38ec535008c4316

Observation 38bde750-2dc5-4341-9082-c286faf1b590 · outbound

This paper cites Iemocap: Interactive emotional dyadic motion cap- ture database,.

A Comparative Study of Discrete Speech Tokens for Semantic-Related Tasks with Large Language Models Iemocap: Interactive emotional dyadic motion cap- ture database,

Reference 34

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T21:27:19.298435Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-12T21:27:18.857518Z digest=sha256:107d666a1babcf718deb341aca4112b9bd369319e3ff75d2d4a9a74a61e0c3d7

Observation 306a5808-2d7d-43e8-aecc-5b38f6d14baa · outbound

This paper cites LoRA: Low-Rank Adaptation of Large Language Models.

A Comparative Study of Discrete Speech Tokens for Semantic-Related Tasks with Large Language Models LoRA: Low-Rank Adaptation of Large Language Models

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-12T21:27:18.862726Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T21:27:18.862726Z digest=sha256:1dfe4ad11cd035c6d3b1ef3108b8ce34333f4e666fe1430a60d60a854c58792f

Pith citing papers

Observation cf075be4-d900-495b-b85f-80164947a406 · inbound

The ICME 2025 Audio Encoder Capability Challenge cites this paper.

The ICME 2025 Audio Encoder Capability Challenge A Comparative Study of Discrete Speech Tokens for Semantic-Related Tasks with Large Language Models

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-10T14:27:09.035252Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T14:27:09.035252Z digest=sha256:59308ea70674ef546ec47e2c14a6650297d1438560324f4594c092ec9d6ac8bf

Observation f5f248cf-2e0c-4431-ace5-6751d1a27ea2 · inbound

X-ARES: A Comprehensive Framework for Assessing Audio Encoder Performance cites this paper.

X-ARES: A Comprehensive Framework for Assessing Audio Encoder Performance A Comparative Study of Discrete Speech Tokens for Semantic-Related Tasks with Large Language Models

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-07T15:05:13.708782Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T15:05:13.708782Z digest=sha256:c743416ae99cb9af474c769536fff7f882d7d15b71e9e1449eca6b5b3ddf5d15

Observation e76f0f9e-556f-4f76-80dd-868510da3a91 · inbound

Phonemes vs. Projectors: An Investigation of Speech-Language Interfaces for LLM-based ASR cites this paper.

Phonemes vs. Projectors: An Investigation of Speech-Language Interfaces for LLM-based ASR A Comparative Study of Discrete Speech Tokens for Semantic-Related Tasks with Large Language Models

Reference 22

Resolution
verified exact
arxiv_id, observed 2026-05-11T08:40:59.394509Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-05-10T16:33:32.012025Z digest=sha256:9a0d560a2a02870e16df7f310b2cd488db5aa408224cbc5fd338d3354c841a64

Observation acbf8981-92f0-4987-8a6a-027fcc88c228 · inbound

MegaScale-Omni: A Hyper-Scale, Workload-Resilient System for MultiModal LLM Training in Production cites this paper.

MegaScale-Omni: A Hyper-Scale, Workload-Resilient System for MultiModal LLM Training in Production A Comparative Study of Discrete Speech Tokens for Semantic-Related Tasks with Large Language Models

Reference 50

Resolution
verified exact
arxiv_id, observed 2026-05-12T02:06:14.989334Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-05-12T02:04:07.344134Z digest=sha256:897a2621187457fc9d3eea2d34ccc55908f0e10edc6b6272c030098850df06a0