Pith. sign in

Paper Citation Record · LEDGER

Phoneme-First Prediction for LLM-Based Speech Recognition

As of 21 August 2026, this Paper Citation Record lists 41 of 41 outbound references and 0 inbound Pith citation observations for arXiv:2606.10864.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2606.10864 v1

Coverage vector

measured 41 of 41 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-06-27T11:50:03.947364Z

measured 41 of 41 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-21T06:32:19.484+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

41 of 41 outbound references displayed

  • verified exact1
  • verified fuzzy0
  • unresolved40
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation d1b14169-4b35-4c45-8544-e5f89945c72f · outbound

This paper cites Hybrid CTC/Attention architecture for end-to- end speech recognition,.

Phoneme-First Prediction for LLM-Based Speech Recognition Hybrid CTC/Attention architecture for end-to- end speech recognition,

Reference 1

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:6de410037b11ce5bd0a2873c069985f92458fd08c22ab7a278dd5fda99a7b391

Observation 6b01d563-b780-4530-b8d2-e70c5c4481db · outbound

This paper cites Robust speech recognition via large-scale weak supervision,.

Phoneme-First Prediction for LLM-Based Speech Recognition Robust speech recognition via large-scale weak supervision,

Reference 2

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:e5405a9f715c87607f125e4c2fe44c7f37be7b3bf0074c42f71849875427eee4

Observation e1db1406-605b-43c8-a94d-8a2c6faa10cd · outbound

This paper cites Reproducing Whisper-style training using an open- source toolkit and publicly available data,.

Phoneme-First Prediction for LLM-Based Speech Recognition Reproducing Whisper-style training using an open- source toolkit and publicly available data,

Reference 3

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:ac64de9fcb071961be33aeda1e89fc2137cd287096a631e6759f20c832ef62bb

Observation 669d07a2-23b5-487f-ad7d-b8b78af9ab28 · outbound

This paper cites Wav2vec 2.0: A framework for self-supervised learning of speech representations,.

Phoneme-First Prediction for LLM-Based Speech Recognition Wav2vec 2.0: A framework for self-supervised learning of speech representations,

Reference 4

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:3bce15b645c5e643023452b3b27d734abc684af80e069f7e064e0a558687acac

Observation 986f3fd8-9c41-46e4-9dbb-f71a4806f83d · outbound

This paper cites HuBERT: Self-supervised speech representation learning by masked prediction of hidden units,.

Phoneme-First Prediction for LLM-Based Speech Recognition HuBERT: Self-supervised speech representation learning by masked prediction of hidden units,

Reference 5

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:fc7eaa3b461f594887fc9bd674c5c233620d0a0064366eaae05bfcc3b18fc298

Observation 04e42d85-8d14-46d5-bd4a-9f700843e86b · outbound

This paper cites Language models are few-shot learners,.

Phoneme-First Prediction for LLM-Based Speech Recognition Language models are few-shot learners,

Reference 6

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:e62f8f7f012c9d87108bb3de3dedcb51165320ed1573bdefcd73ab84c8f05e05

Observation 992fab96-0548-4444-932c-5eac8b18f3ab · outbound

This paper cites ICLEval: Evaluating in-context learning ability of large language models,.

Phoneme-First Prediction for LLM-Based Speech Recognition ICLEval: Evaluating in-context learning ability of large language models,

Reference 7

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:217d7035a5096e4700fd6e7cfd959a3c4716edfaffec727ca11c7ad21a5cf87e

Observation 1b6710c4-8ada-4492-82e0-4abca001297a · outbound

This paper cites AudioChatLlama: Towards general-purpose speech abilities for LLMs,.

Phoneme-First Prediction for LLM-Based Speech Recognition AudioChatLlama: Towards general-purpose speech abilities for LLMs,

Reference 8

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:1ca2568eead1aeafbe0f95de677eb688bfef71eda7f22d8b7131f5eb0034f76e

Observation 9a2f510a-899c-42b2-a92a-38338f8b3f75 · outbound

This paper cites Prompting large language models with speech recognition abilities,.

Phoneme-First Prediction for LLM-Based Speech Recognition Prompting large language models with speech recognition abilities,

Reference 9

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:e3c4d25acff63e579ff5d29a922297efc88170cc8e73166b17affe492d073f1f

Observation ddf5143e-c500-4292-ac28-174acafe8bff · outbound

This paper cites SALMONN: Towards generic hearing abilities for large language models,.

Phoneme-First Prediction for LLM-Based Speech Recognition SALMONN: Towards generic hearing abilities for large language models,

Reference 10

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:78406096ea4cea1b36af97c63b439154925cdb299112a7b68c3ecc594f9c677a

Observation 53be9f38-2b91-475f-b8bc-f9a32fcf2d5a · outbound

This paper cites On decoder-only architecture for speech-to-text and large language model integration,.

Phoneme-First Prediction for LLM-Based Speech Recognition On decoder-only architecture for speech-to-text and large language model integration,

Reference 11

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:9877da50d1490b64a84809524222529ac2a174e85ae1aae0ab254769b591d01d

Observation e5656288-7fba-4200-8c70-4f65b25316db · outbound

This paper cites Wav2Prompt: End-to-end speech prompt learning and task-based fine-tuning for text-based LLMs,.

Phoneme-First Prediction for LLM-Based Speech Recognition Wav2Prompt: End-to-end speech prompt learning and task-based fine-tuning for text-based LLMs,

Reference 12

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:0af946bf8f09a9d360fa145e0a00bf275cd036ec7e04b0a5cb772f12119dffde

Observation 0b8865ce-2074-48db-8f6e-c578995019b6 · outbound

This paper cites Speech ReaLLM: Real-time speech recognition with multimodal language models by teaching the flow of time,.

Phoneme-First Prediction for LLM-Based Speech Recognition Speech ReaLLM: Real-time speech recognition with multimodal language models by teaching the flow of time,

Reference 13

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:6cbb94c05700f8314ecdae20ad5b2ee4f3735306a436743886811733e58f579f

Observation 09d58f6b-d535-4145-87bc-754bb56ae523 · outbound

This paper cites SALM: Speech-augmented language model with in-context learning for speech recognition and translation,.

Phoneme-First Prediction for LLM-Based Speech Recognition SALM: Speech-augmented language model with in-context learning for speech recognition and translation,

Reference 14

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:67189a73c6672eeaf4ae6cd5ae8a2946e1480bc692ba7a0fba249af02a3fe2e3

Observation 93153887-f10e-4eb3-8b8e-95ff650fa62e · outbound

This paper cites Investigating decoder-only large language models for speech-to-text translation,.

Phoneme-First Prediction for LLM-Based Speech Recognition Investigating decoder-only large language models for speech-to-text translation,

Reference 15

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:cf3fb0fd5f5543781a54a4b3401cfe7f100706fbdd2db01f9eb89a50ef8e9b81

Observation 7e5de177-0799-46ec-a724-2e35eb519400 · outbound

This paper cites Prompting large language models with audio for general-purpose speech summarization,.

Phoneme-First Prediction for LLM-Based Speech Recognition Prompting large language models with audio for general-purpose speech summarization,

Reference 16

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:078863b7a067b2989fa400866759991da864f9ecc8425f1e749526b766f2fcd6

Observation df4b2ca7-7ecd-4176-ad0d-0b21386aaf62 · outbound

This paper cites Contextual biasing speech recognition in speech- enhanced large language model,.

Phoneme-First Prediction for LLM-Based Speech Recognition Contextual biasing speech recognition in speech- enhanced large language model,

Reference 17

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:9d3bf31d4c2f01d9db499740ac438455d032caef49bf489e81e26d5d7a5e0be6

Observation 36704c65-2420-4a0c-a8cb-ec950f86c00f · outbound

This paper cites MaLa-ASR: Multimedia-assisted LLM-based ASR,.

Phoneme-First Prediction for LLM-Based Speech Recognition MaLa-ASR: Multimedia-assisted LLM-based ASR,

Reference 18

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:ea3cb2d418f3888427c26f48f385e95261ec24fa7f65ff8dc340e19b8904dce3

Observation a54408b2-a99b-4b86-a9e1-2c66c8191eb1 · outbound

This paper cites SpeechGPT: Empowering large language models with intrinsic cross-modal conversational abilities,.

Phoneme-First Prediction for LLM-Based Speech Recognition SpeechGPT: Empowering large language models with intrinsic cross-modal conversational abilities,

Reference 19

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:a90969d56ceac301cd905bb206234b75eff9690c3019aec13cf9ea661bf9cda2

Observation 284b0de5-918a-404f-9c31-6d890f22f798 · outbound

This paper cites Using large language model for end-to-end Chinese ASR and NER,.

Phoneme-First Prediction for LLM-Based Speech Recognition Using large language model for end-to-end Chinese ASR and NER,

Reference 20

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:a9ef01a37fa56e75107503de3211472d4bde8cdf0c8bccb7180f2a11e6ffd9f8

Observation 83509249-a515-4525-b1cf-39a88a4c44f4 · outbound

This paper cites Whispering LLaMA: A cross-modal generative error correction framework for speech recognition,.

Phoneme-First Prediction for LLM-Based Speech Recognition Whispering LLaMA: A cross-modal generative error correction framework for speech recognition,

Reference 21

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:3fa8db0742ed17cd004e9b75c05265606f1f3472e758bd951c17b9f9892b19a8

Observation 308dcc7e-753a-4e69-9279-90908678973a · outbound

This paper cites SLM: Bridge the thin gap between speech and text foundation models,.

Phoneme-First Prediction for LLM-Based Speech Recognition SLM: Bridge the thin gap between speech and text foundation models,

Reference 22

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:52f9665a190b77cd00f10088cbc74ba15f3031a986db77d84c9052f8e1909ae8

Observation 0ef9b052-c03a-4603-bc7b-067531d782cd · outbound

This paper cites Connecting speech encoder and large language model for ASR,.

Phoneme-First Prediction for LLM-Based Speech Recognition Connecting speech encoder and large language model for ASR,

Reference 23

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:ebf6ccb8620223a7fed744aea14e9ba80848f0cf0a4df120c42d7c9890991213

Observation 8104caaf-e607-4bbb-bff9-2edd8952fe6c · outbound

This paper cites Speech recognition meets large language model: Benchmarking, models, and exploration,.

Phoneme-First Prediction for LLM-Based Speech Recognition Speech recognition meets large language model: Benchmarking, models, and exploration,

Reference 24

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:21ca27c1eeab737cd3ba520c4fd8b1f6a09ee09b3896f131fc02061709ef7b9e

Observation 2118fe69-6661-4f4f-b71d-3f4584908b88 · outbound

This paper cites Improving spoken language modeling with phoneme classification: A simple fine-tuning approach,.

Phoneme-First Prediction for LLM-Based Speech Recognition Improving spoken language modeling with phoneme classification: A simple fine-tuning approach,

Reference 25

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:4e85fac46efb82f4bd036e4c532d5ade38006f840e92accb3bac4ef6cd45a8aa

Observation cd7db311-2d99-4413-ae0a-4b4b24da9145 · outbound

This paper cites Improving large-scale deep biasing with phoneme features and text-only data in streaming transducer,.

Phoneme-First Prediction for LLM-Based Speech Recognition Improving large-scale deep biasing with phoneme features and text-only data in streaming transducer,

Reference 26

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:bff5f6dec2da0030651572e1f1ec7338504290bd21fec7f0790cd686108199aa

Observation 6297b633-bdeb-4f11-8f8a-7d709a229f9b · outbound

This paper cites Phoneme-aware encoding for prefix-tree-based contextual asr,.

Phoneme-First Prediction for LLM-Based Speech Recognition Phoneme-aware encoding for prefix-tree-based contextual asr,

Reference 27

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:bea72d12bc8433984ebe3f59d78cf197d6b4190c2a3166e327cdbc23c50376dc

Observation cf51188d-07bb-454e-b1ee-08920e00827c · outbound

This paper cites WavLLM: Towards robust and adaptive speech large language model,.

Phoneme-First Prediction for LLM-Based Speech Recognition WavLLM: Towards robust and adaptive speech large language model,

Reference 28

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:317a040a53e9f8c7390ac74ca86e112eb4ee0d359645093cfed22922a71d4de9

Observation bbc33d70-9477-4bdd-915f-5130d293ceef · outbound

This paper cites AlignFormer: Modality matching can achieve better zero-shot instruction-following speech-LLM,.

Phoneme-First Prediction for LLM-Based Speech Recognition AlignFormer: Modality matching can achieve better zero-shot instruction-following speech-LLM,

Reference 29

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:39c7cd3b9570ff196284599606378d08897d0933aac9839b7d17a803e4b8e3dc

Observation ab3def8d-3cf8-419b-8428-2fee0b2640fe · outbound

This paper cites QLoRA: Efficient finetuning of quantized LLMs,.

Phoneme-First Prediction for LLM-Based Speech Recognition QLoRA: Efficient finetuning of quantized LLMs,

Reference 30

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:555b44f6fb3b36d8dc1fdf1138e3ec21c689c11820f4e795b31cd1b7051e51a9

Observation f33e143b-118a-4a18-a01b-8699a69ff287 · outbound

This paper cites Speech model pre-training for end-to-end spoken language understanding,.

Phoneme-First Prediction for LLM-Based Speech Recognition Speech model pre-training for end-to-end spoken language understanding,

Reference 31

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:fb93f7f9e6e441b9f1bbc77d01f81e4ee1e75d6cf43fce887f0969582a5e95aa

Observation 824d3fce-3840-4767-a90b-3331137371d9 · outbound

This paper cites TED-LIUM 3: Twice as much data and corpus repartition for experiments on speaker adaptation,.

Phoneme-First Prediction for LLM-Based Speech Recognition TED-LIUM 3: Twice as much data and corpus repartition for experiments on speaker adaptation,

Reference 32

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:d3d5a4112852c764034d5abcf46b4bf37b7ed379850ef859cfc58b96f6a4fb36

Observation 58fa854f-d45e-42d8-bd71-f1277dff0ee1 · outbound

This paper cites TED-LIUM: an automatic speech recognition dedicated corpus,.

Phoneme-First Prediction for LLM-Based Speech Recognition TED-LIUM: an automatic speech recognition dedicated corpus,

Reference 33

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:7c88339365e7dd93aa71a8630d610b3da9cca13d0d01c17c93d5657709c80534

Observation 1978b4ab-abaf-4dca-902c-bbdbccba3c10 · outbound

This paper cites Layer-wise analysis of a self-supervised speech representation model,.

Phoneme-First Prediction for LLM-Based Speech Recognition Layer-wise analysis of a self-supervised speech representation model,

Reference 34

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:4161580c4c80d0ea2593816dba0cfbed73b9810abc059c978094c79d0e0975f7

Observation 15f6a2eb-8be1-4f7e-ad30-5e48f197f1a6 · outbound

This paper cites SUPERB: Speech processing universal PERfor- mance benchmark,.

Phoneme-First Prediction for LLM-Based Speech Recognition SUPERB: Speech processing universal PERfor- mance benchmark,

Reference 35

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:216e173e4bb05591fb1f32b00de6c1aeb3e8062e8787de2bf9f41bae667e4e86

Observation a4d18cae-9b84-4b3c-aad9-0b18a3a40c0d · outbound

This paper cites The Spoken Dutch Corpus: Overview and first evaluation,.

Phoneme-First Prediction for LLM-Based Speech Recognition The Spoken Dutch Corpus: Overview and first evaluation,

Reference 36

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:8e4c9f5fb29ccaa01e2130bec9fd7c0cad216af06c62f2038fb32e00ee50d32a

Observation b79553a2-623e-482b-838a-fe44156eeb26 · outbound

This paper cites Automatic generation of phonetic transcriptions for large speech corpora,.

Phoneme-First Prediction for LLM-Based Speech Recognition Automatic generation of phonetic transcriptions for large speech corpora,

Reference 37

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:be115b0cdbcc6c7f5437637085a41d27c72cd468e9336fa01f30026b4f339ab5

Observation 28860d14-9775-4695-8545-8b7daa61a088 · outbound

This paper cites Assessing manually corrected broad phonetic transcriptions in the spoken Dutch corpus,.

Phoneme-First Prediction for LLM-Based Speech Recognition Assessing manually corrected broad phonetic transcriptions in the spoken Dutch corpus,

Reference 38

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:0ea9f16307652a364cf27f45c266345ac7655290c8408976a868ee34efe2ccb7

Observation 1689d178-78d0-42b0-b4b4-48f29e61a808 · outbound

This paper cites Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling.

Phoneme-First Prediction for LLM-Based Speech Recognition Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling

Reference 39

Resolution
verified exact
arxiv_id, observed 2026-07-03T07:47:44.606826Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:689f27633f84de51286b541f4bd46425709453932458c2e6be8ef729233a8184

Observation 0fc1c09f-bcf6-4dd7-926b-0975430163ce · outbound

This paper cites Trans-tokenization and cross-lingual vocabulary transfers: language adaptation of LLMs for low-resource NLP,.

Phoneme-First Prediction for LLM-Based Speech Recognition Trans-tokenization and cross-lingual vocabulary transfers: language adaptation of LLMs for low-resource NLP,

Reference 40

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:9e0394d12bb64a063fa37f05c2d1d30138e10d0bd5ea3987594a5e3390c1ead7

Observation 2e9ebee1-5cad-42cd-8cab-f9446785a2fe · outbound

This paper cites Montreal Forced Aligner: Trainable text- speech alignment using Kaldi,.

Phoneme-First Prediction for LLM-Based Speech Recognition Montreal Forced Aligner: Trainable text- speech alignment using Kaldi,

Reference 41

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:990122846ba83981afec1cbeb16ac48f1bf64772af0e5cef85eb1274545b5ce2

Pith citing papers

No inbound Pith citation observations are available.