Pith. sign in

Paper Citation Record · LEDGER

Diarization-Aware Multi-Speaker Automatic Speech Recognition via Large Language Models

As of 20 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 4 inbound Pith citation observations for arXiv:2506.05796.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2506.05796 v1

Coverage vector

measured 40 of 40 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-07T10:18:52.399445Z

measured 44 of 44 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-20T06:33:59.587034+00:00

measured 4 of 4 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-06T17:58:01.482455Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-07-03T07:57:44.681677Z

Reference resolution

40 of 40 outbound references displayed

  • verified exact0
  • verified fuzzy25
  • unresolved15
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation ddc2f27e-3a79-40e5-93ee-b2219d301ab9 · outbound

This paper cites Conformer: Convolution- augmented transformer for speech recognition,.

Diarization-Aware Multi-Speaker Automatic Speech Recognition via Large Language Models Conformer: Convolution- augmented transformer for speech recognition,

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-07T10:18:46.284510Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:18:46.284510Z digest=sha256:970a794ee2df2ae9f1b543fdc3d777f9742446a935d9d6d148a9d6e3be894779

Observation 125cf6a5-a89a-406e-b5ec-1b49d37b145a · outbound

This paper cites Recent advances in end-to-end automatic speech recog- nition,.

Diarization-Aware Multi-Speaker Automatic Speech Recognition via Large Language Models Recent advances in end-to-end automatic speech recog- nition,

Reference 2

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:19:00.755249Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:18:46.436866Z digest=sha256:a48314eef2af90dab422089da53b9a99777e2a1d92f3021aa839a5e4e7f4e260

Observation 96fd517d-f861-4492-a9aa-5214cec1df15 · outbound

This paper cites Zipformer: A faster and better encoder for automatic speech recognition,.

Diarization-Aware Multi-Speaker Automatic Speech Recognition via Large Language Models Zipformer: A faster and better encoder for automatic speech recognition,

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-07T10:18:46.610670Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:18:46.610670Z digest=sha256:150cfae51188b87ef0a7af8555d881051ab796bb3f329e97ce9d7bb1199cd17e

Observation 6a6e33d5-330d-49d2-8c46-e186c547be93 · outbound

This paper cites Survey of End-to-End Multi-Speaker Automatic Speech Recognition for Monaural Audio.

Diarization-Aware Multi-Speaker Automatic Speech Recognition via Large Language Models Survey of End-to-End Multi-Speaker Automatic Speech Recognition for Monaural Audio

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-07T10:18:46.748745Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:18:46.748745Z digest=sha256:a797aea2fd6deeba5ec70627bf0b8ff10d2afaa11be6fbcf80dff1ee25d65b2a

Observation e719cc1b-7012-42c1-a3f9-2aa26fcf4324 · outbound

This paper cites The CHiME-7 DASR Challenge: Distant Meeting Transcription with Multiple Devices in Diverse Scenarios.

Diarization-Aware Multi-Speaker Automatic Speech Recognition via Large Language Models The CHiME-7 DASR Challenge: Distant Meeting Transcription with Multiple Devices in Diverse Scenarios

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-07T10:18:46.930479Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:18:46.930479Z digest=sha256:c91adc9772d191207179e08efe792c27f7889ff3da51304afeb34ad8a792adfb

Observation fce4c73c-2739-4fc4-9714-7aa4dd7007d3 · outbound

This paper cites The CHiME-7 Challenge: System Description and Performance of NeMo Team's DASR System.

Diarization-Aware Multi-Speaker Automatic Speech Recognition via Large Language Models The CHiME-7 Challenge: System Description and Performance of NeMo Team's DASR System

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-07T10:18:47.093900Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:18:47.093900Z digest=sha256:777647a6ada4f3ed84b63266c8fa6f0c1169ba68f1c79f71a9c4cd598c13da0d

Observation ae635742-d518-43ee-a32b-485d18629f94 · outbound

This paper cites The iacas- thinkit system for chime-7 challenge,.

Diarization-Aware Multi-Speaker Automatic Speech Recognition via Large Language Models The iacas- thinkit system for chime-7 challenge,

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:19:00.491328Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:18:47.212304Z digest=sha256:d6a823c6452a8b22925482ae2da8759028bd83dfd4280beed1a8b191db467bd4

Observation 40a396bd-63a8-44c3-a9f7-24276a5de59f · outbound

This paper cites Lexical speaker error correction: Leveraging language models for speaker diarization error correction,.

Diarization-Aware Multi-Speaker Automatic Speech Recognition via Large Language Models Lexical speaker error correction: Leveraging language models for speaker diarization error correction,

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:19:00.174579Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:18:47.378249Z digest=sha256:848066d9fe3de397e857a09f12a93745c730382ee3dd1e30153aebde80394ffe

Observation a30ada74-12b3-4e78-b54d-cb3ec0539a55 · outbound

This paper cites Diariza- tionlm: Speaker diarization post-processing with large language models,.

Diarization-Aware Multi-Speaker Automatic Speech Recognition via Large Language Models Diariza- tionlm: Speaker diarization post-processing with large language models,

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:18:59.813755Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:18:47.577559Z digest=sha256:77b033417ca587d6f1e8c5b69123fbff16c468bb55ea1ead61f5904f341c5eff

Observation 3d8c46d5-8615-439a-8c07-efb2f3278b04 · outbound

This paper cites Continuous speech separation with conformer,.

Diarization-Aware Multi-Speaker Automatic Speech Recognition via Large Language Models Continuous speech separation with conformer,

Reference 10

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:18:59.351172Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:18:47.692208Z digest=sha256:f033ba139516b20a9eaa80ed43b6f5d57e3c8e48f6014a993f684f78cd686cf7

Observation ead1c679-59bd-4bb8-8119-4c1a3580cbc7 · outbound

This paper cites Low latency online blind source separation based on joint optimization with blind dereverberation,.

Diarization-Aware Multi-Speaker Automatic Speech Recognition via Large Language Models Low latency online blind source separation based on joint optimization with blind dereverberation,

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:18:59.137794Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:18:47.874830Z digest=sha256:bbde0618b567653bcff5b42cd98ef6cf9b90370002d6f55f89751840368c907a

Observation 2268b755-ca0c-49f0-af65-18373f325de5 · outbound

This paper cites Gpu-accelerated guided source separation for meeting transcription,.

Diarization-Aware Multi-Speaker Automatic Speech Recognition via Large Language Models Gpu-accelerated guided source separation for meeting transcription,

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:18:58.864495Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:18:48.008644Z digest=sha256:8bb1f672f45205178935d1c9f608cfa7a4ff0d88b6e2eb20c7677e1c5ea0c217

Observation 123df304-22b8-42da-b864-e69730549b57 · outbound

This paper cites Recognizing multi-talker speech with permutation invariant training,.

Diarization-Aware Multi-Speaker Automatic Speech Recognition via Large Language Models Recognizing multi-talker speech with permutation invariant training,

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:18:58.570712Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:18:48.186953Z digest=sha256:75169c164004626ae075d4db2ee0097d4468f89c01bd05b203400867c7fcc441

Observation 33aff08b-c8ff-4a63-9447-ba9428149f9c · outbound

This paper cites Mimo- speech: End-to-end multi-channel multi-speaker speech recognition,.

Diarization-Aware Multi-Speaker Automatic Speech Recognition via Large Language Models Mimo- speech: End-to-end multi-channel multi-speaker speech recognition,

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:18:58.298479Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:18:48.367081Z digest=sha256:97f4c89595d4b95b446d9acb6350f385e5083845629974a3188cee2c4fd88bbf

Observation 5b8a5bc0-0652-4e9d-a55f-546a11dd33ae · outbound

This paper cites Improving end-to- end single-channel multi-talker speech recognition,.

Diarization-Aware Multi-Speaker Automatic Speech Recognition via Large Language Models Improving end-to- end single-channel multi-talker speech recognition,

Reference 15

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:18:57.994425Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:18:48.523338Z digest=sha256:6c68076912efd3e155772f28e8e08684acbb6fed8ea7094956803e05f785208c

Observation 1b2c1675-0cb5-4a41-a4ab-9378605ff336 · outbound

This paper cites Serialized output training for end-to-end overlapped speech recognition,.

Diarization-Aware Multi-Speaker Automatic Speech Recognition via Large Language Models Serialized output training for end-to-end overlapped speech recognition,

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-07T10:18:48.656650Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:18:48.656650Z digest=sha256:693410088dbe31c62115369f882d775c24589dbfa9baa2ebb98768d863b7fc1e

Observation 37f24056-4cef-4f4e-872a-5d2bd2541fdc · outbound

This paper cites End-to-end speaker-attributed asr with transformer,.

Diarization-Aware Multi-Speaker Automatic Speech Recognition via Large Language Models End-to-end speaker-attributed asr with transformer,

Reference 17

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:18:57.636294Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:18:48.816512Z digest=sha256:b7a543bbb4d7270a4756e5b15f24a89c8c723c6f5bec43eb4dc25d46fd9e1cf0

Observation e4bc38a4-514c-4e0f-aaf7-ceef925de09b · outbound

This paper cites Streaming speaker-attributed asr with token-level speaker embeddings,.

Diarization-Aware Multi-Speaker Automatic Speech Recognition via Large Language Models Streaming speaker-attributed asr with token-level speaker embeddings,

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-07T10:18:49.072312Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:18:49.072312Z digest=sha256:bfd826bdb727c8076aacf241dcdd86f5bad8cf2dd6f210562fd44f7d7220dea3

Observation 56024215-7799-4f6b-90ac-6042bd091f54 · outbound

This paper cites Auxiliary interference speaker loss for target-speaker speech recognition,.

Diarization-Aware Multi-Speaker Automatic Speech Recognition via Large Language Models Auxiliary interference speaker loss for target-speaker speech recognition,

Reference 20

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:18:56.992755Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:18:49.251676Z digest=sha256:b2a115a8fab0aff6e84ceb9fa198123d8fba11b54f2ed95393ad4f416bbcbbaf

Observation bc9da3ab-26d4-42e7-ac47-7c8d4fdefe5b · outbound

This paper cites Conformer- based target-speaker automatic speech recognition for single-channel audio,.

Diarization-Aware Multi-Speaker Automatic Speech Recognition via Large Language Models Conformer- based target-speaker automatic speech recognition for single-channel audio,

Reference 21

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:18:56.514038Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:18:49.430150Z digest=sha256:a479818d7e749e39fff3688d3c404f2b771ed59fb48dbacfbc9b1b9997043c53

Observation 346aead5-8527-4efc-89f1-c9f22ae35a6f · outbound

This paper cites Extending whisper with prompt tuning to target-speaker asr,.

Diarization-Aware Multi-Speaker Automatic Speech Recognition via Large Language Models Extending whisper with prompt tuning to target-speaker asr,

Reference 22

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:18:56.210009Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:18:49.568686Z digest=sha256:c2e9ff08b33bfeece5f229cca36db7b86a83e4d6bd3abd4e2c85724e93871c4c

Observation 37920476-61a9-4a53-8e8a-34c95af5e9fe · outbound

This paper cites Adapting self- supervised models to multi-talker speech recognition using speaker embeddings,.

Diarization-Aware Multi-Speaker Automatic Speech Recognition via Large Language Models Adapting self- supervised models to multi-talker speech recognition using speaker embeddings,

Reference 23

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:18:55.796727Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:18:49.734536Z digest=sha256:52dc371570fd76ea853d6edd6be27a58024f8c1df7b67606c824e13ced84b3f3

Observation ae636b1d-81ce-4ba8-9748-e27cddc8117c · outbound

This paper cites Empowering whisper as a joint multi-talker and target-talker speech recognition system,.

Diarization-Aware Multi-Speaker Automatic Speech Recognition via Large Language Models Empowering whisper as a joint multi-talker and target-talker speech recognition system,

Reference 24

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:18:55.423927Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:18:49.846478Z digest=sha256:4aa9c0a5f22075f41010db7fb5dff34d6a253863769551ed96e04c0582dbdffa

Observation ffeb8292-4373-48ef-8acd-da3da4e2bbbf · outbound

This paper cites LLaMA: Open and Efficient Foundation Language Models.

Diarization-Aware Multi-Speaker Automatic Speech Recognition via Large Language Models LLaMA: Open and Efficient Foundation Language Models

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-07T10:18:49.976744Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:18:49.976744Z digest=sha256:00dacdf5e420b8aa70206681a021c6122383106db27a3869c1f8802e3688ca93

Observation b2b1d17f-ddac-4d28-bf84-58aabff639e3 · outbound

This paper cites DeepSeek-V3 Technical Report.

Diarization-Aware Multi-Speaker Automatic Speech Recognition via Large Language Models DeepSeek-V3 Technical Report

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-07T10:18:50.077448Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:18:50.077448Z digest=sha256:81a118d500b1204bb05033908037cbaa5af991ff09fa7abb7642d35ab434f7f8

Observation 000cff5f-cd19-42f7-8d6d-f3c63d10dc20 · outbound

This paper cites Qwen3 Technical Report.

Diarization-Aware Multi-Speaker Automatic Speech Recognition via Large Language Models Qwen3 Technical Report

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-07T10:18:50.210221Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:18:50.210221Z digest=sha256:fc18df7d9840f0b26809584c0fe80b5b1cbb8f9072d2cae040cf6fef8964ed0c

Observation 2180efab-0a2e-4738-bbb0-371c3ac4193a · outbound

This paper cites M2met: The icassp 2022 multi-channel multi- party meeting transcription challenge,.

Diarization-Aware Multi-Speaker Automatic Speech Recognition via Large Language Models M2met: The icassp 2022 multi-channel multi- party meeting transcription challenge,

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:18:55.088131Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:18:50.365313Z digest=sha256:50448ce3f63345c5e31a814b57948cc421db8bb51f3f6c984db2826299c1a099

Observation 66011fc7-a22c-4882-8c55-ed4d9be4af44 · outbound

This paper cites Meeteval: A toolkit for computation of word error rates for meeting transcription systems,.

Diarization-Aware Multi-Speaker Automatic Speech Recognition via Large Language Models Meeteval: A toolkit for computation of word error rates for meeting transcription systems,

Reference 29

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:18:54.622571Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:18:50.502377Z digest=sha256:4ae7f6bd125f3a358e346b67cbf55b91d748ef4ffd828fffcb607c090432daa3

Observation 801486c9-2bc7-4312-845a-bd11e17f897f · outbound

This paper cites Common Voice: A Massively-Multilingual Speech Corpus.

Diarization-Aware Multi-Speaker Automatic Speech Recognition via Large Language Models Common Voice: A Massively-Multilingual Speech Corpus

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-07T10:18:50.628216Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:18:50.628216Z digest=sha256:d3006e4b081a6258bc5d27753069410a5e1bac8247212bfe30ce88f3fb555566

Observation 0a90cc38-0f02-40b5-a2ad-e24e58716043 · outbound

This paper cites V oxblink: A large scale speaker verification dataset on camera,.

Diarization-Aware Multi-Speaker Automatic Speech Recognition via Large Language Models V oxblink: A large scale speaker verification dataset on camera,

Reference 31

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:18:54.262814Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:18:50.823454Z digest=sha256:4132c34037581be54f2b1ca9ca9887d7f0438961730b234ab1ea9d8065a32437

Observation 4f78afb0-9a03-4102-90f9-cb1a70816c95 · outbound

This paper cites V oxblink2: A 100k+ speaker recognition corpus and the open-set speaker-identification benchmark,.

Diarization-Aware Multi-Speaker Automatic Speech Recognition via Large Language Models V oxblink2: A 100k+ speaker recognition corpus and the open-set speaker-identification benchmark,

Reference 32

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:18:54.023729Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:18:50.988675Z digest=sha256:71d63ac18433972dd27abbf029599988773235d1db290bacb5f1167ff1790178

Observation 39b93780-8255-491f-887c-3ac98585d8e6 · outbound

This paper cites Robust speech recognition via large-scale weak super- vision,.

Diarization-Aware Multi-Speaker Automatic Speech Recognition via Large Language Models Robust speech recognition via large-scale weak super- vision,

Reference 33

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:18:53.743113Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:18:51.147336Z digest=sha256:8336d680700c3926fae48cbdca705ef4e3d3c782d03b9a4a2d0086c11eb78d7b

Observation 3d33cebb-b5fd-47d7-b599-9828410d05be · outbound

This paper cites Sequence-to-Sequence Neural Diarization with Automatic Speaker Detection and Representation.

Diarization-Aware Multi-Speaker Automatic Speech Recognition via Large Language Models Sequence-to-Sequence Neural Diarization with Automatic Speaker Detection and Representation

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-07T10:18:51.269948Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:18:51.269948Z digest=sha256:5834cafdffb2922e0475f9195ca78838ca42b697ee910ba663b7346f9bcba98c

Observation fab60a21-d8ef-452b-b852-a9fe986cd6d9 · outbound

This paper cites Target-speaker voice activity detection via sequence-to-sequence prediction,.

Diarization-Aware Multi-Speaker Automatic Speech Recognition via Large Language Models Target-speaker voice activity detection via sequence-to-sequence prediction,

Reference 35

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:18:53.357300Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:18:51.461795Z digest=sha256:e2de725bbd9153e54316aa307a7828230970729df9c7419fa421cdd9660ff6e8

Observation 5c368eea-06b5-4ebd-aadf-26aaea5af809 · outbound

This paper cites Qwen2.5: A party of foundation models,.

Diarization-Aware Multi-Speaker Automatic Speech Recognition via Large Language Models Qwen2.5: A party of foundation models,

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-07T10:18:51.655153Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:18:51.655153Z digest=sha256:76b713108b96a7eec412cc6e0245f7eb2b1e4cd8025756e0630a33eeb734d6cb

Observation 0db2632f-140a-4448-afce-d095e8da946f · outbound

This paper cites Deep residual learning for image recognition,.

Diarization-Aware Multi-Speaker Automatic Speech Recognition via Large Language Models Deep residual learning for image recognition,

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-07T10:18:51.770378Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:18:51.770378Z digest=sha256:4d5688f9e72c3ef85438ed9f9cdf52759a01b59aac89419220a690cf37b73e9d

Observation 314f9479-bc79-4f09-bcb5-5fa240649b68 · outbound

This paper cites OSUM: Advancing Open Speech Understanding Models with Limited Resources in Academia.

Diarization-Aware Multi-Speaker Automatic Speech Recognition via Large Language Models OSUM: Advancing Open Speech Understanding Models with Limited Resources in Academia

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-07T10:18:51.939607Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:18:51.939607Z digest=sha256:992daf777e49c8c7337a4824601f6b0f5874fe0b58b9273d5d9d0981877b009a

Observation 1fa9ea15-77d6-4f3a-b8c1-78ddd7c64b54 · outbound

This paper cites A comparative study on speaker-attributed automatic speech recognition in multi-party meet- ings,.

Diarization-Aware Multi-Speaker Automatic Speech Recognition via Large Language Models A comparative study on speaker-attributed automatic speech recognition in multi-party meet- ings,

Reference 39

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:18:53.069598Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:18:52.106493Z digest=sha256:0d2c3c027d9a4cbf0ef3f019af4a66a8d302ef7903f765ce77d3a01d7617cb75

Observation 5bc6a903-a3ec-4597-a90a-9d67dfb09248 · outbound

This paper cites Casa-asr: Context-aware speaker-attributed asr,.

Diarization-Aware Multi-Speaker Automatic Speech Recognition via Large Language Models Casa-asr: Context-aware speaker-attributed asr,

Reference 40

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:18:57.286697Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:18:52.254423Z digest=sha256:ca132600ba9eee7c1c9f1c180a9e7f575fccd6b5b0dbe683d89b3cd65b41d6e8

Observation e16a9a69-f74d-4592-a6eb-d97a60d0239d · outbound

This paper cites Sa-paraformer: Non-autoregressive end-to-end speaker-attributed asr,.

Diarization-Aware Multi-Speaker Automatic Speech Recognition via Large Language Models Sa-paraformer: Non-autoregressive end-to-end speaker-attributed asr,

Reference 41

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:18:52.750199Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:18:52.399445Z digest=sha256:e13ac3ea4ddc2391a6e7c6d8c3ff5fcb23a6573a58d0e84cf556b0c2a1eda058

Pith citing papers

Observation 3f3f5baf-da44-4948-8150-38964a23088a · inbound

The DKU System for Multi-Speaker Automatic Speech Recognition in MLC-SLM Challenge cites this paper.

The DKU System for Multi-Speaker Automatic Speech Recognition in MLC-SLM Challenge Diarization-Aware Multi-Speaker Automatic Speech Recognition via Large Language Models

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-06T17:58:01.482455Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T17:58:01.482455Z digest=sha256:89fead4377bb752cc45351d04234670cff1864d554a91faf73aee0943734a4d1

Observation 4674cee3-c33d-4994-8c22-d0b1951e15b1 · inbound

TagSpeech: End-to-End Multi-Speaker ASR and Diarization with Fine-Grained Temporal Grounding cites this paper.

TagSpeech: End-to-End Multi-Speaker ASR and Diarization with Fine-Grained Temporal Grounding Diarization-Aware Multi-Speaker Automatic Speech Recognition via Large Language Models

Reference 2021

Resolution
unresolved
no resolver link, observed 2026-08-03T11:20:26.130555Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T11:20:26.130555Z digest=sha256:1c0a62b4d71d7c197afec9a8dba2da5569343be7798f810e4c36749486b5554a

Observation 7979bb9f-f26c-4b78-8e4e-1a2604944a82 · inbound

DM-ASR: Diarization-aware Multi-speaker ASR with Large Language Models cites this paper.

DM-ASR: Diarization-aware Multi-speaker ASR with Large Language Models Diarization-Aware Multi-Speaker Automatic Speech Recognition via Large Language Models

Reference 33

Resolution
verified exact
arxiv_id, observed 2026-05-11T20:21:12.609984Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-05-08T09:18:53.285951Z digest=sha256:f69cb84d388db91012e72cfe22ab0afc8dec59e0f8392d429672ac4f668a457f

Observation 491b754c-fb6f-4348-9336-9153c19c506a · inbound

Speech Encoder Fusion for LLM-based Automatic Speech Recognition cites this paper.

Speech Encoder Fusion for LLM-based Automatic Speech Recognition Diarization-Aware Multi-Speaker Automatic Speech Recognition via Large Language Models

Reference 31

Resolution
verified exact
arxiv_id, observed 2026-07-03T07:57:44.683338Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-06-27T11:32:58.335783Z digest=sha256:e761118cff1b93b2e35166e530e64f0bdf0c4ec8a21e3b5e7c9108e763bedc56