{"as_of":"2026-08-09T04:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7d722a49e09215fa0cdd046feebdb43cd4f0b069f79863add69dba5b8658e115","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:21:55.953111Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:21:51.628157Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T13:21:57.046523Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"cited_work":{"arxiv_id":"2505.22005","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.22005","snapshot_observed_at":"2026-08-07T13:21:57.046523Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","venue":"cs.SD","work_id":"db5f0165-8812-4a66-866a-e041cb628fbe","year":2025},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:51.628157Z"},"links":{"cited_paper":"/paper/2505.22005","citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:ba2e71f2ed2a1a5741630bfef25327cbb3c1cbe34d8ed180b6e4104f07a63b3b","observation_id":"9fe746d9-93ce-4cf3-b975-99589304441e","resolution":{"observed_at":"2026-08-07T13:21:57.116469Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.22005/citation-record","integrity":"/paper/2505.22005/integrity","json":"/paper/2505.22005/citation-record.json","paper":"/paper/2505.22005"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"cited_work":{"arxiv_id":"2505.22005","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.22005","snapshot_observed_at":"2026-08-07T13:21:57.046523Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","venue":"cs.SD","work_id":"db5f0165-8812-4a66-866a-e041cb628fbe","year":2025},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:51.628157Z"},"links":{"cited_paper":"/paper/2505.22005","citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:ba2e71f2ed2a1a5741630bfef25327cbb3c1cbe34d8ed180b6e4104f07a63b3b","observation_id":"9fe746d9-93ce-4cf3-b975-99589304441e","resolution":{"observed_at":"2026-08-07T13:21:57.116469Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:00.233772Z","title":"Framework Overview As shown in Figure 1 (a), the proposed LLM-driven ASR- SED multi-task learning framework comprised two parallel branches: the ASR branch and the SED branch","venue":null,"work_id":"6b404f48-9177-483a-ba20-b6cf4a70d91d","year":null},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:51.771744Z"},"links":{"citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:3b086e4799fcb21a5b67d8563d0c9f64f9f6f80efa3f784f3eed4929e6d59abb","observation_id":"f8b4865f-98f5-4824-bce9-aefe3f698475","resolution":{"observed_at":"2026-08-07T13:22:00.340060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:00.018450Z","title":"<|im_start|>user<S><D><C ><P><|im_end|><|im_start|>assistant< T><|im_end|>|","venue":null,"work_id":"05893bf5-5db1-4d55-b6cc-8aa91cd3a866","year":null},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:51.872461Z"},"links":{"citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:9d257856ffc9d78edb9a93ebeae29f8e320ea748e83a32ca88a15bb5dc256b22","observation_id":"7283768c-b3c5-4731-aba4-67e6cec66d4a","resolution":{"observed_at":"2026-08-07T13:22:00.144386Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:21:59.859066Z","title":null,"venue":null,"work_id":"7db63330-0f87-4374-a61d-a4a7b3304f7f","year":null},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:52.015369Z"},"links":{"citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:f74c3b3b354e22ab698d580dad888ad66f655f05e7420bd4f9eb92bff187a926","observation_id":"ab2ee8f0-80c9-4213-bae4-f8be2ad39216","resolution":{"observed_at":"2026-08-07T13:21:59.932773Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:21:59.676546Z","title":null,"venue":null,"work_id":"0f5b7724-51a4-49e4-b99b-acfdd3265725","year":null},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:52.157747Z"},"links":{"citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:9f3c7fa28aca1788b22d69553274457b7ad382f556a4d1bc3f8bed56df0597a9","observation_id":"1ad68827-f6e7-4481-be73-2d0cea040adc","resolution":{"observed_at":"2026-08-07T13:21:59.776733Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:21:59.483796Z","title":"“the world is designed for fluent people","venue":null,"work_id":"99ef7343-591a-4612-89c8-90d2b9839739","year":2023},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:52.298893Z"},"links":{"citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:98826f13507e5909b7e955f20027ecd7d63024a7dd53d7177a278ce44016ba03","observation_id":"e46e9522-0176-4f7a-9245-5d58e254f889","resolution":{"observed_at":"2026-08-07T13:21:59.575083Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:21:59.278850Z","title":"Microaggression and the adult stuttering experience,","venue":null,"work_id":"4795daf5-93f7-440c-9deb-b406466f35be","year":2022},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:52.407492Z"},"links":{"citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:a1061b1dd4904ad0131229869573cf3cbd38ce92f10bf1ede77414606d601051","observation_id":"cd6985fd-335b-4633-8890-34a6f485847d","resolution":{"observed_at":"2026-08-07T13:21:59.364553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:21:59.078199Z","title":"Enhanced asr for stuttering speech: Combining adversarial and signal-based data augmentation,","venue":null,"work_id":"7b06a642-3ef1-46df-96fc-6f7d654a6baa","year":2024},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:52.509373Z"},"links":{"citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:9a12cb56051bd772e9044506c9448adb383313a37b051ec37f2ce0292a490264","observation_id":"0c7645df-e6f1-4765-b6f2-a4b33f9d47fb","resolution":{"observed_at":"2026-08-07T13:21:59.199713Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:21:58.846477Z","title":"The fos- afer system for the chime-8 mmcsg challenge,","venue":null,"work_id":"32dcbb55-f24b-4b80-883d-85c15e184af6","year":2024},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:52.667668Z"},"links":{"citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:ee0364adbfe2bd71655fa6d702af38ed50ba08400c6ffc413bcfb8b517f00b65","observation_id":"2566b13d-7681-41f3-a450-89af52746feb","resolution":{"observed_at":"2026-08-07T13:21:58.967000Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07256","last_updated":"2024-06-11T13:35:50Z","snapshot_observed_at":"2026-08-07T05:21:54.175230Z","submitted_at":"2024-06-11T13:35:50Z","title":"AS-70: A Mandarin stuttered speech dataset for automatic speech recognition and stuttering event detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07256","snapshot_observed_at":"2026-08-07T13:21:52.781241Z","title":"As-70: A mandarin stuttered speech dataset for automatic speech recognition and stuttering event detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:52.781241Z"},"links":{"cited_paper":"/paper/2406.07256","citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:2df482b9841c82dd9f3e1fec8ed894fa77da1941569289ae5556445b420ab633","observation_id":"937da8a8-bc10-487d-9776-2642dd5dcd3e","resolution":{"observed_at":"2026-08-07T13:21:52.781241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:21:58.670212Z","title":"Findings of the 2024 mandarin stuttering event detection and automatic speech recognition chal- lenge,","venue":null,"work_id":"afa03471-7ed5-434d-ba24-79d712f5a926","year":2024},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:52.901510Z"},"links":{"citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:8090d715acbce0ca94eb4fa318024feb1a3898f19c78dc2f6ca3395690dc000f","observation_id":"26ee585e-9103-4093-97ea-26f6aa3f9deb","resolution":{"observed_at":"2026-08-07T13:21:58.735853Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1604.03209","last_updated":"2016-04-12T02:34:00Z","snapshot_observed_at":"2026-08-02T09:58:25.765651Z","submitted_at":"2016-04-12T02:34:00Z","title":"Disfluency Detection using a Bidirectional LSTM","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1604.03209","snapshot_observed_at":"2026-08-07T13:21:53.124971Z","title":"Disfluency detec- tion using a bidirectional lstm,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:53.124971Z"},"links":{"cited_paper":"/paper/1604.03209","citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:9af6f72673cbf10a673bd877fd9ca9a81c7e1cfd29f0af403a6ebb9c5c4f3d92","observation_id":"d4295314-a2fb-476d-9c21-ca5c6c3eac94","resolution":{"observed_at":"2026-08-07T13:21:53.124971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.05396","last_updated":"2022-02-08T19:55:23Z","snapshot_observed_at":"2026-07-06T12:36:41.820948Z","submitted_at":"2022-02-08T19:55:23Z","title":"Enhancing ASR for Stuttered Speech with Limited Data Using Detect and Pass","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.05396","snapshot_observed_at":"2026-08-07T13:21:53.285721Z","title":"Enhancing asr for stuttered speech with limited data using detect and pass,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:53.285721Z"},"links":{"cited_paper":"/paper/2202.05396","citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:e22a79914855851a5debaede7bb547f095ca01c8f5b168b1cfb2a3dd383d1733","observation_id":"17ddf87c-da67-4fcf-a5ee-b3d32ecd1c40","resolution":{"observed_at":"2026-08-07T13:21:53.285721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:21:53.391511Z","title":"From user percep- tions to technical improvement: Enabling people who stutter to better use speech recognition,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:53.391511Z"},"links":{"citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:6f3100614d4218b20a0f40d00892b7fd9efb08f378b07c8266181414ca33def4","observation_id":"1162c1fb-cce4-4a37-9bfd-a91cad9ef6e4","resolution":{"observed_at":"2026-08-07T13:21:53.391511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.11759","last_updated":"2021-06-18T20:58:34Z","snapshot_observed_at":"2026-07-06T11:21:44.767735Z","submitted_at":"2021-06-18T20:58:34Z","title":"Analysis and Tuning of a Voice Assistant System for Dysfluent Speech","version":1},"cited_work":{"arxiv_id":"2106.11759","doi":null,"metadata_source":"pith","pith_arxiv_id":"2106.11759","snapshot_observed_at":"2026-08-07T13:21:56.874046Z","title":"Analysis and Tuning of a Voice Assistant System for Dysfluent Speech","venue":"eess.AS","work_id":"a46ab85a-6b52-4a63-9260-799e83a48c99","year":2021},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:53.527444Z"},"links":{"cited_paper":"/paper/2106.11759","citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:c9268cbd93f73f16bbda044b2ef850fcd991d90882d354a512b5108f05045498","observation_id":"b89b2d1f-52c0-4493-b28b-52bb54a09f75","resolution":{"observed_at":"2026-08-07T13:21:56.935159Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09731","last_updated":"2022-11-04T23:45:31Z","snapshot_observed_at":"2026-08-06T16:26:00.584647Z","submitted_at":"2022-11-04T23:45:31Z","title":"Stutter-TTS: Controlled Synthesis and Improved Recognition of Stuttered Speech","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09731","snapshot_observed_at":"2026-08-07T13:21:53.625995Z","title":"Stutter-tts: Con- trolled synthesis and improved recognition of stuttered speech,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:53.625995Z"},"links":{"cited_paper":"/paper/2211.09731","citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:917c805f72a59050665b7d2bf73e633c657ddf24da743b3a23e36ce6a75e2f21","observation_id":"4bade08d-f3be-4584-9c9e-837ee4c91450","resolution":{"observed_at":"2026-08-07T13:21:53.625995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:21:58.504921Z","title":"Stutter- net: Stuttering detection using time delay neural network,","venue":null,"work_id":"39be1d73-d0d7-4896-9bfb-860142410981","year":2021},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:53.766639Z"},"links":{"citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:6cde354d884acd9b0f55c83b4024296e72390a3a94de262b6b136da38449c7ec","observation_id":"68ce1fc8-a4a6-4642-8539-73a548394b3d","resolution":{"observed_at":"2026-08-07T13:21:58.600453Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:21:58.258211Z","title":"Stuttering detec- tion using atrous convolutional neural networks,","venue":null,"work_id":"60e26330-faf5-4c60-b840-e0f8305f37a7","year":2022},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:53.964388Z"},"links":{"citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:62205bba1c3056bba73aeb4ef99b15338f1824f858159f9eb0e54ce3c40047cc","observation_id":"cd03bd9d-42d5-4a92-ad09-4c3b6c416598","resolution":{"observed_at":"2026-08-07T13:21:58.368116Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.11394","last_updated":"2020-09-23T21:51:29Z","snapshot_observed_at":"2026-07-06T09:58:15.721426Z","submitted_at":"2020-09-23T21:51:29Z","title":"FluentNet: End-to-End Detection of Speech Disfluency with Deep Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.11394","snapshot_observed_at":"2026-08-07T13:21:54.091638Z","title":"Fluentnet: end- to-end detection of speech disfluency with deep learning,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:54.091638Z"},"links":{"cited_paper":"/paper/2009.11394","citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:f837a112c3df26bf340ed72b5bd1010dad722e4f3ed135dffd6a782deab53010","observation_id":"4bdc8cea-344b-4190-af65-0e1f01f84ba5","resolution":{"observed_at":"2026-08-07T13:21:54.091638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09479","last_updated":"2024-11-14T14:35:40Z","snapshot_observed_at":"2026-08-07T03:58:50.832697Z","submitted_at":"2024-11-14T14:35:40Z","title":"An End-To-End Stuttering Detection Method Based On Conformer And BILSTM","version":1},"cited_work":{"arxiv_id":"2411.09479","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.09479","snapshot_observed_at":"2026-08-07T13:21:56.719978Z","title":"An End-To-End Stuttering Detection Method Based On Conformer And BILSTM","venue":"eess.AS","work_id":"9c76531d-f326-4949-b38e-3020c930f369","year":2024},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:54.233333Z"},"links":{"cited_paper":"/paper/2411.09479","citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:71266edb855d4163365c70defa7708eb2318da9af573b2169359dfb79c8bd646","observation_id":"5b76ea21-dd3f-49a9-8b87-edbca8a24e0b","resolution":{"observed_at":"2026-08-07T13:21:56.775542Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:21:54.408021Z","title":"Momentum con- trast for unsupervised visual representation learning,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:54.408021Z"},"links":{"citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:11282b52dfccd7fc7996eb75da1f639270a382f2af2b4cf5b72a524a0ec8a747","observation_id":"f42f06a5-3f69-4ac6-9b00-8aa6ec256350","resolution":{"observed_at":"2026-08-07T13:21:54.408021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:21:57.961927Z","title":"Cola: Weakly- supervised temporal action localization with snippet contrastive learning,","venue":null,"work_id":"7e2abd58-7e4c-4cf0-ae77-291c1bee7758","year":2021},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:54.508611Z"},"links":{"citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:6a973d57d8ba4c1e34d5db1629cb721de8adcc14b81c42d1d8112d1245a79ef8","observation_id":"6f379ebe-217b-47ea-8c01-2323cc01e8cf","resolution":{"observed_at":"2026-08-07T13:21:58.120139Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.03152","last_updated":"2024-05-06T04:05:19Z","snapshot_observed_at":"2026-08-01T12:07:56.351929Z","submitted_at":"2024-05-06T04:05:19Z","title":"MMGER: Multi-modal and Multi-granularity Generative Error Correction with LLM for Joint Accent and Speech Recognition","version":1},"cited_work":{"arxiv_id":"2405.03152","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.03152","snapshot_observed_at":"2026-08-07T13:21:56.578317Z","title":"MMGER: Multi-modal and Multi-granularity Generative Error Correction with LLM for Joint Accent and Speech Recognition","venue":"eess.AS","work_id":"ffe5880f-a158-401b-8875-361b090994cd","year":2024},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:54.670984Z"},"links":{"cited_paper":"/paper/2405.03152","citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:ac557352fc2ee0b0dedef8b9f396f2f417049a06b788c168c658440b45ffc51d","observation_id":"d65b85c7-26d4-4e4a-bc6e-80396ec46e77","resolution":{"observed_at":"2026-08-07T13:21:56.622044Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:21:57.730220Z","title":"Speech recognition meets large language model: Benchmarking, models, and exploration,","venue":null,"work_id":"91dab00d-d977-437c-993a-9686b8b92bf3","year":2025},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:54.769858Z"},"links":{"citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:51c9bea96cccd8c8c8746987ca513e93d1f538558ec6d3a8fb90f848409e245a","observation_id":"8660c956-47f3-45c2-9194-a573bca74fe5","resolution":{"observed_at":"2026-08-07T13:21:57.884832Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.09491","last_updated":"2024-08-18T14:10:35Z","snapshot_observed_at":"2026-08-05T20:02:44.497508Z","submitted_at":"2024-08-18T14:10:35Z","title":"A Transcription Prompt-based Efficient Audio Large Language Model for Robust Speech Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.09491","snapshot_observed_at":"2026-08-07T13:21:54.905684Z","title":"A transcrip- tion prompt-based efficient audio large language model for robust speech recognition,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:54.905684Z"},"links":{"cited_paper":"/paper/2408.09491","citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:aaed6ce228c86ff8f47a34732bcf310decce333d62111716b7d9c12e714c48da","observation_id":"07cf5247-7ee5-4ad4-aa3b-fdcba432b5e1","resolution":{"observed_at":"2026-08-07T13:21:54.905684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.04673","last_updated":"2024-07-03T02:38:03Z","snapshot_observed_at":"2026-08-02T08:46:39.076208Z","submitted_at":"2023-10-07T03:17:59Z","title":"LauraGPT: Listen, Attend, Understand, and Regenerate Audio with GPT","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.04673","snapshot_observed_at":"2026-08-07T13:21:55.024547Z","title":"Lauragpt: Listen, attend, understand, and re- generate audio with gpt,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:55.024547Z"},"links":{"cited_paper":"/paper/2310.04673","citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:739f1710fe74dcee47c94c5f991be71db1ada4b1916d5d6c6aeba0c2ed216071","observation_id":"5ffb8d62-ec18-4574-8387-0ea3b3aaf67b","resolution":{"observed_at":"2026-08-07T13:21:55.024547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.11000","last_updated":"2023-05-19T14:41:16Z","snapshot_observed_at":"2026-08-07T10:56:05.622094Z","submitted_at":"2023-05-18T14:23:25Z","title":"SpeechGPT: Empowering Large Language Models with Intrinsic Cross-Modal Conversational Abilities","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.11000","snapshot_observed_at":"2026-08-07T13:21:55.108083Z","title":"Speechgpt: Empowering large language models with intrinsic cross-modal conversational abilities,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:55.108083Z"},"links":{"cited_paper":"/paper/2305.11000","citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:80ab2d814788fff38a0af8392107f4bee5b82c3999c945217f90434f3b72557c","observation_id":"64d3a285-54b7-435d-a867-d5ce1688ceed","resolution":{"observed_at":"2026-08-07T13:21:55.108083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07919","last_updated":"2023-12-21T10:20:42Z","snapshot_observed_at":"2026-08-07T10:17:55.688598Z","submitted_at":"2023-11-14T05:34:50Z","title":"Qwen-Audio: Advancing Universal Audio Understanding via Unified Large-Scale Audio-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07919","snapshot_observed_at":"2026-08-07T13:21:55.142440Z","title":"Qwen-audio: Advancing universal audio understand- ing via unified large-scale audio-language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:55.142440Z"},"links":{"cited_paper":"/paper/2311.07919","citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:b292dfab17ba2a3834a1590ec64c6d344e2e3346504ce7d7df204889df95e1ad","observation_id":"dce6e421-5b96-4fca-8bd1-220eb73cb159","resolution":{"observed_at":"2026-08-07T13:21:55.142440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.13289","last_updated":"2024-04-08T06:12:52Z","snapshot_observed_at":"2026-08-02T21:51:36.809095Z","submitted_at":"2023-10-20T05:41:57Z","title":"SALMONN: Towards Generic Hearing Abilities for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.13289","snapshot_observed_at":"2026-08-07T13:21:55.228659Z","title":"Salmonn: Towards generic hearing abilities for large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:55.228659Z"},"links":{"cited_paper":"/paper/2310.13289","citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:45821619620d40583995072f8a53235e4efd28ef270089a1f51c577ed2144e77","observation_id":"bf6972d5-35c7-4815-98af-6ff6f7bea28f","resolution":{"observed_at":"2026-08-07T13:21:55.228659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10446","last_updated":"2024-01-19T01:29:27Z","snapshot_observed_at":"2026-07-06T17:17:39.686362Z","submitted_at":"2024-01-19T01:29:27Z","title":"Large Language Models are Efficient Learners of Noise-Robust Speech Recognition","version":1},"cited_work":{"arxiv_id":"2401.10446","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.10446","snapshot_observed_at":"2026-08-07T13:21:56.367062Z","title":"Large Language Models are Efficient Learners of Noise-Robust Speech Recognition","venue":"cs.CL","work_id":"ee77e287-b65e-4a65-8ac1-9cfe2cfca479","year":2024},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:55.297768Z"},"links":{"cited_paper":"/paper/2401.10446","citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:25a5e7c1921158e97a1b1b028d95904a7a1a930d5f766f71f2c640bfc654b0fb","observation_id":"a57deff4-d3cb-43a9-84bc-d3e5a4572d49","resolution":{"observed_at":"2026-08-07T13:21:56.442307Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:21:55.410096Z","title":"Con- nectionist temporal classification: labelling unsegmented se- quence data with recurrent neural networks,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:55.410096Z"},"links":{"citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:b076e8c1fe8a3467e1f7456b5613cb7ce32573a4e31ff558bd82cfa0c1f5330d","observation_id":"df3cda09-c93d-4542-b72f-358a475d131f","resolution":{"observed_at":"2026-08-07T13:21:55.410096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:21:57.519249Z","title":"Focal loss for dense object detection,","venue":null,"work_id":"be1bd5dc-9c6f-4fa1-80fa-3e99a28a8fa6","year":2017},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:55.512503Z"},"links":{"citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:f94624e3a303d9c434f8dcc5a300db66744bff28a74fd5a7ad647680e98d839d","observation_id":"18d76233-6b98-4f60-9ddc-9d63fcecd696","resolution":{"observed_at":"2026-08-07T13:21:57.610902Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-07T07:43:16.294957Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-07T13:21:55.624992Z","title":"Lora: Low-rank adaptation of large lan- guage models,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:55.624992Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:382e638b04887d24acb924cb541697bfcfa9600aa5dd84ac82c6a37c87b8fe41","observation_id":"c35e9cc8-1456-46a2-ba53-d2ad84fada4e","resolution":{"observed_at":"2026-08-07T13:21:55.624992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04051","last_updated":"2024-07-11T02:08:35Z","snapshot_observed_at":"2026-08-06T00:42:36.144034Z","submitted_at":"2024-07-04T16:49:02Z","title":"FunAudioLLM: Voice Understanding and Generation Foundation Models for Natural Interaction Between Humans and LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.04051","snapshot_observed_at":"2026-08-07T13:21:55.701464Z","title":"Funaudiollm: V oice understanding and gen- eration foundation models for natural interaction between humans and llms,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:55.701464Z"},"links":{"cited_paper":"/paper/2407.04051","citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:e8e9796641d4ef81073b612187473d8191d856931ce16871f4e7bab379fe9dd0","observation_id":"34ac81e1-f341-4ee5-9e05-db94371956fc","resolution":{"observed_at":"2026-08-07T13:21:55.701464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:21:57.365729Z","title":"Advanc- ing stuttering detection via data augmentation, class-balanced loss and multi-contextual deep learning,","venue":null,"work_id":"03dfa1ee-5f60-41e2-9506-35fdae5b4290","year":2023},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:55.742878Z"},"links":{"citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:088ddeecb75e3abf552f26c090044e6ef4039dc920935a7ffdeba7cd40f4b3bd","observation_id":"33cd1905-2201-4417-b11e-011407ae6963","resolution":{"observed_at":"2026-08-07T13:21:57.433262Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.08100","last_updated":"2020-05-16T20:56:25Z","snapshot_observed_at":"2026-08-08T15:18:32.322111Z","submitted_at":"2020-05-16T20:56:25Z","title":"Conformer: Convolution-augmented Transformer for Speech Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.08100","snapshot_observed_at":"2026-08-07T13:21:55.806950Z","title":"Conformer: Convolution- augmented transformer for speech recognition,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:55.806950Z"},"links":{"cited_paper":"/paper/2005.08100","citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:66844343a8a31f8ed325b0e245e301d4e9e77f40046f43406e931d9ecc3de47d","observation_id":"823371dd-2fe8-497f-bf8c-80c1fb16fbab","resolution":{"observed_at":"2026-08-07T13:21:55.806950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:21:57.209374Z","title":"Sep-28k: A dataset for stuttering event detection from podcasts with people who stutter,","venue":null,"work_id":"fb94ed80-a440-41d4-a66e-d2586ed5ab02","year":2021},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:55.864302Z"},"links":{"citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:de89ba1c4732d001dbfa0694040d08b7b396c6ad0a8dba068fdd698f601d1246","observation_id":"1d6768a8-2688-4c1f-a76c-3f61f9617ed7","resolution":{"observed_at":"2026-08-07T13:21:57.279130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2204.03417","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:21:56.153725Z","title":"Detect- ing dysfluencies in stuttering therapy using wav2vec 2.0,","venue":null,"work_id":"0889d60a-1afa-4e86-ab5e-d735c74d05fd","year":2022},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:55.953111Z"},"links":{"citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:204c9d6b8b9bb62dde60360a4fd693442f4ff221bf72565f756bb5053ea48072","observation_id":"c652d8c5-0f7e-43b7-9f6f-74e4e714713f","resolution":{"observed_at":"2026-08-07T13:21:56.258641Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":18,"verified_exact":5,"verified_fuzzy":13},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 1 inbound Pith citation observation for arXiv:2505.22005."}