{"as_of":"2026-08-21T06:31:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fd15cd7c3d62c9bf1bab1c39a5c8d05064f45ac87f2152c2510ff92bbb634c6e","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T10:16:04.899137Z","state":"measured"},{"denominator":42,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":42,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.04392/citation-record","integrity":"/paper/2509.04392/integrity","json":"/paper/2509.04392/citation-record.json","paper":"/paper/2509.04392"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:16:05.350752Z","title":"Automatic channel selection and spatial feature integration for multi-channel speech recog- nition across various array topologies,","venue":null,"work_id":"4e21fcc1-2864-41cc-bb7e-5a3479355fd9","year":2024},"citing_paper":{"arxiv_id":"2509.04392","last_updated":"2025-09-04T17:03:58Z","snapshot_observed_at":"2026-08-13T21:21:28.581566Z","submitted_at":"2025-09-04T17:03:58Z","title":"Denoising GER: A Noise-Robust Generative Error Correction with LLM for Speech Recognition","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T10:16:04.758545Z"},"links":{"citing_paper":"/paper/2509.04392"},"observation_digest":"sha256:cc35308e58b66be6d68d15f75000803bdd5ce57282a4fbabf1ec24b969f57a65","observation_id":"0309f99b-a889-4a31-b686-e47c116611c9","resolution":{"observed_at":"2026-08-05T10:16:05.354529Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:16:05.339041Z","title":"Deliberation model based two-pass end-to-end speech recognition,","venue":null,"work_id":"bc00b30f-2aa9-4db8-9580-2bff2c980196","year":2020},"citing_paper":{"arxiv_id":"2509.04392","last_updated":"2025-09-04T17:03:58Z","snapshot_observed_at":"2026-08-13T21:21:28.581566Z","submitted_at":"2025-09-04T17:03:58Z","title":"Denoising GER: A Noise-Robust Generative Error Correction with LLM for Speech Recognition","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T10:16:04.762276Z"},"links":{"citing_paper":"/paper/2509.04392"},"observation_digest":"sha256:dfc3df801221dbe1d2fd503b0459147008d95307af519c5e92a4893577410488","observation_id":"a2bd4b7a-dd85-49fc-a124-480539383b13","resolution":{"observed_at":"2026-08-05T10:16:05.343299Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:16:05.328277Z","title":"An analysis of incorporating an external language model into a sequence-to-sequence model,","venue":null,"work_id":"f262d361-f242-4db6-8ddc-1f7d33f0871b","year":2018},"citing_paper":{"arxiv_id":"2509.04392","last_updated":"2025-09-04T17:03:58Z","snapshot_observed_at":"2026-08-13T21:21:28.581566Z","submitted_at":"2025-09-04T17:03:58Z","title":"Denoising GER: A Noise-Robust Generative Error Correction with LLM for Speech Recognition","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T10:16:04.765733Z"},"links":{"citing_paper":"/paper/2509.04392"},"observation_digest":"sha256:99ad66cab8911a7c6df005fbc9720a405c3131c6c278af31400e7b335d8ab35b","observation_id":"e9f6646a-f612-45e7-9ab4-9e8cb3262710","resolution":{"observed_at":"2026-08-05T10:16:05.332351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:16:05.316737Z","title":"Component fusion: Learning replaceable language model component for end-to-end speech recognition system,","venue":null,"work_id":"d5f8ce2c-eab9-4370-8be5-ea5a9dd47b0f","year":2019},"citing_paper":{"arxiv_id":"2509.04392","last_updated":"2025-09-04T17:03:58Z","snapshot_observed_at":"2026-08-13T21:21:28.581566Z","submitted_at":"2025-09-04T17:03:58Z","title":"Denoising GER: A Noise-Robust Generative Error Correction with LLM for Speech Recognition","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T10:16:04.770069Z"},"links":{"citing_paper":"/paper/2509.04392"},"observation_digest":"sha256:753c37c530053fe7f8ddc5d261ee8486cc31a233f3c272ad4d23a177da838d99","observation_id":"ec706002-a978-4feb-a47e-7adcda5b034c","resolution":{"observed_at":"2026-08-05T10:16:05.321181Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:16:05.306352Z","title":"Fastcorrect: Fast error correction with edit alignment for automatic speech recognition,","venue":null,"work_id":"a80f235c-0385-4c75-b423-f1b809fa4a58","year":2021},"citing_paper":{"arxiv_id":"2509.04392","last_updated":"2025-09-04T17:03:58Z","snapshot_observed_at":"2026-08-13T21:21:28.581566Z","submitted_at":"2025-09-04T17:03:58Z","title":"Denoising GER: A Noise-Robust Generative Error Correction with LLM for Speech Recognition","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T10:16:04.773508Z"},"links":{"citing_paper":"/paper/2509.04392"},"observation_digest":"sha256:7f7baaea70d3e5c4232d1e33bb60202a8d6de7faf628bc5b4a167d0ccb3725a7","observation_id":"04772e2b-b4d5-498c-9982-a514fa7831fd","resolution":{"observed_at":"2026-08-05T10:16:05.310209Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:16:05.295512Z","title":"Fastcorrect: Fast error correction with edit alignment for automatic speech recognition,","venue":null,"work_id":"e9412e5b-8bb0-4918-ab61-71962e2c3cc3","year":2021},"citing_paper":{"arxiv_id":"2509.04392","last_updated":"2025-09-04T17:03:58Z","snapshot_observed_at":"2026-08-13T21:21:28.581566Z","submitted_at":"2025-09-04T17:03:58Z","title":"Denoising GER: A Noise-Robust Generative Error Correction with LLM for Speech Recognition","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T10:16:04.776926Z"},"links":{"citing_paper":"/paper/2509.04392"},"observation_digest":"sha256:825bbe23d4dc79b2d78c2ea83d323c54f020b004ccb3fb1ca24471f78156dcac","observation_id":"bc9cd86b-4f77-4eca-a34a-1b2f558f1451","resolution":{"observed_at":"2026-08-05T10:16:05.299551Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:16:05.284251Z","title":"Improving readability for automatic speech recognition tran- scription,","venue":null,"work_id":"8945cf43-d817-4e0e-ac9a-92ce7d69bd42","year":2023},"citing_paper":{"arxiv_id":"2509.04392","last_updated":"2025-09-04T17:03:58Z","snapshot_observed_at":"2026-08-13T21:21:28.581566Z","submitted_at":"2025-09-04T17:03:58Z","title":"Denoising GER: A Noise-Robust Generative Error Correction with LLM for Speech Recognition","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T10:16:04.780368Z"},"links":{"citing_paper":"/paper/2509.04392"},"observation_digest":"sha256:ee961d990a0f3a6d1fa597a5d033e4135c3485b7a1b19519c53b44485a9794fa","observation_id":"9f5354d9-3315-4a59-9f61-2464881b37a1","resolution":{"observed_at":"2026-08-05T10:16:05.288101Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:16:05.274130Z","title":"N-best t5: Robust asr error correction using multiple input hypotheses and constrained decoding space,","venue":null,"work_id":"3753e501-e413-4b9d-848e-3ee2fbe597bb","year":2023},"citing_paper":{"arxiv_id":"2509.04392","last_updated":"2025-09-04T17:03:58Z","snapshot_observed_at":"2026-08-13T21:21:28.581566Z","submitted_at":"2025-09-04T17:03:58Z","title":"Denoising GER: A Noise-Robust Generative Error Correction with LLM for Speech Recognition","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T10:16:04.783818Z"},"links":{"citing_paper":"/paper/2509.04392"},"observation_digest":"sha256:fb2d58e743ecc3f83b7874be7dbe894bf5230a16ef8cd57d2e25bae153b6cdf5","observation_id":"c6834d8d-4715-4040-a009-e627e31e2e2c","resolution":{"observed_at":"2026-08-05T10:16:05.277826Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:16:05.264080Z","title":"Towards interfacing large language models with asr systems using confidence measures and prompting,","venue":null,"work_id":"555bc5d0-e830-484a-b6b5-db1283678c62","year":2024},"citing_paper":{"arxiv_id":"2509.04392","last_updated":"2025-09-04T17:03:58Z","snapshot_observed_at":"2026-08-13T21:21:28.581566Z","submitted_at":"2025-09-04T17:03:58Z","title":"Denoising GER: A Noise-Robust Generative Error Correction with LLM for Speech Recognition","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T10:16:04.787078Z"},"links":{"citing_paper":"/paper/2509.04392"},"observation_digest":"sha256:b02cd6728e6ff65d5727787ee999266732271b7808cf0b88c326d7636da8d844","observation_id":"7214771b-f77a-49a8-92e0-fbef963d77d0","resolution":{"observed_at":"2026-08-05T10:16:05.267846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:16:05.254203Z","title":"Hyporadise: An open baseline for generative speech recognition with large language models,","venue":null,"work_id":"c0a626d8-7d43-4b49-9eb3-05606a06cbde","year":2023},"citing_paper":{"arxiv_id":"2509.04392","last_updated":"2025-09-04T17:03:58Z","snapshot_observed_at":"2026-08-13T21:21:28.581566Z","submitted_at":"2025-09-04T17:03:58Z","title":"Denoising GER: A Noise-Robust Generative Error Correction with LLM for Speech Recognition","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T10:16:04.790602Z"},"links":{"citing_paper":"/paper/2509.04392"},"observation_digest":"sha256:c804a79c6bcadd96db003dbbc43ac9e2af4648bf61a0d4009f5055d753b36ca8","observation_id":"f98c4fd8-8af0-4a10-8d27-75b13f2417a8","resolution":{"observed_at":"2026-08-05T10:16:05.257731Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:16:05.243479Z","title":"Noise-robust speech recognition with 10 minutes unparalleled in-domain data,","venue":null,"work_id":"3c28fc20-e62b-4534-b6c5-e8247425baad","year":2022},"citing_paper":{"arxiv_id":"2509.04392","last_updated":"2025-09-04T17:03:58Z","snapshot_observed_at":"2026-08-13T21:21:28.581566Z","submitted_at":"2025-09-04T17:03:58Z","title":"Denoising GER: A Noise-Robust Generative Error Correction with LLM for Speech Recognition","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T10:16:04.793718Z"},"links":{"citing_paper":"/paper/2509.04392"},"observation_digest":"sha256:4ef311518856805f55e63d5003c28af7400e03f8a1f34141110f57384c426635","observation_id":"f730f8bd-92e0-4c88-87e6-a26e89ba61cb","resolution":{"observed_at":"2026-08-05T10:16:05.247060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:16:05.231545Z","title":"It’s never too late: Fusing acoustic information into large language models for automatic speech recognition,","venue":null,"work_id":"70447f7d-ca0f-488c-89c1-e45b8a2b77ad","year":2024},"citing_paper":{"arxiv_id":"2509.04392","last_updated":"2025-09-04T17:03:58Z","snapshot_observed_at":"2026-08-13T21:21:28.581566Z","submitted_at":"2025-09-04T17:03:58Z","title":"Denoising GER: A Noise-Robust Generative Error Correction with LLM for Speech Recognition","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T10:16:04.797191Z"},"links":{"citing_paper":"/paper/2509.04392"},"observation_digest":"sha256:4b522649d95119261bb5999972e48d447ad037aa6029f4594849f2077abfc9fd","observation_id":"c7b9d0cc-8ff4-49ae-aab5-16c9101fd2e5","resolution":{"observed_at":"2026-08-05T10:16:05.236031Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:16:05.220675Z","title":"Whispering llama: A cross-modal generative error correction framework for speech recognition,","venue":null,"work_id":"dfa9c284-56df-4f1b-92a6-5dd0c4d2d847","year":2023},"citing_paper":{"arxiv_id":"2509.04392","last_updated":"2025-09-04T17:03:58Z","snapshot_observed_at":"2026-08-13T21:21:28.581566Z","submitted_at":"2025-09-04T17:03:58Z","title":"Denoising GER: A Noise-Robust Generative Error Correction with LLM for Speech Recognition","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T10:16:04.800451Z"},"links":{"citing_paper":"/paper/2509.04392"},"observation_digest":"sha256:fbad6854b227b04f0f75ecee97f5ede3d7ccb90db5cacaf3db0b2434379fd7b1","observation_id":"5131510e-5801-4fbd-be2f-c264987c1871","resolution":{"observed_at":"2026-08-05T10:16:05.224749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:16:05.210537Z","title":"Connecting speech encoder and large language model for asr,","venue":null,"work_id":"9bfd2c1f-9187-4fca-8f29-47d07208a86d","year":2024},"citing_paper":{"arxiv_id":"2509.04392","last_updated":"2025-09-04T17:03:58Z","snapshot_observed_at":"2026-08-13T21:21:28.581566Z","submitted_at":"2025-09-04T17:03:58Z","title":"Denoising GER: A Noise-Robust Generative Error Correction with LLM for Speech Recognition","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T10:16:04.803640Z"},"links":{"citing_paper":"/paper/2509.04392"},"observation_digest":"sha256:2a372cfb098d9a3260aec38ea3245fcb525d1dd7566adb2cfc4493a46a332dbf","observation_id":"edd05fb2-d02b-4d5f-94aa-261a4b3cba1e","resolution":{"observed_at":"2026-08-05T10:16:05.214180Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:16:05.199698Z","title":"Listen again and choose the right answer: A new paradigm for automatic speech recognition with large language models,","venue":null,"work_id":"7e5deaf9-4831-46b9-b839-e7a96700a0f4","year":2024},"citing_paper":{"arxiv_id":"2509.04392","last_updated":"2025-09-04T17:03:58Z","snapshot_observed_at":"2026-08-13T21:21:28.581566Z","submitted_at":"2025-09-04T17:03:58Z","title":"Denoising GER: A Noise-Robust Generative Error Correction with LLM for Speech Recognition","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T10:16:04.806687Z"},"links":{"citing_paper":"/paper/2509.04392"},"observation_digest":"sha256:fdbce5410d10fc798e7491dcb3dedcf59eafc7652977656d64615cdae0e7437a","observation_id":"73c026fc-d225-4822-8421-2d29ca8bfe0a","resolution":{"observed_at":"2026-08-05T10:16:05.203527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:16:05.188433Z","title":"Mmger: Multi-modal and multi-granularity generative error correction with llm for joint accent and speech recognition,","venue":null,"work_id":"83f74d0f-fed2-4024-8014-ae633cd84c58","year":2024},"citing_paper":{"arxiv_id":"2509.04392","last_updated":"2025-09-04T17:03:58Z","snapshot_observed_at":"2026-08-13T21:21:28.581566Z","submitted_at":"2025-09-04T17:03:58Z","title":"Denoising GER: A Noise-Robust Generative Error Correction with LLM for Speech Recognition","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T10:16:04.810565Z"},"links":{"citing_paper":"/paper/2509.04392"},"observation_digest":"sha256:3009158c14aed86e52254a9188aa745697f1a0038a33e0f388614c6f431b973a","observation_id":"006e356c-0992-49bd-b8cf-1b5c5f59cc2d","resolution":{"observed_at":"2026-08-05T10:16:05.192010Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07919","last_updated":"2023-12-21T10:20:42Z","snapshot_observed_at":"2026-08-07T10:17:55.688598Z","submitted_at":"2023-11-14T05:34:50Z","title":"Qwen-Audio: Advancing Universal Audio Understanding via Unified Large-Scale Audio-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07919","snapshot_observed_at":"2026-08-05T10:16:04.813741Z","title":"Qwen-audio: Advancing universal audio understanding via unified large- scale audio-language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.04392","last_updated":"2025-09-04T17:03:58Z","snapshot_observed_at":"2026-08-13T21:21:28.581566Z","submitted_at":"2025-09-04T17:03:58Z","title":"Denoising GER: A Noise-Robust Generative Error Correction with LLM for Speech Recognition","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T10:16:04.813741Z"},"links":{"cited_paper":"/paper/2311.07919","citing_paper":"/paper/2509.04392"},"observation_digest":"sha256:411947de342bded1140a8844246957ae9b637b15fea8f5eb667fbfd481c7f6cd","observation_id":"791ec010-1c49-4085-8a11-a51d2edb1e65","resolution":{"observed_at":"2026-08-05T10:16:04.813741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08846","last_updated":"2024-02-13T23:25:04Z","snapshot_observed_at":"2026-08-16T14:18:48.581750Z","submitted_at":"2024-02-13T23:25:04Z","title":"An Embarrassingly Simple Approach for LLM with Strong ASR Capacity","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08846","snapshot_observed_at":"2026-08-05T10:16:04.817224Z","title":"An embarrassingly simple approach for LLM with strong ASR capacity,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.04392","last_updated":"2025-09-04T17:03:58Z","snapshot_observed_at":"2026-08-13T21:21:28.581566Z","submitted_at":"2025-09-04T17:03:58Z","title":"Denoising GER: A Noise-Robust Generative Error Correction with LLM for Speech Recognition","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T10:16:04.817224Z"},"links":{"cited_paper":"/paper/2402.08846","citing_paper":"/paper/2509.04392"},"observation_digest":"sha256:503ac9dc1bc417d4eb2ebd0a904811df4a4f5b8ffedde0e5c4befe10202db00a","observation_id":"16abd9eb-df37-4f74-9542-77af2a53c1b2","resolution":{"observed_at":"2026-08-05T10:16:04.817224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:16:05.178222Z","title":"Salmonn: Towards generic hearing abilities for large lan- guage models,","venue":null,"work_id":"fd30a5a7-6fc7-4722-9bdc-d1bba683a61b","year":2024},"citing_paper":{"arxiv_id":"2509.04392","last_updated":"2025-09-04T17:03:58Z","snapshot_observed_at":"2026-08-13T21:21:28.581566Z","submitted_at":"2025-09-04T17:03:58Z","title":"Denoising GER: A Noise-Robust Generative Error Correction with LLM for Speech Recognition","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T10:16:04.820603Z"},"links":{"citing_paper":"/paper/2509.04392"},"observation_digest":"sha256:3acc4fd6b0e674230acbefef1d4ebc845842875ff65872219d4496e536c8aaa8","observation_id":"fb62c280-17c3-4e2c-b016-b855de249411","resolution":{"observed_at":"2026-08-05T10:16:05.182059Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:16:05.167622Z","title":"Prompting large language models with speech recognition abilities,","venue":null,"work_id":"7b25554a-6971-4e06-96bd-071ef30d4cae","year":2024},"citing_paper":{"arxiv_id":"2509.04392","last_updated":"2025-09-04T17:03:58Z","snapshot_observed_at":"2026-08-13T21:21:28.581566Z","submitted_at":"2025-09-04T17:03:58Z","title":"Denoising GER: A Noise-Robust Generative Error Correction with LLM for Speech Recognition","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T10:16:04.823790Z"},"links":{"citing_paper":"/paper/2509.04392"},"observation_digest":"sha256:eb4fea998de7f043d5226204824a7ef4e863821807deacf11347cb573487807c","observation_id":"04956550-ec28-4de8-b332-b4fc7b616d28","resolution":{"observed_at":"2026-08-05T10:16:05.171300Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:16:05.157387Z","title":"Slm: Bridge the thin gap between speech and text foundation models,","venue":null,"work_id":"7d011d13-7bb3-4470-941c-10b81bae8b41","year":2023},"citing_paper":{"arxiv_id":"2509.04392","last_updated":"2025-09-04T17:03:58Z","snapshot_observed_at":"2026-08-13T21:21:28.581566Z","submitted_at":"2025-09-04T17:03:58Z","title":"Denoising GER: A Noise-Robust Generative Error Correction with LLM for Speech Recognition","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T10:16:04.826775Z"},"links":{"citing_paper":"/paper/2509.04392"},"observation_digest":"sha256:2c9829f2af2cbec9e859ac2eb94278eca7c2a0432623b3c1749c29dd0739f5d2","observation_id":"659efc10-769a-4d24-989d-bad7907b011a","resolution":{"observed_at":"2026-08-05T10:16:05.161022Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:16:05.147671Z","title":"Chatting about chatgpt: how may ai and gpt impact academia and libraries?,","venue":null,"work_id":"9e530d5c-1660-4225-a087-7a44654578c9","year":2023},"citing_paper":{"arxiv_id":"2509.04392","last_updated":"2025-09-04T17:03:58Z","snapshot_observed_at":"2026-08-13T21:21:28.581566Z","submitted_at":"2025-09-04T17:03:58Z","title":"Denoising GER: A Noise-Robust Generative Error Correction with LLM for Speech Recognition","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T10:16:04.829758Z"},"links":{"citing_paper":"/paper/2509.04392"},"observation_digest":"sha256:2735b704b1426041883282a7f078beaf89d29fa1fc08b55dda0a10c5f15704e9","observation_id":"4880aade-3fb7-4e76-bbcc-b014742743a2","resolution":{"observed_at":"2026-08-05T10:16:05.151281Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-05T10:16:04.832728Z","title":"Gpt-4 technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.04392","last_updated":"2025-09-04T17:03:58Z","snapshot_observed_at":"2026-08-13T21:21:28.581566Z","submitted_at":"2025-09-04T17:03:58Z","title":"Denoising GER: A Noise-Robust Generative Error Correction with LLM for Speech Recognition","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T10:16:04.832728Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2509.04392"},"observation_digest":"sha256:7c34b6f2b4b32cf07c8cea222bc3327e90b4634616e13df94e921131022c953f","observation_id":"ae06776a-8285-42a1-9cf4-cb8b69637ee0","resolution":{"observed_at":"2026-08-05T10:16:04.832728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-05T10:16:04.836032Z","title":"Llama: Open and efficient foundation language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.04392","last_updated":"2025-09-04T17:03:58Z","snapshot_observed_at":"2026-08-13T21:21:28.581566Z","submitted_at":"2025-09-04T17:03:58Z","title":"Denoising GER: A Noise-Robust Generative Error Correction with LLM for Speech Recognition","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T10:16:04.836032Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2509.04392"},"observation_digest":"sha256:eda585e5f5ba4b2cf2692deb51249252b8a3750e2ff446ce697917b8f60032b7","observation_id":"2a9d6266-bbf9-4a4f-853b-c58ec648a8d5","resolution":{"observed_at":"2026-08-05T10:16:04.836032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:16:05.137147Z","title":"Blip-2: Bootstrapping language- image pre-training with frozen image encoders and large language models,","venue":null,"work_id":"76a393e0-fc9e-4d2a-b0c2-fc27cbf0234d","year":2023},"citing_paper":{"arxiv_id":"2509.04392","last_updated":"2025-09-04T17:03:58Z","snapshot_observed_at":"2026-08-13T21:21:28.581566Z","submitted_at":"2025-09-04T17:03:58Z","title":"Denoising GER: A Noise-Robust Generative Error Correction with LLM for Speech Recognition","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T10:16:04.839487Z"},"links":{"citing_paper":"/paper/2509.04392"},"observation_digest":"sha256:651c0e3b416033cc0b345bd44c67ea7c498db0c79890f06904fbb3b8ebda2118","observation_id":"7ce5cd9b-fce4-4ece-82fa-21e0ffbfe57f","resolution":{"observed_at":"2026-08-05T10:16:05.140908Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09093","last_updated":"2023-06-15T12:45:25Z","snapshot_observed_at":"2026-08-19T18:43:43.234703Z","submitted_at":"2023-06-15T12:45:25Z","title":"Macaw-LLM: Multi-Modal Language Modeling with Image, Audio, Video, and Text Integration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09093","snapshot_observed_at":"2026-08-05T10:16:04.842954Z","title":"Macaw-llm: Multi-modal language modeling with image, audio, video, and text integration,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.04392","last_updated":"2025-09-04T17:03:58Z","snapshot_observed_at":"2026-08-13T21:21:28.581566Z","submitted_at":"2025-09-04T17:03:58Z","title":"Denoising GER: A Noise-Robust Generative Error Correction with LLM for Speech Recognition","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T10:16:04.842954Z"},"links":{"cited_paper":"/paper/2306.09093","citing_paper":"/paper/2509.04392"},"observation_digest":"sha256:a18b9ce0cdbd5cd56a322670c0dfb404a083d0e140258ab2038ba1db8cddf17c","observation_id":"41bc5a63-d4dc-4a4d-8689-e30e4d35f1c7","resolution":{"observed_at":"2026-08-05T10:16:04.842954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:16:05.126687Z","title":"On decoder-only architecture for speech-to-text and large language model integration,","venue":null,"work_id":"54d59761-a580-426f-9fa3-6285c2f2cdae","year":2023},"citing_paper":{"arxiv_id":"2509.04392","last_updated":"2025-09-04T17:03:58Z","snapshot_observed_at":"2026-08-13T21:21:28.581566Z","submitted_at":"2025-09-04T17:03:58Z","title":"Denoising GER: A Noise-Robust Generative Error Correction with LLM for Speech Recognition","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T10:16:04.846375Z"},"links":{"citing_paper":"/paper/2509.04392"},"observation_digest":"sha256:79d5e12bfd0676ed9a12d5c897a5f3e522f1e57c7f89de288965c322bc437ae8","observation_id":"5c30e5ff-2c78-42b8-a721-b8a8543463d7","resolution":{"observed_at":"2026-08-05T10:16:05.130322Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.05187","last_updated":"2023-12-08T17:18:42Z","snapshot_observed_at":"2026-08-19T22:26:55.755677Z","submitted_at":"2023-12-08T17:18:42Z","title":"Seamless: Multilingual Expressive and Streaming Speech Translation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.05187","snapshot_observed_at":"2026-08-05T10:16:04.849538Z","title":"Seamless: Multilingual expressive and streaming speech translation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.04392","last_updated":"2025-09-04T17:03:58Z","snapshot_observed_at":"2026-08-13T21:21:28.581566Z","submitted_at":"2025-09-04T17:03:58Z","title":"Denoising GER: A Noise-Robust Generative Error Correction with LLM for Speech Recognition","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T10:16:04.849538Z"},"links":{"cited_paper":"/paper/2312.05187","citing_paper":"/paper/2509.04392"},"observation_digest":"sha256:39dec19be6f2d8f52f03c03d7d9c55f102d417d92bcfdd7ddd805f16c7a08d6b","observation_id":"5717e209-f013-4b6d-90b2-82114cc72974","resolution":{"observed_at":"2026-08-05T10:16:04.849538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.12925","last_updated":"2023-06-22T14:37:54Z","snapshot_observed_at":"2026-08-07T01:18:02.068918Z","submitted_at":"2023-06-22T14:37:54Z","title":"AudioPaLM: A Large Language Model That Can Speak and Listen","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.12925","snapshot_observed_at":"2026-08-05T10:16:04.853044Z","title":"Au- diopalm: A large language model that can speak and listen,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.04392","last_updated":"2025-09-04T17:03:58Z","snapshot_observed_at":"2026-08-13T21:21:28.581566Z","submitted_at":"2025-09-04T17:03:58Z","title":"Denoising GER: A Noise-Robust Generative Error Correction with LLM for Speech Recognition","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T10:16:04.853044Z"},"links":{"cited_paper":"/paper/2306.12925","citing_paper":"/paper/2509.04392"},"observation_digest":"sha256:faced24941e0ca8087b7cc168fbd6a01947ee7b38e9b2e8ddc85f4503783a805","observation_id":"03e345c8-3c81-484f-b566-23eca600407b","resolution":{"observed_at":"2026-08-05T10:16:04.853044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04172","last_updated":"2023-09-29T07:32:03Z","snapshot_observed_at":"2026-08-18T02:07:02.948810Z","submitted_at":"2023-07-09T13:38:25Z","title":"Can Generative Large Language Models Perform ASR Error Correction?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04172","snapshot_observed_at":"2026-08-05T10:16:04.856417Z","title":"Can generative large language models perform asr error correction?,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.04392","last_updated":"2025-09-04T17:03:58Z","snapshot_observed_at":"2026-08-13T21:21:28.581566Z","submitted_at":"2025-09-04T17:03:58Z","title":"Denoising GER: A Noise-Robust Generative Error Correction with LLM for Speech Recognition","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T10:16:04.856417Z"},"links":{"cited_paper":"/paper/2307.04172","citing_paper":"/paper/2509.04392"},"observation_digest":"sha256:3913aa3dd49b62033b29b981c9b3c4351eb7916672d86306eb1c2fb68447608f","observation_id":"c73c2754-a00d-4cfb-9a52-9371bea6725a","resolution":{"observed_at":"2026-08-05T10:16:04.856417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:16:05.115244Z","title":"Robust speech recognition via large-scale weak supervi- sion,","venue":null,"work_id":"a5dd8194-f96d-4460-aba8-8b9eb080c7f8","year":2023},"citing_paper":{"arxiv_id":"2509.04392","last_updated":"2025-09-04T17:03:58Z","snapshot_observed_at":"2026-08-13T21:21:28.581566Z","submitted_at":"2025-09-04T17:03:58Z","title":"Denoising GER: A Noise-Robust Generative Error Correction with LLM for Speech Recognition","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T10:16:04.859650Z"},"links":{"citing_paper":"/paper/2509.04392"},"observation_digest":"sha256:5c411de112d57dedf605e6968632f592ac03b7fa1fd42b5a188a3f043881a443","observation_id":"bdfe3de1-8c6a-41e3-9c31-6a1614c2c788","resolution":{"observed_at":"2026-08-05T10:16:05.119669Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:16:05.104943Z","title":"Beats: Audio pre-training with acoustic tokenizers,","venue":null,"work_id":"519f991e-81f0-4f33-86ed-90bb016f0404","year":2023},"citing_paper":{"arxiv_id":"2509.04392","last_updated":"2025-09-04T17:03:58Z","snapshot_observed_at":"2026-08-13T21:21:28.581566Z","submitted_at":"2025-09-04T17:03:58Z","title":"Denoising GER: A Noise-Robust Generative Error Correction with LLM for Speech Recognition","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T10:16:04.862966Z"},"links":{"citing_paper":"/paper/2509.04392"},"observation_digest":"sha256:861450f255c12b4f1578a57393295406f49b3d6f6776ecf8ec22a0542d8d85eb","observation_id":"8087cc9f-4575-4906-b0a2-e6895501d1bb","resolution":{"observed_at":"2026-08-05T10:16:05.108573Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:16:05.094215Z","title":"Speechgpt: Empowering large language models with intrinsic cross- modal conversational abilities,","venue":null,"work_id":"1d32f212-543c-4461-9fc7-029be3254b60","year":2023},"citing_paper":{"arxiv_id":"2509.04392","last_updated":"2025-09-04T17:03:58Z","snapshot_observed_at":"2026-08-13T21:21:28.581566Z","submitted_at":"2025-09-04T17:03:58Z","title":"Denoising GER: A Noise-Robust Generative Error Correction with LLM for Speech Recognition","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T10:16:04.865919Z"},"links":{"citing_paper":"/paper/2509.04392"},"observation_digest":"sha256:695c51e2e62034c68db2eb01de93da49701674b9a8fd4f88fcc16f2fa2cf694c","observation_id":"c9a338d3-7211-4f12-8110-baff576a0ab8","resolution":{"observed_at":"2026-08-05T10:16:05.097718Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:16:05.083419Z","title":"Librispeech: an asr corpus based on public domain audio books,","venue":null,"work_id":"cc0ebd78-e332-4444-aa23-ed8356c9d932","year":2015},"citing_paper":{"arxiv_id":"2509.04392","last_updated":"2025-09-04T17:03:58Z","snapshot_observed_at":"2026-08-13T21:21:28.581566Z","submitted_at":"2025-09-04T17:03:58Z","title":"Denoising GER: A Noise-Robust Generative Error Correction with LLM for Speech Recognition","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T10:16:04.869066Z"},"links":{"citing_paper":"/paper/2509.04392"},"observation_digest":"sha256:10139a07c77448a45d1b3947d8d1a27193efb5827119b5fa3334d3919f8ed0cd","observation_id":"07d5ce17-2a58-4b1e-a4b3-ef22bb2a2ef7","resolution":{"observed_at":"2026-08-05T10:16:05.087400Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:16:05.071479Z","title":"Mrcn: A novel modality restitution and compensation network for visible-infrared person re-identification,","venue":null,"work_id":"ec736a52-41f2-4f5b-a3d0-4367671093ac","year":2023},"citing_paper":{"arxiv_id":"2509.04392","last_updated":"2025-09-04T17:03:58Z","snapshot_observed_at":"2026-08-13T21:21:28.581566Z","submitted_at":"2025-09-04T17:03:58Z","title":"Denoising GER: A Noise-Robust Generative Error Correction with LLM for Speech Recognition","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T10:16:04.873189Z"},"links":{"citing_paper":"/paper/2509.04392"},"observation_digest":"sha256:83758087fea01339f148125fa72a3e1a996002520c5f9f4953f32b78fa397eae","observation_id":"b3a2b0ee-d733-440c-89cf-0f054f455eb8","resolution":{"observed_at":"2026-08-05T10:16:05.075328Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:16:05.060174Z","title":"Multi-stage auxiliary learning for visible-infrared person re-identification,","venue":null,"work_id":"23f2be7b-c844-4624-84c2-415cabd9b6a8","year":2024},"citing_paper":{"arxiv_id":"2509.04392","last_updated":"2025-09-04T17:03:58Z","snapshot_observed_at":"2026-08-13T21:21:28.581566Z","submitted_at":"2025-09-04T17:03:58Z","title":"Denoising GER: A Noise-Robust Generative Error Correction with LLM for Speech Recognition","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T10:16:04.877323Z"},"links":{"citing_paper":"/paper/2509.04392"},"observation_digest":"sha256:72a16dd3e176c4de34c11fd3ab23dd9e2b33a7ce783f825f47d3166a2db6ea4c","observation_id":"9d3de821-eb26-4252-8059-22b78a4dbc41","resolution":{"observed_at":"2026-08-05T10:16:05.064186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04675","last_updated":"2024-07-10T09:01:17Z","snapshot_observed_at":"2026-08-16T13:36:42.713695Z","submitted_at":"2024-07-05T17:38:03Z","title":"Seed-ASR: Understanding Diverse Speech and Contexts with LLM-based Speech Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.04675","snapshot_observed_at":"2026-08-05T10:16:04.880310Z","title":"Seed-asr: Understanding diverse speech and contexts with llm-based speech recognition,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.04392","last_updated":"2025-09-04T17:03:58Z","snapshot_observed_at":"2026-08-13T21:21:28.581566Z","submitted_at":"2025-09-04T17:03:58Z","title":"Denoising GER: A Noise-Robust Generative Error Correction with LLM for Speech Recognition","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T10:16:04.880310Z"},"links":{"cited_paper":"/paper/2407.04675","citing_paper":"/paper/2509.04392"},"observation_digest":"sha256:bb3f4f83ddd58f1aef536cce8a3e293376e2075c56ec7c29edeac76ad3b13010","observation_id":"09b12923-4b21-4f31-a03c-f2275b0f650f","resolution":{"observed_at":"2026-08-05T10:16:04.880310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1510.08484","last_updated":"2015-10-28T20:59:04Z","snapshot_observed_at":"2026-08-18T07:31:38.105834Z","submitted_at":"2015-10-28T20:59:04Z","title":"MUSAN: A Music, Speech, and Noise Corpus","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1510.08484","snapshot_observed_at":"2026-08-05T10:16:04.884569Z","title":"MUSAN: A music, speech, and noise corpus,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2509.04392","last_updated":"2025-09-04T17:03:58Z","snapshot_observed_at":"2026-08-13T21:21:28.581566Z","submitted_at":"2025-09-04T17:03:58Z","title":"Denoising GER: A Noise-Robust Generative Error Correction with LLM for Speech Recognition","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T10:16:04.884569Z"},"links":{"cited_paper":"/paper/1510.08484","citing_paper":"/paper/2509.04392"},"observation_digest":"sha256:851c346f4f37c28d7859f89f2c956070a521c9d2d5adaef32cafa3a3d7ae466d","observation_id":"6b3429fe-9157-4481-89c1-34de5ae81691","resolution":{"observed_at":"2026-08-05T10:16:04.884569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:16:05.049336Z","title":"The design for the wall street journal-based csr corpus,","venue":null,"work_id":"4a4d033a-1345-481b-9cc8-f9b746c7bb88","year":1992},"citing_paper":{"arxiv_id":"2509.04392","last_updated":"2025-09-04T17:03:58Z","snapshot_observed_at":"2026-08-13T21:21:28.581566Z","submitted_at":"2025-09-04T17:03:58Z","title":"Denoising GER: A Noise-Robust Generative Error Correction with LLM for Speech Recognition","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T10:16:04.888432Z"},"links":{"citing_paper":"/paper/2509.04392"},"observation_digest":"sha256:337205f89d29d124754f5d3802aa52c205917bb90317d0959204468d29a847e9","observation_id":"07ca5e88-5e26-4971-886c-9fde1fac9ed6","resolution":{"observed_at":"2026-08-05T10:16:05.053004Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:16:05.038309Z","title":"The rwth/upb/forth system combination for the 4th chime challenge evaluation,","venue":null,"work_id":"e24b94a2-0023-4db5-ac97-c366bb106372","year":2016},"citing_paper":{"arxiv_id":"2509.04392","last_updated":"2025-09-04T17:03:58Z","snapshot_observed_at":"2026-08-13T21:21:28.581566Z","submitted_at":"2025-09-04T17:03:58Z","title":"Denoising GER: A Noise-Robust Generative Error Correction with LLM for Speech Recognition","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T10:16:04.891704Z"},"links":{"citing_paper":"/paper/2509.04392"},"observation_digest":"sha256:57e2a91fbef6664eed521e7b4c3233a7d7c88533bfbfe2d2bcced1a674fc0f38","observation_id":"e223f097-a1fe-4fa6-acd7-5e5596a6bd51","resolution":{"observed_at":"2026-08-05T10:16:05.042194Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-08-20T15:31:01.041088Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-05T10:16:04.895681Z","title":"Qwen technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.04392","last_updated":"2025-09-04T17:03:58Z","snapshot_observed_at":"2026-08-13T21:21:28.581566Z","submitted_at":"2025-09-04T17:03:58Z","title":"Denoising GER: A Noise-Robust Generative Error Correction with LLM for Speech Recognition","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T10:16:04.895681Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2509.04392"},"observation_digest":"sha256:bc12da8a185fd89b48779668d489b4052dec033855f3178f191c74bf9bd1d0ea","observation_id":"0fe4e747-0118-49f9-932a-aadda61ae897","resolution":{"observed_at":"2026-08-05T10:16:04.895681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:16:05.024049Z","title":"Lora: Low-rank adaptation of large language models,","venue":null,"work_id":"2b340ea7-dc0c-4a43-a4e6-5172f56f4e28","year":2022},"citing_paper":{"arxiv_id":"2509.04392","last_updated":"2025-09-04T17:03:58Z","snapshot_observed_at":"2026-08-13T21:21:28.581566Z","submitted_at":"2025-09-04T17:03:58Z","title":"Denoising GER: A Noise-Robust Generative Error Correction with LLM for Speech Recognition","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-05T10:16:04.899137Z"},"links":{"citing_paper":"/paper/2509.04392"},"observation_digest":"sha256:ec27b8179431f61ce816bd0e8edf49510019f212b86b1d3c1c97d1d731b915e0","observation_id":"bc0bd940-5565-4035-be56-64ba40a39127","resolution":{"observed_at":"2026-08-05T10:16:05.029934Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.04392","last_updated":"2025-09-04T17:03:58Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-13T21:21:28.581566Z","submitted_at":"2025-09-04T17:03:58Z","title":"Denoising GER: A Noise-Robust Generative Error Correction with LLM for Speech Recognition"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":0,"verified_fuzzy":31},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 0 inbound Pith citation observations for arXiv:2509.04392."}