{"as_of":"2026-08-23T20:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:37ec904c8f1e1be23f52496a38568f892c6855b485cbd1410c477c03bf44d806","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T21:34:36.388230Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-10T20:25:33.127942Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-10T20:27:36.589504Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.04521","last_updated":"2025-01-09T09:28:37Z","snapshot_observed_at":"2026-08-19T03:05:24.440114Z","submitted_at":"2025-01-08T14:14:19Z","title":"Right Label Context in End-to-End Training of Time-Synchronous ASR Models","version":2},"cited_work":{"arxiv_id":"2501.04521","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.04521","snapshot_observed_at":"2026-07-10T20:27:36.589504Z","title":"Right Label Context in End-to-End Training of Time-Synchronous ASR Models","venue":"cs.SD","work_id":"7782d72d-8752-48e0-b4eb-1ddb9f6776c6","year":2025},"citing_paper":{"arxiv_id":"2607.06831","last_updated":"2026-07-07T21:57:54Z","snapshot_observed_at":"2026-08-18T21:57:27.056849Z","submitted_at":"2026-07-07T21:57:54Z","title":"Gradient-Based Speech-to-Text Alignment for Any ASR Model: From CTC to Speech LLMs","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-10T20:25:33.127942Z"},"links":{"cited_paper":"/paper/2501.04521","citing_paper":"/paper/2607.06831"},"observation_digest":"sha256:ba16b228493c18b1676e92e13c957463fa8b0d0dbfbdf624568291f459e72009","observation_id":"b5413ae3-61ac-42fb-8423-5534e301fb5b","resolution":{"observed_at":"2026-07-10T20:27:36.590845Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.04521/citation-record","integrity":"/paper/2501.04521/integrity","json":"/paper/2501.04521/citation-record.json","paper":"/paper/2501.04521"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:34:36.857582Z","title":"Connection- ist temporal classiﬁcation: labelling unsegmented sequen ce data with recurrent neural networks,","venue":null,"work_id":"8b41bcda-5226-4423-9750-2c1e2c5bb0ba","year":2006},"citing_paper":{"arxiv_id":"2501.04521","last_updated":"2025-01-09T09:28:37Z","snapshot_observed_at":"2026-08-19T03:05:24.440114Z","submitted_at":"2025-01-08T14:14:19Z","title":"Right Label Context in End-to-End Training of Time-Synchronous ASR Models","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T21:34:36.249026Z"},"links":{"citing_paper":"/paper/2501.04521"},"observation_digest":"sha256:d0577126c92b95cc1a7c9cd4ea3ff3e071ad9f22474b713216f5b56db5824b7f","observation_id":"4b5b5192-4e8d-47e7-9acc-4999b40153fe","resolution":{"observed_at":"2026-08-10T21:34:36.861993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1211.3711","last_updated":"2012-11-14T19:25:21Z","snapshot_observed_at":"2026-08-15T00:39:21.296689Z","submitted_at":"2012-11-14T19:25:21Z","title":"Sequence Transduction with Recurrent Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1211.3711","snapshot_observed_at":"2026-08-10T21:34:36.253848Z","title":"Sequence transduction with recurrent neura l networks,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2501.04521","last_updated":"2025-01-09T09:28:37Z","snapshot_observed_at":"2026-08-19T03:05:24.440114Z","submitted_at":"2025-01-08T14:14:19Z","title":"Right Label Context in End-to-End Training of Time-Synchronous ASR Models","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T21:34:36.253848Z"},"links":{"cited_paper":"/paper/1211.3711","citing_paper":"/paper/2501.04521"},"observation_digest":"sha256:7b166ff4422ad6d1a4119b53d83dcf5ba76402614ff967d983a6dccc351405eb","observation_id":"6e2dddb1-adbe-4656-af0e-3417f5d16f98","resolution":{"observed_at":"2026-08-10T21:34:36.253848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:34:36.844631Z","title":"Monotonic recu rrent neural network transducer and decoding strategies,","venue":null,"work_id":"caed1f4e-35d7-4571-b98c-ae9362a44620","year":2019},"citing_paper":{"arxiv_id":"2501.04521","last_updated":"2025-01-09T09:28:37Z","snapshot_observed_at":"2026-08-19T03:05:24.440114Z","submitted_at":"2025-01-08T14:14:19Z","title":"Right Label Context in End-to-End Training of Time-Synchronous ASR Models","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T21:34:36.258940Z"},"links":{"citing_paper":"/paper/2501.04521"},"observation_digest":"sha256:7a56a0c889df99dd9638b70fa0f7e3da9dc1cacf3207f84a20721534c21ca8af","observation_id":"42052eb8-8c27-468a-a0a0-e1e2daecf71d","resolution":{"observed_at":"2026-08-10T21:34:36.848808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:34:36.832646Z","title":"H MM vs. CTC for Automatic Speech Recognition: Comparison Based on F ull- Sum Training from Scratch,","venue":null,"work_id":"7e54d27e-89b8-457d-a649-de6b0de5cd46","year":2023},"citing_paper":{"arxiv_id":"2501.04521","last_updated":"2025-01-09T09:28:37Z","snapshot_observed_at":"2026-08-19T03:05:24.440114Z","submitted_at":"2025-01-08T14:14:19Z","title":"Right Label Context in End-to-End Training of Time-Synchronous ASR Models","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T21:34:36.263392Z"},"links":{"citing_paper":"/paper/2501.04521"},"observation_digest":"sha256:ac73e8875d14fa63ce42182b6aa91785a85f7e979ac20fbdef17fea8a8d477ff","observation_id":"4a34e7cf-0eae-4cf8-9a01-0488113baf35","resolution":{"observed_at":"2026-08-10T21:34:36.836828Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:34:36.820384Z","title":null,"venue":null,"work_id":"fa6e3941-14ef-491a-a859-da99519001ab","year":1993},"citing_paper":{"arxiv_id":"2501.04521","last_updated":"2025-01-09T09:28:37Z","snapshot_observed_at":"2026-08-19T03:05:24.440114Z","submitted_at":"2025-01-08T14:14:19Z","title":"Right Label Context in End-to-End Training of Time-Synchronous ASR Models","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T21:34:36.267986Z"},"links":{"citing_paper":"/paper/2501.04521"},"observation_digest":"sha256:2caada96aeeb77631163ad2220a5cc0dc24f4c43f5dcd802e6dd3b197962501b","observation_id":"ecfef1e2-e29d-471b-92bc-bd04606be8bb","resolution":{"observed_at":"2026-08-10T21:34:36.824873Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:34:36.807927Z","title":"Neural machine tra nslation of rare words with subword units,","venue":null,"work_id":"4d3abd41-196f-4aa2-8378-31ac674f42e4","year":2016},"citing_paper":{"arxiv_id":"2501.04521","last_updated":"2025-01-09T09:28:37Z","snapshot_observed_at":"2026-08-19T03:05:24.440114Z","submitted_at":"2025-01-08T14:14:19Z","title":"Right Label Context in End-to-End Training of Time-Synchronous ASR Models","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T21:34:36.271878Z"},"links":{"citing_paper":"/paper/2501.04521"},"observation_digest":"sha256:637ef2095286fa6eb992771d38ed5b5cb953e45b8e160ee7ad574bcd91a8c3b4","observation_id":"6b1c0039-a83b-4129-8cc3-1a1cee437a4e","resolution":{"observed_at":"2026-08-10T21:34:36.811909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:34:36.795643Z","title":"Multitask lear ning of context- dependent targets in deep neural network acoustic models,","venue":null,"work_id":"ede5f5f4-5882-41da-b75d-6a3c65af55a5","year":2016},"citing_paper":{"arxiv_id":"2501.04521","last_updated":"2025-01-09T09:28:37Z","snapshot_observed_at":"2026-08-19T03:05:24.440114Z","submitted_at":"2025-01-08T14:14:19Z","title":"Right Label Context in End-to-End Training of Time-Synchronous ASR Models","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T21:34:36.276495Z"},"links":{"citing_paper":"/paper/2501.04521"},"observation_digest":"sha256:8ec1973a0d4c8fe87318c29fded6f4dac5c635f8250490cc050ff02595e466a6","observation_id":"13a891c8-b96c-4cd8-a1e5-f88ac4b28655","resolution":{"observed_at":"2026-08-10T21:34:36.800261Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:34:36.778948Z","title":"Context-de pendent acoustic modeling without explicit phone clustering,","venue":null,"work_id":"8adfa25e-b85f-4920-9503-5bfff918b021","year":2020},"citing_paper":{"arxiv_id":"2501.04521","last_updated":"2025-01-09T09:28:37Z","snapshot_observed_at":"2026-08-19T03:05:24.440114Z","submitted_at":"2025-01-08T14:14:19Z","title":"Right Label Context in End-to-End Training of Time-Synchronous ASR Models","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T21:34:36.280368Z"},"links":{"citing_paper":"/paper/2501.04521"},"observation_digest":"sha256:09732efa7cd52cc7ad8c82a3c0efc8f7526de244f47fe4ea98b2e08da890d0c6","observation_id":"21f54064-2dd3-4acf-842b-cc7d124d6dea","resolution":{"observed_at":"2026-08-10T21:34:36.785201Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:34:36.765692Z","title":"RNN- transducer with stateless prediction network,","venue":null,"work_id":"a183e0ef-e11e-4592-9c08-2a23ac3ade99","year":2020},"citing_paper":{"arxiv_id":"2501.04521","last_updated":"2025-01-09T09:28:37Z","snapshot_observed_at":"2026-08-19T03:05:24.440114Z","submitted_at":"2025-01-08T14:14:19Z","title":"Right Label Context in End-to-End Training of Time-Synchronous ASR Models","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T21:34:36.284360Z"},"links":{"citing_paper":"/paper/2501.04521"},"observation_digest":"sha256:79f72f309c49753f8fddb54832579888b25941d5b3335392b98ccda47f927a18","observation_id":"3426bffa-f777-42d8-98f4-7172672b56e4","resolution":{"observed_at":"2026-08-10T21:34:36.770588Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:34:36.751647Z","title":"Zipformer: A faster and better encoder for automatic speech recognition,","venue":null,"work_id":"e8f54862-baad-4cc2-a3c3-ff7aeffccf71","year":2023},"citing_paper":{"arxiv_id":"2501.04521","last_updated":"2025-01-09T09:28:37Z","snapshot_observed_at":"2026-08-19T03:05:24.440114Z","submitted_at":"2025-01-08T14:14:19Z","title":"Right Label Context in End-to-End Training of Time-Synchronous ASR Models","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T21:34:36.288960Z"},"links":{"citing_paper":"/paper/2501.04521"},"observation_digest":"sha256:55c40c9698de32e3bf888554bb9f56cabc0ecbca747af646f619030e896ae744","observation_id":"2ff99f79-9641-439c-b0fa-02f034008fa9","resolution":{"observed_at":"2026-08-10T21:34:36.755823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:34:36.737963Z","title":"Phoneme ba sed neural transducer for large vocabulary speech recognition,","venue":null,"work_id":"69776c93-c76a-4276-b687-d515a98c8775","year":2021},"citing_paper":{"arxiv_id":"2501.04521","last_updated":"2025-01-09T09:28:37Z","snapshot_observed_at":"2026-08-19T03:05:24.440114Z","submitted_at":"2025-01-08T14:14:19Z","title":"Right Label Context in End-to-End Training of Time-Synchronous ASR Models","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T21:34:36.292907Z"},"links":{"citing_paper":"/paper/2501.04521"},"observation_digest":"sha256:0dce1a9d841b475ef4cb41475623d09a8afd6de264344475060ad989eacccd1e","observation_id":"748969ed-ce33-4507-b6a5-8b635c7b8417","resolution":{"observed_at":"2026-08-10T21:34:36.743163Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:34:36.725374Z","title":"Global normalization for streaming speech recogn ition in a modular framework,","venue":null,"work_id":"65dbff26-2448-4f00-a773-04aa1677b5e5","year":2022},"citing_paper":{"arxiv_id":"2501.04521","last_updated":"2025-01-09T09:28:37Z","snapshot_observed_at":"2026-08-19T03:05:24.440114Z","submitted_at":"2025-01-08T14:14:19Z","title":"Right Label Context in End-to-End Training of Time-Synchronous ASR Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T21:34:36.296796Z"},"links":{"citing_paper":"/paper/2501.04521"},"observation_digest":"sha256:af2033a3a62477b8699f89aa203978ccd4c16afc20c9f6c9195f21cde2b110e1","observation_id":"514a7b2a-6069-468d-b639-bf13b7a7bc31","resolution":{"observed_at":"2026-08-10T21:34:36.729462Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.02387","last_updated":"2021-10-12T11:52:41Z","snapshot_observed_at":"2026-08-19T08:00:50.151580Z","submitted_at":"2021-04-06T09:24:01Z","title":"Towards Consistent Hybrid HMM Acoustic Modeling","version":3},"cited_work":{"arxiv_id":"2104.02387","doi":null,"metadata_source":"pith","pith_arxiv_id":"2104.02387","snapshot_observed_at":"2026-08-10T21:34:36.440781Z","title":"Towards Consistent Hybrid HMM Acoustic Modeling","venue":"cs.SD","work_id":"9ea84963-6835-4be7-a36e-8539a986f178","year":2021},"citing_paper":{"arxiv_id":"2501.04521","last_updated":"2025-01-09T09:28:37Z","snapshot_observed_at":"2026-08-19T03:05:24.440114Z","submitted_at":"2025-01-08T14:14:19Z","title":"Right Label Context in End-to-End Training of Time-Synchronous ASR Models","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T21:34:36.301409Z"},"links":{"cited_paper":"/paper/2104.02387","citing_paper":"/paper/2501.04521"},"observation_digest":"sha256:8cfac0074a79fb7b973256bfd8b3248fcc2912354e96509ac4d26a482c98ebdf","observation_id":"2453f992-d550-4548-985b-cb448a79cbb0","resolution":{"observed_at":"2026-08-10T21:34:36.445733Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:34:36.713718Z","title":"Conformer: Convolutio n- Augmented Transformer for Speech Recognition,","venue":null,"work_id":"83dd76a9-a970-446c-917a-7237064099d0","year":2020},"citing_paper":{"arxiv_id":"2501.04521","last_updated":"2025-01-09T09:28:37Z","snapshot_observed_at":"2026-08-19T03:05:24.440114Z","submitted_at":"2025-01-08T14:14:19Z","title":"Right Label Context in End-to-End Training of Time-Synchronous ASR Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T21:34:36.305727Z"},"links":{"citing_paper":"/paper/2501.04521"},"observation_digest":"sha256:63259c5202d969c018ef763d62dcf3cefe3a2e3c7f52c65a1a9d516944d8c17a","observation_id":"ea190225-4ee1-4a2e-a463-8ee75ca508c8","resolution":{"observed_at":"2026-08-10T21:34:36.717861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:34:36.700920Z","title":"Competitive and resource efﬁcient factored hybrid HMM systems are simpl er than you think,","venue":null,"work_id":"8cd13f06-a4c9-4061-845f-f07bf01fab63","year":2023},"citing_paper":{"arxiv_id":"2501.04521","last_updated":"2025-01-09T09:28:37Z","snapshot_observed_at":"2026-08-19T03:05:24.440114Z","submitted_at":"2025-01-08T14:14:19Z","title":"Right Label Context in End-to-End Training of Time-Synchronous ASR Models","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T21:34:36.309693Z"},"links":{"citing_paper":"/paper/2501.04521"},"observation_digest":"sha256:1f497211e70531b26742362c6f47ec920b156d9c00dc0c802adcb446d5d79e4b","observation_id":"c7eafc15-13db-4318-9231-11ea4ec66244","resolution":{"observed_at":"2026-08-10T21:34:36.705177Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:34:36.688826Z","title":"CDNN : A context dependent neural network for continuous speech recognitio n,","venue":null,"work_id":"35f3d76e-6c3c-4a31-a4e9-5a9d5a63fcf8","year":1992},"citing_paper":{"arxiv_id":"2501.04521","last_updated":"2025-01-09T09:28:37Z","snapshot_observed_at":"2026-08-19T03:05:24.440114Z","submitted_at":"2025-01-08T14:14:19Z","title":"Right Label Context in End-to-End Training of Time-Synchronous ASR Models","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T21:34:36.313329Z"},"links":{"citing_paper":"/paper/2501.04521"},"observation_digest":"sha256:3ae601a1c46305702e16a3f1056ef9fc974387ca5d7e31636d7bab93b4a3e9d4","observation_id":"d4ea37fd-2223-4e07-8d50-eed73406601a","resolution":{"observed_at":"2026-08-10T21:34:36.692842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:34:36.676752Z","title":"HMM vs. CTC for automatic speech recognition: Comparison based on f ull-sum training from scratch,","venue":null,"work_id":"49e09ccf-4ae2-4760-8711-07ca6c5c2a6f","year":2022},"citing_paper":{"arxiv_id":"2501.04521","last_updated":"2025-01-09T09:28:37Z","snapshot_observed_at":"2026-08-19T03:05:24.440114Z","submitted_at":"2025-01-08T14:14:19Z","title":"Right Label Context in End-to-End Training of Time-Synchronous ASR Models","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T21:34:36.316943Z"},"links":{"citing_paper":"/paper/2501.04521"},"observation_digest":"sha256:9c5a3c52c78d2ab848fb243dd11222ac7bc0730631a1c6fff2455f7fb72798ae","observation_id":"e032a9c1-97c3-4458-9eb7-3598027c6ef1","resolution":{"observed_at":"2026-08-10T21:34:36.680793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:34:36.665033Z","title":"Weighted ﬁnite-sta te transducers in speech recognition,","venue":null,"work_id":"1beecd67-ddc1-447e-b1a0-269fb993bdd1","year":2002},"citing_paper":{"arxiv_id":"2501.04521","last_updated":"2025-01-09T09:28:37Z","snapshot_observed_at":"2026-08-19T03:05:24.440114Z","submitted_at":"2025-01-08T14:14:19Z","title":"Right Label Context in End-to-End Training of Time-Synchronous ASR Models","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T21:34:36.320606Z"},"links":{"citing_paper":"/paper/2501.04521"},"observation_digest":"sha256:22261639464d18916b5e5d8c31dd69bf469c1eb4982ff5bcc476e0a329248cdd","observation_id":"1934f727-8935-4eb3-aab0-2cbd28153504","resolution":{"observed_at":"2026-08-10T21:34:36.669010Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:34:36.653267Z","title":"Regarding topology and variant fra me rates for differentiable WFST-based end-to-end asr,","venue":null,"work_id":"8981dade-c0ff-4193-a251-557c9b4d9377","year":2023},"citing_paper":{"arxiv_id":"2501.04521","last_updated":"2025-01-09T09:28:37Z","snapshot_observed_at":"2026-08-19T03:05:24.440114Z","submitted_at":"2025-01-08T14:14:19Z","title":"Right Label Context in End-to-End Training of Time-Synchronous ASR Models","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T21:34:36.324481Z"},"links":{"citing_paper":"/paper/2501.04521"},"observation_digest":"sha256:6d69a48a9397a466d390d0c058310eb20fcab94861252754642f4fec54eb35ab","observation_id":"3d6b370c-8953-4ad9-9fab-5812eb3fda1b","resolution":{"observed_at":"2026-08-10T21:34:36.657432Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:34:36.640797Z","title":"CTC in the co ntext of generalized full-sum HMM training,","venue":null,"work_id":"d2d31c14-4e71-48e1-85e7-568fe53e11ac","year":2017},"citing_paper":{"arxiv_id":"2501.04521","last_updated":"2025-01-09T09:28:37Z","snapshot_observed_at":"2026-08-19T03:05:24.440114Z","submitted_at":"2025-01-08T14:14:19Z","title":"Right Label Context in End-to-End Training of Time-Synchronous ASR Models","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T21:34:36.328163Z"},"links":{"citing_paper":"/paper/2501.04521"},"observation_digest":"sha256:df450b6cd108cfb32a9438c04182734aa7ae4957e7ef9f48e6020ef798d4196c","observation_id":"84b6171d-bc8e-46d9-8550-ca60e300fc05","resolution":{"observed_at":"2026-08-10T21:34:36.645121Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:34:36.627067Z","title":"Investigating the effect of label topology and training criterion on asr pe rformance and alignment quality,","venue":null,"work_id":"ff633424-d379-42ea-9630-25daa29c7d50","year":2024},"citing_paper":{"arxiv_id":"2501.04521","last_updated":"2025-01-09T09:28:37Z","snapshot_observed_at":"2026-08-19T03:05:24.440114Z","submitted_at":"2025-01-08T14:14:19Z","title":"Right Label Context in End-to-End Training of Time-Synchronous ASR Models","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T21:34:36.332607Z"},"links":{"citing_paper":"/paper/2501.04521"},"observation_digest":"sha256:b004f72d9245260101322d8bd735561cf84542f28d8880391b6c4dd3404ae9c8","observation_id":"f5fa6b54-4b9d-4fb7-b3f8-017fd5cffb20","resolution":{"observed_at":"2026-08-10T21:34:36.631536Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:34:36.614602Z","title":"Tree-based state tying for high accuracy acoustic modelling,","venue":null,"work_id":"75e8c03e-b275-4f18-b684-e18561ba9ad2","year":1994},"citing_paper":{"arxiv_id":"2501.04521","last_updated":"2025-01-09T09:28:37Z","snapshot_observed_at":"2026-08-19T03:05:24.440114Z","submitted_at":"2025-01-08T14:14:19Z","title":"Right Label Context in End-to-End Training of Time-Synchronous ASR Models","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T21:34:36.336368Z"},"links":{"citing_paper":"/paper/2501.04521"},"observation_digest":"sha256:af5df508b9167b8db2496cf761118aa6086bfc1f7f05af50ca4022131d2acd5e","observation_id":"d4818f61-8556-49d5-87a5-7fce9a915400","resolution":{"observed_at":"2026-08-10T21:34:36.619003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:34:36.602636Z","title":"Switchboard : Telephone Speech Corpus for Research and Development,","venue":null,"work_id":"424c6547-db08-4033-9d25-448015d89408","year":1992},"citing_paper":{"arxiv_id":"2501.04521","last_updated":"2025-01-09T09:28:37Z","snapshot_observed_at":"2026-08-19T03:05:24.440114Z","submitted_at":"2025-01-08T14:14:19Z","title":"Right Label Context in End-to-End Training of Time-Synchronous ASR Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T21:34:36.340196Z"},"links":{"citing_paper":"/paper/2501.04521"},"observation_digest":"sha256:9b9a525f770d08c0f55d6700ece3020665ed920d53a922b5e8c2afa451036dc5","observation_id":"f20a9d58-6eae-4e4e-aeec-2808c4281c15","resolution":{"observed_at":"2026-08-10T21:34:36.606897Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:34:36.589899Z","title":"Libr iSpeech: An ASR Corpus Based on Public Domain Audio Books,","venue":null,"work_id":"cd35178c-3242-4164-a482-7bdb771576bf","year":2015},"citing_paper":{"arxiv_id":"2501.04521","last_updated":"2025-01-09T09:28:37Z","snapshot_observed_at":"2026-08-19T03:05:24.440114Z","submitted_at":"2025-01-08T14:14:19Z","title":"Right Label Context in End-to-End Training of Time-Synchronous ASR Models","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T21:34:36.344341Z"},"links":{"citing_paper":"/paper/2501.04521"},"observation_digest":"sha256:ae95da89dcbee38f8b28d15beb46cc5813d2779628def95b3dc83c484ca0b634","observation_id":"f77601fc-8ca0-47ef-89cf-f8e53b32d924","resolution":{"observed_at":"2026-08-10T21:34:36.594196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:34:36.576362Z","title":"RETURNN: The RWTH extensible training framework for unive rsal recurrent neural networks,","venue":null,"work_id":"1202a2a2-d05a-495e-955d-9cd4a137eadf","year":2017},"citing_paper":{"arxiv_id":"2501.04521","last_updated":"2025-01-09T09:28:37Z","snapshot_observed_at":"2026-08-19T03:05:24.440114Z","submitted_at":"2025-01-08T14:14:19Z","title":"Right Label Context in End-to-End Training of Time-Synchronous ASR Models","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T21:34:36.348294Z"},"links":{"citing_paper":"/paper/2501.04521"},"observation_digest":"sha256:0f81b8b1d29f1cf23194b90fdeed7c888daa2c7a79928170bd6c37d21b851a46","observation_id":"64ed2ed2-c9bc-4e5d-a81a-665e8c7380fe","resolution":{"observed_at":"2026-08-10T21:34:36.581250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:34:36.562358Z","title":"RASR-the RWTH Aachen u ni- versity open source speech recognition toolkit,","venue":null,"work_id":"bd3d0827-2e4b-4702-90ee-ca41fbc33c1e","year":2011},"citing_paper":{"arxiv_id":"2501.04521","last_updated":"2025-01-09T09:28:37Z","snapshot_observed_at":"2026-08-19T03:05:24.440114Z","submitted_at":"2025-01-08T14:14:19Z","title":"Right Label Context in End-to-End Training of Time-Synchronous ASR Models","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T21:34:36.352241Z"},"links":{"citing_paper":"/paper/2501.04521"},"observation_digest":"sha256:b061e56edff4d5fc93476d347c06d06bcb539f91c20ed09229ef091bddbc2f30","observation_id":"2461d4c6-c100-4e94-a477-c7623696ae20","resolution":{"observed_at":"2026-08-10T21:34:36.567717Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:34:36.549761Z","title":"RA SR2: The RWTH ASR toolkit for generic sequence-to-sequence speech r ecogni- tion,","venue":null,"work_id":"f54335f9-fa56-4ccf-9e87-4b2e4b86e0cd","year":2023},"citing_paper":{"arxiv_id":"2501.04521","last_updated":"2025-01-09T09:28:37Z","snapshot_observed_at":"2026-08-19T03:05:24.440114Z","submitted_at":"2025-01-08T14:14:19Z","title":"Right Label Context in End-to-End Training of Time-Synchronous ASR Models","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T21:34:36.356990Z"},"links":{"citing_paper":"/paper/2501.04521"},"observation_digest":"sha256:ab833db07deab75ac6596facb15618cda7df8ec9aed3a743a28b813a07219342","observation_id":"25179f24-2f88-4c14-9086-280c83c2aaaa","resolution":{"observed_at":"2026-08-10T21:34:36.554140Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:34:36.536677Z","title":"Sisyphus, a workﬂow ma nager designed for machine translation and automatic speech reco gnition,","venue":null,"work_id":"5e2b6d08-ced2-4d94-9708-4975aa2747e2","year":2018},"citing_paper":{"arxiv_id":"2501.04521","last_updated":"2025-01-09T09:28:37Z","snapshot_observed_at":"2026-08-19T03:05:24.440114Z","submitted_at":"2025-01-08T14:14:19Z","title":"Right Label Context in End-to-End Training of Time-Synchronous ASR Models","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T21:34:36.361616Z"},"links":{"citing_paper":"/paper/2501.04521"},"observation_digest":"sha256:a22c02d3aa1a223c091e616cdcdcd335f1c458c20df1c7cb72891e18131bc862","observation_id":"7d34f993-c345-490b-a0ef-de982e80eadc","resolution":{"observed_at":"2026-08-10T21:34:36.541374Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:34:36.522914Z","title":"Gamma tone features and feature combination for large vocabulary speech recogn ition,","venue":null,"work_id":"e3c453e5-3cd7-4faa-983d-d53ecdcc7028","year":2007},"citing_paper":{"arxiv_id":"2501.04521","last_updated":"2025-01-09T09:28:37Z","snapshot_observed_at":"2026-08-19T03:05:24.440114Z","submitted_at":"2025-01-08T14:14:19Z","title":"Right Label Context in End-to-End Training of Time-Synchronous ASR Models","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T21:34:36.366564Z"},"links":{"citing_paper":"/paper/2501.04521"},"observation_digest":"sha256:185789f06acfb3fd7bf014ae7adc9ecea661b2c249ba128ddc71fcc3cdc71fda","observation_id":"a3176f0b-b1f7-4799-9804-17656ecd0747","resolution":{"observed_at":"2026-08-10T21:34:36.527462Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:34:36.509740Z","title":"SpecAugment on Large Scale Datasets,","venue":null,"work_id":"c73c0657-9d7c-4133-9bdd-f4f11f8c1ab7","year":2019},"citing_paper":{"arxiv_id":"2501.04521","last_updated":"2025-01-09T09:28:37Z","snapshot_observed_at":"2026-08-19T03:05:24.440114Z","submitted_at":"2025-01-08T14:14:19Z","title":"Right Label Context in End-to-End Training of Time-Synchronous ASR Models","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T21:34:36.371644Z"},"links":{"citing_paper":"/paper/2501.04521"},"observation_digest":"sha256:54e7f15cd573c631b31327f710d28007e8c9b77357f9e31eb89023513435dd2a","observation_id":"88db6780-e84f-43c3-bc25-5c77f0046b79","resolution":{"observed_at":"2026-08-10T21:34:36.514550Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.10586","last_updated":"2022-08-08T09:47:40Z","snapshot_observed_at":"2026-08-19T17:48:57.759212Z","submitted_at":"2022-04-22T09:16:51Z","title":"Efficient Training of Neural Transducer for Speech Recognition","version":4},"cited_work":{"arxiv_id":"2204.10586","doi":null,"metadata_source":"pith","pith_arxiv_id":"2204.10586","snapshot_observed_at":"2026-08-10T21:34:36.420831Z","title":"Efficient Training of Neural Transducer for Speech Recognition","venue":"cs.CL","work_id":"1c945fc5-15a6-4f28-a3cf-b962556a00e5","year":2022},"citing_paper":{"arxiv_id":"2501.04521","last_updated":"2025-01-09T09:28:37Z","snapshot_observed_at":"2026-08-19T03:05:24.440114Z","submitted_at":"2025-01-08T14:14:19Z","title":"Right Label Context in End-to-End Training of Time-Synchronous ASR Models","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T21:34:36.376117Z"},"links":{"cited_paper":"/paper/2204.10586","citing_paper":"/paper/2501.04521"},"observation_digest":"sha256:a4c9b2e1fc80019dd0d9882370f73c9bdddd7e26a12b7f559802dc8aa7fa6689","observation_id":"7d3c61b0-964d-45ea-9563-d9f44c082871","resolution":{"observed_at":"2026-08-10T21:34:36.427499Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:34:36.495684Z","title":"Conformer: Convolution-augme nted Transformer for Speech Recognition,","venue":null,"work_id":"8877db87-9e13-4103-8963-5e7d5d446b78","year":2020},"citing_paper":{"arxiv_id":"2501.04521","last_updated":"2025-01-09T09:28:37Z","snapshot_observed_at":"2026-08-19T03:05:24.440114Z","submitted_at":"2025-01-08T14:14:19Z","title":"Right Label Context in End-to-End Training of Time-Synchronous ASR Models","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T21:34:36.380045Z"},"links":{"citing_paper":"/paper/2501.04521"},"observation_digest":"sha256:e446cf5f2409e15bfdfb4e9fa8bd29bd05ec5c4c23dfa6b2bb3b05ba79abd080","observation_id":"ba0b36b3-e216-49f2-87f5-cfe87455457f","resolution":{"observed_at":"2026-08-10T21:34:36.500055Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:34:36.481449Z","title":"Super-convergence: V ery f ast training of neural networks using large learning rates,","venue":null,"work_id":"f87d0293-196c-44d4-b705-8c4d286c068d","year":2019},"citing_paper":{"arxiv_id":"2501.04521","last_updated":"2025-01-09T09:28:37Z","snapshot_observed_at":"2026-08-19T03:05:24.440114Z","submitted_at":"2025-01-08T14:14:19Z","title":"Right Label Context in End-to-End Training of Time-Synchronous ASR Models","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T21:34:36.383970Z"},"links":{"citing_paper":"/paper/2501.04521"},"observation_digest":"sha256:1b1a4221115669e3d41f9870dc9ea888d3ae9d25a92801cbb524dbdd9b9c14a2","observation_id":"402b8d24-fa3e-45cf-b0a1-95ce71a27605","resolution":{"observed_at":"2026-08-10T21:34:36.485998Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:34:36.468186Z","title":"Incorporating Nesterov Momentum into Adam,","venue":null,"work_id":"5eaa9177-20c8-4888-9546-79b23cae0af7","year":2016},"citing_paper":{"arxiv_id":"2501.04521","last_updated":"2025-01-09T09:28:37Z","snapshot_observed_at":"2026-08-19T03:05:24.440114Z","submitted_at":"2025-01-08T14:14:19Z","title":"Right Label Context in End-to-End Training of Time-Synchronous ASR Models","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T21:34:36.388230Z"},"links":{"citing_paper":"/paper/2501.04521"},"observation_digest":"sha256:fa6e4346b836bb90bab9162e1049fd8ffd6b0fdd9956036186fcc41f71265b7d","observation_id":"4281a5f4-a019-48a2-8cb2-068414736169","resolution":{"observed_at":"2026-08-10T21:34:36.472700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.04521","last_updated":"2025-01-09T09:28:37Z","latest_version":2,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-19T03:05:24.440114Z","submitted_at":"2025-01-08T14:14:19Z","title":"Right Label Context in End-to-End Training of Time-Synchronous ASR Models"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":2,"verified_exact":2,"verified_fuzzy":30},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 1 inbound Pith citation observation for arXiv:2501.04521."}