{"as_of":"2026-08-21T19:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9b815b00edfdeb686f9931bbba8c86bce1d9c6810dfa28bf02786ca985a253aa","coverage":[{"denominator":92,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":92,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T05:35:17.130966Z","state":"measured"},{"denominator":94,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":94,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T09:46:28.470791Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T07:47:44.604777Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"cited_work":{"arxiv_id":"2502.03212","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03212","snapshot_observed_at":"2026-07-03T07:47:44.604777Z","title":"Leveraging broadcast media subtitle transcripts for automatic speech recognition and subtitling,","venue":null,"work_id":"00d5cc56-1399-40cf-9ea8-c32366104f46","year":2025},"citing_paper":{"arxiv_id":"2606.10864","last_updated":"2026-06-09T13:43:30Z","snapshot_observed_at":"2026-08-16T23:20:24.726565Z","submitted_at":"2026-06-09T13:43:30Z","title":"Phoneme-First Prediction for LLM-Based Speech Recognition","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-27T11:50:03.947364Z"},"links":{"cited_paper":"/paper/2502.03212","citing_paper":"/paper/2606.10864"},"observation_digest":"sha256:689f27633f84de51286b541f4bd46425709453932458c2e6be8ef729233a8184","observation_id":"1689d178-78d0-42b0-b4b4-48f29e61a808","resolution":{"observed_at":"2026-07-03T07:47:44.606826Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03212","snapshot_observed_at":"2026-08-03T09:46:28.470791Z","title":"Leveraging broadcast media subtitle transcripts for automatic speech recognition and subtitling,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29299","last_updated":"2026-07-31T11:15:22Z","snapshot_observed_at":"2026-08-17T12:36:34.017179Z","submitted_at":"2026-07-31T11:15:22Z","title":"Leveraging Beam Search Information for Confidence Estimation in E2E ASR","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-03T09:46:28.470791Z"},"links":{"cited_paper":"/paper/2502.03212","citing_paper":"/paper/2607.29299"},"observation_digest":"sha256:893345d2e35f7ac67c4d3b32ec7c6e9dc1f2aa50e0fa03b1c23d236beeeb8565","observation_id":"ef4dfce7-71a1-4c08-ab3f-182a7e0eea20","resolution":{"observed_at":"2026-08-03T09:46:28.470791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2502.03212/citation-record","integrity":"/paper/2502.03212/integrity","json":"/paper/2502.03212/citation-record.json","paper":"/paper/2502.03212"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:16.725810Z","title":"Vaswani, et al., Attention is all you need, in: Proc","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.725810Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:aabddd0421f952cfec0e237b16868a353aff4ab346812bfa2c9a35193ed78c08","observation_id":"96d83ab3-ae8a-4b1f-98dd-45428e5daf89","resolution":{"observed_at":"2026-08-09T05:35:16.725810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:16.730157Z","title":"Gulati, et al., Conformer: Convolution-augmented transformer for speech recognition, in: Proc","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.730157Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:4c272808f171e06ce51ff1012efee3cd9ceb970cfce9e6a747164d6bc127e985","observation_id":"7d8ca118-e130-43f9-a835-6fd2610cbe49","resolution":{"observed_at":"2026-08-09T05:35:16.730157Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/jstsp.2022","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:17.688325Z","title":null,"venue":null,"work_id":"ab3bf639-c2d6-4aaa-b027-9c477f274763","year":2022},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.734876Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:f1572ed0538383dcc0373587c4b7a0a0bed86165984256640ad322c0857ad6ec","observation_id":"24e14718-a872-460c-a938-e223c70b9f38","resolution":{"observed_at":"2026-08-09T05:35:17.692813Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:16.739013Z","title":"Zhang, et al., Pushing the limits of semi-supervised learning for automatic speech recognition, in: Proc","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.739013Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:01224a0cd18bf1a65f33ba5066b689078b5992567e6ccffe164f0ad5c0f058a9","observation_id":"3abd4446-b803-4123-a993-2e55ed965c49","resolution":{"observed_at":"2026-08-09T05:35:16.739013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:16.743369Z","title":"Babu, et al., XLS-R: Self-supervised cross-lingual speech representation learn- ing at scale, in: Proc","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.743369Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:9df77aefbe96af52b55913b3bc6220c4a921c89d1d2fdebaa7652c80b7922898","observation_id":"784c800f-9306-4bd0-b04a-30011562bb3e","resolution":{"observed_at":"2026-08-09T05:35:16.743369Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:21.454062Z","title":null,"venue":null,"work_id":"84d38c02-af31-4470-bfd8-ce0edceeae2e","year":2024},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.747852Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:b9550c432df10bcb1b914fd9845a503ea17cc0f93031834ac389e18208bce376","observation_id":"422e05d8-0e36-4a8a-a73f-900c932d7a65","resolution":{"observed_at":"2026-08-09T05:35:21.460442Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:16.752218Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.752218Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:575a431e3d62320ef3777efaca47944c06b0c4be7585bc3966fd998be84287a4","observation_id":"29f0e01c-d379-417c-af46-7e93b445ac11","resolution":{"observed_at":"2026-08-09T05:35:16.752218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:16.760201Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.760201Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:31fa6dd3833710fc6c1f67d8dbe661de52c0845e130f430986db3c2be5c30751","observation_id":"bd9b2197-9a8b-4e27-b9da-7efaad72ae3b","resolution":{"observed_at":"2026-08-09T05:35:16.760201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:21.050387Z","title":"Mohamed, et al., Self-supervised speech representation learning: A review, IEEE Journal of Selected Topics in Signal Processing (JSTSP) 16 (6) (2022) 1179–1210","venue":null,"work_id":"fb647722-77c0-4a58-8ab0-532d37a25596","year":2022},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.764284Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:a378ba9c231b9e35beae4c072413dbc79013893d86a8232b0600890b2c0b52d2","observation_id":"53ce44a1-8c71-4893-b266-36ef49e3486f","resolution":{"observed_at":"2026-08-09T05:35:21.057100Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:16.768419Z","title":"Baevski, H","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.768419Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:7d97a27a302c33a7b09044b81e3bd63db73dc918a416b803c904f1a2f0c47763","observation_id":"a9e52600-6e4b-409d-991d-f9e5773be5ea","resolution":{"observed_at":"2026-08-09T05:35:16.768419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:20.875506Z","title":null,"venue":null,"work_id":"025f6972-177d-4a69-b7c4-640abe13a785","year":2021},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.772676Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:6c9f8f9fb11493a5c068c1311898c338f17423496c2ec8978868283a20615a7d","observation_id":"4720f6c1-2cc1-4c02-bbc9-a28635034e34","resolution":{"observed_at":"2026-08-09T05:35:20.879785Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:20.707683Z","title":"Chen, et al., WavLM: Large-scale self-supervised pre-training for full stack speech processing, IEEE Journal of Selected Topics in Signal Processing (JSTSP) 16 (6) (2022) 1505–1518","venue":null,"work_id":"9b8e3013-c879-4467-994b-8a4807f7d8c4","year":2022},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.777252Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:d67d59365ea333403a1373c93cdfa578ce49d8fbb8fc032c73a4e729a174bd8d","observation_id":"ed0cf7d2-9bff-4e6a-9849-6aefcf94fe60","resolution":{"observed_at":"2026-08-09T05:35:20.715050Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:16.781655Z","title":"Conneau, A","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.781655Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:da3a0a1aa2a7d31f3949c625cf3a039291f21e1e484623ca4a13afd69fe53ad7","observation_id":"2f84dc58-b6c8-4814-bf34-8abe29f0f02b","resolution":{"observed_at":"2026-08-09T05:35:16.781655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:16.785903Z","title":"Lee, et al., Textless speech-to-speech translation on real data, in: Proc","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.785903Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:1503b2398584355515ffd58e5fb0881b6d183d802f7f752204a73e5376208f31","observation_id":"76f9b024-03df-4676-98bc-c53e6cbfff05","resolution":{"observed_at":"2026-08-09T05:35:16.785903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:16.789599Z","title":"Chen, et al., Joint prediction and denoising for large-scale multilingual self- supervised learning, in: Proc","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.789599Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:2691eac46fb5c0f7c30e77a0f53721d314ff39a837a8523184d84be332ce4970","observation_id":"d6c7de0d-8819-4996-b58c-9f9f7dcbeed0","resolution":{"observed_at":"2026-08-09T05:35:16.789599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:16.793463Z","title":"Yang, et al., SUPERB: Speech processing universal performance benchmark, in: Proc","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.793463Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:6460ef675fe2ff801236aa41338f6ac41a70b08f65a6c19b0ea3629327ea0baf","observation_id":"a79fb3d0-0024-4dbf-b60b-380ed5f2876d","resolution":{"observed_at":"2026-08-09T05:35:16.793463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:16.801327Z","title":"Hsu, et al., Robust wav2vec 2.0: Analyzing domain shift in self- supervised pre-training, in: Proc","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.801327Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:888b10ffd94cea7c4985ba55fe95e0c40c39f5c304166ece63b15718b560e723","observation_id":"e2f5e9da-c3e3-4106-aa98-879284f5fd27","resolution":{"observed_at":"2026-08-09T05:35:16.801327Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:16.805096Z","title":"Radford, J","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.805096Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:8fb2ba3f3530beaf1d936498df235b54f3c6933f3a46b76667daa361e9b4a54b","observation_id":"b192fd3c-9a5f-47cf-9b5b-9267f0d0716b","resolution":{"observed_at":"2026-08-09T05:35:16.805096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:16.808734Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.808734Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:9d3605e7d9f99b6fdd5f9f933d86a354af9ee2d0dc105edf0b18b0560474921f","observation_id":"a8fdf3f4-2848-47fd-8776-f735d157913d","resolution":{"observed_at":"2026-08-09T05:35:16.808734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:21.731795Z","title":"Peng, et al., Reproducing Whisper-style training using an open-source toolkit and publicly available data, in: Proc","venue":null,"work_id":"c3884460-87e2-4123-99e9-ca987dbef55d","year":2023},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.812303Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:1b926ecb6d873c94a55c42969694e056e9198e2c5c0ea19c67cdbd263ee4323d","observation_id":"a5700dfc-2971-4e08-b87d-fc7c13573534","resolution":{"observed_at":"2026-08-09T05:35:21.736399Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:16.815896Z","title":"Likhomanenko, et al., Rethinking evaluation in ASR: Are our models robust enough?, in: Proc","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.815896Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:3e0febcd91f9624fe1c40dcb859abd0b0c568ca74c5b7a7a3fe284525ff17e99","observation_id":"44e4543c-7cd9-44b6-9b8d-c26b170bf064","resolution":{"observed_at":"2026-08-09T05:35:16.815896Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:21.718636Z","title":null,"venue":null,"work_id":"2b18de83-3b79-4f78-9897-3d76f48cec93","year":2014},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.819602Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:55185e49966a4e6b14ab28d9fa19e7f142bd2f9035d306b0a95990395634d855","observation_id":"c82de418-ca36-410b-8c50-666f1b179cc4","resolution":{"observed_at":"2026-08-09T05:35:21.723030Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:21.705590Z","title":"Karakanta, M","venue":null,"work_id":"ad38c76d-142b-4f01-9743-2a865d1555c4","year":2020},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.823193Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:2d5e7f86be1e350919a001af900efa6ece51ecee0c060fff22256e255a0b169f","observation_id":"84985525-aae9-4734-9fa0-adddc81176aa","resolution":{"observed_at":"2026-08-09T05:35:21.709989Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:21.692888Z","title":"Panayotov, G","venue":null,"work_id":"f97d6b77-5a5f-4f1a-9721-27724abb88a6","year":2015},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.827152Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:b7d2787bf1707e555473b14af716d0fe3a25bf0ac710035466dd1f91cfec3ab4","observation_id":"ea5dff5a-2c4d-4e5f-841f-28b8b7bf1137","resolution":{"observed_at":"2026-08-09T05:35:21.696860Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.21437/interspeech.2009-500","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":null,"work_id":"05b62666-5842-41cd-a391-8df5ec27f426","year":2009},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.831936Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:659f1750b8173a819c73952df71ff7d4579aa487d3495eb5788a8958b2ee2dd1","observation_id":"6e0d4c83-33d4-40d0-8b21-fd7a5f50e10e","resolution":{"observed_at":"2026-08-09T05:35:17.651063Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:21.680322Z","title":null,"venue":null,"work_id":"648614c4-5504-4905-b2b1-97f2c1b26c81","year":2023},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.836559Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:b405301c9ec98433454d3442b11d44079b8d9b8960bdb343144aaec04c60951c","observation_id":"acf7aa56-4fba-4eb8-84b8-6599c091b95b","resolution":{"observed_at":"2026-08-09T05:35:21.684348Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:20.433941Z","title":"Poncelet, H","venue":null,"work_id":"4ad1168c-c0b6-4221-aba6-a86a5834b4e7","year":2023},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.841061Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:8d97e8d8608acaf078131fc2c29a2a535d032c1147efb2f92f96b582c32e7e5e","observation_id":"812bf0b8-63c3-46ea-a358-78fa9b5262d0","resolution":{"observed_at":"2026-08-09T05:35:20.438385Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.21437/interspeech.2023-1655","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Ihori, H","venue":null,"work_id":"f95d1143-5bae-4aa4-9121-8c515d717341","year":2023},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.845739Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:6524a4afc2a97078d2aeb014499d29a8128efe7f76f068027930b0a2c1249caf","observation_id":"b797be2f-b78a-4559-929d-a0bbe499aa4f","resolution":{"observed_at":"2026-08-09T05:35:17.636817Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.21437/interspeech.2020-999","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Kanda, Y","venue":null,"work_id":"e7c78c40-ef71-41ae-b7d5-53f58db4ae5b","year":2020},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.850155Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:a027c8d521a25465e48e201dfdba291c6709b93c6d039264a8d9d5c935332903","observation_id":"d64167dc-1df7-4b63-8d5e-328906ee063a","resolution":{"observed_at":"2026-08-09T05:35:17.622440Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:16.854718Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.854718Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:e9561c2fd60aa6eb49894f2d0b563b5725b52a8a1eeac34126357d0fa0170ebf","observation_id":"4543b5f0-ef0a-4f6a-bd1e-573f61098781","resolution":{"observed_at":"2026-08-09T05:35:16.854718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:20.232090Z","title":"Lamel, J.-L","venue":null,"work_id":"264dcf19-524f-4ddc-a811-adc9deacf30c","year":2002},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.859336Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:4f6fe2b5832a87383bf25366ea4d04e26917a0a6c6e9002d8a2c85b885786fd3","observation_id":"007f2b20-9559-423b-9db3-8db8915edd5a","resolution":{"observed_at":"2026-08-09T05:35:20.239284Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.21437/interspeech.2016-462","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Lanchantin, et al., Selection of multi-genre broadcast data for the training of automatic speech recognition systems, in: Proc","venue":null,"work_id":"00b0b0d2-f1c7-4529-8f2d-95f82c1b06b6","year":2016},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.863753Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:c7bec15e6aabc12cefe994a35ab0f57a4fae4adf4b118f4fe42ab9127563e374","observation_id":"8a2b3ee1-902a-4f35-90b1-d557df48eff2","resolution":{"observed_at":"2026-08-09T05:35:17.598063Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1587/transinf.2019edp7234","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Bang, M.-Y","venue":"IEICE Transactions on Information and Systems","work_id":"86f48b88-590c-443a-bb5e-75264ffd392e","year":2020},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.868565Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:65d3f3b273b81f7c398f44ff54a741920a1e7e4c84f6818ac0c364076817eafe","observation_id":"4150827a-0178-42e9-9898-234d1c030d77","resolution":{"observed_at":"2026-08-09T05:35:17.583547Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:21.667735Z","title":null,"venue":null,"work_id":"c9c94693-03d9-440f-b8e6-3ca13203f5bd","year":2021},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.872979Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:aeb63d959cc9560443230986d75354f5b7e7199aeeaf093f31d899eb15502770","observation_id":"c83091e2-d785-4c28-acbc-f898b9a5b6d6","resolution":{"observed_at":"2026-08-09T05:35:21.671828Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s11042-018-6050-1","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:03:40.895421Z","title":"Saz, et al., Lightly supervised alignment of subtitles on multi-genre broadcasts, in: Multimedia Tools and Applications, Vol","venue":"Multimedia Tools and Applications","work_id":"5fd5ee0a-e491-4bbb-8f69-dba25509821e","year":2018},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.882046Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:20349cefe119c53cb7c7388b0416941c9ed3cb071a86bb36403556b3e812abd1","observation_id":"1f3f8710-c274-4074-beb0-aaf32fa993bd","resolution":{"observed_at":"2026-08-09T05:35:17.569272Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:19.840782Z","title":"Manohar, D","venue":null,"work_id":"aade513b-f3e3-4e55-8e58-4447fc223f91","year":2017},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.886550Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:0473c2bebb8e7593bd32cdde4127a660a178f424a177e4e90a10ba78ec09ea9d","observation_id":"4cc9915e-0c61-4ef1-a54e-7abb2385f23c","resolution":{"observed_at":"2026-08-09T05:35:19.848072Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:16.894902Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.894902Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:b426cbb13185b3b478e415aa863d38391f20a05e34052b25169b6044df41483d","observation_id":"7a16ad7b-6ab2-42a2-8729-b408eb17f274","resolution":{"observed_at":"2026-08-09T05:35:16.894902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:21.654762Z","title":"Geislinger, B","venue":null,"work_id":"92b95bf4-7c2b-431f-b37b-8ee1b7a25c31","year":2022},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.899439Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:a4d367779bcf34d0487f17c8174daa0a6240c9221a58085b7311e0e3ea4d5f9c","observation_id":"d7ef7bd1-4a45-4fb3-ad77-1e3addb2da00","resolution":{"observed_at":"2026-08-09T05:35:21.658953Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:21.642265Z","title":"Milde, R","venue":null,"work_id":"c84785bd-f6ce-4a7e-8832-090961286167","year":2021},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.904371Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:b9eaed942cbce6941526c44e027d4659bcc9148e3986b4d1add89b8c685250eb","observation_id":"c5479615-149f-43c6-8a00-27b7c5ebd32a","resolution":{"observed_at":"2026-08-09T05:35:21.646179Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2020.iwslt-1.30","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":null,"work_id":"1af45274-8293-49ae-b7ed-34db05a0eb83","year":2020},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.908681Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:bd072e6b5aa978d547d4a3a195f425094ee02efb71d42ada3abe77d4c76cce6e","observation_id":"0b9da4a9-44cb-418e-bfa0-e407c7d76d2f","resolution":{"observed_at":"2026-08-09T05:35:17.546485Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:20.030000Z","title":"Bell, et al., The MGB challenge: Evaluating multi-genre broadcast media recognition, in: Proc","venue":null,"work_id":"0e146ab1-af65-46f7-8fc4-b22b5ed0213d","year":2015},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.913158Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:2d9b69f07f47fea47a9da0d79e08e5920045def23180d9258523dd13ed12931f","observation_id":"420b3a61-61cc-40b1-8800-de57321790eb","resolution":{"observed_at":"2026-08-09T05:35:20.034696Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:19.678404Z","title":"Ali, et al., The MGB-2 challenge: Arabic multi-dialect broadcast media recog- nition, in: Proc","venue":null,"work_id":"626dfb10-2ba4-4c36-875e-785bf7acaff6","year":2016},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.917206Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:2317c25b77fa370c959a4dcdfb995bbf854734159cb509a0e471456cc39367a9","observation_id":"50991780-a0a8-4c48-8127-cc5f81784f31","resolution":{"observed_at":"2026-08-09T05:35:19.683071Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.3390/app9245412","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Lleida, et al., Albayzin 2018 evaluation: The IberSpeech-RTVE challenge on speech technologies for Spanish broadcast media, Applied Sciences 9 (24) (2019)","venue":"Applied Sciences","work_id":"85be2bd0-d0ed-4f26-b2c8-27dfd99491a0","year":2019},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.921566Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:b07d92400539acb28e1793753115ee4e35d2a4a6e9f48eb94fb1f22dec7ce42d","observation_id":"2e99c9e3-96cc-4254-b5d3-2c18a0df88f2","resolution":{"observed_at":"2026-08-09T05:35:17.532850Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/icalt.2017.11","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":null,"work_id":"e9a9e9ed-7442-4167-bf85-0923a5deef82","year":2017},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.926068Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:5714e0078bfe3e3d7524226078d41564460ab186dc4a1983c289b509d054e0ec","observation_id":"8688859f-d60e-43ea-9b32-fc7dff549b46","resolution":{"observed_at":"2026-08-09T05:35:17.518621Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:16.930360Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.930360Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:3dcbc37b443e1c4f6c82b6121b5eb1f839daa22fe5d4a557d1f511d7f7ac78a3","observation_id":"03e81ea7-8cb9-40a5-95bd-8df5444ef055","resolution":{"observed_at":"2026-08-09T05:35:16.930360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:21.628787Z","title":"K¨ urzinger, D","venue":null,"work_id":"a0c30f59-b2f0-4812-82f6-9e182b5eac39","year":2020},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.934703Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:2e8652da7b5d053d0f17391688f43b8df5f394f7913b98bbc0258205b114e4d7","observation_id":"940c72d7-f412-4de6-9f37-8a5ffebd1e0f","resolution":{"observed_at":"2026-08-09T05:35:21.633588Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:21.616013Z","title":"Ihori, A","venue":null,"work_id":"e3c52a7e-05d1-4ded-a022-abd3bbb5b631","year":2020},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.939184Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:21fef8835a4b4f40381f2ad484e356ba45d1e87279eef4a04b173f4048b628dd","observation_id":"c8a29664-ef87-4e27-8136-afdfe50c7ac9","resolution":{"observed_at":"2026-08-09T05:35:21.620011Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:16.943423Z","title":"Liao, et al., Improving readability for automatic speech recognition transcrip- tion, ACM Trans","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.943423Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:5dc478140fae75aa27d8d4023e1a9f6881724d7f49f577e01d986f53d0693079","observation_id":"b396845e-8f93-47d9-a00c-605811016cd0","resolution":{"observed_at":"2026-08-09T05:35:16.943423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.21437/interspeech.2022-5","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Nozaki, T","venue":"Interspeech 2022","work_id":"e61528e5-c15d-46d2-ae80-c0c5038f4a1e","year":2022},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.947761Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:0dab2c997f4db7b4f9aeff4b3335d59d7dd6bf5365608da9fef46bf67a846d31","observation_id":"f4712622-d255-487f-a102-f4cf07553ac5","resolution":{"observed_at":"2026-08-09T05:35:17.486104Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:21.603499Z","title":"Futami, et al., Streaming joint speech recognition and disfluency detection, in: Proc","venue":null,"work_id":"4521a2ee-6b94-42d5-b6fa-0a50c0ee0eb0","year":null},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.951996Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:cd4cedc3829a32dc073a3d3ff4a401cb0a61171bd0543f0815fea5c4c63e2d4e","observation_id":"8442b7fa-7e19-451f-99fe-54d670271be9","resolution":{"observed_at":"2026-08-09T05:35:21.607613Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:21.589839Z","title":null,"venue":null,"work_id":"a2797016-1f51-46a1-8992-a1e04c43575b","year":2022},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.964271Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:b403d6aca22b205759895211f05211bfe4301379e98bb85c431b910a807700db","observation_id":"f7d97822-1b18-4908-91e2-4132c3135793","resolution":{"observed_at":"2026-08-09T05:35:21.594300Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:19.193328Z","title":null,"venue":null,"work_id":"f608d158-1ee9-4dfb-ba42-dd2148b1e12d","year":2019},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.967931Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:e52e42bb176693fe5d0be5b3ea6760c91095cd63a71e58ac811a77182e419874","observation_id":"baa67062-d803-4563-ba82-56f736ab9580","resolution":{"observed_at":"2026-08-09T05:35:19.197359Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:16.971765Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.971765Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:5176e320158fca62ec2787ef884403b124a640827570f17de21d47dc04179369","observation_id":"a8bf5b1b-4f29-49ef-9971-cf1b43467cca","resolution":{"observed_at":"2026-08-09T05:35:16.971765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:16.975749Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.975749Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:86e77a4545c74673a44b4721e08f579e766153ae7d4cdadb39e33a70122077bd","observation_id":"884729ee-0db3-4b1d-99b1-dc711a040e99","resolution":{"observed_at":"2026-08-09T05:35:16.975749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:21.576801Z","title":"Pratap, A","venue":null,"work_id":"f3b32194-7b20-44ff-912f-8c7e3e4bb508","year":2022},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.979336Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:bec8a42622f20d8a23646acc9b1005c0d59b2bf6d8bc9df27da6dae4741c2936","observation_id":"16a5e9c0-b6c5-4349-89b5-16108315ca64","resolution":{"observed_at":"2026-08-09T05:35:21.581062Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:18.789050Z","title":"Singh, et al., Training ASR models by generation of contextual information, in: Proc","venue":null,"work_id":"d0ecb2fd-4ef8-42c9-8ca0-4182d85a8fbe","year":2020},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.986972Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:dca9231515e37ea5699aef7d13aceea76690a75b3af3878db20e271eab27d5f1","observation_id":"87163399-5769-4786-b800-d7fcf5532946","resolution":{"observed_at":"2026-08-09T05:35:18.793958Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:16.990540Z","title":"Chen, et al., GigaSpeech: An evolving, multi-domain ASR corpus with 10,000 hours of transcribed audio, in: Proc","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.990540Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:0838d2a937901d94ed2e345293f78e8537d10a251cfd1d54db6e851d52a69bb8","observation_id":"af116292-01e6-412f-842e-089e27b6ca07","resolution":{"observed_at":"2026-08-09T05:35:16.990540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:19.012368Z","title":"Zhang, et al., WenetSpeech: A 10000+ hours multi-domain Mandarin corpus for speech recognition, in: Proc","venue":null,"work_id":"022b79a8-6331-4d56-9393-6eb1ef98e114","year":2022},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.994122Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:f03405efb0355dd297c3de1047fc5e46e828acfbac9cabf6a2a018959eded094","observation_id":"e03ab794-c195-4f3c-9404-5624e67aea9f","resolution":{"observed_at":"2026-08-09T05:35:19.016559Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:21.563794Z","title":"Galvez, et al., The People’s Speech: A large-scale diverse English speech recog- nition dataset for commercial usage, in: Proc","venue":null,"work_id":"38c41dbc-6603-4c6a-bc03-e25996fe9bb8","year":2021},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.997631Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:39df5264182fe1570c1ca6ce1ff8946eb91587fa6547a500ac6f847b097fdaa8","observation_id":"fcecca53-784c-4a4c-b0a3-5413ae106a8d","resolution":{"observed_at":"2026-08-09T05:35:21.568320Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2022.iwslt-1.1","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Wilken, P","venue":null,"work_id":"9855e439-9520-4634-bc34-0659b0cd2506","year":2022},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:17.001931Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:295dcf218eb76f7fe6d87cf3a68d31ab88ad32d80ae8ae90ac408c8a2df077bf","observation_id":"567512e1-df3d-4b16-96f5-8bc86b2d51c3","resolution":{"observed_at":"2026-08-09T05:35:17.446118Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:21.550408Z","title":"Karakanta, F","venue":null,"work_id":"53b378a9-0251-4ac2-8332-009f39099097","year":2022},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:17.006133Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:1930439e9a7c6c63e66a25bda7c2b22c3b43979e5cdd013b3c20017b470faaca","observation_id":"6bdd08f2-0234-4545-9a95-b8ff3fcbc6a2","resolution":{"observed_at":"2026-08-09T05:35:21.554541Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:18.618187Z","title":"Graves, S","venue":null,"work_id":"3c2dbf79-fe18-45f0-8d7f-5c066d6eb9cf","year":2006},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:17.010231Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:22b7a489f1a5299a6eda1302355279134eedf0c6df9f08517fe8b18ab3256880","observation_id":"a2e4e9ac-287b-4c99-919e-7c53eab4af2a","resolution":{"observed_at":"2026-08-09T05:35:18.622487Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:19.233760Z","title":null,"venue":null,"work_id":"84d89762-57a4-4282-8fd8-66c00fb60e75","year":2021},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:17.014294Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:762ebad76849f9a56f86660d5d828642795b6d6f401dd1971bcbe57235c07e9b","observation_id":"b37e9156-5903-44b2-a819-aceab2252bfc","resolution":{"observed_at":"2026-08-09T05:35:19.238656Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/jstsp.2017","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:17.427470Z","title":"Watanabe, T","venue":null,"work_id":"135799e9-cf8f-46be-8842-8ae1154da29c","year":2017},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:17.018148Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:322d19afe9be671562769a08cb7957f8a4e63260318a1b32f3c10ac3a91dd56a","observation_id":"54a2cd2f-1fa3-4038-8805-58545138957a","resolution":{"observed_at":"2026-08-09T05:35:17.432021Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:17.022203Z","title":"Szegedy, V","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:17.022203Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:b2b84dbf0d76d71961ca272940376159ecfefb417f048e893a1eaa5cece6c1bd","observation_id":"f3ee9381-815e-43ba-b54f-3ce519bee488","resolution":{"observed_at":"2026-08-09T05:35:17.022203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/n18-1008","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Anastasopoulos, D","venue":null,"work_id":"c0fc201d-facd-46b4-937d-649902a656a6","year":2018},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:17.026357Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:58a0a3117984a5aee8d0090435600de2b0b6665203016108eccef9850ef216d9","observation_id":"5f69d00c-1829-4062-bbb6-1c4f0e35fb19","resolution":{"observed_at":"2026-08-09T05:35:17.304754Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:21.213236Z","title":"Inaguma, S","venue":null,"work_id":"8c553fde-6ed2-43e0-a4d3-d0e2731e9c05","year":2021},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:17.030590Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:fc19f8d4d80e93dbbd178f264f71029033604bcfd6ea31c93682cffefd74a595","observation_id":"2e56307d-c4f4-4fc3-827e-3f3945c99b56","resolution":{"observed_at":"2026-08-09T05:35:21.217713Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:17.034741Z","title":"Dalmia, B","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:17.034741Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:f3f9e425bc54d12b379bc939b9fe9c32473718990f7cfd8944afa9cedd302ae1","observation_id":"181b0938-a26b-4160-b35b-dacdfcca71f1","resolution":{"observed_at":"2026-08-09T05:35:17.034741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/w18-6441","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:17.275764Z","title":"Helcl, J","venue":null,"work_id":"a56d5f00-7dee-46bf-8b2f-f33590fd664a","year":2018},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:17.039099Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:2ff5ad80c552c7e00abfa4f0cbff7f8c1381912abe0fa02b82e1ea85423f1466","observation_id":"9c3a22a3-a619-4762-bd2d-21d75262cb74","resolution":{"observed_at":"2026-08-09T05:35:17.280971Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2021.findings-acl.92","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Chuang, Y.-S","venue":null,"work_id":"3fd9907f-0c07-4447-9560-61d38a48015b","year":2021},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:17.043400Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:fe3ed349ff396d761f5571ee06d8224ef81f46bd7f8fc7c4e48873068b5529b3","observation_id":"635d132d-3056-4ad4-ab1d-d706eaff5e8f","resolution":{"observed_at":"2026-08-09T05:35:17.265773Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:17.047616Z","title":"Yan, et al., CTC alignments improve autoregressive translation, in: Proc","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:17.047616Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:8d869e4281d7168855043fc3e6b27f99327928502ff0d13fe49946106dc18c7d","observation_id":"61564bde-bb2b-4b58-adb1-1a212e03c2bb","resolution":{"observed_at":"2026-08-09T05:35:17.047616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:21.536461Z","title":"Oostdijk, The Spoken Dutch Corpus: Overview and first evaluation, in: Proc","venue":null,"work_id":"0bc46ea1-6c0d-49fb-8d25-2bec1d6c3ab7","year":2000},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:17.051875Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:710af7df50aac31f217552facafed867e4aa6b83b202303dc85326a10801e78a","observation_id":"55be5d33-74b9-4c54-bcef-b252aab661ae","resolution":{"observed_at":"2026-08-09T05:35:21.541336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:21.522927Z","title":null,"venue":null,"work_id":"8c3223f6-b366-4357-a228-1b1294c03220","year":2015},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:17.055956Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:96047366bec31966343b680b65d0e5b421093265a1b4cfdbecf59a723494add4","observation_id":"b6484693-bacd-40a0-b0f7-ace3cd115c0e","resolution":{"observed_at":"2026-08-09T05:35:21.527184Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:18.372669Z","title":"Poncelet, H","venue":null,"work_id":"19d928f9-2ad1-4d33-9459-cdbecdca0718","year":2021},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:17.060102Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:8034b10eb2a658b426b705c9d1a286cb38829333be67411912cce2865b7af925","observation_id":"83785356-d005-4427-867a-02703467a573","resolution":{"observed_at":"2026-08-09T05:35:18.377761Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:17.064170Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:17.064170Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:8e87a7096e47696a5a7a8ca417b40496b2179febf87ced638d9f42dc2e70da2f","observation_id":"21894ac3-d522-4ac0-94c6-e7014fc543c4","resolution":{"observed_at":"2026-08-09T05:35:17.064170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:17.068546Z","title":"Watanabe, et al., ESPnet: End-to-end speech processing toolkit, in: Proc","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:17.068546Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:f803fb5b3a91501f6588850951c111099b0e2efd941d248e934c6892d1e1eff6","observation_id":"3afdac8a-28b7-4606-b7ae-fef5e8ebb9ac","resolution":{"observed_at":"2026-08-09T05:35:17.068546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-08-17T19:26:44.032537Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-09T05:35:17.072613Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:17.072613Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:94dc905df03e281828452423e9f57d0a34652a97a187f6f461b036456f3fd08e","observation_id":"94edfb93-b653-4c87-a3de-f817a9c30429","resolution":{"observed_at":"2026-08-09T05:35:17.072613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:18.185336Z","title":"Papineni, S","venue":null,"work_id":"2e4ade0a-1ff0-42c7-b9af-307195e51644","year":2002},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:17.077003Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:8bd29bd10141fcf6ee29cb7d1db5b81fff7247e131b6011438fd0341e8851221","observation_id":"988a5fa6-1e5a-478c-9f1c-b5e6ada69937","resolution":{"observed_at":"2026-08-09T05:35:18.190490Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:21.509441Z","title":"Post, A call for clarity in reporting BLEU scores, in: Proc","venue":null,"work_id":"cc50bb7c-704c-4ee4-8c66-d9aa4f1fe804","year":2018},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:17.081057Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:2613fd44d51ffc1d40da5492856a930d75d0549b36a4d3e0f3b74c4d614c8896","observation_id":"253336d9-1f75-4989-9e20-9237d21a1e75","resolution":{"observed_at":"2026-08-09T05:35:21.513886Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:17.964235Z","title":"Pallet, W","venue":null,"work_id":"8db5c6ea-0bed-4004-a28f-a483ec34a269","year":1990},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:17.085445Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:75138387864aceb63ce7bc6e1de6494437ed93e2c22dc0f2de6f39dfab9a8b84","observation_id":"67afc8c0-3e37-4f2f-80e1-055120aec80f","resolution":{"observed_at":"2026-08-09T05:35:17.968914Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:21.496036Z","title":"Koehn, Statistical significance tests for machine translation evaluation, in: Proc","venue":null,"work_id":"2d71e865-52a7-44cf-a47a-bd486a91f0f2","year":2004},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:17.089560Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:bd5e4c3d4364eb525d95412593fdef131036682ca398b051bca1c49aa41c9c8d","observation_id":"497fb432-5ef4-406c-a21c-5cdd0677b684","resolution":{"observed_at":"2026-08-09T05:35:21.500518Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1075/prag.19.4.05van","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Vandekerckhove, A","venue":"Pragmatics Quarterly Publication of the International Pragmatics Association (IPrA)","work_id":"bf799331-43d2-4eb5-8d1d-0285a6a2acf6","year":2009},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:17.093677Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:425d7b5139f6b9d391ad3c4647bb91202cbdde26028b7e21ed02092449cb7f97","observation_id":"fe4d05b1-2b5e-4958-a0b8-c910e5e57692","resolution":{"observed_at":"2026-08-09T05:35:17.223060Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:21.482869Z","title":"Remael, A","venue":null,"work_id":"e1652e99-6df5-41c0-9c28-b3b140e4acae","year":2008},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:17.097830Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:733bffca05addd996b3edf2a53d575d67dbb4ced8aa4694a07616401f8f9a388","observation_id":"58128afc-fa9a-45c5-b54e-bd481acba847","resolution":{"observed_at":"2026-08-09T05:35:21.487089Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.5117/tet2018.2.prie","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Prieels, G","venue":"Taal en tongval","work_id":"d13164e2-bd0e-401c-af6b-11ffcafa813a","year":2018},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:17.102079Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:f6aa27873ca5dff68fa403d7e9d989f5650711c9a1a29f3d0706fbf4fe0f112d","observation_id":"4e595ec4-da70-4fd7-b20b-28aaa947a077","resolution":{"observed_at":"2026-08-09T05:35:17.209330Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1515/ijsl","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Vandekerckhove, Dialect loss and dialect vitality in Flanders, Int","venue":"International Journal of the Sociology of Language","work_id":"c6fd6a18-0375-41cf-93f2-c4631ce29263","year":2009},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:17.106279Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:0e9fca7383514e2476acc9ef80240ef16fb2400161f0af419bbe7bfdb1c5199f","observation_id":"68e2e8db-5691-4fef-9c5c-e9ce888b69ce","resolution":{"observed_at":"2026-08-09T05:35:17.195611Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1515/9783110925463.189","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Vandekerckhove, ’Tussentaal’ as a source of change from below in Belgian Dutch","venue":null,"work_id":"144f37b6-8d18-4360-a48d-72b88cee66df","year":2000},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:17.110628Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:58e7197ba87d103a292b03f8c1e1377d0df2f9bbd33631186339b2da4071aad2","observation_id":"bf060e5c-e79a-4dd8-a697-f3978b8c8815","resolution":{"observed_at":"2026-08-09T05:35:17.181740Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.21437/interspeech.2019-1943","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":null,"work_id":"3f06487d-c3e3-4fae-8349-88305dca6780","year":2019},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:17.114775Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:e25023a65d48938485ee20d99c9521bd99babf01e19fddf1c3bc18f5ba3ec199","observation_id":"4ade18b8-a748-4ea8-a853-206b317087ed","resolution":{"observed_at":"2026-08-09T05:35:17.167273Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:21.469539Z","title":"Kanda, et al., Streaming multi-talker ASR with token-level serialized out- put training, in: Proc","venue":null,"work_id":"ab9d4601-fa4c-4b6c-a668-8e37abbb8ee8","year":2022},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:17.118841Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:926c25af77b218c6125ba757c7e13596c352d034e1c4e45b0fb7aca98d97bc24","observation_id":"99cd9519-3c1a-420a-a1ae-14dc17d18c15","resolution":{"observed_at":"2026-08-09T05:35:21.473887Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.09688","last_updated":"2025-01-24T07:10:48Z","snapshot_observed_at":"2026-08-16T13:25:38.967985Z","submitted_at":"2024-08-19T03:53:48Z","title":"Recording for Eyes, Not Echoing to Ears: Contextualized Spoken-to-Written Conversion of ASR Transcripts","version":4},"cited_work":{"arxiv_id":"2408.09688","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.09688","snapshot_observed_at":"2026-08-09T05:35:17.737993Z","title":"Recording for Eyes, Not Echoing to Ears: Contextualized Spoken-to-Written Conversion of ASR Transcripts","venue":"cs.CL","work_id":"9fe4dffc-bee5-4f57-a707-2bd62b89b5f0","year":2024},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:17.122793Z"},"links":{"cited_paper":"/paper/2408.09688","citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:3c54a7a0cde6aa25abffab673880940a96abc570572ffa52012220294c2e683d","observation_id":"e9c92960-e112-4fcc-a329-880534e76bb7","resolution":{"observed_at":"2026-08-09T05:35:17.743633Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-09T05:35:17.126842Z","title":"Dubey, et al., The Llama 3 herd of models (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:17.126842Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:18d7397fc2735f7911e613ce3b133a28dc3877a8c95051fb9fe9efa632d37387","observation_id":"5c8bde27-d8d2-43ef-a21d-078717599f82","resolution":{"observed_at":"2026-08-09T05:35:17.126842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-08-17T20:30:34.016254Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-09T05:35:17.130966Z","title":"ge”, common in spoken lan- guage, is translated to “je","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:17.130966Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:2fcbc6cb912c2cb636e5e22af1fe99f5f88dcbfcb37ecee4fa32c2eea4ed26fb","observation_id":"35b5836b-427c-4db4-a243-e018a5f69098","resolution":{"observed_at":"2026-08-09T05:35:17.130966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:35:19.435198Z","title":null,"venue":null,"work_id":"1575dfac-0247-47c6-a226-ffec415e0463","year":2023},"citing_paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-09T05:35:16.956343Z"},"links":{"citing_paper":"/paper/2502.03212"},"observation_digest":"sha256:e5944dc31cecb6ee9ae97af0beb2128fbd51aee29212cec73eac51ce5bdaf833","observation_id":"96e77dc9-ebcf-41b2-bad0-070406b89d5e","resolution":{"observed_at":"2026-08-09T05:35:19.439828Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.03212","last_updated":"2025-02-05T14:26:58Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-12T03:57:48.700278Z","submitted_at":"2025-02-05T14:26:58Z","title":"Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling"},"reference_resolution":{"displayed":92,"state_counts":{"malformed_identifier":7,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":40,"verified_fuzzy":15},"total_outbound_references":92},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 92 of 92 outbound references and 2 inbound Pith citation observations for arXiv:2502.03212."}