{"record_type":"pith_number_record","schema_url":"https://pith.science/schemas/pith-number/v1.json","pith_number":"pith:2025:X3VTNT6J6UEPVERXLILRY3E5YM","short_pith_number":"pith:X3VTNT6J","schema_version":"1.0","canonical_sha256":"beeb36cfc9f508fa92375a171c6c9dc309a5ec84322b1ae6cf399f3bfb2cf0ec","source":{"kind":"arxiv","id":"2502.20311","version":1},"attestation_state":"computed","paper":{"title":"Adapting Automatic Speech Recognition for Accented Air Traffic Control Communications","license":"http://creativecommons.org/licenses/by/4.0/","headline":"","cross_cats":["cs.SD","eess.AS"],"primary_cat":"cs.LG","authors_text":"Aloysius Keng Siew Han, Dillion Lim, En Hao Tew, Joe Yu Wei Tan, Justin Juin Hng Wong, Lynus Lim, Marcus Yu Zhe Wee, Prannaya Gupta, Yong Zhi Lim","submitted_at":"2025-02-27T17:35:59Z","abstract_excerpt":"Effective communication in Air Traffic Control (ATC) is critical to maintaining aviation safety, yet the challenges posed by accented English remain largely unaddressed in Automatic Speech Recognition (ASR) systems. Existing models struggle with transcription accuracy for Southeast Asian-accented (SEA-accented) speech, particularly in noisy ATC environments. This study presents the development of ASR models fine-tuned specifically for Southeast Asian accents using a newly created dataset. Our research achieves significant improvements, achieving a Word Error Rate (WER) of 0.0982 or 9.82% on SE"},"verification_status":{"content_addressed":true,"pith_receipt":true,"author_attested":false,"weak_author_claims":0,"strong_author_claims":0,"externally_anchored":false,"storage_verified":false,"citation_signatures":0,"replication_records":0,"graph_snapshot":true,"references_resolved":false,"formal_links_present":false},"canonical_record":{"source":{"id":"2502.20311","kind":"arxiv","version":1},"metadata":{"license":"http://creativecommons.org/licenses/by/4.0/","primary_cat":"cs.LG","submitted_at":"2025-02-27T17:35:59Z","cross_cats_sorted":["cs.SD","eess.AS"],"title_canon_sha256":"e1679b8315e2441a9ca0fbe85ef7b6049fbb7ff336bf52e4e28163cc60e9dc8b","abstract_canon_sha256":"931a30fd74ebd9c06c248c475886d85477afe171fa6cde878893a011ca8ff8e4"},"schema_version":"1.0"},"receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-07-05T10:21:12.846346Z","signature_b64":"oMZdhu0YE1fWdXaJqpojtnXOY52AoM2YwPpDnEOAgTxNclwvNsk6fXMgbmVt4fU3vk0KXL1HEm9hJWkgrZg2Bg==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"beeb36cfc9f508fa92375a171c6c9dc309a5ec84322b1ae6cf399f3bfb2cf0ec","last_reissued_at":"2026-07-05T10:21:12.845108Z","signature_status":"signed_v1","first_computed_at":"2026-07-05T10:21:12.845108Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"graph_snapshot":{"paper":{"title":"Adapting Automatic Speech Recognition for Accented Air Traffic Control Communications","license":"http://creativecommons.org/licenses/by/4.0/","headline":"","cross_cats":["cs.SD","eess.AS"],"primary_cat":"cs.LG","authors_text":"Aloysius Keng Siew Han, Dillion Lim, En Hao Tew, Joe Yu Wei Tan, Justin Juin Hng Wong, Lynus Lim, Marcus Yu Zhe Wee, Prannaya Gupta, Yong Zhi Lim","submitted_at":"2025-02-27T17:35:59Z","abstract_excerpt":"Effective communication in Air Traffic Control (ATC) is critical to maintaining aviation safety, yet the challenges posed by accented English remain largely unaddressed in Automatic Speech Recognition (ASR) systems. Existing models struggle with transcription accuracy for Southeast Asian-accented (SEA-accented) speech, particularly in noisy ATC environments. This study presents the development of ASR models fine-tuned specifically for Southeast Asian accents using a newly created dataset. Our research achieves significant improvements, achieving a Word Error Rate (WER) of 0.0982 or 9.82% on SE"},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2502.20311","kind":"arxiv","version":1},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2502.20311/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"aliases":[{"alias_kind":"arxiv","alias_value":"2502.20311","created_at":"2026-07-05T10:21:12.845169+00:00"},{"alias_kind":"arxiv_version","alias_value":"2502.20311v1","created_at":"2026-07-05T10:21:12.845169+00:00"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2502.20311","created_at":"2026-07-05T10:21:12.845169+00:00"},{"alias_kind":"pith_short_12","alias_value":"X3VTNT6J6UEP","created_at":"2026-07-05T10:21:12.845169+00:00"},{"alias_kind":"pith_short_16","alias_value":"X3VTNT6J6UEPVERX","created_at":"2026-07-05T10:21:12.845169+00:00"},{"alias_kind":"pith_short_8","alias_value":"X3VTNT6J","created_at":"2026-07-05T10:21:12.845169+00:00"}],"events":[],"event_summary":{},"paper_claims":[],"inbound_citations":{"count":2,"internal_anchor_count":0,"sample":[{"citing_arxiv_id":"2606.22399","citing_title":"ATCCaps: A Call-Sign-Aware Speech Dataset for Air Traffic Control Recognition","ref_index":4,"is_internal_anchor":false},{"citing_arxiv_id":"2605.11769","citing_title":"Safety-Oriented Evaluation of Language Understanding Systems for Air Traffic Control","ref_index":10,"is_internal_anchor":false}]},"formal_canon":{"evidence_count":0,"sample":[],"anchors":[]},"links":{"html":"https://pith.science/pith/X3VTNT6J6UEPVERXLILRY3E5YM","json":"https://pith.science/pith/X3VTNT6J6UEPVERXLILRY3E5YM.json","graph_json":"https://pith.science/api/pith-number/X3VTNT6J6UEPVERXLILRY3E5YM/graph.json","events_json":"https://pith.science/api/pith-number/X3VTNT6J6UEPVERXLILRY3E5YM/events.json","paper":"https://pith.science/paper/X3VTNT6J"},"agent_actions":{"view_html":"https://pith.science/pith/X3VTNT6J6UEPVERXLILRY3E5YM","download_json":"https://pith.science/pith/X3VTNT6J6UEPVERXLILRY3E5YM.json","view_paper":"https://pith.science/paper/X3VTNT6J","resolve_alias":"https://pith.science/api/pith-number/resolve?arxiv=2502.20311&json=true","fetch_graph":"https://pith.science/api/pith-number/X3VTNT6J6UEPVERXLILRY3E5YM/graph.json","fetch_events":"https://pith.science/api/pith-number/X3VTNT6J6UEPVERXLILRY3E5YM/events.json","actions":{"anchor_timestamp":"https://pith.science/pith/X3VTNT6J6UEPVERXLILRY3E5YM/action/timestamp_anchor","attest_storage":"https://pith.science/pith/X3VTNT6J6UEPVERXLILRY3E5YM/action/storage_attestation","attest_author":"https://pith.science/pith/X3VTNT6J6UEPVERXLILRY3E5YM/action/author_attestation","sign_citation":"https://pith.science/pith/X3VTNT6J6UEPVERXLILRY3E5YM/action/citation_signature","submit_replication":"https://pith.science/pith/X3VTNT6J6UEPVERXLILRY3E5YM/action/replication_record"}},"created_at":"2026-07-05T10:21:12.845169+00:00","updated_at":"2026-07-05T10:21:12.845169+00:00"}