{"as_of":"2026-08-21T05:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:044aacdad1d7aeb27a420b532e45b362fb7711510cba9acd3dd6b95eb798fb19","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-26T10:01:20.174755Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.22399/citation-record","integrity":"/paper/2606.22399/integrity","json":"/paper/2606.22399/citation-record.json","paper":"/paper/2606.22399"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T10:01:20.174755Z","title":"Spoken instruction understanding in air traffic control: Chal- lenge, technique, and application,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.22399","last_updated":"2026-06-21T09:06:30Z","snapshot_observed_at":"2026-08-14T10:09:13.976067Z","submitted_at":"2026-06-21T09:06:30Z","title":"ATCCaps: A Call-Sign-Aware Speech Dataset for Air Traffic Control Recognition","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-26T10:01:20.174755Z"},"links":{"citing_paper":"/paper/2606.22399"},"observation_digest":"sha256:9f51816a01185dbd74b66f65dd5d4e0f0cff3837cf7868b205510f54b9900c4b","observation_id":"dbe5ecd8-b6a9-4120-99f6-f62431a9f09c","resolution":{"observed_at":"2026-06-26T10:01:20.174755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T10:01:20.174755Z","title":"Automatic speech recognition for air traffic control communications,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.22399","last_updated":"2026-06-21T09:06:30Z","snapshot_observed_at":"2026-08-14T10:09:13.976067Z","submitted_at":"2026-06-21T09:06:30Z","title":"ATCCaps: A Call-Sign-Aware Speech Dataset for Air Traffic Control Recognition","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-26T10:01:20.174755Z"},"links":{"citing_paper":"/paper/2606.22399"},"observation_digest":"sha256:88ebb73e153b70021e464fee42ef16819ff050c7bdb03e7962a7fc00a668d03e","observation_id":"888b74a6-7350-45cf-a347-d8b05578666d","resolution":{"observed_at":"2026-06-26T10:01:20.174755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T10:01:20.174755Z","title":"Speech recognition for air traffic control via feature learning and end-to-end training,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.22399","last_updated":"2026-06-21T09:06:30Z","snapshot_observed_at":"2026-08-14T10:09:13.976067Z","submitted_at":"2026-06-21T09:06:30Z","title":"ATCCaps: A Call-Sign-Aware Speech Dataset for Air Traffic Control Recognition","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-26T10:01:20.174755Z"},"links":{"citing_paper":"/paper/2606.22399"},"observation_digest":"sha256:bcffd520edd14e405c4f8a5de2685f23d767ed952a14acf76b46ec8dfe2f66dc","observation_id":"28ee18dc-3881-44e0-bcc0-9af6a73b50e1","resolution":{"observed_at":"2026-06-26T10:01:20.174755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20311","last_updated":"2025-02-27T17:35:59Z","snapshot_observed_at":"2026-08-16T12:54:33.293754Z","submitted_at":"2025-02-27T17:35:59Z","title":"Adapting Automatic Speech Recognition for Accented Air Traffic Control Communications","version":1},"cited_work":{"arxiv_id":"2502.20311","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.20311","snapshot_observed_at":"2026-07-04T09:29:43.396832Z","title":"Adapting automatic speech recognition for accented air traffic control communications","venue":null,"work_id":"cc85baf3-cdec-4c11-afca-033a7421c33c","year":2025},"citing_paper":{"arxiv_id":"2606.22399","last_updated":"2026-06-21T09:06:30Z","snapshot_observed_at":"2026-08-14T10:09:13.976067Z","submitted_at":"2026-06-21T09:06:30Z","title":"ATCCaps: A Call-Sign-Aware Speech Dataset for Air Traffic Control Recognition","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-26T10:01:20.174755Z"},"links":{"cited_paper":"/paper/2502.20311","citing_paper":"/paper/2606.22399"},"observation_digest":"sha256:4b7f6b125c29c4f0a8b069302a09ab100d059a4d807f9b492b61cacaee1bbcb7","observation_id":"94fd39ee-0a76-4e60-b94c-e061c7bb171f","resolution":{"observed_at":"2026-07-04T09:29:43.398662Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T10:01:20.174755Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech representations,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.22399","last_updated":"2026-06-21T09:06:30Z","snapshot_observed_at":"2026-08-14T10:09:13.976067Z","submitted_at":"2026-06-21T09:06:30Z","title":"ATCCaps: A Call-Sign-Aware Speech Dataset for Air Traffic Control Recognition","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-26T10:01:20.174755Z"},"links":{"citing_paper":"/paper/2606.22399"},"observation_digest":"sha256:ce8a3a9ab474532aa2e5136c373f03536c30f575480728a8c02c83bda3d4375e","observation_id":"d6d003c7-7b95-4b82-8c00-f56167e9af4d","resolution":{"observed_at":"2026-06-26T10:01:20.174755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T10:01:20.174755Z","title":"Hubert: Self-supervised speech representation learning by masked prediction of hidden units,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.22399","last_updated":"2026-06-21T09:06:30Z","snapshot_observed_at":"2026-08-14T10:09:13.976067Z","submitted_at":"2026-06-21T09:06:30Z","title":"ATCCaps: A Call-Sign-Aware Speech Dataset for Air Traffic Control Recognition","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-26T10:01:20.174755Z"},"links":{"citing_paper":"/paper/2606.22399"},"observation_digest":"sha256:ae52759851cae7e06886a64dc3c98f5af9ec2e2a523ba5fd6d2528a8e4dc00eb","observation_id":"c8cca48f-cffc-4efc-88f8-d9726838196b","resolution":{"observed_at":"2026-06-26T10:01:20.174755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T10:01:20.174755Z","title":"Robust speech recognition via large-scale weak super- vision,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.22399","last_updated":"2026-06-21T09:06:30Z","snapshot_observed_at":"2026-08-14T10:09:13.976067Z","submitted_at":"2026-06-21T09:06:30Z","title":"ATCCaps: A Call-Sign-Aware Speech Dataset for Air Traffic Control Recognition","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-26T10:01:20.174755Z"},"links":{"citing_paper":"/paper/2606.22399"},"observation_digest":"sha256:12c86bfc7e2bee2ff6bcaccd3eef6177864264d9f89fd736da7c6d6c04132480","observation_id":"ba00103d-4acd-496f-b0c3-ffbbadbc3cf1","resolution":{"observed_at":"2026-06-26T10:01:20.174755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T10:01:20.174755Z","title":"Fused acoustic and text encoding for multimodal bilingual pretraining and speech translation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.22399","last_updated":"2026-06-21T09:06:30Z","snapshot_observed_at":"2026-08-14T10:09:13.976067Z","submitted_at":"2026-06-21T09:06:30Z","title":"ATCCaps: A Call-Sign-Aware Speech Dataset for Air Traffic Control Recognition","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-26T10:01:20.174755Z"},"links":{"citing_paper":"/paper/2606.22399"},"observation_digest":"sha256:4ae2ceb690339137183b3148fcc5a40a6c59eb9dcf84b7b83e29e4b5e24fabb8","observation_id":"700da795-ea13-45ce-8857-e2a4b47d3c11","resolution":{"observed_at":"2026-06-26T10:01:20.174755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T10:01:20.174755Z","title":"Speechlm: Enhanced speech pre-training with unpaired textual data,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.22399","last_updated":"2026-06-21T09:06:30Z","snapshot_observed_at":"2026-08-14T10:09:13.976067Z","submitted_at":"2026-06-21T09:06:30Z","title":"ATCCaps: A Call-Sign-Aware Speech Dataset for Air Traffic Control Recognition","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-26T10:01:20.174755Z"},"links":{"citing_paper":"/paper/2606.22399"},"observation_digest":"sha256:4f882c8f16d5cc3ec8d53be1f3a37e7a70882e55820792a9ea4e90530ac44fa5","observation_id":"77bc2267-3fa3-48af-b2d4-147b28ca5fac","resolution":{"observed_at":"2026-06-26T10:01:20.174755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T10:01:20.174755Z","title":"Large-scale contrastive language-audio pretraining with feature fusion and keyword-to-caption augmentation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.22399","last_updated":"2026-06-21T09:06:30Z","snapshot_observed_at":"2026-08-14T10:09:13.976067Z","submitted_at":"2026-06-21T09:06:30Z","title":"ATCCaps: A Call-Sign-Aware Speech Dataset for Air Traffic Control Recognition","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-26T10:01:20.174755Z"},"links":{"citing_paper":"/paper/2606.22399"},"observation_digest":"sha256:ada0338262381ff5ad29eceee50147634aea82751ff3ec8d6ac8e1c246f1762a","observation_id":"6612f530-7715-417a-bf2f-bca3fd80c9e2","resolution":{"observed_at":"2026-06-26T10:01:20.174755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.12614","last_updated":"2020-03-10T13:07:47Z","snapshot_observed_at":"2026-08-14T18:07:15.491066Z","submitted_at":"2018-10-30T09:54:44Z","title":"The Airbus Air Traffic Control speech recognition 2018 challenge: towards ATC automatic transcription and call sign detection","version":2},"cited_work":{"arxiv_id":"1810.12614","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1810.12614","snapshot_observed_at":"2026-07-04T09:29:43.395678Z","title":"The airbus air traffic control speech recognition 2018 challenge: Towards atc automatic transcription and call sign detection,","venue":null,"work_id":"7b498529-d136-4811-a800-c11336f37360","year":2018},"citing_paper":{"arxiv_id":"2606.22399","last_updated":"2026-06-21T09:06:30Z","snapshot_observed_at":"2026-08-14T10:09:13.976067Z","submitted_at":"2026-06-21T09:06:30Z","title":"ATCCaps: A Call-Sign-Aware Speech Dataset for Air Traffic Control Recognition","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-26T10:01:20.174755Z"},"links":{"cited_paper":"/paper/1810.12614","citing_paper":"/paper/2606.22399"},"observation_digest":"sha256:c5d16c6ed510a1eb34a7f2248e5eefb1600e5ee0429e3a43c6c6ed00a4fd9c62","observation_id":"7f8bdf01-5cc8-4d45-aa18-018c7ef84dbc","resolution":{"observed_at":"2026-07-04T09:29:43.397188Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T10:01:20.174755Z","title":"Automatic call sign detection: Matching air surveillance data with air traffic spoken communications,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.22399","last_updated":"2026-06-21T09:06:30Z","snapshot_observed_at":"2026-08-14T10:09:13.976067Z","submitted_at":"2026-06-21T09:06:30Z","title":"ATCCaps: A Call-Sign-Aware Speech Dataset for Air Traffic Control Recognition","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-26T10:01:20.174755Z"},"links":{"citing_paper":"/paper/2606.22399"},"observation_digest":"sha256:fd7bde495e7180b65fb407275f49872d7df24251a74b2f7718f6738b8c016ffb","observation_id":"c6d5822c-ddf5-4212-81ea-869e71c79594","resolution":{"observed_at":"2026-06-26T10:01:20.174755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T10:01:20.174755Z","title":"Real- time integration of dynamic context information for improving automatic speech recognition,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2606.22399","last_updated":"2026-06-21T09:06:30Z","snapshot_observed_at":"2026-08-14T10:09:13.976067Z","submitted_at":"2026-06-21T09:06:30Z","title":"ATCCaps: A Call-Sign-Aware Speech Dataset for Air Traffic Control Recognition","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-26T10:01:20.174755Z"},"links":{"citing_paper":"/paper/2606.22399"},"observation_digest":"sha256:07cd1ceeb82cf05631492618f95f5dc6ec66ae0e6e9a94d4aa28c39a27e9f4c8","observation_id":"4936dd3b-b438-435d-9c8e-8abee9ea8ded","resolution":{"observed_at":"2026-06-26T10:01:20.174755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T10:01:20.174755Z","title":"Call- sign recognition and understanding for noisy air-traffic transcripts using surveillance information,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.22399","last_updated":"2026-06-21T09:06:30Z","snapshot_observed_at":"2026-08-14T10:09:13.976067Z","submitted_at":"2026-06-21T09:06:30Z","title":"ATCCaps: A Call-Sign-Aware Speech Dataset for Air Traffic Control Recognition","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-26T10:01:20.174755Z"},"links":{"citing_paper":"/paper/2606.22399"},"observation_digest":"sha256:a490461da434147bf7dea07d2b3938257f882c70c8c7c5b496997b81f4cdea9f","observation_id":"ca0564d6-bced-4445-86f8-34b2d8d907bf","resolution":{"observed_at":"2026-06-26T10:01:20.174755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.12156","last_updated":"2021-08-27T07:56:47Z","snapshot_observed_at":"2026-08-16T18:00:36.440196Z","submitted_at":"2021-08-27T07:56:47Z","title":"Improving callsign recognition with air-surveillance data in air-traffic communication","version":1},"cited_work":{"arxiv_id":"2108.12156","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2108.12156","snapshot_observed_at":"2026-07-04T09:29:43.402988Z","title":"Im- proving callsign recognition with air-surveillance data in air-traffic communication,","venue":null,"work_id":"b4801edf-a6c2-4323-b72a-59098ec1ec37","year":2021},"citing_paper":{"arxiv_id":"2606.22399","last_updated":"2026-06-21T09:06:30Z","snapshot_observed_at":"2026-08-14T10:09:13.976067Z","submitted_at":"2026-06-21T09:06:30Z","title":"ATCCaps: A Call-Sign-Aware Speech Dataset for Air Traffic Control Recognition","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-26T10:01:20.174755Z"},"links":{"cited_paper":"/paper/2108.12156","citing_paper":"/paper/2606.22399"},"observation_digest":"sha256:fe83a974ae5e16512b4f40732d69ff088acc975a15e099b9e8c7fe74e73bc9d3","observation_id":"ecb1356f-cde6-4bb6-9a5f-a505d7484ae5","resolution":{"observed_at":"2026-07-04T09:29:43.404617Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T10:01:20.174755Z","title":"Toward effective aircraft call sign detection using fuzzy string-matching between asr and ads-b data,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.22399","last_updated":"2026-06-21T09:06:30Z","snapshot_observed_at":"2026-08-14T10:09:13.976067Z","submitted_at":"2026-06-21T09:06:30Z","title":"ATCCaps: A Call-Sign-Aware Speech Dataset for Air Traffic Control Recognition","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-26T10:01:20.174755Z"},"links":{"citing_paper":"/paper/2606.22399"},"observation_digest":"sha256:2c9096266fbf2eea8752bcaa6a8af8da481ef38bde3e7812b6567beeb80a8880","observation_id":"ca6757c3-b82a-4fc6-9794-9e9aafb96289","resolution":{"observed_at":"2026-06-26T10:01:20.174755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T10:01:20.174755Z","title":"The atcosim corpus of non- prompted clean air traffic control speech,","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2606.22399","last_updated":"2026-06-21T09:06:30Z","snapshot_observed_at":"2026-08-14T10:09:13.976067Z","submitted_at":"2026-06-21T09:06:30Z","title":"ATCCaps: A Call-Sign-Aware Speech Dataset for Air Traffic Control Recognition","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-26T10:01:20.174755Z"},"links":{"citing_paper":"/paper/2606.22399"},"observation_digest":"sha256:204371cbacd82e9f274ed566c9e6691f3808dcc241becd3aa67b646d71bc83c3","observation_id":"58180f7f-4f4b-4ffb-ab48-d3b110842674","resolution":{"observed_at":"2026-06-26T10:01:20.174755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.11365","last_updated":"2019-11-26T06:35:08Z","snapshot_observed_at":"2026-08-15T12:17:01.031410Z","submitted_at":"2019-11-26T06:35:08Z","title":"ATCSpeech: a multilingual pilot-controller speech corpus from real Air Traffic Control environment","version":1},"cited_work":{"arxiv_id":"1911.11365","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1911.11365","snapshot_observed_at":"2026-07-04T09:29:43.401149Z","title":"Atcspeech: A multilingual pilot-controller speech corpus from real air traffic control environment,","venue":null,"work_id":"01951e3d-4bf4-4021-ac4c-809e94e45bc1","year":1911},"citing_paper":{"arxiv_id":"2606.22399","last_updated":"2026-06-21T09:06:30Z","snapshot_observed_at":"2026-08-14T10:09:13.976067Z","submitted_at":"2026-06-21T09:06:30Z","title":"ATCCaps: A Call-Sign-Aware Speech Dataset for Air Traffic Control Recognition","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-26T10:01:20.174755Z"},"links":{"cited_paper":"/paper/1911.11365","citing_paper":"/paper/2606.22399"},"observation_digest":"sha256:365a46b8535cbd14e5f35e2dda677eb46b8ea60877a6c3407afe3ac3856c1c20","observation_id":"90f93b7a-b03c-43f8-a3ed-dbbbb7e387d5","resolution":{"observed_at":"2026-07-04T09:29:43.402922Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.04054","last_updated":"2023-06-15T13:53:05Z","snapshot_observed_at":"2026-08-16T16:17:52.612615Z","submitted_at":"2022-11-08T07:26:45Z","title":"ATCO2 corpus: A Large-Scale Dataset for Research on Automatic Speech Recognition and Natural Language Understanding of Air Traffic Control Communications","version":2},"cited_work":{"arxiv_id":"2211.04054","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.04054","snapshot_observed_at":"2026-07-04T09:29:43.400071Z","title":"ATCO2 corpus: A large-scale dataset for research on au- tomatic speech recognition and natural language understand- ing of air traffic control communications","venue":null,"work_id":"7fc981e6-676f-423e-9ba7-4ec8d2d686d4","year":2022},"citing_paper":{"arxiv_id":"2606.22399","last_updated":"2026-06-21T09:06:30Z","snapshot_observed_at":"2026-08-14T10:09:13.976067Z","submitted_at":"2026-06-21T09:06:30Z","title":"ATCCaps: A Call-Sign-Aware Speech Dataset for Air Traffic Control Recognition","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-26T10:01:20.174755Z"},"links":{"cited_paper":"/paper/2211.04054","citing_paper":"/paper/2606.22399"},"observation_digest":"sha256:870d0cf3cf0eccf8d3dd3e4af27ad0a10de13e2b504b29cb5074e85b9fe06f3d","observation_id":"5d464d6b-01e4-4dbc-9b07-48c9b04c033e","resolution":{"observed_at":"2026-07-04T09:29:43.401772Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T10:01:20.174755Z","title":"Atco2 corpus: A large-scale dataset for research on automatic speech recognition and natural language understanding of air traffic control communications,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.22399","last_updated":"2026-06-21T09:06:30Z","snapshot_observed_at":"2026-08-14T10:09:13.976067Z","submitted_at":"2026-06-21T09:06:30Z","title":"ATCCaps: A Call-Sign-Aware Speech Dataset for Air Traffic Control Recognition","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-26T10:01:20.174755Z"},"links":{"citing_paper":"/paper/2606.22399"},"observation_digest":"sha256:0e5bfdabfd11c16edc86e7a0d2702a15f9abc2384cd4457945532b8ac0e43534","observation_id":"6c4bd69e-aebd-45b3-b481-5f2be7242220","resolution":{"observed_at":"2026-06-26T10:01:20.174755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T10:01:20.174755Z","title":"M2ats: A real-world multimodal air traffic situation benchmark dataset and beyond,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.22399","last_updated":"2026-06-21T09:06:30Z","snapshot_observed_at":"2026-08-14T10:09:13.976067Z","submitted_at":"2026-06-21T09:06:30Z","title":"ATCCaps: A Call-Sign-Aware Speech Dataset for Air Traffic Control Recognition","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-26T10:01:20.174755Z"},"links":{"citing_paper":"/paper/2606.22399"},"observation_digest":"sha256:595d99016a519bb7d8c9b556f49244794e3a9d4f4501b139fd4117b2687a23e5","observation_id":"71c405a8-a32b-44aa-8d9f-0adb5c5f7a02","resolution":{"observed_at":"2026-06-26T10:01:20.174755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T10:01:20.174755Z","title":"Atsiu: A large-scale dataset for spoken instruction understanding in air traffic control,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.22399","last_updated":"2026-06-21T09:06:30Z","snapshot_observed_at":"2026-08-14T10:09:13.976067Z","submitted_at":"2026-06-21T09:06:30Z","title":"ATCCaps: A Call-Sign-Aware Speech Dataset for Air Traffic Control Recognition","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-26T10:01:20.174755Z"},"links":{"citing_paper":"/paper/2606.22399"},"observation_digest":"sha256:29fe16664a55ef5305a9ca680e3cdb9ef3344f25a74a856b3f6eb0e5f7308267","observation_id":"5c4ff5e8-f9ee-4cf9-b1af-b3e7d00a8c2f","resolution":{"observed_at":"2026-06-26T10:01:20.174755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T10:01:20.174755Z","title":"End-to-end asr-free keyword search from speech,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.22399","last_updated":"2026-06-21T09:06:30Z","snapshot_observed_at":"2026-08-14T10:09:13.976067Z","submitted_at":"2026-06-21T09:06:30Z","title":"ATCCaps: A Call-Sign-Aware Speech Dataset for Air Traffic Control Recognition","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-26T10:01:20.174755Z"},"links":{"citing_paper":"/paper/2606.22399"},"observation_digest":"sha256:740523cc581b0d5f87e0877cf45f350680cb28396a12bbf7de246499ccedc9a9","observation_id":"d276a0c8-4ea8-4284-97ad-16d01e5723f1","resolution":{"observed_at":"2026-06-26T10:01:20.174755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T10:01:20.174755Z","title":"Perfect match: Self- supervised embeddings for cross-modal retrieval,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.22399","last_updated":"2026-06-21T09:06:30Z","snapshot_observed_at":"2026-08-14T10:09:13.976067Z","submitted_at":"2026-06-21T09:06:30Z","title":"ATCCaps: A Call-Sign-Aware Speech Dataset for Air Traffic Control Recognition","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-26T10:01:20.174755Z"},"links":{"citing_paper":"/paper/2606.22399"},"observation_digest":"sha256:d41b9d48446e615c2b11fbe38411ee54767472c35761ad574fb9ce8a53fbb897","observation_id":"b1a89a50-3c35-4ca3-a3e5-17ee728ec2dc","resolution":{"observed_at":"2026-06-26T10:01:20.174755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T10:01:20.174755Z","title":"Audio-text retrieval in context,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.22399","last_updated":"2026-06-21T09:06:30Z","snapshot_observed_at":"2026-08-14T10:09:13.976067Z","submitted_at":"2026-06-21T09:06:30Z","title":"ATCCaps: A Call-Sign-Aware Speech Dataset for Air Traffic Control Recognition","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-26T10:01:20.174755Z"},"links":{"citing_paper":"/paper/2606.22399"},"observation_digest":"sha256:e0f524508954a8fbbe09f5a34141d88db36c6eb9c76de0990d905f503dc47429","observation_id":"7e1fa17d-dd45-4645-9b5f-d0af5b6702bf","resolution":{"observed_at":"2026-06-26T10:01:20.174755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T10:01:20.174755Z","title":"Contrastive representation learning: A framework and review,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.22399","last_updated":"2026-06-21T09:06:30Z","snapshot_observed_at":"2026-08-14T10:09:13.976067Z","submitted_at":"2026-06-21T09:06:30Z","title":"ATCCaps: A Call-Sign-Aware Speech Dataset for Air Traffic Control Recognition","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-26T10:01:20.174755Z"},"links":{"citing_paper":"/paper/2606.22399"},"observation_digest":"sha256:53f517ee02df4c1990f2e4ae2efe700c5aefab7c504a85fca799dbe3508cae1b","observation_id":"fedf9af2-3c2e-4b67-9b10-90485b7442f7","resolution":{"observed_at":"2026-06-26T10:01:20.174755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T10:01:20.174755Z","title":"Contrastive data and learning for natural language processing,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.22399","last_updated":"2026-06-21T09:06:30Z","snapshot_observed_at":"2026-08-14T10:09:13.976067Z","submitted_at":"2026-06-21T09:06:30Z","title":"ATCCaps: A Call-Sign-Aware Speech Dataset for Air Traffic Control Recognition","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-26T10:01:20.174755Z"},"links":{"citing_paper":"/paper/2606.22399"},"observation_digest":"sha256:2b81986d9ea064c46a7055d6b084ae6ceb9a176cf197083cc2b0ee877df5a476","observation_id":"b6b1af1b-3751-4289-8a34-2583bbdcf8af","resolution":{"observed_at":"2026-06-26T10:01:20.174755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T10:01:20.174755Z","title":"A comprehensive survey on contrastive learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.22399","last_updated":"2026-06-21T09:06:30Z","snapshot_observed_at":"2026-08-14T10:09:13.976067Z","submitted_at":"2026-06-21T09:06:30Z","title":"ATCCaps: A Call-Sign-Aware Speech Dataset for Air Traffic Control Recognition","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-26T10:01:20.174755Z"},"links":{"citing_paper":"/paper/2606.22399"},"observation_digest":"sha256:58c05b042ce1b9f3d6d00df3919cea10dca6a93869f9e851505dc736915f07b0","observation_id":"cac94bb6-5c60-4c3e-bfcc-c8217a06433f","resolution":{"observed_at":"2026-06-26T10:01:20.174755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T10:01:20.174755Z","title":"Low-resource automatic speech recognition domain adaptation: A case-study in aviation maintenance,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.22399","last_updated":"2026-06-21T09:06:30Z","snapshot_observed_at":"2026-08-14T10:09:13.976067Z","submitted_at":"2026-06-21T09:06:30Z","title":"ATCCaps: A Call-Sign-Aware Speech Dataset for Air Traffic Control Recognition","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-26T10:01:20.174755Z"},"links":{"citing_paper":"/paper/2606.22399"},"observation_digest":"sha256:f4f08cd25af361b7d886cf1586046976168841ae3444cd7baf266747cc190d55","observation_id":"4db2f9a9-04c6-4f5d-a6d4-706815902ada","resolution":{"observed_at":"2026-06-26T10:01:20.174755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T10:01:20.174755Z","title":"Air-ground datalink technologies (ldacs and current cpdlc) in flight centric atc: Analysis of a fast-time simulation and outlook on a complementary real-time simulation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.22399","last_updated":"2026-06-21T09:06:30Z","snapshot_observed_at":"2026-08-14T10:09:13.976067Z","submitted_at":"2026-06-21T09:06:30Z","title":"ATCCaps: A Call-Sign-Aware Speech Dataset for Air Traffic Control Recognition","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-26T10:01:20.174755Z"},"links":{"citing_paper":"/paper/2606.22399"},"observation_digest":"sha256:a1f47a0dd13d547e230d005b4248df8b05685f6e4dc606fec475dd420ab295bf","observation_id":"746fcb01-1da4-4e16-86c3-07bdb62146de","resolution":{"observed_at":"2026-06-26T10:01:20.174755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T10:01:20.174755Z","title":"Effects of language ontology on transatlantic automatic speech understanding research collaboration in the air traffic manage- ment domain,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.22399","last_updated":"2026-06-21T09:06:30Z","snapshot_observed_at":"2026-08-14T10:09:13.976067Z","submitted_at":"2026-06-21T09:06:30Z","title":"ATCCaps: A Call-Sign-Aware Speech Dataset for Air Traffic Control Recognition","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-26T10:01:20.174755Z"},"links":{"citing_paper":"/paper/2606.22399"},"observation_digest":"sha256:f6361e6fecb94ef5132e416c7e68323e2de47e11827df0b8b6133c33702f061e","observation_id":"d49d1af8-119f-4fc8-9deb-30bf9ae74709","resolution":{"observed_at":"2026-06-26T10:01:20.174755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T10:01:20.174755Z","title":"Recent advances in end-to-end automatic speech recog- nition,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.22399","last_updated":"2026-06-21T09:06:30Z","snapshot_observed_at":"2026-08-14T10:09:13.976067Z","submitted_at":"2026-06-21T09:06:30Z","title":"ATCCaps: A Call-Sign-Aware Speech Dataset for Air Traffic Control Recognition","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-26T10:01:20.174755Z"},"links":{"citing_paper":"/paper/2606.22399"},"observation_digest":"sha256:dbb1bb699fcad212fdcf28e899c69118edcdb9e82864b4315b71b48c7549622f","observation_id":"84436e3e-53f8-4677-b302-2829a1eeacaa","resolution":{"observed_at":"2026-06-26T10:01:20.174755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T10:01:20.174755Z","title":"Air traffic control communication (atcc) speech corpora and their use for asr and tts development,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.22399","last_updated":"2026-06-21T09:06:30Z","snapshot_observed_at":"2026-08-14T10:09:13.976067Z","submitted_at":"2026-06-21T09:06:30Z","title":"ATCCaps: A Call-Sign-Aware Speech Dataset for Air Traffic Control Recognition","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-26T10:01:20.174755Z"},"links":{"citing_paper":"/paper/2606.22399"},"observation_digest":"sha256:61e227ad8c9faae25730e38bee512a837cdb828bef36a77d8e838cb30de7a4ee","observation_id":"9f83e368-a1d0-460a-9dab-530b3e8ac4cd","resolution":{"observed_at":"2026-06-26T10:01:20.174755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T10:01:20.174755Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.22399","last_updated":"2026-06-21T09:06:30Z","snapshot_observed_at":"2026-08-14T10:09:13.976067Z","submitted_at":"2026-06-21T09:06:30Z","title":"ATCCaps: A Call-Sign-Aware Speech Dataset for Air Traffic Control Recognition","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-26T10:01:20.174755Z"},"links":{"citing_paper":"/paper/2606.22399"},"observation_digest":"sha256:0af1c77802819c06439de50f496e3df0fb5f83d0e65fef431012f7aba5054b00","observation_id":"1c826d91-9433-45b5-8908-2a93af51fa50","resolution":{"observed_at":"2026-06-26T10:01:20.174755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T10:01:20.174755Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.22399","last_updated":"2026-06-21T09:06:30Z","snapshot_observed_at":"2026-08-14T10:09:13.976067Z","submitted_at":"2026-06-21T09:06:30Z","title":"ATCCaps: A Call-Sign-Aware Speech Dataset for Air Traffic Control Recognition","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-26T10:01:20.174755Z"},"links":{"citing_paper":"/paper/2606.22399"},"observation_digest":"sha256:b5853d2e8538c54ef7015e74ac73e033127c5dfd8ccfd18446fda4ffdbcbb32e","observation_id":"e60f7026-1942-4728-ab5f-5e845358bfc6","resolution":{"observed_at":"2026-06-26T10:01:20.174755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-18T18:18:37.449517Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":"2412.19437","doi":"10.1016/j.neucom.2023.127063.url:https://www.sciencedirect","metadata_source":"pith","pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"DeepSeek-V3 Technical Report","venue":"cs.CL","work_id":"57d2791d-2219-4c31-a077-afc04b12a75c","year":2024},"citing_paper":{"arxiv_id":"2606.22399","last_updated":"2026-06-21T09:06:30Z","snapshot_observed_at":"2026-08-14T10:09:13.976067Z","submitted_at":"2026-06-21T09:06:30Z","title":"ATCCaps: A Call-Sign-Aware Speech Dataset for Air Traffic Control Recognition","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-26T10:01:20.174755Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2606.22399"},"observation_digest":"sha256:d36b2ad76ef4aa0b8a45e047948f5cc0e39c69c5a7e8c4dc8b1402d32fba0450","observation_id":"690fc82a-ee42-44b6-af6f-d7408bcae831","resolution":{"observed_at":"2026-07-04T09:29:43.394299Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T10:01:20.174755Z","title":"Clap learning audio concepts from natural language supervision,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.22399","last_updated":"2026-06-21T09:06:30Z","snapshot_observed_at":"2026-08-14T10:09:13.976067Z","submitted_at":"2026-06-21T09:06:30Z","title":"ATCCaps: A Call-Sign-Aware Speech Dataset for Air Traffic Control Recognition","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-26T10:01:20.174755Z"},"links":{"citing_paper":"/paper/2606.22399"},"observation_digest":"sha256:47fbe98a6e1a2379a794d2213913b2e9cceb19b9adcc9af52fd0a56cb2218970","observation_id":"a7c039e0-b299-4d55-8abc-44e7b32ce55b","resolution":{"observed_at":"2026-06-26T10:01:20.174755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.05612","last_updated":"2018-07-29T19:11:57Z","snapshot_observed_at":"2026-08-14T20:46:56.185352Z","submitted_at":"2017-07-18T13:51:32Z","title":"VSE++: Improving Visual-Semantic Embeddings with Hard Negatives","version":4},"cited_work":{"arxiv_id":"1707.05612","doi":null,"metadata_source":"pith","pith_arxiv_id":"1707.05612","snapshot_observed_at":"2026-07-11T01:37:42.930624Z","title":"VSE++: Improving Visual-Semantic Embeddings with Hard Negatives","venue":"cs.LG","work_id":"8108d0b9-b9f5-4be3-b715-0e4324fe7506","year":2017},"citing_paper":{"arxiv_id":"2606.22399","last_updated":"2026-06-21T09:06:30Z","snapshot_observed_at":"2026-08-14T10:09:13.976067Z","submitted_at":"2026-06-21T09:06:30Z","title":"ATCCaps: A Call-Sign-Aware Speech Dataset for Air Traffic Control Recognition","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-26T10:01:20.174755Z"},"links":{"cited_paper":"/paper/1707.05612","citing_paper":"/paper/2606.22399"},"observation_digest":"sha256:a9423bf7c00a0ecdbe501ea86d7c5995e35ad08a0b2815d9556f344a417de65a","observation_id":"acb8645a-6233-40ad-8671-290543cce31c","resolution":{"observed_at":"2026-07-04T09:29:43.400113Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T10:01:20.174755Z","title":"Attentional feature fusion,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.22399","last_updated":"2026-06-21T09:06:30Z","snapshot_observed_at":"2026-08-14T10:09:13.976067Z","submitted_at":"2026-06-21T09:06:30Z","title":"ATCCaps: A Call-Sign-Aware Speech Dataset for Air Traffic Control Recognition","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-26T10:01:20.174755Z"},"links":{"citing_paper":"/paper/2606.22399"},"observation_digest":"sha256:ce0a036981d792381929752cf964e7cc8811998a25f61c2e7d10944189b91e02","observation_id":"0e9c7e55-50a9-4789-99d9-11f5f06a02b6","resolution":{"observed_at":"2026-06-26T10:01:20.174755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.02444","last_updated":"2022-05-05T05:14:01Z","snapshot_observed_at":"2026-08-16T17:02:29.187925Z","submitted_at":"2022-05-05T05:14:01Z","title":"Cross-modal Contrastive Learning for Speech Translation","version":1},"cited_work":{"arxiv_id":"2205.02444","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2205.02444","snapshot_observed_at":"2026-07-04T09:29:43.389814Z","title":"Cross-modal contrastive learning for speech translation,","venue":null,"work_id":"6c4ba5df-3cc3-4cd2-a415-aef7ae9e65fe","year":2022},"citing_paper":{"arxiv_id":"2606.22399","last_updated":"2026-06-21T09:06:30Z","snapshot_observed_at":"2026-08-14T10:09:13.976067Z","submitted_at":"2026-06-21T09:06:30Z","title":"ATCCaps: A Call-Sign-Aware Speech Dataset for Air Traffic Control Recognition","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-26T10:01:20.174755Z"},"links":{"cited_paper":"/paper/2205.02444","citing_paper":"/paper/2606.22399"},"observation_digest":"sha256:a8aee382895fcc7dc2d34a9e931dba11f2f0b1ac7aa767f5b8447488f7a767e6","observation_id":"0c2934b5-6145-4d79-bd14-74e363279e1f","resolution":{"observed_at":"2026-07-04T09:29:43.391510Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2606.22399","last_updated":"2026-06-21T09:06:30Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-14T10:09:13.976067Z","submitted_at":"2026-06-21T09:06:30Z","title":"ATCCaps: A Call-Sign-Aware Speech Dataset for Air Traffic Control Recognition"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":32,"verified_exact":8,"verified_fuzzy":0},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 0 inbound Pith citation observations for arXiv:2606.22399."}