{"as_of":"2026-08-18T22:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:65c77cc58255c7796bd686ca241c18914cadc93cb737b7cc7083a69456e6a249","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:39:16.766570Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:39:13.605666Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T05:39:17.372210Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.07515","last_updated":"2025-06-09T07:43:43Z","snapshot_observed_at":"2026-08-13T08:22:15.093098Z","submitted_at":"2025-06-09T07:43:43Z","title":"Speaker-Distinguishable CTC: Learning Speaker Distinction Using CTC for Multi-Talker Speech Recognition","version":1},"cited_work":{"arxiv_id":"2506.07515","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.07515","snapshot_observed_at":"2026-08-07T05:39:17.372210Z","title":"Speaker-Distinguishable CTC: Learning Speaker Distinction Using CTC for Multi-Talker Speech Recognition","venue":"eess.AS","work_id":"b90b25c7-b257-4526-91dc-e9507e233126","year":2025},"citing_paper":{"arxiv_id":"2506.07515","last_updated":"2025-06-09T07:43:43Z","snapshot_observed_at":"2026-08-13T08:22:15.093098Z","submitted_at":"2025-06-09T07:43:43Z","title":"Speaker-Distinguishable CTC: Learning Speaker Distinction Using CTC for Multi-Talker Speech Recognition","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:13.605666Z"},"links":{"cited_paper":"/paper/2506.07515","citing_paper":"/paper/2506.07515"},"observation_digest":"sha256:ac0ce0ef3bebda3c6028e866ab80cdb803c0cbbb8fa489de0bcfa4efd25e2d98","observation_id":"5b15a48c-26d7-4ce5-a7dd-f08135bd65c3","resolution":{"observed_at":"2026-08-07T05:39:17.470990Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.07515/citation-record","integrity":"/paper/2506.07515/integrity","json":"/paper/2506.07515/citation-record.json","paper":"/paper/2506.07515"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.07515","last_updated":"2025-06-09T07:43:43Z","snapshot_observed_at":"2026-08-13T08:22:15.093098Z","submitted_at":"2025-06-09T07:43:43Z","title":"Speaker-Distinguishable CTC: Learning Speaker Distinction Using CTC for Multi-Talker Speech Recognition","version":1},"cited_work":{"arxiv_id":"2506.07515","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.07515","snapshot_observed_at":"2026-08-07T05:39:17.372210Z","title":"Speaker-Distinguishable CTC: Learning Speaker Distinction Using CTC for Multi-Talker Speech Recognition","venue":"eess.AS","work_id":"b90b25c7-b257-4526-91dc-e9507e233126","year":2025},"citing_paper":{"arxiv_id":"2506.07515","last_updated":"2025-06-09T07:43:43Z","snapshot_observed_at":"2026-08-13T08:22:15.093098Z","submitted_at":"2025-06-09T07:43:43Z","title":"Speaker-Distinguishable CTC: Learning Speaker Distinction Using CTC for Multi-Talker Speech Recognition","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:13.605666Z"},"links":{"cited_paper":"/paper/2506.07515","citing_paper":"/paper/2506.07515"},"observation_digest":"sha256:ac0ce0ef3bebda3c6028e866ab80cdb803c0cbbb8fa489de0bcfa4efd25e2d98","observation_id":"5b15a48c-26d7-4ce5-a7dd-f08135bd65c3","resolution":{"observed_at":"2026-08-07T05:39:17.470990Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:22.774371Z","title":"Original serialized output training SOT is a method for MT-ASR using an AED model, as illus- trated on the left side of Figure 1","venue":null,"work_id":"c84c16c3-4eca-4331-836f-42ff00ebcfc9","year":null},"citing_paper":{"arxiv_id":"2506.07515","last_updated":"2025-06-09T07:43:43Z","snapshot_observed_at":"2026-08-13T08:22:15.093098Z","submitted_at":"2025-06-09T07:43:43Z","title":"Speaker-Distinguishable CTC: Learning Speaker Distinction Using CTC for Multi-Talker Speech Recognition","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:13.641508Z"},"links":{"citing_paper":"/paper/2506.07515"},"observation_digest":"sha256:a24f2540eb0921811ba3f11177d26065d1def867bbb60bbd8dd1973a436abcb4","observation_id":"372cdd57-db2d-4746-918e-1b287a6589ab","resolution":{"observed_at":"2026-08-07T05:39:22.860553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:22.496335Z","title":null,"venue":null,"work_id":"58f9aa48-3677-4431-beae-94dbd5df219e","year":null},"citing_paper":{"arxiv_id":"2506.07515","last_updated":"2025-06-09T07:43:43Z","snapshot_observed_at":"2026-08-13T08:22:15.093098Z","submitted_at":"2025-06-09T07:43:43Z","title":"Speaker-Distinguishable CTC: Learning Speaker Distinction Using CTC for Multi-Talker Speech Recognition","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:13.765137Z"},"links":{"citing_paper":"/paper/2506.07515"},"observation_digest":"sha256:0d55701857d04102a34738ff052b809351978349e507280e9026592aeb7d0c3f","observation_id":"7841e00d-ee71-40b3-87ce-4bee8aca8b63","resolution":{"observed_at":"2026-08-07T05:39:22.655260Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:22.306772Z","title":"Auxiliary info","venue":null,"work_id":"60997b04-664e-4511-b4fe-0cd201b05ad3","year":null},"citing_paper":{"arxiv_id":"2506.07515","last_updated":"2025-06-09T07:43:43Z","snapshot_observed_at":"2026-08-13T08:22:15.093098Z","submitted_at":"2025-06-09T07:43:43Z","title":"Speaker-Distinguishable CTC: Learning Speaker Distinction Using CTC for Multi-Talker Speech Recognition","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:13.814062Z"},"links":{"citing_paper":"/paper/2506.07515"},"observation_digest":"sha256:6876e4e711bc66ad19a2e7cd44706e931e83254dcbdc8dfd7ead6317d2add3cd","observation_id":"f4091646-a5c5-4c28-ae1a-51eac25f03d8","resolution":{"observed_at":"2026-08-07T05:39:22.408293Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:22.119511Z","title":null,"venue":null,"work_id":"ac0bb541-f4dd-4151-a92e-7c3bfeb3864f","year":null},"citing_paper":{"arxiv_id":"2506.07515","last_updated":"2025-06-09T07:43:43Z","snapshot_observed_at":"2026-08-13T08:22:15.093098Z","submitted_at":"2025-06-09T07:43:43Z","title":"Speaker-Distinguishable CTC: Learning Speaker Distinction Using CTC for Multi-Talker Speech Recognition","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:13.919649Z"},"links":{"citing_paper":"/paper/2506.07515"},"observation_digest":"sha256:f84e2b4fef90be09d9014f94ca9d305a93042a5796036af1f89a7f4b5e8bacca","observation_id":"3f0a046e-cc3c-4f0a-8620-dadf7160e56b","resolution":{"observed_at":"2026-08-07T05:39:22.229285Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:21.948038Z","title":"Recognizing multi-talker speech with permutation invariant training,","venue":null,"work_id":"009cc8c1-e13e-4aa1-9d50-dad5094bedfd","year":2017},"citing_paper":{"arxiv_id":"2506.07515","last_updated":"2025-06-09T07:43:43Z","snapshot_observed_at":"2026-08-13T08:22:15.093098Z","submitted_at":"2025-06-09T07:43:43Z","title":"Speaker-Distinguishable CTC: Learning Speaker Distinction Using CTC for Multi-Talker Speech Recognition","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:14.017760Z"},"links":{"citing_paper":"/paper/2506.07515"},"observation_digest":"sha256:019696dd467ab4ca33179b3acaf4e15ae7bf9cc2e7a99a9e68eaa3fac13003c9","observation_id":"883f2bd7-3026-417f-b40b-79a9bfb3b439","resolution":{"observed_at":"2026-08-07T05:39:22.035887Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:21.696882Z","title":"A purely end-to-end system for multi-speaker speech recognition,","venue":null,"work_id":"ad2e33bc-78cf-4d67-a700-54691059cb7b","year":2018},"citing_paper":{"arxiv_id":"2506.07515","last_updated":"2025-06-09T07:43:43Z","snapshot_observed_at":"2026-08-13T08:22:15.093098Z","submitted_at":"2025-06-09T07:43:43Z","title":"Speaker-Distinguishable CTC: Learning Speaker Distinction Using CTC for Multi-Talker Speech Recognition","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:14.155706Z"},"links":{"citing_paper":"/paper/2506.07515"},"observation_digest":"sha256:c4b08c5948d672353a834254af234ee2b8f128150f75138904e5f297ddcf3d42","observation_id":"8ce02205-7a03-4e33-8db7-6b51598894ec","resolution":{"observed_at":"2026-08-07T05:39:21.844296Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:21.458342Z","title":"Seri- alized output training for end-to-end overlapped speech recogni- tion,","venue":null,"work_id":"3959082b-75d5-44db-9561-b37143014042","year":2020},"citing_paper":{"arxiv_id":"2506.07515","last_updated":"2025-06-09T07:43:43Z","snapshot_observed_at":"2026-08-13T08:22:15.093098Z","submitted_at":"2025-06-09T07:43:43Z","title":"Speaker-Distinguishable CTC: Learning Speaker Distinction Using CTC for Multi-Talker Speech Recognition","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:14.229063Z"},"links":{"citing_paper":"/paper/2506.07515"},"observation_digest":"sha256:a9e9a67d9a81d11f9c9f3cf800f63f5efdbaf45fd41ca87e8546c6fb93d515ba","observation_id":"9f166858-329e-4c3b-931a-84bf5e45fa77","resolution":{"observed_at":"2026-08-07T05:39:21.581256Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:21.262449Z","title":"Alignment-free train- ing for transducer-based multi-talker asr,","venue":null,"work_id":"dfb8480b-ce23-4d32-884f-396a967b8453","year":2025},"citing_paper":{"arxiv_id":"2506.07515","last_updated":"2025-06-09T07:43:43Z","snapshot_observed_at":"2026-08-13T08:22:15.093098Z","submitted_at":"2025-06-09T07:43:43Z","title":"Speaker-Distinguishable CTC: Learning Speaker Distinction Using CTC for Multi-Talker Speech Recognition","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:14.332171Z"},"links":{"citing_paper":"/paper/2506.07515"},"observation_digest":"sha256:b47f51a52422f6bab3e90d28c6f29296fced44ab0fbe08963e0a5f6fd09aed08","observation_id":"28f526c6-1b3d-46c8-91b0-0c55103fb11a","resolution":{"observed_at":"2026-08-07T05:39:21.341908Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:21.019216Z","title":"Empowering whisper as a joint multi-talker and target-talker speech recognition system,","venue":null,"work_id":"eb1369f2-cda5-4c60-936a-e21099e77972","year":2024},"citing_paper":{"arxiv_id":"2506.07515","last_updated":"2025-06-09T07:43:43Z","snapshot_observed_at":"2026-08-13T08:22:15.093098Z","submitted_at":"2025-06-09T07:43:43Z","title":"Speaker-Distinguishable CTC: Learning Speaker Distinction Using CTC for Multi-Talker Speech Recognition","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:14.403007Z"},"links":{"citing_paper":"/paper/2506.07515"},"observation_digest":"sha256:21220b18e228da469b5506c0bfed29b55cc4c5be50a43f1d6c7db73171285b07","observation_id":"1db94a59-f067-4a9e-afcd-1469f10f7279","resolution":{"observed_at":"2026-08-07T05:39:21.122868Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:14.495334Z","title":"Listen, attend and spell: A neural network for large vocabulary conversational speech recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.07515","last_updated":"2025-06-09T07:43:43Z","snapshot_observed_at":"2026-08-13T08:22:15.093098Z","submitted_at":"2025-06-09T07:43:43Z","title":"Speaker-Distinguishable CTC: Learning Speaker Distinction Using CTC for Multi-Talker Speech Recognition","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:14.495334Z"},"links":{"citing_paper":"/paper/2506.07515"},"observation_digest":"sha256:41562dd94e8cceea110491c23a9505f16aca2b9e45f49531c40fccea09e38ebc","observation_id":"72b93c98-82cc-4812-8914-28e74a637f44","resolution":{"observed_at":"2026-08-07T05:39:14.495334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:20.738737Z","title":"Streaming multi-talker asr with token-level serialized output training,","venue":null,"work_id":"ad29aa5a-c3bf-407c-a62a-d74bb1b9a31e","year":2022},"citing_paper":{"arxiv_id":"2506.07515","last_updated":"2025-06-09T07:43:43Z","snapshot_observed_at":"2026-08-13T08:22:15.093098Z","submitted_at":"2025-06-09T07:43:43Z","title":"Speaker-Distinguishable CTC: Learning Speaker Distinction Using CTC for Multi-Talker Speech Recognition","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:14.591002Z"},"links":{"citing_paper":"/paper/2506.07515"},"observation_digest":"sha256:8ec3ceb9d799f3cf118f48b43557e7f4797e8e155397e778d202f54ae64ac312","observation_id":"4ff3cc2a-b83d-4b7a-bc4f-01f36e899b67","resolution":{"observed_at":"2026-08-07T05:39:20.867225Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:20.514460Z","title":"Sa-sot: Speaker- aware serialized output training for multi-talker asr,","venue":null,"work_id":"4493c295-bda5-432b-a609-5db466fd3621","year":2024},"citing_paper":{"arxiv_id":"2506.07515","last_updated":"2025-06-09T07:43:43Z","snapshot_observed_at":"2026-08-13T08:22:15.093098Z","submitted_at":"2025-06-09T07:43:43Z","title":"Speaker-Distinguishable CTC: Learning Speaker Distinction Using CTC for Multi-Talker Speech Recognition","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:14.666993Z"},"links":{"citing_paper":"/paper/2506.07515"},"observation_digest":"sha256:6e80a6f91c378b9eadb67297c3f8191a7233b625e6cedf4539833ed74e931798","observation_id":"e72b01e0-b998-496c-9368-499e8645e277","resolution":{"observed_at":"2026-08-07T05:39:20.615692Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:20.294504Z","title":"Ba- sot: Boundary-aware serialized output training for multi-talker asr,","venue":null,"work_id":"c907242a-e076-4526-80f3-af8ae81731f6","year":2023},"citing_paper":{"arxiv_id":"2506.07515","last_updated":"2025-06-09T07:43:43Z","snapshot_observed_at":"2026-08-13T08:22:15.093098Z","submitted_at":"2025-06-09T07:43:43Z","title":"Speaker-Distinguishable CTC: Learning Speaker Distinction Using CTC for Multi-Talker Speech Recognition","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:14.809836Z"},"links":{"citing_paper":"/paper/2506.07515"},"observation_digest":"sha256:f3846e8ea769381b25e11150906fc283c3434b8899f8fd575568d9f262941535","observation_id":"ca0a9226-4688-4359-835b-bfba03f90482","resolution":{"observed_at":"2026-08-07T05:39:20.403661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:20.073562Z","title":"Joint autoregressive modeling of end-to-end multi-talker over- lapped speech recognition and utterance-level timestamp predic- tion,","venue":null,"work_id":"45ee7f52-6aa7-4ff3-b5a1-baa63bfcb232","year":2023},"citing_paper":{"arxiv_id":"2506.07515","last_updated":"2025-06-09T07:43:43Z","snapshot_observed_at":"2026-08-13T08:22:15.093098Z","submitted_at":"2025-06-09T07:43:43Z","title":"Speaker-Distinguishable CTC: Learning Speaker Distinction Using CTC for Multi-Talker Speech Recognition","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:14.871613Z"},"links":{"citing_paper":"/paper/2506.07515"},"observation_digest":"sha256:737be77acbc2bc59e9e90198d86d7a33afce3aa59aa56d781e4e0c08d9fd6462","observation_id":"cecec0fe-5dbd-4c0a-8b97-c17e64865158","resolution":{"observed_at":"2026-08-07T05:39:20.187769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:19.850327Z","title":"Improv- ing multi-speaker asr with overlap-aware encoding and monotonic attention,","venue":null,"work_id":"2a5bca20-ca1f-4a0a-8102-3228720d00ba","year":2024},"citing_paper":{"arxiv_id":"2506.07515","last_updated":"2025-06-09T07:43:43Z","snapshot_observed_at":"2026-08-13T08:22:15.093098Z","submitted_at":"2025-06-09T07:43:43Z","title":"Speaker-Distinguishable CTC: Learning Speaker Distinction Using CTC for Multi-Talker Speech Recognition","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:14.962722Z"},"links":{"citing_paper":"/paper/2506.07515"},"observation_digest":"sha256:4a7fc608439316b9c8c49f05ee3e03a2f18ac0d41ef08e253dad53fac1db67ed","observation_id":"208f91e3-e350-4c5c-b3cb-a82efacf1e39","resolution":{"observed_at":"2026-08-07T05:39:19.942629Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:19.617835Z","title":"Somsred: Sequential output mod- eling for joint multi-talker overlapped speech recognition and speaker diarization,","venue":null,"work_id":"32b5a518-def2-466f-9554-b37883bcb29e","year":2024},"citing_paper":{"arxiv_id":"2506.07515","last_updated":"2025-06-09T07:43:43Z","snapshot_observed_at":"2026-08-13T08:22:15.093098Z","submitted_at":"2025-06-09T07:43:43Z","title":"Speaker-Distinguishable CTC: Learning Speaker Distinction Using CTC for Multi-Talker Speech Recognition","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:15.062815Z"},"links":{"citing_paper":"/paper/2506.07515"},"observation_digest":"sha256:86a9d04907c9b76fb449fa0ffbb40f7614211cc096da78e3b8e3a22c8b4744a0","observation_id":"c474eb8e-ebb4-4efa-959a-16b01cabf8cc","resolution":{"observed_at":"2026-08-07T05:39:19.738225Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:19.392925Z","title":"End-to-end speaker-attributed asr with trans- former,","venue":null,"work_id":"7cc333f1-4bd7-4836-91ad-016606e7dcc9","year":2021},"citing_paper":{"arxiv_id":"2506.07515","last_updated":"2025-06-09T07:43:43Z","snapshot_observed_at":"2026-08-13T08:22:15.093098Z","submitted_at":"2025-06-09T07:43:43Z","title":"Speaker-Distinguishable CTC: Learning Speaker Distinction Using CTC for Multi-Talker Speech Recognition","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:15.147915Z"},"links":{"citing_paper":"/paper/2506.07515"},"observation_digest":"sha256:a2e07499be61610a80051c882dd7d023ce1cb29486da7704eee30f81161ed418","observation_id":"0da764f2-2cdf-49cd-8636-f303891db618","resolution":{"observed_at":"2026-08-07T05:39:19.495678Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10959","last_updated":"2023-12-18T06:29:53Z","snapshot_observed_at":"2026-08-17T17:38:13.214518Z","submitted_at":"2023-12-18T06:29:53Z","title":"Speaker Mask Transformer for Multi-talker Overlapped Speech Recognition","version":1},"cited_work":{"arxiv_id":"2312.10959","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.10959","snapshot_observed_at":"2026-08-07T05:39:17.159752Z","title":"Speaker Mask Transformer for Multi-talker Overlapped Speech Recognition","venue":"cs.SD","work_id":"4cf9586e-9481-42e6-8cfc-14a86f08f996","year":2023},"citing_paper":{"arxiv_id":"2506.07515","last_updated":"2025-06-09T07:43:43Z","snapshot_observed_at":"2026-08-13T08:22:15.093098Z","submitted_at":"2025-06-09T07:43:43Z","title":"Speaker-Distinguishable CTC: Learning Speaker Distinction Using CTC for Multi-Talker Speech Recognition","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:15.242188Z"},"links":{"cited_paper":"/paper/2312.10959","citing_paper":"/paper/2506.07515"},"observation_digest":"sha256:88495293ffb48ddb8df2c7d40390da2c977fd940d9b3537113fe08c9020b00e0","observation_id":"6cd16993-9a16-4d38-b662-b3c734d19d5b","resolution":{"observed_at":"2026-08-07T05:39:17.262360Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:19.212328Z","title":"A comparative study on speaker-attributed automatic speech recognition in multi-party meetings,","venue":null,"work_id":"4ee7aa8a-cc43-4e0d-942d-c71ddba49990","year":2022},"citing_paper":{"arxiv_id":"2506.07515","last_updated":"2025-06-09T07:43:43Z","snapshot_observed_at":"2026-08-13T08:22:15.093098Z","submitted_at":"2025-06-09T07:43:43Z","title":"Speaker-Distinguishable CTC: Learning Speaker Distinction Using CTC for Multi-Talker Speech Recognition","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:15.314122Z"},"links":{"citing_paper":"/paper/2506.07515"},"observation_digest":"sha256:7e76203efcdc23c8d8fdba2e8134c26c018aa4dcea5625bfdd6632621670d719","observation_id":"ef23291b-d603-4bf2-aa79-44242ac47671","resolution":{"observed_at":"2026-08-07T05:39:19.277029Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:15.364603Z","title":"Hy- brid ctc/attention architecture for end-to-end speech recognition,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.07515","last_updated":"2025-06-09T07:43:43Z","snapshot_observed_at":"2026-08-13T08:22:15.093098Z","submitted_at":"2025-06-09T07:43:43Z","title":"Speaker-Distinguishable CTC: Learning Speaker Distinction Using CTC for Multi-Talker Speech Recognition","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:15.364603Z"},"links":{"citing_paper":"/paper/2506.07515"},"observation_digest":"sha256:51ec29950f604b75f4ac4e709fc52407e0ba14a0f99fc3813753563fb209e122","observation_id":"0b51659d-59c3-40ac-ab24-f95f96d6a07d","resolution":{"observed_at":"2026-08-07T05:39:15.364603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:15.446135Z","title":"Connectionist temporal classification: labelling unsegmented sequence data with recurrent neural networks,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2506.07515","last_updated":"2025-06-09T07:43:43Z","snapshot_observed_at":"2026-08-13T08:22:15.093098Z","submitted_at":"2025-06-09T07:43:43Z","title":"Speaker-Distinguishable CTC: Learning Speaker Distinction Using CTC for Multi-Talker Speech Recognition","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:15.446135Z"},"links":{"citing_paper":"/paper/2506.07515"},"observation_digest":"sha256:4e4f8ec76ffae3613d878304c69488656b2ef5556d38c407405202c854c86435","observation_id":"05444888-181a-42dd-83f1-d61207937c6a","resolution":{"observed_at":"2026-08-07T05:39:15.446135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:18.999866Z","title":"Serialized speech infor- mation guidance with overlapped encoding separation for multi- speaker automatic speech recognition,","venue":null,"work_id":"4b4706bc-515a-411d-82cc-98bbc77c249a","year":2024},"citing_paper":{"arxiv_id":"2506.07515","last_updated":"2025-06-09T07:43:43Z","snapshot_observed_at":"2026-08-13T08:22:15.093098Z","submitted_at":"2025-06-09T07:43:43Z","title":"Speaker-Distinguishable CTC: Learning Speaker Distinction Using CTC for Multi-Talker Speech Recognition","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:15.482282Z"},"links":{"citing_paper":"/paper/2506.07515"},"observation_digest":"sha256:a7369914b2ef614e132b524adcd6a2dd87fac1cfcd8d2851b642520530e69fda","observation_id":"f9091dc8-ce75-4cc4-ab94-8af74eeb7d11","resolution":{"observed_at":"2026-08-07T05:39:19.095261Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:18.771699Z","title":"Cross-speaker encoding network for multi-talker speech recog- nition,","venue":null,"work_id":"3ae19b56-6483-4552-aa2c-60a1d5ed7493","year":2024},"citing_paper":{"arxiv_id":"2506.07515","last_updated":"2025-06-09T07:43:43Z","snapshot_observed_at":"2026-08-13T08:22:15.093098Z","submitted_at":"2025-06-09T07:43:43Z","title":"Speaker-Distinguishable CTC: Learning Speaker Distinction Using CTC for Multi-Talker Speech Recognition","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:15.579158Z"},"links":{"citing_paper":"/paper/2506.07515"},"observation_digest":"sha256:37ad61c107102cefb54023552c1a7ff6b48363ee18f7f1c00a5f89c29ab1bbf3","observation_id":"b64b88be-e861-4bdf-93db-c3ac9467d183","resolution":{"observed_at":"2026-08-07T05:39:18.863268Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:18.546368Z","title":"Disentangling speakers in multi-talker speech recogni- tion with speaker-aware ctc,","venue":null,"work_id":"33822a32-4208-450c-a38e-89a4b8a93f12","year":2025},"citing_paper":{"arxiv_id":"2506.07515","last_updated":"2025-06-09T07:43:43Z","snapshot_observed_at":"2026-08-13T08:22:15.093098Z","submitted_at":"2025-06-09T07:43:43Z","title":"Speaker-Distinguishable CTC: Learning Speaker Distinction Using CTC for Multi-Talker Speech Recognition","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:15.687244Z"},"links":{"citing_paper":"/paper/2506.07515"},"observation_digest":"sha256:ce51a8a2ad24ddb58994447699a92e5f80b919fd6ec8965ee3dbb2e2b8e7ccf4","observation_id":"b867dbc3-200c-489e-9246-5ca03f1d0474","resolution":{"observed_at":"2026-08-07T05:39:18.676820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:18.367326Z","title":"Espnet: End-to-end speech pro- cessing toolkit,","venue":null,"work_id":"ba8db670-e33b-4776-961b-249d0fb04bfd","year":2018},"citing_paper":{"arxiv_id":"2506.07515","last_updated":"2025-06-09T07:43:43Z","snapshot_observed_at":"2026-08-13T08:22:15.093098Z","submitted_at":"2025-06-09T07:43:43Z","title":"Speaker-Distinguishable CTC: Learning Speaker Distinction Using CTC for Multi-Talker Speech Recognition","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:15.782457Z"},"links":{"citing_paper":"/paper/2506.07515"},"observation_digest":"sha256:bbbf185d3ac5aef70d8f07422ec5cbfdd4ce6b1ae85e28fd9b1cf2cb16b39003","observation_id":"1fdbe005-8b75-49bd-97dc-b36578545e30","resolution":{"observed_at":"2026-08-07T05:39:18.442839Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:15.873418Z","title":"Lib- rispeech: An asr corpus based on public domain audio books,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.07515","last_updated":"2025-06-09T07:43:43Z","snapshot_observed_at":"2026-08-13T08:22:15.093098Z","submitted_at":"2025-06-09T07:43:43Z","title":"Speaker-Distinguishable CTC: Learning Speaker Distinction Using CTC for Multi-Talker Speech Recognition","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:15.873418Z"},"links":{"citing_paper":"/paper/2506.07515"},"observation_digest":"sha256:f648dc46b5ece0786c2d3f5f9e97c956c69187e16fd4c0694ff23ed8d1bfe832","observation_id":"9904b9ab-42f8-4053-9a71-5858362aa1ca","resolution":{"observed_at":"2026-08-07T05:39:15.873418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:18.132105Z","title":"Audio aug- mentation for speech recognition,","venue":null,"work_id":"4a1605c7-eba5-49a4-94d7-c440aea614fa","year":2015},"citing_paper":{"arxiv_id":"2506.07515","last_updated":"2025-06-09T07:43:43Z","snapshot_observed_at":"2026-08-13T08:22:15.093098Z","submitted_at":"2025-06-09T07:43:43Z","title":"Speaker-Distinguishable CTC: Learning Speaker Distinction Using CTC for Multi-Talker Speech Recognition","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:15.959452Z"},"links":{"citing_paper":"/paper/2506.07515"},"observation_digest":"sha256:8104cb4d1e9e71128b2a1a36dedf6d2e0c5ecd735df2c6d62f289dcadf64e98d","observation_id":"b90d0643-9f15-42a1-9645-f6b23f3a3a42","resolution":{"observed_at":"2026-08-07T05:39:18.224564Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.04547","last_updated":"2020-11-09T16:44:47Z","snapshot_observed_at":"2026-08-16T19:07:08.180736Z","submitted_at":"2020-11-09T16:44:47Z","title":"Data Augmentation For Children's Speech Recognition -- The \"Ethiopian\" System For The SLT 2021 Children Speech Recognition Challenge","version":1},"cited_work":{"arxiv_id":"2011.04547","doi":null,"metadata_source":"pith","pith_arxiv_id":"2011.04547","snapshot_observed_at":"2026-08-07T05:39:16.891073Z","title":"Data Augmentation For Children's Speech Recognition -- The \"Ethiopian\" System For The SLT 2021 Children Speech Recognition Challenge","venue":"cs.SD","work_id":"9623edc5-6f94-44aa-a985-9b4f2d2a17b5","year":2020},"citing_paper":{"arxiv_id":"2506.07515","last_updated":"2025-06-09T07:43:43Z","snapshot_observed_at":"2026-08-13T08:22:15.093098Z","submitted_at":"2025-06-09T07:43:43Z","title":"Speaker-Distinguishable CTC: Learning Speaker Distinction Using CTC for Multi-Talker Speech Recognition","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:16.045808Z"},"links":{"cited_paper":"/paper/2011.04547","citing_paper":"/paper/2506.07515"},"observation_digest":"sha256:c1a8d4476fdcb14c2015170bbc45d701dee9f962b6f8367c20eee0d04be51001","observation_id":"69c10e8f-8b4b-442a-8118-8ccf44234773","resolution":{"observed_at":"2026-08-07T05:39:16.963686Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:16.204553Z","title":"Specaugment: A simple data augmentation method for automatic speech recognition,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.07515","last_updated":"2025-06-09T07:43:43Z","snapshot_observed_at":"2026-08-13T08:22:15.093098Z","submitted_at":"2025-06-09T07:43:43Z","title":"Speaker-Distinguishable CTC: Learning Speaker Distinction Using CTC for Multi-Talker Speech Recognition","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:16.204553Z"},"links":{"citing_paper":"/paper/2506.07515"},"observation_digest":"sha256:6f1f3c84c917b3f6e2aa175eb6089ffd16b426268d7de5c6499bbf61888acfa1","observation_id":"c260d1e7-076f-4c09-b807-aee1bd02c6fd","resolution":{"observed_at":"2026-08-07T05:39:16.204553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:17.938834Z","title":"Specaugment on large scale datasets,","venue":null,"work_id":"ac311c41-f218-476b-b75d-09291394dc35","year":2020},"citing_paper":{"arxiv_id":"2506.07515","last_updated":"2025-06-09T07:43:43Z","snapshot_observed_at":"2026-08-13T08:22:15.093098Z","submitted_at":"2025-06-09T07:43:43Z","title":"Speaker-Distinguishable CTC: Learning Speaker Distinction Using CTC for Multi-Talker Speech Recognition","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:16.359355Z"},"links":{"citing_paper":"/paper/2506.07515"},"observation_digest":"sha256:1bd4fb72c5da08586715c1691e16ec76461047751f3786ccd1df112b7bacec66","observation_id":"7e22ea64-d72f-457b-9e19-55cb02760284","resolution":{"observed_at":"2026-08-07T05:39:18.002014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:16.547751Z","title":"Conformer: Convolution-augmented transformer for speech recognition,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.07515","last_updated":"2025-06-09T07:43:43Z","snapshot_observed_at":"2026-08-13T08:22:15.093098Z","submitted_at":"2025-06-09T07:43:43Z","title":"Speaker-Distinguishable CTC: Learning Speaker Distinction Using CTC for Multi-Talker Speech Recognition","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:16.547751Z"},"links":{"citing_paper":"/paper/2506.07515"},"observation_digest":"sha256:c44d6da375cb6098cfb74a44c0395bbcc94dc7201c7280400240d0f0236707b4","observation_id":"25cdc9a3-24a5-43d0-b5d8-de98b0a37014","resolution":{"observed_at":"2026-08-07T05:39:16.547751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:17.730864Z","title":"Acoustic- to-word attention-based model complemented with character- level ctc-based model,","venue":null,"work_id":"f722dd02-18e7-4e4f-a194-6e9106c85f05","year":2018},"citing_paper":{"arxiv_id":"2506.07515","last_updated":"2025-06-09T07:43:43Z","snapshot_observed_at":"2026-08-13T08:22:15.093098Z","submitted_at":"2025-06-09T07:43:43Z","title":"Speaker-Distinguishable CTC: Learning Speaker Distinction Using CTC for Multi-Talker Speech Recognition","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:16.692572Z"},"links":{"citing_paper":"/paper/2506.07515"},"observation_digest":"sha256:3155121acd591e52dc7e22378a9417c10c76771bfefd19ba77803a8b7d92051b","observation_id":"7b67875f-50c0-4729-aeaf-d4249213b363","resolution":{"observed_at":"2026-08-07T05:39:17.799454Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:17.554803Z","title":"Chime-6 challenge: Tackling multispeaker speech recognition for unsegmented recordings,","venue":null,"work_id":"1f6e2f1d-af22-4d9d-8fbf-619275157243","year":2020},"citing_paper":{"arxiv_id":"2506.07515","last_updated":"2025-06-09T07:43:43Z","snapshot_observed_at":"2026-08-13T08:22:15.093098Z","submitted_at":"2025-06-09T07:43:43Z","title":"Speaker-Distinguishable CTC: Learning Speaker Distinction Using CTC for Multi-Talker Speech Recognition","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:16.766570Z"},"links":{"citing_paper":"/paper/2506.07515"},"observation_digest":"sha256:d0c5cf84f4eced74b713d56b8c52021d1c202d481559732a7e2dae1489fe0595","observation_id":"7f2798da-3606-414d-90fa-b6e5b9d40d42","resolution":{"observed_at":"2026-08-07T05:39:17.649705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.07515","last_updated":"2025-06-09T07:43:43Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-13T08:22:15.093098Z","submitted_at":"2025-06-09T07:43:43Z","title":"Speaker-Distinguishable CTC: Learning Speaker Distinction Using CTC for Multi-Talker Speech Recognition"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":8,"verified_exact":2,"verified_fuzzy":23},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 1 inbound Pith citation observation for arXiv:2506.07515."}