{"as_of":"2026-08-17T08:31:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:54101772010a5bc313969093651d903f663b38e02c69aaa1e823abd09d070461","coverage":[{"denominator":33,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:55:24.534982Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:55:22.270498Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T12:55:26.461821Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.23207","last_updated":"2025-05-29T07:47:48Z","snapshot_observed_at":"2026-08-08T12:28:17.887912Z","submitted_at":"2025-05-29T07:47:48Z","title":"Towards Robust Overlapping Speech Detection: A Speaker-Aware Progressive Approach Using WavLM","version":1},"cited_work":{"arxiv_id":"2505.23207","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.23207","snapshot_observed_at":"2026-08-07T12:55:26.461821Z","title":"Towards Robust Overlapping Speech Detection: A Speaker-Aware Progressive Approach Using WavLM","venue":"cs.SD","work_id":"32ae2e0d-6e7e-4430-81ee-f255fb40fcaa","year":2025},"citing_paper":{"arxiv_id":"2505.23207","last_updated":"2025-05-29T07:47:48Z","snapshot_observed_at":"2026-08-08T12:28:17.887912Z","submitted_at":"2025-05-29T07:47:48Z","title":"Towards Robust Overlapping Speech Detection: A Speaker-Aware Progressive Approach Using WavLM","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:22.270498Z"},"links":{"cited_paper":"/paper/2505.23207","citing_paper":"/paper/2505.23207"},"observation_digest":"sha256:fc01d70370de26f477d1eaedd65e91b433fbd480240c6744d5cb56716bfee0fb","observation_id":"0c939e92-2816-42d6-a6c3-f0aef865badc","resolution":{"observed_at":"2026-08-07T12:55:26.468070Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.23207/citation-record","integrity":"/paper/2505.23207/integrity","json":"/paper/2505.23207/citation-record.json","paper":"/paper/2505.23207"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:27.836144Z","title":"Overlapping regions present unique challenges, as they involve both overlap of speech segments and speaker identities","venue":null,"work_id":"8667a66b-5bfb-46c8-b404-02572f8918a8","year":null},"citing_paper":{"arxiv_id":"2505.23207","last_updated":"2025-05-29T07:47:48Z","snapshot_observed_at":"2026-08-08T12:28:17.887912Z","submitted_at":"2025-05-29T07:47:48Z","title":"Towards Robust Overlapping Speech Detection: A Speaker-Aware Progressive Approach Using WavLM","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:22.204152Z"},"links":{"citing_paper":"/paper/2505.23207"},"observation_digest":"sha256:386f54573941040fd5fd76a21b9c593ef994acefff668e163a176a68a5baa888","observation_id":"7d5a2b0e-7db5-476e-8385-2cfddbf7dc21","resolution":{"observed_at":"2026-08-07T12:55:27.881421Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:27.746152Z","title":"We be- gin with an overview of the progressive OSD architecture, fol- lowed by a detailed explanation of the progressive OSD training strategy","venue":null,"work_id":"d563984f-8de8-4c23-9d60-a235a705fa75","year":null},"citing_paper":{"arxiv_id":"2505.23207","last_updated":"2025-05-29T07:47:48Z","snapshot_observed_at":"2026-08-08T12:28:17.887912Z","submitted_at":"2025-05-29T07:47:48Z","title":"Towards Robust Overlapping Speech Detection: A Speaker-Aware Progressive Approach Using WavLM","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:22.362092Z"},"links":{"citing_paper":"/paper/2505.23207"},"observation_digest":"sha256:21f6e93405694006d842301735e9532bc72ed619da032c43ed3cb908f461f5b2","observation_id":"01f4d765-3c10-453b-a958-7fd9cc6d5a7e","resolution":{"observed_at":"2026-08-07T12:55:27.776832Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:27.533714Z","title":"Experiments setup In this section, we describe the experimental setup used for our paper, including the datasets and training configurations","venue":null,"work_id":"4edc2d85-1bd4-4b10-acef-f1d4b9c19530","year":null},"citing_paper":{"arxiv_id":"2505.23207","last_updated":"2025-05-29T07:47:48Z","snapshot_observed_at":"2026-08-08T12:28:17.887912Z","submitted_at":"2025-05-29T07:47:48Z","title":"Towards Robust Overlapping Speech Detection: A Speaker-Aware Progressive Approach Using WavLM","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:22.540302Z"},"links":{"citing_paper":"/paper/2505.23207"},"observation_digest":"sha256:5e41dfb2744bb870a839fe576d11d4cb18c58adcf2dd0087f0842b71a02e36b3","observation_id":"d0a1eabd-7eed-407a-8820-ee4890fd8a98","resolution":{"observed_at":"2026-08-07T12:55:27.601092Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:27.428285Z","title":"Ex- perimental results consistently demonstrate the advantages of this approach across different configurations","venue":null,"work_id":"e502c62e-0bb1-45aa-968c-16ae6bfc6e89","year":2025},"citing_paper":{"arxiv_id":"2505.23207","last_updated":"2025-05-29T07:47:48Z","snapshot_observed_at":"2026-08-08T12:28:17.887912Z","submitted_at":"2025-05-29T07:47:48Z","title":"Towards Robust Overlapping Speech Detection: A Speaker-Aware Progressive Approach Using WavLM","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:22.623923Z"},"links":{"citing_paper":"/paper/2505.23207"},"observation_digest":"sha256:087f8c7c55ff98b21891b9ed1e9fcc15ce412f843ae8e4abbc73e29323e30c34","observation_id":"2cb4a584-f50c-45a1-a8d2-4053d88c68f4","resolution":{"observed_at":"2026-08-07T12:55:27.480431Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:27.018354Z","title":"Detection of overlapping speech for the purposes of speaker diarization,","venue":null,"work_id":"8837505a-53c7-4d1a-86a6-0803da4d9b2a","year":2019},"citing_paper":{"arxiv_id":"2505.23207","last_updated":"2025-05-29T07:47:48Z","snapshot_observed_at":"2026-08-08T12:28:17.887912Z","submitted_at":"2025-05-29T07:47:48Z","title":"Towards Robust Overlapping Speech Detection: A Speaker-Aware Progressive Approach Using WavLM","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:23.056677Z"},"links":{"citing_paper":"/paper/2505.23207"},"observation_digest":"sha256:75fd33aef67e61fe749dd33b2267737ee150fd8f15f120eb46c6ae58a9a9c399","observation_id":"54bfc9cf-c1a6-41d2-91e2-7490932c5b79","resolution":{"observed_at":"2026-08-07T12:55:27.048409Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.11646","last_updated":"2019-10-25T12:22:14Z","snapshot_observed_at":"2026-08-14T12:26:57.192928Z","submitted_at":"2019-10-25T12:22:14Z","title":"Overlap-aware diarization: resegmentation using neural end-to-end overlapped speech detection","version":1},"cited_work":{"arxiv_id":"1910.11646","doi":null,"metadata_source":"pith","pith_arxiv_id":"1910.11646","snapshot_observed_at":"2026-08-07T12:55:26.341121Z","title":"Overlap-aware diarization: resegmentation using neural end-to-end overlapped speech detection","venue":"eess.AS","work_id":"bd900b56-373b-42f9-b853-318cc187d5d8","year":2019},"citing_paper":{"arxiv_id":"2505.23207","last_updated":"2025-05-29T07:47:48Z","snapshot_observed_at":"2026-08-08T12:28:17.887912Z","submitted_at":"2025-05-29T07:47:48Z","title":"Towards Robust Overlapping Speech Detection: A Speaker-Aware Progressive Approach Using WavLM","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:23.123922Z"},"links":{"cited_paper":"/paper/1910.11646","citing_paper":"/paper/2505.23207"},"observation_digest":"sha256:7c348dcd99f8379738f077be66b14e639cc3187e57a675d2ef2be7075890a5af","observation_id":"19b4013f-3da8-48cb-99b7-59c0466f72c6","resolution":{"observed_at":"2026-08-07T12:55:26.413671Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:27.265215Z","title":"Diarization is hard: Some experiences and lessons learned for the jhu team in the inaugural dihard challenge,","venue":null,"work_id":"65f6ae4e-edee-4cac-9c4a-653a7139d58d","year":2018},"citing_paper":{"arxiv_id":"2505.23207","last_updated":"2025-05-29T07:47:48Z","snapshot_observed_at":"2026-08-08T12:28:17.887912Z","submitted_at":"2025-05-29T07:47:48Z","title":"Towards Robust Overlapping Speech Detection: A Speaker-Aware Progressive Approach Using WavLM","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:22.723328Z"},"links":{"citing_paper":"/paper/2505.23207"},"observation_digest":"sha256:863f65a319d8df8d769d83b6ea4d40af8e3e929ddd6d75f909588b5882cacdbe","observation_id":"7801a417-4517-4951-915e-a1b063b288fd","resolution":{"observed_at":"2026-08-07T12:55:27.335488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:27.122584Z","title":"Overlapped speech detection for improved speaker diarization in multiparty meetings,","venue":null,"work_id":"f8a1f43b-9858-48a9-b110-46c30974ebf7","year":2008},"citing_paper":{"arxiv_id":"2505.23207","last_updated":"2025-05-29T07:47:48Z","snapshot_observed_at":"2026-08-08T12:28:17.887912Z","submitted_at":"2025-05-29T07:47:48Z","title":"Towards Robust Overlapping Speech Detection: A Speaker-Aware Progressive Approach Using WavLM","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:22.809830Z"},"links":{"citing_paper":"/paper/2505.23207"},"observation_digest":"sha256:05b74d94abe0fd440c92a7caa9b320e6cb5b787aa2e2045102022a6e171afbb9","observation_id":"3c60974b-963c-4127-b547-3db2af44b773","resolution":{"observed_at":"2026-08-07T12:55:27.163884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:27.107489Z","title":"Impact of overlapping speech detection on speaker diarization for broadcast news and debates,","venue":null,"work_id":"2779731a-3d5f-4c25-b917-b6ffb770e37e","year":2013},"citing_paper":{"arxiv_id":"2505.23207","last_updated":"2025-05-29T07:47:48Z","snapshot_observed_at":"2026-08-08T12:28:17.887912Z","submitted_at":"2025-05-29T07:47:48Z","title":"Towards Robust Overlapping Speech Detection: A Speaker-Aware Progressive Approach Using WavLM","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:22.911625Z"},"links":{"citing_paper":"/paper/2505.23207"},"observation_digest":"sha256:d96d4ca741400c1c8493f926a7822cc3839728160d376a5ef7abe29da8b7c5d9","observation_id":"dedf134a-0f63-4b36-ae91-0818acd1973b","resolution":{"observed_at":"2026-08-07T12:55:27.117536Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:27.057315Z","title":"But system for dihard speech diariza- tion challenge 2018,","venue":null,"work_id":"f931d9a7-be4d-42c1-b5ff-9a2264fe6ba8","year":2018},"citing_paper":{"arxiv_id":"2505.23207","last_updated":"2025-05-29T07:47:48Z","snapshot_observed_at":"2026-08-08T12:28:17.887912Z","submitted_at":"2025-05-29T07:47:48Z","title":"Towards Robust Overlapping Speech Detection: A Speaker-Aware Progressive Approach Using WavLM","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:22.977314Z"},"links":{"citing_paper":"/paper/2505.23207"},"observation_digest":"sha256:e151d07e473c71c2578ad8c336be63e79bae48375a157e24b7b0b61818ffad6a","observation_id":"7c58cc05-b030-4585-826a-87c52ec2d9c8","resolution":{"observed_at":"2026-08-07T12:55:27.089770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:26.832254Z","title":"Over- lapped speech detection in broadcast streams using x-vectors","venue":null,"work_id":"b0acbddb-f5af-42cf-a62c-cf5e61f75036","year":2022},"citing_paper":{"arxiv_id":"2505.23207","last_updated":"2025-05-29T07:47:48Z","snapshot_observed_at":"2026-08-08T12:28:17.887912Z","submitted_at":"2025-05-29T07:47:48Z","title":"Towards Robust Overlapping Speech Detection: A Speaker-Aware Progressive Approach Using WavLM","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:23.504834Z"},"links":{"citing_paper":"/paper/2505.23207"},"observation_digest":"sha256:d2fa6f3a43db6814cb5827fa1e66ed9a40da125d822183f92511c5e575fa27e4","observation_id":"68d7d2b3-2805-4f86-ab3e-857b402f75db","resolution":{"observed_at":"2026-08-07T12:55:26.882336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.00819","last_updated":"2024-09-01T19:23:08Z","snapshot_observed_at":"2026-08-16T13:22:16.279382Z","submitted_at":"2024-09-01T19:23:08Z","title":"LibriheavyMix: A 20,000-Hour Dataset for Single-Channel Reverberant Multi-Talker Speech Separation, ASR and Speaker Diarization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.00819","snapshot_observed_at":"2026-08-07T12:55:23.552544Z","title":"Libriheavymix: a 20,000-hour dataset for single-channel reverberant multi-talker speech separation, asr and speaker diarization,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23207","last_updated":"2025-05-29T07:47:48Z","snapshot_observed_at":"2026-08-08T12:28:17.887912Z","submitted_at":"2025-05-29T07:47:48Z","title":"Towards Robust Overlapping Speech Detection: A Speaker-Aware Progressive Approach Using WavLM","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:23.552544Z"},"links":{"cited_paper":"/paper/2409.00819","citing_paper":"/paper/2505.23207"},"observation_digest":"sha256:29a3f9d7b10396813619e2ab394bd1f3f6a2ce15240ef49012fe4eca2e620df4","observation_id":"25eddd46-20c7-413e-abc3-cbe12ac82788","resolution":{"observed_at":"2026-08-07T12:55:23.552544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.12002","last_updated":"2022-09-24T13:04:52Z","snapshot_observed_at":"2026-08-16T16:30:10.445134Z","submitted_at":"2022-09-24T13:04:52Z","title":"Spatial-aware Speaker Diarization for Multi-channel Multi-party Meeting","version":1},"cited_work":{"arxiv_id":"2209.12002","doi":null,"metadata_source":"pith","pith_arxiv_id":"2209.12002","snapshot_observed_at":"2026-08-07T12:55:26.135381Z","title":"Spatial-aware Speaker Diarization for Multi-channel Multi-party Meeting","venue":"eess.AS","work_id":"986f5ced-653b-436a-9be4-983437031208","year":2022},"citing_paper":{"arxiv_id":"2505.23207","last_updated":"2025-05-29T07:47:48Z","snapshot_observed_at":"2026-08-08T12:28:17.887912Z","submitted_at":"2025-05-29T07:47:48Z","title":"Towards Robust Overlapping Speech Detection: A Speaker-Aware Progressive Approach Using WavLM","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:23.180642Z"},"links":{"cited_paper":"/paper/2209.12002","citing_paper":"/paper/2505.23207"},"observation_digest":"sha256:193d79f32156a04437bfaf2117a57ac06754f98c182255f7e93ff6702ca24173","observation_id":"aa3cc08e-f03e-4394-bb18-11330dd16de1","resolution":{"observed_at":"2026-08-07T12:55:26.254347Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23207","last_updated":"2025-05-29T07:47:48Z","snapshot_observed_at":"2026-08-08T12:28:17.887912Z","submitted_at":"2025-05-29T07:47:48Z","title":"Towards Robust Overlapping Speech Detection: A Speaker-Aware Progressive Approach Using WavLM","version":1},"cited_work":{"arxiv_id":"2505.23207","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.23207","snapshot_observed_at":"2026-08-07T12:55:26.461821Z","title":"Towards Robust Overlapping Speech Detection: A Speaker-Aware Progressive Approach Using WavLM","venue":"cs.SD","work_id":"32ae2e0d-6e7e-4430-81ee-f255fb40fcaa","year":2025},"citing_paper":{"arxiv_id":"2505.23207","last_updated":"2025-05-29T07:47:48Z","snapshot_observed_at":"2026-08-08T12:28:17.887912Z","submitted_at":"2025-05-29T07:47:48Z","title":"Towards Robust Overlapping Speech Detection: A Speaker-Aware Progressive Approach Using WavLM","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:22.270498Z"},"links":{"cited_paper":"/paper/2505.23207","citing_paper":"/paper/2505.23207"},"observation_digest":"sha256:fc01d70370de26f477d1eaedd65e91b433fbd480240c6744d5cb56716bfee0fb","observation_id":"0c939e92-2816-42d6-a6c3-f0aef865badc","resolution":{"observed_at":"2026-08-07T12:55:26.468070Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.04045","last_updated":"2021-06-10T13:51:47Z","snapshot_observed_at":"2026-08-16T18:32:53.281155Z","submitted_at":"2021-04-08T20:38:17Z","title":"End-to-end speaker segmentation for overlap-aware resegmentation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.04045","snapshot_observed_at":"2026-08-07T12:55:23.255131Z","title":"End-to-end speaker segmentation for overlap-aware resegmentation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.23207","last_updated":"2025-05-29T07:47:48Z","snapshot_observed_at":"2026-08-08T12:28:17.887912Z","submitted_at":"2025-05-29T07:47:48Z","title":"Towards Robust Overlapping Speech Detection: A Speaker-Aware Progressive Approach Using WavLM","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:23.255131Z"},"links":{"cited_paper":"/paper/2104.04045","citing_paper":"/paper/2505.23207"},"observation_digest":"sha256:0acd9c05aba19d543bace525734f0c10c1d0ff82de0716632b9010df5f69c878","observation_id":"57d4a822-6ce5-4784-8828-42d818cbb285","resolution":{"observed_at":"2026-08-07T12:55:23.255131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05987","last_updated":"2023-09-07T07:56:10Z","snapshot_observed_at":"2026-08-16T15:09:11.712592Z","submitted_at":"2023-08-11T07:50:41Z","title":"Large-Scale Learning on Overlapped Speech Detection: New Benchmark and New General System","version":3},"cited_work":{"arxiv_id":"2308.05987","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.05987","snapshot_observed_at":"2026-08-07T12:55:25.970505Z","title":"Large-Scale Learning on Overlapped Speech Detection: New Benchmark and New General System","venue":"cs.SD","work_id":"fe053dc3-0730-4f77-92b7-74fead59aee9","year":2023},"citing_paper":{"arxiv_id":"2505.23207","last_updated":"2025-05-29T07:47:48Z","snapshot_observed_at":"2026-08-08T12:28:17.887912Z","submitted_at":"2025-05-29T07:47:48Z","title":"Towards Robust Overlapping Speech Detection: A Speaker-Aware Progressive Approach Using WavLM","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:23.323154Z"},"links":{"cited_paper":"/paper/2308.05987","citing_paper":"/paper/2505.23207"},"observation_digest":"sha256:66b110a2af3ee4861e1f8d8dd4ad90ef14638c1b2a8b2dfdc363a14486ab00d6","observation_id":"9f58ddf8-6df3-40cb-b617-85568ac791f2","resolution":{"observed_at":"2026-08-07T12:55:26.006554Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:26.969942Z","title":"Automatic detection of multi- speaker fragments with high time resolution,","venue":null,"work_id":"536b4e30-41cd-42c0-bfdd-4697e730cdf1","year":2018},"citing_paper":{"arxiv_id":"2505.23207","last_updated":"2025-05-29T07:47:48Z","snapshot_observed_at":"2026-08-08T12:28:17.887912Z","submitted_at":"2025-05-29T07:47:48Z","title":"Towards Robust Overlapping Speech Detection: A Speaker-Aware Progressive Approach Using WavLM","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:23.420013Z"},"links":{"citing_paper":"/paper/2505.23207"},"observation_digest":"sha256:4fa2905c4f47b8c20b0880ced3279cd12ec684022c79e0253fbb6e73f5835825","observation_id":"bf33a67d-5e8c-452d-a8a6-5d0cca8ca36c","resolution":{"observed_at":"2026-08-07T12:55:26.995175Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.04049","last_updated":"2021-09-09T06:10:48Z","snapshot_observed_at":"2026-08-16T17:57:53.972458Z","submitted_at":"2021-09-09T06:10:48Z","title":"BeamTransformer: Microphone Array-based Overlapping Speech Detection","version":1},"cited_work":{"arxiv_id":"2109.04049","doi":null,"metadata_source":"pith","pith_arxiv_id":"2109.04049","snapshot_observed_at":"2026-08-07T12:55:25.736785Z","title":"BeamTransformer: Microphone Array-based Overlapping Speech Detection","venue":"cs.SD","work_id":"69d1d80c-acc7-457d-ad88-c31b04e08e5c","year":2021},"citing_paper":{"arxiv_id":"2505.23207","last_updated":"2025-05-29T07:47:48Z","snapshot_observed_at":"2026-08-08T12:28:17.887912Z","submitted_at":"2025-05-29T07:47:48Z","title":"Towards Robust Overlapping Speech Detection: A Speaker-Aware Progressive Approach Using WavLM","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:23.981026Z"},"links":{"cited_paper":"/paper/2109.04049","citing_paper":"/paper/2505.23207"},"observation_digest":"sha256:e9e26fff990762cd1790d3468e465b52d2285939df9943f4e37ef9d1aad5f28f","observation_id":"2c72fb69-e9f7-4391-8b94-51c92042e0e1","resolution":{"observed_at":"2026-08-07T12:55:25.924681Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:23.633794Z","title":"Multitask detection of speaker changes, overlapping speech and voice activity using wav2vec 2.0,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23207","last_updated":"2025-05-29T07:47:48Z","snapshot_observed_at":"2026-08-08T12:28:17.887912Z","submitted_at":"2025-05-29T07:47:48Z","title":"Towards Robust Overlapping Speech Detection: A Speaker-Aware Progressive Approach Using WavLM","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:23.633794Z"},"links":{"citing_paper":"/paper/2505.23207"},"observation_digest":"sha256:a8d6cce548cbfa161d80a10103f3e954c9112203029856d02ef7fba632902d9c","observation_id":"8e3967e4-3b72-4537-bb5e-e4e3e5bb4fad","resolution":{"observed_at":"2026-08-07T12:55:23.633794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:23.697828Z","title":"M2met: The icassp 2022 multi- channel multi-party meeting transcription challenge,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.23207","last_updated":"2025-05-29T07:47:48Z","snapshot_observed_at":"2026-08-08T12:28:17.887912Z","submitted_at":"2025-05-29T07:47:48Z","title":"Towards Robust Overlapping Speech Detection: A Speaker-Aware Progressive Approach Using WavLM","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:23.697828Z"},"links":{"citing_paper":"/paper/2505.23207"},"observation_digest":"sha256:7108c87ee365737bef22fd0feb2f2485393b1872118d9911f6d04a12852f7200","observation_id":"ffd7667d-2e9d-4c9a-a948-d991e34033ce","resolution":{"observed_at":"2026-08-07T12:55:23.697828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:26.727920Z","title":"Recognition and under- standing of meetings the ami and amida projects,","venue":null,"work_id":"e7daa072-5847-45cd-ac65-f72d1e21016d","year":2007},"citing_paper":{"arxiv_id":"2505.23207","last_updated":"2025-05-29T07:47:48Z","snapshot_observed_at":"2026-08-08T12:28:17.887912Z","submitted_at":"2025-05-29T07:47:48Z","title":"Towards Robust Overlapping Speech Detection: A Speaker-Aware Progressive Approach Using WavLM","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:23.764082Z"},"links":{"citing_paper":"/paper/2505.23207"},"observation_digest":"sha256:6f1801a7a4e907a6e8e6a7b0aabdd0a161f458a06e64f182bf1391d5358929a0","observation_id":"700fc423-6ce2-49c8-98f2-b9d2ece4006b","resolution":{"observed_at":"2026-08-07T12:55:26.773092Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:23.827907Z","title":"A survey on multi-task learning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.23207","last_updated":"2025-05-29T07:47:48Z","snapshot_observed_at":"2026-08-08T12:28:17.887912Z","submitted_at":"2025-05-29T07:47:48Z","title":"Towards Robust Overlapping Speech Detection: A Speaker-Aware Progressive Approach Using WavLM","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:23.827907Z"},"links":{"citing_paper":"/paper/2505.23207"},"observation_digest":"sha256:daa33e68fb27a200cbb643bcd20f18be594c6c483125364f1cd939ff6f5dbe28","observation_id":"af77ebdc-b08f-4a93-bb19-332d31537a5a","resolution":{"observed_at":"2026-08-07T12:55:23.827907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.02878","last_updated":"2021-04-07T03:01:34Z","snapshot_observed_at":"2026-08-16T18:33:25.144047Z","submitted_at":"2021-04-07T03:01:34Z","title":"Three-class Overlapped Speech Detection using a Convolutional Recurrent Neural Network","version":1},"cited_work":{"arxiv_id":"2104.02878","doi":null,"metadata_source":"pith","pith_arxiv_id":"2104.02878","snapshot_observed_at":"2026-08-07T12:55:25.955781Z","title":"Three-class Overlapped Speech Detection using a Convolutional Recurrent Neural Network","venue":"eess.AS","work_id":"face87b5-27fc-4a9e-bf48-92ff1dfed051","year":2021},"citing_paper":{"arxiv_id":"2505.23207","last_updated":"2025-05-29T07:47:48Z","snapshot_observed_at":"2026-08-08T12:28:17.887912Z","submitted_at":"2025-05-29T07:47:48Z","title":"Towards Robust Overlapping Speech Detection: A Speaker-Aware Progressive Approach Using WavLM","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:23.910130Z"},"links":{"cited_paper":"/paper/2104.02878","citing_paper":"/paper/2505.23207"},"observation_digest":"sha256:893652c4b3218cd00ce9195f615b5de6d682be30c515d2f0fff31782ab3c98ba","observation_id":"2bfca183-8cf7-4478-bc99-e79e6d22bb95","resolution":{"observed_at":"2026-08-07T12:55:25.958145Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:26.472265Z","title":"Target- speaker voice activity detection: A novel approach for multi- speaker diarization in a dinner party scenario,","venue":null,"work_id":"81e8ebe4-46ce-49b2-8168-30d733ca5d68","year":null},"citing_paper":{"arxiv_id":"2505.23207","last_updated":"2025-05-29T07:47:48Z","snapshot_observed_at":"2026-08-08T12:28:17.887912Z","submitted_at":"2025-05-29T07:47:48Z","title":"Towards Robust Overlapping Speech Detection: A Speaker-Aware Progressive Approach Using WavLM","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:24.369768Z"},"links":{"citing_paper":"/paper/2505.23207"},"observation_digest":"sha256:89caa85181aea0f2d101dd5e5ddcde6406220906257d3dbb9ed5f2831a729ae8","observation_id":"6fbb3121-2452-41fd-803a-6ab5455fd730","resolution":{"observed_at":"2026-08-07T12:55:26.474965Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:26.605284Z","title":"A survey on text-dependent and text-independent speaker verification,","venue":null,"work_id":"2dddd383-94bf-4cd2-af03-6867b538eb7d","year":2022},"citing_paper":{"arxiv_id":"2505.23207","last_updated":"2025-05-29T07:47:48Z","snapshot_observed_at":"2026-08-08T12:28:17.887912Z","submitted_at":"2025-05-29T07:47:48Z","title":"Towards Robust Overlapping Speech Detection: A Speaker-Aware Progressive Approach Using WavLM","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:24.058217Z"},"links":{"citing_paper":"/paper/2505.23207"},"observation_digest":"sha256:b267ffd3cc3b8c08432d5b64cef6cfb9e36c8c42961dc8967073fb72cdd4de93","observation_id":"dc20b860-6cce-48e7-b612-ff57b515e4b2","resolution":{"observed_at":"2026-08-07T12:55:26.651952Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:27.673146Z","title":"In this paper, we adapt WavLM for OSD tasks","venue":null,"work_id":"98c7c1aa-3a04-428b-b8c8-a3180af1b53e","year":null},"citing_paper":{"arxiv_id":"2505.23207","last_updated":"2025-05-29T07:47:48Z","snapshot_observed_at":"2026-08-08T12:28:17.887912Z","submitted_at":"2025-05-29T07:47:48Z","title":"Towards Robust Overlapping Speech Detection: A Speaker-Aware Progressive Approach Using WavLM","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:22.454267Z"},"links":{"citing_paper":"/paper/2505.23207"},"observation_digest":"sha256:e8bfbbb648ee7adf0d636be2f34facf14822434c190bb15dfbde1f1e6c35c560","observation_id":"7de0ce69-62c6-4636-b13a-852c09fa9e51","resolution":{"observed_at":"2026-08-07T12:55:27.688496Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.01466","last_updated":"2021-04-03T19:37:51Z","snapshot_observed_at":"2026-08-16T18:34:03.148289Z","submitted_at":"2021-04-03T19:37:51Z","title":"ECAPA-TDNN Embeddings for Speaker Diarization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.01466","snapshot_observed_at":"2026-08-07T12:55:24.123323Z","title":"Ecapa-tdnn embeddings for speaker di- arization,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.23207","last_updated":"2025-05-29T07:47:48Z","snapshot_observed_at":"2026-08-08T12:28:17.887912Z","submitted_at":"2025-05-29T07:47:48Z","title":"Towards Robust Overlapping Speech Detection: A Speaker-Aware Progressive Approach Using WavLM","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:24.123323Z"},"links":{"cited_paper":"/paper/2104.01466","citing_paper":"/paper/2505.23207"},"observation_digest":"sha256:1d1a511215481b211c088af7716ebcb3df38b496e5b3ab0b4c2c4c1e2c0888d1","observation_id":"6794acf1-22c7-4ed7-916c-4b27545f55c5","resolution":{"observed_at":"2026-08-07T12:55:24.123323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.00332","last_updated":"2023-06-16T09:07:11Z","snapshot_observed_at":"2026-08-16T15:51:49.152928Z","submitted_at":"2023-03-01T08:50:31Z","title":"CAM++: A Fast and Efficient Network for Speaker Verification Using Context-Aware Masking","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.00332","snapshot_observed_at":"2026-08-07T12:55:24.199871Z","title":"Cam++: A fast and efficient network for speaker verification using context- aware masking,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23207","last_updated":"2025-05-29T07:47:48Z","snapshot_observed_at":"2026-08-08T12:28:17.887912Z","submitted_at":"2025-05-29T07:47:48Z","title":"Towards Robust Overlapping Speech Detection: A Speaker-Aware Progressive Approach Using WavLM","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:24.199871Z"},"links":{"cited_paper":"/paper/2303.00332","citing_paper":"/paper/2505.23207"},"observation_digest":"sha256:19645d46f61e7186765c261343f74da57af37df7c65ac70f860620db4be3e44d","observation_id":"e3a807a5-cb05-448e-beb9-10498a10e830","resolution":{"observed_at":"2026-08-07T12:55:24.199871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:24.261854Z","title":"Wavlm: Large-scale self- supervised pre-training for full stack speech processing,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.23207","last_updated":"2025-05-29T07:47:48Z","snapshot_observed_at":"2026-08-08T12:28:17.887912Z","submitted_at":"2025-05-29T07:47:48Z","title":"Towards Robust Overlapping Speech Detection: A Speaker-Aware Progressive Approach Using WavLM","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:24.261854Z"},"links":{"citing_paper":"/paper/2505.23207"},"observation_digest":"sha256:f39a49d1d4fb188e2e19a9549ff489e8e9c4c4c1686a91e25e882051ab0071f9","observation_id":"800c25ff-5116-41db-ba03-bf0c0d9e30a7","resolution":{"observed_at":"2026-08-07T12:55:24.261854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:26.489351Z","title":"Frame-wise and overlap-robust speaker em- beddings for meeting diarization,","venue":null,"work_id":"8878baf7-1a2a-4691-b005-19be132a32d2","year":2023},"citing_paper":{"arxiv_id":"2505.23207","last_updated":"2025-05-29T07:47:48Z","snapshot_observed_at":"2026-08-08T12:28:17.887912Z","submitted_at":"2025-05-29T07:47:48Z","title":"Towards Robust Overlapping Speech Detection: A Speaker-Aware Progressive Approach Using WavLM","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:24.319519Z"},"links":{"citing_paper":"/paper/2505.23207"},"observation_digest":"sha256:7a360a0f1b8a84d816849dda1bce819806028da18c80ce0db157871c30470d96","observation_id":"0017e364-824d-4ecd-ab6f-53770d6b2b09","resolution":{"observed_at":"2026-08-07T12:55:26.521430Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13012","last_updated":"2023-07-24T14:29:21Z","snapshot_observed_at":"2026-08-16T15:13:45.851288Z","submitted_at":"2023-07-24T14:29:21Z","title":"Joint speech and overlap detection: a benchmark over multiple audio setup and speech domains","version":1},"cited_work":{"arxiv_id":"2307.13012","doi":null,"metadata_source":"pith","pith_arxiv_id":"2307.13012","snapshot_observed_at":"2026-08-07T12:55:25.348748Z","title":"Joint speech and overlap detection: a benchmark over multiple audio setup and speech domains","venue":"cs.SD","work_id":"50d6f856-dc7e-44b0-b1fa-79053b278201","year":2023},"citing_paper":{"arxiv_id":"2505.23207","last_updated":"2025-05-29T07:47:48Z","snapshot_observed_at":"2026-08-08T12:28:17.887912Z","submitted_at":"2025-05-29T07:47:48Z","title":"Towards Robust Overlapping Speech Detection: A Speaker-Aware Progressive Approach Using WavLM","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:24.417081Z"},"links":{"cited_paper":"/paper/2307.13012","citing_paper":"/paper/2505.23207"},"observation_digest":"sha256:a0efe79bc1f875745a0c798e240fa872891c173a66b4f97b0df1c71306286d56","observation_id":"064fbc58-6a89-4bdc-8922-2bf9f78607b6","resolution":{"observed_at":"2026-08-07T12:55:25.549707Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.08552","last_updated":"2024-09-13T06:11:11Z","snapshot_observed_at":"2026-08-16T13:18:55.787756Z","submitted_at":"2024-09-13T06:11:11Z","title":"Unified Audio Event Detection","version":1},"cited_work":{"arxiv_id":"2409.08552","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.08552","snapshot_observed_at":"2026-08-07T12:55:24.968697Z","title":"Unified Audio Event Detection","venue":"eess.AS","work_id":"096ae29f-0019-4f12-ab80-b18e9fb41bdd","year":2024},"citing_paper":{"arxiv_id":"2505.23207","last_updated":"2025-05-29T07:47:48Z","snapshot_observed_at":"2026-08-08T12:28:17.887912Z","submitted_at":"2025-05-29T07:47:48Z","title":"Towards Robust Overlapping Speech Detection: A Speaker-Aware Progressive Approach Using WavLM","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:24.457100Z"},"links":{"cited_paper":"/paper/2409.08552","citing_paper":"/paper/2505.23207"},"observation_digest":"sha256:a26b118cf2807d280c8d01b7f16106f8d4d8a32f9d99991fa80305d742044d01","observation_id":"012e5df1-d63a-49c9-842e-ae7e0e7ec4e8","resolution":{"observed_at":"2026-08-07T12:55:25.125436Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.01960","last_updated":"2024-03-04T11:57:32Z","snapshot_observed_at":"2026-08-16T14:13:07.286848Z","submitted_at":"2024-03-04T11:57:32Z","title":"A robust audio deepfake detection system via multi-view feature","version":1},"cited_work":{"arxiv_id":"2403.01960","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.01960","snapshot_observed_at":"2026-08-07T12:55:24.615890Z","title":"A robust audio deepfake detection system via multi-view feature","venue":"cs.SD","work_id":"87ffefc2-5e43-446b-8bc7-7fc261324489","year":2024},"citing_paper":{"arxiv_id":"2505.23207","last_updated":"2025-05-29T07:47:48Z","snapshot_observed_at":"2026-08-08T12:28:17.887912Z","submitted_at":"2025-05-29T07:47:48Z","title":"Towards Robust Overlapping Speech Detection: A Speaker-Aware Progressive Approach Using WavLM","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:24.534982Z"},"links":{"cited_paper":"/paper/2403.01960","citing_paper":"/paper/2505.23207"},"observation_digest":"sha256:e91e8bc2d0f985ade23fc766cd84d1198f6222807534b2b8f9530541117028b2","observation_id":"7dc939a6-a656-4182-aa5a-07550c43ef72","resolution":{"observed_at":"2026-08-07T12:55:24.757257Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.23207","last_updated":"2025-05-29T07:47:48Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-08T12:28:17.887912Z","submitted_at":"2025-05-29T07:47:48Z","title":"Towards Robust Overlapping Speech Detection: A Speaker-Aware Progressive Approach Using WavLM"},"reference_resolution":{"displayed":33,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":8,"verified_exact":9,"verified_fuzzy":16},"total_outbound_references":33},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 1 inbound Pith citation observation for arXiv:2505.23207."}