{"as_of":"2026-08-15T17:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cffc5edfd90d55b8b25b673e2e2ddf99f30dddf85f877f3546ee506613fda9ee","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T11:12:18.083831Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2411.18497/citation-record","integrity":"/paper/2411.18497/integrity","json":"/paper/2411.18497/citation-record.json","paper":"/paper/2411.18497"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.700344Z","title":"Automatic speech recognition in cocktail-party situations: A specific training for separated speech,","venue":null,"work_id":"02d60211-0d8a-41dc-a5d4-b9b99965eda5","year":2012},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-14T08:19:08.302218Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:17.948669Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:716cd58c9ae16f88cf03fa3c8585d9986b145706704bc40cdcd8b34f0f7e839c","observation_id":"38fda7ad-19d4-4639-8193-ff8b811a1f4e","resolution":{"observed_at":"2026-08-12T11:12:18.704556Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.690007Z","title":"Espnet-se: End- to-end speech enhancement and separation toolkit designed for asr integration,","venue":null,"work_id":"29d1080c-3593-4827-86df-d008bac842fe","year":2021},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-14T08:19:08.302218Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:17.952938Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:46bbe07cdd8c9d73fb904d300cbe20f38fd3382085753373a0f71a666e046173","observation_id":"51858476-056c-4b51-bdf7-16c01e7d2a00","resolution":{"observed_at":"2026-08-12T11:12:18.693559Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.678869Z","title":"All-neural online source separation, counting, and diarization for meeting analysis,","venue":null,"work_id":"204a3aa5-c97f-490b-a590-9f5e77966ecd","year":2019},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-14T08:19:08.302218Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:17.956441Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:f67ec3f4aa00c21d296b2e71d0c768b0f9bf7b066653da646fe230f8bf4ebfe5","observation_id":"310eac9c-04b5-403b-9abb-1d41e41bc6f0","resolution":{"observed_at":"2026-08-12T11:12:18.682636Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.666782Z","title":"Ts-sep: Joint diarization and separation conditioned on estimated speaker embeddings,","venue":null,"work_id":"895e0b31-b5d6-4ddb-a1df-e9686756d65b","year":2024},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-14T08:19:08.302218Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:17.960076Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:0ec0d8dbd492dacfaecb460e56713ff5797ca9e844be462e505516e98bfdbc6a","observation_id":"4e4b6418-2341-49f0-98c8-e625825025f1","resolution":{"observed_at":"2026-08-12T11:12:18.671464Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.656319Z","title":"Singing-voice separation from monaural recordings using robust prin- cipal component analysis,","venue":null,"work_id":"86241419-7baf-4b52-9285-5e3c8216e172","year":2012},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-14T08:19:08.302218Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:17.963380Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:30b962bd984a6421210cb0a4ce1cc1b3786ebb01af0b6dc052ca9b927db36ae7","observation_id":"41ede17a-2608-4abc-b90d-59308bcafd5a","resolution":{"observed_at":"2026-08-12T11:12:18.660447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.643943Z","title":"Speech recognition by bilateral cochlear implant users in a cocktail- party setting,","venue":null,"work_id":"ac7206b2-9258-4b3e-af30-6949f9a755a6","year":2009},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-14T08:19:08.302218Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:17.967791Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:4713dccf65f88c692d6bfc8c3d3ba6f489721fe6e41c201d98b4aca3f083842a","observation_id":"0f11207c-cf74-4fda-bace-e6975ab348e5","resolution":{"observed_at":"2026-08-12T11:12:18.648195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.632712Z","title":"The cocktail party robot: Sound source separation and localisation with an active binaural head,","venue":null,"work_id":"58d31f7e-6637-44a6-bb60-b465e2f68458","year":2012},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-14T08:19:08.302218Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:17.971982Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:e7e62fab3091f2eb488ebc48983716670e159af8d47f0e159cebd5abd40dd978","observation_id":"f1a17075-3c58-431f-a3ea-18e401a3350c","resolution":{"observed_at":"2026-08-12T11:12:18.636616Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.09921","last_updated":"2020-10-05T07:12:42Z","snapshot_observed_at":"2026-08-13T22:40:02.379515Z","submitted_at":"2020-05-20T09:08:41Z","title":"End-to-End Speaker Diarization for an Unknown Number of Speakers with Encoder-Decoder Based Attractors","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.09921","snapshot_observed_at":"2026-08-12T11:12:17.975216Z","title":"End- to-end speaker diarization for an unknown number of speakers with encoder-decoder based attractors,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-14T08:19:08.302218Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:17.975216Z"},"links":{"cited_paper":"/paper/2005.09921","citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:3edcb693c925923489da790da56bc2b7f4109b7d3fd31dc2ac602e387cbd0b11","observation_id":"fd2040c3-4ee0-4704-8cf3-e0c6204efd03","resolution":{"observed_at":"2026-08-12T11:12:17.975216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.621465Z","title":"Boosting unknown-number speaker separation with transformer decoder-based attractor,","venue":null,"work_id":"46a7788b-63a0-4b99-80df-73d291f0377f","year":2024},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-14T08:19:08.302218Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:17.979538Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:e8bc954f58bfd2968ba3a56e455211f37638da5273957b68b603f55c0ff80d81","observation_id":"a24905a6-7503-42c7-bc62-5ba71a0326e6","resolution":{"observed_at":"2026-08-12T11:12:18.625759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:17.982608Z","title":"Looking to listen at the cocktail party: a speaker-independent audio-visual model for speech separation,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-14T08:19:08.302218Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:17.982608Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:3e192219e36273247d73a2f8b6106cf221c456142bec40fae777968d9cd87831","observation_id":"05e5e8e6-48fd-4fcc-945a-ebc42d4e4440","resolution":{"observed_at":"2026-08-12T11:12:17.982608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.11801","last_updated":"2023-05-21T09:32:04Z","snapshot_observed_at":"2026-08-13T15:38:20.657641Z","submitted_at":"2022-05-24T05:40:36Z","title":"SepIt: Approaching a Single Channel Speech Separation Bound","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.11801","snapshot_observed_at":"2026-08-12T11:12:17.985998Z","title":"SepIt: Approaching a single channel speech separation bound,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-14T08:19:08.302218Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:17.985998Z"},"links":{"cited_paper":"/paper/2205.11801","citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:8dbd0e876a546c4291c38978cf2cd47f85b0762b6a75e09828dee13f6ef177c9","observation_id":"81cc6300-aed0-43e7-aa4c-2e32e5de74e0","resolution":{"observed_at":"2026-08-12T11:12:17.985998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:17.989908Z","title":"Supervised speech separation based on deep learning: An overview,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-14T08:19:08.302218Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:17.989908Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:320a8b2e17d935a41d22e81dceb1aff6daadeb328afc236d43b3359eb20ece8b","observation_id":"401310ac-70cc-4594-b6d8-362ea8b58460","resolution":{"observed_at":"2026-08-12T11:12:17.989908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.601064Z","title":"Sdr–half-baked or well done?","venue":null,"work_id":"721d281a-f5fd-4cf3-a29e-239457394466","year":2019},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-14T08:19:08.302218Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:17.993759Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:3bdbd8987f7a52a3d57d10eceb43cbbdbc0721737314f43a73f7f2cf16637a76","observation_id":"403508a8-884e-471d-b580-c8aa5b952fa1","resolution":{"observed_at":"2026-08-12T11:12:18.605597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.590328Z","title":"Joint optimization of masks and deep recurrent neural networks for monaural source separation,","venue":null,"work_id":"c2e30b6d-13de-487d-b7da-ae9c48197926","year":2015},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-14T08:19:08.302218Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:17.997086Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:0fade52e69055bbb82f5fe82ee5df65d37d03ca1253afe502d16cb670facc947","observation_id":"fe2a0365-d571-44f5-8da0-4a6effd92f26","resolution":{"observed_at":"2026-08-12T11:12:18.594092Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.579506Z","title":"Deep neural networks for single-channel multi-talker speech recognition,","venue":null,"work_id":"5c8053d9-1977-4af0-80d3-780bf8ab54ca","year":2015},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-14T08:19:08.302218Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:18.000753Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:9bf61300671aa6baa4c1d2614656805a9c037294c7e11c6dbdfc29fda6b58745","observation_id":"14abe082-9809-4412-aae3-922780083853","resolution":{"observed_at":"2026-08-12T11:12:18.583478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.568503Z","title":"Deep clustering: Discriminative embeddings for segmentation and separation,","venue":null,"work_id":"3bedaeaa-b843-44d8-b73f-6839411d8163","year":2016},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-14T08:19:08.302218Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:18.003650Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:2a231c0ec2a4ab7cdd58b0ad20abd3569c33de00e3d5a05f42f345e115468d40","observation_id":"b67869a5-d6bf-4b87-a126-647f4144033d","resolution":{"observed_at":"2026-08-12T11:12:18.572297Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.558271Z","title":"Deep attractor network for single- microphone speaker separation,","venue":null,"work_id":"49bb532c-65e9-47ea-af41-8de2b31b35c2","year":2017},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-14T08:19:08.302218Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:18.006696Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:798aa5b4631ecff31064373a3ec334fe537d6c06c12259650c9ca10b92a50335","observation_id":"26572624-61b1-4b77-9860-649a277ff3d9","resolution":{"observed_at":"2026-08-12T11:12:18.562151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.546752Z","title":"Permutation invariant training of deep models for speaker-independent multi-talker speech separation,","venue":null,"work_id":"fc75fc0a-c497-47bf-bfa8-8b66aa575fb5","year":2017},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-14T08:19:08.302218Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:18.010792Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:4af8449fcaf2ce79f44bf5514db47a9fbeec03a5f4bea1fee3b15b24380d9be4","observation_id":"0b52f99f-3e9f-45e2-9959-a2f596c01ec1","resolution":{"observed_at":"2026-08-12T11:12:18.550427Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.535152Z","title":"Many-speakers single channel speech separation with optimal permutation training,","venue":null,"work_id":"8fae2a00-55b8-4fe6-ab01-e0c166e45028","year":2021},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-14T08:19:08.302218Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:18.013949Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:02f8587ae5d3e26529728a32f120a77bfdfc6722b1b68eeadce225419aeaf734","observation_id":"8b4b163b-dd9c-49b8-8a65-5cd1ae083833","resolution":{"observed_at":"2026-08-12T11:12:18.538629Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.017104Z","title":"Theoretical improvements in algorithmic efficiency for network flow problems,","venue":null,"work_id":null,"year":1972},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-14T08:19:08.302218Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:18.017104Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:2ff0372eb8e4c23efc0861beab5746ef00a4a28b676d93ca7c6877affd51b82a","observation_id":"1562ac92-a5e2-47b9-b845-4d5732b4cd67","resolution":{"observed_at":"2026-08-12T11:12:18.017104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.517272Z","title":"Towards listening to 10 people simultaneously: An efficient permutation invariant training of audio source separation using sinkhorn’s algorithm,","venue":null,"work_id":"01dc7447-adc1-42e1-adc3-e7f70640e08f","year":2021},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-14T08:19:08.302218Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:18.019963Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:c6edc7618c698e77a47d7c02b5be6ecec1a4d8d6b14c2a60220b4a3d401f237b","observation_id":"d204ad37-7768-4a6e-a18b-4cd67d047354","resolution":{"observed_at":"2026-08-12T11:12:18.521417Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.023631Z","title":"Sinkhorn distances: Lightspeed computation of optimal transport,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-14T08:19:08.302218Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:18.023631Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:388ab6e50463a04bf989a529f4d230642eeb9950e63fa6c289aca8bd2e5d00c1","observation_id":"73f0a81e-a3ff-494c-9e9e-3bf9622d48f4","resolution":{"observed_at":"2026-08-12T11:12:18.023631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.15580","last_updated":"2025-01-17T10:03:39Z","snapshot_observed_at":"2026-08-13T07:33:32.399572Z","submitted_at":"2024-07-22T12:16:56Z","title":"Annealed Multiple Choice Learning: Overcoming limitations of Winner-takes-all with annealing","version":3},"cited_work":{"arxiv_id":"2407.15580","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.15580","snapshot_observed_at":"2026-08-12T11:12:18.273007Z","title":"Annealed Multiple Choice Learning: Overcoming limitations of Winner-takes-all with annealing","venue":"cs.LG","work_id":"bbe08dbe-a1c3-45e7-adbe-2dc8478febac","year":2024},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-14T08:19:08.302218Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:18.026727Z"},"links":{"cited_paper":"/paper/2407.15580","citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:a67aaeb01335b8838eafd1b3c431c8f490f83b0b33570505348353e543f0360b","observation_id":"352f6fcf-2f53-4f75-bb99-286180d5ba44","resolution":{"observed_at":"2026-08-12T11:12:18.276878Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.499425Z","title":"Multiple choice learning: Learning to produce multiple structured outputs,","venue":null,"work_id":"ed731be9-43d5-4b7f-95e7-d8508eaa5661","year":2012},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-14T08:19:08.302218Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:18.030404Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:0f09d6bd902fc61ff31d244d3363bfe645ffc2738982e736b81cb4f76e870270","observation_id":"bbc9cfb6-26e6-4f27-b2cf-44845fb78c7b","resolution":{"observed_at":"2026-08-12T11:12:18.503725Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.488293Z","title":"Stochastic multiple choice learning for training diverse deep ensembles,","venue":null,"work_id":"b34aa99c-9c26-4409-b5f8-8438f7508af3","year":2016},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-14T08:19:08.302218Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:18.033473Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:5994cd3bd34dd187ff7ca701350dcec94c14b16fd4fedb101422ca562dbf9a66","observation_id":"12ed9720-398e-4e3c-a913-80c4797c9ede","resolution":{"observed_at":"2026-08-12T11:12:18.492430Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.477397Z","title":"Dsmcl: Dual-level stochas- tic multiple choice learning for multi-modal trajectory prediction,","venue":null,"work_id":"8c8c8e08-f181-4252-b5ac-bd3e930d05df","year":2020},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-14T08:19:08.302218Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:18.037556Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:c3797cab47d544bfaa257639d9373b48c67542efd789b41b168b5d35bb65a29e","observation_id":"26a0f539-bdd0-4b45-9fb1-b13c20185f9f","resolution":{"observed_at":"2026-08-12T11:12:18.481328Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.467025Z","title":"V oice separation with an unknown number of multiple speakers,","venue":null,"work_id":"c9cafed0-c480-4a80-bdf3-49111e915499","year":2020},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-14T08:19:08.302218Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:18.040720Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:68ee2cb69258424ace3f9176e7f7958e031b9e84220fbcb7df80341c7e3b8d0a","observation_id":"566b3b04-ee96-40da-978c-b27c15a92945","resolution":{"observed_at":"2026-08-12T11:12:18.470285Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.044321Z","title":"Least squares quantization in pcm,","venue":null,"work_id":null,"year":1982},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-14T08:19:08.302218Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:18.044321Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:1fa3b45d66a8131caf023d96b8c9b8f953adedaf4650990bcc6536107aada0f5","observation_id":"b541b667-b5c6-4505-94e5-da79b30a2cbc","resolution":{"observed_at":"2026-08-12T11:12:18.044321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.451267Z","title":"Learning in an uncertain world: Representing ambiguity through multiple hypotheses,","venue":null,"work_id":"2dee7cb0-5b0a-4646-95c8-b1c7cc8d8d02","year":2017},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-14T08:19:08.302218Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:18.047520Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:049a703813f24c7e8d3c58f92ef8719d2d15d7fb80fde8273783b87a1d7e266f","observation_id":"96693ff2-2002-4b2e-b543-c2b7a1a374f4","resolution":{"observed_at":"2026-08-12T11:12:18.454969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.11262","last_updated":"2020-05-22T16:26:54Z","snapshot_observed_at":"2026-08-10T10:54:26.224254Z","submitted_at":"2020-05-22T16:26:54Z","title":"LibriMix: An Open-Source Dataset for Generalizable Speech Separation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.11262","snapshot_observed_at":"2026-08-12T11:12:18.051999Z","title":"Librimix: An open-source dataset for generalizable speech separation,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-14T08:19:08.302218Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:18.051999Z"},"links":{"cited_paper":"/paper/2005.11262","citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:9843a17c455c5926f6874c1bf12e175e603df473e0d0ec3f32f9cb49724dca39","observation_id":"06a52b33-ee20-4967-bd55-5f50280b74fd","resolution":{"observed_at":"2026-08-12T11:12:18.051999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.055529Z","title":"Conv-tasnet: Surpassing ideal time– frequency magnitude masking for speech separation,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-14T08:19:08.302218Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:18.055529Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:ff0f5bb0ba50f099c811c588b8604cd77a865f84a2551ed5c77b6aa6d4e59593","observation_id":"463f3241-96f7-4a0b-a2cb-6ac0effb008e","resolution":{"observed_at":"2026-08-12T11:12:18.055529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"document/9054266","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.244882Z","title":"Dual-path RNN: Efficient long sequence modeling for time-domain single-channel speech separation,","venue":null,"work_id":"a2027400-fa46-4d59-9de0-c9a9f315b836","year":2020},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-14T08:19:08.302218Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:18.059556Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:1e5299d25dc722750834558681eedb858b06bb5b08985efe1997933350f3bddb","observation_id":"62031daf-4687-48d5-9368-e05a9c5af0d0","resolution":{"observed_at":"2026-08-12T11:12:18.250379Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"document/9413901","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.175950Z","title":"Attention is all you need in speech separation,","venue":null,"work_id":"bdb47aae-4255-4242-9790-ebfdfb975f2d","year":2021},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-14T08:19:08.302218Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:18.062766Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:7a5d7b527b60e329fb51ad89ccfde27bdc8008c1ab3d6b1f2d983798ac3f2363","observation_id":"3f5363fd-80e1-4874-8838-5867d05ccee2","resolution":{"observed_at":"2026-08-12T11:12:18.185169Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.435036Z","title":"Mossformer: Pushing the performance limit of monaural speech separation using gated single-head transformer with convolution-augmented joint self-attentions,","venue":null,"work_id":"a1510ada-207d-48fb-a373-2b496996ddda","year":2023},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-14T08:19:08.302218Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:18.066414Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:b1cbface4d7f8e54d7b416b869f243a1438abc17805e38436886ed99e9458728","observation_id":"a283212a-37f8-4ad6-93a3-90be41c60db1","resolution":{"observed_at":"2026-08-12T11:12:18.438809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.069514Z","title":"Tf-gridnet: Integrating full-and sub-band modeling for speech separation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-14T08:19:08.302218Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:18.069514Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:9aa582151cffff0e41d319a5a2af8d7e093287561b87520863bc24d40888c3b5","observation_id":"d9a66a66-cc06-4727-8657-ccd309c27f98","resolution":{"observed_at":"2026-08-12T11:12:18.069514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.418417Z","title":"Universal sound separation,","venue":null,"work_id":"cec793f7-8d89-445e-b049-39da2ace3b9d","year":2019},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-14T08:19:08.302218Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:18.073584Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:e5ff9294da3bdbe856f7bac8f2aabd04e3c213f9419d046fb79e913c2f28b4de","observation_id":"26c1d038-2237-4e16-92f7-e85f293e8eec","resolution":{"observed_at":"2026-08-12T11:12:18.422551Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.407593Z","title":"Signal source separation in the analysis of neural activity in brain,","venue":null,"work_id":"d6cf6d50-b7de-4521-b54c-d2b782e5fd70","year":2001},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-14T08:19:08.302218Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:18.076701Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:942d8e4998ad2e5f30aa1fcbd66c6b78a0ed23d74576ee7558ccaf37de8beb26","observation_id":"d37c1083-977a-446b-b388-1274ac9195e3","resolution":{"observed_at":"2026-08-12T11:12:18.411715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.395035Z","title":"Deep neural network techniques for monaural speech enhancement and separation: state of the art analysis,","venue":null,"work_id":"c22dfe32-8825-486a-a464-0047c5829b88","year":2023},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-14T08:19:08.302218Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:18.080700Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:ac81a9e7551961e55bc814a392b8805d4874ab8a50df4b27f7be1b91335fd1d0","observation_id":"02303274-6974-41f0-aeba-dd64c3473cfd","resolution":{"observed_at":"2026-08-12T11:12:18.399736Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.383272Z","title":"Resilient multiple choice learning: A learned scoring scheme with application to audio scene analysis,","venue":null,"work_id":"cba9d470-a0da-422c-b2fe-bd600f4dbf84","year":2024},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-14T08:19:08.302218Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:18.083831Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:5e91fa507d3bb64ea445d84f2cf1257c686e289d5f3020e7bf81535972535e87","observation_id":"564e0e2b-85a9-4b8b-bc39-e925178c6257","resolution":{"observed_at":"2026-08-12T11:12:18.387048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-14T08:19:08.302218Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":3,"verified_fuzzy":26},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 0 inbound Pith citation observations for arXiv:2411.18497."}