{"as_of":"2026-08-15T20:28:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9bc56d3556ed544ec99630e119d8aeaab4bcd9d79a83e75d5ab03b6b760bfcec","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:00:29.258049Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:00:24.448079Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T20:34:19.302217Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-14T01:02:55.432367Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16607","snapshot_observed_at":"2026-08-07T15:00:24.448079Z","title":"Here, the observed signalyconsists of speech signalsx c from Csources and noisen","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-14T01:02:55.432367Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:24.448079Z"},"links":{"cited_paper":"/paper/2505.16607","citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:e5263145a8444b0720438caeeeddfb4962c7f1ea27208285c3b74bd6a98a0c2b","observation_id":"b7254c3c-488d-4c8b-a3f0-1405dda55ae0","resolution":{"observed_at":"2026-08-07T15:00:24.448079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-14T01:02:55.432367Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"cited_work":{"arxiv_id":"2505.16607","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.16607","snapshot_observed_at":"2026-08-06T20:34:19.302217Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","venue":"eess.AS","work_id":"043ceae9-26e1-4627-98a6-aa893e5fda1e","year":2025},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:18.479293Z"},"links":{"cited_paper":"/paper/2505.16607","citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:51745029abf3ce90eb02d3bfa0dc17bc180793c9c375f6c9015805343418a928","observation_id":"d033676c-bc22-4840-8d9d-e9b7d4b82078","resolution":{"observed_at":"2026-08-06T20:34:19.369203Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.16607/citation-record","integrity":"/paper/2505.16607/integrity","json":"/paper/2505.16607/citation-record.json","paper":"/paper/2505.16607"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:36.646235Z","title":null,"venue":null,"work_id":"0468bc60-e9d9-4d69-ad84-242de786c5d0","year":null},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-14T01:02:55.432367Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:24.372754Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:62cf9a7a20b57162f1a302ffbcbc3b3bfe737a5c77ccc8013905264b00ac085d","observation_id":"fbab1a37-1740-4382-98e0-e6b251ec30a9","resolution":{"observed_at":"2026-08-07T15:00:36.775069Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-14T01:02:55.432367Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16607","snapshot_observed_at":"2026-08-07T15:00:24.448079Z","title":"Here, the observed signalyconsists of speech signalsx c from Csources and noisen","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-14T01:02:55.432367Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:24.448079Z"},"links":{"cited_paper":"/paper/2505.16607","citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:e5263145a8444b0720438caeeeddfb4962c7f1ea27208285c3b74bd6a98a0c2b","observation_id":"b7254c3c-488d-4c8b-a3f0-1405dda55ae0","resolution":{"observed_at":"2026-08-07T15:00:24.448079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:36.314265Z","title":"The system architecture is illustrated in Fig","venue":null,"work_id":"dcdda098-9b36-4395-bdff-f51c67a55722","year":null},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-14T01:02:55.432367Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:24.505302Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:e73985d48b4d0d58b58516040d98e745beb49408f6dd80a05adb804548917967","observation_id":"580e4802-322e-4659-bfdb-8f65d740001c","resolution":{"observed_at":"2026-08-07T15:00:36.453516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:36.032666Z","title":"Datasets In our research scenario, multiple speakers coexist in a mixed signal, each contributing multiple utterances","venue":null,"work_id":"2f47b2f7-c440-402b-96d4-2dea55bbc9ce","year":null},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-14T01:02:55.432367Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:24.598420Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:23cd2a197ae14b61f58ac5fe7d2edb28bc859bc3be863d181b5017f6f81d2aad","observation_id":"ae563731-4ec3-4837-b1f7-1fd3be5a1383","resolution":{"observed_at":"2026-08-07T15:00:36.150119Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:35.879694Z","title":"Besides, an ablation study was conducted Table 2:Evaluation on 2-speaker & 3-speaker dataset","venue":null,"work_id":"983edcb7-d910-41af-ba20-0edf8b0b1192","year":null},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-14T01:02:55.432367Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:24.696572Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:ef0d989b5d562f677783b4f1c237db260a49b500750b2068f7a1abc994a11fe2","observation_id":"5f36cf49-7045-4fb0-828a-7af1ca3fa1d8","resolution":{"observed_at":"2026-08-07T15:00:35.955449Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:35.704196Z","title":"The system employs an RNN attractor module to estimate the number of sources and detect source ac- tivity, resulting in significant improvements in separation per- formance","venue":null,"work_id":"b7710fdc-b355-414c-8153-f33ae364fbfc","year":null},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-14T01:02:55.432367Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:24.831958Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:48cba38f80d5a9c8edeb1d49f1ba929cbc738d6b7da3f9e495a560888a8618a2","observation_id":"9438d5a7-f8e5-476d-b2d4-34c3b74b0b00","resolution":{"observed_at":"2026-08-07T15:00:35.806354Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:35.551287Z","title":"Vincent, T","venue":null,"work_id":"d79c19bf-07e3-481e-a9b7-baa54524bc17","year":2018},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-14T01:02:55.432367Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:24.920680Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:8c7a84b6ab86c3e59ad7b0773b119011e219945bb1b13d6aac6e178ac377ab83","observation_id":"5b9e624b-505f-436f-8eb5-4e3c1e28804b","resolution":{"observed_at":"2026-08-07T15:00:35.622401Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:35.427456Z","title":"Deep learning for audio signal processing,","venue":null,"work_id":"4ca5334d-7719-4df6-a400-d4f3afd471ae","year":2019},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-14T01:02:55.432367Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:24.975941Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:08e2a0a400e09236dc47c3a6afede131e18e76cce3206869e16c8a22ad81f656","observation_id":"6bb44864-208a-47f9-a97d-1becf5a1dbfe","resolution":{"observed_at":"2026-08-07T15:00:35.490807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:35.252204Z","title":"An overview of machine learning and other data-based methods for spatial au- dio capture, processing, and reproduction,","venue":null,"work_id":"a7befa76-864d-4a7d-950c-cedab123ada8","year":2022},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-14T01:02:55.432367Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:25.042061Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:61e06ed441f3bb6db9168ff6efae8de59d80a542c3bf807da2d4b1e3b5785c91","observation_id":"b56d5567-9b41-494b-bd08-1766f6ebc1b5","resolution":{"observed_at":"2026-08-07T15:00:35.357989Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:25.186758Z","title":"Supervised speech separation based on deep learning: An overview,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-14T01:02:55.432367Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:25.186758Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:2caed15a7c4232b48c711d6d13369e706bd079f960ca19e0861c83b0bf0395f6","observation_id":"f4a1951a-20d4-43f8-b26f-c110d8cd4784","resolution":{"observed_at":"2026-08-07T15:00:25.186758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:35.083621Z","title":"Conv-tasnet: Surpassing ideal time– frequency magnitude masking for speech separation,","venue":null,"work_id":"5428e04a-1537-4058-9997-0c0a90b3eb36","year":2019},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-14T01:02:55.432367Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:25.295428Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:747a5689084c5dff351af4d73e724d6ab53696e32bf85da8f27263e2343784bb","observation_id":"d0fc8161-d7ce-4f97-a67e-1b57cb5ba984","resolution":{"observed_at":"2026-08-07T15:00:35.169008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:25.404765Z","title":"Dual-Path RNN: Efficient long sequence modeling for time-domain single-channel speech sepa- ration,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-14T01:02:55.432367Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:25.404765Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:03dc125c747c28821a9b16bd078b0914a5c27e4f0a6e7a6d38955317ba3ec6cf","observation_id":"5e1a1025-effe-445d-a637-2b27118f1084","resolution":{"observed_at":"2026-08-07T15:00:25.404765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:34.907938Z","title":"Permutation invari- ant training of deep models for speaker-independent multi-talker speech separation,","venue":null,"work_id":"2041a993-292f-49ea-ae90-8836e5f29b9f","year":2017},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-14T01:02:55.432367Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:25.535726Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:fa6880a15b95260b643d52a1db535815256d0654b8e4e40268964414c6b6e434","observation_id":"5c3a4836-c997-49a6-9115-c756b3ae674d","resolution":{"observed_at":"2026-08-07T15:00:34.953585Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:34.737692Z","title":"Multitalker speech separation with utterance-level permutation invariant train- ing of deep recurrent neural networks,","venue":null,"work_id":"0e2eacd5-a64c-46da-8333-6cab08fb8f21","year":1901},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-14T01:02:55.432367Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:25.676422Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:87246d7310e2ada89dc97cc8f22cc764f3a13b183d4bd432187f52441f33ab65","observation_id":"d9b3b7c6-6b71-4532-aa53-122598a1062a","resolution":{"observed_at":"2026-08-07T15:00:34.806139Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:25.883371Z","title":"Attention is all you need in speech separation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-14T01:02:55.432367Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:25.883371Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:5287feadbad3d89d99486781b7498b0bd5bf13a9e182f81402fbd24297c7c031","observation_id":"7814764c-25e6-4998-85e8-ed72e1fcdc76","resolution":{"observed_at":"2026-08-07T15:00:25.883371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:34.544471Z","title":"Dual-path transformer network: Direct context-aware modeling for end-to-end monaural speech separation,","venue":null,"work_id":"14e2deff-2762-45cb-80ee-66cb74340153","year":2020},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-14T01:02:55.432367Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:25.993737Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:b9b36e0fddb225790586f12616f8ef4fef3c917fc2445e8ab24a433591f81cd2","observation_id":"0e491b13-ecfc-445c-96d6-f003ed3437a0","resolution":{"observed_at":"2026-08-07T15:00:34.615974Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:34.311172Z","title":"TF-GridNet: Making time-frequency domain models great again for monaural speaker separation,","venue":null,"work_id":"9009e527-0faa-413b-a994-73b2ad96ebc1","year":2023},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-14T01:02:55.432367Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:26.158658Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:fffff623dbd2f85b043b92b06da6b377fbcc00af4397b6481a6f431c15a2efcd","observation_id":"4081ad1c-2eba-41c7-89fe-d77a3fa3b4d6","resolution":{"observed_at":"2026-08-07T15:00:34.410295Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:34.070949Z","title":"TF-GridNet: Integrating full- and sub-band modeling for speech separation,","venue":null,"work_id":"c34ea62c-bcc0-4918-b43d-e8a7a8d7e122","year":2023},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-14T01:02:55.432367Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:26.319957Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:40ef3e09506d0c4e28bf8248e434f36234c146318bdb5b380b5a42480a14b1d6","observation_id":"8f1d6cc6-b77e-44de-a822-addee69109ad","resolution":{"observed_at":"2026-08-07T15:00:34.185511Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:33.806499Z","title":"Recursive speech separation for unknown number of speak- ers,","venue":null,"work_id":"9c2bcdd4-c2a2-4f1a-8f13-93da5985c569","year":2019},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-14T01:02:55.432367Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:26.487513Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:fea0c51f1143a5aa921f9fde26196e59adf679e707a0087d8697311562e34017","observation_id":"dbcd0ac4-d557-4120-8c7c-99fd6ac11a77","resolution":{"observed_at":"2026-08-07T15:00:33.937374Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:33.571151Z","title":"Listen- ing to each speaker one by one with recurrent selective hearing networks,","venue":null,"work_id":"f6925217-1a6a-4308-a08f-bdd8b5974e0f","year":2018},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-14T01:02:55.432367Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:26.547122Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:0e1300c367db101e08380d140eee434773bf1b754b4db7a12ea87840af32f02f","observation_id":"f71c6fd3-1d8b-4e3b-a8ec-265305052112","resolution":{"observed_at":"2026-08-07T15:00:33.670488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:33.308638Z","title":"Deep Clus- tering: Discriminative embeddings for segmentation and separa- tion,","venue":null,"work_id":"64957068-488b-438d-88f8-3aa36922c28b","year":2016},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-14T01:02:55.432367Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:26.729483Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:9d11218cf05274098442c1f34c2184f21cbaed59f47bbddfa6d6b169af42f348","observation_id":"96496c79-9217-4492-83d0-1a039773e086","resolution":{"observed_at":"2026-08-07T15:00:33.425090Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:33.105141Z","title":"Low-latency deep clus- tering for speech separation,","venue":null,"work_id":"73e3b1ff-1c35-412f-8b9c-223d5b9d1332","year":2019},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-14T01:02:55.432367Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:26.904907Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:431fa059695db65101975621de99f45852f692194316d03d73c65a3db29fe068","observation_id":"e90f6f01-977f-4ddd-9cec-b1bd66a690ec","resolution":{"observed_at":"2026-08-07T15:00:33.206808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:27.028221Z","title":"Wavesplit: End-to-end speech separation by speaker clustering,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-14T01:02:55.432367Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:27.028221Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:d3b74856881b05579d1e6dfcd969529366c6b028a5649f1b8214c6fc7f38ade1","observation_id":"c20037d9-059c-4e81-9054-cc164b440e9e","resolution":{"observed_at":"2026-08-07T15:00:27.028221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:27.121484Z","title":"Deep attractor network for single-microphone speaker separation,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-14T01:02:55.432367Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:27.121484Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:4fa472ac7505eb12f8b091c59b155ab7569f55c13843ee88e44312ee182d407b","observation_id":"3ec4b8ec-1ab0-4b63-bf4d-272ffe9aea19","resolution":{"observed_at":"2026-08-07T15:00:27.121484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:32.827396Z","title":"Speaker-independent speech separation with deep attractor network,","venue":null,"work_id":"8dd3e76d-ba59-4271-acf7-61c18c5a814c","year":2018},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-14T01:02:55.432367Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:27.302656Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:d00dfd5e6fa550b6f801e78e24580acf7bcdf8a247fbd6d0e14b72875b0713a8","observation_id":"ed98ec93-96d8-4528-b6f9-9c22700daf3b","resolution":{"observed_at":"2026-08-07T15:00:32.948408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:32.590791Z","title":"EEND-SS: Joint end-to-end neural speaker diariza- tion and speech separation for flexible number of speakers,","venue":null,"work_id":"69797031-3c1d-4abd-8a95-71c64d3e25ff","year":2023},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-14T01:02:55.432367Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:27.461843Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:8796c5c0cce961f10203ab46c7622b6d1f0071edfa4694bf3735d277b69d017e","observation_id":"5bde063a-d799-4c8b-8a3d-1aac9839f90a","resolution":{"observed_at":"2026-08-07T15:00:32.703627Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:32.374242Z","title":"Speech separation for an unknown number of speakers using transformers with encoder- decoder attractors,","venue":null,"work_id":"eeba01f2-b72a-498f-b505-95eda48b93e1","year":2022},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-14T01:02:55.432367Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:27.583445Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:b7eea0302a51542c377eb224a9b30bb7aec5dc7f53d84ca2b3b96051b9f49424","observation_id":"f6d46933-6b9e-4c91-8346-eefe7da29762","resolution":{"observed_at":"2026-08-07T15:00:32.488668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:32.165193Z","title":"Boosting unknown-number speaker separation with transformer decoder-based attractor,","venue":null,"work_id":"01ab2c73-ce80-4f27-a900-63fb27253ee4","year":2024},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-14T01:02:55.432367Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:27.727743Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:98ca3f85c2412b0ee68c09adf491b83ea8c4d8725008ca42afd8076ed7c66721","observation_id":"a11aa4d3-e921-4898-8086-83edf5fad330","resolution":{"observed_at":"2026-08-07T15:00:32.272759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:31.840639Z","title":"Continuous speech separation with recurrent selective at- tention network,","venue":null,"work_id":"39db52ca-cfd9-4f7a-a1f3-efaf92a0c504","year":2022},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-14T01:02:55.432367Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:27.834622Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:ca74bd5fa52276cc195410fffba09b88859d72be6aebfdc24874fc0e317071cd","observation_id":"7020bb74-e9a9-401f-921f-ccfa7c3414b7","resolution":{"observed_at":"2026-08-07T15:00:31.986823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:31.531844Z","title":"All-neural beamformer for continuous speech separation,","venue":null,"work_id":"95484a86-a82c-4f63-abef-6ba40e9bc35c","year":2022},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-14T01:02:55.432367Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:27.982705Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:0e4a3edc642af634f5e1053ccca0ddf571025fbc10cd4f6483917e943f8dfd4f","observation_id":"4499698d-8e50-4de1-b552-ed2ccf4c212f","resolution":{"observed_at":"2026-08-07T15:00:31.670241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:31.281378Z","title":"Continuous stream- ing multi-talker asr with dual-path transducers,","venue":null,"work_id":"b8b8552c-75e7-4ed2-a2e6-ae8c436509d5","year":2022},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-14T01:02:55.432367Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:28.185553Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:5bb9f6f093c04727bdb02c8de035d083916541aad6a047aebe7d61149bcfbe7c","observation_id":"24125053-4242-4b0d-b11b-6a7997dca5b3","resolution":{"observed_at":"2026-08-07T15:00:31.409040Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:31.029456Z","title":"Continuous speech separation: Dataset and analysis,","venue":null,"work_id":"b8dec52f-b1b2-4789-97a9-69887e43592f","year":2020},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-14T01:02:55.432367Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:28.293346Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:a8c8e6394a9def7d14de72451daa9dc6afa66b5c30ec730e9feccf1282b6ad63","observation_id":"4adb06fa-23eb-4c47-95d1-007b22c559a2","resolution":{"observed_at":"2026-08-07T15:00:31.149028Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:30.814005Z","title":"Dual-path rnn for long recording speech separation,","venue":null,"work_id":"a3d7a114-ab82-4176-86f5-1de8a3990d1b","year":2021},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-14T01:02:55.432367Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:28.408150Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:430410488a2a0acba3398b7b61f8bb993a67b503aaf4bfc82cb351087137fd81","observation_id":"a904bfaf-77e2-4811-9af2-56fd1f90d82e","resolution":{"observed_at":"2026-08-07T15:00:30.904792Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:30.561479Z","title":"FiLM: Visual reasoning with a general conditioning layer,","venue":null,"work_id":"70ddbb3d-fc77-4dcf-aaac-4fd6dbbf10be","year":2018},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-14T01:02:55.432367Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:28.510201Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:67a217ad65016a311984c951ade1eeddbbcd622388b3c92245e22cd803b98385","observation_id":"6b891667-317a-4d79-a4ec-86cdd0d6afc8","resolution":{"observed_at":"2026-08-07T15:00:30.657408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.09921","last_updated":"2020-10-05T07:12:42Z","snapshot_observed_at":"2026-08-13T22:40:02.379515Z","submitted_at":"2020-05-20T09:08:41Z","title":"End-to-End Speaker Diarization for an Unknown Number of Speakers with Encoder-Decoder Based Attractors","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.09921","snapshot_observed_at":"2026-08-07T15:00:28.711166Z","title":"End-to-end speaker diarization for an unknown number of speak- ers with encoder-decoder based attractors,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-14T01:02:55.432367Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:28.711166Z"},"links":{"cited_paper":"/paper/2005.09921","citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:18abcdbeeb42a9d9b6c5b48c964a896836a922134653a7413232eee40bd14e82","observation_id":"1cf1b140-71a4-4e3b-ad7e-8a3d08198bbe","resolution":{"observed_at":"2026-08-07T15:00:28.711166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:30.392535Z","title":"Lib- riSpeech: an ASR corpus based on public domain audio books,","venue":null,"work_id":"6c128301-944b-4a39-9b2e-7d9732c54d0f","year":2015},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-14T01:02:55.432367Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:28.800291Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:7ea0a1b7e4a13db01e7c32137abd44cf284c08dd28babe27e68cff73e6582909","observation_id":"b95f4bf6-f12f-4151-b2f8-47cfd3d8076e","resolution":{"observed_at":"2026-08-07T15:00:30.481894Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:28.891113Z","title":"WHAM!: Extending speech separation to noisy environments,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-14T01:02:55.432367Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:28.891113Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:a13dd67a7ecbadcaf617ac0da08c7b2178b88a93ed63f63a18e75508d9bf5561","observation_id":"e60c9a80-df23-4d91-af05-454c339a7dca","resolution":{"observed_at":"2026-08-07T15:00:28.891113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:30.249246Z","title":"gpuRIR: A python library for room impulse response simulation with gpu accelera- tion,","venue":null,"work_id":"fe1e7ca4-2028-4e97-973f-e3efe154763e","year":2021},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-14T01:02:55.432367Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:28.997967Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:35e764933eedbe640fdbaca58cdc3ce05d59143df50e4a15a4945aafec07e83b","observation_id":"cc8395ab-922e-47b3-bbf4-88804e31a606","resolution":{"observed_at":"2026-08-07T15:00:30.307060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:29.980017Z","title":"ESPnet: End-to-end speech processing toolkit,","venue":null,"work_id":"f11a8ab6-dd14-442a-9199-3ca8edfc06f7","year":2018},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-14T01:02:55.432367Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:29.070196Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:58080b48e4b5fc25a2128a5ee265a31cf9c001ddf5ad3796c18cbe77f14c1660","observation_id":"2c9344e0-ff74-4027-bbbc-46a08fc13dfe","resolution":{"observed_at":"2026-08-07T15:00:30.110930Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:29.700027Z","title":"SDR – half-baked or well done?","venue":null,"work_id":"780a463b-6f13-4585-a6bc-1feac89b8233","year":2019},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-14T01:02:55.432367Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:29.133551Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:20e4eea3121fe1eae9ff8a7dc9d31f73b06dce7aa2fc77e1afbb486219aaffa5","observation_id":"e63995fa-500f-426a-898e-ff9ab9dc0275","resolution":{"observed_at":"2026-08-07T15:00:29.835568Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:29.542892Z","title":"The rich tran- scription 2006 spring meeting recognition evaluation,","venue":null,"work_id":"18bddc68-bca3-4aaf-8b54-2225ca50418e","year":2006},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-14T01:02:55.432367Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:29.201944Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:20f75bfbfd5a01cdf3f781faf4dfa9944ff31eca74f4d0525dcd23642e5c5cf8","observation_id":"dfff03c4-4aef-49a0-a549-f1a739e6d747","resolution":{"observed_at":"2026-08-07T15:00:29.616065Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:29.427914Z","title":"Speaker counting and sep- aration from single-channel noisy mixtures,","venue":null,"work_id":"977f3cc7-6cbd-4587-81b4-02f46626446c","year":2023},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-14T01:02:55.432367Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:29.258049Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:875883e389830a2c6e39520ccf2acea582b8a3c7be4f967c2f418502b5498f5c","observation_id":"8d2f2f66-e2f0-428c-a30d-1f2f2c0aa466","resolution":{"observed_at":"2026-08-07T15:00:29.461772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-14T01:02:55.432367Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":0,"verified_fuzzy":31},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 2 inbound Pith citation observations for arXiv:2505.16607."}