{"as_of":"2026-08-15T21:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ddbd62e9fc54732b2cb576a1336b3895fc5c70c0eea56823a72d29a98edc22d1","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T20:34:19.183431Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.02562/citation-record","integrity":"/paper/2507.02562/integrity","json":"/paper/2507.02562/citation-record.json","paper":"/paper/2507.02562"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:24.615865Z","title":"Vincent, T","venue":null,"work_id":"713a4d32-66cb-49eb-a4e1-260665619414","year":2018},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:16.626818Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:68d950765957f137f570f8126df77036da22e7d2f467d6470bdd401700688286","observation_id":"8f6d732c-4d15-4586-80b6-c0e1f71bd2cd","resolution":{"observed_at":"2026-08-06T20:34:24.740725Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:24.375589Z","title":"Deep learning for audio signal processing,","venue":null,"work_id":"f2f4aca7-4955-4c11-8938-e0550bc25821","year":2019},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:16.682859Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:299f8ffd5b8c1763daf8a4b04cf567bd16cf2b43d30854537f074841bf1dbaa6","observation_id":"0b7c1c96-aa54-4704-a02f-ac3643fe9c22","resolution":{"observed_at":"2026-08-06T20:34:24.476684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:24.097678Z","title":"An overview of machine learning and other data-based methods for spatial audio capture, processing, and reproduction,","venue":null,"work_id":"12f40980-a290-4e0e-b69e-07a0670ad80a","year":2022},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:16.751478Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:11f416cd8b18a004437d85274941beb530acf9520281f78caa0a71be6729d632","observation_id":"fdb5f126-8357-437b-ba98-b8e00b0b8027","resolution":{"observed_at":"2026-08-06T20:34:24.250544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:23.836920Z","title":"Supervised speech separation based on deep learning: An overview,","venue":null,"work_id":"5a6eaf97-f636-4521-aeb4-a1e2ddf3c635","year":2018},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:16.820590Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:70f4bb3dbd39a14ab5b448f573ada4ccf88eeda964c25d8ec5e52ded63a6325a","observation_id":"b20059bf-e282-4a17-a428-aaed197d59ee","resolution":{"observed_at":"2026-08-06T20:34:23.965425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:23.567984Z","title":"Conv-tasnet: Surpassing ideal time–frequency magnitude masking for speech separation,","venue":null,"work_id":"92bd2685-e332-4608-9c9c-b96e4e352dbf","year":2019},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:16.884785Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:d13c542fa7ff79db32cc210f753dd368994cbcf43b4a113d58b600ef3705f892","observation_id":"fb5c6f1e-772f-40d8-b637-3c9dd4cb6602","resolution":{"observed_at":"2026-08-06T20:34:23.694612Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:23.308485Z","title":"Permutation invariant training of deep models for speaker-independent multi-talker speech separation,","venue":null,"work_id":"5d687521-1825-4cec-9677-22c14144e098","year":2017},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:16.960980Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:dc5de95c9f9e55dfffb700cab5c04a666b708a906219e4e2bb8e282b7a160136","observation_id":"d569034c-dc7b-47ab-ab60-bf080cd24e49","resolution":{"observed_at":"2026-08-06T20:34:23.419272Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:23.151296Z","title":"Multitalker speech separation with utterance-level permutation invariant training of deep recurrent neural networks,","venue":null,"work_id":"2ad159e4-2c37-478d-9c13-0622370b8eb6","year":1901},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:17.029063Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:985448259f27f23fb35de400f9969a0b349dcc15e674690067c08e2286605334","observation_id":"f666c196-2277-4d17-ab48-95e6bcf58fc5","resolution":{"observed_at":"2026-08-06T20:34:23.232124Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:22.942176Z","title":"TF-GridNet: Making time-frequency domain models great again for monaural speaker separation,","venue":null,"work_id":"132a6976-457f-4f29-a21e-c0ca521284ae","year":2023},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:17.095738Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:c722ae9d08a20154576f9edb24f17a3572dd95846a821b3908bda39a68b1c792","observation_id":"00f29c17-9a1d-4b9d-ae51-63337b8e30c9","resolution":{"observed_at":"2026-08-06T20:34:23.038293Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:22.842425Z","title":"TF-GridNet: Integrating full- and sub-band modeling for speech separation,","venue":null,"work_id":"37cf5c12-ed4e-4d8d-bfa2-6f4e246f7a5e","year":2023},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:17.204361Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:2b8439a28d832053e032418a52237ba955344687298e9b4f243c32658740d981","observation_id":"e66a0aa0-095b-4684-a331-a830d6da0dfe","resolution":{"observed_at":"2026-08-06T20:34:22.902162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:22.694229Z","title":"Deep Clustering: Discriminative embeddings for segmentation and separation,","venue":null,"work_id":"396009e3-6d55-4400-8a47-c616a111fef2","year":2016},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:17.261466Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:439f7f37461c966c3659a201208224c575917e81d13af8f89fb9337f64a43d79","observation_id":"ce37baa0-211e-4ed5-8c75-62e1765b99a3","resolution":{"observed_at":"2026-08-06T20:34:22.764820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:22.475941Z","title":"Low-latency deep clustering for speech separation,","venue":null,"work_id":"d2b807ef-4119-4024-9930-ea9a0d317bb0","year":2019},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:17.371722Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:5fb76e38a038f650e0d6d44130990e5d9b483a08f885fe5b55c23c4911effb4e","observation_id":"451cbdec-a1fb-4f5b-aad3-0abfd9d5f366","resolution":{"observed_at":"2026-08-06T20:34:22.580472Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:22.276369Z","title":"Wavesplit: End-to-end speech separation by speaker clustering,","venue":null,"work_id":"8d167a63-3d73-4232-86b4-815ae8165587","year":2021},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:17.457911Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:224c0809f7d5adae95e34a1548f58e2873d8d8e0e4f292fb3dc0ddfb576301d6","observation_id":"7338dabe-3aba-446f-b1e7-4866b44fb917","resolution":{"observed_at":"2026-08-06T20:34:22.348474Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:22.175312Z","title":"Continuous speech separation: Dataset and analysis,","venue":null,"work_id":"fd310afc-60da-42c4-86bf-4726eac65d97","year":2020},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:17.485139Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:f1344517b5b72c9fd5730af22c6cee10bb4a6a19d16a4c1affdf54d7d05e29b9","observation_id":"7c441472-6f2c-4910-aea8-1da392cf83da","resolution":{"observed_at":"2026-08-06T20:34:22.214251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:22.052972Z","title":"Dual-path modeling for long recording speech separation in meetings,","venue":null,"work_id":"e4a6bd02-c7be-4c47-ac01-142380508f2f","year":2021},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:17.542031Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:66844043b8af5b51d60b7cfae50fae5872035223ce8aa88b4aa75428ec741c8b","observation_id":"54569f0a-8897-4a8a-9d63-e6b7abebb338","resolution":{"observed_at":"2026-08-06T20:34:22.107467Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:21.953720Z","title":"Continuous speech sep- aration using speaker inventory for long recording","venue":null,"work_id":"6521206b-f5aa-43e2-8e2a-720bd57b0073","year":2021},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:17.649108Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:501ac0cdf580a6152fbe85f0412cced1bb765001ed03bca179026a7b94c706c9","observation_id":"5cd83927-bba7-47f2-b959-4c76603a7d7d","resolution":{"observed_at":"2026-08-06T20:34:21.988176Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:21.834613Z","title":"Dual-path rnn for long recording speech separation,","venue":null,"work_id":"b31ed5fc-8acc-4358-9650-1a570948156f","year":2021},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:17.724901Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:8fa542f3ee998729bc4334ed4348aa8c46fc39f328d442b1c378797b47b04092","observation_id":"a5be56f7-f207-42f0-a3c2-8d7b0287244d","resolution":{"observed_at":"2026-08-06T20:34:21.889819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:21.722478Z","title":"Dual-Path RNN: Efficient long sequence modeling for time-domain single-channel speech separation,","venue":null,"work_id":"3e08647d-1e64-4ae8-8583-5f96061e7d9e","year":2020},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:17.855381Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:4eddf51329a4e73165cd8534e557c57e31bb85d4939152fcdb0ce4c9d872b6c4","observation_id":"8b038d2e-da94-447a-b36e-3dd74eea51b8","resolution":{"observed_at":"2026-08-06T20:34:21.761512Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:21.609855Z","title":"Segment-less continuous speech separation of meetings: Training and evaluation criteria,","venue":null,"work_id":"730905b5-fb84-40d7-8bd7-ed77e44da50d","year":2022},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:17.893330Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:e78811427847d7d4339804f2ccacec691b91e283cf6eaf6e22013726fcc09e1f","observation_id":"8d90e3c2-f708-49e1-b325-3c596a17a1ad","resolution":{"observed_at":"2026-08-06T20:34:21.647617Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:21.462529Z","title":"PLDA for speaker verification with utterances of arbitrary duration,","venue":null,"work_id":"e864b148-eede-47a0-bfc4-3ab4d7374b6b","year":2013},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:17.950494Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:13a0d1c1c776a276fcd9b08223ff93559a79c3e6829a94d311546e9e03c19472","observation_id":"623650c6-f496-442a-a3a1-616d560f5ab7","resolution":{"observed_at":"2026-08-06T20:34:21.541562Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:21.354422Z","title":"X- vectors: Robust dnn embeddings for speaker recognition,","venue":null,"work_id":"7ab4a00e-8f76-4f82-ad19-6041ddbbe948","year":2018},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:18.061528Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:2943408ff5b57c3b388275d020f37f92fb3420e5775dba60172c1cd967ba9c16","observation_id":"ee9ee843-3ff8-42b7-bcbf-f30997d242bd","resolution":{"observed_at":"2026-08-06T20:34:21.396438Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:21.270905Z","title":"Speaker recognition for multi-speaker conversations using x-vectors,","venue":null,"work_id":"158be927-b4b3-4482-b259-71b56aa81708","year":2019},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:18.131106Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:9137730549ee3ace7778638648d9a6153dca6b89439216a8678163b7716a1f4c","observation_id":"7069435a-65d3-4d91-90fb-f740ceb75ee8","resolution":{"observed_at":"2026-08-06T20:34:21.300074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:21.163118Z","title":"Deep attractor network for single- microphone speaker separation,","venue":null,"work_id":"32ee0d87-b4fd-4246-b017-28741d140842","year":2017},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:18.200629Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:ad2491b7b59572e0217b2510e4de9cf9a593969f3e28ab224bada16f66b4992e","observation_id":"977e9f2d-c1eb-414c-bbe1-5b10c16ab724","resolution":{"observed_at":"2026-08-06T20:34:21.226423Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:21.092300Z","title":"Speaker-independent speech separation with deep attractor network,","venue":null,"work_id":"e13f490d-ea13-49c5-84ed-6cfa4eca0447","year":2018},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:18.287890Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:877692465de34048728adba6eba50225a763e7d8b9ec6ab84deba329b0ebd79d","observation_id":"ecbfc3db-7d0b-47f9-8ab8-d89d2e429f27","resolution":{"observed_at":"2026-08-06T20:34:21.124785Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:20.949105Z","title":"Speech separation for an unknown number of speakers using transformers with encoder-decoder attractors,","venue":null,"work_id":"b880c6b4-42e6-4290-8cee-c4a5f84cf15e","year":2022},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:18.374939Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:2e2231922e039722514eee366aee067a8c34d2302b5f862a10871eed2e00bd49","observation_id":"32be884b-6432-4ede-98f5-bdd9aed30d97","resolution":{"observed_at":"2026-08-06T20:34:21.031541Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:20.817978Z","title":"Boosting unknown-number speaker separation with transformer decoder-based attractor,","venue":null,"work_id":"6c54c6ac-2990-4c31-bb76-0807e9932a29","year":2024},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:18.436921Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:a5488cec0f57d4680763511d5f711e0a4be04233fac3e01192115951119fced2","observation_id":"cb299b78-a24a-47e7-b132-4f5ecbf2d9f5","resolution":{"observed_at":"2026-08-06T20:34:20.878145Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-14T01:02:55.432367Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"cited_work":{"arxiv_id":"2505.16607","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.16607","snapshot_observed_at":"2026-08-06T20:34:19.302217Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","venue":"eess.AS","work_id":"043ceae9-26e1-4627-98a6-aa893e5fda1e","year":2025},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:18.479293Z"},"links":{"cited_paper":"/paper/2505.16607","citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:51745029abf3ce90eb02d3bfa0dc17bc180793c9c375f6c9015805343418a928","observation_id":"d033676c-bc22-4840-8d9d-e9b7d4b82078","resolution":{"observed_at":"2026-08-06T20:34:19.369203Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:20.645859Z","title":"SDR – half- baked or well done?","venue":null,"work_id":"8c79a23e-cd8a-41c4-9886-7806bb24cd52","year":2019},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:18.582211Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:ac0fcb0ff43e41dd2a6a79e5651d47d7521ab411a777f26f2bd2136dc0b4913b","observation_id":"49d8a6b4-7547-4a33-b898-6c44cb60ebe8","resolution":{"observed_at":"2026-08-06T20:34:20.740694Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:20.537087Z","title":"LibriSpeech: an ASR corpus based on public domain audio books,","venue":null,"work_id":"4e0aea5e-7703-4cae-9781-16e9334fcdd8","year":2015},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:18.625210Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:27aa707d73f7033aebdbef243cc287a8f429900481bd36007cb60ca78955a48e","observation_id":"682b03f1-8f37-414a-a14e-a9cb909e786e","resolution":{"observed_at":"2026-08-06T20:34:20.600299Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:20.354598Z","title":"The diverse environments multi- channel acoustic noise database (DEMAND): A database of multichannel environmental noise recordings,","venue":null,"work_id":"9a9f639c-c005-45fa-ade9-67bc0b2ce867","year":2013},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:18.723198Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:5a174c5335c55b7c5f5462ba5a1935f69a8885f62262031689f994e9607e79e2","observation_id":"f96e3fad-374d-4b8f-a131-3af94949661b","resolution":{"observed_at":"2026-08-06T20:34:20.418612Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:20.230316Z","title":"gpuRIR: A python library for room impulse response simulation with gpu acceleration,","venue":null,"work_id":"46afd0d9-e247-4f1f-86e3-fe8e0692b901","year":2021},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:18.816700Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:5eb0d243422bda881cb9585997211b5a80ba9dabcd03f9cef483255e448e33c9","observation_id":"60373583-bd0c-4ce0-b3ed-2f2a8ef36e57","resolution":{"observed_at":"2026-08-06T20:34:20.290917Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:20.073179Z","title":"ESPnet: End-to-end speech processing toolkit,","venue":null,"work_id":"35500ff4-3a99-4bf8-840a-1c3a8ac67f94","year":2018},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:18.897739Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:102d10306e2ceeee1d86f566ba8eb57719c15857976584f09b273d6999d710fa","observation_id":"47d7f29b-46d2-4ef0-8f71-37a032ce5269","resolution":{"observed_at":"2026-08-06T20:34:20.189643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:19.917348Z","title":"Pyannote. metrics: A toolkit for reproducible evaluation, diagnostic, and error analysis of speaker diarization systems,","venue":null,"work_id":"d1beac04-6f0d-49e4-8036-e5a336fbf2ba","year":2017},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:18.944665Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:13d63f74ad4b17d65a2699ef6fc99e5176bf1de51afe4097f476af3c376bb105","observation_id":"01ac8d89-0cee-4856-a343-0338dc858ee5","resolution":{"observed_at":"2026-08-06T20:34:19.966714Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:19.719692Z","title":"Dual-path transformer network: Direct context-aware modeling for end-to-end monaural speech separation,","venue":null,"work_id":"762d17e5-4bcc-4304-a813-945af48ef1e2","year":2020},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:19.013079Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:e80f715fd339a51b8d53afac0991415266e8c206a8ebe7ec9539504c13e3984c","observation_id":"1cfe8a5b-ddf7-4843-9e78-fc9df44546fc","resolution":{"observed_at":"2026-08-06T20:34:19.808007Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:19.570715Z","title":"Attention is all you need in speech separation,","venue":null,"work_id":"5fe230a1-9cd1-4922-a69e-5e674e8fb4a3","year":2021},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:19.109410Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:f5eda28697fcf895c83b3539b699a8851b4da6ea7e47f68a51b17421ce51d6b3","observation_id":"105304f0-c41f-4672-a145-23e1613161ef","resolution":{"observed_at":"2026-08-06T20:34:19.624654Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:19.444772Z","title":"SA-SDR: A novel loss function for separation of meeting style data,","venue":null,"work_id":"ef9c43b0-74ee-460e-8c62-daf1e08c7736","year":2022},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:19.183431Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:43d3170129685a698fe3476e3fb6776e2c352b5b3e7df7211b5196753b83da13","observation_id":"be78cd39-dc2e-4556-8eeb-e1159868bee2","resolution":{"observed_at":"2026-08-06T20:34:19.503073Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":1,"verified_fuzzy":34},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 0 inbound Pith citation observations for arXiv:2507.02562."}