{"as_of":"2026-08-10T03:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:413dcdcb19d935ec3b869a7f8b943117d8c0e79d47eb46c05ef3adfced243f68","coverage":[{"denominator":50,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":50,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T14:35:51.816957Z","state":"measured"},{"denominator":51,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":51,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T14:35:51.254919Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T14:35:52.001012Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.18446","last_updated":"2025-07-24T14:30:48Z","snapshot_observed_at":"2026-08-06T14:35:50.664337Z","submitted_at":"2025-07-24T14:30:48Z","title":"Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering","version":1},"cited_work":{"arxiv_id":"2507.18446","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.18446","snapshot_observed_at":"2026-08-06T14:35:52.001012Z","title":"Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering","venue":"eess.AS","work_id":"5f42c926-8670-4c5e-b22a-9e85be847c44","year":2025},"citing_paper":{"arxiv_id":"2507.18446","last_updated":"2025-07-24T14:30:48Z","snapshot_observed_at":"2026-08-06T14:35:50.664337Z","submitted_at":"2025-07-24T14:30:48Z","title":"Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:51.254919Z"},"links":{"cited_paper":"/paper/2507.18446","citing_paper":"/paper/2507.18446"},"observation_digest":"sha256:7c1ad97b0cae0f2ea0723220cd2425e11dad49b81499ae934e7df151757f52eb","observation_id":"2dd1569f-e449-4a94-9583-b23f76db2495","resolution":{"observed_at":"2026-08-06T14:35:52.007183Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.18446/citation-record","integrity":"/paper/2507.18446/integrity","json":"/paper/2507.18446/citation-record.json","paper":"/paper/2507.18446"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.18446","last_updated":"2025-07-24T14:30:48Z","snapshot_observed_at":"2026-08-06T14:35:50.664337Z","submitted_at":"2025-07-24T14:30:48Z","title":"Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering","version":1},"cited_work":{"arxiv_id":"2507.18446","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.18446","snapshot_observed_at":"2026-08-06T14:35:52.001012Z","title":"Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering","venue":"eess.AS","work_id":"5f42c926-8670-4c5e-b22a-9e85be847c44","year":2025},"citing_paper":{"arxiv_id":"2507.18446","last_updated":"2025-07-24T14:30:48Z","snapshot_observed_at":"2026-08-06T14:35:50.664337Z","submitted_at":"2025-07-24T14:30:48Z","title":"Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:51.254919Z"},"links":{"cited_paper":"/paper/2507.18446","citing_paper":"/paper/2507.18446"},"observation_digest":"sha256:7c1ad97b0cae0f2ea0723220cd2425e11dad49b81499ae934e7df151757f52eb","observation_id":"2dd1569f-e449-4a94-9583-b23f76db2495","resolution":{"observed_at":"2026-08-06T14:35:52.007183Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:35:52.881234Z","title":null,"venue":null,"work_id":"443186da-8246-4c5b-9e95-35a74d7a0520","year":null},"citing_paper":{"arxiv_id":"2507.18446","last_updated":"2025-07-24T14:30:48Z","snapshot_observed_at":"2026-08-06T14:35:50.664337Z","submitted_at":"2025-07-24T14:30:48Z","title":"Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:51.274459Z"},"links":{"citing_paper":"/paper/2507.18446"},"observation_digest":"sha256:77cc6426a751bc4f30a367bd1405cea09f99be1694b7386ca4315c2c522c297e","observation_id":"5c0a2894-5b59-4355-8c92-7e3c7ad17fb9","resolution":{"observed_at":"2026-08-06T14:35:52.887038Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:35:52.856307Z","title":null,"venue":null,"work_id":"d4778945-96ec-4501-ac57-309d119cee95","year":null},"citing_paper":{"arxiv_id":"2507.18446","last_updated":"2025-07-24T14:30:48Z","snapshot_observed_at":"2026-08-06T14:35:50.664337Z","submitted_at":"2025-07-24T14:30:48Z","title":"Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:51.290203Z"},"links":{"citing_paper":"/paper/2507.18446"},"observation_digest":"sha256:47512fbc31150cdca8b54a5cee5f508b338310219bac55e94ae5f68f69b704e9","observation_id":"76a723c7-c011-4fe5-8046-2a47c50557c5","resolution":{"observed_at":"2026-08-06T14:35:52.861602Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:35:52.828052Z","title":null,"venue":null,"work_id":"47d849ca-5792-4192-ad44-7551c36726e5","year":null},"citing_paper":{"arxiv_id":"2507.18446","last_updated":"2025-07-24T14:30:48Z","snapshot_observed_at":"2026-08-06T14:35:50.664337Z","submitted_at":"2025-07-24T14:30:48Z","title":"Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:51.312006Z"},"links":{"citing_paper":"/paper/2507.18446"},"observation_digest":"sha256:e763bea7517d87dad51c830c21c9954886ec10f6d6da2bf431aff04afc2f17fc","observation_id":"7e83cbc7-efaa-4f25-a387-060d0f22c09a","resolution":{"observed_at":"2026-08-06T14:35:52.838240Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:35:52.794785Z","title":null,"venue":null,"work_id":"6549a8ef-ddc3-441c-b713-6894d5ea6a64","year":null},"citing_paper":{"arxiv_id":"2507.18446","last_updated":"2025-07-24T14:30:48Z","snapshot_observed_at":"2026-08-06T14:35:50.664337Z","submitted_at":"2025-07-24T14:30:48Z","title":"Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:51.330808Z"},"links":{"citing_paper":"/paper/2507.18446"},"observation_digest":"sha256:b728be90978fb0b71cbafffb0a615eddb76ac36b1fea1755da4f5f23986ba26a","observation_id":"5588cc19-602e-4342-925d-c8d6d1c5f163","resolution":{"observed_at":"2026-08-06T14:35:52.801309Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:35:52.769953Z","title":null,"venue":null,"work_id":"f85b8f96-3e49-44e6-af7b-292a6320b0a3","year":null},"citing_paper":{"arxiv_id":"2507.18446","last_updated":"2025-07-24T14:30:48Z","snapshot_observed_at":"2026-08-06T14:35:50.664337Z","submitted_at":"2025-07-24T14:30:48Z","title":"Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:51.345519Z"},"links":{"citing_paper":"/paper/2507.18446"},"observation_digest":"sha256:84766a35c92398c404509255aa436b9907d986cec292cd3a695c073e0f0ee2c6","observation_id":"72c91634-0477-4bfc-952e-8cc96cd7d6a9","resolution":{"observed_at":"2026-08-06T14:35:52.781699Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:35:52.750450Z","title":null,"venue":null,"work_id":"b99b0603-1143-4fed-a31d-3e6ce037572f","year":null},"citing_paper":{"arxiv_id":"2507.18446","last_updated":"2025-07-24T14:30:48Z","snapshot_observed_at":"2026-08-06T14:35:50.664337Z","submitted_at":"2025-07-24T14:30:48Z","title":"Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:51.362712Z"},"links":{"citing_paper":"/paper/2507.18446"},"observation_digest":"sha256:c3b26f9e8f5effcdf922128712ea3be0f8b34f2e6b408e06eaee3bab01a86e50","observation_id":"69fd9ea5-1878-4c02-97f9-21946a760f0f","resolution":{"observed_at":"2026-08-06T14:35:52.755745Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:35:52.729223Z","title":null,"venue":null,"work_id":"b82c7acc-510c-4cb5-8946-446e00f84d81","year":null},"citing_paper":{"arxiv_id":"2507.18446","last_updated":"2025-07-24T14:30:48Z","snapshot_observed_at":"2026-08-06T14:35:50.664337Z","submitted_at":"2025-07-24T14:30:48Z","title":"Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:51.382200Z"},"links":{"citing_paper":"/paper/2507.18446"},"observation_digest":"sha256:749bbe585fd9adabc2a9f2ca744e01aa601c9fda92f06f44b8a8875e0accdb83","observation_id":"2336b67d-0212-43f4-adaf-4a75c10fa415","resolution":{"observed_at":"2026-08-06T14:35:52.736736Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:35:52.699477Z","title":null,"venue":null,"work_id":"aed6365f-b5b9-4544-bbbb-26938aa97bdd","year":null},"citing_paper":{"arxiv_id":"2507.18446","last_updated":"2025-07-24T14:30:48Z","snapshot_observed_at":"2026-08-06T14:35:50.664337Z","submitted_at":"2025-07-24T14:30:48Z","title":"Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:51.401276Z"},"links":{"citing_paper":"/paper/2507.18446"},"observation_digest":"sha256:fcc302b9aa1549a7a70e67714c3d7679dbc7a9f2c22443a7bd06772471978e84","observation_id":"6313f902-9413-43cc-b4e3-a6e9cd479c7b","resolution":{"observed_at":"2026-08-06T14:35:52.709653Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:35:52.677433Z","title":"For frames corre- sponding to +∞ or −∞ scores, use the average silence embedding instead","venue":null,"work_id":"64a215c5-7591-46d9-9f2d-026cb7e27874","year":null},"citing_paper":{"arxiv_id":"2507.18446","last_updated":"2025-07-24T14:30:48Z","snapshot_observed_at":"2026-08-06T14:35:50.664337Z","submitted_at":"2025-07-24T14:30:48Z","title":"Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:51.416505Z"},"links":{"citing_paper":"/paper/2507.18446"},"observation_digest":"sha256:006cbdd716227128b1c93673e3a513bdf85f09ba4c448a29c645e4f6c6c498a1","observation_id":"e2cf0941-186e-4a0d-8e33-c933f8ea1438","resolution":{"observed_at":"2026-08-06T14:35:52.683325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:35:52.652346Z","title":"Datasets We adopted the training dataset from [ 18], which consists of 5150 hours of simulated mixtures and 2030 hours of real multi- talker speech","venue":null,"work_id":"4eaffcf0-dcc0-4fcc-8998-2fdef6480476","year":2000},"citing_paper":{"arxiv_id":"2507.18446","last_updated":"2025-07-24T14:30:48Z","snapshot_observed_at":"2026-08-06T14:35:50.664337Z","submitted_at":"2025-07-24T14:30:48Z","title":"Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:51.431166Z"},"links":{"citing_paper":"/paper/2507.18446"},"observation_digest":"sha256:21444ad1ff9d96688666308f6fc8010b03ec360d2a031c708f5399fce3c2828d","observation_id":"d9914232-7882-41ae-86ef-0cd6ee06a105","resolution":{"observed_at":"2026-08-06T14:35:52.659795Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:35:52.632911Z","title":null,"venue":null,"work_id":"1a22ead9-bb0f-49cc-aa32-c0b838c3f416","year":null},"citing_paper":{"arxiv_id":"2507.18446","last_updated":"2025-07-24T14:30:48Z","snapshot_observed_at":"2026-08-06T14:35:50.664337Z","submitted_at":"2025-07-24T14:30:48Z","title":"Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:51.540577Z"},"links":{"citing_paper":"/paper/2507.18446"},"observation_digest":"sha256:fe6e4936ebdf7db51c51a717cd3263f42f10733cb43913e6f8792c5037f86b58","observation_id":"bb2b2d1d-e83b-455a-a84f-bf22bd6981a4","resolution":{"observed_at":"2026-08-06T14:35:52.637292Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:35:52.614801Z","title":null,"venue":null,"work_id":"e25afe50-d911-4cbe-8b5f-7eb06e8ae1c0","year":null},"citing_paper":{"arxiv_id":"2507.18446","last_updated":"2025-07-24T14:30:48Z","snapshot_observed_at":"2026-08-06T14:35:50.664337Z","submitted_at":"2025-07-24T14:30:48Z","title":"Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:51.573308Z"},"links":{"citing_paper":"/paper/2507.18446"},"observation_digest":"sha256:2dc0ce7229c75ab5326482bf8f376c4938bae10da273aa12889bec88335ac921","observation_id":"1ebebedf-2aff-4477-89b8-93ffb16a71d3","resolution":{"observed_at":"2026-08-06T14:35:52.620348Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:35:52.596541Z","title":"The setup details for each latency configuration are provided in Table 2","venue":null,"work_id":"fa6c8c3c-0189-4a53-b892-0762afd49d74","year":null},"citing_paper":{"arxiv_id":"2507.18446","last_updated":"2025-07-24T14:30:48Z","snapshot_observed_at":"2026-08-06T14:35:50.664337Z","submitted_at":"2025-07-24T14:30:48Z","title":"Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:51.619626Z"},"links":{"citing_paper":"/paper/2507.18446"},"observation_digest":"sha256:36cd93bcd9c5a8b3c1f530c44552b1923cb1a740f385ad5324bc584bbb65a537","observation_id":"69e79ce9-fd7b-4c72-9db7-e1f3e2cc622f","resolution":{"observed_at":"2026-08-06T14:35:52.602968Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:35:52.580761Z","title":"Our speaker cache management technique dynamically adjusts the cache size for each speaker, focusing on speech frames that are most valuable for caching","venue":null,"work_id":"f29b6d29-9329-49b1-9cc8-37542fbe6703","year":null},"citing_paper":{"arxiv_id":"2507.18446","last_updated":"2025-07-24T14:30:48Z","snapshot_observed_at":"2026-08-06T14:35:50.664337Z","submitted_at":"2025-07-24T14:30:48Z","title":"Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:51.635844Z"},"links":{"citing_paper":"/paper/2507.18446"},"observation_digest":"sha256:707e658404085655a113d6704ff182eb508ec74e13845650806c8f3304f8b5c4","observation_id":"dde2186e-1a8b-4a0f-b21a-2da0e6219bfd","resolution":{"observed_at":"2026-08-06T14:35:52.586232Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:35:52.562083Z","title":"End-to-end neural speaker diarization with permutation-free objectives,","venue":null,"work_id":"0d2bf3f7-2cb7-4df7-b977-bc3e967704c8","year":2019},"citing_paper":{"arxiv_id":"2507.18446","last_updated":"2025-07-24T14:30:48Z","snapshot_observed_at":"2026-08-06T14:35:50.664337Z","submitted_at":"2025-07-24T14:30:48Z","title":"Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:51.640952Z"},"links":{"citing_paper":"/paper/2507.18446"},"observation_digest":"sha256:797abd73989b71c4760aa0e784e23a38b6dc51175ba3dacff80ef9f67fae1f9e","observation_id":"ce716b25-63f3-47e4-b8a2-bb33d8f24100","resolution":{"observed_at":"2026-08-06T14:35:52.567822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:35:52.544405Z","title":"End-to-end neural speaker diarization with self- attention,","venue":null,"work_id":"8648f303-864c-4f51-a2c0-20258e71660d","year":2019},"citing_paper":{"arxiv_id":"2507.18446","last_updated":"2025-07-24T14:30:48Z","snapshot_observed_at":"2026-08-06T14:35:50.664337Z","submitted_at":"2025-07-24T14:30:48Z","title":"Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:51.645529Z"},"links":{"citing_paper":"/paper/2507.18446"},"observation_digest":"sha256:776656fa0d0c7a3093e6e6a6d378bd65bf26f50154aa51c3ae56d370f0b8ffb9","observation_id":"206854e1-2100-4409-9d71-16943fe962c4","resolution":{"observed_at":"2026-08-06T14:35:52.550248Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:35:52.523505Z","title":"Permutation invari- ant training of deep models for speaker-independent multi-talker speech separation,","venue":null,"work_id":"62f52f22-966a-49b6-aa62-74ad2bd940a8","year":2017},"citing_paper":{"arxiv_id":"2507.18446","last_updated":"2025-07-24T14:30:48Z","snapshot_observed_at":"2026-08-06T14:35:50.664337Z","submitted_at":"2025-07-24T14:30:48Z","title":"Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:51.650828Z"},"links":{"citing_paper":"/paper/2507.18446"},"observation_digest":"sha256:297b6341e7b0cff426282328dfa4f589733de23a3b49d6c5161997c5c2ae7de7","observation_id":"033e4061-43b5-46fc-bb8a-96275792e202","resolution":{"observed_at":"2026-08-06T14:35:52.529754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.01796","last_updated":"2020-06-02T17:28:12Z","snapshot_observed_at":"2026-08-06T22:18:10.620929Z","submitted_at":"2020-06-02T17:28:12Z","title":"Neural Speaker Diarization with Speaker-Wise Chain Rule","version":1},"cited_work":{"arxiv_id":"2006.01796","doi":null,"metadata_source":"pith","pith_arxiv_id":"2006.01796","snapshot_observed_at":"2026-08-06T14:35:51.975894Z","title":"Neural Speaker Diarization with Speaker-Wise Chain Rule","venue":"eess.AS","work_id":"b764e113-f99a-4632-a8c6-5c0f7e546139","year":2020},"citing_paper":{"arxiv_id":"2507.18446","last_updated":"2025-07-24T14:30:48Z","snapshot_observed_at":"2026-08-06T14:35:50.664337Z","submitted_at":"2025-07-24T14:30:48Z","title":"Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:51.655302Z"},"links":{"cited_paper":"/paper/2006.01796","citing_paper":"/paper/2507.18446"},"observation_digest":"sha256:97df9cc28d5dc54e771c0320210eeee32891e31c572b1da184290c4e18f37c42","observation_id":"804298a3-8d4b-47ed-a438-91a8c918b770","resolution":{"observed_at":"2026-08-06T14:35:51.981325Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:35:52.503554Z","title":"End-to-end speaker diarization conditioned on speech activity and overlap detection,","venue":null,"work_id":"a73ee799-8b5d-43f4-b189-5b4fb7c79a75","year":2021},"citing_paper":{"arxiv_id":"2507.18446","last_updated":"2025-07-24T14:30:48Z","snapshot_observed_at":"2026-08-06T14:35:50.664337Z","submitted_at":"2025-07-24T14:30:48Z","title":"Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:51.660859Z"},"links":{"citing_paper":"/paper/2507.18446"},"observation_digest":"sha256:33c88e430297964cad6d6baa3df56aef34c5198593bbde8770c53da376037651","observation_id":"e80cc04d-73a9-4cc5-8a49-bd88466a9e14","resolution":{"observed_at":"2026-08-06T14:35:52.508486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:35:52.479097Z","title":"End-to-end speaker diarization for an unknown number of speakers with encoder-decoder based attractors,","venue":null,"work_id":"ffb77fb2-8935-4fb0-8e11-0e621b5a1c8a","year":2020},"citing_paper":{"arxiv_id":"2507.18446","last_updated":"2025-07-24T14:30:48Z","snapshot_observed_at":"2026-08-06T14:35:50.664337Z","submitted_at":"2025-07-24T14:30:48Z","title":"Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:51.665954Z"},"links":{"citing_paper":"/paper/2507.18446"},"observation_digest":"sha256:717bdff71dfce91e036290fca96ffef8cccb3efb1ea6797539cc9e36c2439870","observation_id":"50b6af42-bff3-468f-a436-5b901ea4db4d","resolution":{"observed_at":"2026-08-06T14:35:52.485259Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:35:52.451979Z","title":"Encoder-decoder based attractors for end-to-end neural diariza- tion,","venue":null,"work_id":"788d2348-189f-48f0-84c0-7a044e301fd1","year":2022},"citing_paper":{"arxiv_id":"2507.18446","last_updated":"2025-07-24T14:30:48Z","snapshot_observed_at":"2026-08-06T14:35:50.664337Z","submitted_at":"2025-07-24T14:30:48Z","title":"Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:51.670610Z"},"links":{"citing_paper":"/paper/2507.18446"},"observation_digest":"sha256:be15a52b5e9153c5cb4835ed79606bb535c50a950a77c423ca0ab2e4572b29dc","observation_id":"74b5a4bd-8186-450a-a43a-0eb12461b704","resolution":{"observed_at":"2026-08-06T14:35:52.463384Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:35:52.434646Z","title":"Online neural diarization of unlimited numbers of speakers using global and local attractors,","venue":null,"work_id":"243542b3-fbf0-4b67-b8d6-d2a6861d55fe","year":2022},"citing_paper":{"arxiv_id":"2507.18446","last_updated":"2025-07-24T14:30:48Z","snapshot_observed_at":"2026-08-06T14:35:50.664337Z","submitted_at":"2025-07-24T14:30:48Z","title":"Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:51.676272Z"},"links":{"citing_paper":"/paper/2507.18446"},"observation_digest":"sha256:c2bcedea402da5ea9c0ca975100048cd17f1078e9d57a42c779335c897da392f","observation_id":"1b5b1e13-ba83-48b3-b9eb-015b92f33cf9","resolution":{"observed_at":"2026-08-06T14:35:52.439567Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:35:52.417159Z","title":"Attention-based encoder- decoder end-to-end neural diarization with embedding enhancer,","venue":null,"work_id":"e6fb51ca-5757-4a95-afec-3cc279ddeb15","year":2024},"citing_paper":{"arxiv_id":"2507.18446","last_updated":"2025-07-24T14:30:48Z","snapshot_observed_at":"2026-08-06T14:35:50.664337Z","submitted_at":"2025-07-24T14:30:48Z","title":"Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:51.680806Z"},"links":{"citing_paper":"/paper/2507.18446"},"observation_digest":"sha256:e9497f27d203dce55db2e4f836c95817040252d826be71951d2117cd0ea923b1","observation_id":"df1e60fa-18a0-4b86-99d0-c9892254b3e3","resolution":{"observed_at":"2026-08-06T14:35:52.421706Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:35:52.399444Z","title":"BW-EDA-EEND: Streaming end-to-end neural speaker diarization for a variable number of speakers,","venue":null,"work_id":"4b696f10-e23c-4615-970b-17987eb6b9fa","year":2021},"citing_paper":{"arxiv_id":"2507.18446","last_updated":"2025-07-24T14:30:48Z","snapshot_observed_at":"2026-08-06T14:35:50.664337Z","submitted_at":"2025-07-24T14:30:48Z","title":"Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:51.685413Z"},"links":{"citing_paper":"/paper/2507.18446"},"observation_digest":"sha256:69560b56c6c6b52c29b6a15478a2f451031392859e09a7da6b830e3daa0b9afb","observation_id":"a131b2ac-0797-4d13-9366-ebb2cd3637ad","resolution":{"observed_at":"2026-08-06T14:35:52.404142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:35:52.381445Z","title":"Online streaming end-to-end neural diarization handling overlapping speech and flexible numbers of speakers,","venue":null,"work_id":"90fa924a-8007-4a38-8678-d836a4205012","year":2021},"citing_paper":{"arxiv_id":"2507.18446","last_updated":"2025-07-24T14:30:48Z","snapshot_observed_at":"2026-08-06T14:35:50.664337Z","submitted_at":"2025-07-24T14:30:48Z","title":"Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:51.689623Z"},"links":{"citing_paper":"/paper/2507.18446"},"observation_digest":"sha256:2b45f0ceef19bfb0228d2db99f5471894306a258b5815f52c44d01734c4f9063","observation_id":"f6a7ef53-4534-46dc-910b-3408c87646ad","resolution":{"observed_at":"2026-08-06T14:35:52.386734Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:35:52.358632Z","title":"Online end-to-end neural diarization with speaker- tracing buffer,","venue":null,"work_id":"909271e6-6f9e-4e6b-9c8c-a30772f1839f","year":2021},"citing_paper":{"arxiv_id":"2507.18446","last_updated":"2025-07-24T14:30:48Z","snapshot_observed_at":"2026-08-06T14:35:50.664337Z","submitted_at":"2025-07-24T14:30:48Z","title":"Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:51.693755Z"},"links":{"citing_paper":"/paper/2507.18446"},"observation_digest":"sha256:90eca2279fe66d42ded3fc63a8568f8759345511ebb97edbe5321f9f51377b14","observation_id":"26a2c534-a5ef-4bea-b391-9ecf437dad68","resolution":{"observed_at":"2026-08-06T14:35:52.366049Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:35:52.338646Z","title":"Frame-wise streaming end-to-end speaker diarization with non-autoregressive self-attention-based attractors,","venue":null,"work_id":"c0e493c3-c5eb-43ad-ad30-24789336705c","year":2024},"citing_paper":{"arxiv_id":"2507.18446","last_updated":"2025-07-24T14:30:48Z","snapshot_observed_at":"2026-08-06T14:35:50.664337Z","submitted_at":"2025-07-24T14:30:48Z","title":"Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:51.698213Z"},"links":{"citing_paper":"/paper/2507.18446"},"observation_digest":"sha256:dba2d063bba54722fb9839b773c79602f0eb70c7317eef273608d58bffab3006","observation_id":"29693311-8b0b-4676-a963-fa9b9fe83cca","resolution":{"observed_at":"2026-08-06T14:35:52.343973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06670","last_updated":"2025-09-08T12:52:27Z","snapshot_observed_at":"2026-07-06T19:30:17.275798Z","submitted_at":"2024-10-09T08:26:13Z","title":"LS-EEND: Long-Form Streaming End-to-End Neural Diarization with Online Attractor Extraction","version":2},"cited_work":{"arxiv_id":"2410.06670","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.06670","snapshot_observed_at":"2026-08-06T14:35:51.945258Z","title":"LS-EEND: Long-Form Streaming End-to-End Neural Diarization with Online Attractor Extraction","venue":"eess.AS","work_id":"91fbb4d0-5938-40e3-8ae9-7dde82a52195","year":2024},"citing_paper":{"arxiv_id":"2507.18446","last_updated":"2025-07-24T14:30:48Z","snapshot_observed_at":"2026-08-06T14:35:50.664337Z","submitted_at":"2025-07-24T14:30:48Z","title":"Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:51.703555Z"},"links":{"cited_paper":"/paper/2410.06670","citing_paper":"/paper/2507.18446"},"observation_digest":"sha256:d931b7429c6a9473e2b3892604b1f8f9e97f72bf29bb0d91ec1bc2d01a35a615","observation_id":"91f4846c-c8f6-409d-9239-0db28895e583","resolution":{"observed_at":"2026-08-06T14:35:51.953401Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:35:52.322812Z","title":"Target-speaker voice activity de- tection: a novel approach for multi-speaker diarization in a dinner party scenario,","venue":null,"work_id":"5a39f1d9-0264-4f0e-9985-3c22bbfe1947","year":2020},"citing_paper":{"arxiv_id":"2507.18446","last_updated":"2025-07-24T14:30:48Z","snapshot_observed_at":"2026-08-06T14:35:50.664337Z","submitted_at":"2025-07-24T14:30:48Z","title":"Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:51.708305Z"},"links":{"citing_paper":"/paper/2507.18446"},"observation_digest":"sha256:7cc78b2df533f3fb3a9bd556187a987e7bf581d7599942df59c3cebd78beb2b3","observation_id":"2a335783-e2d9-45ae-b14f-8428aade0f14","resolution":{"observed_at":"2026-08-06T14:35:52.327554Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.13849","last_updated":"2025-06-21T06:43:49Z","snapshot_observed_at":"2026-07-06T19:53:34.670694Z","submitted_at":"2024-11-21T05:15:46Z","title":"Sequence-to-Sequence Neural Diarization with Automatic Speaker Detection and Representation","version":2},"cited_work":{"arxiv_id":"2411.13849","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.13849","snapshot_observed_at":"2026-08-06T14:35:51.915918Z","title":"Sequence-to-Sequence Neural Diarization with Automatic Speaker Detection and Representation","venue":"eess.AS","work_id":"d7c2024a-7724-4134-9252-1304bd27aa4a","year":2024},"citing_paper":{"arxiv_id":"2507.18446","last_updated":"2025-07-24T14:30:48Z","snapshot_observed_at":"2026-08-06T14:35:50.664337Z","submitted_at":"2025-07-24T14:30:48Z","title":"Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:51.717332Z"},"links":{"cited_paper":"/paper/2411.13849","citing_paper":"/paper/2507.18446"},"observation_digest":"sha256:afb5cd32ac196b9a1262c46dc6324c7f5f143a9594f745635228d0a79970c948","observation_id":"1556bd5e-7335-4c49-ac77-0305a77e14c5","resolution":{"observed_at":"2026-08-06T14:35:51.925658Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.06656","last_updated":"2025-07-19T18:18:34Z","snapshot_observed_at":"2026-07-06T19:13:20.458958Z","submitted_at":"2024-09-10T17:20:11Z","title":"Sortformer: A Novel Approach for Permutation-Resolved Speaker Supervision in Speech-to-Text Systems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.06656","snapshot_observed_at":"2026-08-06T14:35:51.725915Z","title":"Sortformer: Seamless integration of speaker diarization and asr by bridging timestamps and tokens,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18446","last_updated":"2025-07-24T14:30:48Z","snapshot_observed_at":"2026-08-06T14:35:50.664337Z","submitted_at":"2025-07-24T14:30:48Z","title":"Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:51.725915Z"},"links":{"cited_paper":"/paper/2409.06656","citing_paper":"/paper/2507.18446"},"observation_digest":"sha256:a9e91c1a786bf4843a92784fedf13b7988f542848af5270e7ba8d2d9e31237aa","observation_id":"f059a1fd-6090-459c-b269-2647fa982092","resolution":{"observed_at":"2026-08-06T14:35:51.725915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:35:52.306921Z","title":"NEST: Self-supervised fast conformer as all-purpose seasoning to speech processing tasks,","venue":null,"work_id":"67cbd293-6742-4fd8-ad49-a92e54824a4e","year":2025},"citing_paper":{"arxiv_id":"2507.18446","last_updated":"2025-07-24T14:30:48Z","snapshot_observed_at":"2026-08-06T14:35:50.664337Z","submitted_at":"2025-07-24T14:30:48Z","title":"Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:51.730846Z"},"links":{"citing_paper":"/paper/2507.18446"},"observation_digest":"sha256:15169ca1304df64f9b036fe53561e0b596d232e8a8063cfabea3d5dad0450021","observation_id":"a4c634fc-e1e4-4072-8c19-50543d1ce57e","resolution":{"observed_at":"2026-08-06T14:35:52.312262Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:35:52.289336Z","title":"Fast conformer with linearly scalable attention for efficient speech recognition,","venue":null,"work_id":"d50f3dd0-ccd9-4576-b942-79a4784f5ebc","year":2023},"citing_paper":{"arxiv_id":"2507.18446","last_updated":"2025-07-24T14:30:48Z","snapshot_observed_at":"2026-08-06T14:35:50.664337Z","submitted_at":"2025-07-24T14:30:48Z","title":"Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:51.735784Z"},"links":{"citing_paper":"/paper/2507.18446"},"observation_digest":"sha256:6670adca9a92d069416ba751dbb216730d242f004047360886cf701d94affa0f","observation_id":"5e7b54ec-462e-4ae1-9fb0-5757784cd739","resolution":{"observed_at":"2026-08-06T14:35:52.295324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:35:51.740925Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.18446","last_updated":"2025-07-24T14:30:48Z","snapshot_observed_at":"2026-08-06T14:35:50.664337Z","submitted_at":"2025-07-24T14:30:48Z","title":"Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:51.740925Z"},"links":{"citing_paper":"/paper/2507.18446"},"observation_digest":"sha256:f1b1cd3ce4e850f603ae9eddf174cc41183374daf75bda77078bbab18e9b64f7","observation_id":"4b73e198-ac88-4b58-80fa-718333636c23","resolution":{"observed_at":"2026-08-06T14:35:51.740925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:35:52.261461Z","title":"The Fisher Corpus: A Re- source for the Next Generations of Speech-to-text,","venue":null,"work_id":"6e2f3c6f-b063-437d-9526-f74bf0558d95","year":2004},"citing_paper":{"arxiv_id":"2507.18446","last_updated":"2025-07-24T14:30:48Z","snapshot_observed_at":"2026-08-06T14:35:50.664337Z","submitted_at":"2025-07-24T14:30:48Z","title":"Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:51.745402Z"},"links":{"citing_paper":"/paper/2507.18446"},"observation_digest":"sha256:403405eaa6ba082f1c987831391f71b6d7243993730b4a9106bf5a1e3f2f0dcc","observation_id":"98fee946-f58d-4398-b429-1e25a0d20b8b","resolution":{"observed_at":"2026-08-06T14:35:52.267643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:35:52.246480Z","title":"The AMI corpus,","venue":null,"work_id":"731ce63c-149c-4011-92ef-971be6d4b59b","year":null},"citing_paper":{"arxiv_id":"2507.18446","last_updated":"2025-07-24T14:30:48Z","snapshot_observed_at":"2026-08-06T14:35:50.664337Z","submitted_at":"2025-07-24T14:30:48Z","title":"Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:51.750562Z"},"links":{"citing_paper":"/paper/2507.18446"},"observation_digest":"sha256:f328b1d253bc20537eb7f30f5be7f439cdbb0a56d27dc3a188ec64801274226c","observation_id":"25e09647-426e-49ba-a253-4e322f4a12e0","resolution":{"observed_at":"2026-08-06T14:35:52.250811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:35:52.226539Z","title":"Bayesian HMM clustering of x-vector sequences (VBx) in speaker diarization: theory, implementation and analysis on standard tasks,","venue":null,"work_id":"ebf4e4c5-ee20-4bef-a168-2de1a5efc1ed","year":2022},"citing_paper":{"arxiv_id":"2507.18446","last_updated":"2025-07-24T14:30:48Z","snapshot_observed_at":"2026-08-06T14:35:50.664337Z","submitted_at":"2025-07-24T14:30:48Z","title":"Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:51.755678Z"},"links":{"citing_paper":"/paper/2507.18446"},"observation_digest":"sha256:da21ac0d9313b8ef3b9e2d5fddfcdfaacdde40c3941f9ff7ec9fa9748f349e9c","observation_id":"dda3fe10-27a3-4c0c-ab6c-174af2b47c61","resolution":{"observed_at":"2026-08-06T14:35:52.231895Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.05815","last_updated":"2020-12-02T20:14:57Z","snapshot_observed_at":"2026-08-09T22:25:39.600882Z","submitted_at":"2020-06-04T22:23:10Z","title":"Third DIHARD Challenge Evaluation Plan","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.05815","snapshot_observed_at":"2026-08-06T14:35:51.759915Z","title":"Third DIHARD challenge evaluation plan,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2507.18446","last_updated":"2025-07-24T14:30:48Z","snapshot_observed_at":"2026-08-06T14:35:50.664337Z","submitted_at":"2025-07-24T14:30:48Z","title":"Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:51.759915Z"},"links":{"cited_paper":"/paper/2006.05815","citing_paper":"/paper/2507.18446"},"observation_digest":"sha256:551ba90b7963d10db10f2bcb866e0481447f69281d9c63010ba4e4e107185a38","observation_id":"a0cab94c-7c9f-4620-b47f-7ec4b8b03136","resolution":{"observed_at":"2026-08-06T14:35:51.759915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:35:52.208369Z","title":"Spot the conversation: speaker diarisation in the wild,","venue":null,"work_id":"5bb832a2-75f9-400f-825b-b133c7a0dad7","year":2020},"citing_paper":{"arxiv_id":"2507.18446","last_updated":"2025-07-24T14:30:48Z","snapshot_observed_at":"2026-08-06T14:35:50.664337Z","submitted_at":"2025-07-24T14:30:48Z","title":"Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:51.764905Z"},"links":{"citing_paper":"/paper/2507.18446"},"observation_digest":"sha256:379a0f755970c66eb7839758a7d6805bf7358585fd21530c01dae32128fc13ea","observation_id":"f930a982-6823-47ab-889a-9604923d6f2d","resolution":{"observed_at":"2026-08-06T14:35:52.213218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:35:52.185695Z","title":"The ICSI meeting corpus,","venue":null,"work_id":"5826d958-2684-4c1c-9ec5-cc142db19862","year":null},"citing_paper":{"arxiv_id":"2507.18446","last_updated":"2025-07-24T14:30:48Z","snapshot_observed_at":"2026-08-06T14:35:50.664337Z","submitted_at":"2025-07-24T14:30:48Z","title":"Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:51.769344Z"},"links":{"citing_paper":"/paper/2507.18446"},"observation_digest":"sha256:871d804bcd39773f0764e917aacc7823208e22d9783abee874c57ad097bae8ab","observation_id":"61957fa0-864b-4aa7-8f07-1ddb75965f31","resolution":{"observed_at":"2026-08-06T14:35:52.191106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:35:52.169340Z","title":"AISHELL-4: An open source dataset for speech enhancement, separation, recognition and speaker diariza- tion in conference scenario,","venue":null,"work_id":"af93fe47-d7d6-419c-a89f-d7176c4e96c9","year":2021},"citing_paper":{"arxiv_id":"2507.18446","last_updated":"2025-07-24T14:30:48Z","snapshot_observed_at":"2026-08-06T14:35:50.664337Z","submitted_at":"2025-07-24T14:30:48Z","title":"Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:51.773798Z"},"links":{"citing_paper":"/paper/2507.18446"},"observation_digest":"sha256:f928357a7893914be85fffc21eb7436b2d69db831a068c26f663f6dcf64f9389","observation_id":"7d7384af-4c1b-46e9-834a-e50652a2c393","resolution":{"observed_at":"2026-08-06T14:35:52.174581Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:35:52.151434Z","title":"Kaldi x-vector Recipe v2,","venue":null,"work_id":"c4810e83-faa1-4b5b-9f7b-e674243086a6","year":null},"citing_paper":{"arxiv_id":"2507.18446","last_updated":"2025-07-24T14:30:48Z","snapshot_observed_at":"2026-08-06T14:35:50.664337Z","submitted_at":"2025-07-24T14:30:48Z","title":"Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:51.778765Z"},"links":{"citing_paper":"/paper/2507.18446"},"observation_digest":"sha256:cac8ee670f3c82f09ad579471cab591110af1dbb3c74443375ee90bdf56bf1ee","observation_id":"3dff81bd-11a4-474f-bc33-6ce7ca6f0c00","resolution":{"observed_at":"2026-08-06T14:35:52.157212Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:35:52.132666Z","title":"2000 NIST Speaker Recognition Evaluation,","venue":null,"work_id":"dd3899fb-db3f-46ce-ba03-458775de4d0b","year":2000},"citing_paper":{"arxiv_id":"2507.18446","last_updated":"2025-07-24T14:30:48Z","snapshot_observed_at":"2026-08-06T14:35:50.664337Z","submitted_at":"2025-07-24T14:30:48Z","title":"Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:51.783577Z"},"links":{"citing_paper":"/paper/2507.18446"},"observation_digest":"sha256:b9939ca0cde0f3521883964d97fbd0f802cd4f3c7d32ce695267e8f024c22f29","observation_id":"9b294e04-005b-4817-83c8-7a75b3acc6fd","resolution":{"observed_at":"2026-08-06T14:35:52.137312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:35:52.117436Z","title":"M2MeT: The ICASSP 2022 multi-channel multi-party meeting transcription challenge,","venue":null,"work_id":"8600806d-4501-4add-b7d0-20d90c933d90","year":2022},"citing_paper":{"arxiv_id":"2507.18446","last_updated":"2025-07-24T14:30:48Z","snapshot_observed_at":"2026-08-06T14:35:50.664337Z","submitted_at":"2025-07-24T14:30:48Z","title":"Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:51.788201Z"},"links":{"citing_paper":"/paper/2507.18446"},"observation_digest":"sha256:4216f9b299bf024c858b434993ba426347873274f9f901ea4e4f408b77f0d17c","observation_id":"db759748-e5ef-4559-aef4-216119579f88","resolution":{"observed_at":"2026-08-06T14:35:52.122037Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:35:52.101496Z","title":"DiPCo–dinner party corpus,","venue":null,"work_id":"6a74c611-0753-41ec-8a7c-d466872da5d3","year":2020},"citing_paper":{"arxiv_id":"2507.18446","last_updated":"2025-07-24T14:30:48Z","snapshot_observed_at":"2026-08-06T14:35:50.664337Z","submitted_at":"2025-07-24T14:30:48Z","title":"Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:51.792531Z"},"links":{"citing_paper":"/paper/2507.18446"},"observation_digest":"sha256:211fa92630d11d02df87dd09fe4ca3cfaa12287d90aa618a0bc019e43721045e","observation_id":"5cf94e4d-7708-46de-89dd-f5b2ddf1c88e","resolution":{"observed_at":"2026-08-06T14:35:52.106432Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:35:52.077806Z","title":"STCON system for the CHiME-8 challenge,","venue":null,"work_id":"3ef403c3-832c-4479-96b8-ee76778a609b","year":2024},"citing_paper":{"arxiv_id":"2507.18446","last_updated":"2025-07-24T14:30:48Z","snapshot_observed_at":"2026-08-06T14:35:50.664337Z","submitted_at":"2025-07-24T14:30:48Z","title":"Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:51.797591Z"},"links":{"citing_paper":"/paper/2507.18446"},"observation_digest":"sha256:45a43f2ace1ab41b4a89a0e3dcef8e251248936e57f38e9a054b3e5a7e200ac6","observation_id":"4e69931b-1a2b-45ac-9b5e-04cec000b5db","resolution":{"observed_at":"2026-08-06T14:35:52.086698Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:35:52.051597Z","title":"Callhome american english speech,","venue":null,"work_id":"38706306-6690-4387-acbf-2d043e2fd957","year":1997},"citing_paper":{"arxiv_id":"2507.18446","last_updated":"2025-07-24T14:30:48Z","snapshot_observed_at":"2026-08-06T14:35:50.664337Z","submitted_at":"2025-07-24T14:30:48Z","title":"Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:51.804917Z"},"links":{"citing_paper":"/paper/2507.18446"},"observation_digest":"sha256:12bceaeb76f015962b662bc67ab97e9912a856c6bf55b3db04df32c73c57faa2","observation_id":"ce599f1b-5f32-4e02-952c-17dcadf3ca4f","resolution":{"observed_at":"2026-08-06T14:35:52.058712Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:35:51.812002Z","title":"SpecAugment: A simple data augmentation method for automatic speech recognition,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.18446","last_updated":"2025-07-24T14:30:48Z","snapshot_observed_at":"2026-08-06T14:35:50.664337Z","submitted_at":"2025-07-24T14:30:48Z","title":"Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:51.812002Z"},"links":{"citing_paper":"/paper/2507.18446"},"observation_digest":"sha256:fdbfe2a4006c7b22419f85836aebbb0b4ac43994b40cada8187aa61a2a3d367c","observation_id":"11d23b07-89e2-4dbb-b5d9-dfc18c7c646f","resolution":{"observed_at":"2026-08-06T14:35:51.812002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:35:52.020512Z","title":"A study on data augmentation of reverberant speech for robust speech recognition,","venue":null,"work_id":"05dcdc6c-11c0-4b55-ab77-3db1d07ea5b2","year":2017},"citing_paper":{"arxiv_id":"2507.18446","last_updated":"2025-07-24T14:30:48Z","snapshot_observed_at":"2026-08-06T14:35:50.664337Z","submitted_at":"2025-07-24T14:30:48Z","title":"Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:51.816957Z"},"links":{"citing_paper":"/paper/2507.18446"},"observation_digest":"sha256:0a8afc4ad1bb619f35947a41bf6c7b9fda02a7f519c507848c45dec5a5883c31","observation_id":"ba489141-755c-4da6-a6fd-6499b63cfa34","resolution":{"observed_at":"2026-08-06T14:35:52.026058Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.18446","last_updated":"2025-07-24T14:30:48Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-06T14:35:50.664337Z","submitted_at":"2025-07-24T14:30:48Z","title":"Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering"},"reference_resolution":{"displayed":50,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":13,"verified_exact":3,"verified_fuzzy":32},"total_outbound_references":50},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 50 of 50 outbound references and 1 inbound Pith citation observation for arXiv:2507.18446."}