{"as_of":"2026-08-10T11:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:042657c2eff35ff0568266de9663a59de36d68cd72c762634a2eebba57bd6c1e","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T13:13:07.182612Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T13:13:04.567985Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T04:57:37.975653Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.20926","snapshot_observed_at":"2026-08-06T13:13:04.567985Z","title":"Problem formulation Let X ∈ RM ×L be the multichannel mixture recorded by an M-microphone array, whereL denotes the number of time sam- ples","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:04.567985Z"},"links":{"cited_paper":"/paper/2507.20926","citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:46902d7bd408e798e9c39ee70442776f291560c5f382efd695cc876b60a137ec","observation_id":"c9f72f9c-a67c-4c91-99df-cf8bcbac0804","resolution":{"observed_at":"2026-08-06T13:13:04.567985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"cited_work":{"arxiv_id":"2507.20926","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.20926","snapshot_observed_at":"2026-07-03T04:57:37.975653Z","title":"End-to-end doa-guided speech extraction in noisy multi-talker scenarios,","venue":null,"work_id":"cba639fe-b17d-4e30-823c-691ac4ef4111","year":2025},"citing_paper":{"arxiv_id":"2607.02296","last_updated":"2026-07-02T15:13:32Z","snapshot_observed_at":"2026-08-02T07:05:47.023745Z","submitted_at":"2026-07-02T15:13:32Z","title":"Spatial Speech Perception Systems: A Survey of Sound Source Localization, Directional Enhancement, and Speech Recognition","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-03T04:52:36.712797Z"},"links":{"cited_paper":"/paper/2507.20926","citing_paper":"/paper/2607.02296"},"observation_digest":"sha256:f4f9bf589e8c298a93cef4a27ae59c787525e420c2dcd59f5c8aaf163a40d21b","observation_id":"27ad84c5-009e-4227-9796-919a0c83b8b4","resolution":{"observed_at":"2026-07-03T04:57:37.977094Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.20926","snapshot_observed_at":"2026-07-31T00:58:13.711323Z","title":"End-to-end doa-guided speech extraction in noisy multi-talker scenarios,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27436","last_updated":"2026-07-29T20:05:39Z","snapshot_observed_at":"2026-08-07T01:15:56.832491Z","submitted_at":"2026-07-29T20:05:39Z","title":"WeSep: A Modular and Cue-Composable Framework for Target Speaker Extraction","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-31T00:58:13.711323Z"},"links":{"cited_paper":"/paper/2507.20926","citing_paper":"/paper/2607.27436"},"observation_digest":"sha256:f0ef9c2576ea38df7af786d2d98ecc871c1db21faa47a72a5256879d22aeec3b","observation_id":"83d52725-d8fa-47ae-b9f0-e0dea7aea5d0","resolution":{"observed_at":"2026-07-31T00:58:13.711323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.20926/citation-record","integrity":"/paper/2507.20926/integrity","json":"/paper/2507.20926/citation-record.json","paper":"/paper/2507.20926"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:11.498183Z","title":"cocktail party effect","venue":null,"work_id":"c3e4e589-dabf-48b0-a91a-52aa8267afe4","year":null},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:04.490653Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:81597663811332b7c01720260f10fdcaf3facda0eadb14c784ff6c2f04c1e8a7","observation_id":"ff6aaa57-ffd2-4e86-82f6-82f9556f8793","resolution":{"observed_at":"2026-08-06T13:13:11.502683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.20926","snapshot_observed_at":"2026-08-06T13:13:04.567985Z","title":"Problem formulation Let X ∈ RM ×L be the multichannel mixture recorded by an M-microphone array, whereL denotes the number of time sam- ples","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:04.567985Z"},"links":{"cited_paper":"/paper/2507.20926","citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:46902d7bd408e798e9c39ee70442776f291560c5f382efd695cc876b60a137ec","observation_id":"c9f72f9c-a67c-4c91-99df-cf8bcbac0804","resolution":{"observed_at":"2026-08-06T13:13:04.567985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:11.480622Z","title":"Dataset For this study, the speech data is sourced from the LibriSpeech corpus [23], while the background noise is taken from the DE- MAND dataset [24]","venue":null,"work_id":"446e504d-040a-4f6a-a4ec-db1691e9736b","year":null},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:04.684310Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:6410a03e5d5ab28df109c590cd57c8697c00ff1eb3955e079f4a1e97a57169c4","observation_id":"c53dc4db-99e7-4cb1-92f3-4383aa4f1a32","resolution":{"observed_at":"2026-08-06T13:13:11.486535Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:11.381986Z","title":null,"venue":null,"work_id":"57d376fc-860b-4e74-9f12-204aa4ef1aaf","year":null},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:04.766743Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:4afb1e7f57b8a850ba3ef960cffad3f094b31e96cf758d8c1547eee4e261d92a","observation_id":"2340fc59-cb73-47d0-adb5-140a72445203","resolution":{"observed_at":"2026-08-06T13:13:11.469192Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:11.358016Z","title":null,"venue":null,"work_id":"ec669a28-aaa9-4b7d-a595-49d2bb42b35b","year":null},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:04.837903Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:f190bd80b5c2f419b183e71591cf333eaa5464d1bac18408b330734561028c08","observation_id":"897568b5-e357-4285-96a4-317dc2fc63ba","resolution":{"observed_at":"2026-08-06T13:13:11.363481Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:04.916426Z","title":"The cocktail party problem,","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:04.916426Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:3eb766ec29e145f83e5a1025442090ab0707e6116cbd0a9c7f241cdf0e568c93","observation_id":"94664007-a3ae-4187-9074-92e6f3e93053","resolution":{"observed_at":"2026-08-06T13:13:04.916426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:05.004044Z","title":"Music source separation with band-split rnn,","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:05.004044Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:8d2c48c8375df6370e9dfeb76c019a11555c6ffcb28d9e2e8b2d5491e9162e82","observation_id":"d0ba75bb-3586-4cbf-a584-97a2773c8e4a","resolution":{"observed_at":"2026-08-06T13:13:05.004044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:11.315217Z","title":"Distance- based sound separation,","venue":null,"work_id":"b671c844-86c4-4726-ada8-41f0b8abd453","year":2022},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:05.092275Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:f8ab73d0e85b305375e1076960da828bd2234bbac4a092e7e9f0021d7a6f6a11","observation_id":"ac199df7-91e8-4f09-86f6-19dfedd90db2","resolution":{"observed_at":"2026-08-06T13:13:11.321185Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18141","last_updated":"2024-12-30T09:57:09Z","snapshot_observed_at":"2026-08-02T15:29:10.291795Z","submitted_at":"2024-12-24T03:54:17Z","title":"Neural Directed Speech Enhancement with Dual Microphone Array in High Noise Scenario","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18141","snapshot_observed_at":"2026-08-06T13:13:05.153295Z","title":"Neural directed speech enhancement with dual microphone array in high noise scenario,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:05.153295Z"},"links":{"cited_paper":"/paper/2412.18141","citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:94f0e42777109d06c72815c9ee4ded3b7545888984c0c3166cbea8fe5a7b4285","observation_id":"c7b39a2a-086d-4b3f-80fc-8d1b905ba00a","resolution":{"observed_at":"2026-08-06T13:13:05.153295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:11.299361Z","title":"Dasformer: Deep alternating spectrogram transformer for multi/single-channel speech separation,","venue":null,"work_id":"08f5c1d5-94d3-4ae9-bb17-7ddbeddbdecf","year":2023},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:05.235084Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:8156e90a60195f0baff27c7ebbc8ffa26c0c4199cf2b94e18eed0179fbe9414a","observation_id":"879139d5-f8d1-4350-b917-2b08e322c9b0","resolution":{"observed_at":"2026-08-06T13:13:11.304241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:11.100134Z","title":"Tf-gridnet: Integrating full-and sub-band modeling for speech separation,","venue":null,"work_id":"fefc9800-4c8c-4063-962f-71059b0530dd","year":2023},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:05.324273Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:4bd0da296654087f2a5b9ccf2b31fe22dc9358b20cc5cbf7fc523d515d39a8c8","observation_id":"da76c1d6-6b02-454f-bc2a-680bf646a699","resolution":{"observed_at":"2026-08-06T13:13:11.166929Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:10.792898Z","title":"Deft-an: Dense frequency-time atten- tive network for multichannel speech enhancement,","venue":null,"work_id":"c96b0af4-3f59-4b25-ab82-62e4df796fa6","year":2023},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:05.404059Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:5292b015d0823c0e34927a83eaae0571254b49a3a573f22254465db8390d5d1c","observation_id":"aa1021fd-503d-460b-bcb9-fbd822b78800","resolution":{"observed_at":"2026-08-06T13:13:10.938519Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18913","last_updated":"2024-12-25T14:04:21Z","snapshot_observed_at":"2026-08-06T02:06:11.451347Z","submitted_at":"2024-12-25T14:04:21Z","title":"Robust Target Speaker Direction of Arrival Estimation","version":1},"cited_work":{"arxiv_id":"2412.18913","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.18913","snapshot_observed_at":"2026-08-06T13:13:07.286138Z","title":"Robust Target Speaker Direction of Arrival Estimation","venue":"cs.SD","work_id":"f2e9a3cf-302c-4c4c-9652-541446e3191f","year":2024},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:05.464848Z"},"links":{"cited_paper":"/paper/2412.18913","citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:b8bb8d91c89f43802392f6f5e240b39dcd56b640854d17baf487e839016ac1cc","observation_id":"dc996a2d-6232-47b6-9e87-579f5db58619","resolution":{"observed_at":"2026-08-06T13:13:07.394934Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:10.573618Z","title":"Dsenet: Directional sig- nal extraction network for hearing improvement on edge devices,","venue":null,"work_id":"3720243f-114c-4733-a494-f66e352612e6","year":2023},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:05.529148Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:792c0b69b7175a1e4ff2b9fcd69b5b883ea2b4b9026a29f4c35b5f936bce83d6","observation_id":"7653121b-df0e-4a14-a45a-ffb0739bee14","resolution":{"observed_at":"2026-08-06T13:13:10.692428Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:10.316526Z","title":"Insights into deep non-linear filters for improved multi-channel speech enhancement,","venue":null,"work_id":"8a98a00f-bf6b-4857-b5bd-fff1c3daab50","year":2022},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:05.614537Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:dc94b8f33cdc79ac4ed10af49fa50411e32b96c5278e8a1b6172271c1932b796","observation_id":"74357548-a1a8-47e6-9c1a-29a4b709cc36","resolution":{"observed_at":"2026-08-06T13:13:10.420302Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:10.033229Z","title":"Neural spatio-temporal beamformer for target speech separa- tion,","venue":null,"work_id":"79d60a92-d539-406f-a030-d7c933e725ef","year":2020},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:05.705751Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:bc8efa48094c9b55d3ced4ac19c945e79ddec51eb9739e97f31d8ccdbe71cc03","observation_id":"b16e9fb5-02de-4486-a591-077de3ff8ce5","resolution":{"observed_at":"2026-08-06T13:13:10.142250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:09.804791Z","title":"Multi-channel speech separation us- ing spatially selective deep non-linear filters,","venue":null,"work_id":"133ef63f-fc09-4b9e-a1f2-083a26542975","year":2023},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:05.785136Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:d01dcdb99efcaff098fd3a8f2a9053d6de20ece1563fe2136d9e52421facef31","observation_id":"7fdef1d6-2a7b-405d-973b-8dcbb75be067","resolution":{"observed_at":"2026-08-06T13:13:09.906820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:05.869531Z","title":"Rezero: Region-customizable sound extrac- tion,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:05.869531Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:e8bfe83de025ae747e3b705152c6a4f6ab17cae1ac2b565cc3c95d7bbab9f758","observation_id":"029df0b6-a33c-424e-a9c2-f22399f80b8f","resolution":{"observed_at":"2026-08-06T13:13:05.869531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:09.555923Z","title":"All neural low-latency directional speech extraction,","venue":null,"work_id":"4fb67dc1-83d6-48a3-a29d-1c8e08c02ab2","year":2024},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:05.955750Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:c65fb343214cf6db3959ee951c9c239b3057194958e9bf6ec161a04cb34a41f7","observation_id":"d7bfaef1-6b53-473d-a035-0afc3db2d4ab","resolution":{"observed_at":"2026-08-06T13:13:09.663702Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:09.426217Z","title":"Direction of arrival correction through speech quality feedback,","venue":null,"work_id":"1437bb7d-4e1e-4e16-9df0-4d85ad5f89b8","year":2025},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:06.045737Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:00ba05ca786f08d5b05b92964c52d8ff46c7c4858945f5ea5133b4a9db7a3305","observation_id":"ee2efc9f-b5fc-4a7a-b0e2-45911b445142","resolution":{"observed_at":"2026-08-06T13:13:09.466357Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:09.240096Z","title":"Spatio-temporal outdoor lighting aggregation on image se- quences using transformer networks,","venue":null,"work_id":"8b62fe98-5403-48b5-9458-74e94ba85806","year":2023},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:06.129641Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:f52f51e467aaf2724cb909cd12c19a22dce4c1256ae50bb359e72c5323c978dc","observation_id":"3baea1f0-a661-4a31-9b99-03689e812be4","resolution":{"observed_at":"2026-08-06T13:13:09.318286Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:06.180494Z","title":"Layer normalization,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:06.180494Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:bb872fc9fb0f45d6e1dbd7f4a592cf64a60a4b1427a95c0ac4599228e9fd48f7","observation_id":"e786deec-f1af-46d4-a120-b6abc248ff28","resolution":{"observed_at":"2026-08-06T13:13:06.180494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:06.239999Z","title":"Delving deep into rectifiers: Surpassing human-level performance on imagenet classification,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:06.239999Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:439e7609863ee583bbf0517679941892158e02ee30384d07e4860bb465655294","observation_id":"afde31cf-e670-4442-9f0f-9f102a149790","resolution":{"observed_at":"2026-08-06T13:13:06.239999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:09.059328Z","title":"Spatialnet: Extensively learning spatial in- formation for multichannel joint speech separation, denoising and dereverberation,","venue":null,"work_id":"083fb693-769e-4b52-9fc3-864715086627","year":2024},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:06.295315Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:675d00151abdb9cae270a6a0868ec31db3ee41aad9b3e9d7b1629c6a75d11789","observation_id":"77596097-f6a1-49b7-afd6-c3e4a90a301a","resolution":{"observed_at":"2026-08-06T13:13:09.135710Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:06.375350Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:06.375350Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:e7abaef9d643ec1acb5411c565b24092dac97ecf01282defb0096e5949d89ac3","observation_id":"9b0f394a-b8fb-400d-aaf1-4d1ad3ec11fb","resolution":{"observed_at":"2026-08-06T13:13:06.375350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:08.830910Z","title":"Group normalization,","venue":null,"work_id":"f1e63c12-b6f9-437c-8f67-908df8b6ff96","year":2018},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:06.441584Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:992c45d5d3a1e20784af769ba631ee24c4cd57243b0a7f5cb365ffaea15cfc98","observation_id":"eaf96f2b-fbbe-4e43-a45d-bb12e37e4e0c","resolution":{"observed_at":"2026-08-06T13:13:08.919661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:08.646270Z","title":"Sdr – half-baked or well done?","venue":null,"work_id":"b76ab55b-df6e-4617-97dd-0f088e65d1ae","year":2019},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:06.528006Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:e8d031ba709cfe4371e4af2c13a811dd1d9ef93ccce3ffee38d59870d7bd71bb","observation_id":"83a1c1cb-cbc7-4b7b-9ef4-c1a6c3e2ee07","resolution":{"observed_at":"2026-08-06T13:13:08.751226Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:06.592312Z","title":"Lib- rispeech: an asr corpus based on public domain audio books,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:06.592312Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:0b91d6c3c07d6564a1358f762e3316e99398ca7927948dafc43f87144621fb89","observation_id":"194bbed6-143d-48d9-bb85-246d19232c86","resolution":{"observed_at":"2026-08-06T13:13:06.592312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:08.411660Z","title":"The diverse environments multi-channel acoustic noise database (demand): A database of multichannel environmental noise recordings,","venue":null,"work_id":"2d287be0-171e-4e40-87ca-7b81684ada8e","year":2013},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:06.686131Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:906e2a9859b0a4cb4569ec9d34645cf3dfa63ae595214276abf176b2fc02902d","observation_id":"617ec4b1-5a06-4b19-a9df-1586e4fd7f43","resolution":{"observed_at":"2026-08-06T13:13:08.504057Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:08.212658Z","title":"Pyroomacoustics: A python package for audio room simulation and array processing algorithms,","venue":null,"work_id":"115f986d-461f-452f-9f4d-632cb4eaa093","year":2018},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:06.768245Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:ea9d10a1f592754979f3ce5b13963e8bb6b060c8d019c28d4d278052cbc500da","observation_id":"c1b1dc30-8fe6-4a27-96de-72c888ee12b6","resolution":{"observed_at":"2026-08-06T13:13:08.303256Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:08.028104Z","title":"Adam: A method for stochastic optimiza- tion,","venue":null,"work_id":"a8f54da5-fceb-4cfc-bf86-4a5eadefe789","year":2014},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:06.836055Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:25b06417de29746dfd1a9f703819ceba0e00b88084e27575d0e0852a4b8e8974","observation_id":"57a355b6-4190-485a-95ea-6d7b8cde84db","resolution":{"observed_at":"2026-08-06T13:13:08.113292Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:06.893421Z","title":"Performance measure- ment in blind audio source separation,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:06.893421Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:dd294dd1726f06827d3fa5d000cb25f5b94afb06a2fd68f15b52d8fd46183568","observation_id":"d9c6d166-a622-4c0f-8348-2c2865fbc7ed","resolution":{"observed_at":"2026-08-06T13:13:06.893421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:06.958589Z","title":"Perceptual evaluation of speech quality (pesq)-a new method for speech quality assessment of telephone networks and codecs,","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:06.958589Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:9a7fc457269cda99c700adb567dd0de6b8568a5bc4ff9e093b67cc69ea8373b2","observation_id":"923eb69f-499e-444e-b928-98873d4c8fcb","resolution":{"observed_at":"2026-08-06T13:13:06.958589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:07.841664Z","title":"A signal subspace tracking algorithm for microphone array processing of speech,","venue":null,"work_id":"c0054435-6439-4f46-96c1-c43a7ae40627","year":1997},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:07.033254Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:c6772cdd1a7bfa5ada3ecf717e5a0aa491f9b7d32d370580b9c175c9b153432a","observation_id":"288d1091-5204-4b32-ab7b-12aadc74c36d","resolution":{"observed_at":"2026-08-06T13:13:07.927833Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:07.684900Z","title":"Spatially selective deep non-linear filters for speaker extraction,","venue":null,"work_id":"df22170b-aef6-43f3-82f5-e5cab3d7db73","year":2023},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:07.098928Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:3bc0eaee993f998cd29aaa62b72aa508526adcfe02fca9f0763f5d61c9100fa7","observation_id":"7e87f3ff-1d58-47a0-a80b-574690b16c7b","resolution":{"observed_at":"2026-08-06T13:13:07.748603Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:07.517392Z","title":"On the importance of acoustic reflections in beamforming,","venue":null,"work_id":"3f1bc83d-e481-42f6-92c0-dc65cfbcfc0f","year":2022},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:07.182612Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:696136567264c12e69005aa82ef1cc3663652cf216f833e725a282a7cc4cfc58","observation_id":"05cd7ce8-fc79-4222-a5eb-0098d9884608","resolution":{"observed_at":"2026-08-06T13:13:07.589421Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":1,"verified_fuzzy":22},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 3 inbound Pith citation observations for arXiv:2507.20926."}