{"as_of":"2026-08-14T16:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:22206a93c039b9ea4567694a9d75d081c6a9bf1fb553b34635cd8e7c6b888bba","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:57:10.638866Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.09570/citation-record","integrity":"/paper/2507.09570/integrity","json":"/paper/2507.09570/citation-record.json","paper":"/paper/2507.09570"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1807.00129","last_updated":"2018-12-17T12:47:10Z","snapshot_observed_at":"2026-07-06T06:47:40.492339Z","submitted_at":"2018-06-30T06:05:20Z","title":"Sound Event Localization and Detection of Overlapping Sources Using Convolutional Recurrent Neural Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.00129","snapshot_observed_at":"2026-08-06T17:57:10.461560Z","title":"Sound Event Localization and Detection of Overlap- ping Sources Using Convolutional Recurrent Neural Networks,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-14T10:14:32.683573Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.461560Z"},"links":{"cited_paper":"/paper/1807.00129","citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:cf790fdcb71b419a5c7b61c5f0407d935c995b13dcb9e3c730a52e0169da35c6","observation_id":"1770cc71-7c09-4e42-b603-5b953cc812c9","resolution":{"observed_at":"2026-08-06T17:57:10.461560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:11.253302Z","title":"Context-dependent sound event detection,","venue":null,"work_id":"8c3960e0-35cc-4cb7-b9bf-8ab09c8c458e","year":2013},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-14T10:14:32.683573Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.467666Z"},"links":{"citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:9bf8191ef1b280dd8fa5dbfa34e4e784ddc8988d54a3a3e308c0a48530d261e8","observation_id":"230234ee-d22b-40bf-9021-207e134286c7","resolution":{"observed_at":"2026-08-06T17:57:11.258803Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:11.235431Z","title":"Acoustic event detection in real life recordings,","venue":null,"work_id":"eeecd99d-c451-4f48-827a-dd98c6d68a5d","year":2010},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-14T10:14:32.683573Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.472737Z"},"links":{"citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:c9a3f4b5a6a7db17f426be41b12189966d436a6e308a5ace15d319598d502618","observation_id":"28e7abcd-239b-44ca-a05b-5d1856a1c1d5","resolution":{"observed_at":"2026-08-06T17:57:11.240897Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:11.218280Z","title":"FMSG- JLESS submission for DCASE 2024 task4 on sound event detection with heterogeneous training dataset and potentially missing labels,","venue":null,"work_id":"76504adb-5a3b-4f2d-a677-2bfdc4ff2ceb","year":2024},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-14T10:14:32.683573Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.478462Z"},"links":{"citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:8c1e1db630be090ac9a6aa72ef96f946af46e923fedb54350a1cad3be6dec329","observation_id":"565e1df0-9d40-43d5-88fe-a5610797add9","resolution":{"observed_at":"2026-08-06T17:57:11.223808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:11.201292Z","title":"WildDESED: An LLM- powered dataset for wild domestic environment sound event detection system,","venue":null,"work_id":"8e46fe23-d5be-4af0-9d88-2425f3c9818a","year":2024},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-14T10:14:32.683573Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.484282Z"},"links":{"citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:f6d2d4cecedde5e4f08ce388df52ab4f7641a6b86dde594ca0619b71df29a9cc","observation_id":"4cf4f565-2e3a-4914-94e4-43572f779b4b","resolution":{"observed_at":"2026-08-06T17:57:11.206571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.03657","last_updated":"2025-01-11T11:57:08Z","snapshot_observed_at":"2026-08-12T23:29:05.911646Z","submitted_at":"2024-07-04T05:57:30Z","title":"UCIL: An Unsupervised Class Incremental Learning Approach for Sound Event Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.03657","snapshot_observed_at":"2026-08-06T17:57:10.489465Z","title":"UCIL: An Unsupervised Class Incremental Learning Approach for Sound Event Detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-14T10:14:32.683573Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.489465Z"},"links":{"cited_paper":"/paper/2407.03657","citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:253d0f2153dc8686ebfbcf84d0fda99acd0d480b9ce5a15b0f37ebecc3a41daa","observation_id":"9774cf50-7d59-4a2f-a7a9-a803cca9baad","resolution":{"observed_at":"2026-08-06T17:57:10.489465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.03654","last_updated":"2025-08-26T04:32:04Z","snapshot_observed_at":"2026-08-12T23:29:06.001309Z","submitted_at":"2024-07-04T05:50:40Z","title":"DG-SED: Domain Generalization for Sound Event Detection with Heterogeneous Training Data","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.03654","snapshot_observed_at":"2026-08-06T17:57:10.495073Z","title":"Mixstyle based domain generalization for sound event detec- tion with heterogeneous training data,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-14T10:14:32.683573Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.495073Z"},"links":{"cited_paper":"/paper/2407.03654","citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:20efed403e09bc6d9efc0097ed0bc613137bf7189d9b39b3b10307279d66bb48","observation_id":"1cdaf043-7510-454f-b971-626efe599679","resolution":{"observed_at":"2026-08-06T17:57:10.495073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:11.184917Z","title":"Multiple emitter location and signal pa- rameter estimation,","venue":null,"work_id":"a6481e00-80b6-4887-ba75-ed7e9a2738e7","year":1986},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-14T10:14:32.683573Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.500498Z"},"links":{"citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:ca34d18e24e08c60ed81f58fc4c45bff9e4b41c72ae8125d5fda9596580f6a67","observation_id":"b914c395-9fbd-4236-b93f-47becbac13ee","resolution":{"observed_at":"2026-08-06T17:57:11.190243Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.03661","last_updated":"2025-03-20T17:45:12Z","snapshot_observed_at":"2026-08-12T23:29:05.713526Z","submitted_at":"2024-07-04T06:02:52Z","title":"Where's That Voice Coming? Continual Learning for Sound Source Localization","version":3},"cited_work":{"arxiv_id":"2407.03661","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.03661","snapshot_observed_at":"2026-08-06T17:57:10.876169Z","title":"Where's That Voice Coming? Continual Learning for Sound Source Localization","venue":"eess.AS","work_id":"7742c273-3073-4259-8ea6-2b3d7874e7eb","year":2024},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-14T10:14:32.683573Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.505976Z"},"links":{"cited_paper":"/paper/2407.03661","citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:6dfaa08b2a3dc15d2e6bc7d607fdf5c2df1ae58d998d8a38ff5a9b0f5852c101","observation_id":"9c50665c-1860-4a7e-adb7-ba2ed21d43ce","resolution":{"observed_at":"2026-08-06T17:57:10.881510Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:11.167323Z","title":"An Improved Event-Independent Net- work for Polyphonic Sound Event Localization and Detection,","venue":null,"work_id":"764bc2c0-8a42-4b53-b3be-87e97d7489aa","year":2021},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-14T10:14:32.683573Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.511205Z"},"links":{"citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:a45658a95e1fe441c2006b2e5cfe7a00f41a695724a0f4e240f79f9b15d99bc7","observation_id":"98de5ad4-0c58-47ee-8c34-c5fa101b94e7","resolution":{"observed_at":"2026-08-06T17:57:11.172466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.15306","last_updated":"2021-02-15T03:48:35Z","snapshot_observed_at":"2026-08-07T22:25:14.554601Z","submitted_at":"2020-10-29T01:47:07Z","title":"ACCDOA: Activity-Coupled Cartesian Direction of Arrival Representation for Sound Event Localization and Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.15306","snapshot_observed_at":"2026-08-06T17:57:10.516419Z","title":"ACCDOA: Activity-Coupled Carte- sian Direction of Arrival Representation for Sound Event Localization and Detection,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-14T10:14:32.683573Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.516419Z"},"links":{"cited_paper":"/paper/2010.15306","citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:359eb270977658b0ed6eba4bff3105ccd7e5f88f6beba4c2fa555261d8ab9ccf","observation_id":"3fd0da71-20b8-4217-8714-e07de56b32d5","resolution":{"observed_at":"2026-08-06T17:57:10.516419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.07124","last_updated":"2022-03-28T01:07:20Z","snapshot_observed_at":"2026-08-13T17:53:29.745159Z","submitted_at":"2021-10-14T02:35:50Z","title":"Multi-ACCDOA: Localizing and Detecting Overlapping Sounds from the Same Class with Auxiliary Duplicating Permutation Invariant Training","version":2},"cited_work":{"arxiv_id":"2110.07124","doi":null,"metadata_source":"pith","pith_arxiv_id":"2110.07124","snapshot_observed_at":"2026-08-06T17:57:10.836905Z","title":"Multi-ACCDOA: Localizing and Detecting Overlapping Sounds from the Same Class with Auxiliary Duplicating Permutation Invariant Training","venue":"eess.AS","work_id":"37465ba0-8216-4822-9df6-c7c30877590b","year":2021},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-14T10:14:32.683573Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.521604Z"},"links":{"cited_paper":"/paper/2110.07124","citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:7adc661a0aec6bbf5e71d1acc93b225d766490cfd1497f393a7454bae1517c39","observation_id":"5e6cab15-a4e0-4192-ab6e-dd9ad126ddc1","resolution":{"observed_at":"2026-08-06T17:57:10.841998Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2101.02919","last_updated":"2023-03-07T07:00:29Z","snapshot_observed_at":"2026-07-06T10:30:56.646456Z","submitted_at":"2021-01-08T08:55:37Z","title":"A Four-Stage Data Augmentation Approach to ResNet-Conformer Based Acoustic Modeling for Sound Event Localization and Detection","version":2},"cited_work":{"arxiv_id":"2101.02919","doi":null,"metadata_source":"pith","pith_arxiv_id":"2101.02919","snapshot_observed_at":"2026-08-06T17:57:10.812624Z","title":"A Four-Stage Data Augmentation Approach to ResNet-Conformer Based Acoustic Modeling for Sound Event Localization and Detection","venue":"cs.SD","work_id":"4990bbe4-76a0-44f6-83ef-e05e09f8702e","year":2021},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-14T10:14:32.683573Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.526396Z"},"links":{"cited_paper":"/paper/2101.02919","citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:9f5bf939069316c524c28367a72263a9a42c15b1f321d1c42f371d8b6d6252af","observation_id":"d0cb43ad-fbde-40b5-8c05-f4c9099ef7fd","resolution":{"observed_at":"2026-08-06T17:57:10.819618Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:11.151067Z","title":"PSELDNets: Pre-trained Neural Networks on Large-scale Synthetic Datasets for Sound Event Localization and Detection,","venue":null,"work_id":"5c44c26d-c9c3-415a-8556-13423eecbef2","year":null},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-14T10:14:32.683573Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.531847Z"},"links":{"citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:58f6b5a7d4f5c5cae5151c14ef8457788aeac38ec70b9c3eab8d6c893c3fe60e","observation_id":"f279602c-e2e1-48f0-b97e-da2a7ae74752","resolution":{"observed_at":"2026-08-06T17:57:11.156215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1912.10211","last_updated":"2020-08-23T11:35:41Z","snapshot_observed_at":"2026-08-12T19:49:09.064060Z","submitted_at":"2019-12-21T06:53:14Z","title":"PANNs: Large-Scale Pretrained Audio Neural Networks for Audio Pattern Recognition","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.10211","snapshot_observed_at":"2026-08-06T17:57:10.536756Z","title":"PANNs: Large-Scale Pretrained Au- dio Neural Networks for Audio Pattern Recognition,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-14T10:14:32.683573Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.536756Z"},"links":{"cited_paper":"/paper/1912.10211","citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:4173bbf7e7ed7049539fdb05fe124309da612ae177024b8a2130b919ced30a1e","observation_id":"9082b0e0-d3da-4199-a88c-2ae0bed190bc","resolution":{"observed_at":"2026-08-06T17:57:10.536756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.05069","last_updated":"2022-03-29T12:25:02Z","snapshot_observed_at":"2026-08-13T17:55:35.684192Z","submitted_at":"2021-10-11T08:07:50Z","title":"Efficient Training of Audio Transformers with Patchout","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.05069","snapshot_observed_at":"2026-08-06T17:57:10.542254Z","title":"Efficient Training of Audio Transformers with Patchout,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-14T10:14:32.683573Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.542254Z"},"links":{"cited_paper":"/paper/2110.05069","citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:98fda96bda6d1da960055e52ddbd5f47c9886de9a725e1f7520befcc9dd771e7","observation_id":"1e94711d-41dc-4b9b-b442-dfcc01a66665","resolution":{"observed_at":"2026-08-06T17:57:10.542254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.00874","last_updated":"2022-02-02T04:49:14Z","snapshot_observed_at":"2026-08-13T16:48:43.475692Z","submitted_at":"2022-02-02T04:49:14Z","title":"HTS-AT: A Hierarchical Token-Semantic Audio Transformer for Sound Classification and Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.00874","snapshot_observed_at":"2026-08-06T17:57:10.547383Z","title":"HTS-AT: A Hierarchical Token- Semantic Audio Transformer for Sound Classification and Detection,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-14T10:14:32.683573Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.547383Z"},"links":{"cited_paper":"/paper/2202.00874","citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:3c8b29e4fe482dd48286228d07ee933893d0480a13abe465a11c55929cf832b3","observation_id":"3594eb40-aa50-4d1f-aa81-41edd030dc88","resolution":{"observed_at":"2026-08-06T17:57:10.547383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:11.133815Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces,","venue":null,"work_id":"bac40a94-1ba3-43d1-a422-39165a3de0cb","year":null},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-14T10:14:32.683573Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.552259Z"},"links":{"citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:65fc925d9a7a4093950119e83e3deecfa6e91141f5488773988fc31a7aaa5c41","observation_id":"de27121e-4299-4f4f-b4e0-3cc4f710b102","resolution":{"observed_at":"2026-08-06T17:57:11.139962Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.21060","last_updated":"2024-05-31T17:50:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-31T17:50:01Z","title":"Transformers are SSMs: Generalized Models and Efficient Algorithms Through Structured State Space Duality","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.21060","snapshot_observed_at":"2026-08-06T17:57:10.557141Z","title":"Transformers are SSMs: General- ized Models and Efficient Algorithms Through Struc- tured State Space Duality,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-14T10:14:32.683573Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.557141Z"},"links":{"cited_paper":"/paper/2405.21060","citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:3fd22b4ea86e905edcde3d8282cc3622cbd98bdc4be956eed25c870fa253a542","observation_id":"a51ef3ab-93ec-44e2-8f6c-c4daf11d01b2","resolution":{"observed_at":"2026-08-06T17:57:10.557141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02063","last_updated":"2024-09-10T14:02:58Z","snapshot_observed_at":"2026-08-13T17:37:56.375137Z","submitted_at":"2024-04-02T16:04:31Z","title":"SPMamba: State-space model is all you need in speech separation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02063","snapshot_observed_at":"2026-08-06T17:57:10.562636Z","title":"SPMamba: State- space model is all you need in speech separation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-14T10:14:32.683573Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.562636Z"},"links":{"cited_paper":"/paper/2404.02063","citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:6b3901f2e06788c35454b18861d49682519aad51830f20b4ce22fd9401ce51f9","observation_id":"3a06e65c-62bc-4206-92a4-132a3b64c22b","resolution":{"observed_at":"2026-08-06T17:57:10.562636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05034","last_updated":"2025-05-20T16:53:31Z","snapshot_observed_at":"2026-08-12T22:49:14.990945Z","submitted_at":"2024-09-08T09:20:04Z","title":"TF-Mamba: A Time-Frequency Network for Sound Source Localization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.05034","snapshot_observed_at":"2026-08-06T17:57:10.568516Z","title":"Xiao and R","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-14T10:14:32.683573Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.568516Z"},"links":{"cited_paper":"/paper/2409.05034","citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:d0d44fe2895ec6f77b8161192f1e4a33d1824a99731a04dc19c680eca57f3e19","observation_id":"f3b305f8-63fc-47a5-a603-bb8ee7d4cc41","resolution":{"observed_at":"2026-08-06T17:57:10.568516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:11.117444Z","title":"XLSR-Mamba: a dual-column bidirectional state space model for spoofing attack detection,","venue":null,"work_id":"ef188fe9-d090-4ee4-81a8-075732d53b9f","year":2025},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-14T10:14:32.683573Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.573367Z"},"links":{"citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:cffb14cedafc1cec9cd5938ad94c5ee4b72ebf7ec24894368fd031d0871c901f","observation_id":"a1f55789-8148-4f94-8cc2-e01d295050c6","resolution":{"observed_at":"2026-08-06T17:57:11.123050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:11.100497Z","title":"Mamba in Speech: Towards an Alternative to Self-Attention,","venue":null,"work_id":"bebb4c67-ee46-4c92-a982-4624803e1496","year":null},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-14T10:14:32.683573Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.578980Z"},"links":{"citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:99f415449f7b2708f9a56cee8d3b4edf9dee605bccd9dfbb8601f34245a678e1","observation_id":"b58e98fc-743b-4ddb-bdb1-a9da8ed587de","resolution":{"observed_at":"2026-08-06T17:57:11.106141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.05057","last_updated":"2024-08-09T13:26:08Z","snapshot_observed_at":"2026-08-12T23:06:00.309877Z","submitted_at":"2024-08-09T13:26:08Z","title":"SELD-Mamba: Selective State-Space Model for Sound Event Localization and Detection with Source Distance Estimation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.05057","snapshot_observed_at":"2026-08-06T17:57:10.584768Z","title":"SELD-Mamba: Selective State-Space Model for Sound Event Localization and Detection with Source Distance Estimation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-14T10:14:32.683573Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.584768Z"},"links":{"cited_paper":"/paper/2408.05057","citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:a51868584524716e9febec6ea8854a0eef9910585a4eddc04d566e34f5b197d1","observation_id":"de73558b-270c-406b-8a55-47ef9016330a","resolution":{"observed_at":"2026-08-06T17:57:10.584768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:11.084078Z","title":"Fonseca, X","venue":null,"work_id":"78460ab6-e3ab-44eb-bed6-46556c7850fc","year":2025},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-14T10:14:32.683573Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.590277Z"},"links":{"citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:97b4cfe60ca706370a94b7756997886e4a3e1fcc9a17211a5e4e8a1cca511c8b","observation_id":"0201688c-3e95-44d7-baf1-d5af7961de45","resolution":{"observed_at":"2026-08-06T17:57:11.089042Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:11.066097Z","title":"Image method for efficiently simulating small-room acoustics,","venue":null,"work_id":"e9ad3391-2002-4188-9721-e87dc62c48dd","year":1979},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-14T10:14:32.683573Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.596148Z"},"links":{"citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:1b0fb09169e6cdb426c496392d75a612db927ae6176ac92b125af0ec93edbbe5","observation_id":"94244e51-cb99-416a-96e3-ae2512ef20c2","resolution":{"observed_at":"2026-08-06T17:57:11.071710Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:10.601046Z","title":"Rafaely, Fundamentals of Spherical Array Process- ing","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-14T10:14:32.683573Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.601046Z"},"links":{"citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:c25b58958b324a141ec205f64fe47518c7d29a321296451c6bf6ff3aef645939","observation_id":"7f8a3b5a-1ad3-4132-8ecf-aa0de9f3d109","resolution":{"observed_at":"2026-08-06T17:57:10.601046Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:11.048239Z","title":"Efficiently Modeling Long Sequences with Structured State Spaces,","venue":null,"work_id":"b7be55eb-7a03-4a90-bf6d-c694f4e4f192","year":null},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-14T10:14:32.683573Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.606418Z"},"links":{"citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:37d5571f76ed84abbde111a810953afa8dea32ac68e5ff944ec255bf95ca7762","observation_id":"3d33a7fe-ea22-4a19-ac14-056f1a618ccf","resolution":{"observed_at":"2026-08-06T17:57:11.054598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:11.030284Z","title":"DCASE2025 Task3 Stereo SELD Dataset,","venue":null,"work_id":"00fd92ac-4569-41f3-9e88-cffd2e9c2511","year":2025},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-14T10:14:32.683573Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.612108Z"},"links":{"citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:c47e8e45917be51a3652c181b32209fb5156ddd5e38cbf9871fc2dae2bc1a9e0","observation_id":"4c972436-0bcc-4826-a708-9127ea7c4cc3","resolution":{"observed_at":"2026-08-06T17:57:11.035802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:11.012931Z","title":"STARSS23: Sony-TAu Realistic Spatial Soundscapes 2023,","venue":null,"work_id":"f644a12c-30d4-43f8-adbc-5fbda5924521","year":2023},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-14T10:14:32.683573Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.617511Z"},"links":{"citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:c8b60545e11c9bc5e8af1631c79060776770f5aef22ef88b20ffdf53d83a15f9","observation_id":"7b58e63d-978c-4054-8875-1675ea1f86f6","resolution":{"observed_at":"2026-08-06T17:57:11.017982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:10.996168Z","title":"A multi-level feature extraction network for sound event localization and detection in dcase 2025 task 3,","venue":null,"work_id":"b6ab9f00-90ac-486a-ac18-b518c0ae431a","year":2025},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-14T10:14:32.683573Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.622343Z"},"links":{"citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:c31bb7de72745e98f66dafb18d03afa390a2f9dcb7706566d8ec837ab582bdd9","observation_id":"c7a1a083-0366-44f7-a66d-d18d73e57883","resolution":{"observed_at":"2026-08-06T17:57:11.001398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:10.979657Z","title":"Enhancing stereo sound event localization and detection through pre- trained audio representations and hybrid architectures,","venue":null,"work_id":"bcf9bb9f-18e3-4a4e-81b1-84f573ce84d8","year":2025},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-14T10:14:32.683573Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.627308Z"},"links":{"citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:e426b72e205103cb75d5ab4b5d7c39897dc553f9997338b18ddc76646a72c8c4","observation_id":"b15b4206-b64a-4140-97a6-0e288225cda4","resolution":{"observed_at":"2026-08-06T17:57:10.985243Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:10.964058Z","title":"Resnet-conformer for stereo sound event localization and distance estimation in dcase 2025 task3,","venue":null,"work_id":"cf449975-654e-45a8-87fb-9762b569cd76","year":2025},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-14T10:14:32.683573Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.632388Z"},"links":{"citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:4cb760ad4e4ed1b730d6c77f6e5e472aa804a9353b0012c98803c950a7b70093","observation_id":"09211142-961e-45cf-8233-05ab656888bf","resolution":{"observed_at":"2026-08-06T17:57:10.969074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:10.946959Z","title":"A conformer-based ensem- ble approach for sound event localization and detection for stereo data,","venue":null,"work_id":"972821a1-636a-4286-8c69-e5beb81c213c","year":2025},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-14T10:14:32.683573Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.638866Z"},"links":{"citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:e0a14744d76884875dd20d457cc103572a13ad2db02a54206d294fd540eadf6e","observation_id":"e313b286-7d5e-47eb-a57f-180dfb0c774f","resolution":{"observed_at":"2026-08-06T17:57:10.952973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-14T10:14:32.683573Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":3,"verified_fuzzy":19},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 0 inbound Pith citation observations for arXiv:2507.09570."}